「그래픽카드 없어요」
저희 유튜브 영상에 달린 댓글입니다 · 2026.08.29
재밌는 건, 이 댓글이 달린 영상 제목이 「그래픽카드 없이 클로드 코드 무제한 돌리는 법」이었다는 겁니다. 제목에 「없이」라고 써놨는데도 이 질문이 왔어요.
안 믿기는 게 당연합니다. AI 돌리려면 그래픽카드가 있어야 한다고 몇 년째 들어왔으니까요. 4090이니 3090이니 하는 이야기만 나오고요.
저희도 없습니다
자비스스튜디오 작업 PC 사양입니다.
사무용입니다. 게임도 잘 안 돌아갑니다. 그런데 이 PC에 무료 AI를 붙여서 댓글 답변 초안이랑 릴스 대본 초안을 뽑고 있습니다.
관문은 그래픽카드가 아니라 램입니다
그래픽카드가 하는 일은 병렬 계산입니다. 같은 연산을 수천 개씩 동시에 돌리는 거죠. 없으면 CPU가 대신합니다. 느릴 뿐이지 못 하는 게 아닙니다.
진짜 관문은 따로 있습니다. 모델이 램에 통째로 올라가느냐입니다. 안 올라가면 디스크를 계속 오가면서 읽는데, 이건 느린 정도가 아니라 못 쓸 수준이 됩니다.
⚠ 파일 크기(GB)가 작다고 빠른 게 아닙니다. 저희 PC에서 15.6GB짜리 모델이 3.4GB짜리보다 빨랐습니다. 요즘 나오는 MoE 방식은 메모리엔 전부 올리고 계산은 일부만 쓰기 때문입니다. 그래픽카드가 없을수록 오히려 유리한 구조예요.
그래서 내 램 용량을 먼저 보고 모델을 고릅니다.
| 내 램 | 받을 모델 | 파일 크기 |
|---|---|---|
| 16GB 이하 | gemma4:e2b | 7.2GB |
| 24GB 이상 | gemma4:26b-a4b-it-qat⚠ 2026.09.02 정정 — 아래 참고 | 15.6GB |
⚠ 2026년 9월 2일 정정. 저희 PC에서 gemma4:26b-a4b-it-qat가 이후 로딩에 실패했습니다(Failed to load CLIP model). 원인을 특정하지 못해 저희는 이 모델을 지웠고, 지금은 gemma4:e2b 하나만 씁니다.
램이 넉넉하시면 26b를 시도해보셔도 되지만, 먼저 e2b로 시작하시길 권합니다 — 7.2GB로 가볍고 저희 측정에서 답도 맞았습니다.
붙이는 법 — 네 단계입니다
모델 받기
위 표에서 내 램에 맞는 걸 고릅니다. 터미널(명령 프롬프트)에 한 줄이면 됩니다.
# 램 16GB 이하
ollama pull gemma4:e2b
# 램 24GB 이상
ollama pull gemma4:26b-a4b-it-qat
받는 데 시간이 좀 걸립니다. 받는 동안 3단계를 보셔도 됩니다.
클로드 데스크톱에 붙이기
설정에서 토글 하나입니다. 클로드가 공식으로 지원하기 때문에 따로 설정 파일을 건드릴 게 없습니다. 화면 위치와 순서는 클로드 안에 다른 AI가 공식으로 들어왔습니다에 정리해뒀습니다.
에이전트로 쓰기 — 역할을 정해줍니다
여기가 「그냥 채팅」과 갈리는 자리입니다.
로컬 모델을 대화 상대로 쓰면 답답합니다. 느리고, 아는 것도 적고요. 그런데 역할과 형식을 못 박아서 반복 작업을 맡기면 이야기가 달라집니다. 매번 같은 틀로 초안을 뽑는 일은 로컬로 충분합니다.
저희가 실제로 시키는 두 가지입니다.
- 답변 초안 — 댓글·DM에 달 답을 먼저 뽑습니다
- 릴스 대본 초안 — 형식을 주고 5줄을 뽑습니다
대본 프롬프트 — 그대로 쓰세요
저희가 쓰는 프롬프트 전문입니다. <여기에 소재>만 바꾸면 됩니다.
너는 릴스 대본 작가다. 아래 형식으로 5줄만 써라.
형식: 번호. 첫째행 / 둘째행 [강조: 낱말]
규칙: 첫 줄이 훅이다. 마지막 줄은 '댓글에 램' 으로 끝낸다. 존댓말.
주제: <여기에 소재>
이 프롬프트를 저희 PC에서 그대로 돌린 결과입니다. i3 · 내장 그래픽 · gemma4:26b-a4b로 81.5초 걸렸습니다.
1. 그래픽카드 없어도 AI 돌리는 법? / 무료로 가능합니다
2. 사무용 PC라 안 될 것 같죠? / 그래픽카드는 사실 중요하지 않습니다
3. 핵심은 그래픽카드가 아니라 / 램(RAM) 용량입니다
4. 램만 충분하면 지금 바로 / 인공지능을 직접 쓸 수 있어요
5. 방법이 궁금하시다면? / 댓글에 램
⚠ 81.5초입니다. 빠르지 않습니다. 대신 켜놓고 다른 일 하면 됩니다. 요금이 안 나가고, 몇 번을 돌리든 한도가 없다는 게 로컬의 값입니다. 그리고 강조 표시 자리가 저희 형식과 조금 어긋났습니다 — 초안이지 완성본이 아닙니다. 사람이 손보는 걸 전제로 씁니다.
이런 실측, 남들보다 먼저 받으실 분?
직접 돌려보고 되는 것만 골라 매주 보내드립니다. 광고성 하이프는 거릅니다.
두 가지만 챙기면 됩니다
1. 추론(thinking)을 끕니다
요즘 모델은 답하기 전에 혼자 생각하는 과정을 거칩니다. 그래픽카드가 있으면 순식간이지만, 없으면 이게 전부 시간입니다. 같은 답에 7분 51초가 걸린 적이 있습니다. 껐더니 9.46초였고요.
클로드 데스크톱에서는 모델 옵션에서 끄고, API로 부를 때는 think:false를 넣습니다.
2. 모델은 골라야 합니다
같은 과제를 무료 모델 5종에 시켜봤는데 셋은 틀린 답을 줬습니다. 한국어는 멀쩡한데 내용이 틀린 경우라, 얼핏 보면 모릅니다. gemma4 계열이 나았습니다. 그 측정은 따로 정리해서 올리겠습니다.
가져가실 것
복붙해서 바로 쓰시면 됩니다.
- 내 램으로 뭘 받을지 —
gemma4:e2b(7.2GB)로 시작하세요. 26b는 저희 PC에서 이후 로딩에 실패했습니다(위 정정 참고) - 설치 명령어 —
ollama pull <모델명>한 줄 - 대본 프롬프트 전문 — 위 코드 블록 그대로
그래픽카드는 없어도 됩니다. 램만 보세요.
카드뉴스로 보기
실측 위주 AI 뉴스레터 — 직접 돌려보고 되는 것만 골라 매주 보내드립니다.
이 글의 추천도 나흘 만에 한 번 바뀌었습니다. 바뀌면 알려드립니다.