AI 바이브 코딩 도구·모델·API는 서로 다른 층이다. 에이전트(도구), 추론 공급자, 로컬 실행기, 실제 모델을 한 줄에 섞어 비교하면 가격·프라이버시·품질 판단이 어긋난다. 이 글은 2026년 7월 기준으로, 실사용 가치가 확인된 항목만 정리한다.

그림. OpenCode Go를 한 서비스로 표기한 오픈소스·저가 모델·메이저·종합 IDE 지도
1. 먼저 결론 — 무엇을 쓸까
| 우선순위 | 추천 |
|---|---|
| 품질 | Claude Opus 5 → GPT-5.6 Sol(리뷰) → Cursor(Composer 2.5) · 막히면 Fable 5 |
| 가성비 | OpenCode Go + DeepSeek V4 Flash → Luna Medium → Kimi K2.7 Code |
| 프라이버시 | Ollama 완전 로컬 + OpenCode Go 하네스/Cline → 자체 호스팅 오픈웨이트 (Fable 비권장) |
| IDE 통합 | Cursor → GitHub Copilot → Cline/Roo Code |
한 줄로 말하면, 주력 구현은 Claude Opus 5, 리뷰·디버깅은 GPT-5.6 Sol, 막힌 대형 설계는 Fable 5, 비용 절감은 OpenCode Go + DeepSeek V4 Flash·Luna, 민감 작업은 Ollama 로컬, Gemini는 멀티모달 보조로만 두는 구성이 현실적이다.

그림. Opus 5·Sol·OpenCode Go·Ollama 축 추천
JetBrains가 1만 명 이상 전문 개발자를 조사한 결과(2026년 1월 기준), 업무에서 AI 도구를 정기적으로 쓰는 비율은 약 90%였다. 전문 AI 개발 도구 사용은 약 74%, 그중 GitHub Copilot 29%, Cursor 18%, Claude Code 18% 수준으로 집계됐다. Claude Code는 전 세계 업무 사용률 약 18%, 미국·캐나다 약 24%, 만족도 약 91%, NPS 약 54로도 보고됐다. Codex 수치는 데스크톱 앱 공개 전 조사라는 점을 감안해야 한다.
2. 오픈소스·오픈웨이트 진영
2.1. OpenCode Go
OpenCode Go는 하나의 서비스다. 무료 오픈소스 코딩 에이전트(하네스)와, 그 위에서 여러 오픈·상용 모델을 월 정액으로 돌리는 유료 추론 구독이 한 제품군으로 묶여 있다. 터미널·데스크톱, Build/Plan, 서브에이전트, MCP, Ollama·OpenAI/Anthropic 호환·BYOK를 지원하며 특정 모델 회사에 종속되지 않는 것이 핵심이다.
| 항목 | 내용 |
|---|---|
| 가격 | 첫 달 $5, 이후 $10/월 |
| 한도 예 | 5시간 한도 비용 기준 약 $12 · 주간 약 $30 · 월간 최대 약 $60 상당(고가 모델은 포함액이 더 낮음) |
| 지원 예 | Grok 4.5, GLM-5.2/5.1, Kimi K3/K2.7 Code/K2.6, DeepSeek V4 Pro/Flash, Qwen3.7 Max/Plus, Hy3 등 |
| ZDR | 공급자 Zero Retention·비학습·미·EU·싱가포르 호스팅을 서비스 약속으로 제시. 기업 기밀은 DPA·하위 처리업체·예외를 별도 확인 |
공식 사용량 표 기준 추정으로 DeepSeek V4 Flash는 일반 작업 패턴에서 월간 약 15만 회 전후 요청, Kimi K3는 약 수백 회 수준으로 잡힌다. 요청당 토큰이 달라 절대 보장 수치는 아니다. 개인 개발자·오픈 모델을 싸게 돌리고 싶을 때 매우 추천, 민감 코드는 ZDR 문구만 믿지 말 것. 주력은 V4 Flash, 에스컬레이션은 Kimi K2.7 Code·GLM-5.2·Kimi K3.
에이전트 자체는 무료로 쓸 수 있고 성능은 붙인 모델·공급자에 좌우된다. tool calling 호환성 차이·자동 승인 실수에 주의한다.
2.2. Neuralwatt
코딩 에이전트가 아니라 GPU 에너지(kWh) 기반 추론 API다. NVIDIA NVML 에너지 카운터로 측정하고, 동시 요청은 토큰 점유율로 에너지를 나눈다. 효율 좋은 MoE에서 가격이 내려갈 수 있고 탄소·에너지 추적이 된다. OpenAI 호환 API로 연결 가능하다.
가격 페이지에는 에너지 기반 약 $10/kWh부터, 월 $20 플랜에 약 2.35kWh 포함 등이 보이는데, 방법론 문서에는 PAYG·구독 단가 예시가 다르게 남아 있어 가입 시점 대시보드 단가를 다시 확인해야 한다. 공개 정책상 프롬프트/응답 영구 저장은 안 한다고 해도 휘발성 문맥(최대 약 24시간)·익명 시맨틱 캐시·요청·토큰·에너지 메타데이터는 남을 수 있어, 비학습 ≠ 완전 ZDR이다. 레딧·실사용에서는 저가 사례와 함께 속도 복불복 불만이 반복된다. 주력보다 대량·비긴급 보조 공급자로 두는 편이 맞다.
2.3. Ollama
모델이 아니라 로컬 LLM 실행기다. 로컬 모델 사용 시 Ollama는 프롬프트·응답을 보지 않는다고 FAQ에 명시한다. Cloud 기능을 쓰면 요청은 처리하되 저장·학습에는 쓰지 않는다고 안내하며, 완전 로컬이 필요하면 cloud를 끄면 된다.
로컬 코딩 후보로는 Qwen3-Coder-Next, DeepSeek V4 Flash 양자화, GLM·Kimi K2.7 Code 양자화, Devstral·소형 Qwen Coder 등이 거론된다. Qwen3-Coder-Next는 Ollama 라이브러리에도 등록되어 있고, 통합 메모리 약 60GB 미만 환경에서 “쓸 만한 로컬 코딩” 후보로 자주 언급된다. 대형 모델은 RAM/VRAM·전기료·양자화 품질 트레이드오프가 크다. OLLAMA_HOST로 외부 노출 시 인증·방화벽이 필요하다.
3. 중국계 모델
명칭 정리: Kimi 3.0 → Kimi K3, Kimi 2.7 → Kimi K2.7 Code, Qwen 3.8 → Qwen3.8-Max-Preview.

그림. DeepSeek·Kimi·GLM·Qwen 용도 구분
| 용도 | 추천 |
|---|---|
| 초저가·대량 호출 | DeepSeek V4 Flash |
| 코딩 가성비 | Kimi K2.7 Code |
| 대형 코드베이스·장기 작업 | GLM-5.2 |
| 최고급 일반 에이전트 | Kimi K3 |
| 최신 Qwen 시험 | Qwen3.8-Max-Preview |
| 로컬 코딩 | Qwen3-Coder-Next |
3.1. DeepSeek V4 Flash
1M 컨텍스트, thinking/non-thinking, 최대 약 384K 출력, tool calling·JSON·FIM, OpenAI/Anthropic 호환 API. 공식 API 가격 예(1M 토큰): 캐시 입력 약 $0.0028, 캐시 미스 입력 약 $0.14, 출력 약 $0.28 — 목록 중 가장 공격적이다. 에이전트가 코드베이스를 반복 읽어 캐시 적중률이 올라갈수록 비용이 더 내려간다. 가중치 공개(MIT)로 안내된다. 반복 수정·테스트·리팩터 초안·탐색의 기본 모델 1순위. 애매한 설계·위험한 수정은 상위 모델로 올린다. 공식 API와 OpenCode Go 등 제3자 경로의 체감 품질이 다를 수 있다.
3.2. Kimi K2.7 Code
코딩 특화(256K, 멀티스텝 tool calling, 이미지·비디오 이해, thinking 상시). API 가격 예(1M): 캐시 입력 약 $0.19, 입력 약 $0.95, 출력 약 $4.00. 오픈웨이트(Modified MIT)로 안내되며, 표준 MIT와 수정 조항이 다를 수 있어 라이선스를 확인한다. K3보다 저렴해 순수 코딩·OpenCode Go 에스컬레이션에 적합하다.
3.3. Kimi K3
Moonshot 플래그십. 일반 에이전트·코딩·멀티에이전트·장기 작업. API 가격 예(1M): 캐시 입력 약 $0.30, 입력 약 $3.00, 출력 약 $15.00. 2026-07 조사 기준 공식 오픈웨이트는 확인되지 않아 API/서비스 중심으로 보는 편이 안전하다. 품질 평가는 좋지만 구독·한도 소진 불만이 잦아 고난도 에스컬레이션용이 맞다.
3.4. GLM-5.2
코딩 에이전트·실사용 1M 컨텍스트·장기 작업·요구사항→배포 가능 결과 지향. API 가격 예(1M): 입력 약 $1.40, 캐시 입력 약 $0.26, 출력 약 $4.40. 오픈웨이트(MIT). DeepSeek보다 비싸지만 복잡한 마이그레이션·설계 변경 후보. 공식 API·Z.AI Coding Plan·OpenCode Go·Neuralwatt마다 체감이 갈린다.
3.5. Qwen3.8-Max-Preview
정식 명칭이 Preview다. thinking 상시, reasoning effort(xhigh/high/low), Alibaba Model Studio·Qwen Code에서 선택 가능. 오픈웨이트 배포는 확인되지 않았다(기존 Qwen3·Qwen3-Coder 다수와 일반화 금지). 프론트·UI 시험용으로 두고, 안정성 우선이면 Qwen3.7 Max/Plus, 로컬은 Qwen3-Coder-Next가 낫다.
4. Claude·GPT 최신 모델 (2026-07 레딧 실사용)
기준일 2026-07-26. 아래는 공식 모델이며, Claude Code·Codex 안에서 실제로 고르는 상위 모델이다.
| 모델 | API 입력/출력(1M) | 컨텍스트 | 포지션 |
|---|---|---|---|
| Claude Opus 4.8 | $5 / $25 | 1M | 안정적 구형 Opus·폴백 |
| Claude Fable 5 | $10 / $50 | 1M | Mythos급 최상위 장기 자율 |
| Claude Opus 5 | $5 / $25 | 1M | 최신 일상 주력 Opus |
| GPT-5.6 Sol | $5 / $30 | 1.05M | GPT-5.6 플래그십 |
| GPT-5.6 Terra | $2.50 / $15 | 1.05M | 균형형(레딧에선 ‘끼인 모델’ 평가 다수) |
| GPT-5.6 Luna | $1 / $6 | 1.05M | 고속·저가 반복 작업 |
Fable 5는 Opus보다 위 Mythos급, Opus 5는 Fable급에 가깝게 절반 가격으로 일상 쓰게 만든 최신 주력이다. Sol/Terra/Luna는 GPT-5.6의 성능·가격 등급이다. 일반 ChatGPT 채팅은 주로 Sol, ChatGPT Work·Codex·API에서는 Sol/Terra/Luna를 고를 수 있다. GPT-5.6은 캐시 읽기 약 90% 할인. Sol 입력이 272K를 넘으면 해당 요청의 입력 2배·출력 1.5배가 된다.
4.1. Claude Opus 4.8
Opus 4.7 대비 판단·정직성·도구 사용이 개선됐고, 작성 코드 결함을 놓치는 비율이 약 4배 낮다는 발표가 있다. 레딧에서는 리뷰·버그 탐지·계획-구현 일관성에서 안정적이라는 평가가 많다. 다만 동일 가격의 Opus 5가 나온 뒤에는 기본 선택보다 폴백에 가깝다. 평가 B+.
4.2. Claude Fable 5
장기 자율·대형 마이그레이션·수백만 토큰 작업·멀티에이전트에 강하다. 레딧에서는 “차분한 시니어”·의도 이해·집요한 대형 작업·작은 diff 칭찬이 반복된다. 반면 Max 20x도 빨리 소진되고, 보안·바이오 등 안전 필터 오탐으로 Opus 4.8로 폴백되는 불만이 많다. Mythos급이라 트래픽 30일 보존이 의무이며 Fable에는 ZDR을 걸 수 없다. 품질 A+ / 비용·프라이버시 C — 모든 작업 기본이 아니라 막힌 설계·대형 migration에만 투입.
4.3. Claude Opus 5
2026-07-24 출시. Fable에 가까운 성능을 Opus 4.8과 같은 $5/$25에 제공하고, Fable보다 안전 필터 개입이 약 85% 적으며 일반 사용에 30일 강제 보존이 없다. Claude Max 새 기본·Pro에서 쓸 수 있는 최강 쪽에 가깝다. 레딧은 “Fable급 가성비”와 “Fable보다 성급·위험”으로 갈린다. A / 신뢰도 낮음~중간. 안전 운영: Opus 5에 계획만 → 검토 후 구현 → diff·테스트 → 대형 작업은 Fable 교차검증 → 리뷰는 GPT-5.6 Sol.
4.4. GPT-5.6 Sol / Terra / Luna
Sol은 리뷰·보안·모순 탐지·브라우저 검증에 강하고, 구현보다 리뷰어·QA로 만족도가 높다. 느림·과설계·Ultra 사용량 폭주가 단점. A+ 리뷰·디버깅 / A- 구현. Terra는 공식상 균형형이나 레딧에서는 Luna와 Sol 사이에 끼여 쓸 이유가 약하다는 B. Luna는 Medium이 실사용 균형, 단순 수정·테스트·대량 호출에 A- 가성비 / B 지능 — 아키텍처·DB migration은 맡기지 않는다.
4.5. Claude vs GPT 한 줄 라우팅
| 목적 | 1순위 |
|---|---|
| 설계·대형 구현·의도 이해 | Fable 5 → Opus 5 |
| 일상 Claude Code 주력 | Opus 5 (폴백 Opus 4.8) |
| 코드 리뷰·보안·디버깅 | GPT-5.6 Sol High |
| 저가 반복 | GPT-5.6 Luna Medium · DeepSeek V4 Flash |
| 구독 한도상 중간 | Terra (필요할 때만) |
품질 최우선 조합 예: Fable(계획) → Opus 5(구현) → Sol High(리뷰) → Luna(테스트·문서).
5. 메이저 에이전트
5.1. OpenAI Codex
ChatGPT에 포함된 코딩 에이전트 제품군이다. IDE 확장, CLI, 클라우드·병렬 에이전트, 코드 리뷰, worktree 분리 작업을 지원한다. Plus는 대체로 $20/월, Pro는 사용량 단계별 약 $100/$200대, Business는 좌석당 플랜이며 한도 초과 시 추가 크레딧이 붙을 수 있다. OpenAI는 개발자당 Codex 사용량이 월 약 $100~$200까지 갈 수 있다고 안내하지만 편차가 크다. Business/Enterprise·API는 기본 비학습, 개인은 설정에서 학습 옵트아웃을 확인한다. Codex 안에서는 GPT-5.6 Sol/Terra/Luna와 effort(max/ultra 등)를 고른다.
강점: 병렬 이슈, 코드 리뷰, 테스트 기반 리팩터, 장기 클라우드 위임. 약점: 모델 자유도가 OpenCode Go보다 낮고, 긴 세션의 context 압축 이후 연속성 깨짐이 반복 보고된다.
5.2. Claude Code
터미널에서 시작해 VS Code/Cursor 확장, JetBrains, 데스크톱·웹·클라우드, GitHub/GitLab CI, Slack, Chrome, Agent SDK까지 넓어졌다. Pro는 연간 환산 약 $17/월·월 결제 $20, Max 5x $100/월, Max 20x $200/월, Team/Enterprise 별도. 소비자 Free/Pro/Max는 학습 옵트아웃, Team은 기본 비학습, 엄격 ZDR은 승인된 API·Enterprise 등에 제한 — Pro/Max 결제만으로 ZDR이 되지 않는다. 2026년 7월 기준 일상 주력 후보는 Opus 5, 막힌 대형 작업은 Fable 5, 회귀·필터 폴백은 Opus 4.8.
강점: 코드베이스 이해, 애매한 요구사항, 긴 작업 일관성, CLAUDE.md·Skills·MCP. JetBrains 조사에서 Claude Code 업무 사용·만족도가 높게 잡힌 축이다. 약점: Max 비용·사용량 소모, Fable의 30일 보존·필터, Opus 5 출시 초기 평가 분산.
레딧·실사용 분위기를 합치면 대화형·협업형 1순위는 Claude Code(Opus 5/Fable), 리뷰·디버깅·독립 작업은 Codex(Sol)로 갈리는 경우가 많다.
5.3. GitHub Copilot
가장 널리 보급된 AI 개발 도구다. VS Code·Visual Studio·JetBrains·Xcode·CLI·PR·Cloud Agent·MCP·조직 정책을 묶는다. Free / Pro($10) / Pro+($39) / Max($100), 추가 사용은 GitHub AI Credits. Business/Enterprise는 비학습, 개인 플랜은 학습 사용 가능·옵트아웃 확인. 에이전트 최강이 아니라 기업·IDE 표준화에 강하다.
6. 종합 IDE: Cursor
Hobby 무료, Individual Pro $20/월부터, Teams $40/사용자/월부터, Enterprise 별도. Privacy Mode는 사용자 데이터 비학습·공급자 보호를 강조하지만 비학습 ≠ 무조건 ZDR이다.
6.1. Composer 2.5
Cursor가 학습한 코딩 특화 모델(Kimi K2.5 오픈 체크포인트 기반 안내). API 가격 예(1M): 기본 입력 $0.50·출력 $2.50, Fast 입력 $3·출력 $15. 빠르고 저렴해 일상 구현·UI·반복 수정의 기본 후보. 아키텍처·DB 마이그레이션·대형 리팩터를 단독으로 맡기면 국소 수정·회귀 위험이 있다.
6.2. Cursor Grok 4.5
코딩뿐 아니라 데이터·복합 문제까지 범용. API 가격 예(1M): 기본 입력 $2·출력 $6, Fast 입력 $4·출력 $18. Composer보다 비싸고 체감 편차가 크다. CursorBench에 과거 Cursor 코드가 포함된 문제를 회사가 인정한 바 있어, 공개 벤치만으로 절대 우위를 단정하면 안 된다. 복합·장기 시험용, Claude/Codex를 밀어낼 확정 1순위는 아니다.
7. Gemini — 멀티모달 보조로만
이미지·스크린샷·문서·대형 컨텍스트 읽기·UI·로그 보조에는 쓸 만하다. 운영 DB 직접 쓰기, migration 자동 실행, 스키마 변경 자동 승인, 테스트 없는 대규모 리팩터, 프로덕션 배포 자동 승인은 피한다. 기업용 Gemini Code Assist는 Gemini 3·1M 컨텍스트·IDE/CLI·기업 데이터 비학습, Standard 월 약 $22.80·Enterprise 월 약 $54 등으로 안내된다. 개인용 Gemini Code Assist IDE 서비스는 2026년 6월 18일부터 제공 방식이 변경·중단된 흐름이 있어, 현재는 Gemini CLI/API와 기업용 플랜을 구분해야 한다. 주력 코딩 실행자로는 두지 않는 구성이 맞다.
8. IDE·오픈소스 에이전트 추가분
8.1. Cline
VS Code·JetBrains·CLI, Plan/Act, 명령·수정 승인, MCP, OpenRouter·Ollama·임의 OpenAI 호환 API. Apache 2.0. IDE 안에서 모델 자유도와 diff·비용 확인이 강점. API 직접 결제라 Sonnet/Opus를 붙이면 비용이 폭주할 수 있어, OpenCode Go·DeepSeek V4 Flash와 묶는 편이 안전하다.
8.2. Roo Code
Cline 계열 파워유저용. 역할·모드·자동화가 세밀하다. 둘 다 쓰기보다 Cline 또는 Roo 중 하나만 주력으로 고르는 게 낫다.
8.3. Qwen Code
Apache 2.0 CLI. Qwen뿐 아니라 OpenAI 호환 모델, MCP·Skills·서브에이전트. Qwen·Alibaba 생태계에 적합하고, 범용 라우터로는 OpenCode가 더 넓다.
9. 레딧·실사용 분위기 (정성)
제품 서브레딧은 긍정 편향, r/programming은 AI 도구에 부정 편향, 중국 모델은 출시 직후 홍보성 글을 걸러야 한다. 통계적 감성분석이 아니라 반복 경험 요약이다.
| 등급 | 제품 | 한 줄 |
|---|---|---|
| A+ | Claude Code, Codex | 품질 1군 |
| A | Cursor, OpenCode, DeepSeek V4 Flash | UX·가성비·오픈 하네스 |
| A- | Copilot, Ollama, Composer 2.5 | 표준·로컬·일상 구현 |
| B+ | OpenCode Go, Kimi K2.7, GLM-5.2, Cline, Grok 4.5, Opus 4.8 | 조건 붙음 |
| B~B- | Neuralwatt, Qwen3.8 Preview, GPT-5.6 Terra | 속도·Preview·끼인 모델 |
| C+~C | Gemini(코딩 실행), Fable(비용·보존·필터) | 보조·특수 투입 |
10. 최종 분류표
| 분류 | 도구/모델 | 핵심 용도 | 추천도 |
|---|---|---|---|
| 오픈소스 서비스 | OpenCode Go | 에이전트+저가 모델 구독 | ★★★★★ |
| 에너지 기반 API | Neuralwatt | 대량·효율 추론 | ★★★ |
| 로컬 실행 | Ollama | 보안·로컬 모델 | ★★★★ |
| 저가 모델 | DeepSeek V4 Flash | 대량 코딩 호출 | ★★★★★ |
| 코딩 모델 | Kimi K2.7 Code | 장기 에이전트 코딩 | ★★★★☆ |
| 장문 모델 | GLM-5.2 | 대형 코드베이스 | ★★★★☆ |
| 상위 범용 | Kimi K3 | 어려운 장기 작업 | ★★★★ |
| Preview | Qwen3.8-Max-Preview | 최신 Qwen 테스트 | ★★★☆ |
| 메이저 | Claude Code | Opus 5·Fable 5 | ★★★★★ |
| 메이저 | Codex | Sol/Terra/Luna | ★★★★★ |
| Claude 주력 | Opus 5 | 일상 구현 | ★★★★★ |
| Claude 최상위 | Fable 5 | 설계·대형 migration | ★★★★☆ |
| GPT 플래그십 | GPT-5.6 Sol | 리뷰·디버깅 | ★★★★★ |
| GPT 저가 | GPT-5.6 Luna | 반복·테스트 | ★★★★☆ |
| GPT 균형 | GPT-5.6 Terra | 한도 구조 맞을 때 | ★★★ |
| 종합 IDE | Cursor | IDE 통합 에이전트 | ★★★★★ |
| Cursor 기본 | Composer 2.5 | 가성비 코딩 | ★★★★★ |
| Cursor 상위 | Grok 4.5 | 복합·장기 작업 | ★★★★☆ |
| 기업 표준 | GitHub Copilot | IDE/GitHub/조직 | ★★★★★ |
| 오픈 IDE | Cline | BYOK·승인 흐름 | ★★★★☆ |
| 파워유저 | Roo Code | 커스텀 모드 | ★★★★ |
| Qwen CLI | Qwen Code | Qwen·Alibaba | ★★★★ |
| 멀티모달 보조 | Gemini | 이미지·문서 분석 | ★★★ |
11. 추천 운영 조합
조합 A — 가성비: OpenCode Go + DeepSeek V4 Flash → 중간 Kimi K2.7 Code → 고난도 GLM-5.2/Kimi K3, 민감은 Ollama.
조합 B — 품질: Claude Opus 5(구현) + Fable 5(막힌 설계) + Codex Sol High(리뷰) + Cursor Composer 2.5, 반복은 OpenCode Go + V4 Flash 또는 Luna.
조합 C — 팀: Copilot Business/Enterprise + Claude Code Enterprise, 저비용 자동화는 승인된 API의 OpenCode Go, 모든 AI 변경은 PR·CI·코드 오너 승인.
조합 D — 기밀: OpenCode Go 하네스/Cline + Ollama(또는 자체 vLLM) + Qwen3-Coder-Next, cloud 끔, Fable(30일 보존) 금지, DB·배포 자동 승인 금지.
12. 작업별 모델 라우팅

그림. Opus 5·Fable 5·Sol·DeepSeek·Gemini 작업별 라우팅
| 작업 | 1차 | 실패 시 |
|---|---|---|
| 간단한 수정·테스트 | DeepSeek V4 Flash / Luna Medium | Composer 2.5 |
| UI·프론트 | Composer 2.5 | Qwen3.8 Preview |
| 대형 리팩터 | Claude Opus 5 | GLM-5.2 · Fable 5 |
| 어려운 논리 버그·리뷰 | GPT-5.6 Sol High | Claude Opus 5 |
| 고난도 설계·마이그레이션 | Claude Fable 5 | Opus 5 교차검증 |
| 긴 오픈모델 작업 | GLM-5.2 | Kimi K2.7 Code |
| 완전 로컬 | Qwen3-Coder-Next | 더 큰 로컬 모델 |
| 이미지·문서 | Gemini | (코드·DB 쓰기 금지) |
| DB migration | Opus 5/Fable로 계획 | 사람 승인 후 실행 |
13. 상황별 선택
| 상황 | 선택 |
|---|---|
| 회사 GitHub 표준 | Copilot + (필요 시) Claude Code |
| 혼자 가성비 | OpenCode Go + V4 Flash |
| IDE에서 바로 | Cursor + Composer 2.5 |
| 코드베이스 대화형 개조 | Claude Code · Opus 5 |
| PR·리뷰·병렬 | Codex · Sol High |
| 막힌 대형 설계 | Fable 5 (30일 보존·필터 주의) |
| 노트북 밖 유출 금지 | Ollama + 오픈웨이트 |
| 스크린샷·PDF만 | Gemini (쓰기 권한 없음) |
14. 참고 링크
- OpenCode Go 문서
- OpenCode GitHub
- Neuralwatt 가격 · 개인정보
- Ollama · FAQ
- DeepSeek 가격
- Kimi K2.7 Code · Moonshot 플랫폼
- GLM-5.2 · Z.AI 가격
- OpenAI Codex · Enterprise Privacy
- Claude Opus 5 · Fable 5 · Opus 4.8
- GPT-5.6 · Sol · Terra · Luna
- Claude Code · Claude 가격 · ZDR 적용 범위
- Cursor 가격 · 보안 · Composer 2.5 · Grok 4.5
- GitHub Copilot 플랜
- Cline · Roo Code
- Qwen Code
- Gemini Code Assist Business
- JetBrains AI 도구 업무 사용 조사(2026-04)
15. 마무리
앞에서 다룬 AI 바이브 코딩 도구·모델의 핵심만 짧게 정리한다.
- 도구(에이전트)·API 공급자·로컬 실행기·모델을 같은 줄에 두지 않는다. OpenCode Go는 하나의 서비스로 본다
- 품질 축은 Claude Opus 5·Fable 5·GPT-5.6 Sol, 가성비 축은 OpenCode Go + DeepSeek V4 Flash·Luna
- Kimi K2.7 Code·GLM-5.2는 오픈 모델 고난도, Kimi K3는 한도·가격을 보고 에스컬레이션
- Privacy Mode·비학습 문구를 완전 ZDR로 착각하지 않는다. Fable 5는 30일 보존·ZDR 불가
- Gemini는 멀티모달 보조, DB·배포 자동 실행은 사람 승인
- 가격·한도·서빙 품질은 공급자·시점에 따라 바뀌므로 대시보드·공식 문서를 다시 확인한다
「주력은 Opus 5·Sol, 막히면 Fable, 비용은 OpenCode Go+V4 Flash·Luna, 민감은 로컬, Gemini는 읽기만」 — 플랜과 모델 이름은 분기마다 바뀌니, 이 글의 표는 2026년 7월 스냅샷으로 보고 최신 요금·정책을 공식 페이지에서 맞춰 쓰면 된다.
자주 묻는 질문
- OpenCode와 OpenCode Go를 따로 봐야 하나?
실사용에서는 OpenCode Go를 하나의 서비스로 보면 된다. 무료 에이전트 하네스와 월 정액 모델 구독이 같은 제품군으로 묶여 있고, 모델만 DeepSeek·Kimi·GLM 등으로 갈아 끼운다. 인포에서도 OpenCode Go를 한 항목으로 표기한다.
- 2026년 7월 Claude Code 기본 모델은?
일상 주력은 Claude Opus 5($5/$25)다. 막힌 대형 설계·마이그레이션만 Claude Fable 5($10/$50)로 올리고, Opus 5가 이상하거나 Fable 안전 필터가 발동하면 Opus 4.8을 폴백으로 둔다. Fable은 30일 보존이 강제되고 ZDR을 걸 수 없다.
- GPT-5.6 Sol·Terra·Luna는 어떻게 나누나?
Sol은 리뷰·보안·디버깅 1순위, Luna Medium은 저가 반복·테스트, Terra는 공식상 균형형이나 레딧에서는 끼인 모델 평가가 많다. 일반 ChatGPT 채팅은 주로 Sol이고, Work·Codex·API에서 Terra/Luna를 고른다.
- Fable 5를 매일 기본으로 써도 되나?
품질은 최상위지만 비용·사용량 소모가 크고, Mythos급이라 30일 데이터 보존이 의무이며 보안·바이오 관련 오탐 폴백이 잦다. 계획·아키텍처·두 번 이상 실패한 작업에만 넣는 편이 안전하다.
- DeepSeek V4 Flash와 Luna 중 무엇을 먼저?
OpenCode Go 경로의 초저가 대량 호출은 DeepSeek V4 Flash, Codex·OpenAI 생태계 안의 저가 반복은 GPT-5.6 Luna Medium이 자연스럽다. 둘 다 아키텍처·DB migration 단독 실행에는 부적합하다.
- Cursor Privacy Mode나 Claude Pro가 ZDR인가?
아니다. 비학습·옵트아웃과 완전 Zero Data Retention은 다르다. 특히 Fable 5는 ZDR 적용이 불가하고 30일 보존이 따른다. 기밀 코드는 Ollama 로컬이나 계약형 통제를 본다.
- Gemini는 코딩에 써도 되나?
이미지·문서·대형 컨텍스트 읽기와 계획 보조에는 쓸 만하다. 운영 DB 쓰기나 테스트 없는 대규모 리팩터의 최종 실행자로는 두지 않는 구성이 맞다.
- 품질 최우선 운영 조합은?
Fable 5로 요구사항·아키텍처 계획, Opus 5로 구현, GPT-5.6 Sol High로 리뷰·보안, Luna나 DeepSeek로 테스트·반복 수정이 2026년 7월 기준 가장 현실적인 품질 조합이다.
바이브 코딩