기사

가격 분석

Gemini Omni Flash 영상 생성 — '초당 $0.10'이라는 새 과금 감각 (2026년 8월)Gemini가 대화형 영상 생성·편집 모델 Omni Flash를 정식 출시(GA)했다. 그런데 이건 우리가 늘 보던 '1M 토큰당'이 아니라 '초당'으로 과금된다 — 720p 기준 초당 약 $0.10. 토큰 감각으로 예산을 짜면 자릿수가 어긋난다. 공식 단가로 길이별 비용을 환산했다.'토큰 비용 제로' 로컬 AI 에이전트, 진짜 공짜일까 — 클라우드와 손익분기 계산 (2026년 8월)Perplexity·Nvidia가 '토큰 비용 제로' 완전 로컬 에이전트를 예고하고, 라즈베리파이에 Qwen을 올린 사례가 확산 중이다. 그런데 '제로'는 토큰 과금이 없다는 뜻일 뿐 — 전기·하드웨어라는 다른 통화로 청구된다. 본지 검증 API 단가로 '로컬이 언제 이득인지' 손익분기를 계산했다.Gemini 3.5 Transcribe — 1시간 녹음 전사에 30센트 (2026년 8월)Gemini가 음성 전사 모델 3.5 Transcribe와 실시간용 Transcribe Live를 정식 출시(GA)했다. 과금은 '분당'이고, 일반 전사는 분당 약 $0.005 — 1시간 녹음을 텍스트로 바꾸는 데 30센트다. 사실상 아껴 쓸 이유가 없는 단가를 공식 요금으로 정리했다.공짜 코딩 모델 'ox alpha', 진짜 청구서는 토큰이 아니라 당신 코드다 (2026년 8월)OpenRouter에 익명으로 등장한 무료 프런티어 코딩 모델 ox alpha가 개발자들을 끌어모으고 있다. 입력·출력이 0원이라 '얼마?'라는 본지 질문이 무의미해 보이지만, 실제 비용은 세 곳에 숨어 있다 — 1주 뒤 유료 전환, 익명 운영자의 프롬프트 보관, 그리고 정체다. 지문분석은 Z.ai GLM-5.3을 가리킨다.Grok Bot을 쓰려면 뭘 결제해야 하나 — 가장 싼 진입로는 $300이 아니다 (2026년 8월)xAI가 '항상 켜져 있는 AI 에이전트' Grok Bot을 베타로 냈다. 그런데 이걸 쓰려면 세 가지 구독 중 하나가 필요하고, 개인이 노리는 최저 진입로는 흔히 아는 SuperGrok Heavy($300)가 아니라 Cursor Ultra($200)다. 왜 그런지, 한국에선 얼마인지 정리했다.AI 에이전트에게 한 달을 맡기면 청구서는 얼마? — 2,000억 토큰 실험으로 본 '모델 선택 = 비용' (2026년 8월)한 개발자가 AI 에이전트에게 한 달간 콜오브듀티 MW2 디컴파일을 맡겨 약 2,000억 토큰을 태웠다. 저자는 비용을 공개하지 않았다 — 그래서 본지 검증 단가로 계산했다. 같은 워크로드라도 모델을 잘못 고르면 청구서가 최대 29배 벌어진다.코딩 AI, 뭘 결제할까 — Cursor·Claude·GLM 가격과 선택 기준 (2026년 8월)코딩 에이전트 경쟁이 뜨겁다 — Cursor가 자율 에이전트로 영역을 넓힌다는 보도까지 나왔다. 선택지가 늘면 질문은 하나로 모인다: 나는 뭘 결제해야 하나. 월 실비용과 용도별 기준으로 정리했다.Gemini 3.7 Flash 출시 — 3.6의 절반값 도입가, 대신 2027년엔 2배구글이 3.6 Flash 23일 만에 3.7 Flash를 냈다. 도입가는 입력 $0.75·출력 $3.75로 직전 세대의 절반. 단 이 가격은 2026년 말까지고, 2027년 1월 1일부터 $1.50/$7.50로 두 배가 된다 — 예고된 채로.DeepSeek, 8월 16일부터 시간대별 요금 — '오프피크'마저 오른다싸기로 유명했던 DeepSeek이 피크/오프피크 요금제를 도입한다. 8월 16일 발효. 문제는 가장 싼 오프피크 시간대 요금조차 지금 플랫가보다 높다는 것 — 시간대별 요금의 외피를 쓴 실질 인상이다.OpenAI, 보안 전용 GPT-5.6 Cyber 출시 — 출력 $75짜리 '승인제' 프리미엄 모델GPT-5.6 계열에 보안 특화 모델 Cyber가 추가됐다. 입력 $12.50·출력 $75로 플래그십 Sol($5/$30)보다 2.5배 비싸고, 아무나 못 쓴다 — 승인된 방어자만. 동시에 gpt-5.4·5.5 세대는 요금 페이지에서 사라졌다.AI API 예산, 한국어로 쓰면 견적이 어긋난다 — 토큰세까지 넣은 실전 계산법 (2026년 8월)단가표 × 토큰 수로 API 예산을 잡으면 한국어 서비스에선 항상 빗나간다. 같은 워크로드를 한국어로 돌릴 때 실제로 얼마인지, 명목 단가가 같은 모델끼리도 순위가 뒤집히는 이유를 실데이터로 계산했다.한국에서 AI 구독료, 매달 진짜 얼마 내나 — 표시가·부가세·환율의 함정 총정리 (2026년 8월)ChatGPT·Claude·Grok·Perplexity·Kimi를 한국에서 쓰면 표시가와 실제 청구액이 다르다. App Store 원화가는 부가세가 이미 들어있고, 달러 표시 서비스는 환율과 결제경로가 값을 흔든다. 각 티어의 '실제 매달 나가는 원화'를 한자리에 정리했다.Grok, $30과 $300 사이에 $100 티어 신설 — SuperGrok PlusxAI가 SuperGrok Plus를 새로 냈다. 월 $100(한국 App Store ₩149,000)으로, 기존 SuperGrok($30)과 Heavy($300) 사이를 메우는 중상위 티어다. 본지 일일 관측이 8월 3일 US·KR App Store에서 동시에 감지.OpenAI, gpt-5.6 중·소형 값 내렸다 — luna 80%↓·terra 20%↓, 플래그십은 동결OpenAI가 gpt-5.6-luna를 1M 토큰당 $1/$6에서 $0.20/$1.20로 80% 내렸다. terra도 $2.5/$15→$2/$12로 20% 인하. 반면 플래그십 sol은 $5/$30 그대로. 본지 일일 관측이 7월 30일 요금 페이지에서 감지·공식 대조 확인.GLM 코딩플랜, 값 올리고 사용량 줄였다 — Pro 11%↑·Max 한도 3할 삭감z.ai의 GLM Coding Plan이 Pro를 월 $72→$80로, Max를 $160→$168로 올렸다. 게다가 Max의 사용량 한도는 Lite의 20배→14배로 줄었다. 본지 일일 관측이 7월 30일 요금 페이지에서 감지한, 최근 보기 드문 '인상' 사례.Claude Opus 5 출시 — 세대는 올랐는데 가격은 그대로앤트로픽이 새 플래그십 Claude Opus 5를 내놨다. 그런데 API 단가는 직전 세대 Opus 4.8과 1원도 다르지 않은 $5/$25. 본지 일일 관측이 7월 24일 요금 페이지에서 감지한 '가격 동결형' 세대 교체.Gemini 3.6 Flash 출시 — 출력 단가 17% 내렸다구글이 Gemini 3.6 Flash를 내놓으며 출력 단가를 1M 토큰당 $9에서 $7.50로 낮췄다. 본지 일일 관측이 7월 21일 공식 요금 페이지에서 감지한 첫 실측 인하.'20x'는 무엇의 20배인가 — Claude 사용량 한도, 공식 문서가 처음으로 자세히 답했다5시간 세션 윈도우, 주간 한도, 그리고 웹·앱·Claude Code가 한 풀이라는 것. 7월 13일 요금 페이지 개편으로 추가된 공식 FAQ를 정리했다.AI 요금 비교글이 10% 틀리는 이유 — 부가세의 함정같은 회사 공식 페이지가 $20와 $22를 동시에 보여준다. 둘 다 맞다. 세전가와 세후가를 섞어 쓰는 순간 모든 비교가 어긋난다.월 30만원 시대 — AI 구독 '울트라 티어' 전쟁의 지형도ChatGPT Pro 20x ₩299,000, Claude Max 20x $220, Grok Heavy ₩449,000. 1년 새 형성된 최상위 구독 시장을 체급별로 정리했다.AI의 '생각'에도 요금이 붙는다 — 보이지 않는 추론 토큰 청구서화면에 보이는 답변은 449자인데 과금된 출력 토큰은 1,689개. 그 차이가 추론(thinking) 토큰이다 — 실측에서 출력 요금의 85%를 차지했다.Anthropic, 예고했던 Sonnet 5 인상을 철회 — $2/$10가 표준가로 굳었다8월 말 종료 예정이던 '도입가' $2/$10가 영구 표준가가 됐다. 9월 1일 $3/$15로 50% 오른다던 예고는 취소됐다. 본지가 7월에 예고한 인상을, 8월에 같은 관측으로 '철회'까지 잡았다.같은 프롬프트를 두 번 보내면 90%를 돌려받는다 — 캐싱 단가 읽는 법3사 모두 반복되는 입력에 큰 할인을 준다. Claude는 캐시 히트가 입력가의 10분의 1, OpenAI도 10분의 1. 조건과 함정을 공식 단가표에서 읽어냈다.한국어는 AI한테 더 비싸다 — 5개 모델 토크나이저 실측같은 내용을 한국어로 쓰면 영어보다 토큰이 1.2~1.5배 든다. 그리고 그 격차는 모델마다 다르다 — 단가표가 말해주지 않는 한국어 사용자의 실질 단가.환율 1,500원 시대의 AI 구독 — 달러 요금과 원화 요금은 다르게 움직인다같은 구독인데 어떤 건 환율 따라 매달 결제액이 출렁이고, 어떤 건 고정이다. 달러 연동가와 원화 고정가의 구조 차이, 그리고 환율이 만드는 역전.같은 고객 문의 하나, Claude와 Gemini는 각각 얼마를 청구했나단가표에서 더 싼 모델이 실제 청구액은 2.5배 더 나왔다. 눈에 보이지 않는 추론 토큰이 출력 과금의 85%를 차지한 실측 기록.반값의 중국계 AI — GLM·Kimi 구독, 한국에서 따져볼 것 세 가지GLM 코딩 플랜 $18, Kimi ₩25,000 — 서구 빅테크의 절반값이다. 싼 건 맞다. 다만 한국어 사용자라면 계산서에 넣어야 할 항목이 더 있다.같은 구독인데 앱에서 사면 35% 비싸다 — 결제 채널별 가격 실측Claude Max 20x는 웹 $220, 앱스토어 ₩449,000. 상위 티어일수록 앱 결제 할증이 커진다 — 채널별 가격을 나란히 놓고 재봤다.플래그십은 사치일 때가 많다 — API 모델 체급 고르기최상위 모델은 주력 모델의 5배, 경량 모델의 40배 가격이다. 어떤 작업을 어느 체급에 맡겨야 청구서가 가벼워지는지 — 급 나누기의 기준.연간 결제 할인율 실측 — 11%부터 30%까지, 회사마다 다르다\"연간이 싸다\"는 다 아는데 얼마나 싼지는 회사마다 다르다. 공식 가격표에서 할인율을 계산했고, 연간 결제가 손해가 되는 조건도 정리했다.