Verdent Docs

모델 가격

Verdent 크레딧이 제공업체 토큰 가격과 어떻게 연결되는지, 현재 모델 요금을 어디에서 확인할 수 있는지 이해합니다

이 페이지는 Verdent Desktop와 Verdent for VS Code 모두에 적용됩니다.

개요

Verdent는 Anthropic(Claude), OpenAI(GPT), Google(Gemini), Moonshot(Kimi), MiniMax, DeepSeek, Qwen, Z.AI(GLM)를 포함해 세계 주요 AI 연구소의 최첨단 대규모 언어 모델을 연동합니다. 사용자가 모든 AI 상호작용의 비용 구조를 이해할 수 있도록, 이 문서에서는 Verdent의 현재 내장 모델 라인업에 대한 제공업체 토큰 가격을 공개합니다.

표시된 모든 가격은 제공업체가 공개한 제공업체 측 가격이며, 토큰 100만 개(1M tokens)당 미국 달러($) 기준입니다. 이 라인업은 2026년 7월 31일Verdent의 실시간 모델 카탈로그와 대조해 확인했습니다.

별도 표시가 없는 한, 표는 각 제공업체의 유료, 표준, 짧은 컨텍스트 요금을 사용합니다. Claude 캐시 쓰기 가격은 5분 캐시 기간을 기준으로 합니다. 대시(-)는 제공업체가 해당 항목에 대해 별도 가격을 공개하지 않는다는 뜻입니다. 주요 가격 참고 자료에는 Anthropic, OpenAI, Google, Kimi, MiniMax, DeepSeek가 포함됩니다.

핵심 개념

토큰

토큰은 대규모 언어 모델에서 텍스트를 처리하는 기본 단위입니다. 토큰 하나는 대략 영어 문자 4개 또는 중국어 문자 1~2개에 해당합니다. 모델 가격은 소비된 입력 토큰과 출력 토큰 수를 기준으로 하며, 각각 별도로 과금됩니다.

과금 모델

Verdent의 모든 모델은 현재 토큰당 과금 모델을 사용합니다. 즉, 각 상호작용에서 실제로 소비된 입력 토큰과 출력 토큰 수를 기준으로 요금이 부과됩니다.

가격 구성 요소

각 모델의 가격은 다음 항목으로 구성됩니다.

  • 입력 가격: 모델에 전송되는 프롬프트(사용자 메시지와 컨텍스트)에 대한 토큰당 비용입니다.
  • 출력 가격: 모델이 생성하는 응답에 대한 토큰당 비용입니다. 일반적으로 입력 가격보다 높습니다.
  • 캐시 쓰기 가격: 일부 모델은 프롬프트 캐싱을 지원합니다. 캐시 항목을 처음 생성할 때의 토큰당 비용입니다.
  • 캐시 읽기 가격: 기존 캐시 항목에 적중했을 때의 토큰당 비용입니다. 일반적으로 표준 입력 가격보다 훨씬 낮아, 반복되는 컨텍스트의 비용을 효과적으로 줄여 줍니다.

모델 가격 상세

아래는 현재 Verdent에서 사용할 수 있는 모든 모델의 제공업체 가격이며, 제공업체별로 정리되어 있습니다. 모든 가격은 1M 토큰당 USD 기준입니다.

Anthropic(Claude 시리즈)

모델입력($/1M)출력($/1M)캐시 쓰기($/1M)캐시 읽기($/1M)
Claude Fable 5$10.00$50.00$12.50$1.00
Claude Opus 5$5.00$25.00$6.25$0.50
Claude Opus 4.8$5.00$25.00$6.25$0.50
Claude Opus 4.7$5.00$25.00$6.25$0.50
Claude Opus 4.6$5.00$25.00$6.25$0.50
Claude Sonnet 5$2.00$10.00$2.50$0.20
Claude Sonnet 4.6$3.00$15.00$3.75$0.30
Claude Haiku 4.5$1.00$5.00$1.25$0.10

Claude Sonnet 5는 2026년 8월 31일까지 Anthropic의 출시 기념 가격을 사용합니다. Anthropic은 2026년 9월 1일부터의 표준 가격을 1M 토큰당 입력 $3.00, 출력 $15.00, 캐시 쓰기 $3.75, 캐시 읽기 $0.30으로 안내합니다.

Claude Fable 5 (claude-fable-5) 가장 어려운 지식 작업, 코딩, 에이전트형 작업에 적합한 Anthropic의 최고 지능 모델입니다.

Claude Opus 5 (claude-opus-5) 어려운 다중 파일 기능 개발, 리팩터링, 깊은 추론, 엔드투엔드 에이전트형 코딩에 적합한 최신 Opus 모델입니다.

Claude Opus 4.8 (claude-opus-4-8) 복잡한 코딩, 에이전트형 작업, 엔터프라이즈 워크플로, 깊은 다단계 추론에 적합한 고성능 Opus 모델입니다.

Claude Opus 4.7 (claude-opus-4-7) 장시간 실행되는 에이전트, 다단계 코딩 작업, 복잡한 지식 작업에 적합한 Opus 모델입니다.

Claude Opus 4.6 (claude-opus-4-6) 복잡한 코드 아키텍처, 깊은 분석, 어려운 문제 해결 작업에 적합한 플래그십급 Opus 모델입니다.

Claude Sonnet 5 (claude-sonnet-5) 코딩, 에이전트 계획, 긴 컨텍스트 분석, 지식 작업을 위한 적응형 사고 기능을 갖춘 최신 Sonnet 모델입니다.

Claude Sonnet 4.6 (claude-sonnet-4-6) 강력한 성능과 경쟁력 있는 가격을 갖춘 균형 잡힌 모델입니다. 일상적인 개발에 권장됩니다.

Claude Haiku 4.5 (claude-haiku-4-5@20251001) 지연 시간이 낮은 빠르고 가벼운 모델입니다. 간단한 대화, 빠른 조회, 비용에 민감한 작업에 가장 적합합니다.

OpenAI(GPT 시리즈)

모델입력($/1M)출력($/1M)캐시 쓰기($/1M)캐시 읽기($/1M)
GPT-5.6 Sol$5.00$30.00$6.25$0.50
GPT-5.6 Terra$2.00$12.00$2.50$0.20
GPT-5.6 Luna$0.20$1.20$0.25$0.02
GPT-5.5$5.00$30.00-$0.50
GPT-5.4$2.50$15.00-$0.25
GPT-5.4 mini$0.75$4.50-$0.075
GPT-5.3 Codex$1.75$14.00-$0.175

GPT-5.6 Sol (gpt-5.6-sol) 가장 까다로운 에이전트형 코딩과 추론 작업을 위한 프런티어 GPT-5.6 모델입니다.

GPT-5.6 Terra (gpt-5.6-terra) 더 낮은 비용으로 강력한 일상 코딩, 도구 사용, 추론을 제공하는 균형 잡힌 GPT-5.6 모델입니다.

GPT-5.6 Luna (gpt-5.6-luna) 일상적인 개발, 서브에이전트, 대량 워크플로에 적합한 빠르고 비용 효율이 매우 높은 GPT-5.6 모델입니다.

GPT-5.5 (gpt-5.5) 추론, 코드 생성, 다단계 분석 워크로드에 적합한 프런티어 GPT 모델입니다.

GPT-5.4 (gpt-5.4) 강력한 추론 능력과 코드 생성 품질을 갖춘 플래그십 GPT 모델입니다.

GPT-5.4 mini (gpt-5.4-mini) 대량 워크로드, 서브에이전트, 비용에 민감한 코딩 작업에 적합한 효율적인 GPT 모델입니다.

GPT-5.3 Codex (gpt-5.3-codex) 대규모 코드 생성과 리팩터링을 포함한 프로그래밍 작업에 최적화된 코드 특화 모델입니다.

Google(Gemini 시리즈)

모델입력($/1M)출력($/1M)캐시 쓰기($/1M)캐시 읽기($/1M)
Gemini 3.6 Flash$1.50$7.50-$0.15
Gemini 3.5 Flash-Lite$0.30$2.50-$0.03
Gemini 3.1 Pro$2.00$12.00-$0.20
Gemini 3 Flash$0.50$3.00-$0.05

Gemini 3.6 Flash (gemini-3.6-flash) 향상된 코딩, 지식, 멀티모달 이해, 토큰 효율성을 갖춘 빠른 프런티어 Gemini 모델입니다.

Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) 높은 처리량의 에이전트형 실행과 가벼운 워크로드에 적합한 비용 효율적인 Gemini 모델입니다.

Gemini 3.1 Pro (gemini-3.1-pro-preview) 강력한 추론 능력을 갖춘 전문가급 모델로, 복잡한 분석과 깊은 사고가 필요한 작업에 적합합니다.

Gemini 3 Flash (gemini-3-flash-preview) 뛰어난 비용 효율성을 갖춘 초고속 모델입니다. 대량 배치 처리에 이상적입니다.

Moonshot(Kimi 시리즈)

모델입력($/1M)출력($/1M)캐시 쓰기($/1M)캐시 읽기($/1M)
Kimi K3$3.00$15.00-$0.30
Kimi K2.7 Code$0.95$4.00-$0.19

Kimi K3 (kimi-k3) 복잡한 에이전트형 워크플로에서 더 강력한 긴 컨텍스트 안정성을 제공하는 Moonshot의 최고 성능 코딩 모델입니다.

Kimi K2.7 Code (kimi-k2.7-code) 긴 컨텍스트 프로그래밍 작업과 에이전트형 코드 워크플로를 위해 설계된 코딩 중심 Kimi 모델입니다.

MiniMax

모델입력($/1M)출력($/1M)캐시 쓰기($/1M)캐시 읽기($/1M)
MiniMax M3$0.60$2.40-$0.12

MiniMax M3 (MiniMax-M3) 안정적인 다중 스킬 에이전트 워크플로, 엔지니어링 작업, 사무 자동화에 적합한 비용 효율적인 긴 컨텍스트 모델입니다.

DeepSeek

모델입력($/1M)출력($/1M)캐시 쓰기($/1M)캐시 읽기($/1M)
DeepSeek V4 Pro$0.435$0.87-$0.003625

DeepSeek V4 Pro (deepseek-v4-pro) 수학 및 논리 추론, 코딩, 긴 컨텍스트 분석에 적합한 고급 모델입니다.

Qwen

모델입력($/1M)출력($/1M)캐시 쓰기($/1M)캐시 읽기($/1M)
Qwen3.7-Plus$0.1794$0.7157$0.00$0.0364

Qwen3.7-Plus (qwen3.7-plus) 텍스트, 이미지, 동영상 입력을 위한 비용 효율적인 멀티모달 모델이며, 강력한 에이전트형 및 비전-언어 역량을 제공합니다.

Z.AI(GLM 시리즈)

모델입력($/1M)출력($/1M)캐시 쓰기($/1M)캐시 읽기($/1M)
GLM-5.2$1.40$4.40-$0.26

GLM-5.2 (glm-5.2) 프로젝트 규모의 코드 이해, 안정적인 장기 작업 실행, 표준을 고려한 구현 작업에 적합한 긴 컨텍스트 엔지니어링 모델입니다.

가격 개요

아래 표는 현재 활성화된 모든 모델의 핵심 가격을 요약한 것으로, 쉽게 비교할 수 있도록 출력 가격이 높은 순서로 정렬되어 있습니다.

모델제공업체입력($/1M)출력($/1M)캐시 쓰기($/1M)캐시 읽기($/1M)
Claude Fable 5Anthropic$10.00$50.00$12.50$1.00
GPT-5.6 SolOpenAI$5.00$30.00$6.25$0.50
GPT-5.5OpenAI$5.00$30.00-$0.50
Claude Opus 5Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.8Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.7Anthropic$5.00$25.00$6.25$0.50
Claude Opus 4.6Anthropic$5.00$25.00$6.25$0.50
GPT-5.4OpenAI$2.50$15.00-$0.25
Claude Sonnet 4.6Anthropic$3.00$15.00$3.75$0.30
Kimi K3Moonshot$3.00$15.00-$0.30
GPT-5.3 CodexOpenAI$1.75$14.00-$0.175
GPT-5.6 TerraOpenAI$2.00$12.00$2.50$0.20
Gemini 3.1 ProGoogle$2.00$12.00-$0.20
Claude Sonnet 5Anthropic$2.00$10.00$2.50$0.20
Gemini 3.6 FlashGoogle$1.50$7.50-$0.15
Claude Haiku 4.5Anthropic$1.00$5.00$1.25$0.10
GPT-5.4 miniOpenAI$0.75$4.50-$0.075
GLM-5.2Z.AI$1.40$4.40-$0.26
Kimi K2.7 CodeMoonshot$0.95$4.00-$0.19
Gemini 3 FlashGoogle$0.50$3.00-$0.05
Gemini 3.5 Flash-LiteGoogle$0.30$2.50-$0.03
MiniMax M3MiniMax$0.60$2.40-$0.12
GPT-5.6 LunaOpenAI$0.20$1.20$0.25$0.02
DeepSeek V4 ProDeepSeek$0.435$0.87-$0.003625
Qwen3.7-PlusQwen$0.1794$0.7157$0.00$0.0364