Kimi K3
⧉Kimi K3는 Moonshot AI의 새 플래그십 모델로, 긴 문서 이해와 다중 문서 분석, 중국어 글쓰기에 강하고 에이전트와 도구 호출 능력이 뛰어납니다. 항상 먼저 생각한 뒤 답하며 추론 과정은 reasoning_content로 반환됩니다. 샘플링 온도는 모델이 고정하므로 요청의 temperature / top_p는 무시됩니다. 도구 호출, 스트리밍, 프롬프트 캐싱(반복되는 긴 접두어는 캐시 단가로 정산)을 지원합니다. OpenAI 호환이므로 model을 kimi-k3로 지정하면 되며, 사용한 만큼 과금하고 실패한 호출에는 과금하지 않습니다.
이 모델을 선택하는 이유
Moonshot의 새 플래그십: 파라미터 2.8조, 가중치 공개, 약 100만 토큰 컨텍스트
주요 특징
- 파라미터 2.8조, 가중치 공개. 현재 가장 큰 오픈 가중치 모델 중 하나
- 약 100만 토큰 컨텍스트(1,048,576): 긴 자료도 통째로 입력
- 기본으로 사고하며, 사고 과정은 reasoning_content로 따로 반환되어 답변 본문에 섞이지 않음
- 도구 호출, 스트리밍, 프롬프트 캐시 지원. 반복되는 긴 접두부는 캐시 가격으로 과금
- OpenAI 호환: 기존 SDK 코드에서 base_url과 model만 바꾸면 됨
공식 가격과 비교
100만 토큰당, 미국 달러 · 절약 ↓40%
복사해서 바로 호출
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "kimi-k3", "messages": [{"role": "user", "content": "Hello"}]}'from openai import OpenAI
client = OpenAI(api_key="YOUR_API_KEY", base_url="https://nezhagate.com/v1")
r = client.chat.completions.create(model="kimi-k3", messages=[{"role": "user", "content": "Hello"}])
print(r.choices[0].message.content)YOUR_API_KEY를 콘솔에서 만든 키로 바꾸세요.
온라인 테스트 · 플레이그라운드
Kimi K3 바로 여기서 사용해 보기 (로그인 후 사용 가능).
입력
고급 설정
대화
소개: Kimi K3
Kimi K3는 Moonshot AI의 새 플래그십 모델로, NezhaGate에서 OpenAI 호환 API로 제공됩니다. 긴 문서 이해와 다중 문서 분석, 중국어 글쓰기에 강하며 에이전트와 도구 호출 능력이 뛰어납니다. 항상 먼저 생각한 뒤 답하며, 추론 과정은 message.reasoning_content로, 답변은 content로 반환됩니다. 샘플링 온도는 모델이 고정하므로 요청의 temperature / top_p는 게이트웨이가 무시하며 오류도 나지 않습니다. 도구 호출, 스트리밍, 프롬프트 캐싱을 지원합니다. model을 kimi-k3로 두면 바로 연결되며, 사용한 만큼 과금하고 실패한 호출에는 과금하지 않습니다.
활용 사례
계약서, 논문, 재무 보고서 같은 긴 자료의 요약, 비교, 질의응답. 10만 토큰이 넘는 문서에서도 정보를 정확히 찾아내는 것을 확인했습니다.
OpenAI 형식의 tools / tool_calls를 지원해 검색 증강, 함수 호출, 다단계 작업 조율에 적합합니다.
긴 글, 보고서, 마케팅 카피와 다듬기까지 자연스럽고 매끄러운 중국어로 작성합니다.
먼저 생각한 뒤 답하므로 수학, 논리, 여러 단계의 추론이 필요한 문제에 적합하며, 추론 과정은 reasoning_content에서 확인할 수 있습니다.
어떻게 고를까
긴 문서, 다중 문서, 에이전트 작업이라면 Kimi K3를 먼저 고르세요. 더 낮은 비용의 일상 대화라면 DeepSeek V4.1 Flash나 GLM-5.3도 좋으며, model 필드만 바꾸면 전환됩니다.
자주 묻는 질문
temperature 파라미터가 적용되나요?
사고 모드를 끌 수 있나요?
긴 답변을 받을 때 주의할 점은?
프롬프트 캐싱을 지원하나요?
실패한 호출에도 과금되나요?
관련 모델
연동할 수 있는 다른 모델도 둘러보세요.
GLM-5.3
Z.ai의 새 플래그십 · 코딩과 에이전트
Qwen3.7 Max
Alibaba Qwen 플래그십 · 추론과 코딩
Grok 4.7
xAI의 플래그십 추론 모델 · 긴 컨텍스트
DeepSeek V4.1 Flash
DeepSeek의 현재 Flash 모델 · 사고 모드 켜고 끄기
Claude Sonnet 4.6
균형 잡히고 효율적인 채팅 · 코딩 모델
Gemini 3.1 Pro
Google의 차세대 플래그십 추론 모델