moonshot

Kimi K3

Kimi K3 là model MoE 2.8T của Moonshot AI với context window 1 triệu token, khả năng multimodal vision nguyên bản và hiệu suất coding đỉnh cao cho các agent...

Open WeightsMultimodalCodingMoEReasoning
moonshot logomoonshotKimi16 tháng 7, 2026
Ngu canh
1Mtoken
Dau ra toi da
4Ktoken
Gia dau vao
$3.00/ 1M
Gia dau ra
$15.00/ 1M
Phuong thuc:TextImageVideo
Kha nang:Thi giacCong cuTruyen truc tiepSuy luan
Diem chuan
GPQA
93.5%
GPQA: Cau hoi khoa hoc cap sau dai hoc. Benchmark nghiem ngat voi 448 cau hoi ve sinh hoc, vat ly va hoa hoc. Chuyen gia PhD chi dat 65-74% do chinh xac. Kimi K3 dat 93.5% trong benchmark nay.
HLE
44.3%
HLE: Suy luan cap chuyen gia. Kiem tra kha nang mo hinh the hien suy luan cap chuyen gia trong cac linh vuc chuyen mon. Kimi K3 dat 44.3% trong benchmark nay.
MMLU
89.2%
MMLU: Hieu ngon ngu da nhiem voc lon. Benchmark toan dien voi 16.000 cau hoi tren 57 mon hoc. Kimi K3 dat 89.2% trong benchmark nay.
MMLU Pro
78.5%
MMLU Pro: MMLU Phien ban chuyen nghiep. Phien ban nang cap cua MMLU voi 12.032 cau hoi va dinh dang 10 lua chon kho hon. Kimi K3 dat 78.5% trong benchmark nay.
SimpleQA
48%
SimpleQA: Benchmark do chinh xac thuc te. Kiem tra kha nang mo hinh cung cap cau tra loi chinh xac, thuc te. Kimi K3 dat 48% trong benchmark nay.
IFEval
89.1%
IFEval: Danh gia tuan theo huong dan. Do luong mo hinh tuan theo huong dan va rang buoc cu the tot nhu the nao. Kimi K3 dat 89.1% trong benchmark nay.
AIME 2025
88%
AIME 2025: Ky thi toan hoc moi My. Bai toan toan hoc cap do thi dau tu ky thi AIME uy tin. Kimi K3 dat 88% trong benchmark nay.
MATH
81.2%
MATH: Giai quyet van de toan hoc. Benchmark toan hoc toan dien kiem tra giai quyet van de trong dai so, hinh hoc, giai tich. Kimi K3 dat 81.2% trong benchmark nay.
GSM8k
96.8%
GSM8k: Toan tieu hoc 8K. 8.500 bai toan dang van ban cap tieu hoc. Kimi K3 dat 96.8% trong benchmark nay.
MGSM
94.2%
MGSM: Toan tieu hoc da ngon ngu. Benchmark GSM8k duoc dich sang 10 ngon ngu. Kimi K3 dat 94.2% trong benchmark nay.
MathVista
70.2%
MathVista: Suy luan thi giac toan hoc. Kiem tra kha nang giai quyet bai toan toan hoc voi cac yeu to thi giac. Kimi K3 dat 70.2% trong benchmark nay.
SWE-Bench
49%
SWE-Bench: Benchmark ky thuat phan mem. Cac mo hinh AI co gang giai quyet van de GitHub thuc trong cac du an Python. Kimi K3 dat 49% trong benchmark nay.
HumanEval
92.5%
HumanEval: Bai tap lap trinh Python. 164 bai tap lap trinh yeu cau mo hinh tao ra cac trien khai ham Python dung. Kimi K3 dat 92.5% trong benchmark nay.
LiveCodeBench
68%
LiveCodeBench: Benchmark lap trinh truc tiep. Kiem tra kha nang lap trinh tren cac thach thuc lap trinh thuc te cap nhat lien tuc. Kimi K3 dat 68% trong benchmark nay.
MMMU
72%
MMMU: Hieu da phuong thuc. Benchmark hieu da phuong thuc tren 30 mon hoc dai hoc. Kimi K3 dat 72% trong benchmark nay.
MMMU Pro
59.5%
MMMU Pro: MMMU Phien ban chuyen nghiep. Phien ban nang cap cua MMMU voi cac cau hoi kho hon. Kimi K3 dat 59.5% trong benchmark nay.
ChartQA
88.4%
ChartQA: Hoi dap bieu do. Kiem tra kha nang hieu va phan tich thong tin tu bieu do va do thi. Kimi K3 dat 88.4% trong benchmark nay.
DocVQA
93.6%
DocVQA: Hoi dap thi giac tai lieu. Kiem tra kha nang trich xuat thong tin tu hinh anh tai lieu. Kimi K3 dat 93.6% trong benchmark nay.
Terminal-Bench
88.3%
Terminal-Bench: Tac vu terminal/CLI. Kiem tra kha nang thuc hien cac thao tac dong lenh. Kimi K3 dat 88.3% trong benchmark nay.
ARC-AGI
8%
ARC-AGI: Truu tuong va suy luan. Kiem tra tri thong minh linh hoat thong qua cac cau do nhan dang mau moi. Kimi K3 dat 8% trong benchmark nay.

Ve Kimi K3

Tim hieu ve kha nang cua Kimi K3, tinh nang va cach no co the giup ban dat ket qua tot hon.

Kiến trúc và Quy mô

Kimi K3 là model flagship thế hệ thứ ba từ Moonshot AI, sử dụng kiến trúc Mixture-of-Experts (MoE) với 2,8 nghìn tỷ parameters khổng lồ. Model kích hoạt 16 trong số 896 chuyên gia cho mỗi token, cho phép hiệu suất tính toán cao mà không làm mất đi chiều sâu trí tuệ gắn liền với số lượng parameter cực lớn. Nó giới thiệu Kimi Delta Attention và attention residuals để duy trì độ chính xác thực tế cao và tính ổn định trên toàn bộ context window 1.048.576-token.

Khả năng đa phương thức (Multimodal)

Model là multimodal nguyên bản, có khả năng xử lý văn bản, hình ảnh và khung hình video trong một framework thống nhất. Sự tích hợp này cho phép các agentic workflow phức tạp, chẳng hạn như kiểm tra trực quan code được tạo hoặc phân tích các video kỹ thuật dài để truy xuất thông tin. Kimi K3 được thiết kế đặc biệt cho các tác vụ dài hạn, bao gồm nghiên cứu tự động và kỹ thuật phần mềm phức tạp, nơi vòng lặp phản hồi hình ảnh là thiết yếu.

Định vị hiệu suất

Kimi K3 cạnh tranh trực tiếp với các closed-source model như Claude 3.5 Opus và các hệ thống cấp độ GPT-5. Nó giữ thứ hạng cao trên LMArena Frontend Code Board, chứng minh năng lực trong phát triển web và tạo nội dung 3D theo thủ tục. Bằng cách kết hợp open weights với khả năng reasoning cấp độ frontier, model cung cấp một nền tảng cho các nhà phát triển xây dựng các hệ thống tự động chuyên biệt đòi hỏi sự hiểu biết kỹ thuật sâu sắc và xử lý dữ liệu quy mô lớn.

Kimi K3

Truong hop su dung cho Kimi K3

Kham pha cac cach khac nhau ban co the su dung Kimi K3 de dat ket qua tuyet voi.

Lập trình Agentic dài hạn

Thực thi các phiên lập trình tự động kéo dài nhiều giờ, bao gồm hàng nghìn tool calls và tự sửa lỗi dựa trên terminal output.

Phát triển game 3D theo thủ tục

Tạo môi trường 3D chạy trên trình duyệt bằng 3JS và WebGPU từ các mô tả ngôn ngữ tự nhiên cấp cao.

Thiết kế chip tự động

Sử dụng các công cụ EDA open-source để thiết kế, tối ưu hóa và xác minh các chip ASIC tùy chỉnh trong các lần chạy tự động từ 24-48 giờ.

Tổng hợp tài liệu khoa học

Xem xét các kho lưu trữ khổng lồ gồm các bài báo khoa học cấp độ Tiến sĩ để triển khai các tính toán vật lý thiên văn hoặc hóa học phức tạp.

Trực quan hóa dữ liệu tương tác

Xử lý các tập dữ liệu lịch sử lớn để xây dựng bảng điều khiển nghiên cứu chuyên sâu và báo cáo web tương tác.

Điều phối đa Agent

Điều phối các mạng lưới agent không đồng nhất phức tạp để quản lý các tác vụ tìm kiếm và thực thi song song quy mô lớn.

Diem manh

Han che

Hiệu suất lập trình đẳng cấp: Xếp hạng số 1 trên LMArena Frontend Code Board, vượt qua các ông lớn trong ngành về lập trình sáng tạo và phát triển UI.
Độ trễ output throughput: Tạo ra 17-20 tokens mỗi giây, chậm hơn đáng kể so với các model chuyên biệt nhỏ hơn.
Độ ổn định context khổng lồ: Duy trì độ chính xác 90,4% trên toàn bộ context window 1M-token, sử dụng Delta Attention để ngăn chặn mất mát thông tin.
Giới hạn suy luận phần cứng: Chạy model cục bộ yêu cầu các compute clusters với hơn 1,5TB VRAM, khiến nó không khả thi đối với phần cứng người dùng cá nhân.
Khả năng Agentic đa phương thức nguyên bản: Xử lý video và hình ảnh trong một framework thống nhất, cho phép model tự sửa lỗi tác vụ thông qua phản hồi hình ảnh.
Overhead của reasoning tokens: Giai đoạn suy nghĩ mở rộng có thể dẫn đến thời gian chờ token đầu tiên (time-to-first-token) cao, lên đến 8 giây.
Quy mô parameters cực lớn: Với 2,8 nghìn tỷ parameters, đây là model open-weights lớn nhất hiện có, cung cấp kiến thức kỹ thuật chuyên sâu.
Khoảng cách về độ chính xác thực tế: Điểm SimpleQA là 48% cho thấy model có thể gặp khó khăn với việc xác minh thực tế độ chính xác cao mặc dù khả năng reasoning rất mạnh.

Bat dau nhanh API

moonshotai/kimi-k3

Xem tai lieu
moonshot SDK
import OpenAI from 'openai';

const client = new OpenAI({
  apiKey: process.env.MOONSHOT_API_KEY,
  baseURL: 'https://api.moonshot.cn/v1',
});

async function main() {
  const completion = await client.chat.completions.create({
    model: 'kimi-k3',
    messages: [{ role: 'user', content: 'Design a procedural 3D forest in 3JS.' }],
    stream: true,
  });

  for await (const chunk of completion) {
    process.stdout.write(chunk.choices[0]?.delta?.content || '');
  }
}

main();

Cai dat SDK va bat dau thuc hien cac cuoc goi API trong vai phut.

Moi nguoi dang noi gi ve Kimi K3

Xem cong dong nghi gi ve Kimi K3

Kimi K3 vừa tạo ra một trò chơi phức tạp cho tôi chỉ trong ba lần thử với 600k tokens. Kỷ nguyên mà các phòng thí nghiệm Trung Quốc tụt hậu đã chính thức kết thúc.
AICodeKing
youtube
Khả năng xử lý dài hạn thật điên rồ. Nó đã xử lý qua nhiều lỗi trong một tác vụ fine-tuning mà không cần tôi gợi ý một chút nào.
DevGuru_88
reddit
Đây cơ bản là 'khoảnh khắc Linux' đối với các reasoning model. Chúng ta đang thấy logic đẳng cấp frontier khả dụng với open weights.
SiliconValleyWatcher
hackernews
K3 làm cho Opus trở nên lỗi thời đối với lập trình. Nó ngang tầm với nhóm cao cấp nhất nhưng với chi phí trên mỗi tác vụ chỉ bằng một phần nhỏ.
TechReporter_X
twitter
Model đã có sẵn trên Kimi Code lúc ra mắt. Hai biến thể: K3 Max cho chat và K3 Swarm Max cho xử lý song song.
ivanfioravanti
twitter
Tôi khá chắc là mình đang chạm ngưỡng giới hạn những gì 1,5TB bộ nhớ có thể làm cho một model 2,5T parameters và 1M context.
mweinbach
twitter

Video ve Kimi K3

Xem huong dan, danh gia va thao luan ve Kimi K3

KDA thực chất cho phép kiểm soát chi tiết hơn về cách thông tin thực sự được giữ lại và quên đi theo từng kênh

tỷ lệ kích hoạt. Chimera 3 được chia thành 896 chuyên gia và chỉ có 16 chuyên gia được kích hoạt trên mỗi token, đó là cách họ đạt được tỷ lệ kích hoạt 1.8% tại bất kỳ thời điểm nào. Và thậm chí khi so sánh điều này

khi nói đến inference? Một model lớn như Chimera 3 thường được phân bổ trên nhiều GPU trong các trung tâm dữ liệu. Ngay cả ở độ chính xác thấp hơn, trọng số của model cũng nằm rải rác trên gần sáu GPU trong thiết lập Nvidia DGX B300. Và

Nó đang làm những việc như truy cập Sketchfab để lấy các tài sản 3D nhằm tạo ra các mô hình 3D tương tác

Đi sâu hơn xuống dưới, tôi có thể thấy một số người như Theo đã khá hào hứng muốn xem nó hoạt động thế nào về mặt lập mô hình 3D cũng như điều phối, điều mà tôi cũng rất hào hứng muốn thử nghiệm.

bạn có thể thấy một số biểu đồ về điều đó, và một trong những vấn đề tôi thường gặp phải là khi sử dụng Fable 5, tôi hay bị hết giới hạn 4 giờ, và tôi chuyển sang GPT 5.6, rồi lại bị hết giới hạn đó.

Trong phát triển front-end, Kimmy K3 là model tốt nhất hành tinh hiện tại

Kimmy K3 cũng vượt trội hơn hẳn về thang điểm thông minh so với các đối thủ open-weight trước đó

Đây là benchmark phát triển front-end của Arena AI. Và chúng ta thấy gì? Kimmy K3 đứng ở vị trí cao nhất, vượt qua Fable 5 và GPT 5.6.

Hon ca prompt

Tang cuong quy trinh lam viec cua ban voi Tu dong hoa AI

Automatio ket hop suc manh cua cac AI agent, tu dong hoa web va tich hop thong minh de giup ban lam duoc nhieu hon trong thoi gian ngan hon.

AI Agent
Tu dong hoa web
Quy trinh thong minh

Meo chuyen nghiep cho Kimi K3

Meo chuyen gia giup ban tan dung toi da Kimi K3 va dat ket qua tot hon.

Tận dụng Kimi CLI

K3 được tối ưu hóa cao cho Kimi CLI; việc sử dụng giao diện này mang lại hiệu suất tốt nhất cho các tác vụ agentic dài hạn.

Sử dụng vòng lặp phản hồi hình ảnh (Visual Feedback Loops)

Cung cấp cho model ảnh chụp màn hình UI mà nó tạo ra; khả năng vision nguyên bản cho phép nó xác định và sửa lỗi hình ảnh theo thời gian thực.

Tối ưu hóa cho Caching

Tận dụng prompt caching để giảm chi phí input lên đến 90% cho các khối context lặp lại trong các tài liệu lớn.

Thiết lập Thinking Effort

Điều chỉnh reasoning parameter sang 'nỗ lực tối đa' (max effort) cho các chứng minh toán học hoặc thiết kế chip để tận dụng tối đa logic điều phối của MoE.

Danh gia

Nguoi dung cua chung toi noi gi

Tham gia cung hang nghin nguoi dung hai long da thay doi quy trinh lam viec cua ho

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Lien quan AI Models

openai

GPT-5.5

OpenAI

GPT-5.5 is OpenAI's flagship frontier model with a 1M context window and five reasoning effort levels, optimized for autonomous agentic workflows and coding.

1M context
$5.00/$30.00/1M
xai

Grok-3

xAI

Grok-3 is xAI's flagship reasoning model, featuring deep logic deduction, a 128k context window, and real-time integration with X for live research and coding.

1M context
$3.00/$15.00/1M
openai

GPT-5.2 Pro

OpenAI

GPT-5.2 Pro is OpenAI's 2025 flagship reasoning model featuring Extended Thinking for SOTA performance in mathematics, coding, and expert knowledge work.

400K context
$21.00/$168.00/1M
google

Gemini 3.1 Flash Live Preview

Google

Gemini 3.1 Flash Live Preview is Google's ultra-low-latency, audio-to-audio model featuring a 131K context window, high-fidelity multimodal reasoning, and...

131K context
$0.75/$4.50/1M
anthropic

Claude Opus 4.7

Anthropic

Claude Opus 4.7 is Anthropic's flagship model with a 1-million-token context, adaptive reasoning, and 3.3x vision resolution for enterprise-scale agents.

1M context
$5.00/$25.00/1M
google

Gemini 3.1 Pro

Google

Gemini 3.1 Pro is Google's elite multimodal model featuring the DeepThink reasoning engine, a 1M+ context window, and industry-leading ARC-AGI logic scores.

1M context
$2.00/$12.00/1M
alibaba

Qwen 3.7 Max

alibaba

Qwen 3.7 Max is Alibaba’s flagship AI model for deep reasoning and autonomous agent tasks, featuring a 256k context window and top-tier coding performance.

256K context
$1.20/$6.00/1M
google

Gemini 3 Pro

Google

Google's Gemini 3 Pro is a multimodal powerhouse featuring a 1M token context window, native video processing, and industry-leading reasoning performance.

1M context
$2.00/$12.00/1M

Cau hoi thuong gap ve Kimi K3

Tim cau tra loi cho cac cau hoi thuong gap ve Kimi K3