Nếu theo dõi tin tức công nghệ gần đây, hẳn bạn đã nghe nhắc đến cái tên Kimi – một trong những model AI đang khiến giới công nghệ toàn cầu phải chú ý. Không còn là sản phẩm âm thầm của một startup Trung Quốc, Kimi hiện đã vươn lên cạnh tranh sòng phẳng với những tên tuổi lớn tại Mỹ, đặc biệt sau khi phiên bản Kimi K3 ra mắt giữa năm 2026 với quy mô tham số lớn nhất trong nhóm model mã nguồn mở hiện có trên thị trường. Vậy cụ thể Kimi AI là gì?
Tổng quan về Kimi AI
Kimi AI là gì?
Kimi là hệ sinh thái trí tuệ nhân tạo do Moonshot AI phát triển, bao gồm trợ lý AI dành cho người dùng phổ thông, các model nền tảng, công cụ lập trình, AI Agent và nền tảng API dành cho nhà phát triển.
Hiểu đơn giản, Kimi có thể được nhìn nhận theo hai góc độ:
- Kimi AI: Trợ lý AI mà người dùng có thể truy cập trực tiếp để trò chuyện, nghiên cứu, xử lý tài liệu, làm slide, phân tích bảng tính, viết code hoặc thực hiện công việc với AI Agent.
- Model Kimi: Các model nền tảng đứng phía sau hệ sinh thái, chẳng hạn Kimi K2, Kimi K2 Thinking, Kimi K2.5, Kimi K2.6, Kimi K2.7 Code và Kimi K3.

Trải qua nhiều lần nâng cấp, hệ sinh thái hiện đã mở rộng thành nhiều sản phẩm như Kimi, Kimi Work, Kimi Code, Kimi Platform và Kimi Claw. Các tính năng chính bao gồm Deep Research, AI Agent, xử lý tài liệu, bảng tính, slide, xây dựng website và triển khai trợ lý AI hoạt động liên tục.
Xem thêm: Top 10+ mô hình LLM Open Source tốt nhất
Moonshot AI – “Cha đẻ” đứng sau Kimi là ai?
Moonshot AI là công ty công nghệ có trụ sở tại Bắc Kinh, được thành lập vào tháng 3 năm 2023. Người sáng lập công ty này theo đuổi mục tiêu hướng đến trí tuệ nhân tạo tổng quát (AGI), đồng thời duy trì chiến lược chia sẻ một phần kết quả nghiên cứu với cộng đồng mã nguồn mở toàn cầu – điều giúp Kimi nhanh chóng được các nhà phát triển bên ngoài Trung Quốc biết đến và thử nghiệm.
Khác với một số công ty AI theo hướng đóng hoàn toàn hệ thống, Moonshot AI chọn cách phát hành trọng số (weights) của nhiều phiên bản Kimi dưới dạng mở, cho phép doanh nghiệp và nhà phát triển tự triển khai, tinh chỉnh, thậm chí tự lưu trữ (self-host) model trên hạ tầng riêng. Chiến lược cởi mở này được xem là một trong những yếu tố chính giúp Kimi mở rộng nhanh chóng, đặc biệt tại các thị trường muốn giảm phụ thuộc vào dịch vụ đám mây của Mỹ.
Hành trình phát triển của Kimi qua các phiên bản
Kimi không đi thẳng từ một chatbot lên Kimi K3. Moonshot AI đã trải qua nhiều giai đoạn phát triển, mỗi thế hệ bổ sung một nhóm khả năng mới.
Có thể tóm tắt hành trình này như sau:
Giai đoạn Phiên bản Điểm nổi bật 2023–2024 Kimi / Moonshot V1 Tập trung vào xử lý văn bản và context dài 01/2025 Kimi k1.5 Reasoning và Reinforcement Learning 07/2025 Kimi K2 MoE 1 nghìn tỷ tham số, hướng mạnh vào AI Agent 11/2025 Kimi K2 Thinking Tăng cường suy luận và sử dụng công cụ Đầu 2026 Kimi K2.5 Native multimodal và Agent Swarm 04/2026 Kimi K2.6 Coding dài hạn và AI Agent tự chủ 06/2026 Kimi K2.7 Code Model chuyên biệt cho lập trình 07/2026 Kimi K3 Flagship 2,8 nghìn tỷ tham số, context 1M
Giai đoạn đầu: Kimi và bài toán context dài
Ngay từ những giai đoạn đầu, Kimi đã được biết đến nhờ khả năng làm việc với lượng văn bản lớn. Đây là nền tảng quan trọng giúp Moonshot AI xây dựng các ứng dụng như đọc tài liệu dài, phân tích nhiều nguồn và duy trì hội thoại có nhiều thông tin.
Dòng Moonshot V1 sau đó được cung cấp dưới nhiều mức context như 8K, 32K và 128K. Tuy nhiên, Moonshot AI dự kiến sẽ ngừng hoàn toàn Moonshot V1 trên API vào ngày 31/8/2026.
Kimi k1.5: Bước tiến sang reasoning
Tháng 1/2025, Moonshot AI công bố Kimi k1.5, đánh dấu bước chuyển quan trọng sang các model có khả năng reasoning.
Kimi k1.5 được huấn luyện bằng Reinforcement Learning và long-context scaling. Trong technical report, Moonshot AI cho biết model đạt kết quả cạnh tranh với OpenAI o1 trên nhiều benchmark về toán học, lập trình và reasoning đa phương thức.
Đây có thể xem là giai đoạn Kimi bắt đầu vượt khỏi vai trò của một chatbot xử lý tài liệu để hướng tới các bài toán suy luận phức tạp hơn.
Kimi K2: Bước ngoặt sang Agentic AI
Ngày 11/7/2025, Moonshot AI giới thiệu Kimi K2.
Kimi K2 sử dụng kiến trúc Mixture of Experts với:
- 1 nghìn tỷ tham số tổng.
- Khoảng 32 tỷ tham số được kích hoạt.
- Khả năng sử dụng công cụ.
- Khả năng lập trình.
- Tối ưu cho agentic workflow.
Thay vì chỉ nhận câu hỏi rồi trả lời, Kimi K2 được xây dựng theo hướng có thể lựa chọn công cụ và thực hiện chuỗi hành động để hoàn thành một nhiệm vụ.
Đây là nền móng quan trọng cho định hướng AI Agent của Kimi sau này.

Kimi K2 Thinking: Tăng cường khả năng suy luận
Tháng 11/2025, Kimi K2 Thinking được giới thiệu với khả năng reasoning từng bước kết hợp sử dụng công cụ.
Moonshot AI tập trung cải thiện reasoning, coding, agentic search và khả năng giải quyết các bài toán phức tạp. Trong các đánh giá chính thức, K2 Thinking đạt kết quả cạnh tranh trên Humanity’s Last Exam, AIME, GPQA Diamond, BrowseComp và nhiều benchmark khác.
Kimi K2.5: Multimodal và Agent Swarm
Đầu năm 2026, Moonshot AI tiếp tục mở rộng hướng phát triển với Kimi K2.5.
K2.5 được huấn luyện tiếp trên khoảng 15 nghìn tỷ token kết hợp văn bản và dữ liệu hình ảnh, qua đó trở thành một native multimodal model.
Điểm đáng chú ý khác là Agent Swarm.
Thay vì một AI Agent thực hiện tuần tự từng nhiệm vụ, Kimi có thể tạo nhiều sub-agent hoạt động song song. Moonshot AI cho biết K2.5 Agent Swarm có thể triển khai tới 100 sub-agent và thực hiện hơn 1.500 tool call trong một workflow.
Kimi K2.6: Tăng độ ổn định cho những tác vụ dài
Ngày 21/4/2026, Kimi K2.6 được giới thiệu, tập trung nhiều hơn vào long-horizon coding và khả năng vận hành AI Agent trong thời gian dài.
K2.6 cải thiện khả năng:
- Tuân thủ instruction.
- Lập trình kéo dài nhiều bước.
- Sử dụng tool.
- Tự sửa lỗi.
- Điều phối AI Agent.
- Duy trì workflow trong thời gian dài.
Agent Swarm của K2.6 còn được mở rộng lên hàng trăm sub-agent trong các thử nghiệm của Moonshot AI.
Kimi K2.7 Code: Model chuyên cho lập trình
Ngày 16/6/2026, Moonshot AI ra mắt Kimi K2.7 Code, một nhánh chuyên biệt cho coding.
K2.7 Code tập trung vào:
- Code generation.
- Code editing.
- Repository lớn.
- DevOps.
- Frontend.
- Debug.
- Programming Agent.
- Workflow sử dụng hàng nghìn tool call.
Theo Moonshot AI, lượng thinking token trung bình của K2.7 Code được giảm khoảng 30% so với K2.6, giúp hạn chế tình trạng suy luận quá dài ở những bài toán không cần thiết. Phiên bản HighSpeed đạt tốc độ khoảng 180 token/giây và có thể cao hơn trong context ngắn.
Kimi K3: Bước nhảy lên nhóm model 3T-class
Tháng 7/2026, Moonshot AI giới thiệu Kimi K3, model flagship mới của hệ sinh thái.
K3 tăng quy mô lên 2,8 nghìn tỷ tham số, bổ sung kiến trúc mới, native multimodal, context 1 triệu token và cải thiện mạnh long-horizon coding, knowledge work lẫn AI Agent.
Tính đến tháng 8/2026, Kimi API Platform đang ưu tiên Kimi K3, Kimi K2.7 Code và Kimi K2.6. Dòng Kimi K2 đời cũ đã ngừng hỗ trợ từ ngày 25/5/2026, còn Kimi K2.5 cũng đang bước vào giai đoạn chuyển đổi sang các model mới.

Kimi K3 có gì đặc biệt?
Thông số kỹ thuật của Kimi K3
| Thông số | Kimi K3 |
| Kiến trúc | Mixture of Experts |
| Tổng số tham số | 2,8 nghìn tỷ |
| Tham số được kích hoạt | 104 tỷ |
| Số layer | 93 |
| Tổng số expert | 896 |
| Expert được chọn/token | 16 |
| Context window | 1.048.576 token |
| Vision Encoder | MoonViT-V2 |
| Multimodal | Có |
| Reasoning | Có |
| Open-weight | Có |
Quy mô tham số khổng lồ 2,8 nghìn tỷ
Kimi K3 có tổng cộng khoảng 2,8 nghìn tỷ tham số – lớn hơn khoảng 75% so với DeepSeek V4, một đối thủ mã nguồn mở khác đến từ Trung Quốc. Dù vậy, do sử dụng kiến trúc Mixture of Experts (MoE), các tham số này sẽ không được sử dụng toàn bộ cùng lúc.
Có thể hình dung hệ thống giống một công ty có hàng trăm chuyên gia. Khi nhận một nhiệm vụ, Kimi K3 không huy động tất cả chuyên gia cùng lúc mà lựa chọn nhóm phù hợp nhất. Trong tổng số 896 expert, K3 kích hoạt 16 expert cho mỗi token. Do đó, mặc dù model sở hữu tổng cộng 2,8 nghìn tỷ tham số, số tham số được kích hoạt trong quá trình xử lý chỉ khoảng 104 tỷ.
Cách thiết kế này cho phép tăng quy mô model mà không bắt buộc toàn bộ 2,8 nghìn tỷ tham số phải tham gia vào từng bước tính toán.
Cửa sổ ngữ cảnh 1 triệu token
Model Kimi K3 sở hữu cửa sổ ngữ cảnh lên tới 1.048.576 token trong một lượt xử lý, với khả năng sinh ra tối đa gần 975.000 token đầu ra. Nói dễ hiểu, người dùng có thể đưa cả một cuốn sách dày, một bộ mã nguồn phần mềm lớn, hoặc hàng loạt tài liệu dài vào cùng một cuộc trò chuyện mà model vẫn “nhớ” và xử lý được toàn bộ nội dung.

Khả năng đa phương thức và tác vụ agent
Kimi K3 được thiết kế đa phương thức tự nhiên (natively multimodal), có thể tiếp nhận và phân tích hình ảnh, video bên cạnh văn bản thông thường. Model luôn kích hoạt chế độ suy luận (reasoning), cho phép người dùng tùy chỉnh mức độ suy luận sâu hay nông thông qua tham số reasoning_effort. Ngoài ra, Kimi K3 còn hỗ trợ gọi công cụ bên ngoài (tool calls), chế độ đầu ra dạng JSON, định dạng dữ liệu có cấu trúc, cùng cơ chế lưu đệm ngữ cảnh (context caching) tự động giúp tiết kiệm chi phí cho các tác vụ lặp lại.
Kimi Delta Attention và Attention Residuals
K3 giới thiệu hai thành phần kiến trúc đáng chú ý:
- Kimi Delta Attention – KDA
- Attention Residuals – AttnRes
Kết hợp với Stable LatentMoE, Moonshot AI cho biết những thay đổi kiến trúc này giúp K3 đạt hiệu quả scaling tổng thể cao hơn khoảng 2,5 lần so với Kimi K2.
Đối với người dùng phổ thông, không cần đi quá sâu vào công thức kỹ thuật. Ý nghĩa quan trọng nhất là K3 được tối ưu để duy trì và chọn lọc thông tin hiệu quả hơn khi model ngày càng lớn và phải xử lý chuỗi dữ liệu rất dài.
K3 mạnh đến mức nào? So sánh Kimi K3 với các model AI hàng đầu khác
Nếu chỉ nhìn vào 2,8 nghìn tỷ tham số, rất dễ kết luận Kimi K3 mạnh hơn những model nhỏ hơn.
Thực tế không đơn giản như vậy. Số tham số chỉ là một phần trong hiệu năng của model. Training data, kiến trúc, Reinforcement Learning, inference, reasoning budget, tool và agent harness đều có thể ảnh hưởng đến kết quả.
Moonshot AI cũng thừa nhận rằng hiệu năng tổng thể của Kimi K3 vẫn đứng sau những proprietary model mạnh nhất tại thời điểm K3 được công bố, tiêu biểu là GPT-5.6 Sol và Claude Fable 5.
Tuy nhiên, khoảng cách không quá lớn trên nhiều benchmark và K3 thậm chí dẫn trước ở một số bài kiểm tra cụ thể.
Một số benchmark đáng chú ý
Theo bảng benchmark được Moonshot AI công bố:
Theo bảng benchmark được Moonshot AI công bố:
Benchmark Kimi K3 GPT-5.6 Sol Claude Fable 5 GPQA Diamond 93,5 94,1 92,6 ProgramBench 77,8 77,6 76,8 Terminal-Bench 2.1 88,3 88,8 88,0 FrontierSWE 81,2 71,3 86,6 BrowseComp 91,2 90,4 88,0 MCPMark-Verified 94,5 92,9 87,4 AutomationBench 30,8 29,7 29,1 OSWorld-Verified 84,8 83,0 85,0 OmniDocBench 91,1 85,8 89,8
Kết quả cho thấy K3 đặc biệt cạnh tranh trong những bài toán liên quan đến:
- Tool use.
- Automation.
- Agentic search.
- Long-horizon coding.
- Tài liệu.
- Multimodal.
Trong khi đó, GPT-5.6 Sol hoặc Claude Fable 5 vẫn dẫn trước K3 ở một số benchmark về reasoning, coding và agentic task khác.
Cũng cần lưu ý Claude Opus 5 được Anthropic giới thiệu sau Kimi K3. Vì vậy, bảng benchmark K3 ban đầu chưa có đánh giá trực tiếp giữa hai model. Claude Opus 5 hiện được Anthropic định hướng cho deep reasoning, agentic coding và long-horizon task với context 1 triệu token.

So sánh tổng quan
| Tiêu chí | Kimi K3 | GPT-5.6 Sol | Claude Opus 5 | Gemini 3.1 Pro |
| Context | ~1M | ~1,05M | 1M | ~1M |
| Reasoning | Mạnh | Rất mạnh | Rất mạnh | Mạnh |
| Coding | Rất mạnh | Rất mạnh | Rất mạnh | Rất mạnh |
| Multimodal | Có | Có | Có | Có |
| Agentic workflow | Rất mạnh | Rất mạnh | Rất mạnh | Rất mạnh |
| Open-weight | Có | Không | Không | Không |
| Điểm nổi bật | Agent, coding, open weights | Frontier reasoning & coding | Long-horizon, coding, enterprise | Multimodal, Google ecosystem |
K3, GPT-5.6 Sol, Claude Opus 5 và Gemini 3.1 Pro đều nằm quanh mốc context 1 triệu token trong API hiện hành.
Ưu điểm và hạn chế của model Kimi
Ưu điểm nổi bật
- Phát hành mã nguồn mở, cho phép tự triển khai và tùy biến trên hạ tầng riêng
- Chi phí sử dụng cạnh tranh hơn đáng kể so với nhiều model đóng của phương Tây
- Cửa sổ ngữ cảnh cực lớn, phù hợp với tài liệu và dự án dung lượng cao
- Hỗ trợ đa phương thức, xử lý được cả hình ảnh và video
- Hiệu năng ở nhiều bài kiểm tra đã tiệm cận nhóm model hàng đầu thế giới

Hạn chế cần lưu ý
- Thời điểm phát hành trọng số đầy đủ thường trễ hơn so với ngày công bố model
- Mức giá API của Kimi K3 cao hơn khá nhiều so với các model mở khác cùng đến từ Trung Quốc
- Muốn tự lưu trữ (self-host) với quy mô 2,8 nghìn tỷ tham số đòi hỏi hạ tầng phần cứng rất mạnh
- Hiệu năng thực tế khi triển khai trong sản phẩm có thể khác biệt so với kết quả trong môi trường kiểm thử chuẩn
Bảng giá và chi phí sử dụng Kimi K3
Chi phí sử dụng Kimi có thể chia thành hai nhóm:
- Người dùng sử dụng trực tiếp Kimi.
- Nhà phát triển sử dụng Kimi K3 API.
Giá các gói Kimi dành cho người dùng
Ở thị trường quốc tế, Kimi hiện có các gói membership từ Moderato đến Vivace:
Gói Thanh toán tháng Thanh toán năm, quy đổi/tháng Moderato 19 USD 15 USD Allegretto 39 USD 31 USD Allegro 99 USD 79 USD Vivace 199 USD 159 USD
Các gói cao hơn cung cấp nhiều credit, tác vụ Agent đồng thời và quyền sử dụng nhiều tính năng nâng cao hơn. Allegro và Vivace hiện hỗ trợ K3 Extra Long Chat với context lên tới 1 triệu token.
Giá và quyền lợi có thể khác nhau tùy khu vực, loại tài khoản và chương trình thanh toán. Vì vậy, người dùng nên kiểm tra trực tiếp trang membership trước khi đăng ký.
Giá Kimi K3 API
Kimi K3 sử dụng cơ chế pay-as-you-go theo lượng token:
Loại token Giá/1 triệu token Input – cache hit 0,30 USD Input – cache miss 3 USD Output 15 USD
Điểm đáng chú ý là K3 áp dụng mức giá thống nhất trên context tối đa 1 triệu token, thay vì tăng giá theo từng mức context.
Hướng dẫn cách sử dụng Kimi mới nhất
Trải nghiệm miễn phí qua website và ứng dụng di động
Cách đơn giản và nhanh nhất để làm quen với Kimi là truy cập trực tiếp website kimi.com, đăng ký tài khoản, sau đó chọn model K3 trong giao diện trò chuyện để bắt đầu sử dụng ngay mà không cần cài đặt gì thêm. Người dùng ưa thích trải nghiệm trên điện thoại có thể tải ứng dụng Kimi trên iOS hoặc Android, với đầy đủ tính năng tương tự bản web.
Kimi Work – Công cụ cho công việc chuyên sâu
Với những tác vụ nặng hơn như lập báo cáo, xây dựng bảng biểu hay dashboard trực quan, Moonshot AI cung cấp ứng dụng desktop mang tên Kimi Work, cho phép khai thác tối đa khả năng xử lý dữ liệu và tổng hợp thông tin của model.

Kimi Code – Trợ lý lập trình trong terminal
Đối với lập trình viên quen thao tác trên terminal, Kimi Code là công cụ agent hỗ trợ viết và sửa mã nguồn, được cài đặt thông qua npm với gói @moonshot-ai/kimi-code. Sau khi cài đặt, người dùng chọn model mong muốn bằng lệnh /model. Lưu ý rằng để sử dụng Kimi K3 trong Kimi Code, tài khoản cần đăng ký gói thành viên trả phí, và muốn mở khóa toàn bộ cửa sổ ngữ cảnh 1 triệu token thì cần nâng cấp lên gói cao hơn.
Sử dụng qua API cho nhà phát triển
Nhà phát triển muốn tích hợp Kimi K3 vào sản phẩm riêng có thể đăng ký tài khoản tại platform.moonshot.ai, tạo API key, rồi gọi model thông qua mã định danh kimi-k3. Cấu trúc API của Kimi được thiết kế tương thích với chuẩn phổ biến trên thị trường, giúp quá trình tích hợp diễn ra thuận tiện cho những ai đã quen làm việc với các nền tảng AI khác.
Kết luận
Qua những thông tin trên, có thể thấy Kimi đã đi một chặng đường dài kể từ ngày ra mắt phiên bản đầu tiên vào cuối năm 2023. Sự trỗi dậy của Moonshot AI cùng dòng model Kimi không chỉ chứng minh năng lực công nghệ ngày càng tiệm cận với các ông lớn phương Tây, mà còn góp phần định hình lại cuộc chơi AI toàn cầu theo hướng cởi mở và dễ tiếp cận hơn.
Nếu đang tìm kiếm một trợ lý AI mạnh mẽ, chi phí hợp lý và có khả năng xử lý khối lượng dữ liệu khổng lồ, Kimi K3 chắc chắn là cái tên đáng để trải nghiệm thử ngay trong thời điểm hiện tại.
Những câu hỏi thường gặp
Kimi K3 có tự host được không?
Có thể, kể từ ngày 27 tháng 7 năm 2026, Moonshot AI đã phát hành trọng số đầy đủ của Kimi K3 cho phép tải về và tự triển khai. Tuy nhiên, do quy mô lên tới 2,8 nghìn tỷ tham số, việc tự lưu trữ đòi hỏi hệ thống phần cứng rất mạnh, phù hợp hơn với doanh nghiệp hoặc tổ chức có hạ tầng chuyên dụng thay vì cá nhân.
Kimi có thể dùng tại Việt Nam không?
Có. Người dùng tại Việt Nam hoàn toàn có thể truy cập website kimi.com, tải ứng dụng di động hoặc đăng ký tài khoản API để sử dụng model Kimi như người dùng ở các quốc gia khác, miễn là kết nối internet ổn định.
Kimi AI có miễn phí không?
Phiên bản web và ứng dụng di động của Kimi cho phép dùng thử miễn phí ở mức cơ bản. Tuy nhiên, để mở khóa toàn bộ sức mạnh của Kimi K3 – như cửa sổ ngữ cảnh đầy đủ 1 triệu token hay các công cụ chuyên sâu trong Kimi Code – người dùng cần đăng ký gói thành viên trả phí hoặc sử dụng qua API tính phí theo token.
Kimi có phù hợp để lập trình không?
Có. Coding là một trong những trọng tâm lớn của các thế hệ Kimi mới. Người dùng có thể sử dụng Kimi K3 cho coding tổng quát hoặc Kimi K2.7 Code cho các workflow chuyên về lập trình. Moonshot AI cũng cung cấp Kimi Code dành riêng cho coding agent.
