aitodayCập nhật xu hướng AI, chatbot, automation, đào tạo và công nghệ mới mỗi ngày
Tin mới AI

Kimi K3: Trung Quốc tung mô hình mở lớn nhất lịch sử, hạ Claude Fable 5 ngay tại sân code

Ngày 16/7, Moonshot AI công bố Kimi K3 — mô hình mở lớn nhất từng được phát hành với 2.800 tỷ tham số. Chỉ vài ngày sau, nó chiếm ngôi đầu bảng xếp hạng lập trình giao diện, đẩy Claude Fable 5 và GPT-5.6 Sol xuống phía sau. Điều đáng nói: trọng số của nó được phát miễn phí.

16:21 - 21/07/2026 5 phút đọc 9 lượt xem

Cuối tuần trước, giới công nghệ Mỹ có một phen chấn động. Kimi K3 của Moonshot AI — một phòng nghiên cứu Trung Quốc — leo lên vị trí số 1 bảng xếp hạng Frontend Code Arena với 1.679 điểm, vượt qua Claude Fable 5 và GPT-5.6 Sol với khoảng cách không hề sát nút.

Điều khiến câu chuyện này khác hẳn mọi lần “model Trung Quốc đuổi kịp phương Tây” trước đây nằm ở ba chữ: trọng số mở. Kimi K3 không phải dịch vụ đóng tính tiền theo token. Nó được phát hành công khai để bất kỳ ai cũng tải về được.

Trọng số mở khiến bức tường vốn khép kín của AI tiên phong hé ra một lối vào
Trọng số mở khiến bức tường vốn khép kín của AI tiên phong hé ra một lối vào

2.800 tỷ tham số — lớn nhất từng có

Kimi K3 là mô hình suy luận đa phương thức với 2.800 tỷ tham số, quy mô lớn nhất trong số các mô hình mở từng được công bố. Cửa sổ ngữ cảnh 1 triệu token, đặt nó vào đúng nhóm dành cho lập trình dài hơi và các tác vụ agent chạy liên tục.

Kết quả trên các bài đo lập trình:

Bài kiểm traĐiểm Kimi K3Vị trí
Frontend Code Arena1.679Số 1, trên cả Fable 5
Terminal-Bench 2.188,3Số 2, kém GPT-5.6 Sol nửa điểm
FrontierSWE81,2Dẫn đầu
ProgramBench77,8Dẫn đầu
DeepSWE67,5Nhóm đầu
SWE Marathon42,0Dẫn đầu

Trên sáu bài đo lập trình, Kimi K3 đều nằm trong nhóm ba mô hình mạnh nhất. Đây không còn là chuyện “gần bằng” nữa.

Vì sao chuyện này quan trọng hơn một bảng xếp hạng

Toàn bộ mô hình kinh doanh của các phòng lab AI tiên phong dựa trên một giả định: mô hình mạnh nhất phải đắt, phải đóng, và phải bán theo lượng token. Người dùng trả tiền vì không có lựa chọn nào tương đương.

Nếu một mô hình phát không liên tục đứng đầu bảng, giả định đó sụp. Và Kimi K3 không đơn độc — trọng số của K3 cùng DeepSeek đổ bộ trong vòng mười ngày. Đây là điều giới quan sát gọi là cuộc phản công của phe trọng số mở.

Một chi tiết ít người để ý: Trung Quốc đạt được kết quả này trong điều kiện bị hạn chế tiếp cận chip cao cấp của Mỹ. Việc huấn luyện một mô hình 2.800 tỷ tham số dưới trần hạn chế tính toán nói lên rất nhiều về khả năng tối ưu kỹ thuật của họ.

Nhưng “mở” không có nghĩa là bạn chạy được ở nhà

Đây là chỗ nhiều bài viết bỏ qua, và nó quan trọng với người đọc Việt Nam hơn cả bảng benchmark.

Trọng số mở nghĩa là bạn được phép tải về, không phải bạn chạy nổi. Một mô hình 2.800 tỷ tham số cần cụm máy chủ nhiều GPU chuyên dụng mới nạp nổi vào bộ nhớ — vượt xa khả năng của bất kỳ máy tính cá nhân nào, kể cả cấu hình khủng. Ảo tưởng “tải về máy dùng miễn phí” là không thực tế.

Cái mở thật sự mang lại là điều khác, và vẫn rất giá trị:

  • Giá dịch vụ rẻ đi. Khi ai cũng có quyền tự host, các nhà cung cấp phải cạnh tranh nhau về giá thay vì độc quyền. Bạn dùng K3 qua các cổng trung gian như OpenRouter với chi phí thấp hơn hẳn mô hình đóng cùng đẳng cấp.
  • Không bị khóa nhà cung cấp. Nhà cung cấp tăng giá hay đóng cửa, bạn chuyển sang chỗ khác vì mô hình là như nhau.
  • Doanh nghiệp có dữ liệu nhạy cảm được tự host. Ngân hàng, bệnh viện, cơ quan nhà nước — những nơi không thể gửi dữ liệu ra ngoài — nay có lựa chọn ở đẳng cấp hàng đầu.

Vậy nên chuyển sang Kimi K3 không?

Nếu công việc chính của bạn là lập trình giao diện, K3 đáng thử nghiêm túc — nó đang đứng đầu đúng hạng mục đó, và rẻ hơn đáng kể.

Nếu bạn cần agent chạy tự chủ dài hơi, viết nội dung, hoặc phân tích đòi hỏi độ tin cậy cao, hãy đo trên chính công việc của mình trước khi đổi. Điểm benchmark cao không đồng nghĩa hợp với quy trình của bạn — và các mô hình phương Tây vẫn có lợi thế ở những khía cạnh khó đo bằng điểm số, như mức độ ổn định khi chạy nhiều giờ hay khả năng tự nhận sai.

Lời khuyên thực tế nhất: đừng chọn phe. Chi phí chuyển đổi giữa các mô hình hiện nay rất thấp. Hãy chạy song song hai ba mô hình trên cùng một tập việc thật của bạn trong một tuần, rồi để số liệu quyết định thay vì bảng xếp hạng của người khác.


Nguồn: công bố của Moonshot AI, bảng xếp hạng Arena.AI Frontend Code Arena, VentureBeat và Tom's Hardware, tháng 7/2026.

Chia sẻ bài viết
Tin mới
Đăng ký nhận bản tin AI hàng tuần
Luôn cập nhật những tin tức AI mới nhất, xu hướng công nghệ, hướng dẫn sử dụng AI và các bài phân tích chuyên sâu. Đăng ký để nhận những nội dung nổi bật được gửi trực tiếp đến email của bạn mỗi tuần.