Kimi K3: Mô hình 3T mới và bài học từ thử nghiệm Pelican
Kimi K3, and what we can still learn from the pelican benchmark

Moonshot AI vừa ra mắt Kimi K3 với 2.8 nghìn tỷ tham số, đánh bại nhiều đối thủ lớn về hiệu suất và lập trình Frontend. Tôi đã thử nghiệm mô hình này với bài toán 'Pelican đi xe đạp' quen thuộc, phát hiện chi phí cao do lượng token suy luận khổng lồ nhưng khả năng xử lý hình ảnh rất ấn tượng. Dù benchmark này không còn phản ánh chính xác năng lực thực tế, nó vẫn là cách nhanh chóng để kiểm tra độ ổn định và chi phí của các mô hình mới.
Đừng dùng hình ảnh Pelican để so sánh các mô hình AI nữa!