Ngày 27 tháng 9 năm 2026, startup trí tuệ nhân tạo MiniMax của Trung Quốc đã bất ngờ kích hoạt mô hình lập trình M3.1-Flash-Preview ngay bên trong công cụ tác tử MiniMax Code, bỏ qua hoàn toàn các bước công bố tài liệu kỹ thuật (model card), bảng điểm đo kiểm (benchmark) hay niêm yết API thương mại thường thấy.
Theo thông báo ngắn gọn từ tài khoản chính thức MiniMax_Agent trên mạng xã hội X, mô hình được xây dựng chuyên biệt cho quy trình phát triển phần mềm thường nhật, từ việc sửa lỗi nhanh chóng đến xây dựng các tính năng mã nguồn hoàn chỉnh. Điểm đáng chú ý nhất là việc M3.1-Flash-Preview hỗ trợ cửa sổ ngữ cảnh (context window) lên tới 1 triệu token, đồng thời cung cấp 5 cấp độ nỗ lực suy luận (reasoning-effort levels) bao gồm: low, medium, high, xhigh và một bậc mở rộng hoàn toàn mới mang tên max.
Việc phân chia thành 5 nấc tinh chỉnh riêng biệt thay vì 3 nấc cơ bản cho thấy MiniMax chủ động trao quyền cho lập trình viên cân đối linh hoạt giữa thời gian suy nghĩ, độ trễ phản hồi và chi phí điện toán theo đúng độ phức tạp của từng bài toán lập trình.
Dấu vết thử nghiệm ẩn danh qua mô hình Space Bunny Alpha
Bốn ngày trước khi M3.1-Flash-Preview xuất hiện trên MiniMax Code, một mô hình ẩn danh mang tên Space Bunny Alpha đã xuất hiện trên cổng giao dịch OpenRouter với mã định danh stealth/space-bunny-alpha, cung cấp hoàn toàn miễn phí cho cả lượt token đầu vào lẫn đầu ra trong giai đoạn thử nghiệm.
Cộng đồng kỹ sư phần mềm quốc tế đã lập tức triển khai các phương pháp nhận dạng dấu vân tay kỹ thuật (fingerprinting) qua bộ tách từ (tokenizer) và cơ chế phản hồi lỗi. Kết quả kiểm thử độc lập qua cổng OpenCode ghi nhận toàn bộ 24/24 gói truy vấn kiểm tra đều trùng khớp hoàn toàn với chữ ký kỹ thuật của các mô hình do MiniMax phát triển; một phép đo độc lập khác từ The Neuron và CellCog cũng xác nhận tỷ lệ khớp tuyệt đối 50/50.

Chiến lược giá phá vỡ thị trường và tốc độ lặp vòng đời
M3.1-Flash-Preview là bản phát hành mô hình lập trình thứ ba của MiniMax trong vòng chưa đầy một năm. Phiên bản MiniMax M3 tiền nhiệm từng đạt 80,5% trên bộ chuẩn SWE-bench Verified và 59,0% trên bộ chuẩn nâng cao SWE-Bench Pro, vượt qua cả GPT-5.5 và Gemini 3.1 Pro với mức chi phí chỉ tương đương 5% đến 10%.
Hiện nay, mức giá API chính thức của M3 được niêm yết ở mức 0,30 USD trên một triệu token đầu vào và 1,20 USD trên một triệu token đầu ra (trong đó bộ nhớ đệm cached input chỉ tốn 0,06 USD). Con số này thấp hơn gần 10 lần so với Claude Sonnet 5 (2 USD vào / 10 USD ra) và Claude Opus 5 (5 USD vào / 25 USD ra).
Khoảng cách chi phí chênh lệch tới một bậc độ lớn (order of magnitude) chính là đòn bẩy chiến lược để MiniMax thu hút lập trình viên mà không cần phụ thuộc vào các chiến dịch truyền thông rầm rộ. Trong khi các phòng thí nghiệm phương Tây thường mất nhiều tuần chuẩn bị hồ sơ kỹ thuật trước khi mở quyền tiếp cận, MiniMax lựa chọn đưa sản phẩm trực tiếp vào môi trường thực tế để người dùng trải nghiệm ngay lập tức, biến tốc độ lặp vòng đời sản phẩm (iteration speed) thành rào cản ngăn chặn chi phí chuyển đổi của khách hàng.
Nguồn: Startup Fortune


Liên hệ qua Zalo