Tóm tắt nhanh
- OpenAI vừa công bố mô hình GPT-6.1 Sol với định vị tối ưu chi phí cho các tác vụ lập trình, phân tích tài liệu và tự động hóa luồng làm việc.
- Giá gọi API giữ nguyên mức 2 USD cho mỗi triệu token đầu vào và 10 USD cho mỗi triệu token đầu ra, trong khi chi phí bộ nhớ đệm (prompt caching) giảm một nửa xuống 0,10 USD.
- Các bài thử nghiệm độc lập và nội bộ cho thấy Sol 6.1 đạt kết quả sát nút GPT-6 Astra trên thang đo DeepSWE 1.1 và vượt Claude Opus 5.5 ở bài toán xử lý tài liệu GDP.pdf.
- Mô hình hiện được mở cho người dùng các gói trả phí trên giao diện ChatGPT Work, công cụ Codex và nền tảng lập trình API.
Cân bằng giữa năng lực giải quyết tác vụ và chi phí vận hành

Trong cấu trúc sản phẩm của OpenAI, dòng mô hình Sol đảm nhận vai trò ‘ngựa thồ’ cho các tác vụ đòi hỏi suy luận nhiều bước nhưng cần mức phí dễ chịu hơn dòng cao cấp Astra. Bản nâng cấp GPT-6.1 Sol vừa ra mắt tiếp tục duy trì mức giá đầu vào chuẩn 2 USD và đầu ra 10 USD cho mỗi triệu token. Điểm cải thiện rõ rệt nhất về mặt tài chính nằm ở phí lưu bộ nhớ đệm đầu vào (cached input), hạ từ 0,20 USD xuống còn 0,10 USD trên mỗi triệu token, tức giảm 50% so với thế hệ Sol trước.
Khoản giảm giá bộ nhớ đệm này mang ý nghĩa quyết định đối với các hệ thống trợ lý lập trình hoặc quy trình tự động hóa nhiều lượt. Khi mô hình liên tục phải đọc lại các đoạn mã nguồn lớn, tài liệu hướng dẫn kỹ thuật hoặc bối cảnh cuộc gọi công cụ (tool calling), chi phí thực tế của toàn bộ phiên làm việc sẽ giảm đáng kể. So với dòng đầu bảng GPT-6 Astra (10 USD đầu vào và 50 USD đầu ra), chi phí gọi Sol 6.1 chỉ bằng đúng một phần năm, trong khi phí cached input bằng một phần mười.
Hiệu năng lập trình và suy luận bám sát dòng đầu bảng
Năng lực xử lý bài toán kỹ thuật phần mềm của GPT-6.1 Sol thể hiện sự thu hẹp khoảng cách đáng kể so với dòng Astra. Theo số liệu công bố trên thang thử nghiệm DeepSWE v1.1 — bài kiểm tra khả năng giải quyết các vấn đề kỹ thuật phần mềm phức tạp trên mã nguồn thực tế — Sol 6.1 ghi nhận điểm số ngang ngửa Astra nhưng mức tiêu tốn chi phí cho mỗi tác vụ chỉ xấp xỉ một phần năm. So với chính thế hệ GPT-6 Sol tiền nhiệm, bản nâng cấp tạo ra bước nhảy 6,4 điểm phần trăm ở mức thiết lập suy luận thấp hơn.
| Tiêu chí và bài đo | GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra | Claude Opus 5.5 |
|---|---|---|---|---|
| Giá đầu vào chuẩn / triệu token (thấp hơn tốt hơn) | 2 USD | 2 USD | 10 USD | — |
| Giá bộ nhớ đệm / triệu token (thấp hơn tốt hơn) | 0,10 USD | 0,20 USD | 1,00 USD | — |
| Giá đầu ra chuẩn / triệu token (thấp hơn tốt hơn) | 10 USD | 10 USD | 50 USD | — |
| DeepSWE v1.1 (lập trình phần mềm, cao hơn tốt hơn) | Tương đương Astra | Thấp hơn 6,4% | Chuẩn đối chiếu | — |
| GDP.pdf (đọc tài liệu phức tạp, cao hơn tốt hơn) | Vượt Opus 5.5 | — | Cao nhất nhóm | Thấp hơn Sol 6.1 |
| OSWorld 2.0 (thao tác máy tính, cao hơn tốt hơn) | Kém Astra 2,1% | Thấp hơn 7% | Cao nhất nhóm | — |
| Chi phí bài đo khoa học Terminal-Bench (thấp hơn tốt hơn) | 5,47 USD | — | 23,80 USD | 23,21 USD |
Số liệu kỹ thuật và thử nghiệm do OpenAI công bố tại thời điểm ra mắt mô hình.
Ở bài kiểm tra đọc hiểu tài liệu chuyên môn GDP.pdf với bảng biểu và số liệu chi tiết, Sol 6.1 đạt độ chính xác nhỉnh hơn Claude Opus 5.5 trong khi chi phí mỗi bài toán chưa bằng một nửa. Khi chuyển sang môi trường tương tác với giao diện máy tính trên OSWorld 2.0, Sol 6.1 vượt thế hệ cũ 7 điểm phần trăm và chỉ còn kém điểm số của Astra 2,1 điểm phần trăm ở mức thiết lập suy luận cao nhất.
Tỷ lệ sai sót thực tế và độ trễ khi chạy tác vụ tự động
Bên cạnh điểm số đo lường giải thuật, bài toán kiểm soát tỷ lệ lỗi thực tế (factuality) là yếu tố quyết định để mô hình có thể đưa vào sản xuất thương mại. Trong các nhóm câu hỏi khó được ghi nhận phản hồi lỗi từ người dùng trước đây, GPT-6.1 Sol giảm tỷ lệ câu trả lời chứa sai lệch từ 11,4% xuống 7,7% ở mức nỗ lực suy luận thấp, tương đương mức cải thiện khoảng 32% so với Sol đời đầu.
OpenAI đồng thời công bố tùy chọn tốc độ cao mang tên Ultrafast, dự kiến xuất hiện trên Sol 6.1 trong những ngày tới sau khi đã kích hoạt trước cho Astra. Tùy chọn này đẩy tốc độ xuất chữ lên tới 300 token mỗi giây, nhanh hơn gấp 8 lần trong môi trường lập trình Codex và gấp 6 lần qua ngõ kết nối ứng dụng API. Đổi lại, việc sử dụng luồng Ultrafast qua API sẽ có mức phí đắt gấp 6 lần giá tiêu chuẩn, phù hợp cho các trường hợp lập trình viên cần phản hồi tức thì để tương tác trực tiếp thay vì chạy tác vụ nền qua đêm.
Khả năng tiếp cận và tính thực tế cho người dùng tại Việt Nam
Hiện tại, GPT-6.1 Sol đã được kích hoạt trực tiếp cho các tài khoản ChatGPT Plus, Pro, Business, Enterprise và Edu nhưng chỉ giới hạn trong môi trường ChatGPT Work và công cụ lập trình Codex, chưa mở đại trà cho giao diện chat phổ thông. Giới hạn này phản ánh mục tiêu nhắm thẳng vào nhóm người dùng chuyên nghiệp và các đội ngũ kỹ thuật thay vì đối tượng trò chuyện hàng ngày.
Đối với cộng đồng kỹ thuật và doanh nghiệp tại Việt Nam, sự xuất hiện của gpt-6.1-sol trên cổng API mở ra phương án tiết kiệm ngân sách rất lớn khi xây dựng các sản phẩm trợ lý thông minh. Việc kết hợp đơn giá token rẻ với phí bộ nhớ đệm chỉ 0,10 USD giúp các đội ngũ phát triển trong nước có thể triển khai hệ thống tra cứu cơ sở tri thức hoặc tác tử tự động hóa quy trình nghiệp vụ dài hạn mà không cần gánh chi phí khổng lồ của các mô hình đầu bảng như Astra.
Nguồn tham khảo: Thông cáo giới thiệu GPT-6.1 Sol từ OpenAI, Phân tích chi phí và tùy chọn Ultrafast trên VentureBeat, Báo cáo đánh giá hiệu năng trên SiliconANGLE.







