Tóm tắt nhanh
- Từ ngày 9/10/2026, người dùng cá nhân không trả phí sẽ không còn được dùng mô hình Gemini Flash mà chỉ tiếp cận bản rút gọn Flash-Lite.
- Thuê bao AI Plus (khoảng 132.000 đồng/tháng tại Việt Nam) sẽ bị cắt quyền sử dụng mô hình Gemini Pro cao cấp, chỉ còn lại Flash và Flash-Lite.
- Mô hình Gemini Pro cùng tùy chọn suy luận Deep Think giờ đây bị khóa chặt sau các gói đắt đỏ gồm AI Pro (khoảng 489.000 đồng/tháng) và AI Ultra.
- Chiến lược phân tầng mới biến gói 5 USD thành phương án bổ sung dung lượng lưu trữ kèm quyền ưu tiên tốc độ, đẩy chi phí tiếp cận mô hình lập luận mạnh lên gấp nhiều lần.
Gói AI Plus mất đi giá trị cốt lõi khi bị cắt Gemini Pro

Nền tảng Gemini vừa ghi nhận đợt điều chỉnh lớn về danh mục mô hình trí tuệ nhân tạo dành cho tài khoản cá nhân trong tháng 10/2026. Thay đổi gây chú ý nhất nằm ở gói thuê bao cấp thấp AI Plus — vốn có mức giá 4,99 USD/tháng tại Mỹ và khoảng 132.000 đồng/tháng tại Việt Nam. Thuê bao của gói này sẽ nhận được thông báo về thời điểm chính thức bị dừng quyền sử dụng mô hình Gemini Pro, đẩy bản Pro lên thành đặc quyền riêng của gói AI Pro (19,99 USD/tháng) và AI Ultra.
Trước đây, đợt ưu đãi giảm giá sâu từng thu hút lượng lớn người dùng cá nhân đăng ký nhờ lợi thế tiếp cận Gemini Pro với chi phí tiết kiệm. Động thái mới đồng nghĩa với việc ranh giới chất lượng đầu ra bị nới rộng rõ rệt. Gói AI Plus hiện chỉ còn lại bản Flash và Flash-Lite, biến dịch vụ này chủ yếu thành giải pháp mở rộng bộ nhớ đám mây kèm hạn mức xử lý nhanh hơn, thay vì là một công cụ cung cấp mô hình AI lập luận chuyên sâu giá rẻ.
Tài khoản miễn phí bị thu hẹp đáng kể về năng lực xử lý

Bên cạnh thuê bao trả phí, nhóm người dùng phổ thông không đăng ký gói cũng chịu ảnh hưởng trực tiếp. Bắt đầu từ ngày 9/10/2026, tài khoản miễn phí sẽ mất hoàn toàn quyền truy cập mô hình Gemini Flash và chỉ còn sử dụng được phiên bản Flash-Lite. Mặc dù Flash-Lite mang lại tốc độ phản hồi rất nhanh cho các câu hỏi ngắn, năng lực đọc hiểu ngữ cảnh phức tạp và độ chính xác của mô hình này bị giới hạn đáng kể so với bản Flash tiêu chuẩn.
Việc cắt giảm diễn ra sau khi nền tảng áp dụng cơ chế tính hạn mức dựa trên tài nguyên điện toán (compute-based limits) từ giữa năm 2026. Hệ thống này tính toán mức tiêu thụ dựa trên độ dài đoạn hội thoại, độ phức tạp của câu lệnh và làm mới tài nguyên mỗi 5 giờ cho đến khi chạm trần tuần.
| Gói dịch vụ | Chi phí tham khảo | Mô hình hỗ trợ | Cửa sổ ngữ cảnh | Tùy chọn Deep Think |
|---|---|---|---|---|
| Miễn phí | 0 đồng | Flash-Lite | 32.000 token | Không |
| AI Plus | Khoảng 132.000 đ/tháng | Flash, Flash-Lite | 128.000 token | Không |
| AI Pro | Khoảng 489.000 đ/tháng | Pro, Flash, Flash-Lite | 1.000.000 token | Có |
| AI Ultra | Từ 100 USD/tháng | Pro, Flash, Flash-Lite | 1.000.000 token | Có |
Số liệu: Tài liệu hỗ trợ dịch vụ Gemini Apps và ghi nhận tính năng thực tế.
Bảng phân tầng cho thấy khoảng cách giữa phân khúc 5 USD và 20 USD đã trở thành một bước nhảy lớn về cả mô hình lẫn độ sâu phân tích dữ liệu.
Áp lực tính toán và bài toán chi phí của người dùng
Quyết định gom Gemini Pro về các gói từ 20 USD phản ánh áp lực chi phí hạ tầng máy chủ khi phải phục vụ lượng truy vấn khổng lồ. Việc duy trì cho người dùng khai thác mô hình Pro với giá chỉ 5 USD/tháng rõ ràng không còn khả thi về mặt kinh tế khi các tác vụ đòi hỏi ngày càng nhiều tài nguyên tính toán song song.
Đối với người dùng tại Việt Nam, đặc biệt là nhóm sinh viên, lập trình viên hay người làm nội dung từng chọn AI Plus như giải pháp thay thế tiết kiệm cho ChatGPT Plus (20 USD) hay Claude Pro (20 USD), sự điều chỉnh này buộc họ phải tính toán lại. Khi Flash và Flash-Lite chỉ đáp ứng tốt các nhu cầu tra cứu hằng ngày, người cần mô hình giải toán, viết mã hoặc phân tích tài liệu dài sẽ phải chấp nhận chi trả gần 500.000 đồng/tháng cho gói AI Pro hoặc chuyển sang cân nhắc các nền tảng đối thủ.
Nguồn tham khảo: Tài liệu hỗ trợ Gemini Apps, XDA Developers







