Mac mini M6 nhanh hơn M4 bao nhiêu khi chạy AI?

Tóm tắt nhanh
- Mac mini M6 đạt 742 tok/s khi xử lý prompt Qwen3.5-9B, so với 210 tok/s trên M4 trong cùng loạt thử nghiệm.
- Tốc độ sinh token tăng từ 18 lên 26,9 tok/s; thời gian tạo token đầu tiên giảm từ 2,5 xuống 0,72 giây.
- Ở bài test FLUX.1, M6 hoàn tất ảnh mẫu trong 36 giây, còn M4 mất 94 giây.
- M6 có giá khởi điểm 899 USD tại Mỹ, cao hơn mức 599 USD của M4 khi ra mắt.
Mac mini M6 đang tạo khoảng cách đáng kể với M4 ở một số tác vụ AI chạy cục bộ. Các con số dưới đây đến từ thử nghiệm của YouTuber Alex Ziskind, được Wccftech tổng hợp, chứ không phải phép đo do Apple công bố. Vì vậy, chúng phù hợp để tham khảo trong cùng thiết lập hơn là dùng làm dự báo cho mọi ứng dụng AI.
M6 xử lý prompt nhanh gấp 3,5 lần trong bài test Qwen3.5-9B
Với Qwen3.5-9B bản 4-bit, Mac mini M6 đạt 742 tok/s ở giai đoạn xử lý prompt, trong khi M4 đạt 210 tok/s. Chênh lệch khoảng 3,5 lần cho thấy lợi thế rõ ở thời điểm máy tiếp nhận và xử lý phần ngữ cảnh ban đầu.

Đây là phần người dùng thường cảm nhận qua thời gian chờ trước khi mô hình bắt đầu trả lời. Tuy nhiên, tốc độ này không đồng nghĩa mọi câu trả lời sẽ nhanh hơn 3,5 lần, vì hiệu năng còn phụ thuộc mô hình, phần mềm và kích thước prompt.
Tốc độ sinh token tăng vừa phải nhưng phản hồi bắt đầu sớm hơn

Ở giai đoạn sinh token, M6 đạt 26,9 tok/s, cao hơn mức 18 tok/s của M4 khoảng 49,4%. Mức tăng này khiêm tốn hơn kết quả prompt processing, nhưng lại liên quan trực tiếp đến nhịp câu trả lời khi người dùng đang trò chuyện với mô hình.

Trong llama-benchy, M6 mất 0,72 giây để tạo token đầu tiên, còn M4 mất 2,5 giây. Với chatbot chạy tại chỗ, đây là khác biệt dễ nhận ra hơn một con số benchmark: câu trả lời xuất hiện sớm hơn, nhất là khi prompt chứa nhiều ngữ cảnh.

FLUX.1 cho thấy lợi thế rõ hơn ở tác vụ tạo ảnh

Khoảng cách lớn nhất trong loạt số liệu xuất hiện ở FLUX.1. M6 hoàn tất ảnh mẫu trong 36 giây, còn M4 cần 94 giây, tương đương thời gian chờ giảm khoảng 61,7%.

Kết quả này có thể hữu ích với người chạy mô hình tạo ảnh tại chỗ và thường xuyên thử nhiều prompt. Dù vậy, bài test chỉ dùng một mẫu ảnh; độ phân giải, số bước render, phiên bản mô hình và công cụ chạy đều có thể làm thay đổi kết quả. Apple Newsroom và MacRumors xác nhận hướng nâng cấp phần cứng AI của M6, nhưng không công bố lại đúng bộ số đo Qwen3.5, llama-benchy và FLUX.1 này.
Phần cứng M6 giải thích một phần khoảng cách hiệu năng

Apple cho biết M6 có CPU 12 lõi, GPU 12 lõi với Neural Accelerator trong từng lõi, Neural Engine 16 lõi và băng thông bộ nhớ tối đa 170 GB/s. Máy hỗ trợ tối đa 32 GB unified memory, trong khi cấu hình M4 phổ biến được đề cập trong bài có 16 GB.
Những thông số này giúp M6 có thêm dư địa khi chạy mô hình lớn hơn, nhưng không thay thế cho bài đo thực tế. Hiệu năng AI vẫn phụ thuộc vào cách ứng dụng tận dụng GPU, Neural Engine và bộ nhớ hợp nhất.
Giá cao hơn khiến nâng cấp từ M4 chưa phải lựa chọn mặc định

Mac mini M6 có giá khởi điểm 899 USD tại Mỹ. Mức này cao hơn giá khởi điểm 599 USD của M4 khi ra mắt và cao hơn mức 799 USD của cấu hình tương đương sau đợt điều chỉnh giá được đề cập trong nguồn.
Nếu chỉ dùng máy cho văn phòng, duyệt web hoặc chỉnh sửa ảnh nhẹ, mức tăng AI trên chưa chắc đủ để biện minh cho việc đổi máy. Nhóm hưởng lợi rõ hơn là người chạy LLM cục bộ, tạo ảnh bằng GPU tích hợp hoặc thường xuyên xử lý prompt dài. Giá bán và thời điểm mở bán chính hãng tại Việt Nam chưa có trong các nguồn đã kiểm tra, nên người đang dùng M4 nên chờ thêm các bài đo độc lập và giá thực tế trước khi quyết định.
Loạt thử nghiệm cho thấy M6 phản hồi nhanh hơn M4 ở các tác vụ AI cụ thể, đặc biệt là thời gian bắt đầu phản hồi và tạo ảnh bằng FLUX.1. Nhưng đây vẫn là kết quả trong một số thiết lập, không phải cam kết chung cho mọi mô hình. M6 đáng chú ý với người thực sự chạy AI tại chỗ; còn phần lớn người dùng M4 nên cân đối chi phí nâng cấp trước khi quan tâm đến chênh lệch benchmark.
THEO DÕI CÁC KÊNH CỦA TEKCAFE
- Website: TekCafe.vn
- Fanpage Facebook: facebook.com/tekcafeteam
- YouTube: youtube.com/c/TekCafeTeam
BÀI VIẾT MỚI NHẤT
- Dyson CameraJet giá 499 USD gặp lỗi ngay sau khi bán
- PUBG Asia Stars 2026 bị hủy sau tranh cãi stream sniping
- Thử nghiệm RoboHarm cảnh báo rủi ro khi đưa AI ngôn ngữ vào robot
- Hàng nghìn ứng dụng trên TV Samsung, LG bị phát hiện biến TV thành proxy dân cư
- Apple đang phát triển vòng đeo sức khỏe không màn hình giống Whoop



