Claude đang dẫn dắt 26% khối lượng R&D của Anthropic

Tóm tắt nhanh
- Claude được Anthropic cho biết đang dẫn dắt 26% khối lượng R&D.
- Hơn 90% tác vụ kỹ thuật có AI phối hợp dưới sự giám sát của kỹ sư.
- Công ty vẫn duy trì nhiều lớp giám sát đối với các agent nội bộ.
Claude trực tiếp dẫn dắt 26% khối lượng nghiên cứu và phát triển tại Anthropic
Trong báo cáo đề xuất chuẩn mực đo lường tốc độ phát triển trí tuệ nhân tạo vừa công bố ngày 17/9/2026, Anthropic tiết lộ một con số đáng chú ý: mô hình Claude hiện tự đảm nhiệm và “dẫn dắt” (leads) 26% tổng khối lượng công việc nghiên cứu và phát triển (R&D) nội bộ của công ty. Ngoài ra, hơn 90% khối lượng tác vụ kỹ thuật tại đây có sự phối hợp trực tiếp từ AI dưới sự giám sát của kỹ sư con người.
Định nghĩa “dẫn dắt” được Anthropic quy định cụ thể theo thang đo mức độ tự động hóa của tổ chức Epoch AI: mô hình có thể giải quyết trọn vẹn một tác vụ phức tạp từ đầu đến cuối chỉ từ câu lệnh định hướng tổng thể của kỹ sư, thay vì cần người hướng dẫn từng dòng mã hay kiểm tra từng bước nhỏ. Tuy nhiên, CEO Dario Amodei nhấn mạnh Claude vẫn chưa đạt mức tự vận hành hoàn toàn (AL5 – fully autonomous) ở bất kỳ khâu trọng yếu nào.
Quy trình giám sát đa tầng và cơ chế kiểm soát 30.000 tác nhân AI

Đi kèm mức độ tự động hóa tăng nhanh, Anthropic vận hành đồng thời hai hệ thống kiểm soát độc lập để theo dõi hành vi của khoảng 30.000 tác nhân (AI agent) đang chạy song song trong hạ tầng nội bộ. Hệ thống kiểm soát trực tiếp (online monitor) quét qua 100% thao tác của agent trước khi lệnh được thực thi trên máy chủ, chặn đứng các nguy cơ rò rỉ trọng số mô hình hoặc can thiệp trái phép. Dữ liệu tháng 8/2026 cho thấy tỷ lệ hành vi bị hệ thống chặn đứng chiếm 0,002% (tương đương 1 trên 47.000 quyết định).
Bên cạnh đó, lớp giám sát hậu kiểm (offline monitor) phân tích toàn bộ nhật ký phiên làm việc sau khi tác vụ hoàn tất, phát hiện các dấu hiệu sai lệch hành vi âm thầm mà con người khó nhận thấy ngay. Mỗi tuần, hệ thống hậu kiểm gắn cờ khoảng 100.000 bản ghi để phân loại tự động và chuyển khoảng 50 trường hợp rủi ro cao nhất cho đội ngũ an toàn xử lý thủ công.
Bài toán minh bạch tài nguyên điện toán giữa làn sóng tự phát triển
Vấn đề lớn nhất của các phòng thí nghiệm AI hàng đầu hiện nay không chỉ nằm ở năng lực mô hình, mà là nguy cơ mất kiểm soát khi AI tự đẩy nhanh chu kỳ tự hoàn thiện (recursive self-improvement). Trong tuần khảo sát giữa tháng 7/2026, Anthropic ghi nhận khoảng 6% tổng tài nguyên điện toán R&D được phân bổ riêng cho nghiên cứu an toàn, và con số này đạt 12% nếu tính riêng trong nhóm tác vụ do AI tự thực hiện.
Để ngăn chặn rủi ro tự kiểm duyệt lỏng lẻo, Anthropic tuyên bố sẽ cho phép các tổ chức đánh giá độc lập bên thứ ba truy cập trực tiếp vào hệ thống nội bộ nhằm kiểm chứng số liệu đo lường. Đây là bước đi cụ thể hóa đề xuất điều tiết tốc độ phát triển AI mà Dario Amodei khởi xướng, đặt ra tiền đề minh bạch bắt buộc cho các đơn vị phát triển mô hình biên giới trước khi tiến tới các hệ thống tự động hoàn toàn.
THEO DÕI CÁC KÊNH CỦA TEKCAFE
- Website: TekCafe.vn
- Fanpage Facebook: facebook.com/tekcafeteam
- YouTube: youtube.com/c/TekCafeTeam
BÀI VIẾT MỚI NHẤT
- UBTech mở nhà máy sản xuất robot hình người, cứ 10 phút hoàn thiện một chiếc
- Camp Snap 110D: Máy ảnh kỹ thuật số hoài cổ giá 75 USD
- Khảo sát trình duyệt Android: Chrome dẫn đầu, Brave bám sát
- Claude đang dẫn dắt 26% khối lượng R&D của Anthropic
- The Vergecast mổ xẻ làn sóng lo ngại AI có thể dẫn đến tuyệt chủng