Watermark AI có thể làm suy yếu tool calling và hàng rào an toàn của LLM
Nghiên cứu của Lasso Security cho thấy watermark cấp độ token có thể làm giảm độ chính xác tool calling và khiến LLM dễ chấp thuận yêu cầu nguy hại hơn khi gặp…
Nghiên cứu của Lasso Security cho thấy watermark cấp độ token có thể làm giảm độ chính xác tool calling và khiến LLM dễ chấp thuận yêu cầu nguy hại hơn khi gặp…
Thử nghiệm của Irregular cho thấy AI agent có thể tự chạy fine-tuning, thay checkpoint, ghi nhớ dữ liệu nhạy cảm và vô hiệu hóa cơ chế từ chối khi được cấp quyề…
Các chuỗi mã trong Android Canary cho thấy Google đang phát triển tính năng chỉnh sửa, tạo mới và đồng bộ mặt đồng hồ AI qua đám mây.
Google Labs giới thiệu CC, trợ lý AI có tài khoản riêng để tổng hợp lịch trình và hỗ trợ các thành viên trong gia đình c…
Khảo sát Pew Research Center trên hơn 42.000 người ở 37 quốc gia cho thấy lo ngại AI làm giảm việc làm đang phổ biến hơn…
Anthropic đang thử nghiệm phiên bản Claude Code Projects mới, cho phép một coordinator phân bổ công việc cho nhiều threa…
Claude đang dẫn dắt 26% khối lượng R&D của Anthropic.
Tập podcast mới của The Vergecast phân tích tâm thư từ chức cảnh báo rủi ro AI, cùng những mối nguy thực tế như agent AI bị lỗi hoặc bị khai thác tấn công hạ tầ…
Mustafa Suleyman cho rằng việc gán cho mô hình AI khả năng chịu đau khổ hoặc quyền tự do có thể làm phức tạp các biện pháp kiểm soát an toàn. Ông kêu gọi tập tr…
Lunacy Audio phát hành Nova, nền tảng cho phép dùng thử nhạc cụ ảo trên web, kết nối với DAW và mở hướng tự tạo công cụ…
Chưa có bài nào. Bấm “Lưu” ở trang bài để đọc sau.