2coffee.dev

Bài viết hàng ngày dành cho bạn

Xuân Hoài Tống

Mới đây Anthropic công bố một bản báo cáo chi tiết về vấn đề phát hiện và chống lại việc lạm dụng trí tuệ nhân tạo, cụ thể là các mô hình nguôn ngữ lớn Claude. Báo cáo này bao gồm các hoạt động diễn ra từ tháng 12/2025 đến tháng 8/2026 trên 7 lĩnh vực: mạng máy tính (cyber), ảnh hưởng (influence), giám sát (surveillance), lừa đảo và gian lận, lạm dụng sinh học (biological misuse), chế tạo vũ khí (conventional weapons) và chưng cất (illicit distillation).

Chi tiết các bạn có đọc trong báo cáo vì nó rất dài. Tuy nhiên chúng ta có thể thấy các lĩnh vực trên không quá xa lạ, thậm chí một số nghe đến tên thôi cũng thấy nguy hiểm nếu không có biện pháp ngăn chặn. Một lần nữa mới thấy AI như một con dao 2 lưỡi sắc lẹm mọi người nhỉ.

Anthropic không ngại chỉ thẳng mặt những ai đang chưng cất mô hình của họ. Hoạt động này có thể nói đang diễn ra hàng ngày với quy mô khủng khiếp. Rất nhiều mánh khóe đưa ra để vượt qua rào cản kỹ thuật gắt gao. Sau đó họ mang đi mã nguồn mở hoặc kinh doanh với giá rẻ hơn gấp nhiều lần. Không biết là nên vui hay buồn nữa 🥲

Detecting and countering misuse of AI: September 2026

Bình luận