Mistral AI vừa công bố Shieldstral, một mô hình AI mã nguồn mở chỉ với 3 tỷ tham số nhưng có khả năng kiểm duyệt nội dung vượt trội hơn nhiều mô hình lớn gấp 7 lần. Đây là công cụ giúp các ứng dụng chatbot, mạng xã hội và nền tảng trực tuyến tự động phát hiện nội dung độc hại, từ văn bản bạo lực đến hình ảnh không phù hợp.
Vì sao đây là bước đột phá
Trước đây, mỗi nền tảng phải huấn luyện riêng một mô hình kiểm duyệt theo bộ quy tắc cố định, tốn kém thời gian và chi phí. Shieldstral thay đổi cách tiếp cận: thay vì cố định danh mục vi phạm, người dùng chỉ cần nhập chính sách bằng ngôn ngữ tự nhiên, ví dụ "nội dung này có cổ súy bạo lực không". Mô hình trả lời bằng một điểm số an toàn được tính toán ngay lập tức, không cần huấn luyện lại.
Chạy được trên phần cứng phổ thông
Điểm đáng chú ý là Shieldstral chỉ cần một GPU 16GB để vận hành, phù hợp với các startup nhỏ thay vì chỉ dành cho tập đoàn lớn có hạ tầng khổng lồ. Được phát hành theo giấy phép Apache 2.0, Shieldstral là một phần trong liên minh Open Secure AI Alliance cùng NVIDIA (NVDA), hứa hẹn giúp cộng đồng startup trong lĩnh vực công nghệ xây dựng sản phẩm an toàn hơn với chi phí thấp hơn.






