Google (GOOGL) vừa công bố tích hợp tính năng "computer use" vào mô hình Gemini 3.5 Flash, đánh dấu bước tiến mới trong lĩnh vực AI tác nhân. Trước đây, tính năng này chỉ có trên mô hình riêng Gemini 2.5. Giờ đây, các nhà phát triển có thể xây dựng agent AI có khả năng nhìn, suy luận và thao tác trực tiếp trên trình duyệt, ứng dụng di động và desktop.
Google (GOOGL) tích hợp computer use vào Gemini 3.5 Flash, mở rộng tự động hóa doanh nghiệp
Google (GOOGL) tích hợp computer use vào Gemini 3.5 Flash, cho phép AI tác nhân thao tác trực tiếp trên trình duyệt và desktop, mở rộng tự động hóa doanh nghiệp.

Computer use hoạt động như thế nào và vì sao quan trọng?
Thay vì chỉ trả lời văn bản, Gemini 3.5 Flash có thể điều khiển chuột, bàn phím, đọc màn hình và thực hiện các tác vụ phức tạp như kiểm thử phần mềm liên tục hay tự động hóa quy trình làm việc trong các ứng dụng chuyên nghiệp. Điều này giống như có một trợ lý ảo thực thụ biết mở file Excel, kéo thả dữ liệu hoặc dò lỗi trên website mà không cần can thiệp thủ công.
An toàn là ưu tiên hàng đầu
Google đã áp dụng huấn luyện đối kháng (adversarial training) để giảm thiểu rủi ro tấn công prompt injection. Hai hệ thống bảo vệ tùy chọn dành cho doanh nghiệp bao gồm yêu cầu xác nhận của người dùng trước các hành động nhạy cảm hoặc không thể hoàn tác, và tự động dừng tác vụ nếu phát hiện chèn lệnh gián tiếp. Google khuyến nghị kết hợp với sandbox an toàn, giám sát của con người và kiểm soát truy cập chặt chẽ. Với bản cập nhật này, công nghệ agent AI đang giúp tự động hóa tốt hơn những tác vụ kỹ thuật số lặp đi lặp lại, mở ra cơ hội cho startup và doanh nghiệp tối ưu hóa vận hành.





