Alex Ellis, nhà sáng lập OpenFaaS và Inlets, vừa có bài viết thẳng thắn về việc sử dụng các mô hình AI chạy cục bộ như Qwen 27B và Qwen 35-A3B. Ông khẳng định những mô hình này không phải một Opus kém hơn, mà là công cụ khác dành cho nhu cầu cụ thể.
AI chạy cục bộ có thực sự hiệu quả?
Theo Ellis, chiếc card đồ họa RTX 6000 Pro đã hoàn vốn trong 2-3 tháng đầu nhờ xử lý các tác vụ lập trình nội bộ. Tuy nhiên, ông cũng chỉ ra nhược điểm lớn nhất của Qwen khi chạy cục bộ: vòng lặp vô hạn và nguy cơ ảo giác, đặc biệt khi bạn lượng tử hóa mô hình để vừa với GPU tiêu dùng. Ellis nhấn mạnh ông vẫn chưa thể tin tưởng AI không cần giám sát, nhưng với các trường hợp sử dụng cụ thể trong doanh nghiệp nhỏ, mô hình cục bộ mang lại giá trị thực tế.
Ứng dụng thực tế cho lập trình viên và công ty khởi nghiệp
Ellis, người dùng AI từ thời tự động hoàn thành bằng phím tab trong VS Code đến ChatGPT, cho rằng Qwen chạy cục bộ phù hợp với các công ty khởi nghiệp cần kiểm soát dữ liệu, tiết kiệm chi phí. So với các mô hình AI đám mây như Claude hay Codex, mô hình cục bộ giúp tăng quyền kiểm soát và tự chủ dữ liệu. Nhưng ông cảnh báo: Đừng kỳ vọng Qwen chạy cục bộ thay thế hoàn toàn Claude hay Codex cho các tác vụ phức tạp. Cộng đồng công nghệ Việt Nam có thể tham khảo bài học này để chọn công cụ phù hợp với nhu cầu thực tế, không chạy theo cơn sốt.





