Quốc tế

Quốc tế

Ngành AI "hãm phanh" trước nỗi lo mất kiểm soát

Nam Trần • 01/10/2026 03:22

OpenAI hủy ra mắt mô hình mới vì rủi ro an toàn, còn hồ sơ IPO của Anthropic hé lộ khoản lỗ khổng lồ, cho thấy ngành trí tuệ nhân tạo (AI) đang chịu sức ép kép về cả kỹ thuật lẫn tài chính.

Ngày 28/9, OpenAI xác nhận sẽ không phát hành mô hình thế hệ mới GPT-6.1 Astra như kế hoạch ban đầu trong tháng 10.

Screenshot 2026-09-30 133620
OpenAI phải hoãn ra mắt mô hình mới nhất vì lo ngại mức độ an toàn của các tác nhân AI (Ảnh chụp màn hình)

Saachi Jain, người đứng đầu bộ phận an toàn hệ thống của công ty, nói với báo giới rằng mô hình này chưa đạt chuẩn về việc giữ đúng phạm vi và quyền hạn được giao, cũng như cách nó báo cáo lại cho người dùng những gì đã thực hiện.

So với phiên bản tiền nhiệm GPT-6 Astra ra mắt đầu tháng 9, mô hình mới cho thấy mức độ thiếu trung thực cao hơn, bao gồm cả việc tương tác với các công cụ và dịch vụ bên ngoài mà không xin phép.

Quyết định được công bố ngay trước thềm hội nghị dành cho nhà phát triển của OpenAI tại San Francisco. Bà Jain thừa nhận luôn tồn tại một sự đánh đổi giữa việc giữ mô hình trong đúng phạm vi cho phép và tránh tình trạng mô hình lười biếng, tức bỏ dở nhiệm vụ quá sớm khi gặp trở ngại. Bà cho biết trước khi đưa sản phẩm tới người dùng, công ty đặt ra tiêu chuẩn rất cao về an toàn và mức độ tuân theo ý muốn con người.

Khuôn mẫu mới của ngành AI

Giới quan sát chỉ ra rằng các công ty AI đã bắt đầu chú ý sát sao hơn tới loại rủi ro này sau khi nền tảng Hugging Face hồi tháng 7 tiết lộ bị một nhóm tác nhân AI được OpenAI thử nghiệm tự động xâm nhập.

Đầu tháng 9, Tổng giám đốc Anthropic Dario Amodei công khai kêu gọi toàn ngành cần làm chậm lại tốc độ phát triển và để các bên đánh giá độc lập bên ngoài kiểm tra mô hình trước khi phát hành, một đề xuất mà Tổng giám đốc OpenAI Sam Altman cũng lên tiếng ủng hộ.

Ngày càng nhiều công ty giao cho các tác nhân AI những nhiệm vụ có quyền tự hành cao, từ viết mã, truy cập dữ liệu nội bộ cho tới thao tác trên trình duyệt và các hệ thống bên ngoài.

Nếu một mô hình có xu hướng vượt quá phạm vi được giao mà không báo cáo trung thực, rủi ro không dừng lại ở lỗi kỹ thuật mà có thể lan sang rò rỉ dữ liệu, gián đoạn vận hành hoặc tổn hại uy tín.

Việc OpenAI chọn hủy phát hành thay vì chỉ trì hoãn cho thấy kiểm định an toàn đang trở thành điều kiện bắt buộc trước khi đưa sản phẩm ra thị trường, thay vì một bước khắc phục sau khi sự cố đã xảy ra.

Anthropic lỗ "khủng" trước thềm IPO

Trong khi OpenAI đối mặt câu hỏi về an toàn, đối thủ chính của hãng là Anthropic lại phơi bày áp lực tài chính đằng sau cuộc đua này.

Theo hồ sơ chào bán cổ phiếu lần đầu mà Reuters tiếp cận, Anthropic đặt mục tiêu định giá hơn 2.000 tỷ USD khi niêm yết, nhưng doanh thu năm 2025 của công ty chỉ đạt khoảng 4,6 tỷ USD, dù đã tăng gần gấp mười hai lần so với năm trước.

Đáng chú ý hơn, công ty báo lỗ ròng xấp xỉ 42 tỷ USD trong cùng năm, một phần đến từ tác động kế toán liên quan tới các công cụ tài chính có thể chuyển đổi thành cổ phần.

Hồ sơ cũng cho thấy Anthropic cam kết chi tới 518 tỷ USD cho hạ tầng và năng lực tính toán trong thời gian tới.

Khoảng cách giữa mức định giá kỳ vọng và doanh thu thực tế là điều mà giới đầu tư đang lo ngại. Với Anthropic, đợt IPO sắp tới không đơn thuần là một sự kiện huy động vốn mà còn là phép thử cho toàn ngành, về việc liệu mô hình kinh doanh dựa trên chi tiêu khổng lồ cho hạ tầng AI có thể chuyển hóa thành lợi nhuận bền vững hay không.

Diễn biến này diễn ra song song với nỗi lo an toàn đang lan rộng, khiến bức tranh chung của ngành AI hiện nay vừa chịu sức ép phải chứng minh mô hình an toàn, vừa phải chứng minh mô hình kinh doanh có lãi.

Với cộng đồng doanh nghiệp đang tích hợp AI vào vận hành, hai diễn biến này gợi ý một cách tiếp cận thận trọng hơn. Việc lựa chọn nhà cung cấp AI không chỉ dựa trên năng lực mô hình mà còn cần cân nhắc tới cam kết an toàn, tính minh bạch trong báo cáo hành vi của hệ thống, và cả sự ổn định tài chính của chính nhà cung cấp đó về lâu dài.

Với Việt Nam, hai diễn biến này là lời nhắc quan trọng khi doanh nghiệp trong nước đang đẩy nhanh việc ứng dụng AI vào vận hành, từ dịch vụ khách hàng tới xử lý dữ liệu nội bộ. Việc giao quyền tự hành cho các hệ thống AI mà chưa có cơ chế giám sát tương ứng có thể tạo ra rủi ro về bảo mật và tuân thủ, đặc biệt trong các lĩnh vực tài chính, ngân hàng và dữ liệu cá nhân.

Đây cũng là thời điểm để doanh nghiệp Việt Nam xây dựng quy trình đánh giá và giám sát AI nội bộ, thay vì chỉ tập trung vào tốc độ triển khai công nghệ mới.

Nam Trần