Anthropic đưa Accenture vào kiểm định AI, mỗi bên cam kết ít nhất 1 tỷ USD

|Tác giả: Ban biên tập QUASA|7 phút đọc| 2
Anthropic đưa Accenture vào kiểm định AI, mỗi bên cam kết ít nhất 1 tỷ USD

Ngày 18/9/2026, Anthropic và Accenture công bố kế hoạch lập một đội kiểm định AI nhúng tại Anthropic, do Faculty thuộc Accenture dẫn dắt. Thông cáo của Accenture xác nhận đội này sẽ làm việc cùng các nhóm nội bộ và đối tác an toàn của Anthropic để đánh giá, red-team mô hình, kiểm tra căn chỉnh và thử nghiệm biện pháp bảo vệ; mỗi công ty dự kiến đầu tư ít nhất 1 tỷ USD trong 5 năm cho an toàn AI.

Điểm mới là kiểm định viên được đặt bên trong quá trình phát triển, với mức tiếp cận được mô tả là tương đương nhân viên, thay vì chỉ nhận một mô hình hoàn thiện để thử nghiệm từ bên ngoài. Tuy nhiên, đây mới là quan hệ đối tác đang được thiết lập: chưa có báo cáo kiểm định, chuẩn chung về quyền truy cập và công bố kết quả, còn Anthropic sẽ trực tiếp trả tiền cho Accenture.

Accenture sẽ kiểm định ngay trong quá trình phát triển

Mô hình kiểm định nhúng cho phép người đánh giá theo dõi mô hình trong giai đoạn huấn luyện, tìm hiểu các quyết định chi phối cách mô hình được xây dựng và triển khai, đồng thời trao đổi trực tiếp với nhân sự liên quan. Phạm vi đó rộng hơn một đợt đánh giá tại một thời điểm vì nó có thể bao quát cả mô hình lẫn quy trình vận hành xung quanh mô hình.

Faculty sẽ cung cấp năng lực kỹ thuật cho đội chuyên trách. Bốn nhóm công việc được hai bên nêu ra gồm đánh giá mô hình, red-team nhằm tìm hành vi hoặc điểm yếu ngoài dự kiến, đánh giá mức độ căn chỉnh và thử nghiệm các biện pháp bảo vệ.

Anthropic còn mô tả kiểm định viên nhúng như một bên có thể xác minh việc thực hiện cam kết an toàn, phát hiện điểm mù, báo cáo sự cố và giúp công chúng hiểu rõ hơn về lợi ích cũng như rủi ro. Dù vậy, các công ty chưa công bố quy mô đội ngũ, thời điểm công việc thực tế bắt đầu, danh mục hệ thống bắt buộc phải mở hay tiêu chí định lượng để xác định một cuộc kiểm định đạt yêu cầu.

Hai kế hoạch đầu tư không phải phí kiểm định đã được giải ngân

Cách diễn đạt chính xác của hai doanh nghiệp là mỗi bên “dự kiến đầu tư”, không phải đã chuyển tiền hoặc ký một hợp đồng kiểm toán có tổng giá trị cố định. Accenture mô tả phạm vi là an toàn AI, còn Anthropic nói đến việc xây dựng năng lực trong lĩnh vực này; vì thế không có căn cứ để coi toàn bộ số tiền cộng gộp là ngân sách riêng của đội kiểm định tại Anthropic.

Chưa có phân bổ công khai giữa nhân sự đánh giá, hạ tầng thử nghiệm, nghiên cứu và các chương trình an toàn khác. Con số trong tiêu đề vì vậy phản ánh mức kế hoạch tối thiểu mà mỗi công ty công bố cho giai đoạn 5 năm, chứ không phải kết quả đầu tư đã hoàn thành.

Dòng tiền dành cho công việc cụ thể có cấu trúc khác: thông báo của Anthropic cho biết hãng sẽ trực tiếp tài trợ phần việc của Accenture vì hiện chưa có quỹ chung hoặc nguồn tài trợ chính phủ phù hợp. Anthropic cho rằng về dài hạn, nguồn tiền nên đến từ cơ chế góp chung hoặc khu vực công, nhưng những cơ chế đó chưa tồn tại.

Quyền tiếp cận sâu chưa đủ chứng minh tính độc lập

Hai bên gọi hoạt động này là kiểm định độc lập, song chưa nêu một tổ chức thứ ba nào chứng nhận cách bố trí đó. Việc kiểm định viên thuộc một công ty khác giúp tạo khoảng cách về tổ chức, nhưng không tự loại bỏ xung đột lợi ích khi bên được đánh giá lựa chọn đối tác, cấp quyền truy cập và thanh toán cho công việc.

Cấu trúc đã công bố có thể được tách thành bốn quan hệ:

  • Ai trả tiền: Anthropic trực tiếp tài trợ công việc mà Accenture thực hiện tại hãng; hai kế hoạch đầu tư dài hạn là cam kết rộng hơn và chưa có bảng phân bổ.
  • Ai được tiếp cận: kiểm định viên nhúng được mô tả là có mức tiếp cận tương đương nhân viên, nhưng phạm vi dữ liệu, hệ thống, cuộc họp và ngoại lệ bảo mật chưa được công bố.
  • Ai thực hiện: đội chuyên trách do Faculty dẫn dắt sẽ tiến hành bốn nhóm hoạt động kiểm định đã nêu.
  • Ai nhận kết quả: kiểm định viên có thể báo cáo sự cố và cung cấp thông tin cho công chúng, nhưng chưa có quy tắc xác định phát hiện nào phải được công bố, gửi cơ quan quản lý hay chỉ lưu hành nội bộ.

Quyền nhìn thấy thông tin và quyền tự công bố kết luận là hai vấn đề khác nhau. Một nhóm có thể tiếp cận sâu quá trình huấn luyện nhưng vẫn bị hạn chế tính độc lập nếu bên được đánh giá kiểm soát phạm vi công việc, lịch công bố, nội dung bị lược bỏ hoặc cách xử lý bất đồng.

Bài tường thuật của TechCrunch cũng ghi nhận Accenture là đối tác kiểm định nhúng đầu tiên được Anthropic nêu tên và các chuẩn về quyền tiếp cận, truyền đạt kết quả vẫn chưa tồn tại. Hiện chưa rõ Accenture có quyền tự xuất bản phát hiện, ghi nhận ý kiến phản đối hay công khai trường hợp Anthropic tiếp tục phát hành mô hình bất chấp khuyến nghị hay không.

Chương trình mới ở giai đoạn thiết lập

Quan hệ đối tác đã được công bố, nhưng chưa có cuộc kiểm định hoàn tất, phát hiện kỹ thuật hoặc bằng chứng công khai cho thấy khuyến nghị của Accenture đã làm thay đổi một quyết định huấn luyện hay phát hành mô hình. Việc gọi chương trình là “độc lập” hiện phản ánh mục tiêu thiết kế do hai doanh nghiệp đưa ra, chưa phải kết quả đã được kiểm chứng.

Thỏa thuận không độc quyền: Anthropic dự kiến bổ sung các tổ chức đánh giá khác, còn Accenture có thể đảm nhiệm vai trò tương tự cho những nhà phát triển AI khác. Anthropic cũng đang trao đổi với METR và một số tổ chức phi lợi nhuận về các thử nghiệm dùng nguồn tài trợ riêng, nhưng chưa công bố thỏa thuận hoàn chỉnh với những bên này.

Những dữ liệu quyết định mức độ độc lập thực tế sẽ là phạm vi truy cập bằng văn bản, quy tắc xử lý xung đột lợi ích, quyền xuất bản, cơ chế ghi nhận bất đồng và cách phân bổ ngân sách. Cho đến khi các điều kiện đó được công bố, điều đã xác nhận là Accenture được đưa gần hơn vào quá trình phát triển AI của Anthropic; hiệu lực và tính độc lập của việc kiểm định vẫn chưa thể kết luận.

Đọc thêm:

Chia sẻ:

Đăng ký bản tin

Nhận tin Web3, AI và tiền mã hóa mới nhất ngay trong hộp thư.

0