MXH mygo - Anthropic sử dụng AI để phát triển AI: Claude đã đảm nhận hơn một phần tư khối lượng công việc R&D của công ty.
Anthropic đã công bố dữ liệu nội bộ về quá trình tự động hóa dựa trên AI trong hoạt động R&D (nghiên cứu và phát triển) của mình. Tính đến tháng 8 năm nay, Claude đã dẫn dắt 26% các tác vụ R&D về AI của công ty; con số này chỉ ở mức dưới 1% vào tháng 2, cho thấy tốc độ tăng trưởng đáng kinh ngạc.
Khung tự động hóa 6 cấp độ: Hơn 90% đạt mức độ hợp tác giữa người và máy, nhưng chưa có trường hợp nào "hoàn toàn tự động"
Anthropic sử dụng khung tự động hóa gồm 6 cấp độ để đánh giá mức độ tham gia của AI. Cấp độ AL4 được định nghĩa là "AI dẫn dắt": con người đưa ra các mục tiêu cấp cao, còn AI hoàn thành phần lớn quy trình thực hiện tác vụ, trong khi con người chịu trách nhiệm giám sát và kiểm tra lại. Hiện tại, hơn 90% công việc R&D đạt đến cấp độ hợp tác giữa người và máy hoặc cao hơn, nhưng chưa có tác vụ R&D nào đạt mức tự động hóa hoàn toàn (AL5), và AI luôn hoạt động dưới sự giám sát của con người.
Trong nội bộ, khoảng 30.000 tác nhân AI (AI agents) vận hành bởi Claude đang cùng lúc thực hiện các tác vụ nghiên cứu và kỹ thuật. Các tác nhân này có thể giao việc cho nhau và tự kiểm tra chéo để sửa lỗi, tạo ra hơn 1 tỷ quyết định chỉ trong tháng 8.

80% mã nguồn trong kho lưu trữ được tạo bởi Claude; AI cũng tham gia vào quá trình tự cải tiến của mô hình thế hệ tiếp theo. Để ngăn ngừa rủi ro, mọi hoạt động của AI đều trải qua quy trình kiểm tra an toàn trực tuyến trước khi thực thi, và một số quyết định bất thường sẽ bị chặn lại ngay lập tức. Hệ thống cũng thường xuyên lấy mẫu ngẫu nhiên các bản ghi hội thoại, và những trường hợp có rủi ro cao sẽ được chuyển sang quy trình xem xét thủ công.
Những thay đổi ở cấp độ mã nguồn thể hiện rõ rệt hơn cả: hiện nay, hơn 80% mã nguồn được hợp nhất vào kho lưu trữ (repository) là do Claude tạo ra, giúp năng suất của các kỹ sư tăng gấp nhiều lần so với trước đây. Các tác nhân AI này đảm nhận khối lượng lớn công việc R&D ở cấp độ cơ bản—như thử nghiệm mô hình, viết mã, phân tích dữ liệu và xác minh kết quả—đồng thời tham gia vào quá trình lặp lại và phát triển mô hình Claude thế hệ tiếp theo; đây là quy trình mà ngành công nghệ gọi là "tự cải tiến đệ quy" (recursive self-improvement).
Trích dẫn AiBase Daily https://www.aibase.com/news/31169