Meta phát hành mô hình AI có thể 'tự học' và 'tự phát triển'

Thông báo này được đưa ra sau khi Meta giới thiệu công cụ này trong một bài nghiên cứu vào tháng 8, trong đó mô tả cách công cụ này sử dụng kỹ thuật "chuỗi tư duy" tương tự như các mô hình mới của OpenAI để đưa ra những đánh giá chính xác về phản hồi của mô hình AI. Kỹ thuật này chia nhỏ các vấn đề phức tạp thành các bước logic đơn giản hơn, giúp cải thiện độ chính xác trong các lĩnh vực như khoa học, lập trình và toán học.

Các nhà nghiên cứu của Meta đã sử dụng hoàn toàn dữ liệu do AI tạo ra để huấn luyện mô hình đánh giá này, loại bỏ hoàn toàn sự can thiệp của con người trong giai đoạn đó.

Khả năng sử dụng AI để đánh giá chính AI cho thấy tiềm năng phát triển các tác nhân AI tự động, có khả năng học hỏi từ những sai lầm của chính mình, theo hai nhà nghiên cứu của Meta chia sẻ.

Nhiều chuyên gia trong lĩnh vực AI hình dung về các tác nhân số thông minh này như những trợ lý kỹ thuật số có khả năng thực hiện một loạt các nhiệm vụ mà không cần sự can thiệp của con người.

Các mô hình có khả năng tự cải thiện có thể loại bỏ nhu cầu về quy trình 'Học Tăng Cường Từ Phản Hồi Của Con Người', vốn yêu cầu các chuyên gia có chuyên môn cao để gán nhãn dữ liệu và xác minh tính chính xác của các câu trả lời về toán học và viết lách phức tạp. Quy trình này hiện tại thường rất tốn kém và không hiệu quả.

Jason Weston, một trong các nhà nghiên cứu của dự án, cho biết: "Chúng tôi hy vọng rằng khi AI trở nên ngày càng siêu việt hơn con người, nó sẽ tự kiểm tra công việc của mình tốt hơn, thậm chí vượt qua trình độ của con người".

Ông cũng nói thêm rằng: "Khả năng tự học và tự đánh giá là yếu tố then chốt để phát triển AI đạt đến mức độ siêu nhân".

Ngoài Meta, các công ty khác như Google và Anthropic cũng đã công bố nghiên cứu về khái niệm RLAIF, hay "Học Tăng Cường Từ Phản Hồi Của AI". Tuy nhiên, không giống như Meta, các công ty này ít khi công bố các mô hình của mình để công chúng sử dụng.

Cao Phong (theo Reuters)

Xem thêm

Gemini vượt mốc 1 tỷ người dùng hàng tháng

Gemini vượt mốc 1 tỷ người dùng hàng tháng

(CLO) Giám đốc điều hành Google Sundar Pichai ngày 11/8 thông báo ứng dụng Gemini đã vượt mốc một tỷ người dùng hoạt động hàng tháng, trở thành một trong những sản phẩm phát triển nhanh nhất của tập đoàn.

OpenAI cho ra mắt mô hình AI an ninh mạng

OpenAI cho ra mắt mô hình AI an ninh mạng

(CLO) OpenAI triển khai GPT-5.6-Cyber, mô hình AI chuyên dụng cho an ninh mạng, trong bối cảnh các cuộc tấn công do tác nhân AI thực hiện ngày càng gia tăng.

Lần đầu AI tạo ra virus chưa từng tồn tại trong tự nhiên

Lần đầu AI tạo ra virus chưa từng tồn tại trong tự nhiên

(CLO) Các nhà khoa học Mỹ vừa công bố thành công trong việc tạo ra các loại virus mới bằng AI, mở ra triển vọng phát triển các phương pháp điều trị tiên tiến nhưng cũng làm dấy lên những lo ngại về nguy cơ đối với an ninh sinh học.

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

(NB&CL) Trí tuệ nhân tạo (AI), đặc biệt là AI Tạo sinh, đang tái định hình hệ sinh thái truyền thông toàn cầu. Bên cạnh cơ hội nâng cao hiệu quả báo chí, AI cũng đặt ra những thách thức về tính xác thực, đạo đức nghề nghiệp, quyền riêng tư và niềm tin công chúng. Vì vậy, cùng với thúc đẩy ứng dụng, các quốc gia đang chú trọng xây dựng cơ chế quản trị AI theo hướng minh bạch, an toàn và có trách nhiệm. Đây cũng là yêu cầu đặt ra đối với Việt Nam trong quá trình chuyển đổi số báo chí và truyền thông.

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

(CLO) Thủ đô Bắc Kinh của Trung Quốc đã đưa 72 robot vào hoạt động tại 14 công viên trên địa bàn thành phố trong mùa hè năm nay, đảm nhiệm nhiều công việc như dọn vệ sinh, tuần tra, hướng dẫn du khách, phát hiện côn trùng gây hại và nhắc nhở các hành vi vi phạm.

Google lại bị phạt 1 tỷ USD vì độc quyền

Google lại bị phạt 1 tỷ USD vì độc quyền

(CLO) Ủy ban châu Âu ngày 23/7 thông báo phạt Google 890 triệu euro (khoảng 1 tỷ USD) vì vi phạm Đạo luật Thị trường Kỹ thuật số (DMA), cáo buộc hãng công nghệ Mỹ lạm dụng vị thế thống lĩnh để ưu tiên các dịch vụ của mình và gây bất lợi cho đối thủ.

Cỡ chữ bài viết: