Robot AI mới của Google có thể tự sắp xếp bàn làm việc và 'chơi bóng rổ'

Các mô hình mới mang tên Gemini Robotics và Gemini Robotics-ER, được thiết kế để giúp robot thích ứng với môi trường phức tạp bằng cách tận dụng khả năng suy luận của các mô hình ngôn ngữ lớn, nhằm thực hiện các nhiệm vụ thực tế phức tạp. 

Một robot chạy mô hình AI Gemini Robotics đặt một quả bóng vào rổ mini. Ảnh: Google DeepMind

Theo Google DeepMind, một robot được huấn luyện bằng các mô hình mới này có thể gấp giấy thành hình con cáo origami, sắp xếp bàn làm việc theo hướng dẫn bằng lời nói, quấn dây tai nghe và thực hiện cú úp rổ bóng rổ mini. Công ty cũng đang hợp tác với start-up Apptronik để chế tạo robot hình người sử dụng công nghệ này. 

Sự phát triển này diễn ra trong bối cảnh các tập đoàn công nghệ, bao gồm Tesla và OpenAI, cùng các start-up đang chạy đua để xây dựng "bộ não" AI có thể vận hành robot một cách tự động, hứa hẹn thay đổi nhiều ngành công nghiệp, từ sản xuất đến chăm sóc sức khỏe.

Jensen Huang, CEO của hãng sản xuất chip Nvidia, cho biết việc sử dụng AI tạo sinh để triển khai robot ở quy mô lớn đại diện cho cơ hội trị giá hàng nghìn tỷ đô la, mở đường cho "ngành công nghệ lớn nhất mà thế giới từng chứng kiến". 

Tiến bộ trong lĩnh vực robot tiên tiến đã tiến triển chậm chạp trong những thập kỷ gần đây, khi các nhà khoa học phải lập trình thủ công từng động tác của robot. Nhờ các kỹ thuật AI mới, các nhà khoa học đã có thể huấn luyện robot thích ứng tốt hơn với môi trường xung quanh và học các kỹ năng mới nhanh hơn.

Kanishka Rao, kỹ sư phần mềm chính tại Google DeepMind, cho biết: "Gemini Robotics có tính tổng quát gấp đôi so với các mô hình tốt nhất trước đây của chúng tôi, thực sự tạo ra bước tiến đáng kể hướng tới các robot đa dụng". 

Để tạo ra mô hình Gemini Robotics, Google đã sử dụng mô hình ngôn ngữ Gemini 2.0 và huấn luyện nó đặc biệt để điều khiển robot. Điều này cải thiện hiệu suất của robot và cho phép chúng thực hiện ba nhiệm vụ: điều chỉnh theo các tình huống mới khác nhau, phản ứng nhanh chóng với hướng dẫn bằng lời nói hoặc thay đổi trong môi trường, và đủ khéo léo để thao tác các vật thể.

Để phát triển Gemini Robotics, Google DeepMind đã tận dụng hiểu biết rộng về thế giới của các mô hình ngôn ngữ lớn được huấn luyện trên dữ liệu từ internet. Ví dụ, một robot có thể suy luận rằng nó nên cầm một tách cà phê bằng hai ngón tay.

Ken Goldberg, giáo sư robot tại Đại học California, Berkeley, người không tham gia vào nghiên cứu, nhận xét: "Đây chắc chắn là một phát triển thú vị trong lĩnh vực robot, dường như dựa trên thế mạnh của Google về dữ liệu và tính toán quy mô lớn".

Russ Tedrake, giáo sư tại Viện Công nghệ Massachusetts và phó chủ tịch nghiên cứu robot tại Viện Nghiên cứu Toyota, nhận xét: "Đây là một nỗ lực toàn diện ấn tượng với các kết quả thuyết phục, từ suy luận không gian đến thao tác khéo léo. Đó là bằng chứng khá thuyết phục rằng các mô hình cơ sở mạnh hơn có thể dẫn đến hiệu suất thao tác tốt hơn".

Giáo sư Goldberg cho biết: "Gemini là một bước quan trọng", tuy nhiên vẫn "còn nhiều việc phải làm trước khi các robot đa dụng sẵn sàng được áp dụng rộng rãi". 

Cao Phong (theo FT, NYT, Fortune)

Xem thêm

Gemini vượt mốc 1 tỷ người dùng hàng tháng

Gemini vượt mốc 1 tỷ người dùng hàng tháng

(CLO) Giám đốc điều hành Google Sundar Pichai ngày 11/8 thông báo ứng dụng Gemini đã vượt mốc một tỷ người dùng hoạt động hàng tháng, trở thành một trong những sản phẩm phát triển nhanh nhất của tập đoàn.

OpenAI cho ra mắt mô hình AI an ninh mạng

OpenAI cho ra mắt mô hình AI an ninh mạng

(CLO) OpenAI triển khai GPT-5.6-Cyber, mô hình AI chuyên dụng cho an ninh mạng, trong bối cảnh các cuộc tấn công do tác nhân AI thực hiện ngày càng gia tăng.

Lần đầu AI tạo ra virus chưa từng tồn tại trong tự nhiên

Lần đầu AI tạo ra virus chưa từng tồn tại trong tự nhiên

(CLO) Các nhà khoa học Mỹ vừa công bố thành công trong việc tạo ra các loại virus mới bằng AI, mở ra triển vọng phát triển các phương pháp điều trị tiên tiến nhưng cũng làm dấy lên những lo ngại về nguy cơ đối với an ninh sinh học.

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

Quản trị AI trong truyền thông: Kinh nghiệm quốc tế và gợi ý chính sách cho Việt Nam

(NB&CL) Trí tuệ nhân tạo (AI), đặc biệt là AI Tạo sinh, đang tái định hình hệ sinh thái truyền thông toàn cầu. Bên cạnh cơ hội nâng cao hiệu quả báo chí, AI cũng đặt ra những thách thức về tính xác thực, đạo đức nghề nghiệp, quyền riêng tư và niềm tin công chúng. Vì vậy, cùng với thúc đẩy ứng dụng, các quốc gia đang chú trọng xây dựng cơ chế quản trị AI theo hướng minh bạch, an toàn và có trách nhiệm. Đây cũng là yêu cầu đặt ra đối với Việt Nam trong quá trình chuyển đổi số báo chí và truyền thông.

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

Robot AI thay người dọn rác, tuần tra và bắt muỗi ở Trung Quốc

(CLO) Thủ đô Bắc Kinh của Trung Quốc đã đưa 72 robot vào hoạt động tại 14 công viên trên địa bàn thành phố trong mùa hè năm nay, đảm nhiệm nhiều công việc như dọn vệ sinh, tuần tra, hướng dẫn du khách, phát hiện côn trùng gây hại và nhắc nhở các hành vi vi phạm.

Google lại bị phạt 1 tỷ USD vì độc quyền

Google lại bị phạt 1 tỷ USD vì độc quyền

(CLO) Ủy ban châu Âu ngày 23/7 thông báo phạt Google 890 triệu euro (khoảng 1 tỷ USD) vì vi phạm Đạo luật Thị trường Kỹ thuật số (DMA), cáo buộc hãng công nghệ Mỹ lạm dụng vị thế thống lĩnh để ưu tiên các dịch vụ của mình và gây bất lợi cho đối thủ.

Google Cloud tăng trưởng bùng nổ nhờ AI

Google Cloud tăng trưởng bùng nổ nhờ AI

(CLO) Alphabet, công ty mẹ của Google, vừa công bố báo cáo thu nhập mới nhất cho thấy sự tăng trưởng mạnh mẽ, phần nào giải tỏa nỗi lo của các nhà đầu tư về việc liệu những khoản chi tiêu khổng lồ cho trí tuệ nhân tạo (AI) có thực sự mang lại lợi ích hay không.

Cỡ chữ bài viết: