Tiểu thuyết gia 'nổi dậy' phản đối AI, kêu gọi chấm dứt thời đại nội dung miễn phí

(CLO) Trong hơn 20 năm, Kit Loffstadt đã viết tiểu thuyết về các vũ trụ song song trong “Chiến tranh giữa các vì sao”, nhân vật phản diện “Buffy the Vampire Slayer” và chia sẻ những tiểu thuyết này miễn phí trực tuyến.

Nhưng vào tháng 5, cô đã ngừng đăng các tác phẩm của mình sau khi biết rằng một công ty dữ liệu đã sao chép các câu chuyện của cô và đưa chúng vào công nghệ trí tuệ nhân tạo làm nền tảng cho ChatGPT.

tieu thuyet gia noi day phan doi ai keu goi cham dut thoi dai noi dung mien phi hinh 1

Tác giả tiểu thuyết trực tuyến Kit Loffstadt. Ảnh: NYT

Bài liên quan

Hội đồng Bảo an Liên hợp quốc sắp lần đầu họp bàn về rủi ro AI

Hollywood đình công, đòi sự công bằng trong thời đại trực tuyến và AI

Chatbot Bard của Google được triển khai ra thế giới, có thể nói tiếng Việt

Meta phát hành mô hình AI thương mại nhằm bắt kịp các đối thủ

Cuộc "nổi dậy" cần thiết

Loffstadt cũng đã giúp tổ chức một hoạt động "nổi dậy" vào tháng trước chống lại AI. Cùng với hàng chục nhà văn viết tiểu thuyết khác, cô đã xuất bản một loạt các câu chuyện "tào lao" trên mạng để gây nhầm lẫn cho các dịch vụ thu thập dữ liệu.

Loffstadt, một diễn viên lồng tiếng 42 tuổi đến từ Nam Yorkshire, Anh cho biết: “Mỗi người chúng tôi phải làm bất cứ điều gì có thể để cho họ thấy sản phẩm sáng tạo của chúng tôi không thể bị máy móc thu thập một cách tùy ý".

Các tác giả tiểu thuyết chỉ là một nhóm hiện đang tổ chức các cuộc nổi dậy chống lại hệ thống AI. Trong những tháng gần đây, các công ty truyền thông xã hội như Reddit và Twitter, các tổ chức tin tức bao gồm The New York Times và NBC News, các tác giả như Paul Tremblay và nữ diễn viên Sarah Silverman đều có quan điểm chống lại việc AI thu thập dữ liệu một cách trái phép.

Các cuộc biểu tình của họ đã diễn ra dưới nhiều hình thức khác nhau. Các nhà văn và nghệ sĩ đang khóa các tác phẩm của họ hoặc đang tẩy chay một số trang web xuất bản nội dung do AI tạo ra, trong khi các công ty như Reddit muốn tính phí truy cập vào dữ liệu của họ.

Ít nhất 10 vụ kiện đã được đệ trình trong năm nay chống lại các công ty AI, cáo buộc các công ty này đào tạo hệ thống dựa trên các tác phẩm sáng tạo của các nghệ sĩ mà chưa có sự đồng ý của tác giả. Tuần trước, bà Silverman cùng các tác giả Christopher Golden và Richard Kadrey đã kiện OpenAI, nhà sản xuất ChatGPT và những người khác về việc để chatbot này sử dụng tác phẩm của họ.

Các cuộc nổi loạn đang cho thấy rằng thông tin trực tuyến, bao gồm các câu chuyện, tác phẩm nghệ thuật, các bài báo và ảnh có thể có giá trị đáng kể chưa được khai thác.

Việc sử dụng các mô hình ngôn ngữ lớn để lập trình AI khiến các công ty công nghệ cực kỳ "đói" dữ liệu. Google, Meta và OpenAI về cơ bản đã sử dụng thông tin từ khắp nơi trên internet, bao gồm cơ sở dữ liệu lớn về tiểu thuyết trực tuyến, các bài báo và tuyển tập sách, những thứ có sẵn trên mạng một cách miễn phí. 

GPT-3 của OpenAI, một hệ thống AI được phát hành vào năm 2020, bao gồm 500 tỷ “mã thông báo”, mỗi mã đại diện cho các phần của từ được tìm thấy chủ yếu trên mạng. Một số mô hình AI khác có hơn một nghìn tỷ mã thông báo.

Hoạt động thu thập dữ liệu trên internet đã có từ lâu. Nhưng nó không được các công ty sở hữu dữ liệu coi là vấn đề đặc biệt. Điều này đã thay đổi sau khi ChatGPT ra mắt vào tháng 11 và công chúng đã biết thêm về các chatbot.

Ông Brandon Duderstadt, người sáng lập và giám đốc điều hành của Nomic, một công ty AI cho biết: “Trước đây, người ta thường nghĩ rằng bạn nhận được giá trị từ dữ liệu bằng cách cung cấp dữ liệu cho mọi người và chạy quảng cáo. Bây giờ, các thông tin có nhiều giá trị hơn khi sử dụng làm đầu vào cho AI, và vì thế mọi người đang khóa các dữ liệu trên mạng".

Thời đại nội dung miễn phí sắp kết thúc

Những gã khổng lồ công nghệ giàu có như Google và Microsoft đã ngồi trên hàng núi thông tin độc quyền và có đủ nguồn lực để truy cập nhiều dữ liệu hơn. Nhưng khi thời đại của nội dung miễn phí trực tuyến sắp kết thúc, các công ty AI mới thành lập và phi lợi nhuận từng hy vọng cạnh tranh với các công ty lớn có thể không có đủ nội dung để đào tạo hệ thống của họ.

Trong một tuyên bố, OpenAI cho biết ChatGPT đã được đào tạo về “nội dung được cấp phép, nội dung có sẵn công khai và nội dung do con người cung cấp”. 

“Chúng tôi tôn trọng quyền của người sáng tạo và tác giả đồng thời mong muốn tiếp tục hợp tác với họ để bảo vệ lợi ích của các tác giả", thông cáo nói thêm.

Google cho biết trong một tuyên bố rằng họ đã tham gia vào các cuộc thảo luận về cách các nhà xuất bản có thể quản lý nội dung của họ trong tương lai. “Chúng tôi tin rằng mọi người đều được hưởng lợi từ một hệ sinh thái nội dung sôi động", công ty cho biết. Microsoft đã không trả lời yêu cầu bình luận.

Hoàng Tôn (theo NYT)

Xem thêm

Google lại bị phạt 1 tỷ USD vì độc quyền

Google lại bị phạt 1 tỷ USD vì độc quyền

(CLO) Ủy ban châu Âu ngày 23/7 thông báo phạt Google 890 triệu euro (khoảng 1 tỷ USD) vì vi phạm Đạo luật Thị trường Kỹ thuật số (DMA), cáo buộc hãng công nghệ Mỹ lạm dụng vị thế thống lĩnh để ưu tiên các dịch vụ của mình và gây bất lợi cho đối thủ.

Google Cloud tăng trưởng bùng nổ nhờ AI

Google Cloud tăng trưởng bùng nổ nhờ AI

(CLO) Alphabet, công ty mẹ của Google, vừa công bố báo cáo thu nhập mới nhất cho thấy sự tăng trưởng mạnh mẽ, phần nào giải tỏa nỗi lo của các nhà đầu tư về việc liệu những khoản chi tiêu khổng lồ cho trí tuệ nhân tạo (AI) có thực sự mang lại lợi ích hay không.

Doanh nghiệp Việt muốn bứt phá phải biết dùng AI, không thể mãi cạnh tranh bằng giá

Doanh nghiệp Việt muốn bứt phá phải biết dùng AI, không thể mãi cạnh tranh bằng giá

(CLO) Trong kỷ nguyên AI, lợi thế của doanh nghiệp không còn nằm ở quy mô hay giá bán mà ở khả năng đổi mới sáng tạo, tạo ra giá trị khác biệt và thấu hiểu khách hàng. Đây là nhận định được các chuyên gia đưa ra tại Diễn đàn Chiến lược Kinh doanh "The Future of Business" diễn ra tại TP.HCM chiều 22/7.

Trung Quốc phát triển AI 'đọc' dark web, phát hiện nội dung phạm pháp

Trung Quốc phát triển AI 'đọc' dark web, phát hiện nội dung phạm pháp

(CLO) Các nhà nghiên cứu thuộc Đại học Cảnh sát Điều tra Hình sự Trung Quốc đã phát triển một hệ thống trí tuệ nhân tạo (AI) có khả năng thu thập và phân tích nội dung trên dark web bằng tiếng Trung, nhằm hỗ trợ phát hiện các hoạt động phạm pháp trên không gian mạng.

Meta hầu tòa vì cáo buộc Instagram gây nghiện

Meta hầu tòa vì cáo buộc Instagram gây nghiện

(CLO) Meta Platforms sẽ phải hầu tòa tại bang Tennessee (Mỹ) vào ngày 20/7 để đối mặt với cáo buộc Instagram được thiết kế theo cách "gây nghiện" cho thanh thiếu niên, làm trầm trọng thêm cuộc khủng hoảng sức khỏe tâm thần ở giới trẻ.

Google thua kiện vụ quảng cáo cờ bạc trên YouTube

Google thua kiện vụ quảng cáo cờ bạc trên YouTube

(CLO) Google đã thất bại trong nỗ lực hủy khoản phạt 750.000 euro liên quan đến các video quảng cáo cờ bạc trên nền tảng YouTube, sau khi Tòa án Công lý Liên minh châu Âu (CJEU) ra phán quyết có lợi cho cơ quan quản lý truyền thông của Ý.

Mạng xã hội X điều chỉnh thuật toán, giúp 'bạn bè' gắn kết hơn

Mạng xã hội X điều chỉnh thuật toán, giúp 'bạn bè' gắn kết hơn

(CLO) Giám đốc sản phẩm của mạng xã hội X, Nikita Bier, ngày 13/7 đã thông báo về một sự thay đổi quan trọng trong cách hiển thị nội dung trên nền tảng này nhằm mục đích tăng khả năng hiển thị các bài đăng từ những người dùng có mối quan hệ hai chiều, tức những tài khoản theo dõi lẫn nhau.

Apple kiện OpenAI với cáo buộc đánh cắp bí mật thương mại

Apple kiện OpenAI với cáo buộc đánh cắp bí mật thương mại

(CLO) Ngày 10/7, Apple đã đệ đơn kiện OpenAI cùng một số cựu nhân viên lên Tòa án Quận Bắc California (Mỹ), cáo buộc công ty này tiến hành một chiến dịch có hệ thống nhằm chiếm đoạt bí mật thương mại về phần cứng để phục vụ tham vọng phát triển thiết bị tiêu dùng.

OpenAI chính thức phát hành mô hình GPT-5.6 mới

OpenAI chính thức phát hành mô hình GPT-5.6 mới

(CLO) Ngày 9/7, OpenAI chính thức phát hành dòng mô hình GPT-5.6 gồm ba phiên bản Sol, Terra và Luna. Đây là lần đầu tiên công ty từ bỏ cách đặt tên bằng số để chuyển sang các tên gọi mới nhằm giúp người dùng dễ phân biệt cấp độ hiệu năng và chi phí giữa các mô hình.

Cỡ chữ bài viết: