Công nghệ

Twitch mặc định dùng luồng phát của bạn để huấn luyện AI của Amazon và giấu tùy chọn từ chối

Adrian Kessler

Tính năng này xuất hiện một cách lặng lẽ, nằm gọn trong menu bảo mật mà hầu hết các streamer không bao giờ mở đến: một công tắc duy nhất quyết định liệu mọi thứ họ phát sóng có trở thành nhiên liệu cho trí tuệ nhân tạo của Amazon hay không. Trên Twitch, công tắc đó đã được bật sẵn. Để giữ tác phẩm của mình không bị đưa vào dữ liệu huấn luyện, bạn phải biết nó tồn tại, tìm ra nó và tự tay tắt nó đi.

Đây là phần mà các hướng dẫn cách từ chối thường bỏ qua. Việc từ chối không phải là câu chuyện chính. Mặc định mới là câu chuyện chính, và lý do công ty đưa ra cho điều đó cũng vậy.

Trong một buổi phát trực tiếp của công ty, khi được hỏi tại sao tính năng này lại được bật sẵn thay vì tắt, giám đốc sản phẩm của Twitch, Mike Minton, không dùng những ngôn từ thông thường về trao quyền cho người dùng. “Nếu đây là tùy chọn đồng ý, sẽ không ai đồng ý cả,” ông nói. “Đó thực sự là câu trả lời. Vì vậy nó sẽ được bật mặc định.” Đây là điều hiếm có: một giám đốc điều hành mô tả, một cách công khai, một cơ chế đồng thuận được xây dựng để kìm hãm sự đồng thuận.

Những gì được coi là dữ liệu huấn luyện ở đây gần như là tất cả. Theo lời Twitch, các luồng phát của kênh, các buổi phát trước đây, clip, điểm nổi bật, chat, cùng văn bản và hình ảnh trên trang đều có thể được sử dụng để huấn luyện các mô hình Amazon mà nhiệm vụ được tuyên bố là tạo ra hoặc tổng hợp văn bản, âm thanh, hình ảnh và video. Công ty sở hữu nền tảng này nhận được một kho ngữ liệu được làm mới liên tục từ màn trình diễn trực tiếp của con người. Những người tạo ra nó chỉ nhận được một công tắc mà họ chưa từng được thông báo.

Hãy đặt vấn đề theo góc nhìn của Amazon thay vì của streamer, và hình dạng thay đổi. Amazon không đang cào dữ liệu từ trang của đối thủ. Nó sở hữu đường ống, khán giả, và giờ là luồng dữ liệu huấn luyện, và nó đã biến một thập kỷ lao động của người sáng tạo thành một hào dữ liệu độc quyền cho các mô hình mà một ngày nào đó có thể tạo ra chính nội dung mà những người sáng tạo đó bán. Tùy chọn từ chối là dấu hiệu. Nó chỉ điều chỉnh việc huấn luyện trong tương lai, không phải những năm đã được tích lũy, và Minton thừa nhận ông không thể nói những gì đã được làm với dữ liệu đó. “Tôi thực sự không biết câu trả lời cho câu hỏi đó,” ông nói.

Twitch, một cách kỳ quặc, lại đang dẫn trước các đối thủ trên lý thuyết. YouTube huấn luyện trên nội dung tải lên của người sáng tạo mà không có tùy chọn từ chối nào, và Meta cũng làm tương tự trên Facebook và Instagram mà không đưa ra lựa chọn nào. Một công tắc, dù bị chôn vùi, vẫn hơn những gì họ đưa ra. Nhưng đó là cách ngành công nghiệp tự chấm điểm theo đường cong. Câu hỏi mà chủ sở hữu nền tảng phải trả lời không phải là liệu nó có đưa ra ít sự ép buộc hơn Google hay không. Mà là liệu những người có tác phẩm được dùng để huấn luyện mô hình của họ có đồng ý hay không. Giám đốc sản phẩm của chính Twitch đã trả lời câu hỏi đó: nếu được hỏi thẳng thắn, họ đã nói không.

Tắt cài đặt này không ngắt kết nối cỗ máy. Twitch sẽ tiếp tục chạy AutoMod, phụ đề, đề xuất và công cụ quảng cáo trên nội dung kênh, và cho biết những thứ đó không lưu giữ dữ liệu để xây dựng mô hình mới. Việc từ chối cũng không ngăn được lời nói và hình ảnh của streamer xuất hiện trong chat của các kênh khác. Không có cách nào để xem ai đã đồng ý và ai chưa, không có sự minh bạch công khai về sự đồng thuận trên một nền tảng vừa biến sự đồng thuận thành mặc định mà không ai chọn.

Công tắc nằm ở cuối một menu, một lựa chọn trong số nhiều, dễ bị bỏ qua. Đó là thiết kế có chủ đích. Trên nền tảng phát trực tiếp lớn nhất internet, cái giá của việc không đọc kỹ điều khoản giờ đây là một vai trò thường trực, không được trả lương, làm dữ liệu huấn luyện cho công ty sở hữu sân khấu.

Thẻ: , , , ,

Thảo luận

Có 0 bình luận.