- Bài viết
- 6.020
- Được Like
- 11
Lập trình viên đua tạo công cụ 'tẩy' nhãn AI
Nhiều lập trình viên đang tạo công cụ gỡ dấu chìm sau khi công ty Anthropic triển khai tính năng đánh dấu văn bản đầu ra của Claude.
Tuần trước, Anthropic thông báo áp dụng cơ chế đánh dấu "vô hình", một dạng watermark để phân biệt nội dung do AI và con người tạo ra. Cụ thể, công ty đặt ra khuôn mẫu trong cách chọn từ và cụm từ của Claude mà người sử dụng bình thường không thể nhận biết, nhưng người có "chìa khóa" mã hóa phát hiện được. Dấu chìm sẽ đi theo khi văn bản được sao chép và dán lại, giúp truy nguồn gốc.
Trong khi nhiều người ca ngợi động thái mới làm tăng tính minh bạch, số khác cho rằng cách đánh dấu ảnh hưởng đến chất lượng sản phẩm đầu ra của Claude, chưa kể dấu chìm có thể bị gắn vào văn bản dù họ chỉ dùng chatbot để hiệu đính, dịch thuật hoặc tóm tắt. Một số cho biết đã hủy đăng ký Claude vì điều này.
Theo Business Insider, mức độ quan tâm đến từ khóa "công cụ xóa dấu chìm AI" tại Mỹ trên Google Trends tăng 60% so với tuần trước. Thậm chí, nhiều lập trình viên và doanh nhân đã nhanh tay phát triển công cụ tẩy nhãn AI.
Guillaume Meyer, nhà phát triển startup AI Memo, đã thực hiện dự án mã nguồn mở "Watermarks Remover" (Loại bỏ dấu chìm) vài ngày sau khi Anthropic công bố kế hoạch. Công cụ gỡ siêu dữ liệu và ký tự ẩn, sau đó viết lại văn bản sao cho vẫn giữ nguyên ý nghĩa, nhờ đó phá vỡ khuôn mẫu chọn từ ngữ vốn có thể chứa dấu chìm.
Meyer mất khoảng 5 tiếng để phát triển bản đầu tiên và công cụ hiện nhận hơn 14.000 "sao" trên nền tảng dành cho lập trình viên GitHub, tương đương 14.000 "lượt thích".
"Tôi hoàn toàn ủng hộ việc ghi nguồn nội dung, nhưng phản đối kỹ thuật đóng dấu. Hai thứ rất khác nhau", Meyer nói với Business Insider. Anh giải thích, AI có thể để lại dấu chìm khi tạo ra toàn bộ văn bản, nhưng cũng có thể làm vậy khi mọi người chỉ dùng nó để chỉnh sửa nhẹ. Anh gọi đây là "lời giải sai cho một vấn đề có thật".
Trong bài đăng trên X tuần này, chuyên gia đào tạo AI cho doanh nhân Sabrina Ramonov cho biết đã tạo công cụ miễn phí, hoạt động trên trình duyệt, có thể gỡ dấu chìm khỏi văn bản, tài liệu PDF, Word, trang web, hình ảnh, tệp dữ liệu.
Nhà phát triển phần mềm Ansh Aneja ở Tokyo cũng triển khai công cụ xóa dấu chìm tập trung vào Claude ngay trong ngày Anthropic công bố kế hoạch, sau đó phát hành phiên bản mã nguồn mở MarkScrub. Trong bài đăng trên X tuần trước, Aneja thông báo công cụ tăng từ 0 lên 8.500 người dùng chỉ trong một ngày.
Chia sẻ với Wired, kỹ sư Erik Hughes nói anh chỉ mất 15 phút để tạo công cụ hoạt động với Claude giúp loại bỏ ký tự vô hình và trông giống nhau, sắp xếp lại câu trong đoạn văn, thay thế một số từ bằng từ đồng nghĩa.
Theo Leon Chlon, nhà nghiên cứu thỉnh giảng tại Đại học Oxford, một phương án khác để xóa dấu chìm là tóm tắt phản hồi của Claude, dịch sang ngôn ngữ khác như tiếng Arab, vốn khác tiếng Anh, sau đó dịch ngược lại.
Anthropic cũng thừa nhận, nội dung đã qua chỉnh sửa nhiều, diễn đạt lại hoặc dịch sang ngôn ngữ khác có thể không còn mang dấu chìm nữa. Điều này xảy ra do cơ chế đánh dấu được xây dựng dựa trên cách chọn từ và cụm từ của Claude.
Trong một bài đăng trên blog, startup này giải thích, các mô hình ngôn ngữ lớn như Claude hoạt động bằng cách tạo ra từng từ một. Khi cần quyết định từ tiếp theo, mô hình lựa chọn trong danh sách "ứng viên" phù hợp dựa trên đoạn văn trước đó. Ví dụ, từ tiếp theo trong câu "Trời hôm nay lạnh và...", nhiều khả năng là "u ám" hoặc "xám xịt". Mô hình chọn từ nào thường không quan trọng với người đọc, vì ý nghĩa câu trong cả hai trường hợp đều giống nhau về cơ bản.
Kỹ thuật đánh dấu vô hình của Anthropic tận dụng những lựa chọn ít rủi ro như vậy, vốn xuất hiện nhiều lần trong văn bản đầu ra, để tạo một khuôn mẫu trong phản hồi của Claude. Các lựa chọn vẫn được thực hiện ngẫu nhiên, nhưng nguồn gốc của sự ngẫu nhiên lại khác. Thay vì dùng bộ tạo số ngẫu nhiên tùy ý để hiển thị từ tiếp theo, dấu chìm sử dụng "chìa khóa" và một số từ đứng trước để quyết định. Người giữ "chìa khóa" kiểm tra trật tự từ và xem có nhất quán với những lựa chọn mà Claude thực hiện theo dấu chìm hay không. Nếu có, văn bản đó có thể do AI tạo ra.
Anthropic lưu ý, không phải lúc nào mô hình cũng sẽ thiên về "u ám" hoặc "xám xịt". Cũng giống văn bản không đánh dấu, "u ám" có thể được chọn trong câu này và "xám xịt" xuất hiện trong câu khác, tùy những từ đứng trước. Kỹ thuật đánh dấu vô hình cũng không ép Claude chọn một từ bất hợp lý mà mô hình vốn không cân nhắc.
Phát ngôn viên Anthropic chia sẻ với Wired, công ty thêm dấu hiệu nhận biết vào sản phẩm đầu ra của Claude nhằm tuân thủ Đạo luật AI của Liên minh châu Âu (EU), và các công ty khác cũng đang làm điều tương tự.
"Xác định văn bản do AI tạo rất khó, bước đi mới sẽ cung cấp cho mọi người công cụ để nhận diện. Văn bản từ những mô hình Claude được hỗ trợ, bao gồm Claude Code, sẽ chứa dấu vô hình. Nó không làm thay đổi ý nghĩa, chất lượng hay tính dễ đọc của phản hồi từ Claude", phát ngôn viên Anthropic nói, thêm rằng công ty dự định cung cấp một giao diện lập trình ứng dụng (API) phát hiện văn bản để người dùng có thể chủ động nhiều hơn trong nhận diện văn bản AI.
Theo Konrad Kollnig, phó giáo sư tại Phòng thí nghiệm Luật và Công nghệ thuộc Đại học Maastricht, Đạo luật AI của EU và các điều khoản của Anthropic đều không cấm rõ ràng việc mọi người tạo hoặc chia sẻ công cụ xóa dấu chìm.
Tuy nhiên, Kollnig cảnh báo người dùng có thể gặp rắc rối nếu sử dụng chúng để đánh tráo nguồn gốc, biến sản phẩm AI thành của con người. Chính sách sử dụng của Anthropic nghiêm cấm mạo danh người khác bằng cách trình bày kết quả từ mô hình như thể đó là sản phẩm do con người tạo ra.
Anthropic không phải công ty duy nhất ứng dụng kỹ thuật giúp nhận diện nội dung AI. Trước đó, Google dùng công nghệ SynthID để "đóng dấu" sản phẩm trí tuệ nhân tạo, OpenAI cũng áp dụng với hình ảnh và âm thanh. Tuy nhiên, Google bắt đầu nới lỏng khi bổ sung tùy chọn để người dùng chủ động bật tắt dấu chìm trên ảnh, video, nhạc do Gemini tạo ra. Mạng xã hội X của Elon Musk cũng thêm nhãn "Tạo bằng AI" vào nội dung sản xuất bằng công nghệ này. Tuần trước, dịch vụ phát nhạc trực tuyến Spotify bắt đầu gắn nhãn "AI Persona" cho những hồ sơ chứa nội dung trí tuệ nhân tạo.
Nguồn: VnExpress Số hóa
Chuyên mục: HOT