Cộng đồng viết truyện dựa trên nhân vật có sẵn (fanfiction) đang trải qua một cuộc khủng hoảng niềm tin. Trong tuần qua, một phong trào mới nổi lên với mục tiêu truy lùng những tác giả bị nghi sử dụng AI tạo sinh để viết truyện, thay vì tự tay sáng tác. Vấn đề là công cụ dùng để “bắt bài” AI lại có độ tin cậy rất đáng ngờ, và bất kỳ tác giả nào — dù trong sạch — cũng có thể trở thành nạn nhân oan.
Công cụ “phát hiện Claude” gây bão mạng
Sự ác cảm với việc dùng Claude, ChatGPT và các công cụ AI khác từ lâu đã tồn tại trong giới sáng tạo, bao gồm cả thế giới fanfiction. Người đọc và người viết vẫn thường chia sẻ cho nhau các “dấu hiệu” nhận biết văn bản do AI viết, từ việc lạm dụng gạch ngang dài (em dash) cho tới thứ được gọi là “văn phong màu mè” (purple prose).
Nhưng vào ngày 29/6, một tài khoản X ẩn danh có tên @heatedrivalryai đã công bố thứ được cho là giải pháp đáng tin cậy hơn: một skin (giao diện tùy biến, tương tự extension) dành cho AO3 (Archive of Our Own) — trang lưu trữ fanfic phổ biến nhất hiện nay. Skin này tuyên bố có thể phát hiện dấu vết mã code mà chatbot Claude của Anthropic để lại trong văn bản.
Theo tài khoản này, khi nội dung do Claude tạo ra được dán trực tiếp vào AO3, đoạn văn sẽ bị bọc trong một đoạn mã có tên “font-claude-response-body”. “Sự xuất hiện của đoạn mã này khẳng định chắc chắn việc sử dụng Claude”, tài khoản viết. Khi người dùng truy cập một trang chứa mã này, toàn bộ nền màn hình sẽ chuyển sang màu đỏ.
Tác giả bài viết trên The Verge, Jess Weatherbed, đã tự thử nghiệm công cụ này với các bài đăng mẫu trên AO3 và xác nhận: màn hình chuyển đỏ ngay khi cô dán trực tiếp nội dung từ Claude vào ô soạn thảo, nhưng dấu hiệu này biến mất nếu văn bản (dù nội dung y hệt) được dán từ một nguồn không phải trực tiếp từ Claude.
Dễ bị “bắt nhầm”, dễ lách luật
Người tạo ra công cụ khẳng định mục đích chỉ là chứng minh hệ thống hoạt động, không nhằm “tạo ra môi trường nghi kỵ hay cáo buộc người dùng cụ thể”. Nhưng cộng đồng fandom đã nhanh chóng huy động lực lượng để công khai bóc mặt và chỉ trích các tác giả bị công cụ này đánh dấu. Người tạo công cụ cũng không ngần ngại thể hiện quan điểm cá nhân rằng AI là một điều tiêu cực: “Fandom là không gian kết nối và hợp tác độc đáo. Nó sống nhờ yếu tố con người và tia sáng sáng tạo. Nếu chúng ta vô tình để AI làm hoen ố những không gian này, thì còn lại gì?”
Anthropic không phản hồi yêu cầu xác minh của The Verge về việc công cụ này hoạt động chính xác như mô tả hay không. Tuy nhiên, tác giả bài viết cho rằng về mặt kỹ thuật, phương pháp này có vẻ hợp lý — vì không có lý do gì đoạn mã của Claude lại xuất hiện trong một câu chuyện nếu chatbot này không được sử dụng theo cách nào đó.
Dù vậy, công cụ này tồn tại nhiều lỗ hổng nghiêm trọng. Đoạn mã chỉ được giữ lại nếu văn bản được dán trực tiếp từ Claude vào trình soạn thảo của AO3 — nghĩa là nó sẽ không phát hiện được bất cứ nội dung nào đã qua chỉnh sửa ở Google Docs hoặc Microsoft Word trước khi đưa lên AO3. Một số tác giả bị đánh dấu đã nhanh chóng chỉnh sửa lại tác phẩm để xóa dấu vết, và những tác phẩm tương lai hoàn toàn có thể né được công cụ này một cách dễ dàng.
Ngược lại, việc bị đánh dấu cũng không cho biết mức độ sử dụng AI trong tác phẩm là bao nhiêu. Màn hình đỏ chớp lên có thể đồng nghĩa toàn bộ câu chuyện do AI viết hoàn toàn, hoặc chỉ là tác giả dán vài câu do con người viết vào Claude để kiểm tra lỗi chính tả hoặc dịch thuật, rồi copy lại vào AO3. Nhưng với nhiều thành viên fandom, bất kỳ việc sử dụng AI tạo sinh nào cũng bị xem là sự phản bội không thể tha thứ đối với cộng đồng sáng tạo, một phần vì lo ngại về tác động môi trường của công nghệ này và việc các mô hình AI được huấn luyện bằng cách thu thập dữ liệu từ web mở — trong đó rất có thể bao gồm cả các fanwork được đăng trên những nền tảng như AO3.
Chưa có giải pháp đáng tin cậy nào
Công cụ này cũng có phạm vi áp dụng rất hạn chế: AO3 không phải nền tảng duy nhất để đăng fanfic, và Claude cũng chỉ là một trong nhiều mô hình AI. Có người tuyên bố đã viết một đoạn mã riêng có thể phát hiện việc sử dụng “Claude, DeepSeek, và một phần ChatGPT”, nhưng chưa công khai giải pháp này hay giải thích cách nó hoạt động. Google và OpenAI cũng chưa phản hồi câu hỏi của The Verge về việc mô hình của họ có để lại dấu vết nào có thể phát hiện tương tự hay không.
Theo tác giả bài viết — người đã theo dõi vấn đề phát hiện AI trong nhiều năm — sẽ rất bất ngờ nếu tồn tại một hệ thống đáng tin cậy tuyệt đối, vì hiện tại chưa có giải pháp công nghệ nào phân biệt chắc chắn văn bản do AI tạo ra với văn bản do con người viết tay. Các hệ thống như C2PA Content Credentials hay SynthID của Google đang có tiến bộ trong việc nhận diện AI tạo sinh ở hình ảnh, video, thậm chí âm thanh, nhưng những công nghệ này dựa vào watermark vô hình và metadata — thứ không thể giữ lại khi văn bản bị copy-paste.
Trong khi chờ công nghệ hoàn thiện hơn, giải pháp thực tế nhất hiện có trên AO3 chính là hệ thống tag sẵn có của trang này: thẻ “Created Using Generative AI” (Tạo bằng AI tạo sinh) đã tồn tại và nhiều tác giả chủ động dùng để công khai việc sử dụng Claude hay các công cụ tương tự. Nhưng điều này đòi hỏi sự trung thực tự nguyện — và trong bối cảnh làn sóng chỉ trích gay gắt như hiện nay, gần như chẳng ai có động lực để thành thật. Tác giả bài viết cũng nhắc nhở rằng suy cho cùng, fanfiction vốn là một sở thích, không phải một ngành công nghiệp bị quản lý chặt chẽ.
Trong lúc cộng đồng cố gắng ngăn AI “cướp” sự chú ý khỏi những tác phẩm sáng tạo thực sự của con người, những tác giả viết không theo “chuẩn chất lượng” được cộng đồng ngầm định cũng có thể trở thành nạn nhân oan của cuộc săn lùng này. Đã có ít nhất một tác giả bị vạ lây chỉ vì người mà họ tin tưởng để biên tập truyện đã dùng Claude mà không nói trước. Vì vậy, nếu lần tới bạn đọc một fanfic có cảm giác hơi “máy móc”, hãy nhớ rằng đó chưa chắc là sản phẩm của một con robot.
Nguồn tham khảo: AI | The Verge — Biên tập bởi Cà Phê AI.

