Có một cách hỏng rất riêng của thời này, và nó không giống bất kỳ kiểu hỏng nào trước đây.
Không phải viết dở. Máy viết trôi chảy hơn phần lớn người viết nghiệp dư.
Không phải bịa cả bài. Bịa cả bài thì dễ phát hiện.
Kiểu hỏng đáng ngại là: một chi tiết nhỏ sai, nằm trong một bài đúng gần như hoàn toàn, rồi được năm mươi trang khác chép lại trong hai ngày.
Cơ chế, kể thẳng
Một trang tin dựng tự động hoạt động thế này: lấy tin từ nguồn nào đó, viết lại cho khác chữ, đăng.
Ở bước viết lại, mô hình đôi khi thêm vào một chi tiết mà nguồn không có — một con số tròn trịa hơn, một chức danh nghe hợp lý, một mốc thời gian điền vào chỗ trống. Nó không cố tình; nó điền vào chỗ khuyết bằng thứ có vẻ đúng nhất.
Bài đó lên mạng.
Trang thứ hai lấy bài đó làm nguồn, viết lại lần nữa. Bây giờ chi tiết bịa đã có "một nguồn".
Đến trang thứ mười, chi tiết ấy xuất hiện trong mười bài của mười tên miền khác nhau. Với bất kỳ ai tra cứu — kể cả người tra cẩn thận — nó trông hệt như một sự thật đã được nhiều nơi xác nhận.
Điểm mấu chốt: số lượng nguồn không còn là bằng chứng, vì các nguồn không độc lập. Chúng cùng gốc.
Vì sao đính chính không cứu được
Cứ cho là nguồn gốc phát hiện ra và sửa. Chuyện gì xảy ra?
Bài gốc được sửa. Bốn mươi chín bản sao thì không — vì các trang kia không theo dõi nguồn, và cũng chẳng có động cơ nào để theo dõi.
Thêm nữa, đính chính có lượng người đọc bằng một phần rất nhỏ so với bài gốc. Ai đã đọc tin sai thì phần lớn không bao giờ gặp bản sửa.
Đây không phải hiện tượng mới — báo giấy cũng vậy. Cái mới là tốc độ nhân bản đã vượt xa tốc độ đính chính, và khoảng cách đó ngày càng rộng.
Với doanh nghiệp, đây là rủi ro cụ thể chứ không trừu tượng
Giả sử một chi tiết sai về công ty bạn lọt vào một bài như vậy. Sai lệch về quy mô, về một vụ việc, về người đứng đầu, về một sản phẩm đã ngừng bán.
Bạn liên hệ trang gốc, họ gỡ. Nhưng bốn mươi chín bản kia vẫn còn, và bạn không có cách nào liên hệ hết — nhiều trang không có thông tin liên hệ thật.
Trong sáu tháng sau đó, ai tra tên công ty bạn cũng gặp chi tiết ấy.
Đây là lý do rất thực tế cho một việc rất cũ: phải có một nơi do chính mình kiểm soát, nói rõ mình là ai, làm gì, số liệu thế nào. Không phải để tranh cãi với ai, mà để tồn tại một nguồn thật mà người tra cẩn thận có thể tìm tới.
Trang mạng xã hội không làm được việc này — nội dung trôi, không tra cứu được, và nền tảng có thể đổi luật bất kỳ lúc nào.
Cách kiểm một chi tiết, làm được trong năm phút
Có một thao tác đơn giản mà rất ít người làm.
Lấy chi tiết đáng ngờ — con số, mốc thời gian, tên riêng — rồi tìm xem nguồn sớm nhất nói ra nó là ai, và nguồn đó có dẫn về đâu không.
Nếu tất cả các bài đều xuất hiện trong cùng một khoảng ngắn và không bài nào dẫn về một tài liệu gốc, thì rất có thể cả cụm ấy là bản sao của nhau.
Nếu chi tiết đó là con số, thử tìm nó trong tài liệu gốc: báo cáo, văn bản, thông cáo. Không có ở đó thì nó đến từ đâu?
Thao tác này không cần công cụ gì. Nó chỉ cần thói quen hỏi "ai nói đầu tiên" thay vì "có bao nhiêu nơi nói".
Một hệ quả ít ai nói: nguồn nuôi bị đầu độc dần
Các mô hình mới học từ những gì có trên mạng. Mà những gì có trên mạng ngày càng nhiều thứ do chính chúng sinh ra.
Nghĩa là chi tiết bịa ở vòng một, sau khi được nhân bản khắp nơi, có khả năng quay lại thành dữ liệu học cho vòng sau. Lần này nó không còn là suy đoán điền vào chỗ trống nữa — nó đã trở thành một mẫu hình lặp lại nhiều lần, tức là thứ mà mô hình học rất chắc.
Sai lệch không bị pha loãng theo thời gian. Nó được củng cố.
Đây là lý do vì sao việc giữ lại các nguồn gốc — tài liệu, số liệu công bố, lời người trong cuộc, ghi ở nơi ổn định và tra được — có giá trị lớn hơn nhiều so với cảm nhận thông thường. Không phải để hoài cổ, mà vì đó là điểm neo duy nhất khi mọi bản sao đã trôi.
Phần AI không chạm tới
Nó không đến hiện trường. Không hỏi được người trong cuộc, không thấy được thứ không ai viết ra. Mọi thứ nó có đều là thứ đã có sẵn trên mạng — nghĩa là nó không thể tạo ra thông tin mới, chỉ có thể tổ hợp lại.
Nó không chịu trách nhiệm. Đây là khác biệt căn bản. Một người viết ký tên vào bài thì có cái để mất khi sai. Một hệ thống sinh bài thì không. Và toàn bộ ngành báo chí tử tế dựng trên chính cái "có cái để mất" đó.
Nó không phân biệt được nguồn độc lập với nguồn cùng gốc. Nó thấy nhiều bài nói giống nhau và coi đó là bằng chứng — đúng cái bẫy vừa mô tả. Người biết nghề thì hỏi ngay: bốn mươi bài này lấy từ đâu ra?
Nó không quyết định được cái gì đáng đăng. Việc chọn đề tài, chọn thời điểm, chọn không đăng thứ có hại dù nó câu được nhiều lượt xem — đó là phán đoán mang giá trị, không phải phán đoán mang tính kỹ thuật.
Chỗ vẫn còn cơ hội
Nghịch lý là: càng nhiều nội dung dựng tự động, giá trị của một nguồn tin thật sự đáng tin càng cao.
Khi ai cũng có thể xuất bản một trăm bài mỗi ngày, thứ khan hiếm không phải bài viết. Thứ khan hiếm là một địa chỉ mà người ta biết chắc đằng sau có người chịu trách nhiệm.
Và một địa chỉ như vậy bắt đầu bằng một cái tên. Không phải một trang trên nền tảng của người khác, có thể bị đổi luật hoặc khoá bất kỳ lúc nào.
Khi khâu làm ra nội dung đã rẻ tới mức ai cũng làm được, cái tên là thứ duy nhất không thể sao chép và tích luỹ được theo thời gian.
AiTinTuc.com nói đúng chủ đề, đủ ngắn để nhớ, và đọc lên là biết ngay nó bàn về cái gì.
Tên miền nhắc trong bài: AiTinTuc.com