Reddit trao quyền cho AI tự xóa bài vi phạm nội quy

Reddit mở rộng vai trò của AI trong kiểm duyệt nội dung với Rules Hub, hệ thống có thể tự động phát hiện, báo cáo hoặc xóa bài viết vi phạm.

Reddit để AI tham gia sâu hơn vào kiểm duyệt nội dung

Reddit vừa công bố Rules Hub, hệ thống kiểm duyệt mới ứng dụng mô hình ngôn ngữ lớn (LLM), đánh dấu bước tiến mới trong việc sử dụng trí tuệ nhân tạo để quản lý nội dung trên nền tảng. Khác với các công cụ trước đây chỉ hỗ trợ phát hiện vi phạm, Rules Hub có thể được cấp quyền tự động xóa bài viết hoặc bình luận nếu quản trị viên (moderator) cho phép. Động thái này cho thấy Reddit đang đẩy mạnh ứng dụng AI nhằm giảm tải khối lượng công việc cho hàng nghìn moderator, đồng thời nâng cao hiệu quả kiểm duyệt trong bối cảnh lượng nội dung do người dùng tạo ra ngày càng lớn.

Trước khi Rules Hub xuất hiện, Reddit chủ yếu dựa vào đội ngũ moderator tình nguyện cùng công cụ Automoderator (Automod). Hệ thống này hoạt động theo các quy tắc cố định do quản trị viên thiết lập, chẳng hạn phát hiện từ khóa hoặc mẫu nội dung cụ thể để gắn cờ và xử lý. Tuy nhiên, cách tiếp cận này vẫn tồn tại nhiều hạn chế khi người dùng có thể thay đổi cách diễn đạt để "qua mặt" bộ lọc. Reddit từng thử nghiệm AI với tính năng Post Check, cho phép cảnh báo người dùng nếu bài đăng có nguy cơ vi phạm quy định của cộng đồng, nhưng quyền quyết định đăng tải vẫn thuộc về người dùng.

AI hiểu ngữ cảnh thay vì chỉ dò từ khóa

Điểm khác biệt lớn nhất của Rules Hub nằm ở khả năng phân tích ngôn ngữ tự nhiên. Thay vì chỉ kiểm tra sự xuất hiện của các từ khóa đã được lập trình sẵn, AI có thể đánh giá liệu một bài viết hoặc bình luận có phù hợp với tinh thần của nội quy hay không. Điều này giúp hệ thống xử lý tốt hơn những trường hợp nội dung vi phạm nhưng được diễn đạt theo nhiều cách khác nhau hoặc không chứa từ khóa cụ thể.

Dù được trao thêm quyền, AI vẫn không hoạt động hoàn toàn độc lập. Reddit cho biết moderator sẽ quyết định AI được phép thực thi những quy định nào và lựa chọn hình thức xử lý phù hợp. Khi phát hiện dấu hiệu vi phạm, hệ thống có thể chỉ gắn cờ để con người xem xét, tự động xóa nội dung hoặc không thực hiện bất kỳ hành động nào. Theo Reddit, AI đóng vai trò hỗ trợ, còn quyền kiểm soát cuối cùng vẫn thuộc về quản trị viên của từng cộng đồng.

Reddit triển khai rộng nhưng moderator vẫn thận trọng

Rules Hub đã được thử nghiệm trong nhiều tháng trên hơn 700 cộng đồng với sự tham gia của cả các moderator mới lẫn những quản trị viên giàu kinh nghiệm. Sau giai đoạn thử nghiệm, Reddit bắt đầu kích hoạt mặc định công cụ này cho tất cả các subreddit mới và dự kiến mở rộng ra toàn bộ nền tảng trong năm 2026.

Tuy nhiên, phản hồi từ cộng đồng moderator vẫn khá trái chiều. Một số người đánh giá hệ thống hoạt động hiệu quả trong nhiều tình huống nhưng chưa đủ ổn định để giao toàn quyền xử lý nội dung. Không ít nhóm quản trị hiện chỉ sử dụng AI như một công cụ gắn cờ, sau đó vẫn tiến hành kiểm tra thủ công trước khi đưa ra quyết định cuối cùng. Điều này phản ánh tâm lý thận trọng khi AI ngày càng được trao nhiều quyền hơn trong việc quản lý các cộng đồng trực tuyến.

Reddit khẳng định AI chỉ hỗ trợ kiểm duyệt, còn moderator vẫn giữ quyền quyết định cuối cùng.

AI sẽ thay đổi cách Reddit kiểm duyệt nội dung

Về lâu dài, Reddit kỳ vọng Rules Hub sẽ dần thay thế nhiều tác vụ mà Automoderator đang đảm nhiệm, đồng thời kết hợp với các công cụ như Post and Comment Guidance hay Safety Filters để xây dựng quy trình kiểm duyệt thông minh hơn. Dù vậy, công ty nhấn mạnh AI không phải là sự thay thế cho moderator mà chỉ là trợ lý giúp giảm khối lượng công việc và nâng cao hiệu quả xử lý.

Việc Reddit mở rộng quyền hạn cho AI diễn ra không lâu sau khi nền tảng này vấp phải nhiều tranh cãi liên quan đến các thay đổi trong chính sách quản lý cộng đồng. Bởi vậy, cách Rules Hub được triển khai trong thời gian tới sẽ là phép thử quan trọng, không chỉ đối với công nghệ AI mà còn với niềm tin của các moderator - lực lượng giữ vai trò cốt lõi trong việc duy trì chất lượng nội dung trên Reddit.

App hẹn hò tỷ đô lao đao vì càng thành công càng mất khách

Mô hình kiếm tiền của ứng dụng hẹn hò đang bộc lộ nghịch lý: người dùng tìm được tình yêu cũng là lúc doanh nghiệp mất khách trả phí.

Ngành app hẹn hò từng tăng trưởng bùng nổ nhờ mô hình thu phí theo tháng và thao tác vuốt trái, vuốt phải đã quen thuộc với hàng trăm triệu người dùng. Tuy nhiên, bức tranh năm 2026 đang cho thấy những dấu hiệu thay đổi mạnh mẽ. Bumble - một trong những tên tuổi lớn nhất thị trường - vừa tuyên bố sẽ loại bỏ tính năng vuốt, biểu tượng đã gắn liền với thương hiệu suốt hơn một thập kỷ. Quyết định này được đưa ra sau khi lượng người dùng trả phí giảm khoảng 21% trong quý I/2026, kéo doanh thu đi xuống và buộc công ty phải tìm hướng đi mới. Động thái của Bumble không chỉ phản ánh khó khăn của riêng doanh nghiệp mà còn cho thấy mô hình kinh doanh truyền thống của ngành ứng dụng hẹn hò đang đứng trước áp lực phải thay đổi.

Điểm nghịch lý nằm ở chính cách các nền tảng kiếm tiền. Phần lớn ứng dụng hẹn hò thu phí thuê bao để mở khóa nhiều lượt thích hơn, nhiều bộ lọc hơn hoặc tăng khả năng hiển thị hồ sơ. Điều đó đồng nghĩa doanh thu chỉ tồn tại khi người dùng vẫn còn độc thân và tiếp tục sử dụng ứng dụng. Một khi họ tìm được bạn đời, họ cũng đồng thời rời khỏi nền tảng, khiến doanh nghiệp mất đi một khách hàng trả phí. Nhiều chuyên gia cho rằng đây là rào cản khiến các "ông lớn" khó thay đổi mô hình. Trong khi đó, một khảo sát về Gen Z và Millennials cho thấy tỷ lệ người trẻ cảm thấy cô đơn vẫn ở mức rất cao, dù họ sở hữu nhiều công cụ kết nối hơn bất kỳ thế hệ nào trước đây. Khoảng trống này đang mở ra cơ hội cho một thế hệ startup mới với cách tiếp cận hoàn toàn khác: thay vì bán khả năng "lướt hồ sơ", họ bán cơ hội gặp gỡ ngoài đời thực.

Vì sao Telegram bị Apple gỡ khỏi App Store rồi mở lại?

Apple xác nhận Telegram bị gỡ khỏi App Store vì nội dung CSAM, nhưng ứng dụng nhanh chóng trở lại sau khi xử lý tài khoản vi phạm.

Việc Telegram bất ngờ biến mất khỏi App Store trên phạm vi toàn cầu vào tối 3/8 đã khiến cộng đồng người dùng xôn xao, đồng thời làm dấy lên nhiều đồn đoán về nguyên nhân thực sự. Sau nhiều giờ giữ im lặng, Apple đã chính thức xác nhận quyết định này không liên quan đến lỗi kỹ thuật hay tranh chấp thương mại, mà xuất phát từ quá trình rà soát nội dung trên nền tảng. Theo thông tin gửi tới nhiều cơ quan báo chí quốc tế, trong đó có Bloomberg và 9to5Mac, Apple phát hiện nội dung vi phạm chính sách nghiêm ngặt về tài liệu xâm hại tình dục trẻ em (CSAM) trên Telegram. Sau khi nền tảng xử lý nội dung và khóa tài khoản liên quan, ứng dụng đã nhanh chóng được khôi phục trên App Store. Toàn bộ sự việc chỉ diễn ra trong vài giờ, người dùng đã cài Telegram trước đó vẫn có thể sử dụng bình thường và không bị ảnh hưởng đến dữ liệu hay các cuộc trò chuyện.

Không lâu sau khi được khôi phục, Telegram đã có phản hồi theo hai cách hoàn toàn khác nhau. Trên mạng xã hội X, tài khoản chính thức của nền tảng đăng tải dòng trạng thái mang tính hài hước, ám chỉ rằng những tin đồn về việc Telegram "biến mất" đã bị thổi phồng quá mức. Tuy nhiên, trong tuyên bố gửi Forbes, công ty lại thể hiện quan điểm cứng rắn hơn. Telegram khẳng định Apple chỉ báo cáo duy nhất một tài khoản phát tán nội dung CSAM và tài khoản này đã bị khóa ngay lập tức. Đồng thời, hãng công bố các số liệu kiểm duyệt nội bộ nhằm chứng minh nỗ lực xử lý loại nội dung này. Theo Telegram, chỉ riêng năm 2026, nền tảng đã xóa hơn 337.900 nhóm và kênh liên quan đến CSAM. Trước đó, trong năm 2025, Telegram cũng thực hiện gần 30.000 lượt gỡ bỏ theo báo cáo từ các tổ chức như National Center for Missing & Exploited Children (NCMEC). Công ty còn đặt câu hỏi liệu Apple có áp dụng cùng một tiêu chuẩn nghiêm ngặt đối với tất cả ứng dụng trên App Store hay không.

App độc hại mới trên Android có thể âm thầm rút sạch tài khoản

Một biến thể mới của phần mềm độc hại RedHook, có khả năng chiếm quyền truy cập shell bằng cách lừa người dùng cấp quyền truy cập trợ năng.

Các nhà nghiên cứu vừa phát hiện một loại phần mềm độc hại mới có khả năng xâm nhập sâu vào điện thoại và chiếm quyền truy cập cấp cao thông qua ADB không dây, nhằm chiếm đoạt tài khoản ngân hàng của người dùng.

Đây là phiên bản nâng cấp của trojan truy cập từ xa RedHook từng bị phát hiện vào năm ngoái, nhưng đã được bổ sung nhiều chức năng chống phát hiện.

Đọc nhiều nhất

Tin mới