AI不足以保护社交媒体社区免受AI影响
当前的社交媒体内容审核系统主要依赖于机器学习分类器来分析帖子并标记违规内容,但这些系统难以理解讽刺、俚语等微妙之处,并且可能会错误地将边缘群体的语言视为违规行为。研究表明,AI审核可能导致对边缘群体的过度审查和进一步压制。此外,自动删除不当言论会剥夺人类管理员评估情况的能力,影响社区自我管理能力。Reddit正在测试新的Rules Hub工具,以增强人工审核员对规则执行的控制权,但专家认为减少人力投入是倒退的做法,结合机器检测和人类判断才是更有效的解决方案。AI审核系统可能会产生误判,进一步压制边缘群体,并且自动删除不当言论会削弱社区自我管理能力。Reddit的新Rules Hub工具旨在提高人工审核员的灵活性,但仍需更多的人类判断来确保公平性和有效性。
