南加州大学团队Nature子刊发文:大语言模型使用或与语言多样性下降相关
近日,南加州大学团队及其合作者在Nature子刊Nature Human Behaviour发表研究论文,揭示大语言模型(LLM)作为写作助手的普及,与语言多样性下降存在关联。
研究人员分析了超过88万篇文本,涵盖新闻文章、学术论文、议论文、社交媒体帖子和演讲等类型,发现LLM的使用与写作风格的趋同化趋势相关,并削弱了文本中与个人身份、性格和心理健康相关的线索。
研究通过三项分析展开:其一,观察ChatGPT发布后arXiv论文摘要、Patch News文章和Reddit创意故事等数据集中写作复杂度方差的变化,发现多个平台出现显著性下降,且AI使用率可预测后续方差变化;同时控制实验表明,LLM改写会显著压缩写作风格方差。其二,利用配对的心理测量数据训练分类器,比较原始文本与LLM改写文本后,发现个人特质预测准确率平均下降约6%,其中年龄的F1值从0.351降至0.260,且改写后的文本系统性地偏向特定画像。其三,许多经典“词-人”关联在LLM改写后消失,如外向性与代词使用、忠诚度与朋友类词汇、年龄与未来导向词汇的关联,但部分关联仍保留,呈现选择性侵蚀。
研究团队指出,语言多样性下降可能对临床心理健康识别、个性化营销、招聘公平性及文化保护带来挑战,并提到LLM生成文本进入语料库后可能形成反馈循环,进一步削弱语言多样性。该研究也强调,旨在提升写作清晰度的AI工具,同样需要在技术应用中关注表达多样性的保留。
- 2026-09-18 00:24 | 新浪:Nature子刊:当8亿人都在用AI写作,语言多样性正在快速消失阅读原文
(来源:图灵人工智能)转自学术头条,仅用于学术分享,如有侵权留言删除 “我们正在把语言塑造成它最终的形态,即当没有人再说别的语言时的那种形态。”英国作家乔治·奥威尔(George Orwell)在反乌托邦小说《1984》中如是说。 如今,某种类似的趋势,可能正在真实世界发生。 本周,一篇由南加州大学(USC)团队及其合作者发表在 Nature 子刊 Nature Human Behaviour 上的研究论文揭示:大语言模型(LLM)作为写作助手的普及,正在与语言多样性的下降联系在一起。 简单来说就是,LLM 正在让来自我们不同人的文字“越来越像”。 论文链接:https://www....