一项大规模研究显示,自2022年以来,互联网上由人工智能生成的内容迅速增加,据infohub.kz网站报道。
皮尤研究中心分析了2021年1月至2026年7月期间收集的约49万个英文网页。在2022年11月ChatGPT发布后发布的随机抽样页面中,35%显示出明显的人工智能使用痕迹。搜索引擎和文本模型,如ChatGPT、Google Gemini和Anthropic Claude,对发布内容的影响日益显著。
商业网站上的生成文本浓度最高。在.com域名中,大约每十个页面就有一个包含AI痕迹,而.org域名的这一比例为4.6%,.edu和.gov域名则不超过1%。在流行神经网络出现之前,所有类型网站上的机器文本比例都在1%以内。
分析人士还注意到网络语言习惯的变化。自2023年初以来,长破折号的使用频率翻了一番,牛津逗号的使用频率增加了63%。此外,神经网络特有的词汇,如“delve”和“testament”,使用量增加了一倍多。不过,研究人员强调,这些迹象可能既反映了算法的工作,也可能反映了人类的常规编辑。


