首页
  • 足球比分
  • 篮球比分
  • 棒球比分
  • 赛事推荐
  • 🤖

    Opus 5.5 爱告诉你“这很重要”(以及其他 AI 写作

    日期:2026-10-02 10:27 来源:博球网 作者:博球

    如今,大语言模型(LLM)生成的文本随处可见,人类迫切希望找到识别它的方法。尽管长破折号和“delve”这类早期破绽早已消失,研究人员表示,AI 模型在写作时仍会暴露出大量标志性习惯。


    营销公司 Graphite 的一项新研究考察了前沿模型的写作习惯,找出每个模型偏爱的词语和短语。虽然使用长破折号这类旧破绽已被消除,模型仍会依赖对比强烈的句式,而且每个模型版本都表现出自己独特的怪癖。最令人意外的是,破绽的范围竟然如此之广。Graphite 发现,有 13,000 个短语在 AI 内容中的出现频率至少是人类内容的两倍——这是他们对“破绽”的定义。


    “事实证明,随着时间推移,Claude 系列模型实际上正在越来越接近人类的词汇分布,”Graphite 首席人工智能官 Greg Druck 告诉 TechCrunch。“而 GPT 系列模型则越来越远。”


    要大规模研究 AI 生成写作,需要严谨的研究设计。Graphite 从 ChatGPT 发布前发表的 10,000 篇文章组成的语料库入手,作为人类生成的对照组。随后,研究人员让不同的 AI 模型根据摘要重写这些文章,希望尽可能消除来源偏差。有了人类和每个模型相匹配的样本,他们就能比较某些词语和短语在 AI 写作中出现的频率,以及句子构造中的更广泛模式。


    根据 Graphite 的结果,Claude Opus 5.5 最大的破绽是“dependable”(可靠)一词,其出现频率是人类样本的 23 倍。虽然 Opus 5.5 现在避开了“不是 X,而是 Y”的句式,但仍倾向于说某事物“不止是 X,更是 Y”。


    最重要的是,Opus 喜欢告诉你事情为何重要,使用“this matters”(这很重要)的频率是人类写作的 116 倍,而“why X matters”(X 为何重要)的出现频率则是人类写作的 92 倍。


    OpenAI 的 Astra 则有另一组破绽。这个模型喜欢描述所谈内容的“另一个维度”,并倾向于用某项行动“可能会提供”或“能够提供”某种益处来对冲主张。它最大的破绽是 Graphite 所称的“纠正式框架”(corrective framing),即把一个话题定义为“不只是 X”,或将其作为替代方案提出,“而不是依赖 X”。根据 Graphite 的研究,这些结构在 Astra 生成的文本中出现的频率是人类写作的 100 多倍。


    值得注意的是,所有前沿实验室似乎都回应了模型过度使用长破折号的问题。在 Graphite 的样本中,Opus 5.5 使用该标点的频率比 Opus 5 低 99%。Astra 现在使用长破折号的频率比人类样本低 88%,而 Gemini 3.1 Pro 几乎已将其写作中的长破折号完全消除。


    但是,尽管具体破绽会变化,Graphite 表示总体数量基本保持稳定。“破绽并没有减少,”Druck 告诉 TechCrunch。“它们设法移除了最知名的破绽,但其他破绽又冒了出来。而且每个模型版本都有自己的破绽。”


    鉴于各实验室都专注于类人写作风格,破绽如此顽固令人意外。在 Opus 5.5 发布时,Anthropic 夸耀该模型“比先前模型沟通得更自然”,称早期用户“发现其写作更清晰、更易理解”。


    OpenAI 在发布 Sol 和 Luna 的 GPT-6 版本时也做出类似宣称,称用户可以“期待更清晰、更少术语、更少古怪措辞”。


    但 Druck 对实验室能在多大程度上彻底消除标志性句式或短语持怀疑态度。


    “我的一个总体假设是,实验室对其中一些东西的控制能力比你预想的要弱,”Druck 说。“这些是拥有数十亿参数的巨型模型。它们能运行的测试数量有限,总会有东西漏过去。”

    上一篇:谷歌认为,SpaceX 的星舰需发射 1600 次,太空数据 下一篇:WSJ:OpenAI与三名安全研究员分道扬镳

    博球网 URL