AI新模型误拦科研查询,官方道歉承诺优化
来源:李智衍发布时间:2026-06-15248浏览
询问 AI据《财富》杂志和《华尔街日报》报道,Anthropic近期推出了全新的人工智能模型Claude Fable 5。该模型实际上是Claude Mythos模型的对外发布版本。由于原版模型具备极强的漏洞挖掘能力,Anthropic认为其风险过高,从而限制了访问权限。为了控制风险,Claude Fable 5内置了安全护栏机制。当用户涉及生物化学武器或网络安全等敏感领域时,系统会弹出提示,并自动切换至性能较弱的Claude Opus 4.8模型进行回复。
然而,该安全机制的实际拦截范围超出了预期。许多用户反馈,即便是基础的数学和生物学问题也会被系统拒绝回答,导致科研人员无法正常开展工作。有学者指出,单个企业不应有权决定哪些科学问题可以被提问。
此外,为了防止竞争对手利用“蒸馏”技术窃取模型能力,Anthropic以国家安全和服务条款为由,在未提前通知用户的情况下,暗中降低了此类人工智能开发相关问题的回复质量。这项限制条款被隐藏在长达数百页的模型说明文档中,据Anthropic估计,受影响的查询流量仅占约0.03%。
这一系列操作引发了人工智能安全研究员、开源社区以及Anthropic前员工的广泛不满。美国艾伦人工智能研究所(Ai2)研究员Nathan Lambert批评此举剥夺了研究人员使用顶尖模型的权限。普林斯顿大学研究员Sayash Kapoor也表示,暗中降低模型表现会影响外界对其真实能力的评估。
面对争议,Anthropic已公开致歉,承认在安全与可用性之间未能取得良好平衡。公司承诺未来在实施相关限制时会同步显示通知,并计划向生命科学领域开放无安全护栏限制的版本,以推动生物医疗研究和创新药物的开发。
新闻来源:李智衍,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。

