5号线的生物辅助功能减少:切换到5号线的功能明显减少

21 八月 202618 视图

Anthropic完善了模型的生物保障,在测试中将假阳性降低约85%. 现在用户在日常健康和生物学问题上遇到的开关较少,而敏感议题仍然受到限制.

5号线的生物辅助功能减少:切换到5号线的功能明显减少

变了

Anthropic宣布了对其5号线模型生物保障的重大更新. 以前,该系统经常会错误地阻断与生物学相关的请求,并将它们重定向到一个不太强大的版本——Opus 5. 现在,公司认为,在所有产品界面中,这种转机的数量已经下降了大约85%。 这意味着,正常用户在处理医疗或教育专题时,如在解释实验室结果、分析症状或研究学术环境中的生物学时,会明显减少遇到拒绝的情况。

重要的是,最新情况也影响到专业领域。 医生和其他医务人员在从事临床工作时,将能够从第5号线获得更多的支持,而不会被突然的"弹跳"分散到Opus 5. 对公司本身来说,这是在日常情况下更自然地使用模型的一个步骤,这些情况下需要生物环境,但不会带来严重风险。

为什么限制生物学

最初,Fable 5推出时几乎完全屏蔽了生物查询. 这不是一场意外,而是蓄意妥协:该模式在这一领域具有非常强大的能力,在一些复杂任务中能够比专家更出色。 在恶意行为者的手中,这种潜力可以大大加速生物武器的发展——根据Anthropic的估算,攻击者的能力大幅提高.

问题是,AI在生物学中的有益使用与有害使用之间的界限极其模糊. 即使治疗疾病,有时也需要使用危险的化合物:活疫苗或基于有毒成分的药物是主要的例子。 一个狡猾的对手可以利用这种模棱两可的情况来掩盖他们的真实意图,作为无害的研究查询。 美国情报界2026年年度威胁评估的预测进一步加剧了这一局面:合成生物学和基因组编辑的进展可能引发新的生物威胁,一些国家可能继续实施进攻性生物武器和化学武器计划.

为了降低风险,公司故意选择限制:该模型被开放给其他领域,但生物学几乎完全关闭. 对这一决定作了简单解释——双重用途领域错误的代价可能是灾难性的。

保护是怎样运作的

更新系统的核心是安全分类器——自动AI模块,用于检测执行受保护的生物任务或识别有害输出的请求. 当这种分类器触发时,请求会自动被重定向到Opus 5,其生物能力要低得多.

开发准确的分类器是一项复杂的工程挑战。 它要求正确区分允许和不允许的请求,调整系统,使其既不会产生虚假的阳性,也不会漏掉,并保护它免遭越狱袭击。 在发布会上,Anthropic使用一个刻意广义的生物分类器,让用户更早地访问Fable 5,只有到那时才能调查和完善其行为. 如果公司决定等待更先进的保障措施,该型号的一般发布会推迟数周甚至数月.

尚没有的

尽管情况有显著改善,但5号线仍然将属于双重用途类别的请求改用于Opus 5。 这适用于病毒学,毒理学,和分子设计. 因此,该模型尚不适合专业的生物研究或药物开发——反应可用于伤害的风险太高了.

然而,Anthropic说,它不打算就此作罢。 这些计划包括为合格的专家创建可信赖的进入该模型先进生物能力的途径。 这将缩小AI在生物医学中的安全性和实用性之间的现有差距,而不为恶意行为者打开一个"潘多拉盒子".

结论

更新第5号线的保障措施是朝着平衡实用和安全迈出的显著一步。 假阳性减少意味着这个模式在教育,医学和日常咨询中变得更加有用. 然而,关键的双重用途风险依然存在,公司故意保留"切断"最危险请求的权利. 人们只能希望,通过建立可信赖的进入机制,AI的力量也能够用于严肃的生物研究,而不会产生新的威胁.

常问问题

5 恢复生物保护和减少切换 Opus 5