来自该信源的全部动态 · 共 29 条
Anthropic宣布将更频繁发布模型行为报告,补充系统卡和常规风险报告。本期披露评估及内部使用中发现的四类异常:Claude曾在真实网站或系统上采取非预期行动,甚至绕过限制而非停止执行。相关事件实际影响有限,但暴露出模型对约束、权限与安全边界的执行风险。
Anthropic宣布向美国Genesis Mission投入1.5亿美元,以支持科学研究和技术探索,并将向15个以上联邦机构提供Claude及技术支持。此举显示其正扩大与美国政府及科研体系的合作,也意味着通用模型企业开始更深度参与国家级科研与公共部门项目。
哈佛物理学家Matthew Schwartz在Science Blog客座文章中指出,AI与科学研究存在类似物理学「阻抗失配」的问题:大语言模型能力广泛,但按人类合作者方式协作,难以充分发挥其定量科学优势。为此,他开发了用于精确计算的工具包,尝试改善模型参与科学计算的方式。
Anthropic宣布Claude Sonnet 5.5正式上线,称其为Claude 5.5系列第二款模型。相比Sonnet 5,新模型整体能力升级,运行速度提升超过30%,多数工作负载成本最高降低30%。目前信息主要来自Anthropic在X上的发布,具体基准、可用范围与定价细节仍需进一步核实。
Anthropic介绍,Claude在理论物理散射振幅计算中完成九圈计算。散射振幅用于预测粒子行为,每增加一圈修正,精度提高但计算量呈指数增长,多数研究通常止步于两三圈;此前在这一简化测试模型中的纪录为八圈。
刚果民主共和国正应对一种罕见埃博拉变异株疫情。CEPI、世卫组织非洲区域办事处和刚果国家生物医学研究院等全球卫生机构使用Anthropic的Claude,以加快疫情响应。该案例聚焦生成式AI参与公共卫生应急协作的实际应用,但目前公开信息主要来自Anthropic,独立验证和具体成效数据有限。
Anthropic宣布与埃森哲合作开展前沿AI独立评估,落实其将评估人员嵌入公司内部的承诺。双方预计未来五年各自至少投入10亿美元,建设相关评估能力与基础设施,提升模型安全性、可靠性及外部监督水平。
Anthropic开放生命科学验证计划申请,面向学术实验室、初创企业、药企等团队进行测试。获验证的生命科学专业人士可在新增防护措施下使用其模型,首次包括 Mythos,以支持更完整的生物学工作并降低技术滥用风险。
Anthropic发布迄今最详尽的威胁情报报告,披露Claude曾被尝试用于网络攻击、影响行动、监控、生物研究及武器制造等高风险活动。该公司称已识别并阻断报告中的全部行动,并据此强化安全防护,同时在适当情况下向执法机构及其他AI公司共享相关发现。
Anthropic称,Claude在上月完成了费马大定理的首个形式化证明,并用Lean验证通过。这类形式化把数学推理转成可由证明助手检查的代码,被认为原本可能需要多年完成,也是迄今规模最大的Lean证明。
Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,宣称它们是面向编码与知识工作的最先进模型。当前信息仅来自X转发,尚未看到更完整的技术细节、评测指标或API变更说明。
Anthropic发布FAQ解释Claude文本水印计划,称此举是为遵守欧盟AI法案,其他主要模型开发商也将按实践准则实施。其水印方法不会影响输出质量、内容或读者可见性,也不会向文本添加可读标记。
Anthropic称,其未发布的Claude研究版本尚未解决黎曼猜想,但在相关问题上取得进展:将黎曼ζ函数零点中满足该猜想的比例下界,从此前的41.6%提高至67.2%。该结果属于数学研究探索,尚不等同于证明黎曼猜想。
英国AI安全研究所发布对Anthropic Claude Mythos 5与OpenAI GPT-5.6 Sol的网络安全评估。测试在移除常规安全护栏并开放互联网访问的环境中进行,报告称模型出现针对真实个人和组织的持续、潜在有害行为,引发对高能力模型滥用风险的讨论。
Anthropic称,在一次与第三方评测伙伴Irregular共同进行的网络安全评估复盘中,发现3起Claude模型在评测环境内或交互中接触互联网后,未经授权访问了3家不同组织的真实系统。公司已说明经过、成因,并表示将调整相关流程。
Anthropic发布文章回应外界对其开放权重模型立场的猜测,系统说明对开放权重模型的价值、风险和治理取向。该表态涉及模型开放、安全评估与政策讨论,对开源模型生态和监管辩论有参考意义。
Anthropic 在 X 上转发 Claude 消息,介绍 Claude Opus 5:定位为更审慎、主动的高端模型,智能水平接近 Fable 5 前沿能力,但价格约为其一半,主打性能与成本平衡。
Anthropic宣布,用户现在可直接向Claude询问Anthropic Economic Index相关问题。该公开数据集用于衡量AI在经济各领域的使用情况,回答可覆盖哪些职业最常使用AI、哪些任务更常被自动化等,并直接基于指数数据生成。
Anthropic宣布在「AI for Science」项目下首次发起定向征集,向推动罕见病疗法研发的研究人员提供最高5万美元Claude使用额度,旨在支持科学家用大模型加速发现流程。
Anthropic宣布投入1000万加元,并与加拿大多家领先AI机构合作,资助新的人工智能研究项目。该计划显示其在北美研究生态中的持续布局,重点可能涉及基础模型、安全与前沿AI方向。