今日主轴集中于AI治理、安全与商业化的同步推进。Anthropic一边收紧Claude使用政策、限制持续虐待模型,并向美国Genesis Mission投入1.5亿美元;另一边推出面向开源项目的免费安全扫描。OpenAI则面临研究人员对安全文化的质疑、营收预期下修及新闻版权诉讼,同时加速模型产品迭代。模型评测、智能体监控、自主渗透测试和AI融入科研,显示行业正从能力竞赛转向安全、基础设施与制度建设。
Anthropic将于2026年11月12日生效的新政策,首次禁止用户持续且无必要地虐待或残忍对待Claude,主要措施为终止对话。政策同时扩大武器开发禁令,禁止未经同意追踪个人、辅助刑事司法决策,并要求连接危险硬件时配备人工监督。
Anthropic推出OSS Scanner,面向自愿加入的开源项目免费提供由其最强模型执行的定期、深入安全扫描,帮助更早发现潜在漏洞。项目方需权衡代码接入、数据处理和误报等风险,服务细节及覆盖范围仍有待进一步明确。
GitHub 新锐项目 ARTEX 是一套面向自主渗透测试的 AI 系统,曾获百度「agent+」攻防挑战赛冠军,目前获得约 643 星。项目聚焦将智能体用于目标发现、漏洞分析与攻击验证等安全流程,适合安全研究人员和 AI Agent 开发
Goodfire推出面向AI代理的监控系统,通过观察模型内部运行状态识别异常行为,而非让另一个AI逐条审查代理输出。系统仅在检测到可疑迹象时调用额外模型,有望降低持续监控成本,并提升对失控代理的响应效率。
AgentMemoryRepo 是一个面向智能体记忆系统的规范项目,旨在定义记忆仓库的结构、接口或实现约束。项目已在 GitHub Rising 获得约 628 颗星,但当前公开摘要信息有限,尚不足以判断其具体技术方案、成熟度及实际落地范围
Anthropic宣布向美国Genesis Mission投入1.5亿美元,以支持科学研究和技术探索,并将向15个以上联邦机构提供Claude及技术支持。此举显示其正扩大与美国政府及科研体系的合作,也意味着通用模型企业开始更深度参与国家级科
三名前OpenAI研究员在遭解雇后发布公开信,称公司处理相关事件可能让员工不敢对外表达安全观点,损害内部安全文化。三人认为,与外部机构合作是其工作职责;OpenAI则称他们违反敏感信息访问和处理规定,双方对解雇理由存在明显分歧。
天体物理学家布里斯·梅纳尔借助Claude Science检索并整合已有观测数据,再用统计推断填补紫外波段的天空观测空白,绘制出首张完整紫外天空图。据Anthropic称,这项工作原本需数周,借助Claude缩短至数天。