今日焦点集中在 OpenAI、Google、Anthropic 的模型与产品更新:前者收紧 Astra 网络安全能力开放,后者推进 ChatGPT 医疗系统集成与 Gemini 3.7 Flash 发布;产业侧则有融资、量产和版权训练博弈,显示 AI 正从能力竞赛走向行业落地与合规边界。
OpenAI称下一代模型Astra已达到准备框架中网络安全「关键」门槛,可自主发现并利用真实关键系统中的零日漏洞。公司计划很快发布该模型,但高级网络安全能力初期仅向少量测试人员开放,并逐步扩展。
Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,宣称它们是面向编码与知识工作的最先进模型。当前信息仅来自X转发,尚未看到更完整的技术细节、评测指标或API变更说明。
OpenAI表示将把ChatGPT接入医疗团队常用系统、信息和工作流,新增面向受支持Epic环境的EHR集成,并通过插件连接另外九个行业数据源,进一步推进医疗场景落地。
GitHub 新锐项目,提供一套面向 Claude Code 和 Codex 的 Agent Skill,可将语音驱动的解说视频制作流程自动化。它包含 78 张动效配方卡、逐词级配音同步、反幻灯片式镜头系统和 Remotion 渲染,适合做
HexStellar Cortex 是一个新兴 GitHub 项目,提供 Python CLI 与 API,可为 AI Agent 接入软件加速优化、量子计算、科学计算、决策智能和可验证执行能力,并包含确定性标签、验证回执、示例和免费沙盒。
AI模型训练初创公司AfterQuery据报完成新一轮融资,估值升至32亿美元,距离其今年4月宣布3000万美元A轮仅过去5个月。若属实,这将使其成为Y Combinator历史上最快达到独角兽的公司之一。
地平线宣布征程6M已在20余家车企、70余款量产车型上车,其中7家品牌实现城区辅助驾驶平台化落地。该芯片具备128TOPS算力,支持一段式端到端城区辅助驾驶方案,并推动城区NOA向10万级主流车型及燃油车扩展。
AllenAI介绍BenchMIRT,用多维项目反应理论分析LLM基准,拆解题目难度、能力维度与模型表现关系,帮助判断榜单分数背后实际衡量的能力,减少对单一总分的误读。