今日主轴集中在AI能力跃迁后的风险与治理:OpenAI因Astra触及网络安全关键风险而延迟发布,企业则开始严控令牌成本;蚂蚁百灵开源Ling-3.0-flash,继续推动高效混合推理模型普及。与此同时,GoogleAI团队调整引发战略疑问,AI导师克制性、内容生产质量与算力能源等议题,也显示行业正从单纯追求性能转向安全、成本、组织与社会影响的综合博弈。
OpenAI表示,尚未发布的Astra模型在智能体编程和网络安全领域能力显著提升,按《准备框架》已达到网络安全「关键」风险级别,因此推迟发布。公司将加强隔离测试、网络与工具访问限制、权重加密保护、监控检测和沙箱运行,并澄清该模型未参与此前针对Hugging Face的攻击事件。
蚂蚁集团百灵大模型正式开源原生混合推理模型 Ling-3.0-flash,采用 124B 总参数、5.1B 激活参数的 MoE 架构,提供基础、FP8、FP4、INT4 等版本。模型支持云端 API、单机私有化和高性能部署,指定配置下输出速
Roku 在 FAST 免费广告频道上做新实验,推出一个持续播放 AI 生成内容的频道。文章认为,这类频道原本的价值在于帮助观众重新发现经典影视,如今却被低质量合成内容占据,引发对平台内容生态的质疑。
Simon Willison 把同一组游戏提示词交给 Codex Desktop 的 GPT-5.6 Sol Ultra 复现,结果生成了一个完成度更高的可玩游戏 Moonlight & Mayhem。文章重点不在游戏本身,而在多智能体模式
Simon Willison援引404 Media报道称,企业正因生成式AI令牌消耗快速攀升而收紧成本管理。埃森哲内部数据表明,令牌消耗主力未必是工程师,非技术员工的高频、低效使用行为可能构成重要来源。随着智能体和大模型应用扩张,企业需建立
谷歌本周调整人工智能团队架构,多位核心人物被安排新职,其中包括资深高管杰夫·迪安离开谷歌。此次人事变化发生在谷歌模型竞争力受到质疑之际,也引发外界对其AI战略、DeepMind与谷歌内部协作,以及未来能否应对OpenAI和Anthropic
Hugging Face 博客介绍 Allen Institute for AI 的 TutorMoments 研究,用于评估 AI 导师能否判断学生在不同学习阶段是否需要介入。该研究关注及时提示、适度引导与避免过度帮助之间的平衡,为测量模
威尼斯大学与意大利国家研究委员会团队开发IceBoost v2.0,利用全球冰川超过700万条冰厚测量数据及26项地形、冰流和温度变量,重建冰厚并估算体积。结果显示,不计南极和格陵兰冰盖,全球冰川约含15万立方千米冰,全部融化将使全球平均海