来自该信源的全部动态 · 共 55 条
机器之心用高考真题横测多款顶级大模型,一款国产模型取得708分,被称为「屏蔽生」。文章比较不同模型在语文、数学、理综等科目的表现,讨论推理能力、中文理解、答题稳定性与评测方式对成绩的影响。
机器之心消息,计算机安全领域知名学者宋晓冬已加入Meta,其团队也一同加盟。该动态显示Meta继续吸纳安全与可信计算方向人才,可能服务于AI系统安全、隐私保护或基础安全研究布局。
北大团队提出面向AI视频理解的实时通信框架Artic,尝试让网络传输不再只优化人眼感知质量,而是根据大模型的理解状态动态分配码率与时延资源,提升视频分析任务在实时场景下的有效性与效率。
机器之心发布ACL 2026论文分享会报名提醒,活动将于6月27日在北京举行,面向关注自然语言处理与大模型研究的读者,提供论文解读和交流机会。信息主要是线下活动通知,未披露具体议程或论文内容。
机器之心报道,一款面向加油站场景的防爆机器人已投入使用,宣称获得国内首张防爆资质,并推出全球首个「加油大脑」方案。该系统将机器人本体、感知决策与站内设备联动,用于危化环境下的自动加油与安全作业。
影石开源 UniSHARP,称为首个统一平面透视、广角、鱼眼与 360° 全景相机的单目 3DGS 模型,面向多相机三维重建与新视角合成场景,降低不同镜头参数下的适配成本。
机器之心介绍翁荔最新博客,讨论缩放定律在大模型发展中的适用边界:现有规律多基于经验拟合,对数据质量、模型架构、推理计算和涌现能力解释不足,提醒研究者避免将其视为确定性路线图。
机器之心报道,一家由Anthropic前员工创办的AI公司完成2亿美元融资,英伟达参投,估值约10亿美元。公司方向涉及递归自我改进,指向更强自主学习与能力迭代的AI系统,反映资本继续押注前沿智能体与模型自优化路线。
浙江大学与上海 AI Lab联合探索LabVLA,面向科学实验室构建视觉-语言-动作具身智能能力,目标是让AI不仅理解实验任务,还能操作仪器、执行流程并辅助科研自动化,补齐从「会思考」到「会动手」的关键环节。
上海AI实验室将在ACL 2026圣地亚哥现场举办北极星 X 星启交流会,面向参会者开放报名。活动偏学术社交与项目交流,具体议程信息有限,适合已计划参会者关注。
机器之心报道,Claude Code 相关线索显示其被用于为游戏「Fable 5」回归做准备,并提到 Anthropic CEO Dario Amodei 在谈判中的角色变化。内容更偏行业轶闻与 AI 编程工具应用观察,反映大模型编码助手进入游戏开发流程的趋势。
快手提出RaG思路,将推荐从匹配既有视频推进到生成用户可能想看的内容形态。文章介绍其在短视频推荐中的目标、技术路径与产业含义,反映推荐系统正与生成模型深度融合。
机器之心转载一位博士生在读博最后一年转向并获得OpenAI offer的面试复盘,重点记录研究方向调整、求职准备、面试过程中的意外与经验教训。内容更偏个人职业路径分享,可供计划进入顶尖AI实验室的研究生参考。
UIUC等提出FreeOrbit4D,可在无需训练的情况下,仅用一段单目视频重建动态4D场景,实现任意视角运镜、时间冻结和「子弹时间」效果。方法面向视频编辑、三维内容生成与动态场景重建,入选SIGGRAPH 2026。
报道称,谷歌DeepMind的人才流失仍在持续,多名长期在伦敦工作的资深研究员和工程师转向美国AI公司或创业项目。现象反映顶尖模型人才竞争加剧,薪酬、算力、创业机会与产业重心向硅谷集中,正削弱伦敦AI中心的人才优势。
机器之心梳理Anthropic内部关于Claude与Agent实践的观点:不要沿用旧评测方式衡量新模型,重点在让Agent完成从执行、验证到反馈修正的闭环。文中提到Claude在内部代码合并中的高占比,并强调评测与工作流设计需贴近真实任务。
机器之心介绍一篇入选ICML 2026 Spotlight的观点论文,讨论图像生成模型是否正偏离真实人类艺术,并可能通过训练数据、推荐反馈与审美偏好循环,反向影响人类对图像质量和艺术性的判断。
清华大学与微软提出STAR-PólyaMath,在大模型外部构建探索、推理、验证闭环,用于数学竞赛解题。报道称其横扫八大数学竞赛,并在Apex基准上较GPT-5.5高13.5%,强调框架化提升复杂推理能力。
机器之心报道,一名谷歌员工将 Google Workspace 接入 OpenClaw 后被公司解雇,引发对 AI Agent 生态中平台接口、员工个人项目边界、数据权限与竞业风险的讨论。事件本身技术细节有限,更偏行业观察。
创智、复旦与牛津团队在ICML 2026发布AutoControl-Arena,面向AI Agent安全评测,尝试让系统自动生成未知长尾场景,快速暴露潜在失控与风险行为,为前沿风险发现提供基准和方法。