来自该信源的全部动态 · 共 39 条
量子位实测 TRAE Work Design:围绕软件开发前期链路,将需求描述转为设计方案并继续生成代码,重点展示对设计系统的识别与还原能力,适合关注 AI 编程、产品原型和前端协作的人参考。
量子位称DeepSeek近期开放30多个招聘岗位,覆盖研发、产品、运营及HR等职能,显示其在模型与商业化推进中的团队扩张需求。该消息更多反映公司组织建设和人才竞争动向,暂未涉及新模型或产品发布。
量子位介绍一项名为置信解码的无训练推理策略:在生成时不直接采用最后一层输出,而是基于中间层置信度选择更可靠答案,以减少对齐带来的推理损耗。据称在奥数任务上准确率提升22.4%,适合关注解码策略与推理优化的研究者。
Octopus提出一种无需保存历史数据的持续学习方法,针对大模型学习新任务时遗忘旧知识的问题,通过机制设计让模型在增量训练中保留既有能力。报道称其效果超过使用全量数据训练,入选CVPR 2026。
量子位称,Claude Fable 5开始分批重新上线,几乎同时出现GPT-5.6相关跟进信号。事件可能意味着两家在新模型灰度、命名与可用性上加速,但公开信息仍有限,需等待官方确认。
一位曾负责苹果AI平台技术的负责人回到深圳创办具身智能公司,近期完成约10亿元融资。其方案强调低成本数据获取,将单条数据成本降至其他方案的1/20至1/200,指向机器人训练数据瓶颈。
量子位采访多位一人公司创业者,观察AI工具普及后个人创业的真实进展:部分团队依靠自动化、Agent和低代码完成产品、获客与交付,但仍面临收入不稳、销售难、精力透支和规模化瓶颈。文章更偏创业样本与趋势观察。
谷歌推出具备电脑控制能力的Gemini Flash版本,可基于屏幕截图理解界面并执行点击、滚动、切换标签页等动作,最多连续操作70轮,面向浏览器与桌面任务自动化场景,显示通用模型正加速向可执行Agent演进。
量子位报道网友整理的「怎么loop起来」指南,借黄仁勋关于Prompt正在过时的观点,介绍从一次性提示词转向持续反馈、迭代执行的Loop式AI协作方法,更偏向使用经验与工作流思路。
腾讯混元开源PhoneBuddy-4B手机操作Agent模型,并发布5篇系列论文,覆盖真实手机环境中的任务执行、评测基准与训练方法。报道称其在多项真机Phone-use评测中超过GPT-5.4,目标是提升移动端Agent可用性。
量子位报道一家被称为「3D生成领域的Anthropic」的公司最新进展:可在4秒生成百万面模型,支持千万面级精度与12K高清贴图,并已获得数亿元资金。文章聚焦其技术路线、产品化能力及3D生成赛道下一阶段竞争方向。
文章介绍一项面向扩散模型的自引导方法,将生成过程中的token表示直接交换,用较小改动提升图像生成质量与一致性。据称论文入选CVPR 2026 Oral,关注扩散采样、视觉生成模型优化的研究者可参考。
量子位援引Nature相关研究称,用户把Claude等聊天机器人当作恋爱或情感伴侣,可能加剧情感依赖、妄想和社交退缩等心理风险。研究提示AI陪伴产品需更强安全边界,用户也应避免将模型替代真实亲密关系。
量子位报道,谷歌七年员工、开源项目Gemini CLI核心开发者在项目获得约2.8万GitHub星标、成为热门AI命令行工具后被解雇。事件引发开发者社区对大厂内部激励、开源归属与AI工具团队稳定性的讨论。
报道称OpenAI自研AI芯片项目进展迅速,由前谷歌TPU核心成员主导,约270天完成关键里程碑。文章将其解读为OpenAI向模型、软件、基础设施到芯片的全栈布局延伸,可能削弱对英伟达GPU的长期依赖。
人大与微软团队开源 Arbor,面向自主科研场景提供通用框架和工具包,试图缓解科研 Agent 盲目试错、流程不可控等问题。项目登上 Hugging Face 日榜第一,适合关注科研自动化、多智能体实验流程和开源 Agent 框架的开发者跟进。
报道介绍一套深圳制造的零GPU超算系统,核心芯片、互连和存储均为自研,试图以非GPU路线支撑AI算力与高性能计算。信息主要集中在架构自主化和国产替代,仍需关注实测性能、生态兼容与商业落地。
北大、清华等团队提出面向视觉-语言-动作模型的信息筛选模块,在不增加额外数据和参数规模的情况下,过滤视觉干扰与冗余输入。据称训练效率提升14倍,并在镜头油污等真实扰动场景中提高机器人操作鲁棒性。
量子位发布编辑作者招聘信息,开放3个岗位,其中包括实习岗位,并强调岗位职责不设明确边界。该信息主要面向希望进入AI科技媒体、从事行业报道、内容策划或编辑写作的人群,属于媒体招聘动态。
量子位报道一项面向世界模型和具身智能的因果技术基准,强调评估AI是否能理解事件背后的「为什么」。该方向从相关性预测转向干预、反事实和因果推理,有助于衡量具身大脑在复杂环境中的可解释决策能力。