来自该信源的全部动态 · 共 783 条
量子位报道,视频生成模型Agnes Video 2.5 Flash近期开放免费使用,并通过复刻热门短片《牛来》展示其画面质感、动作连贯性和可控性。该动态主要影响AI视频创作者、内容团队和模型评测者的工具选择。
量子位报道称,一个神秘具身智能模型Demo展示了宇树、智元等不同机器人共用同一「大脑」完成任务,视频采用约10分钟一镜到底形式,强调跨本体泛化和连续执行能力。信息仍偏展示层面,模型来源、训练方法、评测数据和开放计划尚不明确。
蚂蚁国际发布自研时序AI预测大模型鹰序TST 2.0,并称其在世界权威测评中排名第一。该版本聚焦将时间序列基础模型从通用预测推进到金融场景,面向市场趋势、风险控制等高价值应用。
量子位报道,WRC现场一款乒乓球机器人演示吸引大量观众,背后是一家中国具身智能创业公司的全栈方案。文章聚焦其从硬件、运动控制到感知决策的系统化路径,反映具身智能从单点能力展示走向综合场景验证。
量子位实测字节「豆包工作」与飞书协同能力,重点观察其在企业知识检索、跨应用执行、会议与文档处理等场景中的Agent化表现。文章认为其已接近企业级AI助手形态,但仍需验证稳定性、权限治理和复杂流程泛化。
范式举办PhanthyMotus生态社区共建计划发布会,宣布其通用具身Agent底座从开源进入多方共建阶段,并联合优必选等十余家具身智能企业推进生态协作。该动态体现国内具身智能基础平台从代码开放转向产业协同。
量子位介绍了 SenseNova U1.5 Lite,这是一款国产开源 8B 模型,主打更低的部署成本和较强的图像能力。报道强调其在相关评测中已接近闭源 Image 2 的表现,适合关注国产基础模型与轻量化落地的团队跟进。
未来不远机器人完成最新一轮融资,字节、汇川等已入股。公司披露其半年内完成3轮融资、累计约10亿元,并已将机器人卖到500个家庭,显示家用机器人商业化开始进入小规模验证阶段。
量子位称,紫东太初正在推动AI科研能力从单点工具和任务执行,升级为面向完整科研项目的系统化协作。该方向强调对研究目标、步骤拆解、资料处理、实验分析与成果产出的连续支持,意味着AI4S产品形态可能从辅助单项工作,转向覆盖科研流程的项目级智能系统。
在量子位采访中,Tibo谈及下一代Agent的发展方向,认为其将天然走向云端并调用更大规模的计算资源。他还展示了专门用于重置系统的实体按钮,强调用户应能按需掌控Agent状态。访谈体现了对Agent基础设施、算力形态与人机控制权的判断。
科学探索奖公布2026年度获奖名单,50位获奖人来自13个城市的30家高校、医院及科研机构。报道提到王虹的合作者入选,但未披露完整获奖领域与项目细节。该名单反映国内基础科学、医学及交叉研究领域的人才支持动向,对关注科研生态和AI交叉创新的人士具有参考价值。
2026年8月21日,小猿学习机上线「中小学课本学习智能体」,由人民教育音像数字出版社与小猿合作推出,面向教材讲解、同步练习和学习辅导场景,进一步把教材内容与AI交互式学习结合到终端产品中。
原力灵机发布具身大模型 DM0.5,宣称在 RoboDojo 基准上拿到新 SOTA,并同步开放相关能力与资源。报道重点在于它把具身智能的控制、泛化与开源可复现放到同一条线上,适合关注机器人基础模型与开源生态的人跟进。
量子位报道,VC圈开始把AI引入投资判断与趋势研判,FutureX榜单前十中有三家与AI相关。报道反映出资本机构正把AI从辅助工具进一步当作决策变量,关注点从模型本身转向预测能力和行业分化。
生数科技在 WRC 2026 发布通用世界模型研究成果,提出从感知、预测到交互的五级发展路线,强调世界模型向通用智能基础设施演进,对具身智能和仿真训练有参考价值。
Visa大中华区总裁张文翊分享对AI商业化趋势的判断,认为AI将持续改变支付、消费和企业运营,但技术渗透的速度与规模最终取决于信任机制。企业需要同步推进数据安全、隐私保护、风险控制和责任治理,才能将AI能力转化为可持续的商业价值。
一篇聚焦AI科研能力评测的论文提出统一评价标准,试图改变过去依赖单项指标或主观判断的科研评价方式。研究结合中国公司的实践数据进行验证,并在两项排行榜中取得第一,显示该方法已具备一定落地性,也为大模型科研能力比较提供了新框架。
中诚华隆发布HL200国产推理芯片及超节点集群方案,覆盖单芯片到万卡级算力部署,试图从硬件、互联和集群系统层面构建规模化AI推理基础设施。该发布聚焦国产算力在大模型推理场景中的扩展能力,但具体性能、生态适配及商业落地数据仍有待进一步披露。
AFAC2026金融智能创新大赛总决赛路演将于8月25日至26日在上海阿纳迪酒店举行,地点位于长宁区临虹路7号。该活动以金融智能创新为主题,当前进入总决赛倒计时,相关直播预告已发布,具体议程和参赛项目可关注主办方后续信息。
WRC 2026 相关报道介绍了原生全模态世界模型的思路:把视觉、语言、音频和动作统一到同一模型中,目标不是只做离线模拟,而是面向可交互环境生成与推理。内容更偏研究趋势解读,指向具身智能和实时交互系统。