来自该信源的全部动态 · 共 783 条
Om AI推出面向端侧部署的3B参数原生视觉语言模型VLX,主打对物理世界的精准感知,强调以较小参数规模实现接近大模型的视觉理解能力。报道援引其在英伟达、谷歌相关测试中的表现,称该模型适用于资源受限的终端设备,但具体评测指标、数据集与对比条件仍待进一步披露。
第四范式与华夏金融订立服务器售后回租安排,拟通过融资租赁方式盘活既有算力服务器资产,优化现金流和资产结构,继续支撑AI平台与相关业务扩张。事件更多体现资本运作和算力基础设施管理,技术增量有限。
量子位报道称,亚马逊内部使用Claude的成本高到引发关注,相关支出据称达到180万美元级别。事件反映大模型在企业级部署中的推理成本、使用治理和ROI评估压力,尤其对依赖第三方模型的云厂商与AI应用团队有参考价值。
量子位报道称,GPT-5.6与Fable合作解决一道悬而未决25年的数学难题,相关作者曾在读博期间研究该问题,17年后由AI给出突破。事件显示前沿模型在数学推理与科研辅助上的能力继续增强。
量子位报道,一支中国团队探索让AI参与生成训练与评测数据,以缓解传统题库跟不上模型能力提升的问题。该方向被称为数据层RSI,核心是通过模型自我出题、筛选和迭代,为下一代模型提供更高质量的数据闭环。
量子位报道称,GPT-5.6在游戏生成任务上表现突出,用约5美元成本复刻了此前Opus 5消耗6.9亿token完成的游戏案例。信息主要体现新模型在代码生成、交互式内容制作和成本效率上的潜在进展,但仍需更多可复现实测验证。
量子位援引爆料称,DeepMind负责人Demis Hassabis原本可能与Jeff Dean一同离开谷歌,谷歌通过延缓或调整安排将其留下。该消息延续此前Jeff Dean创业传闻,涉及谷歌核心AI人才稳定性与组织博弈,但目前信息源单一,细节仍待验证。
量子位报道称,OpenAI CEO山姆·奥特曼分享自己用ChatGPT辅助育儿后引发争议。讨论集中在AI能否参与婴幼儿照护、医疗与安全建议的可靠性,以及公众人物示范效应可能带来的误用风险。
量子位报道,中国团队EverMind以三篇论文回应NeoLab浪潮,覆盖从模型、数据到系统的全栈自进化方案。文章强调海外团队加速押注相关方向,但目前信息主要来自媒体摘要,需结合论文细节评估技术实质与可复现性。
据量子位报道,Jeff Dean相关创业项目的BP在硅谷流出,杨植麟也出现在名单中,引发VC密集接触和追投讨论。消息显示,该项目因核心人物和大模型背景受到资本高度关注,折射出当前AI创业融资竞争仍在升温。
量子位称,苹果漏洞赏金计划遭大量AI生成报告涌入,低质或重复提交显著增加,导致审核团队一度下线。事件反映生成式AI降低安全报告生产门槛后,对漏洞响应流程和审核资源带来的新压力。
openJiuwen宣布发布企业级分布式蜂群架构,并与邮储银行完成金融生产环境落地,重点解决AI应用从试点可用到规模化部署的问题。该动态涉及多智能体协同、企业级架构与金融场景生产化验证。
AI能力正加速进入运动健身领域,Keep也在尝试将相关功能融入用户训练与健康服务。不过,行业普遍面临功能同质化、用户付费意愿不足等问题。此次探索的关键,不只是增加AI功能,而是能否形成高频使用场景、清晰服务价值和可持续的商业模式。
阿里巴巴视频生成大模型Wan 3.0于8月6日开启公测,支持将文档、PPT等材料转为视频,面向内容创作和办公场景扩展多模态生成能力。该动态显示国内视频模型从文本/图像生成走向资料理解与自动成片。
量子位称,ChatGPT免费版已升级至「Chat优化版」,用户可直接使用GPT-5.6且不再受明显次数限制。该变化降低了高阶模型体验门槛,可能影响免费与付费版的功能分层,但仍需以OpenAI官方说明和实际限额为准。
蚂蚁集团正式开源Avernet,定位为多智能体协作基础设施,社区版已上线。项目强调让人类与智能体像组织一样分工、协同和管理,面向企业级Agent编排、协作流程与应用落地场景。
文章讨论大模型推理中存储角色的变化:随着Token生成牵动算力、网络、内存与存储协同,SSD不再只是冷数据介质,而可能成为推理系统降本、扩容和提升吞吐的关键基础设施。
PPIO正式发布Fusion融合模型,主打以约十分之一成本达到或超过顶级模型的智力表现。报道未披露充分第三方评测细节,但涉及模型路由、成本优化和推理服务竞争,对关注国产模型商业化的从业者有参考价值。
量子位称,智元机器人官网或公开高管信息中已下架首席科学家罗剑岚,引发外界对公司核心团队变化的关注。报道目前信息有限,尚未披露其是否离职、岗位调整原因及对智元机器人研发路线的影响。
量子位报道,一项围绕《指环王》的大模型评测基准获 Andrej Karpathy 推荐。该基准借助广为人知的复杂叙事与角色关系,考察模型在知识理解、长上下文、推理与生成一致性上的能力,为传统跑分外提供更直观的评测视角。