AI2探索面向研究影响力的GPU集群调度
文章介绍 AI2 在多租户 GPU 集群中的调度实践,指出传统以队列等待或 GPU 利用率为核心的策略,难以兼顾训练作业时长、资源碎片与研究产出。团队提出以影响力为目标的调度思路,根据作业价值、预期收益和资源占用动态排序,并讨论评估指标与工程落地中的权衡。
GPU 集群运营者、AI 基础设施团队和大模型训练工程师可借此优化资源分配与作业优先级。
把每天数百信源里真正重要的 AI 信号,折射成一束清晰的光。
文章介绍 AI2 在多租户 GPU 集群中的调度实践,指出传统以队列等待或 GPU 利用率为核心的策略,难以兼顾训练作业时长、资源碎片与研究产出。团队提出以影响力为目标的调度思路,根据作业价值、预期收益和资源占用动态排序,并讨论评估指标与工程落地中的权衡。
GPU 集群运营者、AI 基础设施团队和大模型训练工程师可借此优化资源分配与作业优先级。
微软正与 llama.cpp、GGUF 社区合作升级 Windows 11 的 Windows ML,实验性加入 Windows ML Runtime API 原生推理路径,支持从 Hugging Face 导入 GGUF 模型,并运行 GGUF 与 ONNX 模型。微软还与英伟达向 llama.cpp 贡献性能优化代码,推动开发者在设备端构建本地 AI 应用。
Windows 本地推理开发者可关注其 GGUF、ONNX 接入与 Runtime API,但目前仍属实验阶段。
Anthropic推出可选接入的OSS Scanner,为符合条件的关键开源项目提供基于AI模型的定期免费漏洞扫描。维护者可通过GitHub仓库提交PR申请,审核标准参考OSS-Fuzz。该服务过去半年发现逾2.9万个候选漏洞,约6000个完成人工核验,并通过协调披露流程提交报告。
开源维护者、安全团队和开发者应关注,可降低核心软件漏洞发现与初筛成本。
华为宣布 DevEco Studio、AI 开发工具 DevEco Code 及能力套件 DevEco CLI 同步开启鸿蒙 PC 首次公测,覆盖应用开发、调试与上架流程。支持设备需运行 HarmonyOS 7.0.0.107 及以上,内存至少 16GB、硬盘至少 100GB,面向鸿蒙 PC 开发者。
鸿蒙 PC 开发者可获得官方集成开发与 AI 辅助能力,适合关注鸿蒙生态和跨端工具链的人群。
微软宣布 GitHub Copilot 将在月底前支持本地 AI 模型推理,可在云端与设备端模型间自动编排或手动切换,并在 VS Code、CLI 等入口配置偏好。开发者可指定提供商、模型或端点,Windows ML 可调用 MAI Code 1.1 Flash。
影响AI编程助手部署形态,开发者和企业IT值得关注。
微软发布 Visual Studio Code 1.141,围绕 Copilot Agent 工作流加入非活跃会话与 worktree 清理机制、存储阈值提醒和合并 PR 自动清理;同时提供 Windows、macOS、Linux 终端沙盒、多会话网格布局及多 GitHub Enterprise 实例登录,提升资源管理、安全性与协作效率。
VS Code 用户、Copilot Agent 开发者和关注智能体安全隔离的团队值得关注。
卡普空宣布通过REX分阶段升级现有RE引擎,整合面向AI时代的开发能力,目标是简化游戏制作流程,减少重复、繁琐且耗时的工作。该计划并非重建新引擎,当前更可能聚焦开发辅助与流程优化,而非直接生成游戏美术资源。
游戏研发团队、引擎工具开发者和关注AI落地者可据此观察3A制作流程的自动化方向。
OpenAI在2026开发者日与ModRetro合作,为复古掌机Chromatic推出Codex专用插件Game Studio。用户可用自然语言描述需求,由Codex辅助生成游戏程序,并通过内置模拟器在电脑测试、串流到真机,完成后写入专用空白卡带运行。
适合关注自然语言编程、游戏开发和端侧创作工具的开发者。