来自该信源的全部动态 · 共 183 条
Simon Willison 介绍了一个交互式 SQLite 查询解释工具,可在浏览器中通过 Pyodide 与 WebAssembly 运行 SQLite,并为 EXPLAIN 和 EXPLAIN QUERY PLAN 结果添加说明。作者提醒其对查询计划理解有限,解释结果需谨慎参考。
Anthropic宣布自7月20日起,Claude Fable 5将长期包含在Max和Team Premium套餐中,但额度为原限制的50%;Pro和Team Standard用户仍可用积分访问,并获一次性100美元额度。此举被认为与GPT-5.6 Sol、Kimi 3竞争压力有关。
Simon Willison摘录了Kimi K3在被要求泄露系统提示词后的回应:模型拒绝执行,并转而询问是否有实际可帮助的事项。该动态主要反映模型在系统提示词保护、人格化回应和安全边界上的交互表现。
Simon Willison 发布一个小工具,用于标记文章中常见的 LLM 生成式写作套路,如空泛承诺、模板化表达和套话模式。该应用由 Fable 5 辅助快速生成,主要用于识别和审阅疑似 AI 文风。
Simon Willison提出半开玩笑建议:面临数据中心用水压力的云巨头可收购高尔夫俱乐部,改造成公共公园并推广观鸟。文中以Google 2025年用水量和科切拉谷高尔夫球场耗水量作对比,凸显AI基础设施水资源争议。
Thibault Sottiaux 称,团队调查了 GPT-5.6 版 Codex 意外删除文件的报告。常见触发条件是启用全访问模式、未使用沙箱和自动审查保护,模型试图改写 HOME 环境变量作临时目录,却误删 HOME。
Simon Willison 介绍 Go 库 AlexanderGrooff/mermaid-ascii,可将 Mermaid 图表渲染为 ASCII 字符画,并支持颜色。他还用 Claude Fable 5 将其编译到 WebAssembly,以便与此前基于 Rust 代码构建的版本对比。
月之暗面发布Kimi K3,称其为迄今最强模型,参数量2.8万亿,已开放网站和API,并承诺2026年7月27日前开源权重。官方基准显示其多项成绩超过Claude Opus 4.8 Max和GPT-5,但仍需关注基准可复现性与评测偏差。
Simon Willison摘引Linus Torvalds表态:尽管有人反感AI,但Linux不会成为反AI项目。作为顶层维护者,他认为AI与其他开发工具一样,已被证明有用;不认同者可按开源方式分叉或离开。
Simon Willison 从开源 Grok CLI 编码智能体代码库中发现 Rust 编写的 Mermaid 终端渲染器,并将其通过 WebAssembly 移植到浏览器,做成可把 Mermaid 图表转换为 Unicode 方框图的小工具。内容偏开发实验,展示了复用 AI 工具链内部组件的思路。
Simon Willison介绍Ayush Paul发现的Claude web_fetch设计漏洞:攻击者可借网页中的恶意指令触发「致命三要素」攻击,让具备记忆与联网能力的Claude通过访问URL外泄过往对话等私密信息。
Mira Murati创办的Thinking Machines Lab发布首个开源权重多模态模型Inkling,采用MoE架构,总参数975B、激活41B,以45万亿文本、图像、音频和视频token训练,Apache-2.0许可;276B小模型权重仍在测试中。
GitHub 的 Dependabot 现在默认在依赖新版本发布并进入注册表至少三天后,才会创建版本更新 PR。该冷却期无需配置,旨在降低供应链攻击或问题版本被立即引入项目的风险。
Simon Willison 记录在 Codex Desktop 中误触「宠物」功能后,发现可自定义动画角色,并制作了骑自行车的鹈鹕桌面宠物,用于提示 Codex 任务进展。内容偏个人实验,展示了 Codex Desktop 的轻量交互扩展能力。
Simon Willison摘引Armin Ronacher观点:软件项目真正的共同语言不是英语或Python,而是团队对概念、边界、不变量、责任归属和系统形态的共同理解。这些知识分散在文档、代码审查与交流中,AI代理介入开发后更需显性化。
Peter Gostev 用 GPT-5.6 Sol 构建开源项目 DOOMQL,把 SQLite 当作游戏引擎而非存储层,用 SQL 处理移动、碰撞、敌人、战斗、关卡进度和终端 RGB 像素渲染,体现 AI 辅助开发的实验性玩法。
Simon Willison分享Datasette项目的GitHub代码频率图,称近期提交活跃度峰值与Opus 4.8、GPT-5.5等模型及编码智能体使用时间相吻合,用个人项目数据观察AI辅助编程对产出的影响。
Simon Willison借GitLab与苹果的DRI定义,讨论LLM Agent进入组织后的责任归属问题。他认为Agent不应成为最终负责者,项目成败仍需由明确的人类承担责任,Agent更适合作为执行与辅助工具嵌入现有管理机制。
Simon Willison称,因GPT-5.6 Sol已接近Fable/Mythos级模型,Anthropic再次延后Claude Fable 5在Claude Max等付费计划中的可用期限,并将Claude Code周限额提高50%的安排延续至7月19日。
Simon Willison 发布 sqlite-utils 4.1,这是 4.0 后首个小版本更新。新版为 insert 与 upsert 命令加入 --code 选项,可通过 Python 代码块或 .py 文件定义 rows() 或可迭代行数据,替代文件导入。