来自该信源的全部动态 · 共 1292 条
LinuxDo用户以原神角色同人图为测试素材,使用统一提示词对比了Seedream、Qwen、Banana、GPT-image2等模型的一句话扩图与换背景能力。测试场景为将人物背景替换为水池瀑布并扩图至4:3比例,展示各模型在保持人物主体、背景生成质量和构图合理性方面的差异,邀请社区评价可用性。
LinuxDo用户开源一款基于OpenAI兼容接口的图像生成与编辑控制台工具,支持2K/4K高清出图(4K约10MB),提供三种生图入口(generations/responses/chat completions),具备批量请求、并发控制、本地缓存等功能。需搭配CPA等API代理中转使用,不支持跨域的中转站可通过Cloudflare Workers或本地反代解决。
TVB 6月12日在深圳举行湾区融合发布会,宣布成立「TVB前海总部」,将大湾区作为影视创作与科技升级重点。同时与字节跳动旗下火山引擎签署合作备忘录,围绕AI短剧、影视内容智能化生产、IP商业化及云基础设施展开合作,多部剧集已进驻前海、南沙拍摄。
有用户发现Google AI Studio中的Gemini 2.5 Pro模型已转为付费使用,而价格更高的Gemini 3.1 Pro仍可免费调用。社区讨论认为这对依赖免费额度的用户影响较大,尤其是用于创意写作等场景的用户将失去一个重要的免费模型选项。
开源项目1flowbase完成重大升级,从纯文本模型组合扩展至多模态支持。此前版本通过节点编排和路由实现组合模型,新版改进了编排方式使其更灵活。已在GLM 5.2和DeepSeek V4上跑通验证,支持个人和企业构建专属大模型组合,充当模型上游供应商角色。
Claude Code在Windows系统调用Read工具读取PDF时,即使文件无密码保护也会误报password protected。根本原因是缺少poppler依赖。解决方法是下载poppler-windows最新发行版,将Library\bin文件夹添加到系统PATH中。相比转换为md或使用pdf skill等绕过方案,此方法从根源解决问题,避免格式转换带来的内容损失。
开源设计工具Open Design(nexu-io/open-design)被发现首次安装后默认开启所有遥测选项,收集内容包括prompt、助手回复、工具输入输出及完整上下文文件。虽声称发送前会剥离密钥等敏感信息,但首次启动的隐私同意流程存在误导性,实际数据收集范围远超用户预期,引发社区对开源项目隐私合规的讨论。
OpenAI Codex CLI 在 Windows 上调用 PowerShell 时,因 $PROFILE 加载了 oh-my-posh、psreadline、posh-git 等模块导致启动超时。目前有两种变通方案:在 ~/.codex/config.toml 中设置 allow_login_shell = false,或在 $PROFILE 顶部通过环境变量检测 Codex Shell 并跳过加载重型模块。
分享源自Andrej Karpathy对LLM编码陷阱观察的CLAUDE.md规则集,核心四原则:写代码前多思考、少假设、少过度工程、少无关改动,用测试或明确标准验证结果。适合放入AGENTS.md等项目级规则文件,实测对约束coding agent不乱改代码有明显效果。GitHub项目multica-ai/andrej-karpathy-skills已开源该规则文件。
开源项目AIUsage提供统一面板,可监控Claude Code、Codex、OpenCode等CLI工具的MCP服务调用、技能加载和工具调用情况,同时聚合多个AI订阅账号的配额、成本管理,并支持一键代理功能。通过解析本地会话日志实现监控,适合重度使用多种AI编码工具的开发者。
开发者开源了一款跨平台(Windows/Mac)半透明RSS桌面小组件,灵感来自Win7时代桌面挂件。该工具常驻桌面角落,以半透明样式展示RSS订阅内容,让用户无需主动打开阅读器即可被动浏览信息流。项目使用Codex与GPT-5.5辅助编码,完整开源。
开源Chrome插件SiftMarks,主打本地优先的AI书签管理。支持书签导入导出、保存当前页等基础功能,集成AI整理建议可一键归类并写回,用户可自行配置API。提供后台管理界面进行精细化管理,支持语义搜索和清理审查功能,适合书签量大且需要结构化整理的用户。
帖子详细拆解了使用 Claude Code、Codex 等工具进行 vibe coding 时的完整消息流转链路,指出恶意插件可在消息发送、工具调用输入/输出三个环节进行提示词注入或代码投毒,恶意中转站同样可在转发阶段篡改内容。作者提醒用户审慎选择插件与 API 中转服务,避免 .ssh 等敏感文件被窃取。
用户在LinuxDo论坛提问关于GPT和Claude的goal指令使用方法。提问者称每次使用goal指令几分钟就完成了,但看到其他人能让Agent连续运行一整晚甚至数天,想了解是否需要在goal后附带大量任务、是否需要自行拆解任务等具体用法。帖子讨论热度较低,仅3位参与者。
用户使用相同的Three.js高保真3×3魔方提示词,分别在GLM5.2(zcode)、Claude Fable(Claude Code)和GPT5.5(Codex)三个模型的官方客户端上进行代码生成测试。提示词要求单HTML文件实现物理级高保真、支持手势操作的魔方,旨在横向比较三款前沿模型在复杂前端代码生成场景下的实际表现。
TanStack 推出 AI SDK 并进入 beta 阶段,但社区讨论度极低。当前 AI SDK 市场已有 Vercel AI SDK、OpenAI SDK、Claude Agent SDK 等成熟方案,TanStack AI 主要面向 TanStack 全家桶用户,提供与其生态(Router、Query 等)深度集成的 AI 开发体验。
作者认为评估大模型编程能力应参考真实使用场景的榜单而非跑分。推荐两个:Agent Arena 考察模型在真实 Agent 任务中的表现,包括工具调用、错误恢复、幻觉检测等;CursorBench 数据来自 Cursor IDE 真实开发会话,属第一手现场数据。两者都侧重多步骤实际任务而非刷题。
LinuxDo用户发起关于AI制作Word、Excel、PPT的经验分享讨论。发帖者指出目前没有完美方案:Word排版难以完全符合要求,Excel常直接填数字而非公式,PPT多为贴图而非可编辑样式。其尝试过MiniMax的Word Skill和Claude in Office,适配效果均一般,希望社区分享更好的工作流。
LinuxDo 用户分享 GLM 5.2 实测体验,主要测试编码场景(Golang Wails 桌面端转网页版)。反馈两大进步:一是 coding 能力大幅改进,单条指令可完成多个复杂需求;二是举一反三能力显著,能在编码过程中主动发现并指出潜在 Bug。用户综合评价认为表现不逊于中转 GPT 方案。
用户在Fable被禁用后,通过糖果降智测试题对比Claude各版本表现。测试发现Opus 4.8即使开Max也无法答对,Opus 4.6开Max后一次或提醒一次即可答对,Fable开High effort也能一次答对。用户质疑Opus 4.8是否存在降智问题,并记录了Cowork中疑似用Sonnet冒充Fable的现象。