来自该信源的全部动态 · 共 1292 条
LinuxDo用户发帖询问国产大模型在代码审计场景下的实际表现对比,提到GLM5.2在代码能力上表现突出,想了解其在代码审计方面是否同样领先,同时询问Kimi-k2.6、Qwen-3.7 Max等模型在该场景下的性价比,希望有实测经验的用户分享对比结果。目前尚无实质性回复。
百川智能发布新一代医疗增强大模型M4,在OpenAI医疗评测基准中取得第一名,性能超越GPT-5.5。该模型专注于医疗垂直领域的能力增强,标志着国产大模型在专业医疗场景中的竞争力进一步提升。目前消息来源为LinuxDo转载IT之家报道,具体技术细节和评测数据有待官方论文补充。
一位双非高校研究生分享使用大模型的消费观变化:从不舍得开视频会员,到随手购买Team账号、中转站余额、AutoDL算力。作者坦言这些工具帮助轻松毕业,但真正的科研并非自己完成,关注点也从成果质量转向模型是否掺水、token是否被盗用等技术焦虑,引发对AI依赖的自省。
渗透测试人员发现MCP和A2A等AI协议正成为新攻击面。AgentScan是一款开源扫描工具,红队可用于探测目标暴露的MCP服务器、A2A Agent及LLM接口安全问题,蓝队可用于内网暴露面排查。支持端口探测与一条命令快速扫描,覆盖当前主流AI协议栈。
开源项目 Codeg 发布 V0.16.0 版本,核心更新包括自动化功能(支持定期处理任务并收集运行日志)以及多智能体协作工作台。项目完整开源,在 LinuxDo 社区进行推广,当前社区关注度较低,仅 1 位参与者。
作者在审阅大量简历后,针对缺乏Agent项目经验的校招同学,提出三个可落地的开放题方向:逆向无公开文档的API并基于解锁能力构建真实产品;从自身需求出发做一个AI深度参与核心功能的Web App;强调产品品味与实际部署上线的重要性,而非停留在demo阶段。
LinuxDo用户开源了一个名为「盛夏」的小框架,核心功能是将Claude Agent SDK中的Skill转化为REST接口,方便在非Python生态(如Java/SpringBoot)中调用Agent能力。作者认为SpringBoot不适合开发Agent服务,该框架旨在降低Java开发者构建Agent应用的痛苦。项目完整开源并遵循社区推广规范。
开源项目支持将知识星球、语雀、飞书、阿里云知识库的付费课程内容一键导出为Markdown格式,便于整合后喂给AI进行系统性学习。解决了传统逐页复制文档给AI导致回答片面的问题,将分散的课程文档聚合为完整知识库,让AI能结合上下文给出更全面的解答,作者称三天可学完一个课程。
Anthropic发布万字安全白皮书讨论「递归自我改进」风险,但文中大量展示Claude性能数据:80%合并代码由Claude撰写、工程师产出提升8倍、开放任务成功率从26%升至76%。社区批评其本质是借安全叙事做产品宣传,同时试图铺垫由领先者主导的AI治理秩序,形成「既当裁判又当选手」的公关策略。
开源工具 Bili Note 可将B站视频和图文内容整理为结构化 Markdown 笔记,保留完整字幕和评论存档,支持后续对笔记内容进行追问。项目定位为 Codex/Agent 可调用的 skill,适合用 AI 辅助学习B站内容的场景。已在 GitHub 完整开源。
LinuxDo社区新用户对多个公益API中转站进行实测,覆盖GPT、Claude、GLM、DeepSeek V4 Pro等模型。结论是几乎所有公益站都存在稳定性问题,且稳定性与模型能力近似成反比——用起来流畅的站点,模型实际输出能力往往不如DeepSeek官方。作者建议新人根据自身需求(免费vs稳定vs能力)理性选择,避免花大量时间逐一试探。
LinuxDo用户反馈GPT-5.5 Pro模型在网页端出现明显降智现象。具体表现为:使用赠送的重置额度后必定降智,在旧对话中继续提问则不受影响;Codex中xhigh模式同样受到波及。用户测试发现该问题与IP关系不大,同机房IP下免费账号使用Codex反而比付费Pro账号表现更好。
有用户反映,新注册的OpenAI免费账号已无法调用GPT-5.5模型,目前免费账号可用的GPT系列模型仅剩gpt-5.3-codex-spark、gpt-5.4-mini、gpt-image-1.5、gpt-image-2四个,另有codex-auto-review可用。这表明OpenAI可能正在收紧免费层级的模型访问权限。
一份中文优先的 Vibe Coding 教程开源项目,旨在帮助开发者将 AI 辅助编码从零散使用内化为系统化工作流。内容覆盖 Spec 编写、agent.md 配置、worktree 管理等细节,适合已在使用 Codex 等工具但尚未形成体系化流程的开发者参考。项目托管在 GitHub,配有优化后的文档网站便于查阅。
LinuxDo用户分享使用小米Mimo API的踩坑经历。因有大量简单任务需调用API,被39元lite套餐「41亿额度」吸引后充值,实际使用发现41亿指Credits而非Token,单次接口调用即消耗100多万额度,两分钟用掉1%。帖子引发对Mimo定价策略透明度的讨论。
LinuxDo社区讨论帖,用户分享在个人服务器上部署的非博客类服务。示例包括基于开源模板用Codex搭建的在线白板,以及利用Cloudflare Worker运行的免费GEO(生成式引擎优化)审查工具GeoScore,后者借助GitHub上的CF项目实现。帖子旨在交流自托管服务的玩法与经验。
基于DeepSWE基准测试数据,GLM5.2编程能力介于Opus 4.8 low与medium之间。Fable 5 low超越Opus 4.8 max且更便宜;GPT 5.5 medium强于5.4 xhigh且费用更低,同时优于Opus 4.8 high/medium和GLM5.2 max。结论是大部分编程任务用GPT 5.5 medium即可获得最优性价比。
用户首次充值Claude Max 5x后发现额度刷新采用分模型组合形式,而非像Pro一样所有模型共用额度池。帖子讨论了不同模型(如Sonnet)的独立额度分配方式,以及手机端与桌面端显示差异等细节问题。
开源项目 my-agent-browser 在 chrome-devtools-mcp 基础上封装,解决多 Agent 共享浏览器实例、数据目录持久化、浏览器指纹一致性、故障自愈等痛点。支持 Hermes、Claude Code、Codex 等多种 Agent 统一调用浏览器能力,以 MCP + skill 形式提供服务,迭代数月后开源发布。
有用户反馈此前在Claude网页端收到一份关于未来人工智能发展看法的问卷,填写后今日收到15美元现金奖励而非额外使用额度。这表明Anthropic正通过付费问卷方式收集用户对AI发展方向的意见反馈。