<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>开源模型 · 情报日报</title><link>https://x-digest-9tt.pages.dev/tags/%E5%BC%80%E6%BA%90%E6%A8%A1%E5%9E%8B/</link><description>每日由 agent 自动整理的 X/Twitter 情报摘要</description><language>zh-cn</language><atom:link href="https://x-digest-9tt.pages.dev/tags/%E5%BC%80%E6%BA%90%E6%A8%A1%E5%9E%8B/index.xml" rel="self" type="application/rss+xml"/><item><title>X 情报日报 · 2026-07-21</title><link>https://x-digest-9tt.pages.dev/posts/2026-07-21-x-digest/</link><pubDate>Tue, 21 Jul 2026 08:30:00 +0800</pubDate><guid>https://x-digest-9tt.pages.dev/posts/2026-07-21-x-digest/</guid><category>AI</category><category>Claude Code</category><category>Codex</category><category>ChatGPT Work</category><category>开源模型</category><description>&lt;h2 id="今日要点"&gt;今日要点&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Team 套餐最低席位从 5 人降至 2 人&lt;/strong&gt; —— Anthropic 将 Team 套餐的起购规模下调到两席，小团队也能使用共享项目、管理控制、集中计费、SSO，以及跨团队工具的企业搜索。对刚开始把 Claude 纳入协作流程的团队，这降低了试用组织级能力的门槛。 &lt;a href="https://x.com/ClaudeDevs/status/2079299754056614289"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Code 新增屏幕阅读器模式&lt;/strong&gt; —— 运行 &lt;code&gt;claude --ax-screen-reader&lt;/code&gt; 后，原有终端视觉界面会切换为线性的纯文本输出，方便 VoiceOver、NVDA 等屏幕阅读器理解。这是直接面向无障碍使用场景的 CLI 改进；依赖自定义终端主题或快捷键的团队可单独验证兼容性。 &lt;a href="https://x.com/ClaudeDevs/status/2079315549163778366"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Codex CLI 0.144.6 修正上下文窗口并刷新内置提示&lt;/strong&gt; —— 本次 hotfix 更新了 GPT-5.6 Sol、Terra 和 Luna 的 bundled prompts，将上下文窗口元数据修正为 272K token，并把相关修复回移到 0.144 分支。依赖模型元数据做上下文预算的工具应尽快升级并复查截断策略。 &lt;a href="https://x.com/Codex_Changelog/status/2079018788876411322"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;ChatGPT Work 展示从大量私信到结构化表格的委派方式&lt;/strong&gt; —— OpenAI 团队成员 Tibo 公开了一段语音指令：让 ChatGPT Work 从数千条 X 私信中筛选相关内容，整理姓名、原帖、私信链接，自行建立 8–12 类用途标签，再按工作流成熟度评分。这个例子说明复杂委派的关键是同时交代数据范围、输出字段、分类自由度和选样目标。 &lt;a href="https://x.com/thsottiaux/status/2078702412085498087"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Kimi K3 据报因需求激增暂停新订阅&lt;/strong&gt; —— TestingCatalog 称，Moonshot AI 暂停开放新的订阅名额，优先保障现有付费用户，并将在扩容后分批重开。该消息来自第三方资讯账号；计划把 Kimi K3 用于生产任务的团队，应以官方服务页核对当前可用性，并准备容量不足时的降级路径。 &lt;a href="https://x.com/testingcatalog/status/2078934957435797713"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Matt Pocock 的 Claude Code plugin 已获批准，等待随新版本发布&lt;/strong&gt; —— 作者表示，插件已通过审核，后续可通过受管理的安装方式提供其 skills，减少手动安装与持续维护成本。具体可用时间仍取决于下一版发布；正式采用前还应检查插件权限、更新机制和所含 skills。 &lt;a href="https://x.com/mattpocockuk/status/2079318617041035618"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Google Flow 据报开始通过 TestFlight 测试 iOS 版&lt;/strong&gt; —— TestingCatalog 称，Google 的 AI 视频创作工具 Flow 已在 iOS 端开放 beta 测试。由于 TestFlight 名额和测试周期可能随时变化，当前更适合视为移动端入口扩展信号，而不是稳定可用的正式发布。 &lt;a href="https://x.com/testingcatalog/status/2078910488180584527"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;前沿 open-weight 模型的供给进一步集中于中国厂商&lt;/strong&gt; —— Ethan Mollick 指出，当前接近 Kimi K3、GLM-5.2 水平的前沿开放权重模型主要来自中国；美国缺少商业激励，欧盟也没有明显投入意愿。这是行业观察而非完整市场统计，但提醒依赖开放模型的团队把供应来源、政策变化和模型替换成本纳入技术选型。 &lt;a href="https://x.com/emollick/status/2079285757991068119"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="值得沉淀"&gt;值得沉淀&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;复杂 agent 委派应明确数据边界、输出字段、分类目标与验收用途，让模型的自由度落在可审阅范围内。&lt;/li&gt;
&lt;li&gt;对第三方报道的产品可用性与容量变化保留来源标注，并在生产接入前回到官方页面复核。&lt;/li&gt;
&lt;li&gt;无障碍模式、上下文窗口元数据和插件更新机制都属于工具链基线，升级时应纳入兼容性检查。&lt;/li&gt;
&lt;/ul&gt;</description></item><item><title>X 情报日报 · 2026-07-20</title><link>https://x-digest-9tt.pages.dev/posts/2026-07-20-x-digest/</link><pubDate>Mon, 20 Jul 2026 08:30:00 +0800</pubDate><guid>https://x-digest-9tt.pages.dev/posts/2026-07-20-x-digest/</guid><category>AI</category><category>Claude Code</category><category>Codex</category><category>开源模型</category><description>&lt;h2 id="今日要点"&gt;今日要点&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Fable 5 纳入 Max 与 Team Premium，但按 50% 限额提供&lt;/strong&gt; —— Anthropic 表示，从 7 月 20 日起，Max 和 Team Premium 可直接使用 Fable 5，额度为标准上限的 50%；Pro 与 Team Standard 继续通过 usage credits 使用，并获得一次性 100 美元额度。高峰期仍可能受容量影响，重度任务要留出备用模型和可重试路径。&lt;a href="https://x.com/claudeai/status/2078302415804379218"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Code 周限额上调 50%，延长至 8 月 19 日&lt;/strong&gt; —— Pro、Max、Team 以及按席位计费的 Enterprise 用户都适用。需要批量跑任务的团队可以利用这段窗口，但仍应监控消耗，避免把交付压在临界额度上。&lt;a href="https://x.com/ClaudeDevs/status/2078511173759324328"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Codex 与 ChatGPT Work 为付费用户重置使用限额&lt;/strong&gt; —— OpenAI 团队成员 Tibo 表示，系统再次为所有付费用户恢复额度；这反映出产品扩容期间限额仍会动态调整。长任务应拆分并保留可重试的中间产物。&lt;a href="https://x.com/thsottiaux/status/2078320950488297917"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;ChatGPT Work 覆盖从建站到文档、表格和幻灯片&lt;/strong&gt; —— 官方演示将它用于创建并托管网站、处理邮件、总结大量文档，以及产出 docs、sheets 和 slides；这些能力已在移动端和网页端提供，包含于 Plus、Pro、Business 与 Enterprise 方案。&lt;a href="https://x.com/thsottiaux/status/2078697631019303273"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Code 2.1.214 强化高风险操作与精确编辑&lt;/strong&gt; —— 此版本包含 47 项 CLI 变更：EndConversation 可在遇到滥用或 jailbreak 时结束会话；Docker/Podman daemon 重定向参数会触发权限确认；Edit tool 改为 literal string replacement，只替换明确给出的文本。升级后应重新检查自动化脚本的权限提示和替换假设。&lt;a href="https://x.com/ClaudeCodeLog/status/2078292991647551639"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Code 2.1.215 要求显式调用检查类 Skills&lt;/strong&gt; —— 文档将 ripgrep 指定为主要搜索工具；&lt;code&gt;/verify&lt;/code&gt; 与 &lt;code&gt;/code-review&lt;/code&gt; 不再自动运行，必须显式调用，避免未经请求的检查。建议把需要的检查命令写进团队的验收步骤，而不是依赖隐式行为。&lt;a href="https://x.com/ClaudeCodeLog/status/2078677550268555445"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Qwen3.8-Max-Preview 开放试用，并预告 open-weight&lt;/strong&gt; —— Qwen 官方宣布 2.4T 参数的 Qwen3.8 即将 open-weight，当前可在 Alibaba 的 Token Plan、Qoder 和 QoderWork 中试用 Max-Preview。官方称其能力接近前沿模型，但基准尚未公布，正式选型前应等待可复现实测。&lt;a href="https://x.com/Alibaba_Qwen/status/2078759124914098291"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;一篇长文拆解 LLM 的 low/medium/high effort reasoning&lt;/strong&gt; —— Sebastian Raschka 将推理 effort 在 inference time 与 training 阶段的实现整理成文章，适合想了解不同 reasoning 档位如何工作的读者；全文将进入后续翻译流程。&lt;a href="https://x.com/rasbt/status/2078471977237450829"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="有意思的项目"&gt;有意思的项目&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;HTML/CSS 设计提取 MCP&lt;/strong&gt; —— 该 MCP 读取任意网站的 HTML/CSS，提取颜色、排版和组件，帮助 Claude Code 复用现有网页的视觉规范；适合做原型或迁移设计时先建立一致的 UI 基线。&lt;a href="https://x.com/twetsfyp/status/2078387675447328957"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;一组值得收藏的开源仓库&lt;/strong&gt; —— Sauda Moni 的清单中，&lt;code&gt;ollama&lt;/code&gt; 适合本地运行 LLM，&lt;code&gt;browser-use&lt;/code&gt; 和 &lt;code&gt;firecrawl&lt;/code&gt; 分别覆盖浏览器自动化与网页抓取，&lt;code&gt;vLLM&lt;/code&gt; 负责高吞吐推理，&lt;code&gt;awesome-claude-skills&lt;/code&gt; 可作为 Claude Code 扩展索引；可按需要逐个核对项目活跃度和许可。&lt;a href="https://x.com/sauda_coder/status/2078463245657211007"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="值得沉淀"&gt;值得沉淀&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;为 Claude Code 和 Codex 任务保留沙箱、最小权限与可恢复中间产物；额度或模型发生变化时可以快速重试。&lt;/li&gt;
&lt;li&gt;将 &lt;code&gt;/verify&lt;/code&gt;、&lt;code&gt;/code-review&lt;/code&gt; 等显式检查命令加入仓库验收清单，并对外部 MCP 先做权限审查。&lt;/li&gt;
&lt;/ul&gt;</description></item><item><title>X 情报日报 · 2026-07-17</title><link>https://x-digest-9tt.pages.dev/posts/2026-07-17-x-digest/</link><pubDate>Fri, 17 Jul 2026 08:30:00 +0800</pubDate><guid>https://x-digest-9tt.pages.dev/posts/2026-07-17-x-digest/</guid><category>AI</category><category>Codex</category><category>Claude Code</category><category>安全</category><category>开源模型</category><description>&lt;h2 id="今日要点"&gt;今日要点&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Codex 与 ChatGPT Work 再次重置限额，OpenAI 称活跃用户数已到 900 万&lt;/strong&gt; —— Tibo 表示，当日较早时候已有 900 万活跃用户；为维持系统稳定，团队再次处理了周额度恢复。此前已连续出现额度调整，说明高负载下的可用额度仍是动态运营项：把关键交付押在临近限额边缘的团队，仍应准备降级模型、任务拆分和可重试的工作流。 &lt;a href="https://x.com/thsottiaux/status/2077607697487188198"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;OpenAI 说明 Codex 意外删文件的高风险组合&lt;/strong&gt; —— 针对少数 GPT-5.6 意外删除文件的报告，Tibo 称常见于启用完全访问、关闭沙箱和自动审查，并且模型误将 &lt;code&gt;$HOME&lt;/code&gt; 作为临时目录处理的场景。官方正更新开发者提示与运行时防护；对用户而言，最直接的措施仍是保留沙箱、开启高风险操作审查，并避免让 agent 在未隔离的家目录中运行。 &lt;a href="https://x.com/thsottiaux/status/2077630111499882637"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Code 的 &lt;code&gt;/code-review&lt;/code&gt; 增加 effort 档位&lt;/strong&gt; —— ClaudeDevs 表示，低 effort 以较低 token 成本获得检查结果，高 effort 则追求更高召回率；每个档位都会重新执行评审。团队可以把它映射到风险：日常 PR 使用低档快速筛查，发布前、权限与数据迁移相关变更再提高 effort，并继续以测试和人工判断作为合并门槛。 &lt;a href="https://x.com/ClaudeDevs/status/2077840057130692886"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;GPT-Red 后续数据：GPT-5.6 Sol 在提示注入重放测试中失败次数少 6 倍&lt;/strong&gt; —— 这是对昨日 GPT-Red 发布的补充。OpenAI 称，使用训练中未见过的强攻击进行重放后，GPT-5.6 Sol 的失败数比四个月前最佳生产模型低 6 倍。该结果说明自动化对抗训练有实际收益，但它仍是特定内部测试；接入外部工具的应用应继续保留最小权限、输入隔离和人工确认。 &lt;a href="https://x.com/OpenAI/status/2077446722683650525"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;提示设计的重心：短指令、厚上下文与轻量 skills&lt;/strong&gt; —— OpenAI 的 Thariq 将有效 prompting 概括为“thin prompts、thick artifacts + context、thin skills”。关键不在把每次指令写得更长，而是把需求、约束、可验证产物和仓库上下文沉淀到 agent 可读取的位置；skills 则保持聚焦，避免把一次性细节做成难维护的通用流程。 &lt;a href="https://x.com/trq212/status/2077539537992229076"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Kimi K3 据报开放 Web 与 API，主打百万级上下文&lt;/strong&gt; —— TestingCatalog 称 K3 Max 和 K3 Swarm Max 已面向用户提供，支持最长 100 万 token 上下文，并定位编码、3D 游戏和复杂知识任务。该消息来自第三方资讯账号，正式接入前应以 Kimi 官方文档核对模型名、地区可用性、价格与 API 限制；Ethan Mollick 的早期体验也提到其能力接近前沿但会在任务中反复迭代。 &lt;a href="https://x.com/testingcatalog/status/2077759985761554501"&gt;来源&lt;/a&gt; &lt;a href="https://x.com/emollick/status/2077770187521069152"&gt;体验参考&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="值得沉淀"&gt;值得沉淀&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;为本地 agent 设定默认安全基线：沙箱开启、最小文件范围、自动审查开启；涉及删除、覆盖或环境变量重写时必须保留可恢复路径。&lt;/li&gt;
&lt;li&gt;把项目背景、验收标准和可执行检查沉淀为仓库中的上下文与轻量 skills，让 prompt 负责意图表达而非重复搬运资料。&lt;/li&gt;
&lt;/ul&gt;</description></item></channel></rss>