<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>安全 · 情报日报</title><link>https://x-digest-9tt.pages.dev/tags/%E5%AE%89%E5%85%A8/</link><description>每日由 agent 自动整理的 X/Twitter 情报摘要</description><language>zh-cn</language><atom:link href="https://x-digest-9tt.pages.dev/tags/%E5%AE%89%E5%85%A8/index.xml" rel="self" type="application/rss+xml"/><item><title>X 情报日报 · 2026-07-17</title><link>https://x-digest-9tt.pages.dev/posts/2026-07-17-x-digest/</link><pubDate>Fri, 17 Jul 2026 08:30:00 +0800</pubDate><guid>https://x-digest-9tt.pages.dev/posts/2026-07-17-x-digest/</guid><category>AI</category><category>Codex</category><category>Claude Code</category><category>安全</category><category>开源模型</category><description>&lt;h2 id="今日要点"&gt;今日要点&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Codex 与 ChatGPT Work 再次重置限额，OpenAI 称活跃用户数已到 900 万&lt;/strong&gt; —— Tibo 表示，当日较早时候已有 900 万活跃用户；为维持系统稳定，团队再次处理了周额度恢复。此前已连续出现额度调整，说明高负载下的可用额度仍是动态运营项：把关键交付押在临近限额边缘的团队，仍应准备降级模型、任务拆分和可重试的工作流。 &lt;a href="https://x.com/thsottiaux/status/2077607697487188198"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;OpenAI 说明 Codex 意外删文件的高风险组合&lt;/strong&gt; —— 针对少数 GPT-5.6 意外删除文件的报告，Tibo 称常见于启用完全访问、关闭沙箱和自动审查，并且模型误将 &lt;code&gt;$HOME&lt;/code&gt; 作为临时目录处理的场景。官方正更新开发者提示与运行时防护；对用户而言，最直接的措施仍是保留沙箱、开启高风险操作审查，并避免让 agent 在未隔离的家目录中运行。 &lt;a href="https://x.com/thsottiaux/status/2077630111499882637"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Code 的 &lt;code&gt;/code-review&lt;/code&gt; 增加 effort 档位&lt;/strong&gt; —— ClaudeDevs 表示，低 effort 以较低 token 成本获得检查结果，高 effort 则追求更高召回率；每个档位都会重新执行评审。团队可以把它映射到风险：日常 PR 使用低档快速筛查，发布前、权限与数据迁移相关变更再提高 effort，并继续以测试和人工判断作为合并门槛。 &lt;a href="https://x.com/ClaudeDevs/status/2077840057130692886"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;GPT-Red 后续数据：GPT-5.6 Sol 在提示注入重放测试中失败次数少 6 倍&lt;/strong&gt; —— 这是对昨日 GPT-Red 发布的补充。OpenAI 称，使用训练中未见过的强攻击进行重放后，GPT-5.6 Sol 的失败数比四个月前最佳生产模型低 6 倍。该结果说明自动化对抗训练有实际收益，但它仍是特定内部测试；接入外部工具的应用应继续保留最小权限、输入隔离和人工确认。 &lt;a href="https://x.com/OpenAI/status/2077446722683650525"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;提示设计的重心：短指令、厚上下文与轻量 skills&lt;/strong&gt; —— OpenAI 的 Thariq 将有效 prompting 概括为“thin prompts、thick artifacts + context、thin skills”。关键不在把每次指令写得更长，而是把需求、约束、可验证产物和仓库上下文沉淀到 agent 可读取的位置；skills 则保持聚焦，避免把一次性细节做成难维护的通用流程。 &lt;a href="https://x.com/trq212/status/2077539537992229076"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Kimi K3 据报开放 Web 与 API，主打百万级上下文&lt;/strong&gt; —— TestingCatalog 称 K3 Max 和 K3 Swarm Max 已面向用户提供，支持最长 100 万 token 上下文，并定位编码、3D 游戏和复杂知识任务。该消息来自第三方资讯账号，正式接入前应以 Kimi 官方文档核对模型名、地区可用性、价格与 API 限制；Ethan Mollick 的早期体验也提到其能力接近前沿但会在任务中反复迭代。 &lt;a href="https://x.com/testingcatalog/status/2077759985761554501"&gt;来源&lt;/a&gt; &lt;a href="https://x.com/emollick/status/2077770187521069152"&gt;体验参考&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="值得沉淀"&gt;值得沉淀&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;为本地 agent 设定默认安全基线：沙箱开启、最小文件范围、自动审查开启；涉及删除、覆盖或环境变量重写时必须保留可恢复路径。&lt;/li&gt;
&lt;li&gt;把项目背景、验收标准和可执行检查沉淀为仓库中的上下文与轻量 skills，让 prompt 负责意图表达而非重复搬运资料。&lt;/li&gt;
&lt;/ul&gt;</description></item><item><title>X 情报日报 · 2026-07-16</title><link>https://x-digest-9tt.pages.dev/posts/2026-07-16-x-digest/</link><pubDate>Thu, 16 Jul 2026 09:00:00 +0800</pubDate><guid>https://x-digest-9tt.pages.dev/posts/2026-07-16-x-digest/</guid><category>AI</category><category>Codex</category><category>Claude Code</category><category>安全</category><description>&lt;h2 id="今日要点"&gt;今日要点&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;OpenAI 发布 GPT-Red，用自动化红队规模化测试提示注入&lt;/strong&gt; —— OpenAI 介绍了一套内部自动红队系统，目标是在更广泛部署前，持续寻找模型的 prompt injection 漏洞。随着模型可调用工具和外部数据，安全评测的瓶颈正从“能否发现问题”转向“能否持续、大规模地发现问题”；这类自动化评测会成为产品上线前的重要基础设施。 &lt;a href="https://x.com/OpenAI/status/2077446718728425686"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Code Artifacts 现可调用 MCP connectors&lt;/strong&gt; —— ClaudeDevs 表示，Artifact 中的仪表盘和应用可按每位查看者的请求获取信息、执行操作；Pro、Max、Team、Enterprise 可用，但公开分享的 Artifact 不支持。这让 Artifact 从静态演示进一步走向带权限边界的操作界面，团队应先厘清连接器授权和可执行动作。 &lt;a href="https://x.com/ClaudeDevs/status/2077489907350856038"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Codex in Chrome 展示从请求到上线计划的工作流&lt;/strong&gt; —— OpenAI Developers 演示了让 Codex 根据表单建立清单、汇集 Google Drive、Slack 和本地文件的上下文、标出待跟进项、更新门户并草拟回复的流程，最终决策仍由用户完成。它的价值不只是“写代码”，而是把跨系统的项目推进步骤组织成可审阅的执行计划。 &lt;a href="https://x.com/OpenAIDevs/status/2077468133120766044"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Codex 两个月已有 150 多项更新，官方集中回顾核心能力&lt;/strong&gt; —— OpenAI Developers 称 Codex 周活用户已超过 700 万，并汇总了 GPT-5.6/Ultra、&lt;code&gt;/goal&lt;/code&gt; 并行工作、computer use 加速、AppShots、内联编辑、Sites、移动端与 SSH 工作流，以及从代码审查到合并 PR 的能力。对日常使用者而言，值得按自己的开发链路重查一遍入口，而不是只把 Codex 当作单一聊天式编码工具。 &lt;a href="https://x.com/OpenAIDevs/status/2077166520392970529"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Claude Code 团队：把领域知识编码成基础设施，才会放大 agent&lt;/strong&gt; —— Boris Cherny 认为，lint、CI、测试、注释、skills、&lt;code&gt;CLAUDE.md&lt;/code&gt;、评审规则与记忆都应承载原本留在个人脑中的知识。与其让 agent 每次临场修同一种问题，不如让它把规则沉淀为可复用的自动化；这也能降低新人和非工程成员参与代码库的门槛。 &lt;a href="https://x.com/bcherny/status/2077460395279692197"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;&lt;strong&gt;Grok Build 宣布开源&lt;/strong&gt; —— Elon Musk 发文称 Grok Build 已开源。当前帖文没有给出仓库、许可证或可复现细节，因而更适合作为待核实的生态动态；若计划采用，应先确认项目地址、授权条款和实际可运行范围。 &lt;a href="https://x.com/elonmusk/status/2077495635687723408"&gt;来源&lt;/a&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="值得沉淀"&gt;值得沉淀&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;为任何能读写第三方系统的 agent 建立最小权限、操作确认和审计记录；MCP 接入的便利不应绕过授权设计。&lt;/li&gt;
&lt;li&gt;把反复出现的代码评审意见、发布检查与架构约束转为仓库内可执行的规则和文档，再让 agent 使用它们。&lt;/li&gt;
&lt;/ul&gt;</description></item></channel></rss>