X 情报日报 · 2026-07-11
今日要点
Claude Code 桌面端加入应用内浏览器 —— Claude 现在可以在桌面应用里打开文档、设计稿或其他网站,像操作本地开发服务器一样读取、点击和交互。浏览环境带沙箱,并允许用户决定 session 是否持久化;这让“查资料—改代码—验证网页”的闭环更完整。来源
GPT-5.6 系列开始在 ChatGPT、Codex 和 API 推出 —— OpenAI 宣布 Sol、Terra、Luna 三款模型进入全球滚动发布。相比此前的预告,这次是实际 rollout 信号;需要做模型路由或回归测试的团队,可以开始按不同成本与能力档位安排实测。来源
OpenAI 推出由 Codex 和 GPT-5.6 驱动的 ChatGPT Work —— 新 agent 面向跨应用和文件的长任务,可持续工作数小时并把目标推进到成品;与此同时,OpenAI Developers 宣布 Codex 与 ChatGPT 会进入同一个桌面应用,并加入 Chrome 扩展、改版后的应用内浏览器和更快的 Computer Use。来源一 · 来源二
OpenAI 根据首日反馈调整 ChatGPT Work 与 Codex —— Tibo 承认最高算力档的用量影响提示不够清楚、桌面端重组让聊天和项目更难找,也引入了多 agent 与 plugin 回归。团队已着手修改默认档位和模型选择器、修复插件问题,并计划下周把聊天与项目以更熟悉、可定制的方式带回侧边栏。来源
Claude 上线月度使用回顾与数字健康提醒 —— Settings 中新增 Reflect dashboard,可查看自己最常使用 Claude 的时段和主要工作内容,也能设置安静时间与休息提醒。它把使用统计从单纯的额度视图,扩展到个人工作节奏管理。来源
GPT-Live 已覆盖全部 Go、Plus 和 Pro 用户 —— OpenAI 表示语音功能已完成对上述付费计划的全面 rollout,免费用户也在逐步开放。移动端需要升级到最新版 ChatGPT,适合关注实时语音交互的人直接验证体验。来源
OpenAI 把 Bio Bug Bounty 变为长期私有项目,奖金翻倍至 5 万美元 —— 新计划面向具备 AI 红队、安全或生物安全经验的研究者,重点寻找可绕过预设生物安全挑战的通用 jailbreak。相比一次性活动,常态化项目意味着前沿模型的生物能力防护会持续接受外部压力测试。来源
OpenAI 强调 GPT-5.6 的医疗智能成本曲线 —— 官方称 GPT-5.6 Luna 在最高推理档上的表现超过 GPT-5.5,同时成本低 25 倍。这个数字仍需结合具体医疗评测与风险控制理解,但对大规模健康场景的模型选型是一个值得复测的信号。来源
值得沉淀
- Claude Code 的应用内浏览器值得纳入前端 agent 的验证流程,重点观察沙箱边界、登录态持久化和生产环境访问控制。
- ChatGPT Work 首日调整说明,高算力档位必须同时设计清晰的用量反馈;内部 agent 产品也应把成本、重试与重任务进度做成显式状态。
- Bio Bug Bounty 的长期化适合持续跟踪,尤其是通用 jailbreak 的定义、披露机制和奖励边界。