Horizon 每日速递 - 2026-09-03

从 88 条内容中筛选出 11 条重要资讯。


  1. Claude Fable/Mythos 5.1:新 SOTA 模型,缓存费用降 75% ⭐️ 9.0/10
  2. Gemini 3.8 Flash 光速发布,细节仍欠打磨 ⭐️ 9.0/10
  3. 李飞飞 World Labs 发布 3D 世界模型 Atlas ⭐️ 9.0/10
  4. OpenAI 的新推理技术令 AI 安全专家感到担忧 ⭐️ 8.0/10
  5. 美国政府支持 OpenAI 在 AI 训练版权问题上的立场 ⭐️ 8.0/10
  6. 阿里 Qwen3.8-Max 前端编程登顶全球 ⭐️ 8.0/10
  7. Copilot 应用和 CLI 中的内容排除功能现已正式发布 ⭐️ 8.0/10
  8. 5X 的 Codex 一天半烧完了,晒晒我的智障多智能体工作流 ⭐️ 7.0/10
  9. Clipture 新增 Windows 支持、录屏与 AI Agent Skill ⭐️ 7.0/10
  10. Subpool:开源团队 AI 订阅管理工具 ⭐️ 7.0/10
  11. Claude Code v2.1.259 新增托管 MCP 服务器、GitLab MR 支持与无头权限提示 ⭐️ 7.0/10

Claude Fable/Mythos 5.1:新 SOTA 模型,缓存费用降 75% ⭐️ 9.0/10

Anthropic 发布了 Claude Fable/Mythos 5.1,这是一款新的 SOTA 模型,其提示缓存价格降低 75%,输出 token 数量增加 70%。 此次发布大幅降低了长上下文应用的成本,同时扩展了输出容量,对基于 Claude 开发的开发者来说是一次重大升级。这也表明前沿 AI 模型之间的定价竞争仍在继续。 该模型号称达到 SOTA 水平,缓存价格降低 75%,输出 token 上限增加 70%。公告中未提供更多技术细节。

rss · Latent Space · 9月2日 07:46

背景: 提示缓存(prompt caching)是一种存储重复提示前缀中间键值状态的技术,使模型可以在多次 API 调用中重用这些状态,从而降低发送相同上下文的应用程序的成本和延迟,例如代码编辑或多轮聊天。OpenAI 和 Azure OpenAI 已经支持提示缓存,而 Anthropic 此次降低缓存读取价格,使得在 Claude 上运行此类工作负载更加便宜。

参考链接

标签: #AI, #Claude, #model release, #pricing, #SOTA


Gemini 3.8 Flash 光速发布,细节仍欠打磨 ⭐️ 9.0/10

Google 发布 Gemini 3.8 Flash,这是六周内第三款 Flash 模型,虽然跑分逼近旗舰,但实测细节粗糙。 这一转变表明 Google 优先考虑规模与成本,而非前沿模型竞争。开发者可获得快速便宜的模型,但需管理质量让步。 Gemini 3.8 Flash 在 DeepSWE v1.1 得 71%、HLE-Verified 得 54.9%,定价与 3.7 Flash 相同(输入每百万 Token 0.75 美元、输出 3.75 美元);其性能提升来自额外推理步骤和工具检查,用户可调低推理档位以节省成本。

rss · BestBlogs.dev · 9月3日 06:52

背景: Gemini 3.8 Flash 是 Google Gemini 系列中的轻量模型,定位为 Gemini 3.7 Flash 的下一代迭代。它面向 Agent 工作流以及搜索、手机助手等大规模消费级任务,速度和成本比前沿性能更重要。Google 一直快速迭代 Flash 系列,而 Pro 模型遭遇延误,反映出向规模与实用性转型的战略。

参考链接

标签: #AI, #Gemini, #Google, #model release, #developer tools


李飞飞 World Labs 发布 3D 世界模型 Atlas ⭐️ 9.0/10

李飞飞创办的 World Labs 于 2026 年 9 月发布 3D 世界模型 Atlas,仅用 3-5 台手机拍摄即可重建三维场景,并能从任意视角生成视频,支持精确相机位姿控制与 Real-to-Sim 能力。 这一突破大幅降低了高质量三维场景捕捉与视角合成的门槛,创作者只需几部手机即可制作「子弹时间」效果,同时为机器人训练提供了可扩展的 Real-to-Sim 数据生成路径,有望重塑内容创作与具身智能领域。 Atlas 基于多模态自回归扩散 Transformer,将文字、图像、深度和相机位姿统一到空间上下文中,能够从稀疏视角推断未覆盖区域。与主流视频生成模型不同,它原生支持精确的相机位姿控制,并能输出稠密深度图、点云和 3D Gaussian Splat 等结构化空间数据,可在设备上实时渲染。

rss · BestBlogs.dev · 9月2日 16:42

背景: 3D 世界模型是一类能够学习物理空间内部表征的 AI 系统,可从有限输入合成新视角。Atlas 被描述为面向空间智能的「全能世界模型」,能够处理文本、图像、视频、相机信息、深度和 3D 数据。相机位姿(Camera Pose)指相机在三维空间中的位置和朝向,精确的位姿控制对于三维重建和视角合成至关重要。Sim-to-Real 是一种机器人训练范式,先在模拟环境中训练模型再迁移到真实机器人上,成本更低、更安全;Atlas 的 Real-to-Sim 能力可从真实拍摄快速生成逼真的数字孪生场景,用于大规模机器人训练。

参考链接

标签: #AI, #3D World Model, #World Labs, #Spatial Computing, #Real-to-Sim


OpenAI 的新推理技术令 AI 安全专家感到担忧 ⭐️ 8.0/10

OpenAI 的新 Astra 模型将采用“循环深度”技术,使其能够跳出顺序思维进行推理,这引发了 AI 安全专家的担忧。

rss · TechCrunch AI · 9月2日 20:19

标签: #OpenAI, #AI safety, #reasoning models, #Astra, #recurrent depth


美国政府支持 OpenAI 在 AI 训练版权问题上的立场 ⭐️ 8.0/10

美国政府向法院提交了支持 OpenAI 的法律简报,称在训练大型语言模型时使用受版权保护的材料符合国家利益,并强调保持 AI 产业竞争力至关重要。 这一表态可能影响法院和监管机构,为所有 AI 开发者放宽训练数据的版权限制树立先例。 简报指出美国在建立强劲且具有全球竞争力的 AI 产业方面有重大利益,但新闻报道中未提供具体的法律论证和案件细节。

rss · TechCrunch AI · 9月2日 17:09

背景: 在受版权保护的数据上训练 AI 模型是当前针对 OpenAI 等公司的多起诉讼的核心问题。美国政府的介入标志着政府在相关辩论中的明确立场,可能影响未来对 AI 训练中合理使用的法律解释。

标签: #AI policy, #copyright, #OpenAI, #regulation, #legal


阿里 Qwen3.8-Max 前端编程登顶全球 ⭐️ 8.0/10

阿里巴巴更新了旗舰模型 Qwen3.8-Max,声称其前端编程能力已跃居全球第一。这款 2.4 万亿参数的多模态推理模型现已通过 API 全面开放。 这一进展对全栈工程师和更广泛的 AI 编程生态具有重要意义,表明阿里的模型现在能够在前端代码生成领域跻身顶尖梯队。如果该说法属实,可能会重塑开发者工作流,并加剧 AI 辅助编码工具的竞争。 Qwen3.8-Max 是 Qwen3.8-Max Preview 的通用可用后续版本,拥有 2.4 万亿参数,具备多模态推理能力,可处理复杂推理、视觉理解、编码和智能体工作流。在开放权重发布之前,它已可通过 API 访问。

rss · QbitAI · 9月2日 06:10

背景: Qwen 是阿里巴巴的大语言模型系列,其中 Max 变体是旗舰层级。前端编程基准测试评估 AI 模型生成和调试用户界面代码的能力,这正成为 AI 编码助手的核心竞争力。此次发布延续了中国 AI 实验室快速迭代编程模型、争夺开发者心智的趋势。

参考链接

标签: #Alibaba, #Qwen, #AI Model, #Frontend, #Coding


Copilot 应用和 CLI 中的内容排除功能现已正式发布 ⭐️ 8.0/10

GitHub Copilot 的内容排除功能现已在 Copilot 应用和 CLI 中正式发布,使企业、组织和仓库管理员能够阻止被排除的文件被用作上下文。 将内容排除扩展到应用和 CLI,让管理员在更多工具界面上获得一致的控制权,有助于组织在使用 Copilot 时保护敏感数据并遵守隐私或安全政策。 内容排除可在企业、组织和仓库级别进行配置,但存在一些限制:Copilot 仍可能通过 IDE 间接使用被排除文件的语义信息(如类型信息或悬停定义),且排除规则不适用于符号链接或位于远程文件系统上的仓库。

rss · GitHub Changelog · 9月2日 18:14

背景: 内容排除是 GitHub Copilot 推出的一项策略功能,允许管理员指定 Copilot 不应将其用作建议或聊天上下文的文件或目录。该功能此前已可在 Visual Studio Code 和 JetBrains 等 IDE 中使用,现在扩展到 Copilot 应用和 CLI。管理员可以定义适用于整个组织的排除模式,从而防止敏感或专有代码被发送到 AI 模型。

参考链接

标签: #GitHub Copilot, #AI, #Developer Tools, #Privacy, #Security


5X 的 Codex 一天半烧完了,晒晒我的智障多智能体工作流 ⭐️ 7.0/10

一位开发者在一天半内烧光了 100 美元的 Codex 额度,原因是过度设计的多智能体工作流模拟人类团队,引发了关于智能体编排和成本效率的讨论。

rss · V2EX Tech · 9月2日 07:16

标签: #AI Coding, #Codex, #Multi-Agent Workflow, #Cost Management, #Developer Experience


Clipture 新增 Windows 支持、录屏与 AI Agent Skill ⭐️ 7.0/10

免费的截图工具 Clipture 已更新,新增 Windows 版、MP4/GIF 录屏、贴图、截图二次编辑和录制历史预览,并已在 Mac 和 Windows 商店上架。它还引入了 Codex / AI Agent Skill,使 AI 代理能够自主调用该工具进行标注。 此次更新将 Clipture 的覆盖面扩展到更广泛的 Windows 用户,并新增录屏功能;同时,AI Agent Skill 使其成为可被 AI 代理自主调用的工具,顺应了软件不仅服务人类也为 AI 服务的趋势。这对寻求跨平台、注重隐私的生产力工具的开发者和小团队尤为有用。 该工具依然永久免费、无广告、无水印,并采用本地优先架构,所有处理均在设备上完成。功能亮点包括窗口/区域/全屏/多窗口截图、自动滚动长截图、带暂停恢复和画质配置的 MP4/GIF 区域录制、标注工具(矩形、圆形、箭头、文字、画笔、马赛克、序号)、本地 OCR、贴图置顶、截图历史与二次编辑、剪贴板历史搜索与预览、自定义全局快捷键,以及 Codex / AI Agent Skill。

rss · V2EX Tech · 9月2日 13:18

背景: Clipture 是一款遵循本地优先(local-first)软件理念的截图工具,数据主要存储在用户设备上而非远程服务器,从而保障隐私并支持离线使用。Agent Skills 是一种轻量级开放格式,通过包含 SKILL.md 文件的目录来扩展 AI 代理的专业知识与工作流能力。OpenAI 的 Codex 是一款用于软件工程任务的 AI 编码代理,Clipture 与它的集成让 AI 代理能够自主调用该工具完成截图标注工作流。

参考链接

标签: #screenshot tool, #AI agent, #developer tool, #Windows, #productivity


Subpool:开源团队 AI 订阅管理工具 ⭐️ 7.0/10

Subpool 是一个新开源、可自托管的 Go 服务,允许团队统一接入多个 Codex 或 OpenAI 兼容 API 订阅,为每个成员分配独立的 API Key,并跟踪账户健康状态和 Token 用量。 它解决了工程团队管理多个 AI 订阅时的实际痛点,减少配额冲突和手动切换账号的麻烦。随着 AI 编程工具普及,集中化的订阅治理和用量审计变得至关重要。 Subpool 支持 Codex 设备码授权、基于池的请求路由、Codex 与 API 账号混合池,以及 Responses、Chat Completions 和 Models API。它不保存 Prompt、回复或源代码,仅记录账号分配、路由状态和 Token 用量。

rss · V2EX Tech · 9月2日 11:04

背景: Codex 是 OpenAI 的编程智能体,可通过 ChatGPT 订阅(在无头/远程环境中使用设备码授权)或 API Key 访问。OpenAI 兼容 API 提供标准的 Chat Completions 和 Responses 等端点,便于使用不同模型。在团队中,多个成员常共享同一订阅,导致配额冲突,也难以追踪个人使用情况。Subpool 将多个订阅聚合为池,并根据可用性将每个成员的请求路由到某个账号,同时为每个成员签发独立的 Key 以实现责任追踪。

参考链接

标签: #AI subscription management, #API key management, #Codex, #self-hosted, #developer tools


Claude Code v2.1.259 新增托管 MCP 服务器、GitLab MR 支持与无头权限提示 ⭐️ 7.0/10

Claude Code v2.1.259 新增了 managedMcpServers 托管设置,让组织可以向所有用户提供 HTTP/SSE MCP 服务器;新增 --permission-prompts none 用于无人值守的主机;识别 glab 合并请求命令,使其在工具摘要中显示为 MR !N;并为 claude plugin validate 添加了 --json 输出。此外还修复了并发会话静默覆盖彼此 ~/.claude.json 更改的问题,以及其他一些缺陷。 此版本通过让组织集中管理 MCP 服务器并安全运行无人值守会话,使 Claude Code 更适合企业部署和 CI/CD 自动化。GitLab 用户获得了对合并请求的一流可见性,而并发修复解决了运行大量并行会话的团队的实际痛点。 托管 MCP 条目中指定命令的将被跳过,因此仅支持 HTTP/SSE 服务器;--permission-prompts none 会拒绝任何需要提示的操作,同时活动权限模式(包括自动模式)继续做出决定。GitLab MR 识别覆盖 glab mr create/merge/close/reopen/note/update,并发修复防止工作区信任重置和 MCP/项目状态丢失。

rss · Claude Code Releases · 9月2日 22:33

背景: Claude Code 是 Anthropic 推出的基于 CLI 的智能体编码工具,在本地终端运行。模型上下文协议(MCP)是 Anthropic 于 2024 年 11 月推出的开放标准,用于连接 AI 应用与外部工具和数据源;MCP 服务器可通过 HTTP/SSE 或本地命令进程暴露工具。glab 是 GitLab 官方 CLI 工具,将合并请求等 GitLab 操作带入终端。此版本还针对自动化/无头环境的权限提示进行了改进,并提升了多个会话并发运行时的状态一致性。

参考链接

标签: #Claude Code, #MCP, #GitLab, #Developer Tools, #CLI