Horizon 每日速递 - 2026-07-28

从 81 条内容中筛选出 15 条重要资讯。


  1. Moonshot 发布 2.8 万亿参数 Kimi K3 权重 ⭐️ 8.0/10
  2. 中国为何开放高性能 AI 模型 ⭐️ 8.0/10
  3. Claude 共享聊天和 Artifacts 出现在谷歌搜索中 ⭐️ 8.0/10
  4. 微软推出首款网络安全模型与智能代理安全系统 ⭐️ 8.0/10
  5. 蚂蚁百灵发布 Ling-3.0-Flash 混合推理模型 ⭐️ 8.0/10
  6. GitHub 将企业托管设置扩展至 Copilot 应用和云端代理 ⭐️ 8.0/10
  7. Vercel AI Gateway 支持区域推理 ⭐️ 8.0/10
  8. eve 新增 Slack 持久会话与事件控制 ⭐️ 8.0/10
  9. DeepsecBench 评估 AI 发现应用漏洞的能力 ⭐️ 8.0/10
  10. Anthropic 主张谨慎开放模型权重 ⭐️ 7.0/10
  11. ccteam 编排五十多个并行代码 Agent ⭐️ 7.0/10
  12. Zedis:用 Rust 和 GPUI 打造原生 Redis 桌面界面 ⭐️ 7.0/10
  13. 人工智能从聊天机器人走向电脑操作代理 ⭐️ 7.0/10
  14. Cloudflare 开源隐私代理命令行工具 ⭐️ 7.0/10
  15. GitHub 为 Copilot 应用访问新增专用策略 ⭐️ 7.0/10

Moonshot 发布 2.8 万亿参数 Kimi K3 权重 ⭐️ 8.0/10

2026 年 7 月 27 日,Moonshot 在 Hugging Face 发布了拥有 2.8 万亿参数的 Kimi K3 权重,文件总量约为 1.56 TB。该模型采用定制许可证,并增加了商业署名和模型即服务业务方面的要求。 此次发布让研究人员和基础设施提供商能够使用一个规模极大的开放权重模型,并可能加剧模型服务和托管推理领域的竞争。不过,庞大的下载量和部署要求意味着,实际自托管主要适合拥有大量计算和存储资源的机构。 Kimi K3 的权重约为 1.56 TB,因此即使公开可获取,对大多数个人开发者而言也难以部署。许可证要求达到相应规模的商业产品显示“Kimi K2”;如果模型即服务企业及其关联方在任意连续 12 个月内的总收入超过 2000 万美元,则在进行商业使用前必须与 Moonshot 另行签署协议。

rss · Simon Willison · 7月27日 23:39

背景: 开放权重是指模型训练后的参数被发布出来,其他人可以下载、研究或运行,但这并不一定符合开源的定义。参数数量反映模型规模,而权重文件大小反映发布文件所需的存储空间,二者并不等同于每种推理配置所需的内存。Kimi K3 延续了 Kimi K2 的定制 MIT 风格许可方式,同时扩大了对大型商业用户和模型即服务用户的限制。

参考链接

标签: #AI models, #Open weights, #Inference infrastructure, #Model licensing, #Hugging Face


中国为何开放高性能 AI 模型 ⭐️ 8.0/10

Moonshot AI 发布了开放权重且成本相对较低的 Kimi K3,据称在部分任务上超过一些美国领先模型。它的出现促使硅谷重新评估中国模型带来的竞争与经济影响。 如果高性能模型能够以较低价格获得或下载,美国公司可能需要降低价格,并改变模型采购和部署策略。它也为全球开发者提供了新的基础模型,可能加速开放权重模型与闭源模型之间的竞争。 Kimi K3 据称采用 Kimi Delta Attention 和 Attention Residuals,相关技术资料还提到其拥有 2.8 万亿参数、MXFP4 量化和 100 万令牌上下文窗口。开放权重并不等同于开源,因为训练数据、完整实现细节或再利用权利可能仍受到限制。

rss · The Verge AI · 7月27日 16:51

背景: 开放权重模型会按照规定的许可条件提供训练后的参数,因此开发者通常比使用仅提供接口的闭源模型更容易下载、运行或调整它。开源人工智能通常意味着更广泛地开放源代码、训练信息、许可条款和其他技术材料。这个区别很重要,因为开发者可能获得更大的部署灵活性,却未必能完全了解模型的构建过程。

参考链接

标签: #AI模型, #开放权重, #Moonshot AI, #中美AI竞争, #模型成本


Claude 共享聊天和 Artifacts 出现在谷歌搜索中 ⭐️ 8.0/10

有报道称,一些通过公开链接分享的 Claude 对话和 Artifacts 出现在谷歌及其他搜索结果中。该问题似乎与 Claude 的“分享聊天”功能有关,该功能允许任何拥有指定网址的人查看共享内容。 用户可能以为分享链接只会让收到链接的人访问内容,但搜索引擎索引可能使部分共享材料被意外访客发现。这会给开发者、团队以及在对话或 Artifact 中包含敏感信息的用户带来隐私和安全风险。 相关报道提到,可能暴露的内容包括个人信息、临床试验记录、访问代码、简历、API 密钥和财务信息,但现有报道并未证明所有共享链接都被索引。Anthropic 表示不会向谷歌等搜索引擎提供聊天目录或网站地图,但公开链接仍被描述为任何获得该链接的人都可以访问。

rss · TechCrunch AI · 7月27日 20:19

背景: Claude 的“分享聊天”功能会为对话或项目创建一个链接,其他人可以通过该链接查看内容。搜索引擎索引是可出现在搜索结果中的页面数据库;如果公开分享链接被收录,用户可能无需直接收到链接也能找到它。Artifacts 是与 Claude 相关、可供分享的项目输出或工作区。

参考链接

标签: #Claude, #Privacy, #Security, #AI Tools, #Google Search


微软推出首款网络安全模型与智能代理安全系统 ⭐️ 8.0/10

微软宣布推出 MAI-Cyber-1-Flash,这是其首个专门用于网络安全的自研 AI 模型,同时发布了智能代理网络安全系统 Project Perception。相关产品于 2026 年 7 月 27 日在旧金山的一场微软活动上公布。 这次发布推动微软的安全产品从 AI 辅助工具进一步发展到专用模型和能够分析安全信息、支持自动化运营的系统。它也让微软更直接地参与与 Anthropic、Google 和 OpenAI 在 AI 网络安全领域的竞争。 Project Perception 通过专门的 AI 代理分析安全数据并调用安全工具,而 MAI-Cyber-1-Flash 则针对网络安全任务进行优化,并非通用模型。现有发布信息尚未说明定价、部署要求、基准测试方法或系统可以自主执行操作的具体范围。

rss · TechCrunch AI · 7月27日 18:32

背景: 网络安全模型是经过训练或调整、用于分析安全数据和识别威胁等任务的 AI 模型。智能代理系统由多个专门代理组成,可以分析信息并使用工具完成工作流程中的部分任务,从而支持检测和响应自动化。在此次发布中,Project Perception 就是与微软专用模型一同推出的智能代理层。

参考链接

标签: #Microsoft, #AI Security, #Cybersecurity, #AI Agents


蚂蚁百灵发布 Ling-3.0-Flash 混合推理模型 ⭐️ 8.0/10

7 月 24 日,蚂蚁百灵发布 Ling-3.0-Flash 原生混合推理模型,旨在用同一套系统处理普通生成与深度推理任务。该模型总参数量为 124B,每个令牌约激活 5.1B 参数,已上线 OpenRouter 限时免费体验,后续计划正式开源。 该模型试图在降低推理成本的同时提升推理能力,可能改善代码生成、智能体系统和企业级人工智能应用的使用成本。它的发布也为不断加剧的高效混合推理模型竞争增加了一个重要的国产基础模型选项。 Ling-3.0-Flash 采用原生混合线性注意力架构,以 5:1 比例交替堆叠 KDA 和 MLA,并结合细粒度对角门控与 1/64 稀疏 MoE 结构。据报道,它在基础推理、指令遵循和长文本处理方面可对标或超过参数规模为其两至三倍的领先模型,但目前公开信息未提供独立基准测试细节或 API 使用条款。

rss · QbitAI · 7月27日 01:57

背景: 大语言模型通常按照令牌逐步生成文本,而面向推理的模型往往会为复杂任务投入更多计算。原生混合推理模型的目标,是在无需用户切换不同模型的情况下,统一处理普通生成和更深层的推理任务。混合专家架构保留较大的总参数规模,但每个令牌只激活其中一部分,因此有望降低推理成本;线性注意力组件则主要用于提升长文本处理效率。

参考链接

标签: #大语言模型, #混合推理, #国产AI, #AI开发平台


GitHub 将企业托管设置扩展至 Copilot 应用和云端代理 ⭐️ 8.0/10

GitHub 于 2026 年 7 月 27 日宣布,企业托管设置现已适用于 GitHub Copilot 应用和 Copilot 云端代理。这些产品可以使用企业统一管理的 Copilot 策略。 这项变化让组织能够以更一致的方式控制 Copilot 的使用,有助于使开发者工具和 AI 代理活动符合内部权限、合规与安全要求。通过减少不同 Copilot 产品之间的策略差异,它也可能降低企业规模化采用的管理成本。 企业托管设置是集中分发的配置策略,GitHub 文档列出了服务器托管、MDM 托管和文件部署等方式。这项公告覆盖 Copilot 应用和云端代理,而更广泛的托管设置体系还支持 VS Code 和 Copilot CLI 等客户端。

rss · GitHub Changelog · 7月27日 17:00

背景: 企业托管设置允许企业所有者集中定义配置和治理规则,而不必依赖开发者分别配置 Copilot。Copilot 云端代理在 GitHub 上执行编码工作,包括研究代码库、制定计划、在分支中修改代码以及创建供审核的拉取请求。将相同策略应用于 Copilot 应用和云端代理,可以把集中治理扩展到本地与 GitHub 托管的 Copilot 工作流。

参考链接

标签: #GitHub Copilot, #企业治理, #AI 代理, #开发者工具, #合规与安全


Vercel AI Gateway 支持区域推理 ⭐️ 8.0/10

Vercel AI Gateway 现在允许应用在请求中设置 inferenceRegion,将推理固定到美国或欧盟。如果没有供应商能够在所选区域提供服务,请求会失败而不是被路由到其他区域,并且每个响应都会报告实际处理请求的区域。 这项功能为生产团队提供了统一且不依赖供应商的数据驻留与合规控制,减少了为每个模型供应商单独配置区域路由的工作。它还提供可验证的实际执行区域信息,便于审计和运行监控。 网关支持美国和欧盟两个固定区域,也支持全球路由;未设置 inferenceRegion 的请求不提供数据驻留保证。区域推理可能更贵,因为供应商通常会在标准价格上加收约百分之十,但 AI Gateway 不会额外加价,只会传递供应商的区域价格。

rss · Vercel Blog · 7月27日 19:00

背景: 数据驻留是指控制人工智能推理执行的地理区域,以及供应商保存相关数据的区域。此前,团队必须为每个供应商分别实现这种路由,而全球路由可能难以验证请求实际在哪个区域执行。区域推理将路由选择集中到一个请求字段中,并在响应里公开实际服务区域。

参考链接

标签: #Vercel, #AI Gateway, #数据驻留, #合规, #云基础设施


eve 新增 Slack 持久会话与事件控制 ⭐️ 8.0/10

Vercel 的 eve agent 现在可以在活跃的 Slack 线程中持续回复,无需重复提及,还可以取消进行中的响应或重置整个对话。新增的 onMessage 和 onEvent 钩子支持更广泛的事件处理,参与者查询则支持根据加入线程的用户进行路由。 这些变化让基于 Slack 的 AI agent 在持续对话中更自然,也让开发者更容易控制其运行过程。事件驱动触发器还允许 agent 响应表情反应、新成员加入和频道创建等 Slack 活动,使其用途不再局限于被提及时聊天。 ctx.cancel() 会停止当前响应但保留会话,而 ctx.reset() 会终止线程所属会话,使下一条消息使用全新的历史记录、状态和沙箱。处理公共频道消息需要 message.channels 事件和 channels:history 权限;私有频道还需要 message.groups 和 groups:history,且 onEvent 可以多次调用 ctx.receive(),将一个事件分发给多个目标。

rss · Vercel Blog · 7月27日 17:00

背景: Slack 的 Events API 会将应用订阅的活动作为事件回调发送,而应用选择的事件类型会决定所需的信息和权限。 在 eve 中,拥有活跃会话的线程可以被视为已订阅线程,使 onMessage 能区分明确提及 bot 的消息和同一对话中的后续消息。该框架提供持久化工作流并连接 agent 与通信频道,因此这些钩子决定了 agent 如何接收和路由 Slack 活动。

参考链接

标签: #Slack, #AI agents, #Vercel, #Developer tools, #Event-driven apps


DeepsecBench 评估 AI 发现应用漏洞的能力 ⭐️ 8.0/10

Vercel 发布了 DeepsecBench,用于评估 AI 模型在应用代码中发现网络安全漏洞的能力。报告比较召回率、精确率、成本和总分析时间,并计算综合得分;在示例排行榜中,GPT-5.6 Sol 以 35.58 分领先。 该基准为开发和安全团队选择模型组合、扫描频率以及适合自身代码复杂度和预算的安全方案提供了实际参考。结果还显示,前沿模型目前仍然最强,但成本更低的开放权重模型和更高效的推理选项正在缩小性价比差距。 DeepsecBench 从一个开源代码库中选取 50 个入口文件,并使用包含 231 个经人工判断漏洞的隐藏标准集;其得分采用召回率加权的 F2 公式,使召回率的权重达到精确率的两倍。每次评测运行三次并报告中位数,标准集之外的发现则由另一个模型判断真伪,因此精确率部分依赖模型判断,这是一个限制。

rss · Vercel Blog · 7月27日 04:00

背景: 在漏洞检测中,召回率表示模型找到了多少已知漏洞,精确率表示模型报告的问题中有多少是真实的。DeepsecBench 更重视召回率,因为漏掉漏洞可能导致漏洞继续未被修复,而误报主要会增加人工审核工作。该基准隐藏了代码库、提交版本、文件和漏洞清单,旨在避免模型凭借记忆中的修复方案得分;目前报告的最佳运行仅找到了已知漏洞的 30.7%。

参考链接

标签: #网络安全, #AI代码审计, #模型评测, #开发者工具, #Vercel


Anthropic 主张谨慎开放模型权重 ⭐️ 7.0/10

Anthropic 发布了关于开放权重模型的正式立场,认为应在开放权重带来的创新与可及性收益,以及前沿模型可能产生的安全风险之间保持平衡。Anthropic 倾向于根据模型能力等级采取差异化发布策略,而不是对所有模型采用相同的开放方式。 这一立场可能影响领先人工智能公司是否公开模型权重的决策,尤其是在开放模型的能力和规模不断接近前沿水平的背景下。它也为人工智能安全治理、开发者获取模型以及负责任的模型分发方式提供了行业参考。 这是一份政策立场,而不是新模型或开发者平台的发布;现有材料也没有给出具体的能力阈值或详细发布流程。开放权重有助于扩大获取渠道并支持独立创新,但公开模型权重并不等同于完整开源,因为训练数据、代码和训练流程可能并未同时开放。

rss · V2EX Tech · 7月28日 00:06

背景: 开放权重模型是指向外界提供训练完成后的模型参数,使其他人能够下载、运行或调整这些模型。这样做可以支持本地部署和实验,但也可能让强大能力更容易被复制和传播。前沿模型是处于技术发展最前沿、能力最强的一类系统,因此相比能力较弱的模型,其发布可能带来更高的安全风险。

参考链接

标签: #Anthropic, #开放权重模型, #AI安全, #模型发布策略, #AI治理


ccteam 编排五十多个并行代码 Agent ⭐️ 7.0/10

开发者发布了采用 MIT 许可证的开源工具 ccteam,通过统一界面协作管理 Claude Code、Codex、Grok 等代码 Agent。它支持跨会话派工、异步接力,并可通过浏览器控制台、Telegram 或飞书查看和干预进度。 ccteam 解决了同时运行多个厂商代码 Agent 时的协调负担,让开发者无需持续守着每个终端会话。这种方式可能提升并行处理大量任务的工程师的生产力,同时保留不同模型厂商各自的优势。 作者称日常使用这套工具管理五十多个并行 Agent,并根据实际体验让 Grok 负责快速探路、Claude 负责复杂规划、Codex 负责长期编码和测试。该项目主要编排现有 Agent,而不是替代它们;不过现有材料没有独立验证其稳定性、安全性、成本控制能力或五十多个并行 Agent 的规模声明。

rss · V2EX Tech · 7月27日 16:18

背景: 代码 Agent 是一种能够编写代码、运行测试并在会话中持续执行任务的人工智能开发助手。如果没有编排层,开发者通常需要在不同终端中分别管理各厂商的 Agent,并手动在会话之间传递信息。ccteam 增加了协作层,使一个会话可以向不同厂商的 Agent 派发任务并收集结果,同时继续使用各厂商自身的项目知识机制。

参考链接

标签: #AI Agent, #开发者工具, #代码生成, #任务编排, #开源项目


Zedis:用 Rust 和 GPUI 打造原生 Redis 桌面界面 ⭐️ 7.0/10

Zedis 是一款近期进一步打磨的原生 Redis 图形客户端,使用 Rust 和 GPUI 构建,而不是套用 WebView。它集成了多服务器工作区、SSH 隧道、键空间浏览、多种 Redis 数据类型编辑、命令执行、运维诊断和生产安全模式,作者还分享了借助 Grok 与界面截图改进设计的实践。 这个项目把日常 Redis 开发和运维高频操作集中到非 WebView 的原生桌面应用中,对关注 Rust 桌面工具和 GPUI 应用的工程师具有参考价值。它从键编辑扩展到慢日志和内存分析,可能减少在多个 Redis 管理工具之间切换的需要,但作为个人工具,其生态成熟度和跨平台稳定性仍需验证。 Zedis 支持 String、Hash、List、Set、ZSet、Stream、RedisJSON、Bitmap、HyperLogLog、TimeSeries 以及 GEO 视图,并限制超大 value 的加载,避免将数百万字节内容一次性拖入编辑器。它还提供只读或安全模式、敏感配置字段加密、危险操作确认和内嵌终端;GPUI 本身仍处于积极开发阶段,尚未达到 1.0。

rss · V2EX Tech · 7月27日 13:35

背景: Redis 通过字符串、哈希、列表、集合、有序集合、流以及 HyperLogLog 等专用类型保存数据。Redis 图形客户端会以可视化方式展示这些结构,让用户查看键、编辑值、检查 TTL,并执行运维命令,而不必只依赖命令行客户端。GPUI 是 Zed 团队创建的 GPU 加速 Rust 界面框架,结合了即时模式和保留模式,但其文档说明该框架仍未达到 1.0 版本。

参考链接

标签: #Redis, #Rust, #GPUI, #开发者工具, #桌面应用


人工智能从聊天机器人走向电脑操作代理 ⭐️ 7.0/10

Simon Willison 评述了 Ethan Mollick 更新后的人工智能工具选择指南,并指出指南重点已转向能够一次完成相当于数小时人类工作的代理系统。指南重点介绍了 ChatGPT 和 Claude 中的 Work、Codex、Cowork 与 Code 模式,同时认为 Gemini 尚未建立可比的面向开发者选项。 这场讨论显示,人工智能正从主要回答提示的系统转向能够规划、使用工具并完成长期电脑任务的代理。这可能改变人们处理研究、编程和其他数字工作的方式,也会加大 Google 打造更强面向开发者代理产品的竞争压力。 这些模式的命名十分混乱:ChatGPT 的移动端 Work 模式与桌面端不同,而 ChatGPT 的 Work 和 Codex 也无法与 Claude 的 Cowork 和 Code 简单对应。具体来说,移动端 ChatGPT 的 Work 模式据称允许其 Code Interpreter 容器访问互联网;桌面端体验则更像是 Codex 的易用界面。

rss · Simon Willison · 7月27日 21:55

背景: 代理式人工智能是指能够通过多个步骤追求目标、使用工具或应用程序,而不只是生成一次性回答的系统。ChatGPT、Claude 和 Gemini 正通过专门的自主或代理模式逐步提供这类能力。Codex 是 OpenAI 推出的人工智能编程代理产品,可支持拉取请求、代码重构、代码审查以及并行工作流中的自动化任务。

参考链接

标签: #AI agents, #ChatGPT, #Claude, #AI tools, #Developer workflows


Cloudflare 开源隐私代理命令行工具 ⭐️ 7.0/10

Cloudflare 已开源 pvcli,这是一个类似 curl 的命令行工具,用于简化 Oblivious HTTP(OHTTP)等隐私协议的开发、测试和调试。它将多步骤的 OHTTP 流程整合到一条命令中。 pvcli 降低了运行隐私保护协议所需的配置复杂度,可帮助构建和验证隐私服务的开发者更容易使用 OHTTP。它可能推动隐私基础设施的更多实验和采用,但主要受众仍是协议与服务开发者。 该工具会在 OHTTP 流程中处理二进制 HTTP 编码、密钥获取、加密,以及中继到网关的路由。项目仓库指出,macOS 可能会因后台线程选项目前仅支持 pthread 而显示警告,但这对短生命周期的 pvcli 进程影响很小。

rss · Cloudflare Blog · 7月27日 13:00

背景: Oblivious HTTP 是一种协议:端到端加密的请求和响应会经过中继,从而将请求者身份与发送给目标服务器的内容分离。这样可以让网关无法得知请求来自谁,同时让中继无法读取请求内容。pvcli 为这一原本包含多个步骤的交互提供了更简单的命令行接口。

参考链接

标签: #Cloudflare, #Privacy, #OHTTP, #CLI, #Open Source


GitHub 为 Copilot 应用访问新增专用策略 ⭐️ 7.0/10

2026 年 7 月 27 日,GitHub 宣布 GitHub Copilot 应用现已支持通过专用策略,在企业和组织层面控制用户访问权限。此前,该应用的访问权限并非通过独立策略进行管理。 这项更新让企业和组织管理员能够更精确地控制哪些用户可以使用 Copilot 应用。它有助于实现权限隔离、满足合规要求,并支持分阶段推广,而不必同时改变其他 Copilot 功能的访问权限。 这项专用策略可在企业和组织两个层面配置,而 GitHub 更广泛的 Copilot 策略体系还可以管理功能、代理和模型。公告没有说明其他发布条件、许可变化或该应用具体提供哪些策略选项。

rss · GitHub Changelog · 7月27日 20:43

背景: GitHub Copilot 是一种人工智能开发助手,可在 GitHub 和受支持的开发环境中提供编程与对话能力。在 GitHub 的管理模型中,企业策略提供更高层级的治理,组织策略则控制特定组织所管理用户的功能可用性。专用应用策略能够将 Copilot 应用的访问控制,与更广泛的 Copilot 访问决策区分开来。

参考链接

标签: #GitHub Copilot, #GitHub Enterprise, #权限管理, #企业治理