Horizon 每日速递 - 2026-09-16
AIHOT 已筛选并处理 13 条重要资讯;Horizon 负责页面生成、归档与发布。
- Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking
- 生数科技发布 Vidu S2:含 Avatar 与 Editing 双模型,探索空间视频
- 阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一
- Google 发布 TranslateGemma 等多语言 AI 成果,语言技术覆盖 300 多种语言
- Claude for Small Business 新增 43 个工作流和 27 个集成,并推出免费培训计划
- Perplexity 自研 CobbleDB 替代 AWS DynamoDB,每年最多可节省一亿美元
- Gergely Orosz 探访 OpenAI:Codex 驱动的智能体软件工厂
- Anthropic 与 OpenAI 提议协调放缓前沿 AI 开发,Cohere CEO 等批评者质疑其真实动机
- 404 Media 曝光 OpenAI 莉莉计划:人工审核 ChatGPT 聊天记录以优化模型
- Arena 更新 Image-to-WebDev 榜单:GPT-6 Astra 以 1733 分登顶
- Artificial Analysis 评测:GPT-Live-1 以 81.5 分登顶 Speech to Speech Index
- Trail of Bits 批评 1Password 的 AI 补丁基准存在误导,并发布两个补丁验证 Agent 技能
- Vercel 将 inbound 销售团队从 10 人压缩至 1.25 人,AI 销售开发智能体年成本仅数千美元
模型发布/更新
Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking
Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个近实时语音对话模型,主打语音智能体和复杂任务执行。
来源:Google DeepMind:Blog(RSS)
生数科技发布 Vidu S2:含 Avatar 与 Editing 双模型,探索空间视频
生数科技正式发布 Vidu S2,包含面向数字角色实时交互的 Vidu S2-Avatar 和面向视频流实时编辑的 Vidu S2-Editing,并探索面向 VR 头显的实时空间视频生成与编辑。
来源:公众号:生数科技(Vidu·视频)
阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一
阶跃星辰发布 StepAudio 3 系列,包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,已在阶跃星辰开放平台上线。
来源:公众号:阶跃星辰(Step)
产品发布/更新
Google 发布 TranslateGemma 等多语言 AI 成果,语言技术覆盖 300 多种语言
Google 宣布其语言技术已支持超过 300 种语言、覆盖全球 86% 人口,并发布 TranslateGemma 轻量开源翻译模型(基于 Gemini 训练、支持 55 种语言、可离线运行)。
来源:Google Blog:AI(RSS)
Claude for Small Business 新增 43 个工作流和 27 个集成,并推出免费培训计划
Anthropic 为 Claude for Small Business 新增 43 个工作流和 27 个集成,覆盖 Shopify、Salesforce、Stripe、Gusto 等,该产品自 5 月上线以来安装量超过 90 万次。工作流默认处于审批模式,所有发送、发布或付款需用户确认;今秋将在 10 个美国城市举办免费工作坊,14 个集成伙伴从 9 月底到 11 月各举办一场免费网络研讨会。
来源:Claude:Blog(网页)
行业动态
Perplexity 自研 CobbleDB 替代 AWS DynamoDB,每年最多可节省一亿美元
Perplexity CEO Aravind Srinivas 宣布自研键值数据库 CobbleDB,替代 AWS DynamoDB 用于快速网页内容抓取,迁移后每年最多可节省一亿美元。该项目由两名工程师和数百个持续运行的 Computer 智能体在两个月内完成核心基础设施,官方研究称热存储批次读取延迟较 DynamoDB 全分布下降约 5 倍(P50 从 31.4ms 降至 5.60ms)。
来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
技巧与观点
Gergely Orosz 探访 OpenAI:Codex 驱动的智能体软件工厂
Gergely Orosz 实地探访 OpenAI 总部并访谈七位工程师与工程负责人,发现自约一月起 Codex 和 ChatGPT Work 已成为公司几乎所有工作的基础。
来源:Pragmatic Engineer(RSS)
Anthropic 与 OpenAI 提议协调放缓前沿 AI 开发,Cohere CEO 等批评者质疑其真实动机
Anthropic CEO Dario Amodei 呼吁行业与政府协调放缓前沿 AI 开发,并寻求反垄断豁免,Sam Altman 与 Elon Musk 表示同意。
来源:The Decoder:AI News(RSS)
404 Media 曝光 OpenAI 莉莉计划:人工审核 ChatGPT 聊天记录以优化模型
404 Media 披露 OpenAI 内部代号为莉莉计划(Project Lily)的项目,由时薪超 50 美元的提示词审核员查看匿名化后的真实用户聊天记录,评判回复是否切题、是否存在 AI 式话术和谄媚口吻。
来源:IT之家(RSS)
Arena 更新 Image-to-WebDev 榜单:GPT-6 Astra 以 1733 分登顶
Arena 更新 Image-to-WebDev 排行榜,纳入四个新评测模型。GPT-6 Astra (Max) 以 1733 分居第一,领先 GPT-5.6 Sol (xHigh) 129 分;Claude Fable 5.1 (Max) 以 1710 分排第二,Muse Spark 1.3 (Max) 1645 分第四,GLM-5.3-Flash 1588 分第十。
来源:X:Arena (@arena)
Artificial Analysis 评测:GPT-Live-1 以 81.5 分登顶 Speech to Speech Index
Artificial Analysis 发布 Speech to Speech Index,OpenAI 的 GPT-Live-1 以 81.5 分(Astra 后端,medium 推理强度)排名第一,超过 Grok Voice Think Fast 2.0 High 的 81.3;Sol 后端配置得 80.1 排第三。
来源:X:Artificial Analysis (@ArtificialAnlys)
Trail of Bits 批评 1Password 的 AI 补丁基准存在误导,并发布两个补丁验证 Agent 技能
Trail of Bits 发文批评 1Password 8月6日发布的 FLAWED 报告,称其 26% 的 AI 干净修复率受四项实验设计选择影响而失真,包括刻意指示智能体应用错误修复的提示词占 22% 数据、36% 的试验禁止编译测试,以及不同推理档位设置。
来源:Trail of Bits:AI安全研究
Vercel 将 inbound 销售团队从 10 人压缩至 1.25 人,AI 销售开发智能体年成本仅数千美元
Vercel COO Jeanne DeWitt Grosser 在 The Information 访谈中表示,公司 inbound 销售开发已实现 90% 自动化,团队从 10 人压缩至 1.25 人。
来源:Tomer Tunguz 博客(VC 分析)
资讯筛选与摘要由 AIHOT 提供;Horizon 负责页面生成与归档。