Horizon 每日速递 - 2026-09-16

AIHOT 已筛选并处理 13 条重要资讯;Horizon 负责页面生成、归档与发布。

查看 AIHOT 原始日报


  1. Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking
  2. 生数科技发布 Vidu S2:含 Avatar 与 Editing 双模型,探索空间视频
  3. 阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一
  4. Google 发布 TranslateGemma 等多语言 AI 成果,语言技术覆盖 300 多种语言
  5. Claude for Small Business 新增 43 个工作流和 27 个集成,并推出免费培训计划
  6. Perplexity 自研 CobbleDB 替代 AWS DynamoDB,每年最多可节省一亿美元
  7. Gergely Orosz 探访 OpenAI:Codex 驱动的智能体软件工厂
  8. Anthropic 与 OpenAI 提议协调放缓前沿 AI 开发,Cohere CEO 等批评者质疑其真实动机
  9. 404 Media 曝光 OpenAI 莉莉计划:人工审核 ChatGPT 聊天记录以优化模型
  10. Arena 更新 Image-to-WebDev 榜单:GPT-6 Astra 以 1733 分登顶
  11. Artificial Analysis 评测:GPT-Live-1 以 81.5 分登顶 Speech to Speech Index
  12. Trail of Bits 批评 1Password 的 AI 补丁基准存在误导,并发布两个补丁验证 Agent 技能
  13. Vercel 将 inbound 销售团队从 10 人压缩至 1.25 人,AI 销售开发智能体年成本仅数千美元

模型发布/更新

Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking

Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个近实时语音对话模型,主打语音智能体和复杂任务执行。

来源:Google DeepMind:Blog(RSS)

AIHOT 条目 · 原文


生数科技发布 Vidu S2:含 Avatar 与 Editing 双模型,探索空间视频

生数科技正式发布 Vidu S2,包含面向数字角色实时交互的 Vidu S2-Avatar 和面向视频流实时编辑的 Vidu S2-Editing,并探索面向 VR 头显的实时空间视频生成与编辑。

来源:公众号:生数科技(Vidu·视频)

AIHOT 条目 · 原文


阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一

阶跃星辰发布 StepAudio 3 系列,包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,已在阶跃星辰开放平台上线。

来源:公众号:阶跃星辰(Step)

AIHOT 条目 · 原文


产品发布/更新

Google 发布 TranslateGemma 等多语言 AI 成果,语言技术覆盖 300 多种语言

Google 宣布其语言技术已支持超过 300 种语言、覆盖全球 86% 人口,并发布 TranslateGemma 轻量开源翻译模型(基于 Gemini 训练、支持 55 种语言、可离线运行)。

来源:Google Blog:AI(RSS)

AIHOT 条目 · 原文


Claude for Small Business 新增 43 个工作流和 27 个集成,并推出免费培训计划

Anthropic 为 Claude for Small Business 新增 43 个工作流和 27 个集成,覆盖 Shopify、Salesforce、Stripe、Gusto 等,该产品自 5 月上线以来安装量超过 90 万次。工作流默认处于审批模式,所有发送、发布或付款需用户确认;今秋将在 10 个美国城市举办免费工作坊,14 个集成伙伴从 9 月底到 11 月各举办一场免费网络研讨会。

来源:Claude:Blog(网页)

AIHOT 条目 · 原文


行业动态

Perplexity 自研 CobbleDB 替代 AWS DynamoDB,每年最多可节省一亿美元

Perplexity CEO Aravind Srinivas 宣布自研键值数据库 CobbleDB,替代 AWS DynamoDB 用于快速网页内容抓取,迁移后每年最多可节省一亿美元。该项目由两名工程师和数百个持续运行的 Computer 智能体在两个月内完成核心基础设施,官方研究称热存储批次读取延迟较 DynamoDB 全分布下降约 5 倍(P50 从 31.4ms 降至 5.60ms)。

来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)

AIHOT 条目 · 原文


技巧与观点

Gergely Orosz 探访 OpenAI:Codex 驱动的智能体软件工厂

Gergely Orosz 实地探访 OpenAI 总部并访谈七位工程师与工程负责人,发现自约一月起 Codex 和 ChatGPT Work 已成为公司几乎所有工作的基础。

来源:Pragmatic Engineer(RSS)

AIHOT 条目 · 原文


Anthropic 与 OpenAI 提议协调放缓前沿 AI 开发,Cohere CEO 等批评者质疑其真实动机

Anthropic CEO Dario Amodei 呼吁行业与政府协调放缓前沿 AI 开发,并寻求反垄断豁免,Sam Altman 与 Elon Musk 表示同意。

来源:The Decoder:AI News(RSS)

AIHOT 条目 · 原文


404 Media 曝光 OpenAI 莉莉计划:人工审核 ChatGPT 聊天记录以优化模型

404 Media 披露 OpenAI 内部代号为莉莉计划(Project Lily)的项目,由时薪超 50 美元的提示词审核员查看匿名化后的真实用户聊天记录,评判回复是否切题、是否存在 AI 式话术和谄媚口吻。

来源:IT之家(RSS)

AIHOT 条目 · 原文


Arena 更新 Image-to-WebDev 榜单:GPT-6 Astra 以 1733 分登顶

Arena 更新 Image-to-WebDev 排行榜,纳入四个新评测模型。GPT-6 Astra (Max) 以 1733 分居第一,领先 GPT-5.6 Sol (xHigh) 129 分;Claude Fable 5.1 (Max) 以 1710 分排第二,Muse Spark 1.3 (Max) 1645 分第四,GLM-5.3-Flash 1588 分第十。

来源:X:Arena (@arena)

AIHOT 条目 · 原文


Artificial Analysis 评测:GPT-Live-1 以 81.5 分登顶 Speech to Speech Index

Artificial Analysis 发布 Speech to Speech Index,OpenAI 的 GPT-Live-1 以 81.5 分(Astra 后端,medium 推理强度)排名第一,超过 Grok Voice Think Fast 2.0 High 的 81.3;Sol 后端配置得 80.1 排第三。

来源:X:Artificial Analysis (@ArtificialAnlys)

AIHOT 条目 · 原文


Trail of Bits 批评 1Password 的 AI 补丁基准存在误导,并发布两个补丁验证 Agent 技能

Trail of Bits 发文批评 1Password 8月6日发布的 FLAWED 报告,称其 26% 的 AI 干净修复率受四项实验设计选择影响而失真,包括刻意指示智能体应用错误修复的提示词占 22% 数据、36% 的试验禁止编译测试,以及不同推理档位设置。

来源:Trail of Bits:AI安全研究

AIHOT 条目 · 原文


Vercel 将 inbound 销售团队从 10 人压缩至 1.25 人,AI 销售开发智能体年成本仅数千美元

Vercel COO Jeanne DeWitt Grosser 在 The Information 访谈中表示,公司 inbound 销售开发已实现 90% 自动化,团队从 10 人压缩至 1.25 人。

来源:Tomer Tunguz 博客(VC 分析)

AIHOT 条目 · 原文


资讯筛选与摘要由 AIHOT 提供;Horizon 负责页面生成与归档。