AI复利手记

9 月 24 日

共收录 17 条(头条 5 + 精选 12) · 9 个信源

数据来自 AI HOT / Arena / Artificial Analysis / Google AI / Latent Space / OpenAI Blog / OpenRouter / SemiAnalysis / Simon Willison

17
收录条目
5
头条
0
多源共振
107
未展示(低分)

01今日重点5 条

  1. Fireworks Research 发布 Ember-1,以更少推理 token 保持 Kimi K3 质量

    Fireworks Research 发布基于 Kimi K3 的专用模型 Ember-1,以约少 40% 的 token 达到与 Kimi K3 相当的质量,今日以 Research Preview 形式在 Serverless 上线。

    AI HOT· 当日· 单源未证实

  2. MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna/Sol 发布改变智能指数与成本 Pareto 前沿

    Artificial Analysis 称本周 MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna 和 GPT-6 Sol 的发布在 Intelligence Index 与每任务成本 Pareto 前沿上新增十一个点位,其中 GPT-6 Luna 贡献五个,Claude Opus 5.5 贡献四个。

    AI HOT· 当日· 单源未证实· 社交平台原帖(未经官方渠道核实)

  3. Greg Brockman 宣布 GPT Voice 大幅升级,支持使用工具并登陆 ChatGPT Work

    GPT Voice 获得重大升级,现在可以使用邮箱、日历、Slack 等工具,并由 GPT-6 Astra、Sol 和 Luna 驱动。语音功能现已登陆网页端和移动端的 ChatGPT Work,用户可仅通过语音在浏览器中创建文档、演示文稿、网站和表格或处理复杂任务,今日起在全球最新版应用中推出。

    AI HOT· 当日· 单源未证实· 社交平台原帖(未经官方渠道核实)

  4. Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒样本复刻声音,并提供逐行表演指导、长时音频生成和双说话人场景编排,覆盖 100 多种语言。

    AI HOT· 昨日· 单源未证实

  5. Ringg 的 AI Agent 借助 OpenAI 解决多达 65% 的客户来电

    Ringg 使用 GPT-5.6,为语音、聊天、WhatsApp 和网页渠道提供多语言 Agent,成本比 GPT-4.1 低 90%。

    OpenAI Blog· 昨日· 单源未证实

02模型发布/更新1 条

  • OpenAI Academy 两周年

    庆祝 OpenAI Academy 成立两周年,将 AI 技能带给更多社区。

    OpenAI Blog· 当日· 单源未证实

03产品发布/更新1 条

04行业动态2 条

05技巧与观点2 条

  • Gemini 3.8 TTS Playground

    工具:Gemini 3.8 TTS Playground Google 今天发布了两个新的 Gemini 文本转语音模型 ——gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts。它们内置超过 2,000 种语音库,还支持"只需 30 秒你本人或有使用权限的声音音频样本"即可创建自定义语音。我 vibe coded (http

    Simon Willison· 当日· 单源未证实

  • Shadow Roots 详解:附实时交互示例

    工具:Shadow roots 详解,附实时示例 给 Fable 5.1 Medium 的提示词:构建一个 artifact,用交互式示例解释 CSS 中的 shadow roots 标签:css

    Simon Willison· 当日· 单源未证实

R榜单速览数据快照

榜单页当天的快照,编号为榜内名次。只列名称与指标,不给出条目链接 —— 榜单行的 URL 是榜单页本身。

  1. claude-fable-5-high(Arena 文本总榜第 1 名)综合1 · 专家1 · 难题2 · 代码1 · 数学1 · 创作1 · 指令2 · 长查询2
  2. claude-opus-4-6-high(Arena 文本总榜第 2 名)综合2 · 专家2 · 难题1 · 代码3 · 数学6 · 创作2 · 指令1 · 长查询1

Artificial Analysis

榜单页 ↗
  1. Claude Opus 5.5(max 带 fallback)智能指数 58 · 每任务 $5.98 · 输出 -- tok/s · 首字延迟 --s · 上下文 1M · 厂商 Anthropic
  2. Claude Fable 5.1(max 版本,支持回退)智能指数 53 · 每任务 $7.63 · 输出 66 tok/s · 首字延迟 274.43s · 上下文 1M · 厂商 Anthropic

OpenRouter

榜单页 ↗
  1. GLM 5.3 Flash(OpenRouter 调用量第 1 名)19T tokens 69%
  2. DeepSeek V4.1 Flash(OpenRouter 调用量第 2 名)18.4T tokens 79%

另有 107 条因篇幅控制未展示 —— 这部分是低分长尾,没有进日报正文。