9 月 24 日
共收录 17 条(头条 5 + 精选 12) · 9 个信源
数据来自 AI HOT / Arena / Artificial Analysis / Google AI / Latent Space / OpenAI Blog / OpenRouter / SemiAnalysis / Simon Willison
01今日重点5 条
Fireworks Research 发布 Ember-1,以更少推理 token 保持 Kimi K3 质量
Fireworks Research 发布基于 Kimi K3 的专用模型 Ember-1,以约少 40% 的 token 达到与 Kimi K3 相当的质量,今日以 Research Preview 形式在 Serverless 上线。
AI HOT· 当日· 单源未证实
MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna/Sol 发布改变智能指数与成本 Pareto 前沿
Artificial Analysis 称本周 MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna 和 GPT-6 Sol 的发布在 Intelligence Index 与每任务成本 Pareto 前沿上新增十一个点位,其中 GPT-6 Luna 贡献五个,Claude Opus 5.5 贡献四个。
AI HOT· 当日· 单源未证实· 社交平台原帖(未经官方渠道核实)
Greg Brockman 宣布 GPT Voice 大幅升级,支持使用工具并登陆 ChatGPT Work
GPT Voice 获得重大升级,现在可以使用邮箱、日历、Slack 等工具,并由 GPT-6 Astra、Sol 和 Luna 驱动。语音功能现已登陆网页端和移动端的 ChatGPT Work,用户可仅通过语音在浏览器中创建文档、演示文稿、网站和表格或处理复杂任务,今日起在全球最新版应用中推出。
AI HOT· 当日· 单源未证实· 社交平台原帖(未经官方渠道核实)
Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒样本复刻声音,并提供逐行表演指导、长时音频生成和双说话人场景编排,覆盖 100 多种语言。
AI HOT· 昨日· 单源未证实
Ringg 的 AI Agent 借助 OpenAI 解决多达 65% 的客户来电
Ringg 使用 GPT-5.6,为语音、聊天、WhatsApp 和网页渠道提供多语言 Agent,成本比 GPT-4.1 低 90%。
OpenAI Blog· 昨日· 单源未证实
02模型发布/更新1 条
03产品发布/更新1 条
04行业动态2 条
ClusterMAX 3.0:行业标准 GPU 云评级系统回归
详尽剖析:可靠性、性能、支持、定价——当然还有安全性——这是我们对全球 GPU 云服务商最深入的一次分析。
SemiAnalysis· 当日· 单源未证实
[AINews] Claude Opus 5.5 成为 AINews 新默认模型——各家厂商纷纷降价 40-50%
OpenAI 也做出了奋力一搏,GPT-6 Sol 和 Luna 的发布价格比 GPT-5.6 低 50%,但随着发布内容观看量达到 1700 万且仍在增长,今天注定属于 Claude Opus 5.5 ——"我们全新 Claude 5.5 系列的首个模型",其表现在大多数任务上媲美 "Claude Fable 5.1",运行成本却比 Opus 低 40%
Latent Space· 昨日· 单源未证实
05技巧与观点2 条
Gemini 3.8 TTS Playground
工具:Gemini 3.8 TTS Playground Google 今天发布了两个新的 Gemini 文本转语音模型 ——gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts。它们内置超过 2,000 种语音库,还支持"只需 30 秒你本人或有使用权限的声音音频样本"即可创建自定义语音。我 vibe coded (http
Simon Willison· 当日· 单源未证实
Shadow Roots 详解:附实时交互示例
工具:Shadow roots 详解,附实时示例 给 Fable 5.1 Medium 的提示词:构建一个 artifact,用交互式示例解释 CSS 中的 shadow roots 标签:css
Simon Willison· 当日· 单源未证实
R榜单速览数据快照
榜单页当天的快照,编号为榜内名次。只列名称与指标,不给出条目链接 —— 榜单行的 URL 是榜单页本身。
Arena
榜单页 ↗- claude-fable-5-high(Arena 文本总榜第 1 名)综合1 · 专家1 · 难题2 · 代码1 · 数学1 · 创作1 · 指令2 · 长查询2
- claude-opus-4-6-high(Arena 文本总榜第 2 名)综合2 · 专家2 · 难题1 · 代码3 · 数学6 · 创作2 · 指令1 · 长查询1
Artificial Analysis
榜单页 ↗- Claude Opus 5.5(max 带 fallback)智能指数 58 · 每任务 $5.98 · 输出 -- tok/s · 首字延迟 --s · 上下文 1M · 厂商 Anthropic
- Claude Fable 5.1(max 版本,支持回退)智能指数 53 · 每任务 $7.63 · 输出 66 tok/s · 首字延迟 274.43s · 上下文 1M · 厂商 Anthropic
OpenRouter
榜单页 ↗- GLM 5.3 Flash(OpenRouter 调用量第 1 名)19T tokens 69%
- DeepSeek V4.1 Flash(OpenRouter 调用量第 2 名)18.4T tokens 79%
另有 107 条因篇幅控制未展示 —— 这部分是低分长尾,没有进日报正文。