9 月 23 日
共收录 14 条(头条 4 + 精选 10) · 6 个信源
数据来自 AI HOT / Arena / Artificial Analysis / Latent Space / OpenAI Blog / Simon Willison
01今日重点4 条
Claude Opus 5.5 与 GPT-6 Sol/Luna 发布,Simon Willison 详解新一轮价格战
Anthropic 发布 Claude Opus 5.5,OpenAI 随后发布 GPT-6 Sol 和 GPT-6 Luna。GPT-6 两款价格为其 GPT-5.6 对应型号的一半,GPT-6 Luna 低至 $0.10/M 输入、$0.50/M 输出;Opus 5.5 降价 20% 至 $4/$20,缓存读取降 60%。
AI HOT· 当日· 单源未证实
OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna,API 价格较 GPT-5.6 促销价低 50%
OpenAI 欢迎两个新模型加入 GPT-6 系列。GPT-6 Sol 和 Luna 基于 GPT-6 Astra 的技术成果,将大部分能力带入更快、更便宜、支持大规模工作的模型中。通过提升缓存和推理效率,两款模型 API 价格比 GPT-5.6 促销定价低 50%。
AI HOT· 当日· 单源未证实· 社交平台原帖(未经官方渠道核实)
llm-anthropic 0.29
发布:llm-anthropic 0.29。新增对 Claude Opus 5.5 的支持:llm -m claude-opus-5.5 "prompt goes here"。标签:llm、anthropic
Simon Willison· 当日· 单源未证实
OpenAI 为 GPT-6 推出改进的提示词缓存系统与诊断工具
OpenAI 为 GPT-6 系列推出改进的提示词缓存系统,默认提高缓存命中率,对 30 分钟窗口内复用的合格共享前缀提供最高 90% 的缓存输入 token 折扣。
AI HOT· 当日· 单源未证实
02模型发布/更新1 条
Parallel 借助 GPT-6 Astra 将研究时间和成本减半
GPT-6 Astra 使 Parallel 的 Agent 能以此前模型一半的时间和成本研究并整合劳动力市场数据。
OpenAI Blog· 昨日· 单源未证实
03行业动态2 条
[AINews] 小米 MiMo-V2.6-Pro 1T-A42B:全新顶级开放权重模型,训练成本仅 300 万美元
来 AIE 上海站 见见小米及其他顶级中国前沿实验室!这对这家"中国苹果"——由手机制造商转型而来的前沿实验室来说尚属首次:"MiMo-V2.6 系列包含两款原生全模态模型:MiMo-V2.6-Pro 是我们迄今最强大的模型,而 MiMo-V2.6-Flash 在智能、效率与成本之间实现了最佳平衡。我们还将推出 MiMo-V2.6-Pro-UltraSpeed,在同等质量下提供最高 20 倍的输出速度
Latent Space· 昨日· 单源未证实
🔬 一座奥斯卡奖、两颗小行星,和你 sklearn 里的算法:John Platt 谈 AI for Science
有多少机会能采访到一位既拥有奥斯卡奖、又发明了教科书级机器学习算法的嘉宾?John Platt 拥有一座奥斯卡奖、两个被写进教科书的算法、两颗以他命名的小行星,以及 6 的 Erdős–Bacon 数。这轻松算得上最有趣的一期节目
Latent Space· 当日· 单源未证实
04技巧与观点3 条
Artificial Analysis 评测 GPT-6 Sol 和 Luna:成本减半但各评测有升有降
Artificial Analysis 评测 GPT-6 Sol 和 Luna,价格约为 GPT-5.6 同名型号的一半,Sol 定价 $2/$10 每百万输入/输出 token,Luna 为 $0.10/$0.50。
AI HOT· 当日· 单源未证实
llm 0.36
发布:llm 0.36。新增 OpenAI 模型:gpt-6-sol 对应 GPT-6 Sol,gpt-6-luna 对应 GPT-6 Luna。#1702。模型插件现在可以为仅接受单轮提示的模型声明 supports_conversation = False。当这些模型接收到 assistant 或工具消息时,LLM 会抛出 llm.ConversationNotSupported 异常
Simon Willison· 当日· 单源未证实
llm-typesafe 0.1a0
发布:llm-typesafe 0.1a0。我为 LLM 构建了这个新插件,以支持 TypeSafe AI 的新 Jev 模型。安装方式:llm install llm-typesafe。然后设置 API 密钥(在此获取,候补名单推进速度似乎相当快):llm keys set typesafe # 粘贴密钥。现在你可以像这样提出 yes/no "noul" 问题:llm -m jev 'Plea
Simon Willison· 昨日· 单源未证实
R榜单速览数据快照
榜单页当天的快照,编号为榜内名次。只列名称与指标,不给出条目链接 —— 榜单行的 URL 是榜单页本身。
Artificial Analysis
榜单页 ↗- Qwen3.8 Max (0902)智能指数 45 · 每任务 $5.41 · 输出 39 tok/s · 首字延迟 2.94s · 上下文 984k · 厂商 Alibaba
Arena
榜单页 ↗- gpt-5.6-sol-xhigh(Arena 文本总榜第 18 名)综合18 · 专家9 · 难题15 · 代码17 · 数学23 · 创作12 · 指令11 · 长查询17
- glm-5.3-max(Arena 文本总榜第 19 名)综合19 · 专家12 · 难题17 · 代码22 · 数学10 · 创作22 · 指令17 · 长查询22
- gpt-5.5-high(Arena 文本总榜第 20 名)综合20 · 专家19 · 难题24 · 代码30 · 数学20 · 创作33 · 指令19 · 长查询25
另有 92 条因篇幅控制未展示 —— 这部分是低分长尾,没有进日报正文。