跳到主要内容
MacLodge's Blog
AI 简报 · 2026 年 9 月 24 日

OpenAI和Anthropic同夜降价发新模型,小米开源登顶全球第一

星期四 🐵 程序小猴AI日报,每天8点,带你用5分钟看懂AI圈昨天发生了什么 约 7 分钟读完

昨天绝对是AI圈的"卷王之夜"——Anthropic和OpenAI前后脚发布新模型,一个降成本40%,一个直接腰斩50%。与此同时,小米开源模型悄悄登顶全球开源榜首,阿里千问在云栖大会放出Qwen4训练中的消息并端出语音模型全家桶,高通2nm芯片让手机跑300…

#AIDaily#OpenAI#GPT6Sol#GPT6Luna#ClaudeOpus55#Anthropic#小米MiMo#开源大模型

昨天绝对是AI圈的"卷王之夜"——Anthropic和OpenAI前后脚发布新模型,一个降成本40%,一个直接腰斩50%。与此同时,小米开源模型悄悄登顶全球开源榜首,阿里千问在云栖大会放出Qwen4训练中的消息并端出语音模型全家桶,高通2nm芯片让手机跑300亿参数模型成为现实。信息量很大,我们一条一条来。


1. Anthropic发布Claude Opus 5.5:68万行代码一天迁完,成本降40%

Anthropic正式发布Claude 5.5家族首款模型Opus 5.5。性能对标自家旗舰Fable 5.1,运行成本比上一代Opus 5低40%,输出速度提升超30%。API定价为输入4美元/百万Token、输出20美元/百万Token,缓存命中价降至0.20美元/百万Token(降幅60%)。

早期测试者用它完成了68万行代码的迁移工作,耗时不到一天,同类任务此前预估需要数周。另一项测试中,Opus 5.5审计并修复一个20万行代码库仅用不到3小时,而Opus 5完成相同任务超过20小时,Token消耗是前者的2.5倍。在GDPval-AA v2.1知识工作评测中拿到1846 Elo,超过Fable 5.1的1735和Opus 5的1708。


2. OpenAI发布GPT-6 Sol和Luna:API永久降价50%,Luna输入价创地板

OpenAI在Anthropic发布Opus 5.5仅90分钟后,推出GPT-6 Sol和Luna两款模型。两款模型基于GPT-6 Astra技术训练,API价格较GPT-5.6促销价直接腰斩50%——Sol输入2美元/百万Token、输出10美元/百万Token;Luna输入0.10美元/百万Token、输出0.50美元/百万Token,后者创下前沿模型输入价地板。

Sol在DeepSWE v1.1软件工程测试中拿到68.8%,单任务成本比Claude Fable 5低约80%。Luna在相同测试中拿到66.6%,接近Opus 5和Fable 5的中档水平,成本分别低93%和96%。事实性方面,Sol的错误率约为前代一半,编程欺骗率从10.4%降至1.3%。


3. 小米开源MiMo-V2.6:46分登顶全球开源第一,训练账本全公开

小米正式开源MiMo-V2.6系列,旗舰版MiMo-V2.6-Pro在Artificial Analysis综合智能指数中拿到46分,超过Kimi K3和Qwen3.8 Max,成为当前全球开源权重模型第一名。单位任务成本约0.13美元,API定价沿用上一代未涨价。

更值得关注的是训练方式:预训练架构和参数规模与上一代保持一致,能力提升主要来自强化学习后训练。RL后训练历时不到6天,Flash与Pro训练成本分别约85万和262万美元,累计约75万条轨迹。小米同时开源了7000余个强化学习任务环境、端到端RL训练框架和蒸馏版MiMo-V2.6-Distill-Qwen-9B。


4. 阿里千问发布Qwen-Audio-3.1:5款语音模型齐发,ASR降价95%

千问正式发布Qwen-Audio-3.1系列共5款模型:ASR(语音识别)、ASR-Next(音频理解)、TTS(语音合成)、TTS-Next(音频创作)、Realtime(实时交互),形成覆盖"理解-生成-交互-创作"的完整音频能力栈。全线降价力度惊人:ASR降幅95%、TTS降约70%、Realtime降约85%。

技术亮点上,ASR支持30种语言和16种中文方言,首字响应约160毫秒,新增原生转写润色能力。ASR-Next能理解人物情绪、环境声与机械声。TTS-Next不再局限于语音合成,可统一生成人声、音效和环境音,支持多角色音色复刻和48kHz输出。Realtime模型增强了共情能力,并能主动调用Agent工具。


5. 云栖大会:Qwen4已在训练中,Qwen3.8-Max实现零人工干预自主迭代

2026云栖大会上,阿里公布了大模型多项进展。最重磅的消息是:基于新一代架构的Qwen4已在训练中,未来Qwen4.5、Qwen5等版本将扩展至5-10T参数。Qwen3.8-Max通过"递归自我改进"(RSI)机制,在人类完全零参与的情况下持续迭代超1个月,完成33轮有效迭代——自主搭建训练流程、构造训练数据、设计实验、定位缺陷。

在推理优化方面,Qwen3.8-Max在从未见过的平头哥新款GPU上,自主适配优化了Qwen3.8-Flash新模型的推理框架。此外,Qwen3.8-27B在Hugging Face上超越DeepSeek-R1、Meta-Llama3.1等,成为该平台历史上最受欢迎的开源大模型,阿里已开源460余个Qwen模型,下载量突破30亿次。


6. 高通发布骁龙8 Elite双旗舰:2nm制程,端侧跑通300亿参数MoE模型

高通在骁龙峰会上发布骁龙8 Elite Gen 6和Elite Extreme Gen 6两款旗舰芯片,均采用台积电2nm工艺,Oryon CPU最高主频达5GHz(智能手机处理器首次突破5GHz)。Extreme版本NPU性能提升35%,通过更大共享内存支持端侧运行超过300亿参数的混合专家模型。

高通CEO安蒙在发布会上表示:"我们正在从应用和助手转向智能体,第六代骁龙8至尊版平台系列正是为之而生的平台。"高通还联合阶跃、无量火与江波龙,将阶跃StepEdge-Omni 30B-MoE模型面向端侧深度适配,打造端侧智能体助手。


7. Cursor推出Projects:多Agent协作编程,PR合并量提升6倍

Cursor推出Projects功能(beta),由一个协调者Agent统筹多个子Agent处理复杂任务,支持跨设备同步共享记忆与产物,还支持事件驱动订阅——比如盯Slack消息、监控PR自动修CI。官方数据称重度用户的PR合并量提升了6倍。


📌 今天的内容就到这里!

你觉得昨晚OpenAI和Anthropic的"90分钟对轰",谁赢了? 或者你更关心小米开源登顶、端侧AI芯片、还是语音模型降价?欢迎在评论区聊聊你的看法,我们一起讨论。

觉得有用的话,点赞 + 在看 + 转发,让更多开发者朋友看到。我们明天8点见!

关于这份简报
内容由公众号日报整理而来,代表原文作者观点,不构成任何投资建议。 信息以公开发布时的报道为准,时效性内容请以最新消息为参考。

← 返回简报目录