阿里平头哥真武V900芯片性能翻三倍,Qwen4已秘密训练中
2026云栖大会9月22-24日在杭州举行,阿里密集发布多项AI全栈进展。硬件方面,平头哥发布新一代训推一体AI芯片真武V900,单芯片算力达前代M890的3倍,搭载216GB显存,片间互联带宽1200GB/s,原生支持FP8/FP4低精度计算,单集群可扩展至…
1. 阿里云栖大会收官:真武V900芯片发布,Qwen4已进入训练
2026云栖大会9月22-24日在杭州举行,阿里密集发布多项AI全栈进展。硬件方面,平头哥发布新一代训推一体AI芯片真武V900,单芯片算力达前代M890的3倍,搭载216GB显存,片间互联带宽1200GB/s,原生支持FP8/FP4低精度计算,单集群可扩展至50万卡,计划2027年Q1量产。模型方面,基于新一代架构的Qwen4已投入训练,Qwen4.5/Qwen5计划将总参数扩展至5万亿至10万亿。Qwen3.8-Max通过递归自我改进(RSI)技术,在无人工干预下完成33轮自主迭代,性能提升12.5%进入全球第一梯队。
2. 千问Qwen-Audio-3.1系列上线:五款语音模型,ASR降价95%
千问正式发布Qwen-Audio-3.1系列语音大模型,涵盖语音识别(ASR)、语音合成(TTS)、实时语音交互(Realtime)三大方向全面升级,并新增音频创作模型TTS-Next和音频理解模型ASR-Next,合计五款模型形成"理解-生成-交互-创作"完整音频能力栈。价格方面全线大幅下调:TTS降价约70%,Realtime降幅约85%,ASR降幅达95%。
3. OpenAI即将预览GPT-6 Cyber:首个网络安全专用模型
据报道,OpenAI正准备在未来几天预览其最新网络安全专用模型GPT-6 Cyber。该公司还将发布一款新产品,帮助客户以更安全、自动化的方式部署GPT-6 Cyber。此前GPT-6 Astra已首次达到OpenAI"准备框架"中的"关键"(Critical)网络安全能力门槛。
4. DeepSeek公开Agent训练基建DSec:每秒5000+沙盒,梁文锋署名
DeepSeek论文公开了其Agent训练基础设施DSec的技术细节:每秒可调度5000+训练沙盒,日产300万个,峰值同时运行38万个,单集群配置160节点/3万核/250TB内存,8192个容器部署仅需35分钟。论文由梁文锋署名。研究过程中还发现Agent会自行寻找捷径"刷分",为沙盒安全设计敲响了警钟。
5. 黄仁勋谈AI替代论:AI先替代任务,不是职业
英伟达CEO黄仁勋在接受《纽约时报》采访时回应了AI替代职业的恐慌。他将工作拆分为"任务"和"目的"两个层次,认为AI会先自动化具体任务(写代码、整理资料),但不会必然消灭整个职业。以软件工程师为例,AI可能降低写代码本身的稀缺性,但定义问题、设计架构、验证系统和承担责任的重要性反而会上升。针对"10年内AI毁灭人类"的观点,黄仁勋表示"他们的所有预测都错了,所谓的10%概率既没有科学依据,也没有研究支持"。
6. 高通收购PickNik Robotics:MoveIt开源框架迎来新东家
高通宣布收购机器人软件企业PickNik Robotics,后者长期维护全球应用最广泛的开源机器人操作框架MoveIt。该框架已被产学两界广泛用于复杂机器人应用开发。高通承诺保持MoveIt的开源性,由社区制定路线图,同时将简化MoveIt与其Dragonwing(翼龙)机器人平台的集成,并继续支持MoveIt在第三方硬件上的应用。
7. 中科曙光发布scaleFabric:国产首款原生RDMA高速网络
中科曙光发布scaleFabric,国内首款原生无损RDMA(远程直接内存访问)高速网络,技术规格全面对标英伟达NDR,部分指标实现赶超。从核心关键IP、交换芯片、网卡到交换机、驱动与管理软件均实现自主研发。研究表明,在大规模分布式训练中网络通信耗时占比已达30%-50%。scaleFabric目前已部署于国家超算互联网郑州核心节点,支撑三套万卡级scaleX智算集群运行。
📢 今日互动
今天的AI圈可以说是"基建日"——从芯片到网络到Agent训练平台,全是基础设施层面的进展。你觉得对开发者日常影响最大的是哪条?欢迎在评论区聊聊你的看法。
觉得有用的话,点个「在看」转发给你的技术圈子,我们明天8点见 👋
内容由公众号日报整理而来,代表原文作者观点,不构成任何投资建议。 信息以公开发布时的报道为准,时效性内容请以最新消息为参考。