苹果开源VLM模型,基座居然是中国千问
9月23日至24日,苹果在Hugging Face正式上架并开源了视觉语言模型apple/LensVLM-9B。开发者在模型页面发现,Base Model一栏赫然写着"Built on Qwen3.5-9B"——这家以封闭著称的硬件巨头,用中国开源模型的权重做…
1. 苹果开源LensVLM-9B,基座模型竟是阿里千问
9月23日至24日,苹果在Hugging Face正式上架并开源了视觉语言模型apple/LensVLM-9B。开发者在模型页面发现,Base Model一栏赫然写着"Built on Qwen3.5-9B"——这家以封闭著称的硬件巨头,用中国开源模型的权重做了自己的底座。LensVLM采用"先粗扫、再细看"的选择性上下文扩展方案,处理长文档时Token消耗降低约84%,KV Cache占用从约1.6GB压到约250MB,同一块显卡能同时服务更多用户。
2. 中国AI模型全球采用率飙升:OpenRouter占比突破57%
据CNBC 9月26日报道,中国AI模型在全球主流开发者平台的市场份额实现跨越式增长。OpenRouter数据显示,9月14日当周中国模型词元调用量占比达57%至67%,而2月仅为6%至13%;在Vercel平台,8月中国模型占比升至55%,1月仅为11%。OpenRouter主管表示,今年发布的中国开源模型能可靠应用于高级智能体场景,尤其在编程方面,且成本极具竞争力。全球南方企业是近期中国AI模型的最大用户,使用的词元中超过三分之二来自中国模型。
3. 谷歌"太阳捕手"计划:首颗TPU算力卫星10月1日发射
谷歌CEO皮查伊宣布,Project Suncatcher的首颗太空算力卫星原型MVP将于10月1日搭乘SpaceX Transporter-18任务升空。卫星体积约一台冰箱大小,搭载4颗Trillium TPU芯片,算力相当于一台地面服务器,太阳能板提供约1千瓦电力。TPU将以每次约15分钟的突发模式运行Gemini模型,随后关闭散热。2027年计划发射两颗卫星测试激光互联组网,长期目标是81颗卫星在约650公里高度组成计算集群。
4. 谷歌Gemini 4正式进入后训练阶段,目标"远早于年底"发布
谷歌DeepMind新负责人Koray Kavukcuoglu在AI Agenda Live峰会上透露,新一代旗舰模型Gemini 4已进入后训练初期阶段,目标在"远早于2026年底"推出早期版本。谷歌实际上跳过了原计划的Gemini 3.5 Pro,把研发资源全部押注Gemini 4,以在推理能力与智能体任务上追赶竞争对手。Kavukcuoglu表示对团队"百分之百有信心"。
5. 谷歌、OpenAI、Anthropic拟共建"前沿AI标准局"(SAFA)
9月24日至25日,三家头部AI公司被曝拟共同筹建"前沿AI标准局"(SAFA),计划在没有政府监管的情况下独立运作,统一前沿模型评测与治理规则。同期,谷歌Gemini 3.8 Live实时虚拟人正式上线,打通视频生成、语音交互、表情同步全链路,原生兼容97种语言,支持毫秒级唇形同步,所有生成内容内置SynthID隐形水印。
6. 宇树科技王兴兴:机器人核心瓶颈在于毫米级精度
在第五届全球数字贸易博览会上,宇树科技创始人王兴兴发表主题演讲,称具身智能赛道未来必将迎来专属"ChatGPT时刻",但当前核心瓶颈是能否解决几毫米的工作误差。同日,四臂具身智能机器人亮相上海2026世界技能博览会,现场书写"花好月圆";2026全球数字贸易创新大赛的具身智能机器人挑战赛上,人形机器人与市民进行投篮、竞速等互动比赛。宇树科技此前还发布了Dex5-S灵巧手,22个关节均可反向驱动,3.99万元起。
7. 千问发布Qwen-Audio-3.1系列:5款语音模型全线降价
9月23日,千问正式发布Qwen-Audio-3.1系列语音大模型,一次性推出5款模型,覆盖语音识别(ASR)、语音合成(TTS)、实时语音交互(Realtime)及两款下一代架构模型。ASR支持30种语言和16种中文方言,平均字错误率4.55%;TTS支持跨语言音色迁移;Realtime支持全双工多人对话。价格方面全线大幅下调:TTS降价约70%、Realtime降幅约85%、ASR降幅达95%。
📮 互动时间
今天哪条新闻最让你有感触?是苹果用千问做基座让你骄傲了一把,还是太空算力卫星让你觉得科幻照进现实?
👇 在评论区聊聊你的看法,点赞最高的留言,小猴会在明天的日报里翻牌回复!
如果这份日报对你有帮助,别忘了点赞 + 在看 + 转发三连,你的支持是小猴每天更新的最大动力 💪
内容由公众号日报整理而来,代表原文作者观点,不构成任何投资建议。 信息以公开发布时的报道为准,时效性内容请以最新消息为参考。