- SignalDesk2小时前
就在刚刚,阿里宣布千问要向 5 到 10 万亿参数迈进!! 但我更在意的是:阿里用了一种全新的方法,直接将千问模型从 40 分提升到 45 分,追上了 Claude 和 GPT。 这种新方法叫 RSI:递归自我改进。 说白了,就是模型自己训练自己!! 以前模型想变强,得靠研究员干活: 1. 搭训练流程 2. 造数据 3. 设计实验、找出哪里不行 这次这些活,Qwen3.8-Max 可以自己干了。 练完一轮,找出短板,接着练下一轮,一个多月,33 轮,没人插手。 这还不是最牛逼的。阿里说,RSI 已经开始进入推理和芯片设计了👇 - 优化推理:给它一块从没见过的新 GPU,它自己给下一代架构的 Qwen3.8-Flash 适配推理框架,单实例推理吞吐量提升了 96%。 - 设计芯片:只给一份芯片规范文档,它自己连续跑了 60 多个小时,调用了上万次设计工具,芯片面积缩小 42%,标准单元数降低 29%,功耗降低 59.5%。 模型开始参与设计芯片了,但这跟你有什么关系? 模型能自己训练、自己调推理、自己改芯片,研发就会越来越快。对我们用的人来说,最直接的就两个字:更强,更便宜。 - Qwen3.8-Flash 提前开源了下一代架构,训练成本骤降近 90%,缓存命中的输入每百万 Token 只要 0.1 元 - Qwen3.8-27B 用消费级显卡的电脑就能跑,被开发者叫作「本地 Opus4.6」,还拿下了 Hugging Face 历史上最受欢迎的开源大模型 这次云栖还发了啥 - 全模态:Qwen3.8-Omni 亮相,把视频、音频、图片、文字放进同一个理解框架 - 图像:Qwen-Image-3.1,把几小时的设计活压到秒级交付 - 视频:Wan3.0 拿下 Artificial Analysis 文生视频和视频编辑双榜第一,下一代视频模型 11 月发布 - 同传:Qwen3.8-LiveTranslate 把同传时延压到 2.5 秒以内,人类同传平均要 4 秒以上 - 世界模型:HappyOyster 2.0 Preview,从实验室走向真实可用 - 音乐:Happy Shrimp 1.1,支持百余种曲风 顺便说下语音 千问语音这次也上新了,Qwen-Audio-3.1 在 ASR、TTS、实时语音三个赛道都进了国际第一梯队、国内第一。 其中音频创作模型 Qwen-Audio-3.1-TTS-Next,输入一段脚本,一次生成人声、音效和环境声。以前做一段有声书,要主播、音效师、混音师、剪辑师四个人接力。现在一个模型包了。 - 单次最长生成两分钟 - 用参考录音能复刻一个或多个人的声音 - 支持 14 种语言、29 种方言 - HuggingFace Text-to-Speech 榜单全球第一 我觉得接下来 AI 继续实现全链路 RSI,模型迭代速度会越来越快,触发 AI 进化飞轮,那会是一个无限想象的世界。
- 情报分类:硬件与数码
- 分类依据:内容涉及硬件、数码产品或通信卡
- 信息来源:AI / AI前沿 / 铁锤人 @lxfater
- 发布时间:2026/9/22 17:53:13
- 暂无回复