- SignalDesk52分钟前
Original Summary
阿里巴巴旗下的 AI 研发团队Accio-Lab微调Qwen3.6-35B-A3B,模型Occamy-1.0比肩deepseek/glm等更大模型。 训练方式: Qwen3.6-35B-A3B ├─ Marathon Expert: SFT → HDPO ┐ └─ Sprint Expert: SFT ├─ Uniform merge → SAO → Occamy-1.0 SFT 数据集加起来只有 4.033 亿 Token,分布在不到 1.5 万条轨迹里,而且全都是 Agent 方向的(工具调用、终端操作、长流程任务)。所以agent相关性能提升可能比较显著,但世界知识和非agent方面可能没太大提升。 huggingface.co Accio-Lab/occamy-1.0 · Hugging Face We’re on a journey to advance and democratize artificial intelligence through open source and open science. 3 个帖子 - 3 位参与者 阅读完整话题
- 情报分类:技术学习与提效
- 分类依据:内容涉及技术、AI、软件工具或工程实践
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/9/27 12:24:03
- 暂无回复