- SignalDesk2026-09-11
这次更新带来的提升简直就是魔法!不过,视觉方面的差距还不是一般的大 这次 Deepseek 终于发布统一多模态模型了。上一次的 V4 Vision 还是拼接多模态 粗略测试一下这个多模态视觉是什么水平?让佬友在使用DeepSeek视觉的时候有一个底 SVG复刻肯定还是不如Gemini的 用来理解现实世界问题也挺大 对了 手指的问题能稳定做对了 正确 正确 这道题比较难,做不对于符合预期 逻辑表达式提取完全错误 这道题答对了,这非常意外。而且重复测试也是对的 这个验证码题目少选了一个 这些题目错了,那更难的题就不用测了 价格还是挺贵的,像这样纯聊天的方式都可以花掉1块钱,好在Open Code现在挺便宜 感觉是和 Gemini 2.5 Pro。差不多的水平,略微强一点点 题目来源 https://linux.do/t/topic/286836 接下来测试computer use,测试题库ScreenSpot-Pro里面的 Windows 端 Blender前15题,这个难度对于这个模型还是太高了,估计顶多做一点安卓端的视觉定位还得是最简单的 15道题就对了2道题,Gemini只错两道题时间还短得多.不过比起V4 vision一道对不了,还是好一些 1 个帖子 - 1 位参与者 阅读完整话题
- 情报分类:技术价值
- 命中依据:模型多模态能力测评,有参考价值
- 来源:服务器 / LINUX DO - 最新话题
- 原作者:Mozi
- 发布时间:2026/9/11 21:09:05
- 暂无回复