在今天谈论网页chat似乎有一种边缘化的原始人的感觉,我也明白加钱以获得更好的体验的道理,但这次姑且还是以网页chat轻度用户的视角探讨一些体验、优劣势,以及主观上的偏好和迷茫,欢迎讨论和建议。 chatgpt 感觉是综合体验比较好的一家。 只能使用6-luna模型,思考强度只有一档(think),开启思考后耗时、信息含金量都可以接受,但有时稍显啰嗦。 chat的生态比较成熟,输出的排版看着还可以,可以在远端沙箱执行代码,也有类似agenticloop,工具返回循环输入的体验,开启think后包括搜索在内等工具调用也很积极。 搜索偏好很不错,因此对多语言也更友好,因为需要在英日双语的环境下搜索学习,能够感觉到它抓取信息和解决问题的能力还不错,一些比较边缘化的知识和教程也能从日文的博客上找到。 project功能可以管理局部记忆,整理对话,全局记忆有开关,不影响project记忆。但project中无法开启think。此外对话有分叉功能很便利。 缺点是给的额度非常吝啬,虽然官方说免费用户可以使用无限的luna额度,但是think却是有限的,使用think会占用上传文件,生成图片的额度,长文本粘贴为文件也占用上传文件额度。额度用完后似乎会被路由到一个官方代号gpt-6-t-mini-mini的模型上,暂时没有体感到区别,但是说实话这个名字看着就令人恐惧。 claude 感觉品味要比chatgpt好一些,但是对话的体验反而一般 可以用sonnet,haiku 5.5,思考强度支持各种挡位,sonnet5.5 medium短短几轮对话就会耗光额度,思考时间很长,但惜字如金,能感觉到智力和能力比较强,但说的话总是有点难以理解。haiku5.5会耐用一些,但是我并没有感到评测中的超越6luna的能力,只感觉到它有些懒惰和敷衍。 chat生态也可以,有各种工具,也能沙箱执行代码,也有循环输入。 搜索偏好比较一般,抓取信息的能力一般。 也可以用project管理局部记忆,但是最多只能创建5个,而且关闭全局记忆也会禁用project记忆。 gemini 近期更新后免费用户只能用3.5flash-lite,基本上废了,智力较低,搜索偏好和积极性都差,chat生态也差。 google ai studio 我在用的模型只有3.8flash,思考强度可选但没有察觉到区别,额度没有触限过,可能给的比较大方。 做视频汉化、字幕很强大,支持视频音频多模态,可以直接引用youtube视频,可以区分说话人,可以根据画面中的文字将不确定读音纠正成正确的写法,可以用来校准本地另行生成的支离破碎的srt。(印象中曾经的2.5pro是可以直接打轴的,但后来的模型失去了这个能力)因为世界知识强大各种人名地名作品名亚文化等专有名词也能准确翻译。 搜索偏好和积极性都一般,幻觉率高,经常胡乱标注引用,胡乱总结原出处根本没有的东西。但是因为世界知识的缘故,在边缘型知识譬如日语文法上反而能给出正确的判断,相反gpt则是即便引用了出处却给出错误的结论。 记忆管理和chat生态在studio里等于没有,而且在studio的界面上对话,体验很古怪。 deepseek 功能缺失,有点原始,搜索方面有硬伤,额度慷慨,上传文件图片等也比较自由。没有全局记忆,也没有project功能不能管理对话和局部记忆。chat生态等于没有,没有工具,启用think也无法自行search,不能循环输入。开启思考后耗时过长,不开启直接返回的结果含金量又有些难以接受。 搜索偏好让人很难接受,无法用google等搜索是硬伤,外语结果天然欠缺,信息抓取能力较差,更不必说边缘型知识了。 综上,我个人还是比较偏好于chatgpt,但是它吝啬又不透明的额度和模型分配让人很难受,只能多个平台同时用但是体验又比较割裂会话管理也是问题。在现在这个时期免费用户似乎已经成了各家平台的负资产,各家重点关注的领域似乎也都在顶级模型的编程,harness中的工作能力方面,虽然这也是无可奈何的事。能力均衡适中的模型、完善的生态、便利优雅的界面,慷慨的免费额度的一站式体验,这些似乎在未来可以预见的一段时期内依然是奢求。 2 个帖子 - 2 位参与者 阅读完整话题


  • 情报分类:技术学习与提效
  • 分类依据:内容涉及技术、AI、软件工具或工程实践
  • 信息来源:服务器 / LINUX DO - 最新话题
  • 发布时间:2026/10/11 14:55:47