· 4 分钟阅读
国内大模型使用经验:Kimi、DeepSeek、GLM、豆包怎么选
最近国内外大模型跟下饺子似的。 Kimi K3,DeepSeek V4 Flash和Pro,GLM 5.3,中间穿插着Qwen 3.8-Max,扎堆发布。 国外也没闲着,Gemini 3.7 Flash,还有马斯克的Grok 4.6。
选择一多,经常有朋友问,你平时用哪个。 正好聊聊这个话题,说说我自己的用法。
我平时用的,绝大多数是国产模型。倒不是什么情怀,今年春节前我使用国外大模型为主的,但国内模型的能力,现在已经挺好用了,90%以上的任务完全顶得住。
国外的我主要用两个,Claude和Gemini。 Gemini的多模态最好用,甚至可以识别视频,某些时候只能用它。 Claude能力最强,某些关键任务用它来做架构建议和审核。
国外的头部模型,Claude、Gemini、ChatGPT、Grok,清一色多模态。
国内是分成了两个阵营。 一个阵营支持多模态,能看图,代表是Kimi K3和Qwen 3.8。 另一个阵营是纯文本,不支持看图,我的主力GLM 5.2就是这个路线。 DeepSeek V4 flash和Pro 也在这个阵营,所以GLM 5.3必须要和V4 Pro同一天发布,必须顶上呀。
为啥这样,我猜还是算力的原因,多模态很吃算力。
纯文本最大的优势就是速度快。 这也是我用GLM 5.2的原因,K3虽好,实在是太慢了。 现在GLM 5.3和DeepSeek V4 Pro出来了,我还在比较,回头另写一篇。
但有些场合,你想用文字把一个东西说清楚,很费劲。这时候甩一张截图过去,一目了然。纯文本模型接不住,K3的优势就出来了。
所以我的用法是看任务下菜。 多模态任务,要看图的,选K3,偶尔也用Gemini 3.6 Flash。 国内多模态阵营里,K3领先比较明显。如果你是夜猫子,喜欢晚上干活,使用K3还是很爽的。
再说说我每天都干的一件事。 我每天要从国外网站收集AI相关信息,整理成素材。这种定时任务,量大但不复杂,我用的是DeepSeek V4 Flash。 原因就一个,好用还便宜。这种不需要顶级智力、但需要天天跑的任务,Flash特别合适。
说到这可能有朋友要问,你怎么判断模型强弱的,看榜单吗?
我说个自己的笨办法,特别简单。 平时遇到没把握的复杂问题,我会让几个大模型同步作答。注意是同步,同一个问题发下去,看怎么回答。 然后把他们的回答互相发给对方评价。你评他,他评你。 这么来回几个回合,高下立判。谁更聪明,更靠谱,一眼就能看出来。
这跟看排行榜刷分不太一样。 榜单考的是别人的题,这个考的是你自己手上的活。 模型终究是拿来干活的,能结合自己的日常需求来判断,比什么分数都有针对性。