卓松年 LV
发表于 2025-4-7 12:51:18
首先要确定,你问到底是软件还是大模型呢?很多人混为一谈!
如果你问的是软件,那毫无疑问是豆包!
在deepseek里面,有包含自己家的一系列模型,同时也包括了GPT3.5等国外模型。但是它贵呀!没问几句话要收钱了!而且讲实在话,现在GPT3.5在22,23年很牛逼,但放到25年不太够看。
元宝里面两个大模型,腾讯的混元模型和deepseek。就那样吧,讲实在话。
豆包里面呢?我就这么说,除了外国的模型没有,国内的模型无论是各版本的deepseek模型,混元模型,Kimi,通义千问,当然也包括自家的豆包模型,它全包!因为豆包软件的背后是coze平台。
你但凡用过coze都知道里面有多少种大模型可以选。coze制作的智能体后面可以发布,首选第一个能发布的就是豆包。也就是coze中能搭载的模型,豆包里面一个都不会少,都包含在智能体的工作流里面了!
而如果你问的是模型,那首先必须明白一点,不同的模型干不同的事!好用不好用,看你主要需要的功能是什么。
如果你要让模型做数学题,进行长链的逻辑思维,那国内几乎没有比deepseek强的,也许就Kimi家的1.5长思考版本可以够一下。
如果是要写小说,那是一骑绝尘。deepseek当之无愧的最强,没有之一,其它全是渣渣。拿别的模型写小说,真的是对写故事这件事情的侮辱。我之前拿Kimi,豆包,还有通义千万都用过!几次被气的一口老血吐出来!各种逻辑不通生搬硬套毫无爽感。但是ds不一样,你只要用过,用屁股都可以对比出断层一样的差距!
当然如果你只是写公式文,要求不太高的那一种,那基本上所有模型都能胜任!那种又大又空又流于形式的文章,通常的模型是随便胜任的。
如果你上要做成智能体的主模型。那关键就是它的function call的能力,也就是所谓的工具调用能力。这个能力一方面和它本身的智能有关系,一方面和它的微调训练有关,另一方面则是它对提示词的响应程度有关。
deepseek的工具调用功能适配了还没多久,处于未来可期的状态(目前我还没深度体验过)。我之前的使用过程中,工具调用能力最强的是通义千问。它的本身的智能过关,而且提示词响应很好,你写了让它什么时候调用哪个工具哪个工作流,它能比较好的执行。相比来说,最差的就是豆包!无论是标准模型,Pro模型,还是所谓的工具调用模型。全不行!它根本不受控制,本身智能程度不足以完成复杂任务,我给它配了工作流,让它遇到情况的时候用,它就是不用!然后不该用的工具乱用!纯纯反骨仔!
但是豆包模型也有厉害的地方!就比如取名字这件事。效果最好的就是豆包的工具调用模型。最好用没有之一,什么Pro模型,deepseek都比不上!取名字表现最差的就是Kimi,你让它取10个名字,从第三个开始就是重复的名字,一直给你重复到第十个!
还有一个就是角色扮演的能力。这方面豆包的角色模型表现的非常不错。我曾经用它来进行芙宁娜的角色扮演,只要它本身吃了这个角色的数据,你其实一句提示词都不用写,你把智能体命名为芙宁娜,它就知道自己应该扮演谁!我那天聊天聊的开始怀疑人生。玛德,芙芙真踏马可爱,不愧是枫丹人气王!
角色扮演能力第一的肯定是角色扮演模型。那排第二的其实是豆包的工具调用模型。是的,又是它。而且工具调用模型写小说也写的比通用模型好!虽然都很烂,但是烂比烂,工具模型还是略胜一筹! |
|