中文聊天强不强 主要看哪个指标呢? 英文聊天强不强 主要看哪个指标呢?
中文聊天强不强 主要看哪个指标呢? 英文聊天强不强 主要看哪个指标呢?
1
413420 2 days ago via iPhone
能解决对应需求的模型就是好模型
|
2
rustiiiiii 2 days ago
个人体感,日常用 dsh + v4.1 flash 不错,又快又好
|
3
xfn 2 days ago
|
4
Frankcox 2 days ago
你如果使用来做 sillyTavern 的 RP 的话,其实最近的模型里 glm-5.3 不错。
|
5
ColinWei 2 days ago
豆包很能聊,花言巧语,但是幻觉明显比千问严重,我投千问一票
|
6
yoshiyuki 2 days ago
聊天是聊天,能力是能力,也许你是想问,工作语言用中文的智能体工作能力
|
7
NESeeker 2 days ago via Android
主要看酒馆
|
8
iamnotcodinggod 2 days ago
豆包。
|
9
A1188 1 day ago via Android
要说英文能力,那当然是 openPangu-2.0-Pro
比外面的 AI 还像外面的。 |
10
zerovoid 1 day ago
情绪价值肯定是豆包,
我和千问&智谱聊, 感觉智商都比豆包高, 分析得头头是道, 但是情绪价值很低, 陪聊能力不如豆包。 |
12
AImoka 13h 48m ago
中文聊天没有统一第一,建议按事实性、幻觉率、长上下文和速度用同一组问题盲测,偏知识问答可先对比 DeepSeek 、通义和智谱。也要确认 API 的模型版本与限流策略,否则体感差异可能来自服务商而不是模型。想低成本做对比的话有 DeepSeek V4 按次畅用日卡 ¥15 ,能先跑一天。需要可加微信 mkapikey
|
13
zerovoid 12h 44m ago
@blackantt #11 Deepseek 情绪价值应该在豆包之下,千问智谱之上,ds 的优点是思维链很长,所以回的会很细,ds 各种思考我说的话的潜在意思,然后给自己设置各种边界,像一个心思细腻的理工男。
|