blackantt
V2EX  ›  OpenAI

单以中文聊天来论,国内哪个大模型(api)的能力最强呢?

  •  
  •   blackantt · 2 days ago · 2438 views

    中文聊天强不强 主要看哪个指标呢? 英文聊天强不强 主要看哪个指标呢?

    13 replies  •  2026-09-29 22:13:38 +08:00
    413420
        1
    413420  
       2 days ago via iPhone
    能解决对应需求的模型就是好模型
    rustiiiiii
        2
    rustiiiiii  
       2 days ago
    个人体感,日常用 dsh + v4.1 flash 不错,又快又好
    xfn
        3
    xfn  
       2 days ago
    要看怎么评价,从情绪价值的角度看可能是豆包
    Frankcox
        4
    Frankcox  
       2 days ago
    你如果使用来做 sillyTavern 的 RP 的话,其实最近的模型里 glm-5.3 不错。
    ColinWei
        5
    ColinWei  
       2 days ago
    豆包很能聊,花言巧语,但是幻觉明显比千问严重,我投千问一票
    yoshiyuki
        6
    yoshiyuki  
       2 days ago
    聊天是聊天,能力是能力,也许你是想问,工作语言用中文的智能体工作能力
    NESeeker
        7
    NESeeker  
       2 days ago via Android
    主要看酒馆
    iamnotcodinggod
        8
    iamnotcodinggod  
       2 days ago
    豆包。
    A1188
        9
    A1188  
       1 day ago via Android
    要说英文能力,那当然是 openPangu-2.0-Pro
    比外面的 AI 还像外面的。
    zerovoid
        10
    zerovoid  
       1 day ago
    情绪价值肯定是豆包,

    我和千问&智谱聊,
    感觉智商都比豆包高,
    分析得头头是道,

    但是情绪价值很低,
    陪聊能力不如豆包。
    blackantt
        11
    blackantt  
    OP
       23h 41m ago
    @zerovoid deepseek 聊过没有? 怎么样呢?
    AImoka
        12
    AImoka  
       13h 48m ago
    中文聊天没有统一第一,建议按事实性、幻觉率、长上下文和速度用同一组问题盲测,偏知识问答可先对比 DeepSeek 、通义和智谱。也要确认 API 的模型版本与限流策略,否则体感差异可能来自服务商而不是模型。想低成本做对比的话有 DeepSeek V4 按次畅用日卡 ¥15 ,能先跑一天。需要可加微信 mkapikey
    zerovoid
        13
    zerovoid  
       12h 44m ago
    @blackantt #11 Deepseek 情绪价值应该在豆包之下,千问智谱之上,ds 的优点是思维链很长,所以回的会很细,ds 各种思考我说的话的潜在意思,然后给自己设置各种边界,像一个心思细腻的理工男。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   5191 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 41ms · UTC 02:57 · PVG 10:57 · LAX 19:57 · JFK 22:57
    ♥ Do have faith in what you're doing.