• 请不要在回答技术问题时复制粘贴 AI 生成的内容
wKong753900
V2EX  ›  程序员

有没有大佬测评一下 Qwen3.8

  •  
  •   wKong753900 ·
    Kun-GitHub · 2 days ago · 8534 views

    如题,跟 K3 对比怎么样

    60 replies    2026-07-22 15:44:13 +08:00
    v2mo
        1
    v2mo  
       2 days ago   ❤️ 3
    每次发布,都说世界前列。

    实际一用,就崩塌。

    大家可能都免疫了。
    v2mo
        2
    v2mo  
       2 days ago
    @v2mo 我指的是 qwen 每次新版发布哈
    my101du
        3
    my101du  
       2 days ago
    自从领了两杯送的奶茶后就卸载了。 回答其实中规中矩,比元宝还准确及时一些。 但是总觉得哪里用起来怪怪的。 另外就是 B 站都放了大量千问的广告,非常 low ,令人怀疑它到底想干什么。
    keshawnvan
        4
    keshawnvan  
       2 days ago
    @my101du 千问 C 端太迷了,既不舍得给好模型,又不好好打磨产品,那花钱推广干嘛呢?
    027creed
        5
    027creed  
       2 days ago
    @keshawnvan 都想摘果子,但是没有人种树,kip 的导致一切只看结果,派系斗争严重,所以阿里现在越来越拉
    catazshadow
        6
    catazshadow  
       2 days ago via Android
    时间久了,之前只配呆在中下层的人被公平性要求安到了决策层,所以所有的大型组织最后都会灭亡
    QlanQ
        7
    QlanQ  
       2 days ago
    就 qwen 这样的,明明就是一般,为啥还这么贵,就不理解
    shawnvan
        8
    shawnvan  
       2 days ago
    qwen 主要还是做 2b 市场吧
    Daitabashi
        9
    Daitabashi  
       2 days ago
    基座模型吧 似乎没(怎么)做后训练
    wKong753900
        10
    wKong753900  
    OP
       2 days ago
    哈哈,本来还想试用一下的,现在看还是先观望吧
    renzhe8102
        11
    renzhe8102  
       2 days ago
    說實話, 比上週某個新模型還是強的,但是感覺都是刷分
    ufan0
        12
    ufan0  
       2 days ago
    好奇有在商业订阅百炼的吗?垃圾到开个帖都吐槽不完。
    CloudnuY
        13
    CloudnuY  
       2 days ago
    用 chat 试了一下,单页面 HTML 效果挺不错的
    https://chat.qwen.ai/s/t_7137c533-5109-4c1f-a67a-435e48a6bd04?fev=0.2.74
    techmale
        14
    techmale  
       2 days ago
    中大型项目配合高质的 AGENTS.md 、tests 、SOP 等情况下。Codex 是最最最最靠谱的。没有之一。
    Yesr00
        15
    Yesr00  
       2 days ago
    我用 QWEN 感觉就是在被它薅。。。它家自带的 IDE...动不动就死循环。。。疯狂吃钱。。。我都想报警了。。。
    zhonghao01
        16
    zhonghao01  
       2 days ago
    qwen 每次新模型都吹得天花乱坠,多牛逼多牛逼,但是实际一用,太垃圾了,完全配不上价格。

    qwen 的新模型高产似母猪
    cb74883
        17
    cb74883  
       2 days ago   ❤️ 1
    他自己 Qoder 里面的定价是 0.5 ,GLM5.2 定价是 0.6 ,Kimi-K3 是 0.8 ,可以参考一下。
    kevan
        18
    kevan  
       2 days ago
    每次发布,都说世界前列。
    karld
        19
    karld  
       2 days ago
    垃圾
    unregister
        20
    unregister  
       2 days ago
    V 站没有一个人客观的,都是一句话的,别来这问了
    unregister
        21
    unregister  
       2 days ago   ❤️ 1
    X 上点赞的很多,到这里就是垃圾的不行。
    keshawnvan
        22
    keshawnvan  
       2 days ago   ❤️ 1
    体验了一下:
    1.速度很快,快的不像 2.4T 的模型,可能激活参数不高。
    2.在 Qoder 里一折,导致负载很高,可用性很差。
    3.后训练做的确实一般,查看 AGENTS.md 和知识库不积极。
    levn
        23
    levn  
       2 days ago
    测试了一个问题,用本地的 397b q2 来检查,发现一处错误。
    xiaokaitongxue
        24
    xiaokaitongxue  
       2 days ago
    只能说 现在打折 薅羊毛用用还行。
    Seanfuck
        25
    Seanfuck  
       2 days ago
    @CloudnuY 这个挺不错了。
    不管有没有吹,qwen 在国内总体算是第一的。
    xiaomushen
        26
    xiaomushen  
       2 days ago   ❤️ 1
    V 站上都是用 Fable5 和 GPT5.6 ,一般看不上这些国模,更别说用了
    lostwolfkf
        27
    lostwolfkf  
       2 days ago
    这是 qoder 里的倍率,我不信他又便宜又好
    ifoto
        28
    ifoto  
       2 days ago
    用的 3.7 写的确实一般。错误也多
    lscho
        29
    lscho  
       2 days ago via Android
    qwen3.8 拉中拉。。。写个样式都写不好,两个按钮大小不一致,让他改成一致的。因为 css 类名用了 Tailwind 的风格,他直接判定项目装了 Tailwind ,连 package.json 都不看就说改好了。。。然后故意没说原因,说没生效,提示两次还没处理好。
    ebushicao
        30
    ebushicao  
       2 days ago
    qwen 拉完了,上次的 3.7-max 也是吹的天花乱坠,用起来有时候还没 deepseek-v4-flash 聪明。kimi 虽然 2.7 拉了一坨,但是 k3 确实有点东西。

    看到#3 楼说到了之前千问的宣传,我顺带吐槽一下,当时我说要点奶茶,给我推了一堆奶茶,我说换一批便宜点的,结果给我返回一批蔬菜水果... 拉到我真的绷不住。
    Hilalum
        31
    Hilalum  
       2 days ago
    不管咋的,Qwen3.6-27B 简直是神
    wxjer
        32
    wxjer  
       2 days ago
    有没有可能分跑分版和普通版,参考国内手机送评/跑分内幕
    PopRain
        33
    PopRain  
       2 days ago
    千问插件自动变 Qoder 社区版,credits 突然清 0 了 ,白嫖不了也就不用了. (订阅有腾讯的)
    lenzhang
        34
    lenzhang  
       2 days ago
    @Hilalum 确实,qwen3.6 27b 是真的神
    zhoudaniu
        35
    zhoudaniu  
       2 days ago   ❤️ 1
    @techmale codex 已经沦为我的 方案审核工具了, 让它做一个任务的时间,我可以用 grok 做完+人工测试完+睡一觉
    Nzelites
        36
    Nzelites  
       2 days ago
    qwen 其实并不差 3.7plus review ds4p 经常可以胜利,虽然说 ds4p 也不算顶部模型就是,不过 plus 相比 max 也是丐版嘛
    GeruzoniAnsasu
        37
    GeruzoniAnsasu  
       1 day ago
    @unregister

    > V 站没有一个人客观的,都是一句话的,别来这问了

    你理解错了客观的含义。 客观≠全面,而是在东西垃圾的时候真的说垃圾,在好的时候真的说好。显然 qwen 用户没有说 qwen 好的,k3 用户也没有说 k3 能力不足的,这挺客观的。

    事实上,qwen 的模型长期以来只能作为文本任务的基准模型来用,而且作为开源模型,它的底模表现极其中庸,说白了啥都能干啥都干不好。在此基础上光是官方就发过一大堆不同针对的微调,社区更是五花八门,人格强化的、道德强化的、自定义蒸馏的、拿来训练自己的 persona 的什么都有。

    所有 qwen 在社区眼中应该属于一个「自己接过来训练比较有玩头」的模型,对于 c 端需要它真正完成代码和指令任务的需求并不匹配,它也确实干不好。大伙都没说错,懒得表达自己不关心的场景而已。
    MK47
        38
    MK47  
       1 day ago   ❤️ 1
    不 qwen3.8 还真的确实还可以
    xiangqiankan
        39
    xiangqiankan  
       1 day ago
    前阵子不是被实锤了 2 万多个账号吗,蒸馏的 faber5
    catazshadow
        40
    catazshadow  
       1 day ago
    @wxjer 有可能是多余的
    unregister
        41
    unregister  
       1 day ago
    @GeruzoniAnsasu 太长不看
    unregister
        42
    unregister  
       1 day ago
    @GeruzoniAnsasu qwen 3.8 2.4T 得参数你自己拿来改吗?你说的是小模型吧
    liangc230323
        43
    liangc230323  
       1 day ago
    @MK47 确实还行,但是感觉思考能力不如 3.7max ,执行能力更强了
    bojue
        44
    bojue  
       1 day ago
    测试用过 300 刀的 qwen ,写了一堆垃圾,全删了

    qwen 写代码蜜汁自信,后端有相同的功能,直接新增表新增逻辑,楞给你创建一个新模块,导致后端原有的功能无法缝合
    frantic
        45
    frantic  
       1 day ago
    在我心里,qwen 已经和 minimax 一桌了:吹牛第一名,干啥啥不行
    IamAngry1s
        46
    IamAngry1s  
       1 day ago   ❤️ 1
    @unregister 这点文字都看不了,就别上网了。大模型动不动给你输出千把个字,你这还能理解?有阅读障碍的话你还谈什么大模型。每天赢麻了就行。但凡用过点阿里的 coding 或者 token plan ,都说不出这么蠢的话。
    hidemyname
        47
    hidemyname  
       1 day ago
    @cb74883 这个比例并不能说明模型优劣,最多能说明算力成本
    hidemyname
        48
    hidemyname  
       1 day ago
    目前这些模型除非特别垃圾,其实处理日常开发拉不开多大距离,跟当期自动驾驶一样,同样参数差不多算力水平的模型没有特别大的差距
    hidemyname
        49
    hidemyname  
       1 day ago
    7 月份买一个月的 qoder cn 169 的订阅,主要用 qwen 3.7 plus 和 max ,整体用下来,也没出现什么解决不了的问题,可能我这后端项目比较简单吧
    seven777
        50
    seven777  
       1 day ago
    目前来看 QW 3.7, 3.8 preview 还行吧,一般问题也能解决,主要是便宜啊.能力上感觉比腾讯的 HY3 好一些.
    加上 Qoder 比 codebuddy 好太多,所以 Qoder+QW3.7 能做很多事.
    seven777
        51
    seven777  
       1 day ago
    @Yesr00 #15 Qoder? 它相对来说还好吧, 比 QQ 家的 codebuddy 好很多; 比内涵段子家的 Trae 要轻量化省资源.
    但是它很多毛病,比如专家团不能用来写代码,极不靠谱,但用来评审+找错很好.
    seven777
        52
    seven777  
       1 day ago
    @lostwolfkf #27 3.8 preview 是不稳定,不是不好. 你用就知道了,我的显示 0.01 倍率.
    jujusharp
        53
    jujusharp  
       1 day ago
    我实测下来,至少在前端,3.8 max preview 审美和完成度是完胜 gpt 5.6 sol 的,跟 kimi k3 各有千秋吧,虽然跟 gpt 比前端能力也不太公平,一向短板。后端仍然是用 gpt
    uCharles
        54
    uCharles  
       1 day ago
    昨天下午 3.7 给我的都是错误回答,我切 3.8 后,3.8 跟我道歉说上一个回答是错误的。。。
    xifangczy
        55
    xifangczy  
       1 day ago
    跑分没输过 实战没赢过
    Chuckle
        56
    Chuckle  
       1 day ago

    现在 0.05x ,便宜,蹬了两天,感觉今天下午开始降智了,昨天和上午,体感上比 glm5.2 强一点
    jwan
        57
    jwan  
       1 day ago
    https://qoder.com.cn/referral?referral_code=KgU28a7KG31mIlqf6wRZno2t331BJLJx 你的好友邀请你体验 QoderWork 中国版,阿里巴巴出品的桌面端智能工作助手,立即注册并下载客户端领 2,000 积分,完成学生/教师认证再领 4,000 积分。
    unregister
        58
    unregister  
       16h 29m ago
    @IamAngry1s 你瞧瞧你说的话有逻辑吗?值得别人阅读吗? :) 我没有说赢麻了,你不要自行脑补
    unregister
        59
    unregister  
       16h 27m ago
    @IamAngry1s 正好打算买一个阿里的 coding plan 用用,qoder 现在有折扣哦
    Yesr00
        60
    Yesr00  
       11h 30m ago
    @seven777 死循环太严重了。我上个月订阅了一个 59 的版本。。。死循环至少跑了 30%左右的 Credits 。都不带返还的。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1025 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 128ms · UTC 19:14 · PVG 03:14 · LAX 12:14 · JFK 15:14
    ♥ Do have faith in what you're doing.