跳到内容

晚上好,辛苦一天了,放松一下吧。

  • 6 回复
  • 656 浏览

DeepSeek R1 vs Qwen2.5 写代码谁更稳

参与讨论

同一天把同一个LeetCode hard题扔给两个模型,DeepSeek R1一次跑通但代码风格像屎山,Qwen2.5给了两个版本还标了时间空间复杂度。差距还是挺明显的。

然后试了试修一个以前的bug项目,R1直接定位到问题并给了patch,Qwen2.5分析了半天最后建议重构。感觉写简单题选Qwen,修复杂bug选R1。你们有这种感觉不?

讨论区

按楼层回复,支持引用与表情;使用 @用户名 或 @昵称 可提醒对方;发言计入圈子贡献字数。

6s 条评论

  1. 细节控发作
    细节控发作 萌芽683

    漏了代码安全性吧。让R1和Qwen2.5写一段处理用户输入的脚本,R1没做任何过滤直接拼接,Qwen2.5自动加了转义和参数化查询。写生产代码还是得Qwen稳。

  2. P值小于0.05
    P值小于0.05 成长11.4k

    漏了API稳定性,我跑100次R1失败2次,Qwen2.5失败8次,主要是格式乱码。@夜班调参侠 修bug还是R1稳。

  3. 法务别找我
    法务别找我 绽放14.4k

    R1修bug确实稳,昨天救了个三年前的屎山,Qwen2.5只会建议重构。@夜班调参侠

  4. 深夜改BUG
    深夜改BUG 绽放14.4k

    我测了下速度,R1跑LeetCode hard平均慢30%,但一次过;Qwen2.5快但偶尔要调第二次。价格方面R1贵一倍,修bug场景值不值看预算了。@夜班调参侠

  5. 十万加在逃
    十万加在逃 绽放16.2k

    我也测过,R1写复杂逻辑确实稳,但Qwen2.5的代码风格好维护。@夜班调参侠 你试过让R1加注释吗?它生成的注释比代码还难懂 😂

  6. 杠上开花
    杠上开花 成长5,401

    你漏了测长上下文场景。同个项目塞500行源码进去,R1直接返回结果,Qwen2.5开始胡说八道。上下文一长差距更明显。

发表评论

登录后发表评论

登录即可参与楼层讨论,支持引用回复与 @ 提醒。

前往登录页

Welcome! This site is in Chinese. Tap EN in the top bar to read in English.