第82节
住逻辑漏洞”

    “建议博主出道专职打假”

    姜亦心打字越来越快,耳朵尖微微发红。

    李婷端着咖啡路过她工位,扫了一眼她的手机屏幕。

    姜亦心啪地把手机扣在桌上。

    “你在干什么?”李婷问。

    “没干什么。摸鱼呢!”姜亦心已读乱回。

    李婷看了看她通红的耳尖,没说话,笑着走了。

    水军战打到第二天,一篇知乎长文安静地出现了。

    作者:CodeMonkey老张,技术圈小有名气的独立架构师,写过几篇爆款技术科普,可以说是NullPointer之下第一技术博主。

    标题:《万物生和开物的技术差距到底在哪?一个乾元用户的客观分析》

    四千多字,三个部分。

    第一部分:“乾元模型本身不差。”他贴了外网测评数据,乾元在纯代码生成任务上跟比开物用的第三方开源模型水平不知高到哪里去了,某些垂直场景准确率能高出50%。“说句可能得罪人的话,如果单纯比模型,乾元在代码生成赛道属于第一梯队,比起国际上的模型只强不弱。”

    第二部分:“问题不在模型层,在应用层。”用户输入提示词,模型生成代码,直接交付,中间没有任何质量保障环节。没有代码检测,没有自动修复循环,没有边界条件测试。“相当于工厂出了产品不做质检就上架。会员数据丢失不是模型写不出正确代码,并发写入没有事务保护,任何模型都可能生成这种bug,关键是生成之后谁来检查。”

    第三部分:“开物为什么能打。”开物的模型不是最强的,但有一套完整的生成后质检闭环,BugKiller检测加自动修复。“模型能力决定上限,产品力决定下限。万物生上限可能很高,但没有下限。开物的上限没那么高,下限却足够稳定,只要是交付出来的东西,保证能用。”

    结尾一句:“万物生最大的问题不是技术不行,是太着急了。鼎盛有资源有模型有人才,如果愿意花半年打磨应用层,完全可以是个好产品。但他们选择了现在上线。”

    语气平和,数据详实,结论致命。

    马小飞转发,配文:“专业的事交给专业的人说。”

    文章被开物社区置顶,三家科技媒体全文转载。

    “模型不差,应用层差”,八个字钉进了这场风波的核心。