泡泡资讯网

今天看到林俊旸离职后的首篇长文,坦诚得让人意外。 他直言:"融合思考与指令模式"

今天看到林俊旸离职后的首篇长文,坦诚得让人意外。
他直言:"融合思考与指令模式"这条路,千问试过,走不通。
简单说,现在的 AI 有两种模式:
指令模式:你问它答,追求快、准、省
思考模式:深度推理,消耗大量算力
千问团队曾试图把两者融合成一个模型(Qwen3),结果发现:鱼和熊掌不可兼得。
数据分布不一样,行为目标冲突,强行融合的结果就是——两头不讨好,表现都平庸。
所以 Qwen 后来的版本干脆分开:30B 轻量版跑指令,235B 重载版做深度思考。用户按需选择。
这段话背后的深意:
技术理想 vs 商业现实
融合一个模型是技术人员的浪漫,但商业客户要的是成本低、速度快。
国产大模型的困境
国外 Anthropic、国内DeepSeek 还在探索融合,千问已经务实切割。是技术差距,还是策略不同?
林俊旸的坦诚
离职后说"我们没全做对",比在职时说更有分量。这种反思在国产 AI 圈太少见了。
个人看法:
千问选择"分而治之",短期看是妥协,长期看可能是对的。
大模型战场,活下来比炫技重要。
你同意吗?
阿里 千问 林俊旸 AI 大模型