上周ai圈炸了!但吃瓜群众们可能没注意到,这场狂欢背后藏着更劲爆的剧情。7月15日那天,科技圈上演了一出'双雄会'——前openai技术女神mira murati带着她的thinking machines lab,在旧金山发布了9750亿参数的inkling模型。这可不是普通发布会,而是用20亿美金和100个天才大脑砸出来的王炸!

更巧的是,同一天,刚拿下图灵奖的强化学习教父richard sutton教授,带着他的oak lab放出狠话:'现在的ai架构已经到头了,必须来场彻底革命!'这话简直说到deepseek创始人梁文锋心坎里去了。梁总有个神比喻:ai进化就像爬楼梯,现在咱们正卡在'持续学习'这个台阶上,谁能先迈过去谁就是下一个王者。
就在全球盯着硅谷大佬battle时,中国突然杀出一匹黑马——成立才8个月的mind lab,带着他们的macaron-v1模型系统惊艳亮相。这家2026年10月才成立的小团队,背后站着心洲科技这棵大树,30多个mit、斯坦福的学霸聚在一起搞事情。年初刚拿了美团领投的5000万美金a轮,蚂蚁、红杉这些大佬都抢着跟投,这阵容简直梦幻!
他们家的模型玩得贼溜:旗舰版venti是个7480亿参数的怪兽,能handle两百万字的超长文本;标准版tall只有350亿参数,普通电脑都能跑得飞起。最牛的是他们对lora技术的改造——这玩意儿现在不是简单的调参工具,而是变成了给ai'换皮肤'的核心组件。就像咱们手机能装各种app,macaron-v1能让ai在不同场景自动切换技能包。
这个叫'混合lora'的黑科技,直接解决了ai'精神分裂'的老大难问题。在专业测试里,它的代码能力吊打gpt-5.5,搞复杂工程时尤其厉害。更良心的是他们开放了模型权重,企业可以私有化部署,再也不用担心数据安全问题。配套的repl工具链让训练和上线无缝衔接,这才是真正能落地的技术!
在万亿参数规模玩转lora强化学习,全球没几个团队能做到。mind lab去年四季度就验证成功了,训练成本只有全参数微调的8.3%。现在这个赛道火得不行,专攻这领域的fireworks ai估值都冲到120亿美金了。
和硅谷那些烧钱自建基座的土豪不同,mind lab选择了一条更聪明的路——扎根中国开源生态,用别人8%的资源,做出了更有竞争力的产品。这种'四两拨千斤'的操作,简直是把商业智慧玩出了花。
但最让人兴奋的是他们的持续学习机制。普通ai训练完就定型了,macaron-v1却能边用边学,越用越聪明!实验显示只要基座0.48%的参数就能记住新知识。这哪是ai啊,简直就是会成长的数字生命!
他们还有个更超前的构想——让百万个lora模块组团进化,形成'众人拾柴火焰高'的群体智能。自主研发的mint平台已经建起了庞大的lora资源库,就像人类文明靠协作创造奇迹一样。商业上也很能打,开放api两周就签了1200万美金的年单,市场对持续学习技术的渴望可见一斑。
当巨头们都在持续学习赛道疯狂布局时,mind lab用独门绝技实现了弯道超车。这家年轻团队证明了一个真理:ai竞赛比的不是谁家模型最大,而是谁能造出会自我进化的智能系统。依托中国蓬勃的开源生态,他们用精干的团队为下一代ai开辟了新航道。这故事告诉我们:在科技创新的赛场上,有时候小个子也能打出漂亮的本垒打!
网友留言: