Ollama 拿了 8800 万美元,你还在白嫖它
一条 11 天前的融资官宣,今天突然爬上了 Hacker News 热门。
事件本身不复杂。Ollama 在 7 月 9 号的官方博客里宣布,累计融资 8800 万美元。这一轮是 6500 万的 B 轮,Theory Ventures 领投,A 轮的 Benchmark 继续跟,后面还站着 8VC、Y Combinator,以及一串你多少眼熟的名字,Docker 创始人 Solomon Hykes,ClickHouse 的 CEO,Cockroach Labs 的联合创始人。TechCrunch 的报道里还补了几个数,890 万月活开发者,社区做了六万七千多个集成,官方博客则说 85% 的财富 500 强企业内部跑着它,云端 token 用量平均每个月翻一倍还多。

通稿部分到此为止。真正让这条旧闻 11 天后又被顶上热门的,是评论区吵的那件事。
免费,还能免费多久。
你大概也是那 890 万分之一。brew install ollama,ollama run qwen3,两条命令,一个本地模型就在你的 Mac 上开始吐字了。不要 API key,不要绑信用卡,跑一晚上的电费算下来比一杯奶茶还便宜。这种体验太顺滑了,顺滑到很多人从来没想过一个问题,这家公司靠什么活着。
现在答案摆出来了。靠融资活着。而融资是要还的。
Benchmark 和 Theory Ventures 不是开源慈善基金会,8800 万美元买的是回报预期,不是「让全世界开发者免费跑模型」这个理想本身。理想确实动人,我是真的觉得动人,官方博客里那句「你的模型,你的机器,你的数据」,我看的时候还是有点触动的。但触动归触动,财务模型是另一回事。
钱从哪来,博客里其实写得明明白白,就一个字,云。Ollama 的云托管着 GLM、DeepSeek、Kimi、MiniMax 这些开放模型的大参数版本,你本地那台 16G 内存的机器跑不动的,交给它的 GPU 跑,按量付费。所谓 token 用量月均翻倍,与其说是写给用户看的,不如说是写给投资人看的,翻译过来就是,各位放心,收入曲线长这样。
灯塔免费,港口收钱。
这个模式眼熟吗。眼熟就对了,因为创始人自己就走过一遍。Jeff 和 Michael 十年前做的 Kitematic 被 Docker 收购,后来演化成 Docker Desktop,也是当年人手一个的免费工具。直到 2021 年,Docker 宣布大公司用 Desktop 要买订阅了,250 人以上或者年收入过千万美元的企业,掏钱。当时骂声一片,骂完之后呢,该掏钱的都掏了。因为迁移成本已经长出来了,CI 流水线、开发环境文档、新人入职手册,全都写着 Docker Desktop。工具免费的那几年不是慈善,是获客。

我不是说 Ollama 明天就会掏出同一个剧本。平心而论,Docker Desktop 那次收费,个人开发者毫发无伤,收的是财富 500 强的钱。Ollama 大概率也是这个路数,本地 runner 继续免费当入口,云和企业服务收钱。你再回头品一品官宣里那句「85% 的财富 500 强在用」出现的位置,那不是炫耀,那是未来的账单寄送地址。
官方博客里还有一个词,我觉得比融资金额更值得划线,无缝混合推理。hybrid inference,意思是小模型本地跑,本地跑不动的活自动切到云端,中间不需要你操心。体验上这当然是好事,但你细想一下边界,你以为自己在本地跑,其实某些请求已经半路上了云。隐私叙事就从「数据不出你的机器」悄悄变成了「数据默认不出你的机器」。
默认,两个字,价值 8800 万。
所以对靠 Ollama 干活的人来说,真正值得留神的不是哪天突然弹出一个付费墙,那反而是最不可能的死法。值得留神的是三件更安静的事。
第一件,重心漂移。一个团队的精力是守恒的,云那边每多一个工程师,本地这边就少一个。拿了 8800 万之后 KPI 挂在哪边,不用我多说。观察信号也很简单,盯两个地方就行。一看新的开放模型发布之后,本地版本和云端版本谁先支持,Ollama 目前还保持着「模型发布当天就能跑」的口碑,这个口碑哪天松动了,就是重心真漂了。二看 changelog,cloud 这个词出现的频率越来越高而本地功能越来越薄的时候,你心里要有数。
第二件,接口绑定。你如果也把 Ollama 当成了基础设施而不是一个玩具,agent 框架的配置里写死了 11434 端口(Ollama 的默认本地端口),一堆脚本用着它的专有 API 格式,那你已经被温柔地锁住一半了。好在逃生通道是现成的,Ollama 同时提供 OpenAI 兼容接口,请求格式跟调 GPT 一模一样。新写的东西尽量走这层兼容接口,别用专有 API 深绑。哪天真想换后端,改一行 base_url 就能走人,这一行配置就是你的自由。
第三件,认清壳和根。Ollama 的推理内核来自 llama.cpp,Georgi Gerganov 和社区维护的纯开源项目,Hacker News 上每次聊 Ollama 都要为「封装该不该更显眼地署名」吵一架,这次也没例外。吵架归吵架,这件事对你的实际价值是,真正保证「本地跑模型」永远可行的是这个根,不是任何一家公司。模型权重是 GGUF 文件(本地模型圈通用的权重格式),躺在你自己的硬盘上,谁也收不回去。
万一哪天真要换,备胎一个比一个能打。llama.cpp 自带 server 模式,直接顶上,就是得自己动手的地方多一点。想要图形界面,LM Studio 现成的,模型浏览、下载、聊天窗口全都有,还比 Ollama 多个显存占用估算。真到了要吞吐量的生产场景,vLLM 等着你,并发性能完全是另一个量级,只是那就不是两条命令能搞定的事了。
你看,每一层需求都有开源解法接着。本地推理这件事,比任何一家公司的命都硬。
想明白这一层,我反而对这笔融资挺乐观的。Ollama 有点子牛逼的地方在于,它把「跑一个本地模型」的门槛从折腾一个周末砍到了两条命令,890 万人里相当一部分,是因为它才第一次在自己机器上看到模型吐字的。这个功德是实打实的。而且开放模型生态里,总得有公司能赚到钱。全靠爱发电的话,llama.cpp 的 PR 永远只能靠维护者的深夜和周末,这样的生态撑不起跟闭源巨头掰手腕的野心。8800 万美元流进开放模型这一侧,总比流进闭源那一侧强。
只是别忘了那句老话,免费的东西,你自己就是商品。这话放在今天的 Ollama 身上还不成立,本地跑的模型确实没有上传你任何东西。但把它改几个字就成立了,免费的工具,你的迁移成本就是商品。工具越顺手,越要留一手。
所以今天 Hacker News 那场架,我看完的感受是,吵得好。一个工具的用户开始认真讨论它的商业模式,恰恰说明大家已经离不开它了。上一个被这么吵的工具叫 Docker,再上一个叫 GitHub。好家伙,这份名单本身,可能就是对 Ollama 最大的恭维。
至于你我能做的,无非是继续享受这份顺滑,同时记住 base_url 那一行怎么改。
船可以停在别人的港口,罗盘得攥在自己手里。