据路透报道,9月11日,智谱启动新一轮融资,包括约20亿美元的股票配售和30亿美元的可转换债券发行,合计规模50亿美元,折合人民币超过350亿元。这是继今年7月配售募集约40亿美元之后,智谱在两个月内再次从资本市场拿钱。今年1月,该公司已在港交所上市。

智谱再启50亿美元募资,大模型公司开始自己建算力

募资用途指向同一个方向。此次披露的资金将用于研发、算力资源及相关基础设施、业务扩张、战略投资和潜在并购;7月那笔40亿美元融资中,算力、研发和人才同样占据主要位置。据披露,智谱已建成一座1GW级数据中心并开始部分投入运营,主要用于GLM系列模型研发,全部采用国产AI芯片,同时还运营着多个万卡计算集群,并被曝收购异构算力软件公司中科加禾、与国内芯片公司讨论定制AI芯片。DeepSeek也在做类似的事:今年在内蒙古乌兰察布招聘数据中心高级交付经理、运维工程师和IDC设计规划工程师,7月底有消息称其计划在乌兰察布增加1GW规模算力,并从外部租赁额外算力。

从租算力、买算力到自己盖数据中心,模型公司的角色正在变化——从算力的使用者变成基础设施的建设者。2023年“百模大战”开始时,参数规模、Benchmark、训练用了多少张GPU、能否追上GPT-4才是关键指标,算力只是完成一次训练的生产资料。如今头部模型之间比拼的是持续迭代,预训练之后还有后训练、强化学习和推理,模型更新周期不断缩短,多数厂商已把后训练当作主场。Agent成为新的竞争场景后,模型还要持续调用工具、运行任务、消耗Token,公司需要考虑的问题变成未来几年能否获得稳定且足够便宜的算力。

海外节奏更快。国际清算银行近期披露,2025年至2026年,全球最大的五家科技公司在AI上的投资预计超过1万亿美元,到2030年全球AI相关投资规模可能从约5000亿美元增长至4万亿美元。Anthropic正在筹备规模可能达到1000亿美元的IPO,并已承诺在AWS投入1000亿美元;OpenAI、Meta和Google则把资金投向数据中心、GPU、自研芯片和能源。对头部模型公司而言,算力正从可按需采购的成本变成需要提前锁定的战略资源,竞争也从模型是否更强,转向谁能长期支撑一个最前沿模型。