算力账单正成为大模型厂商的共同压力。智谱联合清华大学等发布的新一代网络架构ZCube引起了广泛关注:在线上GLM-5.1生产集群中,不加一块GPU,节省了33%的交换机与光模块成本,同时将GPU平均推理吞吐提升了15%,TTFT(首Token生成时间)P99降低了40.6%。行业分析指出,这体现出AI基础设施优化正从单纯堆叠算力转向系统级协同创新,为国产大模型在算力约束下的性能突围提供了新范式。lns找找AI | 免费AI工具导航 | 人工筛选靠谱优质 AI 工具!
lns找找AI | 免费AI工具导航 | 人工筛选靠谱优质 AI 工具!
与此同时,行业泡沫的讨论也在升温。2025年全球大语言模型用户总数已突破38亿,总收入约207亿美元。但问题同样严峻:据测算,当AI Agent需要调取行业数据库、实时金融数据等时,传统搜索API只能覆盖约20%的互联网高价值信息,大量专业数据深藏于深网之中。中美大模型周调用量竞争激烈,甚至有报道称中国大模型周调用量已连续三周超越美国。

相关