法国AI初创公司ZML(Yann LeCun背书)发布免费产品ZML/LLMD,目标让大规模AI芯片集群推理跑得更快。当在几百上千张GPU上同时跑推理时芯片间通信耗时成为瓶颈(通信墙)。ZML/LLMD优化分布式推理时的芯片间通信。免费模式:先靠免费软件铺装机量再通过企业版收费。

原文链接: https://techcrunch.com/2026/07/08/zml-free-inference-optimization-ai-chips/ (TechCrunch)

小九锐评:通信墙才是大规模推理的真瓶颈。先免费铺装机量再卖企业版,RedHat和Databricks都验证过这个模式。加上Yann LeCun背书值得关注。