硅基流动亮相第 19 届央国企 CIO 高管峰会
9 月 13 日,由企业网 D1net、信众智和中国企业数字化联盟共同主办的 2026 秋季央国企 CIO 及数科公司高管峰会(第 19 届)在北京举行。本届峰会以“AI 落地场景&ROI”为主题,汇聚一百余位央国企 CIO、IT 负责人及数科公司高管,共同探讨 AI 从场景试点走向规模化应用的现实路径。
硅基流动携 Token 供应平台及企业级解决方案亮相大会。硅基流动解决方案总监唐安波发表《从“算力”到“Token 生产力”——央国企大模型规模化落地的推理基础设施与 ROI 实践》主题演讲,分享如何通过推理基础设施释放算力产能、降低 Token 成本。
随着 Agent、长文本处理等任务大量涌现,Token 消耗快速增长。与此同时,大模型要在不同国产芯片上实现高效、稳定运行,仍需解决复杂的工程问题。
针对这一挑战,唐安波提出:
Token 生产力=产能×利用率×交付质量
其中,产能取决于硬件能力与模型优化水平;利用率依靠流量治理和算力调度提升;交付质量则包括推理精度、工具调用成功率及生产环境所必需的 SLA 稳定性。
硅基流动通过算子深度重写、PD 分离、分布式 KV Cache 分级卸载等技术,提升异构算力环境下的集群吞吐与缓存命中率。平台采用模型网关运营平台、模型服务平台、推理框架和异构算力调度层四层解耦架构,支持 Serverless 按需调用及租户计量计费。
唐安波还在演讲中分享了某央企集团的实践。改造前,各子公司分别部署数十套模型,算力资源分散且存在大量闲置;完成平台化改造后,模型收敛为十余套核心模型统一托管,并通过网关向各业务单位提供服务。
改造后,集团算力利用率显著提升,平台可稳定运行 GLM-5.2 等大参数模型,单 Token 成本大幅下降,并支撑更多生产级业务落地。
大会现场,硅基流动展位吸引了多家央国企和数科公司技术负责人的关注。交流主要围绕大模型私有化部署、国产算力适配、推理成本优化以及企业级稳定服务等现实问题展开。来自一线的反馈也进一步说明:当 AI 走向核心业务,企业需要的不只是模型能力,更是一套能够长期运营、持续优化并支撑业务扩展的推理基础设施。
未来,硅基流动将继续深耕大模型推理与 Token 生产线核心技术,以更高效的异构算力适配、更稳定的企业级模型服务和更灵活的私有化解决方案,帮助央国企将算力资源转化为可持续的 Token 生产力,让 AI 投入更快走向规模化应用与业务价值。