WAIC 2026 | 灵犀智算:全栈协同,打造Token极致性价比
随着全球Token调用量指数级暴涨,很多企业陷入困境:盲目堆叠GPU,算力空转、通信拥堵、故障频繁中断业务,单位Token成本居高不下,陷入“规模越大、成本越高”的恶性循环。 WAIC 2026期间,紫光股份旗下新华三集团重点展示了灵犀智算解决方案。该方案摒弃碎片化交付模式,依托“算-网-存-云-安-维”全栈协同能力,覆盖Token从建设、运行、治理到调优的全生命周期,构建起完整的降本闭环。通过全栈软硬件的深度协同优化,已实现Token生成全链路TCO下降30%以上、能耗成本降低40%以上的系统级成效,让企业真正走出“Token产出规模越大、单位成本摊薄越明显”的良性增长曲线。 四大核心能力 一站式搞定Token生产全链路 1. 建设:弹性快速交付,轻量化灵活落地 灵犀智算方案采用一体化交付模式,有效规避多厂商硬件兼容与跨系统联调带来的漫长交付周期,支持标准化批量自动开局,软硬件平台统一上线。架构层面支持逐层弹性扩容,从单集群平滑拓展至万卡乃至十万卡跨域规模;同时兼容中心智算、边缘算力、混合云三类部署形态,企业现有异构GPU可统一接入、复用,无需一次性替换全部硬件。针对中小型项目,AI业务可做到天级上线,大幅压缩Token算力底座的基建周期,帮助客户更快进入Token生产阶段。 2. 运行:高稳定自愈底座,保障Token不间断产出 训练中断、推理宕机会直接作废已产出的Token,任务重做带来额外的算力损耗与时间成本。灵犀智算方案配备全链路自治运行体系——硬件异常3秒感知、分钟级完成隔离自愈;网络闪断仅小幅降速、不会直接中断业务;双平面无损网络实现毫秒级链路切换,远距离跨域集群近乎零丢包。搭配灵犀运维智能体,可主动进行故障巡检与定位,有效训练时长稳定维持在99%,确保模型迭代与高频智能体调用全天候平稳输出Token。 3. 治理:全链路统一管控,Token安全合规可控 灵犀智算方案提供算力、数据、模型、智能体多层级精细化治理,破解管控分散、安全隐患难防的痛点。统一资源后台支持租户分级隔离与算力任务可视化调度,Token用量按API Key颗粒度统计,方便政企客户对内对外开展算力运营。底层以微VM沙箱实现租户隔离,AI网关开展内容审计、按API Key限制Token调用频次,有效抵御提示词注入、算力恶意刷取等风险,Token从生成到交付全程可追溯,安全合规。 4.优化:全栈软硬协同,持续压低Token生产TCO 灵犀智算方案以硬件工程与软件优化的深度协同,将每一份算力都精准转化为Token输出。 硬件工程系统能力: 液冷散热:高功耗部件采用液冷散热,系统液冷占比可达80%,更可支持两相冷板、全液冷等创新液冷散热技术,PUE降至1.04以下,常年大规模运转下的能耗开销被大幅削减;...
查看详情 →












