问:最近总听到“AI词元”这个词,它跟IDC价格有什么关系?
答:关系越来越直接。过去IDC报价主要看机柜功率和带宽端口,现在AI推理的“词元”消耗量直接影响单机柜的GPU利用率和网络出口流量。本周某头部云厂商内部纪要显示,推理词元日均调用量环比增长17%,导致其华东节点10G/25G混合带宽套餐溢价约5%—8%。简单说,词元越多,带宽和算力打包成本越难分开谈。
问:AI服务器带宽到底怎么计费才不踩坑?
答:目前三种主流模式并存:95计费峰值、固定带宽包月、按流量阶梯。本周行业讨论较多的是“入向免费、出向按词元关联计费”的试水方案。建议签合同前明确:是否对AI推理返回的大流量出向单独加价,以及突发词元高峰是否触发带宽溢出罚则。近期有IDC服务商推出“词元保障型带宽”,承诺每百万词元对应50Mbps瞬发能力,但仍处于试点阶段。
问:IDC网络软件最近有什么实在的更新?
答:本周有两个动向值得关注。一是部分IDC开始部署可编程网卡+SONiC解耦方案,让租户能通过API动态调整AI服务器与存储之间的东西向流量优先级,对词元密集型的向量数据库检索场景延迟降低约12%。二是网络软件开始内置“词元感知”QoS策略,能识别HTTP/3上gRPC流中的推理请求,自动将其标记为高优先级。这对混合部署训练和推理的客户比较实用。
问:现在租AI服务器,是选高主频还是大带宽?
答:取决于你的词元产出结构。如果以长文本生成、高并发对话为主,网络带宽和网卡队列深度比CPU主频更关键,建议至少25G起步并确认支持RDMA over Converged Ethernet。如果是短词元、高吞吐的分类或嵌入任务,则优先看GPU显存带宽与本地NVMe IO。本周有IDC代理商反馈,客户从“只问GPU型号”转向“问每词元网络成本”,说明精细化选型正在成为常态。
问:本周价格整体是涨是跌?
答:分化明显。通用机柜价格平稳,但AI专用高功率机柜(单柜20kW以上)在北上深周边上浮3%—5%,且要求签约12个月以上。带宽方面,普通 transit 价格微降,但面向AI推理优化的低抖动、低丢包线路溢价扩大。软件定义网络附加服务从“赠送”变为独立报价,每月每端口约200—500元。建议近期有扩容计划的企业,锁定带宽单价的同时,把网络软件功能清单写进SLA,避免后续为“词元优先转发”额外买单。


0 留言