Daily Tech Briefing
AI 科技速览
每天 5 分钟内学习 AI。获取最新的人工智能新闻,理解其重要性,并学习如何将其应用于您的工作。
InfoQ AI · 2026/7/31 11:39:44

AI浪潮中,如何定义自己的“确定性”之旅?
AI 中文解读
首都在线在2026年WAIC上释放了一个明确信号:AI竞争已从“拼算力数量”转向“拼算力价值”。这家从传统IDC转型而来的公司,正把自己定位为AI基础设施层的“金牌伙伴”,核心目标就一个——让Token从生产到应用的全过程都“确定”。所谓Token,可以理解成AI思考和产出内容的最小单元,Token流动得越顺畅,AI用起来就越稳。
这则新闻最抓人的点,是首都在线选择了一条重资产路线:收缩传统IDC业务,自建智算集群、自研调度平台、铺设覆盖50多个国家的全球网络。最关键是它坚守“中立”身份,不碰模型、不碰数据、不碰应用,让客户不用担心自家数据被云厂商拿去训练竞品模型——这种安全感在云大厂既做裁判又做运动员的时代成了刚需。同时它的CloudOS平台支持混用不同品牌GPU,客户切换成本低,灵活度远超标准化大厂。
对普通人来说,这意味着未来AI服务的价格可能更合理、响应更快、选择更多元。尤其当Agent应用爆发,从“问一句答一句”变成“持续自主干活”,底层的算力调度和网络传输能力就直接决定AI好不好用。首都在线想做的,就是让每个AI应用背后都有一条不被卡脖子的“确定性”通道。行业里不只有巨头一条路,专注、中立、肯下笨功夫的玩家同样能定义规则。
当 AI 基础设施的竞争从"谁有更多算力"的上半场,迈入"谁能把算力的价值发挥到最大"的下半场,一家从传统 IDC 起家的公司,正在用自己的方式回答一个行业级的问题:在 AI 时代,什么样的基础设施才是客户真正需要的?2026 年 WAIC 上,首都在线给出了清晰的答案——做 AI 的金牌伙伴,定义 Token 从"生产"到"应用"的确定性旅程。这不是一句空洞的口号。从战略决策到业务落地,从算力布局到客户服务,首都在线正在沿着这条主线,构建一套属于自己的 AI 基础设施体系。从 IDC 到 AIDC:一场基础设施级的范式迁移2023 年,当首都在线明确提出"聚焦智算"时,很多人觉得一家做 IDC 起家的公司大举押注 GPU 算力风险太大。但首都在线的判断是——AI 不是风口,是基础设施级的范式迁移。为此,首都在线做了一件"很多人不敢做的事":主动收缩传统 IDC 业务,把资源、人才、资本全部转向智算。这不是"算力倒卖"的短期生意,而是选择了"软硬一体、云网协同"的重资产路径——自建智算集群、自研 CloudOS 调度平台、构建全球二层网络。这一战略决策的成效正在显现。2025 年,首都在线智算云收入达到 2.95 亿元,同比增长 61%,占总收入的比例达到 24%;到 2026 年一季度,营收继续增长 15.32%,亏损大幅收窄,毛利率也提升至 13.1%。在智算基建的规模化落地方面,国内庆阳节点已实现万 P 级算力规模,怀来、芜湖、文昌等智算节点正在加速建设,形成了国内 6 大智算集群的布局。海外方面,达拉斯节点完成了 GPU 算力升级,10 个数据中心节点升级到第五代 Intel 和第四代 AMD 处理器,整体算力提升 30%以上,形成了"国内核心集群+海外重点区域"的算力布局。网络层面,首都在线自建的全球二层架构网络已覆盖 50 多个国家、24 个公有云地域、近百条海缆专线,实现跨境毫秒级互联。这张网络不是租用的,而是自建的——这意味着当首都在线承诺"毫秒级延迟"时,能从架构上保证。从算力到 Token 的全链路确定性当下,首都在线聚焦于大模型处理信息的最小单位——Token 的全生命周期,核心围绕 Token 的生产、传输、调度、应用做优化,定位是纯粹的基础设施层,不触碰上层的业务逻辑与内容生成。首都在线将这条旅程拆解为四个关键环节:生产环节,核心是让每一 P 算力产生更多更有价值的 Token。这涉及节电、集群调度、模型选择、推理优化。庆阳节点的万 P 级算力规模,正是让推理"精益地发生"的产能基础。传输环节,即 Token 的分发和调度。大模型训练完成后需要部署到全球各地做推理,这不是网线一插就完事的。AI 推理流量与传统 Web 流量有着本质区别,流量模式从突发性变为平滑持续性,延迟敏感度从"中等、有一定容忍度"变为"极高、影响体验与算力效率"。首都在线构建的覆盖 50 多个国家的全球智算组网网络,正是为了匹配 AI 推理流量的这些特点,让 Token 在全球范围内"确定性地流动"。运营环节,首都在线自研了 MaaS 智能调度和运营平台,能够基于应用场景提供更具性价比的模型服务,同时端到端监测 Token 从供给到消费的全链路,让模型服务更确定、更精准、更具效费比。应用环节,首都在线通过 AI Sandbox 产品,让 Token 安全、高效地落地到业务场景中。AI Sandbox 基于 MicroVM 技术构建,实现硬件级隔离、毫秒级启动,确保 Agent 代码在安全可控的环境中运行,为客户的 AI 应用提供可靠、轻量的执行环境,让 Token"确定性地交付"。Token 工厂的特别之处:中立、灵活、全球云网首都在线的 Token 工厂有三重独特性,这三重独特性也是其核心竞争力。第一,中立性。首都在线坚持"不碰模型、不碰数据、不碰应用"的三不原则。在今天,很多客户最大的顾虑是——核心数据会不会被云厂商拿去训练他们自己的模型?首都在线作为独立第三方,客户把模型和数据放过来,跟放自己机房一样安全。当越来越多的云大厂自己做大模型、做应用,这种中立性不再是锦上添花,而是刚需。第二,灵活性。大厂的 AI 服务往往高度标准化,客户只能按他们的规矩来。而首都在线自研的 CloudOS 平台支持异构算力调度,客户可以混用不同品牌、不同型号的 GPU,可以自己管集群也可以交给托管,可以跑训练也可以跑推理,切换成本很低。同时,CloudOS 已逐步完成国产芯片的适配,能够让客户的训练和推理任务能在不同芯片之间无缝迁移。第三,全球云网协同。要自建覆盖 50 多个国家、近百条海缆专线的全球二层网络,需要 20 年的时间积累和巨额的资本投入,这不是靠融资能"烧"出来的。这张网络不仅能满足 Agent 场景下的低延迟、全球部署需求,还能帮助中国 AI 企业完成全球化部署。首都在线的贴身服务与确定性交付首都在线给每个客户配备 1 对 1 服务团队,从需求分析到方案设计到部署运维全程闭环。大模型客户经常凌晨两三点找过来说"集群出了点问题能不能帮忙看看"——首都在线的团队真的会爬起来处理。这种响应力,是 20 年运营基因的沉淀,也是大厂很难做到的。在定价策略上,首都在线遵循"随行就市,价值定价"八个字。客户买的不是"机柜里的一张卡",而是经过网络优化、调度优化、平台赋能之后变成的稳定可靠的生产级 Token 服务。同样一张 GPU 卡,裸卡出租是一种价格,变成确定性 Token 服务是另一种价格。客户买的是"确定性"。对于 Agent 时代的新需求,首都在线的应对是三管齐下:扩大算力密度、强化网络能力、升级平台能力。Agent 的运行模式从"流量型"变为"持续型";从"单模型"变为"多模型协同";从"中心化"变为"边缘化"。这些变化要求的不只是"更多 GPU",而是算力+网络+平台的系统能力。 展望未来,首都在线有三个期待:成为国内 AI 算力服务的标杆企业,成为中国 AI 出海的首选基础设施伙伴,定义"Token 确定性"的行业标准。在 AI 浪潮中,首都在线不是要成为最大的那一个,而是要成为更可靠、更懂客户、更有确定性的那一个。
分享
阅读原文 ↗