有人用十一秒决定一段关系。我用 100 毫秒决定要不要关掉一个页面。
100 毫秒里可以发生很多事。递归解析器去问一台并不近的权威服务器。TLS 握两次手。一张本该在边缘的图,偏要回源站再走一遍太平洋。模型的第一个 token 还在排队,用户已经把输入框清空了。
清空是这个时代最贵的手势。它不产生点击,不产生 Token,只产生一次「算了」。
100 毫秒里,用户在等四件事
不是「加载中」这三个字,是四段各自独立的往返:
- 解析:递归解析器要是绕到一台远处的权威服务器,第一跳就先赔进去几十毫秒。
- 握手:TLS 每多一次往返,距离越远,代价越贵。
- 取物:一张图、一段 JS,如果每次都回源站,等于让用户替你横渡一次太平洋。
- 开口:大模型的响应,卡的往往不是生成,是第一个 token 到达之前的那段安静。
任何一段慢下来,前面所有努力一起清零。用户不会读你的架构图,他只知道:慢,算了。
我后来不再跟太平洋谈判
域名接到 IXCDN,四段往返各自找到近路:
- 就近解析:Anycast + DNS 智能解析,按访客的网络线路或物理地域,把他就近解析到最合适的边缘入口——境内运营商、境外大区各自返回不同的解析结果,未命中的回落默认线路,而不是让所有人绕到同一台远端权威服务器。
- 握手更短:HTTP/3(QUIC)、TLS 1.3 与 0-RTT 让连接建立少绕几圈;弱网和切换网络时,QUIC 不会被一个丢包卡住整条连接。
- 取物就地:静态的留在边缘缓存,命中就不再回源;动态的走分区回源——每个区域就近取源、按区收敛连接,配合 Origin Shield 挡住重复回源,不必每次横渡太平洋。
- 开口更快:模型从就近的 AI 网关入口进,OpenAI 兼容,业务代码零改造,第一个 token 更早开口。
这些不是四套要分别维护的工具,是同一条接入路径上的四件事。
DNS 智能解析:同一条主机记录,按线路给不同解析结果

一条 A 记录不该对所有访客给同一个解析结果。IXCDN 的智能解析按线路区分:境内运营商、境外大区各走各的就近入口,命中多条时按优先级裁决,未命中任何线路的访客回落到默认线路。同一条主机记录、按访客所在线路返回不同的就近解析结果——第一跳就省下那几十毫秒,而不是让所有人先绕到同一台远端权威服务器。
分区回源:让回源也就近
缓存没命中时,回源这一跳同样重要。分区回源让每个区域就近取源、按区复用连接,重复请求被 Origin Shield 在边缘收敛,源站只被打扰一次。你的源站在哪不重要,重要的是用户这一侧永远走的是近路。
账单应该是一句诚实话
很多加速的账单,是一口价里揉了你看不见的东西。
IXCDN 把它拆开写:送到用户手里的 CDN 流量、大模型的 Token、以及计算资源,各记各的表,不揉成一个「综合费率」。免费档一直在,够个人网站、测试和轻量生产用;生产用量按实际发生计费。
你为什么付这笔钱,账单自己会说清楚。
不是更快那么简单,是终于看得见
加速容易被讲成一句口号。但真正改变决策的,是可见性。
全链路日志加实时分析,让你看见用户究竟死在哪一跳:是解析绕到了远端权威,是没命中缓存回了源,还是第一个 token 等太久。看见了,才谈得上优化;看不见,就只能继续猜,继续赔那 100 毫秒。
三分钟,从看见开始
不用先签合同,也不用先充值。把域名接进来,静态的留下,动态的复用,模型的从就近入口进,账单分表写清楚。三分钟能开始,免费档一直在。
不是更快那么简单。是你终于看见:用户走了,究竟死在哪一跳。
—— ixcdn.com