Ollama AI系列(2):VPS上的AI推理与API应用

想省钱又怕镜像不兼容?对比 ARM(Ampere/CAX)与 x86(Contabo/Vultr)同价性能、Docker/常见服务 arm64 支持现状、哪些负载 ARM 真省。诚实指出本站白名单内 ARM 机型近乎空白。

延伸阅读

更多相关攻略推荐:Ollama AI系列(2):VPS上的AI推理与API应用Ollama AI系列(2):VPS上的AI推理与API应用ARM / Ampere 席卷 VPS:性价比真香还是兼容陷阱?做欧洲生意要合规:GDPR 友好型欧盟 VPS 节点与数据落地指南(GDPR 与中国出海企业:选对海外 VPS 机房就是合规第一步(20

一、为什么 2026 年大家开始聊 ARM VPS

这两年「ARM 服务器」从云厂商的内部话题变成了普通站长也会琢磨的事。原因很朴素:同配置 ARM 往往更便宜,而且更省电。AWS 的 Graviton、Oracle 的 Ampere、Hetzner 的 CAX 线,把「用 ARM 省钱」从概念变成了能下单的选项。于是很多想降本的站长、开发者就开始问:我那台 x86 小鸡,换成 ARM 是不是直接少花两三成?

但另一半人卡在一个更现实的担心:兼容性。Docker 镜像能跑吗?我那堆闭源二进制、老插件、游戏服务端,ARM 上会不会直接起不来?这篇就专门给大陆用户把这事说清楚:ARM 到底省不省、坑在哪、谁适合上、谁千万别碰。顺带先泼一盆冷水——你常听到的那几个「便宜商家」里,ARM 其实少得可怜。

二、先厘清:本站白名单里 ARM 几乎空白,CAX 不是 Contabo

很多文章把「Contabo CAX」连在一起说,这是个常见误传,必须拆开。事实是:

Contabo 是纯 x86 商家。多家 2026 测评(saastweaks、gwvpsceping、walixz 法国测评)都确认它的 VPS 用的是 AMD EPYC(部分旧档是 Intel Xeon),根本没有 ARM/Ampere 机型。它家便宜靠的是「高密度堆 x86 核 + 内存」,不是 ARM。

CAX 是 Hetzner 的 ARM 线命名(CAX11 / CAX21 / CAX31 / CAX41,基于 Ampere),它不在本站白名单内。网上那句「CAX11 ARM 3.79 刀/月」指的是 Hetzner,不是 Contabo。同样,Vultr 也是纯 x86,没有提供 ARM 实例。

结论很直接:在本站白名单(ContaboVultrRackNerdCloudCone 等)里,ARM 机型基本是空白。你想靠 ARM 省钱,目前得去白名单外的 Hetzner CAX、Oracle Ampere、AWS Graviton、Google Tau T2A、Azure Ampere Altra。所以本文用 Contabo / Vultr 的 x86 价格当「x86 基线」,用 Hetzner CAX / Oracle Ampere(明确标注白名单外)当「ARM 参考价」,帮你算清楚账。

三、ARM 到底是什么,和 x86 差在哪

简单来说,你手里的 VPS 绝大多数是 x86-64 架构(Intel/AMD),指令集复杂、单核频率高;ARM(这里指服务器级的 Ampere Altra、AWS Graviton 这类 ARM64 / aarch64)走精简指令集,核心多、功耗低。

一个反直觉但关键的点:ARM 云实例的 vCPU 通常等于物理核,没有超线程。而 x86 便宜 VPS 常靠超线程把一个物理核拆成两个 vCPU,再叠加超售。结果就是——ARM 的单核性能也许不如同代 x86 顶尖款,但每个核都是实打实的物理核,没有「邻居抢超线程」带来的尾延迟抖动。这对延迟敏感的服务反而是优势。

内存和磁盘方面,ARM 实例和 x86 没本质区别,都给 NVMe、都给足额内存。所以「ARM 差在哪」主要落在两处:单线程峰值略低(约落后 10–20%),以及软件生态里还有 x86 专属的死角。下面两节分别展开。

四、同价性能:ARM(Ampere/CAX)vs x86(Contabo/Vultr)怎么比

先说价格差。公开测评给的区间很一致:迁移到 ARM 通常省 20–40% 的计算成本(krapton),同规格 ARM 裸金属定价比 x86 低 20–30%(jusoucn)。落到具体档位:

维度x86 基线(白名单内)ARM 参考(白名单外)
Contabo VPS S4 vCPU(x86) / 8G / 约 $5–8 月—(Contabo 无 ARM)
Vultr 4G 档2 vCPU(x86) / 4G / 约 $12 月—(Vultr 无 ARM)
Hetzner CAX11(ARM)2 物理核 / 4G / 约 €3.79 月
Oracle Ampere(ARM)4 核 / 24G / 免费档可用
同内存月成本差x86 基线较高约低 20–40%

性能上,基准测试(tsight、jusoucn)显示 Ampere Altra 在 SPECrate 整数上和同代至强已经没有代差;多核吞吐、每瓦性能 ARM 占优。真实案例(johal)把 Go 服务迁到 Graviton4 后,p99 延迟反而降了 19%、月账单降了 34%——因为物理核消除了超线程争抢。所以「同价 ARM 更值」在兼容负载上大体成立,前提是你的软件能原生跑 arm64

五、Docker 与常见服务的 arm64 支持现状

好消息是,到 2026 年 arm64 的生态已经相当成熟,绝大多数自建场景用起来无感。

语言与运行时:Python、Java、Node.js、Go(设 GOARCH=arm64)、Rust、.NET Core 都有完善的 ARM 支持。Go 项目重编译一行就搞定,几乎没有门槛。

容器:Docker 和 Kubernetes 全面支持 arm64,官方镜像绝大多数已是 multi-arch(多架构)镜像,拉下来会自动匹配架构。自托管常用的 Nginx、PostgreSQL、Redis、MySQL、Elasticsearch、WordPress、Nextcloud、WireGuard,全都有 arm64 版本。

机器学习框架:TensorFlow、PyTorch、JAX、ONNX Runtime 都提供 arm64 构建(krapton),轻量推理在 ARM 上能跑且便宜。但注意:ARM CPU 跑大模型推理速度远不如 GPU,别指望它替代显卡。

一句话:如果你是「标准 Docker 全家桶」用户,2026 年上 ARM 基本不用改什么。真正的坑在下一节。

六、兼容性深坑:哪些会翻车

ARM 不是万能,下面几类最容易踩。

一是 x86 专属的闭源二进制。带 x86 内联汇编的老 C/C++ 程序、某些专有软件、个别游戏服务端(如部分 Minecraft 插件生态、Pterodactrix 老 egg),没有 arm64 版本就起不来,得等官方出 ARM 构建或自己交叉编译,工作量不小。

二是 qemu 模拟的陷阱。镜像没有 arm64 时,有人图省事用 qemu 模拟 x86 跑。但实测(johal)生产环境 qemu 有 30–40% 性能损耗,直接把 ARM 的优势吃光。结论:要么原生 arm64,要么别上 ARM,别靠模拟凑合。

三是重训练和 Windows。大模型训练还是 GPU + x86 的天下;ARM VPS 也没有广泛可用的 Windows(Windows on ARM 云端基本没有)。要做这些,ARM 不在考虑范围。

自查很简单:用 docker manifest inspect 镜像名 看它支持哪些架构;用 file $(which 你的二进制) 看是不是 aarch64。不是的话,先别急着迁。

七、真实用例:哪些负载 ARM 真省钱

把兼容和性能摆一起,下面这些负载 ARM 是真香:

负载类型ARM 表现说明
Web / API 微服务强烈推荐物理核尾延迟稳,多实例划算
反向代理 / 网关推荐Nginx、Caddy、Traefik 均有 arm64
缓存(Redis/Memcached)推荐内存型,架构无关
CI / 构建代理推荐(原生编译)Go/Node 重编译即跑,省钱明显
数据库(Postgres/MySQL)可用官方 arm64 镜像成熟,注意原生扩展
轻量 AI 推理可用成本 per-token 低,但慢于 GPU

反例也明确:极致单线程任务(某些科学计算、实时转码)ARM 单核落后 10–20%;GPU 训练x86 专有二进制Windows 别上 ARM。判断标准就一句:你的软件能不能原生跑 aarch64?能,就省;不能,就别勉强。

八、横向对比:x86 基线 vs ARM 参考单价

把「4G 档」和「大内存档」各摆一桌,看清差距。价格来自 2026 公开页面,ARM 侧为白名单外商家,仅作参考,以下单页为准。

档位x86 基线(Contabo/VultrARM 参考(Hetzner/Oracle,白名单外)
入门 4GContabo 约 $5–8 / Vultr 约 $12 月Hetzner CAX11 约 €3.79 月
大内存 24GContabo 约 $15–22 月Oracle Ampere 4核24G 免费档
每核成本x86 基线偏高(含超线程/超售)ARM 约低 20–40%
核的性质x86 多含超线程/超售ARM 多为物理核,无超线程

结论:同内存下 ARM 确实更便宜,且核更「实」。但代价是——你得离开本站白名单去 Hetzner/Oracle 这类商家,并且自己确认镜像架构。对只在白名单里挑机器的人,现实是:ContaboVultr 都给不了 ARM,省钱只能靠它们的高内存密度 x86(如 Contabo 8G/16G/24G)。ARM 是另一条路,不在白名单内。

九、自己动手验证:镜像架构检查与跑分

决定上 ARM 前,两步自查必做。

第一,查镜像架构。别凭感觉,用下面命令看你的镜像到底支不支持 arm64:

# 查看镜像支持哪些架构
docker manifest inspect nginx:latest

输出里若有 linux/arm64,就能原生跑;只有 linux/amd64,就得警惕。对自己编译的二进制,用 file 确认:

# 确认二进制架构
file $(which your-binary)

第二,实机跑分。开通后用 YABS 看 Geekbench 单核/多核,重点对比单核分和 x86 基线的差距;用 fio 看磁盘。ARM 单核略低是正常的,看的是「稳不稳、够不够你的负载」。

十、迁移到 ARM 的实操建议

如果你确认负载兼容,迁移其实没那么恐怖,照着做就行。

Go 项目:构建时加 GOARCH=arm64(CGO 关掉更稳),CI 里把镜像改成多架构。用 buildx 一条命令同时出 amd64 和 arm64:

# 构建多架构镜像
docker buildx build --platform linux/amd64,linux/arm64 -t myapp:latest --push .

Dockerfile:用 multi-arch 基础镜像(如 node:20-alpine、golang:1.22),别写死 amd64 镜像。上线前用灰度副本压测 24 小时,看真实 p99,别只看 benchmark。

数据库原生扩展:Postgres 的 pgvector 这类带 C 扩展的,要在 ARM 上重新编译,依赖老的可能缺 ARM 内联指令,提前测。整体原则:能原生就原生,别依赖 qemu 模拟

十一、风险提示与退款

买 ARM(或任何 VPS)有几点提醒。

白名单内无 ARM:本站推荐商家(Contabo/Vultr 等)都是 x86,想上 ARM 得去白名单外,意味着失去本站推荐的售后/支付便利性,下单前自己评估。

线路非优化:无论 x86 还是 ARM 参考商家(Hetzner/Oracle),对大陆都不是 CN2/GIA 优化线,晚高峰延迟和抖动明显。面向国内低延迟服务,ARM 救不了线路。

退款与计费Oracle 免费档有账号风控和开机率要求;Hetzner 按小时计费、删即停;Contabo 退款条件严格、部分有 setup fee。每家政策不同,下单前读一遍条款,别等踩坑才发现。

十二、结语

ARM VPS 在 2026 年确实「值」,但有个前提:你的软件能原生跑 arm64。能跑的话,Web/API/缓存/CI/数据库这类负载,ARM 用物理核换来了更稳的尾延迟和 20–40% 的成本下降,是真省钱。跑不动的情况也只有三类:x86 专有二进制、GPU 训练、Windows。

但必须说清现实:你在本站白名单里挑不到 ARM——Contabo 是 AMD EPYC 的 x86,Vultr 也是 x86,那个被误传的「CAX」其实是 Hetzner 的 ARM 线,不在白名单内。所以「ARM 省钱」是一条白名单外的路:值得了解,但得你自己去 Hetzner/Oracle 下单,并确认镜像架构。白名单内想省钱,靠的是 Contabo 那种高内存密度 x86。两条路,按需选。