Anyscale API 2026 测评:Ray 与 Endpoints 及 16.5 亿美元 Nscale 收购

AnyscaleRay 背后的公司——Ray 是一款开源分布式计算引擎,可将 Python AI 负载从笔记本扩展到多节点 GPU 集群——同时提供 Anyscale Endpoints,一个面向开源权重模型的无服务器 OpenAI 兼容推理 API。2026 年 7 月 30 日,英伟达支持的英国 neocloud 厂商 Nscale 同意在其计划 IPO 之前以约 16.5 亿美元收购 Anyscale,将 Ray 与 Endpoints 并入 Nscale 的全栈 AI 云。本测评覆盖 API、模型、2026 年 8 月定价、收购的实际影响、区域可用性、竞品与限制。

🌍 快速结论:当你已经身处 Ray 生态,或需要一把 API 同时从无服务器推理扩展到分布式训练时,Anyscale 是最佳选择。Llama 3.3 70B 每百万 token 仅 $0.39,颇具竞争力。Nscale 交易提供了通往托管 Slurm、Kubernetes 与 Inference Endpoints 的更深入路径——但中国访问仍需代理。

🧠 模型列表

模型类型输入/输出 (每百万)最佳用途
Llama 3.3 70B开源权重对话$0.39 / $0.39通用对话、智能体、RAG,性价比高
Llama 3.1 405B开源权重旗舰联系销售 / 更高最大开源模型,复杂推理
DeepSeek-R1推理$1.00 / $1.00数学、代码、多步骤规划
Mixtral 8x22BMoE 对话$0.90 / $0.90中档成本通用 MoE
CodeLlama 70B代码微调联系销售代码补全与生成
Qwen 2.5 72B开源权重对话联系销售多语言,强推理性价比

💰 定价(2026-08-08 核实)

Anyscale 采用 按量计费的用量计费模式,托管档无月度最低要求;另有承诺合同可解锁批量折扣。推理按每百万 token 计费,Ray 计算按加速器小时计费。

模型 / 资源价格计费方式备注
Llama 3.3 70B$0.39 / M按 token颇具竞争力的开源权重推理
DeepSeek-R1$1.00 / M按 token高性价比推理模型
Mixtral 8x22B$0.90 / M按 token通用对话 MoE
纯 CPU 实例$0.0135 / 小时按加速器最便宜的 Ray 计算档位
NVIDIA T4$0.5682 / 小时按加速器入门 GPU,小型推理
NVIDIA A10G$1.3635 / 小时按加速器中档平衡
NVIDIA A100$4.9591 / 小时按加速器大内存,更大模型
新用户额度$100 免费一次性注册时发放

🔌 OpenAI 兼容 Endpoints

from openai import OpenAI

client = OpenAI(
    base_url="https://api.endpoints.anyscale.com/v1",
    api_key="YOUR_ANYSCALE_API_KEY"
)
response = client.chat.completions.create(
    model="meta-llama/Llama-3.3-70B-Instruct",
    messages=[{"role": "user", "content": "用一句话解释 Ray。"}]
)
print(response.choices[0].message.content)

由于接口是 OpenAI 兼容的,任何支持 OpenAI SDK 的框架(LangChain、LlamaIndex、AutoGen、CrewAI、Vercel AI SDK)都可通过更换 base_url 直接接入。同一个 Anyscale 账户还能通过 Python SDK 运行完整的 Ray 任务——你先在同一个平台上扩展一个端点,再扩展到分布式训练或批量推理任务,无需更换技术栈。

🧠 Nscale 收购下的 Ray

Anyscale 的标志性资产是 Ray,这个事实上的 AI 分布式计算引擎已部署到几乎所有主流云平台。2026 年 7 月 30 日,英伟达支持的英国 neocloud 厂商 Nscale 同意以约 16.5 亿美元收购 Anyscale(经 Bloomberg、SiliconANGLE、Reuters 与 TechCrunch 证实),将 Endpoints 与 Ray 平台并入 Nscale 覆盖挪威、英国、德州与葡萄牙数据中心的全栈 AI 云。这紧随 Anyscale 2026 年 6 月 2 日在微软 Azure 上的原生集成——面向构建主权 AI 并希望控制可变 API 成本的企业。

官方目标是多云中立:Ray 负载可同时运行在 Nscale 自有的 NVIDIA 基础设施以及 AWS、GCP、Azure 上,为团队提供一个跨厂商统一的 Ray 控制平面。对开发者而言,近期实际影响是连续性——Anyscale 的 API、SDK 与定价保持不变——外加一条更深的路径:当 Ray 任务超出托管档位时,可进入 Nscale 的托管 Slurm、Kubernetes Service 与 Inference Endpoints。

🆚 对比 Together AI / Fireworks / Anyscale

厂商Llama 3.3 70B 输入/输出分布式计算OpenAI 兼容国内直连
Anyscale$0.39 / $0.39✅ Ray(训练+服务)❌ 代理
Together AI约 $0.35 / $0.35❌ 仅推理❌ 代理
Fireworks AI约 $0.30 / $0.30❌ 仅推理❌ 代理
DeepSeek(国内)¥0.14 / ¥0.28✅ 免代理

在纯 token 价格上,Together AI 与 Fireworks 和 Anyscale 处于同一开源权重价格带——三者对 Llama 3.3 70B 都约在 $0.30-$0.39/M。Anyscale 的差异化在于 Ray 平台:没有其他开源权重托管商能让你在同一个账户、同一套 Python API 下,从无服务器聊天端点直接扩展到多节点分布式训练任务。DeepSeek 仍是明确的价格领导者,并提供大陆直连,但仅限文本、没有一手的分布式计算产品。如果只需要便宜的托管推理,Together 或 Fireworks 更简单;如果需要推理外加可扩展的 Ray 计算,Anyscale 是差异化之选。

⚠️ 需要了解的限制

  • 无中国大陆端点——生产访问需要代理或聚合器。
  • 模型目录以开源权重为主,无自研前沿闭源模型(对比 GPT-5、Claude、Gemini)。
  • UI/UX 与文档偏技术向;Ray 的学习曲线对非分布式用户真实存在。
  • 按加速器的计算价格(尤其 A100 每小时 $4.96)在无承诺合同时的长任务下会快速累积。
  • 收购整合仍在进行——Nscale 统一 Endpoints 与其 Inference Endpoints 的路线图尚未完整公开。
  • 除承诺合同外无公开批量折扣;企业 SLA 条款需合同确认。

🎯 结论

当你已经身处 Ray 生态、需要一个覆盖无服务器推理分布式训练/批量推理的账户,或看重 Nscale 交易带来的多云中立时,选择 Anyscale。如果只是需要便宜的托管开源权重推理,Together AI 与 Fireworks 更简单更快。如果需要大陆直连,DeepSeek、阿里百炼(Qwen)与腾讯混元依然是务实之选。当你的路线图包含 Ray 计算、并希望一把 API 随其成长时,Anyscale 是最强之选。

FAQ

Anyscale 是 OpenAI 兼容的吗?
是的。将 OpenAI 客户端 base_url 指向 https://api.endpoints.anyscale.com/v1 即可。

Anyscale API 多少钱?
Llama 3.3 70B 每百万 $0.39 起;DeepSeek-R1 $1.00/M;计算从 CPU 每小 $0.0135 到 A100 每小 $4.96。

有免费额度吗?
无永久免费档,但注册可得 $100 一次性额度,另有少量项目启动额度。

Anyscale 被收购了吗?
是的——英伟达支持的 Nscale 于 2026 年 7 月 30 日同意以 16.5 亿美元收购 Anyscale。

中国能用吗?
不能直连——需要代理或聚合器;无大陆区域端点。

Ray 用来做什么?
把 Python AI 负载(分布式训练、批量推理、在线服务)从笔记本扩展到多节点 GPU 集群。