Laya AI
  • Playground
  • 模型
  • Laya vs Jev
  • 项目
  • 基准测试
  • 提交

在不同环境运行 Laya

Laya Runtimes 与本地部署

根据技术栈、硬件、内存和 serving 方式选择合适的 Laya runtime,并区分上游实现与社区实现。

上游

Laya Python / PyTorch

上游参考实现和 Router。适合作为 canonical API、checkpoint、微调和跨平台推理的起点。

参考实现Python 服务CUDA / CPU
查看 Runtime
社区 Runtime

Laya MLX(Apple Silicon)

面向 M 系列 Mac 的社区原生 MLX runtime,本地运行 typed decisions,不依赖 PyTorch。

Apple Silicon本地推理低延迟
查看 Runtime
社区 Runtime

Laya Node.js / TypeScript + ONNX

通过 ONNX Runtime 在 Node.js / TypeScript 中运行 Laya,并保持 typed-decision 请求/响应形态。

Node.js 后端TypeScriptONNX Runtime
查看 Runtime
社区 Runtime

Laya MPS(macOS)

面向 Apple GPU / MPS 的本地 runtime 与 HTTP server,提供多种内存模式与 benchmark 工具。

macOSApple GPU / MPSHTTP Serving
查看 Runtime
Serving Layer

Arbiter 本地 Serving

使用 Jev-compatible HTTP API 服务 Laya,提供 checkpoint 路由、batch、metrics、Playground 与 NVIDIA / Apple Silicon recipe。

本地 APIJev-compatible 客户端NVIDIA GPU
查看 Runtime
Laya AI

独立的 Laya AI 开发者资源站,持续整理模型、运行时、基准测试、项目与实践指南。

探索
  • Playground
  • 什么是 Laya
  • System One Models
  • 模型
  • 项目
  • 基准测试
学习
  • Recipes
  • 安装 Laya
  • Laya Python 指南
  • Runtimes
  • Integrations
  • Laya vs Jev
来源
  • GitHub
  • Hugging Face
  • PyPI
网站
  • 关于
  • 联系
  • 隐私
  • 条款
© 2026 Laya AI. 版权所有

独立社区资源站,与 ConvAI Innovations 无隶属关系。Laya 名称及相关标识归各自权利人所有。