智能体原生一体机

端侧小模型日常执行,云侧大模型加密编排,混合路由降低 Token 成本,数据始终留存本地。

0
跑万亿参数模型
0
并发推理路数
0
首 Token 延迟
0
组超节点集群
产品线

Pro & Air

不是"装了 AI 的电脑"——从第一天起,为智能体任务执行而构建的原生一体机。

桌面一体机 · Mac Studio 形态
Pro
"一台放在桌上的算力基站,30B 模型满血运行。"
¥8,999 起
16GB+ VRAM 等效 B50 级 512GB NVMe AirymaxOS + Windows
  • AirymaxOS 内核级智能体操作系统 + AirymaxRT 运行底座,开机即跑智能体
  • 端云混合架构:端侧小模型执行,云侧大模型加密编排
  • vLLM PagedAttention 零碎片显存管理,128+ 并发在线服务
  • llama.cpp GGUF 全格式,24GB 跑万亿参数
  • 2 台 Pro 近场通信组超节点,共享算力线性扩展
  • 信创版 openEuler 24.04 兼容,面向政企安全场景
笔记本 · MacBook Air 形态
Air
"本质是一台个人电脑,但天生就能跑智能体。"
¥4,999 起
RTX 3050 级 2-bit GGUF 256GB SSD Windows + AirymaxOS
  • AirymaxOS 内核级智能体操作系统 + AirymaxRT 运行底座,开机即跑智能体
  • 端云混合架构:端侧小模型执行,云侧大模型加密编排
  • llama.cpp 纯 CPU 推理 7B 模型,无需独显即可运行
  • 2-bit 量化,8GB 显存跑 13B 参数模型
  • 超节点协作:小模型本地跑、大模型分发到 Pro 集群
  • 日常办公 + 智能体任务,一机两用
核心技术栈

四大引擎

OS 层面整合内核、推理引擎与智能体运行时——不是用户态套壳,不是开源组件的简单拼装。

AirymaxOS内核级智能体操作系统
不是用户态的"假 AgentOS"——真正的内核级工程。基于 Linux 6.6 LTS 深度定制,从调度器、内存管理到 GPU 驱动层全面适配智能体工作负载。自定义 BSP 固件烧录,裸金属算力直达应用层,零虚拟化损耗。
Linux 6.6 LTS 自定义 BSP 裸金属调度 机制/策略分离 openEuler 兼容
AirymaxRT智能体运行底座
OS 级智能体运行框架,与 AirymaxOS 内核深度耦合。自动管理 GPU 显存分配、请求排队、模型热加载与端云混合路由。端侧小模型执行,云侧大模型加密编排,降低 Token 成本,数据留存本地。零配置启动,支持 vLLM 与 llama.cpp 双引擎无缝切换。
OS 级框架 内核耦合 零配置启动 端云混合路由 开放 SDK
vLLM高吞吐推理引擎
PagedAttention 分页式 KV Cache 管理,消除显存碎片。Continuous Batching 连续批处理,相同硬件数倍吞吐提升。FP16/INT8/INT4 多精度支持,单实例 128+ 并发请求。兼容 OpenAI API 协议,Pro 满载等效 B50 级算力持续输出。
PagedAttention Continuous Batching 128+ 并发 FP16/INT8/INT4 OpenAI API
llama.cpp纯 C++ 混合推理
纯 C/C++ 零依赖推理引擎。CPU/GPU 混合模式覆盖 CUDA、Vulkan、Apple Silicon。GGUF 量化格式 2-bit 到 FP16 全谱系。24GB 显存即可运行万亿参数大模型,极限量化突破硬件天花板。Air 笔记本纯 CPU 推理 7B 模型,无需独显。
纯 C/C++ GGUF 全格式 2-bit 极限量化 24GB 跑万亿参数 CPU/GPU 混合
全栈架构

固件到算法

自定义 BSP、LTS 内核、推理框架与智能体运行时——软硬件一体,CI/CD 驱动。

硬件层
裸金属架构
CPU 双通道
GPU 16GB+ VRAM
SSD NVMe 512GB+
NPU 张量处理器
BSP 固件
自定义 BSP
固件烧录验证
驱动GPU/WiFi/BT
Airymax社区驱动
AirymaxOS
内核级智能体 OS
Linux 6.6 LTS
openEuler 24.04
UKUIQt6 桌面
AirymaxRT
智能体运行底座
vLLM高吞吐
llama.cpp轻量
7~30B预装模型
用户/应用发起任务
→
AirymaxOS 内核调度
→
AirymaxRT 策略路由
→
vLLM / llama.cpp 推理
→
GPU/CPU 裸金属执行
→
结果返回
核心特性

为 AI 而生

每一层软硬件围绕智能体任务执行设计,不是在通用电脑上叠加 AI 软件。

内核级 AgentOS

不是用户态套壳。AirymaxOS 从 Linux 内核调度器、内存管理到 GPU 驱动全面定制,智能体工作负载直达裸金属,零虚拟化损耗。

机制-策略分离

OS 级框架封装调度、显存管理、请求排队等底层机制。开发者只写策略算法,开机即进入智能体开发状态。

超节点集群

2 台 Pro 近场通信组超节点,共享算力。Pro/Air 混合编组,7B 本地跑、30B 分发集群并行,算力线性扩展。

双推理引擎

vLLM 高并发在线服务 128+ 路;llama.cpp 轻量本地 2-bit 量化。24GB 显存跑万亿参数,8GB 显存跑 13B。

信创合规

openEuler 24.04 兼容,国产软硬件生态适配。Linux 6.6 LTS 长期支持内核,政企安全可控。

端云混合架构

端侧小模型日常执行任务,云侧大模型加密推理编排。混合路由降低 Token 成本,数据始终留存本地,架构层面消除泄露风险。

双系统切换

Pro 以 AirymaxOS 为主面向开发者,Air 以 Windows 为主面向消费者。均支持双系统,开发办公兼顾。

预装模型

出厂预装 7B~30B 主流开源模型,涵盖对话、代码、推理。无需下载配置,开机即执行。

UKUI 轻量桌面

Qt6 三层架构,资源占用远低于 GNOME/KDE。为推理保留更多系统资源,类 Windows 交互降低迁移门槛。

应用场景

一个智能体节点

个人开发者到政企部门,本地原型到集群部署。

个人开发者

本地 7B-13B 模型原型开发,零云 API 费用,代码数据不出本机。

企业私有部署

敏感数据私有 LLM 服务。Pro 集群 30B 模型,128+ 并发服务团队。

政企信创

openEuler + 国产生态,安全可控。数据不出内网,推理不上云端。

教育科研

开箱即用 LLM 实验平台。预装多规格模型,专注算法不搭环境。

产品对比

Pro vs Air

按需选择,超节点混合编组协同。

规格ProAir
形态桌面 Mac Studio 级轻薄 MacBook Air 级
起售价¥8,999¥4,999
GPU等效 B50,16GB+ VRAMRTX 3050 级 / 集显
推荐模型13B-30B 全精度7B-13B 量化
推理引擎vLLM + llama.cppvLLM + llama.cpp
操作系统AirymaxOS (Linux)Windows
双系统+ Windows+ AirymaxOS
桌面UKUI Qt6UKUI Qt6
信创版openEuler 24.04—
超节点2 台组集群与 Pro 协作
目标用户开发者 / 企业 / 政企消费者 / 个人开发者

有 Token,不停机

端云混合,本地算力,本地执行

端侧小模型日常执行任务,云侧大模型加密推理编排,混合路由降低 Token 成本。
数据始终留存本地,不离开设备物理边界。两台 Pro 近场互联,组建私有推理集群。