企业级多模态模型聚合中继网关

统一、高效、私有化的 AI 算力服务中枢

基于天钡双机高可用硬件集群打造。为企业及开发者提供原生兼容 OpenAI 接口标准的语言模型对话与全画幅图像生成服务。

统一接口基础地址 (API Base URL) https://nex395-api-platform.pages.dev/v1
服务可用性
99.9%
高可用冗余架构支持
有效授权凭据
--
支持独立分配额度
专网互联带宽
9.06 Gbps
点对点延迟 0.29 ms
在线多模态模型
2 类模型
Qwen 27B + Qwen-Image
tb02 主控调度节点
Radeon 8060S · 统一内存 48 GB
主控网关 + 语言模型
常驻服务 Qwen3.8-27B (Q5_K_M)
网络调度角色 多模态智能分流网关
显存利用状态 20.96 / 48 GB (43.6%)
tb01 混合算力从机
Radeon 8060S · 统一内存 48 GB
图文双模无冲突并存
多模态引擎 27B LLM (21G) + Qwen-Image (14.2G)
生图加速架构 Vulkan 原生硬件加速
并存显存水线 35.23 / 48 GB (余量 12.8G 防OOM)
Thunderbolt 4 高速网桥低延迟专线直连
实测 9.06 Gbps · 延迟 0.29 ms

访问密钥管理 (API Credentials)

密钥同时适用于大语言模型对话与视觉图像生成,支持在线分配配额。

正在拉取授权密钥...

视觉生成创作室

Qwen-Image-2.1 · 原生 Vulkan 硬件渲染

纯净构图标签:
Radeon 8060S GPU 全程加速
分辨率微调: × px
💡 无限时长与画质保障:已升级工业级异步任务调度轮询引擎彻底消除 Cloudflare 100秒限制!模型原生训练基底为 1024P,系统已内置等比安全自适应,确保 100% 满血调用 Radeon 8060S GPU 硬件加速。
等待渲染
在左侧输入 Prompt 即可调用集群 GPU 出图
生成的图像

开发与客户端接入指南

完全遵循 OpenAI 标准规范,支持无缝接入所有第三方大模型客户端。

NextChat / ChatGPT-Next-Web
1. 模型服务商选择: OpenAI
2. 接口地址 (URL): https://nex395-api-platform.pages.dev/v1
3. API 密钥: 填入在「访问凭据」中生成的 sk-...
4. 自定义模型名称: qwen3.8-27b
Cherry Studio / Chatbox
1. 服务商类型: OpenAI 兼容 (Custom OpenAI)
2. API Base URL: https://nex395-api-platform.pages.dev/v1
3. 模型添加:
  • 对话模型: qwen3.8-27b
  • 视觉生图: qwen-image-2.1
异步生图 API (彻底告别 100s 超时)
1. 任务分发: POST /v1/images/generations (参数加入 "async": true)
2. 立即返回: {"id": "job_...", "poll_url": "..."} (响应 < 0.1s)
3. 轮询取图: GET /v1/images/jobs/{id}
4. 状态流转: queuedgeneratingcompleted (含 b64_json)
已复制