独立,不依附平台
自带前台、鉴权、计费、Key、状态页。ai.barbiz.cn 只是可选调用方,不是生存前提。
不是某个云平台里的模块。是一张可独立运行的推理 OS。
自带前台、鉴权、计费、Key、状态页。ai.barbiz.cn 只是可选调用方,不是生存前提。
Bearer sk- 调 /v1/chat/completions。换芯片、换模型,调用方代码不用重写。
先把国产 910B / 910C 跑通。门禁 60 tok/s,工程目标 190 tok/s。公开日志可核验。
NPU 路径是适配层,不是绑死一家。NVIDIA 与另外三家主流芯按同一网关接入。
手机验证码 + 个人/企业实名,后台审核。禁止演示模式自动抬高等级。未 L2 不能充值、公共测试、付费推理。
按 Token 扣余额。Key、流水、提现在个人中心。定价公开,账单在本站。
一张图看完。现在只承诺昇腾路径;四芯是后续布局,接口不变。
当前唯一承诺的生产路径。mock 现可用,NPU 接入后走同一接口。公开测试与完整记录在 日志页。
H100 / H200 / B200
全球推理装机量第一。昇腾达标后优先插拔,承接高并发与生态工具链。
MI300X / MI350
大显存、开放 ROCm。适合长上下文与多模型同机,作为 NVIDIA 之外的第二供应。
v5e / v6e
云端训练与推理一体。适合大规模批推理与自有调度,不绑死单一 GPU 云。
Gaudi 2 / Gaudi 3
性价比与以太网扩展。适合成本敏感的吞吐型任务,补齐四芯供应面。
说明:四芯尚未作为本站生产承诺。上线后仍走 /v1/chat/completions,调用方不用改协议。
豆包、通义、DeepSeek、Kimi、智谱、混元、小米 MiMo、MiniMax、文心、盘古等。已挂 API 标「已通」;其余对接中。重复厂商不重复入库。
全球 Token 用量第一。开发者默认推理模型,昇腾上的主力。
开源衍生与云/企业覆盖最广。当前已挂 qwen2.5-7b,旗舰 Qwen3 对接中。
国内 C 端使用率第一。消费、内容、客服行业覆盖面最大。
国内企业 API 第一梯队。私有化与金融、政务、制造落地最多。
社交、办公、游戏行业覆盖。全球用量亦在前列。
长文与知识工作高频使用。文档、法律、研究场景覆盖。
多模态与 API 第二梯队。生成、角色、客服行业常用。
搜索与政企行业覆盖。百度生态内的默认选择。
海外开源装机标准。跨国业务与科研行业覆盖。
昇腾原生。政务、央企、华为云路径覆盖,与本站芯片路线一致。
小米 MiMo 系列。端云协同与消费电子场景覆盖。
口径:交叉 2026-08 全球 Token 用量与国内用户/企业覆盖。GPT / Claude 为封闭美模,不列入本站可挂载前 10。
现在 mock / Qwen2.5-7B 可调。昇腾 NPU 与后续四芯接入后,仍是 Bearer Key + Chat Completions。按 Token 计费,¥0.02 / 千 Token。
Authorization: Bearer sk-…POST /v1/chat/completions手机进站 → 个人中心完成 L2 → 用 Key 调 API。公开日志任何人可看;生产必须实名。