开发者中心 · Developer Hub

从首行请求到生产级高并发流量,为您准备好一切

聚合快速上手、公共文档、模型全景、交互式多框架工作台、透明计费与 Agent 机密可信凭证,打造极致极客开发体验。

交互式多框架代码工作台100% OpenAI Drop-in

只需更换 base_url 即可无缝迁移,支持 VaaS 链上存证与 Agent 预算防死循环

Base URL: https://api.batchin.ai/v1
# 1. Install official OpenAI SDK: pip install openai
from openai import OpenAI

# 2. Point base_url to BatchIn Inference Cloud
client = OpenAI(
    api_key="sk-batchin-live-test-key",
    base_url="https://api.batchin.ai/v1",
    default_headers={
        "X-VaaS-Anchor": "true",  # Base L2 Merkle proof commitment
        "X-Agent-Run-Id": "run_live_demo_01",  # Multi-step session tracking
        "X-Agent-Max-Budget": "1.50",  # Hard spend ceiling ($1.50 cap)
    }
)

# 3. Dispatch inference with instant 100% compatibility
response = client.chat.completions.create(
    model="deepseek-ai/DeepSeek-V4-Pro",
    messages=[
        {"role": "system", "content": "You are a senior Silicon Valley AI infrastructure architect."},
        {"role": "user", "content": "Explain why VaaS cryptographic receipts prevent enterprise AI vendor repudiation."}
    ],
    temperature=0.2,
    stream=True,
)

for chunk in response:
    content = chunk.choices[0].delta.content
    if content:
        print(content, end="", flush=True)

零代码重写一键迁移

兼容 100% OpenAI 参数与 SDK,修改 base_url 即可即刻连通 23 款国产旗舰模型。

VaaS 链上密码学存证

每次请求携带 Ed25519 硬件签名与 Base L2 Merkle Root 存证,杜绝供应商虚标与篡改。

Agent 智能体防穿透信封

网关级识别 Agent Run-Id 与硬预算拦截,429 速率限制时自动平滑语义降级。

全球接入,统一网关入口

提供高吞吐大模型推理、密码学算力可信存据与全球高可用 SLA 保障。

BatchIn 协同低时延 API 网关、零数据驻留安全防线与高密度算力集群,为企业级落地提供统一的工程标准。

ViewDocs

亚太与本土接入

BatchIn 生产级网关全面服务亚太开发者与企业级 AI 业务。

提供超低首字时延、境内主流旗舰模型聚合、本地化账单与企业专属支持通道。

https://batchin.tech · https://api.batchin.tech/v1

全球弹性节点

100% 兼容 OpenAI 标准 SDK,无缝赋能自主 Agent 智能体集群。

无需重写现有代码,仅需替换 Base URL 即可获得 99.95% SLA 保证与 VaaS 密码学可信算力凭证。

https://batchin.tech · https://api.batchin.tech/v1

生产级基准

专为高可靠的大规模工业级流量场景打造。

全模态混合负载

全面支撑长文本推理、多模态视觉、音视频生成与批处理复杂工况。

流式链路

区域接入、稳定流式传输与请求连续性保障。

运行护栏

作用域限流、请求隔离与背压控制机制。

公开运维规范与就绪状态

OpenAI 兼容端点在对话、响应、嵌入、图像、音频与视频等负载下保持长期稳定。
公开 MCP 协议传输与工具发现均基于 BatchIn 规范,隐藏内部实现细节以保护稳定性。
流量策略专为持续生产级文本与多模态负载设计,绝非仅供 Demo 演示。
功能可用状态与真实的用量、成本、账单、链路追踪及验真记录完全对齐。

共享调度内核

开发者自助流量与常规企业业务统一运行在 BatchIn 弹性调度内核上。

保证公共 Model API、批处理通道、用量计量、账单结算与 MCP 规范高度一致。

专属保障通道

针对保留算力、专属端点与大型企业流量,提供严格隔离的高通量保障通道。

保持统一的产品交互与账单视图,按合同级别定制交付时延、配额与隔离深度。

真实容量核验

独享算力池与保留吞吐量均对齐至同一底层服务真实存证与集群接入规范。

所有公开展示的算力与实时状态均源自真实已校验的服务注册表。

边缘接入

全球流量经由高弹性区域边缘接入,确保高可用访问与稳定的会话连续性。

延迟优化始于面向客户的边缘网络,在请求进入核心执行链路前即完成鉴权与路由分发。

流式交付

BatchIn 在跨地域与混合多模态负载下保持稳定一致的流式传输表现。

深度调优连接复用与消费端隔离策略,显著降低抖动与长尾失败率。

流量策略

通过明确的作用域防护、重试纪律与优雅过载削峰保障流量平稳。

客户使用简洁统一的 API 与明晰额度,BatchIn 在幕后完成全套流量安全与保护调度。

核心集成接口

聊天补全接口 (Chat Completions)

无缝替换标准 OpenAI 聊天路径,支持流式传输、自动重试与生产级请求遥测。

POST /v1/chat/completions
查看文档

结构化响应接口 (Responses API)

专为智能体工具调用与结构化提取设计的现代接口,无需割裂计费与全链路追踪。

POST /v1/responses
查看文档

向量嵌入接口 (Embeddings & Vectors)

支持主流向量与语义相似度模型,共享统一路由策略、用量分析与账单审计。

POST /v1/embeddings
查看文档

多模态与生图视频 (Media & Multimodal)

图像、语音、转录与电影级视频生成接口,每次生成附带 VaaS 密码学防篡改凭证与失败退赔保证。

POST /v1/images | /v1/audio | /v1/video
查看文档

Agent 协议与 MCP 服务 (Agent & MCP)

一键挂载各类 MCP 客户端、Cursor 与 Windsurf,暴露标准化 llms.txt 与机密审计契约。

GET /.well-known/agent.json
查看文档

开发者资源中心

完整 API 参考文档

详尽的 OpenAPI 3.1 规范、请求体参数说明与 RFC 7807 错误码定义。

查阅文档

模型全景与基准评测

探索 23 款国产旗舰模型,涵盖 1M 上下文窗口、实时价格与 HumanEval / SWE-bench 评测指标。

浏览模型

交互式在线演练场

免配置在线测试多模型流式补全、多路分屏对比、结构化输出与实时延迟分布。

进入演练场

透明计费与容量预订

清晰的按量计费、离线异步 Batch 50% 折扣,以及企业级专有吞吐集群预订。

查看定价

官方 SDK 与跨语言示例

提供 TypeScript、Python、Go 官方客户端,以及 LangChain、LlamaIndex、CrewAI 开箱即用范例。

探索 SDK

自治多智能体架构指南

构建具备死循环防护、硬预算控制、多级平滑降级与 VaaS 链上存证的坚固 Agent 工作流。

了解更多