Everything you want to know about ModelAPI — the multi-model AI orchestration platform.
ModelAPI is a multi-model AI orchestration platform (AI infrastructure SaaS). It lets you run 100+ AI models through one OpenAI-compatible endpoint, so you focus on building, not on wiring up providers.
ModelAPI 是一个多模型 AI 编排云平台(AI 基础设施 SaaS)。你通过一个兼容 OpenAI SDK 的端点就能调用 100+ 个 AI 模型,专注于业务开发,不用逐家对接接口。
ModelAPIはマルチモデルAIオーケストレーションプラットフォーム(AIインフラSaaS)です。OpenAI互換のエンドポイント1つで100以上のAIモデルを実行でき、プロバイダーの接続ではなく構築に集中できます。
ModelAPI는 멀티모델 AI 오케스트레이션 플랫폼(AI 인프라 SaaS)입니다. OpenAI 호환 엔드포인트 하나로 100개 이상의 AI 모델을 실행할 수 있어, 공급자 연결 대신 구축에 집중할 수 있습니다.
It means one platform handles model scheduling, routing, usage tracking, and billing for you. You call a single endpoint; the platform orchestrates the rest.
意思是:一个平台帮你统一处理模型调度、路由、用量追踪和计费。你只管调用一个端点,剩下的调度工作全交给平台。
1つのプラットフォームがモデルのスケジューリング、ルーティング、使用量追跡、請求を担当することを意味します。単一のエンドポイントを呼び出すだけで、残りはプラットフォームがオーケストレーションします。
하나의 플랫폼에서 모델 스케줄링, 라우팅, 사용량 추적, 청구를 처리한다는 뜻입니다. 단일 엔드포인트를 호출하면 나머지는 플랫폼이 오케스트레이션합니다.
ModelAPI is a software platform (SaaS). We provide orchestration, routing, and unified billing. We are not a middleman layer — we are the infrastructure that lets model providers work for you.
ModelAPI 是一个软件平台(SaaS),提供编排、路由与统一账单能力。我们不是中间商层——我们是让模型供应商直接为你工作的基础设施。
ModelAPIはソフトウェアプラットフォーム(SaaS)です。オーケストレーション、ルーティング、統一請求の機能を提供します。私たちは中間層ではありません——モデルプロバイダーがあなたのために働くインフラです。
ModelAPI는 소프트웨어 플랫폼(SaaS)입니다. 오케스트레이션, 라우팅, 통합 청구 기능을 제공합니다. 우리는 중간 계층이 아닙니다 — 모델 공급자가 당신을 위해 일하는 인프라입니다.
Create an account, get an API key, point your OpenAI SDK at our endpoint, and start calling models. Most teams are live in minutes.
注册账号 → 获取 API Key → 把 OpenAI SDK 的 base_url 指向我们的端点 → 开始调用模型。大多数团队几分钟内就能跑起来。
アカウントを作成し、APIキーを取得し、OpenAI SDKのエンドポイントをこちらに向け、モデルの呼び出しを開始します。ほとんどのチームは数分で稼働します。
계정을 만들고, API 키를 받은 후 OpenAI SDK 엔드포인트를 우리 쪽으로 지정하고 모델 호출을 시작하세요. 대부분의 팀은 몇 분 내에 실행됩니다.
Because we are OpenAI SDK-compatible, you only change the base_url and api_key. That is roughly two lines of code to migrate existing code.
因为我们兼容 OpenAI SDK,你只需要改 base_url 和 api_key 这两行代码就能迁移现有程序。
OpenAI SDK互換のため、base_urlとapi_keyを変更するだけです。既存コードの移行は約2行で済みます。
OpenAI SDK와 호환되므로 base_url과 api_key만 변경하면 됩니다. 기존 코드 마이그레이션은 약 두 줄입니다.
ModelAPI orchestrates 100+ models across 60+ vendors through a single endpoint, covering major and specialized AI models.
ModelAPI 通过一个端点编排 60+ 家厂商的 100+ 个模型,涵盖主流和各领域专用 AI 模型。
ModelAPIは単一のエンドポイントで60以上のベンダーの100以上のモデルをオーケストレーションし、主要および専門AIモデルをカバーしています。
ModelAPI는 단일 엔드포인트를 통해 60개 이상 벤더의 100개 이상 모델을 오케스트레이션하며, 주요 및 전문 AI 모델을 포함합니다.
Yes. ModelAPI is OpenAI SDK-compatible, so your existing code and tooling work with minimal changes.
兼容。你的现有代码和工具只需极小改动就能在 ModelAPI 上运行。
はい。ModelAPIはOpenAI SDK互換なので、既存のコードやツールは最小限の変更で動作します。
네. ModelAPI는 OpenAI SDK 호환되어 기존 코드와 도구가 최소한의 변경으로 작동합니다.
ModelAPI is a subscription-based platform. You bring your own API keys (BYOK) and pay a transparent subscription fee — we don't sell tokens. Harness cache reuse can cut your own key's usage by up to 5x.
ModelAPI 是订阅制平台。你自带 API 密钥(BYOK),只付透明的订阅费——我们不卖 Token。Harness 缓存复用最高可让你的密钥账单省 5 倍。
ModelAPI はサブスクリプション型のプラットフォームです。ご自身の API キー(BYOK)をお持ちいただき、透明なサブスクリプション料金のみをお支払いします——トークンの転売は行いません。Harness のキャッシュ再利用で、ご自身のキー利用量を最大 5 倍節約できます。
ModelAPI는 구독형 플랫폼입니다. 직접 보유한 API 키(BYOK)를 연결하고 투명한 구독 요금만 지불하면 됩니다——토큰을 재판매하지 않습니다. Harness 캐시 재사용으로 본인 키 사용량을 최대 5배 절약할 수 있습니다.
No markup — and more importantly, we don't sell model tokens at all. ModelAPI is a subscription SaaS: you bring your own API keys (BYOK) and pay a transparent subscription fee; we never resell or mark up model usage.
不加价——更重要的是,我们根本不卖模型 Token。ModelAPI 是订阅制 SaaS:你接入自己的 API 密钥(BYOK),只付透明的订阅费;我们绝不对模型用量加价或转售。
マークアップはありません。さらに重要な点として、そもそもモデルトークンを販売していません。ModelAPI はサブスクリプション型 SaaS です。ご自身の API キー(BYOK)を接続し、透明なサブスクリプション料金のみをお支払いいただきます。モデル利用への上乗せや転売は一切行いません。
마진은 붙지 않습니다. 더 중요한 점은, 애초에 모델 토큰을 판매하지 않는다는 것입니다. ModelAPI는 구독형 SaaS입니다. 본인의 API 키(BYOK)만 연결하면 되며, 모델 사용량에 마진을 붙이거나 재판매하지 않습니다.
We support WeChat Pay, Alipay, and Stripe (Visa / Mastercard). Enterprise plans support invoicing.
支持微信支付、支付宝和 Stripe(Visa / Mastercard)。企业方案支持对公发票。
WeChat Pay、Alipay、Stripe(Visa/Mastercard)をサポートしています。エンタープライズプランでは請求書にも対応。
위챗페이, 알리페이, Stripe(Visa/Mastercard)를 지원합니다. 엔터프라이즈 플랜은 세금계산서도 지원합니다.
No. ModelAPI does not accept cryptocurrency. We support compliant payment methods only: WeChat Pay, Alipay, and Stripe.
不支持。ModelAPI 不接受任何加密货币。我们仅支持合规的支付方式:微信支付、支付宝和 Stripe。
いいえ。ModelAPIは暗号通貨を受け入れません。WeChat Pay、Alipay、Stripeというコンプライアンス対応の決済方法のみサポートしています。
아니요. ModelAPI는 암호화폐를 받지 않습니다. 위챗페이, 알리페이, Stripe만 규격 준수 결제 방법으로 지원합니다.
Yes. A free developer tier with trial credits is available so you can evaluate the platform.
有。提供免费开发者套餐,包含试用额度,方便你评估平台能力。
はい。プラットフォームを評価できる無料の開発者ティアが試用クレジット付きで提供されています。
네. 플랫폼을 평가할 수 있는 무료 개발자 요금제가 시용 크레딧과 함께 제공됩니다.
ModelAPI targets 99.9% platform availability with enterprise-grade scheduling.
ModelAPI 平台目标可用率 99.9%,采用企业级调度保障稳定运行。
ModelAPIはエンタープライズグレードのスケジューリングで99.9%のプラットフォーム可用性を目指しています。
ModelAPI는 엔터프라이즈급 스케줄링으로 99.9% 플랫폼 가용성을 목표로 합니다.
Harness is our orchestration engine that schedules each request to the right model reliably and efficiently. With intelligent caching, high-hit scenarios can deliver up to 5× cost efficiency ($1 ≈ $5).
Harness 是我们的核心编排引擎,负责把每个请求可靠高效地调度到合适的模型。配合智能缓存技术,高命中场景下可实现最高 5 倍费效比($1 ≈ $5)。
Harnessは各リクエストを適切なモデルに確実かつ効率的にスケジューリングするオーケストレーションエンジンです。インテリジェントキャッシュにより、高ヒットシナリオで最大5倍のコスト効率($1≒$5)を実現できます。
Harness는 각 요청을 적절한 모델로 신뢰할 수 있고 효율적으로 스케줄링하는 오케스트레이션 엔진입니다. 지능형 캐싱으로 높은 적중률 시나리오에서 최대 5배 비용 효율($1≈$5)을 달성할 수 있습니다.
Nexus is our smart router that automatically picks the fastest, most stable path for each request.
Nexus 是我们的智能路由器,自动为每次请求选择最快最稳定的通道。
Nexusは各リクエストに対して自動的に最速かつ最安定の経路を選択するスマートルーターです。
Nexus는 각 요청에 대해 자동으로 가장 빠르고 안정적인 경로를 선택하는 스마트 라우터입니다.
Session budgeting lets you cap spend per session so you stay in control and never get surprise charges.
会话预算让你可以设定每次会话的消费上限,超了就停,绝不出现意外扣费。
セッションごとの支出を制限できるため、常に管理でき、予期せぬ請求を受けることはありません。
세션별 지출 한도를 설정할 수 있어 항상 통제 가능하며 예상치 못한 청구를 받지 않습니다.
Context compression keeps long conversations efficient by summarizing without losing meaning, reducing token usage by ~60%.
上下文压缩让长对话保持高效——自动摘要关键信息而不丢失含义,Token 用量降低约 60%。
コンテキスト圧縮は意味を損なわずに要約して長い会話を効率的に保ち、トークン使用量を約60%削減します。
컨텍스트 압축은 의미를 잃지 않고 요약하여 긴 대화를 효율적으로 유지하며, 토큰 사용량을 약 60% 줄여줍니다.
Prompt caching stores reusable instructions so repeated calls return faster and cheaper — zero latency, zero cost on cache hits.
Prompt 缓存会把常用指令存起来,同样的问题问第二次直接从缓存取结果——零延迟、零费用。
プロンプトキャッシュは再利用可能な命令を保存し、繰り返し呼び出しをより高速・低コストで返します——キャッシュヒット時はゼロレイテンシー、ゼロコスト。
프롬프트 캐싱은 재사용 가능한 명령을 저장하여 반복 호출을 더 빠르고 저렴하게 반환합니다 -- 캐시 적중 시 지연 시간 0, 비용 0.
Yes. Enterprise plans include dedicated channels, SLA, compliant billing, and dedicated support.
有。企业方案包含专属通道、SLA 服务协议、合规账单和专属客服支持。
はい。専用チャンネル、SLA、コンプライアンス課金、専用サポートを含むエンタープライズプランをご用意しています。
네. 전용 채널, SLA, 규격 준수 청구, 전용 지원이 포함된 엔터프라이즈 플랫폼이 있습니다.
High-throughput orchestration, dedicated channels, compliant billing, and SLA for large-scale enterprise workloads.
高吞吐编排、专属调度通道、合规账单和 SLA 保障,面向大规模企业级工作负载。
大規模エンタープライズワークロード向けの高スループットオーケストレーション、専用チャンネル、コンプライアンス課金、SLA。
대규모 엔터프라이즈 워크로드를 위한 고처리량 오케스트레이션, 전용 채널, 규격 준수 청구, SLA.
Yes. ModelAPI is built as enterprise-grade AI infrastructure designed for high-concurrency, large-scale usage.
能。ModelAPI 从架构上就是为企业级高并发、大规模使用而设计的基础设施。
はい。ModelAPIは高並列大規模使用向けに設計されたエンタープライズグレードAIインフラとして構築されています。
네. ModelAPI는 고동시성 대규모 사용을 위해 설계된 엔터프라이즈급 AI 인프라로 구축되었습니다.
ModelAPI is operated by a team with 10+ years of overseas operations experience since 2012.
ModelAPI 由一支自 2012 年起拥有 10 年以上海外运营经验的团队运营。
ModelAPIは2012年から10年以上の海外運営経験を持つチームによって運営されています。
ModelAPI는 2012년부터 10년 이상의 해외 운영 경험을 가진 팀이 운영합니다.
Our technical lead is Dr. Tengyuan Xie, an AI PhD from Lingnan University (Hong Kong), formerly at Huawei and Runze Cloud Translation, focused on attention mechanisms, context compression, and model routing.
技术负责人为谢腾远博士,香港岭南大学 AI 博士,曾任职华为和润泽云译,研究方向包括注意力机制、上下文压缩与模型路由。
技術責任者は謝騰遠博士で、香港嶺南大学のAI博士、元華為・潤沢雲訳、注意力メカニズム、コンテキスト圧縮、モデルルーティングに注力しています。
기술 책임자는 사등원(謝騰遠) 박사로, 홍콩령남대학교 AI 박사, 전 화wei·윈제운번역, 어텐션 메커니즘, 컨텍스트 압축, 모델 라우팅에 집중했습니다.
Security is built into the platform with enterprise-grade controls. We follow compliant data-handling practices.
安全是平台的内置特性,采用企业级控制措施。我们遵循合规的数据处理规范。
セキュリティはエンタープライズグレードのコントロールでプラットフォームに組み込まれています。コンプライアンス対応のデータ処理 practicesに従っています。
보안은 엔터프라이즈급 컨트롤로 플랫폼에 내장되어 있습니다. 규격 준수 데이터 처리 관행을 따릅니다.
We process requests to deliver the service and follow our privacy commitments. See our documentation for details.
我们为提供服务而处理请求,并遵循隐私承诺。详见文档说明。
サービス提供のためにリクエストを処理し、プライバシーへのコミットメントに従います。詳細はドキュメントをご覧ください。
서비스 제공을 위해 요청을 처리하며 프라이버시 약속을 준수합니다. 자세한 내용은 문서를 참조하세요.
ModelAPI serves a global user base with a focus on overseas markets.
ModelAPI 服务全球用户,重点关注海外市场。
ModelAPIは海外市場に焦点を当てたグローバルユーザーベースにサービスを提供しています。
ModelAPI는 해외 시장에 중점을 둔 글로벌 사용자 기반에 서비스를 제공합니다.
Yes. Enterprise plans support compliant invoicing and VAT invoices.
提供。企业方案支持合规发票和增值税专票。
はい。エンタープライズプランではコンプライアンス対応の請求書とVAT請求書に対応しています。
네. 엔터프라이즈 플랫폰은 규격 준수 세금계산서와 VAT 세금계산서를 지원합니다.
Smart routing (Nexus) selects the fastest, most stable path to keep latency low.
智能路由(Nexus)自动选择最快最稳的通道,确保低延迟体验。
スマートルーティング(Nexus)が最速かつ最安定の経路を選択し、遅延を低く保ちます。
스마트 라우팅(Nexus)이 가장 빠르고 안정적인 경로를 선택하여 지연 시간을 낮게 유지합니다.
Yes. Because everything goes through one OpenAI-compatible endpoint, switching models is a configuration change, not a code rewrite.
能。因为所有请求都走同一个兼容 OpenAI 的端点,换模型只是改配置,不需要改代码。
はい。すべてがOpenAI互換エンドポイントを通るため、モデルの切り替えはコードの書き直しではなく設定変更です。
네. 모든 것이 OpenAI 호환 엔드포인트를 통과하므로 모델 전환은 코드 재작성이 아닌 설정 변경입니다.
Developers get community and email support; enterprise customers get a dedicated support channel.
开发者可通过社区和邮件获取支持;企业客户享有专属客服通道。
開発者はコミュニティとメールサポートを利用でき、エンタープライズ顧客は専用サポートチャンネルを利用できます。
개발자는 커뮤니티와 이메일 지원을 받을 수 있으며, 엔터프라이즈 고객은 전용 지원 채널을 이용할 수 있습니다.