100+ 모델을 위한 엔터프라이즈 AI 게이트웨이
— 설계부터 투명하게

하나의 API 뒤에 100개 이상의 모델 — GPT, Claude, Gemini에 더해 DeepSeek, Qwen, GLM, Kimi까지. 텍스트부터 이미지·영상 생성까지 지원합니다. 역할, 예산, 감사 기록이 기본 제공되어 팀 단위로 통제할 수 있습니다.

네 가지 숫자로 보는 엔터프라이즈 약속

* SLA는 Ofox 플랫폼 가용성을 대상으로 합니다. 상위 모델 제공사 측 장애는 제외됩니다.

0%
모든 요청에 대한 플랫폼 수수료
99.9%
가동률 SLA *
없음
프롬프트·출력의 학습 사용
100%
사용자와 정확한 비용이 기록된 요청
엔터프라이즈 기능

첫 요청부터 엔터프라이즈급 AI 인프라

하나의 API, 하나의 대시보드, 하나의 청구서. 프로덕션 도입에 필요한 통제·안정성·데이터 처리 방식을 갖췄습니다. 플랫폼 수수료 0%는 그 출발점일 뿐입니다.

모델 카드$3.00 / M
실제 지불$3.00 / M · 0%
볼륨 크레딧최대 −7% · 자동

플랫폼 수수료 0% — 공식 요율 그대로

모델 제공사의 공식 요율로 과금됩니다 — 카드에 표시된 가격이 곧 지불하는 가격입니다. 사용량이 늘면 최대 7%의 볼륨 크레딧이 자동 적용됩니다.

OpenAIOpenAI
ClaudeClaude
GeminiGemini
DeepSeekDeepSeek
QwenQwen
GrokGrok
sk-ofox-••••••••

API 키 하나로 GPT, Claude, Gemini 등 100+ 모델

Claude, GPT, Gemini, DeepSeek, Qwen 등 100개 이상의 모델을 API 키 하나로 이용합니다. OpenAI SDK와 완전히 호환됩니다.

가동률 100%
최근 30일Tokyo

99.9% 가동률 SLA와 다중 리전 자동 페일오버 *

다중 리전 이중화와 자동 페일오버. 가용성 약속을 문서로 명시합니다.

월 한도$0 / $1,000
오늘
$0
이번 주
$0
이번 달
$0

키별·사용자별 세밀한 비용 통제

키별·사용자별로 일간·주간·월간 예산을 설정하고 자동으로 요청을 제한합니다. 실시간 사용량 대시보드로 예상 밖의 청구를 없앱니다.

요청모델
저장 안 함학습 안 함

콘텐츠 영구 저장 없음

프롬프트와 응답은 학습에 사용되지 않습니다. 보관하는 것은 단기 운영 로그와 과금에 필요한 요청 메타데이터·토큰 사용량뿐입니다.

티켓< 24h
우선< 4h
전담실시간

등급별 기술 지원

사용량이 늘수록 응답 시간이 짧아집니다. 상위 등급 계정에는 전담 기술 담당자와 우선 티켓 처리가 제공됩니다.

트레이스
LangfuseDatadogWeave

LLM 옵저버빌리티(Langfuse, Datadog, Weave)

출시 예정

옵트인 방식으로 프롬프트와 응답 로그를 수집해 Langfuse, Datadog 등으로 전송하여 디버깅과 분석에 활용합니다. 대시보드에서 보는 것과 동일한 귀속 정보를, 이미 운영 중인 관측 스택으로 그대로 내보냅니다.

* SLA는 Ofox 플랫폼 가용성만을 대상으로 하며, 상위 모델 제공사 측 장애는 포함되지 않습니다.

보안과 컴플라이언스

보안과 컴플라이언스: 보관이 아니라 전달

게이트웨이의 역할은 요청을 옮기는 것이지 붙잡아 두는 것이 아닙니다. 트래픽은 TLS로 암호화되며, 콘텐츠는 영구 저장되거나 학습에 사용되지 않습니다. 아직 취득 중인 인증은 아래에 그대로 표시했습니다.

데이터 취급 방식

전송 구간 TLS 암호화

고객사 시스템과 당사 사이의 모든 API 트래픽을 종단 간 암호화합니다.

프롬프트·응답 영구 저장 없음

프롬프트와 응답은 영구 저장되지 않습니다. 보관하는 것은 단기 운영 로그와 과금에 필요한 요청 메타데이터·토큰 수뿐입니다.

귀사의 데이터를 학습에 사용하지 않습니다

고객사의 콘텐츠는 당사 모델이든 타사 모델이든 학습에 사용되지 않습니다. 상위 제공사는 각사의 엔터프라이즈 약관을 따릅니다.

인증 및 데이터 계약

SOC 2 Type II

감사 진행 중 — 2026년 3분기 예정

취득 진행 중

ISO 27001

2026년 3분기 예정

취득 진행 중

GDPR

표준계약조항이 포함된 DPA 제공, 하위 수탁자 목록은 요청 시 공개

준수

DPA

계약 체결 전 요청 시 제공

제공 가능

아직 보유하지 않은 인증을 보유했다고 표시하지 않습니다. 검토 일정상 특정 프레임워크가 중요하다면 알려 주십시오. 현재 감사 단계를 공유하겠습니다.

팀 관리

개발팀을 위한 사용량 애널리틱스

비용·성능·사용량을 실시간으로, 모델·API 키·구성원 단위까지 귀속합니다. 지출 검토와 용량 계획을 월말 정산이 아니라 데이터로 진행하십시오.

모델·구성원·API 키·앱이라는 동일한 필터를 비용, 요청 상태, 토큰, 캐시에 그대로 적용합니다. 캐시 적중 여부에 따라 가격을 분리해 표시합니다.

같은 추이를 모델·API 키·구성원 기준으로 전환합니다. 사용량이 급증하면 청구서가 오기 전에 원인을 지목할 수 있습니다.

비용·토큰·캐시를 하나의 대시보드에서 분석
연동

연동: 베이스 URL만 바꾸고 SDK는 그대로

Ofox는 OpenAI, Anthropic, Gemini SDK와 호환됩니다. 코드를 다시 쓸 필요도, 전용 클라이언트를 도입할 필요도 없습니다.

OpenAI, Anthropic, Gemini SDK와 호환

from openai import OpenAI

client = OpenAI(
    base_url="https://api.ofox.run/v1",  # ← 여기만 바꾸면 됩니다
    api_key="YOUR_OFOX_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-5.6-sol",
    messages=[{"role": "user", "content": "Hello!"}],
)

print(response.choices[0].message.content)

Claude Code, Cursor, LangChain 등에서 그대로 동작

전체 연동 보기
지원과 온보딩

엔터프라이즈 도입은 이렇게 진행됩니다

1단계 가입하고 테스트

계정을 만들고 크레딧을 충전하면 바로 자체 검증을 시작할 수 있습니다. 모델·지연·가격이 워크로드에 맞는지 확인하는 데 영업 미팅은 필요 없습니다.

2단계 예산을 설정한 상태로 파일럿 운영

예산과 한도를 설정한 상태로 워크로드 하나를 먼저 배포하십시오. 지연, 품질, 청구를 자사 수치로 검증할 수 있습니다.

3단계 역할과 키별 한도로 정식 도입

역할과 키별 예산을 팀 전체에 적용해 확대하십시오. 사용량이 늘수록 응답 시간이 짧아지고 전담 기술 담당자가 배정됩니다.

자주 묻는 질문

엔터프라이즈 FAQ

제품과 안정성

각 제공사의 공식 API와 Ofox는 무엇이 다릅니까?

공식 가격을 그대로 유지하면서(플랫폼 수수료 0%) 여러 연동을 하나로 대체합니다. OpenAI, Anthropic, Google, DeepSeek, Qwen, GLM, Kimi 등 100개 이상의 모델을 키 하나, 청구서 하나, 대시보드 하나로 다루며 역할·예산·감사 기록이 기본 제공됩니다. 직접 계약하면 제공사마다 거래 관계와 SDK, 청구서가 따로 생기지만 Ofox는 이를 마크업 없이 통합합니다.

99.9% SLA는 무엇을 보장합니까?

Ofox 플랫폼(게이트웨이, 라우팅, API 레이어)의 가용성입니다. 상위 모델 제공사에서 발생한 장애는 당사가 해당 인프라를 통제하지 않으므로 제외됩니다. 현행 서비스 크레딧 조건은 문의해 주십시오.

상위 모델 제공사에 장애가 발생하면 어떻게 됩니까?

플랫폼 수준의 장애는 여러 리전에 걸쳐 자동으로 우회합니다. 상위 제공사 자체가 중단된 경우에는 조용히 품질을 낮추는 대신 오류를 명확히 노출합니다. API가 모델에 종속되지 않으므로 대부분의 팀은 문자열 하나만 바꿔 동급 모델로 전환합니다. 상위 장애가 SLA에서 제외된다는 점도 미리 밝히고 있습니다.

연동에는 얼마나 걸립니까?

대부분의 팀은 몇 분이면 됩니다. API가 OpenAI, Anthropic, Gemini SDK와 호환되므로 베이스 URL과 키만 바꾸면 기존 코드를 그대로 사용할 수 있습니다.

데이터와 컴플라이언스

프롬프트와 응답을 저장합니까?

아니요. 요청 내용은 실시간으로 처리되며 영구 저장되지 않습니다. 보관하는 것은 단기 운영 로그와 과금에 필요한 요청 메타데이터·토큰 수뿐입니다. 모든 트래픽은 전송 구간에서 TLS로 암호화됩니다.

당사 데이터가 모델 학습에 사용됩니까?

전혀 사용되지 않습니다. 프롬프트와 출력은 당사 모델이든 타사 모델이든 학습에 쓰이지 않습니다. 상위 제공사는 각사의 엔터프라이즈 약관을 따릅니다.

SOC 2 인증을 보유하고 있습니까?

아직입니다. SOC 2 Type II 감사가 진행 중이며 2026년 3분기를 목표로 하고, ISO 27001도 같은 일정입니다. 발급 전 인증을 보유했다고 주장하지 않습니다. 검토에 둘 중 하나가 필요하다면 연락 주십시오. 현재 감사 단계를 서면으로 공유하겠습니다.

GDPR을 준수합니까?

예. 표준계약조항이 포함된 DPA를 제공하고, 전송 구간의 모든 트래픽을 암호화하며, 요청 내용을 영구 저장하지 않습니다. 하위 수탁자 목록도 요청 시 공유합니다. 연락 주시면 검토용 문서를 제공하겠습니다.

결제

요금 체계는 어떻게 됩니까?

모델 제공사의 공식 요율에 따른 사용량 기반 과금이며 플랫폼 수수료는 0%입니다 — 모델 카드에 표시된 가격이 그대로 청구됩니다. 월 고정비도, 플랫폼 최소 사용액도, 충전 수수료도 없습니다. 지속적인 사용량에 따라 최대 7%의 크레딧이 자동 적립됩니다.

실패한 요청도 과금됩니까?

아니요. 실패한 요청은 명확한 오류를 반환하며 과금되지 않습니다. 완료된 요청에 대해서만 지불합니다.

선결제 잔액에 유효기간이 있습니까?

없습니다. 잔액은 소진할 때까지 유효하며, 만료일도 없고 유지에 필요한 월 최소 사용액도 없습니다.

팀과 접근 권한

구성원별 지출 한도는 어떻게 설정합니까?

콘솔에서 구성원별 또는 API 키별로 일간·주간·월간 한도를 설정할 수 있습니다. 한도에 도달하면 요청이 자동으로 제한되고 다음 기간에 재개됩니다. 잘못 돌아가는 스크립트 때문에 청구서가 튀는 일을 막을 수 있습니다.

팀이 호출할 수 있는 모델을 제한할 수 있습니까?

예. 접근 권한을 역할별·키별로 관리하므로 승인된 모델 범위로 사용을 한정하고 지출 한도도 함께 적용할 수 있습니다.

SSO를 지원합니까?

사용 중인 ID 제공자를 알려 주시면 현재 지원 범위와 로드맵상의 계획을 안내해 드리겠습니다.

ofox

팀에 필요한 모든 모델을, 회사가 요구하는 모든 통제와 함께.

먼저 플레이그라운드에서 모델을 시험해 보거나, 팀 도입에 대해 문의해 주십시오. 대상 모델, 리전, 검토 요건까지 함께 논의합니다.

API 키 발급받기