빌링AI빌링AI
openai입력: 300,000 cr/100만 토큰, 출력: 1,200,000 cr/100만 토큰

GPT-4o mini Transcribe

OpenAI gpt-4o-mini 기반 음성 인식(STT). gpt-4o-transcribe 대비 저지연·저가로 대량 전사에 적합합니다. 다국어 인식을 지원합니다. 회사 OpenAI 계정 직접 연동.

엔드포인트

POST/api/v1/audio/transcriptions

Base URL: https://billing-ai.doublezero.kr

인증

모든 API 요청에는 Authorization 헤더에 Bearer 토큰으로 API Key를 포함해야 합니다.

Authorization: Bearer YOUR_API_KEY

요청 파라미터

이름타입설명
model*string

사용할 모델 ID. 이 페이지에서는 "gpt-4o-mini-transcribe"를 사용합니다.

file*file (multipart)

전사할 오디오 파일. multipart/form-data 로 업로드합니다(OpenAI SDK 기본 방식). mp3·wav·m4a·webm·ogg·flac 등 최대 25MB.

audio_urlstring

파일 업로드 대신 사용하는 대안. 공개 접근 가능한 오디오 URL(http/https)을 JSON 본문으로 전달하면 서버가 직접 다운로드합니다.

audiostring

base64 또는 data URI 문자열로 오디오를 JSON 본문에 담아 전달하는 대안. 예: "data:audio/mpeg;base64,...".

응답 필드

이름타입설명
text*string

전사된 텍스트.

usage.input_tokensnumber

입력(오디오) 토큰 수. usage 제공 시 포함됩니다.

usage.output_tokensnumber

출력(텍스트) 토큰 수. usage 제공 시 포함됩니다.

코드 예제

curl -X POST https://billing-ai.doublezero.kr/api/v1/audio/transcriptions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F file=@audio.mp3 \
  -F model=gpt-4o-mini-transcribe

참고 사항

  • 오디오 입력은 multipart/form-data 파일(file) 업로드가 기본이며, JSON 본문의 audio_url(공개 URL) 또는 audio(base64·data URI)로도 전달할 수 있습니다. 파일은 최대 25MB, mp3·wav·m4a·webm·ogg·flac 등을 지원합니다.
  • 지원 기능: 음성 인식(STT), 음성-텍스트 변환, 저지연 전사, 다국어 인식