빌링AI빌링AI
google입력: 79,200 cr/100만 토큰, 출력: 660,000 cr/100만 토큰

Gemini 3.5 Flash Lite

Gemini 3.5 Flash-Lite는 저지연·저비용에 최적화된 경량 모델로, 대량 텍스트 처리와 실시간 응답이 필요한 서비스에 적합합니다. 텍스트뿐 아니라 이미지·비디오·오디오 입력도 지원하는 균형형 멀티모달 모델입니다.

엔드포인트

POST/api/v1/chat/completions

Base URL: https://billing-ai.doublezero.kr

인증

모든 API 요청에는 Authorization 헤더에 Bearer 토큰으로 API Key를 포함해야 합니다.

Authorization: Bearer YOUR_API_KEY

요청 파라미터

이름타입설명
model*string

사용할 모델 ID. 이 페이지에서는 "gemini-3-5-flash-lite"를 사용합니다.

messages*array

대화 메시지 배열. 각 메시지는 role("system" | "user" | "assistant")과 content를 포함합니다.

temperaturenumber

생성 온도 (0~2). 높을수록 다양한 응답을 생성합니다.

max_tokensnumber

최대 출력 토큰 수. 모델별 상한이 다릅니다.

streamboolean

스트리밍 여부. true로 설정하면 토큰 단위로 실시간 전송합니다.

top_pnumber

누적 확률 샘플링. temperature와 함께 사용하지 않는 것을 권장합니다.

media_resolutionstring

영상 입력 해상도. low 는 프레임당 토큰이 적어 긴 영상·대량 분석에 적합하고, default 는 Gemini 기본값을 사용합니다.

lowdefault

응답 필드

이름타입설명
id*string

응답 고유 ID

object*string

"chat.completion" 고정값

created*number

생성 타임스탬프 (Unix epoch)

model*string

실제 사용된 모델 ID

choices*array

생성 결과 배열. 각 항목에 message(role, content)와 finish_reason을 포함합니다.

usage*object

토큰 사용량. prompt_tokens, completion_tokens, total_tokens를 포함합니다.

코드 예제

curl -X POST https://billing-ai.doublezero.kr/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-5-flash-lite",
    "messages": [
      {"role": "system", "content": "당신은 도움이 되는 AI 어시스턴트입니다."},
      {"role": "user", "content": "안녕하세요"}
    ],
    "temperature": 0.7
  }'

참고 사항

  • 지원 기능: 텍스트 생성, 코드 생성, 툴 콜링, 번역, 요약, 멀티모달 입력
  • 영상 입력 지원: messages content 에 video_url 파트({type:"video_url", video_url:{url}}) 또는 Gemini 네이티브 파트({type:"video", fileData:{fileUri}})를 넣어 영상을 분석합니다. fileUri 에는 YouTube URL 또는 공개 https 영상 URL 을 사용할 수 있습니다.
  • 영상 구간·프레임 제어: 각 영상 파트의 videoMetadata 로 fps 와 start/end offset("12s" 또는 초)을 지정합니다. 구간(offset)을 지정하면 선차감 홀드가 크게 줄고, 미지정 시 모델 컨텍스트 상한만큼 선차감했다가 실제 처리 토큰으로 정산·환불합니다.