Gemini 3.1 Flash Live

by Google

Real-time voice and dialogue model

Parameters
Flash Live
Context Length
1M
Category
chat
Available Serverless

Run queries immediately, pay only for usage

$0.79in|$4.73out

Per 1M tokens

Try this modelView documentation

About this model

Real-time voice and dialogue model

Capabilities

Real-time voiceVisionLong context (1M)Streaming

Providers

One model, several sources. DOS routes to the first that answers and falls back automatically, or you can pin a provider per request.

ProviderInput /1MOutput /1MContextServed from
GoogleAvailable
$0.79$4.731MUS

Model Details

Provider
Google
Model ID
gemini-3.1-flash-live
Parameters
Flash Live
Context Length
1M tokens
Category
chat

API Usage

Use the DOS API to integrate Gemini 3.1 Flash Live into your applications. Our API is compatible with OpenAI's client libraries for easy migration.

Model ID

gemini-3.1-flash-live

Python

python
from dos import DOS

client = DOS()

response = client.chat.completions.create(
    model="gemini-3.1-flash-live",
    messages=[
        {"role": "user", "content": "Hello, how are you?"}
    ]
)

print(response.choices[0].message.content)

cURL

bash
curl https://api.dos.ai/v1/chat/completions \
  -H "Authorization: Bearer $DOS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-live",
    "messages": [
      {"role": "user", "content": "Hello, how are you?"}
    ]
  }'

Node.js

javascript
import DOS from 'dos-ai';

const client = new DOS();

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-live",
  messages: [
    { role: "user", content: "Hello, how are you?" }
  ]
});

console.log(response.choices[0].message.content);