Appearance
Стриминг
Все модели поддерживают stream=True (Server-Sent Events).
Python (OpenAI SDK)
python
from openai import OpenAI
client = OpenAI(base_url="https://d-api-3i.llmgw.ru/v1", api_key="sk-llmgw-...")
stream = client.chat.completions.create(
model="x-ai/grok-4",
messages=[{"role": "user", "content": "Расскажи короткий анекдот"}],
stream=True,
)
for chunk in stream:
delta = chunk.choices[0].delta.content
if delta:
print(delta, end="", flush=True)TypeScript
ts
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://d-api-3i.llmgw.ru/v1",
apiKey: process.env.LLMBOX_KEY!,
});
const stream = await client.chat.completions.create({
model: "openai/gpt-5",
stream: true,
messages: [{ role: "user", content: "Hello, stream!" }],
});
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "");
}cURL
bash
curl -N https://d-api-3i.llmgw.ru/v1/chat/completions \
-H "Authorization: Bearer $LLMBOX_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "anthropic/claude-sonnet-4.6",
"stream": true,
"messages": [{"role": "user", "content": "stream please"}]
}'Учёт стоимости при стриминге
Стоимость списывается после завершения генерации — по фактическому usage в финальном chunk. Баланс в кабинете обычно обновляется за несколько секунд (SSE /me/balance/events).
Обработка прерываний
Если клиент закрывает соединение раньше времени, генерация останавливается. Списание — только за уже сгенерированные токены.