API Gemini 3.5 Flash Extra Low
API Gemini 3.5 Flash Extra Low — bản 3.5 Flash với mức reasoning tối thiểu cho phản hồi nhanh nhất. $0.90/1M token đầu vào qua Onie AI API, ngữ cảnh 1M.
Bảng giá
Đầu vào / 1M token
$0.9
≈ 22.500₫
Đầu ra / 1M token
$5.40
≈ 135.000₫
Cửa sổ ngữ cảnh
1M
Model ID
gemini-3.5-flash-extra-lowBắt đầu nhanh
Tương thích OpenAI SDK — chỉ cần đổi base URL.
from openai import OpenAI
client = OpenAI(
api_key="sk-onie-xxxxxxxxxxxx",
base_url="https://api.onie.net/ai/v1"
)
response = client.chat.completions.create(
model="gemini-3.5-flash-extra-low",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)Tính năng nổi bật
Tất cả những gì bạn cần cho hạ tầng sản xuất
3.5 nhanh nhất
Gần như không tốn thời gian suy nghĩ.
Ngữ cảnh 1M
Đầu vào khổng lồ với độ trễ tối thiểu.
Chi phí dễ đoán
Gần như không bị tính token reasoning.
OpenAI SDK
Tích hợp thay thế trực tiếp.
Thông số & Điểm nổi bật
Giá đầu vào
$0.9 (≈22.500₫) / 1M token
Giá đầu ra
$5.40 (≈135.000₫) / 1M token
Cửa sổ ngữ cảnh
1M token
Model ID
gemini-3.5-flash-extra-low
SDK
OpenAI SDK & Anthropic Claude SDK
Thanh toán
Trả theo token · giới hạn chi tiêu mỗi key
Trường hợp sử dụng
Xử lý tài liệu dài
Phân tích sách, hợp đồng, cả codebase trong một request 1M token.
Pipeline khối lượng lớn
Tóm tắt, trích xuất, phân loại quy mô lớn với chi phí thấp mỗi request.
UX thời gian thực
Autocomplete, chat streaming và trả lời tức thì.
Sẵn sàng bắt đầu?
Triển khai hạ tầng trong vài phút. Không ràng buộc, trả theo sử dụng.