Các provider, model type và plan access đang được Assistant Core hỗ trợ.
Assistant Core hỗ trợ nhiều AI model cho chat, voice và realtime conversation. Tùy plan và cấu hình trợ lý, các model phù hợp sẽ xuất hiện trong đúng selector của Web App hoặc Admin Panel.
Chọn Chat model cho tin nhắn văn bản, file đính kèm, tool use và Kho kiến thức
Web App → Cài đặt → Giọng nói
Chọn model/voice cá nhân cho Voice Agent: Standard mode và Realtime mode
Admin Panel → Assistant Settings
Bật/tắt voice, lưu bản ghi âm, và Phát text phản hồi cho assistant
Platform/Admin catalog
Quản lý catalog model, voice list và plan access
Chat model và Voice Agent model là hai lựa chọn khác nhau. Đổi Chat model trong thanh tiêu đề không đổi VAD, ASR, TTS, TTS voice, Realtime model hoặc Realtime voice trong Settings → Giọng nói.
Alloy, Ash, Ballad, Coral, Echo, Sage, Shimmer, Verse, Marin, Cedar
Verse
Gemini 3.1 Flash Live (Google AI)
Kore, Puck, Charon, Fenrir, Aoede
— (giọng đầu danh sách)
Voice tiếng Việt (vi-VN) hiện chỉ có ở ElevenLabs: Huyền, Jade (nữ) và Nhật Nam (nam). Các voice còn lại là tiếng Anh (en-US/en-GB) nhưng vẫn đọc được tiếng Việt.
Assistant Core quy đổi chi phí provider sang credits theo hệ số billing của
plan. Đây là giá OpenAI Standard làm cơ sở tính toán, đơn vị USD trên 1 triệu
tokens:
Model
Input context
Input
Cached input
Cache write
Output
GPT-5.6 Luna
≤272K
$0.20
$0.02
$0.25
$1.20
GPT-5.6 Luna
>272K
$0.40
$0.04
$0.50
$1.80
GPT-5.6 Terra
≤272K
$2.00
$0.20
$2.50
$12.00
GPT-5.6 Terra
>272K
$4.00
$0.40
$5.00
$18.00
GPT-4.1
—
$2.00
$0.50
—
$8.00
GPT-4.1 Mini
—
$0.40
$0.10
—
$1.60
Với GPT-5.6, request vượt 272K input tokens sẽ dùng mức giá long-context cho toàn bộ request. Model hỗ trợ tối đa 922K input tokens cộng với 128K output tokens trong context window 1,05M.
Khi bạn tạo tài khoản hoặc join một assistant, hệ thống dùng các model mặc định sau nếu bạn chưa chọn preference riêng. Chat model có thể đổi trong thanh tiêu đề Web App; Voice Agent model và voice có thể đổi trong Cài đặt → Giọng nói.
Loại
Model mặc định
Chat (LLM)
DeepSeek V4 Flash
Text to Speech
Grok 2 TTS
Speech to Text
Soniox STT Realtime v5
Voice Activity Detection
Silero VAD
Realtime Voice
Grok Voice Agent
Default model giống nhau cho mọi plan. Sự khác biệt giữa các plan nằm ở danh sách model khả dụng — plan cao hơn mở khóa thêm nhiều model để bạn chuyển đổi.
Mỗi thao tác AI tiêu thụ credits từ ví của bạn. Model đắt hơn tốn nhiều credits hơn. Xem Credits để biết chi tiết.