Sáu mô hình có sẵn cho mọi người dùng, không cần thiết lập và không mất phí. Chúng hoạt động qua một API duy nhất tương thích OpenAI.

Mô hình chủ lực thế hệ mới của nền tảng. Ngữ cảnh 262K token, tích hợp sẵn hỗ trợ hình ảnh (vision). Xuất sắc trong việc tạo văn bản, phân tích dữ liệu, xử lý hình ảnh và viết mã.
bitrixgpt-5.5
Một phiên bản của BitrixGPT 5.5 với khả năng suy luận theo chuỗi (chain-of-thought reasoning). Mô hình “suy nghĩ thành tiếng” trước khi trả lời — phù hợp hơn với các tác vụ logic, toán học và nhiều bước. Mô hình cũng có thể hiểu hình ảnh.
bitrixgpt-5.5-thinking
Một mô hình mã nguồn mở mạnh mẽ với 120 tỷ tham số. Chất lượng sinh nội dung tối đa cho các tác vụ đòi hỏi cao: văn bản dài, phân tích chuyên sâu, câu trả lời ở trình độ chuyên gia.
openai/gpt-oss-120b
Mô hình BitrixGPT 5.5 Agent với ngữ cảnh 262K token và khả năng tạo tối 65K token trong một lần. Lý tưởng để làm việc với tài liệu lớn và các cuộc hội thoại dài.
bitrixgpt-5.5-agent
Một mô hình mã nguồn mở gọn nhẹ từ Google. Nhanh, hiệu quả, và rất giỏi trong tóm tắt, phân loại và trích xuất dữ liệu từ văn bản.
google/gemma-4-26B-A4B-it
Phiên bản Gemma 4 với khả năng suy luận theo chuỗi (chain-of-thought). Một lựa chọn thay thế gọn nhẹ, nhanh cho BitrixGPT 5.5 Thinking từ Google — không có bộ lọc kiểm duyệt.
google/gemma-4-26B-A4B-thinkingKhông chắc nên chọn mô hình nào? Đặt model: "auto" — nền tảng sẽ tự động chọn mô hình phù hợp nhất với yêu cầu của bạn.
Chọn phương án phù hợp nhất với bạn. Bạn có thể kết hợp cả ba cùng lúc.

6 mô hình, 0 Ꝟ, sẵn sàng ngay lập tức
BitrixGPT 5.5 (tích hợp sẵn vision), BitrixGPT 5.5 Thinking, GPT-OSS 120B, Gemma 4 26B, Gemma 4 26B Thinking, BitrixGPT 5.5 Agent — có sẵn cho mọi người dùng, không cần cấu hình. Chỉ cần gửi yêu cầu.

GPT, Claude và nhiều mô hình khác — tính phí theo token
Sử dụng các mô hình tốt nhất mà không cần đăng ký với nhà cung cấp. Chỉ trả phí cho số token bạn thực sự sử dụng, trừ trực tiếp từ số dư của bạn. Mọi mô hình đều có sẵn thông qua một endpoint duy nhất.

OpenAI, Anthropic, DeepSeek — tùy bạn lựa chọn
Kết nối khóa API của riêng bạn từ bất kỳ nhà cung cấp nào. Thanh toán trực tiếp cho nhà cung cấp, không mất phí qua nền tảng. Khóa của bạn — mô hình của bạn — giới hạn của bạn.
curl -X POST /v1/ai/chat/completions \ -H "X-Api-Key: vibe_app_xxx..." \ -d '{ "model": "auto", "messages": [ { "role": "user", "content": "Hello!" } ], "stream": true }'
Định dạng chuẩn tương thích với OpenAI. Sao chép và dán — hoạt động ngay lập tức.
Không cần viết code thủ công. Sao chép câu lệnh, dán vào Claude, Cursor hoặc ChatGPT — trợ lý AI sẽ tạo bot hoạt động hoàn chỉnh cho bạn.
Xây dựng một bot cho Bitrix24 tự động phân loại lead mới bằng AI. Nhiệm vụ: - Bot nhận một lead mới qua webhook Bitrix24 - Gửi mô tả lead đến một mô hình AI thông qua Vibecode API - AI phân tích văn bản và gán một danh mục: nóng, ấm, lạnh - Bot cập nhật trường lead trong CRM với kết quả phân loại Công nghệ: - Vibecode API để truy cập Bitrix24 và các mô hình AI - Endpoint AI: POST /v1/ai/chat/completions với model: "auto" - Endpoint CRM: GET/POST /v1/leads để làm việc với lead - Khóa API: vibe_app_xxx (thay bằng khóa của bạn) Tài liệu API: vibecode.bitrix24.com/llms-full.txt
Ba bước và mô hình của bạn sẽ chạy qua Vibecode. Miễn phí, không tính phí hoa hồng.
OpenAI, Anthropic, Google AI, DeepSeek, OpenRouter — đăng ký và tạo khóa API.
Qua giao diện hoặc API — chỉ định nhà cung cấp và khóa của bạn. Dữ liệu được mã hóa bằng AES-256-GCM.
Khóa của bạn sẽ được sử dụng tự động. Chuỗi ưu tiên: khóa của bạn → tài khoản Bitrix24 → nền tảng.
BYOK = miễn phí qua nền tảng. Khi sử dụng khóa của riêng bạn, Vibecode không tính phí hoa hồng. Bạn chỉ thanh toán trực tiếp cho nhà cung cấp.
Cách AI Model Router hoạt động
Sáu mô hình miễn phí: BitrixGPT 5.5 (hỗ trợ hình ảnh), BitrixGPT 5.5 Thinking (có reasoning), GPT-OSS 120B, BitrixGPT 5.5 Agent, Gemma 4 26B và Gemma 4 26B Thinking. Cùng với Whisper để nhận dạng giọng nói. Tất cả đều khả dụng qua một endpoint duy nhất /v1/ai/chat/completions.
BYOK cho phép bạn kết nối khóa API riêng từ OpenAI, Anthropic, DeepSeek hoặc bất kỳ nhà cung cấp tương thích OpenAI nào. Yêu cầu của bạn sẽ đi qua proxy của Vibecode với định dạng thống nhất và ghi log.
Có. Hỗ trợ đầy đủ Server-Sent Events (SSE) để truyền phản hồi dạng stream. Đặt stream: true trong yêu cầu — và mô hình sẽ trả về token ngay khi được tạo ra.
Có. AI API hỗ trợ tools/function calling theo định dạng OpenAI. Mô hình có thể gọi các hàm, nhận kết quả và tiếp tục tạo nội dung — lý tưởng cho tác nhân AI và tự động hóa.