🔄 Hỗ trợ các mô hình Rerank, hiện tương thích với Cohere và Jina, có thể tích hợp với Dify
⚡ OpenAI Realtime API - Hỗ trợ API thời gian thực của OpenAI, hỗ trợ các kênh Azure
Hỗ trợ vào giao diện trò chuyện qua tuyến /chat2link
🧠 Hỗ trợ nỗ lực thiết lập suy luận thông qua hậu tố tên model:
Các mô hình o-series OpenAI
Thêm hậu tố -high cho khả năng suy luận cao (ví dụ: o3-mini-high)
Thêm hậu tố -medium cho nỗ lực suy luận trung bình (ví dụ: o3-mini-medium)
Thêm hậu tố -low cho khả năng suy luận thấp (ví dụ: o3-mini-low)
Mô hình suy luận của Claude
Thêm hậu tố -thinking để kích hoạt chế độ suy luận (ví dụ: claude-3-7-sonnet-20250219-thinking)
🔄 Reasoning-to-content: hỗ trợ thiết lập thinking_to_content trong Channel - Edit - Channel Extra Setting, mặc định là false. Khi được bật, nội dung lý luận reasoning_content sẽ được chuyển thành thẻ <think> và được thêm vào nội dung trong phản hồi.
🔄 Giới hạn tốc độ mô hình: hỗ trợ cài đặt giới hạn tốc độ mô hình trong Cài đặt hệ thống - Cài đặt giới hạn tốc độ, hỗ trợ cài đặt tổng giới hạn yêu cầu và giới hạn yêu cầu thành công
💰 Hỗ trợ thanh toán bộ đệm: sau khi kích hoạt, bạn có thể lập hóa đơn theo tỷ lệ đã đặt khi xảy ra lần truy cập bộ đệm:
Đặt tùy chọn tỷ lệ bộ nhớ đệm nhắc nhở trong Cài đặt hệ thống - Cài đặt vận hành
Đặt tỷ lệ bộ đệm nhắc nhở trong các kênh, phạm vi 0-1, ví dụ: 0,5 nghĩa là thanh toán 50% khi truy cập bộ đệm