🔄 Prend en charge les modèles Rerank, actuellement compatibles avec Cohere et Jina, peuvent être intégrés à Dify
⚡ OpenAI Realtime API - Prend en charge l'API en temps réel d'OpenAI, prend en charge les canaux Azure
Prend en charge l'entrée dans l'interface de chat via la route /chat2link
🧠 Prend en charge la définition de l'effort de raisonnement via le suffixe du nom du modèle:
Modèles OpenAI de la série o
Ajouter le suffixe -high pour un effort de raisonnement élevé (ex. : o3-mini-high)
Ajouter le suffixe -medium pour un effort de raisonnement moyen (ex. : o3-mini-medium)
Ajouter le suffixe -low pour un faible effort de raisonnement (ex. : o3-mini-low)
Modèles de raisonnement de Claude
Ajouter le suffixe -thinking pour activer le mode raisonnement (ex. : claude-3-7-sonnet-20250219-thinking)
🔄 Raisonnement vers le contenu: prend en charge le paramètre thinking_to_content dans Channel - Edit - Channel Extra Settings, la valeur par défaut est false. Lorsqu'il est activé, le contenu de raisonnement reasoning_content sera converti en balise <think> et ajouté au contenu dans la réponse.
🔄 Limitation du débit du modèle: prend en charge la définition des limites de débit du modèle dans les paramètres système - Paramètres de limite de débit, prend en charge la définition de la limite totale des demandes et de la limite des demandes réussies.
💰 Prise en charge de la facturation du cache: après l'activation, vous pouvez facturer selon le ratio défini lorsque des accès au cache se produisent:
Définissez l'option de taux de cache d'invite dans Paramètres système - Paramètres de fonctionnement
Définissez le taux de cache d'invite dans les canaux, plage 0-1, par ex. 0,5 signifie une facturation de 50 % sur l'accès au cache