Aller au contenu principal

Canal et modèle

Modèle d’accès à deux niveaux : ** Le canal (Channel) « Qu’est-ce qu’un accord, quel accord ? » Le modèle (Model) ** Sous le canal, le tuyau « quel modèle spécifique, quelle capacité, comment le prix ». les deux niveaux sont maintenus en arrière-plan, stockent la base de données, modifient la distribution de code zéro et entrent en vigueur après la conservation.

Admin console model list

  • Page du canal : « modèle »/admin/channels)
  • Page « Modèle »/admin/models Chaque modèle a une page de configuration indépendante. /admin/models/:id

Le canal

Un canal = une URL de base + une clé API + un type de protocole. Un même type de canal peut être construit sur plusieurs canaux (par exemple, deux canaux openai pointent vers des passerelles différentes, des clés différentes).

Le champ de canal

champsExpliquer
Le nomIl est nécessaire de remplir les marques intérieures, telles que Anthropic production
Typesopenai / claude / gemini Déterminer le protocole utilisé pour l'objet de requête, l'appel d'outil et le format de flux
Formats d’interfaceopenai Les types apparaissent : chat (Classic Chat Completions) ou responses (Responses API), sélectionné lors de la création du canal, tous les modèles de conversation sous ce canal sont utilisés de manière unifiée
Base URLUtilisez le point de terminaison par défaut du fabricant; peut indiquer un point de terminaison officiel, une passerelle unique ou un point de terminaison compatible.
API KeyStockage crypté, la réponse de l'API n'est pas affichée; laissé vide lors de l'édition indique la conservation de la clé d'origine
ActivéLe modèle sous ce canal n'est plus disponible après la fermeture
Compatible avec OpenAI ?

Lorsque vous accédez à l’amont « Compatible avec l’OpenAI » tels que DeepSeek, le portail one-api/new-api, le service de déploiement de raisonnement : sélection de type openai Le format est généralement choisi. chat (Beaucoup de terminaux compatibles avec des tiers n'implémentent que Chat Completions), l'URL de base remplit l'adresse du service, c'est-à-dire que les quatre catégories d'amont courantes (Anthropic, OpenAI, Gemini, OpenAI compatible) correspondent respectivement claudeopenai(responses 或 chat)geminiopenai(chat)

Confirmation de la capacité du point de terminaison avant la construction du canal openai

Si le bouton final ne prend en charge que Chat Completions, il est sélectionné. responses La mise en forme, l'appel d'outils et le flux sont généralement erronés. Les exigences minimales pour les points d'extrémité de canal (y compris les passerelles de conversion) sont ** Transmettre les champs de fonction d'appel et de flux SSE à chaque point d'extrémité de conversation natif ** Il est recommandé de transmettre complètement le protocole original, sinon les blocs de pensée, les points de cache et d'autres seront perdus.

Vérification et gestion des canaux

  • ** Vérification ** Il n'y a pas de bouton "test" séparé sur la page de canal. Une fois que vous avez terminé de construire le canal et que vous avez appuyé sur le modèle, il est recommandé d'envoyer un message directement sur le modèle dans le chat. ** Un outil de messagerie déclenchera un appel. ** (Par exemple, laissez-le rechercher en ligne), un protocole d’authentification, une clé et un outil transmettent trois choses.
  • ** ordre ** Les listes prennent en charge l'ordre de traction (ou le déplacement vers le haut / vers le bas en ligne) et l'ordre est persistant.
  • ** Supprimer ** Supprimer le canal ** Supprimer tous les modèles ** Une fenêtre est confirmée.
  • La ligne de liste affiche les emblèmes de type, les emblèmes de format d'interface, les emblèmes désactivés et l'état de l'URL de base avec la clé définie / non définie.

Modèle

La boîte Conversation « Nouveau modèle » ne nécessite que la création des éléments nécessaires : canal, type, nom d’affichage, request_id Des icônes, des prospectus; le reste est ajusté sur la page de configuration. nouveau modèle par défaut: activé, mode outil native Ouverture visuelle, ouverture de flux, ouverture de recherche profonde.

Cliquez sur l'icône de la ligne modèle pour accéder à la page des paramètres, comme indiqué ci-dessous par section.

Informations de base

champsExpliquer
Le canalLes principaux canaux du modèle
Au bout du canalChoix, voir ci-dessous Au bout du canal 1 Section
Type de personne (Kind)chat Conversation /image (Images générées par embedding (Vector embedded). type détermine quelles partitions sont affichées par la suite: conversation se comporte uniquement par chat, dimension vectorielle uniquement embedded, prix unique avec la génération d'une image dépassée uniquement
Montrer le nomLes noms que l'utilisateur voit dans le sélecteur de modèle, tels que Claude Opus 4.8
request_idL'ID modèle réellement attribué à l'API amont (découpé avec l'ID interne), par exemple claude-opus-4-8
SymbolesTrois options d'écriture: laisser vide (avec l'icône par défaut), un caractère emoji, une URL d'image; peut également être directement ** Télécharger les documents d’icônes **
PrésentationUne ligne de texte, affichée dans le sélecteur de modèle
ActivéInvisible pour les utilisateurs après la fermeture.
Montrer l’ordrePlus les chiffres sont petits, plus
Limiter l’affichage

Les téléchargements acceptent uniquement PNG, JPEG et SVG. ** Un seul fichier ne dépasse pas 256 KB ** (Vérification préalable, vérification secondaire du service). Les icônes sont représentées à environ 16 à 32 pixels dans le sélecteur et ne nécessitent pas de grand tableau. L'URL retournée après un téléchargement réussi est automatiquement remplie dans la boîte d'entrée d'icônes.

Remarque lors de la suppression du modèle : les conversations existantes qui font référence au modèle sont toujours visibles, mais ne peuvent pas continuer à être envoyées.

Modèle de conversation (chats uniquement)

** Modèle d’outil (tool_mode) ** Trois méthodes de valorisation permettent de déterminer comment les outils de la plate-forme (recherche, Python bac à sable, graphique, base de connaissances, etc.) sont appliqués au modèle :

Valorisercomportementappliquée
nativeDéfinir et résoudre l'appel avec l'outil d'appel de fonction native du canal auquel le modèle appartientModèle qui prend en charge l'appel d'outils natifs (par défaut)
promptSans passer aux champs originaux, remplacez l'outil de description du protocole de texte et le format d'appel par des mots-clés.La fonctionnalité n'est pas prise en charge, mais les instructions suivent un modèle existant.
nonePas d’outils, une simple conversation.Modèles qui ne nécessitent pas ou ne peuvent pas utiliser d'outils

** Trois interrupteurs **:

InterrupteurExpliquer
La vision (Vision)Supporte-t-il l'entrée d'images. Après la fermeture, le modèle ne reçoit pas d'annexe d'images ni ne participe à des processus internes nécessitant des capacités visuelles
Le flux (Stream)Lorsque l'appel est verrouillé, il est remplacé par un appel bloqué et une fois la réponse complète obtenue, il est poussé à l'avant.
Recherche profondeAutoriser le mode de recherche profonde sur ce modèle

** Le mot système ** Le système prompt de niveau modèle, dérivé d'une combinaison de phrases de plate-forme, peut être utilisé pour définir une personne exclusive pour un modèle.

** Contrôle des paramètres (param_controls) **: Définir déclarativement ce modèle Expose l'utilisateur à des paramètres réglables (tels que le commutateur de réflexion profonde et le sélecteur d'intensité de réflexion).

ContrepartieLe dispositif
Interrupteur (toggle)Nom de clé, texte affiché, icônes, valeurs par défaut, ouverture / fermeture des fragments JSON
Téléchargez (select)Le nom de clé, le texte affiché, les icônes, les valeurs par défaut, plusieurs options (valeur / texte / fragment JSON) peuvent être sélectionnés pour afficher uniquement si une clé est égale à une valeur

Chaque morceau de JSON est ** Fusion directe des paramètres réels dans le corps de la demande amont ** Claire remplit thinking OpenAI/Gemini remplit la documentation de l’API en fonction de la documentation de l’API réelle du modèle. L’utilisateur ne peut sélectionner que des valeurs dans les contrôles prédéfinis et ne peut pas injecter de paramètres arbitraires. L’éditeur propose « Advanced: Original JSON » pour modifier directement l’intégralité de la configuration.

** Comment appeler l'outil (modèle pour le canal OpenAI Responses uniquement) ** En cliquant sur « Utiliser l’outil officiel d’OpenAI », sélectionnez web_searchcode_interpreterimage_generation Ces outils intégrés sont exécutés par OpenAI sur le côté du serveur, en remplacement des outils de construction personnalisés du système.

Modèle de modération

Chaque modèle de chat peut ouvrir indépendamment le commutateur « Générer un préavis de vérification » : chaque ** Nouveau message utilisateur ** (Pas d'historique) avant la génération, l'audit est intercepté et le tour se termine par un refus (pas de crédits, pas de crédits).

Modèlecomportement
Mots clés (keyword)La liste des mots-clés « violation » correspond à la liste globale des mots-clés « violation ».
Modèle d’audit (Model)Le « modèle d'audit » préalablement délivré à l'échelle globale est jugé par la liste des types d'infraction.

Configuration de la section globale sur la page « Système > modération » :

champsExpliquer
Mots clés contrefaitsPour chaque ligne, le mode keyword est utilisé, la page affiche le nombre de mots clés en temps réel
Modèle d’auditLe mode modèle est sélectionné dans le modèle de chat ; le mode modèle n'est pas valide lorsque le mode n'est pas sélectionné
Types de violationsUne catégorie par ligne (par exemple, politique, pornographie, violence) comme base de jugement pour le modèle d'audit
Intercepter les signesLe texte affiché à l'utilisateur lors de l'interception

L'appel du modèle d'audit est enregistré dans un journal d'utilisation à des fins de « modération » et peut être consulté en fonction de l'utilisation dans « Données > Utilisation », voir Quantité et analyse

Autorisations et quotas (chat et modèle d’image)

La partition Autorisations accorde des autorisations de modèle par groupe d'utilisateurs et fixe des limites de cycle (nombre ou quota) pour les modèles qui ne sont pas activés lorsqu'aucun groupe est autorisé. Utilisateurs, quotas et crédits

Comptes

Les administrateurs prélèvent selon le modèle, et le système comptabilise le montant réel à chaque appel (et sert de base pour déduire les crédits) :

champsApplicable à KindExpliquer
Prix d’entrée (/1M token)chat / embeddingLe prix par million de jetons
Prix d’exportation (/1M token)chat / embeddingPrix du million de jetons exportés
Lecture en cache $/1MchatLes tokens cachés sont pris individuellement à ce prix et ne se répètent pas avec le prix d'entrée.
Le cache est écrit en $/1MchatÉcrire le prix du token.
Prix des photos uniquesimagePrix en dollars pour chaque graphique généré
Générer le temps de survie (secondes)imageUne seule demande d'image dépasse ce nombre de secondes, c'est-à-dire qu'elle est interrompue et qu'elle indique "générer un délai excessif"; 0 = illimité
Dimensions vectoriellesembeddingLa dimension vectorielle de la sortie du modèle d'embedding, verrouillée lors de la construction de la base de connaissances, doit être remplie avec le document amont

Tous les modèles du canal

Chaque modèle peut spécifier séparément un canal de rechange pour améliorer la disponibilité :

  • ** Déclencheur ** La dernière requête de canal principal comporte une erreur de couche de transmission (diffusion, TLS, réinitialisation de la connexion, dépassement du temps de réponse) ou renvoie HTTP 401 / 403 / 408 / 409 / 429 / 5xx A l’arrière, ** Testez à nouveau le changement de canal. ** L'utilisateur ne voit pas immédiatement l'erreur, seulement l'échec indique l'échec.
  • ** pas déclencher ** L’utilisateur s’arrête, 400 Les erreurs du client que le changement de canal ne peut pas résoudre ne couvrent que la phase de création de la demande et ne sont pas interrompues après le démarrage du flux (200), car le redéploiement du flux n'est pas sécurisé.
  • ** Obligation ** Le canal principal est le canal principal. ** Le même type et le même format d'interface ** (essayez à nouveau d'utiliser le format de message du canal principal, le changement de canal n'est pas un changement de protocole), seulement l'URL et la clé diffèrent.
  • ** Des outils amicaux ** Dans un tour d'appel à outils multiples, une fois que la demande d'amont a échoué, il sera coupé au fond de la poche pour continuer, sans redémarrer l'ensemble de la poche de l'outil; Ce tour est marqué comme le fond de la poche, à condition d'utiliser une poche.

** Observabilité du côté de l’usage **: Chaque enregistrement d'appel est livré avec un canal de service ; les enregistrements en bas de poche affichent le logo « Données > Utilisation ». ** On se souviendra aussi. ** (l'état est d'erreur, zéro token zéro coût, ne représente pas le montant de l'utilisateur), le logo "erreur" permet de visualiser l'erreur d'origine de l'amont, prend en charge le filtrage "erreur uniquement", ce qui facilite la détermination de la santé du canal principal.

La différence avec l’ensemble du modèle.

Le canal de ce chapitre est ** Pas de changement de modèle **« Système > Paramètres mondiaux » inclut également « modèle en bas de page + dépassement de temps (secondes) » : le modèle sélectionné passe à un autre modèle lorsqu’il n’y a pas de sortie dans les N secondes. Définir le site

Modèle global désigné

Plusieurs fonctions au niveau de la plate-forme sont orientées vers un modèle par un paramètre global et sont configurées comme suit :

mise en placePositionnementExpliquer
Modèle de conversationSystème > Configuration globaleNouvel utilisateur / modèle par défaut non sélectionné
Modèle de tâcheSystème > Configuration globaleInterne LLM appelle à unifier le: génération de titre, route de requête, synthèse de compression contextuelle, extraction de mémoire, etc. Recommandé bon marché, rapide, petit modèle suivant les instructions
Description du mot modèleSystème > Configuration globaleDessiner le modèle de texte de l'indicateur de couleur avant ; sauter la couleur en choisissant « aucun »
Modèle d’audit (audit)Système > Configuration globaleLe deuxième modèle de vérification des réponses dans le mode d'examen, idéalement le modèle fort de différents fabricants avec les réponses principales ; choisissez "aucun" lorsque le mode d'examen est fermé.
Modèle + PrécédentSystème > Configuration globaleVoir la section explicative.
Modèle d’auditSystème de modérationModèle de modération Modèle de modération Modèle de modération
Modèle d'embeddingCapacités > DossiersLa base de connaissances et la documentation nécessaires pour kind=embedding Le modèle choisi ; ** Fermeture après première mise en place **Éviter les différences entre le vieux modèle et le nouveau modèle.

Le modèle de tâche, le modèle d'examen, le modèle d'examen et le mot d'ordre de l'image sont enregistrés dans un journal d'utilisation pour chaque appel, ce qui inclut également les coûts de l'utilisateur.

Gestion des étiquettes modèle

Les étiquettes sont utilisées pour la classification et le filtrage des modèles dans le sélecteur de modèle (comme « Recommandations », « Nouveau », « Expériences ») :

  • ** Gestion des étiquettes **: /admin/model-tags (Accès à l'entrée "Administration d'étiquettes" de la liste modèle ou de la page d'édition modèle), il est possible d'ajouter, de renommer ou de supprimer des noms ; la répétition des noms est refusée.
  • ** Distribution des étiquettes **: Dans la section « Étiquettes » de la page de configuration modèle, cliquez sur Sélection, ce qui prend immédiatement effet sur le filtrage des étiquettes du sélecteur.

Suivant Article Suivant: Après le modèle Utilisateurs, quotas et crédits Répartition des autorisations et des quotas de modèle pour différents groupes d'utilisateurs; voir problèmes de connexion amont au niveau de déploiement Proxy inverseFAQ