メインコンテンツまでスキップ

チャンネルとモデル

モデル アクセス 2 レベル:チャンネル(チャンネル)「どこで、どんな契約をすればいいのか」**モデル(モデル)**チャンネルの下に「具体的にどのモデル、どのような能力、どのように価格を計算するか」を貼り付けます。両層はすべてバックアップで保守、データベースを保存し、ゼロコード配信を削除し、保存後は有効になります。

Admin console model list

  • チャンネル ページ:「モデル > チャンネル 」(/admin/channels)
  • モデル ページ:「モデル > モデル 」(/admin/models) 各 モデルには独立した設定ページがあります/admin/models/:id

チャンネル

1 チャンネル = 1 つの Base URL + 1 つの API Key + 1 つのプロトコルタイプ 同じタイプで複数のチャンネルを構築できます (たとえば、2 つの openai チャンネルが異なるゲートウェイ、異なる Key を指します)。

チャンネル フィールド

フィールド説明
名称内部記号を記入し、例えばAnthropic production
タイプopenai / claude / geminiリクエスト体、ツール呼び出し、ストリーム形式を使用するプロトコルを決定する
インターフェイス形式openaiタイプが現れる:chat(古典的なChat Completions) またはresponses(Responses API) は、チャンネルを構築する際に選択し、チャンネルの下にすべてのセッション モデルを統一的に使用します。
Base URL製造元のデフォルトエンドポイントを使用して空の状態で、公式エンドポイント、独自の統一ゲートウェイ、または任意の互換エンドポイントを指すことができます。
API Key暗号化されたストレージで、APIの反応が表示されず、編集時に空の状態で、元のキーを保持する
オープンチャンネルを閉じた後、そのチャンネルのモデルはもはや利用できません。
OpenAI 互換性の端点とは?

DeepSeek、one-api/new-api ゲートウェイ、デプロイ推理サービスなどの「OpenAI 互換性」アップストリームにアクセスする場合:タイプを選択openai接続形式は通常選択chat(多くの第三者対応エンドポイントでは Chat Completions のみを実装していますが、Base URL はそのサービスのアドレスを入力します。 つまり、一般的なアップストリームの 4 つのカテゴリ (Anthropic、OpenAI、Gemini、OpenAI 対応) に対応します。claudeopenai(responses 或 chat)geminiopenai(chat)

openai チャンネルを構築する前に、エンドポイント能力を確認する

端末が Chat Completions のみをサポートしている場合responsesフォーマット、ツール呼び出し、ストリーミングは全体的に間違っています。チャンネルエンドポイント(ゲートウェイを含む)の最低要件はネイティブ 会話 エンドポイントの function calling フィールドと SSE ストリームを送信原生の合意を完全に伝達することをお勧めしますが、そうでないと思考ブロック、キャッシュブロックなどが失われます。

チャンネルの検証と管理

  • 検証チャンネルページには「テスト」ボタンがありません。チャンネルを構築してモデルを貼り付けた後、チャットでモデルに直面することをお勧めします。ツール呼び出しのストリーミングメッセージを起動します(たとえば、インターネットで検索するようにしてください) 1 つの検証プロトコル、キー、ツールが 3 つのことを伝えます。
  • 順序: リストは引き出し順序(または行内の上下順序)をサポートし、順序が永続化されます。
  • 削除チャンネル削除会**すべてのモデルを削除します。**発砲窓が確認された。
  • リスト ラインには、タイプ バッグ、インターフェイス フォーマット バッグ、「無効」バッグ、および Base URL と「設定済みのキー/設定済みのキー」の状態が表示されます。

モデル

新しいモデル 会話ボックスでは、必要な項目のみを作成する必要があります:チャンネル、タイプ(kind)、表示名、request_idアイコン、概要、その他はすべて設定ページで調整します。新規モデル デフォルト:有効、ツールモードnative視覚オープン、流式オープン、ディプリサーチオープン。

モデル ラインのギャップアイコンをクリックして設定ページに移動し、パーティションごとに以下のように説明します。

基本情報

フィールド説明
チャンネルモデル 所属のメインチャンネル
ケーブルチャンネル選べる、下のケーブルチャンネル1セクション
タイプ(kind)chat(会話) /image(画像生成)embedding(ベクトル埋め込み)。 タイプは、次に表示されるパーティションを決定します: 会話 行動はチャットだけ、ベクトル次元は単に埋め込み、単一価格と生成超時間のイメージだけ
表示名ユーザーがモデルピッカーで見る名前は、Claude Opus 4.8
request_idアップストリーム API に実際に発行されたモデル ID (内部 ID を解読) は、claude-opus-4-8
アイテム3つの書き方:空(デフォルトアイコン)、emoji文字、画像URL、直接使用できます。印鑑文書のアップロード
概要モデルピッカーに表示される一行の文字
オープン閉じた後、ユーザーには見えません。
順序を表示数が小さいほど前へ。
標識の制限

アップロードは、PNG、JPEG、SVGのみを受け入れます。単一のファイルが 256 KB を超えない(フロントエンドのプレビュー、サービスサイドの2回目のプレビュー) アイコンは選択器内で約16〜32ピクセルでレンダリングされ、大きな画像は必要ありません。アップロードが成功した後、返されたURLはアイコン入力ボックスに自動的に記入されます。

モデルを削除する際の注意: モデルを参照する既存のセッションはまだ閲覧できますが、送信を続けることはできません。

会話 行動(チャット モデルのみ)

**ツールモード(tool_mode)**プラットフォームツール(検索、Python サンドボックス、グラフ、ナレッジベースの検索など)をモデルにどのように貼るかを決定する3つの値調達方法:

取値行動適用
nativeモデルに属するチャンネルのネイティブの function calling フォーマットでリリースツールを定義、解析ネイティブツール呼び出しをサポートする モデル (デフォルト)
promptオリジナルのフィールドに移行しないで、ヒントの文字列のテキスト プロトコル 説明ツールと呼び出し形式を変更機能呼び出しはサポートされていませんが、指示は既存のモデルに従います。
noneまったくツールなし、純粋な会話ツールが必要または使用できないモデル

3 スイッチ:

スイッチ説明
ビジョン(Vision)画像の入力をサポートしているか? 閉じた後 モデル 画像の添付ファイルを受け取ることができず、視覚能力を必要とする内部プロセスにも関与しません
ストリーム(Stream)閉じたときにブロックされた呼び出しに切り替え、完全な応答を受けた後、一回ずつ前端に押す。個別にSSEをサポートしていないアップストリーム 用
ディプリサーチこのモデルでディプリサーチモードを開くことを許可するか

システム用語: モデル レベルの system prompt は、プラットフォーム ヒントと組み合わせて発行され、特定のモデルに専用者を設定するために使用できます。

パラメータ制御(param_controls): 宣言式定義 モデル ユーザーに表示される調節可能なパラメータ(例えば「深度思考」スイッチ、「思考強度」セレクター) ビジュアルエディターは、以下の2つのコントロールをサポートします。

控件配置項目
スイッチ(toggle)キー名 key、表示テキスト、アイコン、デフォルト値、「開く時/閉じる時」各 JSON パーツ
ダウンロード(select)キー名 key、表示テキスト、アイコン、デフォルト値、いくつかのオプション(値/テキスト/JSONパーツ)は、選択肢として「キーが値に等しい場合にのみ表示」できます。

すべての JSON パーツが表示されます。アップストリーム リクエスト体の実際のパラメータに直接深く統合(クラウド 満載)thinkingOpenAI/Gemini はそれぞれの API ドキュメントに従って記入し、モデルの実際の API ドキュメントに従って作成します。ユーザーは事前定義されたコントロールから値を選択し、任意のパラメータを注入することはできません。エディターは「Advanced: Original JSON」を提供し、全体の構成を直接編集します。

ツール呼び出し方法(OpenAI Responseチャンネルのモデルのみ)「OpenAI オフィシャルツールを使用」を選択すると、web_searchcode_interpreterimage_generationこれらの組み込まれたツールは、OpenAIによってサーバー側で実行され、システムの自作ツールに代わります。

モデル レベル モデリング

各チャット モデル 個別に「事前検証通知を作成する」スイッチを開くことができます: 各モデル新しいユーザーのメッセージ(歴史を含みません) 生成前に監査を経て、コマンドはブロックされ、このラウンドは拒否で終わります(回数なし、クレジットなし)。

モデル行動
関連キーワード(keyword)ヒントは、グローバルな「違反キーワード」リストと一致し、命中は遮断
監査モデル(モデル)グローバルに指定された「監査 モデル」に先送りし、「違反タイプ」リストで放行/遮断判定

グローバルセクションは、「システム > モデレーション」ページで設定します。

フィールド説明
違反のキーワードキーワードモードが使用され、ページがリアルタイムでキーワード数を表示
監査モデルチャット モデルから選択し、model モードが使用され、model モードが「選択されていない」場合に適用されません。
違反の種類政治、ポルノ、暴力など、それぞれのカテゴリが、監査モデルの判断に基づいています。
メッセージを遮断ブロックされるときにユーザーに表示されるテキスト

レビュー モデルの呼び出しは「モデリング」の用途で使用日記を記録し、データ > 使用量の用途を参照してください。使用量と分析

権限と クォータ(チャットと image モデル)

「権限」パーティション ユーザグループごとにユーザー モデル 使用許可を付与し、サイクル割引(回数または割引)を設定し、グループが有効になっていない場合 モデル すべての人に無制限に開きます。ユーザー、 クォータ と クレジット

会計

管理者はモデルごとに割り当て、システムは各呼び出しごとに実際の使用量を記録します(クレジット料金の基盤として):

フィールド適用 Kind説明
入力価格(1Mトークン)chat / embeddingトークンの100万ドルの入力価格
出力価格(1Mトークン)chat / embeddingトークンの100万ドルの出荷価格
キャッシュ読み込み $/1Mchat命中提示キャッシュされたトークンは、この価格で単独で、入力価格と繰り返さない
キャッシュを $/1M に書き込むchatクーポンのトークンの価格を書く
単一写真の価格image図を生成する各ドルの価格
生成超時間(秒)image単一画像のリクエストがその秒数を超える場合は、中断して「生成超過時間」を報告します;0 = 無制限
ベテランサイズembeddingこの 埋め込みモデル 出力のベクトル次元は、 建設 ナレッジベース 時にロックされ、 必ず アップストリーム ドキュメントを記入する

すべてのチャンネルをモデルに

各 モデル は、可用性を向上させるための代替「ポケット チャンネル 」(空 = ポケットなし)を別々に指定できます。

  • 触発メイン チャンネル 前回のリクエストで転送レイヤーエラー(ダイヤモンド、TLS、接続リセット、応答ヘッドタイムの過剰)または HTTP を返します。401 / 403 / 408 / 409 / 429 / 5xx当時、後端チャンネルを自動変更 再度お試しくださいユーザーは間違いをすぐに見ることはなく、ポケットの底でも失敗が失敗を示す。
  • 引き起こさないユーザーが停止し、400チャンネルを変更することもできないクライアントのエラーを修正します。リクエストの作成段階のみをカバーし、ストリーム開始(200)後に再試行を中断し、既にストリームを再起動していないため安全ではありません。
  • 縛りチャンネルはメインチャンネルと一緒です。同じタイプ、同じインターフェイス形式(チャンネルを変えることはプロトコルを変えることではありません) URL と Key だけが異なります。設定ページのダウンロードは、条件を満たすチャンネルのみをリストします。
  • 循環友好ツール複数のツール呼び出しの中、任意のアップストリームのリクエストの失敗は、ツールの全輪を再起動せず、ポケットの底まで引き続き、ポケットの底にマークされます。

用量側の観測性各呼び出しレコードにはサービスチャンネルが付属し、「データ > 使用量」に「使用量」ロゴが表示されます。しかも思い出します。(状態はエラー、ゼロトークンゼロコスト、ユーザ割引は含まれていません)、「エラー」ロゴをクリックすると、アップストリームのオリジナルのエラーを表示し、「エラーのみ」フィルタをサポートし、メインチャンネルの健康度を判断できます。

全局の「ポケット底モデル」との違い

このセクションのチャンネルは路線変更なし モデル変更「システム > グローバル 設定」には「モデル + 超過時間(秒)」が表示されます: 選択されたモデルは、N秒以内に出力がない場合に別のモデルに切り替えられます。場所設定

全局モデル指定

いくつかのプラットフォームレベルの機能は、それぞれグローバルな設定でモデルを指し、次のように配置されています。

設定位置説明
デフォルト 会話 モデルシステム > 全局設定新しいユーザー/未選択のデフォルトモデル
タスクモデルシステム > 全局設定内部LLMの呼び出しは、それを統合:タイトル生成、クエリルーティング、コンテキスト圧縮の概要、メモリ抽出など。推奨は安く、速く、指示に従って良い小型モデル
写真の言葉 モデルシステム > 全局設定塗りつぶしの文字を描く モデル ; 「無」を選択すると塗りつぶしをジャンプ
監査(監査)モデルシステム > 全局設定審査モードで答えを確認する2番目のモデルは、理想的には主回答と異なるメーカーの強力なモデルで、「なし」を選択すると全駅閉鎖審査モード
ポケット底 モデル + 頭文字超時間システム > 全局設定上段の説明
監査モデルシステム > モデリングモデル モデル モデル モデル モデル
埋め込みモデル能力 > ファイルナレッジベース ドキュメントとベクトリ化は、必要からkind=embeddingモデルを選択し、最初の配置後にロック古いモデルと新しいモデルの違いを避ける

タスク モデル、監査 モデル、監査 モデル、画像 ヒント モデルの毎回の呼び出しは、それぞれの用途に応じて使用量のログを記録し、その費用の一部もユーザーコストカルチャーに含まれます。

モデル ラベル管理

モデルピッカーでモデルを分類し、フィルタリングするためのタグ(「推奨」、「New」、「実験」など):

  • ラベル管理:/admin/model-tags(モデル リストまたはモデル 編集 ページの「管理タグ」入力) で、追加、再命名、削除をサポートし、名前の繰り返しが拒否されます。
  • 配布ラベル: モデル 設定ページの「ラベル」パーティションで選択し、選択器のラベルフィルターに即時有効になります。

次 次の投稿: モデルが届いたら、ユーザー、 クォータ と クレジット異なる ユーザー グループ モデル 権限と割り当て; デプロイレベル アップストリーム 接続の問題を参照リバースプロキシFAQ