B2BB2B LLM

GitHub Copilot

Verbinden Sie GitHub Copilot Chat, VS Code-Agenten und Copilot CLI mit Model Gate mit BYOK und einem benutzerdefinierten OpenAI-kompatiblen Endpunkt.

GitHub Copilot durch Model Gate

GitHub Copilot und Visual Studio Code-Unterstützung Bringen Sie Ihren eigenen Schlüssel mit (BYOK) Modelle. Model Gate kann als OpenAI-kompatibler benutzerdefinierter Endpunkt für Copilot-Chat- und Agenten-Workflows verwendet werden.

Für VS Code ist das empfohlene Setup das Benutzerdefinierter Endpunkt Anbieter mit dem Antwort-API. Verwenden Sie Chat Completions nur, wenn ein ausgewähltes Modell oder ein ausgewählter Workflow diese API-Familie ausdrücklich erfordert.

Erforderliche Werte

API key: mg_live_...
Responses endpoint: https://api.model-gate.com/v1/responses
Chat Completions endpoint: https://api.model-gate.com/v1/chat/completions
Base URL for Copilot CLI: https://api.model-gate.com/v1

Erstellen Sie einen dedizierten API-Schlüssel im Modell Gate-Bedienfeld. Bevorzugen Sie für eine Team- oder Workstation-Integration einen separaten Schlüssel anstelle der Wiederverwendung eines unabhängigen Produktionsschlüssels, damit Grenzwerte, Anforderungsverlauf, Rotation und Widerruf weiterhin leicht zu überwachen sind.

Listen Sie aktuell aktivierte Modelle auf, bevor Sie Copilot konfigurieren:

curl https://api.model-gate.com/v1/models \
  -H "Authorization: Bearer mg_live_..."

Verwenden Sie eine aktivierte kanonische Modell-ID oder einen vom Administrator verwalteten Alias, der von diesem Endpunkt zurückgegeben wird.

VS-Code: Empfohlene benutzerdefinierte Endpunkteinrichtung

Aktuelle VS-Code-Versionen stellen BYOK-Modelle im Sprachmodell-Editor zur Verfügung.

1. Öffnen Sie die Befehlspalette. 2. Laufen Chat: Sprachmodelle verwalten. 3. Wählen Sie Modelle hinzufügen. 4. Wählen Sie Benutzerdefinierter Endpunkt. 5. Verwenden Sie einen Gruppennamen wie z Model Gate. 6. Geben Sie den Model Gate-API-Schlüssel ein, wenn VS Code die Provider-Anmeldeinformationen anfordert. 7. Wählen Sie Antworten als API-Typ, wenn das ausgewählte Modell die Responses-API unterstützt. 8. Konfigurieren Sie das Modell mit dem expliziten Model Gate-Endpunkt und speichern Sie das generierte Ergebnis chatLanguageModels.json. 9. Wählen Sie das Model Gate-Modell aus der Chat-Modellauswahl aus.

Verwenden Sie nicht die veraltete Version github.copilot.chat.customOAIModels Einstellung für eine neue Konfiguration. Der aktuelle Anbieter für benutzerdefinierte Endpunkte unterstützt Antworten, Chat-Abschlüsse und Endpunkte im Nachrichtenstil und ist der bevorzugte VS-Code-Konfigurationspfad.

Empfohlene Antwortkonfiguration

Das generierte chatLanguageModels.json kann eine Konfiguration wie diese verwenden:

[
  {
    "name": "Model Gate",
    "vendor": "customendpoint",
    "apiKey": "${input:modelGateApiKey}",
    "apiType": "responses",
    "models": [
      {
        "id": "gpt-5.4",
        "name": "GPT-5.4 through Model Gate",
        "url": "https://api.model-gate.com/v1/responses",
        "toolCalling": true
      }
    ]
  }
]

Ersetzen gpt-5.4 mit einem aktivierten Model Gate-Modell oder Alias.

VS Code sendet den API-Schlüssel normalerweise als:

Authorization: Bearer mg_live_...

Dies ist das korrekte Authentifizierungsformular für die Model Gate OpenAI-kompatible API.

Chat-Abschlüsse-Fallback

Wenn der ausgewählte Workflow Chat-Abschlüsse erfordert, konfigurieren Sie das Modell wie folgt:

[
  {
    "name": "Model Gate",
    "vendor": "customendpoint",
    "apiKey": "${input:modelGateApiKey}",
    "apiType": "chat-completions",
    "models": [
      {
        "id": "MODEL_ID",
        "name": "MODEL_ID through Model Gate",
        "url": "https://api.model-gate.com/v1/chat/completions",
        "toolCalling": true
      }
    ]
  }
]

Bevorzugen Sie eine explizite vollständige Endpunkt-URL. Dies vermeidet Mehrdeutigkeiten, wenn VS Code das URL-Pfad-Inferenzverhalten ändert.

Empfehlungen zur Modellfähigkeit

Copilot-Agent-Workflows erfordern ein Modell, das Tools verwenden kann. Für eine zuverlässige Agentennutzung über Model Gate:

- Wählen Sie ein verifiziertes Modell Werkzeug-/Funktionsaufruf Unterstützung; - Wählen Sie ein Modell mit Streaming Unterstützung; - Verwenden Sie für Bildanhänge ein verifiziertes Modell Vision/Bildeingabe Fähigkeit und Satz "vision": true für dieses Modell; - Verwenden Sie ein großes Kontextmodell für die Agentenarbeit im Repository-Maßstab. GitHub empfiehlt derzeit mindestens ein 128.000-Token-Kontextfenster für benutzerdefinierte Copilot-CLI-Modelle; - Machen Sie keine Werbung toolCalling, vision, Argumentation, Kontext oder Ausgabegrenzen, die über der tatsächlichen Leistungsfähigkeit des ausgewählten Model Gate-Modells liegen; - Testen Sie das genaue Modell auf dem Model Gate Playground, bevor Sie es für ein großes Team freigeben.

Wenn Sie manuell einstellen contextWindow, maxInputTokens, oder maxOutputTokens Verwenden Sie in VS Code die Grenzwerte des ausgewählten Modells aus dem authentifizierten Modell /models Seite oder von GET /v1/models; errate sie nicht. Model Gate ordnet die Felder wie folgt zu:

VS-Code-EinstellungFeld „Modelltor“.
contextWindowcontext_window (gleicher Wert wie context_length)
maxInputTokensmax_input_tokens
maxOutputTokensmax_output_tokens

Die authentifizierte /models Seite zeigt diese als Kontext, Maximaler Eingang, Und Maximale Leistung wenn der entsprechende Wert bekannt ist. So prüfen Sie das API-Objekt direkt:

curl -s https://api.model-gate.com/v1/models \
  -H "Authorization: Bearer mg_live_..." \
| jq '.data[] | select(.id=="MODEL_ID") | {context_window,max_input_tokens,max_output_tokens}'

Ein Wert von 0 bedeutet, dass Model Gate keinen konfigurierten Wert für diesen Grenzwert hat. Lassen Sie in diesem Fall die entsprechende manuelle VS-Code-Einstellung deaktiviert, anstatt sie einzugeben 0 oder eine Grenze erfinden.

Gebrauchsmuster in VS Code

VS Code verwendet auch kleinere Hintergrundmodelle für Aufgaben wie Titel, Zusammenfassungen, Festschreibungsnachrichten, Umbenennungsvorschläge und Absichtserkennung.

Wenn Sie Model Gate BYOK ohne ein von GitHub gehostetes Copilot-Modell verwenden, konfigurieren Sie Folgendes:

chat.utilityModel
chat.utilitySmallModel

Wählen Sie ein schnelles und kostengünstiges Model Gate-Modell für chat.utilitySmallModel. Normalerweise bringt es keinen Vorteil, für das größte Argumentationsmodell für die Generierung von Commit-Nachrichten oder andere einfache Hilfsarbeiten zu bezahlen.

Der chat.byokUtilityModelDefault Die Einstellung kann auch steuern, ob die Versorgungsarbeit dem ausgewählten BYOK-Hauptagentenmodell folgt, GitHub Copilot Versorgungsmodelle verwendet oder keinen Standard hat.

Copilot-CLI

GitHub Copilot CLI unterstützt OpenAI-kompatible benutzerdefinierte Anbieter über Umgebungsvariablen.

Linux oder macOS

export COPILOT_PROVIDER_TYPE="openai"
export COPILOT_PROVIDER_BASE_URL="https://api.model-gate.com/v1"
export COPILOT_PROVIDER_API_KEY="mg_live_..."
export COPILOT_MODEL="MODEL_ID"

Copilot ```

Windows PowerShell

$env:COPILOT_PROVIDER_TYPE = "openai"
$env:COPILOT_PROVIDER_BASE_URL = "https://api.model-gate.com/v1"
$env:COPILOT_PROVIDER_API_KEY = "mg_live_..."
$env:COPILOT_MODEL = "MODEL_ID"

Copilot ```

Für Copilot CLI muss das ausgewählte Modell unterstützen Tool-Aufruf und Streaming. Verwenden Sie ein aktiviertes Model Gate-Modell oder einen Alias ​​und testen Sie es, bevor Sie die Konfiguration dauerhaft machen.

Platzieren Sie den API-Schlüssel nicht im Shell-Verlauf, in einer Repository-Datei oder in einem Commit .env. Verwenden Sie nach Möglichkeit Ihren Betriebssystem-Anmeldeinformationsspeicher, eine geschützte Shell-Umgebung oder Tools zur Verwaltung von Unternehmensgeheimnissen.

Copilot Business und Enterprise

GitHub unterstützt über BYOK auch benutzerdefinierte Organisations-/Unternehmensmodelle. GitHub listet derzeit auf OpenAI-kompatible Anbieter als unterstützte Anbieterkategorie für benutzerdefinierte Modelle. Diese Funktion auf Organisationsebene wird durch die GitHub-Richtlinie verwaltet und befindet sich je nach Copilot-Oberfläche möglicherweise in der Vorschau.

Für eine verwaltete Organisation:

1. Aktivieren Sie GitHub Sonderanfertigungen / BYOK Richtlinie, die für Ihren Copilot-Plan erforderlich ist. 2. Fügen Sie einen benutzerdefinierten OpenAI-kompatiblen Anbieter/ein benutzerdefiniertes OpenAI-kompatibles Modell in den Copilot-Modelleinstellungen der Organisation oder des Unternehmens hinzu. 3. Verwenden Sie einen dedizierten Model Gate-API-Schlüssel mit den minimal erforderlichen Model Gate-Berechtigungen und -Grenzwerten. 4. Verwenden Sie den Model Gate-Endpunkt und eine Modell-ID, auf die Ihr Konto zugreifen kann. 5. Validieren Sie das Modell in den Copilot-Chat-/Agent-Workflows, bevor Sie es in der Modellauswahl der Organisation allgemein verfügbar machen.

GitHub kann die Benutzeroberfläche des benutzerdefinierten Organisationsmodells ändern, während sich die Funktion weiterentwickelt. Befolgen Sie für die genauen Feldbezeichnungen die aktuelle GitHub-Verwaltungsoberfläche, anstatt sich auf Screenshots einer älteren Version zu verlassen.

Sicherheits- und Kostenempfehlungen

– Erstellen Sie einen dedizierten Model Gate-Schlüssel für Copilot, anstatt einen Allzweckschlüssel zu teilen. - Wenden Sie ein RPM-Limit, ein Parallelitätslimit, ein Ausgabenlimit oder eine Geschäftsgruppenrichtlinie an, die für den Entwickler-Agent-Verkehr geeignet ist. - Drehen Sie den Schlüssel sofort um, wenn er in die Quellcodeverwaltung, den Chat, Protokolle oder ein Problem eingefügt wird. - Niemals festlegen mg_live_... In chatLanguageModels.json; Lassen Sie VS Code die Anmeldeinformationen speichern oder auf eine Eingabe/ein Geheimnis verweisen. - Lassen Sie destruktive Tool-Genehmigungen aktiviert, es sei denn, Ihre Entwicklungsumgebung ist absichtlich in einer Sandbox untergebracht. - Der Agentenmodus kann viele Modell-/Werkzeugdrehungen aus einer Benutzeranweisung generieren. Legen Sie Model Gate-Ausgabengrenzen fest, bevor Sie teure Reasoning-Modelle für große Repositories aktivieren. - Verwenden Sie ein kleineres Dienstprogrammmodell für Hintergrundaufgaben und reservieren Sie größere Argumentationsmodelle für Planung, Debugging oder komplexe Refaktoren. - Überprüfen Sie den Model Gate-Anfrageverlauf, wenn Sie unerwartete Kosten, Latenz, Ratenbegrenzung oder Anbieterfehler untersuchen.

Was BYOK ersetzt und was nicht

Ein Model Gate BYOK-Modell kann VS-Code-Chat, Agent-Workflows, Tools und Dienstprogrammaufgaben unterstützen, wenn das Modell die erforderlichen Funktionen unterstützt.

Das tut es nicht Ersetzen Sie automatisch jedes GitHub Copilot-Feature. Abhängig von der aktuellen VS Code/GitHub-Version erfordern Funktionen wie standardmäßige Inline-Codevervollständigungen, semantische Suche, Einbettungen oder andere von GitHub gehostete Dienste möglicherweise weiterhin eine GitHub-Authentifizierung, einen Copilot-Plan oder eine GitHub-Infrastruktur.

Verwenden Sie daher Model Gate BYOK, wenn es Ihr Ziel ist, das zu kontrollieren Chat-/Agent-Modellpfad und seine Abrechnung, nicht als Annahme, dass der gesamte Netzwerkverkehr GitHub Copilot über Model Gate geleitet wird.

Überprüfen Sie Model Gate, bevor Sie Copilot testen

Antworten

curl https://api.model-gate.com/v1/responses \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MODEL_ID",
    "input": "Reply with exactly: Model Gate OK"
  }'

Chat-Abschlüsse

curl https://api.model-gate.com/v1/chat/completions \
  -H "Authorization: Bearer mg_live_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MODEL_ID",
    "messages": [{"role": "user", "content": "Reply with exactly: Model Gate OK"}]
  }'

Wenn diese Anfragen fehlschlagen, korrigieren Sie die API-Schlüssel-/Modell-/Model-Gate-Richtlinie, bevor Sie Copilot debuggen.

Fehlerbehebung

ProblemAuflösung
Das Modell erscheint nicht im AgentenmodusStellen Sie sicher, dass das Modell mit Tool-Aufrufen konfiguriert ist und dass das tatsächliche Model Gate-Modell Funktions-/Tool-Aufrufe unterstützt. Starten Sie VS Code neu, nachdem Sie die Anbieterkonfiguration geändert haben.
401 invalid_api_keyGeben Sie den entsprechenden Model Gate-Schlüssel erneut ein oder drehen Sie ihn. Bestätigen Sie, dass Copilot sendet Authorization: Bearer ....
404 oder falscher EndpunktVerwenden Sie für Antworten das explizite https://api.model-gate.com/v1/responses; für Chat-Abschlüsse verwenden /v1/chat/completions.
Modell wurde nicht gefundenAbfrage /v1/models und verwenden Sie eine aktivierte kanonische ID oder einen Alias.
Der Agent kann keine Tools verwendenWählen Sie ein Modell mit verifiziertem Werkzeug-/Funktionsaufruf aus. Copilot CLI erfordert auch Streaming.
Bildanhang wird ignoriert/abgelehntVerwenden Sie ein Modell mit verifizierter Bildeingabe-/Vision-Fähigkeit und konfigurieren Sie es vision: true Nur für dieses Modell.
Dienstprogrammfunktionen funktionieren nicht mit der Nur-BYOK-EinrichtungKonfigurieren chat.utilityModel Und chat.utilitySmallModel zu verfügbaren BYOK-Modellen.
Inline-Vervollständigungen verwenden weiterhin GitHub oder erfordern eine AnmeldungErwartet: BYOK kontrolliert in erster Linie den Chat-/Agenten-/Dienstprogramm-Verkehr, nicht alle Copilot-Funktionen.
Anfragen sind unerwartet teuerVerwenden Sie ein kleineres Modell für Hilfsarbeiten, reduzieren Sie gegebenenfalls die Argumentation und konfigurieren Sie Model Gate-Ausgaben-/RPM-/Parallelitätsgrenzen.

Aktuelle Upstream-Referenzen

GitHub und VS Code können die BYOK-Konfiguration zwischen Releases ändern. Überprüfen Sie Folgendes, um das aktuelle Upstream-Verhalten zu ermitteln:

- https://code.visualstudio.com/docs/agent-customization/language-models - https://docs.github.com/en/copilot/concepts/models/bring-your-own-key - https://docs.github.com/en/copilot/how-tos/copilot-cli/customize-copilot/use-byok-models - https://docs.github.com/en/copilot/how-tos/administer-copilot/manage-for-organization/enable-custom-models