Mit Smart Window können Sie Ihr eigenes KI-Modell verbinden, anstatt die von Firefox bereitgestellten zu verwenden. Die Hauptanforderung für die Funktionstüchtigkeit ist, dass der Server, mit dem Sie sich verbinden, mit der OpenAI-API kompatibel sein muss. Dies ist hilfreich, wenn Sie mehr Kontrolle wünschen, einen bestimmten Anbieter nutzen oder ein Modell lokal auf Ihrem Gerät ausführen möchten.
Sie können entweder Folgendes verbinden:
- Ein Remote-Modell (wie OpenRouter)
- Ein lokales Modell, das auf Ihrem Gerät ausgeführt wird (wie Lemonade Server oder Ollama)
Inhaltsverzeichnis
Ein Remote-Modell verwenden (OpenRouter)
- Erstellen Sie ein OpenRouter-Konto unter https://openrouter.ai/, falls Sie noch keines haben.
- Generieren Sie einen API-Schlüssel in OpenRouter und kopieren Sie ihn an einen sicheren Ort.
- OpenRouter-API-Schlüssel beginnen mit
sk-or-v1-.
- OpenRouter-API-Schlüssel beginnen mit
- Öffnen Sie die OpenRouter-Modellseite und wählen Sie ein Modell, das Sie verwenden möchten.
- Notieren Sie sich dessen Modell-ID. Bspw.: z-ai/glm-4.5-air:free.
- In Firefox: Klicken Sie in der Menüleiste am oberen Bildschirmrand auf und wählen Sie dann .Klicken Sie auf die Menüschaltfläche
und wählen Sie .
- Gehen Sie zu > > Assistant model.
- Wählen Sie Custom: Use your own LLM.
- Füllen Sie die Felder aus:
- Modellname: Fügen Sie die OpenRouter-Modell-ID aus Schritt 3 ein.
- Modell-Endpunkt: Geben Sie den OpenRouter-API-Endpunkt ein, der normalerweise https://openrouter.ai/api/v1 lautet.
- API-Schlüssel: Fügen Sie Ihren OpenRouter-API-Schlüssel aus Schritt 2 ein.
- Klicken Sie auf .
- Öffnen Sie ein Smart Window und beginnen Sie, den Assistenten zu verwenden.
Ein lokales Modell verwenden
Beispiel: Lemonade Server
- Laden Sie Lemonade Server unter https://lemonade-server.ai/ herunter und installieren Sie es. Sie müssen Version 10.2.0 oder neuer verwenden.
- Führen Sie Lemonade Server aus und laden Sie ein Modell Ihrer Wahl gemäß den Anweisungen der App herunter.
- Legen Sie in einem Befehlszeilen-Terminal mit dem Befehl
lemonade config set ctx_size=8192eine größere Kontextgröße fest. - Laden Sie das Modell über die Benutzeroberfläche oder mit dem Befehl
lemonade unloadneu (wenn Sie das nächste Mal eine Anfrage an das Modell stellen, wird es mit Ihren Einstellungen geladen). - In Firefox: Klicken Sie in der Menüleiste am oberen Bildschirmrand auf und wählen Sie dann .Klicken Sie auf die Menüschaltfläche
und wählen Sie .
- Gehen Sie zu > > Assistant model.
- Wählen Sie Custom: Use your own LLM.
- Füllen Sie die Felder aus:
- Modellname: Geben Sie Ihren Modellnamen aus Schritt 2 ein (zum Beispiel SmolLM3-3B-GGUF).
- Modell-Endpunkt: Geben Sie den Lemonade Server-Endpunkt ein, der normalerweise http://localhost:13305/api/v1 lautet.
- Beachten Sie, dass für Lemonade Server kein API-Schlüssel erforderlich ist.
- Klicken Sie auf .
- Öffnen Sie ein Smart Window und beginnen Sie, den Assistenten zu verwenden.
Beispiel: Ollama
- Laden Sie Ollama unter https://ollama.com/download herunter und installieren Sie es.
- Führen Sie Ollama aus und folgen Sie den Anweisungen auf der Website, um ein lokales Modell Ihrer Wahl herunterzuladen.
- Öffnen Sie die Firefox-Einstellungen und gehen Sie zu > > Assistant model und wählen Sie Custom: Use your own LLM.
- Füllen Sie die Felder aus:
- Modellname: Geben Sie Ihren Modellnamen aus Schritt 2 ein (Bspw.: qwen3.5:4b).
- Modell-Endpunkt: Geben Sie den Ollama-Endpunkt ein, der normalerweise http://localhost:11434/v1 lautet.
- Beachten Sie, dass für Ollama kein API-Schlüssel erforderlich ist.
- Klicken Sie auf .
- Öffnen Sie ein Smart Window und beginnen Sie, den Assistenten zu verwenden.