Firefox
Firefox
Última atualização:
Nota: O recurso Smart Window será disponibilizado gradualmente para a base de usuários do Firefox, começando com usuários nos Estados Unidos e Canadá na versão do Firefox 150.
O Smart Window permite que você conecte seu próprio modelo de IA em vez de usar os fornecidos pelo Firefox. Isso é útil se você quiser mais controle, usar um provedor específico ou executar um modelo localmente em seu dispositivo.
Você pode conectar:
- Um modelo remoto (como o OpenRouter)
- Um modelo local executado em seu dispositivo (como Lemonade Server ou Ollama)
Nota: Se você usar um modelo personalizado, o Smart Window pode não funcionar como esperado. Este recurso e estas instruções são voltados para usuários familiarizados com esses serviços e ferramentas.
Índice
Use um modelo remoto (OpenRouter)
- Crie uma conta no OpenRouter se ainda não tiver uma, em https://openrouter.ai/.
- Gere uma chave de API no OpenRouter e copie-a para um local seguro.
- As chaves de API do OpenRouter começam com
sk-or-v1-.
- As chaves de API do OpenRouter começam com
- Abra a página de modelos do OpenRouter e escolha um modelo que queira usar.
- Anote o ID do modelo. Ex: z-ai/glm-4.5-air:free.
- No Firefox: Na barra de menu no alto da tela, clique em e selecione (ou , em alguns casos).Clique no menu
e selecione .
- Vá para > > .
- Selecione .
- Preencha os campos:
- Nome do modelo: Cole o ID do modelo do OpenRouter, do passo 3.
- Endpoint do modelo com o endpoint da API do OpenRouter, que normalmente é https://openrouter.ai/api/v1.
- Chave de API: Cole sua chave de API do OpenRouter do passo 2.
- Clique em .
- Abra um Smart Window e comece a usar o Assistente.
Dica: Você pode encontrar modelos gratuitos no OpenRouter pesquisando por “free” na página de modelos (link direto).
Use um modelo local
Exemplo: Lemonade Server
- Baixe e instale o Lemonade Server em https://lemonade-server.ai/. Você deve usar a versão 10.2.0 ou mais recente.
- Execute o Lemonade Server e baixe um modelo de sua escolha usando as instruções do aplicativo.
- Em um terminal de linha de comando, defina um tamanho de contexto maior usando o comando
lemonade config set ctx_size=8192. - Recarregue o modelo a partir da interface de usuário ou usando o comando
lemonade unload(da próxima vez que você fizer uma solicitação ao modelo, ele será carregado com suas configurações). - No Firefox: Na barra de menu no alto da tela, clique em e selecione (ou , em alguns casos).Clique no menu
e selecione .
- Vá para > > .
- Selecione .
- Preencha os campos:
- Nome do modelo: Digite o nome do seu modelo do passo 2 (por exemplo, SmolLM3-3B-GGUF).
- Endpoint do modelo: Digite o endpoint do Lemonade Server, que normalmente é http://localhost:13305/api/v1.
- Note que nenhuma chave de API é necessária para o Lemonade Server.
- Clique em .
- Abra um Smart Window e comece a usar o Assistente.
Exemplo: Ollama
- Baixe e instale o Ollama em https://ollama.com/download.
- Execute o Ollama e siga as instruções no site para baixar um modelo local de sua escolha.
- Abra a tela de configurações do Firefox, vá para > > e selecione .
- Preencha os campos:
- Nome do modelo: Digite o nome do seu modelo do passo 2 (ex: qwen3.5:4b).
- Endpoint do modelo: Digite o endpoint do Ollama, que normalmente é http://localhost:11434/v1.
- Note que nenhuma chave de API é necessária para o Ollama.
- Clique em .
- Abra um Smart Window e comece a usar o Assistente.