Open-WebUI Γ¨ configurato per usare DUE sorgenti di modelli:
βββββββββββββββββββββββββββββββββββββββββββββββββββββββββββββββ
β Open-WebUI β
β (localhost:3055) β
ββββββββββββββ¬βββββββββββββββββββββββββββββββ¬ββββββββββββββββββ
β β
β β
ββββββββββΌβββββββββ ββββββββββΌβββββββββββββ
β Ollama β β LiteLLM Proxy β
β (localhost) β β (localhost:4000) β
β β β β
β β’ llama3.2 β β β’ Claude (paid) β
β β’ codellama β β β’ GPT (paid) β
β β’ gemma3 β β β’ Ollama (local) β
β β’ mistral β β β’ Azure, etc. β
βββββββββββββββββββ βββββββββββββββββββββββ
LOCALE MULTI-PROVIDER
GRATIS (alcune a pagamento)
- Apri: http://localhost:3055
- Primo accesso: Crea un account (diventerai automaticamente admin)
- Dopo il primo utente, le registrazioni sono disabilitate per sicurezza
Open-WebUI vede automaticamente i modelli Ollama:
- β llama3.2:3b
- β llama3.2:latest
- β codellama:latest
- β gemma3:latest
- β embeddinggemma:latest
Questi funzionano subito, nessuna configurazione richiesta!
Per usare modelli esterni (Claude, GPT, ecc.) tramite LiteLLM:
-
In Open-WebUI, vai a:
- Click sull'icona del profilo (in alto a destra)
- Settings β Connections (o Admin Panel β Settings)
-
Aggiungi OpenAI API (LiteLLM Γ¨ compatibile):
OpenAI API Base URL: http://litellm:4000/v1 OpenAI API Key: ${LITELLM_MASTER_KEY} -
Salva e ricarica la pagina
I modelli Claude che vedi nel database di LiteLLM sono disponibili, ma non funzionano senza chiavi API.
-
Ottieni una API key:
- Vai su: https://console.anthropic.com/
- Crea un account
- Genera una API key
- Costa: ~$15 per 1M token input (Claude Sonnet)
-
Aggiungi la chiave nel file
.env:nano /opt/litellm/.env
Decommenta e aggiungi:
ANTHROPIC_API_KEY="sk-ant-tua-chiave-qui" -
Riavvia LiteLLM:
docker compose restart litellm
-
Ora Claude funzionerΓ sia via API LiteLLM che in Open-WebUI!
-
Ottieni una API key:
- Vai su: https://platform.openai.com/
- Crea un account e aggiungi credito
- Genera una API key
- Costa: ~$15 per 1M token input (GPT-4o)
-
Aggiungi nel
.env:OPENAI_API_KEY="sk-tua-chiave-openai-qui" -
Riavvia:
docker compose restart litellm
- Apri Open-WebUI: http://localhost:3055
- Nella chat, clicca sul selettore modelli (in alto)
- Dovresti vedere:
- Sezione Ollama: modelli locali
- Sezione OpenAI (se configurato): modelli via LiteLLM
Se i modelli LiteLLM non appaiono automaticamente:
-
Settings β Admin Panel β Connections
-
Aggiungi OpenAI Connection:
- URL:
http://litellm:4000/v1 - API Key:
${LITELLM_MASTER_KEY} - β Enable
- URL:
-
Verifica disponibilitΓ modelli:
- Settings β Admin Panel β Models
- Dovresti vedere tutti i modelli configurati in LiteLLM
LiteLLM ha i modelli Claude pre-configurati nel database, ma sono inattivi perchΓ©:
- β Non hai una chiave API di Anthropic nel file
.env - β Senza chiave, LiteLLM non puΓ² contattare i server di Anthropic
- β Soluzione: Aggiungi la chiave API (vedi sopra) oppure usa solo modelli Ollama locali
Se non vuoi pagare per Claude/GPT, usa solo i modelli Ollama locali:
# GiΓ installati:
docker exec ollama ollama list
# Scarica altri modelli gratis:
docker exec ollama ollama pull mistral:7b # Ottimo generale
docker exec ollama ollama pull qwen2.5:7b # Eccellente per coding
docker exec ollama ollama pull deepseek-coder:6.7b # Specializzato coding
docker exec ollama ollama pull llava:latest # Per analizzare immagini
docker exec ollama ollama pull phi3:medium # Leggero e veloce
# Modelli piΓΉ grandi (usano quasi tutta la VRAM):
docker exec ollama ollama pull llama3.1:70b-q4 # Quantizzato 4-bit# Usa lo script automatico
./add_ollama_models.sh
# Oppure aggiungi manualmente ogni nuovo modello:
curl -X POST http://localhost:4000/model/new \
-H "Authorization: Bearer ${LITELLM_MASTER_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model_name": "mistral",
"litellm_params": {
"model": "ollama_chat/mistral:7b",
"api_base": "http://ollama:11434"
}
}'In Open-WebUI:
- Crea una nuova chat
- Seleziona modello:
llama3.2:3bollama3.2:latest - Scrivi: "Ciao!"
- β Dovrebbe rispondere immediatamente (modello locale)
Prima assicurati che LiteLLM sia configurato in Open-WebUI:
Settings β Admin Panel β Connections β OpenAI API:
Base URL: http://litellm:4000/v1
API Key: ${LITELLM_MASTER_KEY}
Poi:
- Seleziona modello:
llama3.2-3b(tramite LiteLLM) - Scrivi: "Test"
- β Dovrebbe funzionare (stesso modello, ma tramite proxy)
In Open-WebUI, nel selettore modelli dovresti vedere:
Ollama (modelli locali):
- llama3.2:3b
- llama3.2:latest
- codellama:latest
- gemma3:latest
- embeddinggemma:latest
OpenAI/LiteLLM (se configurato):
- llama3.2-3b (tramite LiteLLM)
- llama3.2 (tramite LiteLLM)
- codellama (tramite LiteLLM)
- gemma3 (tramite LiteLLM)
- claude-sonnet-4 (
β οΈ richiede ANTHROPIC_API_KEY) - claude-opus-4 (
β οΈ richiede ANTHROPIC_API_KEY) - gpt-4 (
β οΈ richiede OPENAI_API_KEY)
Carica documenti per farli analizzare dall'AI:
- Click su "+" β Upload Document
- Carica PDF, DOCX, TXT, MD
- Seleziona modello embedding:
embeddinggemma:latest - Fai domande sui documenti caricati
Abilita ricerca web (se configurata):
- Settings β Features β Web Search
- Permette all'AI di cercare informazioni online
Se configuri un modello di generazione immagini:
- Ollama:
docker exec ollama ollama pull stable-diffusion - Oppure usa DALL-E tramite OpenAI (a pagamento)
Open-WebUI supporta input vocale:
- Settings β Audio β Enable Speech-to-Text
- Richiede configurazione Whisper o servizi cloud
Soluzione:
# Verifica che Ollama funzioni
docker exec ollama ollama list
# Riavvia Open-WebUI
docker compose restart ui
# Controlla logs
docker compose logs uiSoluzione:
-
Verifica che LiteLLM funzioni:
curl http://localhost:4000/model/info \ -H "Authorization: Bearer ${LITELLM_MASTER_KEY}" -
Configura connessione OpenAI in Open-WebUI:
- Settings β Connections
- URL:
http://litellm:4000/v1 - Key:
${LITELLM_MASTER_KEY}
Causa: Non hai configurato le chiavi API nel file .env
Soluzione:
- Ottieni chiavi API da Anthropic/OpenAI
- Aggiungi nel
.env - Riavvia:
docker compose restart litellm
| Scenario | Soluzione | Costo |
|---|---|---|
| Chat generale gratis | Ollama: llama3.2, mistral | π Gratis |
| Coding gratis | Ollama: codellama, qwen2.5 | π Gratis |
| Massima qualitΓ (paid) | Claude Sonnet 4 via LiteLLM | π° ~$15/1M token |
| Analisi immagini gratis | Ollama: llava | π Gratis |
| Embeddings per RAG | Ollama: embeddinggemma | π Gratis |
| Multi-provider + fallback | LiteLLM Proxy | π + π° (dipende) |
Configurazione consigliata per iniziare (GRATIS):
- β Usa solo modelli Ollama locali
- β
Scarica modelli utili:
mistral:7b,qwen2.5:7b - β
Configura RAG con
embeddinggemma - β Testa tutto tramite Open-WebUI
Quando sei pronto per modelli cloud (A PAGAMENTO):
- π° Ottieni API key di Anthropic o OpenAI
- π° Aggiungi nel
.env - π° Riavvia LiteLLM
- π° Usa Claude/GPT per task complessi
La configurazione attuale ti permette di usare modelli AI potenti completamente GRATIS sulla tua GPU! π
Per domande: consulta SETUP_GUIDA.md e ESEMPI_USO.md