HAwiki.cz Hledat ↗
Pokročilejší · 8 minut čtení

Místní modely: vlastní AI server

Vlastní AI počítač v domácnosti propojený s Home Assistant, telefonem a lampou.

Ollama a LM Studio pro Mac, připojení k Assist a instalace místního hlasu s Whisper a Piper.

Kontrola zdrojů: · Podle dokumentace

Vlastní model a vlastní hlas

Místní AI zpracovává požadavky doma. Ollama i LM Studio umějí spouštět stažené modely; Home Assistant dál řídí zařízení. Model tvoří odpověď, Whisper přepisuje řeč na text a Piper převádí odpověď na hlas. Jsou to tři samostatné části asistenta Assist.

Vyberte program a počítač

Ollama běží na Linuxu, Windows i macOS. LM Studio nabízí grafické hledání modelů a chat; pro Mac vyžaduje Apple Silicon a macOS 14+, doporučuje 16 GB paměti. Intel Macy nepodporuje.

U obou záleží rychlost a potřebná paměť na modelu a délce konverzace. Server se nesmí uspávat. Internet potřebujete pro instalaci a stažení; s místním modelem může zpracování běžet bez něj. Ollama nabízí i cloudové funkce, proto je níže vypneme.

1. Stáhněte a vyzkoušejte model

Ollama: nainstalujte program z oficiálního webu. V terminálu AI počítače spusťte:

ollama run llama3.1:8b

LM Studio na Macu: nainstalujte aplikaci z lmstudio.ai, vyhledejte model, stáhněte ho a načtěte do chatu.

V obou zkuste českou odpověď a změřte rychlost. Pro ovládání zařízení potřebujete model s podporou nástrojů (tools); Llama 3.1 je příklad pro Ollama. Spolehlivost ověřte.

2. Spusťte server v domácí síti

Ollama: na Linuxu se systemd otevřete sudo systemctl edit ollama.service a vložte:

[Service]
Environment="OLLAMA_HOST=0.0.0.0:11434"
Environment="OLLAMA_NO_CLOUD=1"

Uložte a v terminálu spusťte:

sudo systemctl daemon-reload
sudo systemctl restart ollama

Na Macu nastavte stejné proměnné podle dokumentace Ollama a restartujte aplikaci.

LM Studio na Macu: v Developer načtěte model, zapněte Serve on Local Network a Start server. OpenAI kompatibilní API bývá na http://IP-MACU:1234/v1.

Serveru rezervujte IP, firewall omezte na HA a port nevystavujte internetu.

3. Připojte model k Assist

Ollama: v Nastavení → Zařízení a služby → Přidat integraci vyberte Ollama, adresu například http://192.168.1.50:11434 a model llama3.1:8b. Nahraďte IP adresou serveru; localhost zde znamená počítač HA.

LM Studio: potřebuje integračního konverzačního agenta podporujícího vlastní OpenAI kompatibilní adresu. Oficiální integrace OpenAI ji nepodporuje a integrace Ollama používá jiné API. Propojení LM Studio proto vyžaduje další integraci; přesný postup rozebereme samostatně.

Dostupného agenta vyberte v Nastavení → Hlasoví asistenti, nastavte češtinu a ověřte text v Assist. U Ollama je ovládání experimentální. Zpřístupněte pro první pokus jednu lampu, povolte agentovi ovládání HA a ověřte její skutečné zapnutí.

4. Přidejte Whisper a Piper

Whisper rozpozná vyslovená slova, ale neovládá lampu. Piper přečte text odpovědi, ale nevymýšlí ji. Doplňují jak místního agenta Ollama, tak vhodně připojeného agenta LM Studio.

V Home Assistant OS otevřete Nastavení → Aplikace → Obchod s aplikacemi, nainstalujte Whisper a Piper, zapněte spouštění při startu a obě aplikace spusťte. V Zařízení a služby přidejte nalezené služby Wyoming. Ve starším rozhraní jsou aplikace označené jako doplňky.

U asistenta vyberte Whisper pro řeč na text a Piper pro text na řeč, nastavte češtinu a dostupný český hlas. Model agenta ponechte vybraný. Ověřte nejprve přepis, potom odpověď a přehrání přes telefon nebo hlasové zařízení. Whisper potřebuje výkon; na slabém počítači může reagovat pomalu. U instalace HA v kontejneru provozujte služby zvlášť a připojte je přes Wyoming.

Zdroje

Co dál

Související návody