conjurer: wepnij oba boty w Ollamę (192.168.1.72:11434) #23

Merged
gitea merged 2 commits from conjurer-ollama-endpoint into master 2026-08-24 15:40:07 +00:00
Owner

Paruje się z conjurer#25 (backend Ollama + wybór modelu).

Dodaje CONJURER_OLLAMA_URL do bota testowego i deploy-bota. Klucza API dla Ollamy nie ma — endpoint jest całą konfiguracją — i dopóki nie jest ustawiony, backend odmawia wyboru. Czyli to jest ten przełącznik, który go włącza.

⚠️ Zweryfikowane z LAN-u przed commitem: port jeszcze nie odpowiada

192.168.1.72 odpowiada na ping (0.4 ms), ale skan pokazuje otwarty wyłącznie port 22. 11434 odrzuca połączenie. To klasyka: Ollama domyślnie binduje się do 127.0.0.1:11434, więc nie jest osiągalna spoza hosta.

Ta zmienna jest poprawna, ale bezczynna, dopóki serwer nie zacznie nasłuchiwać na sieci:

sudo systemctl edit ollama.service
# [Service]
# Environment="OLLAMA_HOST=0.0.0.0:11434"
sudo systemctl daemon-reload && sudo systemctl restart ollama

Weryfikacja: curl -s http://192.168.1.72:11434/v1/models

Jeśli Ollama chodzi w kontenerze — zamiast tego opublikuj port (-p 11434:11434) i ustaw OLLAMA_HOST=0.0.0.0 w środowisku kontenera.

Zachowanie do czasu otwarcia portu

Nieszkodliwe: $gadaj_teraz ollama przełączy się (klient powstaje bez testu łączności), ale odpowiedzi i $modele_ai zwrócą błąd połączenia — czytelny, z komunikatem. Nic innego nie jest dotknięte.

kubectl kustomize czysto (10 obiektów, zmienna w obu botach).

🤖 Generated with Claude Code

Paruje się z conjurer#25 (backend Ollama + wybór modelu). Dodaje `CONJURER_OLLAMA_URL` do bota testowego i deploy-bota. Klucza API dla Ollamy nie ma — **endpoint jest całą konfiguracją** — i dopóki nie jest ustawiony, backend odmawia wyboru. Czyli to jest ten przełącznik, który go włącza. ## ⚠️ Zweryfikowane z LAN-u przed commitem: port jeszcze nie odpowiada `192.168.1.72` odpowiada na ping (**0.4 ms**), ale skan pokazuje **otwarty wyłącznie port 22**. `11434` odrzuca połączenie. To klasyka: **Ollama domyślnie binduje się do `127.0.0.1:11434`**, więc nie jest osiągalna spoza hosta. Ta zmienna jest poprawna, ale **bezczynna**, dopóki serwer nie zacznie nasłuchiwać na sieci: ```bash sudo systemctl edit ollama.service # [Service] # Environment="OLLAMA_HOST=0.0.0.0:11434" sudo systemctl daemon-reload && sudo systemctl restart ollama ``` Weryfikacja: `curl -s http://192.168.1.72:11434/v1/models` Jeśli Ollama chodzi w kontenerze — zamiast tego opublikuj port (`-p 11434:11434`) i ustaw `OLLAMA_HOST=0.0.0.0` w środowisku kontenera. ## Zachowanie do czasu otwarcia portu Nieszkodliwe: `$gadaj_teraz ollama` przełączy się (klient powstaje bez testu łączności), ale odpowiedzi i `$modele_ai` zwrócą błąd połączenia — czytelny, z komunikatem. Nic innego nie jest dotknięte. `kubectl kustomize` czysto (10 obiektów, zmienna w obu botach). 🤖 Generated with [Claude Code](https://claude.com/claude-code)
gitea self-assigned this 2026-08-24 12:43:20 +00:00
gitea added 1 commit 2026-08-24 12:43:20 +00:00
Wires CONJURER_OLLAMA_URL into the test bot and the deploy bot so the
self-hosted backend from conjurer#25 is selectable. No API key exists for
Ollama - the endpoint is the whole configuration - and until it is set the
backend refuses to be selected, so this is what turns it on.

NOTE, verified from the LAN before committing: 192.168.1.72 answers ping
(0.4ms) but only port 22 is open - 11434 refuses. Ollama binds to
127.0.0.1:11434 by default, so it is not reachable off-host yet. This env
var is correct but inert until the server listens on the network:

  sudo systemctl edit ollama.service
    [Service]
    Environment="OLLAMA_HOST=0.0.0.0:11434"
  sudo systemctl daemon-reload && sudo systemctl restart ollama

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
gitea added 1 commit 2026-08-24 12:54:34 +00:00
Probing the real server (192.168.1.72:11434) after it was opened to the LAN:
/v1/models returns exactly one model, gemma4:e2b. Without pinning it the
bot would request the built-in default llama3.1:8b and every reply would
fail with "model not found", so set it explicitly on both bots.

Also raise CONJURER_AI_TIMEOUT_SECONDS to 240. Self-hosted generation is far
slower than a hosted API, particularly the first request after the model is
evicted from VRAM. It applies to every backend, so it is deliberately not
set higher than needed.

Caveat recorded honestly: at the time of writing, generation on that server
does not complete. /v1/models answers instantly, but both /v1/chat/
completions (180s) and native /api/generate with num_predict=5 (60s) return
nothing, and /api/ps shows no model ever becomes resident - so the model
never finishes loading. Ollama is 0.32.14 and gemma4:e2b is 5.1B Q4_K_M
(~3.5GB) despite the "e2b" name. That is a server-side problem, not a
configuration one; these values are correct and take effect once it loads.

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
gitea merged commit a802b90617 into master 2026-08-24 15:40:07 +00:00
Sign in to join this conversation.
No Reviewers
No Label
1 Participants
Notifications
Due Date
No due date set.
Dependencies

No dependencies set.

Reference: gitea/deploy#23