Systemanforderungen
AiHummer ist ein host-natives Produkt: Es läuft als Release-Tarball unter systemd, daher sind die Anforderungen bewusst gering. Die einzige feste Abhängigkeit ist ein Linux-Host mit PostgreSQL. Alles andere — Sidecars, ein echtes Modell, ein Vektorspeicher — ist optional und kann später über die Admin-Oberfläche hinzugefügt werden.
[!NOTE] AiHummer ist host-nativ, nicht Docker. Es wird als Tarball bereitgestellt, der unter läuft systemd von
~/.aihummer(das Heimverzeichnis des Benutzers, der den Installer). Sie benötigen keine Container-Laufzeitumgebung, Kubernetes oder irgendeine Dirigent.
Betriebssystem
AiHummer läuft auf Nur Linux. Es gibt keine Windows- oder macOS-Server-Version – das Gateway und seine Sidecars werden als Linux-Artefakte pro Architektur verpackt und mit systemd bereitgestellt. (Der Client ist eine separate Mobile- und Desktop-App; das ist ein Kanal, kein Server.)
- Eine moderne 64-Bit-Linux-Distribution mit
systemd. x86_64(amd64) oderarm64— der Installer lädt das passende Bundle für jede Architektur.sudo/root-Zugriff ist nicht unbedingt erforderlich: eine normale Installation läuft übersudo, aber das Ausführen des Installers ohne Root installiert AiHummer rootless Modus untersystemd --user— sehen Installation.
Datenbank
PostgreSQL ist der nur harte Abhängigkeit und die einzige Quelle der Wahrheit für alle Zustände. Die pgcrypto Erweiterung ist erforderlich — es unterstützt den verschlüsselten Anmeldeinformationsspeicher. Ohne eine Datenbank startet das Gateway in einem reduzierten nur-Gesundheit-Modus und liefert nichts Nützliches.
[!IMPORTANT] Aktivieren
pgcryptoin der Zieldatenbank vor dem ersten Lauf:CREATE EXTENSION IF NOT EXISTS pgcrypto;
Das Gateway verbindet über eine DSN in AIHUMMER_DATABASE_URL. Für die mandantenfähige Isolation können Sie zusätzlich verweisen AIHUMMER_DB_APP_URL an einem eingeschränkten aihummer_app Rolle zum Aktivieren der Postgres-Zeilenebenen-Sicherheit; lokale Installationen richten dies automatisch ein. Datenbankmigrationen sind vorwärtskompatibel und werden automatisch unter einem beratenden Sperrmechanismus für den Besitzer-Pool angewendet.
Hardware
Diese Zahlen dienen als Richtlinie für eine Einzelserverbereitstellung des Gateways plus PostgreSQL. Sidecars (STT/TTS, Browser, Vektorspeicher) fügen ihren eigenen Fußabdruck hinzu und werden in der Regel nur bei kleinen Bereitstellungen auf demselben Host platziert.
| Profil | CPU | RAM | Scheibe | Notizen |
|---|---|---|---|---|
| Minimum (auswerten) | 2 vCPU | 2 GB | 10 GB | Gateway + Postgres, Mock-Modell, keine Sidecars |
| Empfohlen | 4 vCPU | 8 GB | 40 GB SSD | Gateway + Postgres + ein paar Sidecars |
| Stimm- / lokale Modelle | 8+ vCPU (GPU optional) | 16+ GB | 80+ GB SSD | STT/TTS, Einbettungsprogramm, lokaler LLM-Endpunkt |
Die Datenträgernutzung wächst mit dem Gesprächsverlauf, dem Medien-Blob-Verzeichnis (AIHUMMER_BLOB_DIR), Wissensaufnahme und Prüfungsaufbewahrung. Planen Sie PostgreSQL-Backups (pg_dump + WAL/PITR) entsprechend.
Sidecars (optional)
Sidecars sind separate HTTP-Dienste, jeweils unter ihrer eigenen systemd-Einheit. Das Gateway erreicht sie über eine URL, sodass ein Sidecar auf demselben Host, auf einem anderen Host laufen oder auf eine bestehende Instanz verwiesen werden kann. Sie sind alle kostenlos/lokal und niemals für eine grundlegende Bereitstellung erforderlich.
| Sidecar | Standardport | Ermöglicht |
|---|---|---|
| STT (schneller-flüstern) | 8001 | Spracherkennung für Stimmeingaben |
| TTS (edge-tts) | 8002 | Text-zu-Sprache für Sprachwechsel |
| Video (ffmpeg) | 8005 | Videoverständnis |
| SearXNG | 8888 | Der web_search Werkzeug |
| Chrome/CDP | 9222 | Der browser / computer Werkzeuge |
STT, TTS, Video, die Websuche (SearXNG) und der Browser (CloakBrowser) werden alle vom Installateur ab Werk installiert. Die Such- und Browser-Nutzlasten reisen im signierten Installer-Bündel mit und werden offline installiert: Schalten Sie sie mit --no-search / --no-browser ab, oder binden Sie mit --external-search=URL / --external-browser=URL eine bereits laufende Instanz statt einer lokalen Installation an. Überspringen Sie die Sprach-Sidecars mit den AIHUMMER_SKIP_* Variablen. Der semantische Einbettungscode ist zustimmen (--with-embedder): es lädt PyTorch (hunderte von MB), und ohne es fällt der Speicher auf die lexikalische Suche zurück. Siehe Installation.
[!NOTE] Node.js (Version 20 oder neuer) reist ebenfalls im Installer-Bündel mit und wird offline installiert, sodass Node.js-Plugins — die AiHummer-App, pocket-agent und die Kanal-Konnektoren — auch auf Distributionen mit zu altem eigenem Node.js ab Werk funktionieren.
LLM-Anbieter
AiHummer erfordert niemals ein kostenpflichtiges Modell. Es funktioniert sofort mit kostenlosen/lokalen Modellen und einem Codex-/ChatGPT-Abonnement-Transport; pro Mandant BYOK-Schlüssel sind streng optional.
Unterstützte Anbieter:
- Anthropisch.
- OpenAI.
- Jeder OpenAI-API-Standard-Endpunkt — lokale Modellserver, OpenRouter oder Zum Beispiel Geminis OpenAI-kompatibler Endpunkt.
- Codex / ChatGPT-Abonnement-Transport — ein Modell durch ein ChatGPT fahren Abonnement statt eines abgerechneten API-Schlüssels.
[!TIP] Wenn Sie das Gateway ohne ein angeschlossenes Modell starten (
AIHUMMER_LLM_PROVIDER/AIHUMMER_LLM_MODEL/AIHUMMER_LLM_GATEWAY_URL), Antworten stammen von einem Deterministischen verspotten damit Sie Kanäle validieren und Routing vor dem Anschließen eines echten Modells.
[!NOTE] AiHummer zeigt nur die OpenAI-kompatiblen
POST /v1/chat/completionsEndpunkt. Es gibt nein/v1/modelsoder/v1/embeddingsHTTP-Endpunkt, und Beobachtbarkeit ist OTLP-Push (kein Prometheus/metrics).
Wohin als Nächstes
- Bereit zum Einsatz? Gehe zu Installation.
- Möchten Sie die erste Runde Schritt für Schritt gehen? Sehen Sie die Schnellstart.
- Willst du zuerst das mentale Modell? Lies das Einführung.