---
title: "KI-Assistent"
description: "Optionaler Chat-Assistent, der ein von dir bereitgestelltes Modell nutzt. Wie aktiviere ich ihn? Welche Provider funktionieren?"
sidebar:
  icon: sparkles
---

Erlaubt sind nur Themen rund um diese App: persönliche Finanzen, Bedienung, Datenschutz.

## Wie aktiviere ich ihn? [#how-do-i-enable-it]

**Einstellungen → KI-Assistent**: einschalten, **API Base URL** (z. B. `https://api.openai.com/v1`), **Modellname** (z. B. `gpt-4o-mini`) und **API Token** eintragen. *Verbindung testen*, dann *Speichern*.

## Welche Provider funktionieren? [#which-providers-work]

Alles, was die OpenAI-Chat-Completions-API spricht: OpenAI, OpenRouter, Groq, Together, lokal **Ollama** (`http://host:11434/v1`), **LM Studio**, **vLLM**, **llama.cpp**-Server usw.

## Wie wird die Verfügbarkeit geprüft? [#how-is-a-connection-s-availability-checked]

Pro Verbindung gibt es die **Verfügbarkeitsprüfung**. *Schnell* ruft nur `/models` auf — flott, aber ein Proxy wie **LiteLLM** antwortet auch dann, wenn das Modell dahinter offline ist. *Modell gelistet* verlangt zusätzlich, dass dein Modell in dieser Liste steht. *Echte Anfrage* (Standard) fragt zuerst `/health` für das Modell und schickt sonst eine 1-Token-Anfrage — so fällt ein ausgefallenes Backend auf. Antwortet der Proxy, das Modell aber nicht, wird das Abzeichen orange **Eingeschränkt**. Beim Öffnen der Einstellungen werden alle Verbindungen geprüft, danach still alle 5 Minuten, solange der Tab sichtbar ist; jedes Abzeichen zeigt, wann zuletzt geprüft wurde.

## Was kann er? [#what-can-it-do]

Add-Formular vorausfüllen aus Sätzen wie *„Ich habe 50 im Coop bezahlt für Lebensmittel, Kreditkarte"*; Fragen zu deinen Daten beantworten (*„Wo habe ich letzten Monat am meisten ausgegeben?"*) via Lesetools; App-Funktionen und Datenschutz erklären. Alles andere lehnt er ab.

## Kann ich sprechen statt tippen? [#can-i-talk-to-it-instead-of-typing]

Ja, wenn bei einer KI-Verbindung ein **Transkriptions-Modell** hinterlegt ist (Einstellungen → KI-Assistent, z. B. `whisper-1` oder ein lokales `faster-whisper`-Modell). Im Chat erscheint dann ein Mikrofon-Button: aufnehmen, stoppen — der Text landet im Eingabefeld und kann vor dem Senden korrigiert werden. Die Aufnahme wird als 16-kHz-Mono-WAV nur an diesen Provider gesendet und nicht gespeichert; im Aktivitätsprotokoll steht lediglich eine Textvorschau.

## Schreibt er in meine Daten? [#does-it-write-to-my-data]

Nein. Der Chat **bereitet nur einen Entwurf** für das Add-Formular vor, und die Klassifizierungsläufe (Auszugszeilen, offene Buchungen) füllen nur **Vorschlagsfelder**, die du übernimmst oder ignorierst — speichern musst du selbst. Alle anderen Tools lesen nur.

## Was wird an den Provider gesendet? [#what-is-sent-to-my-provider]

Deine Nachrichten plus die Ergebnisse der Lesetools, die das Modell aufruft (Buchungen, Kontostände, Kategoriesummen). Siehe [Datenschutzseite](https://cash-flow.wi-wo.ch/privacy) für den vollständigen Datenfluss.

## Wo wird mein API Token gespeichert? [#where-is-my-api-token-stored]

Serverseitig in der Tabelle `ai_endpoints`, pro Verbindung einer. Er wird **nicht** an den Browser zurückgegeben, aber der Server-Betreiber kann ihn lesen — behandle ihn wie andere Zugangsdaten auf dieser Instanz.

