Mit der KI chatten

Mit der KI chatten

Diese Seite behandelt das tägliche Chatten mit der KI (Fragen stellen, Prompts, Antworten): eine Frage senden, was die Zustände während der Antwort bedeuten, Agent und Modell wählen, neu generieren oder bearbeiten, eine Antwort anhalten, eine Unterhaltung exportieren, die blauen Chips, was AnyLLM sich für Sie merkt und was die KI innerhalb einer Unterhaltung erinnert.

Zweck

Sie tippen eine Frage, die KI antwortet, während der Text entsteht, und die Unterhaltung wird automatisch in Ihrem Verlauf gespeichert. Kennt die Fläche einen Vorgang oder eine Seite, kann dieser Inhalt mitgegeben werden; erlaubt es die Administration, kann die KI außerdem in Jira und Confluence nachschlagen — siehe Die KI suchen, lesen und erstellen lassen.

Berechtigung

Alle Nutzer:innen. Jede Anfrage läuft mit Ihren eigenen Jira- und Confluence-Berechtigungen.

Voraussetzungen

  • Die App ist eingerichtet, die verwendete Fläche ist aktiviert und — bei einer kostenpflichtigen Installation — das Abonnement ist aktiv (siehe Erste Schritte).
  • Sie haben AnyLLM auf einer beliebigen Fläche geöffnet, z. B. Apps → AnyLLM Chat.

Schritt für Schritt: eine Frage stellen

  1. Klicken Sie in das Feld Nachricht an AnyLLM ….
  2. Tippen Sie Ihre Frage. Für einen Zeilenumbruch drücken Sie Umschalt+Enter.
  3. Drücken Sie Enter oder klicken Sie auf den Senden-Knopf (Pfeil-Symbol, Tooltip Senden (Enter)).
  4. Warten Sie auf die Antwort. Während sie entsteht, ist das Feld gesperrt und der Senden-Knopf wird zum Stopp-Knopf (Tooltip Stopp).

Ergebnis — die Antwort erscheint Wort für Wort. Unter der fertigen Antwort steht der Name des Modells, das sie erzeugt hat. Die Unterhaltung erscheint unter Verläufe und erhält nach der ersten Antwort einen kurzen, von der KI erzeugten Titel (höchstens sechs Wörter); schlägt das fehl, dient die erste Frage als Titel.

Eine entstehende Antwort: Werkzeug-Zeilen über dem Platzhalter Antwort wird erstellt ... und der Stopp-Knopf im Eingabebereich.

Was die Zustände bedeuten

ZustandBedeutung
Antwort wird erstellt …die Anfrage ist gesendet und die KI hat begonnen
Modell denkt nach …das Modell überlegt intern, bevor es schreibt; bei manchen Modellen kann das eine Weile ohne sichtbaren Text dauern
Kleine Zeilen wie „Jira search: …", „Reading issue …", „Confluence search: …", „Reading page …", „Web search: …"die KI schlägt etwas nach; diese Zeilen sind immer auf Englisch

Hinweise

  • Antworten dürfen Markdown enthalten: Überschriften, Listen, Tabellen, Code-Blöcke und Links. Enthält eine Antwort ein Diagramm in Mermaid-Notation (etwa weil Sie darum gebeten haben), wird es als Grafik gezeichnet.
  • Bilder in Antworten werden nicht automatisch geladen. Statt des Bildes sehen Sie den Link externes Bild anzeigen; ein Klick öffnet es in einem neuen Tab. So kann kein Bild ungefragt Daten nach außen melden.
  • Die automatische Speicherung gilt nicht für einen temporären Chat — siehe Temporärer Chat.

Agent und Modell wählen

In der Leiste unter dem Eingabefeld, neben , stehen bis zu zwei Auswahlfelder:

  • Die Agent-Auswahl (Screenreader-Beschriftung Agent wählen) — erscheint nur, wenn Ihnen mindestens ein Agent zur Verfügung steht (von der Administration vordefiniert, von Kolleg:innen geteilt oder Ihr eigener). Kein Agent bedeutet: allgemeiner Chat. Hat der Agent ein festes Modell, wechselt die Modellauswahl mit. Mehr: Eigene Agents und Skills anlegen.
  • Die Modell-Auswahl (Screenreader-Beschriftung Modell wählen) — erscheint nur, wenn mehr als ein Modell freigegeben ist. Die Modelle sind nach Verbindung gruppiert.

Beide Auswahlen werden für Sie gemerkt (siehe Gemerkte Auswahl). Öffnen Sie eine gespeicherte Unterhaltung erneut, werden Modell und Agent dieser Unterhaltung wiederhergestellt, sofern beide noch existieren.

Antwort neu generieren oder Nachricht bearbeiten

  • ↻ Antwort neu generieren erscheint unter der letzten Antwort, sobald die KI fertig ist. Die letzte Antwort — einschließlich offener Vorschlagskarten — wird verworfen und die Frage erneut gesendet. Jede Wiederholung zählt als neue Anfrage.
  • Bearbeiten & erneut senden — fahren Sie mit der Maus über eine Ihrer eigenen Nachrichten und klicken Sie auf das Stift-Symbol. Der Text landet zurück im Eingabefeld, und die Unterhaltung wird ab dieser Stelle gekappt: Alles Spätere wird verworfen. Passen Sie den Text an und senden Sie erneut.

Antwort anhalten

Während die KI schreibt, wird aus dem Senden-Knopf der Stopp-Knopf (Tooltip Stopp). Ein Klick blendet die laufende Antwort aus, und Sie können sofort weiterschreiben.

⚠️ Warnung: Stopp beendet nur die Anzeige. Die Anfrage läuft auf dem Server weiter, und die vollständige Antwort kann trotzdem im gespeicherten Verlauf landen. Wenn Sie das nicht möchten, löschen Sie die Unterhaltung anschließend — siehe Verläufe verwalten.

Unterhaltung exportieren

  • Auf der App-Seite, im Vollbild-Overlay und auf der eigenständigen Vollseite: Klicken Sie auf und dann auf ↓ Unterhaltung exportieren (Markdown) (erscheint, sobald die Unterhaltung Nachrichten hat).
  • In Dialogen und Panels (Vorgangs-Panel, Vorgangs-Seitenleiste, Vorgangs-Aktion, Seiten-Assistent, Makro, Vorgangsnavigator): Klicken Sie in der Kopfzeile auf ↓ Export.

Ergebnis — eine Markdown-Datei namens llm-chat-JJJJ-MM-TT.md (z. B. llm-chat-2026-08-25.md) wird heruntergeladen. Sie enthält Ihre Fragen, die Antworten und die verwendeten Modellnamen; Vorschlagskarten werden nicht exportiert. Der Export läuft vollständig in Ihrem Browser; es wird nichts übertragen.

Die blauen Chips

In der Leiste unter dem Eingabefeld, links neben dem Senden-Knopf, zeigen kleine blaue Chips, was gerade aktiv ist:

ChipBedeutungKlick
Temporär ✕temporärer Chat aktiv (Tooltip Temporärer Chat aktiv — klicken zum Beenden)beendet den temporären Modus und beginnt einen neuen Chat
Zahnrad-SymbolModell-Parameter gesetzt (Tooltip Modell-Parameter angepasst — klicken zum Bearbeiten)öffnet die Parameter
Memory-SymbolMemory aktiv (Tooltip Memory aktiv — klicken zum Bearbeiten)öffnet die Memory-Notizen
{n} Vorgänge ausgewählt bzw. Aktuelle Suche (JQL)im Vorgangsnavigator: diese Vorgänge werden als Kontext mitgegebenrein informativ
Der Eingabebereich mit dem Chip Temporär, dem Zahnrad-Symbol für Chat-Einstellungen und dem Memory-Symbol neben dem Senden-Knopf.

Gemerkte Auswahl

Modell, Agent, die Einstellung Seiten-Kontext mitgeben und Ihre Modell-Parameter werden für Sie gespeichert und beim nächsten Öffnen des Chats wiederhergestellt. Weil AnyLLM eine Installation für beide Produkte ist, gilt dieselbe Auswahl in Jira, in Confluence, im Vollbild-Overlay und auf der eigenständigen Vollseite.

Was die KI innerhalb einer Unterhaltung erinnert

  • Nur die jüngsten 16 Nachrichten einer Unterhaltung (höchstens rund 32.000 Zeichen) gehen an die KI. In langen Chats erinnert die KI frühere Runden nicht mehr, obwohl sie im Verlauf bleiben. Kommt es auf ein frühes Detail an, wiederholen Sie es.
  • Ihre Memory-Notizen und das Site-Wissen der Administration gehen mit jeder Anfrage mit; Seiten- oder Vorgangskontext wird bei jeder Nachricht mit Ihren Berechtigungen neu gelesen.
  • Pro Antwort darf die KI in höchstens 5 Runden nachschlagen (Jira-/Confluence-Suchen, Lesen, Web-Suche), bevor sie antworten muss. Jede Runde darf bis zu 120 Sekunden dauern, die gesamte Antwort höchstens 5 Minuten; jedes Nachschlage-Ergebnis wird bei 8.000 Zeichen gekürzt. Teilen Sie sehr lange, mehrstufige Aufgaben in kleinere Fragen auf.
  • Hat die KI nur eine Vorschlagskarte und keinen Text erzeugt, lautet die Antwort I proposed an action — please confirm or dismiss it above. (Ich habe eine Aktion vorgeschlagen — bitte oben bestätigen oder verwerfen).

Häufige Probleme

MeldungUrsacheLösung
Keine Antwort vom Stream (Timeout) — bitte erneut versuchen.60 Sekunden lang kam nichts vom Servererneut senden; tritt es wiederholt auf, Administration informieren
Hourly limit reached (… requests/hour) — please try again later. (Stundenlimit erreicht)Ihre Administration begrenzt die Anfragen pro Person und Stunde; der Zähler gilt für Jira und Confluence gemeinsam, beginnt mit Ihrer ersten Anfrage und setzt sich nach einer Stunde zurück; jedes Senden zählt, auch das Neu-Generierenwarten, dann erneut versuchen
Timeout after 120s — shorten the prompt or choose another model. (Zeitüberschreitung nach 120 Sekunden)eine Runde der KI hat länger als 120 Sekunden gebrauchtFrage kürzen oder ein anderes Modell wählen
Der Endpoint … ist in … noch nicht freigegeben — Endpoint-Freigaben gelten je Produkt. Ein Administrator kann sie in den AnyLLM-Einstellungen von … unter „Endpoint-Freigaben“ erteilen.der KI-Dienst ist in diesem Produkt (Jira oder Confluence) noch nicht freigegebenAdministration informieren — siehe Endpoint-Freigaben verwalten
The model used its token budget (…) on internal reasoning without answering — shorten the prompt or choose a non-reasoning model. (Token-Budget durch internes Nachdenken aufgebraucht)ein Reasoning-Modell hat das gesamte Antwort-Budget zum Nachdenken verwendetFrage kürzen, Max. Antwort-Tokens erhöhen oder ein anderes Modell wählen
LLM endpoint rejects the API key (401/403). · Rate limit of the LLM endpoint reached (429). · LLM endpoint responded with HTTP … · LLM call failed: … (der KI-Dienst hat die Anfrage abgelehnt)der KI-Dienst hat die Anfrage abgelehntsiehe Fehlerbehebung; meist muss die Administration handeln
Stream-Fehler. · Aufruf fehlgeschlagen (Invocation-Fehler oder Timeout).ein vorübergehendes Übertragungsproblemerneut senden
Diese Funktion wurde von deinem Administrator deaktiviert.diese Fläche ist abgeschalteteinen anderen Einstieg verwenden, z. B. die App-Seite

Verwandte Themen

Aufnahmen der App-Oberfläche mit Beispieldaten; der umgebende Jira-/Confluence-Rahmen ist nicht abgebildet.

Dokumentationsstand: App-Version 0.2.0 · 2026-08-30