Mit der KI chatten
Mit der KI chatten
Diese Seite behandelt das tägliche Chatten mit der KI (Fragen stellen, Prompts, Antworten): eine Frage senden, was die Zustände während der Antwort bedeuten, Agent und Modell wählen, neu generieren oder bearbeiten, eine Antwort anhalten, eine Unterhaltung exportieren, die blauen Chips, was AnyLLM sich für Sie merkt und was die KI innerhalb einer Unterhaltung erinnert.
Zweck
Sie tippen eine Frage, die KI antwortet, während der Text entsteht, und die Unterhaltung wird automatisch in Ihrem Verlauf gespeichert. Kennt die Fläche einen Vorgang oder eine Seite, kann dieser Inhalt mitgegeben werden; erlaubt es die Administration, kann die KI außerdem in Jira und Confluence nachschlagen — siehe Die KI suchen, lesen und erstellen lassen.
Berechtigung
Alle Nutzer:innen. Jede Anfrage läuft mit Ihren eigenen Jira- und Confluence-Berechtigungen.
Voraussetzungen
- Die App ist eingerichtet, die verwendete Fläche ist aktiviert und — bei einer kostenpflichtigen Installation — das Abonnement ist aktiv (siehe Erste Schritte).
- Sie haben AnyLLM auf einer beliebigen Fläche geöffnet, z. B. Apps → AnyLLM Chat.
Schritt für Schritt: eine Frage stellen
- Klicken Sie in das Feld Nachricht an AnyLLM ….
- Tippen Sie Ihre Frage. Für einen Zeilenumbruch drücken Sie Umschalt+Enter.
- Drücken Sie Enter oder klicken Sie auf den Senden-Knopf (Pfeil-Symbol, Tooltip Senden (Enter)).
- Warten Sie auf die Antwort. Während sie entsteht, ist das Feld gesperrt und der Senden-Knopf wird zum Stopp-Knopf (Tooltip Stopp).
Ergebnis — die Antwort erscheint Wort für Wort. Unter der fertigen Antwort steht der Name des Modells, das sie erzeugt hat. Die Unterhaltung erscheint unter Verläufe und erhält nach der ersten Antwort einen kurzen, von der KI erzeugten Titel (höchstens sechs Wörter); schlägt das fehl, dient die erste Frage als Titel.
Was die Zustände bedeuten
| Zustand | Bedeutung |
|---|---|
| Antwort wird erstellt … | die Anfrage ist gesendet und die KI hat begonnen |
| Modell denkt nach … | das Modell überlegt intern, bevor es schreibt; bei manchen Modellen kann das eine Weile ohne sichtbaren Text dauern |
| Kleine Zeilen wie „Jira search: …", „Reading issue …", „Confluence search: …", „Reading page …", „Web search: …" | die KI schlägt etwas nach; diese Zeilen sind immer auf Englisch |
Hinweise
- Antworten dürfen Markdown enthalten: Überschriften, Listen, Tabellen, Code-Blöcke und Links. Enthält eine Antwort ein Diagramm in Mermaid-Notation (etwa weil Sie darum gebeten haben), wird es als Grafik gezeichnet.
- Bilder in Antworten werden nicht automatisch geladen. Statt des Bildes sehen Sie den Link externes Bild anzeigen; ein Klick öffnet es in einem neuen Tab. So kann kein Bild ungefragt Daten nach außen melden.
- Die automatische Speicherung gilt nicht für einen temporären Chat — siehe Temporärer Chat.
Agent und Modell wählen
In der Leiste unter dem Eingabefeld, neben +, stehen bis zu zwei Auswahlfelder:
- Die Agent-Auswahl (Screenreader-Beschriftung Agent wählen) — erscheint nur, wenn Ihnen mindestens ein Agent zur Verfügung steht (von der Administration vordefiniert, von Kolleg:innen geteilt oder Ihr eigener). Kein Agent bedeutet: allgemeiner Chat. Hat der Agent ein festes Modell, wechselt die Modellauswahl mit. Mehr: Eigene Agents und Skills anlegen.
- Die Modell-Auswahl (Screenreader-Beschriftung Modell wählen) — erscheint nur, wenn mehr als ein Modell freigegeben ist. Die Modelle sind nach Verbindung gruppiert.
Beide Auswahlen werden für Sie gemerkt (siehe Gemerkte Auswahl). Öffnen Sie eine gespeicherte Unterhaltung erneut, werden Modell und Agent dieser Unterhaltung wiederhergestellt, sofern beide noch existieren.
Antwort neu generieren oder Nachricht bearbeiten
- ↻ Antwort neu generieren erscheint unter der letzten Antwort, sobald die KI fertig ist. Die letzte Antwort — einschließlich offener Vorschlagskarten — wird verworfen und die Frage erneut gesendet. Jede Wiederholung zählt als neue Anfrage.
- Bearbeiten & erneut senden — fahren Sie mit der Maus über eine Ihrer eigenen Nachrichten und klicken Sie auf das Stift-Symbol. Der Text landet zurück im Eingabefeld, und die Unterhaltung wird ab dieser Stelle gekappt: Alles Spätere wird verworfen. Passen Sie den Text an und senden Sie erneut.
Antwort anhalten
Während die KI schreibt, wird aus dem Senden-Knopf der Stopp-Knopf (Tooltip Stopp). Ein Klick blendet die laufende Antwort aus, und Sie können sofort weiterschreiben.
⚠️ Warnung: Stopp beendet nur die Anzeige. Die Anfrage läuft auf dem Server weiter, und die vollständige Antwort kann trotzdem im gespeicherten Verlauf landen. Wenn Sie das nicht möchten, löschen Sie die Unterhaltung anschließend — siehe Verläufe verwalten.
Unterhaltung exportieren
- Auf der App-Seite, im Vollbild-Overlay und auf der eigenständigen Vollseite: Klicken Sie auf + und dann auf ↓ Unterhaltung exportieren (Markdown) (erscheint, sobald die Unterhaltung Nachrichten hat).
- In Dialogen und Panels (Vorgangs-Panel, Vorgangs-Seitenleiste, Vorgangs-Aktion, Seiten-Assistent, Makro, Vorgangsnavigator): Klicken Sie in der Kopfzeile auf ↓ Export.
Ergebnis — eine Markdown-Datei namens llm-chat-JJJJ-MM-TT.md (z. B. llm-chat-2026-08-25.md) wird heruntergeladen. Sie enthält Ihre Fragen, die Antworten und die verwendeten Modellnamen; Vorschlagskarten werden nicht exportiert. Der Export läuft vollständig in Ihrem Browser; es wird nichts übertragen.
Die blauen Chips
In der Leiste unter dem Eingabefeld, links neben dem Senden-Knopf, zeigen kleine blaue Chips, was gerade aktiv ist:
| Chip | Bedeutung | Klick |
|---|---|---|
| Temporär ✕ | temporärer Chat aktiv (Tooltip Temporärer Chat aktiv — klicken zum Beenden) | beendet den temporären Modus und beginnt einen neuen Chat |
| Zahnrad-Symbol | Modell-Parameter gesetzt (Tooltip Modell-Parameter angepasst — klicken zum Bearbeiten) | öffnet die Parameter |
| Memory-Symbol | Memory aktiv (Tooltip Memory aktiv — klicken zum Bearbeiten) | öffnet die Memory-Notizen |
| {n} Vorgänge ausgewählt bzw. Aktuelle Suche (JQL) | im Vorgangsnavigator: diese Vorgänge werden als Kontext mitgegeben | rein informativ |
Gemerkte Auswahl
Modell, Agent, die Einstellung Seiten-Kontext mitgeben und Ihre Modell-Parameter werden für Sie gespeichert und beim nächsten Öffnen des Chats wiederhergestellt. Weil AnyLLM eine Installation für beide Produkte ist, gilt dieselbe Auswahl in Jira, in Confluence, im Vollbild-Overlay und auf der eigenständigen Vollseite.
Was die KI innerhalb einer Unterhaltung erinnert
- Nur die jüngsten 16 Nachrichten einer Unterhaltung (höchstens rund 32.000 Zeichen) gehen an die KI. In langen Chats erinnert die KI frühere Runden nicht mehr, obwohl sie im Verlauf bleiben. Kommt es auf ein frühes Detail an, wiederholen Sie es.
- Ihre Memory-Notizen und das Site-Wissen der Administration gehen mit jeder Anfrage mit; Seiten- oder Vorgangskontext wird bei jeder Nachricht mit Ihren Berechtigungen neu gelesen.
- Pro Antwort darf die KI in höchstens 5 Runden nachschlagen (Jira-/Confluence-Suchen, Lesen, Web-Suche), bevor sie antworten muss. Jede Runde darf bis zu 120 Sekunden dauern, die gesamte Antwort höchstens 5 Minuten; jedes Nachschlage-Ergebnis wird bei 8.000 Zeichen gekürzt. Teilen Sie sehr lange, mehrstufige Aufgaben in kleinere Fragen auf.
- Hat die KI nur eine Vorschlagskarte und keinen Text erzeugt, lautet die Antwort I proposed an action — please confirm or dismiss it above. (Ich habe eine Aktion vorgeschlagen — bitte oben bestätigen oder verwerfen).
Häufige Probleme
| Meldung | Ursache | Lösung |
|---|---|---|
| Keine Antwort vom Stream (Timeout) — bitte erneut versuchen. | 60 Sekunden lang kam nichts vom Server | erneut senden; tritt es wiederholt auf, Administration informieren |
| Hourly limit reached (… requests/hour) — please try again later. (Stundenlimit erreicht) | Ihre Administration begrenzt die Anfragen pro Person und Stunde; der Zähler gilt für Jira und Confluence gemeinsam, beginnt mit Ihrer ersten Anfrage und setzt sich nach einer Stunde zurück; jedes Senden zählt, auch das Neu-Generieren | warten, dann erneut versuchen |
| Timeout after 120s — shorten the prompt or choose another model. (Zeitüberschreitung nach 120 Sekunden) | eine Runde der KI hat länger als 120 Sekunden gebraucht | Frage kürzen oder ein anderes Modell wählen |
| Der Endpoint … ist in … noch nicht freigegeben — Endpoint-Freigaben gelten je Produkt. Ein Administrator kann sie in den AnyLLM-Einstellungen von … unter „Endpoint-Freigaben“ erteilen. | der KI-Dienst ist in diesem Produkt (Jira oder Confluence) noch nicht freigegeben | Administration informieren — siehe Endpoint-Freigaben verwalten |
| The model used its token budget (…) on internal reasoning without answering — shorten the prompt or choose a non-reasoning model. (Token-Budget durch internes Nachdenken aufgebraucht) | ein Reasoning-Modell hat das gesamte Antwort-Budget zum Nachdenken verwendet | Frage kürzen, Max. Antwort-Tokens erhöhen oder ein anderes Modell wählen |
| LLM endpoint rejects the API key (401/403). · Rate limit of the LLM endpoint reached (429). · LLM endpoint responded with HTTP … · LLM call failed: … (der KI-Dienst hat die Anfrage abgelehnt) | der KI-Dienst hat die Anfrage abgelehnt | siehe Fehlerbehebung; meist muss die Administration handeln |
| Stream-Fehler. · Aufruf fehlgeschlagen (Invocation-Fehler oder Timeout). | ein vorübergehendes Übertragungsproblem | erneut senden |
| Diese Funktion wurde von deinem Administrator deaktiviert. | diese Fläche ist abgeschaltet | einen anderen Einstieg verwenden, z. B. die App-Seite |
Verwandte Themen
- Erste Schritte
- Prompts, Skills, Memory und Modell-Parameter (+-Menü)
- Eigene Agents und Skills anlegen
- Die KI in Jira und Confluence suchen, lesen und erstellen lassen
- Verläufe verwalten: Anpinnen, Fork, Archivieren, Löschen
- Berechtigungen, Rollen und Datensichtbarkeit
- Fehlerbehebung
- Häufige Fragen (FAQ)
Aufnahmen der App-Oberfläche mit Beispieldaten; der umgebende Jira-/Confluence-Rahmen ist nicht abgebildet.
Dokumentationsstand: App-Version 0.2.0 · 2026-08-30