# Nutzungsübersicht

> Wo du abliest, was deine Agenten verbraucht haben – Tokens insgesamt, welche Modelle und welche Agenten sie verbraucht haben, wie viel von deinem Tarifkontingent übrig ist und die Nutzung einer einzelnen Unterhaltung.

Die **Nutzungsübersicht** zeigt, was deine Agenten verbraucht haben: Tokens im Zeitverlauf, aufgeschlüsselt nach Modell und nach Agent.

## Wann du sie nutzt

Öffne sie, wenn das Token-Badge auf dem Board [Aktivität](/de/docs/work/activity/) höher ist als erwartet, bevor du das Modell einer [Routine](/de/docs/automate/routines/) änderst, oder zu Wochenbeginn, um zu sehen, wohin die Nutzung der letzten Woche geflossen ist.

*Was* Nutzung verursacht und wie das Kontingent funktioniert, erklärt [Tarife und Nutzung](/de/docs/account/plans-and-usage/). Lies das zuerst. Auf dieser Seite geht es darum, die Zahlen zu lesen.

## So kommst du hin

<Steps>

1. **Öffne den Tab Nutzung** auf dem Startbildschirm oder wähle das Token-Badge in der Kopfzeile von Aktivität.

2. **Wähle einen Zeitraum.** 7 Tage, 30 Tage oder 3 Monate. Der Zeitraum ändert die Kacheln und die Diagramme. Die Jahreskarte der Aktivität zeigt immer das aktuelle Jahr.

3. **Wechsle zwischen den vier Tabs**: Übersicht, Modelle, Agenten, Rechenleistung.

</Steps>

## Übersicht

Die Kacheln oben beantworten „wie viel, wie oft und womit“:

| Kachel | Zeigt |
| --- | --- |
| **Tokens gesamt** | Alles, was im Zeitraum gesendet und empfangen wurde |
| **Anfragen** | Wie viele Modellaufrufe dafür nötig waren |
| **Aktive Tage** | Tage im Zeitraum mit irgendeiner Nutzung |
| **Aktuelle Serie** | Aufeinanderfolgende Tage mit Nutzung, dazu als Hinweis deine längste Serie |
| **Meistgenutztes Modell** | Das Modell mit den meisten Tokens |
| **Nutzungs-Credits** | Die Ausgaben dieser Woche in Credits. Die Kachel nennt das verwendete Umrechnungsverhältnis |

Darunter ist das **Tarifkontingent** der Wert, auf den du achten solltest: ein Balken, der zeigt, wie viel vom aktuellen Kontingent verbraucht ist, und ein klarer Hinweis, wenn es erschöpft ist. Das ist dieselbe Zahl, die der Dienst prüft, bevor er eine [Ausführung](/de/docs/work/runs/) startet. Ist der Balken voll, stoppen die Ausführungen.

**Tägliche Aktivität** ist eine Jahreskarte mit einem Feld pro Tag, dunkler dort, wo du mehr genutzt hast. So entdeckst du am schnellsten eine Routine, die unbemerkt angefangen hat, jeden Tag zu verbrauchen.

## Modelle und Agenten

Beide Tabs sind gleich aufgebaut: oben ein Tagesdiagramm, darunter eine Aufschlüsselung.

- **Modelle**: an welche Modelle die Tokens gingen. Das ist der größte Kostenhebel, deshalb beginnt hier meist die Entscheidung, ein Modell zu wechseln. Siehe [Modell wählen](/de/docs/build/models/).
- **Agenten**: welche Agenten verbraucht haben und welche Modelle jeder davon genutzt hat. Ein Agent mit vielen Routinen fällt hier auf, lange bevor du ihn anderswo bemerkst.

In beiden Tabs ist die Legende ein Filter: Blende eine Datenreihe aus, um den Rest ohne sie zu lesen, und **Alle anzeigen** holt alle zurück. Zeilen, für die im Diagramm kein Platz ist, werden unter „Sonstige“ gesammelt, statt wegzufallen.

<Aside type="note" title="„Nicht zugeordnet“ ist kein Fehler">
  Der Tab Agenten hat eine Zeile **Nicht zugeordnet** für Nutzung, die keinem einzelnen
  Agenten zuzuordnen ist: Aufrufe auf Kontoebene, darunter Modelle, die du direkt über die
  [LLM API](/de/docs/build/llm-api/) aufrufst. Das sind echte Ausgaben, nur ohne Agenten, dem man
  sie zurechnen kann. Der Tab Quellen schlüsselt sie auf.
</Aside>

## Quellen

Der Tab **Quellen** teilt dieselben Tokens nach ihrer Herkunft auf:

- **Agenten**: Ausführungen von Agenten aus Web-Chats, Routinen und Kanälen.
- **Agent API**: Agenten, die mit einem API-Schlüssel über die [Agent API](/de/docs/build/agent-api/) aufgerufen werden.
- **endue Live**: Unterhaltungen, die Besuchende auf endue Live mit deinem Agenten geführt haben. Unterhaltungen von Besuchenden zählen als Nutzung des Kontos, dem der Agent gehört.
- **LLM API**: Modelle, die direkt mit einem API-Schlüssel über die [LLM API](/de/docs/build/llm-api/) aufgerufen werden.

Jede Zeile zeigt Tokens, Anteil und Anfragen, darunter die verwendeten Modelle. Auch hier funktioniert die Legende als Filter. Aufrufe über die LLM API werden aus gekauften Credits und Aktions-Credits bezahlt, während Ausführungen von Agenten, über die Agent API und auf endue Live das Tarifkontingent nutzen. Öffne diesen Tab also, wenn sich ein Credit-Guthaben bewegt und kein Agent das erklärt.

## Rechenleistung

Browsersitzungen, Speicher des Arbeitsbereichs, Medienverarbeitung und Output-Speicher sind hier aufgeführt, werden aber **noch nicht gemessen**. Der Tab sagt das in jeder Zeile.

Lies leere Zeilen als „noch nicht erfasst“, nicht als „null“. Nichts auf diesem Tab besagt, dass eine Ressource kostenlos ist.

## Ein Agent im Detail

Klappe im Tab Agenten eine Zeile auf. Am Ende findest du **In Studio öffnen**. Damit öffnet sich das Canvas dieses Agenten im Tab Nutzung für denselben Zeitraum. Dort siehst du Chats und Credits nach Quelle und nach Zugang (API-Schlüssel oder Kanalverbindung). Siehe [Analysen](/de/docs/build/analytics/).

## Nutzung einer einzelnen Unterhaltung

Die Übersicht gilt pro Konto. Für eine einzelne Unterhaltung tippst du **`/usage`** in ihr Eingabefeld: Eine Karte zeigt Eingabe- und Ausgabetokens, wie viele davon aus dem Cache kamen, die gewichtete Summe, Credits und die beteiligten Modelle, dazu einen Link in die Übersicht.

Die Karte ist eine lokale Ansicht, keine Nachricht. Sie erscheint nicht im Verlauf und ist nach einem Neuladen verschwunden.

<Aside type="note" title="Zwei verschiedene Zahlen, beide richtig">
  Die Karte von `/usage` zählt, was die Unterhaltung *bisher verbraucht* hat. Das Panel
  [Kontextfenster](/de/docs/work/context-window/) zählt, was *gerade ins Modell geladen* ist.
  Das sind verschiedene Achsen, die Werte stimmen nicht überein.
</Aside>

## Einschränkungen

- Die Nutzung wird pro Konto gemessen. Die Ansicht pro Agent schlüsselt dieselbe Summe auf und ist kein eigenes Kontingent.
- Die Zahlen werden kurz nach einer Ausführung verbucht, daher kann die neueste Ausführung eine kurze Weile fehlen.
- Ausführungen mit [deinem eigenen Schlüssel](/de/docs/account/bring-your-own-key/) werden hier nicht erfasst. Eine Unterhaltung, die nur deinen eigenen Schlüssel genutzt hat, erscheint als „keine Nutzung erfasst“. Für das Protokoll von endue stimmt das, über die Rechnung deines Anbieters sagt es nichts.
- Die Aggregation pro Agent und pro Quelle ist nicht in jeder Umgebung verfügbar. Wenn nicht, sagt der Tab das, statt null anzuzeigen.
- Der Tab Rechenleistung ist eine Liste von Ressourcen, keine Messung.

## Siehe auch

<CardGrid>
  <LinkCard
    title="Tarife und Nutzung"
    href="/de/docs/account/plans-and-usage/"
    description="Was das Kontingent verbraucht und wie das Wochenfenster funktioniert."
  />
  <LinkCard
    title="Modell wählen"
    href="/de/docs/build/models/"
    description="Die Entscheidung, für die es den Tab Modelle gibt."
  />
  <LinkCard
    title="Eigenen API-Schlüssel nutzen"
    href="/de/docs/account/bring-your-own-key/"
    description="Warum manche Ausführungen hier nie auftauchen."
  />
  <LinkCard
    title="Aktivität"
    href="/de/docs/work/activity/"
    description="Das Board, dessen Token-Badge hierher führt."
  />
</CardGrid>
