Agent Studio
Ein neuer Canvas: Ihre Agentenkarte in der Mitte, links die Eingänge für Anfragen, rechts die Tools, mit denen er arbeitet.
Drei Wochen lang haben wir die Stellen repariert, an denen Ausführungen, Sitzungen und Modelle unbemerkt aus dem Tritt gerieten. Spaces setzen mehrere Agenten auf eine Aufgabe an, und Sie können mit Ihrem Agenten laut sprechen. Dazu kommen ein neu gebauter Studio-Canvas, Werkzeuge zum Finden und Ordnen langer Unterhaltungen, Pläne, die Sie vor Arbeitsbeginn freigeben, und vier neue Konnektoren.

Ein neuer Canvas: Ihre Agentenkarte in der Mitte, links die Eingänge für Anfragen, rechts die Tools, mit denen er arbeitet.
Springen Sie über die Markierungen links von Frage zu Frage, suchen Sie mit ⌘F in einer Unterhaltung und bündeln Sie Unterhaltungen in Ordnern.
Lesen Sie den Plan, bevor die Arbeit beginnt. Tools, die Sie ständig nutzen, müssen Sie für diesen Agenten nur einmal erlauben.
Doppelte Abrechnung, eine Antwort, die nie endet, Eingaben, die verschwinden. Wir haben die Wege geschlossen, auf denen das passieren konnte.

Wir haben den Canvas neu gezeichnet. Ihre Agentenkarte steht in der Mitte. Die Kanäle und die API, über die Anfragen hereinkommen, stehen links, die Konnektoren, mit denen er arbeitet, rechts. Name und Verbindungsstatus stehen in jeder Karte, es gibt also keine Formen zu entschlüsseln. Klicken Sie auf eine Karte und bearbeiten Sie sie im Seitenpanel.
Während Daten laden, halten Skeleton-Karten jeden Platz frei, sodass ein leerer Canvas nie mit einer leeren Konfiguration verwechselt wird. Das Punktraster folgt beim Verschieben und Zoomen, und beim Ziehen wird kein Text mehr markiert. Die Bereiche für Skills und Konnektoren haben einen Button zum Katalog bekommen, und der Stopp-Button und das Widerrufen von API-Schlüsseln funktionieren jetzt tatsächlich.
Manche Arbeit ist für einen Agenten zu groß. Legen Sie einen Space an, setzen Sie mehrere Agenten hinein, und die Arbeit wird darin aufgeteilt. Beim Hinzufügen wählen Sie einen Agenten, den Sie bereits nutzen, oder bauen an Ort und Stelle einen neuen.
Schreiben Sie den Auftrag in die Front-Unterhaltung, und er wird zu einer Aufgabe. Um
festzulegen, wer sie übernimmt, tippen Sie @ und wählen einen Namen. Angeboten werden
nur die Agenten in diesem Space. Jeder arbeitet dann in seiner eigenen Unterhaltung,
und der Fortschritt kommt zurück in die Front-Unterhaltung. Wer gerade spricht, erkennen
Sie an Avatar und Name neben der Antwort.
Ergebnisse werden als gesperrte Versionen eingereicht. Bitten Sie später um eine Überarbeitung, bleibt die frühere Version, wo sie ist. Wenn Versuche wiederholt scheitern oder die Entscheidung einen Menschen braucht, wandert die Aufgabe in die Review-Warteschlange. Es gibt Obergrenzen dafür, wie viele Aufgaben gleichzeitig laufen und wie oft jede wiederholt wird, damit ein einzelner Space nicht Ihr ganzes Konto aufbraucht.

In langen Unterhaltungen verliert man leicht den Überblick. Jede Frage hinterlässt jetzt eine Markierung am linken Rand. Fahren Sie mit der Maus darüber, um die Liste der Fragen zu sehen, und klicken Sie, um dorthin zu springen.

Scrollen Sie nach oben, werden frühere Nachrichten nachgeladen, bis zurück zur allerersten, selbst in einer Unterhaltung mit Hunderten von Wortwechseln. Drücken Sie ⌘F, um in der Unterhaltung zu suchen. Enter springt zum nächsten Treffer, Shift+Enter zum vorherigen, und Sie sehen, bei welchem Sie gerade sind. Eine Trennlinie zeigt, wo die Erinnerung des Modells an die Unterhaltung gekürzt wurde.

Legen Sie Ordner an, benennen Sie sie und ziehen Sie Unterhaltungen hinein. Wählen Sie mehrere Unterhaltungen aus und archivieren oder löschen Sie sie auf einmal. Die ⌘K-Palette hat jetzt Befehle, die auf die Unterhaltung wirken, die Sie gerade ansehen, und beim Löschen fragt die Palette noch einmal nach.
Die Suche erfasst Tool-Ausgaben, und archivierte Unterhaltungen lassen sich per
Schalter einbeziehen. Eine Unterhaltung, die auf Ihre Antwort wartet, können Sie auch
ohne Antwort als erledigt markieren. Routinen lassen sich umbenennen, und /rename
funktioniert als Einzeiler. Pins, Sortierung und Filter werden in Ihrem Konto
gespeichert und sind damit auf jedem Gerät gleich.
Drücken Sie im Eingabefeld auf den Wellenform-Button, und die Unterhaltung wird zum Live-Gespräch. Sprechen Sie, und er hört Sie, dann antwortet er laut. Den Schritt „erst transkribieren, dann senden“ haben wir gestrichen und übertragen stattdessen das Audio selbst. Fallen Sie ihm ins Wort, hört er auf zu sprechen und hört zu.
Tools arbeiten weiter, während Sie sprechen. Konnektoren werden aufgerufen, und alles, was eine Freigabe braucht, erscheint als Karte auf dem Bildschirm. Alles Gesagte wird in die Unterhaltung transkribiert. Sie können also die Stimme weglassen, zur Tastatur greifen und an derselben Stelle weitermachen. Er versteht Englisch und Koreanisch, und die Stimme wählen Sie in den Einstellungen.
Echtzeit-Sprache gibt es auch in der öffentlichen API. Öffnen Sie eine Sitzung mit
POST /api/public/v1/agents/{agent_id}/realtime, hängen Sie WebRTC oder einen WebSocket
an, und Ihr Agent antwortet per Stimme. Gebaut ist das für Orte ohne Bildschirm, etwa
eine Telefonleitung oder ein Kiosk-Terminal.

Bei Arbeit, die mehrere Schritte braucht, kommt zuerst eine Plankarte. Das Ziel, die Schritte sowie Tool und Zielobjekt jedes Schritts stehen an einem Ort. Geben Sie frei, und der Agent macht weiter. Lehnen Sie ab, und er fragt erneut.

Auf einer Freigabekarte kann ein einzelner Tastendruck nur abbrechen. Freigeben braucht einen Klick oder zweimal Enter, und ein Enter, das mitten in der Zeichenkomposition gedrückt wird, rutscht nie durch. Für Tools, die Sie immer wieder freigeben, etwa das Senden von Mails, aktivieren Sie „Always allow for this agent“ (für diesen Agenten immer erlauben). Dasselbe Tool auf derselben Verbindung läuft dann 90 Tage lang ohne Rückfrage, und Sie können das in den Einstellungen jederzeit widerrufen. Unumkehrbare Aktionen wie Löschen werden nie gemerkt.
Ist eine Unterhaltung in die falsche Richtung gelaufen, spulen Sie sie über das Nachrichtenmenü zurück. Sie kehrt zu dem Punkt vor dieser Nachricht zurück und bleibt dort, wenn Sie wiederkommen.

Eine Antwort, die auf externes Material zurückgreift, bekommt darunter einen Quellen-Chip. Ein Klick zeigt Titel und Domains, jede Quelle öffnet sich in einem neuen Tab. Mathematik wird als LaTeX dargestellt, und Links, die Sie einfügen, sind anklickbar. Codeblöcke werden per Dreifachklick vollständig markiert, lassen sich über ein Rechtsklick-Menü kopieren und nehmen das Prompt-Zeichen nie mit.

Ein Modell, das den Dienst verlassen hat, bleibt ausgegraut in der Liste, mit dem Grund daneben, und lässt sich nicht auswählen. Ein Modell, das kurzzeitig instabil ist, warnt nur. Verschwindet das Modell, das Sie verwendet haben, sagt Ihnen das Eingabefeld zuerst Bescheid. Aufwandsstufen und Fast-Routing kommen aus dem Live-Katalog, sodass nichts stillschweigend herabgestuft wird.

Durchsuchen Sie die Galerie nach Namen und filtern Sie nach Herkunft: Unterhaltung, Projekt oder App. Pins werden in Ihrem Konto gespeichert. Der Viewer zeigt den neuesten Inhalt, nachdem der Agent eine Datei neu gespeichert hat, und stellt Bilder, PDFs, Audio und Video direkt dar. Der Download des Originals funktioniert für jedes Format. Link kopieren und das Öffnen an Ort und Stelle sind in die Kopfzeile des Canvas gewandert, und App-Dateien werden als Verzeichnisbaum angezeigt.

Tippen Sie in einer Unterhaltung /usage, und eine Karte zeigt die Eingabe- und
Ausgabe-Tokens, die gewichtete Summe und die Credits, die diese Unterhaltung verbraucht
hat. Sie kommt ohne Modellaufruf. Das Nutzungsfenster öffnet sich über das Kontomenü,
und sein Compute-Tab zeigt den gemessenen Speicher und welche Zähler angeschlossen
sind. Wenn Sie ein Limit erreichen, sagt das Banner, welches Limit es ist und wann es
zurückgesetzt wird.

Aus dem Katalog ist eine Entdecken-Ansicht geworden. Jede Zeile zeigt ein Icon, eine Zusammenfassung, die Anzahl der Tools und wie viele davon eine Freigabe brauchen, dazu ein einziger Button zum Verbinden. Kategorien lassen sich einklappen, und es gibt eine Suche und einen Verbindungsfilter.
Dropbox, GitHub, Outlook und Google Analytics sind neu. WordPress deckt jetzt Kategorien, Seiten und Kommentare ab, und WhatsApp ist ein Kanal in beide Richtungen. Sind viele Konnektoren angehängt, rotieren die dem Modell gezeigten Tools innerhalb eines Budgets, damit sich Ihr Kontext nicht füllt. Links zu Notion, Jira, Linear und GitLab, die Sie in eine Unterhaltung einfügen, werden über Ihre eigene Verbindung gelesen. Ihr Agent lässt sich außerdem als MCP-Server aufrufen.
Die Hälfte dieses Release war Reparaturarbeit.
Aktivieren Sie Browser-Push, und Sie bekommen eine Benachrichtigung, wenn eine Ausführung endet, auch bei geschlossenem Tab. Benachrichtigungen für den Bildschirm, den Sie gerade ansehen, werden nicht doppelt gesendet. Im Activity-Board können Sie eine laufende Aufgabe stoppen und sehen, welches Tool sie gerade nutzt.

Konsole und öffentliche Seiten teilen sich jetzt ein Farbsystem. Auf der Landingpage können Sie mit drei Agenten sprechen, Tin, Atlas und Muse, ohne sich anzumelden.

Die Anmeldeseite wurde zweispaltig neu aufgebaut. Mit Google kommen Sie direkt hinein, und bei der Registrierung werden Sie um Ihre Zustimmung zu den Bedingungen gebeten. Pill-Buttons teilen sich eine Textur: eine gefüllte Fläche mit einer hellen Kante oben. Die Fenster für Einstellungen und Nutzung sind größer, die Einstellungen öffnen sich wieder auf dem Tab und Abschnitt, den Sie zuletzt angesehen haben, und Modals lassen sich allein mit der Tastatur bedienen.
Die Dokumentation hat eine koreanische Ausgabe. Alle 36 Seiten liegen unter /ko/docs,
und die Dokumentation ist jetzt unter endue.ai/docs zu Hause. Die drei Home-Tabs und
drei neue Einstellungsbildschirme sind dokumentiert. Die Root-Landingpage ist eine
statische Seite und öffnet sich deshalb ohne das Konsolen-Bundle. Die
Unternehmensangaben stehen im Footer.
Die Rate-Limits des Gateways werden durchgesetzt, und erforderliche Token-Claims werden geprüft. Abrufe externer URLs blockieren interne Netzwerke und begrenzen Redirects und Antwortgröße. Öffentliche Seiten und die Konsolen-Dokumentation tragen Sicherheits-Header, und Artefakt-Vorschauen werden isoliert gerendert.