Agentic Agents
Übersicht
Der Bereich Agentic Agents ist der zentrale KI-Arbeitsbereich innerhalb Ihres Projekts. Er ermöglicht es Ihnen, Agenten-Tabs zu erstellen und zu verwalten — ob CLI-basiert, SDK-basiert oder ACP-basiert. Jeder Tab führt eine unabhängige KI-Agenten-Sitzung aus, sodass Sie gleichzeitig mit mehreren Agenten oder Konversationen arbeiten können.
Kaiju Hub AI wird mit integrierter Unterstützung für Anthropic Claude Code, Google Gemini und OpenAI Codex geliefert. Die Pro-Version unterstützt auch benutzerdefinierte CLI-Ergänzungen wie OpenCode.
Der Agent, der standardmäßig geöffnet wird, wird durch den Anbieter und Modus bestimmt, den du im Bereich Projektinformationen ausgewählt hast. Jedes Mal, wenn du mit der linken Maustaste auf die Schaltfläche + klickst, wird eine neue Registerkarte mit dieser Standardkonfiguration geöffnet.
Sistema di contesto IA Kaiju Hub AI
So funktioniert es
Kaiju Hub AI verwendet ein einzigartiges Kontextbündelungssystem zur Kommunikation mit KI-Agenten. Anstatt Rohnachrichten direkt zu senden, wird jeder Prompt, den Sie senden, in eine strukturierte Kontextdatei gebündelt, die die KI als einzelnes Paket liest. Dieses Bündel enthält Ihren Prompt-Text, angehängte Bilder, angehängte Dateien und Verweise auf Blöcke oder Projekte, die Sie einbezogen haben.
Wenn Sie eine Nachricht senden, stellt Kaiju Hub AI alle diese Teile in einer Bündeldatei zusammen und übergibt sie dem KI-Agenten. Der Agent liest das gesamte Bündel auf einmal und erhält so vollen Zugriff auf alles, was Sie angehängt haben, in einem einzigen, organisierten Kontext.
Cosa viene incluso nel bundle
Testo prompt
Ihre Nachricht an den KI-Agenten wird als primäre Anweisung einbezogen.
Immagini allegate
Alle Bilder, die Sie anhängen, werden im Bündel einbezogen. Sie sind nicht auf eine geringe Anzahl beschränkt — Sie können viele Bilder in einer einzelnen Nachricht senden.
File allegati
Dateien, die Sie anhängen, werden gebündelt, damit die KI deren Inhalte direkt lesen und referenzieren kann.
Riferimenti al progetto
Wenn Sie ein Projekt aus dem Projekt-Hub anhängen, wird dessen Pfad einbezogen, damit die KI dieses Projekt direkt referenzieren und damit arbeiten kann.
Riferimenti ai blocchi
Blöcke aus der Block-Bibliothek können an eine Nachricht angehängt werden. Die KI wird den Block-Inhalt als Teil ihres Kontexts lesen und nutzen.
Memoria tra sessioni
Jedes Bündel wird nach dem Senden auf dem Backend gespeichert. Das bedeutet, die KI kann auf Kontext aus vorherigen Tabs innerhalb derselben Sitzung verweisen und auch auf frühere Chat-Sitzungen komplett zurückblicken. Wenn Sie beispielsweise letzte Woche ein Gespräch über eine bestimmte Funktion hatten, kann sich die KI daran erinnern, was Sie besprochen und worum Sie gebeten haben.
Dieser sitzungsübergreifende Speicher funktioniert über alle Tabs hinweg. Wenn Sie etwas in einem Tab senden, steht der Kontext der KI als Referenz in jedem anderen Tab oder in zukünftigen Sitzungen zur Verfügung.
Perche e importante
Utilizzo ridotto di token
Durch das Bündeln von Kontext in einer strukturierten Datei anstelle des Anhängens von Rohverlauf reduziert das System den Token-Verbrauch erheblich.
Piu materiale di contesto
Sie können weit mehr Kontext einbeziehen — viele Bilder, mehrere Dateien, Projektreferenzen und Blöcke — ohne auf typische Einschränkungen zu stoßen.
Cronologia persistente
Die KI behält das Bewusstsein über vergangene Konversationen über Sitzungen hinweg, sodass Sie sich nicht wiederholen oder frühere Arbeit erneut erklären müssen.
Aggiungi scheda
Übersicht
Die Schaltfläche + in der Agenten-Werkzeugleiste ermöglicht es dir, neue Agenten-Registerkarten zu erstellen. Ein Linksklick auf die Schaltfläche + öffnet sofort eine neue Registerkarte mit dem im Bereich Projektinformationen ausgewählten Standardagenten. Ein Rechtsklick auf die Schaltfläche + öffnet ein Dropdown-Menü, in dem du einen bestimmten Agententyp auswählen kannst.
Tipi di agenti supportati
Markdown-Betrachter
Übersicht
Der Markdown-Betrachter-Tab rendert Markdown-Inhalte innerhalb des Agentenbereichs. Er wird verwendet, um formatierte Dokumentation, Agenten-Anweisungen, Skill-Dateien und andere Markdown-basierte Inhalte direkt im Arbeitsbereich anzuzeigen, ohne zu einem externen Editor wechseln zu müssen.
Funktionen
Vollständiges Rendering
Unterstützt vollständige Markdown-Syntax einschließlich Überschriften, Listen, Codeblöcke mit Syntaxhervorhebung, Tabellen, Links und Bilder.
Agenten-Dokumentation
Zeigen Sie Agenten-Anweisungsdateien (CLAUDE.md, agents/*.md, skills/*/SKILL.md) in einem lesbaren Format gerendert an.
Inline-Anzeige
Inhalte werden inline im Agenten-Tab-Bereich gerendert, sodass Sie Dokumentation neben Ihren aktiven Agenten-Sitzungen lesen können.
Agentenbereich
Übersicht
Der Agentenbereich ist der Hauptarbeitsbereich für die Interaktion mit KI-Agenten. Er zeigt Chat-Nachrichten an, rendert Code mit Syntaxhervorhebung, zeigt Datei- und Komponentenkontext und bietet Steuerelemente zur Verwaltung der Konversation. Jeder Agenten-Tab hat seinen eigenen unabhängigen Agentenbereich.
Tab-Komponenten
Code-Terminal-Tab
Für CLI-basierte Agenten (Claude Code, Gemini CLI, Codex CLI). Zeigt eine terminalähnliche Oberfläche, in der der Agent Befehle ausführt und die Ausgabe in Echtzeit anzeigt.
SDK-Chat-Tab
Für SDK-basierte Agenten (Claude SDK, Gemini SDK, OpenAI SDK). Bietet eine konversationelle Chat-Oberfläche für die Interaktion mit dem Agenten.
ACP-Chat-Tab
Für ACP-Agenten (Agent Communication Protocol). Eine spezialisierte Chat-Oberfläche zur Kommunikation mit dynamischen protokollbasierten Agenten.
Agenten- und Skill-Tab
Durchsuchen und verwalten Sie Agentenfähigkeiten, benutzerdefinierte Agenten und Skill-Definitionen für das aktuelle Projekt.
Sitzungsverlauf-Panel
Zeigen Sie ein Protokoll aller vergangenen Sitzungen für den aktuellen Agententyp an, mit der Möglichkeit, vorherige Konversationen zu laden und zu überprüfen.
Bildergalerie
Durchsuchen Sie Bilder, die von KI-Agenten während der aktuellen Projektsitzung generiert wurden.
Kontextverlauf
Übersicht
Das Kontextverlauf-Panel verfolgt den gesamten Kontext, der mit KI-Agenten in Ihrem Projekt geteilt wurde. Es trennt den Kontext in interne und externe Quellen und gibt Ihnen volle Transparenz darüber, auf welche Informationen Agenten zugegriffen haben.
Kontexttypen
Interner Kontext
Kontext, der innerhalb Ihres Projekts generiert wurde — ausgewählte Dateien, geprüfter Code, Komponentenauswahlen und Dateiinhalte, die Sie Agenten während Chat-Sitzungen explizit bereitgestellt haben.
Externer Kontext
Kontext von außerhalb Ihres Projekts — Websuchergebnisse, abgerufene URLs, importierte Dokumentation oder andere externe Datenquellen, auf die Agenten verwiesen haben oder die Sie angehängt haben.
Funktionen
Chronologisches Protokoll
Kontexteinträge werden in chronologischer Reihenfolge aufgelistet, sodass Sie nachvollziehen können, was wann geteilt wurde.
Dateiregister
Ein internes Dateiregister verfolgt alle Dateien, die mit Agenten geteilt wurden, einschließlich erweiterter Metadaten und eindeutiger IDs für jede Datei.
Kontextanzeigen
Der Chat-Eingabebereich zeigt eine Kontextanzeige, die die Anzahl der aktuell angehängten Dateien anzeigt, damit Sie immer wissen, welcher Kontext aktiv ist.
Kontext-Modalfenster
Klicken Sie auf die Kontextanzeige, um ein detailliertes Modal zu öffnen, das den gesamten aktuellen Kontext zeigt — Dateien, Komponenten und Projekte — mit Optionen zum Hinzufügen oder Entfernen von Elementen.
Intern und Extern
Übersicht
Der Intern-/Extern-Umschalter in der Agenten-Symbolleiste steuert, wie CLI-basierte Agenten, einschließlich benutzerdefinierter Agenten, gestartet werden. Dies bestimmt, ob der Agent im integrierten Arbeitsbereich-Terminal oder in einem separaten externen Terminalfenster auf Ihrem System ausgeführt wird.
Modi
Intern
Der Agent wird im integrierten Arbeitsbereich-Terminal ausgeführt. Die Ausgabe wird inline im Agentenbereich angezeigt, und die Sitzung wird vollständig von Kaiju Hub AI verwaltet.
Extern
Der Agent wird in einem separaten System-Terminalfenster gestartet (z. B. PowerShell, Terminal, iTerm). Nützlich, wenn Sie eine vollständige Terminal-Umgebung benötigen oder Agenten neben anderen Kommandozeilen-Tools ausführen möchten.
Shell-Auswahl
Im Extern-Modus erscheint ein Dropdown-Menü, mit dem Sie auswählen können, welche Shell verwendet werden soll (z. B. PowerShell, Eingabeaufforderung, Git Bash). Die ausgewählte Shell wird beim Starten externer CLI-Agenten-Sitzungen verwendet.
Erweiterte Chat-Eingabe
Übersicht
Die Erweiterte Chat-Eingabe ist der Haupteingabebereich am unteren Rand des Agentenarbeitsbereichs. Sie geht über ein einfaches Textfeld hinaus und bietet Bildanhänge, Bildschirmaufnahme, Dateianhänge, Komponentenauswahl, Spracheingabe und granulare Berechtigungssteuerung für KI-Kontext.
Anhang-Schaltflächen
Galerie (Bildersammlung)
Öffnet das Bild-Upload-Modal, in dem Sie Bilder durchsuchen, auswählen und hochladen können, um sie in Ihre Nachricht einzubeziehen. Unterstützt Mehrfachauswahl mit Vorschaubildern und Drag-and-Drop-Upload.
Bild-Popup-Modal
Klicken Sie auf ein beliebiges angehängtes Vorschaubild, um es in einer zentrierten Vollbildansicht zu öffnen. Schließen Sie es mit der X-Schaltfläche oder durch Klicken außerhalb des Modals.
Bildschirmaufnahme
Nehmen Sie Bildschirmaufnahmen direkt aus der Chat-Eingabe auf. Der Rekorder nimmt Frames mit konfigurierbarer FPS (30 oder 60) auf, verfolgt Frame-Anzahl und Dauer und generiert ein Manifest mit Metadaten. Aufgenommene Frames können an Nachrichten für visuellen Kontext angehängt werden.
Dateianhang
Hängen Sie Projektdateien direkt über das Büroklammer-Symbol an Ihre Nachricht an.
Arbeitsbereich-Kontext
Fügen Sie Arbeitsbereich-Kontext über das Gehirn-Symbol hinzu — umfasst Projektdateien und Metadaten für ein umfassenderes KI-Verständnis.
Komponentenauswahl
Wählen Sie Komponenten oder Blöcke aus der Bibliothek über das Puzzle-Symbol aus, um sie als Kontext einzubeziehen.
Kontext einschließen
Übersicht
Die Schaltfläche „Kontext einschließen" ist das erste Symbol in der linken Seitenleiste des Chat-Eingabebereichs. Sie ermöglicht es Ihnen, Projektkontext — wie angehakte Dateien, ausgewählte Komponenten oder Arbeitsbereich-Metadaten — an Ihre Nachricht anzuhängen, bevor Sie sie an den KI-Agenten senden.
Verwendung
Linksklick
Öffnet das Kontext-Panel, in dem Sie durchsuchen und auswählen können, welche Dateien und welcher Projektkontext Ihrer nächsten Nachricht beigefügt werden sollen.
Rechtsklick
Fügt sofort den aktuellen Kontext in Ihre Nachricht ein, ohne das Panel zu öffnen. Dies ist eine schnelle Verknüpfung, um alle aktuell ausgewählten Dateien und den Kontext anzuhängen.
Projektbilder
Übersicht
Das Projektbilder-Panel ist eine zentrale Galerie für alle mit Ihrem Projekt verbundenen Bilder. Laden Sie Screenshots, Mockups, Referenzbilder oder beliebige visuelle Assets hoch, die Sie an KI-Konversationen anhängen oder im Arbeitsbereich organisiert halten möchten.
Funktionen
Bilder hochladen
Klicken Sie auf den Upload-Bereich oder ziehen Sie Bilder direkt per Drag & Drop in das Panel. Sie können auch Bilder aus der Zwischenablage mit Strg+V / Cmd+V einfügen.
Bildraster
Hochgeladene Bilder werden als Vorschaubild-Raster für einfaches Durchsuchen und Auswählen angezeigt.
Auswahlsteuerung
Wählen Sie einzelne Bilder durch Klicken aus, oder verwenden Sie Alle auswählen / Alle abwählen für Massenauswahlen. Ausgewählte Bilder können mit Alle löschen entfernt werden.
An Nachrichten anhängen
Ausgewählte Bilder können als visueller Kontext beim Senden von Nachrichten an KI-Agenten einbezogen werden und ihnen Referenzmaterial für Ihre Anfragen bereitstellen.
Bildschirmaufnahmen
Übersicht
Das Bildschirmaufnahmen-Panel ermöglicht es Ihnen, Bildschirmaufnahmen zu erstellen und Aufnahmeeinstellungen zu konfigurieren. Aufgenommene Frames werden als Bilder gespeichert, die an KI-Agenten-Konversationen angehängt werden können und visuellen Kontext für Ihre Anfragen bieten.
Aufnahmeeinstellungen
Aufnahmegeschwindigkeit
Wählen Sie zwischen Langsam (2 FPS) und Normal (4 FPS). Verwenden Sie Langsam, wenn die Aufnahme zu schnell ist oder Inhalte fehlen. Normal nimmt mehr Details auf, verbraucht aber mehr Speicher.
Frames pro Bild
Steuern Sie, wie viele Frames pro Bild kombiniert werden. Setzen Sie auf 1 für einzelne Screenshots oder höhere Werte für Rasterkompositionen, die mehrere Frames in einem einzelnen Bild zeigen.
Rasterspalten
Legen Sie die Anzahl der Spalten im Rasterlayout fest, wenn mehrere Frames in einem einzelnen Bild kombiniert werden. Verwenden Sie 1 für vertikale Stapelung oder höhere Werte für breite Raster.
Aufnahmequelle
Wählen Sie, welcher Bildschirm oder Monitor aufgenommen werden soll. Zeigt verfügbare Monitore mit Auflösung und Positionsdetails an. Der primäre Monitor ist zur einfachen Identifizierung gekennzeichnet.
Aufnahmen-Tab
Der Aufnahmen-Tab zeigt alle zuvor erstellten Aufnahmen an. Durchsuchen Sie vergangene Sitzungen, überprüfen Sie aufgenommene Frames und hängen Sie sie an neue KI-Konversationen als visuelle Referenz an.
Einstellungen
Übersicht
Das Einstellungen-Panel bietet Konfigurationsoptionen für den aktiven KI-Agenten. Greifen Sie über das Zahnrad-Symbol in der Chat-Eingabe-Seitenleiste darauf zu. Die Einstellungen steuern Berechtigungsmodi und anderes agentenspezifisches Verhalten.
Berechtigungsmodus
Alle Berechtigungen überspringen
Wenn aktiviert, werden alle Berechtigungsprüfungen für den Agenten umgangen (entspricht --dangerously-skip-permissions). Dies ermöglicht dem Agenten, Dateibearbeitungen, Terminal-Befehle und andere Aktionen ohne Bestätigungsaufforderungen auszuführen.
Neustart erforderlich
Änderungen an den Berechtigungseinstellungen werden in der nächsten Sitzung wirksam. Schließen und öffnen Sie den Agenten-Tab erneut, um die neue Konfiguration anzuwenden.
Spracheingabe
Übersicht
Die Spracheingabe-Schaltfläche ist das Mikrofon-Symbol am unteren Rand der Chat-Eingabe-Seitenleiste. Sie bietet plattformnative Sprache-zu-Text-Funktionalität, mit der Sie Nachrichten an KI-Agenten diktieren können, anstatt zu tippen.
So funktioniert es
Aktivieren
Klicken Sie auf das Mikrofon-Symbol, um die Spracheingabe zu starten. Das Symbol zeigt einen aktiven Zustand während des Zuhörens.
Diktieren
Sprechen Sie natürlich und Ihre Worte werden in Echtzeit in das Chat-Eingabefeld transkribiert, unter Verwendung der Spracherkennung Ihres Systems (Windows-Spracherkennung unter Windows, Diktierfunktion unter macOS).
Senden
Wenn Sie mit dem Diktieren fertig sind, überprüfen Sie den transkribierten Text und klicken Sie auf Senden oder drücken Sie Enter, um Ihre Nachricht an den Agenten zu übermitteln.
Tastenkürzel
Mittlere Maustaste
Unter Windows und Mac (wenn Ihre Maus eine mittlere Taste hat) drücken Sie die mittlere Maustaste, um die Aufnahme zu starten. Klicken Sie erneut im Chat-Eingabebereich, um die Aufnahme zu stoppen und die Nachricht automatisch zu senden.
Benutzerdefiniertes Tastenkürzel
Sie können ein benutzerdefiniertes Tastenkürzel für die Spracheingabe im Voice-Tab in den Einstellungen festlegen. Damit können Sie die Sprachaufnahme ohne Maus starten und stoppen.
