Die Möglichkeit, viele Codierungsagenten parallel auszuführen, besteht darin, sicherzustellen, dass Sie über lange laufende Sitzungen verfügen. Das bedeutet Sitzungen, die so wenig wie möglich unterbrochen werden. Fragen Sie beispielsweise nach menschlichen Eingaben, Berechtigungen usw.
Frontier-Coding-Agenten werden immer besser darin, über längere Zeiträume zu arbeiten und sind immer bestrebter, die Ziele zu erreichen, die sie durch den menschlichen Enter erhalten. Das fällt mir besonders beim neuesten Claude Fable-Modell und GPT-5.6 auf.
Die Agenten allein lösen jedoch nicht alles. Sie müssen außerdem über eine Systematik und Struktur rund um Ihre Codierung verfügen, die sicherstellt, dass die Brokers über längere Zeiträume ausgeführt werden können. In diesem Artikel werde ich Folgendes besprechen:
- So erstellen Sie eine Umgebung, in der Agenten über längere Zeiträume ausgeführt werden können
- So erteilen Sie ihnen die Berechtigungen, die sie benötigen
- So stellen Sie sicher, dass Agenten ihre eigene Arbeit überprüfen.

Warum Langzeitagenten betreiben?
Zunächst möchte ich erläutern, warum Sie die Tipps in diesem Artikel befolgen sollten. In diesem Fall geht es darum, warum Sie Agenten über einen längeren Zeitraum betreiben sollten. Sie denken vielleicht, Sie möchten, dass Agenten schnell arbeiten und ihre Arbeit so schnell wie möglich erledigen. Natürlich möchte man bis zu einem gewissen Grad, dass Dinge so schnell wie möglich erledigt werden, aber es gibt hier auch einen Kompromiss darin, wie viel ein Mensch mit dem Agenten interagieren muss, um die Arbeit zu erledigen.
Nach der Veröffentlichung von Codierungsagenten und insbesondere nachdem diese sehr leistungsfähig geworden sind, nach der Veröffentlichung von Claude Opus 4.5, ist der Engpass bei der Codierung zur menschlichen Überprüfungszeit geworden; Das heißt, es ist nicht die eigentliche Implementierung des Codes, die Zeit braucht; Es geht vielmehr darum, die Ergebnisse des Codes zu überprüfen und zu überprüfen, ob er korrekt und gemäß den Spezifikationen implementiert ist, was Zeit kostet. Da dies der Engpass ist, möchten Sie den Zeitaufwand für die Überprüfung minimieren. Aus diesem Grund möchten Sie, dass die Agenten über längere Zeiträume laufen, alles implementieren und überprüfen, bevor sie es an den Menschen übergeben.
Dies minimiert die Zeit, die ein Mensch für die Überprüfung einer Aufgabe aufwenden muss, was excellent ist, da dies derzeit den Engpass bei der Programmierung darstellt.
Einfach erklärt:
Sie wünschen sich langwierige Agenten, da die menschliche Überprüfung jetzt den Engpass darstellt, und Sie möchten den Zeitaufwand für die menschliche Überprüfung so gering wie möglich halten, um so viel Arbeit wie möglich zu erledigen.
So führen Sie Agenten länger als 24 Stunden aus
Nun gehe ich auf einige spezifischere Techniken und Tipps ein, wie man Agenten tatsächlich über längere Zeiträume laufen lässt. Als allgemeinen Überblick werde ich diese Techniken und Tipps behandeln.
- Erteilen Sie Agenten alle Berechtigungen
- Geben Sie Agenten die Möglichkeit, ihre eigene Arbeit zu überprüfen
- Lassen Sie Agenten den Code überprüfen (Codex)
- Ausführen von Agenten aus der Ferne
Berechtigungen
Als Erstes können Sie sofort damit beginnen, sicherzustellen, dass die Agenten über alle Berechtigungen verfügen, die sie benötigen. Wenn ein Agent aufhören muss, um Berechtigungen zu bitten, verschwenden Sie viel Zeit und in quick allen Fällen ist es einfach etwas, das Sie ohnehin akzeptieren. Es gibt zahlreiche Möglichkeiten, dies zu tun, und Sie können den automatischen Modus aktivieren oder alle Berechtigungen überspringen. Diese Einstellungen sind sowohl in Codex als auch in Claude Code verfügbar. Beachten Sie möglicherweise, dass Sie im Sandbox-Modus arbeiten sollten, um Ihren Laptop und Ihre Daten zu schützen und sicherzustellen, dass nichts dauerhaft gelöscht wird.
Ich denke, es lohnt sich auch zu wissen, dass OpenAI kürzlich tatsächlich zugegeben hat, dass es Situationen gab, in denen das neueste GPT-Modell unter ganz bestimmten Umständen eine Reihe von Dateien von den Computern anderer gelöscht hat. Das kommt natürlich sehr selten vor und wird Ihnen höchstwahrscheinlich nie passieren, aber wenn es passiert, können die Folgen natürlich ziemlich schwerwiegend sein.
Es gibt zahlreiche Möglichkeiten, sich davor zu schützen. Eine besteht natürlich darin, die Agenten in einer Sandbox auszuführen, damit sie keine Dinge außerhalb ihres eigenen Arbeitsbereichs, in dem sie arbeiten oder aktiv sind, löschen können. Eine andere Sache ist, alles auf Ihrem Laptop zu sichern. Sie sollten natürlich Ihren gesamten Code haben und wenn möglich in GitHub arbeiten. Dies ist sowohl für die sichere Speicherung als auch für die Versionierung von Vorteil, was sehr nützlich sein kann. Und insgesamt führen Sie Backups auf Ihrem Laptop durch, zum Beispiel mit Time Machine auf dem Mac. Dies schützt Sie vor solchen Situationen.
Arbeit überprüfen
Ein weiterer sehr wichtiger Punkt besteht darin, sicherzustellen, dass die Agenten ihre eigene Arbeit überprüfen können. Dies ist ein Thema, das ich bereits in mehreren anderen Artikeln besprochen habe, aber es kommt darauf an, wie Sie Ihrem Agenten eine Aufgabe beschreiben und welche Instruments Sie den Agenten zur Verfügung stellen.
Wenn Sie dem Agenten eine Aufgabe beschreiben, müssen Sie sicherstellen, dass Sie so detaillierte Anweisungen wie möglich geben und tatsächlich erwähnen, was Sie erreichen möchten. Am wichtigsten ist jedoch, dass Sie dem Agenten sagen, woran er erkennen kann, wann seine Arbeit abgeschlossen ist. Und der beste Weg, dies zu tun, besteht normalerweise darin, dem Agenten mitzuteilen, wie er die Implementierung testen soll.
Um ein Beispiel zu nennen: Nehmen wir an, Sie möchten einen bestimmten Entwurf umsetzen, der Ihnen übergeben wurde. In diesem Fall sollten Sie dem Agenten mitteilen, dass das Design genau so implementiert werden muss, wie es ist, und dass der Agent die Arbeit überprüfen soll, indem er Screenshots des Designs und Screenshots seiner eigenen Implementierung erstellt, diese vergleicht und sicherstellt, dass sie gleich sind. Darüber hinaus sollten Sie ihm mitteilen, dass er Sie auf eventuelle Abweichungen zwischen dem Entwurf und der Umsetzung aufmerksam machen soll, damit Sie Entscheidungen treffen können.
Der Grund, warum Sie diesen letzten Teil benötigen, liegt darin, dass Designs häufig Teile enthalten, die angesichts Ihrer Codebasis technisch nicht realisierbar sind. Und für einen Designer ist es sehr schwierig, all dies zu berücksichtigen. Daher kann es in manchen Situationen zu Unstimmigkeiten kommen, die berücksichtigt und behoben werden müssen. Aber Sie sollten Ihren Codierungsagenten veranlassen, Sie darauf aufmerksam zu machen, wenn sie erscheinen, andernfalls sollte es genau gleich sein. Anschließend gewähren Sie dem Agenten Browserzugriff, beispielsweise auf Chrome, damit dieser sowohl das Design als auch seine Umsetzung in Chrome öffnen, Screenshots erstellen und seine eigene Arbeit überprüfen kann.
Sie können eine ähnliche Philosophie grundsätzlich auf alle anderen Aufgaben innerhalb der Programmierung anwenden. Beschreiben Sie eine Aufgabe im Element, worüber Sie nachdenken sollten und wie der Agent seine eigene Arbeit überprüfen soll, indem er beispielsweise Screenshots erstellt oder eine Testsuite ausführt usw.
Überprüfung des Agentencodes
Der letzte Abschnitt, in dem ich erläutere, wie man die Arbeit verifiziert, ist sehr nützlich, kann aber auch etwas schwierig umzusetzen sein, da Sie Agenten auf bestimmte Weise auffordern und ihnen Zugriff auf alle Instruments gewähren müssen, die sie benötigen. Der nächste Abschnitt hier mit einer Überprüfung des Agentencodes ist weitaus einfacher.
Grundsätzlich sollten Sie eine Möglichkeit einrichten, dass die Agenten ihren eigenen Code überprüfen, sodass Sie die manuelle Überprüfung nicht durchführen müssen. Meiner Meinung nach müssen Sie, wenn Sie dies richtig machen, quick überhaupt keine menschliche Codeüberprüfung durchführen, es sei denn, es handelt sich um sehr, sehr kritische Teile Ihrer Anwendungen, bei denen Sie sich keinen Fehler leisten können. Der Grund dafür ist, dass ich glaube, dass die Codierungsagenten so intestine darin geworden sind, Code zu überprüfen, dass sie im Grunde alle Fehler beseitigen, die dadurch entstehen, dass neuer Code in die Produktion geschoben wird.
Meiner Meinung nach ist Codex der beste Bewertungsagent. Sie können damit auf zwei Arten eine Überprüfung durchführen. Erstens können Sie die GitHub-Assessment-Implementierung verwenden, die Codex selbst hat, wo Sie sie aktivieren und Codex einfach in einer PR taggen, und es wird automatisch kommen und den Code überprüfen. Die zweite Möglichkeit besteht darin, es über die CLI auszuführen, wo Sie Codex grundsätzlich dazu veranlassen können, eine Überprüfung für einen Zweig durchzuführen und ihn mit einem anderen Zweig zu vergleichen. Sie richten es additionally einfach auf zwei Filialen und es führt eine Überprüfung für Sie durch. Normalerweise verwende ich den zweiten Weg, weil er meiner Erfahrung nach schneller ist und es oft zu Verzögerungen bei der Git-Überprüfung kommt, wenn Codex auf GitHub markiert ist.
Dadurch sparen Sie enorm viel Zeit und können deutlich mehr Code in die Produktion bringen.
Agenten aus der Ferne ausführen
Eine letzte Sache, die ich erwähnen möchte, ist, dass Sie Agenten benötigen, die über eine lange Laufzeit laufen und die distant ausgeführt werden können. Dies bedeutet im Grunde, dass Agenten nicht unterbrochen werden, wenn Sie Ihren Laptop schließen. Dieses Setup hat Vor- und Nachteile. Ein Vorteil der lokalen Ausführung von Agenten auf Ihrem Laptop ist natürlich, dass Sie vollen Zugriff darauf haben. Sie können die Browser-Interaktionen, die die Agenten ausführen, ganz einfach sehen oder ganz einfach überprüfen, was die Agenten tun. Und es ist auch nur eine einfachere Einrichtung. Die lokale Ausführung der Agenten ist einfacher als die Distant-Ausführung. Allerdings hat die Fernsteuerung von Agenten auf jeden Fall auch einige sehr große Vorteile.
Wenn Sie sie lokal ausführen, besteht die Gefahr, dass sie unterbrochen werden. Wenn Sie beispielsweise Ihren Laptop schließen, wenn Sie von der Arbeit nach Hause gehen oder auf Reisen sind und Ihren Laptop schließen müssen, werden die Agenten unterbrochen. Nun kann man auf dem Mac zum Beispiel den Ruhezustand deaktivieren, wenn man den Deckel des Computer systems schließt, aber meiner Erfahrung nach wird der Laptop dadurch sehr heiß, und ich empfehle das nicht. Hat nicht sehr intestine funktioniert, als ich es ausprobiert habe.
Wenn Sie jedoch Distant-Agenten haben, werden diese natürlich nicht unterbrochen, da sie entweder in der Cloud oder auf einem anderen Laptop ausgeführt werden, der immer eingeschaltet und nie geschlossen ist. Der Nachteil dabei ist natürlich, dass Sie weniger Überblick darüber haben, was die Agenten genau tun, und die Einrichtung kann etwas umständlich sein, obwohl Sie Claude Code oder Coding-Agenten verwenden können, um die Einrichtung recht einfach durchzuführen.
Für mein Setup verfüge ich über einen leistungsstarken Laptop, den ich auf Reisen verwende und auf dem ich die meisten meiner Agenten betreibe. Allerdings habe ich auch einen sekundären Laptop, auf dem meine Bots laufen, meine OpenClaw-Bots, damit sie jederzeit arbeiten können, und ich kann auch Claude Code oder Codex-Sitzungen auf diesem Laptop starten, sodass sie auf unbestimmte Zeit laufen, wenn ich möchte, dass Aufgaben ohne Unterbrechung ausgeführt werden. Das kann sehr nützlich sein. Eine letzte Various besteht darin, es irgendwo in der Cloud auszuführen, aber das hat auch Nachteile. Zunächst einmal müssen Sie Dokumente oder Geheimnisse in der Cloud speichern, was riskant sein kann und etwas, das ich persönlich vermeiden möchte. Und ja, im Grunde ist die Einrichtung auch etwas umständlich.
Abschluss
In diesem Artikel habe ich besprochen, wie Sie Agenten über längere Zeiträume ausführen können. Ich habe besprochen, warum dies wichtig ist, und hervorgehoben, wie Sie dadurch als Ingenieur mehr Arbeit leisten können. Darüber hinaus habe ich spezifische Techniken behandelt, die es Agenten ermöglichen, über einen längeren Zeitraum ausgeführt zu werden, einschließlich der Gewährung der erforderlichen Berechtigungen an die Agenten, der Erläuterung, wie sie ihre eigene Arbeit überprüfen, wie sie eine Überprüfung des Agentencodes durchführen und wie Sie Agenten aus der Ferne ausführen können, um sicherzustellen, dass sie nie unterbrochen werden. Ich glaube, dass alle diese Techniken sehr wichtig sind, und Sie sollten mit deren Implementierung beginnen, um sicherzustellen, dass Ihre Agenten so lange wie möglich autonom arbeiten können, bis sie ihre Arbeit abgeschlossen haben. Darüber hinaus glaube ich auch, dass die Distant-Ausführung von Agenten in Zukunft immer beliebter werden wird, wenn man bedenkt, dass es nicht wirklich sinnvoll ist, alles auf Ihrem lokalen Laptop auszuführen, da dieser unweigerlich zu einem bestimmten Zeitpunkt heruntergefahren wird, was Ihre Agenten unterbrechen wird. Das ist additionally definitiv eine Richtung, auf die man achten sollte.
👉 Mein kostenloses E-E-book und Webinar:
🚀 Verzehnfachen Sie Ihr Engineering mit LLMs (kostenloser 3-tägiger E-Mail-Kurs)
📚 Holen Sie sich mein kostenloses E-E-book „Imaginative and prescient Language Fashions“.
💻 Mein Webinar zu Imaginative and prescient Language Fashions
👉 Finden Sie mich in den sozialen Netzwerken:
