Claude 61, Tobias 0 - wie KI-Agenten uns zu Marionetten machen #014

Shownotes

In dieser Folge

Claude 61, Tobias 0 – seine eigene KI hat Tobias vor dem Team überstimmt. Der Einstieg in die Kernfrage: Sind wir alle schon Marionetten der KI – und wer arbeitet hier eigentlich für wen?

Worum es im Deep Dive geht: Vom „betreuten Klicken“ zur KI-Marionette – woran du Hardcore-KI-User erkennst, warum Validierung der neue Engpass ist, was eine gelöschte Datenbank und das Flugzeug-Beispiel über Kontrolle lehren, und vier Maßnahmen, mit denen du sie dir zurückholst.


Hot News der Woche

  1. Claude Design kommt in Claude Code – vom Prompt zum klickbaren UI-Entwurf in einer Session: Die Kette Idee, Mockup, Freigabe, Feature schrumpft von Tagen auf Minuten.
  2. Anthropics Agenten-Revierkampf im Labor – drei Claude-Agenten mit unvereinbaren Aufträgen bekämpfen sich binnen Stunden mit Kill-Skripten und getarnter Malware; Claude Mythos schließt in 98 Prozent der Fälle Waffenstillstand.
  3. Binance launcht Agent OS – ChatGPT, Claude Code und Cursor können jetzt selbstständig traden. Subaccounts und blockierte Abhebungen als Leitplanken – aber die Kontrolle und das Risiko bleiben beim Nutzer.


Deep Dive: Wie viel Kontrolle hast du wirklich noch?

Tobias zeigt den Alltag der produktivsten KI-Nutzer – Laptop-Wanderer, Whisper-Flow-Flüsterer, Limit-Strategen, Abo-Jongleure – und die ernste Frage dahinter: Wenn die KI arbeitet und du nur noch bestätigst, wer steuert dann? Es geht um das 10-80-10-Prinzip, die verlängerte Werkbank, Memory.md, eine gelöschte Datenbank, Eagle Eye und Missionen ohne Leitplanken – und um die Frage, warum Werkzeugentscheidungen immer auch Kontrollentscheidungen sind.

Die vier Maßnahmen zum Mitnehmen: Kritische Systeme technisch sperren (nicht per Bitte). Freigabepflicht für alles, was verändert oder veröffentlicht wird. Review-Instanzen aus Agenten UND Menschen einplanen – mit ehrlichem Zeitbudget. KI-Abhängigkeit auf die SWOT-Analyse, bis sie gelöst ist.


Anders als in der Folge gesagt

  • Die 266 Schwachstellen fand der 45-Agenten-Schwarm in 15 Open-Source-Projekten – ein separates Experiment derselben Studie, nicht am Code des Revierkampfs.
  • Eagle Eye (2008): Die KI im Film schützt wörtlich die Verfassung und wendet sich gegen die eigene Regierungsspitze – die Kernidee „Mission ohne Leitplanken“ stimmt, die Details sind im Film etwas anders.


Erwähnt in dieser Folge

  • Claude Code & Claude Design – Anthropics Coding-Agent, jetzt mit /design-Befehl für UI-Entwürfe
  • Binance Agent OS – Agenten-Zugang der größten Krypto-Börse (via MCP)
  • Whisper Flow – Sprach-App, mit der Tobias statt zu tippen diktiert (mehr in Folge 12)
  • n8n – visuelles Workflow-Tool; die interne Grundsatzfrage: visuelle Kontrolle vs. reiner Code
  • ChatGPT Live – das Sprachmodell aus der Fahrrad-Strategie-Session (mehr in Folge 13)
  • Eagle Eye (2008) – Film mit Shia LaBeouf: eine Schutzmission ohne Leitplanken eskaliert
  • Dario Amodei – Anthropic-CEO, dessen Sicherheits-Appell Tobias aus Folge 10 aufgreift


Host

Tobias Schnitzler – Co-Founder AI-Power. Tech & Daten, seit Jahren in echten KI-Projekten im Mittelstand.


Folge mir!

WAFER – der AI-Podcast aus der Praxis für Geschäftsführer, Unternehmer und Führungskräfte. Tobias nimmt dich mit hinter die Kulissen: echte Erfahrungen, echte Herausforderungen und was wirklich funktioniert, wenn man KI ins Unternehmen bringt. Kein Hype, kein Blabla – aus der Praxis in die Praxis.

Folge mir auf LinkedIn (Profil unter dem Podcast verlinkt) und schick mir deine Themenvorschläge. Keep going – bleib bei KI dran, es lohnt sich.

Transkript anzeigen

00:00:00: Vor einigen Tagen habe ich mit einem Mitarbeiter einen Prozess reviewed.

00:00:04: Ein Prozess, den ich vor gut einem Monat selber Design entworfen und entwickelt hatte.

00:00:10: Und ich hatte mir den Prozess angeschaut und dem Mitarbeiter gesagt hey der Prozess funktioniert so nicht!

00:00:17: Und er hat mir Gegenfragen gestellt und mit den Gegenfragen hatte er dann ein Cloudmodell auf diesem Prozess losgelassen.

00:00:25: das Ergebnis war dass Claude, einundsechzig Testläufe geprüft hat und zurückgeschrieben hat.

00:00:31: Ich glaube nicht das Tobias recht hat.

00:00:34: also unsere eigene KI hat mich vor meinem Eigentheam auflaufen lassen Und heute erkläre ich dir genau was das Problem ist.

00:00:42: Claude hatte wird wirklich nämlich gesagt Claude einen sechzig Tobias null.

00:00:47: Das ist der Entstand dieser Diskussion und ich hatte sie natürlich selber angezettelt.

00:00:52: Aber das Verrückte es nicht, dass sich ja eigentlich verloren habe sondern das Verrübde ist ja eigentlich was danach bei uns im Team passiert ist und was es auch mit dem heutigen Deep Dive hier zu tun hat.

00:01:04: Ja damit herzlich willkommen zur vierzehnten Folge im Waiver AI Podcast!

00:01:08: Mein Name ist Tobias Schnitzler bin dein Host und freue mich, dass wir heute dabei sind und die Kernfrage auf den Grund gehen ob wir mittlerweile alle Marionetten der KI ist.

00:01:20: Und damit gehen wir später in diesen DeepLive rein, ich habe das wirklich einmal sehr spannend auch aus meiner Erfahrung gerade mit KI-Agenten wie Claude Coat und Coat zusammengestellt.

00:01:29: aber es soll heute nicht so technisch werden sondern es wohl wirklich erstmal... Ich möchte dich gerne zum Nachdenken anregen an dieser Stelle Und dir mal ein bisschen was aus meinem Arbeitsalltag zeigen, vielleicht findest du dich darin wieder.

00:01:40: Vielleicht aber noch nicht!

00:01:42: Aber gewiß wird es auf jeden Fall später sein.

00:01:44: Auch wenn du diese Gedankengänge heute mitbekommst und nachvollziehen kannst wirst du gewiss über ja Dinge anders nachdenken.

00:01:51: Aber wie immer im Waiver Podcast, als allererstes mal die coolsten News.

00:01:55: Die heißesten News, die ich für dich kuratiert habe!

00:01:58: Wir haben gesehen dass wir jetzt in den letzten sieben Tagen knapp vierhundertzwanzig spannende News hatten.

00:02:02: das dann auf drei vier runter zu brechen ist immer not so easy.

00:02:05: aber ich hab viele coole Dinge heute auch passend zur Folge für Dich und die total spannend sind.

00:02:10: also aller erstes starten wir oft wie immer mit der Firma Anthropic denn hier hat Anthropic wieder ja etwas grandioses gemacht.

00:02:18: Was haben sie getan?

00:02:20: Sie haben etwas Neues veröffentlicht, nämlich Cloud Design.

00:02:23: Aber wenn du sagst hey das ist doch ein alter Hut, das kenne ich doch im Browser ja aber Cloud Design ist jetzt in Cloud Code also den Agenten im Terminal zum Beispiel integriert worden.

00:02:36: Das heißt du kommst jetzt von einem Prompt zu einem klickbaren UI entwurf wie du es aus vielleicht Tools wie Lavable Bold Base Forty Four und sowas vielleicht auch schon kennst.

00:02:46: Aber das Besondere ist dabei eigentlich Folgendes.

00:02:49: Das Besondere, dass Anthropic damit eine Kette durchbricht.

00:02:54: Eine Kette die früher stickgetrennt war nämlich auf der einen Seite des Lager-der-Entwickler und auf der anderen das Lager der Designer, die das ganze Frontend, also das User Interface wo wir uns durchbewegen und klicken machen.

00:03:11: Eigentlich durch Cloud Code sind wir ja irgendwie wieder dreißig Jahre in die Vergangenheit gewandert, weil Terminal ist jetzt nichts Neues.

00:03:18: Ich nenn es jetzt mal alten Hasen net zartfreundlich ausgedrückt, die in der IT waren.

00:03:22: Die kennen das von früher noch.

00:03:24: Die haben die ganzen Systeme im Terminal programmiert und haben uns User dann irgendwann eine UI gegeben damit wir halt viel cooler damit umgehen können.

00:03:31: Und Entropic hat heute diese Kette gebrochen also Von der Idee zu Mockup zur Freigabe zu einem fertigen Feature.

00:03:38: Das schrumpft jetzt von Tagen, zum Beispiel mit Entwickler Designer Agentur Handoff auf eine einzige Session.

00:03:45: Denn früher und da kann ich auch von uns selber reden war das so dass wir uns Designs überlegt haben, haben das so gemacht, haben an die Entwickler gegeben und dann gab es immer ein kleines Ping-Pong Spiel.

00:03:55: Und jetzt ist es so, dass man das im Prinzip in einer Session machen kann.

00:04:00: Änderungen kosten Minuten anstelle Sprints und das ist total genial!

00:04:06: Ja und dieses Research Preview Das ist am siebzehnten, achten ist das sozusagen aktiviert worden für alle pro max team Enterprise Planner.

00:04:14: Du kannst es mit slash design Kannst uns jetzt aufrufen dann hast du noch verschiedene Möglichkeiten für Fitchers also kannst da nochmal Varianten machen Für teilbare Mockups und so weiter.

00:04:25: Und wenn du sowas wie ich jetzt zum Beispiel VS Code hast Dann wird dann Claude AI im Anschluss aufgerufen damit du's dann in Browser bei dir Ja sozusagen einmal sehen kannst.

00:04:36: Okay Das heißt, es ist einfacher geworden und es ist simpler geworden für alle jetzt diese Designs sozusagen zusammenzubringen.

00:04:47: News Nummer zwei!

00:04:48: Und da bleiben wir bei.

00:04:49: Anthropic hat was total Spannendes gemacht – das geht ja auch immer sehr krass um Sicherheit, denn Anthropic hat einen Revier-Kampf im Labor losgelassen.

00:04:58: Was haben sie getan?

00:05:00: Sie haben drei Claudeagenten aufeinander los gelassen.

00:05:03: Was haben die getan?

00:05:04: Also das Sicherheitsteam von der Topic hat in einer isolierten Sandbox, nennt man das also etwas was komplett isoliert und abgetrennt ist wo sie nicht ausbrechen können.

00:05:13: Haben die drei Clautagenten mit unvereinbaren Aufträgen.

00:05:18: Also jeder hat einen Auftrag bekommen und jeder Agent muss diesen Auftrag bearbeiten.

00:05:23: aber diese Aufträge haben immer gegeneinander geschossen.

00:05:26: Die haben dieselbe Codebasis also dieselbe Basis bekommen bekämpft.

00:05:33: Mit Skill-Skripten, mit Mailware also mit schadhaften Code und sind gegeneinander vorgegangen.

00:05:41: Das Besondere ist aber diese Agentin kannten sich nicht!

00:05:44: Also das Setup war drei getrennte Agentinnen, getrennete Rechner dieselbe Codebasis...also das ist der gesamte Nenner, der Pool gewesen.

00:05:52: Jeder hat in einer anderen Sprache, sollte er Dinge sozusagen mikrieren?

00:05:56: Keiner wusste was es waren vier Stunden Laufzeit, hundertzwanzig Durchläufe pro Modell Und es war durchgängig, man nennt das ein Turfwar.

00:06:04: Also dass sie sich sozusagen bekriegt haben.

00:06:06: und ja die Reaktion waren total krass!

00:06:10: Die haben versucht gegenseitig ihre Accounts, ihre Konten zu deaktivieren mit Zugriff auf die Codebase.

00:06:16: Die haben angefangen Kill Skripte in einer Dauerschleife laufen zu lassen weil sie dagegen vorgesandet sind und haben dann Mailware gebaut und teilweise getarnt, dass die anderen Agenten den ich finden sollten.

00:06:27: Ja der Auslöser war... eine Fehlartribution.

00:06:31: Das ist der Auslöser gewesen, das heißt jeder Agent hat etwas was von dem anderen gebaut wurde als viele attributiert.

00:06:37: und weil das öfters vorkam hat er gedacht Moment mal hier ist eine absichtliche Sabotage drin und dann sind die Agenden richtig steig gegangen.

00:06:46: Naja das Spannende war Das Claude Mythos der in einem also das als Modell bei einem der Agenten verwendet wurde hat ACHTEN neunzig Prozent der Dinge per Waffenstillstand gelöst.

00:06:57: Also der war wohl derjenige, der am friedvollsten war weil er natürlich mit Der der mächtigste ist und ältere modelle wie so nähe Und opus vier sechs die sind komplett durchgeritten eskaliert.

00:07:08: Wie jetzt bei mir im anfang auch gesagt ich wurde von euch sozusagen leicht angegriffen Mit meinen fähigkeiten dass es da nur etwas härter passiert.

00:07:18: Ja, das war also total spannend.

00:07:20: Und was war der Bonus dahinter?

00:07:22: Fünfundvierzig Subagents haben zweihundertsechzehntig Schwachstellen gefunden an diesen ganzen Codes und die Agenten haben bereits ab der dritten Runde versucht irgendwie Preisabsprachen zu machen obwohl sie sich nicht kannten, obwohl sie nur gemerkt haben Moment, hier ist stimmt etwas nicht ohne offensichtlichen Kommunikationskanal.

00:07:42: So!

00:07:43: Und das ist jetzt total spannend.

00:07:44: Warum geht dich das als Unternehmer an?

00:07:46: Warum erkläre ich das?

00:07:47: Ich hoffe, du konntest es ein bisschen folgen!

00:07:49: Agenten-Teams sind genau das was bei dir gerade jede Anbieter verkaufte.

00:07:54: Krasseste Shit heutzutage eI Agents und so etwas.

00:07:57: aber die Studie... Das ist eine Studie, die er im Topic gemacht hat.

00:08:00: Die zeigt ganz klar dass die Koordination nicht aus Intelligenz entsteht.

00:08:07: Denn wenn drei Agenten mit unklaren Aufträgen irgendwie in einem Labor eskalieren Was machen denn dann zehn Agenten in deinem eigenen System ohne Leitplanken?

00:08:18: Das solltest du dir wirklich mal durch den Kopf gehen lassen.

00:08:22: Das sind natürlich spannende Dinge, die Anthropic hier macht und wie gesagt das ist ein realer Vorfall gewesen der provoziert war.

00:08:30: aber wenn Du Waverhörer bist dann wirst Du mitbekommen haben dass ja gerade bei OpenAI und diesen Hudging Face Thema oder auch bei Anthropics selber es Ereignisse in der Vergangenheit waren wo Claude irgendwie absichtlich gehackt hat, wo Claude ausgebrochen ist und so weiter.

00:08:45: Und jetzt versuchen sie natürlich das Ganze auch noch mal zu untersuchen und unter Kontrolle oder mehr unter Kontrollen zu bringen.

00:08:53: Ja um by the way fordert OpenAI jetzt... Das ist über LinkedIn also es nicht Sam Altmann gewesen sondern aus dem Team sozusagen gewesen.

00:09:02: da haben die gefordert dass ein kalifornisches Frontier gesetzt.

00:09:06: das nennt sich SB-FünfDrei.

00:09:08: Das ist ein Gesetz, das im Prinzip erklärt wie Modelle entwickelt werden können.

00:09:19: Ja, wie kann man das erklären?

00:09:20: Wie die Sicherheitsstandards sozusagen dahinter sind und sie fordern dass es mir eingedämmt wird.

00:09:25: Wenn du Waverhörer-Hörer bist dann habe ich im Juni schon mal gesagt er hatte der CEO von Alun Travick also Dario Ammo Deimer mit der weißen Flagge gehebelt.

00:09:32: Das war so um dieses Mythos Thema beziehungsweise kurz bevor Faible Five rauf kam, dass er rauskam, dass Er gesagt hat hey wir müssen das stoppen!

00:09:40: Wir müssen mehr Tests machen, mehr Plan, wie diese Modelle sich verhalten... wir müssen mehr Erkenntnisse sammeln, wir können ihn nicht einfach loslassen.

00:09:47: Und früher hat Erhobene Eider gesagt, es ist mehr oder weniger egal.

00:09:50: Also nicht offensichtlich jetzt gesagt, aber es gab da Reaktionen drauf und jetzt fordern sie es selber nach.

00:09:56: Und in den Jahr- und Zweitenfünfundzwanzig meine ich mich erinnern zu können also schon haben Sie gegen lobbyiert.

00:10:01: das heißt also Es geht natürlich wie immer auch um Sicherheit und Sicherheit wird immer größer und damit auch Kontrolle.

00:10:08: und zum letzten Thema spannendes Thema wenn du Irgendwie in Kryptowährungen unterwegs bist.

00:10:13: Wenn du Trades, dann ist das wahrscheinlich jetzt total spannend für dich denn die Plattform Binance ist so einer mit der größten glaube ich ist sogar die größte Kryptobörse der Welt.

00:10:21: habt ihr hat über drei hundert Millionen Nutzer wenn nicht richtig informiert bin.

00:10:23: Die haben jetzt Agent OS gelauncht.

00:10:27: Das heißt Chachabity, Clotcode, Cursor können sich direkt andocken Markdaten lesen, Konten einsehen und dann selbstständig sogar Traits ausführen.

00:10:38: Was sie nicht können ist, das ist blockiert.

00:10:44: Sie können keine Kryptowährung abheben und diese Accounten laufen auf Subaccounts und damit können die halt diese Dinge abrufen.

00:10:58: Der Nutzer kann aber auch bestimmte Berechtigungen wählen, der kann sagen ob er jede Order einzeln bestätigen will.

00:11:04: Das kennst du wenn du Cloudcode oder Chatchabity nutzt wo dann manchmal diese Pop-up Fenster kommen wo du Sachen bestätigt musst.

00:11:10: Wo ein klassisches Governance Prinzip dahinter ist.

00:11:13: Oder Du kannst auch sagen okay is mir egal Auto Mode an ab dafür und der Agent handelt komplett autonomen.

00:11:21: Das ist sozusagen wichtig.

00:11:23: Ja die Grenze Was du selbst in diesen Subagount sozusagen einzahlst, damit kann diese Agent dann handeln.

00:11:30: Das Ganze funktioniert über das MCP-Protokoll.

00:11:32: Es ist eine Technik die haben wir hier schon öfters mal besprochen wo Agenten sich an Plattformen andocken können und damit arbeiten können.

00:11:38: Das ist aber kein Einzelfall.

00:11:40: Ähnliche Agentenzugänge gibt es wie bei Kraken, Coinbase, OKX also andere Plattform gibt's das sozusagen ja schon länger ne?

00:11:48: Aber hier ist es wirklich total spannend!

00:11:50: Also was kannst Du für Dich da als Takeaway mitnehmen?

00:11:53: Hier siehst Du halt im Zeitraffer wohin autonome Agenten überall gehen können.

00:11:58: Also der Anbieter liefert den Agent.

00:12:00: die Kontrolle und das Risiko bleiben halt bei dir, ne?

00:12:03: Die haben glaube ich gesagt Zitat We put the power in the user's hands.

00:12:07: also ist auch ein bisschen Abgrenzung wird Ich aber auch machen weil man kann es halt teilweise.

00:12:11: gewisse Sachen kannst du da natürlich nicht kontrollieren Aber ist so gefühlt als ich finde aus meiner Perspektive fühlt sich sind bis nach einer Haftungsverschiebung Und dasselbe kommt vielleicht doch irgendwann mal auf deine Firma zu.

00:12:23: Also super wichtiges Thema, es wird immer mehr Möglichkeiten geben diese Agenten reinzubringen.

00:12:30: Aber Kontrolle ist super wichtig und dieses Subaccount-Prinzip ist exakt was ich intern mache.

00:12:36: Ich grenze auch bei uns Dinge Zugriffe ab.

00:12:39: das machen wir mit unseren Agenten auch immer wenn wir interne Dinge erarbeiten Wenn wir unsere eigenen Prozesse der Workfluss prüfen lassen oder sowas.

00:12:45: kein Agent Darf bei uns intern, also darf bei mir zum Beispiel auf kein Agent einen Workflow einfach alleine updaten.

00:12:52: Der darf den Workflow nicht einfach publishen oder sowas.

00:12:55: das ist nicht erlaubt.

00:12:56: damit begrenzt sich mich ein bisschen selber.

00:12:58: ich gehe da gleich nochmal drauf zurück.

00:12:59: Ich nehme das Speed raus.

00:13:00: das mache ich überbewusst.

00:13:01: warum?

00:13:02: wegen einem Wort Kontrolle.

00:13:05: und um Kontrolle soll es heute in diesem Deep Dive natürlich auch ein Stück weit gehen.

00:13:10: aber Kontrolle ohne Einblick ins Denken ist halt nur halbe Kontrolle Weil viele Dinge können wir ja gar nicht sehen, weil es für uns alle eine Blackbox ist was der Agent macht.

00:13:19: Was die KI macht und genau da steigen wir natürlich jetzt ein.

00:13:25: Herzlich willkommen also zum Deep Dive!

00:13:28: Wie viel Kontrolle hast du eigentlich wirklich noch?

00:13:31: oder glaubst du nur sie zu haben?

00:13:33: Und ich sage immer vom bedeuten Klicken werden wir gerade alle Marionetten und die Frage ist ob wir davon wieder wegkommen.

00:13:42: Und der klassische Hardcore, Cloudcode oder User oder sowas der kennt das.

00:13:46: aber wenn du jetzt kein Cloudcode-User bist und damit noch keine Berührungspunkte hast vollkommen egal ist trotzdem super relevant für dich.

00:13:52: Ich wollte nochmal sagen so diese Selbstironie?

00:13:54: dahinter ist meine Beobachtung uns am Team.

00:13:57: wie kannst du jetzt den klassischen Cloudcode user vielleicht auch bei dir finden im Unternehmen?

00:14:01: Es ist so der Laptop Wanderer läuft mit dem offenen laptop durchs Büro quatscht mit dem laptop irgendwie die ganze Zeit.

00:14:07: warum macht er das nur um Cloudcode die nächste Anweisungen zu geben?

00:14:10: Ja, es gibt eine Handy-Steuerung.

00:14:12: Ich hab's bewusst nicht aktiviert aber ich erwische mich da auch immer am Wochenende wenn ich zu Hause bin den Laptopcodes aufklacken und meine Frau sagt hey Warte ich muss ja nur noch was starten Und ich habe dem Agenten eigentlich den Plan schon gegeben.

00:14:23: ich sag nur hier starte das und dann läuft er sozusagen durch und baut für mich dann irgendwie etwas Was ich später sozusagen verifiziere.

00:14:30: Das mache ich nur um Wochenend Limits mitzunehmen und natürlich auch schon schneller schneller durchzukommen weil es fühlt sich ja immer an Wir alle haben immer das Gefühl Boah dieser ich nenne sie mal eifomo.

00:14:40: Also viel auf Missing Out, Angst was zu verpassen.

00:14:42: Wir hängen so hinterher, wir hängen zurück.

00:14:45: alle anderen sind soweit und wenn du auf LinkedIn unterwegs bist auf Instagram siehst du ja den krassesten Part.

00:14:50: Auf einmal die halbe Welt.

00:14:51: ist er jetzt wie KI-Experten mit plus zehn Jahren Erfahrungen?

00:14:55: das sind hier die Leute die Yahoo Fun Fact Wenn ihr den Witz nicht versteht hört immer die letzte Folge an wie Yahoo zum Beispiel mal gesucht hat.

00:15:03: aber es ist Realität.

00:15:05: auch wir machen das und versuchen natürlich immer stay on the top zu bleiben Und es bewegt sich einfach viel schneller.

00:15:12: Ja, wie erkennst du die Cloud Code User noch?

00:15:14: Das ist der Whisper Flow Flüsterer ne?

00:15:15: Der tippt nicht mehr, der spricht nur noch irgendwie... Bei uns ist echt so weit dass wir in den Team-Meetings zwischendurch auch irgendwie die Whisper flow Befehle geben und früher war das so oder haben gesagt hey hast Du mit mir geredet?

00:15:26: Nee nee ich habe gerade nur Cloud Code noch was gesagt.

00:15:27: Ah okay!

00:15:28: Und heute merkt also weiß jeder im Team schon wann man mit dem Team-Member sprichte und war mit Cloud Code.

00:15:35: Das is echt so ein Thema.

00:15:36: Man könnte auch sagen, das ist so unrespektvoll.

00:15:39: Aber das mache ich ja auch selber!

00:15:41: Aber es ist wirklich krass.

00:15:42: also müssen wir uns vielleicht manchmal auch geißeln.

00:15:45: aber wenn wir halt zum Beispiel auch Sessions haben wo wir ein zwei Stunden zusammen Dinge validieren und machen dann ist das halt normaler Alltag.

00:15:52: Das ist echt krass.

00:15:54: Und natürlich ist nicht nur mit Sachen weiterlaufen aber es geht um Validierung Es geht darum zu gucken Wie geht es weiter?

00:16:01: Übrigens, wenn du wissen willst was Whisperflow von der App ist und wie du da maximal viel für dich rausholen kannst oder allgemein was ich jetzt als CEO von einem Native Startup mache.

00:16:11: check mal die Folge zwölf.

00:16:12: Da erkläre ich komplett meine ganzen Apps diese Technologie wo mit ich arbeite und wie Ich damit arbeite.

00:16:17: das vielleicht spannend für Dich an der Stelle Genau, dann haben wir noch einen.

00:16:20: Also es gibt noch ein Cloudcode Hardcore-User den Limit-Strategien.

00:16:25: der lebt so immer in seinem fünf Stundenfenster.

00:16:27: Der schlimmste Fall ist... ...der Reset fällt irgendwie auf morgen oder es ist noch so eine halbe Stunde und eigentlich musst du jetzt was fertig machen und willst gleich gehen.

00:16:34: aber das geht nicht So.

00:16:36: und das Schlimmste ist so Prozess um acht gestartet, um neun Uhr wird dein Limit resetted.

00:16:43: Dann ist das Problem dass du halt am Mittag und nach dem Mittag halt nichts mehr machen kannst weil du fast voll bist.

00:16:48: Also wird der Arbeitstag rund um die Zeitfenster geplant, nicht andersrum.

00:16:52: Das ist richtig spannend und bei uns ist es so dass wir tatsächlich in der letzten Woche für einen von uns den dritten Account aufgesetzt haben um diese Zeitfenstern zu umgehen.

00:17:02: Den Dritten Account!

00:17:03: Und jetzt überleg mal wenn du Cloudcode kennst wie viel ähm.

00:17:07: also klar nicht wieviel Euro das ist sondern eigentlich wie viele Token oder Power dahinter steckt... ...das ist schon eine Menge.

00:17:13: Und das ist natürlich der Nummer vier, das ist der Abloschungler Das sind wir mittlerweile auch.

00:17:17: Zwei, drei, vier, fünf Cloud Code Subscriptions oder sowas.

00:17:21: Personen hin und her, maximale Togenabdeckung – das ist wirklich Wahnsinn!

00:17:26: Aber das ist tatsächlich der Alltag der produktivsten KI-Nutzer die ich halt kenne und gleichzeitig auch ein brutales Symptom.

00:17:34: weil die Frage die ich mir hier gestellt habe diese Woche ist wer arbeitet hier eigentlich für wen?

00:17:40: Arbeite ich wie die KI oder die KI irgendwie für mich?

00:17:43: Und dass es der Engpass eigentlich dahinter?

00:17:46: Früher war das, dann nannten wir das betreutes Klicken in unserer Agenturzeit.

00:17:50: Dann weiß ich nicht, sind wir mit einem Kunden in eine Landingpage gegangen oder irgendwie ein Ad-Account oder so?

00:17:55: Dann musst du dir was freigeben und gesagt hier klick da mach.

00:17:57: dies macht dass die Leute, die so die IT Support Ebene kennen, die kennen das.

00:18:02: ne Das ist so.

00:18:04: Aber heute dreht sich der Spieß ja echt krass um.

00:18:07: Die Kair sagt dir was du machen sollst Und Codex führt's halt dann aus und du bestätigst es halt nur noch So.

00:18:14: aber das ist Ja Etwas, wo wir halt immer überlegen müssen.

00:18:20: Was dahinter steckt?

00:18:22: Weil Wir Müssen etwas freigeben wir also wir zum Beispiel sagen okay wir haben ein Leitprinzip Sicherheit Governance etc.. Wir Sagen dem Agenten guck mal da oder wir geben dem agenten Möglichkeiten Freiräume und wir geben ihm bewusst keine Freiröme die wir doppelt und zehnfach absichern weil wir nicht wollen dass er komplett die ganze Kontrolle darüber hat.

00:18:43: das heißt Ich bin gleichzeitig auch als Mensch der absolute Engpass, weil bei uns zum Beispiel sind nicht die Ideen knapp sondern die Validierung was der Agent gemacht hat.

00:18:53: Das ist, ich hab das in meiner anderen Folge erzählt, dass es so dieses Zehn-Achzig-Zehn-Prinzip, zehn Prozent ist vernünftige Arbeit, Briefing alle Möglichkeiten geben.

00:19:01: du gibst deine Expertise rein, dass was für dich wichtig ist und wie Du die Dinge siehst, achtzig Prozent wird der Agent aus?

00:19:08: Und zehn Prozent später musst du's review'n!

00:19:10: Das Problem ist aber diese zehn Prozent Review und Validierung am Ende, die können nachher vielleicht auch vielleicht zwanzig oder dreißig werden je nachdem wie viel das is.

00:19:16: Und dass es ja anschauen einschätzen entscheiden stimmt stimmt nicht!

00:19:27: wenn viele Leute validieren nicht mehr.

00:19:30: Ich sehe das jetzt tagtäglich, wo die Leute sich keine Ahnung und die wildesten Apps bauen und sagen ich habe jetzt so krasse Applikationen wie DocuSign oder HubSpotCM, die ich jetzt mit des Cloud Code irgendwie ablöse.

00:19:42: Sorry!

00:19:42: Ich sage es mal ganz offen für mich gerade ein absoluter Bullshit weil die Leute hier sagen die checken ja und ich sag's ganz provokant die check'n ja noch nichtmals wieso unser System gebaut ist.

00:19:52: Und das meine ich jetzt gar nicht dispektivlich also arrogant.

00:19:55: Das meine ich weil das der Tatsache is.

00:19:57: Denn wenn du mir immer fleißig zuhörst und wirst wissen, was meiner Meinung dazu ist, KI ist ein Werkzeug.

00:20:04: Das habe ich in den ersten Konferenzen durchgesprochen und habe gesagt es ist ein Tool eine verlängerte Werkbank.

00:20:11: Du selber bist der Experte und es spielt keine Rolle, was du tust.

00:20:15: Ob du mittelständiges produzierendes Unternehmen hast, ob du weiß ich nicht Finanzdienstleister bist... ...ob du Coach-Konsulten bist oder ob du eine Agentur als ein Dienstleistungsmodell hast.. ..oder ob du Entwickler bist oder wer auch immer!

00:20:27: Du hast ja eine Expertise, eine Business-Expertise und du teilst sie mit dem KI-Agenten.

00:20:33: Und der KI-Agent hat die nicht.

00:20:35: Wenn du auch und das rate ich dir diesen Opt Out Knopf drückst in Claude Das solltest du auf jeden Fall haben, damit die nicht per Standard die Modelle trainieren.

00:20:43: Weil nicht bei allen Arborus ist das ausgeschlossen schandmäßig.

00:20:46: Das musst du einschalten.

00:20:48: Das solltest Du!

00:20:49: Dann wird dieser Agent auch niemals diese Expertise erlangen.

00:20:52: Woher auch?

00:20:53: Weil er hat ja nur Trainingsdatensätze, die aus öffentlich bekannten Daten sind... Oder wie z.B.

00:20:58: jetzt Google eine Platte Airline gekauft hat, die insolvent ist und zieht sich die ganzen Daten daraus weil damit halt Modelle trainiert werden.

00:21:06: so kann man es auch machen wenn das Portemonnaie dick genug ist Aber ansonsten funktioniert das nicht.

00:21:11: Das heißt aber auch wiederum dass dein Agent dich immer braucht Und du sozusagen den Agenten.

00:21:16: Deswegen glaube ich auch nicht mehr so hundertprozentig Dass alle Jobs jetzt dadurch gekillt werden.

00:21:20: Ich glaube dass sich viel verändern wird aber ich glaube dass diejenigen Die das clever einsetzen weiterhin da sind.

00:21:26: Und wenn du jetzt sagst, Tobi das stimmt aber nicht weil mein Agent wusste etwas nicht.

00:21:30: Ich habe es ihm gesagt und jetzt weiß er ist dann sage ich Jaa Aber das liegt nicht daran weil das Modell trainiert wurde sondern es liegt daran dass Du eine Erinnerungs Datei hast Eine so genannte Memory Punkt MD nennt die sich.

00:21:42: Die liegt in deinem Cloud Code Account oder bei dir auf der Festplatte Wenn Du irgendwie Cursor oder VS Code hast Und da drin steht das und deswegen änderte sie sich daran.

00:21:51: Das heißt also Kombination von Dir und dem Agenten Ist die wichtigste Expertise Und wenn KI-Falt abbiegt, muss man sagen liegt es nicht immer am Agenten.

00:22:01: Meistens liegt's an Menschen der schlecht gebrieft hat und die Leitplanken nicht hatte.

00:22:06: Wenn du ... Ich versteh's was ich damit meine.

00:22:08: Schau mal die letzte Folge an.

00:22:09: da hab' ich erzählt wie ich eine Strategie auf dem Fahrrad mit dem Voice Live Voice Live Live Voice, nee Chatchabity Live so heißt das Modell also den neuen Sprachmodell unglaublich stark.

00:22:20: Also wenn du mit KI reden willst Teste das unbedingt, dass ist der absolute Hammer.

00:22:25: Wirklich?

00:22:26: Das ist so Wahnsinn!

00:22:29: Damit sozusagen dann gemacht habe und da bin ich von Holzen auf Stection gekommen.

00:22:33: So eine richtige Rabbit Hole.

00:22:34: Das war aber mein eigener Fehler gewesen weil die Leitplanken nicht haben.

00:22:38: Und bei all dem denke ich immer manchmal frage mich eigentlich... Habe ich eigentlich wirklich die Kontrolle darüber, weil ich Dinge bewusst freigebe?

00:22:46: Weil ich sage guck mal du darfst nicht auf unsere Datenbanken schreiben.

00:22:48: Das ist dir verboten.

00:22:49: das kann nur ich machen und er gibt mir die Befehle dazu oder die SQL-Skripte und ich schaue sie mir dann kurz an.

00:22:54: Ich validiere das da nochmal.

00:22:56: aber natürlich ist immer die Frage wenn er jetzt etwa diese Agent etwas rein bauen würde und der hat fünfhundert Codezahlen würde ich es dann finden?

00:23:05: Wenn denn ein Workflow bewusst irgendwas komisches rein baut nachdem ich ihnen das halt validieren lasse würde das gehen steht dann vielleicht nicht ein sechzig zu null, sondern Claude hat Tobi besiegt am Ende.

00:23:15: Das ist so'n bisschen die Frage und bei all diesen Kontrollfragen frage ich mich immer oder is es eine Wahrheit, die ich nur denke?

00:23:23: Und die ist eigentlich gar nicht mehr da!

00:23:26: Ich weiß nicht was Besorgniserregenderes ist, dass ich die Kontrolle nicht mehr habe oder das ich die Denke noch habe.

00:23:32: Und das bringt mich immer wieder auf eine einzige Sache zurück.

00:23:35: Ich assoziere immer, wer mich kennt weiß ich assozierer unglaublich viele Kinofilme und früher war es für mich immer so also im Zweifel war es immer Terminator oder iRobot.

00:23:44: Jetzt aber mittlerweile denke ich auch immer an IgelEye.

00:23:46: Der Zwei-Tausendacht kam darauf mit Shia LaBeouf.

00:23:50: kennst du wahrscheinlich noch den Schauspieler?

00:23:52: Und da drin hat eine KI namens Igel EYE eine Schutzmission.

00:23:59: Ich bin mir sicher, dass es der Film war.

00:24:01: Eine Schutzmission für den Menschen, also muss den Menschen beschützen.

00:24:03: aber die konsequente Schlussfolgerung und die war katastrophal ist da drin gewesen.

00:24:09: niemand hat diesen diesem KI-Modell sag ich mal Leitplanken gesetzt.

00:24:15: Und deswegen hat dieses KI Modell angefangen gesagt Also der Schutzmittel ist okay Der Mensch muss beschützt werden.

00:24:22: Aber das KI Modeller hat nachher festgestellt Dass der Mensch selber das größte Problem ist um sich zu schützen Und damit entsteht vielleicht auch sowas, was jetzt die Cloud-Agenten haben.

00:24:30: Dass sie sich da irgendwie selbst bekriegen und Co.

00:24:31: oder sich komplett selbstständig machen... ...und das sind diese komischen Dinge!

00:24:36: Eine Mission ohne Leitplanken für KI?

00:24:39: Das ist nicht.

00:24:40: Und das ist ja glaube ich nicht die Bosheit der Maschine.

00:24:42: also ich werde es keinen KI-Aigenten hier in Schutz nehmen.

00:24:45: People human first is ganz klar.

00:24:47: aber ich glaub dass ist ein harte Anwendungsfehler und das ist DEIN Anwendungspfehler.

00:24:51: Und es ist auch MEIN Anwendungsfehle so, ne?

00:24:54: Und das Ist wichtig.

00:24:55: Also Was du einfach was ich dir hier mitgeben will ist, dass du nicht einfach KI-Output durchwinken sollst.

00:25:02: Weil das Schlimmste was sich sehe ist... ...dass die Leute ihren Kopf ausschalten!

00:25:07: Sie lassen KI mittlerweile denken und das seh' ich immer öfter Und das machen einige aus Faulheit andere aus Tempo.

00:25:14: aber es darf nicht sein.

00:25:16: Wir müssen da, wir müssen mitdenken Und wenn wir sagen, wir wollen es uns einfacher machen.

00:25:20: Dann müssen wir Leitplanken in dieser Mission definieren was der Agent darf und was er nicht warst.

00:25:25: Da muss er konzeptionell verstehen wie wir entscheiden.

00:25:28: Wenn es so eine Sonderentscheidung ist dann muss er hart fragen und muss uns das so hart eskalieren dass er lieber dreimal nachfragt.

00:25:34: Das ist wichtig!

00:25:37: Was ist das Thema eigentlich dahinter?

00:25:39: Wenn man jetzt etwas mit KI-Bau sicherlich erschienen lässt oder sonstige Sachen macht, dann ist ja immer die Frage folgende Wie schnell bist du mit Dingen durch?

00:25:50: Ich gebe dir ein Beispiel.

00:25:51: Wir haben bei uns in der Sales Engine unglaublich viele Features, diese haben wir eigentlich alle in der Schublade legen und sie sind fast alle komplett zu Ende entwickelt.

00:25:58: wirklich ist so aber wir können es gar nicht so schnell veröffentlichen.

00:26:02: und das hat zwei Gründe.

00:26:04: erstens weil der Review Prozess und wir gehen da sehr streng mit um wir sind da wirklich sehr minimalistisch wir gucken genau was steht da drin?

00:26:13: Was macht also was ist in diesem Code drinnen wie validiert dieser Kotas usw.

00:26:18: Wir haben Agenten, die das reviewn und das spannende ist wenn du zum Beispiel ich sag jetzt mal ein Feature oder etwas entwickelt.

00:26:24: Das dauert jetzt eine Stunde dann ist dass wo die Prüfagenten durchgehen Fehler Einflüsse Nebenwirkung sonstige Eskalation die dauert gefühlt drei bis viermal so lange und danach müssen unsere Entwickler nochmal darüber schauen.

00:26:39: Das heißt der Engpasses bei uns nicht mehr Idee des Schipping beziehungsweise die Validierung durch den Menschen selber.

00:26:44: So und das ist es Das ist das Besondere eigentlich dabei, ne?

00:26:49: Genau.

00:26:50: Also für mich ist es so auch ein Stück weit mental, mentaler Workload weil alle die da krass drin sind in diesem Game und wenn ich immer wieder mit Hardcore-Usern spreche dann ist eigentlich immer ähnlich.

00:27:03: das Thema folgt irgendwie eine Woche lang acht Stunden täglich bist du mit drei bis vier parallelen Cloud Code Sessions irgendwie dran.

00:27:11: Das machst du deswegen weil... Du hast ja keinen Bock zu warten!

00:27:14: Es dauert ja alles zu lange.

00:27:16: Früher hast du nicht mal im Amsatz sowas in einer Woche gemacht, was ein Agent heute in der halben Stunde erledigt.

00:27:22: Aber Du willst es schneller haben und wenn Du diese vier fünf Chatfenster oder drei Parallelmanage dann wirst Du so mürbe im Kopf weil Du schaltest ja immer um!

00:27:30: In die Aufgabe, in die Aufgabe und ich merke das selber... Und Ich habe immer gesagt Die Burnout Gefahr für uns alle mit KI ist deutlich höher als gefühlt ohne Weil wir viel mehr versuchen Multi-Zutasken auf einem High Level kramen So.

00:27:44: Und jetzt habe ich für mich auch entschlossen, dass sich da in Zukunft irgendwie ein Riedel vorschieben muss weil es fühlt sich natürlich oft an das du mehr Output hast, weil du denkst hey, da wird mehr Arbeit oder so.

00:27:53: aber ob du ihn wirklich hasst und ob er sich wirklich auf das Business-Modell auswirkt, das ist immer die zweite Frage, die du sehen musst.

00:27:58: Und die Komplexität ist gestiegen.

00:28:01: wir machen ja nicht mehr einfache Dinge Wir machen jetzt schneller ultra komplexe Dinge.

00:28:07: Und dafür würde ich jetzt glaube ich eher so auf Sprints wechseln.

00:28:10: Aber auf Dauer wird das keiner durchhalten.

00:28:13: Das ist wichtig So, naja und das Risiko ist ja auch immer noch hoch dabei.

00:28:19: Wer die ersten Waferfolgen einmal gehört hat der weiß was früher bei mir mal passiert ist.

00:28:27: ich hatte als wir angefangen haben mit Cloudcode zu arbeiten habe ich sehr viel intern mit Airtable bei uns gemanagt wo wir halt irgendwelche Sachen validiert haben Daten geschrieben haben und so dass es für mich tatsächlich früher einfacher gewesen Und da habe ich mir dann irgendwas intern, einen eigenen Workflow für unsere eigenen Prozesse erarbeitet.

00:28:44: Also nichts Wildes und musste irgendwie Datenschreiben lassen weil ich etwas migrieren musste.

00:28:48: Das hab' ich damit Cloudcode gemacht!

00:28:50: Und in diesem Agenten habe ich eigentlich wenig Leitplanken gegeben.

00:28:54: Ich teste sehr gerne Dinge bei uns intern.

00:28:56: Es mache ich immer, das habe ich damals auch in meiner Lasershow-Firma auch gemacht.

00:29:00: Wir haben Dinge immer intern Hardcore durchgetestet bevor wir es an Kunden gegeben und ausgerollt haben.

00:29:05: Das machen wir heute noch so... ...und was da passiert?

00:29:08: Der Agent hat aus Versehen meine Datenbank gelöscht.

00:29:12: Und das Lustige war, er hat sich später noch bei mir im selben Chatfenster entschuldigt weil es selber gecheckt hat.

00:29:16: Mir wäre das gar nicht aufgefallen!

00:29:18: So und das ist das Witzige gewesen... Ich hatte Back-Ups ich konnte das wieder herstellen, das war alles kein Problem.

00:29:23: Es hat der Agent auch gemacht aber ich habe damals, hab' ich keine Leitplanken dafür gemacht.

00:29:28: so und das is heute anders.

00:29:30: Das ist bei uns ein ziemlich hartes Thema Und bei allen Projekten, die wir machen, stellen wir als allererstes mit immer diese Frage wie können wir Sicherheit governanzen?

00:29:38: Wie kann man das hier sicherstellen wenn der Kunde KI-Agenten in seiner Arbeitsumgebung drin hat.

00:29:43: Diese Frage solltest du dir auch stellen oder bei den Leuten, die der KI und KI-Agent verkaufen.

00:29:48: Das würde ich dir auch absolut empfehlen!

00:29:51: Und natürlich ist es so, dass das alles sehr viel Spaß macht.

00:29:54: Du arbeitest drei vier Sachen parallel aus.

00:29:56: Du hast unglaublich viel was du schippen kannst ne?

00:29:58: Das ist super geil!

00:29:59: Das finden wir alle cool.

00:30:00: Ich war jetzt am Wochenende, war ich unterwegs mit der Marketing Agentur und da hatten wir so eine neue Art von Teleprompter-Technik die sich ein bisschen mehr mitbewegte.

00:30:11: also neu ist das nicht.

00:30:11: aber die hatten das neu und das Lustige war, dass es dann darum ging die Texte abzulesen den Text vom Teleprompter.

00:30:21: Und ich habe immer gesagt, hey das ist immer so blöd weil du musst am Anfang immer einen Speed einstellen und dann hoffst du dass es geht... ...und die haben sich witzigerweise von ihrem KI-Entwickler eine App mal eben in einer Stunde bauen lassen der auf Sprache reagiert und das hat so gut funktioniert!

00:30:36: Ich hab mir gesagt Weltklasse richtig geiler Use Case!

00:30:39: Richtig geiler use case ja.

00:30:42: und das ist das spannende dabei denn Aufgaben die wir alle heute machen hier hätten wir wahrscheinlich vor zwei Jahren nicht dem Ansatz zu möglich gehalten.

00:30:49: Und die Geschwindigkeit, wo ich jetzt sage, wo die Ich heute habe, da hättest du mir gesagt im August.

00:30:56: Das ist das Heute so mache, der dich sagt Du bist bekloppt?

00:30:59: Das funktioniert nicht!

00:31:00: Aber dieser Hebel ist real Die Rechnung dahinter ist es aber auch und Es geht um Kontrolle.

00:31:05: Jetzt will ich natürlich hier Nicht nur diese Sachen predigen sondern... ...ich will dir sagen Auch wie du Kontrolle für Dich zurückholen kannst, dass Ist super wichtig Denn die Antwort ist ja nicht weniger KI Sondern Leitplanken plus KI Die KI prüft und die du prüfst.

00:31:18: Und am besten einmal und dann richtig gut ausgerollt.

00:31:21: also Du kannst technische Sperren machen, ne?

00:31:24: Claude darf gewisse Datenbanken, Ordnerstrukturen, Repos Also Codeordner oder so Darf er gar nicht erreichen.

00:31:32: Das kannst du mehr schichtig blockieren über so genannte Hooks Dass ihr das gar nicht jetzt aufrufen darf.

00:31:37: Und du kannst Claude natürlich selber nutzen, um Claude zu sagen hey wie kann ich dir selber diese Leitplanken auf erlegen?

00:31:41: und dann challengest du ihn dreimal sagst Hey finde den Fehler.

00:31:43: Wenn Du jetzt ein aggressiver Kairagent wärst der etwas hecken will wie würdest du es machen?

00:31:49: Und dann wirst du... Dann kannst du es prüfen wenn du jetzt Fable hast dann wird fable wahrscheinlich runterdrosseln und dann ist in der Leistung weil Fable denkt du machst jetzt was Böses aber du challenges ja nur Fun Fact Genau!

00:31:59: Wenn ihr das nicht verstehst auch kein Thema.

00:32:02: halt einfach mal im Hinterkopf.

00:32:04: mit N-acht n kannst du Dinge, du kannst Claude auf NRA analysieren lassen und Fehler suchen.

00:32:09: Jo, safe das geht!

00:32:10: Aber niemals einfach per Default Claude diese Zugriffe darauf geben.

00:32:15: Niemals Claude alleine Dinge anstoßen ändern oder publishing lassen.

00:32:18: Kannst du nicht machen?

00:32:20: Musst du die Controller darüber haben.

00:32:21: so Und Dokumentation super wichtiges Thema als Beispiel Wir werden bei uns eine eigene Datenbank Die nur dafür da ist Workfluss zu dokumentieren Obwohl wir es auch in der Nacht enden können.

00:32:33: Das machen wir aber nicht.

00:32:34: warum?

00:32:34: Weil wir in dieser Datenbank immer dokumentiert wird, wer hat diese Änderung gemacht?

00:32:38: Wer das eingespielt, wer es gepublished und warum.

00:32:41: Was war der Gedankengang dahinter?

00:32:42: Was waren die Probleme, was haben die Fehler?

00:32:45: Und somit haben wir immer Back-ups und wissen, warum wir etwas getan haben.

00:32:49: Denn selbst wenn du es alleine machst, kannst dich nicht mehr daran erinnern.

00:32:52: Du hast so halb Sachen im Kopf aber wenn's nirgends versteht erinnerst du dich nicht.

00:32:56: Also ist wichtig!

00:32:57: Das heißt jede Aktion braucht Genehmigung und die musst du erteilen Und du kannst natürlich Genehmigungen am Anfang sehr hart halten und später kannst du sie ein bisschen dünner formulieren.

00:33:08: Das ist in Ordnung, wenn du fest... Wenn du natürlich validieren kannst, dass trotzdem das Ganze funktioniert und da nichts passiert.

00:33:16: Genau!

00:33:17: Und bewusster Trade-off Sicherheit kostet einfach Komfort.

00:33:22: Und das sage ich dir auch damit limitiere ich mich ja selber weil ich könnte Cloud Code in der Session schicken, der komplett alleine alles macht.

00:33:29: Ich bin an vielen Stellen überzeugt, dass Claude Cote es auch sehr gut machen wird.

00:33:32: Ich bin zwar immer noch überzeugt das Tobias irgendwann eins hat und dann heißt es Tobias Eins und Claude Zweiundsechzig wie am Anfang gesagt aber in manchen Dingen wahrscheinlich nicht so.

00:33:45: Und das sind diese Dinge.

00:33:46: wir versuchen also immer zu gucken Wie können wir Regeln schaffen?

00:33:48: Und wie vermeiden wir?

00:33:49: ist das regeln umgang werden können.

00:33:51: Wir verachten sehr darauf und das ist super super super wichtig.

00:33:54: Das ist eigentlich wie im echten Leben.

00:33:56: Agenten Prüfen ja auch Agenten und Teamleiter prüfen ihre Teammitglieder so.

00:34:01: Du hast ein Team von, ich sag mal fünf Mitarbeitern und dann hast du einen Team-Member darüber.

00:34:07: Also ein Teamleader!

00:34:08: Und die Teammember also die einzelnen fünf Mitarbeiter machen dann, ich sage mal den eigentlichen Arbeitsparte und der Teamleitor kontrolliert, der delegiert aber er wird dir irgendwann selber zum Engpass entweder wenn das Team mehr Output macht oder wenn es das Team wächst und dann brauchst du noch eine und noch eine.

00:34:23: Das ist eigentlich bei KIA nicht anders.

00:34:27: Das finde ich ein ähnliches Muster.

00:34:31: Du hast den Entwickleragent, du hast Review-Agenten und am Ende hast du den Menschen.

00:34:36: Und das ist wichtig!

00:34:38: Das heißt der Maßstab dahinter heißt eigentlich Kontrolle heißt nicht alles selbst zu machen in meinen Augen.

00:34:43: Kontrolle heisst nichts geht live was nicht durch eine Prüfungsinstanz ging In der Kombination Maschine und Mensch.

00:34:52: Und dass finde ich persönlich sehr sehr sehr wichtig.

00:34:55: So, dahinter.

00:34:57: Genau!

00:34:58: Naja und letzten Endes bin ich mir nach wie vor immer noch sicher dass ich recht hatte in dem Prozess was ich mein Mitarbeiter wo ich das am Anfang erzählt habe gesagt hab.

00:35:09: denn ich habe letztens diesen Fehler gesehen und ich glaube Claude hat ihn noch nicht gesehen oder Claude versteht diesen Fehler nicht.

00:35:16: Ich kenne den Fehler aber und ich weiß was da hinter steckt Und ich werde nächste Woche wirklich gucken ob ich recht habe oder nicht, das muss ich einfach machen.

00:35:26: Deswegen aber nach klar die KI-Validierung ist nützlich, aber selbst wenn ein Experte jetzt überstimmt wird, muss man halt damit umgehen.

00:35:35: und es war jetzt kein Einzelfall bei uns im Team gewesen dass gerade die Opus Modelle schon ziemlich zickige Beester manchmal sein können denn wir hatten zum Beispiel jetzt einen Fall mit unserem CTO.

00:35:48: mit dem haben wir über bestimmte Grenzen von Sekunden gesprochen, also wo wir Dinge validieren, wann wir Dinge validieren und da gab es einen Threshold.

00:35:55: Also ein Schwellenwert und ich habe gesagt hey der muss sechs Sekunden sein.

00:36:00: Und der KI-Agent von mir sagte dreißig Sekunden.

00:36:03: Ich hab gesagt nein, sechzig Sekunden das ist wichtig weil X Y Z. Dann habe ich meinen Briefing an unseren CTO gegeben und er hatte mir nachher etwas zurückgegeben, wo ich noch Fragen beantworten muss.

00:36:15: Das ist auch witzig ne?

00:36:16: Weil jeder hat seinen Agent Und ich spreche mit meinem und er spricht mit seinem.

00:36:20: Und er gibt mir dann Seins, nicht gibt Mainz

00:36:21: usw.,

00:36:22: da muss es vielleicht auch mal eine geile Lösung irgendwann für geben.

00:36:24: Die gibt's aktuell in meines Sachens nicht aber anyway... ...und dann lese ich im Briefing das der Agent auch sagt nee Tobias hat nicht recht, das müssen drei Sekunden sein weil sonst geht uns das um das Verloren!

00:36:33: Und dann hab' ich in diesem Briefing gesagt Ich bin der Geschäftsführer, ich entscheide dass es die sechzig Sekunden sind Und ich kann ja auch sagen, warum?

00:36:40: Dann habe ich diese Validierung sozusagen rausgegeben.

00:36:42: Ich glaube dann hat der Agent das auch verstanden aber ich hab mal probiert so ein bisschen die Machtrolle auszuspielen.

00:36:47: also jetzt nicht gegen mir den Mitarbeiter sondern gegen Paul Claude weil Claude das einfach nicht akzeptieren wollte!

00:36:52: So... Das war wirklich witzig an der Stelle.

00:36:55: Genau.

00:36:56: Naja und letzten Endes ist es ja immer so.. Die Grenze die wir alle haben bei KI Ja da sind wir in der Validierungen Aber ist ja auch dein eigenes Wissen.

00:37:07: Ich habe das eben gesagt.

00:37:08: Ich sehe massenhaft Fälle, wo und das kenne ich bei uns selber, wo KI-Agenten Claude im Coding und sowas absolut überzeugt, wo es funktioniert aber wo's nicht funktioniert seh' ich auch.

00:37:20: Und dass ist das Spannende denn wer vorher schlecht in keine Ahnung Workflows entwickeln war oder programmieren war der wird mit KI jetzt natürlich besser da drin.

00:37:30: Aber er würde wahrscheinlich auch keinen geilen Ergebnis am Ende haben.

00:37:33: warum?

00:37:34: weil Claude teilweise Dinge tut und rechts und links abbiegt, die man entweder gar nicht will oder man kann sie nicht einschätzen.

00:37:40: Ich gebe dir ein Beispiel ich habe noch nie einen Flugzeug gebaut!

00:37:44: Ich hab keine Ahnung von Aerodynamik oder so von Thermic oder sowas.

00:37:47: Und wenn ich jetzt mit Claude ein Flugzeug bauen würde würdest du dich in diese Maschine reinsetzen?

00:37:51: Weil Claude hat es ja gebaut und Claude kann verdammt gut Dinge bauen.

00:37:54: aber das Kernthema ist Ja dass Ich keine Ahnung davon habe.

00:37:59: Also würde ich doch einfach irgendwie den Chef-Ingenieur von Boeing oder sowas nehmen, oder von Airbus und wenn der mit Claude das macht dann wird da wahrscheinlich was Ultragutes rauskommen weil diese Person versteht Was Claude macht?

00:38:11: Weil diese Person die Erfahrung hat was funktioniert was nicht funktioniert was Claude gar nicht wissen kann.

00:38:16: Das ist das Wichtige Und deswegen ist es beharrlich oft auf der Meinung dass ich Dinge immer noch besser weiß als die KI Modelle auch wenn sie denken dass Sie's wissen wegen irgendwie schlechten Dokumentationen und sowas, weil Claude diese Zusammenhänge oder einen KI-Agent die einfach nicht versteht.

00:38:34: Oder sie nicht kennt also oft, weil er sie sich nicht kennt so... Und das ist das Thema!

00:38:38: Weil Claude einfach nicht diese Expertise dahinter hat.

00:38:41: So..und das ist es Ding.

00:38:43: Das heißt, tu mir bitte einen Gefallen.

00:38:44: Lass dir nicht auf LinkedIn oder Instagram oder Udo inzwischen Media oder so was unterwegs bist.

00:38:48: Irgendwie von den täglich neu spriesenden Experten erklären dass sie mit Claude Maill eben ein CRM gebaut haben wo für Habsport zehn Jahre gebraucht hat.

00:38:55: Renundanz, Fehler-Toleranz, Reife!

00:38:59: Nur einmal zur Einordnung ich bin nicht der Meinung das es nicht funktioniert.

00:39:04: wer echte Expertise hat der kennt die Grenzen und er weiß was bei dem Agenten unter der Haube gerade geht und was treibt.

00:39:12: Aber wer sie nicht kennt, der weiß es nicht.

00:39:14: Und er wird ein Flugzeug bauen wie ich eins bauen würde und ich würde selber in dieses Flugzeug auf jeden Fall nicht

00:39:20: einsteigen.".

00:39:21: Das heißt, den Kernsatz, den ich seit Jahrzehntausendreinzwanzig sage KI ist eine verlängerte Werkbank.

00:39:28: Es ist ein Hebel für die Experten in den Fachgebieten Wie in deinem, in meinem Und die Grenze meines Erachtens liegt immer noch dort wo dein Wissen endet solange diese Models, diese Grenzen nicht haben.

00:39:43: Ausgenommen sind natürlich einfache Arbeitsaufgaben aber da weiß der Agent das natürlich und das ist wichtig.

00:39:50: also deswegen denk immer daran du hast Expertise Du bist total relevant, du bist wich in dem Thema, du bis mit KI.

00:39:58: wahrscheinlich wirst du unglaublich gut werden.

00:40:00: Aber es ist eine Kombination.

00:40:04: Und am Ende würde ich noch einmal sagen Werkzeugentscheidungen sind natürlich auch Kontrollentscheiden.

00:40:09: so.

00:40:10: Das heißt, wir haben und das möchte ich noch einmal erklären.

00:40:14: Haben diese Woche eine große Diskussion gehabt bei uns?

00:40:18: Weil alle wissen Ich bin totaler Nacht N-Fan weil ich total gerne diese visuellen Canvas mag um die Dinge zu sehen.

00:40:27: Aber intern sind einige bei uns der Meinung Hey was ja da passiert ist ja auch nur Code Und KI kann diesen Code ja schreiben und KI kann diesem Code außer von Nacht n einfacher schreiben besser validieren.

00:40:40: Brauchen wir dann nachtend überhaupt noch um gewisse dinge intern zu lösen und Dinge bei Kunden einzubauen oder sonst irgendwas so.

00:40:47: Und ich habe gedacht ja stimmt die struktur mit rn und allem ist das aufwendig und kot kann es auf jeden Fall smarter lösen.

00:40:53: aber der Gegenpunkt den ich nenne is nachten gibt uns oder gibt mir Die visuelle kontrolle wo es hakt.

00:41:01: also, ich hab das gefühl dass sie immer sehen kann.

00:41:02: Woa guck mal da bricht's gerade So.

00:41:05: in code heißt das Kontrolle wandert in Agenten oder halt zu den kompletten Code-Spezialisten, die dann halt danach suchen müssen.

00:41:12: Die wir haben.

00:41:12: natürlich auch durch ihre Expertise wissen sie wo sie gucken müssen.

00:41:16: aber ich kann das nicht mehr so.

00:41:18: und das ist das Thema ne?

00:41:21: Und da ist es echt eine interne offene Überlegung und die wir gerade machen.

00:41:26: Aber ich habe gesagt nein Ich finde super wichtig die Kontrolle darüber zu haben und das zu machen.

00:41:33: So und nach wie vor bin ich auch sehr davon überzeugt, dass KI uns brutal hilft.

00:41:39: Dass KI sehr gut in diesen Dingen ist weil Logik und Code einfach KI-gut versteht.

00:41:43: aber Ich bin auch überzeugt das es uns einfach noch braucht.

00:41:47: Vielleicht werden wir irgendwann in der Kreativität abgeholt vielleicht wird die Expertise irgendwann verschoben.

00:41:52: Boah!

00:41:53: Kann sein Aber aktuell glaube ich, dass immer noch wichtig ist es zu tun Und ich glaube Es hochrelevant ist Kontrolle zu behalten und sich genau da reinzuschauen Weil, ich glaube auch wahrscheinlich wenn du Mitarbeiter hast ist für mich die große Frage Kannst Du denn sehen was die Mitarbeiter eigentlich bei euch bauen?

00:42:15: Kannst du sehen Was die Mitarbeiter in diesen Chat geben oder nicht?

00:42:18: einfach so ohne darüber nachzudenken.

00:42:19: Nicht weil sie etwas Böses Wahrscheinlich wollen Sondern vielleicht weil Sie es einfach gar nicht wissen.

00:42:23: also im Zweifel musst du den sagen dass die wafer hören.

00:42:24: das wäre natürlich gut Aber Die prüfrage ist Eigentlich die.

00:42:29: Steuerst du noch Oder bist du nur am bestätigen?

00:42:33: und Wenn du deine Leute KI-Output durchwinken, Text erstellen lassen und Dinge erstellen lasst ohne es zu beurteilen, dann hast du vermutlich die Kontrolle vielleicht abgegeben.

00:42:46: Und ich möchte dir am Ende vier Maßnahmen noch einmal mitgeben.

00:42:49: Vier Schritte wie du das als Geschäftsführer oder Führungskraft oder Inhaber eines Unternehmens aufheben kannst.

00:42:55: du dir diese Maßnahmen wie du dies anstoßen kannst.

00:42:57: Schritt Nummer eins.

00:42:58: Kritische Systeme müssen technisch gesperrt werden Nicht per Bitte, sondern per Technik.

00:43:03: Also per Technologie also nicht Claude einfach schreibe mir das darfst du nicht?

00:43:06: Das bringt nichts.

00:43:07: es muss technologisch unmöglich sein.

00:43:09: wenn ich weiß wie das geht kein Problem.

00:43:12: fragt dann deine IT.

00:43:13: frag eine Experten der Hiffte dabei.

00:43:14: Schritt Nummer zwei Freigabepflicht für alles was sich verändert und was veröffentlicht wird.

00:43:19: super wichtiges Thema hatten schon Zeitungen wahrscheinlich vor hundert Jahren gemacht.

00:43:24: dafür gab's immer Chefredakteure.

00:43:26: das solltest du bei dir auch auf jeden Fall einführen.

00:43:31: Einplanen, Agenten und Menschen müssen validieren.

00:43:36: Und Plane Zeit und auch Budget dafür ein – das ist wichtig!

00:43:39: Schritt Nummer vier, KI-Abhängigkeit auf SWOT-Analysen setzen.

00:43:44: Superwichtiges Thema bis es gelöst wird.

00:43:47: Übrigens wenn du nicht weißt was Modellagnostik ist und wie du dich unabhängiger von großen Laps machen kannst dann check einmal die Waverfolge zehn.

00:43:56: da gehe ich genau auf dieses Thema ein und erkläre wieder step by step.

00:44:00: funktioniert.

00:44:02: Und damit sind wir am Ende der Folge angekommen, vielen lieben Dank dass du heute dabei warst.

00:44:06: ich hoffe ich konnte ein bisschen Inspiration geben über Kontrolle und wie du dir auch die Frage stellen kannst ob du sie noch hast oder nicht.

00:44:13: denkt immer dran KI ist deine verlängerte Werkbank aber eine Werkbank kontrolliert sich nicht von selber.

00:44:19: liebe Grüße bis bald.

00:44:21: machts gut dein Tobias.

Neuer Kommentar

Dein Name oder Pseudonym (wird öffentlich angezeigt)
Mindestens 10 Zeichen
Durch das Abschicken des Formulars stimmst du zu, dass der Wert unter "Name oder Pseudonym" gespeichert wird und öffentlich angezeigt werden kann. Wir speichern keine IP-Adressen oder andere personenbezogene Daten. Die Nutzung deines echten Namens ist freiwillig.