// Transkript
#68: KI-Agent schreibt Kunden: So behältst du die Kontrolle!
Vollständiges Transkript dieser Episode des Co-Intelligence Podcasts. 3.595 Wörter. · Auf YouTube ansehen ↗
0:00 Unser größter Fail: Wenn der KI-Agent die Kontrolle übernimmt
0:00 SPEAKER_00: Wir haben einen KI Agenten erlaubt, unseren Kunden zu schreiben. Wann hat er eine interne Nachricht sein echte Kunden geschickt? Und
0:08 SPEAKER_01: das ist leider kein hypothetisches Beispiel.
0:11 SPEAKER_00: Die technische Ursache war schnell gefunden.
0:14 SPEAKER_00: Die unangenehmere Frage war, wer hat eigentlich entschieden, dass der erkennt, dass Stars?
0:28 SPEAKER_00: Willkommen zurück zu Co-Intelligence, eurem KI Lernpodcast.
0:31 SPEAKER_00: Heute wieder mit Magdalena Beilmann und mir Benjamin Wüstenhagen.
0:36 SPEAKER_00: Wir sind nach wie vor in' Sommeredition
0:39 SPEAKER_00: Folge 68
0:41 SPEAKER_00: und wir haben zuletzt vor 2 Folgen miteinander gesprochen, Maggie, nämlich
0:46 SPEAKER_00: zur Folge 66. Da gab's viel gutes Feedback.
0:49 SPEAKER_00: Scheinbar ging es vielen anderen Menschen auch so, dass KI die Arbeit nicht wegzaubert,
0:54 SPEAKER_00: sondern den Bottleneck verschiebt.
0:56 SPEAKER_00: Und heute soll's darum gehen,
0:58 SPEAKER_00: wer hat das letzte Wort, wenn KI mitarbeitet?
1:03 SPEAKER_01: Für eine Bestätigung, dass wir nicht alleine sind mit den Problemchen.
1:09 SPEAKER_01: Okay, sprechen wir über
1:12 SPEAKER_01: KI Output und wie
1:14 SPEAKER_01: der unter anderem neue Arbeit erzeugen kann oder auch neue Fehler,
1:20 SPEAKER_01: denn das ist auch uns das ein oder andere Mal passiert
1:24 SPEAKER_01: und
1:25 SPEAKER_01: vor allem darüber,
1:27 SPEAKER_01: ja, wie verschiebt sich die Verantwortung auch? Darüber haben wir ja schon ein paarmal gesprochen in einigen Folgen
1:33 SPEAKER_01: und
1:34 SPEAKER_01: das wurde bei so einigen Agenten, die wir gebaut haben,
1:38 SPEAKER_01: recht deutlich, wo die Verantwortung
1:41 SPEAKER_01: bei uns liegt.
1:43 SPEAKER_00: Du hast ja son paar Beispiele mitgebracht. Führ uns doch mal durch,
1:48 SPEAKER_00: wo das der Fall war.
1:51 SPEAKER_01: Sprechen wir mal über
1:54 SPEAKER_01: den ersten Agenten, der bei uns ein bisschen aus dem Ruder gelaufen ist, würde ich's mal betiteln.
1:59 SPEAKER_01: Wir haben Anfang des Jahres über
2:02 SPEAKER_01: OpenClaw gesprochen,
2:03 SPEAKER_01: auch remote lustigerweise.
2:05 SPEAKER_01: Jetzt sind wir wieder hier. Ja,
2:06 SPEAKER_00: in' ähnlichen Set-up. Es war es war noch schlechter beleuchtet als jetzt. Allerdings. Wir sehen, ja, wir können gern zurückgehen auf die OpenClaw Folge. Das war wahrscheinlich
2:16 SPEAKER_00: die am schlechtesten produzierte Folge, aber auch heute wird's nicht ganz so gut wie im Studio, aber nur noch gut genug.
2:23 SPEAKER_01: Nächste Woche dann auch wieder mit anständigem Setup, ne?
2:27 SPEAKER_01: Ja, unser erster Agent mit direkter Kundenkommunikation
2:31 SPEAKER_01: haben wir
2:33 SPEAKER_01: Anfang früher diesen Jahres gebaut
2:36 SPEAKER_01: und
2:37 SPEAKER_01: der hat dafür gesorgt, dass eine interne Nachricht, die eigentlich nicht für unsere Kunden gedacht war,
2:43 SPEAKER_01: an
2:43 SPEAKER_01: ein paar wenige unserer Kunden rausgesendet wurde.
2:47 SPEAKER_01: War,
2:48 SPEAKER_01: würd ich sagen, keine Kleinigkeit,
2:50 SPEAKER_01: weil's einfach
2:52 SPEAKER_01: unsere Außenwirkung
2:54 SPEAKER_01: beeinflusst.
2:56 SPEAKER_01: War dadurch auch ein wenig peinlich, ehrlich gesagt.
2:58 SPEAKER_01: Vielleicht kannst Du mal erzählen, wie's dazu gekommen ist.
3:02 SPEAKER_00: Ja, wir hatten
3:04 SPEAKER_00: intern interne Hinweise
3:06 SPEAKER_00: für den Agenten und der hat das als Arbeitsanweisung
3:09 SPEAKER_00: aufgefasst. Das waren auch die sehr frühen Tage von OpenClaw.
3:12 SPEAKER_00: Man erinnert sich, das war son argentisches System,
3:16 SPEAKER_00: von dem jetzt mittlerweile niemand mehr spricht.
3:19 SPEAKER_00: Und deshalb wurde schon einfach falsch interpretiert und dann gingen irgendwie so kryptische Sachen an unsere Kunden raus, weil wir halt auch recht,
3:26 SPEAKER_00: ja,
3:27 SPEAKER_00: naiv für dich sagen, das ganze Ding mit dem Kommunikationssystem
3:30 SPEAKER_00: verbunden,
3:32 SPEAKER_00: wo auch die Kundenkommunikation
3:34 SPEAKER_00: möglich war.
3:36 SPEAKER_00: Und wir hatten einfach diese Autonomie zu früh eingeräumt, ohne es vorher vernünftig getestet zu haben.
3:44 SPEAKER_00: Glücklicherweise
3:45 SPEAKER_00: waren jetzt keine personenbezogenen
3:46 SPEAKER_00: Daten dabei. Also das war jetzt nicht ganz so schlimm, wie Du's gleich grade
3:50 SPEAKER_00: an die Wand gemalt hast, wobei wir haben ja manchmal verschiedene Auffassungen.
3:54 SPEAKER_00: Dennoch,
3:55 SPEAKER_00: der Agent war sehr proaktiv,
3:58 SPEAKER_00: nicht nur produktiv, sondern proaktiv und
4:00 SPEAKER_00: ein bisschen proaktiver als unser eigentlicher Freigabeprozess
4:03 SPEAKER_00: gewesen wäre.
4:06 Human-in-the-Loop: Warum wir klare Freigaben brauchen
4:06 SPEAKER_01: Man weiß ja, dass ich gerne immer etwas dramatisch bin in meiner Darstellung.
4:11 SPEAKER_01: Aber letztendlich, man muss ja sagen, aus all dem Unangenehmen
4:16 SPEAKER_01: haben wir ja was gelernt.
4:18 SPEAKER_01: Kommen wir mal zum Positiven.
4:20 SPEAKER_01: Wir haben nämlich
4:22 SPEAKER_01: noch gar nicht so lange her
4:25 SPEAKER_01: quasi ein Agenten gebaut, der technisch sehr, sehr ähnlich
4:28 SPEAKER_01: sehr, sehr ähnlich funktioniert, auch wieder mit direktem Kundenkontakt
4:32 SPEAKER_01: und haben den auch auf Basis von diesem
4:35 SPEAKER_01: ersten Agenten gebaut,
4:38 SPEAKER_01: allerdings dann mit den richtigen Regeln,
4:41 SPEAKER_01: nämlich erst mal
4:43 SPEAKER_01: nicht sehr autonom, auch wenn dir das vielleicht nicht so gefällt
4:47 SPEAKER_01: und' längeren Testphase
4:49 SPEAKER_01: und ganz, ganz klaren Regeln,
4:52 SPEAKER_01: dass nichts an irgendeinen Kunden rausgeht, wenn nicht ein klarer Haken drangesetzt wird
4:57 SPEAKER_01: und das übersprungen wird, wenn nicht 100 Prozent sicher und swordnumbar ist, dass
5:03 SPEAKER_01: dass eben man genau diesem Kunden rausgehen soll.
5:06 SPEAKER_00: Ja, und da vielleicht auch vielleicht für euch was gemacht. Wir haben sozusagen so aufgesetzt, dass es immer in' spezifischen
5:12 SPEAKER_00: Slack Kanal, kann man sicherlich auch in Teams aufsetzen, in dem Slack Kanal gibt's ein Post.
5:18 SPEAKER_00: Da steht dann ganz genau drin, was dieser Agent jetzt an den Kunden schicken würde und dann muss ein echter Mensch in Slack mit einem Emoji reagieren
5:28 SPEAKER_00: und diese Reaktion wird dann wieder ausgelesen.
5:31 SPEAKER_00: Und wenn dann diese Reaktion da war, dann geht genau dieser Text raus beziehungsweise man kann auch noch reingehen, kann seine Korrekturen reinschreiben und dann geht der korrigierte Text raus, sodass,
5:41 SPEAKER_00: ja, das lässt sich immer durch einen Menschen noch mal durchgeht und wir uns einfach sparen, das selber zu schreiben.
5:48 SPEAKER_00: Ich allerdings
5:49 SPEAKER_00: hab son bisschen meine Zweifel, wenn das jetzt jedes Mal das Gleiche ist und ich jedes Mal denselben Text freigebe
5:55 SPEAKER_00: und das Gefühl habe, ja, das war schon zum fünfzigsten Mal so, dann war ich vielleicht gar nicht mehr so wenig, dann kann ich auch einfach fucking and pacement und Text machen und brauch keine Agenten.
6:06 SPEAKER_01: Gab es wichtig ist, die Testphase wirklich zu beschränken und das haben wir bei genau diesem Agenten, über den wir gerade sprechen, gemacht.
6:14 SPEAKER_01: Ich glaube, da lief die Testphase
6:16 SPEAKER_01: über 2 Wochen und in denen wurde wirklich
6:20 SPEAKER_01: akribisch drauf geachtet von' Menschen,
6:23 SPEAKER_01: was kann eventuell noch optimiert werden, was läuft eventuell falsch?
6:28 SPEAKER_01: Und nach diesen 2 Wochen wurde dann auf volle Autonomie umgestellt, sprich, dieser Agent
6:33 SPEAKER_01: geht nicht mehr durch menschliche Hände.
6:37 SPEAKER_00: So, letztlich unser gemeinsames Ziel ist die Autonomie,
6:42 SPEAKER_00: nur diesmal in' mit' bewussten Freigabeentscheidung.
6:45 SPEAKER_00: Und wir hatten das auch schon in Folge 61,
6:47 SPEAKER_00: da hatten wir das ganz witzig so beschrieben, dass wir sagen, jeder Agent braucht einen Menschen, der sich ihn kümmert.
6:53 SPEAKER_00: Son bisschen hat sich auch da das gewöhnt.
6:56 SPEAKER_01: Kann man so sagen. Nur, ja, nur,
6:59 SPEAKER_00: wir müssen halt dazu sagen, dass der Mensch auch klare Grenzen braucht, Kontrollpunkte und natürlich auch ein Eskalationsweg.
7:05 SPEAKER_00: Den Eskalationsweg
7:06 SPEAKER_00: nutzt der Agent dann zum Menschen hin.
7:10 SPEAKER_00: Also Frage ist halt, wie viel muss das System bewiesen haben, bevor man den menschlichen Haken in dem Fall entfernt und
7:17 SPEAKER_00: wer darf das auch entscheiden, ob dieser menschliche Haken wegkommt? Waren das deine Entscheidung? Wem hast Du das überlassen?
7:23 SPEAKER_01: In dem Fall war's meine Entscheidung, weil ich diesen Agenten gebaut hab und
7:28 SPEAKER_01: dann letztendlich auch kontrolliert
7:30 SPEAKER_01: habe und dann irgendwann in die Autonomie geschickt hab.
7:34 SPEAKER_00: Sprich, wenn jetzt... Wenn's ein da Fuck up gibt, dann ist es deine Schuld?
7:39 SPEAKER_01: Im wird wohl es sein.
7:46 SPEAKER_00: Dennoch,
7:47 SPEAKER_00: ne, es darf nicht zu' Ritual verkommen, aber
7:52 SPEAKER_00: Aber ging's weiter in unserer Autonomieagentensager.
7:57 Der Support-Agent: Automatisierung mit Sicherheitsnetz
7:57 SPEAKER_01: Wir haben jetzt noch einen Agenten grade laufen, der absolut
8:02 SPEAKER_01: nicht autonom
8:03 SPEAKER_01: ist.
8:05 SPEAKER_01: Kurz das,
8:06 SPEAKER_01: warum gibt's diesen Agenten überhaupt?
8:09 SPEAKER_01: Wir
8:10 SPEAKER_01: haben ein recht hohes Supportvolumenaufkommen
8:16 SPEAKER_01: für manuelle Freischaltung von Kursen
8:19 SPEAKER_01: und
8:20 SPEAKER_01: das wollten wir gerne
8:22 SPEAKER_01: lösen, verringern und haben deswegen eine automatisierte Freischaltung
8:26 SPEAKER_01: gebaut
8:27 SPEAKER_01: plus dann aber auch eine automatisierte Kundennachricht,
8:30 SPEAKER_01: damit
8:31 SPEAKER_01: Menschen auch eine Information darüber bekommen, dass etwas freigeschaltet wurde.
8:35 SPEAKER_01: Und
8:36 SPEAKER_01: das läuft auch momentan noch komplett über einen manuellen Haken und diese Testphase läuft auch länger.
8:42 SPEAKER_01: Einmal,
8:43 SPEAKER_01: weil's da einen Produktzugang geht
8:46 SPEAKER_01: und auch wieder diese Außenwirkung betroffen ist. Also da haben wir jetzt 2 Parts,
8:52 SPEAKER_01: die dafür sorgen, dass ich diesen Test ein bisschen länger ziehe.
8:56 SPEAKER_01: Plus die Datengrundlage ist da einfach nicht so groß, weil das nichts ist, was jeden Tag zwanzigmal passiert
9:02 SPEAKER_01: und dementsprechend
9:04 SPEAKER_01: war ich dann immer noch ein bisschen Mist.
9:06 SPEAKER_01: Und ist das auch wieder in Slack gegeated für dich? Ja, das ist auch wieder ein dedizierter Slack Channel, in denen diese Nachrichten laufen.
9:15 SPEAKER_01: Einmal hier, das und das soll freigeschaltet werden,
9:18 SPEAKER_01: weil da da da und diese Kundennachricht würden wir rausschicken.
9:25 SPEAKER_00: Ja, also auch da ist es wieder diese Schutzfunktion
9:29 SPEAKER_00: und hoffentlich nicht das Ritual, dass man einfach nur seinen Haken setzt, egal, was da steht.
9:36 SPEAKER_00: Für mich ist halt immer son bisschen die die die die wesentliche Frage, ist dieser Haken dann auch eine Kontrolle
9:43 SPEAKER_00: oder ist das einfach nur, ja, ein Ritual, ein gutes Gefühl? Und ich glaub, wenn's dann zu' Ritual wird, dann kann man aus meiner Sicht den Menschen, die Menschen, dem Agenten in dem Fall auch mehr Autonomie geben.
9:55 SPEAKER_00: Noch ein, ja, ein weiteres Beispiel,
10:00 SPEAKER_00: wo wir keinen, also kein keine Rückmeldung haben, aber sozusagen das Nichtmelden zu' Risiko wird. Was hat's damit auf sich?
10:07 SPEAKER_01: Wir
10:08 Der KI-Wächter: Wie wir Support-Tickets priorisieren
10:08 SPEAKER_01: haben einen
10:10 SPEAKER_01: Wächter für unser Supportsystem
10:13 SPEAKER_01: gebaut.
10:14 SPEAKER_00: Ist auch witzig, also 1 1 1 KI, die die andere KI kontrolliert.
10:18 SPEAKER_01: Ja, ich mein, das kommt ja ein paarmal vor in unserem Arbeitsalltag, irgendwie so KI Pingbong spielen wir ab und zu mal ganz gerne,
10:26 SPEAKER_01: was meiner Meinung nach auch einfach zu besseren Ergebnissen führt.
10:30 SPEAKER_01: Aber in dem Fall überwacht das System
10:34 SPEAKER_01: Intercom in unserem Fall,
10:36 SPEAKER_01: alarmiert uns, wenn
10:38 SPEAKER_01: wirklich sehr dringende Supportanfragen
10:41 SPEAKER_01: reinkommen.
10:42 SPEAKER_00: Genau, Intercom ist ist, haben wir schon ein paarmal in den in den
10:46 SPEAKER_00: in den Folgen vorher. Intercom ist unser System für den Kundensupport, gibt viele, aber das ist das, was wir zurzeit nutzen.
10:52 SPEAKER_01: Und auch der Wächter
10:54 SPEAKER_01: schreibt dann letztendlich wieder eine Slack Nachricht in einen eigenen Channel und
10:59 SPEAKER_01: verlinkt das jeweilige Ticket,
11:01 SPEAKER_01: schlägt auch vor, wie darauf reagiert werden sollte
11:04 SPEAKER_01: und dann liegt's am Menschen,
11:07 SPEAKER_01: zu entscheiden, ob das auch wirklich passieren soll. Letztendlich
11:10 SPEAKER_01: also ein Agent in dem Fall, der überhaupt nicht nach außen wirkt und deswegen
11:14 SPEAKER_01: war er auch von Anfang an aktiv.
11:18 SPEAKER_00: Und da ist sozusagen das der Punkt,
11:19 SPEAKER_00: der Punkt, dass die KI
11:23 SPEAKER_00: die Komplexität verringert
11:25 SPEAKER_00: und einfach Aufmerksamkeit entlastet, wenn wir irgendwie, keine Ahnung, 100 offene Tickets haben und 3 sind wirklich wichtig, dann werden hoffentlich diese 3 nach oben gespült und noch mal gezeigt, da sollten wir uns drum kümmern.
11:38 SPEAKER_00: Und das Urteil darüber, was dringend ist, ist natürlich trotzdem in Regeln und Schwellenwerten. Also das heißt, wir legen fest, was sind die Schwellenwerte, was sind die Regeln,
11:47 SPEAKER_00: dann genau diese Dringlichkeit zu bekommen.
11:51 SPEAKER_00: Dennoch brauchen diese Regeln natürlich einen Owner und müssen nachkalibriert werden.
11:59 SPEAKER_00: Ja, es... Der Wächter arbeitet zuverlässig, aber wir müssen trotzdem zuverlässig kontrollieren,
12:04 SPEAKER_00: was der Wächter nicht sieht. Denn wenn in den 50 Tickets oder 100 Tickets 3 hervorgehoben werden, die aber die falschen Tickets sind, dann hat das das Ganze auch nichts gebracht. Und genauso ist es auch andersrum. Wir hatten das erst gestern. Ich hatte son kleinen Mini Agenten aufgesetzt,
12:19 SPEAKER_00: als es als es grad nicht Sommer war, als es busy war und
12:23 SPEAKER_00: zu schauen, wann unsere Webseite down ist, hab ich geguckt, okay, wenn sich so und so viel in son 1
12:28 SPEAKER_00: Zeitspanne kein
12:29 SPEAKER_00: kein Mensch anmeldet,
12:31 SPEAKER_00: dann muss ja irgendwas down sein.
12:34 SPEAKER_00: Und hab die Durchschnittswerte genommen von den Wochen davor
12:38 SPEAKER_00: und dann gab's son Alert Channel und da kamen jetzt Alerts rein, oh, oh, Website ist down,
12:43 SPEAKER_00: weil halt in dem definierten Zeit in dem definierten Zeitraum keine Anwendungen reinkamen.
12:48 SPEAKER_00: Aber das war ganz normal, denn es war warm und alle Menschen liegen am See oder verstecken sich hinter der Klimaanlage,
12:55 SPEAKER_00: aber keiner hat Bock, online zu sein.
12:58 SPEAKER_00: Und so kam es, dass die Webseite nicht da war, aber dennoch sich jemand registriert hat. Und oh Wunder, da gab's dann die Frage, wer ist dafür verantwortlich? Wer hat das eingerichtet?
13:08 SPEAKER_00: Wer kümmert sich drum? Auch hier, ne, die Agenten brauchen eine klare Zuordnung
13:14 SPEAKER_00: Und wir sind mittlerweile übergegangen,
13:16 SPEAKER_00: ein Cockpit zu haben, wo unser Unternehmen und da gibt's ein Tab.
13:19 SPEAKER_00: Da sind hoffentlich alle Agenten,
13:20 Wer haftet eigentlich, wenn die KI Fehler macht?
13:22 SPEAKER_00: hab ein Großteil der Agenten aufgelistet.
13:25 SPEAKER_00: Steht auch jeweils der Gesundheitsstatus
13:27 SPEAKER_00: dessen und dann demnächst auch der Verantwortliche oder die Verantwortliche.
13:32 SPEAKER_01: Sehr schön erklärt. Ja, so haben wir bei jedem System und jedem Agenten
13:38 SPEAKER_01: auch andere
13:39 SPEAKER_01: Risiken letztendlich.
13:41 SPEAKER_01: Bei manchen Systemen müssen wir drauf achten, dass nichts Falsches rausgeht, dass nichts zu dir rausgesendet wird und bei anderen,
13:48 SPEAKER_01: dass wir nicht irgendwas übersehen
13:50 SPEAKER_01: letztendlich.
13:50 SPEAKER_01: Genau, das ist bei dem Wächter ja die Gefahr. Du sagst, die Aufmerksamkeit
13:55 SPEAKER_01: wird entlastet,
13:57 SPEAKER_01: was eben auch dafür sorgen kann, dass uns das durch die Finger rutscht.
14:01 SPEAKER_01: Auch da darf man sich halt nicht 100 Prozent drauf verlassen, dass KI alles regelt.
14:07 SPEAKER_00: Da wieder eine automatisierte Prüfung verschiebt die Verantwortung,
14:11 SPEAKER_00: aber sie löscht sie nicht, ne.
14:15 SPEAKER_00: Was genau? Wir hatten in der letzten in der letzten Episode,
14:18 SPEAKER_00: da hatte Natalie das erwähnt,
14:20 SPEAKER_00: dass es für sie eine sone Epiphanie war, als Produktmanagerin
14:24 SPEAKER_00: in' Hackathon
14:25 SPEAKER_00: mit KI in der Lage zu sein, ja, Code zu schreiben. Wir sind wir sind da
14:30 SPEAKER_00: zusammengekommen, hatten sone Hackweek
14:33 SPEAKER_00: und hat auch hatten auch ein Hackathon
14:35 SPEAKER_00: und da gab's viele, viele Einzellösungen.
14:39 SPEAKER_00: Auch da sind wir schnell vorangekommen,
14:42 SPEAKER_00: aber die Frage ist jetzt, wie kriegt man das Ganze von der Einzellösung zum System?
14:46 SPEAKER_01: Also jetzt genau
14:48 SPEAKER_01: die Entwicklung, die wir vom ersten Hackathon
14:51 SPEAKER_01: zum
14:52 SPEAKER_01: zweiten Hackathon
14:54 SPEAKER_01: hinlegen müssen.
14:55 SPEAKER_01: Der der 1. Gruppenweite Hackathon war super. Es wurden superviele Menschen
15:00 SPEAKER_01: auf die Idee von KI und Vibecoden gebracht
15:04 SPEAKER_01: und ich glaube, dass das auch an vielen einzelnen Schreibtischen
15:09 SPEAKER_01: schon
15:10 SPEAKER_01: superviel gebracht hat
15:12 SPEAKER_01: und
15:13 SPEAKER_01: sich da Menschen einzeln weiterentwickelt haben,
15:16 SPEAKER_01: Aber es ist halt noch nicht so superviel darüber hinausgegangen und genau das wollen wir jetzt bei den nächsten Hackathons schaffen,
15:23 SPEAKER_01: dass auch wirklich
15:25 SPEAKER_01: unternehmensübergreifend
15:26 SPEAKER_01: oder teamübergreifend
15:28 SPEAKER_01: mehrere Menschen von einem einzelnen Produkt oder System
15:32 SPEAKER_01: profitieren können.
15:34 Vom Hackathon zum System: KI im Unternehmen skalieren
15:34 SPEAKER_00: Ja, jetzt bist Du jetzt bist Du auf den gruppenweiten Hackathon raufgegangen. Ich weiß schon, ich war jetzt erst noch bei unserer Hack Week, die wir intern gemacht haben, gibt's auch eine eigene Folge zu, glaube ich, vor ein paar Wochen.
15:45 SPEAKER_00: Ähnliches Thema da, aber da da hatten wir schon das geschafft, dass sozusagen
15:49 SPEAKER_00: mehrere Menschen dann an Themen gemeinsam gearbeitet haben und da auch wechselnde Gruppen hatten. Aber ja, wir haben auch in der Gruppe son Hackathon gemacht
15:56 SPEAKER_00: und
15:58 SPEAKER_00: da gibt es tatsächlich jetzt schon auch die Ersten, die sagen, ich möchte das gern mit anderen teilen und andere Menschen, die es von außen gesehen haben, sagen, ich will das auch übernehmen, weil da kommt dann schnell auch die Frage rein,
16:08 SPEAKER_00: wie schön, dass man dann ein Hackathon macht,
16:12 SPEAKER_00: Wie gieße ich das Ganze in eine vernünftige Strategie für das Unternehmen oder auch für die Gruppe? Und wie schaffe ich es eben, dass aus diesem Einzelwerkzeug,
16:20 SPEAKER_00: auf dem einzelnen Schreibtisch ein System wird? Und welche Policies brauch ich dafür auch?
16:25 SPEAKER_00: Sprich,
16:27 SPEAKER_00: wenn ich damit arbeite mit dem KI Kram, merk ich auch,
16:31 SPEAKER_00: ja, wie sich Organisationen dadurch verändern. Nicht nur das eigene Arbeiten, das eigene Verhalten, sondern auch die Arbeitsweise in Organisationen.
16:39 SPEAKER_01: Letztendlich ist es ja bei Hack Week,
16:42 SPEAKER_01: die wir
16:43 SPEAKER_01: teamintern oder unternehmensintern
16:45 SPEAKER_01: und Hackathon,
16:47 SPEAKER_01: was gruppenweit ist,
16:49 SPEAKER_01: dasselbe Ziel, was wir haben. Einfach, dass wir mit dem
16:54 SPEAKER_01: Output,
16:55 SPEAKER_01: den wir den wir entstehen lassen,
16:58 SPEAKER_01: mehr Menschen
16:59 SPEAKER_01: erreichen, dass das ganze Unternehmen davon profitiert, dass unternehmensübergreifend
17:04 SPEAKER_01: andere Teams davon profitieren.
17:08 SPEAKER_00: Wenn Du jetzt, Du bist ja auch grad dabei, irgendwie neue Agenten aufzusetzen und brainstormst die ganze Zeit, wie Du deine Prozesse noch weiter
17:15 SPEAKER_00: KI mäßig aufbohren kannst.
17:18 SPEAKER_00: Was sind so für dich die Regeln, die Du unseren Zuschauern, unsere Zuhörern mitgeben kannst,
17:23 SPEAKER_00: die sich bei dir
17:25 SPEAKER_00: irgendwie bewährt haben im letzten halben Jahr?
17:29 SPEAKER_01: Und letztendlich
17:30 SPEAKER_01: ist das, glaube ich, eine Lernkurve einfach.
17:34 SPEAKER_01: Das muss ich jetzt nach
17:36 SPEAKER_01: sehr vielen Monaten
17:38 SPEAKER_01: KI so sagen. Es werden einige Fehler passieren,
17:42 SPEAKER_01: trotzdem muss man irgendwo starten und Experimente machen, sich trauen.
17:47 SPEAKER_01: Letztendlich
17:48 SPEAKER_01: ergibt's wahrscheinlich Sinn, wenn man
17:50 SPEAKER_01: erst mal mit'
17:51 SPEAKER_01: MVP,
17:52 SPEAKER_01: mit' mit' kleinen Produkt startet,
17:56 SPEAKER_01: das Risiko möglichst gering zu halten
17:59 SPEAKER_01: und aus den Fehlern, die bei diesem ersten Produkt
18:03 SPEAKER_01: zwangsläufig
18:04 SPEAKER_01: passieren werden,
18:06 SPEAKER_01: lernt und das nächste Produkt,
18:08 SPEAKER_01: die nächste Optimierung
18:10 SPEAKER_01: einfach dagegen
18:11 SPEAKER_01: wieder vorbereitet.
18:14 SPEAKER_00: Ich würd's so mitnehmen. Also
18:17 SPEAKER_00: man muss aus meiner Sicht klar haben, was das System selber entscheiden darf. System in Anführungszeichen.
18:22 SPEAKER_00: Wann muss ein Mensch dazugeholt werden und und und wer darf das Ganze auch stoppen oder eben auch weiterentwickeln?
18:30 SPEAKER_00: Aber ja, die Lernkurve, die kann ich bestätigen. Das... Es hört nicht auf.
18:34 SPEAKER_00: Okay.
18:35 SPEAKER_01: Vielleicht auch, wir sind noch nicht fertig.
18:37 SPEAKER_00: Nee, vielleicht auch aus jedes Frustrationstoleranz. Wir
18:40 SPEAKER_00: Wir hatten das jetzt in den letzten Tagen, Da haben wir uns auch dran gemacht, ein paar neue Dinge zu zu automatisieren.
18:47 SPEAKER_00: Die Kollegin, die bei uns im Support ist, war im Urlaub.
18:50 SPEAKER_00: Sprich,
18:52 SPEAKER_00: ich bin ich hab mich dann auch dabei erwischt, dass ich ab und zu mal ein Ticket klaus, sagen zu können, ich mach auch mal Support Tickets zu und
19:01 SPEAKER_00: war dann tierisch angenervt
19:04 SPEAKER_00: von der Oberfläche, die wir intern haben in diesem Admin Panel und dachte, das kann das doch scheiße, das muss man auch nicht anders machen. Und dann war der 1.
19:12 SPEAKER_00: Impuls, okay, wir bauen jetzt ein neues Admin Panel mithilfe von KI,
19:17 SPEAKER_00: aber dann hätten wir weder
19:19 SPEAKER_00: die Verantwortung verschoben von uns zu den Entwicklern, die die ganzen Pull Request freigeben
19:24 SPEAKER_00: müssen und dann dies anderes tun als Pull Requests beizugeben.
19:28 SPEAKER_00: Pull Request, das das, wenn ich jetzt irgendwie ein Code committe und dann noch ein echter Mensch raufschaut,
19:33 SPEAKER_00: dass da jetzt kein Blödsinn ist und wir haben die Regel intern, dass bei uns 2 echte Menschen raufschauen, bevor wir irgendwas
19:38 SPEAKER_00: in Produktion nehmen.
19:40 SPEAKER_00: Und da kam die 2. Idee, warte mal ganz kurz,
19:43 SPEAKER_00: bevor wir jetzt ein komplett neues
19:45 SPEAKER_00: Admin Panel bauen, können wir auch
19:47 SPEAKER_00: probieren, es agentisch zu lösen.
19:50 SPEAKER_00: Und
19:51 SPEAKER_00: Du warst mein armes Verurskaninchen
19:54 SPEAKER_00: und hast bestimmt 15 Mal gesagt, geht immer noch nicht.
19:58 SPEAKER_01: Oder bin.
19:59 Das Ping-Pong-Spiel: Warum QA ohne Menschen noch scheitert
20:00 SPEAKER_01: Ja. Ich erinner mich, dass ich vor der Podcastfolge erst wieder ein Feedback geschickt hab.
20:05 SPEAKER_00: Diesmal ging's aber. Diesmal ging's.
20:07 SPEAKER_01: Das ist genau son tolles Beispiel. Du hattest eine Superidee,
20:11 SPEAKER_01: wie man etwas über KI löst und
20:14 SPEAKER_01: hast es da reingepromptet
20:16 SPEAKER_01: in Codecs oder Code, was auch immer.
20:19 SPEAKER_01: Und ich war diejenige,
20:21 SPEAKER_01: die manuell ausprobieren durfte, ob das dann auch wirklich funktioniert, was da rauskommt.
20:26 SPEAKER_01: Das war ein Ping Pong, der jetzt über ein paar Tage ging und
20:30 SPEAKER_01: teilweise auch kräftezwerend war, ehrlich gesagt.
20:33 SPEAKER_00: Ja,
20:36 SPEAKER_00: und auch dieses Pattern,
20:38 SPEAKER_00: ich weiß noch nicht, welch was die beste Lösung dafür ist, ne. Also
20:41 SPEAKER_00: irgendwie brauchst Du ja manchmal ein zweites Paar Augen, was sich so was anguckt, ja. Gerade wenn man jetzt nicht nur in seinem eigenen System rumarbeitet, sondern auch schauen will, ist das für die wirklichen Anwender?
20:51 SPEAKER_00: Du bist dann so eher die die Betatesterin für den Rest des Teams,
20:56 SPEAKER_00: was das dann später machen darf bei dir im Team.
20:59 SPEAKER_00: Aber ähnliche Patterns haben wir auch in anderen Bereichen, ne, wo wir interne Systeme bauen
21:05 SPEAKER_00: und wenn die Menschen noch nicht selber daran mitbauen können oder wollen oder
21:11 SPEAKER_00: warum auch immer, dann kann das auch relativ schnell zu' hohen Frustration führen,
21:16 SPEAKER_00: die man so in seinem Tunnel, während man irgendwie die Software vorantreibt oder die Automationen vorantreibt, gar nicht so sieht.
21:23 SPEAKER_00: Auch ein Learning, was ich in den letzten Monaten gemacht habe.
21:27 SPEAKER_01: Das ist gut.
21:28 SPEAKER_01: Und letztendlich mussten wir feststellen,
21:30 SPEAKER_01: dass die QA, also die Qualitätsabnahme
21:32 SPEAKER_01: mit KI einfach an manchen Stellen noch nicht so funktioniert, dass sie ein Menschen ersetzen könnte. Also mit Sicherheit kann man da vielleicht
21:41 SPEAKER_01: bei manchen Ideen erst mal noch eine andere KI drauf ein... Ansetzen,
21:44 SPEAKER_01: die richtigen Berechtigungen geben und
21:48 SPEAKER_01: dann testet ein-, zweimal eine KI, bevor ein Mensch das tut,
21:51 SPEAKER_01: aber in manchen Bereichen geht das halt auch einfach nicht.
21:55 SPEAKER_00: Wenn Du so
21:56 Die Zukunft der Agenten: Brauchen wir noch menschliche Gates?
21:57 SPEAKER_00: reflektierst, was im letzten Jahr passiert ist und dir überlegst, wo wir wo wir im nächsten Jahr stehen, glaubst Du, die haben nach wie vor diese menschlichen Gates
22:04 SPEAKER_00: oder glaubst Du, das werden Agenten unter sich selbst ausmachen können?
22:09 SPEAKER_01: Ich glaube, es kommt auf die Aufgabe und den Bereich an. Ich glaube, dass es schon definitiv Fälle gibt, in denen Agenten
22:18 SPEAKER_01: unter sich arbeiten
22:20 SPEAKER_01: und dann wirklich ein Agententeam
22:23 SPEAKER_01: sich das hin- herspielt
22:25 SPEAKER_01: und
22:26 SPEAKER_01: es dann eher eine Teamleitung
22:28 SPEAKER_01: gibt in menschlicher Form.
22:31 SPEAKER_01: Aber es gibt auch sicherlich Bereiche,
22:34 SPEAKER_01: da ist ein Developer beispielsweise näher dran.
22:39 SPEAKER_00: Bei dir.
22:41 SPEAKER_00: Und was was für mich jetzt immer klarer wird in dem ganzen KI Thema ist, dass die Technik wird immer weniger wichtig aus meiner Sicht. Also das ganze Thema, wie prompt ich was oder nutze ich jetzt Codex oder Claude oder Kimi oder keine Ahnung was. Was aber wichtiger wird, je stärker das in Organisationen
22:58 SPEAKER_00: in,
22:59 SPEAKER_00: ja, im eigenen Arbeitsablauf verankert wird, desto mehr muss man sich halt Gedanken machen, wie genau? Welche Regeln stell ich auf? Welche Horistiken habe ich? Wie kann ich meine Lernkurve effizient gestalten?
23:12 SPEAKER_00: Und das ist eigentlich so für mich das, was ich jetzt immer mehr mitnehme
23:16 SPEAKER_00: und wir auch deswegen die Motivation haben, diesen Podcast weiter zu machen. Nicht nur, weil das neueste Modell morgen rauskommt,
23:23 SPEAKER_00: sondern weil wir sozusagen unsere eigenen, irgendeine Lernkurve hier weitergeben wollen. An euch, ich hoffe,
23:29 SPEAKER_00: euch gefällt das. Wenn es so ist, lasst gern jederzeit ein Like da, kommentiert das Ganze,
23:35 SPEAKER_00: sprecht über uns. Meggie, ich lass aber die letzten Sätze bei dir
23:40 SPEAKER_00: für deine letzten Genau. Zeit.
23:42 SPEAKER_01: Wir machen den Podcast nicht nur, weil wir dokumentieren möchten,
23:45 SPEAKER_01: was unsere
23:47 SPEAKER_01: Lernreise so bringt, sondern weil wir auch den Austausch schätzen und
23:52 SPEAKER_01: es sehr, sehr
23:54 SPEAKER_01: schön finden, spannend finden, wenn wir Kommentare von euch bekommen.
23:58 SPEAKER_01: Sei es, dass es euch ähnlicher geht oder dass ihr ganz andere Erfahrungen gemacht habt,
24:03 SPEAKER_01: Tipps, Tricks,
24:05 SPEAKER_01: irgendwas. Wir freuen uns über euer Feedback.
24:11 SPEAKER_00: So, lass ich stehen.
24:12 SPEAKER_00: Vielen, vielen Dank und bis zum nächsten Mal.
24:15 SPEAKER_02: Bo Intelligence ist eine Produktion von thekey Academy in Zusammenarbeit mit SnipKI,
24:20 SPEAKER_02: produziert im Studio in Berlin.
24:22 SPEAKER_02: Redaktion und Moderation Benjamin Wüstenhagen,
24:25 SPEAKER_02: Moritz Heininger. Und ich, ich bin eine KI, falls ihr das nicht schon längst erraten habt, einfach nur eine Stimme aus dem Algorithmus. Aber hey, immerhin eine mit gutem Timing. Wenn ihr mehr darüber erfahren wollt, abonniert diesen Podcast, keine Folge zu verpassen. Danke fürs Zuhören und bis zum nächsten Mal.