// Transkript
#24: GPT-5: Der Realitätscheck - Nach dem Shitstorm: Unser Urteil
Vollständiges Transkript dieser Episode des Co-Intelligence Podcasts. 4.650 Wörter. · Auf YouTube ansehen ↗
0:00 Intro
0:00 SPEAKER_00: Willkommen zurück zu Cointelligence,
0:03 SPEAKER_00: eurem KI Lernpodcast.
0:05 SPEAKER_00: Heute in der Folge 24
0:07 SPEAKER_00: und mit dem Sonderthema
0:09 SPEAKER_00: ChatGPT 5 einen Monat lang getestet.
0:13 SPEAKER_01: Braucht ihr es? Braucht ihr es nicht? Ist es gut? Ist es schlecht?
0:16 SPEAKER_01: Warum gab's ein Riesen Shitstorm,
0:18 SPEAKER_01: nachdem es veröffentlicht wurde? All das werden wir heute besprechen.
0:21 SPEAKER_00: Und wir sind Moritz Heininger und Benjamin Wüstenhagen.
0:26 SPEAKER_01: Gut, springen wir mal rein ins Thema.
0:28 SPEAKER_01: Wie war der Launch von ChatGPT 5? Vielleicht etwas holprig.
0:32 SPEAKER_00: Also die
0:34 SPEAKER_00: als es grade eingeführt wurde,
0:36 SPEAKER_00: ist es bei mir relativ
0:38 SPEAKER_00: inständig gelaufen, ehrlicherweise und meine Timeline auf LinkedIn war voll von nicht so schönen Kommentaren dazu. Wie war's bei dir?
0:46 SPEAKER_01: Ja, ich fand, es war vor allem gemixt irgendwie so aus den Nachrichten dieser Welt, die sich irgendwie son bisschen auf die Performancethemen konzentriert haben,
0:56 SPEAKER_01: waren die News erst mal eigentlich positiv und das Feedback sehr positiv, weil es hat irgendwie gefühlt einen Tag gedauert und dann haben sich die positiven News vor allem in sehr
1:05 SPEAKER_01: negative News
1:07 SPEAKER_01: gedreht.
1:09 SPEAKER_01: Woran lag das?
1:11 Wie war der Launch von ChatGPT-5?
1:11 SPEAKER_00: Ja, also vorher hatten wir immer drüber gesprochen, dass man bei ChatGPT
1:15 SPEAKER_00: so viele Modelle hat und man überlegen muss, was will ich jetzt?
1:18 SPEAKER_00: 3 o oder o 3 oder o 4 oder 4o oder mini oder Makro oder Nano oder wie auch immer. Ja. Und dann gab's nur noch 1.
1:26 SPEAKER_00: Ja. Und ChatGPT hat im Prinzip selber ausgewählt, welche Modelle grad genutzt werden und das führt
1:33 SPEAKER_00: zu mal besseren und mal schlechteren Ergebnissen. Ja, und im Endeffekt haben
1:37 SPEAKER_01: die Leute, glaub ich, vor allem ein Press gehabt, weil ihnen gefühlt was weggenommen wurde. Auch wenn ihnen vielleicht was Besseres gegeben wurde, haben sie sich irgendwie teilweise so an die Modelle gewöhnt und an den Kommunikationsstil,
1:40 Positive vs. Negative News: Woran lag's?
1:50 SPEAKER_01: vor allem von 4o oder oder 4 ONE, was ja ein ähnliches Modell ist.
1:55 SPEAKER_01: Und dann gab's auf einmal einen Riesen Shitstorm, dass ich nicht mehr die Möglichkeit hatte, eben die mir vertrauten Modelle zu verwenden, weil ChatGPT
2:04 SPEAKER_01: auf einmal auch ganz anders geantwortet hat als vorher. Der Stil war ganz anders.
2:08 SPEAKER_01: Vorher war es immer sehr, sehr blumig und freundlich
2:12 SPEAKER_01: und
2:13 SPEAKER_01: bunt und Emojis son bisschen, ne. Und hat
2:19 SPEAKER_01: ja auch oft mir irgendwie mal ein Kompliment gegeben, dass ich was gut gemacht habe und Deswegen hast Du's genutzt, ja. Die Schulter geklaut. Jetzt macht ja sonst keiner, ja.
2:28 SPEAKER_01: Das war dann auf einmal nicht mehr so. Und da gab's dann ein kleinen Shitstorm an,
2:32 SPEAKER_01: muss ich mal sagen, großen Shitstorm an Leuten, die sich aufgeregt haben und gesagt haben, sie werden nie wieder ChatGPT nutzen.
2:38 SPEAKER_00: Aber Sie haben schnell reagiert. Der Head of Product von ChatGPT ist auch ein Deutscher, Nick Turly.
2:43 SPEAKER_00: Gibt's auch ein UMR Podcast mit dem, ist ganz spannend. Der ist, glaub ich, noch nicht mal 30, also schon. Jedenfalls hat der auch schnell reagiert, auch auf LinkedIn und hat dann gesagt, hey, wir wir haben das die Kritik gehört und ihr könnt jetzt wieder euer Modell auswählen.
2:56 SPEAKER_01: Genau, allerdings nur erst mal
2:59 SPEAKER_01: die Plus Nutzer. Ich bin gespannt, wenn der
3:02 SPEAKER_01: Podcast von uns hier ausgestrahlt wird.
3:04 SPEAKER_01: Dann kann das natürlich auch alles wieder anders sein,
3:07 SPEAKER_01: aber jetzt
3:09 SPEAKER_01: direkt neben dem Detail danach war es eben erst möglich nur für die Plus User dann unter den Optionen, auch die alten Modelle auszuwählen.
3:17 SPEAKER_01: Und ich glaube, da ist es auch per Default
3:19 SPEAKER_01: wieder der Fall, dass ich die alten Modelle auswählen kann im Modell Selector.
3:24 SPEAKER_01: Und ja, es ist halt irgendwie ein bisschen ein zweischneidiges Schwert, ne. Die einen sind happy, cool, ich kann wieder mein altes Modell nutzen.
3:30 SPEAKER_01: Alle anderen, die von KI nicht so viel Ahnung haben, haben jetzt wieder das gleiche Problem. Ich hab irgendwie oben ChatGPT 5, hab ein ChatGPT 5
3:39 SPEAKER_01: und
3:40 SPEAKER_01: hab dann wieder meine ganzen alten Modelle
3:42 SPEAKER_00: und weiß irgendwie wieder nicht so richtig, ich denn eigentlich für ein Modell nutzen sollte, die besten Ergebnisse zu bekommen, ja. Aber ich glaub, für den Großteil der Nutzer ist es schon insofern besser, als dass Du jetzt in gewisser Weise geführt wirst.
3:55 SPEAKER_00: Zwar gibt's noch die Kritik, hey, manchmal wird nicht das richtige Modell ausgewählt, aber ich vermute,
3:59 SPEAKER_00: das wird mit der Zeit besser.
4:01 SPEAKER_00: Und es ist, glaub ich, jetzt besser, dass auch Menschen an die Modelle herangeführt werden, die
4:05 SPEAKER_00: früher man extra auswählen musste, weil sie halt teurer waren oder mehr Energie verbraucht haben oder mehr Zeit verbraucht haben.
4:11 SPEAKER_00: Jetzt, wenn ich jetzt sone komplizierte Aufgabe habe, dann steht teilweise da, hey, ich denke grade nach, ich brauch ein bisschen länger. Dann weiß man, okay, da wird ein 1 Thinking,
4:20 SPEAKER_00: ein Reasoning Modell eingesetzt.
4:22 SPEAKER_00: Und das ist schon ein großer Vorteil für viele Nutzer, die darüber gar nicht Bescheid wussten. Genau, also ich glaub, für
4:28 SPEAKER_01: 90 Prozent unserer Hörer und Hörerinnen
4:30 SPEAKER_01: ist GPT-5
4:32 SPEAKER_01: die beste Wahl,
4:34 SPEAKER_01: weil
4:37 SPEAKER_01: sie im Zweifel nicht genau wissen, welches Modell sie wählen sollen für welche Aufgabe.
4:41 SPEAKER_01: Sam Altman hat
4:43 SPEAKER_01: vor Kurzem gesagt, dass, glaube ich, nur ein oder 2 Prozent aller Nutzer von ChatGPT
4:49 SPEAKER_01: jemals ein Modell verwendet haben. Also die Modelle, die man für komplexere Aufgabenstellungen
4:54 SPEAKER_01: eben verwenden müsste. Ist das in der Free Version? Die gibt es in
4:59 SPEAKER_01: den, ich glaube ja, GPT-5 gibt's in der Free Version und dadurch haben auch das 1. Mal User und die Userinnen der Free Version
5:06 SPEAKER_01: die Möglichkeit, eben diese Modelle
5:08 SPEAKER_01: kennenzulernen. Und
5:09 SPEAKER_01: Und aus dem Grund
5:11 SPEAKER_01: meine ich, dass die allermeisten User von ChatGPT dadurch profitieren
5:15 SPEAKER_01: und im Endeffekt deutlich bessere Ergebnisse bekommen als vorher.
5:19 SPEAKER_01: Ein Case, ich saß letztens mit meinem Dad
5:22 SPEAKER_01: beim Abendessen und kommt aus der Nähe von Frankfurt.
5:26 SPEAKER_01: Und
5:27 SPEAKER_01: da ist jetzt das Thema, dass die Einflugschneise geändert wurde und die Flugzeuge jetzt über unser Haus fliegen und nicht mehr über Darmstadt wie davor.
5:37 SPEAKER_01: Und da gibt's irgendwie Krieg zwischen den Kommunen. Und er wollte sich quasi informieren, wie da die rechtliche Situation ist, was da in der Kommune oder der Gemeinde machen kann und hat einfach ChatGPT
5:47 SPEAKER_01: einfach die vo Variante gewählt, hat das irgendwie da eingegeben und kam halt nur Murks raus, weil a es wurde nicht das Internet an, also diese Internetoption angemacht.
5:57 SPEAKER_01: Das Cutoff Date war superfrüh, das heißt, diese Einzugsschneise und die ganze Thematik kannte ChatGPT überhaupt nicht und es kam Murks raus. Und das war vor GPT-5. Dann
6:03 Vergleich mit anderen Modellen: GPT-4, Mistral & Co.
6:05 SPEAKER_01: Dann hab ich ihm gesagt, okay, guck mal, irgendwie a musst Du besser prompten, besser Kontext geben, Du musst die Internetsuche anmachen und Du musst das o-drei-Modell verwenden, Ja. Weil es ja quasi ein rechtlicher Case ist und.
6:16 SPEAKER_01: Und dann war das Ergebnis sehr, sehr gut. So, das musst Du aber auch erst mal wissen und so was wissen die allerwenigsten Leute. Jetzt mit mit
6:23 SPEAKER_01: mit GPT-5
6:24 SPEAKER_01: kann ich die gleiche Frage stellen und GPT-5 ist schlau genug, zu entscheiden, okay, pass auf, ist ein, dafür muss ich ins Internet, also wählt selbst das Tool Internetsuche aus und gibt dir dann sofort die Antwort. Du musst also kein Prompting Experte oder KI Experte sein,
6:38 SPEAKER_01: das Ergebnis zu bekommen, was Du gerne hättest. Ich hoffe,
6:42 SPEAKER_00: das Modell schlägt vielen Leuten vor, viel zu klagen in Frankfurt, damit ich aus Berlin endlich mal direkt nach San Francisco fliegen kann. Ja. Nicht lieber Lissabellen. Oder
6:51 SPEAKER_01: über Frankfurt. Frankfurt ist wunderschön. Da kannst Du noch ein Apple Wall trinken, gehst nach dem Sachsenhausen
6:57 SPEAKER_01: noch mal vorbei und
6:59 SPEAKER_01: genießt die Zeit. Sehr schön, kann ich dir empfehlen.
7:02 SPEAKER_01: Fußball sowieso, ne. Also jetzt gibt's wahrscheinlich direkt
7:06 SPEAKER_01: Pushback Kommentare. Nein, das beste Team ist x y, aber weiß jeder, dass Eintracht Frankfurt das beste Fußballteam ist. Da brauchen wir uns gar nicht drüber zu unterhalten. Wen
7:15 SPEAKER_01: interessiert Fußball?
7:19 SPEAKER_00: Insgesamt finde ich aber es gut bei ChatGPT 5, dass es deutlich schneller geworden ist, wenn man jetzt nicht grad das Reasoning hat oder das Thinking, was man einstellen kann.
7:26 SPEAKER_00: Und selbst wenn ich sone langsame Antwort habe, hab ich jetzt die Möglichkeit auch zu sagen, kürzt das ab. Dass oben son kleiner Button,
7:33 SPEAKER_00: weiß gar nicht, wie der in der deutschen UI ist, aber irgendwie kürzer oder schneller Du mir
7:39 SPEAKER_01: zu lang, ich will jetzt einfach nur eine Antwort sofort.
7:42 SPEAKER_01: Genau, nee. Vielleicht, wir haben das gar nicht so richtig erklärt, glaub ich, im Eingang. Mit diesen Modellauswahlen,
7:48 SPEAKER_01: Es ist so, dass ich einfach, ich gebe meinen Prompt ein und
7:52 SPEAKER_01: hintendran, hinter GPT-5 liegen verschiedene Modelle.
7:55 SPEAKER_01: Und dann entscheidet sozusagen GPT,
7:58 SPEAKER_01: ChatGPT für mich, welches dieser Modelle ausgewählt wird, mir die Antwort zu geben. Das ist ein riesen Modell, ist ein schnelles Modell, ein kleines großes Modell.
8:06 SPEAKER_01: Das ist ein Riesenvorteil für 90 Prozent aller Leute,
8:10 SPEAKER_01: ist aber ein Nachteil
8:11 SPEAKER_01: für
8:12 SPEAKER_01: erfahrene User und Userinnen, die wissen, welches Modell am besten ist, weil's auch ChatGPT Fehler macht und im Zweifel auch mal ein Modell gewählt wird, was einfach gar nicht so gut ist und nicht State of the Art ist. Und wenn ich mir diese
8:25 SPEAKER_01: Evaluation,
8:27 SPEAKER_01: es gibt ja diese diese LML Arena und Zu Benchmarks. Benchmarks sozusagen Wettbewerben. Anschaue, genauso. Wettbewerbe zwischen den einzelnen Modellen.
8:36 SPEAKER_01: Und dann sind 2 der Modelle von, also 2 GPT-5 Modelle sind die besten 2 Modelle aktuell, ja, das kann sich in' Woche wieder ändern. Aber ein Modell ist irgendwo auf Platz 10 oder 12 oder 15 oder ist ja auch nicht mehr genau irgendwo relativ weit hinten. So und das heißt, es kann sein, ich geborene eine Frage ein und bekomm dann eine Antwort von diesem schlechten Modell
8:56 SPEAKER_01: und bin dann auf einmal enttäuscht von der Qualität, weil eben das schlechte Modell gewählt wurde. Und das ist auch son bisschen das Problem von GPT-5,
9:03 SPEAKER_01: insbesondere von für Experten und Expertinnen oder auch für für für Businesses, die quasi eine gewisse
9:11 SPEAKER_01: Verlässlichkeit einfach brauchen in der Antwort, in der Antwortqualität, in der Konsistenz.
9:15 SPEAKER_01: Und da ist sone sone automatische Modellauswahl
9:18 SPEAKER_01: wieder ein bisschen problematisch. Also
9:20 SPEAKER_01: Also es kommt immer auch son bisschen auf den User Typ an, aber wie gesagt, für die meisten Standard User und Userinnen ist es eigentlich eine ganz gute Option, würd ich behaupten. Ich würde vermuten, dass in' Jahr
9:31 SPEAKER_00: von heute alle Modelle nur noch ein Interface haben, Du vielleicht für die 3 Prozent der absoluten Power User die Möglichkeit hast, ändern,
9:39 SPEAKER_00: aber alle anderen bekommen das serviert,
9:41 SPEAKER_00: was grad richtig ist, weil sonst fäll ich's einfach in Überblick. Also bei Gorg gibt's jetzt auch die Möglichkeit, ich kann dann Gorg 3, Gorg 4, Super Gorg,
9:44 Der große Shitstorm: Die Kontroverse um die neuen Features
9:49 SPEAKER_00: Elon Gorg, was auch immer noch.
9:52 SPEAKER_01: Ja. Bei Claude wahrscheinlich auch, weiß ich gar nicht, nutz ich nicht so viel. Bei Claude kannst Du das, da hast Du, glaub ich, ich nutz das hin und wieder. Du hast die Auswahl zwischen Sonnet und Opus, also im kleinen größeren Modell und kannst dann halt auch dieses Advanced Reasoning oder Advanced Thinking, das ist da glaube ich, anstellen
10:10 SPEAKER_01: und
10:11 SPEAKER_01: hast dann quasi abgewickelt. Also nicht auch nicht so ultraviele verschiedene Optionen.
10:16 SPEAKER_01: Ja, was ganz interessant ist,
10:18 SPEAKER_01: ist
10:19 SPEAKER_01: der Charakter tatsächlich von GPT-5 ist ein anderer als der von GPT-4-o.
10:26 SPEAKER_01: Es ist viel
10:27 SPEAKER_01: technischer. Gefühlt ist es ein 1 Modell oder es ist auch ein Modell, was eigentlich gebaut wurde für Softwareentwickler,
10:34 SPEAKER_01: für technische Positionen. Es ist extrem gut im Coden,
10:38 SPEAKER_01: ein so Product requirement
10:40 SPEAKER_01: Documentation zu erstellen und
10:42 SPEAKER_01: es arbeitet sehr viel mit präzisen Aussagen, mit Bulletpunkten
10:46 SPEAKER_01: und
10:47 SPEAKER_01: ist daher
10:49 SPEAKER_01: kommt es auch deutlich kühler rüber in den Antworten, wie eben GPT-4-o
10:53 SPEAKER_01: oder for one das in der Vergangenheit getan hat oder auch heute noch tut, wenn ich's auswähle.
10:58 SPEAKER_01: Und ist daher
11:00 SPEAKER_01: für mich gefühlt für
11:02 SPEAKER_01: das Verfassen von kreativen Texten, von LinkedIn Beiträgen,
11:06 SPEAKER_01: von irgendwie' nem Content, der jetzt nicht technischer Natur ist,
11:10 SPEAKER_01: nicht besser tatsächlich als das Modell.
11:15 SPEAKER_01: Sam Altman, also der CEO von OpenAI
11:18 SPEAKER_01: hat schon dazu gesagt, dass sie daran arbeiten werden und dass sie es also ein bisschen weniger kühl ausgestalten wollen,
11:24 SPEAKER_01: weil es viele Leute als negativ,
11:26 SPEAKER_01: ja, angemerkt haben. Es kann sein, dass sich darüber die Zeit noch ein bisschen verändert. Aber so in den ersten ein, 2 Wochen ist es definitiv der Fall, dass es ja wie ein wie ein anderer Mensch ist. Und
11:37 SPEAKER_01: ein Grund wohl
11:38 SPEAKER_01: laut laut Reddit und anderen Internetquellen, warum so viele Leute sich darüber aufgeregt haben, ist, dass sie wirklich mittlerweile ChatGPT wie son Lebensberater,
11:48 SPEAKER_01: Psychiater, Body, Coach verwenden.
11:51 SPEAKER_01: Und
11:52 SPEAKER_01: auch wenn der Coach schlauer ist auf einmal, wenn der nicht mehr so 1 ja,
11:57 SPEAKER_01: der ist halt also tatsächlich Leute finden das
12:00 SPEAKER_01: störend, dass die KI nicht mehr so blumig und nett und irgendwie mich verstehen und mir sagt, wie toll ich bin und so weiter. Und ich glaub, das hat OpenAI einfach ein bisschen unterschätzt, also wie sehr Leute da schon teilweise anscheinend
12:12 SPEAKER_01: mit' Charakter
12:13 SPEAKER_01: dieser Maschine,
12:14 SPEAKER_01: dieser dieser KI irgendwie vertraut sind und das sie dann stört, wenn auf einmal der Charakter ein anderer ist, auch wenn inhaltlich vielleicht die Antworten besser sind. Das ist total crazy. Ich hab bei mir im Systemprompt drin, dass ich gerne möglichst alles sehr kühl und sehr faktenbasiert
12:30 SPEAKER_00: und ohne große Komplimente und Blümchen serviert haben möchte. Benny ist nicht so der Emotionaltyp,
12:35 SPEAKER_01: ne? Hast Du wahrscheinlich deiner Frau auch gesagt, so, Also bitte, wenn Du mit sprichst, dass diese ganzen Aktionen, ne, Kind, buddle Points, to the Points,
12:43 SPEAKER_01: wie es GPT-5
12:44 SPEAKER_00: auch macht. Nein, das geil war, dann hab ich diesen Sprachmodus genutzt. Dann hat er mir jedes Mal erzählt, okay, straight to the point und
12:51 SPEAKER_00: dann hat er irgendwas erzählt. Das war jetzt so total.
12:54 SPEAKER_00: Alter, erzähl mir nicht, dass es straight to the point ist und lass das einfach weg.
12:58 SPEAKER_00: Also
12:59 SPEAKER_00: hast Du noch mal die Erklärung bekommen, dass das wirklich to the point ist? Na ja.
13:05 SPEAKER_01: Du hattest angesprochen, es ist technischer, es ist besser zum Coden. Ich hab auch gesehen, Loverable hat's direkt umgesetzt, hat direkt auf Chat Loverable, so weit Coding Tool, für die es nicht kennen, haben auch eine Episode dazu gemacht. Also wenn ich als Nicht Softwareentwickler wie wir trotzdem kleine, coole Apps bauen will, ist ein gutes Tool und da ist natürlich hinten dran immer ein 1 LM sozusagen und da ist jetzt GPT-5
13:26 SPEAKER_01: Standard. Stand jetzt noch, wie lange?
13:29 SPEAKER_00: Und auf jeden Fall kann ich wohl auch jetzt mit ChatGPT direkt Vibe Coding anfangen. Ich hab's selber noch nicht ausprobiert, weil meine ganzen Projekte jetzt auf waren.
13:38 SPEAKER_01: Hast Du's schon mal ausprobiert? Ich hab's noch nicht ausprobiert. Ich hab einige Sachen gesehen. Also ist schon crazy, was die Leute teilweise mit'
13:44 SPEAKER_01: einem Shot, das sogenannte One Shot Prompting. Ich würd einmal dem System sage, was ich gerne möchte und dann
13:50 Vibe Coding mit ChatGPT-5?
13:51 SPEAKER_01: wirklich eine 1 App mit Backend Lösungen
13:54 SPEAKER_01: entwickelt wurde, die über diese
13:57 SPEAKER_01: Standard Vibe Coding Sachen, ich hab irgendwie ein interessantes Front End, aber irgendwie nix hinten dran,
14:02 SPEAKER_01: was so der Status davor war, darüber hinausgeht. Also was ich gesehen habe, ist relativ beeindruckend. Ich hab's selbst noch nicht
14:10 SPEAKER_01: gebaut,
14:12 SPEAKER_01: aber ich werde es demnächst bauen, weil wir bald eine,
14:15 SPEAKER_01: ja,
14:16 SPEAKER_01: MVP bauen wollen für eine coole
14:19 SPEAKER_01: Interview, Voice Interview Lösung. Und da braucht man quasi ein Front End und ein Back End, was analysiert und so weiter und da werden wir das auf jeden Fall mal ausprobieren. Cool.
14:29 SPEAKER_00: Ich hab auch gelesen, dass es jetzt eine Personalisierung gibt, ähnlich wie bei Grog, dass Du dann sagen kannst, antworte wie ein Zyniker,
14:36 SPEAKER_00: wie jemand, der sehr einfühlsam ist et cetera.
14:39 SPEAKER_01: Hab ich noch nicht ausprobiert. Hast Du's ausprobiert? Ich auch nicht. Also ich bin da nicht so,
14:44 SPEAKER_01: dass mir das so wichtig ist. Also ich weiß
14:48 SPEAKER_01: auch nicht, warum man der KI sagen sollte, dass irgendwie ein Zyniker antworten soll. Es sei denn, man ist irgendwie selbst ein bisschen depressiv oder kommt mit der mit der Welt nicht klar oder
14:58 SPEAKER_01: Zynismus
14:59 SPEAKER_01: hat Vor- und Nachteile, aber die KI soll einfach für mich meine Probleme gut lösen und
15:05 SPEAKER_01: da ist mir der Stil jetzt nicht so wichtig. Aber klar, grade für so Themen, wenn's mein wenn ich's wirklich als Life Buddy nutze, als Psychologe,
15:13 SPEAKER_01: als Coach, wie auch immer, da spielt so was dann vielleicht eine Rolle. Aber ich nutz es als Arbeitstool und
15:19 SPEAKER_01: wenn die Arbeit fertig ist, kommunisiere ich lieber mit richtigen Menschen.
15:24 SPEAKER_01: Ohne Bullet Points? Ohne Bullet Points. Aber auch nicht so viel Fluff, das ist schon auch meine persönliche Referenz.
15:32 SPEAKER_00: Die Integration mit...
15:33 Anwendungsfälle: Wer braucht ChatGPT-5 wirklich?
15:33 SPEAKER_00: Es gibt ja verschiedene Integrationen, unter anderem in Google Mail, in Google Kalender, Google Docs. Wahrscheinlich kommt noch mehr dazu. Lustig, dass Google integriert ist und Microsoft noch nicht. Mhm. Und Microsoft
15:45 SPEAKER_00: so eng mit, ob man einfach Bundle ist oder vielleicht auch bald nicht mehr, wer weiß. Ich hab's mal integriert mit meinem Google Mail, hab dann gesagt,
15:52 SPEAKER_00: was steht denn in meinen Mails? Dann konnte ich dir nicht sagen, da musst Du sehr spezifisch fragen, war ich son bisschen enttäuscht.
15:58 SPEAKER_00: Hast Du's ausprobiert?
16:00 SPEAKER_01: Noch nicht. Ich nutze es mit Claude hin und wieder. Ich wollte aber, ich hab tatsächlich einen Use Case, den ich ausprobieren wollte und zwar
16:08 SPEAKER_01: haben wir diese diese KI Führerschein, diese 8 Wochen maßgeschneiderten
16:12 SPEAKER_01: Programme und ein Riesenpain ist immer mit den Unternehmen die Termine
16:18 SPEAKER_01: die Termine festzulegen.
16:19 SPEAKER_01: Das heißt, ich muss ja quasi viermal 2 Stunden Inhalt und viermal eine Stunde Consulting Session irgendwie mit denen planen und dann hab ich in der Regel ein Call und schreib dann die ganzen Termine auf. Ja. Und dann muss ich quasi jeden einzelnen Termin
16:32 SPEAKER_01: benennen und an den Kunden schicken und an die relevanten Personen aus dem Team schicken und hab dann immer manuell diese Kalendereinträge gemacht, die Leute reinkopiert und so weiter. In' ersten Schritt, was ich letzte Woche hinbekommen hab, ist, hab mir daraus eine 1 ICS, eine Kalenderdatei Mhm.
16:48 SPEAKER_01: Mhm. Automatisiert erstellen lassen. Und das hat eigentlich schon ganz gut funktioniert.
16:52 SPEAKER_01: Dann kriegst Du halt drauf und dann musst Du dann noch hier son bisschen hier und da und und saven und so weiter in deinem Kalender. Also musst nicht mehr alles manuell machen. Was ich jetzt probieren möchte im nächsten Schritt, ist eben mit dieser Kalenderintegration
17:03 SPEAKER_01: einfach zu sagen, hier sind die Termine
17:05 SPEAKER_01: und irgendwie für die Termine irgendwie die Personen reinschreiben. In
17:09 SPEAKER_01: In der Memory sind die Personen und die E-Mail-Adressen der Leute. Erstell die jetzt bitte immer im KI Führerscheinkalender
17:14 SPEAKER_01: und schickt das an irgendwie die relevanten Leute. Das ist mein nächster großer Test.
17:20 SPEAKER_00: Dann berichte mal, wie's ist. Nachricht. Die Integration in Google Drive hat bei mir dreimal nicht funktioniert. Weiß gar warum. Vielleicht zu viele Daten oder...
17:28 SPEAKER_00: Größeres
17:30 SPEAKER_00: Kontextfenster
17:30 SPEAKER_00: gibt's auch bei ChatGPT 5. Was heißt Kontextfenster?
17:35 SPEAKER_00: Sprich von Tokens
17:37 SPEAKER_00: und je mehr Tokens
17:39 SPEAKER_00: im Kontextfenster
17:40 SPEAKER_00: habe, desto mehr Inhalt kann ich da reinstopfen, den ich auf einmal analysieren kann.
17:45 SPEAKER_00: Also wenn ich ein kleines Kontextfenster hab, dann kann ich mir vielleicht eine SMS merken. Wenn ich ein großes hab, kann ich ein ganzes Buch rein reinspeichern, mit
17:51 SPEAKER_00: mit dem ich dann interagieren kann.
17:53 SPEAKER_00: Und ChatGPT unterscheidet hier in der Free Version, Pro Version, Plus Version. Free sind, glaub ich, 8000 Druck zurzeit. Was gar nichts ist. Plus sind 32,
18:02 SPEAKER_00: Pro sind 128
18:03 SPEAKER_01: oder so was. Ich glaub, mittlerweile hast Du, glaub ich, ich weiß, hab Du in der Plus Version.
18:08 SPEAKER_01: Du hast, glaub ich, maximal 256
18:10 SPEAKER_01: Ja. Mittlerweile.
18:12 SPEAKER_01: Okay. Was aber tatsächlich immer noch extrem klein ist, weil Gemini hat Gemini hat 1000000, ne? Hat 1000000 und seit
18:19 SPEAKER_01: paar Tagen, also wenn der Podcast rauskommt, bisschen länger Ja, ein Tage, ja. Hat ein Tropic mit dem Sonnad Modell, zumindest mit dem kleinen auch 1000000
18:28 SPEAKER_01: Kontextfenster.
18:29 SPEAKER_01: Ich mein, es ist das kleine Modell, was 1000000 bekommen hat und damit 4 x gegenüber OpenAI.
18:35 SPEAKER_01: Und das ist auch noch ein Grund, warum ich tatsächlich sehr häufig noch Germany nutze einfach, weil wir oft einfach nicht nur also sehr große Dinge irgendwie machen, ganz viel Kontext und aus verschiedenen
18:46 SPEAKER_01: aus verschiedenen Calls und daraus, was entstehen soll.
18:49 SPEAKER_01: Und da ist dann ChatGPT relativ schnell an der Grenze, weil das Kontextfenster voll ist und ein paar Mal hin und her promptest. Und da ist für für mich und für uns immer noch Gemini eigentlich das das Go to LLM.
19:01 SPEAKER_01: Gerade
19:02 SPEAKER_01: wenn wir diese diese Mikroorgane, so 20 Mikroaufgaben, die wir erstellen, das Ultra viel Kontext drehen über die Person, das Unternehmen und und das so richtig schön maßzuschneidern.
19:11 SPEAKER_01: Und
19:12 SPEAKER_01: wenn Du da länger geschätzt hast, dann kommt dann und das hatten wir auch in unserem Test mit GPT-5 kommst Du relativ schnell
19:18 SPEAKER_01: an Halluzinationen,
19:20 SPEAKER_01: weil dann GPT-5 die Sachen sich nicht mehr merkt, die am Anfang waren, weil das Kontaktfenster immer größer wird. Und das merkt man schon. Also wenn man sehr lange Sachen macht, dann dann ist es schon ein Problem. Wo wir
19:31 SPEAKER_01: wo's am Anfang sehr gut war, wir haben die unsere Strategie für,
19:35 SPEAKER_01: wir hatten son 3 Tage Strategie Workshop und haben vorher genau definiert, was wollen wir machen? So,
19:41 SPEAKER_01: was sind unsere Values, die Ziele, unsere verschiedenen
19:45 SPEAKER_01: Geschäftsbereiche
19:46 SPEAKER_01: und
19:47 SPEAKER_01: wo haben wir Gaps und so weiter und so weiter. Alle unsere Kernfragen haben wir runtergeschrieben
19:52 SPEAKER_01: und noch son bisschen Kontext natürlich gegeben zu SnipKI, haben das in GPT-5 reingegeben und haben dann den Workshop zu zweit gemacht Ja. Und haben mit
20:00 SPEAKER_01: GPT-5 als als 3. Sparringspartner
20:03 SPEAKER_01: Person quasi mit reingenommen
20:05 SPEAKER_01: und haben natürlich immer selbst vorher überlegt und das das Stinking gemacht, das ist das Wichtige, hatten wir in der Lernfolge, nicht einfach KI machen lassen und nicht selbst denken, Wir haben selbst die Antworten zu jeder Frage gegeben und haben dann zusätzlich von der KI, von GPT-5 eine Antwort bekommen und haben dann insgesamt einfach sehr, sehr gute Ergebnisse bekommen.
20:23 SPEAKER_01: Aber irgendwann so am zweiten Tag im gleichen Chat nur sehr, sehr, sehr viel da drin hast, dann haben wir gemerkt, okay, jetzt wird das Ding verwirrt und jetzt ist einfach das Kontextfenster voll und jetzt können wir in dem Chatfenster nicht mehr weitermachen. Das war ganz interessant zu sehen. Also am Anfang
20:36 SPEAKER_01: Beispiel, wir waren beeindruckt wirklich an der Qualität, weil er wahrscheinlich auch immer die besseren Modelle für so schwierige Fragen verwendet hat, aber dann irgendwann ja Kontextfenster,
20:45 SPEAKER_01: Thema.
20:46 SPEAKER_00: Kann dir aber auch bei Governance passieren. Ich hatte das letztens, ich hab mir Hast aber viel reingeschrieben. Ja, relativ rumgescriptet in Google App Script und dann hat er mir am Ende die die Skripte durcheinander geworfen. Und ist mir aufgefallen, was ist das denn? Eine
21:02 SPEAKER_00: Sache hat der Guardian, glaub ich, berichtet, ist mir aufgefallen.
21:05 SPEAKER_00: Die haben gesagt, dass ChatGPT 5 bis zu 20 Prozent mehr Energie verbraucht, nee, 20 x
21:11 SPEAKER_00: mehr Energie als v o,
21:13 SPEAKER_00: wenn's so viel
21:15 SPEAKER_00: macht, also in den in den Modellen, die einfach mehr Zeit brauchen.
21:20 SPEAKER_00: Das ist schon krass.
21:22 SPEAKER_01: Ja, die Frage ist also a, ich kenn den Artikel nicht, ne. Ich
21:26 SPEAKER_01: frag mich, wie der Guardian es überhaupt wissen kann,
21:30 SPEAKER_01: weil der Guardian ja in dem Sinn also wahrscheinlich irgendwie über die Token oder so über die API ansteuert.
21:35 SPEAKER_01: Schätze ich mal, irgendwie viel Token da verarbeitet werden hin zu, also so werden die's wahrscheinlich gemacht haben. Die haben geschaut, wie viel Token gehen da irgendwie rein und raus, weil Du für die Token bezahlst und wenn ich die gleiche Anfrage ans eine oder das andere Modell schick, wie viel Token gehen da durcheinander, er gesagt, okay, schätz ich mal zwanzigmal mehr Token oder zehnmal mehr Token, also ist auch zehnmal höherer Energieverbrauch.
21:46 Die Zukunft von KI & Energieverbrauch
21:55 SPEAKER_01: So irgendwie würde ich annehmen, dass sie's gemacht haben, weil sonst können die ja nicht hinter die Kulissen bei OpenAI schauen.
22:04 SPEAKER_01: Das ist halt, ist das ein Unterschied zwischen GPT-4-o
22:07 SPEAKER_01: und GPT-5 oder ist es ein Unterschied zwischen'
22:09 SPEAKER_01: Modell
22:10 SPEAKER_01: und' Modell,
22:12 SPEAKER_01: ne? Und am Ende, wenn deine Antwort halt oder die Qualität der Antwort auch 20 oder 30 x mal besser ist, weil wenn ich mir ein Businessplan
22:20 SPEAKER_01: irgendwie entwickeln lasse oder ein Gerichtsverfahren vorbereite,
22:24 SPEAKER_01: dann,
22:26 SPEAKER_01: ne, ist das halt die Frage son bisschen, ja?
22:28 SPEAKER_01: Dann muss es halt im Zweifel auch mehr gerechnet werden und muss mehr nachdenken und dann kostet's halt einfach mehr.
22:34 SPEAKER_00: Wenn ich den Link noch finde, packen wir in den Shownotes, könnt ihr euch selber anschauen. Ist, glaub ich, auch eine interessante Diskussion jetzt einfach aufkommen wird, ja. Wenn man sich anschaut, wie viel in Rechenzentren grade investiert wird, was da auch aufgebaut wird, Ja. Dann werden die einfach sehr viel Energie fressen. Dann ist die Frage, haben wir grade so viel Energie oder steigen die Energiekosten aufgrund von AI? Die werden bestimmt steigen, glaube ich. Ja. Die Frage ist ja son bisschen,
22:57 SPEAKER_01: ist es, es kann ja auch was Gutes sein, weil dadurch ja viel mehr
23:03 SPEAKER_01: Forschung und Entwicklung vielleicht in die erneuerbaren Energien geht,
23:06 SPEAKER_01: jetzt auf einmal Sachen ausgebaut
23:08 SPEAKER_01: werden, die vorher nicht ausgebaut wurden, weil eben der Bedarf halt da ist
23:13 SPEAKER_01: und
23:14 SPEAKER_01: ja, also es ist es ist ein sehr spannendes gesellschaftliches
23:17 SPEAKER_01: Thema. Ich glaub, in eben und USA hat Google jetzt auch zugesagt, dass sie während der Hauptpeakzeiten
23:25 SPEAKER_01: weniger
23:28 SPEAKER_01: Modelle trainiert oder quasi Modelle
23:30 SPEAKER_01: trainiert, weil das haben sie ja in der Hand, wann sie die trainieren und dass sie die quasi eher in der Nacht trainieren, wenn der Pikbedarf nicht so hoch ist an der Energie. Und das ist spannend, was da passieren wird, ne. Wir haben ja letztens schon mal drüber gesprochen, wie viel
23:44 SPEAKER_01: zusätzliche
23:45 SPEAKER_01: Kernkraft
23:46 SPEAKER_01: und Solar und so weiter eigentlich alles gebaut wird durch diese, ja, Energie,
23:52 SPEAKER_01: eine Riesenenergiebedarf,
23:53 SPEAKER_01: den eben die Modelle und eben die Anbieter damit haben.
23:56 SPEAKER_00: Also Fazit, wahrscheinlich ist Shashi Beate 5 eher wie son neues iPhone,
24:00 SPEAKER_00: was ein bisschen besser ist als die alte Generation, aber halt nicht mehr ein Riesensprung,
24:05 SPEAKER_00: weiß ich nicht, als man von seinem Nokia 32 10 aufs
24:08 SPEAKER_00: iPhone 4 umgeswitcht
24:10 SPEAKER_01: ist. Genau, also ich hab die einzelnen Modelle an sich sind natürlich oder das beste Modell ist natürlich wieder ein Ticken besser in den Benchmarks als es davor, keine Ahnung, welches davor das beste war. Ja. Es ist kein Riesensprung.
24:22 SPEAKER_01: Es ist immer noch kein AGI. Die Maschine ist immer noch nicht schlauer als wir und wird uns immer noch nicht in allen unseren Aufgaben ersetzen. Das ist, glaube ich, in sehr, sehr vielen Aufgaben
24:32 SPEAKER_01: schon auf so
24:34 SPEAKER_01: Doktor PhD Level. Mhm. Das Problem ist, dass man halt nie so genau weiß, ob man grad den Doktor oder den PhD bekommt oder halt den
24:42 SPEAKER_01: nicht so schlauen,
24:44 SPEAKER_01: die nicht so schlaue Person, ne. Das ist son bisschen das Problem da hinten dran. Daher für für Businesses vielleicht noch ein bisschen schwierig aktuell in der Nutzung.
24:53 SPEAKER_01: Für Power User, die wirklich genau wissen, welches Modell wann wie wo ausgewählt wird, ein bisschen schwierig.
25:01 SPEAKER_01: Aber für wahrscheinlich 90 Prozent der Hörer und Hörerinnen hier einfach die beste Wahl, einfach Typ-T-fünf zu nutzen,
25:08 SPEAKER_01: das auf dem Standard quasi ein Modell zu lassen, Typ-T-fünf entscheiden lassen,
25:13 SPEAKER_01: wann was gewählt wird.
25:14 SPEAKER_01: Und im Endeffekt ist, glaube ich, unser
25:32 SPEAKER_01: zufrieden bin und wenn es ein Task ist, den ich regelmäßig mache, dann wähle ich in Zukunft einfach eben dieses Modell. Im Endeffekt ist es alles gut für uns alle, dass es eben die Option gibt und ich muss halt selbst entscheiden, in welchem Ergebnis ich am Ende zufrieden bin. Was wir aber wieder konstatieren müssen über alles, was wir gesprochen haben, sei es jetzt Antropic, sei es
25:52 SPEAKER_00: Purplexity,
25:53 SPEAKER_00: haben wir noch gar nicht besprochen, sei es ChatGPT oder auch Grog, alles amerikanische Unternehmen.
25:58 SPEAKER_00: Da ist kein Europäisches dabei. Ich hab lange Zeit nichts von Mistral gehört und ich glaube, der Zug fährt auch so langsam ab,
26:04 SPEAKER_01: das noch aufzuholen. Totgesagte Leben länger, man weiß es nie. Ich mein, die Europäer haben ja zumindest ein hohes, ich sag mal wirtschaftlich strategisches
26:13 SPEAKER_01: Interesse daran, auch irgendwie eine Eigenlösung zu haben. Aber ja, Stand jetzt sind die Amerikaner
26:18 SPEAKER_01: und teilweise die Chinesen, insbesondere bei so Videothemen,
26:22 SPEAKER_01: einfach
26:23 SPEAKER_01: ein ganzes Eck vorne dran.
26:27 SPEAKER_00: Damit ihr vorne dranbleibt,
26:29 SPEAKER_00: bleibt uns treu.
26:31 SPEAKER_00: Erzählt von uns, euren Freunden, euren Kolleginnen und Kollegen, abonniert uns
26:36 SPEAKER_00: und lasst uns Damit ihr drunter wichtig, lasst gern Kommentare da und
26:40 SPEAKER_00: gebt uns Inspiration, worüber worüber wir noch sprechen können. Und versprochen
26:44 SPEAKER_01: keine Fußball News mehr in den nächsten Folgen.
26:49 SPEAKER_00: Passt. Bis zum nächsten Mal. Bis dann. Tschau.