Zum Hauptinhalt springen
Podcast3. April 20262:04:08

#45 Claude Code Leak, Pretext, Cursor 3, Gemma 4

Gesprächsthemen

  • Beginn der Sendung / Intro
  • Website der Woche
  • Gemma 4
  • Mit dem KI-Avatar (Pika) chatten
  • Cursor 3
  • Quellcode für „Claude Code“ ist durchgesickert
  • Pretex
  • Agine de Potraine, Dadaismus, Die Zukunft des Designs im Zeitalter der KI

Transkript

Äh, die Verbindung ist gerade abgebrochen, aber ich habe es geschafft, wieder online zu kommen. Nur damit ihr Bescheid wisst: Wenn die Verbindung wieder abbricht, dauert es wahrscheinlich nur eine Sekunde, bis ich wieder da bin. Hoffentlich läuft mein Internet aber einwandfrei. Solange ihr keine Verzögerungen habt, oder? Wo seid ihr? Ähm, wo bin ich? Was kann ich sagen, das ihr versteht, obwohl ihr nicht aus Großbritannien kommt? Nein, ich meine, bist du zum Beispiel bei deinen Eltern? Oder bei einem Freund? Ja, bei einem Freund. Die wohnen sozusagen mitten auf dem Land, und, äh, ja, einfach ein bisschen Ruhe und Frieden fürs Wochenende. Obwohl ich heute arbeite, was sehr stressig ist. Ähm, aber, weißt du, vielleicht siehst du mich oft verschwinden, weißt du, wie ich wegen irgendetwas schreie und tobe.

Letzte Woche habe ich gesagt: „Du hast echt die bisher beste Aussicht. Du solltest alle deine YouTube-Videos hier drehen. Das ist das Beste.“ Meinst du? Meinst du das ernst? Ja, die Bildkomposition ist einfach perfekt. Es ist einfach so künstlerisch. Oh, er ist weg. Er ist weg. Okay. Also, jetzt ist er wieder da. Ich wollte gerade was kommentieren, aber ja, er ist wieder da. Ich nehme jetzt einfach meine Tabletten. Ja, ich kann dich immer noch hören, wenn das alles so läuft, obwohl es jetzt anscheinend eingefroren ist. Ja. Ich versuche mal, diese Dinger anzuschließen, und dann starten wir die Show. Das wird eine lustige Folge, aber diese Kamera hat, ähm, ich weiß nicht, ob das funktionieren wird, aber sie hat so eine Art Magnet. Ja, ja, ja, so eine coole kleine Kamera, aber es ist eine CGI-Kamera, die einfach nicht mit dem Mac funktioniert, und ich habe gesehen, wie unser Freund Ryan mit einer dieser kleinen Kameras gestreamt hat.

Und ich habe ihm sogar eine Nachricht geschickt und gefragt, wie er das an seinen Laptop anschließt, weil ich es nicht hinbekomme, dass die Verbindung stabil bleibt – du siehst ja, dass ich immer wieder ausfalle –, und er meinte, ich solle einfach das richtige Kabel ausprobieren, aber ich bin buchstäblich eine ganze Nacht aufgeblieben und habe alle meine Kabel ausprobiert, und eines von denen, die ich dabei habe, schien zu funktionieren – die Verbindung brach nie ab –, aber wie wir gerade feststellen, funktioniert es doch nicht. „Warum benutzt du nicht dein iPhone? Die Continuity-Funktion – das könnte eine Notlösung sein, aber es ist auch kein Mikrofon.“ „Nun, das Mikrofon deines Macs ist wirklich gut, ebenso wie das deines iPhones. Für alle, die zuschauen: Wenn ihr Videos drehen wollt und keine solche Kamera habt, braucht ihr sie eigentlich nicht. Ich habe sie nicht für die Sendung, sondern nur, weil ich früher Fotografie und Videografie gemacht habe.“

Wenn ich heute ganz von vorne anfangen und einfach nur Videos drehen müsste, würde ich definitiv nur mein iPhone benutzen. Das war jetzt nur eine Testaufnahme. Wie ist die Mikrofonqualität jetzt? Wie ist die Mikrofonqualität jetzt? Sie ist nicht so gut wie vorher, aber ich würde sagen, sie ist akzeptabel. Ich probiere mal was aus. Ich versuche mal, dieses Teil mit meinem iPhone zu verbinden. Ich bin im Verbindungsmodus. Ich trenne die Verbindung. Okay. Es ist wieder da. Es ist weg. Jetzt ist es wieder da. Okay. Seltsamerweise verbindet es sich nicht mehr mit meinem Handy, was sehr nervig ist. Ich habe dieses Bluetooth-Mikrofon verbunden. Das übrigens, DJI, falls ihr zuhört, auch überhaupt nicht funktioniert. Ich kümmere mich gerade um die Beleuchtung. Nun, ähm, ich sehe, dass Leute dazukommen.

Äh, wir versuchen gerade, ein paar Dinge in Ordnung zu bringen – ich weiß nicht, zum Beispiel die Kameraeinstellungen und auch die Mikrofonverbindung. Und wir fangen in einer Minute an. Ich frage mich, ob es daran liegt, dass ich das hier mit meinem Handy verbunden habe, dass mein Handy jetzt nicht von Continuity erkannt wird. Möchtest du dein Handy verbinden? Ist es das, was du vorhast? Ja. Ähm, „Continuity“ nutzen, richtig? Moment. Moment. Ich bin gleich wieder da. Es ist, ähm, wie lustig ist das denn? Gerade jetzt wird mein Handy von „Continuity“ einfach nicht erkannt. Das müssen wir noch herausfinden. Ähm, vielleicht muss es neu gestartet werden oder so. Na ja, das … Na ja, deshalb bin ich kurz weggegangen und dann wieder zurückgekommen, um zu sehen, ob ein Neustart nötig ist, denn es hat gerade noch funktioniert.

Klar, es hat einfach funktioniert. Und sobald ich dieses, dieses, dieses Ding anschließe, um einen besseren Ton zu bekommen, nimmst du das nicht auf, oder? Äh, nein. Ich richte auch gerade ein paar Sachen ein. Vielleicht liegt es nur an dieser Kamera. Ich könnte sogar einfach das machen. Verstehst du, was ich meine? Ich könnte sogar einfach das machen und es würde funktionieren, aber mein Handy wird nicht erkannt. Ich bin mir nicht sicher, ob du das gehört hast, aber du kannst dein Handy sogar als Mikrofon benutzen. Äh, vielleicht hast du den DJI komplett ausgeschaltet. Habe ich. Habe ich. Hast du? Mhm. Wir haben die AirPods voll aufgedreht. Wie war das? Äh, nein. Ist es die Vorgängergeneration? Ich schließe Chrome und komme dann wieder zurück.

Okay, also jetzt ist er wieder dabei. Interessanterweise haben wir ein paar Leute, die gerade zuschauen. Wir bringen gerade alles in Ordnung. Wir haben beschlossen, live zu gehen, bevor alles fertig ist – das macht mehr Spaß. Ähm, ja, so wird die Sendung produziert. Und Sa – Sam versucht, eine Verbindung herzustellen, und ich versuche, den Inhalt fertigzustellen, und bereite gerade ein paar Sachen vor, die ich euch zeigen möchte. Ähm, okay, also ich schätze, wir improvisieren einfach, Kumpel. Ich schätze, wir improvisieren einfach. Äh, du kannst die vorherige Ansicht nicht verwenden. Wenn du also die andere Kamera verwendest, wird die Verbindung unterbrochen, richtig? Das ist das Problem. Ja. Ja. Also, kannst du für diese Ansicht das so machen? Diese Ansicht wäre in Ordnung, wenn du den Laptop nicht bewegst, denn wenn du ihn bewegst, verursacht das, äh, Geräusche und auch die Vibration ist etwas nervig.

Mhm. Die Videoqualität ist bei weitem nicht so wichtig wie der Ton. Ja. Ja. Ich sage das und mache dabei selbst Geräusche. Ich frage mich, warum mein Handy gerade nicht erkannt wird. Also, was ist los, Mac OS? Weißt du, was ich meine? Ich hatte mein Handy angeschlossen. Es hat funktioniert. Wie kann ich … Kann ich … Lass uns mal in die Foto-App gehen. Es wird auch in anderen Apps nicht erkannt. Also, es wird einfach in keiner anderen App erkannt. Was einfach super nervig ist. Na ja. Na ja. Und dann ist das nächste Problem wahrscheinlich, dass mein Akku bald leer ist, also muss ich mir da vielleicht noch was einfallen lassen.

Wie wäre es damit? Wie wäre es eigentlich damit? Ich werde die Zeit nutzen, um zu schauen … Wann? Es gibt keine Zeit. Ich warte darauf, dass du loslegst. Ich warte darauf, dass du anfängst. Okay, ich kann jetzt … Wie ist der Ton? Ist das in Ordnung? Ja. Kannst du mich überhaupt hören? Moment, kannst du das? Ja, es ist … es ist in Ordnung. Ich … ich kann dich definitiv hören. Das ist der Ton von meinem iPhone. Meine iPhone-Kamera, die jetzt funktioniert. Ja, wozu brauchst du das Ladekabel? Ich hoffe, ich brauche es nicht. Ja, okay. Das hier. Okay, los geht’s. Wie ist das? Ist das besser? Kannst du … Kommt das aus diesem Mikrofon oder bin ich immer noch … Nein, das ist … Nein, es ist nicht dieses Mikrofon.

Das ist noch ein Mikrofon. Nein, das ist es nicht. Ja, das iPhone ist gut. Das iPhone ist gut. Dann bleiben wir mal dabei. Ja, es ist gut. Cool. Mal sehen, wie wir damit zurechtkommen. Die Vorschaubilder werden Spaß machen. Ich werde Nano Banana bitten, sie zu entfernen. Okay. Also. Ähm, wie spricht Google das übrigens aus? Okay. Sollen wir anfangen? Ja, fangen wir an. Also gut, an alle Zuschauer, die bisher dabei waren: Danke, dass ihr einfach so mit uns abgehangen habt. Äh, jetzt geht es offiziell los, und hier ist eine Liste der Themen, über die wir sprechen werden. Diese Woche gibt es also eine riesige Ankündigung von Google. Äh, ein Open-Source- oder Open… Es ist kein Open Source, es ist „Open Weight“, glaube ich, oder?

Äh, Google hat das Modell „Gemma 4“ veröffentlicht, das super leistungsstark ist. Äh, bei Anthropic ist versehentlich der gesamte Quellcode durchgesickert. Ähm, und wir haben den Cursor-Design-Modus. Wir müssen noch über „Pre-Text“ sprechen. Äh, das ist eine tolle Bibliothek, die vermutlich die Art und Weise verändern wird, wie wir in den nächsten zehn Jahren Layouts und Benutzeroberflächen entwickeln werden. Und was haben wir noch? Das war es auch schon so ziemlich auf meiner Liste. Du meinst, du meinst, ich meinte das, das, das Durchsickern des Quellcodes, ja. Ja, ja. Ja, also ja. Ähm, all das und noch mehr gibt es in der heutigen Folge. Ähm, hier ist „Command AI“. Ich bin Kavarza. Und ich bin Sam, und das hier ist „Week in AI Design and Dev“.

Cool. Soll ich also mit der „Website der Woche“ anfangen? Freut ihr euch schon auf die „Website der Woche“? Ich freue mich riesig darauf. Ich freue mich wirklich sehr darauf. Okay, ich schalte jetzt auf Bildschirmfreigabe um. Cool. Ähm, na gut. Das hier ist also die „Website der Woche“ und sie gehört zu den schönsten Websites, die ich seit Langem gesehen habe. Und wieder stammt sie von Shopify. Wie ihr seht, gibt es diesen Glitch-Effekt, wenn wir die Seite laden. Auf den ersten Blick dachte ich, das wäre ein Fehler oder eine Verzögerung, aber das ist es nicht. Der Effekt ist einfach so gestaltet. Und während wir scrollen, sehen wir einige wirklich schöne Bilder und wie diese Masonry-Layouts zusammenkommen, und ich frage mich: Warum, warum ist mir das nie für die Masonry-Layouts eingefallen, die ich in der Vergangenheit erstellt habe?

Das ist wirklich schön. Dann scrollen wir weiter und sehen diese Uhr. Und bis jetzt denkt man sich: Ja, das ist ganz nett, aber es ist nichts Verrücktes daran, oder? Es ist einfach nur schön. Was ist denn so Verrücktes daran? Na ja, was ist denn so Verrücktes daran? Diese Pille. Man klickt darauf und plötzlich hat man diese interdimensionale Ansicht der Seite, bei der es, wenn ich die Maus nach unten bewege, so aussieht, als würde die Kamera die Seite hinunterblicken, und ich kann den Rest des In- Inhalts weiter unten sehen. Und ich kann scrollen. Seht ihr die Uhr? Da ist sie. Das ist so abgefahren. Das ist so verdammt cool. Es ist einfach so ein einfaches Konzept. Wenn man nur an die Idee denkt, ist sie ganz einfach.

Aber schau mal, ich kann nach oben schauen und zwischen den Layouts hin- und herblättern, und es ist einfach wahnsinnig – ich weiß nicht, es ist so kreativ. Es ist so schön. Und wie ich schon vor der Show gesagt habe: „Das ist ein wirklich kurzer Scroll. Es ist nicht wie bei den anderen Projekten, die sie gemacht haben, die richtig lang sind. Es ist superkurz, aber es enthält doch einiges an Inhalt. Äh, da ist der Slider. Man kann sich den Inhalt ansehen, und es gibt diesen schönen Player, den man öffnen und schließen kann. Es steckt also mehr dahinter. Aber ja. Kurz und sehr, sehr eindringlich – es erobert den Twitter-Account des Designers im Sturm, weil es so schön und kreativ ist.

Wieder einmal eine großartige Leistung des Shopify-Designteams. shopify.design Ich wollte gerade sagen: Ja, ich wollte gerade sagen, dass sie es immer wieder schaffen, kreative, interessante Websites zu gestalten, was wirklich cool ist. Ja, wenn du dich erinnerst, haben sie diese hier gemacht: „The AI the Renaissance“. Sie haben mit KI experimentiert, und ich kann mir nicht vorstellen, wie sie von dem zu diesem Ergebnis gekommen sind. Wie? Denn bei jenem Projekt hatten sie auch so eine interdimensionale Sache mit dem Schloss und den zwei Browsern, und wahrscheinlich hat jemand gesagt: „Hey, das können wir in derselben Ansicht umsetzen und einfach eine 3D-Röntgenansicht der, äh, Website einbauen.“ Man sieht also, wie die Ideen wiederverwertet werden. Äh, das finde ich absolut großartig.

Ich finde es toll, dass man sieht, dass es dieselbe Idee ist, die wiederverwertet wird, aber so gut und kreativ umgesetzt. Nur um jede Menge Interaktion zu generieren – die Leute reden darüber, und wir genießen die Schönheit. Ah, das ist so verdammt gut. Ja. Das war’s. Kurz und prägnant. Worum geht es auf der Website eigentlich? Worum geht es auf der Website? Ich weiß nicht. „Make the new normal“. Äh, die Art, wie wir arbeiten, verändert sich. Ähm, ebenso wie das, was möglich ist. Okay, das ist eine interessante Aussage. Ich glaube, es geht um Design. Und darum, wie es sich verändert, ähm, mhm. Was wir im Internet tun können, insbesondere im E-Commerce. Äh, mal sehen, was das alles ist. Ich glaube schon, dass es um Design geht, also um die Möglichkeiten dessen, was man tun kann.

Das ändert sich doch gerade, oder? Ich arbeite mit KI, und dadurch ändert sich einiges. Mhm. Ähm, ich arbeite gerade an einer App, genauer gesagt an einer Website und einer App, die Videos nutzt. Und das bringt die App fast zum Erliegen. Sie ist nämlich massiv auf Videos angewiesen. Und das ist immer noch – ich weiß nicht, korrigiert mich, wenn ich falsch liege, vielleicht versuche ich hier nur, mir selbst etwas vorzumachen –, aber Video ist immer noch ein riesiges Problem für das Web. Dabei ist 3D doch eigentlich eine Sache, mit der man leichter umgehen kann. Die Website, die ich gerade erstelle, hat Videoübergänge zwischen bestimmten Szenen. Und das Herunterladen und Puffern dauert einfach eine Weile. Es ist immer noch eine so komplizierte Sache.

Dennoch scheint das auf modernen Rechnern recht gut zu laufen. Ja, also Videos – das ist es, was viele Leute falsch verstehen. Sie sehen eine 3D-Website und gehen davon aus, dass das das ressourcenintensivste Ding überhaupt ist. Das ist es aber nicht. Wenn es gut gemacht ist, kann WebGL sogar viel leistungsfähiger sein als Videos. Ähm, und bei Videos gibt es echte Einschränkungen hinsichtlich der Bandbreite. Äh, beim Seitenverhältnis gibt es Probleme. Man hat Probleme mit der maximalen Auflösung. Ähm, und das Seitenverhältnis – ich weiß, ich habe es schon erwähnt, aber ich möchte es noch einmal betonen. Es ist ein entscheidender Faktor. Aber wenn man Dinge in einem Canvas rendert, kann man Berechnungen anstellen und die Darstellung je nach Auflösung und basierend auf so vielen verschiedenen Faktoren skalieren.

Äh, und bei Videos ist es einfach strenger. Und es erfordert eine hohe Bandbreite, und es kommt wirklich leicht zu Bildausfällen, und ja, da stimme ich zu. Die Arbeit mit Videos bereitet seit jeher mehr Kopfzerbrechen, und das ist immer noch so. Äh, ganz zu schweigen davon, dass WebGL deutlich schwieriger ist. Es ist schwierig, aber es ist auch vielseitiger, leistungsfähiger und kann so viel mehr. Mhm. Mhm. Ja. Ja. Cool. Lass uns, äh, weitermachen. Lass uns fortfahren. Äh, willst du dann das nächste übernehmen? Jim, ich, ich mache das. Ich mache das. Ich habe hier ein Fenster geöffnet. Ich habe auch noch andere Fenster geöffnet, falls du willst. Ich könnte auch, ich weiß nicht.

Äh, ich müsste das erst mal durchlesen. Aber wie du willst. Ähm, ich werde meinen Bildschirm freigeben. Ich arbeite gerade mit nur einem Monitor. Ich habe gerade mit den Schwierigkeiten eines einzelnen Monitors zu kämpfen. Du hast doch ein iPad, oder? Ich habe ein iPad, ja. Du könntest es als … Ich weiß, du weißt schon. Ich wollte gerade sagen: Soll ich das jetzt einrichten, während du hier sitzt, und … Nein, nein. Nein, nein. Ist schon gut. Ist schon gut. Ist schon gut. Also, Gemma: Google hat Gemma um vier Plätze von Platz 2 auf Platz 3 der globalen Open-Modell-Rangliste zurückgestuft, von 2 Milliarden auf 31 Milliarden. Es basiert auf derselben Technologie wie Gemini 3 unter Apache 2.

Also, die Nutzung ist kostenlos. Die Nutzung ist kostenlos. Ähm, anscheinend gibt es vier Größen. Es gibt 2 Milliarden, 4 Milliarden, 26 Milliarden, ähm, „Mixture 26 Milliarden“ – „Mixture Experts“, sorry – und 31 Milliarden, offensichtlich der „Big Daddy“. Ähm, also eine Auswahl an verschiedenen, ähm, Größen und all das für eure Bedürfnisse. Äh, und die Tatsache, dass es ein Ranking gibt, ich meine, mal sehen. Funktioniert meine Bildschirmfreigabe übrigens? Ich kann nicht ständig hin und her springen. Deine Bildschirmfreigabe funktioniert, aber ja. Wenn du zu dem einen Diagramm gehst, ja. Dieses hier? Ja. Wenn du das Modell vergrößerst, ja. Ist das gut so? Ja, perfekt. Ja. Also, was sehen wir hier? Es ist Qwen 3.5. Das ist der ELO-Wert.

Was ist ELO? Das ist das ELO. Das ist im Allgemeinen das. Das ist das ELO. Ich weiß nicht, welche Messgröße sie verwenden, aber wir sehen, dass es deutlich besser ist als Qwen. Nun, die Größen unterscheiden sich nicht wesentlich, oder? Nun, da ist Qwen. Das hier sind 27 Milliarden, und das hier sind 397 Milliarden. Also, was die Größe angeht, übertrifft es Qwen im Vergleich zu dessen Größe. Also, das sind 26 Milliarden, das sind 27 Milliarden, 31 Milliarden, nur ein kleines bisschen vorne, und sie liegen alle ungefähr, na ja, ich meine, das ist unglaublich. Das ist doch genau das, was man erreichen will, oder? Also, wirklich, wirklich cool. GLM 5 – das ist unser guter Freund Minimax M2.7, dann nein.

Aber, weißt du, GLM 5.1 ist gerade erst erschienen, daher ist es schade, dass wir das nicht sehen können. Aber ja, ich meine, für ein kostenloses Modell, das man für alles Mögliche nutzen kann, ist es ziemlich gut. Wie ich schon sagte, basiert es auf derselben Technologie wie Gemma 3. Gemini 3, nicht Gemma 3 – kleine Korrektur. Die leistungsfähigste Modellfamilie, die man auf der eigenen Hardware ausführen kann. Also, ich frage mich, wie groß es eigentlich ist – ich meine, lass uns das hier mal öffnen. Und sehen wir hier die tatsächliche Dateigröße, äh, Dateien und Versionen? Und so wie es aussieht, schätze ich mal 10 Gigabyte. Ich schätze etwa 10 Gigabyte. Das ist das kleinste Modell. Es ist also nicht gerade winzig. Ehrlich gesagt hätte ich erwartet, dass etwas mit etwa 2 Milliarden etwa halb so groß ist.

Aber ich denke, es ist ziemlich leistungsfähig, denn es kann ja schon eine Menge leisten – und das bei nur 2 Milliarden Parametern. Ähm, die gesamte Produktfamilie geht über einfachen Chat hinaus und bewältigt komplexe Logik und agentenbasierte Arbeitsabläufe. Das könnte also ein interessantes Vibe-Coding-Tool sein. Ich muss das ehrlich gesagt vielleicht mal ausprobieren. Mal sehen, ob ich es in meiner Vibe-Coding-Umgebung zum Laufen bringe. Und, äh, ja. Leistungsstark, zugänglich und offen, um die nächste Generation bahnbrechender Forschung und Produkte voranzutreiben. Wir haben das Gemma-4-Modell speziell so dimensioniert, dass es auf der Hardware von Milliarden Android-Geräten weltweit effizient läuft und feinabgestimmt werden kann. Also nicht, äh, nicht Apple. Ähm, sondern auf Laptop-GPUs oder Workstations von Entwickler-Beratern.

Also, ja. Ich glaube, ich werde das auf jeden Fall gerne mal ausprobieren. Denn wir haben ja all diese chinesischen Modelle, die gerade für viel Aufsehen sorgen, wie zum Beispiel Qwen 2.5. Ähm, Mini Max, ähm, von denen keines wirklich auf eurer Hardware läuft. Es war nur Qwen 3.5, worüber wir vor ein paar Wochen kurz berichtet haben, das tatsächlich auf schwächerer Hardware laufen konnte, ähm, was ganz okay war. Ähm, wenn wir noch einmal zurückgehen. Erinnern wir uns doch mal daran: „Wo stehen wir gerade?“ Gemma. Alle zusammen: Gemma. Alle zusammen: Gemma. Wisst ihr, ähm, Quen 3.5 lief einfach nicht so gut. Und das war das Modell, das potenziell auf eurer eigenen Hardware laufen könnte.

Also, ja, ziemlich cool. Ich werde es mal ausprobieren. Also, wenn ich das mal in die Diskussion einbringe, sehe ich das schon als weiteren Erfolg für Google, vor allem jetzt, wo Google wieder an Fahrt gewinnt, wie wir sehen. Ähm, etwas, das wir übrigens noch nicht angesprochen haben: ein weiterer Grund, warum man sich die Serie „Silicon Valley“ unbedingt ansehen muss. Die ist immer noch aktuell. Äh, wir haben diese Google-Forschung noch nicht angesprochen, in der „Turbo Quant“ vorgestellt wird, unser neuer Vergleichsalgorithmus, der den LLM-Schlüssel-Wert-Cache-Speicher um mindestens das Sechsfache reduziert und eine bis zu achtfache Beschleunigung liefert. Ähm, ich bin mir nicht sicher, ob das direkt zu Gemini 4 beiträgt oder nicht, da es hier um den Speicher-Cache geht, aber äh, das ist eine weitere Maßnahme, die Google ergreift, um das Modell zu verkleinern und schneller zu machen.

Ähm, w-was umso wichtiger ist, wenn man bedenkt – ich weiß nicht, ob ihr schon von den neuen Einschränkungen durch Claude gehört habt. Claude hat also jetzt während der Stoßzeiten weitere Einschränkungen für die Nutzer eingeführt. Und das zeigt einfach, dass es noch sehr neu ist. Es ist wirklich noch sehr neu. Ich glaube, vor ein paar Tagen wurde bekannt gegeben, dass neue Beschränkungen eingeführt werden. Man stößt also viel schneller an seine Grenzen. Das alles ist deshalb von Bedeutung, weil es so aussieht, als würden die Modelle nicht wesentlich leistungsfähiger werden – zumindest nicht um eine Größenordnung. Was wir stattdessen bekommen, sind viele, ähm, Effizienzsteigerungen, kleinere Modelle, die schneller und kostengünstiger sind, und solche Dinge.

Das wird also noch wichtiger, damit wir vielleicht einen Schwarm von Agenten bilden können, äh, und solche Dinge. Wenn ich hier auch lese, äh, dieser Tweet hat mich ebenfalls angesprochen. Äh, man kann gar nicht genug betonen, wie bedeutend diese Nachricht ist. Die Möglichkeit, ein Frontier-KI-Modell auf der eigenen Hardware auszuführen, bedeutet, dass die Kosten praktisch bei null liegen. Vorausgesetzt, man hat den Computer und den Strom – aber ja, es ist praktisch kostenlos. KI wird … äh, ich weiß nicht, wie man das ausspricht. Allgegenwärtig und günstig – allgegenwärtig und günstig wie das Internet selbst. Das ist … das ist wirklich eine Riesensache. Es wird zu einer Art Standardgut, in dem Sinne, dass man auf der eigenen Hardware ordentliche Modelle betreiben kann – und das alles im Interesse des Datenschutzes und ähnlicher Aspekte.

Äh, das ist ein Schlag ins Gesicht für OpenAI und Anthropic. Lass mich hier aber auch kurz einhaken: Diese Person – wie hieß er noch mal? Entschuldigung. Ich kenne ihn nicht, aber ja, das ergibt Sinn. Nick – Nick, ich glaube nicht, dass Nick dieses Modell verwendet hat. Er oder sie, entschuldige. Man muss politisch korrekt sein. Ähm, sie haben, weißt du, was er theoretisch sagt, ist richtig. Wir bewegen uns definitiv in diese Richtung. Es ist die Richtung, die sich viele Leute wünschen. Aber, ich weiß nicht, ob du das weißt, aber mein Kanal hat sich in letzter Zeit wirklich darauf konzentriert, lokale Modelle zu testen, lokale Modelle auszuführen und sie zum Programmieren zu nutzen, sie mit Open Core zu verwenden und verschiedene Dinge damit zu machen.

Und ja, zugegeben, ich nutze es hauptsächlich für programmierbezogene Aufgaben. Ich würde sagen, das ist eine der am wenigsten anspruchsvollen Anwendungen außerhalb des Chats, die man mit KI machen kann. Wenn man das auf einem M5 laufen lässt – also, noch mal, auf einem MacBook Air –, glaube ich aber nicht, dass wir bei dem Mac Pro und dem Mac … Äh, Entschuldigung, also beim M5 Pro und dem M5 Max, große Sprünge sehen werden. Ich glaube immer noch nicht, dass wir bei der KI schon so weit sind. Und was er hier sagt, klingt so, als hätte er das tatsächlich ausprobiert und es wäre tatsächlich etwas Brauchbares. Aber ich habe das Gefühl, dass er das nicht getan hat. Also, kurz gesagt: Ich möchte das nutzen.

Ich möchte das eigentlich erst mal in der Praxis sehen, denn das klingt so, als könnte es für jeden gelten. Aber ich schätze, was er sagt, trifft nur auf die wenigen zu, die sehr, sehr teure Hardware haben. Ähm, einfach nur, um es lokal ausführen zu können, weißt du? Also, ja. Ich habe Bedenken, seinen Tweet auf ganz normale Leute wie dich und mich mit unseren MacBooks und unseren M1 Pros und unserem, na ja, was auch immer, zu übertragen. Ich stimme zu. Ich persönlich neige dazu, die Modelle auf ihrer absolut höchsten Stufe zu nutzen, es sei denn, ich bin mir ganz sicher, dass die Aufgabe nicht überbewertet werden sollte. Ähm, wenn das der Fall ist, wechsle ich zu einem niedrigeren Modell, aber es macht mir nichts aus, ähm, 10 Sekunden oder sogar eine Minute länger zu warten, um ein besseres Ergebnis zu bekommen.

Ich benutze Haiku gar nicht. Also, ich weiß nicht, wie es im Vergleich zu Haiku abschneidet. Das wäre für mich interessant. Ich weiß nicht, ob du aus dem Stegreif sagen kannst, wo Haiku hier ungefähr einzuordnen wäre. Nein. Keine Ahnung, weil wir nicht wissen, wie viele Parameter Haiku hat. Ja. Aber letztendlich auf jeden Fall, ja. Äh, letztendlich ist das hier ein offenes Modell. Ähm, man kann es auf seinem eigenen Chip ausführen. Vielleicht gibt es Leute mit Aufgaben, die leicht genug sind, äh, dass sie das hier nutzen können. Ich weiß es nicht. Vielleicht gibt es solche Aufgaben.

Ähm, vielleicht wird es für größere Modelle nützlich sein. Äh, vielleicht kann man Sonnet dazu bringen, Aufgaben für die eigene lokale, ähm, KI zu erstellen. Das könnte in Zukunft eine Option sein. Ähm, ja. Aber genau hier liegt das Problem, denn ähm, das bedeutet, dass die Leute im Moment niemals mit der lokalen KI zufrieden sein werden, und dass man sie – wie viele andere auch – mit den Spitzenmodellen von OpenAI vergleicht. Ja. Das wird man einfach nicht verstehen. Die Leute waren überrascht und fragten sich: „Moment mal, wie kann dieses Modell, das auf Hardware läuft, die sich auf der anderen Seite der Welt befindet, immer noch schneller sein als eine KI, die auf dem eigenen Rechner läuft?“ Und die Wahrheit ist, dass sie über so leistungsstarke Hardware verfügen.

Man braucht so leistungsstarke Hardware, um diese Sachen zum Laufen zu bringen. Und wenn Leute sich zum ersten Mal mit KI beschäftigen, vergleichen sie sie mit den „Frontier“-Modellen und wägen diese Optionen ab. Und letztendlich wird man, wenn man das tut, sehr, sehr enttäuscht sein, wie gut KI derzeit für den Durchschnittsnutzer lokal läuft. Quen 3.5 war ein kleiner Vorgeschmack darauf, wie das in dieser App läuft, aber das beschränkt sich nur auf den Chat. Und wen interessiert schon ein lokal laufender KI-Chat? Ich meine, das ist ganz nett, aber die Leute wollen echte Arbeit erledigen. Und ich glaube einfach nicht, dass wir schon so weit sind. Trotz allem möchte ich es ausprobieren.

Ich möchte das herunterladen und mal ausprobieren. Auf jeden Fall. Es macht ziemlich viel Spaß. Ich meine, ich zahle 200 Dollar für Claude. Äh, ich liege wieder unter dem Maximalmodell. Äh, nachdem ich heruntergestuft hatte, habe ich jetzt wieder ein Upgrade durchgeführt. Und ich denke mir, ich zahle das Geld und stoße nicht an die Grenzen. Also, warum sollte ich nicht das beste Modell für jede Aufgabe nutzen, die ich habe? Warum sollte ich mir den Ärger damit machen, wenn es mir keinen Spaß macht? Äh, was es aber tut. Und ich denke, ich werde mir etwas Zeit nehmen, um das herunterzuladen und vielleicht einen Chat einzurichten. Denn wie ihr wisst – ich habe es ja schon mal gezeigt –, habe ich meine eigene Chat-App. So eine komplette Chat-App mit Websuche und einigen Vergleichstools und solchen Dingen, komplett selbst programmiert.

Ich denke mir, warum sollte ich das nicht einfach auf meinem Computer laufen lassen und es meinen Freunden und meiner Familie zur Verfügung stellen? So etwas in der Art, einfach nur zum Spaß. Nur als Experiment. Vielleicht möchte ich das machen. Äh, das würde wirklich Spaß machen und es würde mich kein Vermögen kosten, wenn meine Freunde das Modell von meinem Computer aus laufen lassen würden. Also, etwas, das Spaß macht. Ja, genau. Ich denke, ja, das ist es, was du… Na ja, Spiele. Ja, ja, ja. Oh. Es ist lustig, dass ich mit meinen Inhalten gerade irgendwie in diese Richtung komme, nämlich viel mit lokaler KI zu machen. Oh, wow. Ja. Ich oder warst du das? Du bist gerade total durchgedreht. Nein, ich glaube, du halluzinierst.

Okay, na gut. Nein, nein, es ist nur ein Kabel. Okay. Herrgott. Ja, als ob das alles wäre – als ob das alles wäre, was wir alle, die wir YouTube schauen, von so was erwarten können: einfach Spaß damit zu haben, es zu genießen und zu sehen, wohin das führt. Wir können das wahrscheinlich so gut wie ignorieren. Ich weiß nicht, vielleicht spreche ich zu früh. Ich habe das Ding noch nicht einmal ausprobiert, aber wir können so etwas für uns wahrscheinlich getrost ignorieren. Man braucht einfach – ich glaube, sogar die H100 wurde in dem Artikel erwähnt. Verstehst du, was ich meine? Das ist wie – das ist wie ein … ich weiß nicht, weißt du, wie viel diese GPU kostet? Ich glaube, es sind Zehntausende. Ich glaube, es waren 40.000.

Nein, ich glaube, okay, 40, das ist also weit daneben. H100, ich suche gerade. Ja, 40.000 Tausend, 38.000, aber ich… ja. Wie viel VRAM hat es? Ich glaube, es hat so um die 97 Gig VRAM. Also brauchst du ein paar davon. Weißt du, du brauchst eine ganze Menge davon. Ist es das? 80 Gigabyte. Ja, genau richtig. Ja. Das Ding sieht sexy aus. Es sieht so gut aus. Schau dir das Innere davon an. Oh ja. Schau dir die Größe an, die Größe von dem... Schau dir das an. Ja. Oh Gott. Okay, wir sollten weitermachen. Es wird ein bisschen zu heiß. Okay, ich füge das hinzu. Okay, ich kaufe es direkt vom Bildschirm. Ja, ja. Ich speichere es in deinen Lesezeichen.

Cool. Ähm, oh, das war peinlich. Das muss unangenehm sein. Nein. Ich schaue mir auch zwei Bildschirme gleichzeitig an, wenn ich also ein bisschen abgelenkt bin, mache ich gerade Multitasking. Äh, ich habe da etwas, das ich noch nicht… Lass es mich einfach mal zeigen, und dann schauen wir mal, was du davon hältst. Also, ich habe diesen Tweet über dieses Tool gesehen, und es hat mich fasziniert – ich weiß nicht, ob ich das gruselig oder spannend finde. Man fügt dieses KI-Tool zu Google Meet hinzu und chattet mit ihm. Aber es hat ein Gesicht oder sogar mehrere Gesichter, und es sieht so gut aus. Ich meine, das ist Geschmackssache – es gibt verschiedene Stile, aber … Moment mal. Ist das ein Google-Produkt?

Nein. Nein, das ist es nicht. Es ist nur … Oh, Pika. Pika. G-Gespräche laufen einfach besser, wenn man ein Gesicht und eine Stimme hat. Ähm, ich weiß nicht. Deshalb freuen wir uns riesig, die Beta-Version des ersten Video-Chat-Skills für jeden Agenten zu veröffentlichen, der auf unserem neuen Echtzeitmodell „Pika Stream 1.0“ basiert. Äh, die Skill bewahrt Gedächtnis und Persönlichkeit und ermöglicht Anpassungsfähigkeit in Echtzeit, äh, und wenn man sie zusammen mit seinem Pika-KI-Alter Ego nutzt, können sie während des Gesprächs agentenbezogene Aufgaben ausführen. Also, dafür werden wir unsere GPU-Leistung einsetzen, um den Agenten sozusagen ein Gesicht und eine Persönlichkeit zu geben. Und sie ist auf GitHub. Ich habe sie noch nicht getestet.

Ich habe es mir gerade angesehen und ich … ich weiß nicht. Es … es … es sieht zumindest vom Design her gut aus. Es sieht wirklich … ich weiß nicht … Was ist eigentlich der Sinn dieser Sache? Ich verstehe das nicht. Ich verstehe es nicht. Anstatt wie in einem Text-Chat nur mit Text zu chatten, chattet man mit Gesichtern, und es scheint, als wären sie in Echtzeit und würden einem einfach antworten, und man kann mehrere davon mit verschiedenen … ich schätze, man könnte vielleicht Anthropic-Modelle mit OpenAI-Modellen kombinieren … oh Gott, man könnte Grok haben. Äh, man kann sie alle in einem Chat haben und dann mit ihnen chatten. Grok hatte, ja. Ja. Ja, das, ähm, aber ja. Genau. Das ist also die Idee, und es sieht so aus, als könne es auch Aufgaben ausführen.

Aber was für eine Aufgabe? Ich meine, ich glaube nicht, dass es einfach nur leistungsstärker ist als alles andere, was wir haben. Es ist nur so, dass es ein Gesicht hat. Ein karikaturhaftes Gesicht, das in Echtzeit zu sein scheint, aber es ist nur ein Video. Ich weiß nicht, wie viel davon echt ist. Ich müsste es testen, habe es aber noch nicht getan. Ich habe es mir gerade vor der Sendung angesehen. Interessant. War das … War das als eines der Themen markiert, die du behandeln willst? Ist das … äh … Nein, du musst herausfinden, was das gerade ist … „Car Simulator“ … Das war es, ja. Ja, wir können … Nun, ich habe es nicht … ähm … Es ist nicht aktiv. Äh, bei mir funktioniert es nicht, aber … Wo ist es?

Ja, hier. Äh, ich muss… Äh, soll ich das abdecken? Ja? Kannst du mich hören? Ist er das? Wahrscheinlich ich. Was meinst du damit? Ja, wahrscheinlich bist du es. Für einen Moment habe ich mich gefragt, ob ich es bin. Okay. Äh, ich habe den Design-Modus nicht. Das ist das Problem. Ich habe es versucht, ich habe mein Bestes gegeben. Ich habe es etwa 15 Minuten lang versucht. Ich konnte ihn nicht aktivieren. Äh, aber wir können darüber reden. Mhm. Na ja, sollen wir erst mal über „Car Mechanic Simulator 3“ als Ganzes sprechen und uns dann mit dem Designmodus beschäftigen? Ist das Cursor 3? Interessant. Okay, dann scheint es also etwas anderes zu sein. Ist das Cursor 3? Sieht so aus. Ich meine, das sieht ziemlich genau so aus, wie ich es mir vorgestellt hätte.

Ähm, okay, lass mich das mal nachschlagen. Ähm, es handelt sich um eine komplette Überarbeitung. Cursor Version 3. Sie haben das Ganze von Grund auf neu entwickelt und es auf KI-Agenten statt auf Dateien ausgerichtet. Das ist also ein massiver Paradigmenwechsel, besonders für Cursor. Denn sie hatten diese Art von Agenten und irgendwelche Schaltflächen, die einfach nur halbherzig waren, und weißt du, ich fand Cursor langsam wirklich klobig, einfach voller schrecklicher Entscheidungen. Es fing an, sich in „Vibe Coded Slot“ zu verwandeln, um ehrlich zu sein. Aber das hier fühlt sich so an, als hätte es das Beste von allem übernommen, insbesondere von Codex, denn ich denke, Codex – nun ja, ich würde sagen, Codex hat einen Trend gesetzt. Aber realistisch gesehen war es „Anti-Gravity“, das diesen Trend ausgelöst hat. Ähm, und IDEs, die sich um Agenten drehen.

Und jetzt ist es viel übersichtlicher. Du hast immer noch Dateien, und das gefällt mir eigentlich richtig gut. Es gefällt mir wirklich gut. Es ist schade. Ich möchte … Na ja, eigentlich werde ich gleich darauf eingehen, aber ja. Ich bin, ich bin, ich bin wegen dieser Überarbeitung hier. Ähm, okay, ich habe – ja, ich habe ein paar Dinge zu zeigen und anzusprechen. Die Sache ist die: Ich habe Cursor 3 noch nicht vollständig erkundet, aber ich habe – schau mal, ich habe all diese Fenster, um genau darüber zu sprechen. Leg los. Na gut, reden wir über Cursor 3. Was ihr hier seht, ist der alte Cursor, und das Problem dabei ist, dass er mit einer Menge UI-Optionen überladen ist, die sehr fragwürdig sind, zwischen denen man sich nur schwer zurechtfindet, und es passiert sehr leicht, dass man pro Projekt, pro geöffneter Instanz, eine völlig durcheinandergebrachte Benutzeroberfläche hat.

Aber jetzt gibt es da diese neue Schaltfläche, das Agentenfenster – das ist Cursor drei –, das verdächtig nach … Wisst ihr, wonach das aussieht? Das sieht genau wie die Codex-App aus, die wiederum wie der T3-Code aussieht. Nun ja, der Code sieht aus wie die Codex-App. Ich habe sie alle hier, um sie euch zu zeigen, aber darüber sprechen wir gleich noch. Also, aber lasst uns zuerst darüber sprechen. Das ist also Cursor 3, und was ihr hier seht, ist eine einfachere Benutzeroberfläche, auf der ihr eure Chats und Projekte habt. Ja, Projekte im Plural – mehrere Projekte an der Seite – und pro Projekt könnt ihr einen eigenen Chat laufen lassen, bei dem ein Agent etwas erledigt, und dann wechselt ihr zwischen diesen Projekten hin und her, ohne euch allzu sehr mit dem Code beschäftigen zu müssen.

Wenn man möchte, kann man weiterhin den Browser nutzen, man hat das Terminal, man hat die Dateien – das gefällt mir wirklich gut. Das ziehe ich gegenüber so etwas wie der Codex-App deutlich vor. Aber ich bin mir nicht sicher, ob das wirklich nötig ist. Es ist einfach nur ein nettes Extra. Aber ja, das ist also der neue Cursor, bei dem der Fokus auf einer viel einfacheren Benutzeroberfläche liegt, bei der man sich nur auf mehrere Projekte und mehrere Chats konzentriert. Man konzentriert sich darauf, Aufgaben zu verteilen, und schaut sich nicht die Dateien, den Code oder ähnliches an. Äh, wie ihr wisst, habe ich in der Vergangenheit für den Großteil meiner Arbeit die Codex-App genutzt. Bei so gut wie allen meinen Projekten in den letzten Wochen habe ich diese App jeden Tag den ganzen Tag über genutzt.

Aber ich habe gewechselt. Ich bin vor kurzem, also vor vielleicht zwei, drei Tagen, zu T3 Code gewechselt. Das ist also von Theo. Und der Grund, warum ich zu T3 Code gewechselt bin – wie ihr seht, haben alle genau dieselbe Benutzeroberfläche. Die Benutzeroberfläche ist fast identisch. Man hat Projekte und Chats. Das war’s. Und dann kann man in jedem davon einen neuen Agenten anlegen, ein neues Projekt erstellen oder einen neuen Chat eröffnen. Man weist den Agenten an, etwas zu tun. Ähm, man hat hier ein paar Schaltflächen zum Veröffentlichen, zum Pushen eines Commits, zum Öffnen der Dateien, zum Öffnen des Terminals und so weiter. Ähm, aber das war’s auch schon. Es ist eine sehr agentenorientierte Ansicht.

Der Grund, warum ich T3 Code mag, ist, dass ich damit Claude oder Codex nutzen kann. Und diese laufen über mein bestehendes Abonnement, sodass ich nichts extra bezahlen muss. Außerdem ist T3 Code selbst kostenlos. Es ist Open Source und kostenlos. Es nutzt also einfach meine bereits bestehenden Claude- und Codex-Abonnements in dieser viel einfacheren, ansprechenderen Benutzeroberfläche. Äh, genau das macht Cursor auch. Es ist genau dasselbe Konzept, aber wie du hier unten wahrscheinlich gesehen hast, steht da „Kostenloser Tarif“. Ich habe tatsächlich eine Zeit lang für zwei Cursor-Konten bezahlt, aber jetzt nutze ich den kostenlosen Tarif, weil … ich weiß nicht. Ich habe es nicht so oft benutzt, aber bei diesem hier … ich weiß nicht.

Mir gefällt die Idee irgendwie, meine Dateien einfach als Option zu haben, um sie hier über mein Terminal oder meinen Browser anzusehen – es ist einfach schön, diese Möglichkeit zu haben. Aber ja. Ähm, wenn ich hier in die Einstellungen gehe, sehe ich noch viel mehr, zum Beispiel gibt es bereits viele Optionen, Dinge wie Agenten, die man ändern kann. Es gibt die Modellauswahl. Es scheint also, als wäre Cursor 3.0 im Vergleich zu den anderen Tools ziemlich fortschrittlich. Ähm, es ist also kein reines Minimal-Tool. Das versuche ich zu sagen. Ähm, ich weiß nicht, was es hier mit der Beta auf sich hat. Ähm, ich greife auf die Beta zu. Ich weiß nicht, was das ist, aber es gibt Plugins, Regeln und Skills.

Aber in gewisser Weise sind das nicht unbedingt Dinge, die man nicht zu den anderen hinzufügen kann, ähm, auch hier im Codex. Äh, man kann so ziemlich das Gleiche machen. Man hat die MCP-Server. Man hat hier Umgebungen, äh, solche Dinge wie bei T3 – äh, das ist in gewisser Weise die am wenigsten ausgereifte Lösung, weil es Open Source ist und von Theo und seinem Team entwickelt wurde, aber ich glaube, er hat ein gutes Gespür dafür, wie das Produkt gestaltet sein sollte. Ähm, also probiere ich es mal aus. Letztendlich basieren alle auf dem gleichen Konzept. Das ist – ja, das ist einfach eine Frage dessen, was man persönlich bevorzugt.

Vielleicht gefällt dir das hier besser: einfach ein gutes altes Terminal. Und was ich manchmal wirklich vermisse, wenn ich ein Terminal benutze, ist Folgendes: Ich habe einfach, na ja, vier verschiedene Fenster, vier verschiedene Dinge, die gleichzeitig laufen, und Tabs. Ich wünschte, ich könnte das Gleiche tun. Ich habe sogar darüber nachgedacht, dass T3-Code Open Source ist. Ich habe mir überlegt: Kann ich einfach ein bisschen spontan programmieren, das hier nutzen und mehrere Versionen davon auf einer Arbeitsfläche laufen lassen? Und ja, auf einer Arbeitsfläche wie bei Figma, damit ich zoomen und schwenken und neue Notizen öffnen kann. Es geht bei all dem einfach darum, wie wir versuchen, diese agentische Arbeit zu erledigen, die noch nicht ganz ausgereift ist, aber es scheint, als würden immer mehr Unternehmen diesen Weg einschlagen, was in gewisser Weise auch ein bisschen beängstigend ist, weil man dabei nicht auf den Code schaut.

Es geht hauptsächlich darum, sich die, ähm, Aufgaben anzusehen, äh, oder die Aufgaben an die Agenten weiterzugeben und die Agenten die Arbeit erledigen zu lassen. Ähm, noch eine andere Neuigkeit, ähm, die aber immer noch mit Cursor zu tun hat: Anscheinend gibt es da diesen Designmodus, den ich haben sollte, aber ich kann nicht darauf zugreifen. Da steht, dass man ihn mit Strg+Umschalt+D aufruft. Und hier – lass mich mal alles minimieren. Wenn ich hier zu den Tastaturkürzeln gehe, seht ihr, dass ich diese Option „Designmodus umschalten“ (Umschalt-Befehl-D) habe, richtig? Wenn ich hier Umschalt-Befehl-D drücke, passiert nichts. Und wisst ihr, was wirklich blöd ist? Sie hatten dieses „Umschalt-Befehl-D“ für zwei andere, völlig unabhängige Funktionen. Standardmäßig gab es also drei verschiedene Tastaturkürzel – dieselbe Tastenkombination existierte für drei verschiedene Funktionen, was wahrscheinlich das Problem war. Aber selbst jetzt, wo ich diese entfernt habe, kann ich immer noch nicht darauf zugreifen.

Ich habe da diesen alten, äh, Selektor, der anders ist. Also, es sieht so aus, als ob dieser hier … Lasst uns das Video abspielen. Es ist nicht nur ein Selektor. Das ging zwar schon vorher, aber es gibt da etwas Neues. Es sieht also so aus, als ob man jetzt zeichnen kann, ähm … Ich glaube, das ist einfach ein Screenshot, der an das Modell gesendet wird. Man kann das natürlich auch manuell machen, aber es ist einfach viel praktischer, wenn es direkt im Tool integriert ist. Aber wie gesagt, ich komme nicht darauf zu… Nun, es sieht so aus, als wäre das in… Vielleicht irre ich mich auch. Es scheint, als wäre das in Cursor 3. Aber warum wird es dann in Cursor 2 angezeigt? Ja, genau hier wird es irgendwie unübersichtlich.

Ja, ich werde versuchen, das zum Laufen zu bringen. Ähm, ja, ich habe den Code bei den meisten meiner Projekte gerne geöffnet. Es ist einfach schön, immer mal wieder einen Blick hineinzuwerfen, besonders wenn man, na ja, nicht genau weiß, wie das Projekt aufgebaut ist. So kann man sich einfach wieder einarbeiten. Man kann einfach eine Zeile ändern, wenn man genau weiß, was geändert werden muss. Es ist schön, diesen Code gleichzeitig offen zu haben. Und deshalb finde ich es gut, dass Cursor anscheinend alles in einem zusammengefasst hat. Allerdings bin ich mir noch unschlüssig und hoffe, dass einige dieser IDEs weiterhin so „pur“ bleiben wie VS Code. Denn ich bin mir immer noch ziemlich unschlüssig.

Ich nutze Cursor Codex ausschließlich wegen des doppelten Ratenlimits, das wir haben, und weil ich derzeit einen kostenlosen Account habe. Allerdings nur noch für einen weiteren Monat, glaube ich. Und die Sache ist die: Ich merke, dass ich nicht einmal halb so gut mitbekomme, was vor sich geht, wie wenn ich in Claude programmiere. In Claude Code, sorry. Und das liegt daran, dass Claude sehr deutlich anzeigt, welche Codezeilen es gerade ändert, sobald es sie ändert. Wenn es also etwas ausführt, zeigt es dir, was es getan hat, und macht dann weiter. Der Unterschied zu Codex ist, dass man die Änderungen auf der rechten Seite im Code-Diff-Tool im Blick behalten kann – es zeigt zwar an, was passiert, aber es ist nicht linear.

Es heißt nicht: „Ich werde das tun.“ Und dann sieht man die Änderung. Und dann wird es das tun. Weißt du, was ich meine? Man sieht einfach alles, was es gerade macht. Nun, ich bin sehr offen dafür, dass ich es in VS Code öffnen kann. Ich bin sehr offen dafür, dass, ähm, ich könnte … ich schaue gerade sogar nach. Es ist nicht da. Es ist einfach im Feed – lass mich mal … ich kann meinen Bildschirm zwar nicht wirklich teilen, aber im Codex-Feed wird einfach auf die geänderte Datei verlinkt, und man kann nicht … es ist einfach nicht klar, welche Codezeilen geändert wurden. Ähm, ich klicke gerade sogar auf die Diffs und kann sie öffnen, aber es ist wieder so eine Art Massenangelegenheit.

Trotz allem bin ich mir immer noch nicht sicher, ob mir die Trennung von Warp und Claude-Code gefällt oder ob ich lieber nur den Code hätte, wenn ich das möchte. Ich denke, die ideale Lösung wäre Codex, aber mit mehr Transparenz darüber, welcher Code geändert wurde. Ich hole mir jetzt mal ein Ladegerät. Was haltet ihr davon? Lasst uns darüber diskutieren. Ähm, ich bin mir auch noch unschlüssig. Ich ändere ständig meine Meinung, weil ich denke, dass wir es noch nicht ganz durchschaut haben. Und wie ich schon sagte, es verändert sich gerade. Wir sind von VS Code mit voller Kontrolle über den Code zu einer Art Copilot-Ansatz übergegangen, bei dem man einfach Änderungen vornimmt oder sich von der KI direkt in der Zeile unterstützen lässt, bis hin zu Cursor, wo die Agenten alles erledigen, aber direkt vor deinen Augen, sodass du alles sehen kannst.

Du erinnerst dich noch an die Zeiten, als wir Änderungen quasi eine nach der anderen akzeptiert haben. Du hast im Chat zehnmal hintereinander auf „Akzeptieren“ geklickt. Ich habe das in Cursor gemacht, weil ich mir dachte: „Moment mal, wo geht das überhaupt hin?“, obwohl ich gar nicht programmiere. Ich habe mich gefragt: „Ist das richtig? Machst du das Richtige?“ Bearbeitest du die richtige Datei?“ Bis hin zu heute, wo wir die KI das Ganze erledigen lassen und uns den Code gar nicht mehr ansehen. Äh, also ja. Und genau das versuche ich damit zu zeigen – all diese Beispiele, um zu verdeutlichen, dass es ein Spektrum ist. Äh, man kann beides machen, und ich denke, was „Cursor 3“ ausmacht – es scheint so, als hätte ich übrigens auch das Design-Tool gefunden.

Ich glaube schon, dass es der „Sweet Spot“ ist. Aber nur weil es der „Sweet Spot“ ist, heißt das nicht, dass er unbedingt das Richtige für mich ist, denn man will ja nicht immer im „Sweet Spot“ sein. Ähm, ich glaube, im Moment ist der T3-Code für mich der Gewinner. Denn Codex war für mich zwar schon der Gewinner, aber bei Codex kann man nur die Codex-KI nutzen. Mit T3 kann ich meinen Claude und Codex nutzen, ganz wie ich will. Das ist für mich absolut ein echter Game-Changer. Vielleicht würde ich mir nur wünschen, dass der Browser hier integriert wäre, damit es etwas übersichtlicher ist. Ich bin mir da noch ein bisschen unschlüssig. Vielleicht fange ich ja an, selbst etwas zu programmieren.

Ich programmiere alles in einer T3-Canvas. Ich bin ein Fan davon, Dinge auf einer Canvas darzustellen und so eine Art Vogelperspektive zu haben. Wenn ich hier so eine Canvas zeige, sogar dieses Tool, das ich gerade entwickle, hat, äh, eine Canvas. Für mich ist alles eine Canvas. Äh, ich mag diese Ansicht einfach. Ja. Ja, für mich ist das … Ja, das muss ich mal ausprobieren. Das muss ich mal ausprobieren. Ich bin offen dafür, aber ja, ich bin einfach … Ja, ich bin ein Claude-Code-Fan, um ehrlich zu sein, und mir gefällt einfach, wie Claude … Hast du gesehen, dass Claude Code ein neues … ähm … Wie nennen sie das noch mal?

Es ist nicht flüssig, aber, äh, es verhindert das Flackern. Die Darstellung springt also nicht mehr so stark und ist jetzt viel flüssiger. Man kann quasi nach oben und unten scrollen, was ziemlich cool ist. Ähm, und es gibt Mausinteraktionen. Man kann mit dem Cursor herumklicken. Wow, im Jahr 2026 kann man den Cursor benutzen, um – mhm – die Stelle im Text zu verschieben, an der man gerade bearbeitet. Aber, ich meine, äh, es ist das Terminal, und ich will nichts beschönigen: Für viele Leute in unserem Publikum sieht das wahrscheinlich immer noch beängstigend aus. Ich habe mich daran gewöhnt und es gefällt mir sogar ziemlich gut. Es ist nur so, dass, ähm, ich weiß nicht. Das hier ist in gewisser Weise etwas beständiger.

Weißt du, meine Chats bleiben erhalten. Ich kann sie, ähm, ins Archiv verschieben. Ich kann im Archiv darauf zugreifen. Diese Beständigkeit ist der Grund, warum ich dabei bleibe, und die Multi-View-Funktion ist der Grund, warum mir das auch so gut gefällt. Und ich meine, ich glaube, du hast das einmal erwähnt. Ich finde, es hat auch eine gewisse Aura oder so etwas wie – na ja, man benutzt das Terminal. Man interagiert über das Terminal mit dem Computer und mit der KI. Das ist irgendwie cool. Es sieht einfach cool aus, all das zu haben. Aber ich will damit keineswegs sagen, dass das so etwas wie – na ja – ein Maß dafür ist, ein Profi zu sein, aber es ist cool.

Es gibt einige Leute, die interessante Sachen machen. Tmux ist eine weitere Möglichkeit, so etwas zu betrachten, aber auch hier weiß ich nicht so recht. Vielleicht, vielleicht, vielleicht möchte ich einfach die Vielfalt. Sie fangen alle irgendwie an, zu einer Einheit zu verschmelzen, mit nur noch subtilen Unterschieden. Mir gefällt die Trennung zwischen CLI und Code eigentlich ganz gut. Äh, Entschuldigung, ich schaue mir gerade meinen Code an. Ähm, aber ja, es ist schon interessant, wie weit wir gekommen sind, und das natürlich in Kombination mit Composer 2, über das wir auch gesprochen haben. Ich bin zum Beispiel froh, dass sie endlich das AI-Problem angegangen sind. Das heißt nicht, dass ich dafür ein zusätzliches Jahr bezahlen werde – was wohl darauf hinausläuft, glaube ich –, aber es ist gut.

Das sieht gut aus. Ja. Es hat sich ehrlich gesagt einfach total träge und langsam angefühlt. Mir hat es einfach nicht gefallen. Äh, der Cursor – dieser hier? Der Cursor oder der vorherige? Ja. Äh, für mich ist es die Benutzeroberfläche, die sich ständig ändert, und ich kann – es scheint, als könnte ich mit der KI nicht das machen, was ich will, und ich hasse diese Benutzeroberfläche, dass dein neuer Agent, weißt du, du hast einen neuen Agenten und hier hast du noch einen neuen Agenten. Das ergibt einfach keinen Sinn. Überall gibt es Doppelungen, und wenn ich von hier aus weitermache – ich bin gerade im, wie nennt man das noch? Im Editor-zu-Agent-Modus. Siehst du, wie der Agent auf der rechten Seite ist?

Es verschiebt sich auf die linke Seite. Warum? Warum? Äh, die Verbindung ist abgebrochen, deshalb bin ich gerade total aus dem Häuschen wegen dieser Sache. Ich habe gesagt, dass du diesen Agenten auf der rechten Seite siehst. Siehst du das? Mhm. Siehst du, wie ich hier den Agenten und hier den Chat habe, und ich habe den „Neuer Agent“-Button sowie die Schaltfläche „Neuer Agent“, und wenn ich die Ansicht von „Editor“ auf „Agent“ umstelle, verschieben sie sich auf die linke Seite, und ich frage mich: „Warum, Cursor?“ Warum? Es ist ja nicht so, und bei diesen beiden scheint es, als hättest du zwei Vorlagen, die du frei ändern kannst, und sie nennen es einfach „Editor“ oder „Agent“, aber du bist fast völlig frei, sie nach Belieben anzupassen, und es ist einfach nicht beständig genug, ähm, im gesamten … es bietet dir nicht jedes Mal die gleiche Erfahrung, und es wird super schnell unübersichtlich.

Ja. Du unterbrichst mich gerade, ähm, ich glaube schon. Ja. Gibt es noch etwas, das wir dem Gespräch hinzufügen können? Nein. Nein. Ich meine, ich bin einfach nur froh, dass sie sich um das Chaos kümmern, das dieser Schnitt – gelinde gesagt – angerichtet hat. Wir haben einen Kommentar zu diesem Cloud-Code-Leak. Äh, darüber werden wir sprechen. Darüber werden wir reden. Willst du über „Pick“ reden, äh, wie heißt das noch mal, äh, „Pretext“? Ähm, da ich krank bin, muss ich kurz durchatmen, also wäre es toll, wenn du weitermachen könntest, ich mache dann danach weiter. Ja. Ja. Ja. Ja. Ja. Lass mich, äh, mit „Cloud Code“ anfangen. Ja. Leg los. Ich habe dazu auch etwas Cooles von West Boss zu zeigen.

Aber mach du erst mal weiter, und dann zeige ich dir, was ich habe. Okay. Na, mal sehen. Mal sehen, wie es läuft. Noch einmal: ein einziger Monitor. Also, ClowdCode ist gerade Open Source geworden. Unbeabsichtigt, aber es ist Open Source geworden. Ähm, durch ein Missgeschick ist der Quellcode, aus dem ClowdCode entsteht – der bekanntlich seit, nun ja, einer Ewigkeit Closed Source ist, also wieder absichtlich Closed Source –, nun schon ein paar Mal unbeabsichtigt durchgesickert. Jemand hat die Source-Map in die NPM-Registry hochgeladen – das ist eine Datei, mit der man den gesamten durcheinandergewürfelten Code, den ein Build-Prozess erzeugt, entpacken und tatsächlich alle Dateien definieren kann, aus denen ClowdCode besteht, wodurch jede Menge pikante Geheimnisse enthüllt wurden.

Ähm, wir gehen diesen Artikel hier mal kurz durch, nur um sicherzugehen, dass wir auch alles abgedeckt haben. Und Dropped hat laut dem Sprecher versehentlich einen Teil des internen Quellcodes für seinen Programmierassistenten ClowdCode geleakt. Ich bin überrascht, dass die Person im Chat so reagiert: „Was, ein ClowdCode-Leak?“ Denn das war doch überall zu lesen. Herrgott noch mal. Äh, das Leck könnte Softwareentwicklern und den Konkurrenten von Dropped it Einblicke darin verschaffen, wie das Unternehmen sein virales Programmier-Tool entwickelt hat, und so ein Quatsch. Das ist wichtig. Quatsch-Tools, die in die Enthüllung verwickelt sind. Die Sache ist die: Ich muss ehrlich sein. Wisst ihr, das wurde mir von Leuten geschickt. Ehrlich gesagt ist mir das eigentlich egal. Es ist pikantes Gerede, und wir werden alles durchgehen, aber es ist mir egal. Ich gehöre einfach nicht zu den Leuten, die total auf Open Source abfahren und der Meinung sind, dass ClowdCode Open Source sein muss.

Ähm, aber weißt du, es gibt es, und jemand hat es tatsächlich in Python neu implementiert. Was bedeutet, dass es völlig legal ist, da man etwas geschaffen hat – ein abgeleitetes Werk –, was wiederum bedeutet, dass es jetzt nicht mehr, na ja, nicht mehr, ähm, offen ist. Entschuldigung, es ist nicht mehr urheberrechtlich schutzfähig. Das war also der erste Schritt. Also hol dir das. Offensichtlich schicken sie DMCA-Meldungen an jeden, der Claude aufgreift und Claude-Code als Open Source auf GitHub hochlädt. Sie können diesbezüglich DMCA-Anträge stellen, und das tun sie auch und haben es bereits getan. Ähm, aber die Python-Bibliothek – und ich glaube, es gibt auch eine Rust-Version. Da bin ich mir nicht ganz sicher. Das sind alles, na ja, da könnt ihr euch richtig austoben.

Die sind alle da. Aber ich glaube, das Interessanteste ist das, was wir aus dem Code gelernt haben – ähm, wo ist denn jetzt mein Fenster? Ich habe mein Fenster verloren. Ähm, das Interessanteste ist das, was wir daraus gelernt haben. Oh, ich habe das Fenster wirklich verloren. So, da ist es. Ähm, ich gehe das mal durch, um sicherzugehen, dass wir alles abgedeckt haben. Claude-Code, bla bla bla. Okay, das können wir jetzt ignorieren. Ähm, ich finde es interessant, wie es bei, äh, OpenAI und anderen potenziellen Konkurrenten aussieht. Setzen sie sich hin, schauen sich den Code an und versuchen zu verstehen, was sie daraus lernen können, um ihre Produkte möglicherweise zu verbessern?

Auf jeden Fall, ganz sicher. Und, und, und der Claude-Code hat tatsächlich etwas Magisches an sich. Ähm, sie haben nicht nur mit dem eigentlichen Modell selbst – also Claude – einen großartigen Ausgangspunkt. Es ist wie beim Apple-Ökosystem: Die Software läuft hervorragend auf der Hardware, weil sie die Kontrolle über die gesamte Pipeline haben. Es gibt also einfach eine wirklich schöne Harmonie, eine Art Synchronizität zwischen den beiden, die sich vielleicht auf andere Tools übertragen lässt oder auch nicht – weißt du, es ist einfach so, wie es mit Claude läuft. Aber sie werden sich auf jeden Fall mit einigen dieser Dinge beschäftigen. Interessanterweise habe ich allerdings ein Video von Primagen gesehen.

Und eine der Erkenntnisse war, dass das System versucht zu verstehen, ob es sich um eine negative Stimmung handelt – zum Beispiel, ob man frustriert ist oder sauer auf Claude ist oder was auch immer. Und anstatt ihre KI zu nutzen, um tatsächlich abzufragen, ob es sich um eine negative Stimmung handelt, verwenden sie buchstäblich nur „Suchen und Ersetzen“ – wie bei ganz normalem, altmodischem JavaScript –, um zu prüfen, ob Wörter wie „Scheiße“, „sauer“, „Mist“, „Quatsch“ und so weiter vorkommen. Das kann man sehen. Ja. Genau. Und man würde also meinen, dass solche Dinge eigentlich wirklich sehr komplex wären oder dass sie die ausgefeiltesten Methoden nutzen würden, aber tatsächlich verwenden sie einfache Suchen-und-Ersetzen-Funktionen – das ist billiger, oder? Und konkret machen sie damit Folgendes: Sie kennzeichnen die Unterhaltung einfach.

Sie werden einfach… Soweit ich weiß, nutzen sie das für Auswertungen. Vielleicht können sie sich die Unterhaltung ja ansehen. Da bin ich mir nicht sicher. Ist es, äh, ist es so, dass sie das tun können, sich deine Unterhaltung ansehen, oder ist das verschlüsselt? Ich bin mir nicht sicher. Mhm. Aber ich weiß ganz sicher, dass sie das zumindest für Auswertungen nutzen. Um zu sehen, wie zufrieden oder unzufrieden du mit der, äh, Sitzung bist. Genau, ja. Und außerdem gab es da ein paar Dinge, die, ähm, ich werde dich mitnehmen, ich werde mich selbst auf die Bühne begeben. Ähm, es gab ein paar Lecks. Eines davon wurde tatsächlich schon innerhalb von etwa einem Tag veröffentlicht, nämlich diese „Buddy“-Funktion.

Das virtuelle Haustier Tamagotchi. Und das habe ich ausgebrütet – sobald ich es gesehen habe, dachte ich mir: „Was ist denn dieses ‚Buddy‘-Ding?“, und wenn man {Schrägstrich} buddy eingibt, schlüpft diese Kreatur. Und es gibt verschiedene Seltenheitsstufen. Es war so eine Art Mischung aus Tamagotchi und Pokémon. Aber wenn wir uns mal ein paar der anderen Sachen hier ansehen: Wir haben „Kyros“, einen autonomen „Demon“-Agenten, der immer aktiv ist, mit GitHub-Webhooks und 5-Minuten-Cron-Zyklen; „/dream“ hat „Auto Dream“. Das ist eigentlich irgendwie gruselig. Ja, Speicher. Also offensichtlich laufen da Dinge im Hintergrund, die einfach verstehen, was gerade los ist, und ständig dein GitHub beobachten und, ähm, bestimmte Dinge dieser Art. „Ultra-Plan“. Wir haben also „Ultra Think“, das dein Budget für das Denken im Speicher erweitert.

Man kann einfach {Schrägstrich} ultra eingeben – ich glaube, dann leuchtet alles in Regenbogenfarben und es kann einfach länger nachdenken. Das ist der Ultra-Plan. Die Planung wird an eine entfernte 30-minütige Opus-Sitzung ausgelagert, mit 3-Sekunden-Abfrage, Teleport-Sentinel und Rückgabe der Ergebnisse. Das wird also ziemlich interessant. Ich bin ein Fan. Weißt du, was eine 3-Sekunden-Abfrage bedeutet? „3-Sekunden-Abfrage“ bedeutet, dass man während der 30-sekündigen Laufzeit alle 3 Sekunden nachschaut, was gerade passiert. Ah. Jetzt bin ich mir nicht mehr sicher, was ich meine. Ja, denn anscheinend kann man diese Abfrageintervallzeit ändern. Also, interessant. Ich habe das im T3-Code verwendet. Ja, im T3-Code verwende ich den „Ultra-Plan“.

Ich glaube nicht, dass es 30 Minuten gedauert hat, aber es lief, glaube ich, 18 Minuten lang. Und läuft das remote? Läuft das auf deinem Rechner oder remote? Ich bin mir nicht sicher. Ich … ich habe nicht nachgesehen. Ich … ich habe es benutzt und mir nicht allzu viele Gedanken darüber gemacht. Cool. Ja, also das hier sendet offensichtlich an, ähm, du weißt schon, einen Remote-Server, der sein Ding macht. Ehrlich gesagt, wird man dafür wahrscheinlich extra bezahlen müssen. Und, äh, wo bin ich gerade? Äh, Tungsten Tool – das ist eine interne Sache, direkte Tastenanschläge und Bildschirmaufnahmen in einer virtuellen Umgebung. Ist das so etwas wie, na ja, ein Tool zur Datenerfassung? Ich bin mir nicht ganz sicher, aber es scheint nur für den internen Gebrauch gedacht zu sein.

Der Sprachmodus – den hatten wir doch schon. Vielleicht nutzt es jetzt Deep Ground Nova 3 als Modell statt etwas anderem, keine Ahnung. Ähm, und der Koordinator-Modus, ein Multi-Agenten-Schwarm mit Arbeitern und Scratchpads. Auch das ist etwas, von dem ich dachte, dass wir es bereits kennen oder sogar schon haben. Ähm, noch eine Menge anderer Sachen: Undercover-Modus, Anti-Destillation – interessant. Das haben sie also schon aufgegriffen. Sitzungsspeicher, automatischer Speicher, automatischer Traum und nativer Client. Also, ja, ein paar Dinge sind durchgesickert, insbesondere diese, äh, „Buddy“-Sache. Ich bin mir nicht ganz sicher – ehrlich gesagt verstehe ich das nicht wirklich. Es macht einfach ständig, na ja, im Hintergrund Lärm und jammert und sagt irgendetwas über meinen Code. Ich weiß nicht wirklich, was.

Ähm, ja. Schau dir einfach mal meine Notizen hier an. Das war’s eigentlich auch schon. Ich meine, hast du noch was anderes gehört, was in Bezug auf die Indiskretion so los ist? Ja, ich hab coole Sachen. Ich … Also, ehrlich gesagt, ich … ich bin einfach nicht … ich bin nicht … Kennst du die „Spinner-Verben“? Also, wenn man Claude losschickt, um etwas zu tun, steht da „denken“, und es werden auch andere Wörter anstelle von „denken“ verwendet, diese Verben. Und es gibt auch eine Liste davon. Es sind 187, und das ist einfach eine nette Sache, weißt du – das hat übrigens Vis gefunden. Und ja, es macht einfach Spaß, sich das anzuschauen. Die meisten dieser Wörter kannte ich nicht, äh, aber ich werde sie nachschlagen.

Es macht einfach irgendwie Spaß. Abreiben. Ja, skizzieren und tüfteln und, ich weiß nicht, auftragen und glasieren und, ich weiß nicht, es ist einfach Formen und Gestalten, ähm, Grooves finden und sich Dinge ausdenken. Ja, es ist einfach ein Haufen von B-Booping. Es ist irgendwie … Es ist irgendwie süß, also, äh, ich glaube, sie haben auch gefragt, wer sich das ausgedacht hat, und sie haben erwähnt, äh, ich habe den Namen vergessen, aber einer der Mitarbeiter, und dann haben sich die restlichen Mitarbeiter von Anthropic, äh, zusammengetan und einfach noch mehr, äh, Verben hinzugefügt, also ja, es ist ziemlich lustig. Das ist cool. Das ist cool. Ähm, also ja, es wäre interessant zu wissen, was dabei tatsächlich herauskommt. Ich glaube, es ist eher aus Neugierde als aus irgendetwas anderem – was macht eigentlich das Gehirn von etwas aus, das wir alle für ein mythisches Wesen halten?

Ähm, aber ja. Genau. Also, noch ein paar weitere Code-Leaks. Ja, und ein paar andere Anmerkungen, die ich von anderen Leuten gesehen habe, die darüber berichtet haben, lauteten in etwa: Ähm, es gibt jede Menge Kommentare, mehr als sonst, und die Kommentare klingen so, als wären sie nicht für Menschen geschrieben worden. Sie wurden für den nächsten Agenten geschrieben, der sich den Code ansieht, damit er versteht, worum es geht. Das ergibt also irgendwie Sinn, und wir befinden uns nun einmal in einer neuen Ära. Äh, und außerdem, äh, habe ich Kommentare gesehen, dass es tatsächlich so aussieht, als wäre der Code komplett nur durch Prompts erstellt worden – was bedeutet, dass es sich nicht gerade um Code von höchster Qualität handelt. Mhm. Ja. Aber ich bin nicht qualifiziert, das zu beurteilen.

Ich meine, weißt du, es ist eben so, wie es jetzt ist, und es ist wirklich… Es ist schon ziemlich verrückt, wie… ähm… wie wir einfach denken: „Gut ist gut genug.“ Verstehst du? Ja. Gut genug ist gut genug. Es funktioniert. Ich… ich zahle 200 Dollar, weil es eben das Beste ist. Mhm. Es ist das Beste, und ich bin zufrieden damit. Mir sind ein paar kleine Fehler aufgefallen, aber sie haben alle so ihre kleinen Macken. Weißt du, äh, Codex hakt die Aufgaben auf der Liste nicht ab, während es sie erledigt. Es dreht sich einfach ewig um die erste Aufgabe und dann – zack – sind plötzlich alle erledigt. Ähm, es dauert ewig, bis alle erledigt sind, aber es hakt sie erst ab, wenn es fertig ist.

Ähm, was den Claude-Code angeht: Ich habe gesehen, dass die Zahlen oder Buchstaben aus meiner Statusleiste in den Text eindringen, wenn ich nach oben und unten scrolle, was ziemlich nervig ist. Aber, noch mal, es ist einfach so, dass es … Es sollte das eigentlich nicht zulassen. Ich sage nicht, dass wir das akzeptieren sollten, aber ich sage auch, dass, ähm, weißt du, es … es funktioniert. Es tut das, was wir von ihm erwarten, also ja. Wer weiß? Ähm, ja, ich weiß nicht. Das ist der Cloud-Code-Leak. Ich glaube nicht, dass es dazu noch viel, ähm, viel mehr zu sagen gibt, um ehrlich zu sein. Ja. Ja, cool. Das war’s. Ähm, okay, lass uns… Willst du… Bist du bereit, über „Pretext“ zu sprechen?

Ja, klar. Ähm, äh, mal sehen … Ich bin mir nicht sicher, welchen meiner Bildschirme ich zuerst zeigen soll. Ähm, deshalb überlege ich gerade, was … Okay, ich zeige einfach das Wichtigste. Ähm, also gut, wir haben eine Revolution. Ja, eine Revolution im Frontend. Na ja, vielleicht. Äh, es ist eine sehr vielversprechende Bibliothek. Meine lieben Frontend-Entwickler und alle, die sich für die Zukunft von Benutzeroberflächen interessieren: Das hier stammt von Cheng Lou, äh, einem der Kernmitglieder von React und Ingenieur bei Midjourney. Ich habe mich durch die Tiefen der Hölle gekämpft, um euch für die absehbaren Jahre eines der wichtigeren Grundbausteine der UI-Entwicklung zu präsentieren – wenn schon nicht in der Umsetzung, dann zumindest im Konzept.

Ein schneller, präziser und umfassender Algorithmus zur Textmessung im User-Land in reinem TypeScript. Er kann zum Layouten ganzer Webseiten ohne CSS verwendet werden, wobei DOM-Messungen und der Reflow umgangen werden. Wenn man also Textblöcke auf einer Webseite hat, muss das DOM die Länge des Textes, die Breite, die Höhe, die Zeilenumbrüche und alle Maße dafür ermitteln, wo diese Pixel platziert werden sollen. Was er also getan hat, ist, das DOM zu umgehen und uns sozusagen ein Textlayout zu bieten, das man mit dieser Bibliothek mit 120 Bildern pro Sekunde nutzen kann. Bevor wir auf die Anwendungsfälle eingehen, schauen wir uns doch mal an, was andere damit bereits entwickelt haben. Das hier ist eines davon, und wir können es sogar ausprobieren.

Ich habe es mir selbst geschickt. Das war ziemlich cool. Ja. Um das klarzustellen: Nichts davon ist etwas, was wir vorher nicht schon konnten. Der Unterschied ist, dass wir es jetzt präzise und leistungsstark umsetzen können, ohne auf DOM-Berechnungen zurückgreifen zu müssen. Das DOM muss also derzeit nicht mehr berechnen, wo der Text hingehört – das wird alles über diese Bibliothek erledigt. Sie ist extrem schnell, präzise und leistungsstark. Hier sehen wir also ein Masonry-Layout mit Hunderten, wenn nicht Tausenden – wahrscheinlich sogar Tausenden – von Textfeldern. Und das wiederum bei 120 FPS. Warum ist das wichtig? Das ist wichtig, weil man bei einem solchen Layout fragen muss: Wie legt man fest, wie groß der Scrollbereich ist? Wie legt man fest, wo beim Scrollen der Computer bzw. der Browser mit dem Rendern des nächsten Bereichs beginnt? Rendert man alles und zeigt es an?

Das würde bedeuten, dass man eine Menge Rendering betreiben muss, aber wenn man das nicht tut, wie soll man dann die Höhe erraten? Das geht nicht. Man kann es also nicht, es sei denn, man führt das Rendering durch, was wirklich sehr leistungsintensiv ist – auch wenn es sich nur um Text handelt, ist es dennoch leistungsintensiv. Ähm, aber jetzt macht er das mit so etwas wie diesem Tool, was wirklich beeindruckend ist. Das ist beeindruckend, vor allem, wenn man sich das mit den Benutzeroberflächen vorstellt, die wir haben. Ich weiß nicht, ob es dir schon aufgefallen ist, aber selbst bei ChatGPT wird es extrem ruckelig, wenn man eine lange Unterhaltung führt. Es ruckelt so sehr, dass man kaum noch scrollen kann. Das liegt zum Teil daran, dass der Browser versucht, die Höhe dieses Textes zu ermitteln, und besonders wenn man die Größe der Elemente ändert, muss der Browser alles neu berechnen.

Aber dadurch wird diese DOM-Berechnung komplett umgangen. Hier gibt es dieses wirklich interessante, äh, Beispiel, und an dieser Stelle hat mein Gehirn für einen Moment den Faden verloren. Äh, ich, ich, ich habe das gemacht und dachte mir: „Warum kann man das mit CSS-Text nicht hübsch gestalten?“ Klar. Noch mal: Ich bin hier nicht der Entwickler. Also, äh, ich habe mir genau das angesehen, ich zeige es euch mal. Schaut euch das an. Oh, Moment, es kommt damit klar, weißt du? Ähm, dieser Text. Das wird mit `pre-text` gemacht. Das wird mit CSS gemacht. Und ich dachte mir: „Warum kann man das nicht mit CSS-Text hübsch hinbekommen?“ Weißt du, man kann das doch. Ähm, aber ich hatte das völlig vergessen oder habe es vor dem Testen einfach nicht verstanden.

Ich habe angefangen, es zu testen. Man kann die Zeilen umbrechen und den Text mit „text-wrap: pretty“ so aussehen lassen. Aber man kennt die Größe des Feldes nicht. Man kann die Feldgröße nämlich nicht an den darin enthaltenen Text anpassen. Ähm, CSS berücksichtigt das nicht. Man hat also eine Menge verschwendeter Pixel. Man hat dieses Layout mit diesen verschwendeten Pixeln. Nun, bei „pre-text“ wird alles berechnet. Und übrigens hat er das erreicht, indem er, äh, unzählige, äh, Berechnungen mit Agenten durchgeführt hat, die über mehrere Wochen hinweg auf verschiedenen Browsern liefen. Das ist also auch, äh, ziemlich beeindruckend. Und hier ist ein weiterer Anwendungsfall. Übrigens denken viele Leute, wenn sie das bisher gesehen haben, wahrscheinlich: „Warum machst du den Text unlesbar?“

Darum geht es aber nicht. Es geht nicht darum, es unlesbar zu machen. Es geht darum, beliebige Layouts mit hoher Leistung zu erstellen, ohne all diese Berechnungen und Messungen durchführen zu müssen. All das ist nur eine Demonstration dessen, was möglich ist. Äh, wir haben noch ein weiteres cooles Beispiel, äh, bevor ich das hier vorlese. Also, hier haben wir ein 3D-Modell, das sich bewegt und alle Neuberechnungen automatisch durchführt. Auch hier handelt es sich nicht um praktische Anwendungen. Das dient eher dazu, die Leistung zu demonstrieren. Äh, vielleicht sollte ich das vorlesen, und vielleicht kannst du es in das Video einbauen. Vielleicht lässt du es auch weg. Ich bin mir nicht sicher. Vielleicht mache ich es, vielleicht auch nicht.

Mal sehen. Ja. Ich habe diesen Tweet gefunden, in dem das auch ziemlich gut erklärt wird. Also, gehen wir das mal durch. Lass mich erklären, warum das so wichtig ist. Ein Ingenieur hat ein Problem gelöst, das schon seit, äh, dem Internet heimsucht – Play Wie spricht man das aus? „Heimsucht“. „Heimsucht“. Ich weiß eigentlich gar nicht, was das bedeutet. Äh, „infiltriert“ oder oder ja. Okay, das ergibt Sinn. Ja. So etwas wie eine Krankheit. So in etwa. Ja. Ja. Jetzt weiß ich es. Ich habe es irgendwie verstanden. Okay, jetzt weiß ich es. Jetzt weiß ich es ganz sicher. Ein Ingenieur hat ein Problem gelöst, das das Internet seit drei Jahrzehnten plagt. Jede Website, die du jemals genutzt hast, basiert auf einem Textlayout-System aus den 1990er-Jahren. Der Browser lädt eine Schriftart, misst den Text, ermittelt, wo Zeilenumbrüche stattfinden, und positioniert alles vertikal.

Jeder Schritt hängt vom vorherigen ab. Jeder Schritt zwingt den Browser dazu, anzuhalten und neu zu berechnen. Du hast dieses Problem schon oft gespürt, auch wenn du nicht wusstest, woran es lag. Das Springen beim Scrollen in Slack, wenn die Höhe der Nachrichten falsch ist. Google Docs wird bei langen Dokumenten langsam, weil bei jedem Tastendruck alles unterhalb des Cursors neu berechnet wird. KI-Chat-Apps ruckeln beim Streaming, weil jedes neue Token einen Zeilenumbruch verursachen kann, der die gesamte Seite verschiebt. Jedes verdammte Mal dieselbe Ursache. Die Textmessung ist im DOM des Browsers eingeschlossen. Das ist langsam, und seit 30 verdammten Jahren gibt es keine Alternative. Pretext umgeht all das. Reine TypeScript-Textmessung, kein DOM, kein CSS, kein Browser-Reflow. Du gibst ihm Text, eine Schriftart und eine Breite.

Es liefert exakte Zeilenumbrüche mit Zeilenbreiten und -höhen unter Verwendung reiner Mathematik. In vielen Fällen etwa 500-mal schneller als der Standardansatz. Unterstützt jede Sprache, das ist sehr interessant, einschließlich gemischter bidirektionaler Texte. Das mache ich übrigens ständig. Ich mache das ständig in meinen Textnachrichten. Ähm, und es funktioniert nicht. Das funktioniert in jeder einzelnen App überhaupt nicht. Äh, CJK – ich weiß nicht, was das bedeutet. Nein, wirklich nicht. Ich weiß nicht, was das ist. Ja, lass es uns googeln. CJK steht für Chinesisch, Japanisch und Koreanisch. Okay. Japanisch, Koreanisch, Arabisch und Emojis. Die Engine ist 15 Kilobyte groß und wurde entwickelt und validiert, indem Cloud-Code und Codex wochenlang anhand von Browser-Ground-Truth-Daten getestet wurden. Die Demos sind einfach der Wahnsinn.

Hunderttausende Textfelder, virtualisiert mit 120, äh, Bildern pro Sekunde, ohne DOM-Messung. Passgenau angepasste Chat-Blasen, äh, passgenau angepasste Chat-Blasen ohne ein einziges verschwendetes Pixel – etwas, was CSS buchstäblich nicht leisten kann. Responsives, mehrspaltiges Magazin-Layout, das ASCII-Kunst mit variablen Schriftarten dynamisch anpasst. Das ist nur ein Nebenprodukt davon. Man kann ASCII-Kunst mit variablen Schriftarten erstellen. Im Laufe der Jahre haben Entwickler das Rendern auf Canvas verlagert, das Scrollen auf benutzerdefinierte Implementierungen und die Positionierung auf JavaScript, aber Text war das Einzige, was man nicht aus dem Browser herausholen konnte. Es war das letzte Element, das im DOM eingeschlossen war und für das es keine Alternative gab. Jetzt haben wir eine Lösung. Diese wurde von Changlu entwickelt, einem der wegweisenden Entwickler hinter React, Facebook Messenger und Midjourney.

Er ist nicht irgendwer, lol. Äh, wenn man irgendetwas im Web entwickelt, verändert das jetzt buchstäblich, was möglich ist. Das eröffnet neue UI-Muster, Layout-Schnittstellen und Erlebnisse, wie wir sie noch nie zuvor gesehen haben. Schaut euch mal die Demos im Zitat-Beitrag an. Es ist Open Source, npm install, ähm, der Wahnsinn. Das läuft alles im Browser. Die Zukunft des Designs liegt noch vor uns. Also, ja, das ist sehr optimistisch. Das deutet darauf hin, dass es riesig werden wird. Und die Beispiele, die die Leute erstellen, sind beeindruckend. Ich habe noch eine Sache zu zeigen. Und ich möchte, dass ihr kritisch seid. Ähm, ich weiß nicht, ob ihr es kennt – lasst mich mal suchen. Äh, wie habe ich es genannt? Mm.

Es ist eine interessante Zeit, und ich – äh – wir werden mit einer nicht ganz so „leichten“ Note abschließen, sondern mit etwas, das etwas abseits des Üblichen liegt, aber es ist interessant, wenn es darauf ankommt, und das wird mehr Sinn ergeben, wenn ich gleich darüber spreche. Mhm. Ich habe ein Webflow-Projekt gemacht. Ich muss es erst mal finden. Mm. Ist es in meinem Playground? Webflow ist gerade langsam. Zeig mir bloß nicht den Ladekreis. Ich habe es gefunden. Also gut, hier ist etwas, das vielleicht nützlich sein könnte – und wenn du meinst, werde ich mir die Zeit nehmen, das mit Pre-Text umzusetzen. Ich habe das letztes Jahr mit GSAP und Wipe-Coding gemacht, und wie du siehst, haben wir diesen Container, wenn ich die Seite lade.

Wie ihr seht, haben wir um diesen Container herum etwas Platz mit viel Text, und wenn ich den Cursor bewege, läuft da eine coole, interessante Animation ab. Und wenn ich auf „Start“ klicke, sehen wir hier diese Canvas-Fenster mit Text darin. Es war ziemlich schwierig für mich, das hinzubekommen, weil es schwer war, … Übrigens, all das – all diese Fenster, in denen ich diesen Text habe – das sind Canvas-Elemente. Ich rendere also Text im Canvas. Der Grund dafür ist zum einen die Performance und zum anderen wollte ich noch mehr Funktionen einbauen – aber hauptsächlich wegen der Performance, denn wenn man so viele Knoten erstellt, kann man die Seite nicht mehr laden und nichts mehr tun.

Das kann sehr schnell zu großen Problemen führen, denn jedes dieser Elemente wäre eigentlich ein separater – ja, sogar mehrere separate – div-Block, richtig? Es wären Tausende und Abertausende von div-Blöcken auf der Seite. Aus diesem Grund habe ich all das im Canvas erstellt. Aber es gibt Artefakte. Seht ihr zum Beispiel oben an diesen Elementen diese … Es wird nicht korrekt angezeigt, wenn ich zoome. Seht ihr, das ist eine andere Art von Artefakten. Die Ausrichtung ist nicht perfekt. Es ist schwierig, die Höhe des Textes zu messen und ihn dann im Canvas neu zu fließen zu lassen, insbesondere die Breite, wenn man das dynamisch je nach Größe des Browserfensters des Nutzers, der Schriftgröße und ähnlichen Faktoren anpassen muss.

Es war ziemlich schwierig, das hinzubekommen, und es ist immer noch nicht richtig. Ich glaube also, diese Bibliothek kann mir helfen. Meinst du, ich verstehe das richtig? Glaubst du, das kann mir helfen? Anstatt es im Canvas zu machen, kann ich es einfach mit Pretext machen? Nun, der Vorteil von Pretext ist – magst du das? – „Sorry, das magst du nicht.“ Das ist alles grafisch. Es ist alles … Es hat keine Bedeutung. Das willst du nicht. Du willst eigentlich nicht, dass der Text im Hintergrund, na ja, auf dem Bildschirm lesbar ist. Es könnte also von Vorteil sein, ihn im Canvas zu belassen. Ich denke jedoch, der Vorteil von „pretext“ besteht darin, dass du indexierbaren Schrifttext beibehältst, der auf dem Bildschirm lesbar, barrierefrei und bearbeitbar ist.

Ähm, also, weißt du, noch mal: Es ist Text, der ausgewählt werden muss. Es ist Text, der von Screenreadern gelesen und verstanden werden muss. Aus Sicht der Umsetzung mag es einfacher sein, diese Bibliothek zu verwenden, und sie übernimmt ja einige dieser, na ja, Positionierungsaufgaben und so weiter, aber man sollte das Ganze auf jeden Fall in eine Art, ähm, versteckten Bereich einbetten oder auf eine andere Weise, die einem Screenreader nicht gefallen würde – ich meine, werde ich das finden, wenn ich auf, nun ja, ich mit einem Screenreader auf diese Website gehe, wird mir dann der gesamte Text vorgelesen oder bleibt er verborgen?

Nein, nein. Nein, ich… Ja, aber die Idee dahinter war übrigens etwas sehr Nerdiges. Deshalb hat es einen Zweck. Es gibt einen Grund, warum es diesen Effekt hat. Das ist so, als würde man etwas mitteilen. Ja, das ist völlig in Ordnung. Aber ja, ich stimme zu. Es muss nicht lesbar sein. Es muss nicht lesbar sein. Es sollte es nicht sein. Ja, es sollte nicht lesbar sein, um … Ja, um genau zu sein, es sollte nicht lesbar sein. Da stimme ich zu. Äh, aber als ich den Vortext gesehen habe, war das das Erste, woran ich gedacht habe. Aber auch wenn ich jetzt irgendwie verstehe, dass es kein Vortext sein muss, bedeutet es doch, dass bei einem Vortext jedes dieser Elemente ein Knoten in meinem Dokument wäre.

Es wird dadurch zwar immer noch ziemlich schwerfällig, wobei die Umsetzung im Canvas-Element, ähm, ihre eigenen Vorteile hat. Nun möchte ich, äh, noch eine letzte Sache dazu zeigen. Ich habe auch diesen Tweet gefunden. Das hat nicht unbedingt etwas mit Pretext zu tun. Ich habe ein bisschen mit der experimentellen HTML-in-Canvas-API von Chrome herumgespielt. Interessant. Ich nutze es, um meine Videos zu erstellen, und wollte sehen, ob ich die Textauswahl auf einer gekrümmten Oberfläche zum Laufen bringen kann, indem ich das zugrunde liegende Element bei einer Mausbewegung verschiebe. Es funktioniert ziemlich gut. Ähm, noch einmal: Das ist nicht unbedingt Pretext. Es ähnelt aber ein wenig dem, was ich habe. Es ist Text in einem Canvas. Ähm, Text in einem Canvas hat oft seine eigenen Probleme mit Schriftarten, Darstellung, Abständen und Schärfe.

Ähm, und definitiv nicht auswählbar – oder war es zumindest bisher nicht –, aber jetzt ist es das, weil es, glaube ich, einen Tween hat. Äh, noch mal: Es ist nicht dasselbe, aber ich zeige das im gleichen Zusammenhang, weil es – je nachdem, was man mit Pretext machen will – vielleicht interessanter sein könnte. Es könnte etwas sein, das man … Äh, und es ist offen, also ist es wahrscheinlich etwas, das man braucht. Also, ähm, jedenfalls werde ich mich wahrscheinlich ein bisschen damit beschäftigen. Ja, mach das. Mit beiden. Ja, ähm, macht ziemlich viel Spaß. Ziemlich viel Spaß. Die Leute machen coole Sachen im Internet, und ich bin voll dabei. Ja, ja, ja, auf jeden Fall. Na ja, ja.

Also, wir werden das hier mal abschließen. Ähm, ich werde kurz auf etwas eingehen, das ich buchstäblich heute Morgen gesehen habe und das mich zum Nachdenken gebracht hat. Ich weiß, dass Musik in eurem Leben keine große Rolle spielt. Für mich ist sie ein riesiger Teil meines Lebens, aber es gibt da eine Gemeinsamkeit und einen Bezug zur KI in der heutigen Zeit, den ich für absolut relevant halte. Also, lass mich dir einfach ein Video zeigen, das ich mir angesehen habe – wenn ich meinen Bildschirm teilen kann. Hast du schon mal von einer Band namens, ähm, „Agent de Portein“ gehört? Ich weiß nicht. Nein. Oder gesehen? Ich spiele mal die Musik ab. Das hast du mit ziemlicher Sicherheit schon gesehen. Es sind diese beiden Typen, die mit schwarzen und weißen Punkten bemalt sind.

Und die Musik ist sehr, sehr abgefahren. Der Typ erklärt dann weiter – wenn man ein Musikfreak ist –, warum sie so faszinierend sind: Zunächst einmal verwenden sie seltsame Taktarten. Und wenn man im Publikum sitzt und, ähm, sich mit Musik auskennt, weiß man, was Taktarten sind. Man sieht, dass es manchmal 6/8 ist, manchmal 9/8. Und sie verwenden auch andere Töne als die, die wir aus der westlichen Musik gewohnt sind. Sie nutzen Töne dazwischen – man sieht hier diese Gitarre, die viel mehr Bünde hat als eine normale Gitarre. Ich könnte dir eine normale Gitarre zeigen, aber hier ist fast so etwas wie ein Metallstab. Ja.

das, was man „Bund“ nennt, zwischen jedem dieser Elemente, wodurch sie Zugang zu einigen dieser Töne erhalten. Und schließlich sprechen sie noch über das Looping. Er nimmt also einen Gitarrenpart auf, lässt ihn in einer Schleife laufen und spielt dann einen weiteren Gitarrenpart darüber – das Ganze ist sehr komplex und aus musikalischer Sicht faszinierend anzusehen. Doch dann geht er auf die künstlerische Seite der Dinge ein und erklärt, warum das gerade jetzt, im Zeitalter der KI, so spannend ist. Vielleicht können wir uns anhören, was er dazu sagt. Ich hoffe, ich habe das zeitlich richtig abgestimmt, damit wir es einfach abspielen können. Aber auch ihr Erscheinungsbild ist wichtig. Es wird oft als dadaistisch beschrieben. Und falls ihr es nicht wisst: Der Dadaismus war eine Kunstbewegung vor etwa 100 Jahren, die letztendlich zum Surrealismus führte, und bei der es um Inkongruenz ging, um Dinge, die nicht zusammenpassten, um Dinge, die die Regeln dessen brachen, was der Betrachter erwartete.

Das war sogar der Beginn der gesamten Debatte darüber, was Kunst eigentlich ist. Und es ist interessant, dass der Dadaismus damals eine direkte Reaktion auf die Maschinerie des Krieges und des modernen Lebens war – und genau das passiert wahrscheinlich auch heute. Wenn man noch weiter zurückblickt, sieht man, welchen Einfluss die Fotografie auf die Kunst hatte und wie sich die Kunst radikal veränderte, sobald jeder mit diesem einfachen kleinen Gerät Bilder erstellen konnte. Maler hörten auf, das, was vor ihnen lag, so perfekt wie möglich darzustellen – also figurative Kunst –, denn was bringt das schon? Und sie wurden mit dem Impressionismus kreativer, was schließlich zum Dadaismus, Expressionismus und Kubismus führte, denn was bringt es schon, das, was vor einem liegt, perfekt zu malen, wenn man einfach ein Foto machen kann?

Und das hat Künstler befreit, es hat sie sogar dazu angespornt, mit ihrem Pinsel etwas Interessanteres zu schaffen. Denn derzeit kann in Google Gemini – seit diesem Monat – jeder mit nur einer Textanweisung vollständig produzierte Musiktitel erstellen. Moderne Musik ist unglaublich formelhaft, und die KI wird anhand dieser Formeln trainiert. Also, ich höre hier mal auf. Kam das gut rüber? Ja, das hat es. Das hat es. Und es ergibt Sinn. Es treibt uns also im Grunde genommen weg vom Alltäglichen, vom Vorlagenhaften und vom Einfachen – und von dem, was in der Fotografie gerade angesagt ist, also dem, was, na ja, real ist –, hin zur Abstraktion und auf eine höhere Ebene, hin zum Ausdruck, um etwas auszudrücken. Na ja, ja. Ja. Ich … und das gefällt mir.

Warum ich das so sehe, und warum ich das für wichtig halte – darüber habe ich schon nachgedacht, noch bevor er das Thema KI ins Spiel gebracht hat. Ich habe darüber nachgedacht, als er über Kunst und solche Dinge sprach. Und es ist so interessant, weil ich – wir – schon einmal darüber gesprochen haben, wobei ich, ähm, das genaue Wort oder den genauen Ausdruck vergessen habe, den ich damals verwendet habe, aber es ist so, als würden wir unser Weltbild neu definieren. Wir definieren unsere Weltanschauung neu. Wenn man sich einige der frühesten Folgen dieser Sendung noch einmal ansieht, spreche ich darüber, dass wir keine Ahnung haben, welche Auswirkungen das, was KI leisten kann, haben wird, weil wir unsere Weltanschauung neu definieren werden.

Wir haben insbesondere darüber gesprochen, als es um den Verlust von Arbeitsplätzen ging. Und um diese Vorstellung, dass wir alle überflüssig werden. Und es ist so: Ja, schon, aber unsere Weltanschauung wird sich neu gestalten, und wir werden die Dinge auf der Grundlage der neuen Normalität ganz, ganz anders betrachten. Auch was die Fotografie angeht, ist das hier nur ein kleiner Hinweis. Ich werde das einfach erst einmal beiseite legen. Wir reden darüber, dass, na ja, alles in Zyklen abläuft. Und wir reden darüber, als ob KI das erste Mal wäre, dass wir mit etwas konfrontiert werden, das Arbeitsplätze – genauer gesagt bestimmte Arbeitsplätze – komplett ersetzt, aber im Kontext des Lebens und der Welt und so weiter.

Wir glauben, es sei diese neue Sache, die irgendwas bewirken wird. Nein, das gab es schon unzählige Male zuvor, und die Beispiele, die wir hier in dieser Sendung genannt haben, beziehen sich auf die Landwirtschaft: Früher wurde die Landwirtschaft ausschließlich von Hand betrieben, dann kamen Maschinen auf den Plan, und man konnte ein Feld, auf dem 40 bis 100 Bauern Samen, Obst und Gemüse aus dem Boden pflückten, ersetzen. All ihre Arbeitsplätze wurden zunichte gemacht, als der Traktor aufkam. Okay, wir reden also einfach über diesen zyklischen, ähm, Prozess, bei dem uns immer wieder ein neues Paradigma präsentiert wird, an das wir uns unweigerlich anpassen und für uns selbst eine neue Weltanschauung entwickeln. Das klingt jetzt aber etwas zu ernst. Kommen wir zurück zu Kreativität und Spaß.

Es ist schon wieder so interessant, dass der Aufstand, der sich gegen – na ja, was soll’s – ereignete. Wir können jetzt ein Foto machen. Sie haben erkannt, dass die Technologie sie ersetzt hat. Das ist ein interessanter Anwendungsfall, bei dem Designer oder Künstler dachten: „Anstatt sie zu uns zu lassen, wie können wir gegen sie rebellieren und dadurch interessanter und relevanter werden?“ Und genau das erhoffe ich mir von der KI. Ich hoffe, dass die KI uns antreibt – ich meine, wir befinden uns gerade in einer schwierigen Generation. Und ich habe mir gestern Abend, als ich nicht schlafen konnte, ein erstaunliches Video über Mr. Beast angesehen und darüber, wie schrecklich das Ganze für Kinder ist. Diese ganze, na ja, diese, diese, ähm, Aufmerksamkeit heischende Schnitttechnik, an der wir uns alle irgendwie schuldig machen, aber wir verlieren unsere Aufmerksamkeitsspanne.

Die meisten von euch haben wahrscheinlich den Faden verloren, worüber ich hier eigentlich sprechen wollte, in diesem Albtraum der kurzen Aufmerksamkeitsspanne, in dem wir uns befinden. Aber, ähm, wir müssen – wir müssen diese Art von Verständnis in Einklang bringen, anstatt als Schöpfer, als Entwickler die Arme zu verschränken und zu sagen: „Oh nein, KI ist dies, KI ist das, wir können nicht, was auch immer.“ Seid mutig genug, etwas dagegen zu unternehmen, und nutzt KI zu eurem Vorteil, macht euch ihre Stärken zunutze – oder geht komplett neue Wege und macht etwas ganz, ganz anderes. Deshalb hat mich dein Text wirklich beeindruckt, weißt du, weil er irgendwie beide Seiten beleuchtet, denn wir verlieren den Sinn einer Website – nicht zu 100 % komplett, aber definitiv wurde er, weißt du, sagen wir mal, verkürzt, um einen textbezogenen Begriff zu verwenden, wenn wir über Text sprechen.

Der Bedarf an schönen Websites. Sie müssen nicht mehr so schön sein – ich meine vor allem, dass sie es, seien wir ehrlich, nie waren, wie zum Beispiel Rezept-Websites und Ähnliches. Das waren sie nie, aber da immer mehr Menschen die benötigten Informationen über KI beziehen, besuchen sie die Website gar nicht erst, sodass viel, viel weniger Websites gestaltet werden müssen. Dennoch müssen sie es weiterhin. Ich werde niemals behaupten, dass eine Website nie gestaltet werden muss. Abgesehen davon ist es interessant, wie diese textbasierte Entwicklung vielleicht als eine Art Revolte gegen die KI entstanden ist. Um das alles wieder mit deinem Text über „Pretext“ zu verknüpfen: Vielleicht war diese Person so entschlossen, weil sie dachte: „Scheiß drauf, wir müssen Websites viel interessanter gestalten, denn sie werden sonst alle gleich und rein funktional.“

Also, ja, ein etwas umständlicher Weg, all das miteinander zu verknüpfen. Ich fand dieses Video besonders interessant. Wir werden natürlich den Beitrag von Will Francis unten einfügen. Aber dieses ganze Konzept von Kunst, Kultur und dem Internet ist im Moment irgendwie offen, und ich hoffe, wir können die Chance erkennen, die sich hier möglicherweise bietet, und dass Künstler einfach wieder Künstler sein können. Ja, aber mir gefällt – nein, mir gefällt diese Sichtweise sehr gut. KI ist nur ein Werkzeug. Und mir gefällt die Idee, sie zu nutzen, um auf der Leiter der Abstraktion höher zu steigen – was auch immer das für dich bedeutet, wie auch immer es dir ermöglicht, dich auszudrücken.

Äh, es kann rein zum Lernen dienen. Man kann einfach weitermachen wie bisher und KI zum Lernen nutzen. Lass sie deine ersten Experimente durchführen. Lass sie deine ersten, ähm, Ressourcen sammeln. Vertraue ihr nicht. Betrachte ihre Ergebnisse nicht als endgültig. Sie kann einfach ein Werkzeug sein, ein Assistent, genau wie das Internet. Ähm, KI funktioniert auf die gleiche Weise. Und ich stimme dir zu. Es ist ein weiterer Paradigmenwechsel, wie das Beispiel, das du mit der Landwirtschaft erwähnt hast. Ähm, die KI-Unternehmen neigen dazu, die Sache viel größer darzustellen, als sie ist. Sie ist größer als die vorherigen Paradigmenwechsel, aber wahrscheinlich nicht so groß, wie die KI-Unternehmen sie darstellen.

Äh, übrigens: Ich bin, äh, als Sohn eines Landwirts aufgewachsen. Ich wurde in einem Dorf geboren, wir hatten einen Bauernhof, und ich bin damit aufgewachsen, meiner Familie auf dem Hof zu helfen – also wirklich mit anzupacken. Und mein Vater war jemand, der immer darauf aus war, Dinge auf neue Art und Weise anzugehen. Also hat er sich immer die neuesten Maschinen besorgt, die es eigentlich noch fast nirgendwo gab, oder wir haben versucht, gemeinsam etwas zu bauen. Ich habe das gemacht, also habe ich versucht, … Weißt du, es gibt nichts Verherrlichendes am Leiden. Am Leiden, Dinge auf manuelle Weise zu erledigen. Stell dir mal vor: Wenn man Werkzeuge bauen kann, was sind wir dann?

Wir sind, wir sind, wir sind doch Tiere, die ihr Gehirn nutzen können, um Werkzeuge zu bauen, oder? Ähm, wir haben doch ein verdammtes Raumschiff auf dem Weg zum Mond, oder? Wir bauen Werkzeuge, also, ähm, ich freue mich wirklich sehr auf die KI in der Zukunft, allein schon, um Werkzeuge zu bauen. Und dieser Vorwand ist ein perfektes Beispiel, denn er hat KI genutzt, um die schmutzige, ähm, Arbeit zu erledigen. Nämlich die aufwendigen Berechnungen zum Vergleich der Ergebnisse verschiedener Browser – was von Hand Monate, wenn nicht sogar Jahre dauern würde, um zu verstehen, wie verschiedene Browser dabei vorgehen. Und er hat die Optimierung vorgenommen. Es ist eine Optimierung, die er erreicht hat, indem er die KI diese lästige Arbeit erledigen ließ.

Und was er getan hat, war, dass er die Leiter verschoben hat. Er ist auf der Leiter der Abstraktion nach oben geklettert. Und, ähm, ja. Er ist der Kreative, oder? Mhm. Mhm. Und das war’s auch schon. Es ist so, ich habe das Gefühl, ich meine, natürlich können wir nur auf Kommentare reagieren, die wir zu unseren Videos bekommen, anstatt tatsächlich selbst zu sprechen. Und natürlich gibt es diese lautstarke Minderheit, oder? Aber der Eindruck, den wir, meine Damen und Herren, aus dem, äh, Chat gewinnen – ähm, der Eindruck, den wir gewinnen, ist, dass es viel Aufruhr und nicht viel Unterstützung für KI im Designbereich gibt, von Designern, die sich das anschauen und sagen: „Weißt du was? Ich werde es dazu bringen, mir einfach ein verdammtes Layout zu erstellen, denn ich will das auf keinen Fall noch einmal selbst machen.“

Ich werde jetzt eine Stunde auf Pinterest verbringen, um diese verrückten Designs und Inspirationen zu finden, während diese KI die ganze Drecksarbeit für mich erledigt. Weißt du was? Warum gibt es so viel dieser Art von verschränkten Armen und Ablehnung, wenn es doch eine so kleine Rolle spielen kann, wie du willst? Es könnte deinem Kunden eine E-Mail schreiben, in der steht, dass du eine Verlängerung für dein Projekt möchtest. Es kann sehr, sehr klein sein, oder du kannst die Kontrolle übernehmen. Die Welt steht dir offen, weißt du – pack sie bei den Eiern und sieh sie so, wie sie ist. Aber ja, was ich damit sagen will, ist: Ähm, ich bin fasziniert von dem ganzen Paradigma, in das wir uns bewegen, und davon, wie Lebensbereiche, wie wir Dinge tun und wie wir über Dinge denken, auf eine Weise geprägt werden, die man im Moment noch gar nicht begreifen kann.

Wir stecken mitten drin, und daraus werden neue und interessante Ideen entstehen, denn das ist die neue Normalität, und, ähm, ja, wir sind total begeistert von Agent Provocateur. Ähm, das ist eine französische Band – eigentlich eine französisch-kanadische Band –, weshalb ich so rede. Ähm, es ist gerade so faszinierend. Alle sind wie hypnotisiert, weil wir die scheinbar immer gleiche alte Popmusik nicht mehr sehen können, weißt du? Also, ja, das ist alles, was ich dazu zu sagen habe. Cool. Ja, das war’s. Vor uns lag eine aufregende Welt. Wir haben es geschafft, das durchzustehen. Ja. Ähm, auch wenn wir diese Woche nicht gerade Unmengen an Recherche im Vorfeld betrieben haben, hatte ich einige davon … ich habe einen Hashtag auf Twitter, unter dem ich nach Videos gefragt habe.

Wenn ich also etwas Interessantes finde, speichere ich es für Videos ab. Ich habe eine Liste für längere Texte, um sie irgendwann in der Zukunft zu lesen. Wer weiß, wann? Also stelle ich Listen zusammen, und ja, ich finde, das war ziemlich gut. Wir haben das ziemlich gut hinbekommen. Und es war interessant. Ich persönlich war zum Beispiel daran interessiert, diesen langen Tweet zu lesen. Ich habe ihn nur überflogen, aber jetzt habe ich ihn gelesen und denke: Okay, schön. Ja, ich verstehe es jetzt besser. Weißt du, wir sind technisch gesehen Journalisten, oder? Im Grunde genommen sind wir alle Journalisten. Wir verbreiten unsere Nachrichten, wir verbreiten unsere Meinungen, und das ist Journalismus, oder? Und besonders in den letzten Tagen und darüber hinaus – übrigens, ich schicke dir dieses Video, diesen Herrn …

Ein großartiges Video. Es ist einfach unglaublich. Darin geht es darum, dass diese Art des passiven Fernsehens einfach nicht förderlich für die Entwicklung unserer Kleinen, unserer Kinder, ist, weißt du? Es bringt ihnen bei, sich nur in diesem Moment unterhalten zu lassen und darüber hinaus nichts weiter zu suchen. Und der Vergleich, den er zu einem Mann zieht – ich habe seinen Namen vergessen, Mr. Frederick, glaube ich, wird er in der Sendung genannt –, der, zugegeben, aus den 1960er- oder 1970er-Jahren stammte, verfolgte einen völlig anderen Ansatz im Gegensatz zu all diesen modernen Zeichentrickfilmen, die auf den Markt kommen, die alle mit grellen Effekten, Tieren und verrückten Figuren vollgepackt sind – ihr wisst schon, wie wir sie alle kennen und lieben. Er hat sich wirklich dagegen aufgelehnt und einen langsamen, zum Nachdenken anregenden Ansatz gewählt. Er sprach über die Gefühle der Kinder, darüber, was sie mit ihrem Leben anfangen wollen und wie sie mit schwierigen Situationen umgehen sollten und solche Dinge – das war sein ganzer Ansatz.

Es geht eher um eine langfristige Herangehensweise beim Wachstum und bei der Entwicklung der Kleinen. Ich schicke dir das Video. Es hat mich umgehauen. Ja. Ja, das wäre toll. Weißt du, ich habe einen Sohn, und er geht zur Schule. Ja, er geht zur Schule. Er besucht übrigens eine Montessori-Schule. Ich weiß nicht, ob du die Montessori-Schule kennst. Ich glaube nicht, dass es das nur in Deutschland gibt. Vielleicht schon, aber es ist eine Privatschule. Es ist eine Privatschule. Sie sind nicht besonders technikorientiert – nicht, dass sie Technik ablehnen, aber sie sehen es zum Beispiel nicht gerne, wenn man dort auf sein Handy schaut, oder? Wenn man in der Schule ist. Es ist diese Art von Schule, die sie fördern. So sollte es sein. Das ist typisch für Privatschulen, oder?

Das ist verrückt. Ja, ja. So sollte es sein, und so, wie sie sind – sie haben eine Menge, also eine Menge guter Seiten an sich und wie sie Kinder unterrichten, und es geht darum, unabhängig zu sein und Dinge selbstständig zu erledigen, weißt du. Aber ich sehe schon das Problem, von dem du sprichst, was die Inhalte da draußen angeht, mit Zeichentrickfilmen und dieser kurzen Aufmerksamkeitsspanne. Das Problem bei diesen Kurzform-Inhalten ist nicht nur – eines der Probleme ist –, dass die Aufmerksamkeitsspanne so kurz ist, dass man sich 30-Sekunden-Videos ansieht. Ein weiteres Problem, von dem ich kürzlich erfahren habe, ist, dass jedes Video ein anderes Gefühl auslöst als das vorherige, und darauf ist man einfach nicht ausgelegt.

Dein Gehirn kann diese Menge an, äh, Gefühlsschwankungen nicht verarbeiten, denn in einem Moment bist du aufgeregt, im nächsten traurig, im nächsten wütend und im nächsten fühlst du dich wieder ganz anders. Äh, und wenn du dir so viele Videos ansiehst und dein Gehirn anfängt, so viele verschiedene Gefühle zu verarbeiten, äh, dann schaffst du das einfach nicht. Dein Gehirn ist dafür nicht ausgelegt. Und lass uns das Ganze damit beenden: Ich weiß nicht, ob du dich auf irgendwelche Filme freust, die dieses Jahr herauskommen. Nun, er ist bereits erschienen. „Hail Mary“, auf jeden Fall. Du hast sicher schon von „Dune“ gehört. Wahrscheinlich. Der dritte Teil. Ja, ja, ja, ja. Ja, ja, „Dune“. Also, ich bin wirklich fasziniert von der Idee hinter „Dune“.

Es gibt so etwa 23 Bücher. Die Geschichte ist wirklich tiefgründig. Dahinter steckt eine riesige Philosophie. Äh, ich habe die Bücher zwar nicht gelesen, aber ich lese viel darüber und schaue mir oft lange Videos über die Bücher und die Geschichten an, und das ist faszinierend. Ja, Video-Essays. Viele der Konzepte in „Dune“ – das wissen die meisten Leute übrigens wahrscheinlich gar nicht – sind so, dass vieles, was in „Dune“ passiert, keine tatsächlichen Gespräche zwischen Menschen sind. Ein Großteil des Inhalts dieser Bücher besteht aus Gedanken. Diese Leute denken einfach gerne nach. Das ist also etwas sehr Interessantes, das ich darüber gelernt habe, und vieles davon geht tief in die Philosophie hinein.

Das reicht, äh, wirklich tief in die Gesellschaft hinein. Da gibt es so etwas wie – na ja, im Grunde geht es um denkende Maschinen, oder? Es ist irgendwie so … Mhm. Es ist nicht unbedingt KI, aber es hat etwas mit KI und Computern zu tun. Ähm, es ist so: Wenn Menschen die denkende Maschine für sich denken lassen, in der Annahme, dass sie dadurch befreit werden, dann geben sie die Macht doch nur in die Hände derjenigen, denen diese Maschinen gehören, denn diese können beeinflussen, wie man denkt. Und ja, vielleicht sollte man damit schließen: Mach dir einfach bewusst, was du denkst, und ob diese Gedanken wirklich deine eigenen sind oder dir durch einen dieser kurzen, aufmerksamkeitsstarken Inhalte eingeflößt werden. Sei einfach kritisch gegenüber solchen Dingen.

Ja. Ja. Ja. Was für ein philosophischer Abschluss der Sendung. Nun, das ist alles, wofür wir Zeit haben. Also, seid nächste Woche wieder bei uns dabei. Wir haben eine Website: commandAIshow.com. Und wenn ihr auf YouTube seid: Wir sind … Wie viele von euch sind auf YouTube? Wahrscheinlich nicht viele. Keiner? Momentan gar keiner auf YouTube. Wir kommen alle von Twitter. Meine Güte. Hallo, Twitter. Kommt doch zu uns auf YouTube. Gebt uns dort ein „Gefällt mir“. Sorgt dafür, dass der Algorithmus für uns arbeitet. Ähm, ja, seid nächste Woche wieder dabei, wenn es um alle Neuigkeiten aus den Bereichen KI, Design und Web geht. Ich bin Sam. Oh, du bist abgeschnitten, aber ich schätze, jetzt bin ich dran zu sagen: „Ich bin Sam.“ Bleibt am Ball, Leute.

Bis dann.