# AI Cost Optimization and Hardware Supply Chain Shifts

**Podcast:** Die Nerd Show
**Published:** 2026-07-04

## Transcript

Einen wunderschönen guten Tag, liebe Nerdshow-Freunde bei der diesjährigen Folge.
Ja, für alle, die nicht bei YouTube sind, das war die Kroatien-Trauerbrille, nachdem gestern die FIFA mal wieder entschieden hat, dass man in Portugal mehr Geld verdienen kann als mit Kroatien.
Das nur als kleines Sidenot.
Ich dachte, ich könnte dich wieder aus der Anmoderation raushauen, aber ein zweites Mal hat es nicht geklappt.
Ich muss mir was Besseres einfallen.
Die wollen doch Messi gegen Ronaldo im Finale sehen.
Ach, es ist so ätzend.
Unglaublich, ehrlich.
Da hat der VRR, ich meine echt kein Fußball-Nerd jetzt hier, aber wirklich, wer VRR entscheidet jetzt irgendwie, wie diese Spieler ausgehen, hat angeblich eine Ballberührung gesehen.
die zu einem Abseits geführt hätte, aber sie war es nachweislich nicht.
Und dann so ein scheiß Elfmeter wegen einer kleinen Berührung im Strafraum der Kroaten.
Aber keiner, wenn die Portugiesen im gleichen Strafraum in der Situation einfach komplett klammern.
Dann plötzlich nicht.
Naja, letzte von Modric und alles sehr traurig.
Ich habe dann irgendwann gepennt, habe aber dann später heute Morgen lauter Alarme in meinem Smart Home gesehen.
Lautes Geräusch um 2.20 Uhr, lautes Geräusch um 2.40 Uhr, lautes Geräusch um 3.30 Uhr.
Meine Frau am Schreien vom Fernseher.
Geil.
Häftig.
Ja, meine Nacht war etwas kürzer deswegen.
Aber wie geht es euch Männer?
Gut.
Ich freue mich auf diese Folge.
Ich hänge ein bisschen in den Seilen.
Wir hatten jetzt drei Tage Ruhrsummit, also zwei offizielle Tage und ein Side-Event-Ding.
Ich habe extrem wenig geschlafen.
Es wurde extrem viel getrunken.
Wenig Schlaf in Kombination mit ein paar Bier ist dann irgendwie doppelt hart.
Man lernt aber auch irgendwie nicht, ne?
Ja, genau.
Aber es hat Bock gemacht.
War sehr gut.
War jetzt nicht besser als letztes Jahr.
So die gleiche Menge, 1500 Leute, die da waren.
Aber die Stimmung, Vibe war sehr...
gut, auch viele spannende Speaker, die polarisieren auf jeden Fall auch.
Anne und Stefan Lemke mit ihrem Ankerkraut.
Wie war so die Fragen mit, von wegen ihr habt das zurückgekauft und so.
Ja, genau, das war so eine spannende Story auch mal zu hören, dass man nach so einem Exit dann irgendwie so im luftleeren Raum, dann weiß man gar nicht wohin mit sich und dann merkt man irgendwie auch, dass Geld nicht glücklich macht und dann...
kaufen wir es wieder zurück und die Challenges, die sie jetzt haben, weil natürlich irgendwie Ankerkraut hat ja immer gefühlt so eine kleine Alleinstellungsmerkmal.
Ich meine, es gab schon immer Gewürzmischungen, aber die haben das dann nochmal wieder neu revolutioniert.
Aber jetzt gibt es natürlich auch noch eine Menge andere und selbst Lidl hat irgendwie, glaube ich, Eigenmarken und sonst irgendwas.
Und fand ich immer gut.
Also haben sie gut erzählt, die Story und einfach sehr, sehr nett.
Wo ich auch großer Fan war.
Obwohl der Typ total polarisiert ist, war der Andreas Herb von MBG.
Habt ihr den mal gehört?
Nein.
Der wird ja neuer Jugo bei Die Höhle der Löwen.
Und der ist so eine Gastro-Nightlife-Ikone.
Der hat halt Effekt.
Der geht jetzt zur Höhle der Löwen.
Der geht jetzt zur Höhle der Löwen.
Der wird ja neuer Jugo.
Das wird Einschaltquoten feuern.
Ja.
Das brauchen die aber auch so.
Ja, das brauchen die so.
Und ich muss sagen, der hat auf jeden Fall, es war am Anfang so, hat er so ein bisschen geplänkelt, die üblichen Fragen und so.
Und dann hat er ganz gut gefreestylt und hat sich irgendwie gut vom Publikum auch löchern lassen, wie man was macht und so.
Er ist ja jemand, der das Herz auf der Zunge trägt.
Das war schon sehr, sehr geil.
Also wenn jemand einen guten Speaker sucht, der macht auf jeden Fall das Publikum.
Der macht Laune.
Ja, der macht Laune, genau.
Warum macht der Laune?
Wie eckt der an?
Was ist so sein Angle?
Ich glaube einfach, der ist an ein paar Stellen, ist der glaube ich einfach dann laut, vielleicht auch manchmal dann nicht so woke, hat sehr authentisch über Fehler erzählt, wo er sagt, er hat dann irgendwie auch mal Geld angenommen von der Warschauer Steiner Brauerei, das war halt ein Riesen-Shit irgendwie und wo es dann...
Einfach so die Details, wo es dann messy geworden ist in dem Deal, wo dann Leute bei ihm mitgeredet haben und so, das hätte er nicht machen müssen.
Die meisten Leute stellen sich immer hin und sagen, die Gewinner hat er jetzt nicht gemacht.
Er war irgendwie sehr authentisch.
Und ja, dann auch im Dialog mit den Gründern.
Er ist auch einer derjenigen gewesen, die super lange danach noch ansprechbar waren für Leute.
Es gab so den einen oder anderen Speaker, die sind halt gekommen, haben gespeakt, sind gegangen.
Und der war halt die ganze Zeit dann da gechillt und so.
Wo geht's noch weiter?
Okay, geht's noch weiter?
Alright, bin ich dabei.
Und das macht natürlich viel vom Spirit dann mit.
Das haben, glaube ich, auch viele sehr, sehr geschätzt.
Ja, aber super geil, dass ihr den World Summit auf so ein Niveau gebracht habt, dass so Leute halt auch kommen.
Das ist halt mega für NRW.
Ja, klar.
Und der ist halt so ein bisschen Vibe-mäßig, so ein bisschen wie Christian Wolff von Moor.
Sehr...
Er erzählt, was er erzählen will.
Ihm ist scheißegal, was Leute drüber denken.
Er redet einfach, wie es ihm gerade gefällt und sagt halt, wie er es findet.
Und wenn es jemand nicht mag, dann mag er es halt nicht.
Ich kann mir auch gut vorstellen, dass der in der Firma auf jeden Fall ultra kontrovers ist.
Wenn man sich die QNUNU-Bewertungen von MBG anguckt, dann haben die irgendwie so zwei Sterne.
Oder vielleicht drei.
Da ist, glaube ich, auch...
richtig Action in der Firma und ich glaube, wenn man mit ihm nicht klarkommt, dann eckt man wahrscheinlich auch schnell mit ihm irgendwie an.
Ich glaube, der ist, also ich glaube dem, dass der sagt, wie es ist und dass er irgendwie kein Slacking duldet und dass der einfach irgendwie auch so, keine Ahnung, dass der da sehr exakt ist und wenn er dann sofort irgendwie so eine Unrechtmäßigkeit sieht, dann greift er auch durch.
Das traut mir immer zu.
Der hat so eine geile Sales-Story immer gehabt, wie sie ihren Energy-Drink in Marken genommen haben und hat dann gesagt, so, Ist relativ simpel.
Lieber Clubbesitzer, du hast hier Red Bull.
Du kannst unseren Energydrink nehmen.
Der kostet dich irgendwie 20 Cent weniger pro Dose.
Du verkaufst eine Million Dosen im Jahr.
Dementsprechend, oder 100.000 Dosen im Jahr.
Dementsprechend ist in 10 Jahren dein Ferrari drin.
Fertig.
Deswegen nimmst du jetzt unsere Dosen.
In 10 Jahren kaufst du dir einen Ferrari.
Nur weil du unsere Dosen nimmst.
Das anders musst du gar nicht mehr überzeugen.
Also sehr Sales-Typ und so.
Ist halt Sales-Sau.
Aber spannend.
Sehr geil.
Aber Olli, du musst auch in den Seilen hängen, oder?
Hast du nicht gerade Geburtstag gefeiert?
Ja, ich habe ein bisschen gefeiert, aber ich hänge nur nicht so in den Seilen, dass...
Das holen wir Samstag nach.
Ich erwarte Sonntag in den Seilen.
Okay, versprochen, versprochen.
Ja, ich meine, wir haben es ja echt verkackt.
Wir wollten ja uns alle beim Ruhrsummit nochmal treffen.
Aber ja, sorry dafür.
Ich hätte es super gerne gesehen.
Anyway, beim Puppetsummit haben wir es geschafft.
Und ey Leute, ich fand es so geil wieder.
Ist das das erste Mal für mich so gewesen?
Also ich meine, wir machen das ja hier schon ein bisschen länger und es gab ja auch schon andere Events.
Aber es sind so häufig Leute irgendwie entgegengekommen, die gesagt haben so, ah geil hier, die Nerdshow.
Irgendwie Shoutout an Schorsch und Udo.
und ein paar andere, die alle gesagt haben, ich bin immer der Erste, der das auf YouTube guckt.
Wieso guckt ihr das auf YouTube, Leute?
Was stimmt nicht in eurem Leben?
Das ist ein Podcast.
Aber anyway, die Antwort fand ich geil.
Ich glaube, Schorsch oder Udo, einer war es, die gesagt haben, das ist so, als wäre man mit vier Freunden zusammen in einer gemütlichen Runde und kann ein bisschen rumnörden.
Man fühlt sich irgendwie so dabei.
Mega gut.
Das fand ich so einen geilen.
Super, oder?
Ich meine, okay, darum geht es uns ja auch hier.
voll gut.
Ja, aber ich finde es tatsächlich auch ab und zu mal angesprochen von so ein paar Leuten, die einfach sagen, so finde ich irgendwie spannend, einfach so zu hören und es ist so gemütlich.
Genau, das ist auch so.
Vielleicht müssen wir doch mal anfangen, Marketing dafür zu machen, dass wir ein paar mehr Leute zuhören, aber ich weiß nicht, muss auch nicht sein.
Und singen wir eigentlich für Daniela und wenn nicht glücklich?
Ja, darum geht es ja nur.
Singen wir eigentlich für Daniela als unser First-Time-Fanboyen?
Girling?
Nee, ne?
Wir singen nicht.
Das ist unser Geburtstagsgeschenk.
Wir singen nicht Genau.
Ja, herzlichen Glückwunsch.
Happy Birthday.
Cool.
Ja, ansonsten muss ich natürlich, wenn wir jetzt schon Pirate Summit und Ruhr Summit gesagt haben, auch nochmal sagen, Startup Week Aachen startet nächste Woche Montag.
im Hub am Montagnachmittag.
Ich glaube, da kriegt man keine Karten mehr, aber den Rest der Woche ist vollgepackt mit Zeug.
Dann gibt es auch das Founders Festival.
Das ist, glaube ich, Freitag und das ist richtig Open Air bei Besten Wetter angekündigt, draußen, mitten in der Stadt.
Auch mit geilem Line-Up.
Also, wer irgendwie noch Bock hat, einfach nach Aachen kommen.
Sind alle Events kostenlos und natürlich ganz viel Aachen ohne Limits auch dabei.
Das ist der Zehnte dann oder was?
Der Elfte?
Der Elfte ist das Founders Festival, genau.
Du musst irgendwann doch mal über Aachen erzählen und Aachen ohne Limits und so weiter.
Wir beide machen eine Sonderfolge, wenn die anderen nicht können.
Einverstanden?
Machen wir.
Die letzte Sonderfolge war beliebt.
Ja, stimmt.
Gut, dann lass uns mal rein starten.
Was haben wir denn alles?
Wir haben eine ganze Menge.
Also OpenAI hat irgendwie gesagt, dass sie für ihre Free Plans eine unfassbare Beschleunigung von 50% irgendwo erreicht haben.
Alle grübeln jetzt darüber nach, wie sie das geschafft haben.
Und sie können damit irgendwie die GPUs für die Free Plans drastisch reduzieren.
Mein Take on this one, Pure Marketing.
Also ja gut, haben sie wahrscheinlich irgendwie das Modell hart runter quantisiert für die Free Plans.
Die kriegen dann halt nicht so gute Antworten.
Da wird dann nicht so ordentlich, kannst du nicht mit Vibe coden, sondern kannst du nur irgendwie ein bisschen Research machen.
Dafür reicht es wahrscheinlich.
Aber vielleicht haben sie natürlich auch irgendwas mega krasses erfunden.
Wird dann die Zeit zeigen.
Aber ich muss auch sagen, die machen so komplettes Antiprogramm, gerade zu Entropic und sagen irgendwie, kommt Leute, scheiß drauf, ist günstig, macht einfach, gibt Gas.
Also wenn wir irgendwie wirklich so richtig lange Pro-Extra-Thinking-Task haben, dann schmeißen wir Kodex wieder an.
Einfach, weil es finanziell der beste Deal ist.
Ja.
Auf jeden Fall.
Ich finde auch Codex, also ich finde, brauchst beide Modelle, wenn du gerade, wenn du programmierst, brauchst du beide Modelle, die aufeinander aufpassen.
Sonst hast du Ether das eine oder das andere.
Also die haben schon ihre Vor- und Nachteile und dann brauchst du irgendwie gerade auf jeden Fall noch beide.
Aber wir kommen mit dem Pro-Plan echt super hin.
Also Antropic ist immer Montag leer und Codex immer erst Freitag.
Also auf jeden Fall eine gute Option.
Aber das mit den Preisen ist auch wichtig.
Also das ist ja super krass.
Wenn die das nicht hinkriegen und das nicht effizienter wird, dann sind wir alle im Arsch.
I'm sorry, diese ganze Thema Preisradar.
Wir haben gerade irgendwie ein neues NAS aufgesetzt, um die ganzen Videodaten mal zu backupen.
Und ich habe gedacht, ja, lass mal nicht so viele Platten kaufen, weil es ist ja gerade zu teuer.
Dann habe ich irgendwie sechs Monate gewartet, dann war es irgendwie doppelt so teuer.
Und dann haben wir gemerkt, oh scheiße, jetzt kaufen wir mal.
Zu wenig Platten gekauft, einen Monat später nochmal doppelt so teuer.
Das ist einfach der Horror.
RAM seit Juni 2026, beim Sechsfachen von Juni 25.
Prognosenrichtung neunfach im Dezember, zwölffach 27.
Und das waren jetzt nur die RAM-Preise.
SSD ist nochmal krasser mit siebenfachem Faktor und so weiter.
Muss man doch mitkommen und Aktion kaufen.
Also sie sind ja gerade runtergekommen tatsächlich.
Also würde empfehlen dann aber wirklich so ein ETF, Halbleiter-ETF, Semiconductor-ETF oder sowas zu nehmen oder ein Speicherding.
Die sind gerade runtergekommen einfach nur, weil sie sind halt tierisch hochgelaufen und andere Sachen sind gerade more sexy.
Aber wenn du dir das langfristig anguckst, würde ich sagen, eigentlich schon.
Also ich bin auch nicht reingegangen damals, aber ich überlege jetzt gerade.
Und inhaltlich dazu, OpenAI hat einen Inferenz-Chip mit eigenen, damit sie ein bisschen in die Fußstapfen von Google treten und von allen anderen.
Ich glaube, Entropic hat auch keinen eigenen Chip, aber dass sie sagen, hey, damit können wir die Inferenz billiger machen, weil die einfach in Hardware gegossen ist.
Mit Broadcom, die übrigens auch total abgekackt sind, komischerweise.
Also abgekackt, die haben auf hohem Niveau, aber nach der Message hätte ich gedacht, Broadcom geht hoch.
Also auch da wieder, das ist kein Anlagetipp.
Was ihr hier tut, geht auf euren eigenen Nacken.
Also Chips ist der Weg, oder?
Also ich glaube schon irgendwie an der Stelle, also ich sehe es auch in Aachen gibt, ich glaube schon mal erzählt, Element 3.5, Basweiler, also hier ein bisschen aus dem Umland, aus der Region, die dampfen Chips mit 300 Grad statt mit 900 Grad und schaffen es damit dann mehrere Layer übereinander zu machen, was das Ganze deutlich effizienter macht.
Und jetzt kommt so ein Nvidia natürlich her und sagt, cool, können wir euch kaufen oder können wir Maschinen von euch kaufen.
Und wenn ihr es richtig verstanden habt, ich muss es noch verifizieren, dann sagen die einfach nö, aber ihr könnt gerne eure Chips bei uns machen lassen.
Mega balls.
Also mal gucken, ob sie damit durchkommen.
Oder auch so andere Sachen, das hat Udo auf dem Pirate Summit erzählt.
Ich glaube, wenn ich es richtig in Erinnerung habe, Samsung ist da dran, dass Chips irgendwie gefaltet werden.
Und dann auch irgendwie normal mit dem Wafer bedampft und dann aber gefaltet.
Und dann haben die auch dieses Layer-Thema.
Das wäre natürlich eine Alternative dazu.
Keine Ahnung, da kenne ich mich nicht gut mit aus, aber in die Richtung passiert wahnsinnig viel, merke ich gerade.
Ja, ich finde es jetzt gerade nicht, aber es gab auch ein Startup, die neu gestartet sind.
Coming out of stealth, 800 Millionen, 800 Billion raised, 1.1 Billion Customer Contracts.
Die bauen Inference Cluster.
Die bauen quasi vom Get-Go ein Cluster-Konstrukt, das irgendwie anders funktioniert.
Ich habe es mir genau angeguckt.
Kann man die eigentlich noch Startups nennen?
Wenn die einfach mit 800 Millionen starten, ist doch einfach ein, keine Ahnung.
Das ist eine Frage, wie du Startup definest.
Wenn du dein Business Model noch finden musst, ein Business Model haben die wahrscheinlich schon.
Dementsprechend würde ich sagen, ja, Startup nicht wirklich grown up.
Aber ob sie Validation haben, ja.
Ja, das ist immer das Ding.
Also wenn halt kein Proof da ist, dann nehme ich es erstmal nicht ernst.
Also gute Ideen haben viele, aber es muss irgendwie funktionieren und dann nur noch in die Skalierung, dann geht es ab.
Aber du hast ja auch jetzt...
Noch mal zurück zu diesen Hardwarekosten.
Ich meine ganz ehrlich, alles, die irgendwie wir das machen müssen jetzt, was man auch nicht mit KI zu tun hat, entweder du willst lokal eine KI betreiben oder einen Server anbauen, NAS bauen oder what auch immer, deine alte Hardware fällt aus, du kommst dich an die Sachen ran und du bezahlst ein Vielfaches.
Also ich sehe auch kein Ende.
Also es geht ja einfach immer weiter.
Ja, der Markt passt sich ja an.
Also es hat damals begonnen, als OpenAI angefangen hat, RAM zu kaufen auf mehrere Jahre.
Und so wie ich das damals verstanden habe, die Produktionsketten sind halt total ausgelastet und du kannst nicht einfach das hoch rampen.
Und das braucht halt ein Stück weit Zeit, bis es halt nachgezogen ist.
Und ich bin überhaupt nicht drin jetzt gerade, deswegen spekuliere ich jetzt nur.
Das werden die aber auch verstanden haben, als OpenAI das schon gekauft hatte da.
Die bauen halt Fabriken und irgendwie, dass sie das halt bedienen können.
Das wird sich auch wieder entspannen in den nächsten Jahren.
Die Frage ist, wie lange dauert das?
Also brauchen die zehn Jahre, um so eine Factory hochzuziehen oder brauchen sie halt nur ein Jahr?
Dann könnte es sich relativ schnell entspannen, weil das weist man ja jetzt seit zwei Jahren.
Ich glaube, die brauchen zwei Jahre.
Wenn ihr so eine Chipfabrik hochzieht, dann kann die nach zwei Jahren produziert werden.
Vielleicht geht es ein bisschen schneller, aber so nach zwei Jahren schuldet schon was.
Aber dann müsste es ja langsam eine Runden gehen.
Dann müsste ja langsam was passieren.
Ich meine, wir wissen seit über zwei Jahren, dass das irgendwie alles eng ist.
Na gut, das Ganze führt jetzt auf jeden Fall zu explodierenden KI-Kosten.
Und Heiser hat es gerade ganz schön irgendwie getitelt, die Konzerne sperren Zugänge oder raten zu älteren Modellen.
What the fuck?
Ich meine, jetzt haben wir irgendwie die Super-Bazooka und können auf alles schießen.
Und dann hatten wir das Thema, glaube ich, letztes Mal, als wir gerade aufgelegt hatten, hatten wir noch ein bisschen drüber weitergesprochen, wie man jetzt eigentlich so mit Mitarbeitern dann auch umgeht.
Weil die sind ja nicht unbedingt alle Unternehmer.
Und wenn ich denen sage, hey Leute, das kostet alles Geld, dann wird ein Nicht-Unternehmer eher ja sagen, okay, dann nehme ich das billige Modell.
Dabei ist das unternehmerische eigentlich die falsche Entscheidung.
Dann eigentlich an den richtigen Stellen zu sagen, ich gebe jetzt bewusst Geld aus, weil ich spare damit Geld oder ich schaffe damit etwas, was besser ist, was mehr Geld bringt, kann ich ja nicht von jedem einzelnen Mitarbeiter erwarten.
Aber diese ganzen Kosten sind schon einfach krass.
Also ich weiß, es ist ja auch so, dass du, wir haben relativ viele Leute, die so Cloud Max Subscriptions haben.
Das geht aber nur bis zu 150 Leute.
Sobald du 150 Leute bist, kannst du bei Anthropic nur noch API machen.
Dann hast du diese ganzen so hübschen Dinger nicht mehr.
Also das ist bei Kunden von uns, die da einfach wirklich, wirklich, wirklich, wirklich krass Geld ausgeben.
Da merken wir aber gerade zum Beispiel mit unserem ganzen MCP-Konstrukt, wir sparen halt 80% Inference-Kosten, weil das Ding eigene Dinger baut.
Dieses Ganze, wo kriege ich meine Daten her, was für Daten nutze ich, wie stelle ich diese Daten bereit, nach was für Daten schaue ich automatisiert.
Da ist noch super viel Luft drin, das einfach wahnsinnig zu automatisieren und wahnsinnig Tokens zu sparen, weil du nicht immer alle Informationen holst, sondern irgendwie im Vorhinein weißt, was die relevanten Informationen sind, die du jetzt brauchst.
That's the way.
Auf der gleichen Seite will ich gar nicht wissen, was ich, ich hatte mal mit einem Chip-Ersteller gesprochen, die auch gesagt haben, sie würden da gerne noch mehr machen und auch eher drauf lassen.
Aber das Problem ist einfach, wenn die mal alle Daten aus ihrer Factory von einem Tag zusammensammeln würden, was sie gar nicht tun, weil sie die Festplatten nicht bezahlen können.
Sammeln sie einen Petabyte an Daten.
Wäre natürlich schön, ein AI darüber laufen zu lassen, sagen würden, was findest du denn noch an Optimierung und so weiter und so fort.
Aber einen Petabyte an Daten kannst du auch gleich eine zweite Fabrik daneben stellen.
Also deswegen bin ich echt gespannt, wie das so weitergeht.
Ja, Inference-Chips werden billiger.
Wir hatten ja noch dieses OpenAI-Broadcom-Ding da drin.
die einen eigenen LLM-Chip jetzt irgendwie announced haben.
Soll viel besser sein und so weiter, warten wir alles ab.
Also machen ja einige.
Aber ja, du wirst da einen größeren Split haben.
Du wirst irgendwelche Dinge haben wirklich zum Training und irgendwelche Sachen für Inference und da einfach spezielle Modelle haben, die das einfach anders machen.
Deswegen, du wirst die Kosten irgendwie jetzt langsam auch den Schach halten müssen und gucken müssen, welches Modell du nimmst und wie du das Modell nimmst.
Lustig, wir haben gerade für Kubernetes-Management einen Benchmark gefahren von Sonnet 4.6, Sonnet 5, Opus 4.7, 4.8 oder 4.7 und 4.8 oder sowas.
Und einfach geguckt, wer fixt denn das Ding am schnellsten?
Wer ist am besten?
Wer ist am schnellsten?
Sonnet 4.6.
Also, ich würde auch...
Also, bei der Diskussion für mich ist das...
Aber jetzt vom Prinzip her ist, du musst halt aufpassen, was du nutzt.
Also bei mir ist die Diskussion so ein bisschen so, bei großen Unternehmen kann ich das sehr gut nachvollziehen.
Jetzt gehst du einfach hin und sagst, okay, KI rettet uns, alle müssen jetzt KI nutzen.
Du hast dieselbe Anzahl Mitarbeitender und sagst eigentlich nur, okay, jeder kriegt jetzt auch noch einen KI-Zugang, im Zweifel halt nicht irgendwie Subscription, nicht irgendwie nach oben gecappt.
Dann hast du pro Mitarbeitenden nachher, keine Ahnung.
zwischen 20 und 500 Euro, je nachdem, wie viel die das nutzen, einfach mehr.
Was hat sich denn jetzt wirklich getan?
Die Kosten gehen nicht runter, sondern die Kosten gehen erstmal hoch, pro Person, die du hast.
Die Leute feuern sich ja auch nicht selber.
Die gehen ja nicht einfach fertig.
Deswegen kannst du nur der rauswachsen.
Und das ist jetzt erstmal unwahrscheinlich, wenn du den einfach unkontrolliert, dass das letztendlich gibst.
Deswegen die Kosten, die bleiben gleich.
Die haben jetzt etwas...
mehr Zeit, können ein paar andere Sachen machen und das Wachstum siehst du erst mal nicht.
Deswegen ist das glaube ich auch nicht der smarte Angang, wie man mit KI in größeren Unternehmen tatsächlich umgehen sollte.
Und das andere ist die Diskussion Richtung bin ich immer bereit für teure Modelle Mehrheit zu Also könnt mir eine schöne Frage machen, wäre ihr bereit für Fable 1.000 Euro im Monat auszugeben oder würdet ihr Opus 4.8 benutzen?
Und ich bin nach wie vor der Meinung, dass ein guter Harness, gute Prompts, gute Guidelines auch ein schlechteres Modell sehr, sehr gut machen und ein gutes Modell mit mittelmäßigen Prompts nicht signifikant besser sind.
Also das nur.
Das ist zumindest das, was ich sehe.
Und wir wechseln, je nach Job wechseln wir das Modell.
Also klar, weil es einfach sinnvoll ist.
Genauso brauchst du nicht für jeden Job einen Top-Rechtsanwalt, sondern manchmal reicht auch ein Rechtsanwaltsgehilfe.
Reicht auch aus.
Und das ist da auch genauso übertragbar.
Und wir machen sehr viele Routineaufgaben auch.
ganz normale Modelle, Basic-Modelle komplett ausreicht.
Wie geht ihr denn mit euren Mitarbeitern um?
Wie sagt ihr denen das, wann sie was nehmen sollen?
Pflegt ihr ständig neue Referenzen, die man sich morgens angucken soll, bevor man den Rechner geht?
Wir denken das aber ein Stück weit anders.
Wir sehr viel mit Hermes arbeiten.
Wir denken ja, das sind quasi digitale Assistenten.
Dort ist das eingestellt, welche Jobs welche machen.
Beziehungsweise da ist auch ein Orchestrator, der das im Prinzip auch sagt.
Also sagt, wie komplex ist die Aufgabe, brauchst du es dafür oder nicht.
Und das macht ja auch Cloud selber auch schon, wenn du das im Chat letztendlich nutzt.
Also einfache Aufgaben werden dann auch an Sonnet oder Heiko runtergestuft.
Wie macht ihr das bei neuen Elements?
Also ich sage immer allen Leuten, dass sie sich so ein Cloud Max Plan holen sollen.
Wir haben doch mal so ein extra Cloud Extra Budget für die Leute, die das superseden.
Momentan arbeite ich aber mehr bei Vendus, das ist unser AI-First-TM.
Da ist es auch sogar, dass wir nochmal einen extra Cloud-Mitarbeiter haben, der hinter dem kein Mensch steckt, den wir so gebaut haben, dass ganz viele kleine Sachen, die steuern wir eigentlich über ein GitHub-Board, also viele kleine Bug-Reports oder irgendwie so Wünsche wie, ach, ich hätte hier noch einen Copy-Paste-Button oder so.
Die wandern da rein und dann baut er die selber, macht am Ende nur ein PR und dann guckt einer von uns drauf und winkt den durch oder nicht.
Und ich glaube, da willst du eigentlich auf den besten Modellen arbeiten.
Ich glaube, ich will nicht den Context-Switch so machen müssen, dass ich sage, das mache ich jetzt mit dem Jammer irgendwas.
Ich glaube, dass du immensen Boost nochmal hast durch die AI-Harness, die du reinbringst.
Also wir haben uns die bei Wende selber entwickelt, weil die mit uns gewachsen ist.
Ich glaube, wenn du jetzt von Neu Null anfängst, kann ich als Recommendation geben, Superpowers von Obra, das ist so ein Framework, so ein AI-Harness-Framework, die haben jetzt gerade von der Version 5 auf eine Version 6 geupdatet und sind bei ihren Benchmarks, haben die nochmal die Tokens um 30% reduziert durch effizientere Skills und durch Reusen von Kontext und so weiter und so fort.
Das machen die schon, also da passiert halt auch gerade total viel in der Optimierung der Harness.
Ja.
Okay, merci.
Ich bin gespannt.
Aber auf jeden Fall, da wird noch viel passieren.
Aber das mit dem viel passieren und was für ein Modell muss man nutzen, habt ihr alle das liebe Video gesehen.
Hier, wo ist es denn?
Welches war das Video?
Das musst du sagen, welches du meinst.
Ja doch, ich bin doch gerade...
Aber bezüglich Modelle, dann ganz kurz euer Take Fable, bis du das Video gefunden hast.
Fable ist zurück.
Es ist eigentlich genervt.
Und auch bei mir ist es häufig runtergedroppt auf Opus 4.8.
Irgendeine Meinung zu bei euch?
Nutzt ihr Fable?
Interessant, nicht interessant?
Ja, klar nutzt man Fable.
Ich habe jetzt aber auch, das war jetzt so, also ich war jetzt von Fable, ich habe jetzt, ja, es war ein bisschen besser.
Naja, okay.
Also for everyday tasks.
Obbei, er hat ja auch irgendwie Sol, Terra, Luna vorgestellt irgendwie.
Aber natürlich nicht für uns in der EU, sondern die Preview beginnt erst irgendwie, also es ist am 26.
Juli begonnen und das glaube ich erstmal nur für US und auch nur für Regierungsabteilungen und die dürfen wir jetzt bis jetzt mal drauf gucken.
Aber immerhin haben sie sich alle geeinigt.
Ja, das ist ja schon mal ganz gut.
Und ich glaube halt, wir sind an so einem Punkt angekommen, wo man multivariat, muss ich sagen, kann ich viele Sachen nicht mehr entscheiden, weil wir so viele Moving Parts haben.
Das ist alles reines Bauchgefühl.
Guck mal, wenn du jetzt unten drunter in einer AI-Harness irgendwie die Skills veränderst und dann hast du gleichzeitig ein neues Modell, dann weißt du jetzt nicht, ob irgendeine Regression daherkommt, ob du jetzt A oder B gemacht hast.
Das muss man eigentlich minutiös checken und da sehr, sehr scientifically unterwegs sein.
Muss ich sagen, fehlt mir im Day-to-Day-Workalltag die Zeit für, sondern dann muss man einfach auf seinen Bauch verlassen.
Ja, da weiß ich nur von unseren Kollegen, dass relativ viele von den Sachen, die wir machen, mit Fable einfach fertiger werden.
Das ist das Feedback, das ich höre.
dass du relativ viele Sachen hast, die bei anderen einfach noch relativ viel Postwork brauchen oder irgendwelche noch Adaptation und so weiter und Fable macht es aber fertig.
Aber gut, müssen wir die nächsten Wochen mal ein bisschen beobachten.
Ich habe da mitbekommen, dass OpenAI-Codex jetzt Arbeitsabläufe aufzeichnen kann und daraus dann wiederkehrbare Skills macht.
Das ist in der macOS-App mal wieder drin.
Meine Theorie ist ja immer, dass die sagen, wir testen auf macOS und wenn es da gut auskommt, dann machen wir es auch Windows.
Aber inzwischen, keine Ahnung, ich meine, die Coder sind doch die meisten auf Mac unterwegs.
Inzwischen könnte man inzwischen fast andersrum machen.
Naja, aber du kannst halt dann quasi einmal so ein Workflow vormachen und dann mit einem Upload von Metadaten, Thumbnail, Untertiteln oder was auch immer du da gerade machst, wandelt Codex das dann in so einen wiederverwendbaren Skill um.
Also kannst ein bisschen leichter diese Skills irgendwie dadurch erstellen und hast dann Computer Use natürlich im Einsatz.
Aber wie immer gibt es leider nicht in der EU, sondern...
Erstmal nur in den USA.
UK und Schweiz sind auch erstmal raus.
Aber ja, on the way.
Ja gut, haben wir sich so ein bisschen was abgeschnitten von irgendwie Meta, die das ja in groß orchestrieren.
Und jetzt übrigens ihre AI-Hardware verließen an andere Leute.
Meta hat jetzt entschieden, wir vertickern auch, kannst bei uns AI-Hardware buchen.
Erstmal der Aktienkurs ist 12% hoch.
Das, was Krok kann, das können wir auch.
Oder SpaceX gehört jetzt alles zutreinander.
Also zu deinem Punkt davor, ja, jetzt habe ich ein bisschen verloren, dass Russland mit Weibach zu haben.
Also irgendwie Agent to Skill, das ist ja in den ganzen, also wenn ihr Open Claw oder so macht das von alleine, Hermes macht das glaube ich auch sehr gut, wenn du Sache dreimal machst, dann sagt er dir irgendwann Bescheid, sagt so, hey, das machst du jetzt zum dritten Mal, soll ich dir mal ein Skill draus machen oder so?
Das heißt ja schön, dass Codex das kann, aber das können halt Open Source Frameworks schon länger und die sind nicht gesperrt in der EU.
Generell kannst du es doch immer briefen.
Ich glaube, viele Leute sind damit eigentlich überfordert, irgendwie diese Sachen zu tun.
Ich glaube, das ist auch so ein bisschen das Ding, was ich gerade sehe.
Also wenn ich die ganzen Marktschreier auf LinkedIn mir anhöre, die immer sagen so, AI baut mir jetzt einfach eine App so geil.
Ich höre nur so, ja.
Okay, betreibt die mal.
Ja, betreibt die mal.
Und auch erst mal, das Video erst mal sehen.
Aber es gibt natürlich sehr, sehr mächtige Loops, die du machen kannst.
Und ich glaube, das ist eigentlich so das, worauf man sich auch fokussieren sollte, dass man sich halt einfach anguckt, was an meinem Task oder an meinen Prozessen ist eigentlich das Repetitive.
Und wenn ich das einigermaßen gut untereinander schreibe, dann kriegt man das auch hin.
Ich mache mal ein Beispiel dazu.
Das, was sehr häufig passiert in Softwareprojekten, ist so Document Drift.
Du hast irgendwelche Dokumentationen, irgendwelche Features wurden irgendwann spezifiziert und so.
Und dann werden echte User drauf losgelassen und dann schleift man so bei.
Dann sagt man so Codex fernab der Spezifikation nur noch so, naja, mach mal den Button dahin, mach mal das.
Und so, oh hier, da haben wir es vertan.
Statt einer 1 zu M Relation muss das eine N zu M Relation werden und so.
dann stimmt natürlich der Code irgendwann nicht mehr mit den eigentlichen Speck-Dokumenten überein.
Das ist so der Drift-Faktor.
Und da irgendwas zu haben, was einfach immer die Codebase durchgeht und checkt, ist das jetzt konsistent zu den Specks und so dieses Cleanup oder gibt es irgendwo Refactoring oder gibt es Code-Smells oder gibt es diese Sachen.
Da ist AI extrem stark und trotzdem diese Skills fallen nicht vom Himmel, die man sich da baut und die man dann laufen lässt, sondern die muss sich oft...
überlege ich mir die, was das sein sollte.
Oder wer anders, vielleicht sehe ich es irgendwo.
Klaus.
Danke.
Wir müssen Sebastian noch so einen extra Podcast geben.
Ich könnte den ganzen Tag zuhören.
Obwohl er in den Seilen hängt.
Nur zu den Loops.
Damit beschäftigen wir uns auch sehr intensiv.
Was wir jetzt gemacht haben, ist, wir haben tatsächlich alle Prozesse einfach mal in gemeinsamen Gesprächen runtergesprochen.
Wir haben ja so eine Maschine gebaut, um die Maschine zu bauen und da mal gegenlaufen lassen, um dass wir alle Prozesse, die wir haben, in so einem absoluten guten Standard haben.
Was wir jetzt gerade machen, wir versuchen, die halt zu optimieren und dann zu schauen, wo kann KI Loops bauen.
Also wir haben wirklich die ganze Company ist jetzt in Prozessdokumenten einfach aufgeschrieben.
Und mein nächster, das ist jetzt mein Projekt für nächste Woche, ist das mal einfach komplett an Hermes zu geben und zu gucken, wo Hermes jetzt gerade unterstützen kann schon.
Das wird, glaube ich, ordentlich krachen, weil viele Sachen halt noch nicht gut funktionieren, aber weil das gesamte Framework funktioniert und die Maschine, wo drin das sich dann alles bewegt, bin ich jetzt erstmal zuversichtlich.
Aber das ist alles auch in der Denke, wie kriegen wir möglichst viele Loops da rein.
Let's see.
Ich kann da mal berichten beim nächsten Mal.
Bitte nicht vergessen.
Hammer, bin sehr gespannt.
Also das mit den Prozessen machen wir auch gerade.
Aber bei Luke sind wir noch nicht angekommen.
Das finde ich extrem spannend.
Also freue ich mich, wenn du da vorläufst.
Olli, hast du dein Video gefunden?
Ich habe mein Video gefunden.
Es geht um das, habe ich gepostet.
Palantir-CEO Alex Karp hat einen 20-minütigen Rant bei CMBC gehabt.
Habt ihr den Rant angehört?
Nein.
Ich habe ihn nicht angehört, ich habe aber viele Kommentare dazu irgendwie auf Twitter gesehen.
Er hat sich so richtig schön aufgeregt, das muss man sagen.
Also resonated bei uns gerade, weil wir auch gerade im Militärbereich ein paar Sachen machen.
Und am Ende sagt er halt, dieses ganze Model-Dings ist kompletter Bullshit.
Du kriegst mit offenen Modellen und, wie wir vorhin gesagt haben, richtigem Harness und so weiter, richtigen Daten.
richtiger Kontrolle, kriegst du mindestens ein ähnliches Level hin, als die Daten einfach zu einem Anthropic OpenAI, sonst was zu schicken, die dann irgendwas damit machen.
Nutzt ihr meine Daten, nutzt ihr sie nicht?
Wie nutzt ihr sie?
Nutzt ihr sie gar nicht?
Wie kann ich dir die geben?
Baut ihr meine Firma nach am Ende, weil ich euch die Daten geschickt habe und so weiter und so fort.
Geschweige denn, dass du irgendwelche High Confidential und so weiter Sachen hast.
wo er einfach sagt, okay, diese ganzen Valuations sind schwachsinnig, kannst du ganz anders bauen und am Ende, netter Punkt, die Kosten von so einem Ding, also du machst da irgendwas mit AI, das sind dein Umsatz minus deine Kosten, aber deine Kosten inkludieren ja auch einen potenziellen Verlust an eigener Kontrolle über deine Daten.
Warum kannst du deine Wades nicht selbst denn...
definieren.
Warum kannst du nicht sicher gehen, dass deine Daten deine Daten bleiben und so weiter und so fort.
Und es ist auf jeden Fall spannend mal zu hören.
Natürlich verkauft er auch sich selbst, weil er sagt, wir haben da so einen Datenlayer oben drüber.
Und er kann natürlich auch nicht anders.
Er muss irgendwelche lokalen Modelle geben, weil die Ukraine wird nicht ihre Militärkonstrukte irgendwie gegen Anthropic feuern.
Das wird aber nicht passieren.
wo wir gar nicht über die NATO sprechen oder so, was für Sicherheitsmechanismen da laufen, wer da mit wem reden darf.
Und dementsprechend geht das genau in diese Richtung, welches Modell nutzt du jetzt für was und wie wichtig ist am Ende dein ganzes Konstrukt oben drüber und um das Modell drumherum.
Und ist das nicht am Ende das Wichtigere und sollten die Firmen nicht viel mehr da rein investieren, bevor es zu spät ist und alle ihre Daten weg sind.
Weil ja, wird nicht zum Training benutzt, aber wissen tun wir sie trotzdem.
Irgendwo einfließen tun sie auch.
Also ist alles ein bisschen fishy.
Aber da geht es genau darum, was machen Enterprises langfristig, gerade wenn es mal um wirkliche Daten geht.
Wir hatten das ja im Automobilbereich, wenn es um irgendwelche Legierungen geht oder so, da sagen die auch, nee, das werden wir nicht Anthropic schicken.
Da brauchen wir ein lokales Modell, das analysiert, was für bessere Legierungen wir bauen können.
Das werden wir denen nicht schicken.
Egal, was da irgendwelche AGBs sagen.
Das wird einfach nicht passieren.
Und das finde ich gerade ultra spannend, weil das genau diese Frage ist.
Da kommt wieder die Hardware-Frage rein.
Wie teuer wird diese ganze Hardware?
Kannst du dir das Zeug überhaupt kaufen?
Wie viel kaufen die denn überhaupt?
Wie viel liegt da überhaupt drin?
Was ist dann der wirkliche Benefit?
Die denken natürlich nochmal ganz anders über Benefit nach, wenn sie plötzlich Hardware kaufen.
Wo kommen diese offenen Modelle her?
Wie viele coole Modelle macht Nvidia, denen das ja egal ist, die ja schon einige Modelle announced haben und weiter daran arbeiten?
Und das überall reinpacken und irgendwie sich in Anthropic da auch nicht freuen wird.
Und am Ende, wo ist denn dann der Profit?
In den Hardware-Dingern?
In den LLM-Modellen?
Haben wir ja schon mal diskutiert.
Das ist die Frage.
Die werden relativ schnell kopiert.
Oder einfach in deinen Daten, in deinem Harness oben drüber, was so ein bisschen Manuels-Richtung ist.
Am Ende ist dein Power darin, wie du das Ding steuerst und managst.
Ist auf jeden Fall lustig zu hören.
Auch weil er ein bisschen Overboard geht in vielen einzelnen Teilen, weil es dann wieder darum, den Reichen wird das Geld genommen und keine Ahnung was, wo man sich fragt, was hat das jetzt mit irgendwas zu tun.
Aber macht das schon nicht schlecht.
Die krasseste jüngste Meldung, die ich jetzt irgendwie letzte Woche irgendwie mitbekommen hatte, war dieses Thema, Meta AI stellt Brain-to-Query-V2 vor.
Nichtinversive Brain-to-Text-Dekodierung ist natürlich wieder eine Menge Hype dahinter und naja so.
Man muss ein bisschen auseinander divinieren, aber die Idee ist halt wirklich so eine End-to-End-Pipeline aus nicht-inversiven MEG-Hirnsignalen.
Also setzt ihr so einen Helm auf, aber man muss eben keine Dioden in den Kopf ballern oder so.
Und das Ding soll in Echtzeit getippte Sätze wieder rekonstruieren können.
Haben sie allerdings nur mit 22.000 Sätzen mit neun Versuchspersonen gemacht, die zehn Stunden lang in der Aufzeichnung waren und haben dann wohl 61% Wortgenauigkeit im Schnitt erkannt.
Der Beste hat 78% geschafft.
I don't know, aber es ist natürlich eine super kleine Versuchsmenge.
Warum diese neuen, warum nicht mehr?
Aber heißt am Ende des Tages, Brain-Computer-Interfaces, Rücken aus der Implantat-Nische, dann wirklich raus Richtung skalierbare AI-Forschung.
Das ist halt noch weit weg von Alltagstechnik, aber so MEG-Geräte sind jetzt nicht unendlich teuer.
Aktive Tippaufgaben, wer weiß, mit dem großen Kontext der Sprachmodelle, so wie wir ja jetzt auch reinsprechen und der die Grammatik korrigiert und so, kann natürlich das bisschen, was an Signalen dann da ist, wahrscheinlich relativ gut von so einem Large Language Model zu einem, was hat der da wohl geschrieben, ob das dann aufs Wort genau ist, keine Ahnung, gemappt werden.
Aber verschwimmt dann so ein bisschen die Grenze zwischen medizinischer Kommunikationshilfe und Grundlagen des Gehirns.
Wie viel Gedankenlesen da jetzt wirklich drin ist, weiß ich nicht.
Für Menschen mit einer Behinderung ist das natürlich gigantisch, wenn das funktioniert.
Ich glaube nur, dass Meta wahrscheinlich andere Ziele damit hat.
Die einzige Frage ist natürlich, trackt der deine Gedanken oder dein Tippen?
Das tippen eben.
Es hat nichts mit Gedankenforschen zu tun.
Wenn der halt dein Tippen trackt, dann bist du immer noch schneller als Tippen.
Und war der 76-Typ einfach ein Scheißtipper und hat irgendwie ganz langsam getippt?
Du musst jetzt um die Ecke denken.
Also es macht natürlich keinen Sinn, dass du beim Tippen erkennst, was du tippst, weil du tippst ja schon.
Aber die Tatsache zu sagen, ich nehme Gehirnströme, lege das auf ein Large Language Model und komme darauf drauf, ist technisch gut.
Aber sie haben ja nun mal beim Tippen das Tippen erkannt.
Das ist ja was anderes, als ohne das Tippen das Tippen zu erkennen.
Genau, wie schaffen sie jetzt Sagen?
reines Denken, glaube ich, sind die meilenweit von weg.
Aber wenn ich jetzt sage, das, was ich tippe, wird jetzt mit Sprechen gemacht.
Ich meine, realistisch, das werden ja Fingerbewegungen wahrscheinlich sein, die die tracken.
Es wird ja nicht das Gehirn hat an das Wort gedacht sein, vermute ich jetzt mal.
Hoffe ich, sonst mache ich mir Sorgen.
Ja, gut, also Shoutout an Udo, der das mir geschickt hat.
Ja, aber finde ich spannend, vor allen Dingen, weil ich da gerade wieder, du bist beispielsweise aus dem Medizinbereich, ein Mensch hat irgendwie, nimmt gerade Medikament X und soll jetzt noch irgendwie Medikament Y bekommen, da hat halt keine Sau im Kopf, welche Nebenwirkungen es zwischen X und Y geben könnte.
Wenn du das sofort live irgendwie auf dem Zettel stehen hast, da werden schon einiges an Effizienzen kommen, die wir noch nicht so ganz denken, die auch gar nicht so kompliziert sind, wo du auch sagen musst, da brauche ich jetzt kein Faible für.
Ich brauche nur die Daten, wie da Eigene Daten, eigenes Harness, eigenes sonst was und irgendwie ein Basismodell, das irgendwie da den Match finden kann.
Deswegen, ich bin weiterhin noch stärker diese Woche so drauf, diese Spezialmodelle, kleinen Modelle, sonst was, irgendwas, wann werden die Modelle auf dem iPhone besser und so.
Das wird noch spannend.
Ja, es gibt in Aachen auch, die Riesendinger brauchen.
Du hattest ja eben das Beispiel gebracht mit dem Petabyte an Daten in der In der Produktionsanlage.
In der Produktionsanlage, genau.
Das ist ein Riesenthema in der Arbeit.
Noch einige Startups dran.
Letzte Woche war der Demo-Day in Aachen, wo die aktuellen besten Startups aus Aachen, die im Inkubationsprogramm und Wachstumsprogramm und so weiter waren, sich vorgestellt haben.
Und da war auch einer mit dabei.
Ich suche den Link noch raus, steck dir noch hinterher.
Der hatte gesagt, die versuchen das so ein bisschen live mit echten Daten sofort nutzbar zu machen.
Dass man sagt, ich muss den nicht erstmal aufzeichnen und ein Riesenmaschinen-Learning draufsetzen, sondern man kann aus den Live-Daten sogar schon...
irgendetwas machen.
So habe ich es jetzt erstmal auf die Schnelle verstanden.
Kämme dann natürlich mit einem deutlich kleineren Modell aus.
Ja, aber das mit den Live-Daten habe ich ein tolles Beispiel.
Timo, mein wunderbarer CTO, hat das gemacht.
Der hat einfach Claude an seiner Heizungsanlage Steuerungsgedöns gepackt.
Und der hat so einen kleinen Bildschirm, wo so draufsteht, wie viel Grad vor Lauftemperatur und sonst was und so weiter.
Der steht schon da.
Das hat das Ding natürlich nicht gesehen.
Dann hat er einfach gesagt, hier ist der Datenbus.
Lies mal einfach 10 Stunden heute Nacht mit und zum Start drücke ich mal auf hoch und mal auf runter und mal auf plus und mal auf minus und so guck mal ein bisschen und so fort.
Nach 10 Stunden hatte der das Ergebnis so, ich weiß jetzt grob, was da läuft.
Hier wäre so ein Display, der Display sah es fucking genauso gleich aus.
Also er konnte sagen, was auf diesem Display steht, einfach nur, weil er den Live-Daten-Stream mitgelesen hat und konnte dann...
Entscheidungen treffen.
Wo es darum geht, kann ich meine Heizung nicht anders steuern?
Kann ich nicht das kalte Wasser aus dem Brunnen holen und den in meine Fußbodenheizung packen?
Nein, sag ihm das nicht zu tun.
Was passiert an der Fußbodenheizung ist, sobald du diese thermische Kurve verlässt, fängt das an zu beschlagen und ihm schimmelt unterm Boden alles weg.
Du musst nah an Zimmertemperatur bleiben und so weiter.
Das ist das Gleiche, wie ich gehört habe.
Wenn du so einen coolen Indoor-Pool hast.
mit einer Wasserheit, also dieses Wasser wird geheizt, musst du gleichzeitig eine Klimaanlage haben, damit die Lufttemperatur nahe der Pooltemperatur bleibt, sonst bist du einfach in einem Gewächshaus.
Die befeuern sich gegenseitig.
Also es ist einfach, deswegen sind so, Poolheizen drin kann echt teuer werden, weil gleichzeitig Klimaanlage.
Aber...
Aber vom Prinzip her glaube ich deswegen sehr stark daran, dass du noch ultra viel auslesen kannst.
Und vor allen Dingen, was ja, weil wir arbeiten mit einigen Fabrikkunden zusammen, was die immer sagen, das Problem ist halt einfach, wir müssen irgendwann, irgendwie den Carl Gustav ersetzen.
Der arbeitet hier seit 40 Jahren und der sagt halt einfach, wenn es unten rechts klickert und oben links pocht, dann muss ich dreimal dagegen treten und den Regler nach rechts drehen.
Das kriegen die nicht weitervermittelt.
Und der ist irgendwann Pan 60 und geht.
Und es gibt auch keine neuen, die da irgendwie sagen, oh, ich will jetzt unbedingt so eine, keine Ahnung was, Maschine bedienen.
Deswegen, also da muss einfach ultra viel passieren, weil wir nicht drum herum kommen.
Was habt ihr noch mehr Namen?
Wir haben noch Krypto-Gedöns.
OpenUSD wurde announced.
Visa, Stripe, Mastercard, BlackRock, Google, Coinbase.
Und alle wollen, insbesondere auch Coinbase, die ja in Circle investiert sind, greifen jetzt Circle USDC an und haben ihre eigene OpenUSD Stablecoin announced mit einem lustigen Twist.
Das ist eine Foundation, das fühlt sich so ein bisschen an wie Visa zu einem gewissen Punkt.
Das ist eine Foundation, wo alle zusammen Member sind und mitentscheiden, wie es weitergeht.
Die nimmt eine minimale Fee, aber nur eine minimale Fee, um Operations zu rechtfertigen.
Alle Earnings darüber hinaus behalten die Leute, worüber du deine OpenUSD gekauft hast.
Weil das Problem ja manchmal in Amerika ist, irgendwelche Prozente, die du auf Krypto verdienst, musst die Bank behalten und darf sie nicht an die User weitergeben oder so.
Aber ich bin da immer noch skeptisch, ob das wirklich alles so genau so drin steht.
Also soll scheinbar so drinstehen, aber mal sehen, wie sich das weiterentwickelt.
Aber das heißt, wir haben so ein ganz neues Ding.
Ich nehme auch stark an, wieder stark auf das ganze Stripe-Konstrukt, die ja ihr eigenes Backend gebaut haben und so weiter, wo ich jetzt gerade ein bisschen gespannt bin, wie es mit Ethereum weitergeht, muss ich zugeben.
Weil das läuft necessarily nicht auf Ethereum, beziehungsweise das Problem, das du halt hast, ist, dass die allerhöchstens da noch securen am Ende, aber diese paar Transaktionen pro Tag, die irgendwie eine Secondary Chain irgendwie securen, ist halt nicht viel Umsatz.
Deswegen geht es auch Ethereum gerade nicht so wahnsinnig Bombe.
Wobei es seit einer Woche konstant bergauf geht.
So die letzten drei Tage vor allem.
Ich weiß nicht, ob wir gerade irgendwie so einfach so Maximum vier haben und jetzt alle irgendwie langsam wieder reingehen oder ob es nur so ein kleiner Fake-Out ist, aber es geht langsam wieder so ein bisschen hoch.
Ich hoffe.
Ich hoffe, es passiert was.
Apropos, ich habe letztes Mal ja so ein bisschen über die fehlende Mika-Lizenz von Binance-Sorge verbreitet.
Bis zum 1.
Juli sollte man irgendwie sich mal um seine Coins dort kümmern.
Ich habe mir das jetzt mal im Detail nochmal angeschaut und kann ein bisschen Entwarnung geben.
Dadurch, dass Binance selber gar keine deutsche Dependance hat, betrifft sie das erstmal nicht.
Anders sieht das aus in Frankreich oder Portugal oder so.
Da haben die eigene...
Dependancen und da sind die Leute dann wirklich in Trouble, wenn sie vorher ihr Zeug nicht weggezogen haben.
Also bei uns ist es noch nicht schlimm.
Man kann auch in Ruhe seine Konzer liegen lassen, wer es immer noch hat, aber trotzdem ein bisschen im Blickwinkel halten, weil warum die keine Mika machen, weiß ich nicht, aber EU wird das nicht witzig finden.
Also ein rechtliches Konstrukt auf jeden Fall.
Ja.
Wir haben noch zwei spannende Sachen.
In einem müssen wir definitiv sagen, weil jetzt ist es soweit.
der Haushaltsroboter Isaac 1 kommt und der kostet nur 8000 Dollar, Sebastian.
Oh, geil.
Du hast gesagt, 20.000 Dollar würdest du drüber nachdenken.
Er sieht ganz süß aus, finde ich.
Er ist halt arschlangsam gefühlt beim Zusammenlegen und so.
Aber er muss ja auch nicht schnell sein.
Wenn er mal eine Wäsche aus der Wäsche rausholt und irgendwie drei Stunden braucht, das nachts zusammenzulegen, ist mir egal.
Also er macht das schon.
wie schön das am Ende wirklich ist, ein Video und also, ja, ne, schauen wir mal.
Aber ja, der erste Haushaltroboter ist für Ende des Jahres Launch und so, Herbst 2026, soll man den wirklich kriegen können.
Acht Stunden Akkulaufzeit, zwei Stunden Ladezeit, WLAN-fähig, ne, relativ groß und kann halt zusammenlegen, aufräumen.
Wobei das Aufräumen auch wieder lustig ist.
Sie haben so ein Beispiel, wie man so ein Kinderzimmer aufräumt.
Komischerweise spielt das Kind nur mit so irgendwelchen Squishy Toys.
Da ist nichts irgendwie Festes dabei.
Das sind nur so komische...
Komische Weichspiele Sachen.
Das ist ein sehr, sehr debiles Kind.
Ja, ja.
Also, okay, okay.
Ich gucke es mir an und sage Bescheid, ob es einzieht oder nicht.
Ja.
Carlos Gadgetry.
Ist auf jeden Fall cool.
Gut, gut, gut.
Und das Zweite?
Ich sehe dich irgendwann, ich sehe dich so im Pool chillen und dann kämpfen so fünf Hauffahrtsroboter, die du so zweckgefremdet hast mit so einer Custom-Firma-Gegner, der so ein Robot-Match-Fight.
Die dürfen mir mal einen Cocktail machen.
Ich weiß nicht, haben wir da letztes Mal drüber gesprochen mit diesen AI-Kämpfen in irgendwelchen künstlichen Welten?
Ja, wir haben letztes Mal drüber gesprochen.
Ja, genau.
So ähnlich.
Musst du mit echten Robotern machen.
Das Letzte, was ich ultra geil finde, weil das Ding ist scheinbar riesig, gerade 220 Millionen bei einer 2 Milliarden Bewertung aufgenommen.
Wir alle kennen den Uyura Ring oder die Armbänder und so weiter und so fort.
Und die liebe Firma, die das jetzt anders gemacht hat, hat solarbetriebene GPS-Halsbänder für Kühe gebaut, die damit virtuelle Zäune errichten, die über Töne etc.
die Kühe dahin leiten, wo sie hinleiten sollen.
und du keine Zäune mehr brauchst und die von Grasfläche zu Grasfläche treiben kannst, ohne dass ein Mensch da was treiben muss.
Das Ganze natürlich über Satelliten steuern und so weiter.
Haben eine Million von diesen Halsbändern verkauft.
Ist halt jetzt keine Grundsatz- irgendwie so Spaßidee.
Und spart halt Geld wie doof, weil keine Zäune, keine Kontrollfahrten und so weiter und so fort.
Ist ein laufendes Abo.
Das heißt, du zahlst jetzt 20 Dollar für deine Kuh im Monat.
dass man die ihre Tage hat.
Ich habe die Kühe digitalisiert.
Wir können jetzt Geld verdienen mit Kühen.
Wie geil.
Hammer, aber ich meine, eigentlich brauchst du eine Kude auch so ein visuelles Moment, um zu lernen, wenn das, was ich da sehe, ich dagegen laufe, tut's weh.
Wenn du das Visuelle wegläufst, dann laufen sie einfach irgendwo hin und dann tut's weh.
Oder verstehe ich das gerade falsch?
Vorher laufen sie irgendwo hin, dann laufen sie da nicht mehr hin.
Scheinbar geht das auch.
Ich weiß auch nicht, ob es Wehten oder Töne sind, wie das ganz genau funktioniert.
Habe ich mir nicht angeguckt, aber bei einer Million Halsbänder scheint es zu funktionieren.
Also ist kein...
Okay, ich verstehe.
Da steht Ton- und Vibrationssignale.
Okay, wenn das ausreicht, dann ist das wahrscheinlich okay.
Aber auch stressig, wenn so eine Kuh die ganze Zeit bescheuert wird.
Ich weiß nicht, ob die Peter das feiert.
Ja, das weiß ich auch nicht.
Aber die Peter kann feiern, die Kuh hat keinen Zaun mehr.
Stimmt, stimmt.
Es ist so geil.
Man muss nur mal kurz nachdenken.
Du kannst in jedem Scheiß-Business noch irgendwas revolutionieren, wenn du das mal zu Ende denkst.
Oh, da habe ich noch eine geile Sache.
Ich versuche den Link noch rauszufinden.
Pass auf, weil du die rausfindest.
Die haben aus Stammzellen Eier gemacht.
Und schon die ersten Mäuse gezüchtet.
So dass du quasi, selbst wenn du theoretisch keine Eier mehr hast, oder die, ne?
Und du kannst die...
Mäuse aus Eiern?
Ich würde sagen, Mäuse aus Eiern.
Mäuse aus Eiern.
Nein, Mäuse aus Eiern.
Nein, Mäuse aus Eiern.
Es geht um Female Eggs.
Du hast Sperma.
Ja, ich hatte davon Bienchen, Blümchen und so.
Genau.
Und die Eierseite haben die jetzt aus Stammzellen ein Ei gebaut, das du befruchten kannst und aus dem ein Tier geboren wurde.
Verrückte Scheiße.
Das heißt, du hattest nicht, dass du das Original-Ei brauchtest, sondern du hast das Ei hergestellt.
Männer, den Rest müsst ihr ohne mich schaffen.
Ich muss zum Toten Hosen Konzert nach Düsseldorf und will nicht zu spät kommen.
Macht's gut, bringt das hier in Ruhe zu Ende.
Viel Spaß, geil.
Danke, ciao, ciao.
So, da war der Carlo so excited über sein Toten Hosen Konzert, dass er nicht die Aufnahme verlassen hat, sondern die Aufnahme beendet hat.
Dafür muss Carlo jetzt auch das Nacht das zusammen schneiden.
Also, ich sag's nochmal.
Das ist ja auch nur fair.
Ja, genau.
Ich sag's nochmal.
Nächste Woche ist Race Summit in Frankreich, habe ich glaube ich schon mal erzählt.
Und dann Dienstag dabei ist der Maschiner, die Maschiner-Konferenz nur um Roboter.
Und ich nehme stark an, da werde ich ein paar lustige Sachen sehen.
Also bin mit Henning und Timo da und wir werden uns mal Roboter angucken.
Finde ich richtig gut.
Dann machen wir eine ganze Session eigentlich nur.
Du stellst uns vor, was du für geile Sachen gesehen hast, oder?
Ja, das finde ich auch cool.
Mit Fotos bitte.
Mit Fotos.
Schick die in so eine WhatsApp-Gruppe, Telegram-Gruppe mit uns.
Das ist das Roboter-Special.
Ich mache lauter Selfies.
Seeing is believing ist da, glaube ich, echt witzig.
Selfies mit Robotern und da gibt es noch ein Foto vom Evening-Dinner in Versailles im Spiegelsaal.
Also die AI-Leute sind die neuen, wir haben Geld und machen weirde Sachen.
Offensichtlich.
Ja, Menschen bleiben Menschen anscheinend.
Ja, also...
Machen Menschen Dinge.
Mein Smoking kommt wieder zum Einsatz.
Black Tie Event Only ist meine erste Konferenz mit einem Black Tie Event.
Aber gut.
Gibt's nichts mit T-Shirt und so.
Kann ich auch nicht mit Hoodie kommen.
Soll ich mit deinem grünen Jackett kommen?
Kann ich nicht mit meinem grünen Jackett.
Das Markenzeichen bricht weg.
Werde ich an den nächsten Tagen anziehen.
Wir sind aber auch nahezu durch, ne?
Wir sind eigentlich auch durch.
Ich hatte noch eine Sache, die ich dich fragen wollte, Sebastian.
Weil wir letztes Mal darüber hatten.
Und das Distillieren von Modellen, das war das Thema.
Und ich hätte mich auch kurz damit beschäftigt und auch einen Link geteilt hier, dass Anthropik Alibaba das vorwirft, dass sie das im großen Stil tun.
Und letztendlich, die klauen ja nichts eigentlich.
Das ist doch wie, also einfach als offene Frage, so als provokante These mal, das ist wie, die gehen durch die New York Times und so und trainieren ihre Modelle, also die Anthropics dieser Welt und jetzt gehen die Alibabas hin.
Gehen die halt durch die Anthropics dieser Welt und trainieren ihre Modelle.
Das ist ja das Schlafide, dass halt Anthropic sagt, oh, das ist aber hier Intellectual Property Theft, while it was totally okay for them, all den ganzen Content aus dem Internet zu rippen.
Das ist ja genau der Punkt.
Also entweder man muss so argumentieren oder so.
Aber man kann nicht weiter sagen.
Kennt ihr den Mechanismus, den Entropic unter der Haube macht, um das zu erkennen und zu verhindern und auch so ein bisschen zu machen?
In dem System-Prompt, oder in dem Prompt, was Entropic schickt, ist immer drin, you're a useful agent, und heute ist der, und dann schicken sie ein Datum.
Today's the, und dann kommt das Datum.
Und sie haben verschiedene Kodierungen für das Apostroph und sie haben verschiedene Kodierungen für die Datum-Delimiter.
Mal ist es der Slash, mal ist es was anderes und da sind auch so Leerzeichen drin.
Und damit kodieren sie zum Beispiel, wenn sie in einem internen Firmennetzwerk laufen und das ist aus China, wird genau dieses Datum etwas anders kodiert, als wenn sie irgendwo anders laufen.
Und damit...
Gucken sie, versuchen sie halt, Abuse-Detection zu machen, das rauszufinden, wo irgendwer ist.
Und dann auch gezielt AI-Labs aus China, die Distillierung betreiben.
Damit tracken sie halt irgendwie, wer sind denn die Leute, die das machen?
Was machen die so für Prompts?
Wenn sie dann reingeguckt haben und Abuse feststellen, sperren sie die Accounts.
Ich muss sagen, ich habe es noch nicht ganz genau verstanden, wenn das unter der Haube läuft, wie kann man dann Abuse feststellen?
Du kannst zumindest limitieren, dass du weißt, kommt aus China und dann kannst du dir das genauer angucken.
Ah, okay.
Aber du kannst nicht damit Abuse erkennen, oder?
Sie gucken halt in die Sachen rein und siehst ja, also wenn jetzt zum Beispiel, wenn man jetzt meinen Entropic Prompting so durchgehen würde, dann würdest du sehen, naja, okay, der schreibt da gerade eine Software zum Thema CRM.
Und wenn du jetzt aber irgendwie relativ standardmäßig vielleicht auch so ein bisschen merkst, so, ey, hier macht einer irgendwie Anfragen im Sekundentakt und die sind alphabetisch, die Wörter, also die Fragen sind nicht alphabetisch sortiert oder sonst irgendwas.
Du merkst irgendwie, weil jemand versucht, da strategisch gezielt Wissen rauszusaugen, dann wird das wohl ein Distillierungsprozess sein.
Aber die Grundfrage, Diebstahl oder nicht, ich meine die Zahlen für das Produkt, die Zahlen für jede Anfrage, sind eigentlich das, was die KI rausgibt, ist das Copyright geschützt?
Ist doch gar nicht geschützt, oder?
Sie haben ja in den AGBs drin stehen, dass du es nicht machen darfst.
Dass du nicht den Output von Antropic dazu nutzen darfst, um eigene Modelle zu trainieren.
Blablabla.
Ich glaube halt irgendwie, dass das nicht wirklich verteidigbar ist, was sie sagen.
Das glaube ich aber sowieso nicht, weil wenn in China auch so groß China ist und so ordnet, da viele Dinge ablaufen, aber ich glaube, eine richtige Handhabe hast du da nicht.
Also wir hatten mal den Trouble bei Image.ly, dass eine chinesische Subsidery von Alibaba hat unser GitHub geklont und hat einfach alles umbenannt, aber stand noch ganz viel auch im Quelltext Image.ly drin, deswegen konnte man das auch zeigen.
Da kannst du ganz oft hinmailen und sagen, hier DMCA, Tagdown, blablabla, blubblub, blub, blub, du bist jetzt gar nichts.
Und das ist einfach schwierig und ich glaube einfach so, dass...
Die rein rechtliche Situation, da können sie sich beschweren, ist das eine.
Sie müssen es irgendwie anders machen.
Deswegen machen sie halt die Sachen mit dem Whitespace-Markern und dann sperren sie einfach die Accounts weg.
Das ist zwar auch ein Katze-Maus-Spiel, aber das lohnt sich auf jeden Fall, sie da auszusperren.
Ja, und halt irgendwie, ich glaube halt leider sind die Gesetze da noch daft.
Das ist ja halt das, was ich immer sage, das ist der AI-Wilde-Westen.
Das ist so ähnlich wie mit YouTube damals.
YouTube ist halt sehr viel mit gepiratetem Content groß geworden, als dann irgendwie...
Genau, bis es Regeln gab, so war das ja alles hier ja Fair Use und so.
Wir sind ganz klein, wir sind ja ganz arm, bis man jetzt so groß ist, wie man groß ist.
Damals war es schon so, dass irgendwie Webseiten und Apps, die sich dann auch wiederum an YouTubes Content bedient haben, da haben sie ganz gut die Google Rechtsanwälte rausgeholt und haben das gesagt, nee, das dürft ihr aber gar nicht, dass ihr verstößt gegen unsere AGBs und haben da ordentlich geboxt.
Da gilt leider das rechte Stärkere.
Das heißt letztendlich, wenn man das mal wirklich zu Ende denkt, egal wie gut das beste Modell ist, sobald das Public ist, werden die anderen eben halt auch nachziehen, weil die viel rausdestillieren können.
Das haben wir schon mehrfach gesagt, wird dann passieren.
Genau, das ist aber dann auch, das wird gar nicht auf den Monopolisten hinauslaufen können.
Das ist meine Essenz danach.
Dass du immer nachziehen kannst.
Also das, was gerade nicht auf den Monopolisten hinausläuft, das hat...
Aber du wirst ein Oligopol haben, glaube ich, irgendwie, die sich alle nicht viel tun.
Das ist ja am Ende Zugriff auf Hardware, ne?
Aber meint ihr nicht, dass es dann auch nachher Open-Source-Sachen gibt, die genau dieses Thema halt auch machen, und zwar richtig Open-Source?
Ja, aber dann ist noch die Frage, wer die Hardware hat.
Das ist ja das, wo Leute Elon Musk auf den Rücken geklopft haben.
Sein XAI scheint nicht so wahnsinnig gut zu sein, aber dieses, ich baue jetzt Hardware wie doof, du bist am Ende der mit Hardware und alle müssen mit dir reden.
Das heißt...
Profit würde in der Hardware sein, dann ist die Frage, ob Profit in dem Model ist.
Wir haben ja auch intern immer noch Leute, die wirklich Cursor mögen, weil die Art, mit Cursor zu interagieren und damit zu entwickeln, ist einfach noch ein anderes Level.
Aber ein schlechteres Level, finde ich.
Da gibt es Leute, die davon begeistert sind.
Wie gesagt, das ist nicht meine Entscheidung.
Und deswegen bin ich wirklich auch sehr skeptisch.
Du wirst das LLM brauchen.
für Marketingzwecke und so weiter und so fort, um die User zu kriegen.
Du wirst auch da einen gewissen Login haben.
Wir haben mittlerweile auch 20, 30 Skills, die irgendwie besondere Sachen bei Giant Swarm machen und so weiter, die da jetzt in Cloud drin sind.
Also, dass wir jetzt von Cloud weg wechseln, ist unwahrscheinlich erstmal die nächsten sechs Monate.
Dass wir noch andere Sachen woanders laufen lassen, ja, aber jetzt ganz von Cloud weg, nein.
Passiert nicht.
Das ist ja nicht nur, dass die ein besseres LLM haben, dass die einfach immer am forefront of LLM sein werden.
Mir ist vollkommen scheißegal, ob die immer das Beste haben.
Ich glaube, es kommt immer ganz drauf an, was du machst.
Und wie schnell sich halt diese Router entwickeln werden.
Also Japan hat ja da dieses FUKU-Modell vorgestellt, was ja auch nur so ein Best-of-Breed-Ansatz ist und halt ein gutes Routing macht.
Und ich glaube...
Da wird halt eine ganze Menge Optimierungspotenzial liegen, dass du einfach da auf Modelle gehst, die, was weiß ich, für eine einfache Anfrage irgendwie, keine Ahnung, auch ein einfaches Modell nehmen und für, hey, ich will hier NASA-Rocket-Chip-Quantencomputing bauen, dann halt auch komplexe Sachen machen.
Ja.
So, Freunde der guten Unterhaltung.
Ich müsste auch langsam...
Ja, es war schön.
Es war uns eine Freude.
Herzlichen Glückwunsch an Carlo, dass er schneiden muss.
Selbst schuld.
Wenn du das hörst, Carlo, wir wünschen dir, dass du viel Spaß gehabt hast.
Bis zum nächsten Mal.
Alle miteinander.
Ciao, ciao.
Ciao.
