# AI Agent Economics, Token Costs, and Security Risks

**Podcast:** Die Nerd Show
**Published:** 2026-06-05

## Transcript

Schönen guten Tag, liebe Nerdshow-Freunde.
Es geht los.
Wir haben wieder eine Nerdshow.
Und wie ihr seht, bin ich auf dem Campingplatz.
Aber ich habe es mir nicht nehmen können, mich in die Sonne zu setzen.
Bin aber trotzdem hier mit Sebastian, Manuel und Carlo.
Einen wunderschönen guten Tag.
Hallöchen.
Okay, lass uns direkt den Elefanten im Raum klären.
Bist du noch nüchtern?
Nein.
Es ist aber auch schon eins.
Es ist schon ein Uhr nachmittags, da gebe ich dir vollkommen recht.
Genau.
Genau.
Und irgendwo auf der Welt ist es ja auch schon 17 Uhr, ne?
Genau, also deswegen, nein, das ist nicht das Ziel hier.
Ich weiß auch gar nicht, ob wir genug Wasser mithaben, außerdem kriegen das die Kinder.
Dementsprechend, wir haben ja Prioritäten.
Aber die Kinder sind jetzt alle frei.
Ich glaube, es wird eine ganz besondere Folge.
weil wir ja was Neues haben.
Der liebe Sebastian war ganz fleißig und hat uns den Nerd-Agent entwickelt.
Und das führt jetzt dazu, dass wir in der Telegram-Gruppe einfach die Links, die uns so umtreiben, reinballern können.
Und der uns das zu cooler Vorbereitung und Shownotes umarbeitet.
Führt aber auch dazu, dass es jetzt so einfach geworden ist, diese Dinger zu schreiben, dass wir jetzt plötzlich, ich glaube, 27 Links drin haben, die wir mal versuchen müssen, ob wir die in einer Stunde durchgeballert bekommen.
Aber mal ein richtig geiler Use Case für einen Sinnvollen.
einen Agent finden.
Ja, auf jeden Fall.
Vielen Dank, Sebastian.
Das habe ich mit Open Claw mal gewastelt, weil Open Claw auch noch wieder ausprobieren wollte.
Ich muss sagen, es ist nicht so geil wie Hermes.
Ich glaube, irgendwann baue ich das Ding noch um auf Hermes wieder.
Und ja, es ist jetzt total einfach geworden.
Das heißt, wir können den Podcast jetzt locker irgendwie in so eine Allesgesagt-Sache umwandeln und für vier Stunden reden.
Und sind dabei noch das Skill zu improve, über welche Sachen reden wir denn jetzt ganz ausführlich, was kann man so im Vorbeigehen mal miterzählen, was ist irgendwie Spezial-Nerd-Wissen und wo lohnt sich die Diskussion.
Das muss ich dann alles noch rausfinden lassen.
Aber wir haben irgendwie intern hier sehr, sehr viel darüber gequatscht, wie man solche Agents aufsetzt, was das ist.
Vielleicht kann Manuel dazu auch ein bisschen mehr erzählen.
Ich glaube, der hat das meiste Background wirklich sehr gut.
Also sich viele Gedanken zugemacht, wo ich mir dachte, ach krass, so tief habe ich da noch nie drüber nachgedacht.
Und ich bin ja immer eher so der Pragmat, der sagt, okay, setzen wir mal so ein Ding auf, machen wir mal einen Workflow, keiner schreibt gern Shownotes, alle posten gerne Links durch die Gegend.
Ja, ist doch ein super Use Case für so ein LLM, irgendwie das zu automatisieren.
Genau, wollen wir eigentlich auch starten.
Total super.
Und wenn du Hermes noch kurz einweisen kriegen willst, kann ich dir sehr gerne helfen.
Ich habe ja mit dem E-Rei von Imagely eine Hermes Instanz am Laufen.
Ich kenne beide Sachen schon.
Ich hatte Open Claw noch gemacht, als es noch Moldbook hieß.
Da war es neu und krass und uh.
Und dann haben wir Hermes gemacht, weil das dann plötzlich so der New Contender war.
Und dann hatten mir aber ganz viele gesagt, es hat sich aber richtig was bei Open Claw getan.
Das ist viel besser geworden.
Und gib dem nochmal eine Chance, das musst du nochmal machen.
Der Peter Steinberger, der brennt ja irgendwie angeblich für eine Million Dollar pro Monat Tokens weg, um das Produkt weiterzuentwickeln.
Peter, ich habe dich richtig lieb, du weißt das.
Aber davon sehe ich jetzt noch nicht so viel.
Das wird auf jeden Fall ein TikTok-Short.
Genau dieser Teil.
Auf jeden Fall.
Mit raus schneiden, Toddy G.
Nein, ich finde halt irgendwie die Anwendung, also das Installieren von OpenClaw ist immer noch sehr, sehr tech-driven.
Also du musst wirklich echt Ahnung haben.
Das war dann auch irgendwie, das hat dann auch erstmal nicht funktioniert.
Das ist ja auch mein Main Agent für meine internen Dinge, die ich tue.
Dann wollte ich nicht, dass ihr irgendwie auf meine Vaults zugreifen konnt.
Also musste ich das irgendwie sandboxen, was wir hier mit dem Nerd Agent machen.
Das war etwas, wo ich einfach, das hätte, glaube ich, jemand anderes nicht geschafft, der nicht so viel Basiswissen in Programmierung und Linux und Containern und Docker gehabt hätte.
Ja, absolut.
Wenn wir da schon gerade sind, das Gegenbeispiel ist nämlich Hermes, die nämlich ein Hermes Desktop rausgebracht haben, hatte ich auch in den Show Notes gesehen.
Und die gehen voll auf, die machen das jetzt für den Nicht-Techie zugänglich.
Und ist tatsächlich ziemlich gut geworden.
Also, und du kannst es dir neu installieren, auf Windows auch.
Sonst war früher immer nur Mac und so weiter.
Du kannst es dir auf meinem Mac, kann ich es einfach installieren.
Der erkennt meine Hermes-Instanz.
Der dockt sich direkt dran.
Also, ist schon ziemlich cool.
Dann hänge ich da direkt das Thema Microsoft dran, denn die haben jetzt auch vor, Co-Pilot zu so einer super App zu machen, die Hintergrundagenten hat, so wie Scout.
OpenClaw hat jetzt auch diese native Windows-App, aber Microsoft hat so eine policygetriebene Sandbox.
Und das führt jetzt dazu, dass eigentlich das Ganze von Terminal-Nerd-Tools richtig in so OS-Level-Workflows reinkommen.
Dass man dann wirklich sagt, räum mal meinen Download-Folder aus, was irgendwie so ein typisches Beispiel ist.
Gemini hat das ja auch, also Google hat das auch mit Gemini Spark.
Also ich glaube, alle machen das jetzt.
Und ich glaube da und auch da nochmal wieder, Peter, ich habe dich richtig lieb, das hast du richtig gut gemacht.
Ich glaube, der Vorteil von Open Claw ist die Community.
Also da hast du so, es gibt ja dieses Clawed Hub, das ist so ein Repository von Skills, die auch teilweise battle-tested sind.
Manche haben auch Würmer drin, aber die meisten sind schon ziemlich gut.
Wenn irgendwas irgendwie mehrere 10.000 Stars hat, dann weißt du dann auch schon, das ist schon echt amtlich.
Und da sind dann Sachen drin wie, keine Ahnung, dass du mit Apollo von irgendwelchen Kontakten, die du kennenlernst, irgendwie die Telefonnummer raussucht, die ganzen Profile raussucht, das anreichert.
dann für dich irgendwie in einem, was weiß ich, Obsidian irgendwas anlegt und so.
Diese Sachen funktionieren schon sehr, sehr gut und da ist eigentlich auch, glaube ich, die Stärke von dem Produkt.
Ich glaube, wenn du irgendwas haben willst mit, räume mal in meinem Google Drive irgendwie den Müllhalter auf, das kannst du dann wahrscheinlich mit Gemini Spark super gut machen.
Wenn irgendwie bei OneDrive die Bukakas, dann kannst du das halt irgendwie wahrscheinlich mit dem Microsoft Copilot Ding machen.
Ich finde die anderen Sachen, also ich finde auch Coburg ist sehr, sehr stark.
Also mir sagen immer auch ganz viele Leute, wenn ich denen halt mein OpenClaw oder Hermes Zeug zeige, sagen immer so, ja, kann ich mit Coburg auch machen.
Der kann auch Loops, der kann auch dies und das.
Irgendwas sagen, wer am günstigsten ist?
Also mal so rein von der Kostenseite, ist da irgendeiner weiter vorne?
Ne, aber ich habe heute Morgen, das ist aber Secondhand Smoke, habe ich mich mit einem von unseren Jungs bei Wendis unterhalten, das ist das CRM, was wir gerade bauen, dass der sagte, in drei Tagen schaltet Entropic Cloud für Open Claw auf jeden Fall ab.
Also du kannst und darfst dann Open Claw nicht mehr mit Cloud Code zusammen verwenden, also dürftest dann nicht mehr sowas machen, dass dann Open Claw sogar Cloud Code remotet.
Also das weiß ich von vielen, dass sie das machen, dass sie zum Beispiel so ein Gateway haben, wo die dann einfach so Aufträge geben.
Programmiere mal eine Marketing Webseite, programmiere mal ein Dashboard und der gibt es dann an Cloud Code, an eine Cloud Code Instanz weiter.
Und das darf jetzt nicht mehr über Max Plans gemacht werden, sondern dafür gibt es einen separaten Only Pay Per Token Plan, den sie darüber laufen lassen.
Das heißt, wenn du das machst, ist es dann halt auch recht schnell arschteuer.
Aber das heißt, die Max-Plans, die gaten sie jetzt richtig rein in das Cloud-Harness im Prinzip.
Und Achtung, Cloud-Max, wenn du eine Firma bist, 150 Leute ist Ende.
Über 150 Leute kannst du auch kein Cloud-Max mehr nehmen.
Dann musst du in den API-Raum.
Ist vorbei.
Dann musst du per API-Tool sein.
Wir bauen das sehr, sehr strukturiert, bauen wir unsere ganze Architektur und die Landschaft auf.
Genau aus dem Grund, weil diese Frage, ist das eine teurer als das andere, das will ich überhaupt nicht beantworten müssen.
Sondern ich schneide bestimmte Layer einfach raus.
Ich will auch ein Hermes wirklich komplett austauschen können gegen was auch immer.
Aber diese vertikale Integration, die alle versuchen, die will ich unbedingt vermeiden.
Du musst natürlich aufpassen, es gibt noch nicht überall.
Auf ein Modell.
Es gibt halt nur noch nicht überall Standards.
Also die ganze Austauschfähigkeit ist noch nicht so 100% gegeben.
Du hast jetzt schon Skills und ähnlich und Soul, MD und es nähert sich an, aber du hast noch keine wirklich Standardisierung.
Das merken wir bei dem Agent Bauen, dass wir noch sehr hart darauf warten, was für Standards sich entwickeln.
Ich glaube, da können wir einen eigenen Podcast machen.
Wir haben außerdem viel zu viel Links.
Wir reden schon über das 10 Minuten und haben noch keinen einzigen Link gesprochen.
Doch, doch, doch.
Einen habe ich getroppt.
Einen hast du getroppt, genau.
Vorbeigeht.
Und den Hermes Desktop auch.
Okay, dann machen wir ganz schnell.
Okay, so viele Links zur Auswahl.
Mit welchem starten wir?
Ich mache zwei.
Einen schnell und einen kurz.
Super Idee.
Jeder darf sich einen Link aussuchen, den er kurz anspricht und dann darf er bei einem reden.
So, den, den ich kurz anspreche.
Alphabet hat auch schon announced gerade, dass sie ihre 80 Milliarden geraced haben, beziehungsweise 40 Milliarden haben sie geraced und 40 Milliarden raisen sie noch.
für AI-Infrastruktur und haben auch announced, dass sie das mehrfach machen werden.
Am Ende, so gefühlt, haben die halt gesagt, naja, was Anthropic kann, können wir schon lange mit einer vierfachen Bewertung.
Dementsprechend versuchen die jetzt Geld zu raisen für diese ganze AI-Hardware.
Das machen die auch.
Das spannendere Thema ist, es gibt so eine riesen Shitshow mit verschiedenen Dingern und ich habe mich ein bisschen tiefer da reingelesen, deswegen will ich es kurz erklären.
Können wir darüber diskutieren oder nicht?
Es gibt einen Punkt, dass Nvidia hat für 5,4 Milliarden an eine neu gegründete Firma, die Valor irgendwas heißt, Hardware verkauft und das komplett als Revenue gebuckt.
Wenn man sich Valor anguckt, hat aber Valor 1,9 Milliarden von Nvidia bekommen als Geld und dann 3,5 Milliarden von einer anderen Firma als Credit.
Die Firma, die dann Credit gegeben hat, hat das danach in so Rentenpapiere umgemünzt, wo Leute halt, wo das dann in Pension Funds und so weiter reingeht.
Wo Leute feststellen, okay, das ist doch ein Circle Joke, das ist doch genau dieses Ding, worüber wir reden, dass die sich Geld von links nach rechts schieben.
Das Problem ist, man muss da tiefer reingucken.
Ja, das ist komisch, weil sie sich natürlich selbst Geld gegeben haben.
Aber dieses Valor Compute Infrastructure Ding hat einen Vertrag mit XAI.
XAI ist verpflichtet, hat da quasi ein Leasing Agreement mit.
und zahlen über fünf Jahre wesentlich, wesentlich mehr als die 5,4 Milliarden.
Haben jetzt in den ersten drei Monaten 2,6 oder 2,5 war das, keine Ahnung, schon 800 Millionen gezahlt in den ersten sechs.
Also kann man selbst nachgucken, wenn man will, aber werden definitiv wesentlich mehr zahlen als die 5,4.
Und dann fragt man sich, aber warum hat der jetzt denn XAI gemacht?
XAI wiederum hat das gemacht, um einen Operations-Vertrag mit Valor zu machen.
dass sie nicht Capital Expenditure haben, dass sie nicht 5,4 Milliarden für Grafikkarten ausgeben, sondern eine Milliarde pro Quartal, am Ende irgendwie 12 Milliarden über drei Jahre, keine Ahnung was, oder eine halbe Milliarde, irgendwas, dass sie halt mehr Geld ausgeben, aber das als Operationskosten betiteln können und das damit profitmindern ist und nicht abgeschrieben werden muss.
Weil das nicht Capex ist in einer Operation.
Es ist nicht CapEx, sondern OPEX.
Genau.
Und das ist ja immer so ein bisschen der Versuch.
Das versuchen scheinbar relativ viele Leute mit diesem Konstrukt.
Michael Saylor sagt, das ist hier Schmuh und alles falsch.
Stimmt nicht ganz.
Ich finde es auch gar nicht so schlimm, weil also der Vertrag besteht über fünf Jahre mit XAI und die müssen das zahlen.
Oder halt pleite sein und das werden sie nicht sein.
Das heißt, die Leute, die auch diese Rentenpapiere kaufen, kriegen ihre Zinsen zurück und Nvidia verdient sogar wesentlich, wesentlich, wesentlich mehr als die 1,9 Milliarden.
Das ist so wie so ein Leveraged House Deal.
Du hast halt einen Kredit, der kriegt seine 6% oder so und allen Rest Profit kriegst du.
Dementsprechend ist das eigentlich gar nicht so schlimm.
Du musst nur ultratief reingucken.
Für XI ist es leider schief gegangen, weil PwC hat gesagt, nee, die Idee war doof.
Ihr habt quasi Hardware gekauft, aber zahlt sie anders.
Also, das ist CapEx.
Also, leider hat jetzt XAI CapEx von 5,4 Milliarden für 12 Milliarden gekauft.
Wie viele Milliarden es sind, weiß ich nicht, aber ein Riesenteil mehr.
Wow.
Was Schlechtes aus beiden Welten erreicht.
Man muss halt ultratief reingucken, stelle ich immer wieder fest.
Gerade bei Twitter, weil irgendwie da 90% ist eh schmuh und da müsst ihr ein bisschen hinterher gucken und auch bei solchen Sachen.
Das ist alles nicht so einfach.
Natürlich sind das Financial Plays und so weiter und ja, jede große Firma hat ein Debt-Sandwich, irgendwas aus Steuergründen in Europa, um Steuern zu sparen in Europa und so weiter und so fort.
Das sind aber einfach die Regeln, nach denen gespielt wird und nach den Regeln spielen die halt und sie versuchen halt Sachen zu optimieren innerhalb dieser Regeln.
Deswegen fand ich auf jeden Fall spannend, dass man so anfängt, das kann ja gar nicht sein, Nvidia kauft ihre eigene Hardware und macht dann 5,4 Milliarden Revenue und irgendwelche Rentenkassen zahlen den Bill.
Ja, langfristig.
Ich weiß nicht genau, ob sich jeder Zuhörer das alles so vorstellen kann, was das für Summen sind.
Ich glaube, ich hatte das auf LinkedIn gepostet, das letzte Mal schon.
Wenn Google 80 Milliarden Dollar aufnimmt, dann ist das ja nur so ein kleiner erhobener Mittelfinger in Richtung Entropic, die kurz vorher nochmal 65 Milliarden geraced haben und so zeigen kann.
Also was ihr könnt, könnt ihr schon lange.
Und bei den 65 Milliarden hatte ich schon einmal gepostet.
Nur damit man sich das einmal vorstellt, die Relation.
Wenn ich alle Startups in Europa nehme und alle Funding Rounds nehme, dann kommt man auch auf 65 Milliarden.
Das heißt, Entropic hat in einer Runde so viel aufgesammelt wie alle Startups in Europa überhaupt.
Und das ist halt ultra krass.
Und jetzt macht Google das gleiche nochmal und so weiter und so fort.
Und jetzt muss man sich einmal bei den Tokens fragen.
Ich weiß nicht, checkt ihr eure Usage?
Also ich weiß, ihr seid alle auf irgendwelchen Plänen und so.
Ich auch.
Ich gucke trotzdem, wie viele Tokens ich so verbrauche.
Es gibt da so ein cooles Tool.
Das heißt CC-Usage, wo liegt der denn da?
Bei mir ist es harmlos, bei den Mitarbeitern natürlich.
Und weil wir haben ja immer diesen Spagat, sagen wir ihnen jetzt, bitte passt ein bisschen auf, aßt nicht so rum.
Oder sagen wir, nee, bitte gib Vollgas.
Weil das ist ja so, du hast auf der einen Seite Leute, die so ein bisschen wirtschaftlich denken können, die denken sich, ja wie geil.
Brenn jetzt hier 200 Dollar durch, aber ich habe auch mal eben den Tagessatz von einem Freelancer für 800 gespart.
So denkt ja nicht jeder normale Angestellte, der denkt sich, oh Gott, scheiße, ich habe 200 Euro verballert.
Okay, wenn er die 200 Euro für Mist verballert hat, dann ist natürlich irgendwie ein bisschen doof, aber jetzt gerade ist ja so Builder-Time und probier aus und krieg's irgendwie klar.
Aber das passt ganz gut zu einer anderen Shownote, dass Amazon ja ihr internes AI-Leaderboard abgeschaltet hat, weil da quasi belohnt wurde, wer am meisten Tokens verballert.
Ich weiß auch ein Insight von Shopify, wo die auf so einer Konferenz alle zusammengesessen haben, auf einem großen Monitor oben sich gefeiert haben, wer mehr Tokens verballert hat.
Aber das führte eben dazu, dass die auf diesem ChiroRank-Dashboard einfach sinnlos Agenten haben laufen lassen, mit dem Ziel einfach nur im Usage-Leaderboard aufzusteigen.
Und das führt natürlich dann nur zu aufgeblasenen Cloud-Kosten.
Sorry für den kleinen Exkurs.
Manuel, wie viel brennst du so durch?
Ich habe gar keine Ahnung.
Interessiert mich auch nicht.
Mich interessiert das schon.
Also ich habe halt eine Subscription und wenn die alle ist, ist die alle.
Ja, aber du musst dich ja mal fragen, was passiert, wenn die Subscriptions, wenn die sagen, die gibt es jetzt nicht mehr.
Also bei unseren Leuten, die das so richtig hardcore machen und auch einschließlich mir, habe ich eigentlich API-Token-Kosts von zwischen, also es geht eigentlich mehr so bei 1000 Euro los und die heftigen Player machen auch schon mal 10.000 oder 15.000 im Monat.
Und zahlen dann, sind dann auf so einem Max-Plan, ja, von 200 Euro.
Das heißt, dass es halt gerade ultra krass subsidiarisch ist, damit sie an die Daten kommen, damit sie an die Repositories kommen, auf denen sie lernen können.
Und irgendwann kommt der Moment der Wahrheit, wo sie das abschalten müssen.
Jetzt muss ich mir einmal sagen, ich glaube, 1000 Euro, das würde ich noch bezahlen.
Aber ob ich jetzt 10.000 oder 15.000 Euro bezahlen würde, Boah, weiß ich nicht.
Nee, ist mir völlig glatte.
Also es geht wirklich nur um das Verhältnis.
Wenn ich weiß, ich kriege irgendwie für 1000 Euro einen Vollzeitentwickler, so nach dem Motto, und ich habe Bedarf für 10, dann zahle ich auch 10.000, wenn sie wirklich die Performance machen.
Genau, wenn das über 10 geht.
Aber das ist halt irgendwie, also ich glaube einfach, dass der Workflow, den sich da viele Leute, also ich glaube, dass die super viele Tokens werden momentan da so einfach krass missbraucht.
Also ich glaube, wenn ich mir unseren Workflow angucke, dann arbeiten wir sehr stark damit.
dass wir halt so PRDs haben, das sind die Product Requirements Documents, die gehen in so RFCs, die sind halt etwas technischer.
Wir haben für die Architektur haben wir quasi Architekturdokumente, die dann auch nochmal so ein Architectural Decision Record, sogenannte ADRs und so.
Und damit wir eigentlich in der Lage sind, zu jedem Zeitpunkt eigentlich immer ein Feature nochmal neu zu generieren, gerade wenn du irgendwie mit mehreren Leuten daran arbeitest und dann bewegt sich unten drunter die Architektur, dann kannst du eigentlich immer aus dem...
ADR und dem PRD nochmal einen neuen RFC ableiten und kannst dann ein Produkt neu generieren.
Wenn du das drei, viermal machst, bist du aber auch locker bei einem komplexeren Produkt irgendwie 1000 Euro in Tokens eigentlich los.
Und das ist etwas, wo ich denke, dass der Workflow, der funktioniert jetzt gerade, wo das so heavily subsidized ist, der funktioniert aber nicht mehr, wenn jetzt plötzlich die Tokens auch tatsächlich Geld kosten.
Und ich gucke da schon sehr genau hin, weil mit dem IPO wird ja genau das passieren.
Mit dem IPO sind sie plötzlich an der Public Surveillance.
Da kannst du nicht mehr den Aktionären sagen, ja, wir müssen ja Marktanteile hier gewinnen, sondern die sagen dann, hier, wo ist unser Profit?
Und dann werden sie die Sachen umschalten.
Also mein Hauptpunkt hier ist, dass wir so schnell sehen, wie sich das wandelt, dass ich glaube, es wird sehr viele Open-Source-Alternativen geben.
Es wird einen enormen Preisdruck geben.
Und ich kann total nachvollziehen, dass Anthropic jetzt halt sagt, dass die Leute nur ihren eigenen Harness nehmen können.
Und ich habe drei verschiedene Subscriptions.
Ich tingle halt ein bisschen rum, da und da.
Ich mache mich aber von keinem abhängig.
Und dann nutze ich halt was anderes.
Und ich glaube, das ist von Anfang an.
Also so wie wir das bauen, ist, dass wir tatsächlich immer auch so ein Gate haben, ein Cost-Gate.
reinmachen, dass er nicht einfach so blind einfach so wegläuft.
Also jeder, wir nennen das Assistance, das sind so Skill Bundle quasi.
Die wissen auch, was sie quasi ausgeben können und was nicht.
Und wir machen von Anfang an, denken wir in Token Effizienz.
Und ich habe auch ein lokales LLM hier laufen, das habe ich das letzte Mal auch schon erzählt, Gemma.
Das wird einfach nur noch besser werden.
Die Frage ist jetzt eher, wir diskutieren gerade, ob wir einfach eine fette Maschine hier hinstellen, dass wir bestimmte Sachen einfach komplett über so lokale LLMs machen lassen, weil ich nutze einiges so mit Quen und so weiter, Open Source LLMs und DeepSeq 4.
Das ist total in Ordnung.
Das ist echt total ein Problem.
Okay, dann kann Open Source irgendwann helfen, aber ich meine, irgendwo muss es halt betrieben werden und wenn dir die Maschine zu Hause halt nicht reicht, dann hilft es dir auch nichts, dass es Open Source irgendwo anders ist, dann ist es ein Infrastructure-Play.
Aber um mal einen Schritt weiter zu kommen hier mit unserer Linkliste.
Zum Thema Effizienz und Token reduzieren hat Heisen einen ganz coolen Artikel rausgebracht.
Da reden sie über semantische Anker.
Ich packe es in die Shownotes rein.
Die sollen den Prompt-Kontext für generisches Coden deutlich verkürzen.
Das heißt, man hat so ein paar Begriffe definiert, die jedes Latched-Language-Model, was irgendwie Coden kann, gut kennen.
und dann so Referenzen wie Clean Architecture, Code Smells.
oder Stilvorbilder, so Zeug, dann für ein Sprachmodell als ganzes Regelwerk hinterlegt.
Das heißt, du musst es nicht nochmal neu beschreiben, der muss nicht nochmal tierisch viele Tokens dafür verballern, sondern wenn du diese Sachen benutzt, dann wird es halt deutlich effizienter.
Daher auf jeden Fall mal reingucken, wer so codet und das dann in seinen Agents einfach verwenden.
Damit kann ich den Tokenverbrauch senken.
Ich habe es noch nicht ausprobiert, aber klingt total logisch.
Ja, cool.
Genau, und das ist genau das, was wir halt auch letztendlich sehen werden.
Und wenn wir mal weiterspringen in den Show Notes, auch hier Nvidia Spark.
Also da passiert ja auch auf der Hardware-Seite komplett viel.
Und ich glaube sehr stark daran, dass wir sehr viel LLMs sehen auf unserer eigenen Infrastruktur.
Das ist jetzt vielleicht noch zwei, drei Jahre hin.
dann wird sich das wieder zu einer dezentralen Compute-Infrastruktur entwickeln mit deinem eigenen LLM.
Also da glaube ich stark dran.
Nvidia Spark ist eine Grafikkarte für Endkonsumenten-PCs, die dann aber sehr dazu fähig ist, auch so ein LLM laufen zu lassen.
In a nutshell.
Ja, und dann, lieben Olli, haben wir auf dem Campingplatz gerade verloren.
Wahrscheinlich hat er in den ersten zehn Minuten schon seinen Dataplan durchgeballert.
Seine 2,4 Gigabyte sind jetzt einfach schon alle.
Die sind plumpsklo gefallen.
Gut.
Vielleicht kommt er gleich noch dazu, aber das Netz sah echt nicht so gut aus.
Zu den lokalen Modellen.
Google hat ja gerade irgendwie das Gemma 4 12 Milliarden Parameter vorgestellt, was ja auch so ein mittelgroßes LLM ist, was sie irgendwie on a mobile phone local irgendwie machen können.
Und du kannst es über Ulama, Hugging Face und so verschiedene Outlets einfach ausspielen.
Das ist eh total cool, was jetzt alles so an lokal kommt.
Ich erinnere dich noch an Stable Diffusion 1.5?
Ja.
Wie creepy man da irgendwie versucht hat, so ein bisschen Bilder mitzumachen.
Damals war es richtig geil, aber eigentlich noch so hart.
Das läuft jetzt auf dem iPhone 17s.
Total krass.
Du brauchst irgendwie drei Sekunden Generierungszeit für ein 512x512 Bild.
Damals brauchst du da die fette Nvidia-Karte für.
Ja, das glaube ich eigentlich auch.
Ich glaube auch daran, dass die Techniker das schon irgendwie hinkriegen werden, das so stark zu optimieren, dass die Kosten dann irgendwo auch so ein bisschen in was, was rechnet man denn für so einen Plan ab und was kann man da irgendwie machen, was kann da irgendwie reinpassen.
Nur, ich mache mir die Sorgen auch, wenn man darüber redet, dass man irgendwie beim Funding gerade echt einen krassen Stunt macht und es irgendwelchen Rentenleuten verkauft, über drei Packages gebundelt, dann sind die Techniker halt doch noch nicht so weit.
Die Rente muss aber morgen bezahlt werden.
Ja, ganz realistisch.
Das ist doch wirklich so digitales Hailership.
Die lassen uns jetzt gerade an die Nadel und dann werden die Preise angezogen.
Ich meine, passiert ja gerade schon aktiv.
Was haben wir noch?
Wer möchtest du?
Also ich könnte mal ein bisschen über Krypto.
Ich versuche immer ein bisschen aufzupassen, dass wir nach der alten Historie wegen noch ein bisschen Krypto hier unterbringen.
Also, ja, ihr seht ja, habt ja mitbekommen wahrscheinlich gerade, dass der Markt ziemlich dippt.
Ich will auch gar nicht spekulieren, wieso, weshalb, warum.
Aber es hat jetzt erstmal dazu geführt, dass Michael Saylor mit seinen Strategy-Jungs, der hat für 74.000 Dollar im Schnitt seine ganzen Bitcoins gekauft.
Jetzt sind wir irgendwo bei 60.000.
Das heißt, der ist mal eben 10 Milliarden in den Miesen, bleibt aber immer noch bold.
Sagt, das ist so ein bisschen, ja, so ein...
Rotationswechsel, Kapitalrotation, weil es braucht halt Kohle für die ganze AI-Infrastruktur.
Also dass selbst Krypto darunter leidet, dass jetzt einfach mehr Kohle für AI gebraucht wird.
Es ist wahrscheinlich ein bisschen was dran.
Gucken, wie sich das auszahlt.
Aber ja, ich merke einfach, wenn wir so viel Kapital für Rechenzentren, Chips und Aktien rotieren, dann hängt Bitcoin da voll mit drin und andere Kryptos wahrscheinlich auch.
Also ich glaube nicht, dass der Dip irgendwie damit zusammenhängt, dass die EU da jetzt irgendwelche strengeren Regeln irgendwie gerade aufgerufen hat.
Mit Mika tritt ja jetzt gerade in Kraft oder so.
Das ist aber etwas, was jetzt schon lange irgendwie andeutet.
Ich glaube, wie alle meine Börsen, wo ich so unterwegs bin, nicht, also die quasi, wo ich nicht eigene Keys habe, die sind auch schon safe, die haben irgendwie schon immer announced, wir haben jetzt irgendwas in Lichtenstein und so, über das der Adel abläuft.
Bei den anderen Sachen glaube ich, das sind einfach so Bewegungen, wo, also ich glaube, wir haben jetzt gerade einfach so ein IPO-Fenster, wir haben irgendwie SpaceX, wir haben Entropic.
Der Pip Klöckner aus dem Doppelgänger-Podcast hat das ja letztes Mal auch schon gesagt.
Also wenn ein Tropic an den Markt geht, dann werden sie das wahrscheinlich mit einer Bewertung von einer Billion tun.
Und er glaubt aber, dass die Firma das doppelte Wert ist.
Also er sagte, ich wäre relativ bullish, dass ich das auch nochmal verdoppelte.
Klar wird das jetzt einen riesen Tipp geben, wenn die Ersten dann auch irgendwie bei einem Liquidations-Event rauskommen.
Aber er sagte, das, was die gerade machen, das ist ultra krass.
Da passiert so viel und es ist einfach, this is the way, das ist die Zukunft.
Er hat es so nicht gesagt, er ist sehr bullisch.
Du hast da gerade ein zweites Thema schon mit reingebracht, nämlich die Mika-Regeln.
Nur noch der Hinweis an alle Hörer, am 1.7.
treten die in Kraft und falls ihr noch an irgendwelchen dubiosen Exchanges, Coins oder sogar Fiat rumliegen habt, zieht die vorher da raus, denn ab da kannst du die in der EU, wenn Mika eintritt, Mika heißt Markets in Cryptoassets, dann einfach nicht mehr handeln.
Das heißt, es ist einfach gesperrt und ob die dann die Zulassung kriegen oder nicht, I don't know.
Ich habe, wenn da mal irgendwas bei Kraken oder Binance, Kraken ist safe.
Binance konnte ich jetzt auf Anhieb nicht so ganz sicherstellen.
Also irgendwie ja, dann aber auch irgendwie doch nicht.
Also Binance muss ich auch nochmal gegenchecken.
Checkt, also do your own research.
Aber erster Siebter ist dann Mika aktiv.
Cryptocheckt.
Cryptocheckt.
Was haben wir noch?
Ja, SpaceX hast du gerade angerissen, ne?
Der größte Bankraub der Geschichte, zweitgrößte, hat Zitat von Sascha Pallenberg.
den ich eigentlich schon einen ganz guten Typen finde.
Manchmal ist er auch ein bisschen off, aber ist schon okay.
Ich kenne ihn auch aus diesen Web 2.0-Zeiten, den Barcamps und so.
Ja, genau.
Und der hat irgendwie einen großen Blogpost auf seinem Metacheles-Blog gemacht darüber, wo er das ein bisschen einfach mal aufzieht, wo er sagt, wie hat Elon Musk das geschafft, sehr viele Bullshit-Filmen zusammen zu bundeln und zu einem...
Mega-Exit zu machen und den ganzen Retail-Ownern, ich meine, ich habe gestern die Nachricht von Trade Republic bekommen, dass Trade Republic offizieller quasi ICO-Launch-Partner von SpaceX ist, wo ich mir denke, natürlich wird der Herbert um die Ecke, der auch irgendwie mit seinem Fernrohr immer den Sternenhimmel beobachtet, auch mal in den Weltraum investieren.
Und dem auf gar keinen Fall klar ist, in was er da alles so investiert.
Wie seht ihr das?
Also ich fand diese ganzen Kreuzverbindungen, dass er damit dann irgendwie einen XAI finanzieren kann und so weiter, halt wirklich, wirklich wild.
Und ich meine, es gibt viele schöne andere Sachen, die jetzt dadurch, dass ja wirklich irgendwie Dinge im Weltall passieren, wo man gut investieren kann, also wo so Technologien, die du brauchst, um da irgendwie hochzukommen, jetzt total profitieren, wenn die auch mal ein bisschen Geld bekommen.
SpaceX, ich finde es eine, also ich glaube, es ist ein Riesenscam.
Ich glaube, letztes Mal hatten wir es schon gesagt.
Du bist der Exit.
Und das glaube ich auch.
Also ich glaube, das wird richtig, richtig übel erstmal runtergehen.
Aber Never Betta Gain Stalen.
Also muss man auch immer drauf achten, dass...
Ich finde es ja gut.
Da spielt das Spiel schon.
Irgendwie die Standards & Poor 500 Regeln für so Mega-IPOs.
Ich habe vorhin ein ICO gesagt, ein IPO.
Dass die auf jeden Fall sagen, nee, nee, es gibt erstmal so ein Zwölf-Monats-Fenster, wo wir uns das angucken, bevor wir die reinnehmen.
Dann hast du ja sofort das ganze passive Geld aus den ETFs, was in sowas reinfließt.
Das finde ich gleich unfassbar.
Genau, da gab es irgendwie die Überlegung, dass der S&P da so eine Kurzabkürzung macht für die.
Aber sie haben gesagt, nee, lassen wir zwölf Monate.
Bewährungsphase muss irgendwie sein.
Profitabilitätsprüfung, Free-Float-Anforderungen bleiben alle bestehen.
Und so kann eben SpaceX, OpenAI, Antropic und so dann nicht über die Schnellspur in S&P.
Und genauso wie du sagst, dadurch müssen die ETFs noch nicht so schnell nachkaufen.
Und das hilft vielleicht ein bisschen, dass es nicht ganz so schlimm platzt.
Aber ist das nur bei S&P, aber beim Nasdaq-Hunder kommen die mal rein, oder?
Ich glaube Nasdaq, ja.
Genau, das war nämlich mein Ding, dass sie in Nasdaq nämlich schon den Fast Entry bekommen.
Also das, was ich gelesen hatte, nach 15 Handelstagen, danach kommen sie direkt rein.
Und deswegen, wenn du in den Nasdaq investierst, als ETF, bist du auch gezwungen, da eben halt mitzugehen.
Und die klassische Verkaufssperre ist nämlich aufgehoben auch.
Und das ist natürlich auch spannend, dass du direkt nach den ersten Quartalszahlen kannst du im Prinzip raus.
Also die Insider können, oder die jetzt Anlass eigener sind.
Das ist alles ganz weird, warum man das machen sollte.
Warum nicht die ganz normalen Regeln?
Und deswegen, für mich ist das, ich habe es letztes Mal auch gesagt, es ist alles komisch.
Es hat alles ein Geschmäckle.
Und andere positionieren sich da klarer, ich bin da nicht weit genug drin, da wirklich eine fundierte Aussage zu machen.
Aber alles drumherum, nee, das klingt nicht gut.
Ich stimme dir zu.
Ich kriege gerade einen Wasseralarm in Thailand.
Ein Wassersensor, so ein Acara Wassersensor.
Freut man sich.
Aber gut, die haben ja auch ein bisschen Luftfeuchtigkeit gerade um die Zeit da.
Ah, ist nicht das Haus jetzt unter Wasser?
I don't know, I don't know.
Aber falls man es eben gehört hat, eben lauter Alarm hier.
Noch kurz mal abschließend.
SpaceX geht am 12.
Juni oder so.
Wann ist der Börsengang?
Ist jetzt irgendwann, oder?
12.
oder 15.
Ich weiß es nicht, aber Mitte des Jahres.
Also es ist noch maximal eine Woche Zeit.
Ich bin gespannt.
Also es kann Märkte ganz übel bewegen, aber müssen wir jetzt auch tiefer reinlesen, um zu sagen oder sowas.
Hatten wir Antropic IPO auch schon darüber geredet?
Die haben irgendwie Confidentially angemeldet.
Die wollen dann auch.
Das dauert jetzt dann noch so ein bisschen.
Ich glaube, das ist dann erst ein bisschen später im Jahr.
Also zwei, drei Monate kann es dann noch dauern.
Aber da geht es ja genauso hin.
Und bis dahin haben zu viel, zu viele Leute der Hochfinanz noch Interesse, dass es halt weiter hoch geht.
Und auch wir haben die Midterms, deswegen wird es weiter, also da wird jetzt im Sinne von, das kracht jetzt alles ab.
Das könnte ich mir jetzt aus der gesamtübergreifenden Sicht jetzt nicht so richtig vorstellen, aber klar, Börsen kann man halt nicht vorhersagen.
Das glaube ich auch.
Aber bei Entropic muss ich auch sagen, also die machen das natürlich ganz gut.
Die haben ein sehr gutes Playbook, auch Marketing-Playbook.
Die bereiten sich auf ihren IPO auch sehr gut vor.
Wir haben zum Beispiel heute ein Thema gepublished, oder gestern, und zwar Recursive Self-Improvement.
Da weiß ich, haben wir letztes Jahr auf dem Brust, haben wir hier drüber geredet, dass wir gesagt haben, dein Satz, Manuel, um dich zu zitieren, war, was meinst du, warum die alle so hart darauf gehen, dass die LLMs programmieren können?
Weil wenn sie plötzlich programmieren können, dann ist quasi nur noch Energie die limitierende Ressource, wie schnell du dein Produkt weiterentwickelst.
wenn du dann auch alle Weichen dazu stellst.
Und ich glaube, der Blogpost geht genau darum, dass sie so ein bisschen, einmal so ein bisschen so History, also wie viel Code pro Tag wird inzwischen komplett automatisch eingecheckt und so.
Und jetzt sagen sie, okay, wie machen wir es denn rekursiv Self-Improvement?
Also wie bringe ich einem LLM bei, dass es einfach selber...
entscheiden darf, dass es proaktiv irgendwas macht, irgendwas verbessert.
Sagt so, hier, ich habe hier gesehen, hier, ich habe unsere Logs alle durchgelesen, was ja Menschen ja nicht so gerne machen.
Ich habe hier einen Bottleneck identifiziert, hier ist direkt der Pull-Request, willst du den durchwinken oder vielleicht Features weiterentwickeln, weil sie irgendwie merken, dass Menschen an einer ganz speziellen Stelle einen Prozess abbrechen oder hängen und so weiter und so fort.
Und die einzige limitierende Ressource ist eigentlich Energie und ich glaube, sie haben noch einen Human in the Loop.
Aber der wird ja wahrscheinlich dann auch immer irrelevanter werden.
Energie und Rechenleistung noch.
Rechenleistung ist ja auch gerade schon knapp, außer bei Elon.
Der hat, der hat.
Und Human in the Loop.
Also ich glaube, der zentrale Punkt hier, den nahezu alle unterschätzen, ist der Punkt, dass wir das gar nicht begreifen können, wenn das einmal funktioniert.
Wir können die Geschwindigkeit, in der das dann sich weiterentwickelt, überhaupt nicht fassen.
Abschätzen.
Genau.
Also deswegen, ich habe mit euch ja so ein bisschen meine Architekturgedanken geteilt und so weiter.
Ich bin ja schon seit länger da dran, zu sagen, alles klar, ich will dieses Service-as-Software, also Human-led-Service-as-Software wirklich halt bauen.
Ich glaube, da ist ein Riesenmarkt.
Und das, was wir jetzt gemacht haben, wir haben diese Architektur.
Ding als Blaupause genommen und wir haben eine Maschine gebaut, um die restliche Maschine zu bauen.
Genau das haben wir jetzt gemacht.
Und da bin ich auch ziemlich bullisch, dass das funktioniert und die ersten Outcomes sind auch ziemlich cool.
Und wenn das funktioniert, dann ist das Einzige wirklich nur noch, dass die Menschen, die arbeiten, ihr Wissen teilen und immer wieder drauf schauen und immer wieder in den Loop das halt reingeben.
Deswegen hat mein Bild Immer diesen selbstlernenden Loop mit drin.
Und ich glaube da radikal dran.
Du hattest das ja vor einer Woche geschickt und ich habe mich da ziemlich tief mit auseinandergesetzt.
Ich glaube, da steckt schon extrem viel Sinn drin.
Nicht nur, wie du sagst, Sebastian, einfach mal loslegen und ausprobieren, sondern auch so ein bisschen die darüber liegenden Paradigmen sich einmal klar zu machen.
Übrigens zu dem Antropic-Thema war sogar heute Morgen bei ARD Börse ein Zitat von Antropic.
Habe ich extra fotografiert.
KI kann 80 Prozent der neuen KI selbst erfinden.
KI trainiert sich selbst 52 Mal schneller als ein Mensch und KI erledigt die Arbeit von vier Jahren in vier Tagen.
Das ist Zitat Antropic rund um den Börsen.
Und deine Billionen-Vermutung, glaube ich, kommt gut hin, weil die hatten ja zuletzt zur Bewertung 900 Milliarden, die 65 Posts geholt.
Das heißt, da bist du ja schon fast bei der Billionen.
Daher denke ich auch, wenn es jetzt schnell gehen soll, dass die rauskommen, dann ist natürlich die Story der automatischen Selbstverbesserung mega gut.
Ja, das machen sie gerade gut.
Also sie haben ja ganz viel.
Man muss auch sehen, die dicksten Köcher, den haben sie da noch in der Pipeline mit Mythos.
Das haben sie auch noch released.
Das ist nur gepreviewt und das haben jetzt ganz viele gesehen und da gibt es auch ganz viel im Security-Bereich.
Da haben wir gleich noch ein paar Links, über die wir ein bisschen diskutieren können, weil die auch sehr spannend sind.
Aber aus meiner Erfahrung kann ich auch nur sagen, die machen einfach gerade total viel.
Also ich habe zum Beispiel Entropic Cloud Design ausprobiert, als das rausgekommen ist und habe es eher belächelt, weil ich irgendwie versucht habe, ein großes Figma-File von uns reinzuspielen und das Design-System zu analysieren.
Da hat er sich erstmal verschluckt und hat es nicht hingekriegt und es abgestürzt und war kaputt.
Und jetzt haben wir das nochmal probiert.
Shoutout an Thorsten Witt, der hat es gestern gemacht.
Und es ist richtig gut geworden.
Also es ist erschreckend gut.
Wir haben irgendwie gestern, weiß ich nicht genau, 10 oder 15 Customer Journeys.
mit Cloud Design irgendwie durchdesignt und du kannst einfach so elegant reingehen und einfach sagen, nee, nicht so, da soll ein Glow drauf, nee, da ist nicht genug Kontrast und so weiter und so fort.
Das hat man richtig gut verstanden, super gut umgesetzt, dass man sich so denkt, meine Güte, ja, das ist wirklich Trouble.
Und die haben halt einen krassen Vorteil, den alle anderen nicht haben.
Also ich glaube, bei diesem ganzen Self-Learning und bei den ganzen Problemen, LLMs haben ja das Ding, dass du halt irgendwie Daten zur Verfügung stellen musst.
Und wir haben ja sehr viel Redundanz in unseren Daten, Also manchmal werden Sachen doppelt und dreifach erklärt.
Gerade wenn du dann in der Kommunikation mit Kunden bist und die auch noch reinfließen lässt und so, wenn du zu viele Sachen hast, dann werden die LLMs schlechter.
Also wie kondensiert man das runter?
Und das Einzige, was wir als Enduser machen können, ist, wir können im LLM sagen, hier hast du Daten, kannst das irgendwie kompakten, aber das Wichtige soll irgendwie intakt bleiben.
Aber so ein Entropic oder so ein OpenAI intern, die haben ja noch viele andere Möglichkeiten, auf ihre LLMs zuzugreifen.
Also die können ja wirklich genau sagen, wenn sie einem LLM eine Aufgabe stellen, welche Gewichte wurden denn jetzt genau aktiviert, wo sind die Thresholds und können da wieder auch einen Umkehrschluss ziehen und sagen, ich gucke mir die aktivierten Gewichte an, welcher Teil von meinem Text hat denn dazu beigetragen und können da Optimierungen machen, von denen wir eigentlich nur träumen können.
Und ich glaube, das ist ein krasser Mode.
den sie nicht rausgeben werden so schnell, der auch irgendwie sie vor vielen Sachen beschützt, der aber dann für dieses Learning und für dieses Self-Learning sehr, sehr essentiell ist.
Ich weiß nicht, wer es reingebracht hat, aber hier in den Shownotes ist noch der Business Punk über Claude 4.8 und Dynamic Workflows.
Also sagt halt, wie das ein Wechsel vom linearen Prompting zum asynchronen Multiagenten-Software-Arbeit funktioniert.
Und es scheint ein gutes Signal dafür zu sein, wie so agentisches Coding auch an Führungskräfte verkauft wird.
Fand ich ganz interessant, kann man sich in dem Zug auch mal angucken.
Aber ja, die machen da wirklich ein extrem gutes Spiel, finde ich auch.
Da habe ich noch einen kurzen Gedanken dazu.
War nicht einmal irgendwo, ist das durch die Presse gegangen, dass L-Topic nur ein Market...
einen Marketingmenschen hat.
Deswegen wundere ich mich dafür, weil die machen ein ziemlich gutes Marketing.
Das heißt, nur wenn man diese eine Person macht, kann ich mir fast nicht vorstellen.
Das ist vielleicht auch Teil dieser Story.
Teil der Story.
Aber einfach nur, ja, großartig.
Der saß da so irgendwie an seinem Rechner, ich mache das ganze Marketing für Anthropic.
Das war so die Story.
Aber es gibt diesen Artikel, der ist auch in den Show Notes, wie Anthropics Marketing Team Cloud Cowork nutzt.
Der ist da drin.
Kann man sich registrieren.
Das ist ein Recorded Event.
Kann man sich das angucken.
Also gibt es ein Team, nicht nur eine Einzelperson.
Gibt es ein Team.
Featuring, zwei Stück Growth Marketing, Product Marketing.
Direkt verdoppelt.
Okay, okay.
Gut, ich weiß, ich bin auf verlorenem Flur, aber ich versuche immer noch mal nicht KI-Themen und nicht Krypto-Themen reinzubringen.
Ich habe mir einen neuen Smartring geholt.
Hier dieses kleine Ding, Aiwela heißt der.
Der hat nur ein Feature mehr als mein Alter.
Und zwar ist da ein...
Gestiensteuerung dran.
Das heißt, ich kann, ich habe es jetzt auf dem Ringfinger drauf tatsächlich, aber ich kann dann hier so einfach swipen, tippen, drehen und so weiter.
Und das ist halt bei Präsentationen total geil.
Also Minority Report mäßig die Folie wegwischt und so Zeug.
Und in dem Zug habe ich gerade noch einen neuen anderen gesehen und zwar, also der registriert sich einfach als Maus am Handy oder am Rechner.
Ich liebe dich dafür, dass du über diese, wo holst du diese obskuren Gadgets her?
Das hast du schon immer gemacht.
Das sind wirklich so Sachen.
Ich feiere dich dafür hart.
Ich denke mir nur so, ja, okay, brauche ich nicht.
Ihr kennt noch meinen alten PT Cruiser, in dem ich, bevor es Handys gab und man in einem Handy alles machen konnte, einfach hunderte von Geräten hatte.
Eins für Navigation, eins für Videos mit so einem Touchding dran und so.
Als ich das Auto auseinandergebaut habe, musste ich so viele Kabelkanäle wieder lehrräumen.
Okay, aber es gibt ein neues Ding und zwar den SR15 Ultra Smart Ring und der hat jetzt ein Display da dran und da bin ich aber lost.
Sorry Leute, da bin ich raus.
Wenn ich ein Display haben will, dann nehme ich mir irgendein Band oder eine Uhr oder irgendwas.
Aber dass die Dinger jetzt dann auch noch irgendwie ein Display drin haben, wo ich dann irgendwie, keine Ahnung, die Telefonnummer sehen kann, der mich anruft oder wie viele Schritte ich gemacht habe.
I don't know, ich habe es verlinkt, vielleicht ist es für jemand anders was.
Der soll aktuell tatsächlich nur 99 Euro kosten oder 99 Dollar sogar noch kosten.
Und 30 Tage Laufzeit mit Ladecase haben.
Mit Ladecase heißt, du lädst das Ding mit dem Ladecase dann doch noch ein paar Mal im Monat.
Aber ja, krasser Preis.
Also es ist auch nur ein Einführungspreis, aber die ganzen Sensoren in den Ringen sind alle ähnlich.
Kannst du Blutdruck damit oder brauchst du das dann am Handgelenk?
Nee, Blutdruck gibt es Hilo, das Hilo-Band.
Da hat man eine Manschette, mit der man einmal im Monat den richtigen Blutdruck passend zu einem Band, was ich gerade nicht anhabe, sorry, misst.
Und der guckt dann mit optischen Sensoren, wie der Blutdruck, den die Manschette gemessen hat, mit dem, was der Sensor dann durch den Blutfluss sehen kann.
Also wahrscheinlich ist das wirklich so ein Farbunterschied, der dann da ist.
Und das musst du dann einmal im Jahr auch rekalibrieren.
Das schafft dann aber tatsächlich auch Apple noch nicht sauber.
Die wollten das auch schon lange in der Watch ankündigen, aber ist auch nur so eine Indikation bisher.
So komplett ohne Manschette weiß ich gar nicht, ob es jemals gehen wird.
Für mich ist es okay, so einmal im Monat die Manschette einmal aufpusten zu lassen und dann hast du wieder akkurate Daten.
Aber die Ringe, die haben meistens einfach wirklich nur Vibrationshinweise.
Ich meine, auch das ist ja neu, die ganzen alten Aura-Ringe und so, die haben auch keine Vibrationen, was aber auch, glaube ich, bei Design so gedacht ist.
Und kriegst du dann so eine viertägige Campingplatz-Tour vom Olli, zeigst du die sich dann auch in den Daten ab?
Olli, du hast auch so einen Smart.
Ja, die zeichnen sich in den Daten ab.
Also ich bin wieder da.
Ich bin jetzt durch WLAN und lokales Netz und eine SIM-Karte kaufen ohne Video.
Also Internet ist scheiße.
Campingplatz ist Vollwetter.
Das zeichnet sich im Ring auf, dass wenig Schlaf und so weiter.
Wenig Schlaf und mehr Alkohol, höherer Puls und so weiter kann man sehr gut nachvollziehen.
Man kriegt irgendwann Warnmeldungen, dass man jetzt langsam wieder schlafen sollte.
Sie leben ungesund.
Ich habe aber direkt beim Eintritt auf den Campingplatz den Ruhemodus aktiviert.
Ich habe keine Bewegungsziele mehr.
Ich bin halt auch super skeptisch bei so einem Ring.
Was will ich da ein Display drauf und so.
Wie gesagt, wenn es zu gut ist, um wahr zu sein, 99 Euro für das ganze Zeug ohne Subscription, alles ist mit Subscription, ich weiß es nicht.
Müssen wir auch gar nicht weiter thematisieren, aber ich fand das Thema so, dass die ganzen Dinger jetzt alle irgendwie aufgeballert werden, weil wir es können, aber will ich das dann.
Hau mal den Ring rein.
Meine Frau ist ja immer sehr traurig, dass ich meinen E-Ring sehr selten trage.
Ich glaube, wenn ich dann plötzlich mit so einem Smart-Ring ankomme, dann gibt die mir links und rechts.
Aber der hat ein Display.
Wenn unser Ehering ein Display hätte, dann.
Das wäre ja mal geil.
Überleg mal so ein richtiges Nerd-Couple, was sich so Smart-Ring als Ehering gibt.
Cool.
Okay, kommt Leute.
Ein paar Sachen schaffen wir noch.
Wir stoßen, glaube ich, schon langsam aufs Ende zu.
Wir müssen durchballern hier.
Ja.
Ich weiß ja nicht, was ich schon gemacht habe.
Eine Sache, die ich sehr, sehr spannend fand, war so ein Security-Research.
Die haben...
eine Zusammenkunft aus verschiedenen LLM-Modellen vorgestellt, mit der du eigentlich jedes beliebige Device in deinem Haushalt targeten kannst.
Die proben dann ganz viele Sachen, sind da Ports offen, was macht das eigentlich und so, sind eigentlich gerade bei älteren, ungepatchten Devices auch immer in der Lage, irgendwas zu finden, craften dann on the fly, coden die live an Exploit, schleusen den da rein als Wurm und das Ding vermehrt sich dann weiter.
Guckt, was sind denn noch für Geräte hier irgendwo im Netzwerk.
Und vermehren sich dann.
Und das Krasse dabei ist halt, dadurch, dass der Exploit halt gecraftet ist auf die Sicherheitslücke, ist der halt ultraschwer von irgendwelchen Virenherstellern zu detecten, weil es halt ja nicht so eine Binärsignatur gibt.
Natürlich der Exploit, den die schon erkennen.
Es ist einfach ein neu geschriebener Exploit.
Es ist einfach ein neu geschriebener Exploit und je nachdem, wie die Binärsignatur da drin ist.
Ich meine, das muss man sagen, die Würmer, die haben in letzter Zeit da auch schon, also sie haben schon seit Jahren, gibt es da selbstmodifizierenden Code, um diese Sachen drum herum zu kommen.
Aber mit AI bewegt sich dieser Threat Level jetzt nochmal auf einem neuen Niveau.
Kannst du das noch einmal ganz kurz erklären, wie das genau funktioniert?
Nimm doch mal so eine schöne, ungepatchte Fritzbox.
Wie ist AI da quasi drin?
Also AI muss irgendwo gebootstrapped werden.
Irgendwo muss das Ding, ich muss irgendwie mal eine WLAN-Verbindung kriegen oder sonst irgendwas.
Du probst quasi das Netz, findest irgendwie eine ungepatchte Fritzbox, die irgendwie zu alt ist, nicht geupdatet, nicht gepflegt.
Ist, glaube ich, bei vielen Haushalten der Fall.
Und von da aus...
Merkt ihr dann, ah ja gut, das ist eine Fritzbox mit der Versionsnummer, da kann man über einen modifizierten Curl-Request eine Privilege-Escalation machen, da kann ich Remote-Code-Execution machen, dann schreibt er ein bisschen Code, der dann geexecuted wird, dann läuft das Ding erstmal auf der Fritzbox.
Von da aus connectet sich das Ding wieder zu einem Host, drobt weiter das Netzwerk, sieht dann aus der Fritzbox, hat natürlich dann sofort mehr Informationen, welche Geräte sind noch hier, was machen die so über die Fritzbox, hast ja dann direkt mehr Informationen.
Die behalten schon auch nach außen letztendlich eine Verbindung, um vom LLM quasi Attack-Services zu finden.
Ja, genau.
Also das ist natürlich eine Sache, die man dann auch detekten könnte, wo man das machen kann.
Aber es ist ein selbst replizierender Wurm, der beliebige Devices in Netzwerken attackieren kann.
Und auch einfach mal drei Monate chillen könnte und irgendwann abgeht.
Und der erstmal auch chillen könnte und ganz lange gedormt ist.
Ja, krass.
Also wenn dann irgendein Exploit kommt in irgendeinem System, weil das halt Public wird, dann kann das direkt zuschlagen.
Das ist natürlich crazy.
Ich finde, wir treffen uns bei Carlo, machen das an und gucken, wie weit er kommt.
Bei 300 Devices, das ist ja Heaven.
Das Ding rastet aus.
Nachher vibriert sein Ring die ganze Zeit.
Carlo, warum hat sich Robertina von dir geschieden?
Achso, das Ding hat die ganzen Hometic-Geräte alle.
Die Heizung zu heiß gestellt.
Ich stelle mir das eher so vor wie Jabba bei Star Wars, der dann so ganz, der Wurm ganz fett in der Ecke liegt und einfach sich nicht mehr bewegen kann, weil es einfach total überladen wurde.
Defense by Multitude of Devices.
Genau.
Du hast, glaube ich, reingepackt, Olli, hier Self über Privacy Preserving Proof of Humanity.
Nee, warst du gar nicht.
Also Self spricht über Self-Knowledge Identity als Weg, um echte Nutzer zu identifizieren, ist als Link drin.
Wir beileiten jetzt einfach mal ein paar Links zum Ende noch durch, damit ihr Bescheid wisst, was in den Show Notes noch drin ist.
Damit könnte man dann Sibyl-Angriffe abwehren, ohne komplette Identitätsdaten einzusammeln.
Ja, aber das wäre ja eventuell dieses Zero-Knowledge-Proof-Gedöns, von dem wir immer mal...
immer ja wieder angerissen.
Ich weiß, dass mehrere Startups in Amerika dran arbeiten, mit dem Konstrukt, nur in ganz, ganz kurz, dass du bei Zero-Knowledge-Proofs quasi nachfragen kannst, bin das ich, ohne dass ich Sachen über mich freigeben muss und so weiter.
Das ist der einzige Weg, wie wir das hinkriegen, weil also mein Gesicht zu fälschen, weil da kriegst du ja alles hin.
Du musst irgendwelche anderen Methoden finden, um irgendwie sicherzustellen, dass klar ist, dass ich das jetzt nicht war.
Ich war zum Beispiel gerade in Holland, hatte scheiß Internet.
wenn irgendwer mit einer 100-Mbit-Leitung gerade in Köln irgendwas hackt.
Bin das nicht ich, ich bin in Kamperland.
Mega, finde ich gut.
Ganz wichtig, glaube ich, da wird ganz viel passieren.
Antropic hat auch irgendwie über LLMs zur Absicherung von Sourcecode was geschrieben.
Sebastian, du hast was geteilt.
Packen wir auch in die Shownotes rein.
Ja, genau.
Die haben einfach ganz viel dann quasi um die...
Das, was sie mit der Mythos Preview hatten, die hatten sie ja geteilt, weil die halt so ultra krass ist im Aufhören von Security-Lücken und ihre Learnings und die ganze Security-Harness, die Learnings daraus haben sie in einem GitHub-Repository geteilt und ermutigen gerade alle Leute, viele Prompts, viel Methodologie, das auf ihre Software-Systeme anzuwenden.
Einfach zu sagen, just start.
Ihr müsst jetzt nicht hier alles machen, aber hier ist jetzt echt gute Best Practices drin.
Startet einfach mal.
und lasst das System irgendwie auf eure Software los, damit ihr Sicherheitslücken findet, bevor jemand anderes es tut.
Das hat dieser Kassara Rageri, wie auch immer man es richtig ausspricht, irgendwie auch gemacht.
Der hat mit Absicht eine verwundbare ExpoFast API Firebase App gemacht und hat dann mehrere Frontier Open Source Modelle darauf losgelassen und während die anderen riesige Token Budgets verbrannt haben.
wegen einer gehärteten API, hat angeblich GPT 7 von 10 Runs mit 1500 Dollar, wenn ich es hier richtig sehe, das Ding irgendwie fixen können.
Gefunden auf jeden Fall.
Ist natürlich spannend.
Und wenn dieses Antropic-Ding da rauskommt, wie hieß es nochmal?
Mythos.
Mythos, genau.
Dann sollten sich alle warm anziehen, so heißt es ja.
Wenn es nicht auch wieder ein gutes Marketing war, aber da hat man ja wirklich geile Sachen von gehört.
Gut.
Gut, am Ende haben wir noch drei Stück, wenn ich es richtig sehe, die wir noch nicht durchgeballert haben.
Heise über Emergence Worlds in der AI-Gesellschaftssimulation.
Weiß noch einer, wer es geteilt hat?
Emergence AI von Unbekannt.
Also Emergency AI ließ Agenten auf Basis von Claw, Gemini, Grog oder GPT-5 Mini und gemischten Modellpopulationen simulierte Gesellschaften mit Gesetzen, Ressourcen, Gebäuden und destruktiven Werkzeugen betreiben.
Alles klar, gucke ich mir an.
Danke für den Link.
Heise Link.
Gut.
Was haben wir noch?
Trumps AI Executive Order.
Trump hat gesagt so, hey, liebe AI-Hersteller, wenn ihr irgendwas Neues rausbringt, dann muss das US-Government da wenigstens eine kleine Preview zu bekommen.
Aber ich glaube, das ist relativ schmal Spur, was er da gemacht hat.
Also er will ja auch da nicht seine Wirtschaft abwürgen.
Absolut.
Ja, und dann last but not least, Codex hat ein Sudo-Workaround gefunden über Docker-Bind-Mounts.
Kleines bekanntes Beispiel dafür, dass Codinger-Innen lokale Permissions als Hindernis behandeln, dass man umgehen kann.
Codex soll Docker-Hauszugriff genutzt haben, um ein fehlendes Sudo zu umgehen.
Schade.
Da werden wir jetzt noch viele Sachen drin sehen.
Gut, ich glaube, das wird durch.
Ich würde sagen, trotz der Menge.
Ich entschuldige mich vielmals, dass das hier nicht so internetmäßig geklappt hat.
Aber immerhin war ich ein bisschen da.
Du warst ein bisschen da.
Sehr schön, dass du es versucht hast.
Warst gut genug da.
Dabei sein ist alles.
Genau.
Genau.
Ich will seinen Traum auf uns mit.
Mache ich.
Wünsche euch noch einen schönen Tag.
Ich bedanke mich für diesen wunderbaren Podcast, den ich jetzt hier sogar noch hören kann.
Das ist ja doppelt gut.
Also ich war dabei und kann ihn hören.
Und ich kann ihn hören.
Und den Rest auch noch zu hören.
Alles klar.
Viel Spaß dir da.
Danke schön.
Schönes Wochenende.
Danke, dass ihr an einem Brückentag alle so verfügbar wart.
Ciao.
