Second Brain
Read in EnglishThemen Wissensmanagement
33 Sekunden zur Folge, bevor du liest.
Worum es geht
Personal Knowledge Management mit Auto-Kuration, RAG und portablen Skills
Ein Gast, den Mark sich lange gewünscht hat: Cornelius Illi, Product Cluster Lead für Innovation und GenAI, mit dem er sich nach eigener Aussage immer gerne unterhält und von dem er einiges lernt. Bevor es losgeht, darf Jens noch von seinem Wochenende erzählen, und das passt besser zum Thema, als ihm lieb ist. Er wollte mit seinem Sohn ein altes Computerspiel spielen, das es für den Mac nicht mehr gibt, also hat er Crossover gekauft und Claude Vollzugriff auf seinen Mac Mini gegeben. Das Ding hat die halbe Nacht durchprobiert, tausendmal gestartet, geschaut, ob es zwischen 3D-Animation und Intro-Video abstürzt, eigene Shader gebaut, Software installiert, wieder gelöscht und nebenbei die Festplatte aufgeräumt. Gespielt wurde am Ende auf dem Linux-Rechner des Sohnes. Immerhin hat Claude noch die Support-Mail für die Rückerstattung geschrieben, inklusive Liste aller Versuche, damit niemand mit „haben Sie es schon so probiert" antwortet.
Dann die Freitagabend-Frage, Bier in der Hand, jemand hat den Begriff Second Brain aufgeschnappt: Was ist das eigentlich? Cornelius holt aus. Das Konzept ist älter als die LLM-Debatte, geprägt hat es Tiago Forte mit der CODE-Methode: Capture, Organize, Distill, Express. Alles reinladen, ordnen, den Sinn herausdestillieren, am Ende etwas damit bauen. Neu ist, dass Andrej Karpathy Anfang des Jahres seinen LLM-Wiki-Ansatz vorgestellt hat und viele daraufhin gemerkt haben, dass so ein Speicher vielleicht gar nicht für den Menschen gedacht ist, sondern der perfekte Kontextspeicher für die KI. Cornelius hat genau deshalb das Capture automatisiert: 130 Quellen liefern ihm 400 bis 500 Inhalte pro Woche, die werden gerankt und bewertet, höchstens ein Drittel landet im wöchentlichen Digest, der Rest fliegt als irrelevant oder als bloßes Repackaging raus. Sogar seine LinkedIn-Likes zieht er sich zurück, über eine selbstgeschriebene App und die Betroffenenrechte, die ihm als EU-Bürger zustehen.
Und dann kommt der ehrlichste Moment der Folge. Cornelius liest seinen eigenen Digest nicht mehr. Zu viel, und es bleibt ja nicht beim Lesen, danach muss man mit der KI darüber diskutieren, um überhaupt Insights zu bekommen. Sein Befund: Kuration ist der eigentlich schwierige Teil, und der Mensch bleibt darin noch lange nötig. Die KI kann erklären, was Harness Engineering ist und wer den Begriff geprägt hat. Was sie nicht liefert, sind Best Current Practices, also die Frage, was in genau dieser Version von Modell und Harness gerade wirklich funktioniert. Wo eine Visualisierung dagegen hilft: beim Aufdecken der eigenen Verzerrung. Cornelius hielt das LLM-Wiki-Thema für riesig und musste feststellen, dass in hundert Tagen nur 23 von 5.000 Inhalten davon handelten. Ein Randthema, das sich in seinem Kopf groß angefühlt hat.
Beim Werkzeug gehen die drei auseinander. Mark hält dagegen, dass Wissen durch Reduktion entsteht, durch Struktur und dadurch, dass ein System auch vergessen kann, und nicht durch das Anhäufen möglichst vieler Dateien. Er selbst nutzt kein Obsidian, sondern packt alles in einen einzigen Skill: zehn Jahre Apple-Entwicklerdokumentation und WWDC-Transkripte, dazu seine eigenen Mobile-Artikel, als Zip ein paar MB, entpackt ein paar hundert. Antwortzeit rund zwei Minuten. Perfekt ist das nicht, ein RAG ist es auch nicht, aber es ist portabel und läuft in jedem Harness, ob Codex, Claude Code oder das eigene System der Firma. Das Ding heißt SkillSafe (godmodeai2025.github.io/SkillSafe), ein lokaler Wissenstresor als portabler Skill: Wissensbausteine im OKF-Format mit Quelle und Fundstelle an jeder Kernaussage, kontrollierte Begriffswelten mit Synonymen statt Vektor-Blackbox, und sechs eiserne Regeln, von denen die erste lautet: Deckt der Bestand eine Frage nicht ab, heißt die Antwort „Nicht im Bestand". Modellwissen füllt das nie auf. Genau deshalb hat Mark sich überlegt, mit welchen Begriffswelten er überhaupt an seinen Skill herankommt, statt sich auf ein grep zu verlassen. Jens dagegen braucht die Grafik. Über 20.000 Dokumente liegen in seinem Vault, gezielt eine einzelne Markdown-Datei zu suchen ist die Hölle, aber der Blick auf den Graphen gibt ihm ein Gefühl für die Gewichtung. Am Wochenende sah der falsch aus, also läuft jetzt eine neue Logik darüber. Sein Vault liegt bewusst lokal auf einem Mac Mini, mit lokal laufenden Gemma-Modellen, die archivieren und vergessen, einem Advisory Board aus den Autoren, denen er am meisten folgt (Karpathy sitzt mit drin), und einem Wächter, der prüft, was aus dem Vault heraus überhaupt an eine öffentliche API gehen darf.
Weil viele Begriffe durch den Äther gingen, übersetzt Cornelius zwei davon in Normaldeutsch. Ein RAG, Retrieval Augmented Generation, zerlegt Texte in Chunks, wandelt sie in Embeddings und ordnet sie in einem hochdimensionalen Raum an, in dem Nähe Bedeutung heißt. Das klassische Beispiel: König minus Mann plus Frau ergibt Königin. Eine Ontologie kommt aus der Graphentheorie, Knoten und Kanten, und beschreibt, wie Begriffe zusammenhängen, damit sich Pfade entlanghangeln lassen. Warum das zählt, wird beim Teilen klar: Wer ein Wissenssystem selbst gebaut hat, kennt die Begriffe darin. Wer es geerbt bekommt, kann nicht danach suchen, weil ihm das Schlüsselwort fehlt. Ein grep hilft dann nichts, und Brute Force über 200 Treffer kennt keine Relevanzgewichtung. Für die Firma heißt das: Single Source of Truth, oder wie Mark es nennt, ein Knowledge Hive, für Richtlinien, FAQs, Organigramme, Architekturdokumentation, Verträge. Nur eben ohne den nächsten Monolithen zu bauen, für den man erst eine Schulung braucht.
Zum Schluss die Empfehlung für alle, die anfangen wollen. Mark sagt: mit Skills starten. Nicht das Monster bauen, sondern sich für eine konkrete Aufgabe überlegen, welche Informationen ein Skill braucht und wie sie strukturiert sein müssen. Ein Skill plus ein paar Dateien im Projektordner ist bereits ein Mini-Second-Brain. Cornelius empfiehlt etwas anderes: den Fokus verschieben, weg von „was könnte ich noch wissen wollen" hin zu „woran arbeite ich gerade und was will ich erreichen". Dann braucht es oft gar nicht so viel Wissen, sondern eine gezielte Suche, und das Brain wächst von selbst. Sein Trostpflaster für Perfektionisten: Wenn er 90 Prozent des Zeitaufwands spart und das System 30 Prozent falsch macht, bleibt immer noch ein großer Mehrwert. Jens' Schlusswort ist wie immer einfach machen, und Marks Beobachtung zum Mitnehmen: Wir haben Modelle, die Videos generieren, und speichern unser Wissen in schlichten Textdateien. Schaut euch Markdown an. Enterprise Brains und die Frage, wie tausend Second Brains miteinander reden, bleiben liegen. Dafür gibt es schon die Einladung zur zweiten Folge mit Cornelius.
Transkript
00:00:00Willkommen bei Thinkdifferent, ThinkAI, dem Podcast von Mark und Jens.
00:00:07Zwei technologieverliebte Köpfe, die nicht nur über künstliche Intelligenz reden, sondern sie leben.
00:00:14Hier gibt es klare Einordnungen, echte Praxiseinblicke und einen frischen Blick auf das, was möglich ist.
00:00:20Verständlich, kritisch und immer mit einem Augenzwinker.
00:00:24KD zum Nachdenken, zum Schmunzeln und vor allem zum Mitreden.
00:00:29Herzlich willkommen bei Think different, Think AI.
00:00:36Heute ist in vieler Hinsicht eine ganz besondere Folge.
00:00:40Zum Einsten, genau, also so fängt es schon sehr gut an.
00:00:44Den ersten Versprecher schon gleich mal durch den Eltern geschickt.
00:00:47Zum ersten haben wir heute einen Gast, den ich mir schon lange herbeigewünscht habe,
00:00:52weil ich mich auch immer wieder sehr gerne mit ihm unterhalte
00:00:56und von ihm auch viel lernen kann. Der Cornelius ist heute da, hallo Cornelius.
00:01:00Hallo, ich frage mich.
00:01:02Bevor wir wissen wer du bist, also bevor die anderen wissen wer du bist,
00:01:06und bevor wir das Thema lüften, über das wir heute sprechen,
00:01:09muss ich unbedingt mit Jens das Wort erteilen.
00:01:12Der hat nämlich glaube ich so ein bisschen Spielebranche
00:01:15und Chlor zusammengebracht. Jens, wie geht es dir?
00:01:19Was ist passiert und was hat das jetzt miteinander zu tun?
00:01:22Ja das werden wir später sehen, aber ein bisschen kann ich schon an Tee sein und herzlich willkommen auf jeden Fall Cornelius. Ich freue mich natürlich genauso wie Bolle wieder mag, dass du da bist und freue mich auch auf die heutige Folge, die wir machen werden.
00:01:33So ein bisschen, naja, passt es dazu, was wir heute auch besprechen werden, was mir am Wochenende wieder passiert ist? Ich wollte ganz gerne ein altes Computerspiel mit meinem Sohnmann spielen und dachte, du hast auch so einen geilen Mac Mini, wo sonst nur dein mega geiles Deckenbrain draufläuft.
00:01:50lasst den da auch mal vernünftig was machen und mal Spiel danach kommt das Spiel drauf.
00:01:54Problem ist dieses Spiel gibt es nicht mehr auf dem Mac, es gibt so eine Windows Version davon
00:01:59und dementsprechend saß ich da und dachte okay du hast ja auch eine schöne Cloud Installation die
00:02:03auf dem Desktop komplett Zugriff auf deinem ganzen Mac Mini habt, lasst uns das doch mal
00:02:08zusammen angehen. Das war wieder so ein Beispiel für übersteigerte, jetzt muss ich aufpassen,
00:02:14Selbsteinschätzung sowohl bei mir als auch bei Claude, was möglich ist, was nicht möglich ist.
00:02:20Also wir haben wirklich mit weh in den Fahnen sind wir beide in diese Schlacht gezogen um das
00:02:24zu schlagen. Ja, waren auch relativ zügig mit einfachen Lösungen eigentlich dabei. Das muss
00:02:28locker klacken mit dieser Software. Ich habe dann diese Software sofort gekauft. Ende vom
00:02:32Lied ist, ich habe eben die komplett freigabe über Passworteingaben mit Screenshots,
00:02:36die Claude machen durfte, die ganze Nacht, der hat irgendwie tausendmal dieses Programm
00:02:39versucht zu starten, hat dann immer wieder beobachtet, in welchen Momenten, ob es
00:02:42zwischen den 3D-Animationen oder dem Intro Video abstürzt und hat dann irgendwelche Shader
00:02:47versucht selber zu bauen, um das inwiegend laufen zu kriegen.
00:02:49Neues Software runtergeladen, altes Software gelöscht, meine Festplatte aufgehäumt
00:02:52währenddessen, weil da ziemlich viel Müll drauf war, hat es dann festgestellt.
00:02:55So oder so, es ist gut ausgegangen, muss ich hinter sagen.
00:02:58Also gespielt habe ich mit dem Linnungsrechner meine Sohne, alle Sachen sind wieder gelöscht
00:03:03vor meinem Rechner, was falsch darauf installiert worden ist, weil es nicht geklappt hat.
00:03:07Und Claude hat mir dann noch wenigstens geholfen, hat mir so eine Rhythmie-Datei angelegt
00:03:12mit der Schrieb für die Firma, von der ich die Software gekauft habe, Cross-Oper war das,
00:03:17dass ich dann doch gerne mein Geld zurückhaben wollte, weil ich vergeblich versucht habe.
00:03:20Und wir haben auch so eine lange Liste gemacht, damit der Support mich nicht anschreibt und
00:03:23sagt, versuchen Sie es erst mal so, haben wir erst mal alles aufgelistet, was wir gemacht
00:03:26haben.
00:03:27Die Supportjungs werden wahrscheinlich erschlagen, werden wir von dieser Mail-Diesel-Kollege
00:03:31machen.
00:03:32Aber ich freue mich auf mein Geld zurück.
00:03:34Und parallel hatte dir die Kreditkarte leckeruert.
00:03:37Aber du hast ja schon ein richtig schönes Dichwort gebracht, Second Train.
00:03:41Bevor wir anfangen, Cornelius, auch nochmal jetzt hier, damit wir es nochmal ganz offiziell gemacht haben, ja, schön, dass du da bist und ich freue mich total mit dir über das Thema Second Train zu unterhalten.
00:03:56Wir haben uns irgendwie mal irgendwann vorgenommen, mal anfangen zu erzählen, worum es denn geht und ich habe bei einem anderen Podcast das genommen und das nehmen wir jetzt auch für deine Vorstellung.
00:04:04Stell dir vor, es ist Freitagabend, 20 Uhr, du hast ein Bierchen in der Hand, du triffst
00:04:09auf Menschen, die du noch nie in deinem Leben gesehen hast und die Fragen zu dich, ey, ich
00:04:15habe letztens mal diesen Begriff Second Prane gehört, du bist doch hier irgendwie so
00:04:18ein bisschen nahe mit der KI, magst du uns mal erklären, was das ist, was man darunter
00:04:24versteht?
00:04:25Da hast du eine gute Frage, also dieses Thema Second Prane gibt es schon seit, ich
00:04:33Ich würde sagen, vielen Jahren und schon länger, als es die ganze Large Language Model-Debatte gibt.
00:04:40Es gibt auch einen Outer, den Tiago Forte, der dieses Konzept, glaube ich, federführend geprägt hat.
00:04:48Und das grundlegende Prinzip ist eigentlich, dass ich alle meine Gedanken und Recherchen, die ich mache,
00:04:56Ablege in einem System, das gut durchdacht ist und das mir dann dient quasi als Referenzwerk für meine Arbeit.
00:05:04Der hat das auch mit einer Methode hinterlegt, die heißt Code, steht als Akronym für Capture.
00:05:12Jetzt muss ich gerade überlegen Organize, Distill und Express.
00:05:18Also das erste eben erstmal Sachen reinzuladen, dann sie zu organisieren und dann quasi den
00:05:26Sinn herauszudestellieren und dann später damit was zu machen, was zu programmieren,
00:05:31was zu schreiben, Podcast aufzunehmen.
00:05:34Das war so der Ursprung, glaube ich, von Second Brain.
00:05:37Und ja, das Thema ging, glaube ich, dann durch die Decke am Anfang diesen Jahres
00:05:42als der NJK Pathly sein LLM-Wiki-Ansatz vorgestellt hat und dann viele, glaube ich, dann nochmal
00:05:49aufgestiegen sind, um zu sagen, hey, vielleicht ist das ja gar nichts, was ich als Mensch brauche,
00:05:53sondern vielleicht ist es einfach der perfekte Kontext-Speicher für meine KI.
00:05:59Ich finde, ich habe mir gerade vorgestellt, wie wir hier stehen, mit einem Bärchen in
00:06:04der Hand. Ich habe mir gerade vorgestellt, wie Menschen ohne KI-Kompetenz quasi dabei
00:06:09beisitzen und ganz gespannt zuhören mit offenen Augen wie das Reh, wenn das Auto kommt.
00:06:13Genau.
00:06:14Und ich denke, Mann, ein Wahnsinn, was hier an Wisten vermittelt wird, aber Jens...
00:06:18Jetzt hab ich's verstanden.
00:06:19Ja, genau.
00:06:20Jetzt hast du's verstanden.
00:06:21Aber das deckt sich ja so ein bisschen mit dem, was du ja auch immer wieder mal so
00:06:25durchblicken lässt, so nach dem Motto, wenn du von deinem Second Train sprichst, warum
00:06:30brauchen wir denn jetzt so einen Second Train überhaupt?
00:06:33Also, was haben wir denn davon?
00:06:35Ich mein, wo hilfst du uns denn jetzt?
00:06:38Ich weiß ja nicht, was ihr konzept, aber also ich kann euch sagen, was ich jetzt mal versucht habe und was in mein gedanke war.
00:06:45Ich mache ja auch ganz viel mit K.I. und muss ja auch dann strategisch themen
00:06:51beurteilen und dann muss man sehr viel wissen, konsumieren, dann hat man irgendwelche Konferenzbeiträge,
00:06:58Podcasts, Newsletter, LinkedIn-Posts,
00:07:02alles Mögliche und ich habe da einfach gemerkt, dass es mir
00:07:05zu viel wird, weil das vor allem auch Dinge sind, die man nach der Arbeit tun muss und dann sind die
00:07:10Abende viel blockiert mit Konsum von Inhalten. Dann habe ich auch gemerkt, dass der Signal to
00:07:16Noise Ratio nicht so gut ist. Also die Frage ist immer, wie viel Originales ist wirklich dabei,
00:07:21was dann auch eine zukünstige Debatte prägt und wie viel ist einfach nur Repackaging für YouTube
00:07:28oder für LinkedIn. Und dann habe ich einfach angefangen, den ersten Part quasi, das Capture
00:07:35in Auto Capture umzuwandeln. Das heißt mittlerweile macht die KI, zapft alle Quellen an, zieht
00:07:42sich die Sachen selber rein, organisiert sie selber, distilliert sie selber. Das Express muss ich
00:07:48schon noch selber machen. Distilliert hat das aber nichts mit Alkohol zu tun, aber so ähnlich,
00:07:53oder? Nein, nein, nein. Ja, ja. Cornelius, wenn du sagst Quellen, sag mal, beschreib mal,
00:08:00was sind das dann für Quellen und wie machst du das?
00:08:02Naja, also ganz unterschiedliche Dinge. YouTube gibt es eben ganz viele Videos oder Podcasts.
00:08:07Das Gute bei YouTube ist, es gibt dazu passend die Transkripte. Die Transkripte kann ich
00:08:11mir dann direkt ziehen. Da gibt es unterschiedliche technische Anbindungen, wie man das machen
00:08:15kann. Aus den Transkripten kann ich mir dann Zusammenfassungen erstellen und
00:08:20dann gibt es eine komplexere Pipeline, die dann quasi bewertet ist, dass ich definiere ein Ziel und
00:08:28dann gucke ich sozusagen, ist da ein Beitrag, der werteilig ist für dieses Ziel und dann wird
00:08:34daraus aus ganz vielen Quellen ein wöchentlicher Deitus gemacht, der versucht gute, relevante
00:08:41und vielleicht auch provozierende Argumente zu liefern, die dann eine Diskussion starten,
00:08:47die ich mit der KI habe, um dann daraus Insights zu generieren.
00:08:50Mittlerweile kann das aber auch im LinkedIn-Post, also ich habe dann für LinkedIn noch eine App geschrieben,
00:08:56dann hast du die Möglichkeit als EU-Bürger natürlich betroffenen Rechteausübung zu machen.
00:09:01Das heißt, ich darf meine eigenen Daten, die ich dort generiere, auch einsehen.
00:09:05Das heißt, ich sehe, was ich geliked habe.
00:09:07Und weil die meisten Posts, die man liked, öffentlich sind, kann man die dann auch ohne Session.
00:09:12Auch sozusagen ziehen kann links folgen, hat eigentlich dann so alle Traces, die man im Internet hinterlässt, kann man wieder einsammeln.
00:09:22Also alles, was man sich angeschaut hat oder was man ohnehin schon folgt. Und dann wird es einfach eingebunden und verarbeitet.
00:09:29Wenn wir da, Mark, schuldigung, ja, wenn wir da, ich will mal so ganz kurzen Gefühl für Menge haben, wovon reden wir da jetzt?
00:09:39Also keine Terabyte, höchstwahrscheinlich, weil es alles Text-Dateien sind, aber in Anzahl von, wie viel ist denn das, 1000 Likes, 1000 Artikel oder wovon reden wir denn, wenn du so auf deinen Second Range aus.
00:09:52Also so 130 Quellen, die etwa so 400 bis 500 Inhalte pro Woche liefern, die werden dann
00:10:01alle gerankt und bewertet und dann wandert eine Timing, das von in der Regel nicht mehr
00:10:07als ein Drittel wandert dann in so eine wöchentliche, in wöchentlichen Digest und der Rest ist
00:10:14quasi aussortiert als irrelevant oder nur repackaging.
00:10:18Genau.
00:10:19Wie verguckst du der von selber noch an? Dann, wenn er jetzt sagt, guck mal, da läuft viel drüber und er hat ja auch ein bisschen was zu mag und ich rede häufig aber auch über Chvast, das Chvast ein wichtiges Thema ist in diesem KI-Zeitalter.
00:10:31Das heißt, du wirst ja nicht schaffen, das alles dir anzugucken und immer zu bewerten, macht die KI das alles richtig. Also das heißt, was ist so dein Weg, Vertrauen zu deinem eigenen Second Brain zu gewinnen oder zu halten?
00:10:45guckst du dir dann mal Sachen an oder ist es immer nur das Digest? Und dann sagst du auch,
00:10:48das Digest ist schon ganz gut, dann wird der Rest vollkommen okay sein.
00:10:51Ich glaube, es gibt so ein paar Podcasts natürlich wie dieser hier, die man sich gerne selber
00:10:57anhört und die auch einfach kurzweilig sind. Aber ich glaube, die Menge an Podcasts,
00:11:03die ich noch in der Lage bin zu konsumieren, sind vielleicht so drei pro Woche. Einer
00:11:08seid ihr, dann gibt es noch einen, den Lennys Newsletter zum Thema Produktmanagement
00:11:12im KI. Diese Woche war, glaube ich, der letzte Woche vom Handelsblatt, wo er Thomas Domke,
00:11:17der ehemalige CEO vom GitHub ein Interview hatte. Das habe ich mir angehört. Das fand
00:11:22ich super spannend. Aber ansonsten der Rest einig gar nicht mehr. Und ich muss auch ehrlich sagen,
00:11:26dass es vielleicht in die Erkenntnis, der selbst dieses System, das ich mir gebaut habe,
00:11:31ich das auch nicht mehr konsumiere. Also mir wurde es dann irgendwann zu viel,
00:11:34diese EDITEST wöchentlich zu lesen. Das ist dann doch relativ viel Arbeit. Das ist
00:11:39dann auch nicht nur das Lesen, sondern eine Diskussion darüber mit der KI zu führen, um
00:11:43die Insights zu generieren. Da ich dann auch wieder versucht zu überlegen, kann man das
00:11:47nicht besser machen, kann ich nicht Topics-Seiten veröffentlichen, wo ein Thema vollständig
00:11:53umrissen wird, was der Diskussion stand, was die Widersprüche sind oder die Breite
00:11:57der Diskussion, ob es eine Richtung gibt, ob sich Evidenz verdichtet, dass eine Sache
00:12:03stabil wird. Und da merke ich aber auch, dass das ganze Thema Kuration und so einfach
00:12:07was ultra schwierig ist. Und wo ich glaube, dass es den Mensch in der Loop noch sehr lange
00:12:13braucht. Also einfach in der Qualitätsanalyse, wenn man, egal ob es jetzt Attacking ist oder
00:12:18ob es aus dem LLM-Wiki-Ansatz-Konzept in Entitäten sind oder ob ich selber Topic-Seiten
00:12:25generiere, es wuchert schnell zu mit einer Unmenge an Themen. Also man braucht gute
00:12:31Ansatz für Korration und was eben nicht, also die KI aus sich herausgenerieren kann, ist
00:12:38Meaning.
00:12:39Also ich habe vielleicht ein Thema wie Harnes Engineering, das kann mir dann die KI erzählen,
00:12:45was das ist und wer es genannt hat und wo die ursprüngliche Quelle war, aber das,
00:12:50was ich ja eigentlich wissen möchte, sind so Sachen, die best current practices.
00:12:55Also wenn ich mir jetzt selber für meinen Cloud Code oder für meinen Codex überlege, wie muss der Coder Harness gestaltet sein?
00:13:05Also mache ich Test Driven Development, arbeite ich mit Feature Branches und Pull Requests und so weiter.
00:13:12Die ganzen Dinge, die ich vielleicht festgelege, dann möchte ich er wissen, in welcher Version das Harness und das Modells, das ich benutze,
00:13:21sind fast die besten Lösungen. Und solche Sachen, die muss ich eben selber die KI instruieren,
00:13:29dass das an diesem Thema eine Sache ist, wo ich interessiert bin. Und das kann ich nicht
00:13:33über so einen generischen Ansatz machen. Wenn du davon sprichst so nach dem Motto,
00:13:40man guckt sich das vielleicht schon alles zum Teil auch gar nicht mehr so selber an,
00:13:43ja, wenn ich mal so auf meinen gucke, so nach dem Motto, große Ordner, Spruchpuren,
00:13:48ganzer Sack von Markdown-Files, mal egal ob das jetzt nach diesem OKF-Format ist oder nicht, ja, und wir reden vielleicht auch gleich nochmal über die verschiedene Möglichkeiten von Nordisch Grafen, Obsidian Nose, wie der ganze Kram heißt.
00:14:01Ich glaube, das Letzt, was du gebracht hast, ist halt so der große Unterschied, weil wenn du im Internet guckst bei Social Media, da findest du immer die Leute, die dann Fotos schicken, wie ihr Prane aussieht, ja, lauter Nose, am besten ein Tag, ja, sieht aus wie hier mein
00:14:17gehören und man sieht irgendwas wahr waren und macht dann und keine Ahnung
00:14:20Effekthascherei. Ich würde eher sagen, Wissen in solchen Systemen entsteht
00:14:26durch Reduktion, durch Struktur, durch, ja, dass das System in der Lage ist, auch
00:14:31zu vergessen und nicht nur durch Anhäufung und das Funktionieren von
00:14:36möglichst vielen Dokumenten in möglichst unstrukturierter Art und Weise.
00:14:41Hast du eine Meinung zu dem Thema Notion, Obsidian, Knowledgecraft, Capacity, keine Ahnung was?
00:14:49Findest du da Dinge oder klassisches Rack, Vector-Datenbank, weiß ich was?
00:14:54Hast du da so eine persönliche Meinung zu und warum?
00:14:58Also ich finde der Obsidian sehr gut, einfach weil es ein visuelles Interface ist in Ordnerstrukturen in denen Markdown-Dateien liegen.
00:15:08Die werden dann so angezeigt, dass sie hübsch aussehen und dass man sie einfach lesen kann.
00:15:13Und ich glaube, dafür nutze ich es eigentlich überwiegend.
00:15:16Natürlich gibt es die Möglichkeit, da auch tolle andere Features drin zu haben und auch
00:15:22sich visuell in Grafen darstellen zu lassen, die Sachen zu traversieren.
00:15:25Aber hat er vor allem damit was zu tun, wie gut sind die Daten kooperiert?
00:15:31Habe ich wirklich sinnvolle Verknüpfung?
00:15:33habe ich eine relevante Menge an einem kanonischen Taxsystem oder Konzertsystem, sodass ich eben
00:15:40nicht nur Tax habe, die nur einmal verwendet werden, sondern idealerweise eine sinnvolle
00:15:47Menge an Begriffen habe und die dann auch vielfach genutzt wird, sodass ich wirklich
00:15:51alle Artike finde, die dazu was sagen, brauche ich Obsidian dafür?
00:15:56Wahrscheinlich nicht.
00:15:57Also es wird auch immer weniger, muss ich sagen, dass es tatsächlich benutzt war.
00:16:01Und ich sage mal so, der LLM Wiki-Ansatz ist ja erst mal einer, der eigentlich genau
00:16:09in dieses Thema Autokuratierung reingeht, noch nicht wirklich Distillation, also es wird
00:16:16nicht wirklich Sachen reduziert, sondern eher geguckt, welche Konzepte und Entitäten
00:16:21gibt es da drin.
00:16:22Guter Anfang.
00:16:23Aber ich würde auch sagen, sicherlich, also es hängt vielleicht am Anwendungsfall,
00:16:30der Entricker-Party da rein, vielleicht nur irgendwelche wissenschaftlichen Paper packt,
00:16:35dann ist das vielleicht die Ebene, die relevant ist. Wenn ich jetzt gucke, was die Fragen sind,
00:16:39die ich habe, dann geht es eher um praktische Rat für die Anwendung. Und das braucht eine
00:16:46andere Form der Auseinandersetzung, die ja vor allem aus der Dissillation kommt,
00:16:50dass man drüber nachdenkt, dass man Dinge ausprobiert und merkt, aha, das funktioniert
00:16:54gar nicht. Also ich glaube, vier von dem Verstehen und Denken passiert eben mit den Händen, weil wir
00:17:00die Dinge bauen und dann im Bauen verstehen, was nicht funktioniert. Und diese ganzen Prozesse
00:17:05brauchen, glaube ich, nicht ein spezifisches Tool, sondern brauchen vor allem uns Menschen in der
00:17:12Kuration, dass am Ende was rauskommt, was verwehrt ist. Genau. Und der Streicheklinie ist, würde
00:17:17jetzt aber trotzdem mal, würde da eine Sache nur einhaken wollen, weil ich, also ich nutze
00:17:21auch obsidien und vielleicht auch für die für die lähte draus, da ist der einzigelte das nicht
00:17:26verwendet. Ja, weiß es nicht. Du kannst, ich dachte ja auch gerade, dass hier dein rand über die
00:17:33leute, die im prinzipien neuronal der second brain fotos posten, so wie ich das gemacht habe,
00:17:38ging gegen mich. Du würdest das wahrscheinlich auch machen, jetzt haben sie die. Hat man diese
00:17:46schöne Feature, dass man im Prinzip diese Verknüpfung, die zwischen diesen ganzen
00:17:51IMD-Files passieren, dass man die so als so eine Art Wolke Neuronalis in Anführungsstrichen
00:17:57Netz sieht, wo im Prinzip starke Verknüpfung immer dicker werden und es sieht einfach
00:18:03auch spaßig aus, das zu beobachten. Ich habe jetzt kurz mal ein Wort wieder aufräumen
00:18:07lassen und dann sitze ich da und lasse das auf dem einen Minute laufen und dann
00:18:10verknüpfen sich diese Pünsche in die ganze Zeit neu, das ist auch irgendwie beruhigend
00:18:14finde ich. Aber jetzt mal Spaß beiseite. Kanäles, weshalb ihr das sagen wollte.
00:18:18Ja, es wird das.
00:18:20Man könnte mir da aus Videos machen, so ein bisschen Climper Climper im Hintergrund und
00:18:23verkaufen das als Eye Meditation.
00:18:27Oh, jetzt, jetzt, mit ein bisschen einfacher Musik im Hintergrund.
00:18:32Ne, aber weshalb ich das nochmal aufgenommen habe, Kanäles, und ich sie unter Wochen habe,
00:18:35ist das Ding, dass ich sage, ich schau manchmal da drauf, um so ein grafisches
00:18:40Gefühl für die Knotenpunkte zu haben.
00:18:42Also ich benutze es auch nicht mehr so, dass ich sage, also wenn ich jetzt irgendwie was Spezielles daraus will, dann nehme ich das LMM und lasse es mir machen oder sowas.
00:18:49Also sagt mir was steckt drin oder so oder hilft mir, dann ich gehe jetzt nicht gezielt auf einen MD-File, weil das einfach Hölle ist, den zu finden.
00:18:55Ich habe irgendwie mit dem, mit den Rohdaten auch über 20.000 Dokumente drin liegen.
00:19:01Aber ich gucke ab und zu drauf und kriege so ein grafisches Gefühl und da ist dann wieder dieses, was du meinst, mit dem Schumel in Blue.
00:19:07Aber ich brauche diese grafische Oberfläche.
00:19:09Mir reicht es nicht auf, außen ab und zu mal auf eine Ordnerstruktur zu gucken oder etwas anderes.
00:19:13Oder es zu diskutieren auch mit dem jeweiligen Element, dass ich sage,
00:19:16ist meine Struktur gut oder so was.
00:19:18Nee, ich habe jetzt auch im Wochenende einmal draufgeguckt und dachte so,
00:19:21was ist falsch, es fühlt sich von der Gewichtung, von der reinen Optik,
00:19:25wie dieses Second Brain, aus sah nicht gut aus und hat mich dann zugebracht,
00:19:28quasi jetzt nochmal eine neue Logik drüber forsten zu lassen.
00:19:32Da kann ich später noch etwas von erzählen.
00:19:34Wie siehst du das?
00:19:35paar Tools, die nicht nur Text senden, jetzt seid ihr beide mehr die Techies und ich eher
00:19:39der UIer unter uns, ne? Aber ich glaube, so ein paar Visualisierungs-Tools braucht man
00:19:43schon, um irgendwie zu begreifen, was da im Hintergrund passiert.
00:19:46Also ich glaube, dass, wo ich das noch nicht gut gemerkt habe, war, um eigene Verzerrungen
00:19:53festzustellen. Also, gerade das Thema LLM-Tiki, ich dachte, das ist super wichtig, weil
00:20:00ich mich natürlich wegen dem Second Brain damit beschäftige und dann merkst du
00:20:04aber dass in der ganzen Periode es sind jetzt irgendwie hundert Tage, seitdem dieser Kapafi-Artikel
00:20:11erschienen ist, dass es, glaube ich, nur 23 aus 5.000 Inhalten sich darum getreten haben. Das heißt,
00:20:20meine persönlichen Wahrnehmung dachte ich, das Thema ist voll groß. Und in der Realität,
00:20:24das ist eigentlich ein Randthema. Und so was, das ist eine Visualisierung toll,
00:20:28weil du einfach merkst, es gibt kaum Kanten auf dieses Thema und es gibt andere Themen,
00:20:32die werden hoch und runter diskutiert, die überhaupt nichts damit zu tun haben.
00:20:36Und das ist ja schon mal ein cooler Indiz und wenn du das halt noch nach Zeit irgendwie
00:20:42aufdrösen kannst und sagen kannst, was war nicht im letzten Monat, was sind die Kanten,
00:20:47die neu entstanden sind und was sind die Knoten, die gar nicht da waren, dann ist es schon
00:20:51mächtig, so was zu nutzen, visuell.
00:20:54Ich fühle mich ja so ein bisschen wie ein Außenseiter grad.
00:21:00Erstens, ich nutze keinen Obsidian, zweitens, ja, ja, Entschuldigung, ich bin ja mehr
00:21:07so ein Freund grad von so Cluster zu basteln mit diesem Skill-Safetyg, also das ich sage,
00:21:14ich pack alles in so ein LLM-Bickey, aber ich verknote das Ganze so, dass es als Skill
00:21:20verfügbar gemacht wird, so dass ich es quasi vorm beliebigen KI-System nutzen kann, ob es Codecs ist,
00:21:27ob es Codecs ist, ob es das ist, was wir auch in der Firma bauen, dass du das überall quasi
00:21:34konsumierbaren Häppchen zur Verfügung hast, sodass du in der Lage bist, deine Knowledge-Häppchen
00:21:41mitzunehmen. Wie viele Teilen passen da rein? Ich habe gerade eben mal so auf meinem größten
00:21:47mit rechts klickt, mal geguckt zu einem Skill, ist ganz nett, weil wenn du ihn als Punkt Skill mitnimmst,
00:21:55dann ist das so wie ein Zip-Feil, in dem dann diese ganze Ordnerstrucke mit dem ganzen Kram drin ist.
00:22:00Und wenn das Zip-Feil schon, ich sage mal, ein paar MB hat, dann kannst du dir vorstellen, was da
00:22:06herausputzelt, wenn er das in sich entpackt und als Ordner anlegt, er ist ein bisschen was dabei.
00:22:11Und dann, wenn du dann überlegst, dass da ein paar Hundert MB vielleicht am Ende vom Tag
00:22:15rausputzeln. Es ist trotzdem noch erstaunlich, wie gut er sich in dem, was ich ihm da gebe,
00:22:22zu Recht findet. Also, was habe ich da zum Beispiel? Das ist die letzten zehn Jahre
00:22:28Entwicklerdokumentation der verschiedenen Vorträge von Apple auf den Entwicklerkonferenzen,
00:22:35die Transkripte, meine eigenen Artikel, die ich zu Mobile mal so bisher verfaßt habe,
00:22:41Sonstige Nachschlagewerke dazu und ich kann ihn dann sogar fragen, wie haben sich
00:22:46bestimmte Dinge entwickelt über die Zeit hinweg und das ist schon ganz lustig, wenn
00:22:52du überlegst, ich habe in dem Sinn nur ein Skill, also ist ja auch nur eine
00:22:57Ansammlung, ich sage jetzt mal von Markdown Dateien, die, wo das Ding weiß,
00:23:03okay, ich habe hier einen gewissen Pfad, wie ich durch deine Daten
00:23:06durchgehe, beziehungsweise wenn ich nichts finde, mache ich Crap minus
00:23:09minus keine Ahnung was, um halt irgendwie an die Dateien zu kommen. Da habe ich mir auch
00:23:13letztens das, was du mir gesagt hast, Cornelius ist noch mal zu Herzen genommen, so das ganze
00:23:17Thema der Semantik. Also wenn ich jetzt suche nach einem Begriff, dass das ja unter Umständen
00:23:23mit einem anderen Begriff bei mir niedergeschrieben steht, da habe ich das Thema so gebeten,
00:23:28nach dem Motto kannst du mir dann da nicht immer auch ein bisschen entgegenkommen,
00:23:32nach dem Motto, mit welchem Begriffsweltin könnte ich denn auf diesen Skill zugreifen,
00:23:37ohne dass er dann gleich irgendwie ins Nirwana geht, ist das perfekt? Nein, ist das ein Rack? Nein.
00:23:41Aber es ist halt extrem portable und auch wenn es vielleicht, ich sage jetzt mal,
00:23:46zwei Minuten brauche mir eine Antwort zu liefern, es ist halt trotzdem noch einfacher,
00:23:50aufzusetzen, zu nutzen, zu transportieren als beispielsweise dieses Rackzeug und von der Seite.
00:23:56Das, was du es eben meintest, Jens mit, man guckt sich das mal an und sieht da so ein Ungleichgewicht.
00:24:03Das ist vielleicht etwas, wo ich sage, das wird vielleicht im ganzen System gut tun, aber die
00:24:09Supportabilität, das finde ich echt, also auch wenn wir vielleicht mal irgendwie nochmal
00:24:13so überlegen, wie das so im dienstlichen Kontext ist, und da bin ich davon, wie man es jetzt
00:24:17bei uns in der Firma macht oder nicht, diese Frage, wo ist denn die Single Source auf
00:24:21Struß?
00:24:22Wie gehst du hin und stellst nicht nur wissen bereit, sondern wie pflegst du?
00:24:26Du willst ja nicht den nächsten Monolithen bauen, bei dem du ein Studium und eine
00:24:30Schulumbrauch oder bin ich davon, dass man ja in Europa immer für jedes KI-System auch
00:24:35eine KI-Schulumbrauch, damit jeder Mitarbeiter entsprechend abgeholt wird, aber lassen wir
00:24:40das mal außen vor. Wie kriegst du so Wissen auch einfach verbreitet? Weil, ich meine,
00:24:46das ist ja jetzt unspezifisch. Es gibt irgendwelche Richtlinien, es gibt irgendwelche FAQs,
00:24:52es gibt irgendwelche Organikramme, es gibt irgendwelche Architekturdokumentationen,
00:24:56gibt keine Ahnung, was nicht, als Handbücher, Verträge, das schreit ja regelrecht danach,
00:25:02eine Ablagestruktur zu haben. Und ich glaube, das wird auch mal eine große Herausforderung
00:25:06sein, wie du so diesen, ich würde es jetzt mal nicht nur Second Prane nennen und Singles
00:25:11of the Truths, ich würde es hier so Knowledge Hive oder irgendwie so, weil irgendwie musste
00:25:17das ja alles mal unter einen Hut bringen. Ich glaube, das wird spannend. Oder habt
00:25:22Ihr da auch was von Obsidien oder noch schon einem Angebot?
00:25:26Ich glaube, man sollte noch mal ganz kurz vielleicht...
00:25:28Da sind wir so ein bisschen drüber galoppiert über diese andere Summe.
00:25:32Wenn ich rede, reden wir von drüber galoppiert.
00:25:34Das ist ja toll.
00:25:35Ich habe eben so von destillieren und während der Periode und ich dachte so,
00:25:43Nein, nein, Coach, ich wollte ja noch mal ganz kurz,
00:25:45vielleicht auch da nochmal, diese Second Brains.
00:25:47Und deshalb, ich komme nur darauf, weil du das gerade mit den Skills gesagt hast.
00:25:51Und ich finde das ganz spannend, weil das ja im Prinzip so kleine Skills, Second Brains
00:25:55nochmal sind.
00:25:56Na, was du da gebaut hast.
00:25:57Aber ich glaube, bei mir war der Treiber der Second Brains auch, um mich von den Modellen
00:26:01zu lesen.
00:26:02Ich hatte damals letzten Herbst angefangen, das Gefühl zu haben, irgendwie habe ich
00:26:06keine Lust mehr, wenn das neue Modell da ist, mich immer wieder auf das neue Modell
00:26:11einzulassen, zwischen den Anbietern hin und her zu wechseln, meine Memory Files
00:26:15zu portieren, wenn es überhaupt schon ging zu den Zeitungen, das geht auch
00:26:18erst seit ungefähr letzten Sommer,
00:26:21High-ups meine ich so in dem Dreh, dass sie angefangen haben,
00:26:23dass sie dann exportieren konnten,
00:26:25von Chatsy PT oder von Cloud und Co.
00:26:27Und da habe ich eben angefangen, etwas zu bauen,
00:26:29was mir hilft, die ganzen Sachen,
00:26:31die ich mit der KI besprochen habe zu dem Zeitpunkt,
00:26:34irgendwo außerhalb der Modelle zu speichern
00:26:38und die dann sehr selektiv
00:26:40einem neuen Modell wieder zur Verfügung zu stellen.
00:26:42Das war eigentlich mein Treiber.
00:26:44Ich wollte das nur nochmal so ein bisschen
00:26:46Richtung Framenbaum, ich mich in diese Ecke bewegt habe.
00:26:49Alles andere, was da später dazugekommen ist.
00:26:51Weißt du, das Thema, die Recherchen, die ich irgendwo mache, so wie Cornelius es auch
00:26:55beschrieben hat, zu automatisieren, gewisse Themen zu automatisieren, aber auch einfach
00:26:59ganz normal meine Likes, die ich irgendwo gebe, täglich jetzt über eine API abzufragen,
00:27:03um die zuzufügen, um dann quasi immer mehr zu verstehen, wie ich denke, damit
00:27:09ich im Prinzip dieses, so wie ich bin, wie ich auf Sachen schaue, nicht ständig
00:27:15neuen KI, einem neuen KI-Modell beibringen muss. Das war mein Treiber für dieses Second Brain.
00:27:21Und was du ja beschreibst, das portiert sich natürlich perfekt auch für Skills, zu sagen,
00:27:25okay, auch bei Skills ist das nötig. Da ist vielleicht nicht das ganze Second Brain nötig,
00:27:29sondern da ist im Prinzip ein sehr skill-spezifisches Brain nötig. Und dann kann man drüber diskutieren,
00:27:35und welches Brain muss das denn da sein? Muss das dein Brain sein? Muss das ein Enterprise Brain sein?
00:27:39Muss das ein Team Brain sein, was da in zur Verfügung steht, um dann sehr kontextspezifisch
00:27:43eigentlich die richtigen Sachen zu machen.
00:27:45Ich werde meine Brücke schlagen.
00:27:47Oh.
00:27:48Ist nett.
00:27:49Und zwar über Sie, Klaube, Brücken sollst du gehen.
00:27:52Und nein, musst du nicht singen.
00:27:53Was war das anderes?
00:27:54Wir sehen, er hört auf zu singen, ne?
00:27:55Das geht.
00:27:56Ja, wir haben so ein Stück Einfall.
00:27:57Versteht ihr, wie das Peter immer falle?
00:27:59Ja.
00:28:00Ich glaube ja, dass diese Second Brain-Kiste ist das für allen, was im Bereich Personal
00:28:05Knowledge Management für, also dein Ablageort für dich, für deine Dokumente
00:28:11und so weiter. Und ich glaube, dass es da einfach, ich glaube, es braucht eine Typologie, die man
00:28:17irgendwie definieren muss, für wen das ist und was drin enthalten ist und das bedingt dann auch,
00:28:23was du brauchst an Technik, um damit zu arbeiten. Wenn du der Ersteller von dem Ganzen bist,
00:28:29dann kennst du die Begriffsfälle, die da abgelegt ist. Das heißt, du weißt,
00:28:32was unter Harnes Engineering gemeint ist oder anderen Themen, weil du dich damit auseinander gesetzt
00:28:39und der Begriff für dich bekannt ist. In dem Moment, in dem du aber dieses Wissen jemand zur Verfügung
00:28:44stellst, der nicht in dieser Begriffsfeld zu Hause ist, kann er nicht darauf suchen. Das war ja auch
00:28:49so ein bisschen markt, dass wir darüber schon gesprochen hatten. Ein Krepp, das der ausführt
00:28:55auf der Kommandozeile, wird dann nicht funktionieren, wenn die Person nicht weiß,
00:29:00was der Schlüsselwort ist, nachdem er suchen muss. Also das Wissen über das richtige Wort
00:29:05quasi ist das Wichtigste, damit das funktioniert. Und ich glaube, dann ist es da halt besser,
00:29:12wenn man zum Beispiel einen semantischen Layer hat, ob das jetzt ein Racksystem ist oder andere
00:29:19Formen von Suchen, die quasi Synonyme kennen oder vielleicht auch wissen, wie in einer Ontologie
00:29:26Begriffe miteinander zusammenhängen und was gemeint sein könnte. Das ist eben hilfreich.
00:29:31Das andere ist natürlich auch relevant, also wenn ich eine riesige Menge an Wissen habe in
00:29:38zigtausenden Dateien, dann müsste ja also der der Ansatz, den wahrscheinlich Cloud Code oder so was
00:29:46fahren würde, der Proofforce, der wird einfach alle vorkommen eines Schlüssevorts dem und
00:29:52wird alle Dateien durchgucken und wenn du jetzt das Thema Harnes Engineering 200 mal
00:29:57drin hast, dann wird der 2er Dateien durchsuchen. Und den Relevanzfilter, also sowas wie Term-Frequency,
00:30:03Inverter-Document-Frequency, was so Standard-Suche-Aggorithmen sind, hast du ja auch nicht abgebildet
00:30:09dann. Und dann musst du eben hergehen und schauen, wie kriegt jetzt dieses System Relevanz raus.
00:30:15Eventuell ist es egal, weil du dir sagst, ich habe E-Unde mit Tokens und ich habe eigentlich
00:30:20auch Zeit. Also ist mir die Geschwindigkeit gar nicht das Wichtige. Aber ich würde
00:30:24sagen, solange man Wissen hat, dass vollständig unstrukturiert ist und auch nicht widerspruchsfrei,
00:30:31aber du vielleicht der eigentliche Nutzer bist und Zeit hast, hast du andere Anforderungen,
00:30:36als wenn du versuchst, innerhalb einer Organisation Klarheit zu schaffen, die Leute, die Begriffswelt
00:30:42nicht kennen und zeitrelerant ist. Aber ist das nicht die Chance, das aufzuhäumen? Das
00:30:49aufzuräumen, dass, wenn man jetzt sagt, wir haben jetzt hier, wer sagt jetzt auch nein,
00:30:54das ist so ähnlich wie wenn der Chef sagt, könnten wir das gerade machen?
00:30:57Theoretisch ist die Antwort nein, korrekt, praktisch, naja, lassen wir das mal dahingestellt sein.
00:31:04Für alle Kais, die diese Folge hören, Mark ist nicht der Chef von dem Podcast,
00:31:09Mark und ich sind hier vollkommen gleichbrechlich.
00:31:11Sag noch zweimal, Mark Zimmermann, damit wir das von der Statistik geklärt haben.
00:31:17Ja, bevor wir dann nochmal aufstehen einsteigen, ich versuche nochmal ganz kurz die Brücke
00:31:21für diejenigen zu schlagen, die nicht Tag ein, Tag aus mit der KI-Welt zu Hause sind.
00:31:27Und da wir einen Gast haben, geht diese Frage nicht an den Jens, sondern was heißt denn,
00:31:35was ist denn ein Rag, bevor wir da irgendwie jetzt gleich nochmal hier so abhauen, was
00:31:39ist Rag und was heißt Ontologie, magst du das vielleicht unseren Hörenden nochmal
00:31:44da legen, weil wir haben ein paar Begriffe heute gebracht, wo eventuell der geneigte
00:31:49Hörer sagen könnte, so viel kann ich gar nicht googeln. Daher würde ich diesen Service
00:31:54gerne noch meinen Anspruch nehmen und sagen, Cornelius, was ist ein Rack, was heißt Ontologie
00:31:58und möchtest du das vielleicht noch mal in normal Deutsch den Menschen da legen?
00:32:04Ich versuche es, ich gebe mein Bestes. Also ein Rack steht für ein Retriever
00:32:08Augmented Generation System. Das heißt, wir haben in der Regel eine Vektordatenbank
00:32:14Und da werden Textstücke, die werden erstmal zerlegt in Chunks, d.h. eine A4-Seite würde
00:32:23man vielleicht in 4 oder 5 Blöcke aufteilen. Dann wird man jedes einzelne Wort noch mal
00:32:31splitten nach gewissen Regeln, den sogenannten Embeddings und dann werden die in einem,
00:32:37weiß ich nicht, wie 400-dimensionalen mathematischen Raum angeordnet und ermöglichen quasi überräumliche
00:32:45Distanz, Vergleichbarkeit und Nähe. Also gibt immer dieses Standardbeispiel, König minus Mann
00:32:52plus Frau gleich Königin. Also ich kann damit dann auch rechnen quasi und habe damit eben die
00:32:59Möglichkeit, Dinge zu finden, die semantisch von der Bedeutung her sehr dicht an etwas dran sind.
00:33:05Genau. Ontologien gibt es eigentlich schon, glaube ich, deutlich länger, aber kommen auch
00:33:13aus der gleichen Ecke. Grafentheorie, quasi ich habe Knoten und Kanten und bildet dann
00:33:21solche Trippe aus einem zwei Objekten und der Verbindung zwischen den Objekten und
00:33:27die kann ich beschreiben. Wie sie zusammenhängen, um dann quasi Beziehung zwischen Worten,
00:33:32Konzepten zu beschreiben. Es ist ganz gut, wenn man dann das ganze Thema KI sagt,
00:33:39welche Dinge zusammengehören, welche nicht und damit habe ich einfach noch mal die
00:33:42Möglichkeiten, ein bisschen feiner, auch Dinge auseinanderzuhalten und auch
00:33:48Möglichkeiten zu geben in der Suche zum Beispiel, dass dann noch entlang
00:33:52gewisser Fahre traversiert wird, um ähnliche Dinge zu finden.
00:33:59Ich bin jetzt ein bisschen eingeschüchtert, nachdem wer Jens vorhin gesagt hat, so nach dem Motor, der macht es nicht der Chef. Das ist auch so, ja? Jens, möchtest du ein paar Anweisungen raus geben?
00:34:12Raus zum Kaffee oder sowas?
00:34:14Nein, nein, nein, nein, nein, den nehme ich mir nach der Aufnahme. Wir haben ja heute zwei Aufnahmen, die wir machen wollen.
00:34:19Von der Seite werde ich nach dem Gespräch und nicht mittendrin rausgehen. Wer würde das schon tun, ne? Wer würde das schon tun?
00:34:27Ja, ich hole dir jetzt kein Kaffee, auch wenn du den versteckten Hinüber vielleicht gegeben hast. Nein, das ist passbar. Also ich würde noch mal
00:34:34Einblick auch auf das Thema des Waltz, den man so hat, das ist ja dann auch so dieser Datenspeicher in dem das liegt, der Tresor, wo das dann nicht liegen, weil ich finde
00:34:45wir haben das vielleicht noch nicht ausreichend genug beleuchtet, wo der Vorteil liegt. Wir haben jetzt so verschiedene Aspekte reingebracht, verschiedene Technologien reingebracht.
00:34:54Für mich ist es aber wirklich so, dass ich
00:34:56Ich spare mir, also A erstmal A, die Qualität des Researchers, und ich muss, Herr Cornelius hat am Anfang gesagt, du hast dir dieser Weekly-Digits nicht mehr durchgelesen irgendwann, also das kommt auf Wöchterger Basis und dann guckt man nicht mehr drauf.
00:35:12Ich kriege die auf täglicher Basis tatsächlich und gebe auch zu, da darf dann jemand so ein bisschen das Ding verloren, dass ich immer reingucke, das schaffs nicht immer.
00:35:19Ich bin aber von der Qualität, wenn ich jetzt reingucke, wahnsinnig überzeugt.
00:35:23alles, was mir das Ding gerade liefert, auf Grun meines Second Brains, weil es weiß, was
00:35:28mich interessiert.
00:35:29Ist extrem gut, ne, weil ich habe so eine Kette gebaut, dass er eben nach Sachen schaut,
00:35:35die abgelegt werden, dann lasse ich auch immer so drei Deep Dive schreiben als MD-Pfeil,
00:35:40die abgelegt werden, auf der lokalen Maschine bei mir, auch zur Erklärung, ich wollte
00:35:45auch weg sein aus der Cloud, das liegt alles auf der lokalen Maschine, auf
00:35:49dieser lokalen Maschine gibt es dann nochmal so einen Bundel von LMMs, die lokal laufen
00:35:54mit dem Gemma-Modell, dass ich sage, ich verbrauche da auch keine Tokens, sondern das läuft alles
00:35:58lokal. Die gehen halt aber rüber und archivieren Sachen, die alt sind, also dieses Thema vergessen,
00:36:05auch Sachen wegschieben, die vielleicht gar nicht mehr so spannend sind. Dann gibt es
00:36:08auch da, Mark, so ein bisschen inspiriert von dir das Advisory Board, dass quasi rüber läuft
00:36:14über dieses Vault und sich die Themen auch anguckt. Das habe ich irgendwann mal gebildet
00:36:18aus den Autoren, die ich am meisten folge, da ist dann auch ein links, die ich am meisten
00:36:23geliked habe oder sowas.
00:36:24Da sind ein paar dabei und da in einem Camerfi auch, der dann auch im Advisorboard sitzt und
00:36:27sich diese Themen nochmal anschaut und auch sagt, sind diese Themen aktuell und nach
00:36:31neuen Verknüpfungen einfach zu.
00:36:33Also das heißt, dieses Vault im Hintergrund, dieses Second Brain im Hintergrund hat auch
00:36:37so eine Art, ohne diesen Begriff hier zu stark ausbringen zu wollen, über so eine
00:36:41eigene Evolution.
00:36:42Also das wächst mit, ohne dass ich etwas tue.
00:36:45Das erkennt also auch Sachen, die sind mit eingebaut, dass ich, wenn ich auf gewisse Nachrichten
00:36:50nicht reagiere, ich es dem über Skills so mitgegeben habe, dass und nach und nach diese Themen dann
00:36:57anscheinend von mir auch gar nicht mehr so wichtig sind. Ich versuche das dann so aufzusetzen,
00:37:01dass ich sage, guck aber trotzdem noch mal einmal einen Wochenende, da kommt noch mal ein
00:37:05anderer Skills, der dann drüber läuft, der ist dann auch noch mal angucken und sagt,
00:37:08wow, dieses Thema ist aber online immer noch so heiß und Jens hat es immer noch nicht
00:37:13aufgegriffen. Obwohl Jens es langsam vergessen möchte anscheinend oder einfach nicht aufmerksam genug ist,
00:37:19auf meine Aktivierung, spiele ich sie noch einmal hoch. Wenn er dann sagt, nein, dann ist es auch weg.
00:37:24Also solche Mechanismen habe ich eingebaut. Und das ist natürlich ein extremer Vorteil. Ich habe
00:37:29auch noch weitere Sachen eingebaut, wie so ein Wächter, der schaut, weil ich natürlich ab und zu
00:37:32auch mal mit meiner OpenClaw drauf zugreifen möchte und auch mit dem Online-Service in
00:37:38Real-Time-Arbeiter, dass ich sage, der Wächter schaut auch noch mal, ob da Informationen drin sind,
00:37:43die okay sind für eine öffentliche API oder für meine private API bei Cloud, die ich dann bezahle,
00:37:50wo ich dann aber auch nicht mehr alles hoch schicken möchte. Da wird dann auch im Prinzip
00:37:53geschaut, was kommt aus dem Second Brain raus. Und ich glaube, in all den Sachen,
00:37:58die ich jetzt gerade so beschrieben habe, da sind noch viele Themen drin, die man so
00:38:02so ein bisschen ableiten kann, wenn wir auf das Thema, schlag ich die Brücke? Auch gerne zu Mark oder
00:38:08zu Cornelius, eine von euch beiden, gerne antworten in die Richtung, wie bauen wir denn so was dann
00:38:12eigentlich in so einem Firmenkontext in Zukunft auf? Ich finde es schön, dass wir wieder zurück zur
00:38:16Förderung gekommen werden. Ich hätte ja noch die Brücke dahingehend erweitert nach dem Motto,
00:38:21was geben wir den Leuten denn als Ratschlag mit? Aber ich hebe mir diese Brücke dann
00:38:25zu den Abschluss auf und ich gucke jetzt als erstes dann doch Richtung Cornelius,
00:38:30was machen wir jetzt? Also wir haben jetzt alle ganz viel das Thema ja, second train und hast
00:38:34nicht gesehen. Was machen wir jetzt in der Firma? Was wäre denn so ein guter Schritt,
00:38:39den man in welcher Firmen empfehlen kann, haben wir so ein bisschen? Also ich gehe noch mal einen
00:38:44Schritt ganz kurz zurück zu Jens und gucke dann, dass ich den Weg zurückstehe in der Firma.
00:38:48Wir helfen dir auf euch. Das, was ich hier für mich persönlich...
00:38:52Zu einer Firma, ja? Zu einer Firma. Das, was ich für mich festgestellt habe,
00:38:59ist tatsächlich, dass die Systeme oftmals einigermaßen gut funktionieren, wenn ich aber im Detail
00:39:07draufschaue, dann doch sehr viele Fehler teilweise passieren und die propagieren sich natürlich.
00:39:15Also alles, was der im Wissen falsch auto-distilliert oder welche Ableitung er trifft oder auch
00:39:22teilweise welche Dinge er sich überlegt, wie er es kuratiert, der macht viele Fehler
00:39:28Und der macht viele Fehler, weil ich auch faul bin.
00:39:32Der überlegt sich ein gutes Konzept, das sehr gut klingt.
00:39:34Und ich denke mir, na ja, der hat sich was ausgedacht, wie er das ganze
00:39:38scored und rated oder es wird schon gut sein.
00:39:42Und dann baut er das und dann denke ich mir auch, ich habe ja ein Feature Workflow
00:39:47und der macht ja Test Driven Design und der benutzt Codex fürs Review
00:39:50und das wird schon alles sauber sein, wenn es durchgeht.
00:39:53Und dann machst du trotzdem mal irgendwann mal den den Check und prüßt
00:39:58ob er die Dinge wirklich macht oder dir fällt was auf, wie eben in deinem Grafenmodell, dass
00:40:02es irgendwie nicht gut aussieht in irgendeiner Form und dann lässt du mal länger darüber
00:40:07nachdenken, wie die Dinge denn funktionieren und was sich kommt raus, der hat ziemlich
00:40:12viel Mist gemacht.
00:40:13Und ich glaube halt dieses, also zumindest aktuell glaube ich, ist Kuration nicht vollständig
00:40:21ausgliederbar und ich glaube, das wird schon auch der Job sein, dass wir da reingehen
00:40:27und viel machen. Und auf der anderen Seite denke ich mir auch, also wenn ich 90% des
00:40:32Zeitaufwand spare und der macht 30% falsch, habe ich immer noch großen Mehrwert. Also
00:40:37ich glaube, diese Gleichung ist auch richtig. Muss kein perfektes System sein. Ich kriege
00:40:41deutlich mehr Sachen, die mich stimulieren in der guten Art und Weise und zum Nachdenken
00:40:46anregen, als ich es davor gehabt hätte, wenn ich mir einfach die Dinge so anhören
00:40:50muss. Ich glaube aber, dass genau in der Kuration der Punkt ist, der halt
00:40:54super wichtig ist für den Unternehmenskontext. Also, dass man sich sehr gut überlegt, welches
00:40:59Wissen möchte ich eigentlich weh mitgeben und in einem Skill verfügbar machen, das dann
00:41:05eben eine sehr hohe Qualität hat, widerspruchsfrei ist, vielleicht Methodenwissen, Standard Operating
00:41:11Procedures, also Geschäftsabläufe, die man definiert hat, enthält und so weiter
00:41:16und so fort. Also Dinge, die das Qualitätsniveau der Arbeit grundsätzlich steigern. Aber
00:41:22Der Weg dahin ist eben einer, den man sehr aktiv und mit menschlichem Einfluss gestalten muss.
00:41:29Wenn ich jetzt zu meiner zweiten Frage überleite,
00:41:33es geht dann euch beide.
00:41:35Du darfst euch überlegen, wer zuerst dran fängt.
00:41:38Was empfiehlt man denn jetzt?
00:41:39Also jeder, der bis hierhin durchgehalten hat, der muss jetzt ein Guti kriegen.
00:41:44Der muss ein Guti kriegen, weil er hat jetzt ja verstanden,
00:41:49Okay, ich möchte vielleicht nicht jede Modell und jedem Anbieter alles von vorne erklären.
00:41:55Ich möchte mein Interesse, dass ich habe irgendwie der Maschine festhalten.
00:42:01Ich möchte einfach anfangen mit dem Thema Second Brain.
00:42:07Was sind denn so die drei Minuten in West, wo einfach mal ein bisschen abzustecken,
00:42:13damit man anfangen machen kann.
00:42:15einen ersten Schritt in diese Richtung. Wer möchte anfangen?
00:42:21Ja, ich überlege noch, wie das geht, dass wir beide überlegen, obwohl wir an verschiedenen
00:42:25Orten sind. Nein, das ist vielleicht auch so ein Second Brain-Thema hätten. Cornelius
00:42:28und ich sind schon ein virtuelles Second Brain, wer uns das einfacher gefallen zu überlegen.
00:42:32Gemeinsam zu überlegen, wer von uns anfängt. Aber ich tue es jetzt einfach mal. Ich
00:42:35Ich glaube, wenn man jetzt anfängt, sich zu überlegen, ein Second Brain aufzubauen, dann
00:42:45sollte man tatsächlich, glaube ich, wenn man es vorher noch gar nicht gemacht hat, dann
00:42:49ich würde mit Skills anfangen, so wie du es beschrieben hast.
00:42:52Weil ich glaube, das Thema Skills ist eine gute Herleitung, um einen guten Skills irgendwo
00:42:57abzulegen.
00:42:58Da muss ich mir, oder einen guten Skill zu produzieren, das geht ja gar nicht ums
00:43:00ablegen.
00:43:01Es geht ja darum, dass ich einen guten Outcome hinterhaben möchte mit diesem
00:43:04Dafür muss ich mir überlegen, welche Aufgabe soll dieser Skill machen, erledigen können
00:43:10und welche Informationen zusätzlich muss dieser Skill noch haben.
00:43:14So, und da bin ich schon genau in dieser Ecke, wo ich darüber überlegen muss, okay,
00:43:20welche Informationen, in welcher Art und Weise sollten die strukturiert sein, muss ich
00:43:24diesem Skill zur Verfügung stellen, damit er seine Aufgabe erfüllen kann.
00:43:27Das ist für mich so der erste Schritt in so eine Second Brain Überlegung rein, weil
00:43:30dieses Second Brain, wie ich es gebaut habe. Das ist riesig. Das muss man natürlich irgendwie
00:43:34wieder schneiden für einzelne Aufgaben später machen. Ich glaube, das würde ich jetzt keinem
00:43:40so raten, so ein Monster erst mal hinzusetzen. Das ist tatsächlich eher so ein Sparspiel,
00:43:46was ich betreibe in dem Moment. Das fängt mit Skills an. Schaut erst mal, dass er vernünftige
00:43:51Skills aufbaut, weil ich glaube, die Kombinationen von Skills mit Files, die er noch ablegt
00:43:56für dieses Skills in Projektordnern, irgendwas anderes, aber den Rechnern ist eine schöne
00:44:03erste Stufe eines Mini-Second Brains, dass man ganz speziell für ein Skill aufbaut, weil
00:44:10der Second Brain ist im Prinzip nichts anderes.
00:44:13Bevor ich das Wort an Cornelius gebe, kurz aus der Werbel-Regie, was ich da tatsächlich
00:44:19an der Stelle das total, ich soll sagen, simpel gemacht, du hast ja gesagt mit Skills
00:44:24und Skillself mit die Chancen, ich kann sie speichern und woanders hin schicken. Ich habe ja diesen Skillself
00:44:30aufgetan und was ich dem Ding dann sage, hier nimm mal aus dem RePro das Projekt und schau dir das
00:44:37Projekt an und speichere in dem Projekt das Wissen aus folgenden Ordnern und dann gebe ich ihm so
00:44:43ein Ordner, was heißt ich die Transkripte von der WWDC oder von der Google IO und sage hier
00:44:47gib ihm das und dann kann ich dagegen Fragen stellen. Das finde ich, das könnte man
00:44:52tatsächlich ziemlich einfach machen, weil da heißt dann der Prompt, egal ob du da jetzt
00:44:55German 9 nimmst oder, oder, oder hier Chatchi P.T. oder, oder Entropic, nimm dieses Gitterprojekt.
00:45:04Hier ist mein Wissen, fräst das zusammen, gib mir den Skill zurück.
00:45:08Vielen Dank.
00:45:09Das ist, glaube ich, ein guter Einstieg so und jetzt bin ich gespannt, was uns der
00:45:14Canelius empfiehlt.
00:45:16Ich glaube, was ganz anderes.
00:45:19Und es schön.
00:45:20Bananen.
00:45:21Ja, das ist total Gutes.
00:45:24Aber auch wieder eher persönlich.
00:45:27Ich glaube bei mir ist es ja eher so dieses gewesen,
00:45:30wie reduziere ich auch mein Medienkonsum,
00:45:35wie schaffe ich es auch sozusagen weniger Zeit verbringen,
00:45:39mich informieren zu müssen oder das Gefühl zu haben,
00:45:41mich zu informieren.
00:45:42Und ich glaube dieses, was halt wirklich hilft
00:45:46oder ist eigentlich den Fokus zu schiften von der Frage,
00:45:50was könnte ich noch wissen? Oder was will ich noch wissen wollen? Hinzu, woran arbeite ich
00:45:56eigentlich gerade? Was will ich eigentlich erreichen? Und dann schaffe ich ja schon einen Fokuspunkt,
00:46:02zu sagen, okay, folgen das Wissen ist vielleicht überhaupt relevant. Und dann habe ich eigentlich
00:46:07einen Einstieg. Also, bei mir ging es ja vor allem um das ganze Thema eigentlich Kuration und alle
00:46:13möglichen Inhalte kommen rein. Und ich glaube, es ist gar nicht so wichtig, dass man sich ein
00:46:18perfektes System baut, das dann auch nachher nur sehr, sehr viel Müll vielleicht auch nur anhäuft,
00:46:25sondern dass man eigentlich einen steigt mit einer anderen Frage, nämlich wo will ich hin,
00:46:29was will ich erreichen, was will ich bauen und was brauche ich dafür. Und dann ist
00:46:33vielleicht gar nicht so viel Wissen notwendig oder es ist eine gezielte Suche. Und dann kann
00:46:39man sich daraus quasi sein Pray nach und nach ausbauen. Damit will ich anfangen.
00:46:44Okay, ich glaube, guter Punkt von Nekonewos, ich würde sagen, also wir haben es immer gesagt,
00:46:53Anfang ist immer hilft, KI Thema. Ich glaube einfach machen, also das nochmal als Hinweis
00:46:59von meiner Seite. Ich glaube, da kann man nicht viel kaputt machen. Es ist halt irgendwie auch
00:47:03komisch. Wir haben so Supermodelle, die alles mit dem machen, Videos generieren können und
00:47:08auslesen können. Und auf der anderen Seite sind aber so Second Brains momentan einfach
00:47:13reine Texte teilen. Und das ist, glaube ich, so auf der anderen Seite auch wieder schön, weil es total
00:47:16zugänglich ist, weil jeder hat wenigstens mal in seiner Schulzeit schon mal versucht,
00:47:21ein strukturiertes Text zu schreiben und nichts anlesen. Ja, auch zu lesen auch. Nichts anderes ist
00:47:28es eigentlich das, was wir da gerade machen. Wir legen versuchen, irgendwie Daten strukturiert
00:47:33abzulegen, dass die sowohl von den Agents als auch für uns für die unterschiedlichen Anwendungs-Szenarien
00:47:37erstmal einfach zu verstehen sind. Das wird nicht das Ende der Fahnenstange sein.
00:47:41Also diese Sachen werden sich meiner Meinung nach weiterentwickeln.
00:47:43Wir haben heute gar nicht so richtig das Thema Enterprise, Enterprise Brains,
00:47:49eine Anzahl von 1000 Second Brains, die miteinander interagieren werden in Zukunft oder so was
00:47:54dann geht.
00:47:55Das sollten wir vielleicht noch in einer anderen Folge nochmal nachholen.
00:47:57Also Cornelius, da geht vielleicht schon mal die erste Einladung an dich, dass du gerne
00:48:01noch mal Gast bist.
00:48:02Da machen wir nochmal eine zweite Folge dazu und gucken mal drauf, wie im Prinzip
00:48:05diese Brains miteinander interagieren können.
00:48:08Aber, wie immer, einfach probieren. Es gibt auch da draußen keinen, der irgendwie sagt,
00:48:15das ist der Plan A und der es richtig macht und dementsprechend, ich glaube, wir konnten
00:48:20heute wieder so ein paar Sachen vielleicht diskutieren, aufzeigen, wie man es machen
00:48:26kann, auch aufzeigen, wie man es nicht machen kann. Wenn man sich zurück erinnert an meine
00:48:30Story mit dem Computerspiel, installieren, da muss man nicht unbedingt einen LMV benutzen.
00:48:34hätte auch zwar da Sachen googeln können, ist wahrscheinlich. Aber sei es drum, ich bin in den
00:48:39Fahrt eingeburgen und konnte ihn dann nicht mehr verlassen, weil ich auch keine Ahnung gehabt habe,
00:48:42was das Ding gar nicht auf meinem Rechner macht. Aber sei es. Und dann gibst du der KI einfach
00:48:47volle Kontrolle um Jesusbett. Das kann schon schief gehen, ja? Das kann schon schief gehen. Was macht
00:48:53das den Kasselbüro hinter dir, ja? Ja, es ist ja Gott sei Dank nichts passiert. Ja,
00:49:00Ja, aber ich glaube, Mark, möchtest du noch, wie so häufig, das machst du auch immer sehr schön, muss ich aber sagen,
00:49:05wir sind irgendwie gut drauf und nett zueinander, wir müssen mal wieder irgendwie vielleicht...
00:49:09Ich hab jetzt schon ein gewisses Zwangsgefühl in mir, dass du mir das so gibst.
00:49:16Also auch von meiner Seite Cornelius, ja, auch wenn der ein oder andere vielleicht heute gedacht hat,
00:49:21ah ja, ja, ja, ja, ja, heute sind aber viele Begriffe über den Äther geflossen, die ich erst mal nachdrogeln muss.
00:49:26würde ich sagen fangt an probiert das mit den skills aus ich glaube das ist
00:49:31tatsächlich sehr umgänglich ansonsten notion obsidian einfach hauptsache
00:49:35machen und eines sache wird einem gefühlt auch klar wenn man anfängt
00:49:42sich mit diesen ur speichern von wissen zu beschäftigen markdownfalls merkt
00:49:49man eigentlich was man alles verloren hat in Zeiten von kein bashing gegen
00:49:53Microsoft-Jahr, aber Word-Excel-Powerpoint, wo man sich beschäftigt, Informationen durch Fetch-Schrift und
00:49:59Farbwahl einer Spalte, sich zu verewigen, wo man sich dann überlegt, ja eigentlich ganz ehrlich,
00:50:06es geht auch anders. Komischerweise beschäftigen sich gerade immer mehr Menschen damit, wie
00:50:10man in klassischen Text-Dateien mit einem Hashtag. Früher nannten wir das Schweinegatter,
00:50:15aber das kann man irgendwie heutzutage, glaube ich, so nicht mehr sagen, weil sie nicht
00:50:19Für Überschriften und Tiedungselemente und keine Ahnung was von der Seite schaut euch
00:50:23Markdown an, schaut euch an wie eure Informationen dort reinspeichert, schaut euch an wie ihr vielleicht
00:50:28Transkripte von YouTube, Podcasts oder Professor Meldung oder was auch immer euch interessiert
00:50:34dort rein bekommt und damit würde ich sagen, schließen wir das erste Kapitel des Second
00:50:39Prane, kommen zu einer weiteren Folge sicherlich bald wieder mit dem netten Cornelius, wenn
00:50:45Und wir verabschieden uns in dieser Folge, entlassen euch in die Nacht mit den Gedanken über eure eigene Wissenserweiterung mit Hilfe von Mark Laundertein.
00:50:55In diesem Sinne, bis bald, ciao.
00:50:58Ciao.
00:51:30SWR 2020