Souveräne KI: So machst du dein Unternehmen unabhängiger #010

Shownotes

In dieser Folge

Montagfrüh, und dein bestes KI-Modell meldet nur noch: in deinem Land nicht verfügbar. Kein Hack – eine Behörde hat den Schalter umgelegt. Genau das ist mit Fable 5 passiert, und die Frage ist nicht ob, sondern was du machst, wenn es dich trifft.

Worum es im Deep Dive geht: Souveräne KI als Risikomanagement – wie du dein Unternehmen unabhängiger von US- und China-Modellen machst: Datenklassen statt Ideologie, EU-Hosting, Self-Hosting im Klartext und warum „eigene KI trainieren“ fast immer RAG bedeutet.


Hot News der Woche

  1. Fable 5 wird Premium – Anthropic verlängert den Gratis-Zugang kurzfristig bis 12.7., danach kostet das stärkste öffentliche Modell Usage-Credits: ca. 10 $ / 50 $ pro Mio. Input-/Output-Token, rund doppelt so teuer wie Opus 4.8.
  2. Claude Cowork kommt aufs Handy – der agentische digitale Kollege läuft jetzt als Mobile App (Beta, Max-Abo): Aufgabe am Rechner starten, unterwegs überwachen und freigeben.
  3. KI-Modelle werden Rüstungsgüter – China erwägt eine Exportbremse für seine besten Modelle, Trump hebt die GPT-5.6-Restriktion auf, und OpenAI bietet dem US-Staat laut Bericht 5 % der Anteile an (~42,6 Mrd. $).


Deep Dive: Souveräne KI & Self-Hosting

Warum „Server in Frankfurt“ dich wegen des US Cloud Act nicht souverän macht – und warum Souveränität nach Datenklasse entschieden wird, nicht nach Ideologie: unkritische Workloads auf EU-gehostete Frontier-Modelle (Bedrock, Vertex AI, Azure), sensible Daten zu EU-Anbietern wie Mistral, hochsensible auf selbstgehostete Open-Weight-Modelle.

Dazu Tobias’ 5-Schritte-Plan (Datenklassifikation ist Chefsache!), Self-Hosting im Klartext inklusive Lizenzfallen bei Llama & Co., der Denkfehler „wir trainieren unsere eigene KI“ (RAG = Aktenschrank daneben, kein Training) – und die ehrliche Antwort: Self-Hosting spart kein Geld, es kauft dir Datenhoheit.


Erwähnt in dieser Folge

  • Fable 5 (Anthropic) – stärkstes öffentlich zugängliches KI-Modell, ab 13.7. nur noch per Usage-Credits
  • Claude Cowork – Anthropics Agent-App für Wissensarbeiter, jetzt mobil
  • Mistral – EU-Champion aus Frankreich, u.a. sehr stark bei OCR/Belegerkennung
  • Aleph Alpha – deutsche KI-Hoffnung aus Heidelberg, laut Folge wohl kanadisch geworden
  • Black Forest Labs (Flux) – Bild-/Videogenerierung aus Deutschland
  • Teuken-7B (Fraunhofer) & OpenEuroLLM – deutsche bzw. europäische Open-Source-Bausteine
  • AWS Bedrock / Google Vertex AI / Microsoft Azure – EU-gehostete Wege zu den US-Frontier-Modellen


Host

Tobias Schnitzler – Co-Founder AI-Power. Tech & Daten, seit Jahren in echten KI-Projekten im Mittelstand.


Folge mir!

WAFER – der AI-Podcast aus der Praxis für Geschäftsführer, Unternehmer und Führungskräfte. Tobias nimmt dich mit hinter die Kulissen: echte Erfahrungen, echte Herausforderungen und was wirklich funktioniert, wenn man KI ins Unternehmen bringt. Kein Hype, kein Blabla – aus der Praxis in die Praxis.

Folge mir auf LinkedIn (Profil unter dem Podcast verlinkt) und schick mir deine Themenvorschläge. Keep going – bleib bei KI dran, es lohnt sich.

Transkript anzeigen

00:00:00: Alle reden von der besten KI, aber fast keiner fragt, wem gehört sie eigentlich und wer kann sie mehr wegnehmen.

00:00:08: Und genau diese Frage entscheidet gerade ob dein Betrieb in ein oder zwei Jahren noch handlungsfähig ist?

00:00:16: Oder nicht!

00:00:18: Denn stell dir einmal vor du kommst montag früh rein Und das beste KI-Tool, die besten Integration und die besten Workflows, die alle LLM getrickert sind.

00:00:27: Die fest mit deinem Unternehmen und deinem Team verankert sind... ...die zeigen nur noch... Ups!

00:00:33: Dieses LLm ist in deinem Land nicht mehr verfügbar.

00:00:36: Und auf einmal stehst du als Unternehmerinnen und Unternehmer mit einem Unternehmen in der EU da.

00:00:42: Das ist kein Auswahl, das ist kein Heck.

00:00:44: Das es einfach eine Behörde, die in einem Land entschieden hat den Schalter umgelegt, dass dieses Modell nicht mehr fervoggbar ist.

00:00:50: Und genau das ist vor vier Wochen ungefähr passiert, hast du wahrscheinlich mitbekommen.

00:00:55: Mit Claude Fable V und auch GPT-Fünf Punkt Sechs.

00:01:00: und die Frage dies nicht ob sondern was du machst wenn es dich betrifft.

00:01:07: ja und damit herzlich willkommen zu einer neuen Folge zur zehnten Folge vom OAV Podcast.

00:01:12: mein Name ist Tobias Schnitz vielleicht bin dein Host Und heute nehme ich diese Folge, ja in der Nähe direkt von einem zauberhaften VN-Nähdich aus.

00:01:19: Ich bin nämlich im Urlaub mit meiner Family aber habe mein Podcastmikro natürlich dabei und für dich die spannendsten News im Bereich KI-Souveränität und Co.

00:01:29: zusammengestellt.

00:01:30: Man will auch heute natürlich mit dir einen richtig krassen Deep Dive gehen.

00:01:34: In meines Erachtens ein Deep dive, der längst überfällig ist denn wir gehen nämlich in den Bereich Souveräne KI Wie du unabhängiger wirst, was vielleicht self-hosing wird sich bedeutet und wie Du das ganze angehst.

00:01:49: Ja bevor wir in diesen deep dive reingehen und ich glaube der wird super spannend werden wenn du ein Unternehmen in der EU hast Wenn du Kunden hast die EU sind Und ja du dich eigentlich aufstellen willst dass du nicht so abhängig bist dann ist es mega.

00:02:02: Wir gehen jetzt aber noch mal kurz in die news rein denn Heute zum achten Juli, wo ich diese Podcast-Volker am späten Abend um zweiundzwanzuhr sechsunddreißig aufnehme ist es so dass kurzfristig Fable Five verdengert wurde.

00:02:19: Denn ursprünglich war Fable five bis zum siebten, siebte verfügbar falls du nicht weißt was fable five ist.

00:02:25: Fabel five ist eines mit der stärksten KI Modelle auf dem Markt die für die Allgemeinheit zugänglich ist das von der Firma Anthropic Die aus den USA kommt.

00:02:35: Als sie das vor ca.

00:02:36: vier Wochen gelauncht haben, ist es binnen zwanzigstunden per Exportbeschränkung von der S-Regierung ja limitiert worden, dass es vom Markt genommen werden musste.

00:02:46: Es war dann so gut, ich glaube, für circa vierzehn Tage knapp drei Wochen unter Verschluss kamen wieder... Und dann hat der Fabrik natürlich immer angekündigt, hey ihr könnt es mal testen.

00:02:55: Aber irgendwann hört das auf und dieser Test sollte zum siebten enden.

00:02:59: Jetzt haben Sie's bis zum zwölften sieben gemacht.

00:03:02: also wenn du es noch testen willst Go for it!

00:03:04: Lass wirklich die Token brennen und danach wird es nämlich Usage Credits kosten.

00:03:11: Das ist das beste öffentliche Modell und wandert jetzt binnen von Wochen Ist in deinem Abo drin zu ja als jetzt ein Premium-Preis-Pronutzung und der Preis verdoppelt sich fast zu dem bisher teuersten Modell.

00:03:26: Und das ist wirklich, wirklich spannend!

00:03:28: Kurz einmal zur Einordnung – was bedeutet es eigentlich?

00:03:32: Es wird ja immer zwischen Input- und Outputtoken unterschieden.

00:03:35: Die Inputtokken sind meistens immer günstiger als die OutputToken.

00:03:38: Das ist auch relativ klar, weil Output Token natürlich mehr Computing Time also mehr Rechenzeit erfordern.

00:03:43: Wenn man sich jetzt z.B.

00:03:44: Opus vier Punkt acht nimmt, dann ist Fable Five ungefähr doppelze teuer circa zehn Dollar für eine Million Input-Token und ca.

00:03:51: fünfzig Dollar für einen Millionen Output-Token.

00:03:55: Man mag jetzt so denken, eine Million Token ist doch gar nicht so wenig, das ist doch auch gar nicht ... Doch es ist ja gar nicht sehr wenig.

00:04:01: aber hey!

00:04:03: Das ist so schnell erreicht dieses Limit.

00:04:06: wenn du ein paar Läufe am Tag hast weiß ich nicht, zwanzig Läufel oder sowas bist du mal schnell irgendwie elfhundert Dollar im Monat los oder mehr.

00:04:15: das kann wirklich richtig durch die Decke knallen.

00:04:18: Na ja, so läuft das bei den Frontier-Treibern also bei den frontiermodellen Entwicklern Thema Kosten Alternativen.

00:04:26: Das ist natürlich ein Riesenthema.

00:04:28: wie gesagt werden wir uns gleich damit beschäftigen.

00:04:31: Was es noch passiert auch aus der Anthropic Welt ist angekündigt worden gestern am siebten Juli.

00:04:38: Anthropic hat er CloudCube im Januar rausgebracht für die KnowledgeWorker und die Wistensarbeiter eine Tool, eine App zur Verfügung gestellt wo du direkt auf deinem Computer mitarbeiten kannst.

00:04:50: Aber jetzt spezielle Leute die nicht entwickeln, nicht Coder und nicht so technisch unterwegs sind das hat den ganzen Markt komplett umgekrempelt wird bei dir wahrscheinlich auch nicht vorbeigegangen sein.

00:05:00: schlechte Arbeit ist so aktiv damit!

00:05:02: Und jetzt wirst Du Dich nämlich freuen denn für alle die das immer genutzt haben war es immer so okay ich kann's ja nur jetzt am Computer machen.

00:05:08: und jetzt wird das ganze in der oben mobile app überführt.

00:05:12: Das heißt, du kannst eine Aufgabe am Rechner starten.

00:05:15: Unterwegs vom Handy überwachen dem Agent sagen was er zu tun hat und er arbeitet sozusagen weiter.

00:05:21: Das heißt die Coding Agent Wars, die schwappen jetzt sozusagen ins Büro rein und im Korb ist kein einfacher Chatbot mehr sondern der erledigten mehrstöpfige Büroarbeit komplett selbstständig im Hintergrund.

00:05:33: Naja, ich denke das ist so eine super spannende Sache weil letzten Endes fragt er dich als Menschen noch um Freigabe und Bestätigung.

00:05:41: Und um Prüfung also den klassischen bisschen den Human in the Loop.

00:05:45: genau.

00:05:46: Das heißt also der Sprung dem wir jetzt die ganze Zeit schon sehen von KI Die Ich bediene zu KI die selbstständige eine Aufgabe zu Ende bringt.

00:05:55: Der wird immer intensiver.

00:05:56: Jetzt hast du es auch in einer Hosentasche nämlich immer mit dabei Und jetzt kannst du das wirklich aus dem Bett triggern oder sonst was, ich weiß viele Leute werden das jetzt sensationell geil finden.

00:06:05: Ich habe mir mal gedacht okay, mich weiß nicht, ich arbeite jetzt nicht mit Cloud Codework sondern ich hab mit WS-Code also einem IDE eine Entwicklungsumgebung aufm Rechner gearbeitet.

00:06:15: aber hab da auch häufig gedacht so ah das ist ja noch cool wenn er es vom Handy machen könnte's aus Digitalisierungshygiene habe ich mir nachher gedacht ok vielleicht ist es besser wenn es nicht ganz war sonst wirst du die ganze Zeit nur noch am Handy hängen.

00:06:28: genau Also der Rohrrod ist gestern gewesen, es betrifft aktuell nur die Max-Abos.

00:06:32: Das ist ein Beta das erfolgt schrittweise.

00:06:33: Es kann sein dass du es vielleicht schon hast, vielleicht auch noch nicht.

00:06:37: Das musst du dann einfach prüfen aber es wird wahrscheinlich in den kommenden Tagen kommen.

00:06:42: Wichtig ist es gibt eine Einschränkung Der Web hat also... Die App hat natürlich kein Zugruf auf lokale Dateien Also auch nicht vom Smartphone aus erstmal.

00:06:54: Und natürlich auch nicht auf deinen Computer, das heißt dafür bleibt der Desktop einfach bestehen.

00:06:59: Ja und... Der dritte News-Part ist so ein bisschen eine Korration aus verschiedenen Dingen und auch so'n bisschen die Überleitung zu unserem Thema.

00:07:07: Ich hab mich manchmal gefragt in einer Zeit wo wir heute leben werden KI Modelle eigentlich so n bisschen zu?

00:07:11: so?

00:07:12: ja Rüstungsgütern wird Europa so n bissen in die Zange irgendwie genommen?

00:07:16: Warum?

00:07:17: Weil mittlerweile es isso Da hatte der Decoder Anfang Juli erst mal nicht drüber geschrieben und jetzt heute auch nochmal aktualisiert, dass China auch eine Exportbremse für seine besten KI-Modelle erwägt.

00:07:34: Und naja zeitgleich hat Trump die Restriktionen für GPT-Fünf Punkt Sechs also ein ähnlich starkes Modell wie Fable Five wieder aufgehoben.

00:07:46: Und ja beide Supermächste behandeln KI wie Top Julius Güter.

00:07:50: Also es ist wirklich krass.

00:07:51: man merkt, dass sie sich ganz aktiv Gedanken machen wer hat eigentlich Zugriff auf diese krasse Technologie und wer nicht?

00:08:00: Das ist natürlich für uns in Europa ein riesen Thema.

00:08:03: wenn du mal endlich das ganze einmal interessiert wo wir in europa eigentlich mit den Modellen mit den Frontiermodels auch stehen.

00:08:11: dann hier nochmal einen Querverweis.

00:08:14: ich hatte eine andere Folge gehabt und das ist die Folge sieben in der folge sieben.

00:08:21: da ging es um fable five von die abschaltung.

00:08:23: da habe ich einmal gegenübergestellt die top fünfundzwanzig modelle auf platz.

00:08:27: zehn war mistral ein model aus der eu aus frankreich alle anderen also die eins bis neun war nur usa und china und von elf bis zwanzig glaube ich gab's einen kanadisches ein russisches ansonsten auch meine ich nur noch China und USA, also man sieht ganz klar wer hier den Markt eigentlich anführt.

00:08:51: Und worauf wir uns wahrscheinlich in der Zukunft auch einstellen müssen.

00:08:54: denn ich bin davon überzeugt dass die krassesten Modelle vielleicht nicht unbedingt für uns zugänglich sein werden.

00:09:02: aber das ist Zukunftssache.

00:09:04: Ich denke darüber müssen wir Unternehmerinnen und Unternehmer bei uns auf jeden Fall Gedanken machen weil es natürlich auch ein sehr großes Thema an der Wettbewerbsherigkeit ist.

00:09:13: Okay, das heißt also der Zugang zu den besten Modellen.

00:09:16: Man merkt es jetzt schon so ein bisschen politisch und national.

00:09:19: Es ist total spannend in den USA so dass die USA direkt ein wenig in diese Konzerne rücken will denn Trump und Open AI sind ja auch diverse Male in Gesprächen schon gewesen, dass sich die Vereinigten Charme von Amerika Anteil an diesem Unternehmen sichern.

00:09:38: Und genau es gab einen Bericht der besagt hatte, dass Open AI fünf Prozent angeboten hatte.

00:09:48: Das fünf Prozent der Shares von den Vereinigten Staaten übernommen werden können.

00:09:53: und wenn so etwas wirklich sein könnte dann muss man sich überlegen.

00:10:00: es ist gerade im Verhandelsschadium noch kein Deal aber wir reden hier über knappe zweiundvierzig kümmer sechs Milliarden US-Dollar.

00:10:07: Dann kontrolliert ein Staat Ein Frontier Model Lab, das ist schon krass.

00:10:17: So sieht es auf jeden Fall im Markt aktuell aus.

00:10:19: Das heißt wir merken dass diese ganze National Security Export Welle die damals vom Weißen Haus damals vor vier Wochen mit dem Fable V Mythos Bann war im Juni GPT-Fünf Punkt Sechs Riff Die interne Cyberangriff Risikoschwelle nochmal hoch.

00:10:38: China dreht das US-Instrument jetzt um und irgendwie zeigt es in alle Richtungen, und wir sitzen irgendwie dazwischen, denken wir so okay!

00:10:46: Wir wollen aber auch sorry den geilen Shit irgendwie haben.

00:10:48: was können wir jetzt eigentlich machen?

00:10:50: Und darum soll's natürlich in dieser Folge heute einmal gehen weil ich wollte mich heute einfach mal mit dir darüber unterhalten und beschäftigen.

00:10:58: Einfach mal die Perspektiven zu sagen... ...und in der Überlegung bin Mit der KI, die ich nutze bin ich damit eigentlich sozusagen erpressbar.

00:11:07: Weil letzten Endes ist es ja so.

00:11:09: Wir müssen überlegen.

00:11:10: Die wichtigsten Daten, die wir haben gehören aktuell mehr oder weniger noch uns Und ein wachsender Teil von Burgfluss hängen natürlich aber auch an der KI weil LLMs das evaluiert Natürlich KI injected wird, Agents arbeiten und Burgflussen arbeiten.

00:11:26: Aber das gehört dann natürlich nicht uns Das gehört nicht der EU Das gehört also die besten Gehörnheit US-Konzern an China und die können uns natürlich dann das Ganze auch abdrehen.

00:11:37: Und es ist immer so, wenn du Waiver hörst oder wenn du mir auf Link infolz, falls du das noch nicht machst mehr auf link infolgen.

00:11:43: ich habe das unter den Schonos verlinkt.

00:11:44: folg mal auf jeden Fall weil da kriegst du auch unter der Woche nochmal ziemlich geile News.

00:11:48: Ich halte auch echt einen schönen Schritt raus.

00:11:50: deswegen meine Empfehlung folgt mir einfach und wenn du Fragen hast schreibt mir gerne dm genau.

00:11:57: also man muss ein bisschen an dieser Stelle einfach schauen dass man natürlich eine Abhängigkeit ist, weil man baut natürlich auch Workflows.

00:12:05: Man schaut wie gut die performen.

00:12:07: wenn man jetzt bestimmte Modelle nimmt, die jetzt nicht so leistungsfähig sind wie zum Beispiel Heiko-Modell oder sowas dann muss man das auch richtig richtig gut prompten.

00:12:15: Das muss auch angepasst werden.

00:12:16: Das kann man nicht mal ebenso wechseln ja man kann es machen aber halt nicht einmal.

00:12:22: eben also kannst du einfach sagen okay ich tauche eins gegen anderes das funktioniert nicht.

00:12:26: das muss dann eventuell neu angeprompt und neu angepasste werden.

00:12:29: Und wenn du natürlich so leistungsfähige Modelle wie Opus hast, dann zahlst du dich natürlich richtig doof und dämlich dabei.

00:12:35: Weil die sind halt echt schweine teuer!

00:12:37: Das muss man dazu sagen... Was wir jetzt überlegen?

00:12:41: Dass eigentlich fast alle irgendwie die US-Modelle nutzen oder von US Anbietern das ist so.

00:12:50: Jetzt muss man halt überlegen, okay, wir haben natürlich jetzt mehrere Perspektiven die hier zusammenkommen.

00:12:54: Wir haben auf der einen Seite natürlich die Abhängigkeit zu KI-Modellen.

00:12:57: also was passiert wenn es immer wieder Exportbeschränkungen kommen oder sonstige Sachen?

00:13:01: Wird uns der Saft abgedreht und man hat ja gemerkt, ein Tropic oder OPI kann sich gar nicht dagegen wehren, die müssen das natürlich logischerweise machen.

00:13:11: Das ist das eine.

00:13:12: Auf der anderen Seite geht's darum dass du natürlich schauen musst Dass du dann ständig Deine Daten ins Ausland schickst, das heißt du unterstützt natürlich auch die Wirtschaft darin.

00:13:22: Ich gebe dir mal ein krasses Beispiel.

00:13:23: jetzt mal ganz weit gedacht was passiert denn wenn jetzt in zwei drei vier Jahren sehr viele Jobs sich verändern wegfallen und alles was früher von Ja einem realen menschen gemacht worden ist der komplett sozialversicherungspflichtig in deutschland ist er in die Kassen einzahlt der Steuern zahlt uns weiter.

00:13:41: dass wird jetzt von dem agent erledigt.

00:13:43: Wer zahlt denn dann auch in die Kassen einen, wie funktioniert das denn mit eventuellen Lohnsteuern oder Einkommenssteuer?

00:13:52: Das ist eine super spannende Frage.

00:13:53: und dieses ganze Geld schieben wir halt aktuell wahrscheinlich nach USA.

00:13:59: Und geben den jetzt natürlich noch mehr Kapital um noch mehr Geld da reinzustecken, um noch krasser ein Shit zu bauen.

00:14:05: Darüber sollten wir uns alle mal wirklich Gedanken machen ob das eigentlich so der richtige Weg für Europa eigentlich ist und das dann auch so sinnig ist.

00:14:16: Na ja gut, wir sind mit Software-Apps sowieso natürlich schon abhängig stichwort Google, Nebricksbase oder Microsoft Raihfünbsechzig oder sowas.

00:14:24: aber ich denke es macht wahrscheinlich Sinn dass wir alle mal überlegen sollten muss es eigentlich so sein oder ja gibt es die Möglichkeit da dass Europa jetzt endlich mal sagt hey wir nehmen mal richtig Schotter in die Hand und versuchen diese Technologie selber zu bauen, zu verbessern und zu own.

00:14:41: Ich weiß es gibt viele Unternehmen die das machen oder an diese Dinge dran wagen.

00:14:46: meines Erachtens korrigiert mich kann auch sein dass ich dann vielleicht einige noch nicht kenne, kenne ich keins was ansatzweise an die großen Frontiermodelle irgendwie dran kommt Oder sie sind echt gut, aber nur schlechte Marketing.

00:14:59: Das würde ich jetzt nicht abwägen.

00:15:01: Okay das ist also das andere.

00:15:03: Das heißt wir reden über Karrierevorsouveränität und Risiko die wo Dinge abgeschaltet werden können Aber wir sprechen auch über etwas anderes Denn wir sprechen über den US Cloud Act Und der US Cloud act ist ein Riesenthema.

00:15:17: Ich weiß nicht ob dir damit überhaupt was sagen weil man sagt immer Ja, die Server stehen ja in Frankfurt.

00:15:24: Dann ist es souverän.

00:15:26: Sag ich gleich noch mal was zu den Modellen, dass man die DSGVOKonform nutzen kann.

00:15:29: aber der CloudAct ist das anderes.

00:15:32: Der betrifft doch etwas anderes, ne?

00:15:34: Denn im CloudAct, den gibt's seit dem Jahr zwei Tausend Achtzehn, der verpflichtet jeden US-Anbieter zur Datenherausgabe an US Behörden egal wo der Server steht.

00:15:42: Das können sie natürlich nicht einfach so machen.

00:15:44: da müssen natürlich auch gewisse Hürden, gewisse richterliche Beschlüsse und sowas drin sein.

00:15:50: Aber Das könnte im Ernst war sein und es gab vor einigen Zeitjahren, das gab's.

00:15:56: Es ist ein bisschen losgetreten, gab es eine Anhörung in Frankreich vor dem Chef von Microsoft Frankreich genau und der musste spezifizieren wie weit auf diese Daten zugegriffen werden können Weil da Themen im Raum stand, dass Daten an US-Behörden weitergegeben wurde.

00:16:16: Weil natürlich Frankreich ja auch komplett die ganzen Behörden irgendwie in irgendwelchen Microsofts Cloud hat und er hatte sowas gesagt... Ich kann jetzt das ganze Zitat nicht mehr, ich hätte es in der vergangenen Wave-Verfolge mal erwähnt.

00:16:29: Er hat gesagt okay, ich kann nicht dafür garantieren, dass das nicht passiert.

00:16:32: so ist auch unmöglich Und das muss man sich halt immer so ein bisschen machen.

00:16:36: Okay, warum geht ich das jetzt als Unternehmer an?

00:16:38: Fast jeder Mittelstand erinnert es irgendwie nach dem Sechzig, AWS Google Workspace.

00:16:44: Das sind supersensibel Daten, Personalverträge F&I Kunden-Daten und ist natürlich alles theoretisch US Behördenzugriff ausgesetzt ohne dass sie ein deutsches Gericht draufschauen könnte.

00:16:58: So!

00:16:58: Und das ist natürlich ein Thema.

00:17:00: Es gab jetzt vor einiger Zeit Man kann jetzt nicht sagen eine Gesetzesänderung, aber es gab vor einiger Zeit einen Worteil.

00:17:13: Also das was der Supreme Court sozusagen dazu gesagt hat also die oberste Instanz sozusagen und die hatten eine Behörde genannt, die sogenannte FTC Und die hatten gesagt, dass die FTC nicht unabhängig von der Direktion des US-Präsidenten sozusagen agieren kann und das schwächte diese Unabhängigkeit der FTC.

00:17:44: Die FTC ist eine Behörde, die ummittelbar mit diesem Cloud Act zusammenhängt – ich hoffe, das richtig jetzt nochmal spezifiziert!

00:17:52: Hier ist es so, dass es keine beschlossene Rechtsfolge ist aber Ein Risiko-Szenario, was sich daraus ergibt.

00:17:59: Dass theoretisch einfacher auf oder schneller auf Daten zugerufen werden können rückt wohl immer etwas näher.

00:18:08: so ist aber glaube ich noch nicht wie gesagt beschlossene Sache.

00:18:11: Aber da passiert gerade irgendwas.

00:18:13: also es ist total spannend dass man dieses Thema cloud AI ekt und dann wäre es nachwesen will.

00:18:18: Ich glaube das ist Trump vs Florida heißt das glaube ich dass man sich dann einfach nochmal reinliest und nochmal schaut, was passiert da jetzt sozusagen langfristig mit.

00:18:32: Okay das heißt also nur weil Server jetzt in Frankfurt z.B.

00:18:36: stehen oder sowas heißt es nicht dass wir souverän sind, also es gibt da Dinge genau.

00:18:43: Also es ist ein Risiko sozusagen da.

00:18:46: aber man muss halt einfach schauen was das sozusagen letzten Endes bedeutet hat jetzt auch nichts mit dem Thema zu tun, dass die Leute sagen ja Wenn ich jetzt direkt in die API gehe, dann stehen diese Server ja nicht irgendwo in der USA.

00:19:05: Und damit habe ich hier schon irgendwie ein Problem das die Daten eigentlich Deutschland verlassen und jetzt muss sich gucken dass ich dann entsprechende Vorkehrungen, Maßnahmen treffe mit denen zusammen.

00:19:16: Jetzt sind wir mal ganz ehrlich ob jetzt ein mittelständiges oder kleines Unternehmen da ankommt und den versucht irgendwie, was mit dem Verträgen zu kommen.

00:19:23: Ich meine die haben ja auch Standardvertragswerke, da lachen sie natürlich drüber.

00:19:26: So kannst du also nicht machen.

00:19:29: Ich weiß in den Subscriptions wie zum Beispiel im Teamplan haben die standardmäßig einen Auftrags-Datenverarbeitungstatak als ein DPA in Data Processing Agreement.

00:19:40: aber für die anderen Dinge gibt es das in der Form nicht, wie wir das brauchen.

00:19:46: Deswegen macht es natürlich den Sinn zu überlegen, dass du halt eine Modelle nimmst die in der EU gehostet sind.

00:19:51: Das gibt's dann auch von allen großen Anbietern, das gibt's von Google.

00:19:55: also da gibt sie Gemini-Modelle und es gibt die Clot-Modelle und es gibts die GPT-Monelle von OpenAI Und da kannst du zum Beispiel zur der AWS gehen als Amazon Web Service.

00:20:08: Da ist der sogenannte Service, nennt sich Bedrock und Bedrock ist in der EU gehostet.

00:20:13: Ist in Frankfurt Und da kannst du diese Modelle werden ganz normal benutzen.

00:20:16: Du könntest aber auch zu Google gehen.

00:20:18: Das ist ja eine sogenannte Vortex AI So nennt es sich das.

00:20:20: Also sind die Services von denen Und da kannst du das auch machen Und Microsoft hat das mit Azure mittlerweile auch eingeführt Und dann sind die Server in Deutschland Und dann kannst du Diese Modelle DSGVO-konform nutzen.

00:20:35: Dann läuft das halt Ja über diese Datenlokalität, also die Residenz hier in Deutschland.

00:20:42: Wie gesagt gibt immer noch das Thema Cloud AI Act was immer noch so ein bisschen als ja Thema bei dem Hinterkopf sein sollte Was ein Problem ist genau okay?

00:20:54: Was können wir jetzt machen?

00:20:55: wie können wir es eigentlich weiter vorgehen um uns auch so ein Bisschen unabhängiger von diesen ganzen Dingen zu Machen?

00:21:03: ich denke Der parkenartische Mittelweg ist immer, Souveränität geht nach Datenklasse und nicht nach Ideologie.

00:21:12: Also es ist eher eine Architekturfrage.

00:21:15: Und ich denke ein Fehler ist das in alles oder nichts zu sehen.

00:21:17: entweder alles US sozusagen oder alles selber hosten bzw.

00:21:21: alles über US-Modelle nehmen und dann über EU-Housing oder halt nicht.

00:21:26: Ich glaube es wäre eher so dass man Daten klassifizieren würde und dann pro Klasse entscheiden sollte Warum sich das jetzt als Unternehmer angeht?

00:21:34: Du musst halt nicht blind bei den Riesen bleiben und irgendwie muss auch kein Millionen Rechenzentrum bauen.

00:21:41: Der realistische Einstieg, der kostet sich in die Wochen und nicht Jahre und ist irgendwie im Tausender bis fünfstelligen Bereich pro Jahr drin.

00:21:50: und ich sieben stelle ich so.

00:21:52: was heißt es jetzt?

00:21:53: man könnte zum Beispiel sagen okay man hat unkritische Workloads die einfach bestimmte Modelle brauchen.

00:22:01: Man kann dann die Frontier-Modelle nehmen, also z.B.

00:22:04: in Thropic oder von Gemini oder Open AI und kann die dann nehmen, die eine EU Gehose sind.

00:22:10: Damit hat man die Möglichkeit, ich sage jetzt mal, siebzig Prozent vielleicht drüber abzudecken.

00:22:15: Man hat nicht die Geschäftskritikenthemen mit drin.

00:22:17: Man hatte einfache Dinge mit drin, die auch normale Modelle machen könnten.

00:22:22: Das wäre eine Möglichkeit!

00:22:25: Du könntest aber auch hingehen und sagen, hey ich möchte das ganze zum Beispiel Self-host und Self-Hosting wird mittlerweile immer wieder erwähnt.

00:22:33: Und ist ein super spannendes Thema.

00:22:38: Das spannende dabei ist dass man jetzt sich irgendwie nicht eigene Rechenzentren oder sowas mieten kann.

00:22:43: Ich kenne Unternehmen die haben das mittlerweile bei sich wie der so den guten alten Fettenserver im Keller irgendwie stehen Nur das da halt anstatt jetzt ohne Ende fest platten und RAM halt richtig dicke GPU-Karten sind, die irgendwie zwanzig dreißig tausend Euro kosten.

00:22:59: Also Karten, die das Ganze rechnen können um den ganzen Tokenverbrauch auch mitzunehmen.

00:23:06: Und das wären halt Möglichkeiten, die man machen könnte.

00:23:11: Man kann aber auch mittlerweile – weiß ich gibt es in Deutschland IT Service, die sich darauf spezialisiert haben – Modelle zu hosten und damit kann man sozusagen weiter reingehen.

00:23:22: Es gibt aber auch noch eine andere Möglichkeit, nämlich die EU-Modelllandschaft abzugrasen und es gibt da halt mehr als nur Mystery.

00:23:30: und Mystery ist natürlich Frankreich wie am Anfang schon gesagt, das würde ich sagen in der EU halt ein klarer Champion, die sind beangeführt und sie haben verschiedene Modelle für verschiedene Aufgaben.

00:23:44: Mystery ist zum Beispiel unglaublich stark in der OCR Erkennung.

00:23:47: also wenn du Wenn du z.B.

00:23:49: Rechnungen hast, Buchhaltungsprozesse und du willst dann Daten davon einlesen sind sie unglaublich haben die unglaublich starkes Modell.

00:23:55: also wir haben eine sehr gute Erfahrung gemacht.

00:23:58: das zum Beispiel super spannend aber auch für andere Dinger genau Ja.

00:24:01: dann gibt es noch etwas Das heißt LF Alfa.

00:24:05: Die kommen glaube ich aus Heidelberg oder Kamos Heidelberg.

00:24:08: Ich meine jetzt dass sie mittlerweile leider kanadisch geworden sind so wie ich's gehört habe Genau verschiedene Kunden gehabt.

00:24:19: Auch deutsche Bundkunden oder Länderkunden, Behörden Enterprise Governance.

00:24:27: und als ich gelesen habe... Ich konnte das nicht hundertprozentig bestätigen.

00:24:30: deswegen ist es jetzt diese Aussage.

00:24:34: Ich kann's dir nicht hundraprozentig sagen aber ich hab gehört dass sie jetzt kanadisch ist.

00:24:37: Habe ich mir nur gedacht okay Deutschlands größte KI Hoffnungs jetzt Teil eines kanadischen Konzerns ist wieder super gelaufen.

00:24:43: genau Dann gibt's natürlich Black Forest Labs Flux, kennen super viele so aus dem letzten Jahr.

00:24:49: Es ist glaube ich immer noch Weltspitze in der Videogenerierung.

00:24:54: Weiß nicht ob die komplett noch in Deutschland beheimatet sind Aber es auf jeden Fall richtig cool für Bildproduktion.

00:25:00: So.

00:25:01: und dann gibt es noch etwas vom Fraunhofer-Institut Das heißt Tolkien Seven Bee Und ja das ist noch ein bisschen finde ich Zukunftsbaustein irgendwie.

00:25:16: und dann gibt es noch Open-Euro LLM.

00:25:19: Das ist ein EU Konsumption, wo ich glaube ungefähr in die Institutionen mit draufgehen.

00:25:24: Die haben so knapp vierzig Millionen Budget und genau die haben so vierundzwanzig EU Sprachen, wo sie was machen wollen oder machen wollen.

00:25:32: Und das ist aber aktuell auch noch ein Forschungsprojekt.

00:25:36: Genau also das heißt der Hebel liegt wie eben schon gesagt in den Infrastruktur nicht im Modell.

00:25:41: Das heißt hier muss man sich wirklich Gedanken.

00:25:43: Wie kann man das Ganze sozusagen angehen?

00:25:47: Genau.

00:25:47: Das heißt, wenn du jetzt konkret dir überlegst, okay, das ist alles schön und gut.

00:25:52: Was kann ich jetzt irgendwie machen?

00:25:54: Kann ich das benutzen oder kann ich hier für mich mitnehmen?

00:25:57: Ich würde sagen mach erstmal fünf Steps in fünf Schritten.

00:26:02: Kann ich dir sagen was ich an deiner Stelle tun würde.

00:26:06: Erstmal Schritt eins, Datenklassifikationen.

00:26:10: Also ist für mich auf jeden Fall ein Chefsacher Thema, denn das ist eine Frage die natürlich Geschäftsführung beantworten muss bevor die IT jetzt sagt okay.

00:26:17: Und die Frage ist die welche unsere Daten dürfen eigentlich unter welchen Bedingungen des Haus verlassen?

00:26:23: Wenn ohne diese Klassifikationen baut man nachher irgendwie am falschen Ende.

00:26:27: Grobe Klassen kannst du sagen, zum Beispiel unkritisch Marketing für öffentliche Dokumentationen.

00:26:33: Sensible Daten, Kundendaten, Personal

00:26:36: etc.,

00:26:36: Hochsensibelverträge M&A F&I und so.

00:26:41: Also wenn du das hast Schritt zwei würde ich folgendes machen Ich würde dann eine Klasse zuordnen.

00:26:46: Ich würde sagen okay wir teilen in drei Bereiche einen unkritich sensibel und hochsensibel.

00:26:51: Und für unkritische Dinge, was wahrscheinlich seventy-achtz Prozent sind, können wir einfach klassische Frontiermodelle nutzen.

00:26:57: GPT Cloud Gemini EU gehostete Regionen wie gesagt Bedrock, Vertex AI oder Azure haben eine super Qualität günstige Token und ja das sind so Allzweckdinger.

00:27:10: und wenn das nachher nicht funktioniert dann kann man hier auch denke ich auch zügig wechseln.

00:27:14: Ich kann mir vorstellen dass jetzt kein Land irgendwie komplett in H&M zu drehen würde, sondern nur für die krassen Modelle.

00:27:23: Das heißt da wird wahrscheinlich sein... dass man auch immer noch Zuguft auf hat weil jetzt in diesem ganzen Thema war es ja so das wir Heiku, Sonnetopos und so also die drei anderen Modelle von ein Topic nach wie vor ja auch Zuguft darauf hatten.

00:27:38: okay Dann hatten wir den zweiten Punkt, sensible Daten.

00:27:42: Das könnten fünfzehn-fünfzehnt Prozent vielleicht bei der Ausmachung da würde ich gucken dass du wahrscheinlich irgendwie EU Anbieter nimmst also Mistral oder sowas.

00:27:51: das wäre eine Möglichkeit und du hättest dann noch vor hochsensibel Daten könntest du zum Beispiel einen Selbstgehust des OpenWide Modellen nehmen.

00:28:01: OpenWidemodell heißt ein Modell was jetzt nicht so viele Trainingsdatensetzer hat Deswegen leichter sozusagen ist, aber für klassische Aufgaben auch super gut meines Erachtens geeignet ist.

00:28:14: Genau!

00:28:16: Wenn wir dann zum Schritt drei gehen zur Multimodellfähigkeit als ja so ein bisschen Versicherung, dann würde ich sagen können wir jetzt von einer strategischen Vorinvestition im Jahr zwölf und sechsundzeig sprechen.

00:28:26: man könnte eine eigene Plattform Architektur bauen die mehrere Modelle Hosting-Orte gleichzeitig bedienen kann.

00:28:33: Das kennst du von früher, wenn du Server hattest?

00:28:35: Dann hast du immer gesagt okay ich habe innerhalb eines Servers ja immer unterschiedliche Festplatten die sich spiegeln für Backups und die Leute die cleverer IT Berater hatten haben gesagt Ja wir müssen aber auch nochmal das Ganze in der Firma haben Und keine Ahnung der Chef hat zu Hause noch ein Server stehen oder so wo alles gespiegelt wird dass es so ein bisschen etwas ähnlich ist.

00:28:53: So d.h.

00:28:55: Du bist dann etwas unabhängiger.

00:28:57: Oder du machst einfach so dass du sagst wenn du jetzt ein anderes gutes Modell findest in der EU was funktioniert, dann bist du nicht auf einen Anbieter festgenagelt und wenn der nächste Fable Five Modell kommt bis halt nicht in der Falle sondern guckst in die Sache relativ entspannt rein.

00:29:14: Schritt Nummer vier wäre immer konkret ausprobieren und Kleinstarten.

00:29:19: super wichtiges Thema also.

00:29:21: das heißt ich würde erst mal gucken zum Beispiel Mistral nutze es in der API.

00:29:27: Das ist eine coole EU-Alternative.

00:29:29: Check's einmal, lass mal Agenten mitlaufen und mach mal deine Erfahrungswerte.

00:29:34: Informiere dich welche Unternehmen können dir dabei helfen eigene LLMs zu hosten?

00:29:41: Wie sehen auch Kosten und Investition dafür aus?

00:29:44: wie schnell kann sowas starten?

00:29:46: ich finde es immer spannender wenn man so ein Server nicht in der Haus hat sondern wirklich in einem Rechenzentrum was in Deutschland oder sowas irgendwie steht weil die machen nichts anderes als server betreiben und sicherstellen, dass die auch funktionieren in einem gewissen Aspekt sozusagen.

00:30:02: Deswegen ist es meist wahrscheinlich günstiger.

00:30:05: Genau!

00:30:06: Und Schritt Nummer fünf wäre dann Souveränität.

00:30:10: einfach als Instrument für dich benutzen denn wenn du jetzt irgendwie ein BtoB mittelschändler hast bist und du kannst DSGFO-konform sein da bleiben wir in der EU.

00:30:23: das kann zu klar für dich benutzten.

00:30:25: Wenn du KI einsetzt um eigene Geschäftsmodelle zu, jetzt nicht bevor, sondern neue Geschäfts-Modelle zu erschließen.

00:30:33: Dann finde ich ist dieser Compliance-Zwang einfach unglaublich wichtig und das ist nachher auch eine Differenzierung und wer damit früh ansetzt der hat dann überhaupt in meinen Augen eigentlich gar keine Probleme mehr.

00:30:48: okay Kommen wir mal zu einem neuen Punkt.

00:30:52: Ich weiß, dass es jetzt alles so ein bisschen trocken aber ich glaube das ist wirklich wichtig weil man muss sich über diese Dinge ja einfach Gedanken machen und auch überlegen.

00:31:03: Lass uns noch einmal als Punkt überlegen Was bedeutet eigentlich Self-hosting?

00:31:10: Also was kann ich mit Self-Hosting eigentlich ganz konkret machen?

00:31:13: und was ist es eigentlich, weil man hört es überall gerade eine eigene Keim-MH aus.

00:31:18: Der SKVO-konform, Self- Hosting... Aber die ehrliche Frage dahinter ist jetzt muss sich mir wieder den Server schrankt doch wieder in den Keller stellen damit mein Daten nicht irgendwie auswandern oder so?

00:31:29: Ich hatte ja eben schon angedeutet fast immer nein meine Sachen.

00:31:32: aber lass uns das jetzt noch mal sauber auftrennen und nochmal wegen Klartext packen.

00:31:36: Also Self-hosting, was ist das überhaupt so?

00:31:40: Du mietest die KI jetzt nicht mehr stundenweise beim großen Räsernbieter also zahlst du für diese Computentime mit dem Token sondern du stellst dir die KI Fähigkeit einfach fest ins Haus.

00:31:51: Das kannst du dir vorstellen als wenn du dir heute wieder einen hoch spezialisierten Sachbearbeiter stundenweisen bei einem Dienstleister buchst und jedes Dokument dass er bearbeiten soll schickst du ihm per Post drüber.

00:32:00: Das ist so was du eigentlich mit oben ein Topic und sowas machst, in einem US-Rechenzentrum oder im EU-Rechnzentrum.

00:32:07: Das ist super bequem aber die Unterlagen verlassen das Haus und du zahlst halt pro Seite.

00:32:13: und Self-hosting heißt eigentlich du stellst dir diesen Sachbereiter selber an also das Gehören.

00:32:18: Und bei KI heißt es einfach als Modell und das ist eine große Datei die du herunterletzt je nachdem mehrere Gigabyte oder immer mehr Gigabyte groß Und die kannst du auf deinen eigenen Rechner spielen, auf deinem eigenen Server spielen.

00:32:32: Diese Modelle nennt man in der Regel Open-Wide-Modelle weil das sind frei verfügbare Modelle.

00:32:37: Liama von Meta Mystery gibt es dann auch, Gwen ist ein chinesisches Modell oder mit deutscher Option wie zum Beispiel Tolken von Frauenhofer und Aleph Alpha.

00:32:49: Da müsst ihr aber nochmal genau schauen wie man diese ganzen Modellen nutzen kann denn... Es gibt eine Lizenzfalle.

00:32:58: Da komme ich gleich nochmal drauf zu, dass wissen super viele Leute nicht.

00:33:01: Deswegen kann ich dir gleich dazu noch mal ein bisschen was mitgeben.

00:33:06: Okay also das heißt wir haben das Modell, wir brauchen einen Server und eine GPU, also klassisch früher eine Grafikkarte die dann diese ganzen Rechenleistungen braucht und diese Grafikarten sind halt richtig hochgezeichnet und verdammt teuer.

00:33:21: deswegen macht es meistens Sinn dieses Server zu mieten weil Man muss jetzt immer schauen, das ist wie damals bei den klassischen Web-Servern auch.

00:33:29: Man kann natürlich für sich selber einen kompletten Server mieten was halt viel teurer ist.

00:33:33: man kann aber auch Sichleistungen teilen.

00:33:36: Das heißt jetzt nicht dass irgendwie Daten verschwinden, das heißt einfach nur dass man ja GPU Zeit und Sicht aufteilt Was kosteneffizienter ist und dadurch wird zum Self-hosting auch dann deutlich günstiger sozusagen als wenn man sich selbst jetzt einfach auch kaufen würde.

00:33:54: Okay Lassen Sie mal über diese Lizenz Fallen sprechen, wie ich das eben gesagt habe.

00:34:00: Also man muss immer schauen in der Lizenzdatei über was oder wofür ist diese Open Source Lizenz eigentlich gedacht?

00:34:10: Bei Lyama es ist so, es ist keine meines Erachtens keine echte Open Source-Lizenz denn es gibt eine Namensinnung zu Pflicht plus einer Klausel die sagt, die ab siebenhundert Millionen monatlichen Nutzern eine extra Genehmigung verlangt.

00:34:24: Okay, wer siebenhundert Millionen Nutzer monatlich hat, der hat noch ganz andere Probleme.

00:34:29: Aber ich will dir einfach zeigen es ist kein Freifahrtsschein.

00:34:32: So bei DeepSync zum Beispiel.

00:34:35: das kannst du auch nutzen und da kommt es ganz teils komplett ohne Startlizenz irgendwie aus.

00:34:42: also ich konnte keine recherchieren, konnte keine finden.

00:34:44: Das ist ein bisschen weird.

00:34:46: Das heißt informiere ich wirklich wenn du Self-Hosest darüber was in diesen Open Source Lizenzen mit drin und was kannst du machen?

00:34:54: Nehmen wir mal an, du hast diese Hürde genommen.

00:34:56: Du hast einen Dienstleister gefunden der das vielleicht für dich macht, der dich unterstützt und jetzt geht es halt darum zu überlegen okay?

00:35:04: Jetzt wird immer so...hör ich immer wieder ein Wort Ja wir trainieren unsere eigene KI.

00:35:09: Das habe ich schon im Jahr zwanzigundzehn die ganze Zeit gehört.

00:35:12: Das ist totaler Bullshit.

00:35:14: Du trainierst in der Regel keine eigene KI.

00:35:16: wenn du eine eigene Kanäle trainieren würdest dann würden wir über ein Investment wahrscheinlich von.

00:35:21: Ich glaube die DeepSig hat angeblich nur sieben Millionen gekostet.

00:35:26: Ich meine, dass OpenAI GPT-IV hat... ...siebzig Milliarden Dollar gekosted oder so?

00:35:31: Also es ist unglaublich teuer diese Modelle zu trainieren!

00:35:35: Was du wahrscheinlich dann meinst ist entweder das so ein Rack zur Verfügung stellt's is fine choosed aber in der Regel nicht trainieren.

00:35:44: Okay was bedeutet das jetzt eigentlich?

00:35:46: Lass uns mal hier mit diesen Denkfehler aufräumen.

00:35:49: Ich reichere das Modell mit unserem Firm-Wissen an.

00:35:53: Genau, also es ist etwas anderes wie die meisten denken und ich erkläre dir einmal wie das funktioniert.

00:35:59: Meistens ist es ein REC System Also einen Retrieval der wie folgt funktioniert?

00:36:10: Ich gebe dir mal ein Beispiel, stell dir vor du hast einen neuen Mitarbeiter Du hast den Aktenchank, schätzt.

00:36:15: in dem Nebenraum Kommt eine Frage, holte sich die passende Akte, liest die nach und beantwortet sie dir mit Quellenangabe.

00:36:22: So das Gehirn selber.

00:36:25: also das wird nicht verändert.

00:36:26: es ändert sich ein Preis oder in der Richtlinie oder tauscht einfach eine Akte aus aber du trainierst halt nicht neu.

00:36:34: Das heißt wer der Mitarbeiter hat ja sein Gehirnt nach wie vor so.

00:36:37: dass ist der übliche und günstige meist oft richtige Weg für irgendwie Firmenwissen.

00:36:43: Es hatte auch Probleme weil Rack funktioniert so, dass es semantisch ähnliche Dinge ausliest.

00:36:49: Das heißt wenn du z.B.

00:36:50: sagst Preis-Kalkulationen dann wird oft bei so Racksystem nach dem Keyword Preiskalkulationen geguckt aber auch zum Beispiel könnte das Wort Investition fallen oder Preise oder Kosten.

00:37:05: also semantig verwandt und dadurch ist manchmal Rack nicht in allen Fällen Die beste Entscheidung, aber funktioniert trotzdem recht gut.

00:37:15: und dann gibt es sogenannte Confidence-Kurs.

00:37:17: Also Wahrscheinlichkeiten wie sicher die KI ist dass das Ergebnis das Richtige ist und dadurch kriegt man halt eine sehr gute Qualität hin so.

00:37:26: Und letzten Endes ist es so du kannst mit dem Rack System in wenigen Wochen starten mit einem Open Source LLM.

00:37:34: Das sind niedrige fünfledige Kosten meines Erachtens und das geht sehr schnell So.

00:37:39: wenn man jetzt von einem Fein-Tune reden würde.

00:37:45: Dann wäre es eher so, dass du sagen würdest, du gibst es mit Lora oder Qlora sind die Fachwürde dafür, gibst du etwas ein und du gibts dem Modell nochmal eine Rahmen mit.

00:37:59: und dieser Rahmen ist so.

00:38:01: das ist sozusagen die Form für.

00:38:05: die Form ist wie dieses Modell Antworten sollen was es macht.

00:38:11: Dadurch hast du die Möglichkeit, dass es zum Beispiel sagen könnte.

00:38:15: Also du kannst genau erklären wie dieses Modell antworten soll und tust Standard-Dinge festhalten.

00:38:21: Das kann so ein Modell aber auch einschränken in gewissen Dingen.

00:38:24: Kann aber auch hilfreich sein.

00:38:25: das muss man halt je nach Case sehen.

00:38:27: Deswegen habe ich ja gesagt, ein klassischer Rack ist eigentlich immer besser oder armer Weg, der aber immer sehr viel Computing-Time kostet.

00:38:36: Dass du den natürlich die ganzen Dokumente in Echtzeit zur Verfügung stellst.

00:38:40: Also das ist wie wenn du ein Cloth Shad öffnest und du letztlich irgendwie eine Microsoft Word Datei oder so was rein, dann gibts dir dem Modell super viele Informationen.

00:38:48: Das muss erstmal alles tokenisiert werden Und das ist halt das Problem.

00:38:52: Bei Rack passiert das nicht weil bei Rack wird es einmalig tokenisiert Es gibt eine Zahlenabfolge, es werden nur noch Zahlen gesucht.

00:38:58: dadurch ist es unglaublich schnell, unglaublich effizient und verbraucht wenig Token.

00:39:02: Wenn du das über herkömmliche Wege machst, ist es natürlich nicht so einfach möglich.

00:39:09: Also es heißt long story short.

00:39:11: ich werde gar nicht so tief darauf eingehen aber es gibt verschiedene Möglichkeiten das zu machen und ich glaube Open Source ist ein super spannendes Thema weil mittlerweile diese Open Source Modelle auch immer besser geworden sind.

00:39:26: Natürlich kommen die nicht an diese Frontiermodels ran Wie auch, ne?

00:39:30: Ich meine damit wird ja bei den ganzen großen Firmen auch Geld verdient.

00:39:33: und wenn die diese aufgepuserten Bewertungen mit teilweise nicht in neunhundert Milliarden Dollar.

00:39:40: Bei ein Schoppel oder wahrscheinlich mittlerweile noch mehr anschaust dann muss natürlich irgendjemand auch die Zeche zahlen.

00:39:44: aber das ist mal eine andere Folge genau.

00:39:48: Das heißt hier muss man wirklich schauen wie gut sind die wirklich?

00:39:52: ich glaube für wahrscheinlich siebzig, acht Prozent der Aufgaben in der Fälle tägliche Büroarbeit.

00:39:56: E-Mails formulieren, Dokumente zusammenfassen, Ansragen klassifizieren weiterleiten, internen Dokumenten suchen... Da brauchst du nicht den Formel eins wagen, Self-hosting wird damit Sicherheit ausreichen ne?

00:40:09: So!

00:40:10: Wenn Du jetzt was Krasses hast, wo Du sagst okay das ist ein langer Denkprozess, da müssen viele Schritte mit reingebracht werden.

00:40:17: Das ist ein Agent-Demos, zwanzig Arbeitsschritte selbstständig machen, fehlerfrei abarbeiten und so weiter und sofort dann würde ich sagen ist wahrscheinlich Obenshaus nicht so cool geeignet.

00:40:29: Dazu kann man sich natürlich auch immer Benchmarks reinschauen, aber das finde ich auch immer ein bisschen mit Vorsicht zu genießen wenn man sich das Ganze sozusagen anschaut.

00:40:42: Okay!

00:40:43: Das heißt also du kennengelernt hast verschiedene Möglichkeiten Self-hosting zu betreiben, dass verschiedene Möglichkeiten Souveräner auf KI sozusagen drauf einzugehen.

00:40:57: Man muss sich nicht komplett abhängig machen von den ganzen US Anbietern.

00:41:04: Ich denke die Vorteile sind einfach man hat Datenurheit Die Daten bleiben nachweisbar im Haus oder in der EU wenn man bestimmte Grenzen einhält.

00:41:14: Man hat nicht dieses Skillswitch-Risiko, keiner sperrt dich einfach so aus als fremde Regierung.

00:41:19: Du hast eine hohe Kostenkontrolle bei gewissen Volumen und du kannst komplett dsgfo konform sein.

00:41:26: Du kannst in der EU sein, du kannst auch im Eigenhaus gehostet sein.

00:41:30: das ist für mich super spannendes Thema.

00:41:34: Und du kannst natürlich auch Austauschbarkeit kann zu machen.

00:41:38: Ob Self-hosting jetzt viel Geld spart?

00:41:41: Ich würde sagen Nicht unbedingt, weil ich glaube wenn man self-hostet ist es der Grund der Datenhoheit.

00:41:48: Die versteckten Kosten im Self-hosting sind Renonanz, Backup, Personal also Leute die dann dafür sorgen dass das Ganze auch wartbar bleibt.

00:41:58: Das heißt hier muss man eingehen.

00:42:01: Ja zum Ende würde ich gerne dir nochmal kurz folgendem Gedankengang mitgeben KI-Souveränität für mich keine Ideologie.

00:42:09: Sie ist ein klassisches Risikomanagement.

00:42:12: Jeder Unternehmerin und Unternehmer geht wetten in seinem Unternehmen ein, versucht mit Sportanalysen aus so was Risiko zu minimieren.

00:42:20: Deswegen würde ich einfach sagen behandle deine KI wie einen Lieferanten nie nur eine Quelle!

00:42:26: Denn der ehrliche Grund für Self-Hustling, wie gesagt das Datenhoheit des Nichtkostenersparners.

00:42:31: ob wir alle von großen Modellen abgegrenzt werden in der Zukunft wissen wir nicht.

00:42:37: aber wie immer gilt Wer vorbereitet ist, hat es später einfacher.

00:42:41: In dem Sinne ich hoffe die Folge war nicht zu verwirrend und nicht zu technisch aber mir war wichtig dass wir das ein bisschen erörtern.

00:42:47: Ich glaube du hast nochmal eine neue Perspektive darauf bekommen auch was es für Möglichkeiten gibt.

00:42:52: deswegen geh ran mach dir Gedanken!

00:42:54: Wir hören uns in der nächsten Folge.

00:42:56: bis dahin ciao.

Neuer Kommentar

Dein Name oder Pseudonym (wird öffentlich angezeigt)
Mindestens 10 Zeichen
Durch das Abschicken des Formulars stimmst du zu, dass der Wert unter "Name oder Pseudonym" gespeichert wird und öffentlich angezeigt werden kann. Wir speichern keine IP-Adressen oder andere personenbezogene Daten. Die Nutzung deines echten Namens ist freiwillig.