@floknowsai: In einem Jahr ersetzt ein lokales Modell dein Claude-Abo. Ob eins auf deinen Rechner passt, rechnest du vorher aus, nämlich Parameterzahl mal Bits je Gewicht, geteilt durch acht. Acht Milliarden Parameter in Q4 sind rund 4,5 GB. Bei einem Mixture of Experts ist das die Falle. Qwen3-30B-A3B trägt „3 Milliarden aktiv" im Namen und braucht trotzdem den Speicher für 30,5 Milliarden. Aktiv heißt gerechnet, nicht geladen. Das Tempo schätzt du ab mit Speicherbandbreite geteilt durch Modellgröße, dann halbiert. Ein 8B-Modell in vier Bit auf 400 GB/s landet bei rund 44 Token pro Sekunde. Fine-Tuning und LoRA sind kein Weg für Wissen, das sich ändert. Ein Fine-Tune ist veraltet, sobald sich das Dokument ändert, ein Index nicht. Was ist bei lokaler KI noch wichtig? #ki #lokaleki #claude
Florian Schünemann
Region: DE
Sunday 16 August 2026 09:35:00 GMT
Music
Download
Comments
nefqzpwl3 :
In einem Jahr kann mein MacBook M3 immer noch kein brauchbares lokales Modell laufen lassen. Clickbait. 2/10 made me reply
2026-08-16 16:33:11
16
rundoedoedoe :
Fähigkeiten 😂
2026-08-17 01:33:58
1
Newcomer1989 :
noch nie gab es ein besseren Anwendungsfall für die Cloud. Massive Rechenoperationen und nur minimale Netzwerkübertragung. Lokale Hardware so auszustatten, dass es performant und qualitativ ist, ist in 98% wirtschaftlicher Wahnsinn. Alleine aus Umweltgründen würde es Sinn machen, die Berechnungen dort stattfinden zu lassen, wo wir den Strom am effizientesten herstellen können und gleichzeitig die Hardware auf so viele Menschen als möglich aufzuteilen.
2026-08-16 15:07:40
11
Gofonia :
in einem Jahr können lokale Modelle immer noch nicht Hunde von Katzen unterscheiden
2026-08-17 00:50:30
0
Horizon :
Das funktioniert bei mir heute schon... also sehe das Problem nicht
2026-08-16 11:47:32
3
@Pilot_of_my_Body :
ich habe qwen coder 30b auf einer 4080super (16GB) mit 36k context laufen. für die Projekte die ich ab und an umsetze reicht es
2026-08-16 10:09:32
3
qudrok :
Wenn du einen Rechner hast mit 128GB Speicher der 10.000 kostet
2026-08-16 15:04:55
1
aitan:tunes :
Welche lokale KI funktioniert am besten beim programmieren mit UNITY?
2026-08-17 06:44:23
0
Samson :
Also 5000 Serie 16 gb bringt nicht viel die llm sind quasi dumm
2026-08-16 19:36:57
0
veganweakness :
Bis dahin hat auch der letzte gecheckt dass Generative ki keinen Mehrwert hat
2026-08-16 11:44:07
0
Der Ben :
Du hast nen grundlegenden Fehler drin. Die locale. Erinnerungen ruft man Semantisch über ne chromadb sql Datenbank ab. Alles andere ist zu langsam
2026-08-16 17:27:23
1
Serok 💫 :
Welche Pc‘s oder Laptops würdest du für lokale KI empfehlen, bzw. worauf würdest du achten?
2026-08-17 14:38:00
0
coffeeinus :
Das Problem, Speicher bleibt für viele noch wenigstens für ein weiteres Jahr unerschwinglich ☝️
2026-08-16 17:03:11
0
Alex :
hab gehört lieber Graphdatenbank seiner Dateien aufbauen statt RAG?
2026-08-16 18:39:12
0
SNAPY_M235 :
Wo lernt man sowas um es beruflich nutzen zu können?
2026-08-16 11:24:43
0
ライナス :
wird gespeichert und wird genutzt wenn ich nen gaming pc habe
2026-08-16 09:42:32
2
Steffen HS :
Bratkartoffeln und kalter Kaffee warum nicht nur Fremdwörter für jedes einzelne Wort😏
2026-08-16 09:53:07
0
Der Ben :
Nen rag ist nicht nötig. Ich hab nen 18 Node Cluster mit jeweils 3x dualgpu nodes und mehrere kleine nodes die hybrid fahren. Setzt meine Kosten auf 40€ im Monat
2026-08-16 14:09:02
0
cousin.fuller :
Watt? 😅
2026-08-16 09:47:04
0
user156019839 :
mit meine 6800xt AMD ist lokales model immer ein Glückspiel aus Treiber und was das Model ausspuckt
2026-08-16 13:46:13
1
KernelGhost :
Ne danke bleibe bei Claude Code
2026-08-16 14:12:42
0
j8p3r :
not true you can buy them anymore, you will only be able to buy models embedded in the chip.
2026-08-16 13:18:59
1
vincentmumme :
Strong
2026-08-16 12:35:00
1
Stoapiperl :
Qwen 3.8 27b ist einfach Mörder geil hab mir extra eine zweite 7900xtx geholt dafür
2026-08-17 06:25:15
0
Mindset Crew 🧠 Mr. Mindset :
Ne ich meine nefqzpwl3 mit seinem M1
2026-08-17 10:20:29
0
To see more videos from user @floknowsai, please go to the Tikwm
homepage.