@floknowsai: In einem Jahr ersetzt ein lokales Modell dein Claude-Abo. Ob eins auf deinen Rechner passt, rechnest du vorher aus, nämlich Parameterzahl mal Bits je Gewicht, geteilt durch acht. Acht Milliarden Parameter in Q4 sind rund 4,5 GB. Bei einem Mixture of Experts ist das die Falle. Qwen3-30B-A3B trägt „3 Milliarden aktiv" im Namen und braucht trotzdem den Speicher für 30,5 Milliarden. Aktiv heißt gerechnet, nicht geladen. Das Tempo schätzt du ab mit Speicherbandbreite geteilt durch Modellgröße, dann halbiert. Ein 8B-Modell in vier Bit auf 400 GB/s landet bei rund 44 Token pro Sekunde. Fine-Tuning und LoRA sind kein Weg für Wissen, das sich ändert. Ein Fine-Tune ist veraltet, sobald sich das Dokument ändert, ein Index nicht. Was ist bei lokaler KI noch wichtig? #ki #lokaleki #claude

Florian Schünemann
Florian Schünemann
Open In TikTok:
Region: DE
Sunday 16 August 2026 09:35:00 GMT
34659
1338
117
122

Music

Download

Comments

nefqzpwl3
nefqzpwl3 :
In einem Jahr kann mein MacBook M3 immer noch kein brauchbares lokales Modell laufen lassen. Clickbait. 2/10 made me reply
2026-08-16 16:33:11
16
rundoedoedoe
rundoedoedoe :
Fähigkeiten 😂
2026-08-17 01:33:58
1
newcomer43
Newcomer1989 :
noch nie gab es ein besseren Anwendungsfall für die Cloud. Massive Rechenoperationen und nur minimale Netzwerkübertragung. Lokale Hardware so auszustatten, dass es performant und qualitativ ist, ist in 98% wirtschaftlicher Wahnsinn. Alleine aus Umweltgründen würde es Sinn machen, die Berechnungen dort stattfinden zu lassen, wo wir den Strom am effizientesten herstellen können und gleichzeitig die Hardware auf so viele Menschen als möglich aufzuteilen.
2026-08-16 15:07:40
11
gofonia
Gofonia :
in einem Jahr können lokale Modelle immer noch nicht Hunde von Katzen unterscheiden
2026-08-17 00:50:30
0
horizon4005
Horizon :
Das funktioniert bei mir heute schon... also sehe das Problem nicht
2026-08-16 11:47:32
3
pilot_of_my_body
@Pilot_of_my_Body :
ich habe qwen coder 30b auf einer 4080super (16GB) mit 36k context laufen. für die Projekte die ich ab und an umsetze reicht es
2026-08-16 10:09:32
3
qudrok
qudrok :
Wenn du einen Rechner hast mit 128GB Speicher der 10.000 kostet
2026-08-16 15:04:55
1
aitan.tunes
aitan:tunes :
Welche lokale KI funktioniert am besten beim programmieren mit UNITY?
2026-08-17 06:44:23
0
usernameuranus
Samson :
Also 5000 Serie 16 gb bringt nicht viel die llm sind quasi dumm
2026-08-16 19:36:57
0
veganweakness
veganweakness :
Bis dahin hat auch der letzte gecheckt dass Generative ki keinen Mehrwert hat
2026-08-16 11:44:07
0
benjamin_bluemchen81
Der Ben :
Du hast nen grundlegenden Fehler drin. Die locale. Erinnerungen ruft man Semantisch über ne chromadb sql Datenbank ab. Alles andere ist zu langsam
2026-08-16 17:27:23
1
voodooman78
Serok 💫 :
Welche Pc‘s oder Laptops würdest du für lokale KI empfehlen, bzw. worauf würdest du achten?
2026-08-17 14:38:00
0
coffeeinus7
coffeeinus :
Das Problem, Speicher bleibt für viele noch wenigstens für ein weiteres Jahr unerschwinglich ☝️
2026-08-16 17:03:11
0
the9ty9
Alex :
hab gehört lieber Graphdatenbank seiner Dateien aufbauen statt RAG?
2026-08-16 18:39:12
0
snapy_m235
SNAPY_M235 :
Wo lernt man sowas um es beruflich nutzen zu können?
2026-08-16 11:24:43
0
liouinz
ライナス :
wird gespeichert und wird genutzt wenn ich nen gaming pc habe
2026-08-16 09:42:32
2
steffenhs0
Steffen HS :
Bratkartoffeln und kalter Kaffee warum nicht nur Fremdwörter für jedes einzelne Wort😏
2026-08-16 09:53:07
0
benjamin_bluemchen81
Der Ben :
Nen rag ist nicht nötig. Ich hab nen 18 Node Cluster mit jeweils 3x dualgpu nodes und mehrere kleine nodes die hybrid fahren. Setzt meine Kosten auf 40€ im Monat
2026-08-16 14:09:02
0
cousin.fuller
cousin.fuller :
Watt? 😅
2026-08-16 09:47:04
0
user156019839
user156019839 :
mit meine 6800xt AMD ist lokales model immer ein Glückspiel aus Treiber und was das Model ausspuckt
2026-08-16 13:46:13
1
kernelghost4
KernelGhost :
Ne danke bleibe bei Claude Code
2026-08-16 14:12:42
0
j8p3r
j8p3r :
not true you can buy them anymore, you will only be able to buy models embedded in the chip.
2026-08-16 13:18:59
1
vincentmumme
vincentmumme :
Strong
2026-08-16 12:35:00
1
stoapiperl
Stoapiperl :
Qwen 3.8 27b ist einfach Mörder geil hab mir extra eine zweite 7900xtx geholt dafür
2026-08-17 06:25:15
0
mindsetcrewmrmindset
Mindset Crew 🧠 Mr. Mindset :
Ne ich meine nefqzpwl3 mit seinem M1
2026-08-17 10:20:29
0
To see more videos from user @floknowsai, please go to the Tikwm homepage.

Other Videos


About