увеличить конечно можно. вопрос в том что он из этого контекста поймет
2026-07-29 11:07:37
17
Аквил :
подключили mem0 и греют инвесторов красавцы
2026-07-29 01:25:26
34
ZailoxTweank :
И в чём прикол?
Просто взяли Qwen, дистиллировали на чуть более длинном корпусе, чтобы модель не терялась на длинном контексте и всё
.
Да даже если они сделали умнее – толку мало, kv cache будет весить как сама модель и никто её инференсить не будет
2026-07-31 06:16:12
0
Clever Monkey :
О ура сценарий написан нейронкой и озвучен нейронкой
уточню что SubQuadratic не раскрыла какую модель они дообучали, но точно не Qwen, слишком много не сходится в отчётах и paper SubQuadratic если предположить что это была Qwen (впринципе любая Qwen), я пришёл к выводу что это была Mistral medium 3.5, но там тоже есть несостыковка по TFLOPS H100 на миллионном контексте, хотя остальное совпадает идеально
2026-07-29 17:01:40
1
User :
Так надо все тестить. А то на хайпе такую ерунду несут…. Только тесты! 👍
2026-07-28 19:45:31
1
хз лох :
у каждой модели не квадратичная сложность, я с квадратичной помню ток дипсик какойто, и то так сделали потому что у них 1 лям контектса и в его пределах он вообще как o logn растет
2026-07-29 09:32:11
0
Ilya :
А смысл, еслм активного контекста дай бог 40к,как у топовых моделей, все астольное просто забывает нейронка, и вспоминает когда ей напоминать, она не использует всегда этот контекст, так что я думаю там хуйня, для прогрева инаесторов
2026-07-29 12:58:29
0
Vladl :
Вот же дебилы, себе же яйца пилят, да и нам тоже!😆
2026-07-28 20:37:17
0
Hippocrates :
Это я первый делал эту технологию она зафексирочга в линкделин на моем аакаунтк а это просто мошенн ки
2026-07-28 23:25:21
0
Oleg :
👍👍👍
2026-07-28 16:24:15
0
romokaso :
❤️❤️❤️
2026-07-30 11:59:22
0
To see more videos from user @xenon.lab2, please go to the Tikwm
homepage.