@student.gpt: Ejecuta grandes modelos de IA como LLAMA 3.37B sin superordenador usando la biblioteca LLM en Python, una solución en tendencia que optimiza memoria con flash attention. Ideal para estudiantes, investigadores y desarrolladores que buscan innovación en inteligencia artificial accesible. #llama3 #modelosia #inteligenciaartificial #pythonopensource #flashattention
Tarda días para una tarea que lleva minutos, ese es el problema que no se resuelve, y te acorta la vida de los discos de estado sólido
2026-09-13 16:45:11
2
Tovar🚩 :
se te muere el disco
2026-09-13 00:41:42
5
. :
si, pero una cosita. Tarda minutos y horas para una respuesta
2026-09-12 21:49:19
1
nodejs :
Eso es demasiado lento, el tiempo vale oro, si solo lo ocupas para uso personal, te sale más barato pagar una suscripción.
2026-09-13 17:58:15
0
Diario Libre 📰📚 :
aja, re lento y además imposible o muy difícil de implementar en PC de 8gb
2026-09-13 18:42:35
0
JESUS :
que desinformación
2026-09-13 17:00:29
2
SAMA :
Y cto espacio en el disco necesitamos? Supongo q reduce la vida útil del disco
2026-09-13 18:00:10
0
horadenoticias.cl :
El.problema es que el modelo se vuelve dependiente del streaming desde RAM/disco. AirLLM muestra un ejemplo extremo con KIWI K3 donde el.consumonde VRAM es.bajísimo, pero la generación llega a 293 segundos por token, porque el cuello de botella pasa a ser el almacenamiento.
2026-09-13 07:21:55
0
Rincon de letras....✍️ :
2026-09-12 21:21:29
0
To see more videos from user @student.gpt, please go to the Tikwm
homepage.