@rickbjia: ¿27 mil millones de parámetros en poco más de 7 GB? 🤯 Esto es Ternary Bonsai 27B PQ2_0, funcionando completamente en local. En mi RTX 5070 ronda los 60 tokens por segundo: la prueba de razonamiento la clava, pero cuando le pedimos una web completa empiezan a salir las costuras. 🔧 Modelo, instalación y configuración: github.com/RicardoBertran/ternary-bonsai-27b-pq2 ¿2 bits son suficientes o estamos comprimiendo demasiado? #IA #IALocal #InteligenciaArtificial #TernaryBonsai #LocalAI #LlamaCPP #GGUF
tengo un portátil de 32 GB ram y una 4060 de 8vram y cuál ia local puedo correr?
2026-09-19 01:48:44
3
Rodrigo Zamora :
2bits las alucinaciones de esa ia deben ser monumentales 😂
2026-09-18 22:02:51
1
Kaïsam :
esa interfaz gráfica para hablar con el modelo cual es?
2026-09-19 00:23:08
1
Toti's :
Ricardo...¿Que modelo tienes en github para la prueba?
2026-09-18 23:37:27
1
Zumito de limón 🍋🍋🍋 :
llegará, igual dentro de los tres siguientes meses, pero llegará...
2026-09-18 19:27:25
2
Neil McCauley995 :
no sirve, de 4 bits en adelante es ok
2026-09-18 21:03:06
1
Gocho289 :
yo tengo un Ryzen 5 3600 con 32 GB de ram y 8GB en RX 6600.. quiero cambiar a una RX 9060 xt de 16GB Pero antes de hacer el salto quiero probar la de 8GB con una IA local que me recomiendas y gracias crack
2026-09-18 15:58:44
2
zonextg :
ese modelo ya casi lo corre decente android 😅
2026-09-18 17:38:45
1
Sebastian Ortiz :
que recomiendas para 3060 de 6GB de portatil
2026-09-18 14:24:07
1
TioZes :
cómo haces para ver la velocidad de los token?
2026-09-18 17:12:28
1
esteban :
para una 3070 de 8Gb y 24 de RAM que recomienda?
2026-09-18 18:58:51
0
Jimy Tintaya :
Gracias por compartir tus pruebas!
2026-09-18 14:26:15
1
Ghostccj :
pierde mucho rendimiento al estar en q2 (hay test de rendimiento con respecto a otro modelo?)creo que es más preferible usar un modelo con q4 a menos que se use para tareas sencillas entonces podría ser viable. es mi opinión no digo que sea la verdad absoluta porque hay tantos modelos para comparar que puede haber excepciones que no allá probado
2026-09-18 15:57:09
1
danielcarrascom10 :
Interesante... tengo que probarlo con mi NAS a ver qué tal. Es a CPU pero para las tareas que hace no tengo prisa 😁.
2026-09-18 18:33:22
1
Zentro Data Group :
Hola, q gran contenido, consulta Tengo una i5
Con 32gb de ram
1tb ssd y 1tb hdd
1 una rtx 3060 de 12gb (no es TI)
q IA local podría tener si el uso normal que e doy es de un 30% de ram y entre 1 y 3% de gpu
Y cuanto de almacenamiento requiere, la tendría en el ssd o hdd, el ssd por velocidad pero ahí tengo el SO.
2026-09-18 18:27:20
1
Richard :
El problema es la cuantizacion Q2, para coding tiene problemas, lo pudistes comprobar y no es el modelo en si, es su quantizacion, lo mínimo sería Q4
2026-09-18 23:51:56
1
Fénix :
cuál funciona mejor la que corre en disco o estás comprimidas ?
2026-09-18 17:04:24
0
PatricioASC :
2026-09-18 20:49:36
0
No Me Pisotees :
La quantización más agresiva que funciona decente es la gsq rco iq3 s
2026-09-19 04:43:01
0
Ricardo Bertran :
27B en poco más de 7 GB y ~60 t/s 🤯Todo el setup, configuración y pruebas en la descripcion!
2026-09-18 14:13:41
0
Andres Berger :
es que 2b ya estas mochando mucho y alucina
2026-09-19 03:40:13
0
To see more videos from user @rickbjia, please go to the Tikwm
homepage.