@cheriffai: Apresentamos o DiffusionGemma: um modelo experimental de 26B parametros que gera blocos inteiros de texto ao mesmo tempo, em vez de palavra por palavra. 🔬 Os números: → 26B parametros totais, mas somente 3.8B ativados em inference → Mais de 1000 tokens/segundo na H100 → Mais de 700 tokens/segundo numa RTX 5090 → Cabendo em apenas 18GB de VRAM A ideia é simples: o modelo comeca com um canvas de tokens aleatorios e vai refinando até o texto aparecer — exatamente como os modelos de difusão geram imagens. Sim, tem trade-off: a qualidade é inferior ao Gemma 4 padrão. Mas para uso local e interativo, a velocidade e incomparável. Ja esta disponivel no Hugging Face com licenca Apache 2.0. 💬 E vocês: preferem velocidade ou qualidade na geração de texto? Comentem abaixo! #DiffusionGemma #Google #IA #InteligenciaArtificial #MachineLearning OpenSource Gemma LLM NVIDIA RTX5090 TechNews AIResearch HuggingFace Apache2 Inovacao CheriffAI

CheriffAI
CheriffAI
Open In TikTok:
Region: BR
Wednesday 17 June 2026 07:44:58 GMT
181
4
0
0

Music

Download

Comments

There are no more comments for this video.
To see more videos from user @cheriffai, please go to the Tikwm homepage.

Other Videos


About