@cheriffai: Apresentamos o DiffusionGemma: um modelo experimental de 26B parametros que gera blocos inteiros de texto ao mesmo tempo, em vez de palavra por palavra. 🔬 Os números: → 26B parametros totais, mas somente 3.8B ativados em inference → Mais de 1000 tokens/segundo na H100 → Mais de 700 tokens/segundo numa RTX 5090 → Cabendo em apenas 18GB de VRAM A ideia é simples: o modelo comeca com um canvas de tokens aleatorios e vai refinando até o texto aparecer — exatamente como os modelos de difusão geram imagens. Sim, tem trade-off: a qualidade é inferior ao Gemma 4 padrão. Mas para uso local e interativo, a velocidade e incomparável. Ja esta disponivel no Hugging Face com licenca Apache 2.0. 💬 E vocês: preferem velocidade ou qualidade na geração de texto? Comentem abaixo! #DiffusionGemma #Google #IA #InteligenciaArtificial #MachineLearning OpenSource Gemma LLM NVIDIA RTX5090 TechNews AIResearch HuggingFace Apache2 Inovacao CheriffAI