@subi_pra_nuvem: OLLAMA NÃO É DE GRAÇA! Ollama roda LLMs localmente, sem pagar API, sem limite de requisições. No papel é perfeito. Na prática, cada modelo decente exige dezenas de gigabytes de memória unificada só pra carregar os pesos na RAM — e isso antes de processar qualquer token. Um modelo como o LLaMA 3 70B precisa de ~40GB de VRAM só pra rodar. O hardware que aguenta isso no ecossistema Apple são os chips M-series com memória unificada alta — o que na prática significa Mac Studio com 96GB+. Quatro unidades dessas, montei a sacola na Apple: 296 MIL REAIS. Pra 99,9% dos devs, continua mais barato pagar API. #ollama #llm #inteligenciaartificial #programacao #dev #ia #backend #machinelearning

João Marcelo
João Marcelo
Open In TikTok:
Region: BR
Wednesday 03 June 2026 20:00:00 GMT
28142
1795
45
42

Music

Download

Comments

math_the_dev
math_the_dev :
Por isso uso Deepseek, fácil e barato, coloquei 10 dólares começo do ano passado e dura até hoje.
2026-06-04 01:57:31
14
mmkk77_3
￴ ￴￴ ￴￴￴￴ ￴￴ ￴ ￴￴ ￴ ￴￴ ￴ :
mas um Macbook não tem todo o hardware favorecido pra rodar IA localmente? Pq eu sei que depende do modelo de IA né? se for um 24B da certo em 1 Mac studio?
2026-06-10 05:14:24
0
3dbuild.com.br
Marcelo PC :
Ollama é só pra quando tiver um apocalipse ou ficar sem Internet.. Kkkkk
2026-06-22 11:00:48
0
gabdecsters
GABRIELDECSTERS :
Mano sério que jeito ridículo de explicar
2026-06-04 05:04:42
4
blyrics87
Bruno 🇧🇷 ⚡ :
Sem condições de rodar IA local , GLM-5.2 ,- Até ~1,5 TB de RAM para rodar sem quantização🤯 Mesmo em uma versão altamente comprimida, ainda exige cerca de 240–256 GB de RAM
2026-06-29 13:47:44
1
tribosaudavel
Tribo Saudável :
Hoje temos o Gemini, Copilot e outros com uma quantidade generosa de uso, pra que usar API d deep seek?
2026-06-03 21:43:22
4
ri_chardyso
Richard :
falar mais facil, mim não entender
2026-06-09 18:19:56
0
smileynogueira
Smiley Nogueira :
no Paraguai e + barato
2026-06-19 21:06:40
0
youngxrk
young :
tenho 64gb de ram dá?
2026-06-04 07:10:41
0
synastrianetworks
SynastrIA Networks 🇧🇷 :
Mais barato usar IA pequena 👍👍👍👍👍👍
2026-06-11 03:35:50
0
diogobernini1
Diogo Bernini :
Minha 5070 com 32gb de RAM e 12 de Vram rodam ollama com qwen 3.6 27B no OpenCode suave
2026-06-04 05:37:50
2
felipe.rodrigues5674
Felipe Rodrigues :
eu rodo um modelo com 6 giga de ram do ollama e daí me explica
2026-07-21 22:51:56
0
wevesilva7
wevesilva7 :
estou usando um versão com 9 gigas pra minha rtx 4070 e roda de boa, calro que ajustei vai claude code e deixou 100 e ainda coloquei intercalando com gemini com a chave api grátis
2026-06-17 17:15:08
0
xzz1109
chocks :
concordo com tudo
2026-06-03 21:41:20
0
papainoel.recap
Papai Noel Recap :
Tem as versões quantizadas que aguenta de boa e nao perde muita qualidade de resposta. Mas Ollama eu particularmente não gosto, como o ollama gerencia entre cpu e gpu sozinho, se ele troca de cpu pra gpu no meio da resposta, ele alucina, baixando o modelo via hf vc tem mais dominio em definir em cpu ou gpu, evitando alucinação por gargalo
2026-06-15 15:07:40
0
awayluk0
luk :
isso pensando a curto prazo, se for pensar a longo prazo compensa sim
2026-06-03 22:01:12
1
ricardonegro7
Ricardo :
Pra que falar deste jeito moço! Ficaria melhor se falasse de maneira séria!
2026-06-06 16:05:58
0
ctf.777
FIREFOX :
eu com o meu servidor caseiro com o allama eu tenho o table do governo 2gb um a03 e o principal para eu roda os comandos o a05 total 10gb eu to fazendo uma ia local para programação no terminal eu vou fazer um vídeo amanhã ou depois de amanhã
2026-08-13 23:55:38
0
cezarlobo
Cezar Schwartz :
Ollama é só mono, produção esquece
2026-08-24 00:15:15
0
under_rea
Renan Carvalho :
Para fins específicos é útil sim, e na versão mais acessível (que dá para hospedar sem gastar tanto). Só que vai demandar bastante técnica e gambiarra. Não vai ser útil para tudo, óbvio.
2026-06-08 15:51:24
0
hades8334
🌈♾️ hades 🚸📝 :
O que isso tem de brainrot?
2026-06-07 19:41:26
0
adrianoolher413
Adriano Play Online :
Eu prefiro iA local.uso a hora que eu quiser e sempre esta saindo modelos iA novos pra testar,no meu caso foi a melhor coisa que eu fiz.
2026-06-07 19:32:48
0
yohanlee314
Azedin :
Ollama serve, mas se quer desempenho, use LlamaCPP com um BAT bem estruturado. Quem não sabe programar, usa Kimi K3. Sem internet, a coisa simples é Qwen 4B no LlamaCPP; online, Kimi K3.
2026-07-18 20:32:44
1
craiou
craiou :
100 reais ollama pro limite até você não aguentar mais usar o modelo ollama compensa sim usa ollama paga api só tem 1 modelo ollama bom sim
2026-06-04 01:24:00
0
To see more videos from user @subi_pra_nuvem, please go to the Tikwm homepage.

Other Videos


About