Sobre Ollama v0.19

## Aceleração Massiva de Modelos Locais no Apple Silicon com MLX

Resumo da IA

Ollama v0.19 reconstrói a inferência em Apple Silicon com base no MLX, trazendo um desempenho local muito mais rápido para fluxos de trabalho de codificação e agentes. Também adiciona suporte a NVFP4 e reutilização de cache mais inteligente, snapshots e remoção para sessões mais responsivas.

Descricao Detalhada

Ollama v0.19: 🚀 IA local turbinada! Performance ultra-rápida em Apple Silicon com MLX, ideal para codificação e agentes. 💻 NVFP4 e cache inteligente 🧠 para sessões responsivas. Snapshots e descarte otimizado. ⚡️

Principais Recursos

Reconstrução da inferência Apple Silicon sobre MLX para maior velocidade local.
Desempenho aprimorado para fluxos de trabalho de codificação e agentes.
Adição de suporte NVFP4.
Reutilização de cache mais inteligente.
Snapshots para sessões mais responsivas.
Eviction para sessões mais responsivas.
Comentarios 0

Nenhum comentário ainda

Seja o primeiro a compartilhar seus pensamentos e iniciar a conversa!

Participe da conversa

Entre para deixar um comentário e compartilhar seus pensamentos.

0.0
0 reviews
Carregando...
Loading rating distribution...
Carregando...

Loading reviews...