Перейти к содержимому
Экосистема AI Vibe
← Назад к AI Vibe News

Редакция 21 июля 2026 г.

Новости

Ollama 0.30: GGUF с Hugging Face и coding-агенты одной командой

Локальный сервер Ollama отдаёт GGUF-модель coding-агенту на видеокарте NVIDIA, AMD или Intel.

Ollama 0.30 расширила поддержку GGUF через llama.cpp — рядом с движком MLX на Apple Silicon. На NVIDIA заявлен прирост до 20% (тест: Gemma 4 26B на RTX 5090, квантование Q4_K_M). Vulkan включён по умолчанию: GPU-ускорение на AMD и Intel без установки библиотек вендора.

Модели и свои веса

Из коробки добавились семейства LFM и Prism, плюс дообученные модели от Unsloth. Свой вес с Hugging Face: скачиваете GGUF-файл или папку, в Modelfile указываете FROM ./my-model.Q4_K_M.gguf, затем ollama create -f Modelfile my-model и ollama run my-model.

Coding-агенты

Модель с вызовом инструментов в Ollama работает так же — проверить можно через ollama show my-model: в выводе ищите capability tools. Запуск одной командой:

  • Claude Code — ollama launch claude --model my-model
  • Hermes Agent — ollama launch hermes --model my-model
  • OpenClaw — ollama launch openclaw --model my-model

Источник: Improved performance and model support with GGUF.