Содержание
llama.cpp упрощает запуск локального AI на компьютере
У популярного open-source проекта llama.cpp появился официальный сайт llama.app. Он собрал в одном месте установку, документацию и каталог моделей, которые можно запускать прямо на своём компьютере — без облачного API, телеметрии и передачи переписки на сторонние серверы.
Установка одной командой
Главное изменение для обычных пользователей — более простой старт. На сайте опубликована единая команда установки, а для тех, кто предпочитает привычные инструменты, оставлены варианты через Homebrew, Winget и сборку из исходного кода. llama.cpp поддерживает macOS, Windows, Linux и разное железо: от CPU и Apple Silicon до видеокарт NVIDIA, AMD и Intel.
На llama.app также появился каталог готовых моделей. Среди примеров — Qwen 3.6, Gemma 4, GPT-OSS и другие открытые модели. Это снижает порог входа: не нужно сначала разбираться в репозиториях и форматах файлов, чтобы понять, какую модель попробовать локально.
Можно подключить локального кодинг-агента
Отдельный сценарий — работа с кодом. llama.cpp предлагает запустить локальный сервер командой llama serve, установить плагин pi-llama и подключить кодинг-агента Pi. Агент автоматически находит локальную модель, не требует API-ключа, а файлы и запросы остаются на устройстве пользователя.
Почему это важно
Локальный запуск особенно полезен для конфиденциальных материалов, черновиков, клиентских данных и задач, где важны предсказуемые расходы. Качество и скорость по-прежнему зависят от выбранной модели и мощности компьютера, но новый официальный сайт делает весь путь — от установки до первого запроса — заметно понятнее.