Статьи

Статьи о Доке и AI-агентах

Как устроена Дока, зачем нужен десктопный агент, и что вообще происходит с ИИ. страница 3.

7 августа 2026 г.·4 мин чтения

MCP в Unreal Engine 5.8: как подключить ИИ-агента к своему проекту

В UE 5.8 появился встроенный MCP-сервер: как включить плагин Unreal MCP, сгенерировать конфиг клиента, что агент может делать в редакторе и почему сервер нельзя открывать наружу.

unreal enginemcpгеймдев
5 августа 2026 г.·3 мин чтения

Аналоги LM Studio, Open WebUI и AnythingLLM: чем заменить и под что

Разбор локальных ИИ-приложений по типам: чат с моделью, веб-платформа, RAG по документам и агент. Что из них чем заменяется и почему замена внутри одного типа редко решает проблему.

аналогилокальносравнение
5 августа 2026 г.·4 мин чтения

AnythingLLM Desktop: что умеет и где заканчивается чат по документам

Разбор десктопной версии AnythingLLM: рабочие пространства и RAG, агентские навыки и MCP, чего в Desktop нет по сравнению с серверной версией и от чего на самом деле зависит приватность.

anythingllmragлокально
5 августа 2026 г.·3 мин чтения

Jan AI: локальная замена ChatGPT и её потолок

Что умеет Jan: локальные модели с Hugging Face, сервер на localhost:1337, подключение облачных провайдеров и MCP. Чем приложение отличается от агента и где упирается формат чата.

janлокальночат
5 августа 2026 г.·3 мин чтения

llama.cpp на процессоре: запуск локальной модели без видеокарты

Как запустить llama.cpp только на CPU, какая модель реально пойдёт без видеокарты, почему всё упирается в пропускную способность памяти и каких скоростей ждать.

llama.cppcpuлокально
5 августа 2026 г.·3 мин чтения

Эмбеддинги в llama.cpp: локальный поиск по своим документам

Как поднять llama-server в режиме --embeddings, зачем нужна отдельная модель под эмбеддинги, что делает --reranking и почему для RAG приходится держать два сервера.

llama.cppragэмбеддинги
5 августа 2026 г.·4 мин чтения

MCP в llama.cpp: инструменты для локальной GGUF-модели

Как в llama-server подключить MCP-серверы через --mcp-servers-config, зачем нужен --jinja, почему CORS-прокси опасно включать и что при такой схеме остаётся на компьютере.

llama.cppmcpлокально
5 августа 2026 г.·4 мин чтения

llama.cpp, Ollama и LM Studio: чем движок отличается от обёртки

Почему llama.cpp — это движок, а Ollama и LM Studio — надстройки над ним, чем Llama отличается от llama.cpp, и что из этого выбрать под свою задачу на домашнем ПК.

llama.cppollamalm studio
5 августа 2026 г.·3 мин чтения

llama-cpp-python: локальная модель из Python за десять минут

Как поставить llama-cpp-python, включить сборку под видеокарту, загрузить GGUF-модель прямо с Hugging Face и поднять OpenAI-совместимый сервер одной командой.

llama.cpppythonлокально
5 августа 2026 г.·4 мин чтения

llama.cpp на Windows: запуск без сборки из исходников

Как запустить llama.cpp на Windows на готовых бинарниках: какую сборку выбрать под NVIDIA, AMD или процессор, как стартует llama-server и почему нельзя менять --host на 0.0.0.0.

llama.cppwindowsлокально
5 августа 2026 г.·3 мин чтения

llama-server: локальный OpenAI-совместимый API на своём компьютере

Как поднять llama-server, какие эндпоинты он отдаёт, зачем нужны --api-key и --parallel, и почему замена --host на 0.0.0.0 открывает твою модель всей сети.

llama.cppapiлокально
5 августа 2026 г.·4 мин чтения

MLX или GGUF на Mac: в каком формате запускать локальную модель

Чем формат MLX отличается от GGUF на Apple Silicon, почему mlx-lm не открывает .gguf, что выбрать под свою задачу на MacBook и как единая память влияет на размер модели.

mlxggufmac