Ниже — перевод статьи «Friends Don’t Let Friends Use Ollama», опубликованной на Sleeping Robots в апреле 2026 года. Поскольку за прошедшие месяцы Ollama успела заметно измениться, я добавил к переводу несколько комментариев и примечание в конце статьи, где обновил ключевые технические детали по состоянию на сентябрь 2026 года.Ollama стала популярной потому, что первой предложила простой интерфейс поверх llama.cpp. А затем годами старалась лишний раз не напоминать, на чём на самом деле работает, вводила пользователей в заблуждение и в конце концов развернулась в сторону облака — всё это на венчурные деньги, привлечённые вокруг чужого движка.Вот эта история целиком — и почему сегодня альтернативы выглядят лучше.Ollama — самый популярный способ запускать большие языковые модели локально. И, пожалуй, не должна им быть.Своим положением она обязана прежде всего тому, что оказалась первой: первым инструментом, который сделал llama.cpp доступным людям, не желавшим компилировать C++ или самостоятельно писать конфигурацию сервера. На тот момент это действительно был полезный вклад.Но затем проект годами систематически затушёвывал происхождение технологии, на которой работал, вводил пользователей в заблуждение относительно того, что именно они запускают, и всё дальше отходил от принципа «локально прежде всего», благодаря которому изначально и заслужил доверие. И всё это — параллельно с привлечением венчурных инвестиций.Это не попытка найти «правду где‑то посередине». Я пользовался Ollama. Потом перестал. Ниже — почему, на мой взгляд, вам стоит сделать то же самое. Читать про Ollama и историю
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Я устал писать одноразовые скрипты для бенчмарков LLM и собрал харнесс, который сам считает Pareto-front | 0 | 7 | 27-06-2026 |
| 2 | Открытые LLM в продакшене: 8 выводов о llama.cpp, Gemma и Qwen | 0 | 7 | 14-07-2026 |
| 3 | В чём реальная проблема ЛЛМ | -5 | 7 | 03-07-2026 |
| 4 | Один интерфейс — девять LLM-провайдеров: как мы подружили Kimi K3, GLM-5.2, Claude и Ollama в одном терминальном агенте | 0 | 12.65 | 31-07-2026 |
| 5 | Как желание быстрее читать чужой код превратилось в войну с недетерминизмом LLM | 0 | 5 | 28-06-2026 |
| 6 | Qwen 3.6 27b на 8-12gb vram в llama.cpp до 256к контекста | 0 | 20.06 | 16-07-2026 |
| 7 | Как мы сделали AI code review через Ollama без облака? | 0 | 6.97 | 06-03-2026 |
| 8 | Книга: «LLM на практике. Большие языковые модели от идеи до внедрения» | 0 | 8.01 | 18-08-2026 |
| 9 | Как не потерять себя в эпоху ИИ | 0 | 8.92 | 01-08-2026 |