RAG Pipeline 6/N: Бенчмарк – от 20% до 98%, а потом 52.7% на чужих данных

В предыдущих сериях: Qdrant (1/N), эмбеддинги (2/N), нарезка на чанки (3/N), гибридный поиск (4/N), переранжирование (5/N). Конвейер (pipeline) – вся цепочка от запроса до ответа – построен и работает. Но насколько хорошо? Пока нет цифры, оценка "хорошо" остаётся субъективной. Повод для замера: проект AgentMemory заявляет 95.2% recall@5 на бенчмарке LongMemEval-S. Recall@5 (полнота поиска) – это доля вопросов, для которых нужный фрагмент попал в первую пятёрку результатов. Решил проверить эту цифру у себя: прогнал тот же метод через свой конвейер, но на реальных данных. ...

11 июня 2026 · 13 минут · 2617 слов · DevOps Way

Networking 20/80, уровень 6: Балансировка нагрузки и сети Kubernetes

Седьмой, финальный уровень мини-курса "Networking 20/80". Всё предыдущее сходится здесь: адреса, DNS, TCP, HTTP и межсетевые экраны складываются в то, как запрос снаружи попадает в pod и распределяется между репликами. L4 против L7, четыре типа Service, Ingress – и общая картина сети в Kubernetes целиком. "В Kubernetes нет понятия "сервер". Есть pod-ы, которые рождаются и умирают. Service – абстракция, которая превращает хаос в стабильную точку доступа (endpoint). Ingress – дверь снаружи." ...

8 августа 2026 · 9 минут · 1 слово · DevOps Way

Стратегии наблюдаемости и примеры дашбордов

Основные подходы к наблюдаемости Метод USE (Utilization, Saturation, Errors) Метод USE (Утилизация, Насыщенность, Ошибки) предложен Брэнданом Греггом как способ системно проверять "здоровье" ресурсов инфраструктуры (CPU, память, диск, сеть и пр.) (brendangregg.com) Идея проста: для каждого ресурса отслеживай три аспекта: Utilization (утилизация) – сколько времени ресурс занят полезной работой (в процентах). Saturation (насыщенность) – имеются ли очереди задач, ждут ли они доступ к ресурсу. Errors (ошибки) – сколько операций завершилось с ошибкой или сбоем. Этот подход помогает быстро выявлять "узкие места" на уровне оборудования или базовых систем, даже когда ты не знаешь заранее, где может быть проблема. (brendangregg.com) ...

25 сентября 2025 · 5 минут · 894 слова · DevOps Way

Локальный AI-ассистент в терминале: гайд для DevOps-инженера (2026)

В феврале Qwen Code выглядел как бесплатная альтернатива Claude Code. 15 апреля Alibaba закрыла бесплатный доступ. Инструмент устарел за два месяца. Это типичная проблема: привязка к одному вендору = риск. Сегодня бесплатно, завтра – нет. Поэтому перезапускаем тему с другим фокусом: tool-agnostic + model-agnostic. Выбираем CLI отдельно, модель отдельно, и собираем рабочий стек, который не сломается от решений чужого менеджмента. Часть 1: Выбираем CLI Три рабочих варианта на май 2026. Все – open-source, все работают с локальными моделями через Ollama. ...

22 мая 2026 · 11 минут · 2175 слов · DevOps Way

Docker Level 04: .dockerignore -- Образ 2GB, внутри .env с паролями

БОЛЬ Ревью Docker-образа перед деплоем. docker images показывает 2.1GB для простого Node.js-приложения. Запускаете docker run --rm myapp ls -la и видите: node_modules (800MB), .git (400MB), test-data (500MB). И самое страшное – .env с DB_PASSWORD, JWT_SECRET, AWS_SECRET_KEY. Образ уже в Docker Hub. Пароли в открытом доступе. Даже если удалить .env в следующем слое – он останется в истории образа. docker history покажет всё. Исправление: .dockerignore – файл-фильтр, который не пускает лишнее в контекст сборки. ...

18 мая 2026 · 3 минуты · 535 слов · DevOps Way

Docker Level 02: Dockerfile -- Работает у меня, а у коллеги нет

БОЛЬ Джуниор присылает в чат: "У меня всё работает". Вы клонируете репозиторий, запускаете npm install – ошибка. У него Node 18, у вас Node 22. У него Ubuntu, у вас macOS. У него python3 указывает на 3.10, у вас – на 3.12. "Работает у меня" – это не баг, это отсутствие воспроизводимой среды. Dockerfile решает проблему: он описывает среду декларативно. Кто бы ни собрал образ – результат будет одинаковый. КАК УСТРОЕНО Dockerfile – это текстовый файл с инструкциями для сборки образа. Каждая инструкция создаёт слой (layer) в образе. ...

18 мая 2026 · 3 минуты · 448 слов · DevOps Way

Docker Level 01: docker run -- Зачем вообще контейнеры?

БОЛЬ Пятница, 18:47. Вы обновляете Python на сервере, где крутятся 5 микросервисов. apt upgrade python3 – и бот в Telegram падает, потому что ему нужен Python 3.10, а вы только что поставили 3.12. Заодно сломался Flask-сервис, который зависел от libssl1.1, а теперь стоит libssl3. Знакомо? Это классика: конфликт зависимостей на общем хосте. Один apt update может положить всё, потому что 5 сервисов делят одну файловую систему, одни библиотеки, один Python. ...

18 мая 2026 · 3 минуты · 477 слов · DevOps Way

MLOps Roadmap: 838 вакансий против 90 тем roadmap.sh

Проблема: 90 тем и ноль приоритетов Откройте roadmap.sh/mlops. Там 90+ тем, разбросанных по 11 категориям. Feature Store, Model Registry, Data Versioning, Experiment Tracking, Model Serving, A/B Testing, Data Labeling… Каждая тема – отдельный мир с документацией на 200 страниц. Если вы DevOps-инженер, который хочет перейти в MLOps, эта карта выглядит как план захвата Луны, когда вам нужно просто доехать до работы. Проблема roadmap.sh – он показывает всё, что существует, но не говорит, что из этого реально нужно. Это как список из 500 инструментов в Prometheus – технически они есть, практически вы используете 12. ...

1 мая 2026 · 7 минут · 1289 слов · DevOps Way

Страх и ненависть в Telegram: Как я написал свой Bot API на рельсах НОРЫ

«У нас было два бинарника на 22 МБ, 75 SQLite-файлов, 5 петабайт ИИ-данных в НОРЕ и целое множество энкодеров всех сортов и расцветок…» Мы оказались где-то посреди цифровой пустыни между Лас-Вегасом и Бейкерсфилдом, когда до нас начало доходить: Telegram – всё. С 10 февраля медиа тормозят, а 1 апреля маячит полная блокировка. Боль: Мониторинг на грани слепоты У товарища на поддержке 50+ организаций (кино, вещание, живые эфиры). Вся инфраструктура мониторинга – это Zabbix + Python-боты. Они годами слали в Telegram всё: от SNMP-статусов железа до скриншотов эфира и алертов по битрейту. ...

19 марта 2026 · 5 минут · 1042 слова · DevOps Way

🧠 Диагностика системного мышления: Оценка за 7 минут

🧠 Диагностика системного мышления ❓ Большинство переоценивают свой T-shaped уровень Многие IT‑специалисты считают себя T‑shaped, но в критических ситуациях переходят в модель I‑shaped – и это указывает на недостаточность системного мышления в реальных условиях. Проверьте свой реальный уровень по 3 критериям: навыки, мышление, влияние. 🧪 Пройдите быструю самодиагностику Отмечайте только то, что реально проявлялось в ваших проектах. Диагностика занимает ~7 минут и покажет ваш уровень от базового до мастера. Загружается диагностика системного мышления... ...

15 июля 2025 · 1 минута · 80 слов · DevOps Way