AI/Infra #77: Kubernetes готовят к AI, GLM-5.3 открыли, JetBrains раскрыла взлом
Платформенным командам предлагают готовить Kubernetes к гетерогенным AI-нагрузкам и предсказывать потребность в GPU заранее. Вышли открытые веса GLM-5.3 и локальный ускоритель инференса для Qwen. JetBrains сообщила о компрометации Cadence через критическую уязвимость TeamCity. Также — htmx 4.0, Flatpak, ClickHouse Managed Postgres и идеи для памяти агентных систем.
🎧 Подкаст-версия выпуска (mp3)
☸️ Платформы и облака
- Предиктивный автоскейлинг GPU в Kubernetes — Контроллер с Bi-LSTM раз в минуту прогнозирует нагрузку на 10 минут вперёд, чтобы GPU-узлы успели подняться до всплеска трафика.
- Что нужно Kubernetes-платформе для AI — При том что 66% команд уже используют Kubernetes для части инференса, авторы советуют расширить планирование, CI/CD и наблюдаемость на весь жизненный цикл моделей.
- Как настроить JVM против OOMKill — Команда Т-Банка описала настройку JVM в Kubernetes, которая устранила OOMKill и снизила потребление ресурсов примерно на треть.
- Tailscale добавил DNS-фильтрацию Control D — Фильтры вредоносных и нежелательных доменов можно применять к группам, тегам и устройствам tailnet через интеграцию с ACL.
- Cloudflare упрощает регистрацию ботов — BotBase предлагает операторам более понятный путь в каталог известных ботов и агентов, чтобы сайты могли различать автоматический трафик.
🤖 Модели и агентные системы
- GLM-5.3 опубликована с открытыми весами — zai-org представила открытую модель GLM-5.3, позиционируя её как модель для продвинутого программирования.
- DFlash 2 ускоряет локальный Qwen — GGUF-черновик для Qwen3.8-27B использует спекулятивное декодирование в llama.cpp и достигает средней длины принятия до 5,39 токена.
- fal заявляет генерацию видео быстрее реалтайма — H3 Max, дообученная поверх MiniMax H3, по заявлению fal генерирует пять секунд видео менее чем за три секунды и лидирует в image-to-video с аудио.
- Память LLM превратили в анализ программ — Lemmalog отделяет рассуждения агента от базы фактов на Datalog и автоматически отменяет выводы, если исходные наблюдения изменились.
- Модели хуже людей оценивают AI safety-идеи — Бенчмарк TASTE показывает, что модели согласуются с оценками предложений по безопасности AI лишь примерно в 60% случаев и уступают людям.
- Для пустых комментариев кода предложили термин yap — Автор предлагает помечать многословные, но бессодержательные комментарии, часто оставляемые LLM, коротким словом yap.
- OpenAI отключит модели в Cursor после сделки со SpaceX — OpenAI намерена прекратить контракт с Cursor 12 ноября 2026 года, сославшись на риски соблюдения условий после смены владельца.
🛠️ Инструменты и опенсорс
- Вышел htmx 4.0 — Релиз переходит с XMLHttpRequest на fetch, делает наследование атрибутов явным и пока остаётся веткой next, а не latest в NPM.
- Project Loom в IntelliJ IDEA — JetBrains разбирает поддержку virtual threads, scoped values и structured concurrency, упрощающих разработку конкурентного Java-кода.
- Django снова выбирает скучную надёжность — Пятый ежегодный опрос Django, подготовленный DSF и PyCharm, собрал ответы почти 3 500 разработчиков из более чем 40 стран.
- Flatpak получил 500 тысяч евро — Sovereign Tech Agency инвестирует 500 тысяч евро в развитие Flatpak как инфраструктуры распространения Linux-приложений.
- Виртуальный iPhone из командной строки — vphone-cli позволяет загружать виртуальный iPhone через Apple Virtualization.framework, что может упростить локальную автоматизацию iOS.
- Спор о клавиатурном управлении GUI — Популярное эссе на Hacker News защищает интерфейсы, где все действия доступны с клавиатуры, а не только через указатель.
🔐 Инциденты и доверие
- JetBrains Cadence скомпрометирован через TeamCity — Злоумышленники эксплуатировали критическую CVE-2026-63077 с 8 по 24 августа; пользователям Cadence следует отозвать или сменить все использованные секреты.
- Как Яндекс собирает энтропию для KMS — Команда Яндекса рассказывает, как сочетает источники случайности, чтобы предсказуемый рандом не подрывал криптографическую защиту.
- Яндекс Браузер запускает программу корневых сертификатов — Новая Root Certificate Program описывает требования к центрам сертификации, которым браузер будет доверять в экосистеме WebPKI.
🗄️ Данные
- ClickHouse обновил старт для Managed Postgres — Четырёхшаговый онбординг проводит от запуска NVMe Postgres и загрузки данных до CDC-репликации и аналитики в ClickHouse.
Больше заметок: @mediocreit
Собрано: OpenAI / gpt-5.6-terra
Обогащение: Tavily
TTS: ElevenLabs / eleven_multilingual_v2
Tracing: Nebius Tracing