Вместо долгого начала про июльские отпуска и шуток про жару просто похвастаемся цифрами. Тридцать секунд — столько теперь занимает создание сервера. 2,7 миллиарда — столько объектов лежит в нашем S3. До 12,5 миллионов — столько токенов начисляем на первого AI-агента.
А если серьезно, за месяц у нас: два новых провайдера AI-моделей, обновления в S3, сертификаты Минцифры, приватные агенты, новая площадка для Амстердама и многое другое.
Не сбавляем темп — насыщенный на события июль ниже ↓
Новая площадка для зоны AMS-1
В июне в дата-центре зоны AMS-1 были проблемы с охлаждением — поэтому мы переезжаем. Нашей новой площадкой станет ЦОД NorthC, сейчас вместе с их инженерами расширяем мощности по питанию под объемы наших стоек. Все подробности появляются в нашем канале →
Масштабируем, пересобираем, ускоряем
Продолжаем заниматься тем, что видно не в панели, а в скорости отклика. В июле взялись за три точки, где инфраструктура упиралась в потолок при росте нагрузки:
-
Очереди задач. Когда вы нажимаете кнопку в панели, задача уходит на ноду и встает в очередь — а расставляет их по приоритетам libvirt. Под высокой нагрузкой очереди забивались, и задача могла зависнуть или отмениться на полпути. Поэтому ускорили изоляцию нод, которые перестали отвечать, и перенастроили политики — теперь действия из панели отрабатывают заметно быстрее.
-
Сетевые диски. За создание, монтирование и подключение отвечает отдельный сервис. Запросов к нему становится больше, и на пиках это было заметно: диск подключался не сразу. Поэтому переработали и сделали архитектуру распределенной — так мощность растет вслед за нагрузкой. Прежнего ограничения по скорости больше нет.
-
Бэкапы. Обновляем парк хранилищ в Москве на более производительное оборудование и заодно приводим все хранилища к единой конфигурации — за счет этого копии создаются быстрее. На весь парк уйдет около двух месяцев, но ждать не придется: хранилища переезжают по очереди, и на уже обновленных бэкапы сразу делаются быстрее. Данные на время работ реплицируются.
Проверить скорость на своем проекте →
Что сделали для 2,7 миллиарда объектов в S3
Посчитали, сколько всего лежит в нашем S3, — вышло 2,7 млрд ваших объектов. Чем их больше, тем важнее удобство работы с ними — за это и взялись.

Сделали предпросмотр 74 форматов. Видео, текстовые файлы, таблицы, документы и презентации теперь открываются прямо в объектном менеджере. Чтобы заглянуть в файл и понять, тот ли это, качать его больше не нужно. Полный список форматов →
Выделили роль «Чтение и запись». С ней сотрудник, сервис или приложение работает только с объектами: читает, загружает, изменяет и удаляет. Настройки бакета и управление хранилищем остаются закрыты — задеть конфигурацию не получится. Остальные роли и уровни доступа →
Добавили CDN в один клик. Из раздела S3 теперь можно сразу создать CDN-ресурс с выбранным бакетом в качестве источника. Там же виден список связанных с бакетом ресурсов и переход в их настройки — статику из хранилища раздаете с ближайшего к пользователю узла, не собирая связку руками. Разложить файлы по бакетам →
Сертификаты Минцифры в один клик
Российские сервисы вроде API банков и госорганизаций работают с сертификатами Минцифры. Чтобы приложение им доверяло, у него должен быть корневой сертификат. Но в большинстве систем и библиотек его нет по умолчанию, и сертификат приходилось добавлять руками.

Теперь в App Platform он включается переключателем «Сертификаты Минцифры» — при создании приложения или в настройках готового. После включения приложение уйдет на повторный деплой.
Работает для бэкенд-приложений и развернутых из Dockerfile или Docker Compose. Фронтенду сертификаты не нужны. В бэкенд-приложениях сертификат подхватится сам, а для Docker мы кладем в контейнер три файла — доверие настраивается под ваш рантайм. Готовые инструкции для Node.js, Python, Go, JVM и .NET в документации →
Подружить приложение с российскими API →
Первый агент с токенами на старт
Кажется, без своего агента сегодня уже никуда. Мы сделали первый шаг проще: теперь вашему первому AI-агенту начисляем стартовый пакет токенов.
Размер пакета зависит от выбранной модели — до 12,5 млн токенов. Брать можно любую из 47 доступных: GPT, Claude, Gemini, DeepSeek, Grok, Qwen, YandexGPT и другие.
Сам агент стоит 1 ₽ в месяц. Когда стартовый пакет закончится, он продолжит работать по обычному тарифу выбранной модели.
Пакет начисляется один раз и только на первого агента. Получить его можно до 31 декабря 2026 года. Подробнее в правилах акции →
Железо с большим контролем
Приятно, когда всё железо ваше и ни с кем не делится. Для этого есть выделенные серверы — и в июле управлять ими стало проще.

Интернет-канал и дополнительные IP из панели. Раньше, чтобы сменить канал или заказать адрес, нужно было писать заявку в поддержку и ждать. Теперь всё делается самостоятельно и применяется сразу. Работает для выделенных серверов в Москве и Санкт-Петербурге.
Таб «История». Появился по аналогии с другими сервисами: видно, кто и когда заказал сервер, менял настройки, перезагружал, переключал канал, заказывал и освобождал IP. Если в команде несколько человек с доступом, то будет понятно, откуда взялось изменение.
Тридцать секунд от клика до сервера
В июне ускорили запуск управляемых сервисов, а в июле дошли до стандартных облачных серверов. Теперь сервер создается за 30 секунд — от нажатия кнопки до готовой машины.

Дело в смене архитектуры. Раньше цепочка операций тянулась через центральный API, теперь на каждом гипервизоре работает свой агент: API ставит задачу → агент выполняет ее на месте и сразу отчитывается. Цепочка стала короче, а независимые процессы идут параллельно, а не по очереди.
Заодно схема стала прозрачной для нас: каждый шаг создания сервера виден на графиках. Если что-то замедляется или сбоит, мы замечаем это по данным и чиним точечно, а не ищем причину по всей цепочке.
Дальше переводим на новую схему остальное: управляемые базы данных, серверы с Windows и установку из образов.
Два новых провайдера и большой завоз моделей
Во-первых, перевели агентов на High Availability в два кластера в Германии и США, чтобы отказ одной площадки не останавливал работу агентов.
Во-вторых, пополнили и обновили каталог моделей:
GLM 5.2, 4.7 и 4.7 FlashX от Z.ai. Заточены под агентные сценарии — то есть вызывать инструменты и выполнять цепочку действий.
Kimi от Moonshot. Сильны на длинном контексте: модель держит суть на больших объемах — своде документации, кодовой базе и длинной переписке.
GPT 5.6 в трех вариантах — Sol, Terra и Luna. Под широкий круг задач: текст, код, цепочки рассуждений.
Claude Opus 5 и Claude Sonnet 5 от Anthropic — для сложных сценариев и работы с базами знаний.
Grok 4.5 и Grok 4.3 — когда важен актуальный контекст.
Qwen 3.7 Max, 3.7 Plus и 3.6 Plus. Max тянет самые тяжелые задачи, Plus держит баланс скорости и качества.
Gemini 3.6 Flash и Gemini 3.5 Flash с быстрыми ответами без перерасхода бюджета.
GPT-4o mini TTS, GPT-4o mini Transcribe, GPT-4o Transcribe для синтеза и распознавания речи. Плюс GPT Image 2 — для генерации картинок.
А еще режимы thinking и non-thinking сделали просто переключением, а не двумя отдельными моделями.
И начали отключать устаревшие модели — их уже не поддерживают провайдеры. За две недели до отключения у модели появится плашка на странице агента и в Gateway, а еще напомним письмами. Если у вас пакетный тариф, за неиспользованные токены начислим бонусы.
Одно место для настроек
Активно разбирали техдолг, чтобы сервисы работали быстрее и предсказуемее. И если большую часть видно не будет, кое-что вы точно заметите — при настройке домена App Platform.

Раньше редактировать домены приходилось на отдельной странице, вне остальных настроек App Platform. Одна ошибка — и приложение не откроется у пользователей. Поэтому сделали всё во вкладке «Домены» в настройках приложения: просто выбираете уже добавленный домен или вводите внешний. Подробнее о привязке →
Заодно подстраховали в двух местах. Если домен занят другим сервисом, предупредим заранее и после сохранения перепривяжем сами. Если домен внешний, подскажем нужный IP прямо в окне — останется добавить A-запись у регистратора.
Агенты в российском контуре
Добавили в AI Gateway локальные модели: они размещены на серверах в РФ, и трансграничной передачи данных при работе с ними нет. В панели они собраны под фильтром «Локальные» — Qwen 3 235B Instruct, Qwen 3 Coder 480B A35B, Kimi K2.6, GPT OSS 120B и Gemma 4.

А следом появились и приватные AI-агенты — такой агент целиком работает на локальной модели, с базой знаний и интеграциями. Подойдет, если по внутренним требованиям данные не должны покидать российский контур.
Выбрать модель с российской пропиской →
Дайджест раз в месяц, журнал постоянно
Переработали журнал обновлений — теперь по нему можно искать и фильтровать по сервису и по месяцу, вплоть до лета 2024 года.
Все релизы, изменения и исправления багов собраны в одном месте. Удобно, если пропустили дайджест или хотите проверить, что менялось в конкретном сервисе.
Бэкапов много не бывает
В марте запускали логические бэкапы — вместо снимка всей системы формируется дамп базы и складывается в S3-бакет. А в июле принялись за прокачку физических.

Физические копии баз MySQL и PostgreSQL теперь скачиваются так же, как бэкапы облачных серверов. Пригодится, чтобы держать копию у себя или поднять из нее тестовый стенд.
Всё, что о нас говорят
Начнем с кейса Metamentor — команда делает AI под заказ и за месяц внедряет его в контур клиента: речевая аналитика, боты поддержки, обработка документов. За два года их выручка выросла в 32 раза, и прежняя инфраструктура за таким темпом перестала успевать — поэтому 80% ее переехало к нам. Подробно разобрали в текстовом кейсе, а кратко — в видео на YouTube, Rutube и в ВК.
Посчитали, чем малый и средний бизнес пользуется в облаке — картина получилась любопытная. Быстрее всего растет спрос на AI-агентов: в 4 раза за полгода, больше миллиарда токенов в день. Следом идут облачные серверы с GPU, S3-хранилище, бэкапы и Managed Kubernetes. А главное — больше 70% используют сразу два сервиса и больше: облако перестает быть точечным решением и становится единой платформой.
Поднялись с восьмого на пятое место в рейтинге GPU Cloud 2026 от CNews. Всего в рейтинге 15 провайдеров, сравнивали условия, типы GPU-серверов и ускорителей, стоимость ресурсов и варианты развертывания.
И про агентов — они научились генерировать изображения, искать в интернете и подключаться к инструментам из галереи MCP. Поделились новостью с CNews, TAdviser и IT World.
Что читали и лайкали
Для ваших глаз и лайков от нашей редакции — самое интересное из июльских публикаций.
Разбираемся, как LLM обесценили половину вашего опыта. Михаил Шпаков, наш руководитель разработки, заметил, что разговор про опыт и взгляды на собеседованиях стал различать кандидатов лучше, чем техническая секция. Текст-мнение о том, как модели перекраивают профессию, а вслед за ней и требования к людям в командах.
Открываем тайны самой экзотической видеокарты из 90-х — Intel i740. Первый GPU от Intel обогнал свое время и все равно провалился. Написали, на что он был способен и в чем его секрет, без рассказов про GeForce 256 и ATi 3D Rage, их и так все знают.
Стенка во «ВКонтакте», Баш.орг в закладках, LiveJournal и пиликающая «Аська» — и никаких алгоритмов, которые знают нас лучше нас самих. Возвращаемся к тому, чем пользовались все и что исчезло почти незаметно.
Осторожно: хардкор, или как написать фильтр Блума на C. Алгоритму больше полусотни лет, а поводов вспомнить, как пишут по-настоящему оптимизированный код, меньше не становится.
* * *
Июль позади, и лето потихоньку идет к финалу — остался август. Вернемся с новым дайджестом уже через месяц, а пока ждем ваши комментарии и лайки.

