До 12.5 млн токенов на тест ИИ-агента
Вход/ Регистрация

Июльский дайджест — сервер за 30 секунд, новые модели и токены на агента

14
10 минут чтения

Вместо долгого начала про июльские отпуска и шуток про жару просто похвастаемся цифрами. Тридцать секунд — столько теперь занимает создание сервера. 2,7 миллиарда — столько объектов лежит в нашем S3. До 12,5 миллионов — столько токенов начисляем на первого AI-агента.

А если серьезно, за месяц у нас: два новых провайдера AI-моделей, обновления в S3, сертификаты Минцифры, приватные агенты, новая площадка для Амстердама и многое другое.

Не сбавляем темп — насыщенный на события июль ниже ↓ 

Новая площадка для зоны AMS-1

 

В июне в дата-центре зоны AMS-1 были проблемы с охлаждением — поэтому мы переезжаем. Нашей новой площадкой станет ЦОД NorthC, сейчас вместе с их инженерами расширяем мощности по питанию под объемы наших стоек. Все подробности появляются в нашем канале →

Масштабируем, пересобираем, ускоряем

Продолжаем заниматься тем, что видно не в панели, а в скорости отклика. В июле взялись за три точки, где инфраструктура упиралась в потолок при росте нагрузки:

  1. Очереди задач. Когда вы нажимаете кнопку в панели, задача уходит на ноду и встает в очередь — а расставляет их по приоритетам libvirt. Под высокой нагрузкой очереди забивались, и задача могла зависнуть или отмениться на полпути. Поэтому ускорили изоляцию нод, которые перестали отвечать, и перенастроили политики — теперь действия из панели отрабатывают заметно быстрее.

  2. Сетевые диски. За создание, монтирование и подключение отвечает отдельный сервис. Запросов к нему становится больше, и на пиках это было заметно: диск подключался не сразу. Поэтому переработали и сделали архитектуру распределенной — так мощность растет вслед за нагрузкой. Прежнего ограничения по скорости больше нет.

  3. Бэкапы. Обновляем парк хранилищ в Москве на более производительное оборудование и заодно приводим все хранилища к единой конфигурации — за счет этого копии создаются быстрее. На весь парк уйдет около двух месяцев, но ждать не придется: хранилища переезжают по очереди, и на уже обновленных бэкапы сразу делаются быстрее. Данные на время работ реплицируются.

Проверить скорость на своем проекте →

Что сделали для 2,7 миллиарда объектов в S3

Посчитали, сколько всего лежит в нашем S3, — вышло 2,7 млрд ваших объектов. Чем их больше, тем важнее удобство работы с ними — за это и взялись.

10 (1)

Сделали предпросмотр 74 форматов. Видео, текстовые файлы, таблицы, документы и презентации теперь открываются прямо в объектном менеджере. Чтобы заглянуть в файл и понять, тот ли это, качать его больше не нужно. Полный список форматов →

Выделили роль «Чтение и запись». С ней сотрудник, сервис или приложение работает только с объектами: читает, загружает, изменяет и удаляет. Настройки бакета и управление хранилищем остаются закрыты — задеть конфигурацию не получится. Остальные роли и уровни доступа →

Добавили CDN в один клик. Из раздела S3 теперь можно сразу создать CDN-ресурс с выбранным бакетом в качестве источника. Там же виден список связанных с бакетом ресурсов и переход в их настройки — статику из хранилища раздаете с ближайшего к пользователю узла, не собирая связку руками. Разложить файлы по бакетам →

Сертификаты Минцифры в один клик 

Российские сервисы вроде API банков и госорганизаций работают с сертификатами Минцифры. Чтобы приложение им доверяло, у него должен быть корневой сертификат. Но в большинстве систем и библиотек его нет по умолчанию, и сертификат приходилось добавлять руками.

2 (1)

Теперь в App Platform он включается переключателем «Сертификаты Минцифры» — при создании приложения или в настройках готового. После включения приложение уйдет на повторный деплой.

Работает для бэкенд-приложений и развернутых из Dockerfile или Docker Compose. Фронтенду сертификаты не нужны. В бэкенд-приложениях сертификат подхватится сам, а для Docker мы кладем в контейнер три файла — доверие настраивается под ваш рантайм. Готовые инструкции для Node.js, Python, Go, JVM и .NET в документации →

Подружить приложение с российскими API →

Первый агент с токенами на старт

 

Кажется, без своего агента сегодня уже никуда. Мы сделали первый шаг проще: теперь вашему первому AI-агенту начисляем стартовый пакет токенов.

 

17

 

Размер пакета зависит от выбранной модели — до 12,5 млн токенов. Брать можно любую из 47 доступных: GPT, Claude, Gemini, DeepSeek, Grok, Qwen, YandexGPT и другие.

 

Сам агент стоит 1 ₽ в месяц. Когда стартовый пакет закончится, он продолжит работать по обычному тарифу выбранной модели.

 

Пакет начисляется один раз и только на первого агента. Получить его можно до 31 декабря 2026 года. Подробнее в правилах акции →

 

Начать с первого агента →

Железо с большим контролем

Приятно, когда всё железо ваше и ни с кем не делится. Для этого есть выделенные серверы — и в июле управлять ими стало проще.

16 (1)

Интернет-канал и дополнительные IP из панели. Раньше, чтобы сменить канал или заказать адрес, нужно было писать заявку в поддержку и ждать. Теперь всё делается самостоятельно и применяется сразу. Работает для выделенных серверов в Москве и Санкт-Петербурге.

Таб «История». Появился по аналогии с другими сервисами: видно, кто и когда заказал сервер, менял настройки, перезагружал, переключал канал, заказывал и освобождал IP. Если в команде несколько человек с доступом, то будет понятно, откуда взялось изменение.

Забрать себе железо целиком →

Тридцать секунд от клика до сервера

В июне ускорили запуск управляемых сервисов, а в июле дошли до стандартных облачных серверов. Теперь сервер создается за 30 секунд — от нажатия кнопки до готовой машины.

19

Дело в смене архитектуры. Раньше цепочка операций тянулась через центральный API, теперь на каждом гипервизоре работает свой агент: API ставит задачу → агент выполняет ее на месте и сразу отчитывается. Цепочка стала короче, а независимые процессы идут параллельно, а не по очереди.

Заодно схема стала прозрачной для нас: каждый шаг создания сервера виден на графиках. Если что-то замедляется или сбоит, мы замечаем это по данным и чиним точечно, а не ищем причину по всей цепочке.

Дальше переводим на новую схему остальное: управляемые базы данных, серверы с Windows и установку из образов.

Проверить секундомером →

Два новых провайдера и большой завоз моделей

 

Во-первых, перевели агентов на High Availability в два кластера в Германии и США, чтобы отказ одной площадки не останавливал работу агентов. 

 

9

 

Во-вторых, пополнили и обновили каталог моделей: 

 

  • GLM 5.2, 4.7 и 4.7 FlashX от Z.ai. Заточены под агентные сценарии — то есть вызывать инструменты и выполнять цепочку действий.

  • Kimi от Moonshot. Сильны на длинном контексте: модель держит суть на больших объемах — своде документации, кодовой базе и длинной переписке.

  • GPT 5.6 в трех вариантах — Sol, Terra и Luna. Под широкий круг задач: текст, код, цепочки рассуждений.

  • Claude Opus 5 и Claude Sonnet 5 от Anthropic — для сложных сценариев и работы с базами знаний.

  • Grok 4.5 и Grok 4.3 — когда важен актуальный контекст.

  • Qwen 3.7 Max, 3.7 Plus и 3.6 Plus. Max тянет самые тяжелые задачи, Plus держит баланс скорости и качества.

  • Gemini 3.6 Flash и Gemini 3.5 Flash с быстрыми ответами без перерасхода бюджета.

  • GPT-4o mini TTS, GPT-4o mini Transcribe, GPT-4o Transcribe для синтеза и распознавания речи. Плюс GPT Image 2 — для генерации картинок.

 

А еще режимы thinking и non-thinking сделали просто переключением, а не двумя отдельными моделями.

 

И начали отключать устаревшие модели — их уже не поддерживают провайдеры. За две недели до отключения у модели появится плашка на странице агента и в Gateway, а еще напомним письмами. Если у вас пакетный тариф, за неиспользованные токены начислим бонусы.

 

Перебрать весь каталог →

Одно место для настроек 

Активно разбирали техдолг, чтобы сервисы работали быстрее и предсказуемее. И если большую часть видно не будет, кое-что вы точно заметите — при настройке домена App Platform. 

5

Раньше редактировать домены приходилось на отдельной странице, вне остальных настроек App Platform. Одна ошибка — и приложение не откроется у пользователей. Поэтому сделали всё во вкладке «Домены» в настройках приложения: просто выбираете уже добавленный домен или вводите внешний. Подробнее о привязке →

Заодно подстраховали в двух местах. Если домен занят другим сервисом, предупредим заранее и после сохранения перепривяжем сами. Если домен внешний, подскажем нужный IP прямо в окне — останется добавить A-запись у регистратора.

Привязать домен в два шага →

Агенты в российском контуре

Добавили в AI Gateway локальные модели: они размещены на серверах в РФ, и трансграничной передачи данных при работе с ними нет. В панели они собраны под фильтром «Локальные» — Qwen 3 235B Instruct, Qwen 3 Coder 480B A35B, Kimi K2.6, GPT OSS 120B и Gemma 4.

6

А следом появились и приватные AI-агенты — такой агент целиком работает на локальной модели, с базой знаний и интеграциями. Подойдет, если по внутренним требованиям данные не должны покидать российский контур.

Выбрать модель с российской пропиской →

Дайджест раз в месяц, журнал постоянно

 

Переработали журнал обновлений — теперь по нему можно искать и фильтровать по сервису и по месяцу, вплоть до лета 2024 года. 

 

Все релизы, изменения и исправления багов собраны в одном месте. Удобно, если пропустили дайджест или хотите проверить, что менялось в конкретном сервисе.

 

Полистать журнал →

Бэкапов много не бывает

В марте запускали логические бэкапы — вместо снимка всей системы формируется дамп базы и складывается в S3-бакет. А в июле принялись за прокачку физических.

13

Физические копии баз MySQL и PostgreSQL теперь скачиваются так же, как бэкапы облачных серверов. Пригодится, чтобы держать копию у себя или поднять из нее тестовый стенд.

Положить копию поближе →

Всё, что о нас говорят

 

Начнем с кейса Metamentor — команда делает AI под заказ и за месяц внедряет его в контур клиента: речевая аналитика, боты поддержки, обработка документов. За два года их выручка выросла в 32 раза, и прежняя инфраструктура за таким темпом перестала успевать — поэтому 80% ее переехало к нам. Подробно разобрали в текстовом кейсе, а кратко — в видео на YouTube, Rutube и в ВК

 

Посчитали, чем малый и средний бизнес пользуется в облаке — картина получилась любопытная. Быстрее всего растет спрос на AI-агентов: в 4 раза за полгода, больше миллиарда токенов в день. Следом идут облачные серверы с GPU, S3-хранилище, бэкапы и Managed Kubernetes. А главное — больше 70% используют сразу два сервиса и больше: облако перестает быть точечным решением и становится единой платформой. 

 

Поднялись с восьмого на пятое место в рейтинге GPU Cloud 2026 от CNews. Всего в рейтинге 15 провайдеров, сравнивали условия, типы GPU-серверов и ускорителей, стоимость ресурсов и варианты развертывания.

 

И про агентов — они научились генерировать изображения, искать в интернете и подключаться к инструментам из галереи MCP. Поделились новостью с CNews, TAdviser и IT World.

Что читали и лайкали

Для ваших глаз и лайков от нашей редакции — самое интересное из июльских публикаций.

Разбираемся, как LLM обесценили половину вашего опыта. Михаил Шпаков, наш руководитель разработки, заметил, что разговор про опыт и взгляды на собеседованиях стал различать кандидатов лучше, чем техническая секция. Текст-мнение о том, как модели перекраивают профессию, а вслед за ней и требования к людям в командах.

Открываем тайны самой экзотической видеокарты из 90-х — Intel i740. Первый GPU от Intel обогнал свое время и все равно провалился. Написали, на что он был способен и в чем его секрет, без рассказов про GeForce 256 и ATi 3D Rage, их и так все знают.

Стенка во «ВКонтакте», Баш.орг в закладках, LiveJournal и пиликающая «Аська» — и никаких алгоритмов, которые знают нас лучше нас самих. Возвращаемся к тому, чем пользовались все и что исчезло почти незаметно.

Осторожно: хардкор, или как написать фильтр Блума на C. Алгоритму больше полусотни лет, а поводов вспомнить, как пишут по-настоящему оптимизированный код, меньше не становится.

 

*   *   *

Июль позади, и лето потихоньку идет к финалу — остался август. Вернемся с новым дайджестом уже через месяц, а пока ждем ваши комментарии и лайки.

14
10 минут чтения
Средний рейтинг статьи: 5
Предыдущая статья
Пока нет комментариев