«Турбо Облако» предлагает модели с контекстом до 1 млн токенов и 753 млрд параметров

Российский облачный провайдер «Турбо Облако» (входит в группу компаний РТК-ЦОД) сообщил о расширении своего каталога Foundation Model Hub. В сервисе появились новые поколения востребованных ИИ-моделей.

«Турбо Облако» предлагает модели с контекстом до 1 млн токенов и 753 млрд параметров
Источник

По данным компании, спустя неделю после добавления моделей DeepSeek-V4-Flash-0731 и GLM 5.2 фиксируется стабильный интерес со стороны разработчиков и корпоративных клиентов. Модель DeepSeek-V4-Flash-0731, отличающаяся контекстным окном объемом до 1 миллиона токенов, заняла первую строчку в рейтинге платформы OpenRouter по показателю потребляемых токенов и сохраняет эту позицию. Модель GLM 5.2, насчитывающая 753 миллиарда параметров, укрепила сегмент открытых решений и на данный момент является самой производительной в каталоге провайдера.

Возможности DeepSeek-V4-Flash-0731 наиболее полно раскрываются в задачах, требующих высокой скорости обработки, точности и работы с большими объемами данных. Контекст в миллион токенов позволяет анализировать крупные массивы документации, значительные репозитории кода или разнородные базы знаний за один проход. Обновленная архитектура, как заявляется, обеспечивает улучшенное качество обработки текста и генерации кода, в том числе в многошаговых агентных сценариях.

Модель GLM 5.2 предназначена для более сложных инженерных и аналитических нагрузок, включая многоэтапные рассуждения, расчеты и построение автономных агентных систем. Наличие открытых весов делает ее привлекательной для проектов, где требуется глубокая настройка и возможность аудита.

Дополняют линейку каталога две модели семейства Qwen, которые закрывают различные корпоративные потребности. Модель Qwen3.6-35B-A3B с 35 миллиардами параметров и контекстом до 262 тысяч токенов поддерживает работу с текстом и изображениями и подходит для типовых бизнес-задач, таких как генерация контента, поиск по внутренним базам данных и автоматизация рутинных процессов. Модель Qwen3.5-122B-A10B (122 миллиарда параметров) ориентирована на более ресурсоемкие сценарии: обработку больших объемов документации, аналитику и создание продвинутых ИИ-ассистентов.

Все перечисленные модели доступны через единый API, совместимый с форматом OpenAI, что позволяет пользователям переключаться между ними без изменений в существующей кодовой базе. Интеграция не требует развертывания собственной GPU-инфраструктуры. Предусмотрено гибкое управление ключами и настраиваемые лимиты потребления (дневные, недельные, месячные), что дает командам возможность контролировать использование ресурсов под разные проекты. Оплата осуществляется по модели «pay-as-you-go» — только за фактически обработанное количество токенов.

Читайте также: Разработан чип для ИИ с программируемой скоростью отклика.

Что будем искать? Например,ChatGPT

Мы в социальных сетях