Китайская компания DeepSeek представила новую модель искусственного интеллекта DeepSeek-V4. 1-Flash. Разработчики называют ее самой маленькой моделью в новом семействе V4. 1, но в то же время подчеркивают заметное улучшение возможностей. Модель создана с акцентом на более высокую скорость работы, большую производительность и возможность масштабирования для более сложных задач.
DeepSeek также заявляет об улучшении работы с текстовыми и ИИ-агентами. V4. 1-Flash может использоваться не только для обычного общения, но и для выполнения более сложных последовательностей действий, программирования и других задач, где важна скорость получения результата. Кроме того, новая модель поддерживает собственное понимание изображений, то есть может работать не только с текстовыми запросами.
По данным технических материалов, DeepSeek-V4. 1-Flash построена по архитектуре Mixture of Experts. Общее количество параметров модели составляет около 522 млрд, но во время обработки каждого токена активируется лишь часть из них. Это позволяет сочетать высокую мощность с относительно небольшими вычислительными затратами.
Отдельное внимание DeepSeek уделяет стоимости и скорости работы. Компания позиционирует V4. 1-Flash как более доступный вариант для массового использования, что особенно важно для разработчиков, работающих с большими объемами запросов через API. Новая модель должна стать одним из ключевых инструментов DeepSeek для конкуренции с другими крупными ИИ-системами.

Презентация состоялась на фоне активного развития DeepSeek. Компания одновременно готовится к возможному выходу на Шанхайскую фондовую биржу STAR Market, специализирующуюся на технологических компаниях. Поэтому запуск V4. 1 – Flash имеет для DeepSeek не только технологическое, но и стратегическое значение-компания пытается закрепиться среди главных игроков мирового рынка искусственного интеллекта.

