Разработчик DeepSeek Чэнь Сяокан опубликовал в сети X загадочный тизер, который может сигнализировать о скором анонсе новой мультимодальной модели. В посте, сопровождаемом фразой «Now, We See You», он разместил изображение двух китов-маскотов компании: один с закрытыми повязкой глазами, другой — с открытыми.
По мнению экспертов, это может означать подготовку модели, способной работать с визуальными данными на новом уровне. Чэнь Сяокан специализируется на мультимодальных проектах в DeepSeek, что подтверждает его компетенцию в данной области. Напомним, что в 2024 году компания уже выпустила DeepSeek-VL и DeepSeek-VL2 — модели, ориентированные на обработку текста и изображений. Однако новый продукт может стать как продолжением этой линейки, так и самостоятельной разработкой, способной расширить возможности компании в сфере компьютерного зрения.
На данный момент от DeepSeek не поступало официальных заявлений о грядущем анонсе. Это оставляет вопрос о статусе новой модели открытым, но вызывает интерес у сообщества.
Специалисты отмечают, что если новая модель действительно появится, она может стать важным шагом в развитии мультимодальных систем, которые становятся все более востребованными в условиях роста спроса на ИИ-решения для анализа данных. Тизер с китами-маскотами, один из которых «открывает глаза», а другой «закрывает», может символизировать переход от ограниченного восприятия к более глубокому анализу данных. Это косвенно подтверждает гипотезу о том, что новая модель DeepSeek будет способна обрабатывать не только текст, но и сложные визуальные запросы, включая распознавание объектов, сцен и даже эмоций на изображениях.
Пока рано говорить о конкретных характеристиках или дате релиза новой модели. Однако уже сейчас понятно, что DeepSeek продолжает активно развиваться в сегменте мультимодальных ИИ-решений, что может усилить конкуренцию на рынке генеративных моделей.