Post #8924

@ai_machinelearning_big_data

Machinelearning

Просмотры43,800Количество просмотров

Опубликован2 нояб.02.11.2025, 09:32

Содержимое поста

Содержимое

⚡️LongCat-Flash-Omni - открытая 560B MoE-модель (27B активных параметров), которая умеет вести живой диалог в реальном времени, слышать, видеть и отвечать голосом. Ключевые фишки: -модель разговаривает и видит собеседника, реагирует на беседу в реальном времени - 128K контекст - продвинутая MoE-архитектура: высокое качество при меньших затратах (27B активных параметров из 560B) - Полгный open-source По тестам: - лидер на OmniBench, DailyOmni - хорошие показатели на ASR (распознавании речи), DocVQA, RefCOCO - обходит лучше Qwen3-Omni Instruct - и очень близка к Gemini-2.5-Flash, но это все таки*открытая* модель Открытая мультимодальная модель, которую можно запускать локально, хороший вариант для голосовых ассистентов. 🤖Model: https://modelscope.cn/models/meituan-longcat/LongCat-Flash-Omni 🌐Demo: https://longcat.ai 📄 Full technical report & code: https://github.com/meituan-longcat/LongCat-Flash-Omni @ai_machinelearning_big_data #AI#OpenSourceAI#Multimodal#MoE#LLM#GenAI