Крупная китайская компания Meituan, известная своими сервисами доставки, презентовала необычный искусственный интеллект — LongCat-Flash-Omni. Это открытая и бесплатная модель, которая умеет не просто реагировать на голосовые команды, а буквально вести живой диалог, слышать интонации и даже “читать” выражение лица собеседника по видео. Чем особенен этот ИИ У LongCat-Flash-Omni огромная архитектура: 560 миллиардов параметров! Правда, реально задействовано только 27 миллиардов — в этом и фишка подхода “смесь экспертов” (Mixture of Experts). Такой принцип позволяет делать работу ИИ качественной, но в разы сокращать траты на вычисления. Ещё одна “суперспособность” модели — работать с очень длинным контекстом, до 128 000 токенов, а это значит: Что показали тесты LongCat-Flash-Omni отлично справилась с задачами на популярных бенчмарках: например, ASR (распознавание речи), DocVQA (работа с документами), RefCOCO (понимание изображений) и занимала верхние строчки в рейтингах OmniBench и DailyOmni. На практике она даже опередила Qwen3-Omni Instruct и почти догнала топовую Gemini 2.5 Flash от Google. Главное отличие — полная открытость модели. В отличие от других похожих решений, LongCat-Flash-Omni можно свободно запускать у себя, изучать, менять и приспосабливать под свои задачи. Это — большой шаг к демократизации ИИ-систем, считают эксперты: вход в сферу ИИ становится доступнее, а не только для крупных компаний со своими разработками. На фоне возрастающей конкуренции между крупнейшими технологическими гигантами, выход таких мощных и открытых ИИ показывает амбиции Meituan: компания хочет быть не только лидером в Китае, но и занять серьёзное место на международном рынке технологий.