TGTGInsighttelegram intelligenceLIVE / telegram public index
← Mathshub: интенсив по математике и Python (aug '22)

TGINSIGHT SIMILAR POSTS

Најди сличен содржај

Изворен канал @pythonmathaug22 · Post #22 · 7 сеп.

Дорогие студенты Mathshub! Спасибо за поддержку идеи помогать друг другу❤️ Мы получили уже более 20 заявок от более продвинутых студентов, желающих помочь начинающим с нуля✨ В ближайшее время мы присвоим вам в Discord роль «helpers», которая будет отображаться в вашем профиле. А теперь хотим понять, кому нужна помощь и поддержка хелпера — если вам нужна помощь более продвинутого студента, то, пожалуйста: 1. Зайдите в Discord на наш канал #python-и-математика-интенсив 2. Найдите последний закрепленный пост про набор в мини-группы 3. Оставьте под этим постом реакцию "палец вверх👍🏻" 4. Ожидайте от нас распределения на группы) Идея объединяться в группы не обязательна для всех. Она актуальна только для желающих поддержку от более продвинутых студентов. Если вам не актуально, то можете не обращать внимание на это сообщение😌 Спасибо!

Hashtags

Резултати

Пронајдени 1 слични објави

Пребарај: #mistralsmall4

当前筛选 #mistralsmall4清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #9685 · 18.03.2026 г., 14:15

⚡️Mistral выпустила Small 4. Mistral Small 4 - это мультимодальный комбайн, который закрывает сразу три задачи: ризонинг, агентный кодинг и работу с изображениями. Раньше под каждую из них была отдельная модель: Magistral, Devstral и Pixtral. Теперь один чекпоинт, 🟡Архитектура MoE с 128 экспертами, из которых на каждый токен активируются 4. Всего 119B параметров, активных - 6B на токен. Контекстное окно - 256 тыс. токенов. По сравнению с Mistral Small 3 в новой версии задержка сократилась на 40%, пропускная способность выросла в 3 раза. Ключевая фича - параметр reasoning_effort. Если поставить none будет быстрый чат-режим, как в Small 3.2, а с ключом high модель начнет разворачивать цепочку рассуждений, сопоставимую с Magistral. Переключение в рантайме, без смены модели. 🟡Тесты Small 4 с включенным reasoning обходит GPT-OSS 120B на LiveCodeBench и генерирует при этом на 20% меньше токенов. На AA LCR набирает 0.72 при длине ответа 1.6K символов. Для сравнения, модели Qwen для тех же результатов нужно от 5.8K до 6.1K. Для self-hosted деплоя минимальный стенд - 4× NVIDIA HGX H100, 2× HGX H200 или 1× DGX B200. Попробовать бесплатно можно на build.nvidia.com, через Mistral API или AI Studio. 📌 Лицензирование: Apache 2.0 License. 🟡Статья 🟡Набор моделей @ai_machinelearning_big_data #AI#ML#LLM#MistralSmall4#MistralAI