TGTGInsighttelegram intelligenceLIVE / telegram public index
← Python Заметки

TGINSIGHT SIMILAR POSTS

Најди сличен содржај

Изворен канал @pythonotes · Post #312 · 14 мар.

Из-за всем известных событий очень многие потеряли работу. Для поиска вакансий вполне можно использовать паблики в telegram. Вот несколько которые мне известны: https://t.me/django_jobs https://t.me/javascript_jobs https://t.me/workzavr https://t.me/workoo https://t.me/Workesss @g_jobbot ➡️ Чем шире о себе заявите, тем больше шансов найти нужный контакт. Поэтому предлагаю айтишникам и художникам бесплатно разместить на моём канале @pythonotes информацию о вас. Формат сообщения можно сделать примерно следующий: _______________________________ Имя Фамилия Специализация О себе - Долго думаю, быстро делаю. Кем хочу работать - Разработчик мобильных приложений Локация - Удалённо, возможен переезд в ГородНейм Знаю языки программирования - JSON - CSS - HTML Хорошо владею софтом - Maya. Ротоскопинг, трекинг - Nuke. Персонажная анимация - 3DsMax. Композитинг и кленап Где работал - Microsoft, админ лифта - Yandex, доставка пончиков - Disney, протирка шариков от мышей Контакты - Телеграм: @username - Почта: [email protected] - Полное резюме (ссылка на GoogleDoc/LinkedIn/PDF) _______________________________ Картинки не надо, смайлы без фанатизма. Текст присылайте в этот временный канал, где будем обсуждать все вопросы: ▶️@pn_work 🌼 Если найдутся желающие, вакансии тоже могу запостить 📅 Предложение актуально как минимум до лета 2022г. Если будет хоть один пост, уже не зря старался) 📌@pythonotes #offtop

Hashtags

Резултати

Пронајдени 1 слични објави

Пребарај: #ssm

当前筛选 #ssm清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #8750 · 13.10.2025 г., 15:05

⚡️Mamba-3 тихо и без объявления вышла на ICLR - и это может стать началом конца эпохи Transformers. Новая архитектура Mamba-3 делает модели быстрее, стабильнее и эффективнее при работе с длинными контекстами. Главная идея - не в слоях внимания, а в state-space моделях, где модель хранит и обновляет внутреннее состояние во времени. 📘Краткие эускурс: - Mamba-1 ввела непрерывную динамику и выборочное обновление памяти - помнила эффективно без высокой цены attention. - Mamba-2 показала, что обновления состояния и attention - это две стороны одной математики, что ускорило вычисления на GPU. - Mamba-3 довела концепцию до зрелости: теперь внутренняя память развивается плавнее и устойчивее за счёт перехода от простого шага Эйлера к трапецеидальному интегрированию. Вместо простого шага Эйлера, как в Mamba-2, Mamba-3 аппроксимирует интеграл обновления состояния не только по правому концу интервала, но усреднением между началом и концом, с коэффициентом λ, зависящим от данных. Это даёт более точное приближение (второго порядка) и делает динамику состояния более выразительной. 🧠Что изменилось под капотом: - Память стала «ритмичной»: теперь модель может хранить повторяющиеся и периодические паттерны (например, структуры языка или музыки). - Новый multi-input-multi-output дизайн позволяет обрабатывать несколько потоков параллельно — идеально для современных GPU. ⚙️Что это даёт на практике: - Эффективная работа с длинными последовательностями: документы, геномы, временные ряды. - Линейное время выполнения и стабильная задержка делают её идеальной для реального времени: чат-ботов, перевода, речи. - Энергоэффективность и масштабируемость открывают путь к on-device AI, где большие модели работают локально, без облака. Mamba-3 - это не просто ускоренная альтернатива Transformers. Это новая архитектура, которая объединяет глубокое понимание контекста, скорость и устойчивость, от серверных систем до умных устройств. 🟢Подробности: https://openreview.net/pdf?id=HwCvaJOiCj @ai_machinelearning_big_data #ssm#mamba3#llm,#architecture#ai