🔥 Опубликованы веса и код Green-VLA — модели для управления роботами общего назначения.
Сбер открыл доступ к своей Vision-Language-Action модели. В феврале эта работа стала лучшей статьей недели на Hugging Face, а сейчас всё выложили в open-source.
🔘Главное о технической части:
- В основе лежит Qwen3-VL-4B и трансформер, который с помощью flow-matching предсказывает действия робота в реальном времени
- Модель обучалась в пять этапов, от мультимодальных веб-данных до примеров с реальных роботов
- Унификация робототехнических данных позволяет модели лучше обобщаться и работать на разных роботах
Благодаря такому подходу, модель получает лучшие метрики на робототехнических бенчмарках Fractal и Bridge.
🔘Состав релиза:
- исходный код для обучения и инференса на GitHub;
- предобученные веса на платформе Hugging Face;
🔜 Релиз может быть важен для всех, кто занимается робототехникой. Базовую модель можно быстро дообучить под конкретного робота и использовать ее для решения реальных задач, например на производствах или складах.
@ai_machinelearning_big_data
#ai#ml#sber
Polymathic - междисциплинарный ИИ
Ох, какая классная межуниверситетская инициатива - Polymathic🔥.
Задача, которую они решают, заключается в создании ИИ моделей, которые используют информацию из наборов данных различных модальностей и разных научных областей, которые не имеют общего представления (например, текста). Такие модели могут использоваться в качестве надежных базовых показателей или можно сделать файн-тьюнинг для конкретных приложений. Такой подход может демократизировать ИИ в науке, предоставляя более сильные априорные модели для общих концепций, таких как причинность, измерение, обработка сигналов, и т.п.
В общем история с базовыми и генеративными моделями понемногу адаптируется к научным задачам, за что мы топим тоже 🤘. Реальных проектов пока немного, но есть, например, Multiple Physics Pretraining - подход к разработке больших предобученных физических суррогатных моделей или AstroClip - видимо модель CLIP для астрофизиков.
На данный момент кроме команды ученых есть и крутой консультативный совет, например, с Яном Лекуном (Yann LeCun) из Meta AI.
#AI#ML
#AI
Немного ИИ-теории
❗️В недавнем иске против компании OpenAI Илон Маск утверждал, что GPT-4 является ранним AGI, по сути равным человеческому интеллекту.
Что же такое AGI и когда он появится?
👤Сэм Альтман, CEO Open AI определяет AGI (artificial general intelligence) как интеллект, равный уровню обычного человека, который можно было бы принять в команду как сотрудника. Также популярно определение AGI как «системы, способной выполнить любую когнитивную задачу, доступную человеку».
📎Для справки: существует несколько видов (уровней развития) ИИ, а именно узкий ИИ (narrow, ANI), общий ИИ (genreal, AGI) и супер ИИ (super AI, ASI).
⏲Исследователи никак не могут прийти к консенсусу относительно даты появления AGI. По результатам Expert Survey on Progress in AI, существует 50% шанс того, что AGI появится до 2059 года. Тем не менее, поле ИИ изменяется постоянно и становится сложным оставаться в курсе событий.
⭐️Для этого мы нашли крупнейшее русскоязычное AGI-сообщество agirussia.org — у них есть канал и группа в Telegram.
🌐еще проходят еженедельные онлайн-семинары по тематике AGI на русском языке, записи семинаров за последние несколько лет доступны на YouTube и их сообществе в ВК.
Держим руку на пульсе ИИ⭐
⭐️Автор, Анна, @qcuqueen
Хакатончик от Xeek
Two Birds, One Neural Network - так называется новый хакатон от Xeek в области Generative AI. Звучит как-будто нужно сделать свой Dalle-E2, но на самом деле, задача выглядит немного иначе. По условиям хакатона, участникам нужно сделать нейронную сеть, которая максимизирует разнообразие генерируемых результатов, отвечающих двум условиям. Авторы хакатона проводят параллели с добавлением двух геофизических измерений для ограничения сценариев геологических моделей. Буквально, нужно построить нейронную сеть, которая генерирует разнообразные значения x0, x1, сохраняя при этом их природу в виде нисходящих или восходящих прямых линий, удовлетворяющих заданным функциям y1, y2, как показано на картинке.
Более подробное описание - тут. Призовой фонд $40К (первое место $19.5K).
#hackathon#AI#ML
🚀 Сбер представил новое поколение ГигаЧата
Вчера, 24 марта, вышло масштабное обновление ИИ-помощника Сбера. Главные изменения:
🧠Долгосрочная память — модель запоминает ваши интересы, профессию и предпочтения между диалогами (включить/отключить можно в настройках).
⚡️Скорость выросла в 2 раза — благодаря архитектуре Mixture of Experts (MoE) ответы приходят почти мгновенно.
💬Голосовой режим с поиском — теперь можно прерывать модель, уточнять детали, а она автоматически ищет актуальные данные.
🛠Код-интерпретатор — ГигаЧат пишет, запускает код и строит графики прямо в интерфейсе.
📦Open Source — Сбер выложил веса модели в открытый доступ, что позволит компаниям развернуть её в своём контуре.
Попробовать новую версию можно бесплатно в веб-версии Гигачат. Для доступа к голосовому режиму и памяти просто авторизуйтесь через Сбер ID.
#sber#gigachat#moe#voice#gigacode
https://t.me/semasci
❤️Интервью Павла Дурова на русском в 4k@durov
🎞 Ссылка на Youtube
Решил поиграться с нашим #AI и перевести видео с липсинком полностью через бот @plasma_gpt_ai_bot На русский в разы сложнее переводить, чем на английский.
Смотрите, что получилось)
👌 Новый #AI технологии на страже HR/HH. Если вы руководите компанией, то внедрение таких ботов в ваши бизнес процессы управления кадрами сильно сэкономит бюджет и повысит x10 качество кандидатов! Можно собрать сегодня даже no-code / no-budget решение самому!
Eсли вам все уже нужен быстрый и качественный подбор сложных IT кадров, или вы сами ищите работу, то рекомендую моего топового рекрутера @mikevolkov
Также я постоянно расширяю наш штат senior solidity / react / python разработчиков. Так что шлите мне @ilia_0x ваше резюме если готовы работать на интересных проектах в международных стартапах!)