Намери подобно съдържание

Изходен канал @clockstackwheels · Post #367 · 30.05

Поговорим про ML. Пару дней назад вышла новость о том, что в продажу поступила первая русскоязычная книга, половину текста в которой написала нейросеть ruGPT-3. А до этого вы все наверняка натыкались на очень яркие записи про Dalle и Imagen, где нейросеть по описанию рисует картинку, и получается очень любопытно. Такими темпами скоро нейросети превратятся в крипту: высокотехнологичную вещь, о которой, однако, в среде приличных технарей лучше не упоминать. Потому что то, каким образом это используется, и то, какой образ этому создают в массах, расходится не только с реальностью, но и с определённым уровнем вменяемости. Кстати, ML ещё и может ярко демонстрировать эффект Даннинга-Крюгера. Мем про "Ты чё, пёс, я математик!" нифига не шутка. Человек может считать себя крутым программистом, если научился комбинировать чужие библиотеки на питоне. Хотя на самом деле простейшую практическую задачу решить не способен -- я с такими сталкивался лично. ML-щики вообще пихают свои нейросети куда ни попадя, считая, что это волшебная таблетка и швейцарский нож для любых ситуаций. Мне рассказывали случай, когда на хакатоне по работе с данными выиграл человек, который просто аккуратно вручную подобрал нужные зависимости в Excel :) Глобально же нейросетями пытаются решать три вида задач: 1. Информации в вопросе много, а в ответе нужно мало. Например, распознавание образов и символов. Подбор значений каких-нибудь коэффициентов. Приложение "Хотдог или не хотдог" из сериала Кремниевая Долина. Обычно нейросети справляются с таким очень хорошо. Рукописный ввод распознают шикарно, по фото могут назвать породу собаки, математические формулы читают. Но важно понимать, что под капотом даже у такой нейросети не возникает никаких понятных вам символов. Например, при распознавании рукописного ввода случайный набор пикселей, не имеющий для человека смысла, может быть с той же степенью уверенности интерпретирован нейросетью, как совершенно чёткая буква А. Просто мы на такой случайный набор не попадаем почти всегда, и поэтому всё ок. 2. Информации в вопросе средне, и в ответе нужно средне. Как правило, это предсказание, восстановление недостающих данных, улучшение качества фото, раскрашивание ч/б. С такими задачами нейросети справляются уже средненько. Улучшенный нейросетью снимок сразу видно. Предсказание лишь ненамного точнее, чем случайный выбор. Польза в том, что в обращении такие сети просты, а результат всё-таки дают. Но не стоит их переоценивать. Например, сюда можно отнести задачу суммаризации текста (по большому объёму текстов тебе печатают выжимку). Мои товарищи в одном чате несколько дней игрались с ботом-суммаризатором, и в основном половина написанных им фраз это просто мусор и ерунда для ржача. Но в другой половине всё-таки какой-то совсем небольшой смысл проглядывался. Недостаточный для того, чтобы задалбывать этим ботом участников чата (привет, ребята :) ), но не абсолютный рандом. 3. Информации в вопросе мало, а в ответе нужно много. Это генерация данных: вот как раз написание текстов, составление рисунков, логотипов и так далее. Так вот, по моему скромному, но всё-таки хоть немного компетентному мнению, в таких вопросах нейросети выдают полную херню. И хвалёная логотипная нейросетка Лебедева — тоже полная херня. И распиаренная GPT ничего толкового не пишет. Когда читаешь примеры в новостях-анонсах, сразу думаешь: "Вау, как круто!". Но когда пробуешь сам: ruGPT-3 по уровню осмысленности где-то чуть ниже "Яндекс.Рефератов", если помните такой сервис и суть его работы. Я не знаю, будут ли сети по созданию изображений работать так круто (сейчас доступа к ним ни у кого нет), но книга в соавторстве с человеком стала возможна только по той причине, что в качестве человека взяли Павла Пепперштейна, который берёт случайные комбинации словосочетаний и выдаёт это за литературу. Поверьте: человечество пока что в безопасности касательно захвата машинами. #dev

Hashtags

#dev

Резултати

Намерени 6 подобни публикации

Търсене: #jax

当前筛选 #jax清除筛选

𝗗𝗜𝗔𝗥𝗜𝗢 𝗗𝗘 𝗟𝗔 𝗠𝗟𝗕 ⚾️🇺🇸

@MLB_Daily · Post #16336 · 10.12.2025 г., 12:41

Намери подобни Прегледай

🇺🇸🧢 Griffin Jax lanzará para el Equipo de EE. UU. en el WBC 2026. #️⃣#TeamUSA#Jax#WBC26 🗞 | t.me/MLB_Daily

Hashtags

#teamusa #jax #wbc26

GitHub Trends

@githubtrending · Post #14835 · 17.06.2025 г., 12:30

Намери подобни Прегледай

#jupyter_notebook#jax Flax is a library for creating neural networks with JAX. It offers a flexible way to build and analyze these networks. The new Flax NNX API makes it easier to work with neural networks by using regular Python objects, which helps in creating, debugging, and analyzing models more efficiently. This means users can express their models in a more intuitive way, making it simpler to develop and modify neural networks. Flax also provides many tools and examples to help users get started quickly. https://github.com/google/flax

Hashtags

#jupyter_notebook #jax

Machinelearning

@ai_machinelearning_big_data · Post #8095 · 17.07.2025 г., 13:01

Намери подобни Прегледай

✔️Stanford и Google представили Marin — первую полностью открытую LLM, разработанную на JAX Что делает Marin особенной: — Полностью открыты не только веса, но показан весь процесс обучения: код, данные, гиперпараметры модели, логи, эксперименты — всё доступно на GitHub — Модель обучена на 12.7 трлн токенов и в 14 из 19 тестов обошла Llama 3.1 8B — Лицензия Apache 2.0, всё можно использовать, модифицировать и воспроизводить — Levanter + JAX обеспечивают bit‑exact повторяемость и масштабируемость на TPU/GPU Проект позиционируется как открытая лаборатория: каждый эксперимент оформляется через pull request, логируется в WandB, обсуждается в issue и фиксируется в истории репозитория. Даже неудачные эксперименты сохраняются ради прозрачности. Выпущены две версии: - Marin‑8B‑Base — сильный base-модель, превосходит Llama 3.1 8B - Marin‑8B‑Instruct — обучена с помощью SFT, обгоняет OLMo 2, немного уступает Llama 3.1 Tulu Это не просто открытые веса, а новый стандарт для научных вычислений в эпоху больших моделей. * JAX — это фреймворк от Google для научных и численных вычислений, особенно популярен в сфере машинного обучения. **TPU (Tensor Processing Unit) — это специализированный чип от Google, созданный для ускорения AI-задач. 🟠Github: https://github.com/stanford-crfm/marin 🟠Блог: https://developers.googleblog.com/en/stanfords-marin-foundation-model-first-fully-open-model-developed-using-jax/ 🟠Гайд: https://docs.jax.dev/en/latest/quickstart.html @ai_machinelearning_big_data #ai#ml#tpu#jax#google

Hashtags

#ai #ml #tpu #jax #google

Data Science Jobs

@datasciencejobs · Post #2872 · 15.08.2025 г., 16:18

Намери подобни Прегледай

#вакансия#ml#rl#python#numpy#pandas#pytorch#jax#mlflow#rllib О НАШЕМ ПРОЕКТЕ Мы работаем над системой управления доходами (RMS). Наши клиенты - российские авиакомпании. Приглашаем в команду Data scientist для разработки и обучения RL-агента для управления доходами авиаперевозчика на уровне рынка. Основной стек: Python, PyTorch/JAX, NumPy/Pandas, MLFlow/Weights & Biases, приветствуются RLlib/Acme/Stable-Baselines. 🧑‍💻Чем предстоит заниматься: 🖊постановка формальной задачи RL: определение пространств состояний/действий/вознаграждения, ограничений и KPI; 🖊разработка и валидация симулятора рыночной среды на основе исторических данных (реакции спроса, сезонность, шоки); 🖊исследование и внедрение алгоритмов RL/IL (value-based, policy-gradient, actor-critic, off-policy/offline RL); 🖊экспериментальный дизайн: off-policy оценка, А/В в симуляторе, подготовка к онлайн-экспериментам; 🖊инструменты качества: стабильность обучения, воспроизводимость, мониторинг метрик (reward, RM KPI, робастность к шокам); 🖊 взаимодействие с продуктом/инженерией: требования, передача моделей в прод, контроль деградаций. 🧑‍💻Что ожидаем: 🖊сильная подготовка в RL/оптимизации/статистике (магистр/кандидат или сопоставимый опыт); 🖊практике в PyTorch/JAX; опыт построения и отладки сложных обручающих циклов; 🖊 желателен опыт causal inference/ контрафактической оценки; 🖊будет плюсом: временные ряды, эконометрика спроса, ценовые эксперименты; 🖊умение формализовать задачу и защитимо сравнивать политики. 🧑‍💻Мы предлагаем: - СТАБИЛЬНОСТЬ: оформление и оклад в соответствии с ТК РФ (гпх, фриланс - невозможны); - БЕЗОПАСНОСТЬ: работа в аккредитованной IT-компании, отсрочка и т.д; - УДАЛЕННУЮ РАБОТУ: график работы 5/2 по МСК в интервале 09-18.00 -/+2 часа (гибкое начало рабочего дня с учетом планирования общих коммуникаций); - РАЗВИТИЕ: современный стек, наставничество в первый месяц работы, карьерный рост; - процессы без бюрократии, политика «открытых дверей» руководства. 📝 Ждём ваши резюме 89287653141, тг @MariP_rnd

Hashtags

#вакансия #ml #rl #python #numpy #pandas #pytorch #jax #mlflow #rllib

GitHub Trends

@githubtrending · Post #14863 · 24.06.2025 г., 13:30

Намери подобни Прегледай

#other#automl#chatgpt#data_analysis#data_science#data_visualization#data_visualizations#deep_learning#gpt#gpt_3#jax#keras#machine_learning#ml#nlp#python#pytorch#scikit_learn#tensorflow#transformer This is a comprehensive, regularly updated list of 920 top open-source Python machine learning libraries, organized into 34 categories like frameworks, data visualization, NLP, image processing, and more. Each project is ranked by quality using GitHub and package manager metrics, helping you find the best tools for your needs. Popular libraries like TensorFlow, PyTorch, scikit-learn, and Hugging Face transformers are included, along with specialized ones for time series, reinforcement learning, and model interpretability. This resource saves you time by guiding you to high-quality, actively maintained libraries for building, optimizing, and deploying machine learning models efficiently. https://github.com/ml-tooling/best-of-ml-python

GitHub Trends

@githubtrending · Post #14988 · 23.07.2025 г., 00:00

Намери подобни Прегледай

#python#deep_learning#diffusion#flax#flux#hacktoberfest#image_generation#image2image#image2video#jax#latent_diffusion_models#pytorch#score_based_generative_modeling#stable_diffusion#stable_diffusion_diffusers#text2image#text2video#video2video The Hugging Face Diffusers library is a powerful and easy-to-use tool for generating images, audio, and 3D molecular structures using advanced diffusion models. It offers ready-to-use pretrained models and flexible components like pipelines, schedulers, and model building blocks, allowing you to quickly create or customize your own diffusion-based projects. Installation is simple via pip or conda, and you can generate high-quality outputs with just a few lines of code. This library benefits you by making cutting-edge AI generation accessible, customizable, and efficient, whether you want to run models or train your own[1][2][5]. https://github.com/huggingface/diffusers

Hashtags