TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #271 · 26.03

Два года назад я писал, что поучаствовал в грантовой системе от Фонда Содействия Инновациям и получил 500к рублей на разработку нескольких NLP-алгоритмов для русского языка. Кратко: если у вас есть проект, который по каким-то признакам является научно-исследовательской работой, вы можете получить на него чуть-чуть денег просто так, в обмен на нужные бумажки. Схема рабочая и без обмана, но дьявол в деталях, сейчас расскажу. Вчера я закрыл всю отчётность, окончательно выполнив свои обязательства. Деньги получил гораздо раньше, и уже давно все потратил. В комментариях мне тогда говорили, что государственный фонд может бесконечно долго давить непонятной бюрократией, и потом трижды пожалеешь, что взял деньги. Это и верно, и нет. Скажем так: у меня были отдельные моменты, когда я задумывался, что лучше бы не стал в это вписываться. Но ретроспективно думаю вот что: в тот момент деньги были нужны, и, пожалуй, на этот риск идти стоило. А если вы начинающий специалист или вовсе студент, то вдвойне оправдано. В целом претензии у меня три: 1. Реальный результат работы никого не интересует. Отчётность важнее, чем то, делали ли вы проект, и есть ли у вас какое-то достижение. Я алгоритмы написал, как обещал, но, судя по всему, никто не смотрел ни код, ни репозитории, ни готовые проекты на базе этих алгоритмов. Абсолютно все замечания были по оформлению. Я должен был сдать последний этап 23 января, я сдал собственно саму работу, и вот всё это время до конца марта я закрывал документы. Настоящая значимость этих документов в десятки раз ниже, чем значимость проекта, но для завершения процесса нужны именно отчёты, а то, что вовремя проделана огромная работа и получен реальный результат, никого особо не волновало. Думаю, если бы я не писал алгоритмы, а составил только отчёт, это прокатило бы. 2. Отчётов нужна тьма, все они до боли бюрократичны и канцеляричны. Формы заполнения стандартизированы, и это полнейший ад. Дело даже не в объёме информации, хотя это тоже беда. Просто часть полей не подходят для конкретных случаев (например, нужно указать материал, из которого сделан продукт, а у меня компьютерная программа), а другая часть полей — бессмысленная абстракция, которая непонятно каким образом родилась в голове составителей. Что-то вроде: "Аргументируйте выбор способа решения задачи", "Аргументируйте выбор пути решения задачи", "Аргументируйте выбор метода решения задачи" — это три разных поля, и заполнять их нужно разными данными! 3. И самая жуть — по необъяснимой причине ваша научная работа на бумаге должна трансформироваться в приносящий деньги бизнес. По завершении работы вы должны пройти аккредитованный "преакселератор" и составить "бизнес-модель". Это шаблонный многостраничный документ, который вы заполняете заумно звучащей водой про анализ "рынка" и "конкурентные преимущества" по совершенно вымышленному продукту, который никогда не будет существовать, потому что в настоящем мире ни научные исследования, ни бизнес не работают таким чудовищно наивным и поверхностным образом. Отдельная часть этого документа — эксель таблица с частично заблокированными ячейками, куда вам нужно вбить цифры из воздуха так, чтобы показать "окупаемость". Никого особо не волнует, что для "окупаемости" нужно платить программисту 25 тысяч в месяц, а в первый день выпуска продукта продать его сразу тысячами единиц. В общем, отчёты описывают несуществующий мир, рождённый фантазией людей, которые некомпетентны ни в науке, ни в бизнесе, но умеют и любят причинять боль бумагой и ручкой. Sticks and stones. Однако, если принять эти странные правила игры и согласиться прорываться через заросли, то вы получите деньги и мотивацию закончить какой-нибудь собственный проект. С помощью этого гранта я добил кучу кода, который и так собирался сделать, получил три успешные статьи на Хабре и попадание в Программу Поощрения Авторов, а также реализовал несколько платных заказов в том числе на основе сделанных наработок. Кстати, факт существования реальных продаж не играл абсолютно никакой роли при составлении доказательства, что моя разработка может приносить деньги :) #dev

Hashtags

Резултати

Намерени 3 подобни публикации

Търсене: #hdfs

当前筛选 #hdfs清除筛选
Data Science Jobs

@datasciencejobs · Post #2288 · 29.08.2024 г., 18:33

#job#работа#vacancy#вакансия#Data engineer #DataScience#HDFS#PySpark #Python#удаленно Вакансия: Data engineer Формат: Удаленно Занятость: полная, 5/2 (гибкое начало дня) З/П: до 300 000 руб. 🔶Эта вакансия - отличная возможность для инженера данных стать часть вдохновленной команды и принять участие в развитии платформы машинного обучения дочерней компании 🔶 Ключевая задача: развитие платформы машинного обучения 🔶Основные обязанности •Разрабатывать отчетность с использованием скриптов на PySpark •Генерировать новые признаки для ML-моделей •Автоматизировать процессы для бизнеса 🔶Обязательные требования: •Опыт работы с большими данными: HDFS, PySpark от 1 года •Опыт работы с Python, в том числе с Pandas, NumPy Преимуществом при отборе будет •Опыт работы с геоданными, git 🔶 Что мы можем предложить взамен •Место работы: удаленно по РФ •Трудоустройство по ТК РФ в аккредитованное юр. лицо •Официальное трудоустройство •Размер заработной платы обсуждается после собеседования •Годовое премирование •ДМС со стоматологией •Компенсация мобильной связи •Возможности для развития 📲Контакт: @Oskar17

Data Science Jobs

@datasciencejobs · Post #2934 · 20.09.2025 г., 07:03

#вакансия#datascientist#llm#nlp#HDFS#Kafka#Spark#удалёнка Ищем Senior Data Scientist в команду Поиск 3.0. Сейчас направление фокусируется на развитии Циан-помощника (наш LLM агент), делая его умнее и полезнее для всех пользователей и развитии текстового поиска, внедряя в него современные NLP и мультимодальные механики. Полная удалёнка внутри РФ. Если есть желание ходить в офис, у нас есть замечательные современные офисы в Москве, Питере и Новосибе. Вилка - от 350 до 500, готовы обсуждать. О нас: В Циан большая команда ML. В команде настроены процессы перфоманс ревью, регулярного обмена опытом, выделяем время на исследовательскую работу! Сейчас направление фокусируется на развитии текстового поиска, чтобы пользователи находили идеальные варианты быстрее, и Циан-помощнике, делая его умнее и полезнее. Задачи: * NLP задачи как в виде обучения моделей, так и в виде разработки вспомогательных сущностей на python * Внедрение мультимодального подхода к поиску * Развитие интеллектуального помощника по поиску недвижимости: обучение собственных llm моделей на базе opensource, исследование готовых решений от openAI/Yandex и других. * Разработка и внедрение в продакшн моделей машинного обучения для улучшения пользовательского опыта Требования: * Опыт: Не менее 3х лет релевантного опыта на позиции DS в продуктовой компании * Python: пишет легко читаемый и поддерживаемый код * SQL (оконные функции, оптимизация запросов) * Опыт в DL: обучение/дообучение собственных глубоких нейросетей * Опыт разработки NLP моделей: от tfidf до llm * Классический ML: бустинги, линейные модели. Будет плюсом: * Apache стек: HDFS/Kafka/Spark (DF API) * Опыт работы с CV и мультимодальными моделями Бонусы: ДМС с первого дня (стоматология, госпитализация, полис ВЗР), Кафетерий льгот, 5 day off в год, помимо основного отпуска. Контакты: По всем вопросам и с резюме пишите @mistakef Не забудьте указать, что вы из datasciencejobs

GitHub Trends

@githubtrending · Post #15246 · 24.10.2025 г., 13:30

#go#blob_storage#cloud_drive#distributed_file_system#distributed_storage#distributed_systems#erasure_coding#fuse#hadoop_hdfs#hdfs#kubernetes#object_storage#posix#replication#s3#s3_storage#seaweedfs#tiered_file_system SeaweedFS is a fast, simple, and highly scalable distributed file system designed to store billions of files and serve them quickly, especially small files. It uses a master server to manage volumes on volume servers, which handle file data and metadata, enabling very fast file access with minimal disk reads. It supports features like replication, erasure coding, cloud integration for elastic storage, and compatibility with many metadata stores and APIs including Amazon S3. This means you get efficient, cost-effective storage with fast access, easy scaling, and flexible deployment options for large-scale file storage needs. https://github.com/seaweedfs/seaweedfs