@libreware · Post #1085 · 04.05.2022 г., 09:32
Wenet Automatic #Speech#Recognition toolkit. https://github.com/wenet-e2e/wenet https://wenet.org.cn/wenet/
Hashtags
TGINSIGHT SIMILAR POSTS
Изходен канал @clockstackwheels · Post #388 · 20.06
Telegram вчера запустил подписку Premium только на iOS. Это, кстати, очень любопытно: Павел Дуров вот уже несколько лет ведёт систематическую критику компании Apple, и совсем недавно высказался очередной раз. По его словам, умышленные ограничения устройств Apple и отставание от веб-стандартов создают наиболее значительное в наши дни препятствие для развития мобильного веба. А самой компании это нужно, чтобы привязывать разработчиков к магазину приложений и диктовать свои условия + брать процент от выручки. Это, конечно, совершенно верное замечание. Об индуцированном отставании мобильного веба у Apple я писал вот тут. Но вот Telegram выпускает важнейшее мажорное обновление только на айфонах. Понятно, что на Android тоже подтянут, я просто обращаю внимание на то, что лучше бы не словом, а делом. Подписку из России на айфонах, вроде как, люди могут купить, используя костыль с пополнением через мобильного оператора. На андроидах такого костыля нет, так что, скорее всего, Premium на андроиде будет для россиян недоступен (UPD в комментариях написали, что есть другой способ оплаты). Лично для меня из ценного там только десять закрепов и папка по-умолчанию, но это, кажется, не стоит ни возни с попытками оплатить, ни 449 рублей в месяц, которые за такую подписку просят. Тем не менее, идейно это правильная монетизация, в отличие от рекламы в том виде и на тех условиях, на которых она появилась. Поразмышлял о том, за какие функции в Telegram я бы всё-таки стал платить, и понял, что таких особо нет. Да, больше всего хотелось бы адекватное оформление каналов: текст во всю ширину экрана, возможность крепить картинки с хорошим UI, а не как сейчас. Вообще это, на мой личный взгляд, одна из самых серьёзных недоработок Телеграма, вызванная, как я понимаю, изначально "сообщенческой" природой каналов: канал это как бы чат с одним пишущим участником, со всеми вытекающими. Но было бы очень глупо делать такое обновление для небольшой доли донаторов, а все бесплатные каналы оставлять со старым ужасным внешним видом. Все остальные проблемы Телеграма тоже не выглядят, как опции для премиум-функций. За деньги добавляется дискавери, а без них нет? Ну тогда проще рекламную платформу в нормальный вид привести. Или, скажем, за деньги не так шакалятся фотографии? Но ведь возможность отправлять фото без сжатия уже есть бесплатно, просто это менее красиво и менее удобно. Не слишком правильно продавать за деньги понижение уровня неудобства, как я уже рассказывал. Впрочем, папка по-умолчанию это вот тоже оно самое: такая опция должна была быть изначально при появлении функциональности папок, потому что, если человек в принципе пользуется систематизацией, значит, ему внезапно нужна систематизация, и оставлять главный экран беспорядочным в таком случае неправильно, это полностью отключает смысл папок (мне вот они нужны, но по факту я ими не пользуюсь). И за деньги, как бы сказать, "включили" обратно эти папки, чтобы ими можно было пользоваться. По сути это нормально, как платная опция, но ведь по заявлениям компании папки бесплатны, а то, что пользоваться ими неудобно, это уже детали. Ну, посмотрим. Платные пользователи светятся у всех, хочу понаблюдать, купит ли хоть кто-нибудь из моих друзей подписку. #web
Hashtags
Търсене: #recognition
@libreware · Post #1085 · 04.05.2022 г., 09:32
Wenet Automatic #Speech#Recognition toolkit. https://github.com/wenet-e2e/wenet https://wenet.org.cn/wenet/
Hashtags
@libreware · Post #1084 · 04.05.2022 г., 09:32
Vosk Speech Recognition Toolkit Vosk is an offline open source #speech#recognition toolkit. It enables speech recognition for 20+ languages and dialects - English, Indian English, German, French, Spanish, Portuguese, Chinese, Russian, Turkish, Vietnamese, Italian, Dutch, Catalan, Arabic, Greek, Farsi, Filipino, Ukrainian, Kazakh, Swedish, Japanese, Esperanto, Hindi, Czech. More to come. Vosk models are small (50 Mb) but provide continuous large vocabulary transcription, zero-latency response with streaming API, reconfigurable vocabulary and speaker identification. Speech recognition bindings implemented for various programming languages like Python, Java, Node.JS, C#, C++ and others. Vosk supplies speech recognition for chatbots, smart home appliances, virtual assistants. It can also create subtitles for movies, transcription for lectures and interviews. Vosk scales from small devices like Raspberry Pi or Android smartphone to big clusters. https://t.me/speech_recognition https://alphacephei.com/vosk https://github.com/alphacep/vosk-api
Hashtags
@libreware · Post #1021 · 09.01.2022 г., 14:56
SongRec An open-source Shazam client for Linux, written in Rust. Features: • Recognize audio from an audio file. • Recognize audio from the microphone. • Usage from both GUI and command line. • Provide an history of the recognized songs. • Continuous song detection. • Ability to recognize songs from your speakers rather than your microphone. Download: https://github.com/marin-m/SongRec#installation https://github.com/marin-m/SongRec @foss_desktop #music#shazam#recognition
Hashtags
@libreware · Post #1192 · 06.10.2023 г., 11:18
#Linux Desktop application that provides live #captioning FUTO Fellowship program interview; linux captions software 👉 Live Captions github: https://github.com/abb128/LiveCaptions 🔵 Q&A w/ billionaire alt-tech investor/philanthropist Eron Wolf https://www.youtube.com/watch?v=OJPmbcU-Vzo 🔵 FUTO Fellows program: https://futo.org/fellows/ 🔵 FUTO Youtube channel - @futotech ⚠️ Google's breaches of privacy have gone TOO FAR! https://www.youtube.com/watch?v=_vWAF13KigI #speech#recognition#stt#voice
@djangoproject · Post #448 · 18.09.2017 г., 11:30
https://medium.com/@GalarnykMichael/logistic-regression-using-python-sklearn-numpy-mnist-handwriting-recognition-matplotlib-a6b31e2b166a Logistic Regression using Python (#Sklearn, #NumPy, #MNIST, Handwriting #Recognition, #Matplotlib) #machine_learning.
@libreware · Post #1114 · 09.03.2023 г., 22:58
https://writeout.ai #Transcribe and #translate any #audio file. 100% free to use. This website with source code available (it can be hosted locally) allows you to upload any audio file and receive a transcription and/or text translation. It uses OpenAI's Whisper API on the back end. Source on GitHub: https://github.com/beyondcode/writeout.ai #writeout#ai#speech#recognition