TGTGInsighttelegram intelligenceLIVE / telegram public index
← GitHub Trends

TGINSIGHT SIMILAR POSTS

Find similar content

Source channel @githubtrending · Post #15421 · Jan 18

#python#audio#deeplearning#minicpm#python#pytorch#speech#speech_synthesis#text_to_speech#tts#tts_model#voice_cloning VoxCPM is a free, open-source TTS tool that turns text into realistic speech without tokens, creating expressive audio that matches context and clones voices perfectly from just 3-10 seconds of sample. Download VoxCPM1.5 (800M params) from Hugging Face, install via pip, and use simple Python or CLI commands for fast synthesis (RTF 0.15 on RTX 4090) or fine-tuning your own voices. You benefit by easily making natural audiobooks, podcasts, clones, or apps with pro-quality sound—saving time and costs on voice work. https://github.com/OpenBMB/VoxCPM

Results

1 similar post found

Search: #toolki

当前筛选 #toolki清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #8567 · 09/17/2025, 10:10 AM

⚡️Qwen-ASR Toolkit — мощный Python CLI для быстрой транскрипции длинных аудио и видео Эта утилита снимает ограничение API Qwen-ASR (бывший Qwen3-ASR-Flash) в 3 минуты и позволяет расшифровывать часы контента. Достигается это за счёт умного разбиения записи и параллельной обработки. Основные возможности: - Снятие лимита в 3 минуты - транскрибируй файлы любой длины - Умное разбиение (VAD - это технология, которая определяет, где в аудио есть речь, а где — пауза или шум.) - деление по естественным паузам, без - Высокая скорость - многопоточность и параллельные запросы к API - Автоматический ресемплинг — конвертация в нужный формат 16kHz mono - Поддержка любых форматов — MP4, MOV, MKV, MP3, WAV, M4A и др. - Простота - запуск одной командой через CLI 🟢Установка: pip install qwen3-asr-toolkit 🔗 GitHub: https://github.com/QwenLM/Qwen3-ASR-Toolkit @ai_machinelearning_big_data #asr#speech2text#qwen#opensource#nlp#toolki