TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #596 · 14.10

Свершилось. Сегодня Экосистема городских сервисов совместно с VK Mini Apps подвели итоги конкурса, в котором я участвовал, и писал вам об этом. Мой музейный кликер оценили не только вы в комментариях, но и члены жюри: я занял первое место во втором этапе (по правилам можно занять призовое место только в одном, даже если подавался в два). Очень рад :) Люблю наш город, люблю конкурсы по программированию, ну и, разумеется, люблю выигрывать, чего греха таить :) Работы интересные, список всех победителей можно посмотреть вот тут. До шорт-листа дошли всего 42 проекта, так что на самом деле при внимательном и аккуратном отношении шансы попасть в список из 20 призёров были хорошие. Участвуйте в конкурсах тоже. Это полезно для прокачки скилла, даже если вы не получите приз. Но если получите — ещё и приятно :) P.S. Постоял рядом с CEO VK, думал попросить включить мне новый дизайн, но постеснялся. #dev

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #diarization

当前筛选 #diarization清除筛选

🗣 VibeVoice ASR ● Распознавание речи и диаризация ● RU ● Portable by Nerual Dreming Ссылка на оригинальный GitHub:https://github.com/microsoft/VibeVoice Ссылка на репозиторий репакера:https://github.com/timoncool/VibeVoice_ASR_portable_ru Репакер:#nerual_dreming Дата обновления: 3 февраля 2026 Категории:#stt, #ASR, #diarization, #AIaudio Платформа:#Windows Язык: RU Системные требования: NVIDIA GPU с поддержкой CUDA от 8 ГБ VRAM для полной версии, меньше для квантованной Совместимость:#Nvidia 🖥Описание софта VibeVoice ASR — новейшая модель от Microsoft для транскрибации, диаризации (разделения по спикерам) и простановки таймкодов за один проход. Главная фишка — обработка до 60 минут аудио целиком, без нарезки на куски, что позволяет модели «понимать» контекст всей беседы. Особенности портативной версии: В сборку включены две модели: полная (оригинал) и квантованная (от scerz). Реализована поддержка эмуляции 4-bit квантизации для полной модели — это позволяет запускать тяжелую оригинальную версию даже на картах с небольшим объемом памяти без потери качества. Также добавлена нативная поддержка видеофайлов и парсер текста с выбором спикеров для показа. 😬Основные возможности VibeVoice ASR: 🟣Две модели на борту: Выбор между оригинальной Full версией и оптимизированной Quantized (scerz). 🟣Эмуляция квантизации: Уникальная фича сборки — возможность запуска полной модели в режиме 4-bit (bitsandbytes) для экономии VRAM. 🟣Всеядность: Поддержка не только аудио, но и видео (MP4, MKV, AVI, MOV) — звук извлекается автоматически через FFmpeg. 🟣Умная диаризация: Точное определение «Кто, Когда и Что сказал» (Who, When, What). 🟣Длинный контекст: Обработка часовых записей без потери смысла и путаницы в спикерах. 🟣Удобство: Веб-интерфейс на русском языке 🟣Парсер текста: позволяет скрыть или показать временные метки, спикеров, дескрипторы 💿Установка и запуск ⁍ Скачайте архив с установщиком или окружением. ⁍ Распакуйте в папку без кириллицы в пути. ⁍ Запустите install.bat для установки библиотек (для установщика). ⁍ Запустите run.bat для старта веб-интерфейса. ⁍ Модели скачаются при первом запуске ➡️Скачать VibeVoice ASR Portable installer— установщик, сам все скачает ➡️Скачать VibeVoice ASR Portable env — готовое окружение для RTX 4090 и win11 💬Обсудить в нашем чате 👾НЕЙРО-СОФТ - делаем нейросети доступнее