TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #623 · 2.11

Тут уже несколько дней народ играется с генерацией музыки по текстовому описанию. Идея такая же, как с картинками: ты пишешь фразу, тебе нейросетка по ней создаёт трек. На деле реализовано чуть более топорно: текстовый препроцессор разбирает фразу и ищет контекстную близость до слов из специального списка тегов. Ну, например, он считает слово "weed" (трава, конопля) близким к жанру "reggie", вот и подставляет. Эти теги передаются в облачный API сервиса Mubert (да, никакого опенсорса на этот раз), и оно выдаёт трек. Я попробовал тоже. По примерам из статей я уже было подумал, что окончательно решена проблема "не подобрать трек для нового видео". Но увы. Результат на деле (а не в рекламе) такой же не впечатляющий, как и с картинками. Эта штука сносно генерирует всякие эмбиенты и другие спокойные треки, но на более сложных жанрах сразу загибается и очень сильно недокручивает и темп, и агрессию и разнообразие музыкальных фраз. Я после часа попыток не смог сделать ничего для быстрого интенсивного полёта дрона, только для плавного и медленного. Ну и очень часто неправильно улавливает контекст, даже даже открыто писать, что примерно ты от неё хочешь (вот как с треком Помпеи — вообще мимо, слишком спокойная и не грустная мелодия). Первые два трека сгенерировал @wooferclaw. Он не хейтер ML, в отличие от меня, поэтому у него больше терпения и, вероятно, он смог дольше перебирать варианты. Но всё равно на мой взгляд какой-то намёк на правильную идею есть, а развития совсем нет. Музыканты, можете выдохнуть. #dev

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #sbc

当前筛选 #sbc清除筛选

#WantThis#SBC#RaspberryPi https://www.youtube.com/watch?v=huAKEbyPcBc https://forum.radxa.com/t/introduce-the-radxa-zero/6550 有点厉害 性能吊打树莓派ZeroW 可惜视频只走MicroHDMI CPU: AmLogic S905Y2 (4核心 Cortex-A53 1.8 GHz, 12nm制程) GPU: Mali G31 MP2 RAM: LPDDR4 512MB/1GB/2GB/4GB 存储: 板载eMMC 5.1 8/16/32/64/128GB + MicroSD扩展 HDMI: Micro HDMI, HDMI 2.1, 4K@60 HDR 硬件解码: H265/VP9 decode 4Kx2K@60 无线: WiFi4/BT4 或 WiFi5/BT5 USB: 1x USB 2.0 Type C OTG (数据+供电), 1x USB 3.0 Type C host GPIO: 40Pin GPIO, ADC/UART/SPI/PWM 其他: Crypto Engine, 支持外置天线, 一个硬件按钮 系统: 目前有 Android 9, TwisterOS (基于Armbian的Ubuntu 20.04分支), Manjaro, EmuELEC