@phygitalcreative · Post #3158 · 06/29/2023, 01:26 PM
Mixed Image Editing Playground AI выкатили редактор изображений с большинством последних достижений в этой области. #image2image#imageediting
Hashtags
TGINSIGHT SIMILAR POSTS
Source channel @githubtrending · Post #15052 · Aug 12
#python#audiobook#audiobooks#content_creation#content_creator#epub_converter#kokoro#kokoro_82m#kokoro_tts#media_generation#narrator#speech_synthesis#subtitles#text_to_audio#text_to_speech#tts#voice_synthesis Abogen is a user-friendly tool that quickly converts ePub, PDF, or text files into natural-sounding audio with synchronized subtitles, perfect for creating audiobooks or voiceovers for social media and other projects. You can customize speech speed, choose or mix voices, generate subtitles by sentence or word, and select various audio and subtitle formats. It supports batch processing with queue mode and lets you save chapters separately or merged. Installation is straightforward on Windows, Mac, and Linux, with options for GPU acceleration. This saves you time and effort in producing high-quality audio content from text files efficiently. https://github.com/denizsafak/abogen
Search: #imageediting
@phygitalcreative · Post #3158 · 06/29/2023, 01:26 PM
Mixed Image Editing Playground AI выкатили редактор изображений с большинством последних достижений в этой области. #image2image#imageediting
Hashtags
@ai_machinelearning_big_data · Post #8240 · 08/09/2025, 02:01 PM
🖼️ GPT-Image-Edit-1.5M — крупнейший и полностью открытый датасет для редактирования изображений по тексту! 🚀 1.5 миллиона триплетов: инструкция + оригинальное изображение + отредактированное по запросу Как мы это сделали? Мы переосмыслили и усилили три известных датасета (OmniEdit, HQ-Edit, UltraEdit) с помощью новой GPT-Image API. 📊 Результаты впечатляют: Модель FluxKontext, дообученная на этом наборе, показывает: ▫️ 7.24 на GEdit-EN ▫️ 3.80 на ImgEdit-Full ▫️ 8.78 на Complex-Edit — на уровне с топовыми проприетарными решениями! 🎯 Инструкции выполняются точно, а изображения выглядят реалистично. Цель — сократить разрыв между open-source и закрытыми системами редактирования. 🔗 Подробнее: 🌐 Проект: https://ucsc-vlaa.github.io/GPT-Image-Edit/ 💻 Код: https://github.com/wyhlovecpp/GPT-Image-Edit 📦 Датасет: https://huggingface.co/datasets/UCSC-VLAA/GPT-Image-Edit-1.5M 🤖 Модель: https://huggingface.co/UCSC-VLAA/gpt-image-edit-training 📄 Статья: https://arxiv.org/abs/2507.21033 @ai_machinelearning_big_data #AI#ImageEditing#OpenSource#GPT4V#Multimodal