TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #545 · 6.09

Помню что обещал видео, но очень устал сегодня. Давайте чуть отвлечемся. Вот новость: выпускают настольную игру, изображения для которой создавала нейросеть Midjourney. Я раньше сказал, что применений у этих сетей не так много, точно не "полностью заменить художников". Но если кто-то когда-то играл в Dixit или Имаджинариум, то может помнить, какие там странные картинки, составленные из будто бы не слишком подходящих друг к другу элементов. Так что в целом использование генерации для настолки или видеоигры было очевидным. Я удивлён лишь, что так быстро. Но во всех случаях под такую графику нужна определенная игровая механика. Нельзя проиллюстрировать любую игру нейросеткой: будет плохо. Так что тоже пространство ограничено. Не знаю, как будет играться "Я не человек". Кажется, что механика очень простенькая и похожа на Spyfall (которую я очень не люблю). Было бы прикольно, если бы появилась настолка с необычным и глубоким игровым процессом, работающим чисто за счёт того, что изображения получены генерацией. #games

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #documentai

当前筛选 #documentai清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #9070 · 25.11.2025 г., 12:11

⚡️ HunyuanOCR: открытая OCR-модель, которая рвёт бенчмарки при размере всего 1B Tencent выложила в open-source новую модель HunyuanOCR. Это компактная, быстрая и полностью готовая end-to-end система для OCR, построенная на мультимодальной архитектуре Hunyuan. Главное - при размере только 1 миллиард параметров она показывает результаты уровня крупных моделей и стоит в разы дешевле в запуске. ⚡ Топ по бенчмаркам • 860 на OCRBench среди всех моделей до 3B • 94.1 на OmniDocBench - лучший результат в задачах распознованяисложных документов 🌐 Что умеет HunyuanOCR Модель закрывает практически все типы OCR задач • текст на улицах, витринах, табличках • рукописный текст и художественные шрифты • сложные документы: таблицы, формулы, встроенный HTML и LaTeX • субтитры в видео • перевод текста на фото end-to-end сразу на 14 языков Это не каскадный пайплайн, а единое решение Один запрос и одно инференс-прогон дают готовый результат. Это быстрее, надёжнее и удобнее, чем традиционные OCR-цепочки. 📌 Project Page web: https://hunyuan.tencent.com/vision/zh?tabIndex=0 mobile: https://hunyuan.tencent.com/open_source_mobile?tab=vision&tabIndex=0 🔗GitHub https://github.com/Tencent-Hunyuan/HunyuanOCR 🤗 Hugging Face https://huggingface.co/tencent/HunyuanOCR 📄 Technical Report https://github.com/Tencent-Hunyuan/HunyuanOCR/blob/main/HunyuanOCR_Technical_Report.pdf @ai_machinelearning_big_data #HunyuanOCR#TencentAI#OCR#VisionAI#DeepLearning#Multimodal#AIModels#OpenSourceAI#ComputerVision#DocumentAI