TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #9 · 27.03

Умные колонки, пожалуй, самые недооценённые из устройств нашего времени. В том смысле, что, не имея личного опыта использования, многие люди считают их чем-то совершенно бесполезным и не видят способа применения в своей жизни. Но, получив этот опыт, зачастую остаются очень довольны, а иногда и не понимают, как жили без них. У меня далеко не один знакомый, прошедший по этому пути: кому-то колонку подарили, у кого-то купил другой член семьи, а кого-то даже уговорил на покупку ваш покорный слуга. Во всех без исключения случаях колонка (в отличие, например, от 3D принтера и тем более от VR очков) не пылится где-то на антресолях, а вполне себе используется с завидной регулярностью. Казалось бы, вот вам и ответ на вопрос в заголовке: нужна. Но не всё так просто. Я тоже не случайным образом выбирал, кого именно пытаться уговорить. Давайте разберёмся, когда и зачем есть толк в умной колонке, а попутно посмотрим на новую Яндекс Станцию Макс, которая приехала ко мне. #gadgets#tech https://teletype.in/@clockstackwheels/station-max

Резултати

Намерени 1 подобни публикации

Търсене: #documentai

当前筛选 #documentai清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #9070 · 25.11.2025 г., 12:11

⚡️ HunyuanOCR: открытая OCR-модель, которая рвёт бенчмарки при размере всего 1B Tencent выложила в open-source новую модель HunyuanOCR. Это компактная, быстрая и полностью готовая end-to-end система для OCR, построенная на мультимодальной архитектуре Hunyuan. Главное - при размере только 1 миллиард параметров она показывает результаты уровня крупных моделей и стоит в разы дешевле в запуске. ⚡ Топ по бенчмаркам • 860 на OCRBench среди всех моделей до 3B • 94.1 на OmniDocBench - лучший результат в задачах распознованяисложных документов 🌐 Что умеет HunyuanOCR Модель закрывает практически все типы OCR задач • текст на улицах, витринах, табличках • рукописный текст и художественные шрифты • сложные документы: таблицы, формулы, встроенный HTML и LaTeX • субтитры в видео • перевод текста на фото end-to-end сразу на 14 языков Это не каскадный пайплайн, а единое решение Один запрос и одно инференс-прогон дают готовый результат. Это быстрее, надёжнее и удобнее, чем традиционные OCR-цепочки. 📌 Project Page web: https://hunyuan.tencent.com/vision/zh?tabIndex=0 mobile: https://hunyuan.tencent.com/open_source_mobile?tab=vision&tabIndex=0 🔗GitHub https://github.com/Tencent-Hunyuan/HunyuanOCR 🤗 Hugging Face https://huggingface.co/tencent/HunyuanOCR 📄 Technical Report https://github.com/Tencent-Hunyuan/HunyuanOCR/blob/main/HunyuanOCR_Technical_Report.pdf @ai_machinelearning_big_data #HunyuanOCR#TencentAI#OCR#VisionAI#DeepLearning#Multimodal#AIModels#OpenSourceAI#ComputerVision#DocumentAI