TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #676 · 2.12

Не выдержал и заказал один DJI O3 Air Unit, посмотрим :) FPV-квадрокоптер это летающая платформа с камерой. И эти контуры более менее друг от друга изолированы: можно снять всё, что касается видео, и по-прежнему будет летать и нормально управляться, правда, пилот не сможет ничего видеть. То есть там полётный контроллер со своим радиоприёмником, отдельно радиопередатчик и камера для видео, и ещё почти всегда ставили отдельно камеру для съёмок — просто прикручивали сверху GoPro. С полётным контроллером и его радиомодулём всё хорошо — научились делать очень круто, работает чётко, опенсорсная прошивка, отличная дальность. А вот у видео были проблемы. Долгое время оно было вообще аналоговое, но пришла компания DJI и кроме собственных отдельных дронов стала выпускать Air Unit — модульную камеру с передатчиком, которую можно поставить на фактически любой дрон. При этом видео цифровое и передаётся только в очки от DJI. Это был отличный ход: качество у такого видео лучше, чем у аналогового, поэтому FPV-шники стали массово скупать очки от DJI, китайские компании массово приобрели у DJI лицензию на выпуск своих модулей с их чипами (Caddx, например, она у меня на одном из дронов стоит), на аналоге остались разве что дроно-гонщики, там слишком важна задержка между картинкой и реальным временем. Но потихоньку стали появляться решения от других производителей: например Walksnail Avatar — тут тебе и очки сразу и видеомодуль. Сами DJI выпустила новые очки, оказавшиеся несовместимыми с Air Unit. А ещё они же релизнули FPV-дрон Avata, который хоть и хороший, но не даёт той гибкости, которая нужна крутым (и не таким богатым :)) ребятам. Казалось бы — ну всё, лидерство DJI в области видеопередачи для FPV-дронов постепенно заканчивается. А, ну и параллельно с этим всегда была проблема "на что снимать?". GoPro очень тяжёлая. А всё, что лёгкое — не слишком качественное. Сами GoPro выпустили версию Bones со снятым всем подряд, кроме самого необходимого. Ещё активно делали (причём, как люди сами, так и фирмы) так называемые GoPro Naked — разбирали камеру, выкидывали аккумулятор и экран, печатали новый корпус полегче. И тут бац тебе: O3 Air Unit. Это камера от DJI Avata с видеопередатчиком, которую можно установить на любой дрон. Качество на голову выше, чем у всего, что есть на рынке. Достаточное, чтобы на эту камеру даже можно было снимать, а не только смотреть, куда летишь. Совместимая со всеми версиями очков. Решает сразу очень много проблем. FPV-шники теперь ещё больше будут покупать дорогущие очки от DJI обеих версий. Вишенкой на торте ещё и идёт тот факт, что камера впаивается, то есть ты её так просто с одного дрона на другой не поставишь. А у летающих ребят обычно по 2-3-5-10 дронов. Ну, экономику считайте сами. Гениальный ход, как по мне :) И очередной Game Changer. #drone

Hashtags

Резултати

Намерени 2 подобни публикации

Търсене: #paddleocr

当前筛选 #paddleocr清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #9453 · 30.01.2026 г., 10:05

🌟PaddleOCR-VL-1.5: компактная модель для сложного парсинга. PaddlePaddle обновили свою линейку PaddleOCR-VL, выпустив PaddleOCR-VL-1.5 - компактную VLM на 0.9 млрд. параметров на базе ERNIE-4.5-0.3B-Paddle. Несмотря на скромный размер, в задачах разбора документов она показывает SOTA-результаты. На тесте OmniDocBench v1.5 модель выбила 94.5% точности, обойдя не только прошлую версию, но и более тяжелых конкурентов. Фишка обновления - упор на полевые условия. Модель специально учили работать с плохими исходниками: кривыми сканами, бликами от мониторов и мятыми страницами. Попутно сделали бенчмарк Real5-OmniDocBench, который гоняет модели по 5 сценариям: сканирование, перекосы, деформация листа, фото с экрана и плохое освещение. 🟡В 1.5 добавили: 🟢Text spotting: находит и распознает текст одновременно (печатный русский - неплохо, рукописный - почти никак) 🟢Seal recognition: распознает печати (русские - не очень, китайские - на ура). 🟢Cross-page table merging: умеет склеивать таблицы, которые разорваны между страницами. 🟢Работа с заголовками: не теряет структуру параграфа при переходе на новый лист. 🟢Новые языки: добавили поддержку тибетского и бенгальского, подтянули распознавание редких символов и древних текстов. 🟡Деплой - на любой вкус Модель работает с transformers, дружит с Flash Attention 2 и, само собой, поддерживается PaddlePaddle 3.2.1. Если нужно быстро поднять сервис - есть готовый Docker-образ. 🟡Пара важных моментов по использованию Если нужен полноценный постраничный парсинг всего документа, лучше использовать официальный пакет PaddleOCR. Реализация через transformers пока ограничена только распознаванием отдельных элементов и споттингом. В пайплайн встроили логику препроцессинга. Если картинка меньше 1500 пикселей, она автоматом апскейлится фильтром Lanczos. При этом есть потолок в 1.6 млн. пикселей для споттинга, это чтобы не перегружать память GPU и сохранить читаемость мелкого шрифта. 📌Лицензирование: Apache 2.0 License. 🟡Модель 🟡Arxiv 🟡Demo 🟡DeepWiki 🖥Github @ai_machinelearning_big_data #AI#ML#VL#OCR#PaddleOCR

Machinelearning

@ai_machinelearning_big_data · Post #8792 · 16.10.2025 г., 14:10

📄PaddleOCR-VL (0.9B) — компактная Vision-Language модель нового поколения Команда Baidu AI представила PaddleOCR-VL (0.9B) — сверхлёгкую VLM-модель, которая достигает SOTA-точности в задачах распознавания: - текстов, - таблиц, - формул, - графиков 💡Под капотом: - NaViT - динамический vision-энкодер - ERNIE - облегчённая языковая модель от Baidu ⚡️ Поддержка 109 языков. 🟠GitHub: https://github.com/PaddlePaddle/PaddleOCR) 🟠HuggingFace: https://huggingface.co/PaddlePaddle/PaddleOCR-VL 🟠Docshttps://paddleocr.ai/latest/en/index.html @ai_machinelearning_big_data #BaiduAI#PaddlePaddle#Ernie#PaddleOCR#VisionLanguage#AI#OCR