TGTGInsighttelegram intelligenceLIVE / telegram public index

TGINSIGHT SIMILAR POSTS

Најди сличен содржај

Изворен канал @pythonotes · Post #239 · 3 мај

Один из самых удобных способов записать данные это использование готовых форматов, такие как JSON или YAML. Из плюсов такого подхода стоит отметить вот что: 🔸 готовый, повсеместно используемый и поддерживаемый формат 🔸 простой и понятный файл, удобочитаемый для человека 🔸 можно легко редактировать в любом текстовом редакторе без специальных программ и библиотек Но есть и минусы 🔹 затраты времени при записи файла (кодирование данных в нужный формат строки) 🔹 затраты времени при чтении файла (декодирование данных в Python объекты) 🔹 размер файла увеличивается из-за разметки данных (скобки, запятые, переносы, отступы...) 🔹 перед записью все данные должны быть помещены в память в полном объёме (не всегда) 🔹 при чтении необходимо считать весь файл в память и только потом декодировать данные Если нужно писать немного данных в несколько файлов, то затраты по времени не ощутимы. Обычно это файлы конфига или какие-либо метаданные. Это отличный вариант под такие задачи. Есть и другой поход к записи файлов - это бинарные файлы. Используется, когда данных достаточно много и никто их не собирается читать глазками😳. 🔸 очень быстрая запись 🔸 чтение значительно быстрей чем JSON, YAML итд 🔸 размер файла значительно меньше, так как нет разметки 🔸 можно записывать данные по мере поступления не загружая всё в память 🔸 можно извлечь любую часть данных независимо Из минусов 🔹 нужно определить свой формат записи данных (если не используете готовую спецификацию определённого формата) 🔹 не получится открыть файл и визуально понять что там записано, а для чтения файла потребуется знать его спецификацию. 🔹 не так-то просто создать такой файл без специальной библиотеки В таком виде удобно записывать большой массив любых однородных данных. Например, мониторинг валютной биржи или кэшированная анимация 3D геометрии. (Это не означает что нельзя записать данные разного типа, просто это будет не так удобно) Представьте себе JPG-картинку. По сути это немного мета-информации и большой массив пикселей. Тоже самое со звуком или видео файлом. Поэтому, если вы попробуете открыть картинку в текстовом редакторе вы увидите что-то вроде такого f15d cd29 a564 4578 ... 09e2 9bc4 a696 1253 ... 84e9 4de1 3b23 c24a ... 2534 5161 28e0 709d ... ... Это и есть записанные байтики. И для их чтения требуется определённый софт который знает что с ними делать. Под каждый тип файла. К чему это я? Читайте в следующем посте... #tricks#basic

Hashtags

#tricks #basic

Резултати

Пронајдени 92 слични објави

Пребарај: #ocr

当前筛选 #ocr清除筛选

Libreware

@libreware · Post #1171 · 01.09.2023 г., 13:00

Најди слично Погледај

Image to Text OCR is a utility website made by Alejandro Akbal for extracting text from any image using #OCR. This tool was made for those moments where you take a photo of some text and wish you could have it digitally. https://github.com/AlejandroAkbal/Image-to-Text-OCR Online: https://image-to-text-ocr.netlify.app/

Hashtags

#ocr

落樱/Fallen sakura

@xxluoxx · Post #196 · 05.09.2022 г., 13:41

Најди слично Погледај

Umi-OCR—基于PaddleOCR的OCR，识别准确度很不错链接:Github 🏷#OCR

Hashtags

#ocr

秋月资源分享社-破解软件VPN

@qiuyuezt · Post #6313 · 10.09.2025 г., 15:34

Најди слично Погледај

🔻标题：U-rOcrV1.1 文字识别/配音翻译 🌈说明: 支持识别本地文件和在线 OCR 识别，能离线使用，默认快捷键是 Alt＋Z，支持读取剪切板。 📃下载地址: 夸克盘 / 蓝奏云 ✉️标签：#ocr#工具

Hashtags

#ocr #工具

Machinelearning

@ai_machinelearning_big_data · Post #8847 · 24.10.2025 г., 11:48

Најди слично Погледај

🦉 LightOnOCR-1B: новая быстрая OCR-модель от LightOn Модель дистиллирована из Qwen2-VL-72B-Instruct и обучена на корпусе из 17.6 млн страниц / 45.5 млрд токенов. 🔥 Главное:** -1 B параметров - позволяет обрабатывать 5.7 страниц/с на одном H100 (это примерно ≈ 493 000 страниц за день) - Распознаёт таблицы, формы, уравнения и сложные макеты - 6.5× быстрее dots.ocr, 1.7× быстрее DeepSeekOCR - Расходы < $0.01 за 1000 страниц A4 📊 Качество (Olmo-Bench): - Превосходит DeepSeekOCR - Сопоставима с dots.ocr (при этом модель в 3 раза меньше по весу) - +16 пт к Qwen3-VL-2B-Instruct Эта моделька - отличный баланс качества, скорости и стоимости. 🟢Модель 1B: https://huggingface.co/lightonai/LightOnOCR-1B-1025 🟢Модель 0.9B (32k): https://huggingface.co/lightonai/LightOnOCR-0.9B-32k-1025) 🟢Блог LightOn:https://huggingface.co/blog/lightonai/lightonocr 🟢Демка: https://huggingface.co/spaces/lightonai/LightOnOCR-1B-Demo @ai_machinelearning_big_data #ocr#ml

Hashtags

#ocr #ml

拔毛工 🥸

@bamaogong · Post #457 · 09.04.2025 г., 02:07

Најди слично Погледај

#GitHub#OCR 📝Versatile-OCR-Program - 多模态 OCR 系统 ▎项目介绍：一个多模态 OCR 系统，专门用于从复杂的教育材料，如考试试卷中提取结构化数据，以优化机器学习训练。支持多种语言，包括日语、韩语和英语，能够处理数学公式、表格、图表等元素，并生成适合 AI 的 JSON 或 Markdown 格式输出。 ▎项目地址：点击打开

Hashtags

#github #ocr

JJ.ai (NFA)🪽

@jsmjsmxyz · Post #1108 · 22.12.2020 г., 10:01

Најди слично Погледај

#OCR#Tools Newlearner 的 OCR 使用分享（离线篇） 🔌Offline OCR🔌 离线的 OCR 工具主要依赖离线库，处理精度上可能比不上在线接口，但优点是可以进行大批量的 OCR 工作，且处理速度较快。 🔍OwlOCR - 支持对 PDF, PNG, JPEG, GIF 文件进行 OCR - 支持在 iOS 设备上拍照，OwlOCR 上立即进行 OCR 处理 - 离线 OCR 多语言支持，包括简体中文和繁体中文，但 - 免费版保留了大部分功能，付费版可以提高 OCR 处理速度 🔍TextSniper - 小巧轻量，使用方便 - 支持 OCR 结果叠加至剪切板 - 离线多语言支持 - 买断制 app，包含在 Setapp 订阅中 👀 以上提到的几款 OCR 工具都是在 Win/Mac 端使用的，至于移动端我比较推荐的是「白描」。我对 OCR 识别精度要求不高，因此使用的是 Bob 的免费接口；OCRmyPDF则是我扫描大型 PDF 文档时采取的方案。 🎗「天若 OCR」与「白描」即将迎来优惠促销活动，有需要的朋友们可以考虑入手。 📘 关联阅读： 1⃣️OCRmyPDF·给你的PDF文档添加文字层 2⃣️alfred-ocr：macOS 上的多接口 Alfred OCR / 翻译插件频道：@NewlearnerChannel

Hashtags

#ocr #tools

JJ.ai (NFA)🪽

@jsmjsmxyz · Post #1107 · 22.12.2020 г., 07:13

Најди слично Погледај

#OCR#Tools Newlearner 的 OCR 使用分享（在线篇）通常在图片、PDF文档中提取文字，我们都会使用 OCR(Optical Character Recognition) 技术，今天就和大家分享一下几款比较优秀的 OCR 工具 ☁️Online OCR ☁️ 在线 OCR 大多是调用云 OCR 引擎进行处理，对得到的结果进行优化后再输出，所以精确度、还原度会更高。因为大多数 OCR 接口都需要付费，所以有一定的使用成本。 🔍iText - 使用 Google & 百度 & 腾讯 OCR 接口，识别精准度高 - 独创算法，优化识别结果 - 支持识别后翻译 - 每月免费体验20次，Pro 版支持月/年付订阅 🔍天若OCR - 一款 Windows 平台上的 OCR 工具 - 支持表格识别、竖排识别、LaTex 公式识别、翻译功能 - 支持自定义文本接口 - 提供免费版与付费版，付费版采取买断制 🔍Bob - 本质是一款翻译工具，但其附带的 OCR 功能可以满足日常使用 - 支持自定义文本接口，默认使用百度智能云 OCR 接口 - 半开源，免费 - Bob 的作者十分贴心，在使用文档中给出了各大 OCR 接口（百度、腾讯、搜狗、有道）的申请方式：教程地址频道：@NewlearnerChannel

Hashtags

#ocr #tools

RrOrange和朋友们 | 周刊资源分享频道

@RrOrangeAndFriends · Post #427 · 11.05.2024 г., 06:05

Најди слично Погледај

#网站分享#OCR 📝图片文字识别(OCR) 🔗直达链接 🤓 试了一下，个人主观感受如下： 🟠UI 简洁 🟠准确率挺高 🟠识别要验证码 🟠底层使用了GitHub star 2.2k的库 📬投稿 & 群聊🔈频道🔎索引

Hashtags

#网站分享 #ocr

Machinelearning

@ai_machinelearning_big_data · Post #8813 · 20.10.2025 г., 11:10

Најди слично Погледај

📄 DeepSeek-OCR - модель для распознавания текста 🔍 DeepSeek выпустили мощную OCR-модель, способную преобразовывать изображения документов прямо в Markdown или текст. Что умеет: - Распознаёт текст на изображениях и в PDF - Работает с документами, таблицами и сложными макетами - Поддерживает разные режимы: Tiny, Small, Base, Large - Оптимизирована под GPU (PyTorch + CUDA 11.8) - MIT-лицензия — можно свободно использовать и модифицировать DeepSeek-OCR достигает высокой точности и эффективности за счёт компрессии визуальных токенов. На Omnidocbench - лучшая точность при минимуме визуальных токенов, превосходит другие OCR-модели по эффективности и скорости. 🟠HF: https://huggingface.co/deepseek-ai/DeepSeek-OCR 🟠Github: https://github.com/deepseek-ai/DeepSeek-OCR 🟠Paper: https://github.com/deepseek-ai/DeepSeek-OCR/blob/main/DeepSeek_OCR_paper.pdf @ai_machinelearning_big_data #ocr#DeepSeek

Hashtags

#ocr #deepseek

🐰兔子风暴/TG内容中转站/网络/网盘资源整合

@RabbitStorm · Post #206 · 18.01.2024 г., 11:04

Најди слично Погледај

#夸克网盘#ocr 团子翻译器团子翻译器是一款基于 OCR 的生肉翻译软件夸克：https://pan.quark.cn/s/0f5f222cfbb0 Github：https://github.com/PantsuDango/Dango-Translator 🦋频道 @RabbitStorm

Hashtags

#夸克网盘 #ocr

GeekHub资源分享

@geekhub23 · Post #240 · 22.10.2024 г., 09:05

Најди слично Погледај

软件名称：白描软件链接：https://baimiao.uzero.cn/ 软件介绍：灵动的OCR扫描识别神器。具备高准确度的文字识别、表格识别转Excel、批量识别、识别后翻译、文件扫描等功能。支持网页版移动端、pc端，有一定的免费额度 #软件#工具#OCR

Hashtags

#软件 #工具 #ocr

油油の科技软件资源分享

@Youyousharechannel · Post #14711 · 24.04.2026 г., 11:42

Најди слично Погледај

#翻译#OCR 😞STranslate，即用即走的桌面翻译与 OCR 工具一款基于 WPF 开发的 Windows 翻译与 OCR 工具，集成了 Google、DeepL、OpenAI 等翻译服务，支持划词翻译、截图识别、全文翻译、生词管理和插件市场等功能。 🥰https://stranslate.zggsong.com/ 🧐https://github.com/STranslate/STranslate/releases

Hashtags

#翻译 #ocr

12 3•••7 8

← ПретходнаСтраница 1 од 8Следна →