@testflightynoti · Post #38216 · 12.05.2026 г., 20:32
#MiniCPM#V#Demo Join the MiniCPM-V Demo beta on ✈️#TestFlight 🔗 Link: https://testflight.apple.com/join/yNKyFZwW Shared by thiago
Hashtags
TGINSIGHT SIMILAR POSTS
Изходен канал @clockstackwheels · Post #849 · 26.07
Робот для мойки окон. Сейчас не так уж и редко встретишь обсуждение роботов-пылесосов. Тема более менее проникает в быт, не только гики и фанаты гаджетов завели себе таких зверей. А вот роботы для мойки окон — пока ещё диковинка. Мои родители пару лет назад поставили панорамные окна, и я им такого подарил. А теперь вот взял сам попользоваться, впервые в жизни. Он очень забавно ползает по стеклу. В целом, впечатления такие же, как от пылесоса: старательный человек уберет/помоет заметно лучше, но в выборе между "робот сделает средненько прямо сейчас" и "человек сделает хорошо, но никогда" побеждает первое. Да, окна мыть, это вам не квартиру убирать. Уборку обычно делают раз в неделю, а окна хорошо если раз в полгода. Казалось бы: "Ну раз в полгода то и самому не лень помыть!" Но, во-первых, всё-таки лень (точнее, некогда из-за работы и более приоритетных дел). А, во-вторых, у мойщика есть важное свойство, которого нет у пылесоса — повышение уровня вашей безопасности. В обычных условиях нужно вставать на подоконник или как-то свешиваться, даже при использовании длинной швабры. Есть хитрые механизмы на магнитах или со специальной ручной для безопасной мойки, но это всё равно требует орудовать в сравнительно опасных условиях. Робот же требует просто поставить его снаружи на край окна, а потом забрать с этого же края. #gadgets
Hashtags
Търсене: #minicpm
@testflightynoti · Post #38216 · 12.05.2026 г., 20:32
#MiniCPM#V#Demo Join the MiniCPM-V Demo beta on ✈️#TestFlight 🔗 Link: https://testflight.apple.com/join/yNKyFZwW Shared by thiago
Hashtags
@ai_machinelearning_big_data · Post #8373 · 27.08.2025 г., 12:03
🌟MiniCPM-V 4.5: компактная модель, которая бьет гигантов в мультимодальном ИИ. Проект OpenBMB выпустил MiniCPM-V 4.5, мультимодальную модель на основе Qwen3-8B и SigLIP2-400M для распознавания изображений, серий изображений и видео, которая может работать на мобильных устройствах на более чем 30 языках. OpenBMB - некоммерческое подразделение китайской технологической компании ModelBest, под патронажем Университета Цинхуа. Среди инвесторов материнской ModelBest - Habo (Huawei), Primavera Capital Group и государственный Shenzhen Guozhong Venture Capital Management. 🟡Киллер-фича модели - эффективная работа с видео. Благодаря унифицированному 3D-Resampler модель сжимает видео в 96 раз: шесть кадров разрешением 448x448 преобразуются всего в 64 токена, тогда как большинству MLLM для этого потребовалось бы 1536 токенов. Это позволяет обрабатывать видео с частотой кадров до 10 FPS и длинные ролики без роста вычислительных затрат, что подтверждается топовыми результатами на наборах Video-MME, LVBench и MLVU. Архитектура LLaVA-UHD позволяет модели работать с изображениями до 1,8 мегапикселей и любым соотношением сторон, используя в 4 раза меньше визуальных токенов. Модель предлагает гибкий режим работы: быстрый ризонинг для повседневных задач и глубокий для сложных сценариев, переключаемый по требованию. При общем объеме в 8 млрд. параметров, MiniCPM-V 4.5 набирает 77.0 баллов по комплексному бенчу OpenCompass. Этот результат не просто улучшает предыдущие версии, модель превосходит GPT-4o-latest и Gemini-2.0 Pro, обходит открытую Qwen2.5-VL с 72 миллиардами параметров и устанавливает новый стандарт для общего MLLM на OmniDocBench. 🟡С инференсом тоже нет проблем. Доступны варианты для CPU через llama.cpp и ollama, есть квантованные версии в форматах int4, GGUF и AWQ, поддержка бэкендов SGLang и vLLM, возможность дообучения через Transformers и LLaMA-Factory, а также WebUI и оптимизированное iOS-приложение. ▶️ Чтобы было проще разобраться во всех вариантах запуска, разработчики заботливо подготовили подробный cookbook. 📌Лицензирование: MiniCPM Model License. 🟡Модель 🟡Demo 🟡Сообщество в Discord 🖥GitHub @ai_machinelearning_big_data #AI#ML#MMLM#MiniCPM#OpenBMB
@githubtrending · Post #15421 · 18.01.2026 г., 12:00
#python#audio#deeplearning#minicpm#python#pytorch#speech#speech_synthesis#text_to_speech#tts#tts_model#voice_cloning VoxCPM is a free, open-source TTS tool that turns text into realistic speech without tokens, creating expressive audio that matches context and clones voices perfectly from just 3-10 seconds of sample. Download VoxCPM1.5 (800M params) from Hugging Face, install via pip, and use simple Python or CLI commands for fast synthesis (RTF 0.15 on RTX 4090) or fine-tuning your own voices. You benefit by easily making natural audiobooks, podcasts, clones, or apps with pro-quality sound—saving time and costs on voice work. https://github.com/OpenBMB/VoxCPM
@githubtrending · Post #14815 · 10.06.2025 г., 11:30
#jupyter_notebook#chatglm#chatglm3#gemma_2b_it#glm_4#internlm2#llama3#llm#lora#minicpm#q_wen#qwen#qwen1_5#qwen2 This guide helps beginners set up and use open-source large language models (LLMs) on Linux or cloud platforms like AutoDL, with step-by-step instructions for environment setup, model deployment, and fine-tuning for models such as LLaMA, ChatGLM, and InternLM[2][4][5]. It covers everything from basic installation to advanced techniques like LoRA and distributed fine-tuning, and supports integration with tools like LangChain and online demo deployment. The main benefit is making powerful AI models accessible and easy to use for students, researchers, and anyone interested in experimenting with or customizing LLMs for their own projects[2][4][5]. https://github.com/datawhalechina/self-llm