TGTGInsighttelegram intelligenceLIVE / telegram public index
← Python Заметки

TGINSIGHT SIMILAR POSTS

Најди сличен содржај

Изворен канал @pythonotes · Post #314 · 14 мар.

Раньше на курсах была проверка домашних заданий и фитбек. Теперь, по понятным причинам, я не смогу это поддерживать в том же объёме. Чтобы вам не учится в сферическом вакууме, я сделал для вас площадку для общения. А точней две! Там вы сможете помогать друг другу, ведь старые студенты тоже подтянутся, за что я буду им очень благодарен. Я тоже буду отвечать на ваши вопросы по возможности. Основная площадка: ➡️Discord Сервер Запасной вариант: ➡️Telegram Чат 👍 Вход свободный, все чаты открыты. 🤬 Никакой политики и токсичности! Только по делу! 💣 Нарушителей банить буду резко и с размаху! 📌@pythonotes #offtop

Hashtags

Резултати

Пронајдени 1 слични објави

Пребарај: #tuvanlanguage

当前筛选 #tuvanlanguage清除筛选

В 2023 мы с Айраной Монгуш и Давидом Дале сделали первый Тувинско-Русский ИИ переводчик — раньше Google и Яндекса. Опубликовали на конференции по машинному переводу WMT 2024. С тех пор я думал: а если без интернета? Прямо на телефоне? Взял Gemma3 1B, обучил на Colab, запустил на CPU. Вот скрин — живые переводы, ~500мс, без GPU. Модель пока сырая. Иногда галлюцинирует. Но когда попадает — попадает точно. Это работающая система. Дальше хочу добиться реального качества: — iOS через Core ML (моя основная среда) — 4-bit квантизация для мобильного — Правильно организовать "трубу" (пайплан) — основная проблема — Организовать более гибкий системный промпт (фью-шот промптинг) — Почистить датасет и обогатить синтетически — Сравнить несколько моделей — Выпустить офлайн-приложение для тувинцев 💬 Что сейчас работает для low-resource MT с ~300к парами? Интересно всё — архитектуры, трюки при обучении, способы улучшить качество на маленьком датасете. #NLP#Gemma3#iOS#CoreML#TuvanLanguage#EdgeAI#Google