~ WEEKLY UPDATE 332 ~
#OP#WEEKLY
Iniziamo con la nuova rubrica! Nella Community sta ritornando la pace, ma le novità non si fermano!
• La guerra tra i tipi di fotocamera frontale continua. Il team OnePlus ha realizzato un articolo analizzando i pro e i contro di ogni sistema adottato. Lo trovate qui
• Nuove raffles! Potete vincere una borraccia OnePlus o una t-shirt. Qui trovate più informazioni
• Le recensioni del programma The Lab sono fantastiche, forse la migliore edizione di sempre. Si possono vedere tutte qui
• Dal debutto del 5 marzo, il programma IDEAS ha ricevuto un sacco di idee per migliorare OxygenOS! Potete ancora inviare i vostri suggerimenti entro il 30 aprile qui!
• Il programma Open Beta è terminato per OnePlus 6 e 6T. Per assicurare un supporto continuo, è consigliato tornare al ramo stabile. Più dettagli qui. Le Beta 12 per OnePlus 7 e 7 Pro sono state ritirate a causa di problemi. É in corso l'analisi dei problemi per riprendere il rollout al più presto
• Novità per OnePlus 5 e 5T! Tra pochi giorni sarà svelato un regalo per chi ancora usa questi telefoni (e sappiamo tutti di cosa si tratta). Restate sintonizzati su OnePlus Guide!
• Un utente della community sta facendo un contest per regalare il suo "dbrand grip case con la black dragon skin" per OnePlus 7 Pro! Se vi interessa, date un'occhiata qui
• Per i gamers, Fortinte è finalmente arrivato sul Play Store. Al riguardo è stata aperta una discussione ufficiale qui
Pierre
🎙️ Qwen3-ASR — универсальная модель распознавания речи!
🟢Поддержка EN/CN + ещё 9 языков: ar, de, en, es, fr, it, ja, ko, pt, ru, zh
🟢 Авто-определение языка
🟢 Модель умеет распознавать речь даже в сложных условиях — когда человек поёт, читает рэп или говорит под фоновую музыку. — WER <8% (ошибки меньше 8 слов на каждые 100)
🟢 Работает даже в шуме, низком качестве и на расстоянии
🟢 В модель можно добавить свои слова/термины/имена и фразы, и она будет их правильно распознавать
▪API:https://bailian.console.alibabacloud.com/?tab=doc#/doc/?type=model&url=2979031
▪ModelScope Demo: https://modelscope.cn/studios/Qwen/Qwen3-ASR-Demo
▪Hugging Face Demo: https://huggingface.co/spaces/Qwen/Qwen3-ASR-Demo
▪Blog:https://qwen.ai/blog?id=41e4c0f6175f9b004a03a07e42343eaaf48329e7&from=research.latest-advancements-list
@ai_machinelearning_big_data
#ASR#SpeechRecognition#Qwen3#AI#MachineLearning#DeepLearning#VoiceAI
🎙️NVIDIA выпустили Canary-1B v2 — открытую модель для распознавания и перевода речи, которая работает с 25 европейскими языками.
Что она умеет:
- 📝 Точное ASR (распознавание речи) и AST (перевод речи) между английским и 24 другими языками.
- Автоматическая пунктуация, капитализация и точные таймстампы до слова.
- Поддержка русского, французского, немецкого, испанского и многих других языков.
Чем интересна
- До 10× быстрее инференс, чем у моделей в 3 раза больше.
- Уже показывает state-of-the-art точность среди открытых моделей на Hugging Face.
- Лицензия CC-BY-4.0 — можно свободно использовать в проектах.
Под капотом:
- Архитектура: FastConformer-энкодер + Transformer-декодер (~978M параметров).
- Форматы: .wav и .flac, моно 16 кГц.
- Легко интегрируется через NVIDIA NeMo или прямо с Hugging Face.
Где пригодится:
🟢 голосовые ассистенты
🟢 субтитры и перевод видео
🟢 чат-боты с речевым вводом
🟢 real-time анализ речи
Всего ~978M параметров → легче, быстрее и дешевле в использовании, чем большие модели конкурентов.
🟠Попробовать можно здесь: https://huggingface.co/nvidia/canary-1b-v2
🟠SET: https://huggingface.co/datasets/nvidia/Granary
🟠PARAKEET: https://huggingface.co/nvidia/parakeet-tdt-0.6b-v3
@ai_machinelearning_big_data
#AI#NVIDIA#SpeechRecognition#ASR#AST#Multilingual#MachineLearning#DeepLearning