TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #10 · 6.04

Предыдущая статья о нужности умных колонок, к моей радости, не собрала ни одного конспирологического комментария. Видимо, профилактический абзац про это сделал своё дело. Однако, было несколько длинных обсуждений с критикой моих выводов. Хочу подчеркнуть, что все статьи, разумеется, субъективны. Да, я пишу о вещах, в которых у меня есть опыт, причём, как правило, разнообразный. Сам я легко ломаю привычки в том, что касается технологий и устройств, потому что люблю исследовать новое и сравнивать свои впечатления и полученные результаты. Но не все столь гибкие, если вдруг ваше естество неистово сопротивляется, то рекомендации следует рассматривать как опциональные, а статьи — как чтиво о чём-то далёком от вашей жизни. Сегодня мы посмотрим ещё на одну умную колонку, и на этом пока тему закроем. А именно — «Капсула» от MailRu с голосовым ассистентом «Маруся» на борту. Сравним с Яндекс Станцией и попытаемся понять, на этот раз, не «нужна ли вам умная колонка вообще», а «нужна ли вам именно Капсула, если вы хотите умную колонку». #gadgets#tech https://teletype.in/@clockstackwheels/mail-capsule

Резултати

Намерени 2 подобни публикации

Търсене: #frontiermath

当前筛选 #frontiermath清除筛选
Venture Village Wall 🦄

@venturevillagewall · Post #3607 · 20.12.2024 г., 19:00

o3 & o3-mini Break Benchmark Records The performance of o3 and o3-mini showcases state-of-the-art (SOTA) results across various benchmarks. Key insights include: - Frontier Math scores increased from 2% to 25%. - SWE-Bench achieved 71.7%, a significant leap for a startup that recently raised $200 million with 13.86% earlier this year. - ELO on Codeforces reached 2727, held by only 150 individuals globally. - ARC-AGI model scored 87.5%, breaking a five-year deadlock. - Noteworthy progress on GPQA and AIME benchmarks. Access to o3-mini is currently available to security researchers, while general public access is set for late January. Full access to o3 will follow later. #AI#SOTA#Benchmarks#o3#o3-mini #FrontierMath#SWE-Bench #Codeforces#ELO#ARC-AGI #GPQA#AIME#Funding#Progress#Research#Technology#Innovation

Venture Village Wall 🦄

@venturevillagewall · Post #3606 · 20.12.2024 г., 18:41

O3 and O3-Mini Benchmark Breakthroughs The O3 and O3-Mini models showcase state-of-the-art (SOTA) performance with significant leaps in various benchmarks. Results on Frontier Math have jumped from 2% to 25%. The SWE-Bench model achieved a score of 71.7%, while a startup has raised $200 million following results of 13.86%. ELO on Codeforces reached 2727, surpassing most peers globally. Notably, the ARC-AGI model scored 87.5%, breaking a five-year benchmark. Access for security researchers to O3-Mini starts today, with general access available in late January. #O3#O3Mini#SOTA#Benchmarks#AI#ML#Funding#Codeforces#ARC-AGI #FrontierMath#SWE-Bench #ELO#GPQA#AIME#SecurityResearch#TechUpdates#Innovations#Startups#Performance#AIModels