@c0mmit
история моих коммитов про машинное обучение, карьеру и набитые шишки @ibragim_bad
О канале commit history
история моих коммитов про машинное обучение, карьеру и набитые шишки @ibragim_bad
AI-обзор
Обновлено 18.07.2026Канал "commit history" ведёт автор, который делится своими опытами в области машинного обучения, карьеры и IT. В постах рассказывается о его участии в конференциях, проектах, таких как SWE-rebench Leaderboard, а также о взаимодействии с другими специалистами в этой сфере. Канал будет интересен программистам, разработчикам AI и всем, кто интересуется новинками в IT.
Описание сформировано MaxBook AI на основе последних публикаций канала.
Основные метрики
Рост подписчиков
Вовлечённость
Здоровье аудитории
Часовая активность
МСККогда канал публикует — распределение постов по часам суток.
Последние публикации канала «commit history»
- 1.4K просмотров, 61 реакций, 04 июл. 2026 г.
Приехал в Сеул на ICML (одна из трех топ ai конференций) с SWE-rebench-v2 , который прошёл сюда, так что буду со стенгазетой на постерной сессии ICML, а потом ещё на воркшопе про код . В этот раз у нас здесь большая команда и сразу две статьи на main track. Приходите, если вы тоже здесь, и пишите — сгоняем попить прохладительные напитки. Фотку приложу со своей прошлой поездки в Сеул, потому что новых пока не сделал.
Открыть пост в MAX - 1.7K просмотров, 38 реакций, 01 июл. 2026 г.
За последний месяц сделали несколько апдейтов SWE-rebench Leaderboard: https://swe-rebench.com/ > собрали новые задачи и прогнали кучу моделей на свежем срезе > обновили интерфейс, сделали его более понятным и красивым > добавили rebench в HarborHub : теперь бенчмарк можно запускать в Harbor Мы немного поменяли формат апдейтов: теперь делаем их не каждый месяц, а примерно раз в два месяца. Зато в каждом таком обновлении сразу прогоняем много моделей на пачке из примерно 100 свежих задач. Ещё один интересный момент: независимый исследователь прогнал наши задачи и задачи SWE-bench Pro на…
Открыть пост в MAX - 11.8K просмотров, 63 реакций, 17 июн. 2026 г.
В начале апреля я выступал на AI Engineer Europe – и на днях вышло видео моего доклада! имхо: AI Engineer — сейчас одна из лучших конференций по прикладному AI. Еще у них есть YouTube-канал, на 500к+ подписчиков, куда выкладывают видео выступлений. Там много классных записей! видео доклада: https://youtu.be/wcUJWP6WpGM Я рассказывал про лидерборд SWE-rebench — динамический бенчмарк со свежими SWE-задачами с GitHub: https://swe-rebench.com/ Если бы мне нужно было выделить главные выводы, я бы выбрал эти: > Динамические бенчмарки помогают держать задачи свежими и снижают контаминацию. > Для…
Открыть пост в MAX - 3.5K просмотров, 51 реакций, 14 мая 2026 г.
Когда-то в университетские годы мы много организовывали мероприятия с минимальным бюджетом. Концерт студвесны на два часа: с костюмами, реквизитом и типографией — умудрялись собрать примерно за 12 тысяч рублей. Потом были ивенты побольше. На одном из награждений нужно было накормить 100+ человек, а бюджет был всё такой же минимальный. Тогда мы собрали волонтёров, которые помогли приготовить огромный казан плова — им в итоге всех и накормили. С тех пор прошло много времени, но любовь к офлайн-ивентам осталась. Особенно в новых городах: это всё ещё один из лучших способов развиртуализироваться,…
Открыть пост в MAX - 4.2K просмотров, 44 реакций, 28 апр. 2026 г.
Буду в Казани, решил сделать небольшое выступление + встречу подписчиков. Поговорим про кодовых агентов. Сделал комфортный уровень для понимания, но при этом плотно по смыслу. Никакой сухой теории или пересказов чужих кейсов — сконцентрированный опыт по агентам и эвалам: как гоняем сами, как сравнивать модели итп. Будет полезно тем, кто уже ими пользуется и/или интересуется темой. Ещё добавил развлекательную часть: расскажу, как агенты «читерят», и поделюсь историями. Приходите, буду рад! Встречаемся в новом IT-парке 4 мая в 18:00 https://it-akademiya-3c.timepad.ru/event/3939782/
Открыть пост в MAX - 4.3K просмотров, 79 реакций, 15 апр. 2026 г.
Как я смонтировал видео с лекции прямо с телефона (и без ручного труда) Выложил видео с недавнего выступления на Innovation Guild. Посмотреть можно тут. Я никогда не занимался видеомонтажом и не хотел тратить на это время. Был запрос: уложиться в час-два максимум и получить адекватное качество. Более того, я хотел сделать это автоматически и автономно , так что я запустил агента и вышел из дома, потом уже просто с телефона апдейтнул таски (с телефона есть доступ к tmux на маке). Кажется, сейчас записать и свести любую лекцию можно вообще без продакшена и минимальным ручным трудом (чтобы по…
Открыть пост в MAX - 2.9K просмотров, 35 реакций, 13 апр. 2026 г.
Два доклада и как прошел AI Engineer: впечатления спикера Прошлая неделя выдалась плотной: я выступил с докладом про SWE-rebench Leaderboard два раза! Сначала заглянул на Innovation Guild. Хорошая аудитория, комфортная атмосфера. Получилось отлично пообщаться, классные вопросы — спасибо Айбулату за приглашение! Если вы в Лондоне, горячо рекомендую заглядывать к ним в офлайне. Про AI Engineer Europe. Это их первый ивент в Европе, и планку они задали высокую. В отличие от академических конференций, здесь выше концентрация более сенсорных практиков + удивило, что большая часть людей, с кем…
Открыть пост в MAX - 3.5K просмотров, 39 реакций, 24 мар. 2026 г.
Мои новости сразу пачкой: 1. Пару недель назад сходил попить кофе с Ross Taylor из gr.inc ($10M raised), кофаундером Papers with Code (кто-то помнит еще такое?) и лидом по ризонингу в Llama 2/3. Сегодня они запустили свою платформу для RL - OpenReward. По сути, это клей между разными датасетами задач для RL и бэкендами для обучения (как Tinker, например). Мы поддержали там SWE-rebench-V2 с первого дня. 2. Обновили SWE-rebench Leaderboard. Заняло чуть больше времени, но добавили много нового — смотрите инсайты: https://swe-rebench.com/?insight=feb_2026 еще пост в X бодро разошелся на 120к и…
Открыть пост в MAX - 4.4K просмотров, 54 реакций, 06 мар. 2026 г.
недавно записали подкаст с ребятами из JetBrains Research https://youtu.be/-G3e0qffIPE?is=MAmdpFNKXu3n16AB Подкаст свежий, это только второй выпуск (первый был с Анной Коган, ex-ceo OpenCV) поговорили про мой путь из стоматологии в рисерч, SWE-rebench, кодовых агентов, наши свежие релизы (SWE-rebench-V2 и contree)! Советую чекнуть профили ведущих! Игорь один из авторов известного курса по CV на степике , это был мой первый курс по CV в 2019, который я экспрессом прошел перед хакатоном. А у Ильи психологический бэкграунд + phd и сейчас он занимается human-AI experience
Открыть пост в MAX - 48.8K просмотров, 106 реакций, 03 мар. 2026 г.
Последние пару месяцев я плотно работал над этим релизом, и наконец-то мы выкатываем его в опенсорс! 📟 Встречайте SWE-rebench-V2: самый большой открытый, мультиязычный датасет для обучения кодовых агентов! Вместе с командой Nebius AI R&D мы построили пайплайн для масштабного сбора задач из реальных GitHub репозиториев и теперь делимся всем с комьюнити. На текущий момент это самый большой и разнообразный открытый датасет подобных задач в мире. Что внутри: > 32 000+ задач — на базе реальных issue + готовый Docker-образ. > 20 языков программирования. Некоторые языки (например, Lua или Clojure)…
Открыть пост в MAX - 15.4K просмотров, 71 реакций, 26 февр. 2026 г.
Мы тут в Nebius AI R&D выкатили новый тул для всех, кто работает с кодовыми агентами – ConTree 🌳 https://contree.dev/ Пока в альфа релизе, будем рады фидбеку и вопросам! Начинаем раскатывать понемногу перед большим релизом, чтобы собрать фидбек и шлифануть все. Мы давно работаем с агентами, и одна из ключевых сильных сторон нашей команды – это умение пилить инфру. С агентами всегда стоит вопрос: где им безопасно и быстро выполнять код? В докере есть ограничения, а обычные виртуалки — слишком медленные. В итоге мы сделали свою песочницу на базе microVM. Пара главных фичей: + Git-like…
Открыть пост в MAX - 4.5K просмотров, 48 реакций, 04 февр. 2026 г.
Снова пост-солянка! 1. В Google Scholar мой профиль перешагнул отметку в 100 цитирований. Приятно! 2. В X (бывший Twitter) есть статья, которая набрала 170млн просмотров. Ждал, что её кто-то переведет, но в итоге сделал это сам для vc и Хабра Суммарно вышло 200тыс просмотров и много полярных комментов. Статья называется: «Как исправить всю свою жизнь за один день». 3. Писали статью на конфу. В этот раз основной связкой были VS Code + Codex для работы с LaTeX. В ChatGPT Pro загружал проект целиком вместе с PDF и просил прожарить – удобно искать несоответствия фактов, артефакты верстки.…
Открыть пост в MAX - 4.5K просмотров, 42 реакций, 20 янв. 2026 г.
Как попробовать Claude Opus 4.5 и другие модели в CLI-агенте бесплатно За последние полтора года из первого ряда наблюдал как сильно выросли способности моделей в формате кодинг агентов. При этом кто-то еще не пробовал сделать проект просто агентами, без погружения в код, хотя желание есть. Не у всех есть enterprise-подписка на Codex, Claude или Cursor, либо лишние $100–200 в месяц. При этом $10 в том же Cursor выедаются довольно быстро, если запускать агента на задачах чуть сложнее простых автокомплитов. Фронтирные модели уже нормально работают в агентских обвязках. На бенчмарках топовые…
Открыть пост в MAX - 12.9K просмотров, 47 реакций, 05 янв. 2026 г.
Серега @southfreebird параллельно с работой в Nebius с друзьями сделал крутой open-source проект! Авторы: @southfreebird , @Olegbalakhnov и @zaringleb . Ребята обучили и выложили в open-source VLA-модель на базе VLA-0 от Nvidia, только с backbone в 6 раз меньше (0.5B vs 3B в оригинальной работе), которая показывает success rate 94.1% на Libero benchmark (против 94.7% у оригинальной модели). VLA (Vision-Language-Action) это модель, которая смотрит на картинку, понимает текстовую команду и сразу выдаёт действие для робота, типа «возьми кубик и положи справа». Вообще порог входа в robotics ML…
Открыть пост в MAX - 3.7K просмотров, 23 реакций, 04 янв. 2026 г.
Открыл сегодня x и увидел пару постов на 100k+ просмотров про статью Recursive Language Models Суть такая. Вместо того чтобы запихивать всё в контекст, предлагают относиться к проблеме длинного контекста как к software engineering задаче. Дать LLM инструменты вроде поиска по регуляркам, чтобы она сама обрабатывала контекст, плюс инструмент для запросов в LLM, чтобы параллельно гонять сабагентов. Идейно – обычный агент (codex/claude-code/итд) просто теперь вместо репозитория нужно искать агент работает по большому txt. Приложил картинку из статьи, очень наглядная. Сразу после статьи вышел…
Открыть пост в MAX
Качество и доверие
Эвристические сигналы качества по публичным метрикам (охват, реакции, динамика подписчиков). Это не доказанный фрод и не приговор — лишь поводы присмотреться к каналу.
Реклама и монетизация
Внешняя реклама, которую этот канал размещал в других лентах.
Рекламирует с 13.06.2026
- @max_dot_sh2 поста
- @southfreebird1 пост
- @Olegbalakhnov1 пост
- @zaringleb1 пост
- @dealerAI1 пост
Каналы, которые размещали рекламу этого канала у себя.
- @max_dot_sh1 пост · 3.5K охват
- @ai_driven1 пост · 3.4K охват
- @etechlead1 пост · 1.8K охват
Средние показатели последних публикаций. Тип определён по тексту поста — оценочно.
Цитирование
Сколько раз канал упомянут и репостнут в постах других каналов.