@datastorieslanguages
Канал о ML/AI, изучении иностранных языков, книгах и жизни. Контакт с автором https://t.me/Erlemar Персональный сайт: https://andlukyane.com/ Рекламу не публикую Забустить канал можно тут: https://t.me/boost/datastorieslanguages
О канале Data, Stories and Languages
Канал о ML/AI, изучении иностранных языков, книгах и жизни. Контакт с автором https://t.me/Erlemar Персональный сайт: https://andlukyane.com/ Рекламу не публикую Забустить канал можно тут: https://t.me/boost/datastorieslanguages
AI-обзор
Обновлено 18.07.2026Канал "Data, Stories and Languages" посвящен темам машинного обучения и искусственного интеллекта (ML/AI), изучению иностранных языков, книгам и личным размышлениям автора. В постингах обсуждаются актуальные события в мире IT, публикуются ссылки на интересные статьи и ресурсы, а также проводятся рецензии книг. Канал будет интересен всем, кто интересуется современными технологиями, языками программирования и развитием искусственного интеллекта.
Описание сформировано MaxBook AI на основе последних публикаций канала.
Основные метрики
Рост подписчиков
Вовлечённость
Здоровье аудитории
Часовая активность
МСККогда канал публикует — распределение постов по часам суток.
Последние публикации канала «Data, Stories and Languages»
- 12 просмотров, 1 реакций, 18 июл. 2026 г.
Beginning July 20, Claude Fable 5 will be included in all Max and Team Premium plans, at 50% of limits. Вот что конкуренция животворящая делает! https://x.com/claudeai/status/2078302415804379218
Открыть пост в MAX - 108 просмотров, 7 реакций, 17 июл. 2026 г.
Time Series with PyTorch — Graeme Davidson, Lei Ma Мне прислали очередную книжку от Packt на прочтение и ревью - на этот раз про time series forecasting на PyTorch. Тема мне близкая: временные ряды — одна из самых сложных для меня областей ML, и при этом большинство книг по deep learning относятся к ним как к чему-то второстепенному после CV и NLP. Книга идёт начинает с базовых вещей (что делает временные ряды сложными, как правильно оценивать модели, PyTorch с нуля), демонстрирует современные архитектуры (RNN, transformers, N-BEATS, N-HiTS, foundation models, diffusion) и выходит за…
Открыть пост в MAX - 825 просмотров, 16 реакций, 15 июл. 2026 г.
Data Sanity Talks: AI-Driven Participation in Kaggle Competitions https://datasanity.dev/data-sanity-talks-london-2026-07-23.html На следующей неделе будет оффлайн ивент в Лондоне, где я буду рассказывать о своём опыте применения агентов для участия в каггл соревнованиях, говорить, что работает и что не работает. Запись будет доступна позже #ai
Открыть пост в MAX - 487 просмотров, 9 реакций, 10 июл. 2026 г.
Рекомендую канал Хочу порекомендовать вам Data Blog ( @jdata_blog ) — отличный канал, где качественно и на понятном языке разбирают интерпретируемость и безопасность LLM: mechanistic interpretability, SAE, activation steering, персоны и джейлбрейки. У ведущей канала много опыта в этой теме, поэтому разборы статей получаются интересными, практическими, с объяснениями ограничений и часто с ноутбуками, которые можно самостоятельно потыкать. Посты, которые мне зашли: — Свой SAE против джейлбрейков (статья с ACL 2026 Findings): если прогонять активации через разреженный фильтр на инференсе,…
Открыть пост в MAX - 753 просмотров, 11 реакций, 09 июл. 2026 г.
Kaggle в Google Antigravity: агент, который помогает стартовать и уверенно ошибается В рамках активности Google Developer Expert, я попробовал поучаствовать в соревновании Kaggle Playground (S6E7, табличная многоклассовая классификация) почти полностью силами агента — в Google Antigravity 2.0 на Gemini 3.1 Pro. Для начала я попросил Claude собрать "starter kit" на оснвое моего прошлого опыта: гайдлайны, промпты, базовый код с общими правилами для мультиагентного пайплайна. Дальше запустил промпт — и Gemini сделал EDA, фичи, обучил модели параллельно в фоновых задачах и собрал бленд. Правда…
Открыть пост в MAX - 572 просмотров, 4 реакций, 09 июл. 2026 г.
Бенчмарк GPT-5.6 Sol/Terra/Luna - двигают фронтир Это тест новых моделей OpenAI на нашем новом агентском бенчмарке. Под капотом бенчмарка - паттерны из топовых харнесов с BitGN соревнований, которые мы разобрали и заново прогнали через ECOM1 под трейсом с лупой, анализируя точки возникновения ошибок. А самые уязвимые места самых сильных архитектур (когда они путаются, пропускают нарушения границ, забывают про политики итп) собрали в бенчмарк. И получается, что лайтовые модели GPT-5.6 (есть еще pro версии, которые протестирую попозже) настолько хороши, что они двигают Парето-фронтир как по…
Открыть пост в MAX - 697 просмотров, 4 реакций, 09 июл. 2026 г.
Build with Muse Spark, now available on Meta Model API https://developer.meta.com/ai/resources/blog/build-with-muse-spark/#3-pricing-and-free-credits Muse Spark 1.1 - публично доступна. "pay-as-you-go pricing starts at $1.25 input/$4.25 output per million tokens" - демпинг! Верим метрикам? :) #ai
Открыть пост в MAX - 731 просмотров, 8 реакций, 08 июл. 2026 г.
Новое голосовое общение с GPT https://openai.com/index/introducing-gpt-live/ Голосовой режим в GPT обновили! Мне он всегда нравился, а теперь уверяют, что вышло новое поколение
Открыть пост в MAX - 2.2K просмотров, 21 реакций, 08 июл. 2026 г.
Cayley graph search с Claude Code: решение головоломок в 2026 с помощью агентов Я написал большой пост про два Kaggle-соревнования из серии CayleyPy — IHES Picture Cube и Megaminx. Это комбинаторные головоломки (кубик и додекаэдр), но по сути - поиск коротких путей в огромных неявных графах Cayley: вершины графа — это состояния головоломки, рёбра — это ходы, а решить пазл значит найти короткий путь до собранного состояния. Мы занимаемся этим уже пару лет и опубликовали несколько статей, а в 2026 году я решил попробовать новый подход: вместо того, чтобы писать код самому, я использовал…
Открыть пост в MAX - 757 просмотров, 11 реакций, 07 июл. 2026 г.
the diary of Tom Riddle, for the reMarkable Paper Pro Помните это эпичное видео? Автор выложил код: https://github.com/MaximeRivest/Riddle
Открыть пост в MAX - 824 просмотров, 5 реакций, 06 июл. 2026 г.
Book ReviewGPU-Accelerated Computing with Python 3 and CUDA Я получил очередную книжку от Packt на прочтение и ревью. Книга учит писать код под GPU на Python: сначала CUDA-ядра на Numba-CUDA, потом высокоуровневые библиотеки (CuPy вместо NumPy/SciPy, RAPIDS cuDF/cuML вместо pandas/scikit-learn, JAX), и в конце четыре мини-проекта. Книга мне понравилась (но код запускать я не пробовал). Авторы замеряют все оптимизации и демонстрируют случаи, когда ускорение не получилось. Из интересного: на примере computer-vision демонстрировали три способа классификации зашумлённых объектов: 7 Hu moments…
Открыть пост в MAX - 1.1K просмотров, 32 реакций, 04 июл. 2026 г.
О дистилляции Anthropic: some people (looks at China) distill our models, so we have implemented the guardrails. Some people: https://huggingface.co/AliesTaha/fable-traces
Открыть пост в MAX - 1.1K просмотров, 13 реакций, 02 июл. 2026 г.
Интересное изменение графиков в статье Sonnet 5 https://www.anthropic.com/news/claude-sonnet-5 Внимательный читатель может заметить, что графики в статье очень сильно изменились. Официальное оправдание "сорри, не тот график опубликовали". Неужели вайб-кодили и сделали ошибку?! Видимо забыли добавить "make no mistakes"! #ai
Открыть пост в MAX - 1.3K просмотров, 12 реакций, 29 июн. 2026 г.
Qwen 3.6 27B is the sweet spot for local development или нет? https://quesma.com/blog/qwen-36-is-awesome/ https://news.ycombinator.com/item?id=48721903 Увидел я тут очередной пост про то, как же хорошо гонять локальные модели. Автор запустил модель локально с помощью llama.cpp с квантизацией в 8-bit на Macbook Max M5 120 Gb. И вот я ну никак не могу с этим всем согласиться. Первое, и самое главное, это качество. Qwen неплох, но он намного хуже frontier-level моделей, особенно при квантизации. Я недавно рассказывал как пробовал minimax - ему было очень далеко до клода/кодекса. Кроме того,…
Открыть пост в MAX - 1.4K просмотров, 6 реакций, 22 июн. 2026 г.
LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding Современные VLM для детекции и grounding кодируют bounding box как текст: каждый бокс — это короткая строка координатных токенов, которые декодируются по одному слева направо. Из-за этого возникают две проблемы: генерация строго последовательна, поэтому latency растёт с числом боксов; и четыре координаты одного геометрического объекта предсказываются так, будто они независимы, хотя описывают один прямоугольник. Обычное подход к решению первой проблемы — multi-token prediction (MTP): выдавать…
Открыть пост в MAX
Качество и доверие
Эвристические сигналы качества по публичным метрикам (охват, реакции, динамика подписчиков). Это не доказанный фрод и не приговор — лишь поводы присмотреться к каналу.
Реклама и монетизация
Средние показатели последних публикаций. Тип определён по тексту поста — оценочно.
Цитирование
Сколько раз канал упомянут и репостнут в постах других каналов.
Публикации
Дополнительно
Из 23 пойманных постов в диапазоне ID сообщений отсутствует 1. Пропуски — это удалённые посты ИЛИ медиа-альбомы и служебные сообщения (один альбом = несколько ID). Точную причину по одним ID определить нельзя.