Telegram Group Search
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Привет! Мы очень рады, что вы с нами и хотим отблагодарить вас за ваше внимание! 💚

В честь этого разыгрываем 5 подписок Telegram Premium на год 🔥🔥🔥

Никаких сложных условий! 🎉
Для участия в розыгрыше необходимо:

— Быть подписанным на канал ИИ песочница
— Быть подписанным на канал LightAutoML
— Дождаться результатов

Итоги подведем 12 февраля в 16:00, так что следите за новостями, вдруг именно вы заберёте приз! 🎁
Please open Telegram to view this post
VIEW IN TELEGRAM
🔝Как опыт Avito подтверждает ценность наших open-source продуктов

Команда Avito рассказала на Хабре, как использовала нашу либу AutoWoE для повышения ликвидности объявлений на площадке.

Модель анализирует успешные объявления и подсказывает, что можно улучшить: добавить фото, скорректировать цену, активнее отвечать или включить продвижение. AutoWoE разбивает фичи на бины, оценивает их влияние на отклики и формирует скор-карту инструментов, переведённую в рекомендации пользователям.

A/B-тесты показали рост целевых контактов и увеличение числа сделок.

Круто, когда open-source находит применение в реальных задачах!


#новости
@sb_ai_lab
Please open Telegram to view this post
VIEW IN TELEGRAM
Audio
Всем привет, друзья!

Напоминаем, что наш конкурс на 5 Telegram Premium подписок на год заканчивается уже сегодня в 16.00 (проходит он довольно интересно, конечно 🙈).

В качестве интересного интерактива для конца конкурса предлагаю вам послушать подборку сгенерированных треков про LightAutoML, PyTorch-LifeStream и AutoML Grand Prix - есть ощущение что получилось прям неплохо 🔥

Также, если вы по доброте душевной хотите поддержать нас звездой на GitHub - будем только рады

Please enjoy 🦙
Please open Telegram to view this post
VIEW IN TELEGRAM
Какой трек понравился больше? 🔥 (можно выбрать несколько)
Anonymous Poll
21%
1_Victory_Code
24%
2_LightAutoML
22%
3_PyTorch_LifeStream
21%
4_AutoML_Fusion
21%
5_Coders
LightAutoML framework
Please open Telegram to view this post
VIEW IN TELEGRAM
📔 Мы внимательно следим за последними статьями в области ML, и сегодня хотим обратить ваше внимание на модель TabPFN v2 из статьи “Accurate predictions on small data with a tabular foundation model”, опубликованную в январе 2025 года в Nature. Модель работает на табличных данных, первая версия TabPFN была опубликована в октябре 2022, во второй версии помимо классификации появилась регрессия.

💡 Идея TabPFN v2:
В классических алгоритмах для решения suprevised задач на табличных данных модель обучается с нуля, в статье используется подход с предобучением:
1. Генерируются 130 миллионов синтетических датасетов с помощью каузальных графов, которые имитируют сложные зависимости в данных, пропуски, выбросы.
2. На сгенерированных данных предобучается трансформер, предсказывая таргет test выборки, получая на вход train как контекст. Для каждой ячейки таблицы используется отдельная репрезентация. Используется механизм внимания как по строкам, так и по столбцам таблицы.
3. Вместо привычных отдельных "fit" и "predict", трансформер за один проход получая и train, и test новой задачи одновременно, делает инференс на test, используя in-context learning. Простыми словами, модель обучена однажды, но подхватывает зависимости в данных из подаваемого в контекст датасета и сразу делает предсказания.

🥇 Результаты авторов:
1. Скорость и качество: в задачах классификации и регрессии на данных до 10к строк и 500 признаков за несколько секунд получает качество лучше, чем ансамбль из базовых алгоритмов (бустинги, лес, линейные), которые тюнились в течение нескольких часов.
2. Минимум работы: алгоритм не нужно тюнить, имеет отбор признаков, нативно работает с числовыми и категориальными признаками, а также с пропусками.
3. Плюсы foundation моделей: возможность получить распределение таргета, генерировать данные итд.
4. Неплохо показывает себя на временных рядах.

🤔 Выводы:
1. Статья показала эффективность foundation моделей в домене табличных данных, теперь у бустингов сильные конкуренты.
2. Пока есть вопросы с точки зрения эффективности инференса, ограниченности контекста, но дальше будут улучшения.
3. Интересно, что TabPFN v2 можно назвать AutoML решением, ведь для решения задачи он не требует ни настройки гиперпараметров, ни предобработки данных.

Тема интересная, у нас имеются наработки по этой теме, и мы работаем над их применением в LightAutoML🦙, stay tuned!

#обзор
Please open Telegram to view this post
VIEW IN TELEGRAM
Хочешь знать, сколько на самом деле зарабатывают специалисты в Data Science? Давайте соберем статистику, пройдя опрос от наших коллег по индустрии, и узнаем 💸💸💸
Forwarded from Нескучный Data Science (Евгений Смирнов)
💸 Сколько ты зарабатываешь на Data Science?

👉 Пройди опрос сейчас, не откладывай на потом❗️

🤔 Вы можете примерно оценить вилку на вашей позиции благодаря вакансиям из каналов, где они публикуются. Тем не менее вилки довольно широкие и одни работодатели недоплачивают или платят строго по низу вилки, другие наоборот переплачивают и выходят за ее пределы. Вам в свою очередь нужно на собеседовании или при повышении назвать одно число, ровно столько вам будет платить довольно продолжительный период времени.

📊 Запускаю опрос, который в будущем поможет подписчикам сопоставить свой набор навыков с рынком труда. Прошу вас ответить на вопросы про ваш опыт, текущую роль в компании, ваш уровень удовлетворенности и планы на будущее. Чем прозрачнее будет рынок труда, тем выгоднее будет обоим сторонам, ведь дата сайентисты не будут смотреть в лес рынка труда.

🔖 Результаты опроса буду порционно публиковать в канале Нескучный Data Science @not_boring_ds.

😉 классические вопросы с популярных интервью тоже включены)

P.S. при публикации статистики дам ссылки на каналы поддержавшие опрос.
This media is not supported in your browser
VIEW IN TELEGRAM
А это твой ансамбль бустингов и неройнок закусился с AutoML’м в топе лидерборда 🦙
📺📺📺
Привет! Помимо работы над LightAutoML, мы занимаемся и следим за многими другими темами в области ML.

Завтра сотрудник нашей команды Миле Митрович выступит на научном семинаре с обзорным докладом на тему агентов, ждем вас онлайн!
Please open Telegram to view this post
VIEW IN TELEGRAM
📆 Последний доклад был очень интересным, и сегодня продолжим обсуждение агентов уже на панельной дискуссии в 17:00, от нашей команды снова выступает Миле. Еще можно успеть присоединиться онлайн!

👋 Кому тема интересна, рекомендуем канал Миле: там он рассказывает про свой опыт, новости ML/агентов/LLM/AutoML, добро пожаловать!
Please open Telegram to view this post
VIEW IN TELEGRAM
📆 Также вчера Александр Рыжков выступил на митапе у ОТП банка с рассказом про open-source и развитие LightAutoML -- видеозапись прилагается в комментариях 😉

💔 Увидели пасхалку в посте ОТП? 💔
Please open Telegram to view this post
VIEW IN TELEGRAM
🔄 Обновление LightAutoML v0.4.1 в PyPI 🚀

В новой версии внедрили ряд исправлений, улучшающие стабильность и надежность библиотеки. Основные изменения:
🔘Исправление перемешивания колонок после загрузки модели: баг мог возникать при загрузке модели из файлов -- это приводило к снижению качества модели или ошибкам "IndexError: index ... is out of bounds for dimension 0 with size ...".
🔘Исправление падения с ролями NumericRole:
Ошибка "KeyError: Numeric role ...", которая возникала при использовании класса NumericRole, возникала в основном в AutoUplift (строковое задание роли работало штатно).

‼️Важно:
Первая из перечисленных проблем была критической, поэтому версия v0.4.0 будет изъята из PyPI. Настоятельно рекомендуем обновиться до версии v0.4.1. Спасибо за ваше терпение и поддержку!
Please open Telegram to view this post
VIEW IN TELEGRAM
2025/06/13 21:18:14
Back to Top
HTML Embed Code: