Small Data Science for Russian Adventurers
11.2K subscribers
303 photos
3 videos
13 files
705 links
БЕЗ ЧУЖОЙ РЕКЛАМЫ Авторский канал Александра Дьяконова (dyakonov.org)
машинное (machine learning) и
глубокое обучение (deep learning)
анализ данных (data mining)
наука о данных (data science)
ИИ (artificial intelligence)
математика (math)
и др.
ЕСТЬ ЧАТ;)
加入频道
#соревнование
Конкурс "VoicePrivacy" при конференции Interspeech 2020:
https://www.voiceprivacychallenge.org/
#статья
Статья со ссылкой на соответствующий сервис. Идея - облегчить трансферное обучения. Если Вы решаете задачу, в которой мало данных, то стандартный приём - взять предобученную на большом наборе данных нейросеть и "дотьюнить" её на Вашу задачу. Авторы задались вопросами: как выбрать подходящий большой датасет для первичного обучения нейросети, можно ли из него выделить подвыборку, максимально релевантную нашей задаче. Они даже сделали сервис с подобным функционалом;)
https://arxiv.org/abs/2001.02799
#математика
К вопросу о том, что в классической математике "совсем свежего": например, тропическая геометрия - она появилась уже в этом веке, всякие тропические полукольца применяются в экономике (считается, что с их помощью лучше формализуются процессы типа объединения компаний и т.п.), а также в ИИ (например, в т.н. Weighted Finite-State Transducers). Бегло ознакомиться с тропической геометрией можно с помощью этой небольшой книги:
https://www.mccme.ru/dubna/2006/notes/Kazaryan.pdf
#конференции
Конференция «Оптимизация и приложения» в Черногории в конце сентября
http://agora.guru.ru/display.php?conf=optima-2020
#книга
Фантастика! Новая книга Нассима Талеба Статистические последствия тяжелых хвостов: преасимптотика, эпистемология и приложения просто выложена на Arxiv-е. Можно читать не дожидаясь, пока какое-нибудь модное издательство переведёт;)
https://arxiv.org/abs/2001.10488
#книга
Небольшая брошюра от "Касперского" про использование ML в кибербезопасности:
https://media.kaspersky.com/en/enterprise-security/Kaspersky-Lab-Whitepaper-Machine-Learning.pdf
#вакансия
Нужен человек, хорошо разбирающийся в прикладной дискретной оптимизации (в идеале - желающий работать и в DS) на проекты, в которых упрощённая математическая постановка задач выглядит так:
1) оптимизация разборки и сборки составов (условно: есть поезда с вагонами ABBBC, BAAC, AACCC, надо их превратить в поезда с вагонами AAAAA, BBBB, CCCCC + куча всяких условий на то, когда каждый из поездов вида XXXX должен быть готов и т.п.)
2) оптимизация нескольких коммивояжёров (есть транспортные средства, которые в совокупности в течение дня должны посетить все заранее заданные пункты и вернуться на базу, желательно использовать минимальное число транспортных средств + есть ограничения на перемещения каждого из них).
Можно в личке задать вопросы, резюме на [email protected] (в теме письма напишите: «вакансия на задачи оптимизации»)
#интересно
Вчерашняя красивая новость про то, как искусственно сделать пробки. Я про это как раз рассказываю в рамках одного из своих курсов. Раз уж это сделал художник, то можно было бы пойти дальше и пробками чертить на Гугл-карте узоры, но потребовалось бы существенно больше ресурсов...
https://tjournal.ru/internet/140483-nemeckiy-hudozhnik-sozdal-virtualnye-probki-v-google-maps-on-vozil-po-dorogam-telezhku-s-99-telefonami
#статья
Работа From local explanations to global understanding with explainable AI for trees опубликованная в Nature Machine Intelligence про интерпретацию алгоритмов, основанных на решающих деревьях, с помощью SHAP-подхода
https://www.nature.com/articles/s42256-019-0138-9.epdf
#математика
Некоммерческий проект - электронная математическая библиотека. Например, нашёл там интересный перевод 1923 года книги Эмиля Бореля «Случай». Можно почитать, как рассказывали о вероятности до трудов Колмогорова.
https://www.mathedu.ru
#DL
Одно из применений нейронок - реставрация старых видео
https://youtu.be/3RYNThid23g
#законы
В наше время анализа данных один из способов их получения - веб-скрейпинг, про законность которого есть разные мнения (естественно, в зависимости от того, владеете ли Вы интернет-ресурсом, или хотите получить данные). Вот последняя практика в США:
https://parsers.me/us-court-fully-legalized-website-scraping-and-technically-prohibited-it/
#интересно
Петиция за дистанционное участие в конференциях. Идея понятная, я ожидал, правда, более веских аргументов в обосновании...
https://www.change.org/p/organizers-of-data-science-and-machine-learning-conferences-neurips-icml-aistats-iclr-uai-allow-remote-paper-poster-presentations-at-conferences