Помочь разобраться в статье. Добрый день! Есть статья описывающая работу библиотеки xgboost: https://arxiv.org/pdf/1603.02754.pdf. Реализация самой библиотеки незначительно отличается от статьи. В частности Logloss дерева в ней сумма а не среднее арифметическое от loss по наблюдениям, а Gain не делится на 2. Тем не менее, в статье написано что Gain отображает уменьшение Logloss при разбиении узла на два новых листа. Я строю два дерева, и хочу эмпирчески увидеть эту связь (см. рисунок красный цвет).Тем не менее она не наблюдается. Требуется подсказать насколько уместно производить это сравнение, а также продемонстрировать как выводится градиентный бустинг математически.
Разработка с нуля, доработка существующего продукта, настройка, тестирование. Ищу интегратора CRM для совместной работы и партнёрства (с меня продажи, с вас реализация проектов). Для начала общения нужно написать отклик сюда. Хорошо, если у вас есть 2-3 кейса (проекты, где вы уже настраивали воронку и задачи для клиента, а также интегрировали телеграмм, вотсап, почту, соцсети и телефонию для сбора заявок. Если у вас есть специализация, тоже напишите об этом.
Разработка с нуля. Необходимо построить модель прогноза цен на золото на основе меняющихся переменных (инфляционные ожидания, валютные курсы, м1). Желательно с использованием support vector machine.
Data Science. Настройка. Добрый день! 1.У меня есть рабочая почта Яндекс, мне приходит около 1800 писем ежедневно. Возможно ли отсортировать письма по теме письма, я иногда пропускаю важные. Хотелось бы упорядочить письма по запросам, чтобы не путаться в них. 2. У меня есть много точек на карте Москвы и России, у каждой точки есть контактная информация, возможно ли сделать редактируемый файл с указанием локаций и данных этих точек. Наглядный, простой и понятный. 3. Можно ли сделать автоматические ответы в Яндекс почте? 4. Можно ли автоматически прислать смс с данными после звонка? Не копировать из заметок, а из программы?бесплатно) Это для тех, кто разбирается в 1С, можно ли автоматически подгружать по форме данные в 1С. Условно: приходят файлы по определенной форме с данными, в форме pdf, jpg, там одни и те же поля. Сейчас я вставляю и копирую их в программу, возможно ли это автоматически сделать?.
Data Science. Решить задачу. Добрый день, необходимо решить 2 задачи из приложенного файла, все данные проверены, уникальные, пропусков нет. Что нужно сделать – удалить тех респондентов, которые на этапе калибровки продемонстрировали неадекватные (с точки зрения распределения) значения проявления эмоций. Посчитать сдвиг эмоционального отклика для каждой секунды контента относительно среднего по калибровке для каждого респондента. Результат необходимо предоставить в формате файла .ipynb. На выходе алгоритма нужно иметь для оставшихся и удаленных респондентов, список id для каждого сегмента, данные сдвига по каждому респонденту/эмоции. Дать комментарии к логике решения задачи. Обращаем внимание, что в файле необходимо отразить всю последовательность расчетов Вводные: • Хронометраж ролика 15’ • база данных измерений респондентов с посекундной фиксацией 7ми эмоций (neutral, happy, surprise, sad, angry, fear, disgust) с id респондента, • формула сдвига эмоции - Em_sec_shift = (Em_sec/Em_avg_cal - 1) * 100% (значение эмоции в секунде/средняя по эмоции на калибровке (12 сек). • Калибровка – первые 12 секунд записи рекламного ролика (значения с 1 по 12 в ячейке для каждой эмоции отдельного респондента (id) . • Данные по хронометражу рекламного ролика – после 13 секунды включительно (значения с 13 в ячейке для каждой эмоции отдельного респондента (id) . • Значений может быть больше, чем 27 (12+15) – погрешности измерени . Задание 2. Что нужно сделать – выделить паттерны (по схожести реакции) восприятия среди выборки респондентов, где замерялось эмоциональное восприятие рекламного ролика. Результат необходимо предоставить в формате файла. ipynb. На выходе алгоритма нужно иметь список id для каждого паттерна и графическую визуализацию. Обращаем внимание, что в файле необходимо отразить всю последовательность расчетов Вводные: • из задания Для первой задачи максимальное значение 27.
Data Science. Разработка с нуля. Программа на Python. Прогноз курса монетки на 1 час вперед . На Бинанс , данные API бинанс дает все которые нужно. Требуемые данные: 1. Анализ движения монеты за прошлый период. Важно корриктировка по дням недели 2. При прогнозе Важно, чтоб монетка смотрела и корректировал прогноз в зависимости от движения биткоина. 3. Важно чтоб робот смотрел на объемы предложения-спроса и на основе этого корректировал свой прогноз каждые 10 мин, при изменениии(прогноза) более чем на 40 пунктов отправлял в телегу новые прогноз 4. Врема погноза нужно в промежутке от 12-10 ам. до 18-30 рм. И требуется прогноз каждый час , в этом промежутке времени. Если есть корректировка более 40 пунктов, робот указывает на это в телегу. 5. Еще одна корреляция отслеживания по изменению биткоина, т.е робот видит , что монетка пошла резко вниз(или вверх) а биткоин в это время не движется, тогда мы понимаем, что это разовая продажа(только этой монеты)(просто минутная манипуляция) в этом случае нам это тоже интересно и это робот указывает как не стандартное поведение. 6. Отправка данных(прогноз на час) в телегу.
найти данные действующих строек. Нужен человек который найдет и соберет данные по действующим стройкам в городах: МСК и МО, Нижний Новгород, Питер, Казань.
Data Science. Доработка существующего продукта, разработка с нуля. Есть отчет в эксель, где аккумулируются данные по движению денежных средств. В отдельных вкладках собираются данные с каждого счета. Эти вкладки заполняются вручную через копирование и адаптирование данных из каждой выписки(также эксель). Этот процесс повторяется каждую неделю и занимает много времени, так как выписок много. Можно ли автоматизировать этот процесс?.
Разработка с нуля, Обработка и анализ имеющихся массивов данных. Собрать данные из архива Обработать данные по операционной деятельности(не не финблок) Построить модель для анализа данных Обучить работе с моделью.
Разработка ПО. Data Science. Доработка существующего продукта. Необходимо спроектировать аналитическую платформу больших данных на базе архитектуры Hadoop.
Data Science. Настройка. Необходимо категоризировать список товаров. Для каждого SKU( наименования товара) надо прописать одну из 20 обобщающих категорий. Количество SKU более 31 млн штук. Цена договорная.
Data Science. Написать веб парсер. Добрый вечер! Требуется спарсить порядка 300к контента с двух сайтов. Тип файла картинки. https://www.deviantart.com/ https://www.artstation.com/?sort_by=community&dimension=all По 150к с каждого ресурса.
Аналитика филиала бизнеса. Г.Сочи!!! - необходимо провести аналитику проходимости и пассажиропотоков филиала, просчитать поток, часы пик и др. (Хотим предложение) - провести исследование района филиала (якорные места, жилые массивы, вокзалы и тд).
Разработка с нуля. Формирование корпуса текстовых данных (на основе парсинга двух-трех новостных сайтов за определенный период времени (несколько месяцев) по заданной теме; обработка корпуса (очистка); некоторые элементы анализа (например, облако слов, сентимент).
Решить кейс. Необходимо решить кейс из 2-ух заданий: 1. Написать не сложный SQL код (данные из CRM (их немного), сфера: фармацевтика). 2. Рассчитать необходимое количество FTE (кол-во необходимых сотрудников), проанализировав данные (5 листов с разными данными, но их не прям много) в Excel, здесь лучше понимать специфику работы фармацевтической компании (но формулы в инете никто не отменял ?), чтобы предложить логические выводы и оптимизацию.
Data Science. Разработка с нуля. Необходимо разработать гугл скрипт, который будет собирать всех пользователей, которые имеют доступ к файлам и папкам в начальной директории в гугл диске, а затем преобразовывать этот список в удобном виде. Ссылка на ТЗ: https://drive.google.com/drive/folders/17tecmZgvDhjbq-SzK1Ou-6y3LP8wjI2U?usp=sharing.
Data Science. Разработка с нуля. Нужно в гугл докс сделать таблицу с подвязкой по апи что бы информация вся сама подтягивалась и рассчитывала потребность исходя из данных. Пример таблицы, тут расчет за предыдущие 14 дней. Стоимость работы обсуждается.
Data Science. Специалист по блокчейну. Нужно зарегистрировать меня на маркетплейсе nft и привязать туда кошелёк с криптой, объяснить, как я могу продавать nft.
Помощь в изучении математики XgBoost библиотеки и разбор её paper. Требуется ответить на ряд вопросов по математике описсаной в статье https://arxiv.org/pdf/1603.02754.pdf это официальная публикаци метода градиентного бустинга XgBoost.
Data Science. Консультация, помощь в составлении плана/текста/графиков. Тема: "Планирование ресурсов предприятия по производству стройматериалов на основе имитационного моделирования/оптимизации" Требуется помощь в составлении некоторых глав работы, а также в составлении таблиц, работы с запросами, сборе и анализе данных.
Анализ трафика из разных соц сетей. Делаем рекламу в разных соц сетях и нужно собрать все данные в эксель таблицу для определения эффективности каждого источника.
Data Science. Разработка с нуля. На Питоне(Python) . Нужно создать простейшую нейроную сеть, по анализу данных. Можно взять из существующих, только вставить мои ссылки откуда надо брать данные. По прогнозу движения рынка крипта(или рынок акций). Т.е есть график цены, программа должна брать и обновлять данные движения цены и делать прогноз на следующий период 24 часа/12часов, по самым низким и самым высоким значениям(цены).
Подготовка к экзамену. Прошу ознакомиться с прикрепленным файлом - там все темы. Перевод на русский через переводчик. Если вы в курсе этих тем, то вся информация будет предоставлена (скрипт профессора). Необходимо: - проработать известные вопросы экзамена. - заполнить пробелы и возможное недопонимание. Знаменитого профессора или профессионала я не ищу. Мне нужен просто адекватный человек, кто в курсе про машинное обучение, как это работает и как это объяснить - ни больше ни меньше. Прям совсем глубоко копать в глубину - тоже не надо. Необходимо понимание только основных принципов. С нуля объяснять не требуется. Необходимо только проработать некоторые темы. Занятия только онлайн - ехать никуда не надо. По времени подстроиться для меня не проблема. Рассматриваю человека на долгосрочную перспективу, тк в ближайшем будущем будут задания на эту тему и скорее всего опять понадобиться помощь. Корректировка цена возможна - обговаривается лично. Язык преподавания: русский. Оплата: почасовая. Благодарю за внимание моей заявке.
Анализ уже сделанных таблиц. Задача: научиться писать комментарии уже к подготовленным таблицам с данными 1) таблицы связаны с tcfa, территории(ОТС и rx), Цп по врачебному направлению и т.д 2. Бизнес связан с фармой.
Data Science. Разработка с нуля. 1) Создать пустой pandas DataFrame, состоящий из 3-х колонок с произвольными названиями. 2) Создать класс, требующий входной параметр: N, где N — цело число, которое будет равно числу строк в таблице. 3) Внутри класса создаются: - функция_1, генерирующая N случайных значений и записывающая их в каждую колонку pandas DataFrame (для каждой колонки значения разные). Выходом функции является готовый набор данных, состоящий из трех колонок и N строк. - функция_2 с входным строчными аргументами S1 и S2 — названиям двух колонок из датасета, созданого функцией_1. Эта функция должна возвращать точечный график с переменными, взятыми из колонки S2 (ОУ) в зависимости от значений S1 (ОХ) - функция_3, выдающая среднее, стандартное отклонение и коэффициент асимметрии по каждой колонке датасета из функции_1.
Работа с готовым набором данных. Построение сетевой модели на основе сопряженных наблюдений с учетом весов. Есть 5 датасетов (всего 3 тыс. наблюдений), которые представляют уровни. В каждом из уровней в предыдущем несколько наблюдений соответствуют одному наблюдению из последующего. Есть также тупиковые связи, которые прерываются. Задача состоит в построении интерактивного графика сети с возможностью переключения на доп. переменные, которые определяют силу связи и вес наблюдения. Также важно учесть иерархию (упомянутые 5 уровней).
Тестирование, доработка существующего продукта. Работа с CSV-файлом. Нужен специалист с образованием Data-Science. Есть CSV-файл, в котором 800+ строк. Необходимо привести его в подобающий вид и после этого выполнить ряд команд на извлечение данных по определенным запросам (около 20 запросов). Примеры запросов дам кандидатам. Пишите свой опыт работы. Время на выполнение задания 1 час 30 мин. Цена обсуждается.
объяснение в работе кода питон (дата сайнс). Объяснить, как работает код решения соревнования на kaggle (мне нужно защитить его на презентации). Т.е. подробно расписать каждую строчку кода, и концептально объяснить идею подхода к решению https://www.kaggle.com/code/jiprud/simple-light-gbm.
Мелкая доработка учебного проекта по замечаниям ревьювера с обьяснением проделланого. При выполнении учебной работы по обучении моделей ревьювер сделал замечания. С двумя из них я не смог разобраться. 1. Кодирование после разделения на выборки 2. Использовать прямое кодирование при Линейной регрессии (если после нее используются еще модели с деревом решений). Необходимо доделать работу по замечаниям ревьювера и обьяснить доделки. (необязательно, но желательно подсказать другие способы решения, нежели принятые).
Почему стоит искать работу для фриласнеров по профилю data scientist в Москве у нас?
🔸 Более 3 предложений о работе за сегодня в тематике data scientist
🔸 Работа и подработка на бирже фриланса от прямых заказчиков, которым нужна помощь специалистов по профилю data scientist уже сегодня!
🔸 Свежих заказов на data scientist в Москве для фрилансеров на октябрь 2026 года — 182 шт.
Как найти удалённую работу для фриланс-специалистов по профилю data scientist в Москве?
Вы специалист по data scientist и ищете проекты и заказы на удалёнке в Москве? Нам всегда есть что вам предложить. Ежедневно мы публикуем новые проекты и заказы по вашей специальности. Найдите интересную работу уже сегодня
Сколько проектов для IT-специалистов по профилю data scientist в Москве?
На октябрь 2026 года опубликовано 182 предложений удалённой работы от прямых заказчиков для исполнителей по специализации data scientist
Сколько можно заработать выполняя проекты по data scientist?
Специалисты по профилю data scientist зарабатывают от 0.00 рублей с заказа. Хотите больше? Выполняйте как можно больше заказов и зарабатывайте сколько пожелаете