
Деревья решений — способ визуализации предсказательной модели, понятный даже ребенкуЭтот пост — продолжение серии.Первая часть — здесьВторая часть — здесь В серии постов о визуализации предсказательных моделей поговорим об одном из самых наглядных инструментов — дереве решений (decision tree). Для того, чтобы понять, как работают регрессионные предсказательные модели, необходимо приложить определенные усилия. Поэтому мы вряд…

В первой части этого кейса Дамир Ильдарович Марапов у себя в канале разобрал методологическую сторону: что такое конфаундинг, почему в нерандомизированном исследовании простого сравнения групп может быть недостаточно и как подходить к выбору потенциальных конфаундеров.А здесь разберём тот же пример уже практически — в R. Напомню исходные данные: 120 пациентов после планового хирургического вмешательства, по…

Пост подготовлен совместно с медицинским кибернетиком Еленой Филипповой, автором канала MedData Lab. В клинических исследованиях есть понятие конфаундеров — вмешивающихся, или спутывающих, факторов. Это признаки, которые связаны как с изучаемым исходом, так и с воздействием, не являясь при этом промежуточным звеном влияния воздействия на исход. Часто к ним относятся возраст, тяжесть заболевания, наличие сопутствующих заболеваний…

Если вы читали книгу или смотрели фильм «Автостопом по галактике», то, конечно, помните, какой универсальный ответ дал мегасуперкомпьютер Думатель на «основной вопрос о жизни, вселенной и вообще»: 42. Ответ-то есть. Но, к сожалению, без четко сформулированного вопроса он является бессмысленным, абстрактным. Мне кажется, этот сюжет отлично описывает ситуацию, когда исследователь, не задумываясь, применяет какой-то статистический…

Выбираем статистический метод исходя из проверяемой гипотезы Данный подход состоит в том, что вначале исходя из решаемой задачи нужно определить проверяемую нулевую гипотезу. Нулевая гипотеза — это предположение об отсутствии эффекта (различий, связи, изменений и т.д.). В большинстве случаев мы желаем опровергнуть нулевую гипотезу с помощью p-значения. Если p окажется ниже уровня значимости (например, p<0.05), делаем…

Продолжаем тему ред флагов при прочтении раздела «Материалы и методы». В этом посте — причины заподозрить некачественный анализ по описанию статистических методов. Ошибочные, несуществующие названия критериев, терминов. Букву t в названии теста Стьюдента сложно перепутать с другой, а вот критерию хи-квадрат Пирсона часто достается! Греческую букву «хи», χ авторы заменяют на «кси», ξ. Запрос в Elibrary выдал…

Неправильное название программы Особенно часто вызывает проблемы с написанием название программы Microsoft Excel, например: Статистический анализ проведен с использованием программы Exel. (Акушерство и гинекология, 2025) Накопление, корректировка, систематизация исходной информации и визуализация полученных результатов проводилась в электронных таблицах Microsoft Exell (Вестник новых медицинских технологий, 2025) Но и с другими программами могут возникнуть сложности, например, с…

Как мы видим, на сегодняшний день накоплено достаточно данных, опровергающих целесообразность проверки на нормальность распределения. В связи с этим совместно с коллегами Максимом Кузнецовым (автором блога Biostatistics on the Table) и Матвеем Славенко (автором блога душно про дату) и при поддержке сообщества BioStat <- R | Чат по статистике и R был подготовлен алгоритм действий исследователя…

Эта тема вот уже не первый год будоражит все статистические чаты. Проверять или не проверять количественные данные на нормальность распределения перед анализом количественных данных? Начну с истории. Некоторые коллеги-математики и биостатистики удивляются популярности алгоритма выбора метода в зависимости от нормальности распределения в медицинских исследованиях. Возможно, мой краткий экскурс раскроет некоторые предпосылки этого явления. Сразу оговорюсь,…

Можно по-разному относиться к применению искусственного интеллекта в науке для генерации идей или описания результатов. Но польза ИИ при подготовке обзоров — очевидна и вызывает значительно меньше возражений. В настоящее время большинство систем для поиска публикаций в интернете используют в своих алгоритмах ИИ. Однако есть одна проблема — галлюцинации. Это означает, что ИИ, когда не…
Новости
Самое главное — запущена реферальная программа! С её помощью можно будет получить большие скидки на приобретение доступа к StatTech. Вплоть до 100% от её стоимости! А ещё добавлены новые инструкции — по линейной и логистической регрессии, ROC-анализу, сравнению связанных групп (анализу до-после). Подробную информацию о новых функциях читайте по этой ссылке.
У нашей программы Статтех вышла новая версия! Обновление — долгожданное: до этого крайний раз обновлялись в июле. Обновление — объемное: появился такой обширный и важный функционал, который позволил нам присвоить этой версии новый номер — 3.0.