Обсуждение:Причинное машинное обучение

Материал из MachineLearning.

(Различия между версиями)
Перейти к: навигация, поиск
 
(1 промежуточная версия не показана)
Строка 1: Строка 1:
-
== Как строилась статья ==
+
Статья была сделана с помощью '''GPT-5.6 Terra High'''. Первый промпт был такой:
-
 
+
-
Я выбрал тему причинного машинного обучения, потому что мне было интересно отличие прогноза от оценки последствий действия. В первом запросе я хотел получить понятную статью, которая начинается с простого примера и постепенно переходит к основным методам.
+
{{well|
{{well|
-
Ты хорошо разбираешься в машинном обучении, статистике и причинном выводе. Напиши подробную энциклопедическую статью для MachineLearning.ru про причинное машинное обучение (causal machine learning) на русском языке.
+
Напиши подробную статью про причинное машинное обучение. Объясни простыми словами, чем обычный прогноз отличается от оценки последствий какого-либо действия.
-
Начни с простой мотивации: почему модель, которая умеет предсказывать, ещё не умеет отвечать на вопрос о последствиях вмешательства. Потом постепенно перейди к более формальной части.
+
Расскажи про причинные графы, вмешательства, контрфактические вопросы, конфаундеры и структурные причинные модели. Ещё добавь потенциальные исходы Y(1) и Y(0), ATE, ATT, CATE, propensity score, причинные леса и causal discovery.
-
Объясни разницу между обычным предсказанием, вмешательством и контрфактическим вопросом. Расскажи про причинные графы, структурные причинные модели, конфаундеры, потенциальные исходы Y(1) и Y(0), ATE, ATT, CATE, propensity score, причинные леса и causal discovery. Покажи, где такие методы реально применяются и какие у них есть ограничения.
+
Начни с понятного примера, а потом постепенно переходи к формулам и более сложным методам. Добавь реальные примеры применения, ограничения, внутренние ссылки и нормальные научные источники. Ничего не выдумывай.
-
Статья должна быть понятной студенту, но не примитивной. Добавь внутренние ссылки на связанные статьи, реальные научные источники и список литературы. Не выдумывай факты, результаты исследований, авторов и DOI.
+
Оформи текст в вики-разметке. Формулы пиши через <tex> и </tex>, а перед отдельными формулами ставь два двоеточия.
-
 
+
-
Используй обычную вики-разметку MachineLearning.ru. Формулы пиши через <tex> и </tex>; отдельные формулы выделяй двойным отступом через два двоеточия.
+
}}
}}
-
В первом результате мне не хватило точного объяснения условий идентификации и некоторых практических методов. Ещё нужно было исправить оформление формул и понятнее описать ограничения causal discovery. Поэтому я сделал второй запрос.
+
С первого раза получилось в целом нормально, но не хватало условий, при которых причинный эффект вообще можно оценить. Некоторые практические методы были описаны слишком коротко, а causal discovery выглядел так, будто он может сам восстановить причинные связи из любой таблицы. Ещё надо было поправить оформление формул.
 +
 
 +
Второй промпт был такой:
{{well|
{{well|
-
Статья в целом получилась хорошей, но перепиши и доработай её как научный редактор.
+
Доработай статью. Добавь условия идентификации причинного эффекта: согласованность, отсутствие неучтённого смешения, позитивность и отсутствие интерференции. Объясни критерий задней двери и покажи формулу корректировки.
-
 
+
-
Добавь отдельный раздел про условия идентификации причинного эффекта: согласованность, отсутствие неучтённого смешения, позитивность и отсутствие интерференции. Объясни критерий задней двери и приведи формулу корректировки.
+
-
 
+
-
Расширь раздел про практические методы: matching, propensity score, inverse probability weighting, двойную устойчивость, double machine learning и причинные леса для оценки CATE. Отдельно и аккуратно объясни, почему causal discovery не может автоматически восстановить направление причинности из любой таблицы наблюдений.
+
-
Для важных редких терминов указывай английское название в скобках. Не растягивай текст пустыми общими фразами, не рекламируй продукты и не придумывай источники. Оставь текст живым и энциклопедическим, а не похожим на шаблонный ответ нейросети.
+
Подробнее напиши про matching, propensity score, inverse probability weighting, двойную устойчивость, double machine learning и причинные леса для CATE. Отдельно объясни ограничения causal discovery и почему по обычным наблюдениям не всегда можно определить направление причинности.
-
Проверь всю разметку: вместо <math>...</math> используй <tex>...</tex>. Для отдельных формул ставь перед строкой два двоеточия. Верни готовую статью целиком.
+
Убери лишние общие фразы и проверь источники. Все формулы оформи через <tex> и </tex>, отдельные формулы начинай с двух двоеточий. Верни статью целиком.
}}
}}
-
После второго запроса я проверил итоговый текст и исправил найденные неточности. Также я привёл формулы, ссылки и остальную вики-разметку в порядок.
+
После второго запроса я вручную проверил статью, поправил формулы и ссылки, а также убрал несколько слишком общих формулировок. Отдельно посмотрел, чтобы методы причинного вывода не описывались как работающие без необходимых предположений.
[[Участник:Oleg Batsiev|Oleg Batsiev]]
[[Участник:Oleg Batsiev|Oleg Batsiev]]

Текущая версия

Статья была сделана с помощью GPT-5.6 Terra High. Первый промпт был такой:


Напиши подробную статью про причинное машинное обучение. Объясни простыми словами, чем обычный прогноз отличается от оценки последствий какого-либо действия.

Расскажи про причинные графы, вмешательства, контрфактические вопросы, конфаундеры и структурные причинные модели. Ещё добавь потенциальные исходы Y(1) и Y(0), ATE, ATT, CATE, propensity score, причинные леса и causal discovery.

Начни с понятного примера, а потом постепенно переходи к формулам и более сложным методам. Добавь реальные примеры применения, ограничения, внутренние ссылки и нормальные научные источники. Ничего не выдумывай.

Оформи текст в вики-разметке. Формулы пиши через <tex> и </tex>, а перед отдельными формулами ставь два двоеточия.


С первого раза получилось в целом нормально, но не хватало условий, при которых причинный эффект вообще можно оценить. Некоторые практические методы были описаны слишком коротко, а causal discovery выглядел так, будто он может сам восстановить причинные связи из любой таблицы. Ещё надо было поправить оформление формул.

Второй промпт был такой:


Доработай статью. Добавь условия идентификации причинного эффекта: согласованность, отсутствие неучтённого смешения, позитивность и отсутствие интерференции. Объясни критерий задней двери и покажи формулу корректировки.

Подробнее напиши про matching, propensity score, inverse probability weighting, двойную устойчивость, double machine learning и причинные леса для CATE. Отдельно объясни ограничения causal discovery и почему по обычным наблюдениям не всегда можно определить направление причинности.

Убери лишние общие фразы и проверь источники. Все формулы оформи через <tex> и </tex>, отдельные формулы начинай с двух двоеточий. Верни статью целиком.


После второго запроса я вручную проверил статью, поправил формулы и ссылки, а также убрал несколько слишком общих формулировок. Отдельно посмотрел, чтобы методы причинного вывода не описывались как работающие без необходимых предположений.

Oleg Batsiev

Личные инструменты