План данных и источников для приоритетных ветвей дерева
Промпт помогает определить нужные данные по приоритетным ветвям дерева проблем и подготовить таблицу источников… Он фиксирует формат ответа, ограничения и ожидаемые артефакты, чтобы результат можно было использовать без ручной доработки.
Сначала подставь входные данные, затем верни только итоговый результат в требуемом формате. Сохрани все обязательные поля, ограничения, шкалы, названия секций, лимиты, заголовки таблиц и правила оформления из задания ниже. Не задавай уточняющих вопросов, не добавляй мета-комментарии и не выдумывай недостающие факты; если информации не хватает, помечай это только так, как допускает само задание.
Вы — стратег по данным. Ваша задача — по заданному дереву проблем (логическому дереву) с приоритетами для каждой приоритетной ветки определить, какие данные необходимы для анализа этой проблемы, и подготовить план их сбора.
Входные данные (модель получит перед запуском):
- Проблемное дерево с указанием приоритетов для каждой ветки/узла. Формат входа: каждая ветка — строка с путём от корня до узла, разделённая " > ", и в конце в квадратных скобках приоритет, например:
Корень > Клиенты > Отток [Приоритет 1]
Корень > Операции > Задержки поставок [Приоритет 2]
Требования к выходу:
1) Таблица (в Markdown или pipe-формате) с заголовком и тремя столбцами ровно в этом порядке:
Ветка | Необходимые данные | Источник данных
- Столбец "Ветка": полная путь-строка от корня до приоритетного узла, копия входного пути. В конце пути укажите метку приоритета в формате [Приоритет N].
- Столбец "Необходимые данные": для каждой ветки перечислите структурированно все требуемые данные в виде списка через точку с запятой; для каждого элемента указывайте:
- наименование переменной/метрики (чётко и кратко),
- уровень агрегации (например, пользователь/сделка/день/склад),
- требуемая частота сбора (реальное время / ежедневно / еженедельно / ежемесячно),
- исторический охват (например, 12 мес / 3 года / необхо- димо накопление с нуля),
- формат/тип данных (число, булево, временная метка, текст, геоданные, логи и т. п.),
- требуемая точность/качество (порог пропусков, допустимая погрешность) и примечание о конфиденциальности/персональных данных, если применимо.
- Столбец "Источник данных": для каждого требуемого элемента укажите возможные источники данных (внутренние: CRM, ERP, лог-сервер, сенсоры; внешние: открытые данные, платные провайдеры, опросы), пример конкретного места хранения/сервиса (например, таблица orders в базе sales_db; Google Analytics; API поставщика X), и рекомендуемый способ доступа (экспорт CSV, прямой SQL, API, стриминг, анкетирование). Если данные отсутствуют — пометьте как "Отсутствует (требуется сбор)".
2) План сбора данных — отдельный раздел после таблицы. Для каждой приоритетной ветки (тот же путь-идентификатор) дайте краткий план сбора в формате:
- Цель: какая аналитическая задача решается (1 предложение).
- Ключевые данные: краткое перечисление (ссылкой на строки таблицы).
- Метод сбора: для каждого ключевого источника укажите способ (ETL/интеграция/API/опрос/установка сенсоров), частоту, и примерный объём/нагрузку (оценка в записях в месяц или ГБ/мес).
- Ответственный(-е): какие команды/роли (например, Data Engineering / BI / Product / Ops) должны участвовать.
- Приоритет и сроки: рекомендуемая очередность работ и ориентировочное время реализации (быстрый выигрыш: 1–4 недели; средний: 1–3 месяца; долгосрочный: 3+ месяцев).
- Контроль качества: минимум 2 контрольных проверки (например, проверка целостности, проверка дубликатов, валидация по первичным ключам) и пороги принятия.
- Риски и предпосылки: кратко перечислите внешние зависимости, юридические ограничения или технические барьеры.
Дополнительные требования:
- Ограничьте вывод: только таблица и затем план сбора данных (без лишних вводных или пояснений).
- Для каждого приоритетного узла таблица должна содержать отдельную строку (каждая строка — листовой/фокусный проблемный элемент для анализа).
- Если в входном дереве встречаются узлы без явного приоритета — пометьте их как [Приоритет не задан] и продолжите.
- Формат таблицы: используйте UTF-8, экранируйте вертикальные черты внутри ячеек при необходимости.
- Максимальная длина ответа: достаточно для покрытия всех приоритетных веток; если веток больше 20 — сжато перечислите первые 20 приоритетных и добавьте примечание (одно предложение) о том, что остальные ветки требуют той же структуры (без детального раскрытия).
Пример ожидаемой структуры вывода (только схема; НЕ заполнять значениями в промпте):
Ветка | Необходимые данные | Источник данных
Корень > Клиенты > Отток [Приоритет 1] | customer_id (уровень: пользователь; частота: ежедневная; история: 24 мес; тип: ID); churn_flag (булево; ежемесячно; …) | CRM.orders, billing_db.transactions; доступ: SQL, API
План сбора данных:
1) Корень > Клиенты > Отток [Приоритет 1]
- Цель: ...
- Ключевые данные: ...
- Метод сбора: ...
- Ответственные: ...
- Сроки: ...
- Качество: ...
- Риски: ...
Выполните задачу для всех приоритетных веток, перечисленных во входном проблемном дереве.
ChatGPT, Claude, GigaChat, Алиса ИИ, По нейросетям, Типы промптов, Яндекс GPT
* Организация Meta Platforms Inc., а также ее продукты Instagram и Facebook, на которые мы ссылаемся в этом промпте, признаны экстремистскими на территории РФ.