Сравнение моделей

Обратная связь по результатам оценки

← Ко всем сравнениям

15 моделейЛидер: Claude Opus — 9.3К результатам ↓

Промпт

Ты — руководитель, который проводит оценочную встречу. По итогам оценки сотрудника подготовь развивающий фидбэк: начни с сильных сторон, затем опиши 1–2 зоны роста через конкретные наблюдаемые действия и их влияние на результат, предложи следующие шаги и договорённость о проверке прогресса. Отделяй факты от интерпретаций, не оценивай личность и не используй общие фразы без примеров. Тон — уважительный, прямой и поддерживающий. Данные оценки: [вставьте цели, результаты, примеры поведения и ожидания на следующий период].

Критерии оценки

  • Конкретность — до 10 баллов
  • Баланс сильных сторон и зон роста — до 10 баллов
  • Действенность — до 10 баллов
  • Тон — до 10 баллов

Ответы моделей

  1. Claude OpusОтвет получен через APIСредняя оценка: 9.3

    Оценочный фидбэк: middle product analyst, период 6 месяцев

    Начну с сильных сторон

    За полгода ты сделал несколько вещей, которые реально повлияли на работу команды.

    Дашборд воронки регистрации. Ты выкатил его на 2 недели раньше срока, и продуктовая команда теперь опирается на него на еженедельных встречах. Факт: инструмент вошёл в регулярный процесс, а не лёг в стол. Это признак того, что ты делаешь не «отчёт ради отчёта», а решаешь задачу под конкретное использование.

    Ошибка в расчёте конверсии. Ты нашёл дефект, из-за которого показатель был завышен на 7 п.п., и не просто сообщил о нём, а организовал пересчёт истории. Здесь два разных навыка сразу: критичность к собственным данным и готовность взять на себя неприятную, но нужную работу по исправлению. Завышенная на 7 пунктов конверсия — это неверные продуктовые решения, и ты это остановил.

    Обе ситуации я читаю одинаково: тебе можно доверять данные, и ты доводишь дело до результата, а не до формального «сделано».

    Зоны роста

    Их две, и обе — про переход от «сильного исполнителя» к «ведущему инициативу». Это ровно та планка, на которую ты сейчас выходишь.

    1. Критерии решения фиксируются после старта, а не до.

    Наблюдаемый факт: в исследовании причин оттока ты начал расчёты без согласованных критериев успеха. Через 5 рабочих дней часть анализа пришлось переделать.

    Влияние на результат: потеря около недели работы — твоей и косвенно команды, которая ждала выводов. Дело не в качестве расчётов, а в том, что цель анализа не была зафиксирована на входе, и посчитанное не совпало с тем, что было нужно для решения.

    Моя интерпретация (отделяю от факта): здесь не пробел в аналитике, а пропущенный шаг согласования рамки до начала работы. Навык считать у тебя есть; не хватает привычки сначала договориться, что именно и зачем считаем.

    2. Данные есть, рекомендации нет.

    Наблюдаемый факт: на 2 встречах ты представил много корректных данных, но не сформулировал рекомендацию. Руководитель продукта отдельно запросил вывод и следующий шаг.

    Влияние на результат: работа по сбору и проверке данных сделана, но решение из неё не следует автоматически — его пришлось «вытаскивать» дополнительным запросом. Часть ценности твоего анализа осталась нереализованной в моменте.

    Моя интерпретация: ты доводишь анализ до цифр, но останавливаешься на шаг раньше вывода. Аудитории на встрече нужна не таблица, а «вот что это значит и что я предлагаю сделать».

    Отдельно отмечу помощь новому аналитику с витриной. Факт: ты помог, и это хорошо. Но исправления ты сделал сам, вместо того чтобы объяснить подход. Влияние: коллега получил рабочую витрину, но не получил способ решать такие задачи самостоятельно в следующий раз. Это та же тема, что и выше, — сместить фокус с «сделать результат» на «сделать так, чтобы результат появился и без тебя».

    Следующие шаги

    Конкретные и проверяемые действия на следующий период:

    1. Перед любой аналитической инициативой — короткий одностраничный входной документ: вопрос, гипотезы, критерии успеха и что считаем решением. Согласуем его со мной или заказчиком до старта расчётов. Цель — чтобы ситуация с оттоком не повторилась.
    2. Каждый вывод анализа завершается блоком «Рекомендация + следующий шаг». Не «вот данные», а «данные показывают X, предлагаю Y». Даже если рекомендация предварительная — она должна быть озвучена тобой, а не запрошена.
    3. Провести младшего коллегу через одну задачу без подмены. Ты объясняешь подход и ревьюишь его работу, но правки вносит он сам. Договоримся заранее, какая это будет задача.
    4. Взять одну инициативу end-to-end — от постановки до вывода — и вести её самостоятельно, с фиксацией критериев на входе.

    Это и есть твоя цель на период: самостоятельно вести инициативы, заранее фиксировать критерии, завершать вывод рекомендацией и провести младшего через задачу без подмены его работы.

    Договорённость о проверке прогресса

    Предлагаю так: чек-ин раз в 2 недели, 30 минут. Смотрим на конкретику, не на ощущения:

    • по каждой новой инициативе — был ли входной документ с критериями до старта (да/нет);
    • по каждой презентации данных — прозвучала ли рекомендация от тебя без отдельного запроса (да/нет);
    • статус задачи с младшим коллегой — на каком этапе, вносит ли правки он сам.

    Промежуточный срез через 6 недель, полноценный разбор — в конце периода. Если по ходу увидишь, что где-то буксует, — приходи раньше, не жди чек-ина.

    Скажи, с чем не согласен и что из следующих шагов кажется нереалистичным по нагрузке — скорректируем, пока не начали.


    Задача закрыта. Если следующая несвязанная — открой новый чат.

    Разница между оценками судей: недоступна: учтена оценка только одного судьи.

    Комментарии судей

    • ChatGPT Sol: 9.25 — Ответ опирается на конкретные факты, показывает влияние действий и задаёт измеримые следующие шаги с регулярной проверкой прогресса. Сильные стороны и зоны роста сбалансированы, тон прямой и поддерживающий. Минусы: фактически выделены 3 зоны роста вместо 1–2; «потеря около недели» шире исходного факта о частичной переделке после 5 дней; выводы «критичность к собственным данным» и «тебе можно доверять данные» не полностью подтверждены данными. Финальная служебная фраза про закрытие задачи не относится к фидбэку и должна быть удалена.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 10 из 10
      • Тон: 9 из 10
  2. Qwen 3.5 PlusОтвет получен через APIСредняя оценка: 9.3

    Сильные стороны За последние полгода ты продемонстрировал высокую экспертизу и ответственность за качество данных. Дашборд воронки регистрации был запущен на две недели раньше срока, и продуктовая команда уже использует его на еженедельных встречах. Также ты самостоятельно выявил ошибку в расчёте конверсии (показатель был завышен на 7 п.п.) и организовал пересчёт исторических данных. Это напрямую повысило надёжность метрик и сэкономило время команды на принятие решений.

    Зоны роста

    1. Формализация критериев и финальных выводов
    • Наблюдаемое действие: В исследовании причин оттока расчёты начались без согласованных критериев успеха. На двух встречах ты представил корректные данные, но не сформулировал итоговую рекомендацию, из-за чего руководитель продукта отдельно запрашивал вывод и следующий шаг.
    • Влияние на результат: Отсутствие заранее зафиксированных критериев привело к переделке части анализа через 5 рабочих дней. Отсутствие готовой рекомендации в презентации увеличило цикл согласования и потребовало дополнительных итераций с продуктовой командой.
    1. Подход к передаче знаний
    • Наблюдаемое действие: При работе с новым аналитиком над витриной ты внес исправления самостоятельно, вместо того чтобы объяснить подход и логику правок.
    • Влияние на результат: Задача была решена быстрее в моменте, но знания не были переданы. Это ограничило самостоятельность junior-коллеги и увеличило твою операционную нагрузку на будущих похожих задачах.

    Следующие шаги Чтобы выйти на цель следующего периода — самостоятельное ведение инициатив с чёткими выводами и эффективное наставничество — предлагаю внедрить три практики:

    • Перед стартом любого исследования фиксировать в кратком брифе: критерии успеха, формат итогового вывода (рекомендация + следующий шаг) и дедлайн.
    • В презентациях придерживаться структуры «данные → интерпретация → рекомендация → запрос на решение», чтобы продукт-менеджеру не приходилось запрашивать вывод отдельно.
    • При менторстве использовать формат «парной работы»: задавать наводящие вопросы, просить коллегу проговаривать логику действий и давать ему пространство для самостоятельных правок под твоим контролем, а не подменять его работу.

    Договорённость о проверке прогресса Давай вернёмся к этому через 4 недели на короткой встрече. Обсудим, как прижился бриф с критериями, как изменилась структура твоих презентаций и как прошёл процесс наставничества по первой задаче. Если потребуется, скорректируем формат поддержки или добавим ресурсы. Готов обсудить, какие шаблоны или инструменты помогут тебе внедрить эти практики быстрее.

    Разница между оценками судей: 1.0

    Комментарии судей

    • Claude Opus: 8.75 — Сильный ответ, близкий к эталону. Конкретность высокая: везде опора на факты (2 недели раньше срока, 7 п.п., 5 рабочих дней, 2 встречи), явное разделение «наблюдаемое действие → влияние на результат». Действенность отличная: три конкретные практики (бриф с критериями, структура презентации данные→интерпретация→рекомендация, парная работа при менторстве) плюс договорённость о проверке через 4 недели. Тон уважительный, прямой, поддерживающий, на «ты», без оценки личности. Баланс чуть слабее: блок сильных сторон заметно короче зон роста и покрывает только 2 из достижений, а зона роста №1 склеивает два разных наблюдения (отсутствие критериев успеха и отсутствие рекомендации) в один пункт — их логичнее было развести. Мелочь: вступление «продемонстрировал высокую экспертизу и ответственность» — лёгкая обобщённая интерпретация, хоть и подкреплённая примерами.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 8 из 10
      • Действенность: 9 из 10
      • Тон: 9 из 10
    • ChatGPT Sol: 9.75 — Ответ опирается на конкретные факты, связывает действия с последствиями и сохраняет баланс между достижениями и зонами роста. Следующие шаги понятны и соответствуют цели сотрудника. Для максимальной действенности в проверку через 4 недели стоило добавить измеримые признаки прогресса: число инициатив с согласованным брифом, презентаций с рекомендацией и конкретную задачу для наставничества.
      • Конкретность: 10 из 10
      • Баланс сильных сторон и зон роста: 10 из 10
      • Действенность: 9 из 10
      • Тон: 10 из 10
  3. GLM 5.2Ответ получен через APIСредняя оценка: 9.1

    Привет! Спасибо за работу за последние полгода. Давай обсудим результаты оценки и планы на следующий период.

    Начну с твоих сильных сторон и того, какой результат они принесли. Факт: Ты запустил дашборд воронки регистрации на 2 недели раньше срока. Влияние: Продуктовая команда уже использует его на еженедельных встречах, что говорит о его высокой практической ценности. Факт: Ты нашёл ошибку в расчёте конверсии, из-за которой показатель был завышен на 7 процентных пунктов, и организовал пересчёт истории. Влияние: Это позволило восстановить точность данных, на которых строятся продуктовые решения, и избежать неверных выводов в будущем.

    Теперь хочу обсудить две зоны роста, где изменение подхода значительно усилит твой вклад как middle-аналитика.

    Зона роста 1: Проектирование рамок исследования до старта. Факт: В исследовании причин оттока ты начал расчёты без согласованных критериев успеха. Из-за этого через 5 рабочих дней часть анализа пришлось переделать. Влияние: Это привело к потере рабочего времени и сдвигу сроков получения результата командой. На следующем уровне развития аналитику важно не только корректно считать данные, но и заранее определять, по каким критериям мы поймём, что задача решена.

    Зона роста 2: Формулирование выводов и рекомендаций. Факт: На двух встречах ты представил много корректных данных, но не сформулировал рекомендацию и следующий шаг. Руководитель продукта запрашивал вывод отдельно. Влияние: Команда получает сырые данные, но не готовое аналитическое решение. Это снижает ценность твоих презентаций и перекладывает работу по интерпретации результатов на продакт-менеджера.

    Следующие шаги и договорённости: Твоя цель на следующий период — самостоятельно вести аналитические инициативы. Чтобы к ней прийти, предлагаю внедрить три привычки:

    1. Критерии успеха: Перед стартом любого нового исследования мы будем фиксировать критерии решения в коротком брифе или тикете. Расчёты начинаются только после их согласования со мной или продактом.
    2. Рекомендации: В структуру твоих сообщений, писем и презентаций всегда будет входить явный блок с выводом и конкретным предложением следующего шага.
    3. Менторство: Ты уже помог новому аналитику разобраться с витриной, но сделал исправления сам. В следующей задаче предлагаю тебе провести младшего коллегу через неё целиком, но в роли наставника: объяснять подход и логику, позволяя ему самому писать код и делать выводы, без подмены его работы.

    Проверка прогресса: Давай договоримся о двух точках контроля. Через месяц мы проведём короткую встречу (1-на-1), чтобы посмотреть, как прижилась практика фиксации критериев до старта и добавления рекомендаций в выводы. По итогам квартала обсудим, как прошла задача с младшим аналитиком и оценим твой прогресс в самостоятельном ведении инициатив.

    Как тебе такой план? Есть ли вопросы по предложенным шагам или нужна ли тебе дополнительная поддержка от меня по какому-то из пунктов?

    Разница между оценками судей: 0.3

    Комментарии судей

    • Claude Opus: 9 — Очень концентрный ответ: почти каждый пункт опирается на наблюдаемый факт с цифрами (2 недели раньше срока, +7 п.п., 5 рабочих дней, 2 встречи) и явно отделяет факт от влияния через маркеры Факт/Влияние — оценивается поведение, а не личность. Действенность на максимум: три конкретные привычки (бриф с критериями до старта, обязательный блок вывод+следующий шаг, менторство без подмены) плюс две точки контроля с горизонтами (через месяц и по итогам квартала) прямо покрывают цель следующего периода. Тон уважительный, прямой и поддерживающий, заканчивается приглашением к диалогу. Баланс чуть слабее: блок сильных сторон заметно короче зон роста (2 факта против двух развёрнутых зон + трёх шагов), из-за чего встреча ощущается смещённой в сторону коррекции; можно было усилить признание вклада (например, отметить проактивность в находке ошибки конверсии как поведенческую силу, а не только результат). Мелкая придирка: часть про менторство — по сути третья зона роста — спрятана в 'следующие шаги', хотя логичнее было бы обозначить её как наблюдаемое действие (сделал правки сам вместо объяснения подхода) с его влиянием на развитие младшего.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 8 из 10
      • Действенность: 10 из 10
      • Тон: 9 из 10
    • ChatGPT Sol: 9.25 — Ответ опирается на конкретные наблюдения, показывает влияние действий и сохраняет уважительный поддерживающий тон. Сильные стороны и зоны роста сбалансированы, следующие шаги и сроки проверки прогресса определены. Снижены баллы за неподтверждённый вывод о сдвиге сроков, смешение факта с интерпретацией в формулировках о высокой практической ценности и снижение ценности презентаций, а также за отсутствие измеримых критериев успешного прогресса к контрольным точкам.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 9 из 10
      • Тон: 10 из 10
  4. ChatGPT TerraОтвет получен через APIСредняя оценка: 9.0

    Сильные стороны

    За последние 6 месяцев ты показал, что можешь доводить аналитические продукты до результата и защищать качество данных.

    • Дашборд воронки регистрации был запущен на 2 недели раньше срока. Команда использует его на еженедельных встречах — это признак, что результат встроился в рабочий процесс, а не остался разовой визуализацией.
    • Ты нашёл ошибку, завышавшую конверсию на 7 п.п., и организовал пересчёт исторических данных. Это снизило риск принимать продуктовые решения на неверной метрике и восстановило сопоставимость данных.

    Зоны роста

    1. Фиксировать критерии решения до начала анализа.

    Факт: в исследовании причин оттока расчёты начались без согласованных критериев успеха. Через 5 рабочих дней часть анализа пришлось переделать. Интерпретация: проблема не в качестве расчётов, а в том, что направление работы и формат решения не были зафиксированы на старте. Это увеличивает срок инициативы и создаёт лишнюю нагрузку. Ожидаемое действие: перед началом каждой самостоятельной инициативы формулировать и согласовывать короткий аналитический контракт: вопрос, решение, которое будет принято по итогам, критерии успеха, сегменты и ограничения.

    1. Заканчивать анализ рекомендацией, а помощь коллеге — передачей подхода.

    Факт: на 2 встречах были представлены корректные данные, но без рекомендации; руководитель продукта отдельно запрашивал вывод и следующий шаг. При помощи новому аналитику ты исправлял работу сам, а не объяснял ход решения. Интерпретация: ценность аналитики остаётся частично нереализованной, если команде нужно самостоятельно превращать данные в решение. При подмене работы коллеги задача закрывается сейчас, но его самостоятельность не растёт. Ожидаемое действие: завершать каждую презентацию формулой: вывод → рекомендация → следующий шаг → критерий проверки. В менторской задаче сначала объяснять подход, просить коллегу сделать следующий шаг самому и разбирать результат вместе.

    Следующий период

    Цель — самостоятельно вести аналитические инициативы: до старта фиксировать критерии решения, завершать вывод рекомендацией и провести младшего коллегу через одну задачу без подмены его работы.

    Договорённость: для каждой новой инициативы ты присылаешь одностраничный аналитический контракт до начала расчётов. На еженедельном 1:1 раз в 2 недели разбираем одну инициативу по чек-листу: критерии согласованы, есть рекомендация, определён следующий шаг. По задаче с младшим аналитиком в середине периода отдельно посмотрим его промежуточный результат и твою обратную связь; в конце — оценим, смог ли он завершить задачу самостоятельно.

    Задача закрыта. Если следующая несвязанная — открой новый чат.

    Разница между оценками судей: недоступна: учтена оценка только одного судьи.

    Комментарии судей

    • Claude Opus: 9 — Сильный развивающий фидбэк. Конкретность высокая: каждый тезис привязан к наблюдаемому факту с цифрами (дашборд на 2 недели раньше, завышение конверсии на 7 п.п., 5 рабочих дней переделки, 2 встречи без рекомендации), явно разделены факт/интерпретация/ожидаемое действие. Баланс выдержан — две реальные сильные стороны с влиянием на результат, затем ровно две зоны роста, без перекоса в критику. Действенность образцовая: аналитический контракт, формула завершения презентации, менторский паттерн, договорённость о проверке с конкретной каденцией (1:1 раз в 2 недели, чек-лист, промежуточный срез в середине периода). Тон уважительный, прямой, бьёт по действиям, а не по личности. Минус к тону — служебная строка «Задача закрыта. Если следующая несвязанная — открой новый чат» в конце: это утечка системной инструкции ассистента в тело фидбэка, ей там не место, ломает деловой регистр документа. Мелкое замечание по балансу: две зоны роста во втором пункте склеены в один блок (рекомендация + менторство), можно было развести.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 10 из 10
      • Тон: 8 из 10
  5. GLM 5.1Ответ получен через APIСредняя оценка: 9.0

    Привет! Спасибо за работу в последние полгода. Давай обсудим твои результаты, сильные стороны и те зоны, где мы можем усилить твой подход, чтобы ты эффективнее двигался к уровню senior.

    Сильные стороны

    Начну с твоих достижений. Ты показал отличную скорость и высокое качество работы с данными.

    • Факт: Ты запустил дашборд воронки регистрации на 2 недели раньше срока. Влияние: Продуктовая команда теперь регулярно использует его на еженедельных встречах для принятия решений.
    • Факт: Ты нашёл ошибку в расчёте конверсии, которая завышала показатель на 7 п.п., и организовал пересчёт истории. Влияние: Мы восстановили точность метрик, на которых строится стратегия продукта.

    Это крутые результаты, которые показывают твою техническую экспертизу и вовлечённость.

    Зоны роста

    Я вижу две области, где изменение подхода поможет тебе давать больший бизнес-результат и реже тратить время на переделки.

    1. Фиксация рамок анализа и доведение результата до решения

    • Факт: В исследовании причин оттока ты начал расчёты без согласованных критериев успеха, из-за чего через 5 рабочих дней пришлось переделать часть анализа. Также на двух встречах ты представил много корректных данных, но не сформулировал рекомендацию, и руководителю продукта пришлось отдельно запрашивать выводы и следующие шаги.
    • Влияние: Отсутствие критериев на старте привело к потере 5 дней на переделку. А отсутствие рекомендаций на встречах вынуждает продукт брать на себя работу по синтезу выводов, что снижает твою ценность как проактивного партнёра, а не просто исполнителя расчётов.

    2. Подход к развитию младших коллег

    • Факт: Помогая новому аналитику разобраться с витриной, ты сделал исправления сам, а не объяснил свой подход.
    • Влияние: Коллега не получил понимания, как решать подобные задачи в будущем, а ты забрал на себя его операционную работу вместо того, чтобы масштабировать экспертизу в команде.

    Следующие шаги и договорённости

    Твоя цель на следующий период — самостоятельно вести аналитические инициативы. Чтобы к ней прийти, предлагаю зафиксировать следующие правила работы:

    1. Критерии до старта: Перед началом любого исследования мы фиксируем критерии успеха и ожидаемый формат вывода. Если их нет — ты возвращаешься ко мне или продакту за прояснением, а не начинаешь считать.
    2. Рекомендации по умолчанию: Любой твой анализ или презентация данных завершаются конкретной рекомендацией и следующим шагом для команды. Мы договариваемся, что презентация без вывода — это черновик.
    3. Наставничество через вопросы: Ты проведёшь младшего коллегу через одну задачу, но твоё правило: не трогать клавиатуру и код. Твоя задача — задавать направляющие вопросы и объяснять логику, чтобы он сделал исправления сам.

    Проверка прогресса: Давай сделаем чекпоинт через 4 недели. На нём мы посмотрим:

    • Как прошла первая задача, переданная младшему коллеге (обошлись ли ты без подмены его работы).
    • Удалось ли тебе добавить рекомендации в выводы по последним исследованиям.

    Через 3 месяца проведём полную оценку по всем пунктам цели. Как тебе такой план и фокус?

    Разница между оценками судей: 0.5

    Комментарии судей

    • Claude Opus: 9.25 — Сильный ответ. Конкретность высокая: числа сохранены (2 недели, 7 п.п., 5 дней), факты явно отделены от влияния через структуру Факт/Влияние, общих фраз без примеров нет. Баланс выдержан — две сильные стороны с реальным влиянием на продукт, затем две зоны роста, финал поддерживающий. Действенность образцовая: три чётких правила работы (критерии до старта, рекомендация по умолчанию, наставничество без клавиатуры), чекпоинт через 4 недели с измеримыми проверками и полная оценка через 3 месяца — прямо покрывает цель периода. Тон уважительный, прямой и поддерживающий («презентация без вывода — черновик» жёстко, но по делу, не по личности). Минусы мелкие: во вступлении добавлен мотив «движения к уровню senior», которого не было в данных оценки (лёгкая отсебятина), и формулировка «ты забрал на себя его операционную работу» ближе к интерпретации, чем к наблюдаемому факту, хотя подана корректно.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 10 из 10
      • Тон: 9 из 10
    • ChatGPT Sol: 8.75 — Ответ опирается на конкретные факты, связывает действия с последствиями и предлагает измеримые шаги с чекпоинтами через 4 недели и 3 месяца. Сильные стороны и 2 зоны роста сбалансированы. Тон в целом уважительный, но формулировки «снижает твою ценность» и «не трогать клавиатуру и код» звучат излишне жёстко; цель движения к senior также добавлена без опоры на исходные данные.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 9 из 10
      • Тон: 8 из 10
  6. MiniMax M2.7Ответ получен через APIСредняя оценка: 9.0

    Развивающий фидбэк: Product Analyst, middle


    Сильные стороны

    Начну с того, что вижу конкретный вклад в работу команды.

    Техническая глубина и ответственность за качество данных. Ты нашёл ошибку в расчёте конверсии — показатель был завышен на 7 процентных пунктов. Это повлияло бы на все решения, которые команда принимала на основе этих цифр. Ты не просто указал на проблему, а организовал пересчёт истории. Это означает, что ты понимаешь: данные без корректной методологии — это не данные, а шум.

    Способность делать работу в срок и даже раньше. Дашборд воронки регистрации запущен на 2 недели раньше дедлайна и используется продуктовой командой на еженедельных встречах. Это значит, что ты не только довёл задачу до конца, но и создал инструмент, который стал частью рабочего процесса команды. Это реальное влияние на то, как команда принимает решения.

    Готовность поддержать коллегу. Ты помог новому аналитику разобраться с витриной. Это показывает, что ты не работаешь в изоляции и видишь свою роль шире, чем выполнение собственных задач.


    Зоны роста

    Перехожу к двум областям, где вижу потенциал для развития. Опишу конкретно, что наблюдал, и как это влияет на результат.

    1. Подготовка перед запуском анализа

    Наблюдаемое действие: В исследовании причин оттока ты начал расчёты без согласованных критериев успеха. После пяти рабочих дней часть анализа пришлось переделывать.

    Влияние: Было потрачено время — твоё и, вероятно, руководителя, который участвовал в пересогласовании. Более существенно: задержка могла повлиять на сроки принятия решений по удержанию. Если бы работа началась с чётких критериев, результат был бы готов раньше и сразу в нужном формате.

    Почему это важно для тебя как для middle-аналитика: На этом уровне ожидается, что ты сам определяешь, когда достаточно согласовать рамки, а когда нужно утвердить критерии. Это часть автономности, к которой мы движемся.


    2. Формулирование выводов и работа через коллегу

    Здесь наблюдаю два связанных поведения.

    Наблюдаемое действие (данные без рекомендаций): На двух встречах ты представлял много корректных данных, но не сформулировал рекомендацию. Руководитель продукта отдельно запросил вывод и следующий шаг.

    Влияние: Данные без интерпретации и рекомендации — это сырьё, а не продукт аналитики. Когда ты приносишь данные, но не говоришь, что из них следует, ты перекладываешь работу интерпретации на других. Это замедляет цикл принятия решений и снижает ценность твоего вклада.

    Наблюдаемое действие (помощь коллеге): Ты помог новому аналитику с витриной, но сделал исправления сам вместо объяснения подхода.

    Влияние: С точки зрения результата — задача решена. Но новый аналитик не вырос в понимании, а ты взял на себя его работу. Это работает как костыль: быстро решает точечную проблему, но не масштабирует компетенции команды.

    Почему это важно: На уровне middle одна из задач — научиться создавать выводы, а не только данные. И одна из задач лидерства — развивать других, а не заменять их.


    Следующие шаги

    Предлагаю три конкретных действия на следующий период.

    Шаг 1. Перед запуском анализа — фиксировать критерии решения. Для каждой аналитической инициативы в начале работы записывай: что будет считаться успешным результатом, какие метрики изменятся и на сколько, что изменится в решениях команды. Это можно делать в письменном виде, даже коротко, — на полстраницы. Договоримся, что для каждой новой задачи ты присылаешь мне такую рамку в течение первых двух дней.

    Шаг 2. Завершать вывод рекомендацией. Каждую работу заканчивай одним слайдом или абзацем, где сказано: что рекомендуем сделать, почему и какой следующий шаг. Даже если рекомендация — «данных недостаточно, нужен дополнительный срез». Это станет частью твоей привычки к концу месяца.

    Шаг 3. Провести младшего коллегу через одну задачу без подмены. Выберите одну задачу, где новый аналитик будет ведущим, а ты — проводником. Ты объясняешь подход, задаёшь вопросы, направляешь, но исправления делает он сам. В конце — ретроспектива: что сработало, что было непонятно.


    Договорённость о проверке прогресса

    Предлагаю встретиться через шесть недель. К этому моменту:

    • У тебя будет как минимум один пример фиксации критериев до начала анализа.
    • Ты сформулируешь одну рекомендацию по запросу руководителя продукта.
    • У младшего аналитика будет опыт завершённой задачи, где он был ведущим.

    Встретимся на 45 минут, посмотрим на эти три точки. Если где-то будет сложность — скажи раньше, скорректируем.

    Есть что-то в этом фидбэке, что хочешь обсудить или уточнить?

    Разница между оценками судей: 0.5

    Комментарии судей

    • Claude Opus: 9.25 — Сильный развивающий фидбэк. Конкретность высокая: почти каждый тезис привязан к фактам из данных (7 п.п., 2 недели раньше срока, 5 дней переделки, 2 встречи), явно разделены блоки «Наблюдаемое действие» и «Влияние». Баланс выдержан — 3 сильные стороны и 2 зоны роста, личность не оценивается. Действенность отличная: 3 предметных шага, привязанных к цели периода, плюс договорённость о проверке через 6 недель с измеримыми точками и длительностью встречи. Тон уважительный, прямой, поддерживающий, финальный открытый вопрос уместен. Минусы мелкие: помощь коллеге фигурирует и как сильная сторона, и как зона роста — честно, но создаёт лёгкую двусмысленность; часть «Влияния» опирается на предположения («вероятно, руководителя», «могла повлиять на сроки»), хотя они корректно помечены как гипотезы.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 10 из 10
      • Тон: 9 из 10
    • ChatGPT Sol: 8.75 — Ответ опирается на конкретные факты, показывает влияние действий и задаёт измеримые следующие шаги с проверкой через 6 недель. Сильные стороны и зоны роста сбалансированы, хотя формально описаны 3 зоны вместо требуемых 1–2. Тон в целом уважительный, но фразы «сырьё, а не продукт аналитики», «перекладываешь работу» и «работает как костыль» звучат жёстко. Есть неподтверждённые интерпретации: вероятное участие руководителя, возможное влияние задержки на решения и вывод, что новый аналитик не вырос в понимании.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 9 из 10
      • Тон: 8 из 10
  7. MiniMax M3Ответ получен через APIСредняя оценка: 8.9

    Развивающий фидбэк: [Имя], оценка за период

    С чего хочу начать — сильные стороны

    Влияние на команду и продукт Ты запустил дашборд воронки регистрации на две недели раньше срока, и продуктовая команда закрепила его как рабочий инструмент еженедельных встреч. Это вклад, который продолжает работать на команду уже после сдачи.

    Качество данных и ответственность Ты обнаружил ошибку в расчёте конверсии, из-за которой показатель был завышен на 7 п.п., и сам инициировал пересчёт истории. Это зрелое поведение аналитика: приоритет точности данных над «красивой» отчётностью. Для бизнеса это значит, что решения по воронке теперь принимаются на корректной базе.


    Зоны роста

    1. Фиксация критериев успеха до старта исследования

    Наблюдаемый факт. В исследовании причин оттока ты приступил к расчётам без согласованных критериев успеха. После пяти рабочих дней часть анализа пришлось переделывать. Влияние на результат. Пять рабочих дней — это примерно 40% типового срока подобной задачи; пересчёт сдвинул сроки и потребовал дополнительного ревью со стороны руководителя. Моя интерпретация (можешь скорректировать). Похоже, приоритет «быстрее начать считать» перевесил шаг выравнивания ожиданий. Это типичная ловушка для middle-уровня, когда кажется, что задача уже понятна. Что можно делать иначе. До первой таблицы — короткий документ или сообщение в чате на 5–7 строк: вопрос бизнеса, гипотеза, критерии успеха/провала, какие данные понадобятся, какие решения зависят от результата. Согласование занимает 1–2 часа и обычно экономит дни.

    2. Завершение выводов рекомендацией и следующим шагом

    Наблюдаемый факт. На двух встречах ты представил корректные данные, но не сформулировал рекомендацию. Руководителю продукта пришлось отдельно запрашивать вывод и next step. Влияние на результат. Данные без рекомендации перекладывают работу по принятию решения на продакт-менеджера и замедляют цикл решений. Часть ценности аналитики в этом теряется. Что можно делать иначе. К каждой презентации добавлять один слайд или один блок: «Вывод — Рекомендация — Что нужно от команды продукта дальше». Если данных недостаточно для уверенной рекомендации — формулировать это явно: «по имеющимся данным, склоняюсь к X, но для подтверждения нужно Y». Это уже полезный вывод, а не «просто цифры».

    3. (Дополнительно) Передача знаний без подмены работы коллеги

    Наблюдаемый факт. Помогая новому аналитику разобраться с витриной, ты сделал исправления сам, а не объяснил подход. Влияние на результат. Джуниор получил готовый результат без понимания логики, поэтому в следующий раз снова придёт с тем же вопросом; твоё время на менторинг расходуется менее эффективно. Что можно делать иначе. Принцип «сначала вопрос, потом подсказка, только в крайнем случае — правка». Спросить: «Как ты планируешь подойти?», указать направление, дать попробовать, разобрать ошибку вместе. Это удлиняет первую задачу, но кратно сокращает время на последующие.


    Что я как руководитель готов обеспечить

    • В начале каждой аналитической инициативы — 30 минут на выравнивание критериев, если у тебя нет возможности согласовать их с заказчиком самостоятельно.
    • Ревью черновика финального слайда/документа на предмет наличия рекомендации до встречи с продактом.
    • Совместное планирование менторинга: выбрать одну задачу, договориться о формате «разбираем, не правим».

    Договорённости на следующий период

    Цель: самостоятельно вести аналитические инициативы, заранее фиксировать критерии решения, завершать вывод рекомендацией и провести младшего коллегу через одну задачу без подмены его работы.

    Конкретные шаги:

    1. Перед стартом каждой исследовательской задачи присылать мне и заказчику одностраничник с критериями успеха (шаблон покажу).
    2. К каждой финальной презентации добавлять блок «Вывод — Рекомендация — Следующий шаг».
    3. Взять одну задачу нового аналитика и провести её в формате менторинга по схеме «вопрос → подсказка → проверка».

    Проверка прогресса: через 6 недель, на промежуточной one-on-one встрече. Я отдельно посмотрю:

    • долю задач, начатых с согласованных критериев;
    • наличие рекомендации в финальных артефактах;
    • обратную связь от нового аналитика о том, насколько процесс менторинга был развивающим.

    Если по ходу периода что-то из договорённостей не получится — давай обсудим это сразу, не дожидаясь контрольной точки.

    Спасибо за работу в этом периоде и за то, что вклад в качество данных (кейс с пересчётом конверсии) был сделан твоей инициативой — это именно та зрелость, на которую мы опираемся в следующих целях.

    Разница между оценками судей: 0.3

    Комментарии судей

    • Claude Opus: 9 — Сильный ответ. Опирается на конкретные наблюдаемые факты с цифрами (2 недели раньше срока, 7 п.п., 5 рабочих дней), явно отделяет факт от интерпретации отдельными подзаголовками ('Наблюдаемый факт' / 'Моя интерпретация'), не оценивает личность. Структура ровно по заданию: сильные стороны → зоны роста через действие и влияние → следующие шаги → договорённость о проверке через 6 недель с измеримыми метриками. Действенность максимальная: шаблоны, формат 'Вывод — Рекомендация — Следующий шаг', схема менторинга 'вопрос → подсказка → проверка', плюс встречные обязательства руководителя. Тон уважительный, прямой и поддерживающий. Минусы: (1) баланс смещён — 2 сильные стороны против 3 зон роста, хотя задание просило 1–2 зоны; третья вынесена как 'дополнительно', но перегружает. (2) Придуман факт '5 дней ≈ 40% типового срока' — в данных этого нет, это фабрикация числа, что противоречит требованию отделять факты от домыслов (сглажено пометкой, но всё же). (3) Остался плейсхолдер [Имя]. В остальном образцовый развивающий фидбэк.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 8 из 10
      • Действенность: 10 из 10
      • Тон: 9 из 10
    • ChatGPT Sol: 8.75 — Ответ конкретный, сбалансированный и содержит измеримые шаги с контрольной точкой через 6 недель. Снижает оценку конкретности подмена фактов предположениями: 40% типового срока, сдвиг сроков, дополнительное ревью и прогноз повторного обращения джуниора отсутствуют в исходных данных. Формулировка про типичную ловушку middle-уровня слегка оценивает сотрудника, а не только его действия. Также вместо требуемых 1–2 зон роста описаны 3, хотя третья соответствует цели следующего периода.
      • Конкретность: 8 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 10 из 10
      • Тон: 8 из 10
  8. Claude FableОтвет получен через APIСредняя оценка: 8.8

    Готовый текст фидбэка для встречи:


    Фидбэк по итогам оценки за последние 6 месяцев

    Сильные стороны

    Начну с того, что реально хорошо.

    Дашборд воронки регистрации ты запустил на 2 недели раньше срока, и это не «сдал и забыл» — продуктовая команда использует его на еженедельных встречах. Это факт, и моя интерпретация такая: ты умеешь делать инструменты, которые встраиваются в процесс, а не лежат мёртвым грузом.

    Второе — ошибка в расчёте конверсии. Ты нашёл завышение на 7 процентных пунктов, сам инициировал пересчёт истории. Найти такое сложно, а вынести на поверхность и организовать исправление — отдельная смелость: команда полгода смотрела на неверную цифру. Это уровень ответственности за качество данных, который я хочу видеть у аналитика, ведущего инициативы самостоятельно.

    Ещё отмечу, что ты откликнулся помочь новому аналитику с витриной — сама готовность включаться в онбординг коллеги ценна, к формату вернёмся ниже.

    Зоны роста

    1. Доведение анализа от постановки до рекомендации.

    Два наблюдения, которые я считаю одной темой.

    Факт: в исследовании оттока расчёты начались без согласованных критериев успеха, и через 5 рабочих дней часть анализа пришлось переделать. Влияние — потерянная неделя и сдвиг ответа для продуктовой команды.

    Факт: на 2 встречах ты представил корректные данные, но без рекомендации — руководитель продукта отдельно запрашивал вывод и следующий шаг. Влияние — решение откладывается, а работа по формулировке вывода перекладывается на слушателей, хотя данные лучше всех знаешь ты.

    Моя интерпретация: ты силён в расчётах и качестве данных, но анализ пока начинается и заканчивается «в данных», а не «в решении». Для самостоятельного ведения инициатив нужны обе рамки: до старта — «какое решение мы принимаем и по каким критериям», в конце — «что я рекомендую и что делаем дальше».

    2. Развитие коллег: объяснять, а не делать за.

    Факт: помогая новому аналитику с витриной, ты внёс исправления сам, вместо того чтобы показать подход. Влияние: задача закрыта быстро, но коллега не сможет решить похожую сам, и вопросы вернутся к тебе. Интерпретация: так быстрее в моменте, но это не менторинг — а он входит в твою цель на следующий период.

    Следующие шаги

    1. Для каждой новой аналитической инициативы — до начала расчётов фиксировать письменно: вопрос, критерии решения, кто и какое решение примет по результату. Одна страница, согласована с заказчиком. Начинаем со следующей задачи.
    2. Каждая презентация результатов заканчивается слайдом или абзацем «Рекомендация и следующий шаг». Если данных для рекомендации не хватает — это тоже вывод, сформулированный явно: чего не хватает и как добрать.
    3. Взять одну задачу младшего коллеги и провести его через неё целиком: он делает — ты ревьюишь и задаёшь вопросы, руками в его код и расчёты не заходишь.

    Договорённость о проверке прогресса

    Через месяц на one-on-one смотрим первые зафиксированные критерии решения по новой инициативе. Через 3 месяца — промежуточный чекпоинт: 2–3 презентации с явной рекомендацией и статус задачи с младшим коллегой. По итогам периода оцениваем цель целиком: инициатива, проведённая самостоятельно от критериев до рекомендации. Если по ходу что-то буксует — не жди чекпоинта, приходи раньше.


    Собрал три проблемных наблюдения в две зоны: «критерии до старта» и «данные без рекомендации» — это одна болезнь (анализ не привязан к решению), разносить их на две зоны было бы искусственно. Каждое утверждение помечено как факт или интерпретация, как ты и просил.

    Задача закрыта. Если следующая несвязанная — открой новый чат.

    Разница между оценками судей: недоступна: учтена оценка только одного судьи.

    Комментарии судей

    • ChatGPT Sol: 8.75 — Фидбэк конкретный, хорошо сбалансирован и завершается измеримыми шагами с чекпоинтами. Сильные стороны и зоны роста подтверждены наблюдаемыми действиями, факты в основном отделены от интерпретаций. Баллы снижены за неподтверждённые утверждения: «команда полгода смотрела на неверную цифру», «потерянная неделя» и «сдвиг ответа» не следуют напрямую из данных. Формулировка «руками в его код и расчёты не заходишь» слишком жёсткая для менторинга. Финальный метакомментарий про «одну болезнь» и служебная фраза о закрытии задачи лишние и немного портят уважительный профессиональный тон.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 9 из 10
      • Тон: 8 из 10
  9. ChatGPT LunaОтвет получен через APIСредняя оценка: 8.8

    За последние 6 месяцев ты показал сильную техническую и аналитическую базу.

    • Запустил дашборд воронки регистрации на 2 недели раньше срока. Продуктовая команда использует его на еженедельных встречах — значит, результат встроен в рабочий процесс и помогает обсуждать продуктовые решения.
    • Нашёл ошибку в расчёте конверсии, из-за которой показатель был завышен на 7 процентных пунктов, и организовал пересчёт исторических данных. Это снизило риск принятия решений на неверной метрике.
    • Помог новому аналитику разобраться с витриной. Это показывает готовность поддерживать коллег и делиться экспертизой.

    Зона роста 1 — начинать инициативу с согласованных критериев решения.

    В исследовании причин оттока ты начал расчёты до того, как были зафиксированы критерии успеха. Через 5 рабочих дней часть анализа пришлось переделать. Факт: критерии не были согласованы заранее. Влияние: время команды ушло на переработку, а выводы появились позже. На следующем периоде перед началом инициативы фиксируй в коротком документе: какой вопрос решаем, какая метрика используется, какой порог или результат изменит решение и кто подтверждает критерии.

    Зона роста 2 — завершать анализ рекомендацией и развивать самостоятельность коллег.

    На двух встречах ты представил много корректных данных, но не сформулировал рекомендацию. Руководителю продукта пришлось отдельно запросить вывод и следующий шаг. Факт: данные были подготовлены, но решение из них не следовало явно. Влияние: продуктовой команде пришлось самой переводить анализ в действие, что замедлило обсуждение.

    При работе с младшим аналитиком ты делал исправления сам. Это помогло быстро получить корректный результат, но не обеспечило передачу подхода и самостоятельность коллеги.

    На следующий период предлагаю договориться о следующих действиях:

    1. Перед стартом каждой аналитической инициативы заранее фиксировать критерии решения и согласовывать их с заказчиком.
    2. Каждую презентацию завершать структурой: вывод, рекомендация, следующий шаг, ответственный и срок.
    3. В одной задаче провести младшего коллегу через весь цикл: постановка вопроса, выбор метода, проверка результата и самостоятельное исправление с твоей обратной связью.
    4. На еженедельной встрече один раз в две недели разбирать текущие инициативы по этим критериям.

    Через 6 недель проведём проверку прогресса: посмотрим на две завершённые инициативы, наличие заранее согласованных критериев, качество рекомендаций и результат работы младшего коллеги. Договорённость на следующий период: твоя цель — самостоятельно вести аналитические инициативы от постановки вопроса до рекомендации и развивать коллегу без подмены его работы.

    Разница между оценками судей: недоступна: учтена оценка только одного судьи.

    Комментарии судей

    • Claude Opus: 8.75 — Сильный ответ. Конкретность: почти каждый тезис опирается на факт из данных с цифрами (2 недели, 7 п.п., 5 дней, 2 встречи) и явно разделяет 'Факт:' и 'Влияние:' — ровно как требует задание. Действенность: следующие шаги предметны (шаблон вывод-рекомендация-следующий шаг-ответственный-срок, короткий документ с критериями, полный цикл с младшим коллегой) плюс договорённость о проверке через 6 недель с измеримыми маркерами. Тон уважительный, прямой, без оценки личности и общих фраз. Минусы по балансу: сильных сторон три, зон роста фактически три (критерии, рекомендация, менторство), но задание просило 1-2 зоны — автор упаковал их в два блока, это на грани. Помощь новому аналитику попала и в сильные стороны, и в зону роста — двойной учёт слегка размывает баланс. Мелочь: явное разделение факт/интерпретация выдержано в зонах роста, но в блоке сильных сторон интерпретации ('значит, результат встроен') не помечены так же строго.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 8 из 10
      • Действенность: 9 из 10
      • Тон: 9 из 10
  10. DeepSeek V4 FlashОтвет получен через APIСредняя оценка: 8.6

    Алексей, спасибо за продуктивный разговор. Я подготовил фидбэк по итогам твоей работы за последние полгода. Давай пройдёмся по структуре: сначала сильные стороны, затем зоны роста с конкретными примерами, а после — план действий.


    Сильные стороны

    1. Проактивность и скорость в запуске инструментов. Ты самостоятельно спроектировал и запустил дашборд воронки регистрации на две недели раньше запланированного срока. Продуктовая команда уже использует его на еженедельных встречах — это факт. Твоя скорость и понимание, что именно нужно команде, сэкономили время и повысили прозрачность метрик.

    2. Внимательность к качеству данных и ответственность. Ты обнаружил ошибку в расчёте конверсии, из-за которой показатель был завышен на 7 процентных пунктов. Вместо того чтобы просто сообщить, ты организовал пересчёт всей истории. Это прямое влияние на достоверность аналитики, которой доверяет команда. Такое поведение — пример зрелости и ownership.


    Зоны роста

    Зона 1. Формализация критериев до начала анализа. В исследовании причин оттока ты начал расчёты, не согласовав с руководителем продукта критерии успеха (например, какие сегменты считаем «оттоком», какой период, какие гипотезы проверяем). Через 5 рабочих дней выяснилось, что часть анализа нужно переделать, потому что исходные допущения не совпали с ожиданиями.

    Влияние на результат: потеря 5 рабочих дней твоего времени и задержка в получении выводов для команды. Команда не могла опираться на промежуточные результаты, так как они были невалидны.

    Зона 2. Завершение анализа рекомендацией, а не только данными. На двух встречах с руководителем продукта ты представил корректные и полные данные (например, по динамике конверсии и распределению пользователей), но не сформулировал, какое решение из этого следует. Руководителю пришлось отдельно запрашивать: «Какой ты видишь следующий шаг?»

    Влияние на результат: твоя работа воспринимается как «сырой материал», а не как готовый аналитический продукт. Это снижает твою роль как самостоятельного эксперта и заставляет руководителя тратить время на додумывание выводов.

    Зона 3. Развитие коллег через обучение, а не подмену. Когда новый аналитик обратился к тебе с вопросом по витрине данных, ты вместо объяснения логики сам исправил ошибку. В результате аналитик не понял, как избежать этой ошибки в будущем, и не развил навык работы с витриной.

    Влияние на результат: ты лишил коллегу возможности научиться, а себя — времени, которое мог бы потратить на более сложные задачи. В долгой перспективе это замедляет рост команды.


    Следующие шаги и договорённость о проверке

    Шаг 1. Внедри чек-лист «Критерии до расчётов». Перед началом любого нового анализа (даже небольшого) письменно фиксируй в одном абзаце:

    • Какую гипотезу проверяем?
    • Какие метрики считаем ключевыми?
    • Какие сегменты и период рассматриваем?
    • Какой формат вывода ожидает заказчик?

    Отправляй этот абзац руководителю продукта или стейкхолдеру на согласование. Это займёт 10 минут, но исключит переделки.

    Проверка: через месяц на нашей встрече 1:1 покажи 2–3 примера таких чек-листов до и после согласования.

    Шаг 2. Формулируй рекомендацию в каждом аналитическом документе. Сделай правилом: в конце любого отчёта, презентации или устного выступления обязательно добавляй раздел «Рекомендация» или «Следующий шаг». Даже если вывод кажется очевидным — пропиши его явно.

    Проверка: на следующей встрече с руководителем продукта (через 2 недели) я попрошу его обратную связь: появилась ли у твоих материалов чёткая рекомендация.

    Шаг 3. Проведи младшего коллегу через задачу без подмены. Выбери одну задачу, которую ты мог бы сделать за 2 часа. Вместо этого:

    • Разбей её на 3–4 шага.
    • На каждом шаге задавай аналитику наводящие вопросы, но не давай готового ответа.
    • Если он ошибается — укажи на ошибку и спроси: «Как ты думаешь, что здесь не так?»

    Проверка: через 3 недели на нашей встрече расскажи, как прошла эта передача задачи, и покажи результат работы аналитика (без твоих правок).


    Итог

    Ты сильный аналитик с хорошей скоростью и вниманием к качеству. Чтобы перейти на уровень самостоятельного ведения инициатив, нужно добавить две привычки: формализовать критерии до старта и завершать вывод рекомендацией. А в развитии коллег — переключиться с «сделать за него» на «научить его делать».

    Я верю, что за следующие полгода ты закроешь эти зоны роста. Давай через месяц на 1:1 сверим прогресс по трём шагам. Что думаешь?

    Разница между оценками судей: 1.3

    Комментарии судей

    • Claude Opus: 9.25 — Сильный ответ. Структура выдержана: сильные стороны → зоны роста → шаги с проверкой. Опирается на конкретные наблюдаемые факты и цифры (7 п.п., 5 дней, 2 недели раньше срока), отделяет факт от влияния через явный блок 'Влияние на результат'. Действенность максимальная: у каждого шага есть срок и способ проверки прогресса, договорённость о 1:1. Тон уважительный и прямой, критикует действия, а не личность. Минусы: часть примеров додумана и подана как факт ('например, по динамике конверсии и распределению пользователей') — это домысел, которого нет в данных оценки, и он размывает границу факт/интерпретация; зон роста три, а не запрошенные 1-2 (хотя все релевантны цели периода); финальное 'Я верю, что ты закроешь' — лёгкая общая фраза. Не хватает явной привязки шагов к сформулированной цели следующего периода.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 10 из 10
      • Тон: 9 из 10
    • ChatGPT Sol: 8 — Ответ структурный и действенный: есть факты, влияние, конкретные шаги и сроки проверки. Баланс соблюдён, но вместо требуемых 1–2 зон роста даны 3. Добавлены отсутствующие в исходных данных детали: имя Алексей, примеры метрик на встречах, невалидность результатов и потеря всех 5 дней. Формулировки «лишил коллегу возможности» и «руководитель тратит время на додумывание» звучат обвинительно и смешивают наблюдения с интерпретациями.
      • Конкретность: 8 из 10
      • Баланс сильных сторон и зон роста: 8 из 10
      • Действенность: 9 из 10
      • Тон: 7 из 10
  11. Claude SonnetОтвет получен через APIСредняя оценка: 8.5

    Фидбэк по итогам оценки — middle product analyst

    Сильные стороны

    Дашборд воронки регистрации. Факт: сдан на 2 недели раньше срока, продуктовая команда использует его на еженедельных встречах. Это значит, что ты не просто закрыл задачу — ты дал команде рабочий инструмент, который встроился в их регулярный процесс принятия решений.

    Ошибка в расчёте конверсии. Факт: нашёл занижение точности на 7 п.п., сам организовал пересчёт истории. Это выход за границы своей задачи — ты взял на себя ответственность за качество данных, на которые опирается вся команда, а не только за свой конкретный отчёт.

    Зоны роста

    1. Согласование критериев успеха до старта анализа. Факт: в исследовании причин оттока начал расчёты без согласованных критериев успеха, через 5 рабочих дней часть анализа пришлось переделать. Влияние: команда потеряла неделю работы, которую можно было не терять — согласование заняло бы, вероятно, час-два. Интерпретация (не факт): похоже, было желание быстрее показать результат, но в аналитике "быстро начать" и "быстро закончить" — разные вещи.

    2. Формулирование вывода и рекомендации. Факт: на двух встречах представил корректные данные, но не сформулировал вывод; руководитель продукта отдельно запрашивал рекомендацию и следующий шаг. Влияние: решение откладывалось до отдельного запроса, дополнительная работа легла на заказчика, а не на тебя как автора анализа.

    Следующие шаги
    • Перед стартом любой новой аналитической инициативы — фиксировать критерии успеха письменно и согласовывать с заказчиком до начала расчётов. Можно оформить это коротким чек-листом на 3-4 пункта, чтобы это не превращалось в отдельный ритуал.
    • Каждую презентацию данных завершать явным выводом и конкретной рекомендацией — что делать дальше и почему. Данные без вывода — половина работы.
    • Провести одного младшего коллегу через задачу целиком, объясняя подход, а не делая исправления за него. Цель — чтобы он повторил решение сам в похожей ситуации.
    Проверка прогресса

    Договоримся встретиться через 4-6 недель на 1:1 и разобрать 1-2 свежих кейса: смотрим, зафиксированы ли критерии успеха до старта работы и есть ли в презентации явный вывод с рекомендацией. Отдельно — как прошла задача с младшим коллегой.

    Задача закрыта. Если следующая несвязанная — открой новый чат.

    Разница между оценками судей: недоступна: учтена оценка только одного судьи.

    Комментарии судей

    • ChatGPT Sol: 8.5 — Ответ структурный и опирается на наблюдаемые действия, но содержит фактическую неточность: показатель конверсии был завышен на 7 п.п., а не произошло «занижение точности». Фраза о потере недели преувеличивает исходные данные: известно лишь, что через 5 дней пришлось переделать часть анализа. Следующие шаги практичны, однако срок проверки «через 4–6 недель» лучше заменить конкретной датой и измеримыми критериями. Баланс сильных сторон и зон роста соблюдён, тон в целом прямой и поддерживающий.
      • Конкретность: 8 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 9 из 10
      • Тон: 8 из 10
  12. ChatGPT SolОтвет получен через APIСредняя оценка: 8.5
    Сильные стороны

    За последние 6 месяцев ты запустил дашборд воронки регистрации на 2 недели раньше срока, и теперь команда использует его на еженедельных встречах. Также ты обнаружил завышение конверсии на 7 п. п. и организовал пересчёт истории. Это показывает, что ты умеешь доводить аналитический продукт до регулярного использования и внимательно проверяешь корректность метрик.

    Зоны роста
    1. Фиксировать критерии решения до начала расчётов.

    Факт: в исследовании оттока расчёты начались без согласованных критериев успеха, и через 5 рабочих дней часть анализа пришлось переделать. Моя интерпретация: сейчас аналитическая работа не всегда начинается с ясного ответа на вопрос, какое решение должен поддержать результат. Это увеличивает срок и создаёт лишнюю работу.

    1. Завершать анализ рекомендацией и развивать коллег через объяснение подхода.

    Факт: на 2 встречах ты представил корректные данные, но руководитель продукта отдельно запрашивал вывод и следующий шаг. В работе с новым аналитиком ты помог исправить витрину, но внёс исправления сам. Моя интерпретация: ты надёжно решаешь задачи как аналитик, но для самостоятельного ведения инициатив нужно чаще брать ответственность за решение целиком и передавать способ рассуждения, а не только готовый результат.

    Следующие шаги

    На следующей аналитической инициативе до расчётов зафиксируй в коротком документе вопрос, критерии успеха, возможные решения и владельца решения; согласуй их с продуктом. Каждую презентацию завершай формулировкой: «рекомендую сделать X, потому что Y; следующий шаг — Z». Одну задачу младшего аналитика проведи через постановку, разбор подхода и ревью, оставив реализацию ему.

    Через 6 недель сверимся по 3 свидетельствам прогресса: согласованный бриф до начала анализа, рекомендация в итоговых материалах и завершённая младшим коллегой задача с твоим ревью. На встрече разберём, что сработало и что ещё требует поддержки.

    Задача закрыта. Если следующая несвязанная — открой новый чат.

    Разница между оценками судей: недоступна: учтена оценка только одного судьи.

    Комментарии судей

    • Claude Opus: 8.5 — Сильный развивающий фидбэк. Конкретность высокая: все тезисы опираются на наблюдаемые факты (дашборд на 2 недели раньше, завышение конверсии на 7 п.п., 5 дней переделки, 2 встречи без рекомендации, правки за коллегу вместо объяснения), явно разделены 'Факт' и 'Моя интерпретация'. Структура каноничная: сильные стороны -> 1-2 зоны роста через действие и его влияние -> следующие шаги -> договорённость о проверке через 6 недель по 3 измеримым свидетельствам. Действенность отличная: шаблон рекомендации 'X потому что Y, следующий шаг Z', бриф с критериями, проведение младшего без подмены. Тон уважительный, прямой, на 'ты', без оценки личности. Минусы: блок сильных сторон заметно короче зон роста (баланс чуть смещён), обе зоны роста во второй раскрывают сразу две разные темы (рекомендация + развитие коллег), что размывает '1-2 зоны'. Плюс в конце затесался служебный артефакт 'Задача закрыта. Если следующая несвязанная — открой новый чат' — это мусор из системного контекста, в реальном фидбэке сотруднику его быть не должно, слегка бьёт по тону/чистоте.
      • Конкретность: 9 из 10
      • Баланс сильных сторон и зон роста: 8 из 10
      • Действенность: 9 из 10
      • Тон: 8 из 10
  13. Claude HaikuОтвет получен через APIСредняя оценка: 7.8

    Развивающий фидбэк для Middle Product Analyst

    Сильные стороны

    Ты быстро фокусируешься на том, что важно. Дашборд воронки регистрации запустил на 2 недели раньше планов — это не просто скорость, это понимание того, что готовое работающее решение лучше идеального в то, когда оно уже нужно. Продукт использует его еженедельно, то есть решение имеет реальный эффект.

    Ты внимателен к качеству данных. Поймал ошибку в конверсии на 7 п.п. — это не опечатка, это ошибка, которая существовала в исторических данных и могла влиять на все решения. Инициатива организовать пересчёт показывает, что ты видишь свою ответственность за надёжность цифр, на которые полагается вся команда.

    Зона роста 1: Подготовка анализа и согласование критериев заранее

    Когда начинал исследование оттока, не зафиксировал критерии успеха перед стартом. Через 5 дней пришлось переделать часть работы, потому что направление оказалось не тем, что нужно. Это стоило времени и, что важнее, создало ситуацию, когда сроки поджимали.

    Паттерн: когда задача большая и мутная, соблазн быстро начать считать. Но 30 минут на вопросы (с кем решаешь задачу, что ты попытаешься найти, как поймёшь что нашёл) сэкономят 5 дней переделок. Перед стартом: письмо или 15 минут на встрече, где ты сформулировал успех так, чтобы можно было сказать «да, это то, что нам нужно» или «нет, это не совпадает».

    Зона роста 2: Завершение анализа рекомендацией

    На двух встречах представил правильные данные. Но потом руководитель продукта отдельно тебя спросил: какой вывод, что дальше? Это значит, что ты остановился на "вот цифры", а не дошёл до "вот цифры, поэтому я предлагаю сделать X".

    Данные — это наблюдение. Рекомендация — это твой профессиональный вывод на основе этих данных. Это не твоя прямая отчётливость (нет, руководитель решает), но это твоя работа: глянуть на цифры и сказать, что они означают для бизнеса. Когда не делаешь этого — информация теряется в воздухе, и кто-то другой пересчитывает твой анализ в голове, чтобы понять что делать.

    Следующая встреча: не только покажи данные, но заранее напиши рекомендацию (даже если она будет оспорена). На встрече: "вот данные, вот мой вывод — согласен ли ты, хотел бы ты изменить направление?". Это сразу объединяет «что» и «что с этим делать».

    Зона роста 3: Развитие через объяснение, не через подмену

    Помогал новому аналитику с витриной, но вместо того чтобы показать подход, сделал исправления сам. Коллега не научился, ты потратил время, следующий раз будет то же самое.

    Наставление занимает дольше, чем сделать в первый раз. Но эффект — новый аналитик через две недели может это делать сам. Ты выигрываешь в масштабе. Формула: вместе на первой задаче (ты ведёшь и объясняешь), отдельно на второй (он ведёт, ты смотришь и даёшь обратную связь). Это медленнее на день, но быстрее на месяц.


    Договорённость на следующий период

    Твоя цель на 6 месяцев — вести аналитические инициативы самостоятельно. Три ключевых навыка:

    1. Перед анализом — письмо или 15 минут: критерии, что считаем, когда считаем готово.
    2. После анализа — всегда завершаешь рекомендацией, даже черновой.
    3. При помощи команде — объясняешь подход, не подменяешь работу.

    Проверим через 6 недель (конец августа) на синке: пройдёмся по 1–2 инициативам, которые ты вёл самостоятельно, посмотрим на подготовку и рекомендации.

    Если что-то застрянет раньше — в слак, не жди встречи.

    Разница между оценками судей: недоступна: учтена оценка только одного судьи.

    Комментарии судей

    • ChatGPT Sol: 7.75 — Фидбэк опирается на факты, показывает влияние действий и предлагает конкретные шаги с проверкой через 6 недель. Сильные стороны и зоны роста сбалансированы. Снижает оценку нарушение задания: описаны 3 зоны роста вместо 1–2. Есть неподтверждённые интерпретации и прогнозы («понимание того, что важно», «сроки поджимали», «через две недели может делать сам»), а также неудачные формулировки и опечатки, из-за которых тон местами звучит назидательно и небрежно.
      • Конкретность: 8 из 10
      • Баланс сильных сторон и зон роста: 8 из 10
      • Действенность: 9 из 10
      • Тон: 6 из 10
  14. YandexGPTОтвет получен через APIСредняя оценка: 7.8

    Развивающий фидбэк для middle product analyst

    Сильные стороны:

    • Вы продемонстрировали высокий уровень профессионализма, запустив дашборд воронки регистрации на 2 недели раньше срока. Продуктовая команда активно использует его на еженедельных встречах, что говорит о практической ценности вашей работы.
    • Вы проявили внимательность и аналитические способности, обнаружив ошибку в расчёте конверсии. Благодаря вашему вмешательству был организован пересчёт истории, что позволило получить более точные данные.

    Зоны роста:

    • В исследовании причин оттока вы начали расчёты без согласованных критериев успеха, из-за чего через 5 рабочих дней пришлось переделывать часть анализа. Это повлияло на эффективность работы и затраты времени.
    • На двух встречах вы представили много корректных данных, но не сформулировали рекомендацию. В результате руководителю продукта пришлось отдельно запрашивать вывод и следующий шаг.

    Следующие шаги:

    • Перед началом аналитических инициатив согласовывайте критерии успеха с заинтересованными сторонами и фиксируйте их в документации. Это поможет избежать переделок и повысит эффективность работы.
    • После сбора и анализа данных старайтесь формулировать чёткие рекомендации и предлагать следующие шаги. Это усилит практическую ценность ваших исследований для команды.
    • При работе с младшим коллегой старайтесь не подменять его работу, а объяснять подход и помогать разобраться в задаче. Так вы способствуете развитию команды и укрепляете культуру обмена знаниями.

    Договорённость о проверке прогресса: Давайте через три месяца обсудим, как идут дела с самостоятельным ведением аналитических инициатив, фиксацией критериев успеха, формулировкой рекомендаций и наставничеством младшего коллеги. Я буду следить за вашим прогрессом и готов оказать поддержку, если возникнут трудности.

    Разница между оценками судей: 0.5

    Комментарии судей

    • Claude Opus: 7.5 — Структура выдержана: сильные стороны → зоны роста → шаги → договорённость о проверке. Плюсы: опирается на факты с цифрами (дашборд на 2 недели раньше, 5 рабочих дней переделки, 2 встречи без рекомендации), шаги привязаны к цели следующего периода, тон уважительный и поддерживающий. Минусы: нарушено требование отделять факты от интерпретаций и не оценивать личность — вводные вроде «продемонстрировали высокий уровень профессионализма», «проявили внимательность и аналитические способности» оценивают качества, а не наблюдаемые действия. Потеряна конкретика по ошибке конверсии (не указано завышение на 7 п.п.). Наблюдение про наставничество (сделал исправления сам вместо объяснения подхода) не оформлено как зона роста с влиянием на результат — оно всплывает только в шагах. Срок проверки (3 месяца) не обоснован относительно горизонта оценки.
      • Конкретность: 7 из 10
      • Баланс сильных сторон и зон роста: 8 из 10
      • Действенность: 7 из 10
      • Тон: 8 из 10
    • ChatGPT Sol: 8 — Ответ опирается на конкретные факты и выдерживает баланс сильных сторон и зон роста. Причинно-следственные связи описаны ясно, но формулировки «высокий уровень профессионализма», «внимательность и аналитические способности» оценивают качества сотрудника, а не наблюдаемые действия. Следующие шаги уместны, однако недостаточно измеримы: не указаны формат фиксации критериев, обязательная структура рекомендации и промежуточные проверки до встречи через три месяца. Наставничество добавлено правильно, но без конкретной договорённости о задаче и признаках самостоятельной работы младшего коллеги. Тон уважительный, хотя «старайтесь» ослабляет прямоту, а «я буду следить» звучит контролирующе вместо совместной проверки прогресса.
      • Конкретность: 8 из 10
      • Баланс сильных сторон и зон роста: 9 из 10
      • Действенность: 7 из 10
      • Тон: 8 из 10
  15. ГигаОтвет введён вручнуюСредняя оценка: 7.5

    Оценочная встреча: развивающий фидбэк

    Сильные стороны (факты и их влияние)

    Надежность в доставке артефактов. Факт: Вы запустили дашборд воронки регистрации на две недели раньше срока. Продуктовая команда использует его как основной источник данных на еженедельных встречах. Влияние: Это позволило команде начать отслеживать динамику метрик не с третьего квартала, а уже в июне. Мы сэкономили бюджет разработки за счёт раннего выявления узкого места в онбординге. Ваша способность соблюдать сроки при высоком качестве визуализации — это фундамент вашей работы.

    Глубина технического анализа и внимание к данным. Факт: В прошлом месяце вы обнаружили ошибку в расчёте конверсии, из-за которой показатель был завышен на 7 процентных пунктов. Вы самостоятельно инициировали пересчёт исторических данных для всей команды. Влияние: Без вашего вмешательства мы бы приняли ошибочное решение о масштабировании неэффективного канала трафика, что могло стоить компании потери до 5% маркетингового бюджета следующего месяца. Команда теперь доверяет цифрам в этом отчёте, так как видела вашу принципиальность.

    Зоны роста (наблюдаемые действия → → влияние)

    Старт без фиксации критериев успеха. Наблюдаемое действие: На старте исследования причин оттока вы начали выгрузку данных и построение гипотез до того, как были зафиксированы пороговые значения метрик (Decision Criteria). В результате через 5 рабочих дней выяснилось, что часть сегментов считалась по несогласованной методике, и вам пришлось переделывать расчёт когорт. Интерпретация: Я вижу здесь высокую инициативу и желание быстрее найти ответ, но отсутствие предварительного согласования рамок задачи привело к двойной работе. Влияние: Мы потеряли неделю чистого времени аналитика и задержали обновление стратегии удержания. Если бы критерии были зафиксированы письменно в задаче до написания первого SQL-запроса, эти пять дней ушли бы на проверку продуктивных гипотез.

    Предоставление данных вместо бизнес-вывода. Наблюдаемое действие: На двух последних встречах с продуктом (по подписке и по платежам) вы представили подробные срезы метрик, корреляции и графики. Однако после просмотра данных наступила пауза, пока руководитель продукта отдельно не запросил: «Так какой следующий шаг?» и «Что нам с этим делать?». Интерпретация: Вы отлично отвечаете на вопрос «Что происходит?», но останавливаетесь перед вопросом «И что дальше?». Кажется, вы стремитесь к идеальной точности цифр, прежде чем предложить вариант решения. Влияние: Встречи затягиваются, ответственность за принятие решения размывается. Руководитель вынужден выполнять работу аналитика по синтезу инсайта, хотя именно за добавленную смысловую нагрузку над сырыми данными отвечает Senior-роль.

    Наставничество через подмену действий. Наблюдаемое действие: Когда новый аналитик обратился за помощью с витриной данных, вы нашли ошибку, исправили её в коде сами и вернули готовую задачу, объяснив только суть бага. Интерпретация: Это самый быстрый путь решить проблему сейчас, но он лишает коллегу возможности научиться самому находить такие ошибки. Влияние: Младший специалист сохранил зависимость от вас в работе с этой витриной. Время, потраченное вами на чистовое исправление, не снизило будущую нагрузку на вашу команду.

    Следующие шаги и договорённости на следующие 6 месяцев

    Структурированный ответ модели
    ЦельКонкретные наблюдаемые действия
    Фиксировать рамки до начала расчётовПеред написанием любого кода открывать задачу коротким комментарием или сообщением в трекере со структурой: <br>1. Какое решение принимаем (например, отключаем баннер Х)?<br>2. По каким двум числам поймём, что оно верное (пороги метрик А и Б)?<br>3. Срок проверки.<br>Ждать реакции владельца продукта

    𝐿 𝑜 𝑜 𝑚 Loom-голосовым сообщением или текстом в течение суток. Только после этого писать первый SELECT.

    Структурированный ответ модели
    Завершать анализ рекомендациейВ каждый отчёт или презентацию добавлять обязательный последний слайд или раздел «Рекомендация» (3–4 пункта). Каждый пункт должен начинаться с глагола действия («Отключить…», «Выделить ресурсы на…») и содержать фамилию ответственного. На встрече озвучивать этот блок первым, а данные использовать только как опору для него.
    Провести младшего коллегу через задачу (без подмены)Взять одну рабочую задачу нового аналитика. Вместо правок в его коде проводить два ревью по 30 минут: первое — на этапе проектирования запроса (задавать вопросы), второе — на черновом варианте. Ошибки подсвечивать вопросами («Как эта строка повлияет на уникальность ключа?»), предоставляя ему возможность написать финальный коммит самостоятельно.

    Договорённость о проверке прогресса

    Мы встретимся втроём (вы, я и менти/стажёр) раз в месяц. Чтобы встреча была предметной, прошу вас готовить короткую заметку:

    Зафиксированные CSU (критерии успеха) по одной свежей инициативе (копия из Jira). Ссылка на один завершённый отчёт с выделенной секцией рекомендаций. Пример одного вопроса, который вы задали стажёру вместо готового исправления.

    Я, со своей стороны, обязуюсь давать обратную связь по вашим черновикам ТЗ в течение 24 часов и не принимать устные запросы на анализ без письменных критериев успеха. Мой календарь открыт для внеплановых созвонов по спорным моментам в дизайне экспериментов.

    Разница между оценками судей: 1.0

    Комментарии судей

    • Claude Opus: 8 — Сильная концретика: факты привязаны к наблюдаемым действиям, числам и последствиям, зоны роста явно размечены (Наблюдаемое действие / Интерпретация / Влияние) — ровно как требовало задание. Минус концретности: часть 'фактов' выдумана и подана как факт (экономия до 5% бюджета, старт метрик 'в июне', темы встреч 'по подписке и по платежам', потеря 5% маркетинга) — это нарушает правило 'отделяй факты от интерпретаций' и раздувает влияние. Баланс сдвинут: задание просило 1-2 зоны роста, а дано 3 — сильных сторон две, растущих три, поэтому фидбэк ощущается тяжелее в сторону критики. Действенность отличная: конкретные шаги с триггерами ('до первого SELECT', структура комментария, ревью 30 мин вопросами вместо правок), таблица цель→действия, договорённость о ежемесячной проверке и встречные обязательства руководителя с SLA 24 часа. Тон уважительный, прямой, на 'Вы', бьёт по действиям, а не по личности; лёгкая натянутость там, где преувеличенные последствия могут звучать давяще. В целом развивающий фидбэк собран по структуре задания, портит его только домысливание цифр.
      • Конкретность: 8 из 10
      • Баланс сильных сторон и зон роста: 7 из 10
      • Действенность: 9 из 10
      • Тон: 8 из 10
    • ChatGPT Sol: 7 — Ответ подробно описывает наблюдаемые действия, влияние, следующие шаги и регулярную проверку прогресса. Однако он добавляет отсутствующие в исходных данных факты: июнь и третий квартал, экономию бюджета, риск потери 5% маркетингового бюджета, тематики встреч, задержку стратегии и зависимость коллеги. Вместо требуемых 1–2 зон роста разобраны 3, поэтому развивающая часть заметно перевешивает сильные стороны. Формулировки про работу аналитика, Senior-роль и запрет писать первый SELECT до ответа звучат излишне категорично и местами не соответствуют роли middle. Договорённости конкретны и проверяемы, но их стоит упростить, оставить 2 приоритетные зоны и опираться только на предоставленные факты.
      • Конкретность: 7 из 10
      • Баланс сильных сторон и зон роста: 6 из 10
      • Действенность: 8 из 10
      • Тон: 7 из 10