javascript

Shadow AI — почему инженеры скрывают, что пользуются ИИ

  • пятница, 21 августа 2026 г. в 00:00:22
https://habr.com/ru/articles/1072478/

Shadow AI — почему инженеры скрывают, что пользуются ИИ

главная
главная

Доброго дня, инженеры и те, кто инженеров ведёт.

Слушал подкаст Code of Leadership, выпуск про AI-assisted engineering. Полтора часа про то, как правильно встроить ИИ в разработку: копайлоты, MCP, метрики, место ИИ в SDLC. Разговор хороший, по делу. И где-то в середине проскочил термин, за который я зацепился и с которым хожу уже неделю — shadow AI. Проскочил сноской, в ряду прочих ИБ-рисков, между утечками и комплаенсом.

А я на этой сноске завис. Потому что мне кажется, что она интереснее основного разговора.

Что это вообще такое

Shadow AI — это когда человек пользуется нейронками в работе, а работодатель об этом не знает. Название собрано по образцу shadow IT — так лет пятнадцать назад назвали историю, когда сотрудники ставили себе нужные инструменты в обход ИТ-отдела, потому что через отдел было дольше, чем через себя.

Дальше в ИБ-жанре всё предсказуемо: данные уходят в публичные сервисы, подрядчика не аудировали, надо закрывать. И это правда, с этим я не спорю.

Только люди прячут не данные. Они прячут сам факт, что пользуются. Мою задачу нейронка решила за пятнадцать минут — и я об этом молчу, хотя в задаче не было ни строчки секретного.

Одну цифру всё-таки приведу, дальше их не будет. В опросе WalkMe почти половина работников — 48,8% — призналась, что скрывает своё использование ИИ, чтобы не нарваться на осуждение. Половина. Это уже не отдельные скрытные ребята, это норма поведения.

Дальше я разложу её на три уровня. Они складываются: снять верхний не значит снять остальные.

Раскроем некоторые карты

  • Пишу как лид, который нанимает, оценивает и раздаёт задачи, и одновременно как инженер, который сам сидит в этой же ловушке. Не сверху вниз.

  • Показать, что сокрытие рационально — не то же самое, что порекомендовать его. Рационально для одного, разрушительно в сумме.

  • На главный вопрос текста у меня ответа нет. Если бы был, статья была бы вдвое короче.

  • К безопасникам претензий у меня нет вообще. Их беспокойство я разделяю, и мне кажется, что здесь как раз возможен нормальный win-win. Про него будет ниже.

Уровень первый. Не ясно, за что прилетит

Самый внешний слой — правила. Точнее, их отсутствие.

Когда правило чёткое, у человека два варианта: соблюдать или осознанно нарушать. Оба честные, оба он про себя понимает. А когда правила нет, или оно написано так, что под него подходит что угодно, появляется третий вариант — пользоваться и не отсвечивать. Не из вредности. Просто непонятно, за что прилетит, и в такой неопределённости молчание дешевле разговора.

И сразу скажу, кого я тут не виню. Безопасников. Их беспокойство я разделяю полностью: код и данные правда уезжают на чужие серверы, лицензионные соглашения правда читаются тяжело, и никто пока не может внятно пообещать, что наша переписка с моделью не всплывёт где-нибудь потом. При этом опереться им не на что — практики нет, прецедентов нет, а отвечать за утечку им. Написать в такой ситуации хороший документ объективно тяжело.

Тут вторая половина той же проблемы, и про неё говорят реже. Инженерной культуры вокруг ИИ пока просто не сложилось.

Смотрите: код-стайл, ревью, ветвление, тестовая пирамида — всё это складывалось годами, спорами и граблями, и в итоге превратилось в общее «так принято». Новый человек приходит и за неделю считывает, как здесь принято. С ИИ никакого «так принято» ещё нет. Каждый делает как сумел: один гоняет всё через корпоративный инстанс и руками вычищает секреты, второй кидает кусок прода в веб-чат просто потому, что не задумался, третий поставил в IDE плагин, который тянет весь репозиторий целиком, и совершенно об этом не знает.

Это не про невнимательных людей. Это про то, что ориентиров нет, а работу надо делать сегодня.

Вот отсюда, по-моему, и складывается win-win. Инженеру нужно понимать, где безопасно, чтобы перестать бояться сказать вслух. Безопаснику нужно видеть настоящую картину, чтобы закрывать реальные дыры, а не воображаемые. Мешает обоим одно и то же — пустота на месте правил. Пока её нет, использование ИИ не снижается, снижается его наблюдаемость: компания получает худший из миров, где риски остались, а видимости нет.

Хорошая новость: этот уровень лечится, причём дешевле остальных двух. Плохая новость дальше.

Уровень второй. Защита нормы выработки

Этот слой мне интереснее всех остальных.

Представьте: вы честно сказали, что CRUD теперь пишется за пять минут вместо двух часов. Что произойдёт? Планка поднимется. Не завтра, так через спринт — и уже навсегда. Обратно её никто не опустит, потому что план всегда считается от факта.

Я думал, что это новая проблема. Оказалось, ей под сто лет.

1931 год, завод Western Electric под Чикаго, цех под названием Bank Wiring Observation Room. Четырнадцать рабочих паяют контакты, оплата сдельная: сделал больше — получил больше. Казалось бы, вот прямой денежный стимул, работай сколько влезет. А выработка стоит на месте. Потому что бригада между собой договорилась держать свою планку, примерно шесть тысяч контактов в день, и тех, кто её превышал, тихо ставили на место. Для таких у них было отдельное слово — rate busters, «ломающие норму». Логика простая: покажем, что можем больше — нам поднимут план, а платить будут так же.

Механизм с тех пор не поменялся ни на грамм, изменился только предмет — не количество спаянных контактов, а количество закрытых тикетов.

И вот здесь я расхожусь с большинством текстов про shadow AI. Их общий мотив — это иррациональный страх, который лечится культурой и психологической безопасностью. Только в том цеху никто ничего не боялся. Там сидели люди, которые прикинули последствия своей честности и приняли решение.

Уровень третий. Результат перестал ощущаться работой

Третий слой самый тихий, и он не про то, что подумают другие.

То, на что уходило два часа, занимает пять минут. Задача закрыта, тесты зелёные, всё хорошо. А ощущения сделанной работы нет.

Мы вообще устроены так, что цену вещи прикидываем по труду, который в неё вложен. Картина, над которой художник сидел месяц, кажется лучше такой же картины, нарисованной за час. Вещь одна и та же, разный только рассказ о том, сколько над ней возились.

И сильнее всего это работает там, где качество нельзя измерить напрямую. То есть ровно у нас. Ревьюер не может приложить к коду линейку и сказать «здесь качества на семь из десяти», поэтому подставляет то, что доступно, — сколько человек над этим сидел.

Мы, кстати, давно про это знаем. Прогресс-бар, который крутится лишние две секунды, потому что мгновенный ответ выглядит подозрительно дёшево, — это старый приём. Мы годами продавали заказчику прогресс-бары, а теперь требуем их друг от друга.

Раньше два часа возни были одновременно и оценкой сложности, и подтверждением компетентности, и оправданием перед собой в конце дня. Сейчас всё это отвалилось разом, а замены нет.

Почему при выросшей производительности стало тяжелее

Отдельно про ощущение, которое мне описывают на созвонах один на один и которое я вижу за собой.

Выматывают не сами по себе высокие требования. Выматывает сочетание высоких требований с тем, что ты ничего не решаешь. ИИ поднял требования и контроля при этом не отдал: полтора освободившихся часа — не ваши, их забирает бэклог, и решаете это не вы.

Дальше простая арифметика дня. Рутинный CRUD был передышкой между тяжёлыми кусками. Не отдыхом, но местом, где голова остывала. Убрали передышки — день стал плотнее при том же количестве часов. Производительность формально выросла, а к вечеру человек выжат сильнее, чем раньше.

Это не жалоба. Это прямое следствие, и его стоит держать в голове, когда считаете, сколько ещё задач влезет в спринт.

Что мне на это возразят

«Это проблема плохих компаний, у нас все спокойно говорят». Возможно. Но «у нас все говорят» — это всегда наблюдение того, кто в иерархии сверху, и снизу оно выглядит иначе. Проверяется легко: спросите не на общем созвоне, а один на один, и не «пользуешься ли ты», а «где ты решил не уточнять, что пользовался».

«Ну скрывают и скрывают, работа-то делается». Ломается в трёх местах. Данные уходят в публичные сервисы, и никто не знает куда именно. Оценка людей едет: лид видит темп, но не видит, чем он достигнут, и калибрует перформанс-ревью вслепую. И джуны учатся у старших не инженерии, а конспирации — вот это меня беспокоит больше всего.

«Напишите нормальную ИИ-политику, и shadow AI кончится». Политика снимает первый уровень и не трогает второй и третий. Разрешение пользоваться никак не мешает планке подняться. Человеку, которому официально разрешили, ровно так же не хочется говорить, что задача заняла пять минут.

«Стыдиться и правда есть чего: если код пишет нейронка, ты не инженер». Вот здесь спорить сложнее всего, потому что ощущение настоящее. Только обесценился здесь не сам результат — он на месте, задача решена. Обесценился привычный способ понять, что решена она хорошо. Чем это мерить теперь, я не знаю, и честнее сказать так, чем изобразить, что знаю.

И добавлю про это же. Ощущение, что признаваться невыгодно, растёт не на пустом месте. Понаблюдайте за собой, как вы читаете фразу «я это нагенерил» в описании пулл-реквеста. У меня, если честно, первая реакция — насторожиться, а не порадоваться за скорость. Пока она такая у меня, странно ждать откровенности от других.

Где стою я

Стандартный совет в таких текстах — постройте психологическую безопасность, и люди перестанут прятаться. Я в него не верю. Пока признавшегося реально штрафуют в восприятии и планом, культура тут не лечит. Сначала надо убрать штраф, потом уже звать к откровенности.

Что бы я делал на месте лида, и что стараюсь делать сам:

Идти к безопасникам самому и просить не регламент, а рамки. Регламент на все случаи они писать будут долго и всё равно не успеют за инструментами. А рамки — это страница текста: что можно без вопросов, что только через корпоративный инстанс, что нельзя никогда и к кому идти, если твой случай сюда не попал. Последний пункт важнее остальных: он превращает серую зону в вопрос вместо тихого решения. И пересматривать это надо раз в квартал, иначе через полгода документ будет описывать инструменты, которыми никто не пользуется.

Перестать спрашивать «сколько это заняло». Этот вопрос я задавал годами и считал безобидным. Он больше не безобидный: он прямо просит человека соврать. Спрашивать надо про другое — где было сложно, что решил не делать, что осталось непонятным.

Не поднимать план по факту ускорения молча. Если команда стала быстрее и вы сразу забрали разницу в бэклог, вы своими руками воспитали rate busters. Разницу надо хотя бы обсуждать вслух, а часть — оставлять команде.

На ревью смотреть на решение, а не на объём. Если человек честно сказал «это сгенерировано, я проверил вот здесь и здесь» — это лучшее ревью, чем «я всё написал сам». Такое поведение надо хвалить публично, иначе оно не заведётся.

Гарантий не дам. Это не методика, это то, во что я ставлю сейчас, и я вполне могу ошибаться.

Вместо вывода

Узел, который я не могу развязать, такой.

Время и усилие перестали работать как мера сделанного. Ни для инженера, который по ним понимал, что день прошёл не зря. Ни для лида, который по ним понимал, кто как тянет. Чем их заменить, никто пока не сказал — а оценивать людей надо в этом квартале, а не когда индустрия разберётся.

У меня есть предчувствие, что ценность съезжает с «решил задачу» на «понял, какую задачу надо решать». Но в лоб это звучит как общее место, и пока я не могу показать это на конкретном примере из своей практики, я не готов выдавать это за вывод. Считайте гипотезой.

Два вопроса, и оба не риторические.

Если вы ведёте команду — чем вы сейчас меряете работу инженера, кроме времени и объёма? Мне нужен не принцип, а то, что реально работает у вас в перформанс-ревью.

Если вы инженер — попробуйте вспомнить последний раз, когда решили не уточнять, сколько на самом деле заняла задача. Что вас остановило: правила, планка или ощущение, что это было слишком легко, чтобы называться работой?

Пишите в комментарии, я правда собираю это для себя. И если где-то ошибся в механизмах — говорите прямо, учту в обновлённой версии.