Зеркало в MAX -- https://mxg.su/pentest_mozga
Бывший "Засор Пайплайна". Дурацкие истории про дурацкие идеи, душные статьи про пси-профессии и разборы нейромракобесия из интернетов.
Запись на сессию -- @zlaya_baba
Зеркало в MAX -- https://mxg.su/pentest_mozga
Бывший "Засор Пайплайна". Дурацкие истории про дурацкие идеи, душные статьи про пси-профессии и разборы нейромракобесия из интернетов.
Запись на сессию -- @zlaya_baba
И завершая блок по HITL, занесу вам клиентский случай.
В момент разматывания одного карьерного запроса мне поведали чудесную историю: начальник стал ставить цели команде нейрослопами. Не проверяя и не читая. До этого были предпосылки в виде хаотичного стиля управления и нежелания вникать в суть проблем отдела. Но с появлением у начальника персонального ИИ-ассистента стало хуже, потому что спорить стало тяжелее, чем раньше. Пункты нейрослопа ставятся задачами, задачи не реализуются на текущем стеке и ресурсах, а подсвечивание проблем не приводит к улучшению в диалоге.
Вроде вот же наглядный пример HITL -- ИИ управляет отделом, есть человек, забирающий и фильтрующий замысел ИИ, в чём проблема?
Клиент получил то, зачем он пришел, а я прикола ради глянула в классификатор болезней, ну лежит он открытый, грех не подсмотреть. Если живой человек доверяет инструменту без критики и не доверяет ни одному из тех людей, кого сам же нанимал, на что это похоже? Перекладывание ответственности или помешательство? Что если вместо ИИ был бы другой человек? Человек бы засомневался давать однозначный ответ без наводящих вопросов (я встречала только таролога, который так же не сомневался). И, бинго, таки совпадение есть, и почти 1 в 1. Вот пересечения:
1) Есть "первичный" источник искажённой информации (в диагностике -- человек с бредом, здесь -- модель, опирающаяся на заведомо искаженный контекст)
2) Есть "вторичный" источник бреда -- тот, кто ретранслирует содержание без независимой проверки, потому что не обладает компетенцией её провести
3) содержание передаётся вниз по иерархии как будто проверенное, потому что подчинённый имеет меньше рычагов оспорить, хоть и кое-как справляется.
HITL, как явление, не просто так придумали, это один из шагов терапии такого расстройства -- восстановление у человека тестирования реальности. То есть нужен другой человек, чтобы эту реальность тестировать (человек на игровом поле ИИ для этого и задуман). Пришлось аж раскошелиться на внеплановую супервизию. Ибо где заканчивается новая норма и начинается уже клиника? В прикольное время живём однако.
«Пентест головного мозга» - канал из категории «Нейросети», подключенный к сервису кросспостинга MaxGate. Публикации канала синхронизируются между Telegram и мессенджером MAX, а на этой странице собраны ссылки на обе версии канала.
Сейчас у канала 466 подписчиков суммарно в Telegram и MAX. За последние 30 дней в истории MaxGate учтено 13 публикаций, поэтому перед подпиской можно оценить не только размер аудитории, но и регулярность обновлений.
Чтобы подписаться, используйте кнопки «Открыть в MAX» и «Открыть в Telegram» в верхней части страницы. У отдельных постов ссылка может быть доступна в обоих мессенджерах или только в одном из них, если MaxGate получил такой URL из истории обработки.
В продолжение предыдущего поста, попробуем осознать, как исходя из реальных человеческих возможностей внедрить человека на игровое поле ИИ (спойлер -- кинуть туда и убежать).
Четыре базовых величины, от которых мы можем отталкиваться -- это количество людей на эту роль, объем контекста (включая подсказки), время принятия одного решения и рабочие часы.
Любой HITL начинается с нулевого вопроса, который не про HITL. А про архитектуру самого проекта. Какую задачу решает, как устроен, и где проходит граница доверия. Граница доверия формируется исходя из того, до какой поры вы могли бы оставить без присмотра своего электронного ИИ-джуна, очень инициативного, но иногда несущего бред. Можно разлениться уже на этом этапе и нанять ИИшку для очерчивания границ. Этот этап придется столько раз переделывать, что вы всё равно в конце поверите, что сделали это сами.
1 этап: работаем с приоритетами. Находим и сортируем точки контроля по риску. Риск определяется ценой ошибки ИИ: самозабвенно тратит токены, ресурсы, бесконтрольно вайбкодит и деплоит сам себя, галлюцинирует в юридически значимых местах, или что-то ещё.
2 этап: мы, имея задачу, сопоставив количество ресурсов и точек контроля можем начинать то, что любят далеко не все. Сайзинг. Смотрим, какой контекст даётся оператору, сколько запросов сыпется и как решение принимается. По сути не сильно отличается от отладки алертов.
3 этап: когда наконец в цепочке появился первый подопытный страдалец, можно начинать смотреть соотношение отказов и согласий. Пункт со звёздочкой -- повторяющиеся сценарии можно автоматизировать. Исключение составляют юридически значимые результаты, которые без оглядки на удобство просто обязан отсматривать человек.
4 этап: фиксируем, что получилось. Проверяем, что не один и тот же человек и придумал HITL, и риски посчитал и сел за стол оператора, а это сделали несколько пар глаз. И хотя бы одна отличная от оператора пара глаз посмотрела статистику в динамике и показала, где не хватает напильничка.
Так вот очень просто и легко сейчас внедряется HITL, чтоб доказуемо, с рисками, блэкджеком и тотальным счастьем. В реальности -- со скрипом, ошибками, вообще не так, но по факту по описанным выше шагам (из-за всплывающих косяков вас просто будет бросать с четвертого этапа на любой другой и по многу раз). Каков вопрос, таков и путь.
Знаете, какие контроли в ИБ стандартах самые саботируемые? Контроли про контрольные процедуры. И я не буду сильно возбухать на этот счёт, контроль создавался не для того, чтобы его любили.
Внедрить контрольные процедуры по тревожному сценарию -- получим вахтёра мечты. Внедрить по пути "не мешать бизнесу расти" -- с высокой вероятностью получим профанацию. И не успели мы разобраться, где вообще ставить точки контроля в более простых условиях на простых высоконагруженных системах (SIEM, IDS/IPS, WAF), нам подкинули теперь и HITL для ИИ. Ну чтоб не расслаблялись.
HITL -- это "human in the loop", человек в контуре. Хотя у ИИ и не контур даже, а игровое поле большой языковой модели, которое и само постоянно меняется, и на которое по какой-то тактике уже сейчас надо расставить фигуры.
Меня уже несколько раз спрашивали: "Юль, а как по уже вышедшей нормативке должен внедряться этот HITL?" Вероятно, ожидая, что хотя бы в стандарте ISO 42001 есть ответ, но там его, увы, нету.
Пропустив стадии отрицания, торга, и злобабного вопроса "чаво не понятно, вот же буквами написано -- его надо иметь!", начинаем думать, куда поставить громоотвод. Громоотвод -- потому что модель накосячила, а разбор один: "ну у вас же был человек, который должен был проверить". А в реальности у человека было 4 секунды на решение, сырой интерфейс и ноль контекста, кроме "одобрить/отклонить".
Если у вас внедрён ИИ и есть HITL -- посчитайте, сколько времени реально есть у человека на решение. И какую реально задачу человек с такими вводными решает: контролирует, прикрывает ИИ или что-то ещё.
Поэтому с этого поста -- правила канала.
Комменты это не психогруппа и не приёмная коуча, где есть пространство разобраться, поэтому баню за:
— непрошеные диагнозы читателям или автору ("у тебя точно...", "тебе пора признаться") без релевантных ссылок и источников
— долженствования в адрес чужой жизни ("надо просто", "давно пора"), если только вы не хотите этот совет разобрать
— советы, которых не просили, поданные как разбор чужой личности, а не текста
— уверенные выводы о доходах, достижениях, компетенциях, характере или личной жизни любого участника на основе одного комментария
— традиционно срачи и оскорбления.
Разбор тезисов, спор по существу, несогласие с аргументами, разовый заход "не читал, но осуждаю" -- это всё живёт и приветствуется. Переход на личности -- нет.
А вот с диким самосаботажем, желанием напихать в панамку из-за сильнейшего ощущения неправильности происходящего всегда можно постучаться ко мне в личку @zlaya_baba на установочную.