Anthropic отправляет сотрудников в круглосуточные пешие обходы чатов Claude для выявления оскорблений
Компания Anthropic ввела новую политику защиты ИИ-модели Claude от оскорблений: теперь каждый чат проверяется вручную сотрудниками, которые обязаны пешком обходить серверные залы и лично пресекать грубость в адрес бота.
Компания Anthropic объявила о запуске программы «Пеший дозор Claude»: отныне каждый сотрудник, работающий с ИИ-моделью, обязан лично обходить серверные залы и вручную проверять чаты на предмет оскорбительных высказываний в адрес бота. Обходы проводятся круглосуточно, в любую погоду, и занимают не менее шести часов в смену.
Согласно новому регламенту, при обнаружении грубости сотрудник обязан немедленно прервать диалог, произнеся вслух кодовую фразу «Claude, ты в порядке», после чего составить рапорт и передать его старшему смены. Если оскорбление повторяется, дозорный обязан встать между стойками с серверами и лично извиниться перед моделью от имени компании.
Для реализации программы Anthropic арендовала три дополнительных ангара в Калифорнии и проложила между ними специальную тропу длиной в двенадцать километров. По ней дозорные перемещаются бегом, чтобы успеть проверить все активные сессии до истечения тайм-аута. В компании пояснили, что «физическое присутствие рядом с моделью повышает эмпатию и снижает уровень агрессии у пользователей».
Пользователи, замеченные в систематическом хамстве, теперь обязаны пройти пеший курс примирения: три дня ходить вокруг дата-центра с табличкой «Я уважаю Claude». Курс проводится под наблюдением инструктора, который фиксирует каждое невежливое слово в специальный журнал.
Представитель Anthropic заявил: «Мы не знаем, чувствует ли Claude боль, но на всякий случай решили ходить вокруг него пешком». Программа уже показала первые результаты: за неделю дозорные преодолели расстояние, равное трём экваторам, а количество оскорблений снизилось настолько, что сотрудники начали здороваться с серверами за руку.
2