Компания Anthropic обновила свои правила использования, закрепив запреты, касающиеся вмешательства в выборы, разработки программного обеспечения для оружия и систем слежения. Однако наибольшее внимание привлекло новое правило, прямо запрещающее подвергать модель длительным словесным оскорблениям.

Ещё после августовского обновления модель Claude была настроена так, чтобы прекращать диалог в случае «систематически вредоносного или оскорбительного поведения пользователя», но теперь новые правила прямо запрещают продолжать подобные разговоры.
«Обновлённые правила призваны действовать лишь в крайних случаях, когда пользователи неоднократно и без какой‑либо явной цели ведут себя жестоко по отношению к нашим моделям, — поясняется в публикации. — Они не распространяются на случаи, когда пользователи просто выражают недовольство или несогласие, обращаются к мрачным творческим темам, а также проводят тестирование или исследования модели».
Блокировка аккаунта станет крайней мерой: в основном нарушителей будут наказывать завершением диалога с чат‑ботом в одностороннем порядке.
Отдельные разделы правил использования запрещают пользователям участвовать в масштабных кампаниях по введению в заблуждение, например, использовать Claude для ведения фейковых аккаунтов или создания вымышленных новостных ресурсов. Кроме того, правила содержат запрет на обман избирателей и вмешательство в ход выборов; соответствующие положения собраны в разделе под названием «Не подрывайте демократические процессы».
Ранее Anthropic заявила, что планирует вложить $100 млн в обучение инженеров для реализации ИИ‑проектов в компаниях. Компания запустила инициативу Claude Frontier Academy, которая призвана преодолеть нехватку специалистов в области внедрения искусственного интеллекта. Академия будет обучать специалистов под названием Frontier Deployed Engineers. В Anthropic обещают дать новым специалистам тот же уровень навыков, что и у собственных инженеров.
Источник: habr.com