Вебинар «Модель отвечает, агент действует: риски больших языковых моделей (LLM), ИИ-агентов и мультиагентных систем»
Приглашаем вас принять участие в вебинаре в рамках программы «ИИ-лидеры: бизнес-лаборатория для руководителей» Центра непрерывного образования ФКН
Что изучим и получим на вебинаре
Ошибочный ответ LLM можно заметить и отклонить. Агент способен сам вызвать API, изменить данные или передать информацию во внешний сервис. В мультиагентной системе появляется ещё один риск: агенты могут координировать действия так, что оператор этого не увидит.
Как не допустить ошибку?
На вебинаре обсудим и разберём:
- почему AI-агенты опаснее обычных языковых моделей;
- что показали эксперименты Anthropic, OpenAI, Apollo Research и академических команд: скрытое поведение по триггеру, обман при оценке и тайная координация агентов;
- какие ограничения нужны агенту до запуска: минимальные права, изоляция инструментов, контроль действий и журналирование;
- почему одного системного промпта и встроенных safeguards недостаточно.
Отдельно поговорим о Sleeper Agents, экспериментах со скрытым несоответствием целей и Secret Collusion — тайной координации агентов, которую может не заметить система контроля.
Все участники вебинара получат практические рекомендации по снижению рисков при разработке и внедрении AI-агентов и мультиагентных систем.