@evilfreelancer TG
Занятный пример LLM-инъекции в данном посте описан.
Данный приём был использован против анализа кода большими языковыми моделями, авторы просто добавили в комментарии и документацию упоминания биологического и ядерного оружия и у модели проводящей аудит начали срабатывают защитные механизмы.
Как следствие проверяющая система не смотрит на вредоносный код создавая тем самым белые пятна.
Данный приём был использован против анализа кода большими языковыми моделями, авторы просто добавили в комментарии и документацию упоминания биологического и ядерного оружия и у модели проводящей аудит начали срабатывают защитные механизмы.
Как следствие проверяющая система не смотрит на вредоносный код создавая тем самым белые пятна.
😁 24 👍 5