Skip to main content

Занятный пример LLM-инъекции в данном посте описан.Данный приём был использован против анализа кода большими языковыми моделями, авторы просто добавили в комментарии и документацию упоминания биологического и ядерного оружия и у модели проводящей аудит начали срабатывают защитные механизмы.Как следствие проверяющая система не смотрит на вредоносный код создавая тем самым белые пятна.

  1. @evilfreelancer TG

    Занятный пример LLM-инъекции в данном посте описан.

    Данный приём был использован против анализа кода большими языковыми моделями, авторы просто добавили в комментарии и документацию упоминания биологического и ядерного оружия и у модели проводящей аудит начали срабатывают защитные механизмы.

    Как следствие проверяющая система не смотрит на вредоносный код создавая тем самым белые пятна. John Scott-Railton (@jsrailton)
    😁 24 👍 5