Self-generated prompt injections in compaction summaries In Our framework for reporting model misalignment OpenAI provide "six reports on unexpected or concerning model behavior we’ve observed in the last six months". This one here is my fa…
Firehose
Filtered to People, tagged “prompt engineering” · clear filters
Browse: People · Companies · Papers · Podcasts · Hacker News · Deep dives