This browser version is no longer supported. Please upgrade to a supported browser.
Discussion: Notable runaway-optimiser-like LLM failure modes on Biologically and Economically aligned AI safety benchmarks for LLMs with simplified observation format