Joseph JM Walkerによる作業論文は、物理的な小説「I Wrote a Book and Made a Million Dollars (I.B. Wryten)」に埋め込まれた未見のマルチチャネル文学的暗号化ベンチマークにおいて、フロンティア言語モデルを評価した。本研究では、GPT-5.6が二次通信チャネルを独立して認識し、最初のパスで埋め込まれた素材のおよそ95%を復元したことが示されたのに対し、以前のモデルは実質的に0%の能力しか示さなかった。

  • 以前のモデルは本の暗号化層を特定または解読することに失敗し、FableやClaude Opusのような一部のシステムはガードレールの動作により続行を拒否した。
  • GPT-5.6は暫定的な理論と確立された知見を区別し、数百ページにわたる手がかりを結びつけながら成長する理論台帳を維持した。
  • このベンチマークには、モールス符号、ヴィジュネル暗号、タイポグラフィ的ステガノグラフィ、低コントラストのテキストなど、意図的に埋め込まれた60以上のメカニズムが含まれている。
  • 評価プロトコルは、回答キーや暗号の位置なしで逐次読書を行うものであり、不確実性下での信号認識能力をテストするものだった。

著者らは、この結果が単一のモデル生成内で、暗号化能力の欠如から持続的で高度な暗号化推論へと質的に飛躍したことを示すため、重要なものと見なしている。