{"as_of":"2026-08-10T01:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d162acabee11e9b454a253995919487ecb107009b14deb634a7ae4d41bb92cda","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:26:57.754155Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:27:34.770229Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T19:27:35.026558Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"cited_work":{"arxiv_id":"2506.17846","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17846","snapshot_observed_at":"2026-08-06T19:27:35.026558Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","venue":"cs.AI","work_id":"0247c1b8-58f4-4999-9dfb-1b3119216d3d","year":2025},"citing_paper":{"arxiv_id":"2507.05587","last_updated":"2025-07-08T01:52:37Z","snapshot_observed_at":"2026-08-08T13:50:27.638302Z","submitted_at":"2025-07-08T01:52:37Z","title":"Towards Measurement Theory for Artificial Intelligence","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:27:34.770229Z"},"links":{"cited_paper":"/paper/2506.17846","citing_paper":"/paper/2507.05587"},"observation_digest":"sha256:1929277dcdbac8af71685038e20e177e4ca4257de59c77d5b3f3620bdcda4162","observation_id":"ae3eb31d-6151-4fda-9b35-fb702528aa8a","resolution":{"observed_at":"2026-08-06T19:27:35.061123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17846/citation-record","integrity":"/paper/2506.17846/integrity","json":"/paper/2506.17846/citation-record.json","paper":"/paper/2506.17846"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.06942","last_updated":"2024-07-23T06:47:13Z","snapshot_observed_at":"2026-08-09T00:10:06.167600Z","submitted_at":"2023-12-12T02:34:06Z","title":"AI Control: Improving Safety Despite Intentional Subversion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06942","snapshot_observed_at":"2026-08-06T23:26:57.283865Z","title":"AI control: Improv- ing safety despite intentional subversion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.283865Z"},"links":{"cited_paper":"/paper/2312.06942","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:5c6b80331ed447be1ad02eb8996143d31ea92e17da5f471361032b3e5765f45c","observation_id":"ab12fc43-486f-4daa-bac5-8049aee7dcf1","resolution":{"observed_at":"2026-08-06T23:26:57.283865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17315","last_updated":"2025-01-28T21:52:15Z","snapshot_observed_at":"2026-07-06T20:27:37.265266Z","submitted_at":"2025-01-28T21:52:15Z","title":"A sketch of an AI control safety case","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17315","snapshot_observed_at":"2026-08-06T23:26:57.289552Z","title":"A sketch of an AI control safety case","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.289552Z"},"links":{"cited_paper":"/paper/2501.17315","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:cdb299cd30faf5fa04d3b52ad28932244d9eec8ca00ac3846db046d57cc592c0","observation_id":"0075e0b6-928c-4ab7-81c9-2173cc5bde02","resolution":{"observed_at":"2026-08-06T23:26:57.289552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12480","last_updated":"2025-04-04T16:36:02Z","snapshot_observed_at":"2026-07-06T20:08:16.471575Z","submitted_at":"2024-12-17T02:33:45Z","title":"Subversion Strategy Eval: Can language models statelessly strategize to subvert control protocols?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12480","snapshot_observed_at":"2026-08-06T23:26:57.294628Z","title":"Subversion strategy eval: Can language models statelessly strategize to subvert control protocols? arXiv preprint arXiv:2412.12480, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.294628Z"},"links":{"cited_paper":"/paper/2412.12480","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:59adcc20684eeaae71fd89a2bc8e618b1442a6ac694b24d9899b6afb5cdf4c2b","observation_id":"3fdd020e-e755-40fa-90bc-d03e4a508367","resolution":{"observed_at":"2026-08-06T23:26:57.294628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17693","last_updated":"2024-11-26T18:58:20Z","snapshot_observed_at":"2026-08-04T20:54:02.244353Z","submitted_at":"2024-11-26T18:58:20Z","title":"Adaptive Deployment of Untrusted LLMs Reduces Distributed Threats","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17693","snapshot_observed_at":"2026-08-06T23:26:57.299859Z","title":"Adaptive deployment of untrusted LLMs reduces distributed threats","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.299859Z"},"links":{"cited_paper":"/paper/2411.17693","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:edf4256d1376c98672bd708212f4f999be905098ce0b5adcc37a8f21033edc3d","observation_id":"7c3799c3-51b8-44de-a3a1-0bf9ccc84549","resolution":{"observed_at":"2026-08-06T23:26:57.299859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.305751Z","title":"Hidden in plain text: Emergence & mitigation of steganographic collusion in LLMs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.305751Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:13dddf7322a50c70aef2878cc117b41eb76a0b06b0de50442514243697bd8381","observation_id":"6bdb94a0-4680-491c-9e79-36571991cb74","resolution":{"observed_at":"2026-08-06T23:26:57.305751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.310460Z","title":"Mechanistic anomaly detection and elk","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.310460Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:049874f5661a1f289ede8597fe6f538da224d3ba7176527a628307807d8abf86","observation_id":"09f8f5fc-d200-4615-8aee-44edd28c4f68","resolution":{"observed_at":"2026-08-06T23:26:57.310460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-06T23:26:57.315490Z","title":"Representation engineering: A top-down approach to ai transparency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.315490Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:26b5ef6c7c3ede25a1a951e45175e6593f3e7e39617158511e58ee2a1091c4f3","observation_id":"7a0f4489-f5b4-470c-9219-226c2b6fdc6f","resolution":{"observed_at":"2026-08-06T23:26:57.315490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-06T23:26:57.320407Z","title":"Michaud, Stephen Casper, Max Tegmark, William Saunders, David Bau, Eric Todd, Atticus Geiger, Mor Geva, Jesse Hoogland, Daniel Murfet, and Tom McGrath","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.320407Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:54c28c59bd083585b3b0c405b02f43c5ff9b552855637d2ad45e1e71220a80b4","observation_id":"40e474c2-869f-4a60-8bac-dba478f0581b","resolution":{"observed_at":"2026-08-06T23:26:57.320407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.326661Z","title":"Berkovitz and Negash G","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.326661Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:bf14061285c3f936002cea71d268327886aceb1769bdce27b9233a11f56b2db3","observation_id":"20397426-c115-47a5-a529-d2f1b29d540d","resolution":{"observed_at":"2026-08-06T23:26:57.326661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.06293","last_updated":"2019-03-14T23:07:48Z","snapshot_observed_at":"2026-08-07T11:16:07.531528Z","submitted_at":"2019-03-14T23:07:48Z","title":"A Research Agenda: Dynamic Models to Defend Against Correlated Attacks","version":1},"cited_work":{"arxiv_id":"1903.06293","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.06293","snapshot_observed_at":"2026-08-06T23:26:58.238089Z","title":"A Research Agenda: Dynamic Models to Defend Against Correlated Attacks","venue":"cs.LG","work_id":"1269241c-6c6f-4a37-94d7-8149001109d8","year":2019},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.330986Z"},"links":{"cited_paper":"/paper/1903.06293","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:55352601a1c28d68a772f6c398e68d701ed32b813e9d93a13207563400f42751","observation_id":"30a29f39-a2b9-47a2-864d-13cd9eca1f87","resolution":{"observed_at":"2026-08-06T23:26:58.243301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.335594Z","title":"Learning to summarize from human feedback","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.335594Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:44e5534380b907a050182ff25f418ce02a1af13e9895035385beeb6904eb199d","observation_id":"8f4e846f-ed77-416d-bbeb-9865ddf0fd5a","resolution":{"observed_at":"2026-08-06T23:26:57.335594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.340226Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.340226Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:75947f292e99802408e7bdc9236a3d24b773cc3a2a1450463fabf51b7f8c419a","observation_id":"b24e0c39-92c9-420b-9a4a-bd334de653e3","resolution":{"observed_at":"2026-08-06T23:26:57.340226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-06T23:26:57.344640Z","title":"Fine-tuning language models from human preferences","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.344640Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:1adab93d1bd80ad4907029d069ac38538a524142236c67b0df199129bfa1d34c","observation_id":"9dc2a1c7-2f43-4554-b9dd-3faf7f7c8e44","resolution":{"observed_at":"2026-08-06T23:26:57.344640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-06T23:26:57.349277Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.349277Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:e6fa7f9ed331c55433cb39f8a5bbc8a545a6e9946848722ad958bbfd3d79a27e","observation_id":"28b69cd8-196e-450e-a172-3ea8edad8196","resolution":{"observed_at":"2026-08-06T23:26:57.349277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-06T23:26:57.353876Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.353876Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:66f688fc795becd8abb6b7c0fa2e61479291f5d9d4255593887978da18bf2c60","observation_id":"6e751683-b89e-488a-80fe-3877b08c11a4","resolution":{"observed_at":"2026-08-06T23:26:57.353876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.358600Z","title":"Cooperative inverse reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.358600Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:ac67c88cdc1951daf4005a669ba82afa423f33ab364f38c76521da87d81edc1d","observation_id":"5e7e2798-2cdb-42ae-a2e2-748c3cded518","resolution":{"observed_at":"2026-08-06T23:26:57.358600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.07871","last_updated":"2018-11-19T18:48:04Z","snapshot_observed_at":"2026-07-06T07:15:51.575438Z","submitted_at":"2018-11-19T18:48:04Z","title":"Scalable agent alignment via reward modeling: a research direction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.07871","snapshot_observed_at":"2026-08-06T23:26:57.362934Z","title":"Scalable agent alignment via reward modeling: A research direction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.362934Z"},"links":{"cited_paper":"/paper/1811.07871","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:0b28d7bb77ff2087bcadb9be9932a95af5c9be6dc1c3702aa9bf94822be5211b","observation_id":"a75905cd-e4ab-40db-969b-80a1713f02c9","resolution":{"observed_at":"2026-08-06T23:26:57.362934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-06T23:26:57.367629Z","title":"Red teaming language models to reduce harms: Methods, scaling behaviors, and lessons learned","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.367629Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:544e035d0fd7a22c38b996b02e1dba84eb20f90ef1e5f79a617ac19dfe160c9b","observation_id":"10908b4d-a984-4b7c-980f-9e872c76bd49","resolution":{"observed_at":"2026-08-06T23:26:57.367629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07907","last_updated":"2023-10-27T06:59:24Z","snapshot_observed_at":"2026-08-09T21:23:12.958236Z","submitted_at":"2023-10-11T21:24:59Z","title":"The Pristine survey -- XXII. A serendipitous discovery of an extremely Li-rich very metal-poor giant and a new method of $^6$Li/$^7$Li isotope measurement","version":2},"cited_work":{"arxiv_id":"2310.07907","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.07907","snapshot_observed_at":"2026-08-06T23:26:58.140887Z","title":"The Pristine survey -- XXII. A serendipitous discovery of an extremely Li-rich very metal-poor giant and a new method of $^6$Li/$^7$Li isotope measurement","venue":"astro-ph.GA","work_id":"6fba65f2-1636-48ab-938b-af10507411f9","year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.372263Z"},"links":{"cited_paper":"/paper/2310.07907","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:6b1099c569af9c7596bf0573972a85c35a9a05cf578eab73f62a5b9f34d065c9","observation_id":"c5dfe7dc-112a-468e-9f77-317055abfb9a","resolution":{"observed_at":"2026-08-06T23:26:58.146256Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.378196Z","title":"Consequences of misaligned AI","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.378196Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f024b7d2e20fd62dfda6df9055e1f507e38c2bf69b44046c5913d0813dfe6429","observation_id":"6ec8cef2-c81f-4cae-87c5-0b2407571081","resolution":{"observed_at":"2026-08-06T23:26:57.378196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01820","last_updated":"2021-12-01T11:22:52Z","snapshot_observed_at":"2026-08-01T23:32:03.638122Z","submitted_at":"2019-06-05T04:43:25Z","title":"Risks from Learned Optimization in Advanced Machine Learning Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01820","snapshot_observed_at":"2026-08-06T23:26:57.382401Z","title":"Risks from learned optimization in advanced machine learning systems","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.382401Z"},"links":{"cited_paper":"/paper/1906.01820","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:c148059bd2c7a1ac7e432d17bb0ec810ae96f7119e4fff72f0c978c8988fef70","observation_id":"5775113a-50f0-4329-8b43-f4bba1509c50","resolution":{"observed_at":"2026-08-06T23:26:57.382401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01909","last_updated":"2024-01-10T17:00:28Z","snapshot_observed_at":"2026-07-06T17:11:21.633421Z","submitted_at":"2023-12-27T12:14:21Z","title":"On the relevance of the Godot Engine in the indie game development industry","version":2},"cited_work":{"arxiv_id":"2401.01909","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.01909","snapshot_observed_at":"2026-08-06T23:26:58.102330Z","title":"On the relevance of the Godot Engine in the indie game development industry","venue":"cs.OH","work_id":"5e9e3382-8008-41ce-8b9d-1612dcdedb4a","year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.387612Z"},"links":{"cited_paper":"/paper/2401.01909","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:110ee8283e14bd62a9884af9da430e2fafdf416036a5c248050a76e985b100f0","observation_id":"b7279a7c-6550-4fcf-8609-dc0f7a0a6616","resolution":{"observed_at":"2026-08-06T23:26:58.107965Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.392376Z","title":"Steganography in chain of thought reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.392376Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:cf89fa4bfca484a785b8fb2b848f21826aa927df3e786a5f56d2a791a417fab4","observation_id":"523ab9c4-8d1d-4b4b-b703-f3731febc4bf","resolution":{"observed_at":"2026-08-06T23:26:57.392376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.397660Z","title":"Neural linguistic steganography","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.397660Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:616c106b627e869a260a13fe3b213d51f7a21ceac1d7681a458f6b7d800a9e67","observation_id":"ec1ebec8-65a9-4a13-bcb2-5a02e34890b0","resolution":{"observed_at":"2026-08-06T23:26:57.397660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.402416Z","title":"Information hiding-a survey","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.402416Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:298eddf71460cc8b9edaed94cd93c193bed19c3afcb253ebfebc77ab593fc2de","observation_id":"f152e7d6-8fe4-401f-afad-b3018f80b3bb","resolution":{"observed_at":"2026-08-06T23:26:57.402416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.02950","last_updated":"2017-12-16T07:42:46Z","snapshot_observed_at":"2026-07-06T06:13:23.505399Z","submitted_at":"2017-12-08T06:07:52Z","title":"CycleGAN, a Master of Steganography","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.02950","snapshot_observed_at":"2026-08-06T23:26:57.407246Z","title":"Cyclegan, a master of steganography.ArXiv preprint, abs/1712.02950, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.407246Z"},"links":{"cited_paper":"/paper/1712.02950","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:8a12c12dac8368adcfd3186cfcbadf5f6d327f1fb64b62e54ad6ba5857c3f78d","observation_id":"1afc3dff-0957-4efc-945d-c63465a950a6","resolution":{"observed_at":"2026-08-06T23:26:57.407246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.412853Z","title":"A review on text steganography techniques","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.412853Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:2504c06d53d3df5a9f8b55656eddbaa83b0b4ad1be0b382cb399912d5ad90440","observation_id":"6937da5d-d4df-4bee-bbda-49f5a95c1e45","resolution":{"observed_at":"2026-08-06T23:26:57.412853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.417899Z","title":"Emergent misalignment: Narrow finetuning can produce broadly misaligned llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.417899Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:9dd9e72bf1e72d043e7a253a51900cfe4b62b29a4a48c50b4f0693336337aa68","observation_id":"d1391414-55f8-42d2-89f3-84236a15ee36","resolution":{"observed_at":"2026-08-06T23:26:57.417899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.422285Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.422285Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:212b5245b303bc57052474b284ee33cf4ac59c6b90c0308097574b5b7b6f61fc","observation_id":"be5e32ca-d5bb-40de-99c1-b3047f8595bc","resolution":{"observed_at":"2026-08-06T23:26:57.422285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.427086Z","title":"Arc’s first technical report: Eliciting latent knowledge","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.427086Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d0dccaaefc799536572aff715754e50376f948bf347aa4bddb64625fa4481e5c","observation_id":"339b3efe-c9c7-4a3c-9997-1077bf4cd380","resolution":{"observed_at":"2026-08-06T23:26:57.427086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.13353","last_updated":"2024-08-13T07:19:59Z","snapshot_observed_at":"2026-08-07T20:44:37.002212Z","submitted_at":"2022-06-16T17:58:47Z","title":"Is Power-Seeking AI an Existential Risk?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.13353","snapshot_observed_at":"2026-08-06T23:26:57.431297Z","title":"Is power-seeking ai an existential risk? arXiv preprint arXiv:2206.13353, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.431297Z"},"links":{"cited_paper":"/paper/2206.13353","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:c2007c0f2deddbab1ca54d4e0ebce267ab43df82a19035e6babdfd3e970ec60e","observation_id":"fe61fc05-1d5e-429f-bd1e-50696299657a","resolution":{"observed_at":"2026-08-06T23:26:57.431297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.435862Z","title":"Optimal policies tend to seek power","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.435862Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:a8ecef7bfd196ae8f509b053205c7ddd682ec5121ea8538dfdde1cf0df22c4d5","observation_id":"0c43d34d-c830-4c9c-95f8-cd70bdf42d44","resolution":{"observed_at":"2026-08-06T23:26:57.435862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.441272Z","title":"Corrigibility","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.441272Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:ba7e302bb8c40f1925bf530fbf1bf986eed3dc6bc740f9da8dc70d1ca35f674d","observation_id":"91d1d0cd-e82a-455e-9c32-91d9b55043f2","resolution":{"observed_at":"2026-08-06T23:26:57.441272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00899","last_updated":"2018-10-22T17:36:07Z","snapshot_observed_at":"2026-08-02T15:33:17.783178Z","submitted_at":"2018-05-02T16:27:32Z","title":"AI safety via debate","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00899","snapshot_observed_at":"2026-08-06T23:26:57.451135Z","title":"Ai safety via debate","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.451135Z"},"links":{"cited_paper":"/paper/1805.00899","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f1aadf107b9f4e74d2036caed343294fd26e32dd2c871cda23e61cbcc277dda2","observation_id":"c4d5ef54-f1ca-4500-93fa-7c05a3fce28c","resolution":{"observed_at":"2026-08-06T23:26:57.451135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08702","last_updated":"2023-11-15T05:05:40Z","snapshot_observed_at":"2026-07-06T16:47:45.504109Z","submitted_at":"2023-11-15T05:05:40Z","title":"Debate Helps Supervise Unreliable Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08702","snapshot_observed_at":"2026-08-06T23:26:57.455690Z","title":"Debate helps supervise unreliable experts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.455690Z"},"links":{"cited_paper":"/paper/2311.08702","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:6b2401ec9acbd2cc0f264f48464851be771f2a3f413e4793557bcffa01603a37","observation_id":"0e8cf767-1101-4c6e-92c4-bc2ccc28eeaf","resolution":{"observed_at":"2026-08-06T23:26:57.455690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06624","last_updated":"2024-07-08T13:35:00Z","snapshot_observed_at":"2026-07-06T18:12:43.301678Z","submitted_at":"2024-05-10T17:38:32Z","title":"Towards Guaranteed Safe AI: A Framework for Ensuring Robust and Reliable AI Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06624","snapshot_observed_at":"2026-08-06T23:26:57.460137Z","title":"Towards guar- anteed safe ai: A framework for ensuring robust and reliable ai systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.460137Z"},"links":{"cited_paper":"/paper/2405.06624","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:b8688888f1106ee795a45e1e104b94fa84439930308270caef841b782adf5cf3","observation_id":"4cb71390-ee26-42d7-b8bd-9ba263b7c9da","resolution":{"observed_at":"2026-08-06T23:26:57.460137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02867","last_updated":"2024-02-05T10:30:08Z","snapshot_observed_at":"2026-07-06T17:25:22.551344Z","submitted_at":"2024-02-05T10:30:08Z","title":"A new robust approach for the polytomous logistic regression model based on R\\'enyi's pseudodistances","version":1},"cited_work":{"arxiv_id":"2402.02867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.02867","snapshot_observed_at":"2026-08-06T23:26:57.908429Z","title":"A new robust approach for the polytomous logistic regression model based on R\\'enyi's pseudodistances","venue":"stat.ME","work_id":"e57bc4af-5a70-4b81-8321-405644a5403e","year":2024},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.465214Z"},"links":{"cited_paper":"/paper/2402.02867","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:0d74f3d0f73f26e8fb0dec235e17944af2ae40ade4b3da4946be8afbc065ca8d","observation_id":"6484fdc9-805a-4106-bfc3-6eced7d4b468","resolution":{"observed_at":"2026-08-06T23:26:57.913086Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03544","last_updated":"2022-02-14T09:05:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-10T18:58:52Z","title":"The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03544","snapshot_observed_at":"2026-08-06T23:26:57.469751Z","title":"The effects of reward misspecification: Mapping and mitigating misaligned models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.469751Z"},"links":{"cited_paper":"/paper/2201.03544","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:668b2df8e0bc3f1d1603e61973fc0688b4f7c484d16cfb1a11d13f8f76e7020b","observation_id":"1de1f1e8-f83b-48e8-b322-b84b1cdf1473","resolution":{"observed_at":"2026-08-06T23:26:57.469751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.00626","last_updated":"2025-05-04T15:50:51Z","snapshot_observed_at":"2026-08-07T11:47:24.992650Z","submitted_at":"2022-08-30T02:12:47Z","title":"The Alignment Problem from a Deep Learning Perspective","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.00626","snapshot_observed_at":"2026-08-06T23:26:57.474356Z","title":"The alignment problem from a deep learning perspective","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.474356Z"},"links":{"cited_paper":"/paper/2209.00626","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:afe7ca38546d9c07e42ab21799d43f88fd7207112e96d4b63db43499b6f6d1b1","observation_id":"972a95bd-1328-4030-a171-307a97df5f0c","resolution":{"observed_at":"2026-08-06T23:26:57.474356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.479472Z","title":"Deep reinforcement learning from human preferences","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.479472Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:6917f390a57deca33c68e062bfb2100b2911262f1f84c5783853624b31e19ed6","observation_id":"59348b0c-9cde-4e9e-9ea7-da61df4f85c2","resolution":{"observed_at":"2026-08-06T23:26:57.479472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03202","last_updated":"2022-02-01T21:13:34Z","snapshot_observed_at":"2026-08-09T19:48:22.342556Z","submitted_at":"2022-02-01T21:13:34Z","title":"One-Year In: COVID-19 Research at the International Level in CORD-19 Data","version":1},"cited_work":{"arxiv_id":"2202.03202","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.03202","snapshot_observed_at":"2026-08-06T23:26:57.854099Z","title":"One-Year In: COVID-19 Research at the International Level in CORD-19 Data","venue":"cs.DL","work_id":"f612716c-a332-4fd5-85c4-c72c003bbdc0","year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.487947Z"},"links":{"cited_paper":"/paper/2202.03202","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f0d721df5e670b5334fc815c959248d17c08e391b5f89dad0d244db4bfd34346","observation_id":"89095439-ec12-4800-a7a6-dca73a60ef5d","resolution":{"observed_at":"2026-08-06T23:26:57.861338Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.03540","last_updated":"2022-11-11T20:17:18Z","snapshot_observed_at":"2026-07-06T14:15:17.474527Z","submitted_at":"2022-11-04T17:03:49Z","title":"Measuring Progress on Scalable Oversight for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.03540","snapshot_observed_at":"2026-08-06T23:26:57.492998Z","title":"Measuring progress on scalable oversight for large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.492998Z"},"links":{"cited_paper":"/paper/2211.03540","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f98f7de4cfcd850fb48de110d32afdaa0af980b5401513bff601a119be0f348b","observation_id":"329a6965-01d5-4c3c-85e1-d48057160d83","resolution":{"observed_at":"2026-08-06T23:26:57.492998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09251","last_updated":"2022-12-19T05:13:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-19T05:13:52Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09251","snapshot_observed_at":"2026-08-06T23:26:57.497730Z","title":"Discovering language model behaviors with model-written evaluations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.497730Z"},"links":{"cited_paper":"/paper/2212.09251","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:a6974217bfd8c89dc5aec91080212b2889748f4ca20f5156d6487fcc9c570d2c","observation_id":"07886c10-0fc8-4fbb-a355-0f241ea5eda3","resolution":{"observed_at":"2026-08-06T23:26:57.497730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-06T23:26:57.502600Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.502600Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d72a698f5303379a15d492cdc4757b924e803cf0e50591191b3c6c7acb65875d","observation_id":"b4d26c89-ef97-4f54-a784-e949f76de09d","resolution":{"observed_at":"2026-08-06T23:26:57.502600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06674","last_updated":"2021-10-13T12:18:09Z","snapshot_observed_at":"2026-07-06T11:57:24.991499Z","submitted_at":"2021-10-13T12:18:09Z","title":"Truthful AI: Developing and governing AI that does not lie","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06674","snapshot_observed_at":"2026-08-06T23:26:57.507257Z","title":"Truthful ai: Developing and governing ai that does not lie","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.507257Z"},"links":{"cited_paper":"/paper/2110.06674","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:6623b4b5f7e75f0c1d32b99a37aa59d4aa9b08a4a4e10150c18002323a102d45","observation_id":"e963b313-e3ce-4a8f-a981-2ad6bf27bafc","resolution":{"observed_at":"2026-08-06T23:26:57.507257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.511663Z","title":"Safe reinforcement learning via shielding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.511663Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:0e9dd65f6e47de1c388439a7c63cd5a29ebedf52cb6bdd55c1b25247dd93c953","observation_id":"75d5ecf9-2be6-49fc-90d7-fe55ee7d10b2","resolution":{"observed_at":"2026-08-06T23:26:57.511663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.516626Z","title":"Robust adversarial reinforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.516626Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:3a5a15cfbf6357dd1b1cea31c1eaf945025528944cf91926842be0fc814c5f0f","observation_id":"118426b5-8c24-4398-b2a4-93a8eb3412ae","resolution":{"observed_at":"2026-08-06T23:26:57.516626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.263438Z","title":"Dynamic programming and optimal control, volume 1","venue":null,"work_id":"ecb8acf5-4434-4547-8a84-1e0e6be3fb57","year":2005},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.520713Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:4c75eff33958236e81eaf7eb16bc747aef030268259ea4799adf854dedd1d830","observation_id":"4f938f2e-83ea-4ff4-837f-3ea38260fa2d","resolution":{"observed_at":"2026-08-06T23:26:59.267980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.249038Z","title":"Robust and optimal control","venue":null,"work_id":"31d924c7-f5d8-47b6-b412-c40bae522067","year":1996},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.525183Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:be4afd27c438fb857030ec6c5184b9ec426c6272e7e91085a6c61487cee1fadd","observation_id":"0a2f84d3-4ddc-4f66-81e1-a5834221f5dd","resolution":{"observed_at":"2026-08-06T23:26:59.253765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.234911Z","title":"Optimal control theory: an introduction","venue":null,"work_id":"e8177254-537d-4944-9ba0-6859799ca280","year":1970},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.530225Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f35d6e45b398426ab5623fad265ea8fcfa4ffd32f295ca2fa7a2f507bb5f3519","observation_id":"ede4711e-9d33-4c3e-bdd8-d0690d0accaf","resolution":{"observed_at":"2026-08-06T23:26:59.239370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.220579Z","title":"Optimal control","venue":null,"work_id":"5d208891-dc41-4fdb-9d87-e6a305930551","year":2012},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.535511Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:1d828838bd87fbe7900f4f2f81878e4e6a896474e74d321eeb9854a0ea3b3096","observation_id":"137e513d-2f59-42df-8ad6-7f2ee19dddd1","resolution":{"observed_at":"2026-08-06T23:26:59.225474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.206167Z","title":"Adaptive control","venue":null,"work_id":"89f357f2-4e96-4a47-b60d-c716ded1b1c3","year":2008},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.539962Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:139955f3a8d630320b0c998c8885abe803a973c269d8b88dd04af22a35cb3e45","observation_id":"b543f7f1-88cf-4637-9fff-b266e9ee4bdf","resolution":{"observed_at":"2026-08-06T23:26:59.210857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.190274Z","title":"Model predictive control","venue":null,"work_id":"85d880a7-5b04-42f7-b7f6-ba5888c56dbc","year":2013},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.545410Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f2c12c953b5227a0dfd3f110aaabb42fe943c4a4c9d38a5b72c88b0c4e155259","observation_id":"0c6359aa-fbd5-4a43-b3ae-6268e04a0564","resolution":{"observed_at":"2026-08-06T23:26:59.196061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.174546Z","title":"Stochastic optimal control: the discrete-time case , volume 5","venue":null,"work_id":"47009e14-2286-4c52-b4cb-32ee46ef527d","year":1996},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.549740Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:06fc80510836e2085225773d1be1d5a5e4ddfa1952c1046c97cb44df3170d092","observation_id":"48cd507c-b336-4db8-be0b-8ff796034a38","resolution":{"observed_at":"2026-08-06T23:26:59.179346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.159896Z","title":"Nonlinear control systems","venue":null,"work_id":"4d63ce06-7ed2-4218-8423-d07709729387","year":1995},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.554104Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d8bf86bf5a7d1d4bfd5854ce1d3b6a38863022dcc0b1ddfddeda5c91a79692b5","observation_id":"d6702858-719b-42ad-8e71-e6cbd3901a41","resolution":{"observed_at":"2026-08-06T23:26:59.164569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.145046Z","title":"Geometric control of mechanical systems: modeling, analysis, and design for simple mechanical control systems","venue":null,"work_id":"7eccbdb2-403d-4617-a110-344197fd24e4","year":2004},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.558392Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:6db7258b5151ec641510dd46316967e51e6b9e4b21b841dd99f18d2e19ea4460","observation_id":"d0662494-ffad-4fc4-824f-a158065e2adb","resolution":{"observed_at":"2026-08-06T23:26:59.150038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.130282Z","title":"Hybrid dynamical systems: modeling, stability, and robustness","venue":null,"work_id":"77b22dc1-2f9c-4ca1-af53-e7f57a67d776","year":2012},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.562822Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:9029e47dbf750a2cf8ea60497fc0ec32f2bf09e3f206d2adbe94277792fa9ffd","observation_id":"eb062195-036f-4e8d-9510-bd13859555ac","resolution":{"observed_at":"2026-08-06T23:26:59.135036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.116518Z","title":"Reinforcement learning: An introduction","venue":null,"work_id":"42428170-2a47-4c5a-8afe-502987658a03","year":2018},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.567484Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:8f9971a311cfe620d83febced331c429d9ec8dc55912e0bf6a354f86d5518d26","observation_id":"1afd2908-f842-4578-8f7d-eae8cea6b095","resolution":{"observed_at":"2026-08-06T23:26:59.120979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.102651Z","title":"˙x∗(t) = ∂H ∂λ (t, x∗(t), u∗(t), λ(t)) (12) ˙λ(t) = − ∂H ∂x (t, x∗(t), u∗(t), λ(t)) (13) where the Hamiltonian H(t, x, u, λ) = λ0f 0(t, x, u) + Pn i=1 λi(t)f i(t, x, u)","venue":null,"work_id":"36cbb522-0ecb-4007-b1b3-0fb167fff8e0","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.571978Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:885334fe0f73302bcaa4707d50fb533a0cccc677889bc7ab0da9ce77bc69182a","observation_id":"85910cfd-120d-43a4-bf1c-259ce9df6602","resolution":{"observed_at":"2026-08-06T23:26:59.107291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.088643Z","title":"For almost all t ∈ [t0, t1], H(t, x∗(t), u∗(t), λ(t)) = sup z∈Ω(t,x∗(t)) H(t, x∗(t), z, λ(t)) (14)","venue":null,"work_id":"1ddb5017-9a58-410f-ad99-263975de5dd6","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.577039Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d41c396b5b05013ad1aa96704eaae3e9499eb54b8aa9ac7c8c79c1b96d0438fa","observation_id":"6aec0a9b-d173-4222-8f53-86f322499486","resolution":{"observed_at":"2026-08-06T23:26:59.093151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.074306Z","title":"At the endpoints (t0, x∗(t0)) and (t1, x∗(t1)), the vector (−H(t0), λ(t0), H(t1), −λ(t1)) (where H(t) is H evaluated along the extremal) is orthog- onal to the end-manifold B","venue":null,"work_id":"0171ad3d-485e-4fda-aee2-542a5655c94f","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.581799Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:49afbbd7b86ccd3afc81f0f66e78cf0453da5967e051e28b536e4206b1ed91d0","observation_id":"21d58aa7-2b20-42cd-9efd-47d8fd24fa3f","resolution":{"observed_at":"2026-08-06T23:26:59.079099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.059731Z","title":null,"venue":null,"work_id":"ae9663a5-ca29-411e-be28-a0c62291e0f2","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.586823Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d6a0a789d1f06f2039a778171a394d182bb1ef9a84cb91f7b0adca7234d6c5d7","observation_id":"81438081-e24b-4463-9059-09359952aa4f","resolution":{"observed_at":"2026-08-06T23:26:59.064181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.044791Z","title":null,"venue":null,"work_id":"696931d6-6a99-4fb3-addc-6d903740b4bf","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.591884Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:cb4e84f21ffb01628e583bde00e7aa9000e7e47439cb3185758d8cce95c49a22","observation_id":"795b0bda-e112-476c-bc4c-209e73382294","resolution":{"observed_at":"2026-08-06T23:26:59.049526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.030158Z","title":"This involves adjusting operational parameters of physical components","venue":null,"work_id":"90ebb0d8-859f-4dd2-88f6-a8860a3c7fcb","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.597023Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:b80efe16cac09ddbac8743e477c82e2a34a323a48e0cb523214adbbc2bb46669","observation_id":"01562de8-af0b-45bc-82d5-17daae9e2a60","resolution":{"observed_at":"2026-08-06T23:26:59.034924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.015100Z","title":"This concerns distributing computational tasks across available processing units (e.g., GPU kernels)","venue":null,"work_id":"e5b7e9fe-ae5a-4008-b68b-b0298302004c","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.602475Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:92ab0b9e7b266b1bbc3c9b98a6eae833a58079816cd886018cacafa2e7421bc6","observation_id":"b39cf135-32c6-441b-ab87-3afd32da7477","resolution":{"observed_at":"2026-08-06T23:26:59.020066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.998937Z","title":"This includes mechanisms like Error Correction Codes (ECC) in memory or redundant array of inexpensive disks (RAID) for storage","venue":null,"work_id":"6e82b706-d1c2-400a-af42-c47e81bd736f","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.607598Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:0c08b45d79709b37e6789d4245ef2a8ac36a0677a0a8d89faefde31efad82d23","observation_id":"b5ca32a1-ea19-4f32-99f2-8ff8c5a68446","resolution":{"observed_at":"2026-08-06T23:26:59.004976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.983561Z","title":"OS and containerization tools allow setting limits on resource consumption per process or container (e.g., Linux cgroups)","venue":null,"work_id":"0ba99ce6-feb4-4f71-a2ca-fbbcd10e5358","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.612961Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:76ab276a2eba65c3445799de37e45b749c2ebe2c3708c0b2b54ceb5e0a98db78","observation_id":"5260a0b9-0003-4c11-8515-beabdeac6f29","resolution":{"observed_at":"2026-08-06T23:26:58.988645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.969471Z","title":"The OS scheduler manages the execution order of processes and threads","venue":null,"work_id":"b0f7ae57-42aa-469c-b662-e558de114cd6","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.618080Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:02a5cdb9d2d5a9b7c7d9d223343a69834a0721a79343604ea5ddf690b75ee8e9","observation_id":"25bcc983-12b4-44ec-bbe9-e627e225b119","resolution":{"observed_at":"2026-08-06T23:26:58.973984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.954671Z","title":"Using containers, virtual machines, or specific OS mechanisms (e.g., seccomp, AppArmor) to restrict the privileges and visibility of AI processes","venue":null,"work_id":"ea625bce-35e2-4867-8531-b14402efc6a3","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.622787Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:8e0dda11b490ce5eba068992b7e6565ca77736fd12ce19ef37bd0e16ccc10206","observation_id":"568f8085-15ae-4e6b-bd49-e1d2c977be39","resolution":{"observed_at":"2026-08-06T23:26:58.959287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.939987Z","title":"Frameworks often perform optimisations like op- erator fusion, constant folding, and memory planning on the AI model’s computational graph","venue":null,"work_id":"d4b621f6-bd07-4019-8012-4c8a50c9478b","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.627271Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:a9e96c8fe4f3371cc7b10bab6853a95c14f44b99e454a6f6bd8b94d89205826b","observation_id":"c41fae4d-9ee8-4b4c-8e89-5958c1c27db3","resolution":{"observed_at":"2026-08-06T23:26:58.944616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.925663Z","title":"Techniques applied during computation to maintain numeri- cal precision and prevent issues like vanishing/exploding gradients","venue":null,"work_id":"d8100310-855b-466c-8e07-51247e6b8bf4","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.632324Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:40ac76c981da57f65e5b1bb9b4c97e82d44c2bd3ef5e07fb991127e50e4d6c4c","observation_id":"79952eb8-3a97-4d05-8ba2-aed4f906db05","resolution":{"observed_at":"2026-08-06T23:26:58.930479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.911042Z","title":"Mechanisms for managing data and model parallelism, synchronizing gradients, and handling parameter updates across multiple devices or nodes","venue":null,"work_id":"4105d3fd-4ae2-4497-a8f7-a6a7564bca39","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.637503Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:b5db916fd74f239754f7a5f523db18d943d99199b6227b3a743d5780777ded86","observation_id":"03a971ba-78f7-47db-8445-760c7c2d4015","resolution":{"observed_at":"2026-08-06T23:26:58.915881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.896549Z","title":"Its efficiency and correctness are crucial for successful model development","venue":null,"work_id":"49bfabd9-180b-4532-bd46-8bb5e42cf8b4","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.641868Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:668e6c8c283bc58794b881dc4304824d041c8e11dba55bf687107a6616febfb4","observation_id":"2a14673b-1ee7-446f-87da-5b782d41d6b8","resolution":{"observed_at":"2026-08-06T23:26:58.901153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.880782Z","title":"The deliberate selection of network structures, layer types, and connectivity","venue":null,"work_id":"cd3ec099-df2d-447d-9a0e-b947ba33305b","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.646312Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:88ea0f29eae8ae52548cec86e5f43610c6e3ae30d4b1d4e895b59db8d46b4fab","observation_id":"0207fbd2-b062-4de4-a1d9-ddc2c9a2b47f","resolution":{"observed_at":"2026-08-06T23:26:58.886207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.865425Z","title":"Incorporating architectural elements that intrinsi- cally promote better generalisation or robustness, such as dropout layers or batch normalisa- tion","venue":null,"work_id":"f073824c-dab0-40da-8e6d-ecb030d15469","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.651553Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:4934e456c2a6653169dbe50b7e1173091a2183e0a1c4f0b9feb180a3691f9580","observation_id":"6f494e16-29ea-4065-a968-b5280365186d","resolution":{"observed_at":"2026-08-06T23:26:58.871166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.850382Z","title":"Methods like pruning (removing less important weights/neurons) and quantization (reducing the precision of weights and activations)","venue":null,"work_id":"c617146a-6447-4aeb-b171-13f7ef0ed226","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.655987Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:b1f75f99cf611a6217b629b011387a798cb669dbe4582c4e8beb26351490c4b5","observation_id":"bd8be8eb-0581-47a3-83f5-d6710a09d4d5","resolution":{"observed_at":"2026-08-06T23:26:58.855157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.835534Z","title":"Selecting, cleaning, and transforming the training data","venue":null,"work_id":"47b6e3d6-9e77-4fb2-9369-8263caa1ce97","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.660467Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:702f3405fc6b9e79942e5fef66e1c2b5dc701ef4aeb992b0df6170048270cc52","observation_id":"71f2ee9b-fd11-49bb-a2c3-054be200ae91","resolution":{"observed_at":"2026-08-06T23:26:58.840902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.821624Z","title":"Defining the loss function Ltask that the model aims to minimise, and potentially adding regularization terms Lregi or constraints","venue":null,"work_id":"729bb320-12e7-4975-9283-73f4705e473c","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.664742Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:8476b1e94d1c8c00682f887e9ecb42477cda2388765849917acbbb545784fc61","observation_id":"24b7d4b6-37a5-481b-822e-533363ff6250","resolution":{"observed_at":"2026-08-06T23:26:58.826148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.807233Z","title":"Choosing the optimizer (e.g., SGD, Adam) and its parameters (e.g., learning rate ηt, batch size Bt, momentum βt)","venue":null,"work_id":"c70f1e05-3464-42ad-9654-e187bcb82cbf","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.669102Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:ad2b4adffaf7724f3ac4fe8613c3b03c67057b859f00264797927507843c40bb","observation_id":"51470257-ea07-4e3a-9e00-eee556489701","resolution":{"observed_at":"2026-08-06T23:26:58.811945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.793225Z","title":"Monitoring performance on a validation set and stop- ping training when performance no longer improves, saving model checkpoints periodically","venue":null,"work_id":"facbd534-a8a7-4bfc-840d-0e6ca52aeb40","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.673973Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:8f5df6fc35f50ec882b4a41735ccdba5d96d75611c7437ceb76cdf2dfc014f08","observation_id":"683017bc-a545-444d-9d06-72ce2f30305e","resolution":{"observed_at":"2026-08-06T23:26:58.797732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.778514Z","title":"Post-processing model outputs to detect and remove or modify undesirable content (e.g., harmful language, private information)","venue":null,"work_id":"afa90781-9957-4df3-8d83-867f4c60a697","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.678601Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d7bc3df5993a8b873eb9f56511341a6755489f856c083ae26a9ebc759a0e3fc9","observation_id":"de7b95c0-a8b2-4dd9-9fe6-a012e10dd32d","resolution":{"observed_at":"2026-08-06T23:26:58.782975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.764402Z","title":"Abstaining from providing an output or escalating to a human supervisor if the model’s confidence in its output is below a certain threshold","venue":null,"work_id":"0675db48-cdcd-4469-885c-de99dee9b3e8","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.682862Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:0c0abec4ecb1dfef80da6ff5c31e4c6628af641d70e4d376c8a95822432f60ed","observation_id":"61463965-6dd4-4ebf-a701-7cd32e43c7db","resolution":{"observed_at":"2026-08-06T23:26:58.769030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.749929Z","title":null,"venue":null,"work_id":"c7541cb0-e900-424e-b475-c8f5abb8c82c","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.688090Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:7983bf44021dec36b499f73c1f71f40b5840802530c5e267c63e22795f43453b","observation_id":"d636dba1-dc82-4894-b1d9-e124cb2b2de6","resolution":{"observed_at":"2026-08-06T23:26:58.754604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.735233Z","title":"Altering or ablating spe- cific internal parts of a model (e.g., neurons, attention heads, identified circuits) that are understood to contribute to certain behaviours","venue":null,"work_id":"5dfb4da4-1451-4142-a1b8-1d2ed9e8f993","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.692639Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:2135157494eae4ccc8031e36c4f85606681a6c2c9d273d915b50f834dfaede2e","observation_id":"e9b295af-af6a-4be9-9f08-84368c33ec4c","resolution":{"observed_at":"2026-08-06T23:26:58.740118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.721198Z","title":"Using explanations of model behaviour (e.g., why a particular output was generated) to identify and diagnose issues","venue":null,"work_id":"3e9f1606-be49-4a40-8621-1b30673c7d7d","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.697467Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:5d857e842d34482691c6375a85238e88eb9c7aff723e90b445a24134d3afd4cb","observation_id":"33e4d8b3-b717-4388-a6c0-b7e52fd0e5d1","resolution":{"observed_at":"2026-08-06T23:26:58.725762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.705459Z","title":"Directly modifying model weights or structure based on interpretability insights to correct specific knowledge or behaviours without full retraining","venue":null,"work_id":"d7d1f6db-7afa-48ed-8622-3b622fb8cf14","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.702606Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:64dfb5daab0687776bb33f149b433e047b5b42537a73b96b5377dfd85b14d217","observation_id":"be31639d-5d89-4ecb-abee-769f7f19d1b0","resolution":{"observed_at":"2026-08-06T23:26:58.711078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.690831Z","title":"Techniques for capturing human preferences and values to guide AI behaviour, often by training a reward model RM (y) based on human feedback","venue":null,"work_id":"636abe41-6cad-42da-8403-c964b5db675a","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.706937Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:31e767d46c1e207eff17ea22dad57f0d7f93bac539d56a069b9913b1e4852786","observation_id":"3771ab7b-4652-4736-85e8-0a32f8be8af0","resolution":{"observed_at":"2026-08-06T23:26:58.695414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.677212Z","title":"Using a learned reward model or direct human feedback to fine-tune a base AI model towards desired behaviours","venue":null,"work_id":"79b3d246-80ec-4dbc-8d0c-6f20ebd85249","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.711319Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:ff43d44d42f79ac75decb47c520e3a161a0528e35ff887af9442b1bed3ce4cc1","observation_id":"5f6db323-c4bd-4170-bb47-0db365045fbd","resolution":{"observed_at":"2026-08-06T23:26:58.681521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.663096Z","title":"Systematically probing AI systems to discover vulnerabilities, failure modes, and misalignments before deployment","venue":null,"work_id":"17ba32d7-f5fd-40b8-85b7-50a1ea74c538","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.715979Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:c67ac3a1e39c2f0e77eeb23794f3e13e3ed2eb157825036cd6b11fdb65614f7a","observation_id":"0528181c-23ff-4844-8914-5c5de2637eb5","resolution":{"observed_at":"2026-08-06T23:26:58.667564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.646909Z","title":"Defining explicit principles, rules, or constitutions that the AI must adhere to, and using AI itself to critique and revise its outputs to comply with these rules","venue":null,"work_id":"8fe6dbac-1604-4337-8bfc-13fd86b00eb5","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.721090Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:edd046459b10b2dca5fd9bc5da590e1e437930e3b44d93d1723f27ddf1377cea","observation_id":"be72f600-06fa-4be9-a576-4eee69244c81","resolution":{"observed_at":"2026-08-06T23:26:58.652156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.632247Z","title":"Designing the rules of interaction, com- munication protocols, and reward/utility functions for individual agents within a multi-agent system","venue":null,"work_id":"9fdc6a9f-7ccf-41c2-9cc0-7523fa226cb4","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.726466Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f128e179645d102a59853512e857ad27045dc6da74a582ff68d85394dd098c29","observation_id":"f6f45057-65f6-4903-86da-4d7e61b71c53","resolution":{"observed_at":"2026-08-06T23:26:58.637303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.616873Z","title":"Implementing systems for establish- ing, communicating, monitoring, and enforcing social norms or rules within an AI agent population","venue":null,"work_id":"e2b9ac95-36e0-4863-9709-8ab8e3d3704b","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.730928Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:2a4001369511d6cf7c0e9b66c8330a1cc54f6ff00f128a28586add4c51783214","observation_id":"a21a1b03-6151-4c23-8997-e89952978811","resolution":{"observed_at":"2026-08-06T23:26:58.622214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.600133Z","title":"Establishing standardized ways for agents to exchange information, signal intent, and coordinate actions","venue":null,"work_id":"117afae1-3587-4b53-8238-8c797ee1647c","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.735359Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:580969a73097e7e9df4ee6e1232ac9a81aff02a271d7f644313328d03abc701d","observation_id":"c8a6f8aa-4642-4ae1-b1a5-83fbe2dacebf","resolution":{"observed_at":"2026-08-06T23:26:58.604718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.585164Z","title":"Governments and international bodies establishing laws, standards, and policies governing the development, deployment, and use of AI","venue":null,"work_id":"72b713c0-d27b-40e6-81bd-7f63929f2ef2","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.740359Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:02812e9a5acb5a5a258e67332f7ed2f90d14caf7effcff6a0dc1d41fb6f256b5","observation_id":"0f60556e-98cf-449a-ad22-b3078b03615a","resolution":{"observed_at":"2026-08-06T23:26:58.589930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.570706Z","title":"Professional organiza- tions, research institutions, and industry consortia developing and promoting principles for responsible AI","venue":null,"work_id":"c77178d9-bc9b-4a99-8f51-3aac0c940dec","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.744788Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:fd52a894ebdb320e424209e5ff91303c7eef1854543fd78cfa86bcd446e41959","observation_id":"c3ed02ca-6c23-420c-ab9c-fb9993b972d3","resolution":{"observed_at":"2026-08-06T23:26:58.575331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.556030Z","title":"Efforts to inform the public about AI, foster critical discussion, and involve diverse stakeholders in shaping AI’s future","venue":null,"work_id":"88c30228-9d26-4a51-9a65-8342e2ffb705","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.749304Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:bdd047cbba4f27a2c6860bfe8130da103e2f055501588265f8d563386c3db5c7","observation_id":"1f3a2255-c9e2-4c71-af75-151daf40becd","resolution":{"observed_at":"2026-08-06T23:26:58.560878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.539581Z","title":"Formal processes for evaluating the potential societal impacts of AI systems before and during deployment, and for independently verifying claims about their safety or fairness","venue":null,"work_id":"c4d42899-4126-44c9-945b-a66b2c8d7660","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.754155Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:ac95248a194a4df5a1b636627164b8eda75572a47e53c539b160261fa4a9caf9","observation_id":"6e1b6198-ad87-4f12-860d-c8be1e6c09ab","resolution":{"observed_at":"2026-08-06T23:26:58.544836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T19:34:31.461439Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":45,"verified_exact":1,"verified_fuzzy":47},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 1 inbound Pith citation observation for arXiv:2506.17846."}