{"as_of":"2026-08-13T14:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:16c3eb50cab5184adb5d7bcf3e1299702ac3a4a3353f4e9a562474a72f765cbd","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:35:02.320784Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:29:24.656530Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T07:34:21.626740Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"cited_work":{"arxiv_id":"2412.11867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.11867","snapshot_observed_at":"2026-06-30T07:34:21.626740Z","title":"Spies, William Edwards, Michael I","venue":null,"work_id":"50d42432-6bba-4209-a3c9-0af0bde7120b","year":2025},"citing_paper":{"arxiv_id":"2604.22227","last_updated":"2026-04-29T07:51:58Z","snapshot_observed_at":"2026-08-11T23:45:02.118870Z","submitted_at":"2026-04-24T05:02:20Z","title":"A Co-Evolutionary Theory of Human-AI Coexistence: Mutualism, Governance, and Dynamics in Complex Societies","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T09:51:33.783535Z"},"links":{"cited_paper":"/paper/2412.11867","citing_paper":"/paper/2604.22227"},"observation_digest":"sha256:1b2a8d76b6da6b648f479b60a3cdbb9d07517f1459cde786b885ae010ddda1a3","observation_id":"1245c3f9-0ba0-405f-8c8d-fdf6f0a6fbe9","resolution":{"observed_at":"2026-05-11T20:16:08.936468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"cited_work":{"arxiv_id":"2412.11867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.11867","snapshot_observed_at":"2026-06-30T07:34:21.626740Z","title":"Spies, William Edwards, Michael I","venue":null,"work_id":"50d42432-6bba-4209-a3c9-0af0bde7120b","year":2025},"citing_paper":{"arxiv_id":"2605.20784","last_updated":"2026-05-20T06:25:49Z","snapshot_observed_at":"2026-07-06T23:31:18.520630Z","submitted_at":"2026-05-20T06:25:49Z","title":"Interaction Locality in Hierarchical Recursive Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T05:04:14.532933Z"},"links":{"cited_paper":"/paper/2412.11867","citing_paper":"/paper/2605.20784"},"observation_digest":"sha256:940841bc6751061eca4b150570f351aba19f37ecacfc1c02c49544087634e976","observation_id":"639df370-b7d8-4661-b2fc-7e397cfb41b7","resolution":{"observed_at":"2026-05-21T05:04:37.210641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"cited_work":{"arxiv_id":"2412.11867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.11867","snapshot_observed_at":"2026-06-30T07:34:21.626740Z","title":"Spies, William Edwards, Michael I","venue":null,"work_id":"50d42432-6bba-4209-a3c9-0af0bde7120b","year":2025},"citing_paper":{"arxiv_id":"2606.29315","last_updated":"2026-06-28T10:21:55Z","snapshot_observed_at":"2026-08-05T11:59:47.223958Z","submitted_at":"2026-06-28T10:21:55Z","title":"Hierarchical Experimentalist Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T07:29:24.656530Z"},"links":{"cited_paper":"/paper/2412.11867","citing_paper":"/paper/2606.29315"},"observation_digest":"sha256:28d607d29f22066893169b5edfdf145ff9a132d98e473eec2ce0274dd6795b9f","observation_id":"701e4781-67ff-4f63-b6ea-d7d59ededb3c","resolution":{"observed_at":"2026-06-30T07:34:21.628437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.11867/citation-record","integrity":"/paper/2412.11867/integrity","json":"/paper/2412.11867/citation-record.json","paper":"/paper/2412.11867"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-11T14:35:02.214193Z","title":"Understanding intermediate layers using linear classifier probes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.214193Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:0e8954b68703652c8dcb903cb70fd8cac9702713f2fc6330c398830be67deb6e","observation_id":"ad6820a7-19e1-403c-b153-3420259e9e13","resolution":{"observed_at":"2026-08-11T14:35:02.214193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.621553Z","title":null,"venue":null,"work_id":"97bc9f55-0ded-47ca-be82-0cab4cb3081d","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.304268Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:f0ae7d9422f37cab3fcc42442124596aa5a4de7c1dc0d3618438a43196be3d23","observation_id":"fb8e1ec8-914d-4e19-819b-4f47327e8ea7","resolution":{"observed_at":"2026-08-11T14:35:02.625767Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-11T14:35:02.228788Z","title":"Nelson Elhage, Neel Nanda, Catherine Olsson, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.228788Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:4ecacb9752cf79000b7b247a9bbebb468aaefc7a502b2fb7e6377cdb5366d509","observation_id":"0fcc66e0-6d0c-4c5f-8663-72ea7388104c","resolution":{"observed_at":"2026-08-11T14:35:02.228788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.608915Z","title":"1- and 3-back","venue":null,"work_id":"a329f8cb-1836-4c92-8743-04786ddf9727","year":2024},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.308523Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:dceac668cf3fc5fb749180bc432ba95382ac620ba4e7f5a48106294761710993","observation_id":"6e600833-0be1-47ec-ae0b-6e41b528d5df","resolution":{"observed_at":"2026-08-11T14:35:02.612977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00877","last_updated":"2024-06-02T21:57:32Z","snapshot_observed_at":"2026-08-12T23:52:03.444117Z","submitted_at":"2024-06-02T21:57:32Z","title":"Evidence of Learned Look-Ahead in a Chess-Playing Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00877","snapshot_observed_at":"2026-08-11T14:35:02.251568Z","title":"Erik Jenner, Shreyas Kapur, Vasil Georgiev, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.251568Z"},"links":{"cited_paper":"/paper/2406.00877","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:12ad4bba346b1e39b4167dcf82ed8f8afb5db8fe0832546d3fc7821e49d1e571","observation_id":"2fbfb1a6-0ec6-43c2-852e-4c3c43cd9f9a","resolution":{"observed_at":"2026-08-11T14:35:02.251568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.661148Z","title":"Anthropic circuits Updates - January 2024, Jan- uary","venue":null,"work_id":"44407a0a-0723-4218-8108-20e3c05908d8","year":2024},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.256398Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:8ab1689a7b8263a3dc4a626ba6af506579b1af1abd78e58234558e70520235c1","observation_id":"74d95881-dbef-4728-9b18-037837a381a6","resolution":{"observed_at":"2026-08-11T14:35:02.665287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15498","last_updated":"2024-07-14T20:23:19Z","snapshot_observed_at":"2026-08-13T00:48:22.560549Z","submitted_at":"2024-03-21T18:53:23Z","title":"Emergent World Models and Latent Variable Estimation in Chess-Playing Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15498","snapshot_observed_at":"2026-08-11T14:35:02.260686Z","title":"Adam Karvonen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.260686Z"},"links":{"cited_paper":"/paper/2403.15498","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:62d6e33a2d3e5b9436a67b051fd57a10e793b7f88c43297407da30269cec2b0f","observation_id":"b86b0fd5-d3c7-4d0a-83af-ce31c2c8ed5a","resolution":{"observed_at":"2026-08-11T14:35:02.260686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00113","last_updated":"2024-10-30T14:21:59Z","snapshot_observed_at":"2026-08-12T23:10:43.877749Z","submitted_at":"2024-07-31T18:45:13Z","title":"Measuring Progress in Dictionary Learning for Language Model Interpretability with Board Game Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00113","snapshot_observed_at":"2026-08-11T14:35:02.265630Z","title":"Measuring progress in dictionary learning for language model interpretability with board game models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.265630Z"},"links":{"cited_paper":"/paper/2408.00113","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:1a2f4fb732ad0c5e8f11e29e9f6b43fc7d191e9342fb9203ef91086c033e6789","observation_id":"fe097f5d-d18e-4551-a47e-89f0af4336ac","resolution":{"observed_at":"2026-08-11T14:35:02.265630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13382","last_updated":"2024-06-26T14:27:49Z","snapshot_observed_at":"2026-08-13T13:58:07.766526Z","submitted_at":"2022-10-24T16:29:55Z","title":"Emergent World Representations: Exploring a Sequence Model Trained on a Synthetic Task","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13382","snapshot_observed_at":"2026-08-11T14:35:02.270102Z","title":"Emergent world representations: Exploring a sequence model trained on a synthetic task","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.270102Z"},"links":{"cited_paper":"/paper/2210.13382","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:f60006c151c404fd6d5c00e5d593b57a0ea454d5d5b01a66625d728bd837a6ea","observation_id":"ffa14660-9086-4895-a091-95d0c089fc04","resolution":{"observed_at":"2026-08-11T14:35:02.270102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09458","last_updated":"2023-07-24T08:32:40Z","snapshot_observed_at":"2026-08-13T10:53:08.817635Z","submitted_at":"2023-07-18T17:39:04Z","title":"Does Circuit Analysis Interpretability Scale? Evidence from Multiple Choice Capabilities in Chinchilla","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09458","snapshot_observed_at":"2026-08-11T14:35:02.274512Z","title":"Does Circuit Analysis Interpretability Scale? Evidence from Multiple Choice Capabilities in Chinchilla","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.274512Z"},"links":{"cited_paper":"/paper/2307.09458","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:722537175c7f03080b3999db21f4ce32771d5c9b887dee41f114b7c9929b2b9a","observation_id":"d7358571-6f56-4511-93e4-2986f1dc8bc3","resolution":{"observed_at":"2026-08-11T14:35:02.274512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03207","last_updated":"2024-05-06T07:12:45Z","snapshot_observed_at":"2026-08-13T00:14:15.913645Z","submitted_at":"2024-05-06T07:12:45Z","title":"A Philosophical Introduction to Language Models - Part II: The Way Forward","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03207","snapshot_observed_at":"2026-08-11T14:35:02.278670Z","title":"Ida Momennejad, Hosein Hasanbeig, Felipe Vieira Frujeri, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.278670Z"},"links":{"cited_paper":"/paper/2405.03207","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:123c4525b47f673274d2631fb85c181b3fc35cbe2bd30b825270c9f5c7d68eb8","observation_id":"ce172b65-e52a-4973-9810-58cf95fd697f","resolution":{"observed_at":"2026-08-11T14:35:02.278670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-11T14:35:02.282864Z","title":"In-context Learning and Induction Hea ds","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.282864Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:e49178bf53859489cb35f3a36e27a3749e5ccd0a0ce7ce333788dfaffc867059","observation_id":"860adedc-0d51-4d48-b774-b659bcaf6d71","resolution":{"observed_at":"2026-08-11T14:35:02.282864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04897","last_updated":"2023-11-08T18:56:35Z","snapshot_observed_at":"2026-08-13T05:29:38.854663Z","submitted_at":"2023-11-08T18:56:35Z","title":"Future Lens: Anticipating Subsequent Tokens from a Single Hidden State","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04897","snapshot_observed_at":"2026-08-11T14:35:02.287451Z","title":"Future lens: Anticipating subsequent tokens from a single hidden state","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.287451Z"},"links":{"cited_paper":"/paper/2311.04897","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:5b41e3216086258d8e63a0ce5b2cdcebc0df2260f2017baf816cdcb86b8ebb0d","observation_id":"fb3f64f0-6dc3-4956-ac65-ca8c7665e917","resolution":{"observed_at":"2026-08-11T14:35:02.287451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.647347Z","title":"Toward Transparent AI: A Survey on Interpreting the Inner Structures of Deep Neural Networks","venue":null,"work_id":"9f57fb4c-5b0c-4bc9-b9aa-6148748f4270","year":2023},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.291900Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:a9e94392ecf8cfedaec83bbc95a2d7ec3e3bbbdab451f1ecd07fa8dda0102c77","observation_id":"f57ce243-8517-4410-aa13-d050866bb63f","resolution":{"observed_at":"2026-08-11T14:35:02.652386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.07512","last_updated":"2022-07-15T14:57:33Z","snapshot_observed_at":"2026-08-13T05:56:38.304552Z","submitted_at":"2022-07-15T14:57:33Z","title":"Sparse Relational Reasoning with Object-Centric Representations","version":1},"cited_work":{"arxiv_id":"2207.07512","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.07512","snapshot_observed_at":"2026-08-11T14:35:02.354938Z","title":"Sparse Relational Reasoning with Object-Centric Representations","venue":"cs.LG","work_id":"9c8ff4f3-0352-41b9-947e-5e017dd32cd0","year":2022},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.295539Z"},"links":{"cited_paper":"/paper/2207.07512","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:22a9de8eafcbcd37bdd851b191940a2715d1b22aba36da05cc7d7aa09e9f0aa9","observation_id":"abb4c6b7-46f6-45ca-9ccb-059987e141d5","resolution":{"observed_at":"2026-08-11T14:35:02.361877Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.595908Z","title":"16 Published as a conference paper at ICLR 2025 0 1 2 3 4 Maze X 4 3 2 1 0Maze Y 95% (1798,","venue":null,"work_id":"44cdfd3e-bb66-4cec-8f40-29fbeffa8dd9","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.312621Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:c2f8edbbd03fc6905a7841b3bc6970a4b7d4620e45578b880dc3b189f0513221","observation_id":"49894076-1b22-4827-b887-1abb20e781a6","resolution":{"observed_at":"2026-08-11T14:35:02.600405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.569581Z","title":"generic edge","venue":null,"work_id":"1f70a11d-6b1c-4a14-9d22-9d35698d0e01","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.320784Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:4ece935771fdaa5c3d51774a7b6ec0d6d9435da493b72e563aedab64a46a4c87","observation_id":"8cf25f77-76e5-4a1c-b50f-a9f95ebb3eb5","resolution":{"observed_at":"2026-08-11T14:35:02.573839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.582862Z","title":null,"venue":null,"work_id":"5243fb9b-f472-4447-9e0f-b611596a0933","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":1619,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.316637Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:da8d966e613260ed37259fc82ee7b19e2d5d89aef88802ed8db60a3c2a687246","observation_id":"6cd74cfd-3c54-44fc-97c0-c9bed4e904db","resolution":{"observed_at":"2026-08-11T14:35:02.587225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-08-12T19:18:05.160367Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-08-11T14:35:02.219578Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.219578Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:f68527e71d4a771099088f191659ca568de258377f287d4946293eb4733e647f","observation_id":"4cb9fc3c-d98d-4eaa-8267-4c3a2d95d717","resolution":{"observed_at":"2026-08-11T14:35:02.219578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.634309Z","title":"Train Val","venue":null,"work_id":"93dea119-b1eb-43e1-be56-5bc4855451de","year":2025},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.299935Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:5e392286a2710ae9bd1dd8f63ee4f1b0a962e166d677f260ceeb062f85fa06f0","observation_id":"0316d28b-0e31-4bc5-86fb-a7e79b944b80","resolution":{"observed_at":"2026-08-11T14:35:02.638475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10498","last_updated":"2023-10-24T21:42:01Z","snapshot_observed_at":"2026-08-13T10:10:06.528194Z","submitted_at":"2023-09-19T10:20:11Z","title":"A Configurable Library for Generating and Manipulating Maze Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10498","snapshot_observed_at":"2026-08-11T14:35:02.247220Z","title":"Ivanitskiy, Rusheb Shah, Alex F Spies, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.247220Z"},"links":{"cited_paper":"/paper/2309.10498","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:b9c017d6481fd3353e0940f24467f48ca543f62283f756377bb72527698b7c7f","observation_id":"c8627dc5-4146-435b-83a8-1f641af29e63","resolution":{"observed_at":"2026-08-11T14:35:02.247220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-11T14:35:02.233057Z","title":"Nelson Elhage, Tristan Hume, Catherine Olsson, et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.233057Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:95074fe5fb885ee508e8c18b7305471b0c71ec21158e3b703ad3b41a1d0ef47c","observation_id":"cfddd630-c145-45ea-8d31-0c8dac448b06","resolution":{"observed_at":"2026-08-11T14:35:02.233057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12201","last_updated":"2024-02-19T15:04:53Z","snapshot_observed_at":"2026-08-13T04:15:21.594134Z","submitted_at":"2024-02-19T15:04:53Z","title":"Dictionary Learning Improves Patch-Free Circuit Discovery in Mechanistic Interpretability: A Case Study on Othello-GPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12201","snapshot_observed_at":"2026-08-11T14:35:02.237878Z","title":"Dictionary learning improves patch-free circuit discov- ery in mechanistic interpretability: A case study on othello-gpt.arXiv preprint arXiv:2402.12201,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.237878Z"},"links":{"cited_paper":"/paper/2402.12201","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:d4fe8665822d4046cdc7a1f4c07a7409b71f1768903d84ddb7dfa4aa52fd5b38","observation_id":"44d25516-9f58-4091-bed9-8d8c97c6f7fe","resolution":{"observed_at":"2026-08-11T14:35:02.237878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11917","last_updated":"2024-06-30T00:52:49Z","snapshot_observed_at":"2026-08-13T04:15:41.132675Z","submitted_at":"2024-02-19T08:04:25Z","title":"A Mechanistic Analysis of a Transformer Trained on a Symbolic Multi-Step Reasoning Task","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11917","snapshot_observed_at":"2026-08-11T14:35:02.224040Z","title":"Jannik Brinkmann, Abhay Sheshadri, Victor Levoso, et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.224040Z"},"links":{"cited_paper":"/paper/2402.11917","citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:253fac79c92a27de94c64cc000f2acf8e5b9ee4d80ad8267fd3205507b461386","observation_id":"8c358437-31b3-4607-8bbc-1ad78d6c1e84","resolution":{"observed_at":"2026-08-11T14:35:02.224040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:35:02.673792Z","title":"A structural probe for finding syntax in word representa- tions","venue":null,"work_id":"87d52b0c-f5f7-4051-8b83-affeda92f298","year":2019},"citing_paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T14:35:02.242749Z"},"links":{"citing_paper":"/paper/2412.11867"},"observation_digest":"sha256:5ac82a11d1139db6bbcab4203b40cd8e955fcaa4cfb2a77b8b1db4cde9aa6b32","observation_id":"580dea35-582c-4dfc-84fb-23ca7e1bf622","resolution":{"observed_at":"2026-08-11T14:35:02.677759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11867","last_updated":"2025-03-05T23:16:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T00:31:34.836819Z","submitted_at":"2024-12-16T15:21:04Z","title":"Transformers Use Causal World Models in Maze-Solving Tasks"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 3 inbound Pith citation observations for arXiv:2412.11867."}