{"as_of":"2026-08-10T06:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f8fcc6a470ee3d72a073db2ff9ff29457b78d4720c84e6635f3927b80dccb29","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T01:03:22.328312Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T03:50:15.977348Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:59:21.346717Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":"2506.12152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-04T00:59:21.346717Z","title":"VisualToolAgent (VisTA): A reinforcement learning framework for visual tool selection","venue":null,"work_id":"999186fc-4810-434b-96a8-ffa8a517d50d","year":2025},"citing_paper":{"arxiv_id":"2505.15436","last_updated":"2025-12-05T05:44:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-21T12:18:15Z","title":"Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-17T05:35:13.118221Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2505.15436"},"observation_digest":"sha256:a21ca52964ba00a30dd39540ce650fcbe8df2561df6e2b04b2b46ec4b119c982","observation_id":"8949abfc-dd1c-4b41-85b6-5aed53fdaacc","resolution":{"observed_at":"2026-05-17T05:35:13.274940Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-08-03T03:50:15.977348Z","title":"arXiv preprint arXiv:2506.12152 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06841","last_updated":"2026-05-31T17:09:07Z","snapshot_observed_at":"2026-08-09T07:23:34.031341Z","submitted_at":"2026-02-06T16:34:29Z","title":"From Features to Actions: Explainability in Traditional and Agentic AI Systems","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T03:50:15.977348Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2602.06841"},"observation_digest":"sha256:a3e748dc68cb15d96024e382d5ce9a8ab5228b9b8c71abbfbc7dfcecadee0494","observation_id":"715bf029-5944-4d4b-a090-5a2e8a47486a","resolution":{"observed_at":"2026-08-03T03:50:15.977348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":"2506.12152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-04T00:59:21.346717Z","title":"VisualToolAgent (VisTA): A reinforcement learning framework for visual tool selection","venue":null,"work_id":"999186fc-4810-434b-96a8-ffa8a517d50d","year":2025},"citing_paper":{"arxiv_id":"2606.07007","last_updated":"2026-06-05T07:52:43Z","snapshot_observed_at":"2026-08-04T06:36:27.490603Z","submitted_at":"2026-06-05T07:52:43Z","title":"A Geometric View for Understanding Concept Learning and Neuron Interpretation in Sparse Autoencoders","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-27T22:22:50.474397Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2606.07007"},"observation_digest":"sha256:7053221770dabfb14615a3c54d54983f9888f4a3e7289a4c2f31dd35c3093790","observation_id":"b9b42aa7-1170-456f-92e8-9d6809daa34b","resolution":{"observed_at":"2026-07-02T16:47:09.928488Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":"2506.12152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-04T00:59:21.346717Z","title":"VisualToolAgent (VisTA): A reinforcement learning framework for visual tool selection","venue":null,"work_id":"999186fc-4810-434b-96a8-ffa8a517d50d","year":2025},"citing_paper":{"arxiv_id":"2606.19559","last_updated":"2026-06-17T19:59:32Z","snapshot_observed_at":"2026-08-05T18:12:36.227027Z","submitted_at":"2026-06-17T19:59:32Z","title":"Uncertainty Decomposition for Clarification Seeking in LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T20:44:06.027685Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2606.19559"},"observation_digest":"sha256:f1a5d5e0663821de9d10563c5c3a845e1d509f7889ee72feb086218398694bf9","observation_id":"d0440bd1-9207-4522-b016-ff15cda7a584","resolution":{"observed_at":"2026-07-04T00:59:21.349255Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":"2506.12152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-04T00:59:21.346717Z","title":"VisualToolAgent (VisTA): A reinforcement learning framework for visual tool selection","venue":null,"work_id":"999186fc-4810-434b-96a8-ffa8a517d50d","year":2025},"citing_paper":{"arxiv_id":"2606.27510","last_updated":"2026-06-25T19:52:16Z","snapshot_observed_at":"2026-08-09T18:48:23.055970Z","submitted_at":"2026-06-25T19:52:16Z","title":"The Curse of Multiple Mediators: Hidden Interaction Effects in Activation Patching","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T01:47:46.342400Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2606.27510"},"observation_digest":"sha256:f94cc3761172ccfbfb58a8b1b412d405f0a260a8620169f232130159a2eb021e","observation_id":"6e828df5-a319-45ff-a816-957d22a9a462","resolution":{"observed_at":"2026-07-01T18:45:58.488988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12152","snapshot_observed_at":"2026-07-31T23:35:49.490635Z","title":"& Tafjord, O","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23927","last_updated":"2026-07-27T01:47:12Z","snapshot_observed_at":"2026-08-09T08:36:12.705210Z","submitted_at":"2026-07-27T01:47:12Z","title":"Reality Monitoring in Large Language Models: Self-Knowledge That Transforms with Conversation Memory","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-31T23:35:49.490635Z"},"links":{"cited_paper":"/paper/2506.12152","citing_paper":"/paper/2607.23927"},"observation_digest":"sha256:e8801dec19c4ed9e12ae241498bfe178b58e60f75a740fca7c13717662b9f4a7","observation_id":"78706c2d-689e-48bf-a2ca-7c96dc239c67","resolution":{"observed_at":"2026-07-31T23:35:49.490635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12152/citation-record","integrity":"/paper/2506.12152/integrity","json":"/paper/2506.12152/citation-record.json","paper":"/paper/2506.12152"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:23.543789Z","title":"Abdul, J","venue":null,"work_id":"86619b38-0682-4e92-87ce-a93536a188db","year":2018},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.157838Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:fd54b6ebc22d1b72ef2568de7ec8b6519a98a90d9a595f2bb203fc7ed9c6737f","observation_id":"91d74f30-bc4c-459d-9d54-e29fb3303496","resolution":{"observed_at":"2026-08-07T01:03:23.670680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-08-09T11:08:40.708986Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-07T01:03:20.807887Z","title":"Grosse, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.807887Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:6ee0079be6a5f0728dc485464ca3ce4c680871fed6c6835dcffe60d013d1a756","observation_id":"7309861d-5495-4868-847b-d9a5f7b77729","resolution":{"observed_at":"2026-08-07T01:03:20.807887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:20.917665Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.917665Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:9a5816089be539b9aa189c53d7ba70047898c84c7f6f94084e04da3d0af2e1db","observation_id":"5660c1af-c3fc-4483-a960-a1a2a1234d4b","resolution":{"observed_at":"2026-08-07T01:03:20.917665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:21.093735Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.093735Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:ddbb4540c029eacd07443e130ac34180d8b6865cd94736e5a9784b4a85a02869","observation_id":"065723a3-5382-48fc-8277-e83830fc674f","resolution":{"observed_at":"2026-08-07T01:03:21.093735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:21.338690Z","title":"doi: 10.1145/3564240","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.338690Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:7ada647bfa6c78a3dbd83f50d0df7c0aa60f94a687a136284dd2b09c3fedc07c","observation_id":"99aaa16c-8ae6-4aa2-b35e-a55530ecda6a","resolution":{"observed_at":"2026-08-07T01:03:21.338690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01849","last_updated":"2025-04-02T15:59:31Z","snapshot_observed_at":"2026-08-07T16:14:13.125798Z","submitted_at":"2025-04-02T15:59:31Z","title":"An Approach to Technical AGI Safety and Security","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01849","snapshot_observed_at":"2026-08-07T01:03:21.407547Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.407547Z"},"links":{"cited_paper":"/paper/2504.01849","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:dc08df647414e943e120a8b4c257c18cf801f552e3d1082f6d29681996b39be2","observation_id":"b20b3980-7f26-480f-9757-23a47c91446e","resolution":{"observed_at":"2026-08-07T01:03:21.407547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-07T01:03:21.495743Z","title":"Sharkey, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.495743Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:ec75fe862585164e9deeef492b7d5c48fbe91bdfbe1924e7a18eaccf7e2e45a1","observation_id":"5584384c-eafb-41cf-9f8c-642c945093dd","resolution":{"observed_at":"2026-08-07T01:03:21.495743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:21.637308Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.637308Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:4756a21a3b7de7fb3fe6eb24809d30a32226164d4d26774831690bfd537e6f51","observation_id":"f2e9c52c-864f-43da-97e9-fc5dcca42dd8","resolution":{"observed_at":"2026-08-07T01:03:21.637308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:21.710057Z","title":"doi: 10.18653/v1/D16-1159","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.710057Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:a327d49589e9d8ded32b58ff2010758cc29ed0b2589b67dec6a431ddcf0356a2","observation_id":"a7bdb23f-159c-4c85-a2eb-c10b77497794","resolution":{"observed_at":"2026-08-07T01:03:21.710057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02674","last_updated":"2025-02-25T16:59:11Z","snapshot_observed_at":"2026-08-08T15:10:21.294174Z","submitted_at":"2024-12-03T18:47:26Z","title":"Mind the Gap: Examining the Self-Improvement Capabilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02674","snapshot_observed_at":"2026-08-07T01:03:21.917517Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.917517Z"},"links":{"cited_paper":"/paper/2412.02674","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:8a37a3ac0f889157032eaa28d38d5e2ea3b34ef350a5e168cf8fa0e3d66ad0ab","observation_id":"eb7f58e0-4da1-417f-8b70-2b500455401a","resolution":{"observed_at":"2026-08-07T01:03:21.917517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05070","last_updated":"2024-08-20T19:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-07T18:21:17Z","title":"A Roadmap to Pluralistic Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05070","snapshot_observed_at":"2026-08-07T01:03:21.990940Z","title":"org/abs/2402.05070","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.990940Z"},"links":{"cited_paper":"/paper/2402.05070","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:61122e354337d7abaf456cddf8269094068fcc43e86d7bc9fd890e4bf0ee14d7","observation_id":"41a21ca5-2781-41f9-a691-92e990be6664","resolution":{"observed_at":"2026-08-07T01:03:21.990940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T01:03:22.291884Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:22.291884Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:785251f4a0d3e1964bb2d54f06070e63440bb505a164fa95ca8b3235ff6723bb","observation_id":"b9a5a264-c583-455f-8512-4cb5075a344e","resolution":{"observed_at":"2026-08-07T01:03:22.291884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01910","last_updated":"2023-03-10T17:20:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-03T15:43:03Z","title":"Large Language Models Are Human-Level Prompt Engineers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01910","snapshot_observed_at":"2026-08-07T01:03:22.328312Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:22.328312Z"},"links":{"cited_paper":"/paper/2211.01910","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:c8b55ec0d261ac53f8bd02e38a27a16b30d1f4d43f0668558e1102c6701f5794","observation_id":"a9a5d7c8-0322-4597-9f3f-d296e7bb0d50","resolution":{"observed_at":"2026-08-07T01:03:22.328312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:22.067758Z","title":"URLhttps://www.ncbi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":1974,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:22.067758Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:eb5a70c600bdf8bc08236277a1b150cd702712233030031c4d219e6d50f2319b","observation_id":"c9c4d9f5-7700-4a11-892a-e4fe517619da","resolution":{"observed_at":"2026-08-07T01:03:22.067758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:23.165546Z","title":"Merriam-webster, Accessed on 2025-05-22","venue":null,"work_id":"58a8ef8b-d187-43df-bc9d-ec13993a9894","year":2025},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":1982,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.227715Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:944171fdb728d8b1a94bcf71864472f890f8cec28ce09c028d01f2ce87a25588","observation_id":"28924536-ca9b-4f84-a1e7-c13635f86df4","resolution":{"observed_at":"2026-08-07T01:03:23.233742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07882","last_updated":"2024-10-14T17:46:28Z","snapshot_observed_at":"2026-07-06T18:29:21.709395Z","submitted_at":"2024-06-12T05:20:16Z","title":"Designing a Dashboard for Transparency and Control of Conversational AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07882","snapshot_observed_at":"2026-08-07T01:03:20.611033Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":1993,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.611033Z"},"links":{"cited_paper":"/paper/2406.07882","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:1b730254cd2735c5a7afa3280e8afad8ee11761a8087d083205a5d2b24d56090","observation_id":"a2856cf9-3960-4f23-8784-086a987b8959","resolution":{"observed_at":"2026-08-07T01:03:20.611033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-07T01:03:20.741567Z","title":"URLhttps://www.science.org/doi/ abs/10.1126/science.1218633","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.741567Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:4423c17b94157ad8dc6d69fcc3801732337291b0f8c6371bb689a16a6e82a9fe","observation_id":"ecd4a1a0-0a54-48aa-9cdd-44aae1d59611","resolution":{"observed_at":"2026-08-07T01:03:20.741567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T01:03:20.338834Z","title":"org/CorpusID:127197","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.338834Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:ecb29cd9b19d4caab087d7e782e415b4b51a7316e3f00f17dd04219c9cbcc3bf","observation_id":"bdaa9f40-15d2-4727-9204-0c22b5514aad","resolution":{"observed_at":"2026-08-07T01:03:20.338834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:20.677305Z","title":"doi: 10.18653/v1/W16-2524","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.677305Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:a7d8b61c1a1e68fd046a76f9b88864c18fe0751c168a85776743b6b42e36f614","observation_id":"402b051c-2f8b-494d-9fe3-1b581854a724","resolution":{"observed_at":"2026-08-07T01:03:20.677305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10965","last_updated":"2025-03-28T01:48:40Z","snapshot_observed_at":"2026-08-08T08:53:29.457485Z","submitted_at":"2025-03-14T00:21:15Z","title":"Auditing language models for hidden objectives","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10965","snapshot_observed_at":"2026-08-07T01:03:21.160673Z","title":"Marks, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.160673Z"},"links":{"cited_paper":"/paper/2503.10965","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:5a6ebda31e15233297f8603b78e274bf344214219b5f814ca42de3052ec389cf","observation_id":"2f079495-60a1-40d6-a715-75f588fa91e0","resolution":{"observed_at":"2026-08-07T01:03:21.160673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05382","last_updated":"2016-09-25T22:15:38Z","snapshot_observed_at":"2026-07-06T05:00:19.321986Z","submitted_at":"2016-06-16T23:18:23Z","title":"Sampling Method for Fast Training of Support Vector Data Description","version":3},"cited_work":{"arxiv_id":"1606.05382","doi":null,"metadata_source":"pith","pith_arxiv_id":"1606.05382","snapshot_observed_at":"2026-08-07T01:03:23.013530Z","title":"Sampling Method for Fast Training of Support Vector Data Description","venue":"cs.LG","work_id":"4f32f8a3-5dc1-4c98-86b9-1fb6410b522d","year":2016},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.264372Z"},"links":{"cited_paper":"/paper/1606.05382","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:0e38754f4441548b162743c60db75a263d285e439efce6592d5075ca162cc851","observation_id":"c08c3d79-8d55-437c-8cf4-6c9365c936ab","resolution":{"observed_at":"2026-08-07T01:03:23.104484Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:23.297562Z","title":null,"venue":null,"work_id":"2c3ac1ce-21c1-41c9-af6f-34dcd2d42737","year":1902},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.522955Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:419130bc9fd6d94d718cc799000f08bae65a287013e6e47e3fb39e8da24e36b0","observation_id":"56ab1b47-fcb6-4cfd-99c8-6d4a8185974d","resolution":{"observed_at":"2026-08-07T01:03:23.350522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15980","last_updated":"2020-11-07T05:33:35Z","snapshot_observed_at":"2026-08-05T14:17:34.026911Z","submitted_at":"2020-10-29T22:54:00Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15980","snapshot_observed_at":"2026-08-07T01:03:21.800720Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.800720Z"},"links":{"cited_paper":"/paper/2010.15980","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:07a88f8f53b99be504239a1bf7ef47bc8899d85d35606b13ced00a81a9b15af1","observation_id":"8f150441-741f-4da9-b5ca-13a1248d9ad8","resolution":{"observed_at":"2026-08-07T01:03:21.800720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.tics.2021.07.008","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Trends in Cognitive Sciences","work_id":"d57dc866-23f6-45e3-8f38-8bec7701299f","year":2021},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.871098Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:3251fdc5aa5d0ba0583c1e7bec9cd09790cb7a8ca1b37813e91e45e34c57b687","observation_id":"b6adca01-aeda-4876-9a8b-2b6856c8ceec","resolution":{"observed_at":"2026-08-07T01:03:22.527682Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:03:23.428578Z","title":null,"venue":null,"work_id":"82b06099-ecd0-421a-90a8-7d40a8f66688","year":2021},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.405726Z"},"links":{"citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:9be3de01682c9e86b71c59bc6a534746b26fad2b55836b749db19e62c18e9eda","observation_id":"c147767b-17da-4232-8d06-db94f7cb54d5","resolution":{"observed_at":"2026-08-07T01:03:23.491721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05217","last_updated":"2023-10-19T21:25:32Z","snapshot_observed_at":"2026-08-02T10:20:00.635719Z","submitted_at":"2023-01-12T18:56:49Z","title":"Progress measures for grokking via mechanistic interpretability","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05217","snapshot_observed_at":"2026-08-07T01:03:21.272090Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.272090Z"},"links":{"cited_paper":"/paper/2301.05217","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:8d8cd28499f0b99050fe218a1ceb8efc389168cd531f1dc474c008b3c92aaa1a","observation_id":"009c88f1-a1f1-46ef-8ef4-504a046f3b1c","resolution":{"observed_at":"2026-08-07T01:03:21.272090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10380","last_updated":"2024-11-28T01:21:26Z","snapshot_observed_at":"2026-08-07T14:55:14.006555Z","submitted_at":"2024-11-28T01:21:26Z","title":"Challenges in Human-Agent Communication","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10380","snapshot_observed_at":"2026-08-07T01:03:20.470352Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:20.470352Z"},"links":{"cited_paper":"/paper/2412.10380","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:b5a17f21bfc59e8cda6bee988c3a645bfda96ae59b1c231c0c405e4c79b68d15","observation_id":"a287e320-3fd1-421a-b9ef-8b7bf845bac5","resolution":{"observed_at":"2026-08-07T01:03:20.470352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07586","last_updated":"2025-02-11T14:34:05Z","snapshot_observed_at":"2026-08-10T04:58:17.549351Z","submitted_at":"2025-02-11T14:34:05Z","title":"We Can't Understand AI Using our Existing Vocabulary","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07586","snapshot_observed_at":"2026-08-07T01:03:21.013201Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T01:03:21.013201Z"},"links":{"cited_paper":"/paper/2502.07586","citing_paper":"/paper/2506.12152"},"observation_digest":"sha256:d8ce19ebd5b95b933c16bc244ab157cccd39a8e68b9b15134a522f0221ccee8c","observation_id":"2bd2d3f5-d96d-47ae-85b0-ee97be0b6d7f","resolution":{"observed_at":"2026-08-07T01:03:21.013201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12152","last_updated":"2025-06-13T18:13:58Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T03:56:47.932564Z","submitted_at":"2025-06-13T18:13:58Z","title":"Because we have LLMs, we Can and Should Pursue Agentic Interpretability"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 6 inbound Pith citation observations for arXiv:2506.12152."}