{"as_of":"2026-08-09T10:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:32b14b45947c6955b59c5177806cdbdb0dd29fa95fa454efcdfe70aa6c2e9ae4","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:12:08.926105Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:47:08.564508Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T13:24:53.352590Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"cited_work":{"arxiv_id":"2509.09396","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09396","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"David Mickisch, Felix Assion, Florens Greßner, Wiebke G ¨unther, and Mariele Motta","venue":null,"work_id":"097b6cb7-95f3-4093-bcbf-541bb835a70c","year":null},"citing_paper":{"arxiv_id":"2510.03271","last_updated":"2026-05-21T09:16:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-27T07:42:54Z","title":"Decision Potential Surface: A Theoretical and Practical Approximation of Large Language Model Decision Boundary","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T13:22:37.107679Z"},"links":{"cited_paper":"/paper/2509.09396","citing_paper":"/paper/2510.03271"},"observation_digest":"sha256:a9b439799f414155d43044b562d8b915da5f97e11cc4c733d4c2674a5b961faa","observation_id":"25970723-dd10-498d-af0c-addf14098659","resolution":{"observed_at":"2026-05-22T13:24:53.354890Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09396","snapshot_observed_at":"2026-08-03T00:47:08.564508Z","title":"LLMs Don’t Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations2025 2025-09-11","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28677","last_updated":"2026-07-29T07:12:46Z","snapshot_observed_at":"2026-08-07T11:42:59.861665Z","submitted_at":"2026-07-29T07:12:46Z","title":"Reasoning in Real World Clinical Care: Why Large Language Models Are Not Yet Safe for Autonomous Clinical Decision Support","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T00:47:08.564508Z"},"links":{"cited_paper":"/paper/2509.09396","citing_paper":"/paper/2607.28677"},"observation_digest":"sha256:e88d2ddf5d63a42109f86f53c42d6aaea031f406772cb18aa01924295ac0d909","observation_id":"993d9874-d12c-4727-b5dd-74d99e6f52a2","resolution":{"observed_at":"2026-08-03T00:47:08.564508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.09396/citation-record","integrity":"/paper/2509.09396/integrity","json":"/paper/2509.09396/citation-record.json","paper":"/paper/2509.09396"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.326149Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.326149Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:dad876b4befbd2e99df57ce815c879009fe528cc71f434f49e68689a97543ca0","observation_id":"8cda2ce9-1dbb-463a-b157-23ae092d8b03","resolution":{"observed_at":"2026-08-04T19:12:05.326149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.396750Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.396750Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:33a05bedd09c35761c57f3612505f9b3dc68c2d1884232d33adfcc7f06d90ad5","observation_id":"aa3a8928-08ce-4123-9475-ddebf9e192f9","resolution":{"observed_at":"2026-08-04T19:12:05.396750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.485458Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.485458Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:8bb178dfc352fdf2caf6fce2c776cf93a703b5be72fa7f1bfd496fa540f1b1df","observation_id":"c8ddce84-bfc0-44f7-aaff-a888d8b19edb","resolution":{"observed_at":"2026-08-04T19:12:05.485458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08775","last_updated":"2025-05-13T17:53:59Z","snapshot_observed_at":"2026-07-06T21:23:23.760393Z","submitted_at":"2025-05-13T17:53:59Z","title":"HealthBench: Evaluating Large Language Models Towards Improved Human Health","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08775","snapshot_observed_at":"2026-08-04T19:12:05.564129Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.564129Z"},"links":{"cited_paper":"/paper/2505.08775","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:2785e16c18670f529a98a85075254fc8c6505bdbb894a9ab2825108e74231a74","observation_id":"92360142-da8e-4007-b079-0beb0dac641e","resolution":{"observed_at":"2026-08-04T19:12:05.564129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11926","last_updated":"2025-03-14T23:50:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-14T23:50:34Z","title":"Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11926","snapshot_observed_at":"2026-08-04T19:12:05.648490Z","title":"Guan, Aleksander Madry, Wojciech Zaremba, Jakub Pachocki, and David Farhi","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.648490Z"},"links":{"cited_paper":"/paper/2503.11926","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:94fe31374c3b3fe4e61d5457eb5a3eb8c43b3d86f1e5790e43fdcd7be100e048","observation_id":"0c8d9652-4789-49f1-9c1d-60e15a4b81b7","resolution":{"observed_at":"2026-08-04T19:12:05.648490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.732485Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.732485Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:ac737a267c3721d315ebf15686e455f0e911a553b69b557eb5df589ba3c65291","observation_id":"df344732-c605-412b-a353-19372d1bbc28","resolution":{"observed_at":"2026-08-04T19:12:05.732485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05410","last_updated":"2025-05-08T16:51:43Z","snapshot_observed_at":"2026-07-06T21:21:01.070459Z","submitted_at":"2025-05-08T16:51:43Z","title":"Reasoning Models Don't Always Say What They Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05410","snapshot_observed_at":"2026-08-04T19:12:05.814286Z","title":"Bowman, Jan Leike, Jared Kaplan, and Ethan Perez","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.814286Z"},"links":{"cited_paper":"/paper/2505.05410","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:cf44a46a36ac0748b3beba2227f43df85186561746ad5b9f61963a3cefd08098","observation_id":"e706203d-4698-45ef-9caf-4a22f187b0d5","resolution":{"observed_at":"2026-08-04T19:12:05.814286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.899425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.899425Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:54e5f19d5c23fd66947d08f49f856dfb7c8674bc18cea7cc47ead460453cf73b","observation_id":"d0263309-8556-4c0d-b52e-9f89c8773360","resolution":{"observed_at":"2026-08-04T19:12:05.899425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.981205Z","title":"Cruz, Moritz Hardt, and Celestine Mendler-D\\\" u nner","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.981205Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:21527b0f974ee86b0a175b7be09395af9a394d29b150464fd8d1482a2cdf4fad","observation_id":"0a98f8f7-5bd3-43f0-a9f4-281c1eaa6607","resolution":{"observed_at":"2026-08-04T19:12:05.981205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.034770Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.034770Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:78cac36d42f843b7f66761c11c08dfdda461c94287d332598befab646ba69019","observation_id":"2887f73a-4381-4234-9d58-c0ada65a470a","resolution":{"observed_at":"2026-08-04T19:12:06.034770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-04T19:12:06.119620Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.119620Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:b30f9820e7620960d77e7c94b3164ac42d1640ef930252cc459c7ee7a3ed1eb7","observation_id":"69c6d3e5-9d6e-48c0-8539-63b203237fbc","resolution":{"observed_at":"2026-08-04T19:12:06.119620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.202531Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.202531Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:2df01552364f34b882c8a3a0d35282b3c9763160f70412365ca2aaac9e073c1b","observation_id":"b073688a-8c50-467b-b868-5e3632100198","resolution":{"observed_at":"2026-08-04T19:12:06.202531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05246","last_updated":"2025-07-07T17:54:52Z","snapshot_observed_at":"2026-08-06T19:26:32.984962Z","submitted_at":"2025-07-07T17:54:52Z","title":"When Chain of Thought is Necessary, Language Models Struggle to Evade Monitors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05246","snapshot_observed_at":"2026-08-04T19:12:06.259601Z","title":"Elson, Rif A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.259601Z"},"links":{"cited_paper":"/paper/2507.05246","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:e8779bf5037a9c64cfbbb7fdff163b639d6a32d0f3dd1d592d8d0d2398f60748","observation_id":"39213e19-e1ce-4129-8578-75e7184c38fb","resolution":{"observed_at":"2026-08-04T19:12:06.259601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-04T19:12:06.338467Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.338467Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:867d62b38c82f76944120cb87efdb694f6d1a72d7b92f839bb3455e57582bfad","observation_id":"021500b3-9fc8-474a-a79f-117bb9ee08c1","resolution":{"observed_at":"2026-08-04T19:12:06.338467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.419676Z","title":null,"venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.419676Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:cf4a2b4878e8b9c314084cb4f38d8f4e5b40498793238da303a979b79946c81a","observation_id":"e13d22b6-c724-4adb-a8c4-3718eb611193","resolution":{"observed_at":"2026-08-04T19:12:06.419676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T19:12:06.477853Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.477853Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:bbc5cc43e07bcfe649f8f42ea150cc2dad45e52221366b644dc13d3a75240732","observation_id":"de56119d-eb20-4994-8c3c-5aefd49ba625","resolution":{"observed_at":"2026-08-04T19:12:06.477853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.551684Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.551684Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:18fadca607996bf973bc6f494f8fe1330d3a3931fa99e84bf37f56f3c32ce0f6","observation_id":"803ac19e-f731-4008-8751-b54ab1619c92","resolution":{"observed_at":"2026-08-04T19:12:06.551684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.612237Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.612237Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:d90e71f93656d4090bfa1129ff40b016e2685c04cd0aab78f2fee291a749e887","observation_id":"acbf3200-9fab-44a8-9e6e-6663098f3578","resolution":{"observed_at":"2026-08-04T19:12:06.612237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.720852Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.720852Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:7339034589c8c71c5df450beaafb0180324eb37a5016c2000bf30173ae6124e6","observation_id":"77323717-79e0-4a0d-a1f8-7d439add0df7","resolution":{"observed_at":"2026-08-04T19:12:06.720852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-07-31T04:21:27.501709Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-08-04T19:12:06.779090Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.779090Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:ecaed6034453939952b6b3f90d31ce0840611e05a4f5a2dd1e9070f4663c5134","observation_id":"f71c4a8c-1ed0-4ddb-8a27-f33b43b5cd27","resolution":{"observed_at":"2026-08-04T19:12:06.779090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.858066Z","title":null,"venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.858066Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:943c0b0550cb1b9a952b0b44a6c3b54a4d6fb10e6fa38eca07152bf2d855ee66","observation_id":"c9426b7a-3d50-4297-8ac1-81ede99952f1","resolution":{"observed_at":"2026-08-04T19:12:06.858066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.911667Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.911667Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:4b49c2a6dba8da4f2a4107774b7bf11ca071989662c439fd031b3c2e1519d84b","observation_id":"17368954-c1b3-4996-8035-c0d409cbe8c5","resolution":{"observed_at":"2026-08-04T19:12:06.911667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.976491Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.976491Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:f1485051aee0bbd40f7cf7c592b6478087da7a8cd820f1207fc80db4d4200163","observation_id":"9da75fb8-be89-45a4-85dd-39a7cebfa80e","resolution":{"observed_at":"2026-08-04T19:12:06.976491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.020074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.020074Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:d6415e664489a5f620816139a5617e51280f7dd4234736fc7162284d44c062f0","observation_id":"5f94c354-ceab-4c4b-b0ea-c3f446ab3ce6","resolution":{"observed_at":"2026-08-04T19:12:07.020074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05386","last_updated":"2024-11-13T01:40:53Z","snapshot_observed_at":"2026-08-08T17:53:17.777038Z","submitted_at":"2024-05-08T19:31:06Z","title":"Interpretability Needs a New Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05386","snapshot_observed_at":"2026-08-04T19:12:07.079494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.079494Z"},"links":{"cited_paper":"/paper/2405.05386","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:27435ec9e19d4b843453d669d1f2a32cb898c13d80e216553fcb5ae6b4745ea8","observation_id":"3bde116e-8acc-4e3b-8cb4-b2aab8613b8e","resolution":{"observed_at":"2026-08-04T19:12:07.079494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02643","last_updated":"2024-11-04T22:01:52Z","snapshot_observed_at":"2026-07-06T19:45:13.078526Z","submitted_at":"2024-11-04T22:01:52Z","title":"A Comparative Analysis of Counterfactual Explanation Methods for Text Classifiers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02643","snapshot_observed_at":"2026-08-04T19:12:07.118871Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.118871Z"},"links":{"cited_paper":"/paper/2411.02643","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:b578cceb6c7455e91b7db853973ef3aceaa66b25fe4d8996fdc5eb5d92dfc6d1","observation_id":"2ea2d898-1afb-422e-805b-74b8ab6c1646","resolution":{"observed_at":"2026-08-04T19:12:07.118871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.201820Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.201820Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:6ce4160a97cd13060c251b0e680b1dacd824fafe3c6d6633e702f8c775741da8","observation_id":"c6c807c8-02e9-4d93-96d0-fbd8b1185bb5","resolution":{"observed_at":"2026-08-04T19:12:07.201820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.282626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.282626Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:7bdd9afee27a435456589da21a1b0c0f43c46d049eeb1e4bc76521f1dcaf153f","observation_id":"888c442d-082c-4fe1-a362-e4e201e7b104","resolution":{"observed_at":"2026-08-04T19:12:07.282626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.365168Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.365168Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:13111506cd33ffa6524f43190216513a8c41016bf1374c370c500db730647563","observation_id":"7715793f-a691-4f02-95bb-769e7719c0ce","resolution":{"observed_at":"2026-08-04T19:12:07.365168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.419169Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.419169Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:722bf101b049b8615beae58e3bb8540d6ab3e6509e444b4b77d3e7023b9e70ac","observation_id":"7c05e287-1a09-4e16-8bca-3f495cbd6a63","resolution":{"observed_at":"2026-08-04T19:12:07.419169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.532455Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.532455Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:c7f2912ff4baffcc38107161f99e2c4a2c7812fa1af48668474bbe6d91529531","observation_id":"83c41e56-6950-4d20-bb99-bca339ec6253","resolution":{"observed_at":"2026-08-04T19:12:07.532455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.591950Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.591950Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:da5c892cda9e64f2a70eef01c85f4b4544378fdb6ce2ba95b46f216c9ac09c8c","observation_id":"f3bf6fc1-3cdd-4cd4-b3bd-9af4057cef2a","resolution":{"observed_at":"2026-08-04T19:12:07.591950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/1224438","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Taxon","work_id":"c120a268-44ad-4a14-89e0-34e8f462ff72","year":1999},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.673589Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:ea0474e3b737278bbaf9f30a92127afe10fd9d74694ef6d6bb33ae0cac26c323","observation_id":"9c9d80c3-160d-479c-8db9-c8578e09b581","resolution":{"observed_at":"2026-08-04T19:13:26.198825Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10188","last_updated":"2024-07-23T21:54:12Z","snapshot_observed_at":"2026-07-06T18:46:05.098630Z","submitted_at":"2024-07-14T13:16:23Z","title":"Unexpected Benefits of Self-Modeling in Neural Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10188","snapshot_observed_at":"2026-08-04T19:12:07.757757Z","title":"Premakumar, Michael Vaiana, Florin Pop, Judd Rosenblatt, Diogo Schwerz de Lucena, Kirsten Ziman, and Michael S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.757757Z"},"links":{"cited_paper":"/paper/2407.10188","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:9a1ab41873d22b30b43c2f88c58abd708629cd7385dbaa79e2620e08fde01052","observation_id":"85f7c928-ea1d-4701-8b29-c6f710224705","resolution":{"observed_at":"2026-08-04T19:12:07.757757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.839916Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.839916Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:cada7acd79e0afc6c5f6ab6419903c96578d89adc845dd1c35f5ec5a30e66353","observation_id":"a9cee5f4-c3e9-4278-aaeb-29cae1beb750","resolution":{"observed_at":"2026-08-04T19:12:07.839916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.933512Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.933512Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:a7cae05c65d600cd94250c7a245f20765e1aac0afc45f8a5d26a2702bc4e7318","observation_id":"aae5d02a-73e8-4a96-87fa-0d8bec00128b","resolution":{"observed_at":"2026-08-04T19:12:07.933512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.033880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.033880Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:ebb1e2c30fc63b54c6bc640ac1a67c32832cda24f77625dbbab381c621e9446a","observation_id":"024306a8-eafb-443d-aa18-68c4fb492e8f","resolution":{"observed_at":"2026-08-04T19:12:08.033880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.133210Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.133210Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:7b2e4d68c9bbd8233c197adb9c26ef2aa96646461525d75f0508c565cd3a04d1","observation_id":"f62777d2-6160-4cc6-b6d5-a5bc44d699de","resolution":{"observed_at":"2026-08-04T19:12:08.133210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.210404Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.210404Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:e8145da1df70b0fd083d403fae8d49354c40a76d31f6ef26cbdca5fb0e54a378","observation_id":"4c85d24f-2521-4c90-9d10-7296be21bd2c","resolution":{"observed_at":"2026-08-04T19:12:08.210404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.213265Z","title":"Sara Mahdavi, Christopher Semturs, and 7 others","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.213265Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:a4a231f110b6ec9e61ef607d19ca768d6a3c925508e86a4ded2f910487e7c5da","observation_id":"94777b90-7913-4db0-8817-55cde4bb6905","resolution":{"observed_at":"2026-08-04T19:12:08.213265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.274966Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.274966Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:af253291d77d653d2b8e3ce2de44bd795b1b4bf20f26652f5e4ad0787ec2e76d","observation_id":"2b6df944-c392-4895-ab82-2dd886f4f4bc","resolution":{"observed_at":"2026-08-04T19:12:08.274966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.383046Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.383046Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:659f9eb701cc365d061e55555ba27959632c9fdfbdeec70c68d14c6b3983a39b","observation_id":"33d2796b-e370-4d5d-85f8-e5ca11c52885","resolution":{"observed_at":"2026-08-04T19:12:08.383046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.498169Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.498169Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:ed34c34e74e8c0e986962ff9ab75a30307b3bc5b8e2a8fede526a88431162d4f","observation_id":"5818337c-4b15-48f9-8cbc-344fdc97dbc1","resolution":{"observed_at":"2026-08-04T19:12:08.498169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.601054Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.601054Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:ed6e1f124623d33a65ef7d0a035945484c25784304d0d11f5537b75e2bedf54b","observation_id":"27f16379-0b10-4bcd-be56-7834f07f5676","resolution":{"observed_at":"2026-08-04T19:12:08.601054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.715022Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.715022Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:63f0e954e2717412fb3b9f8d8842a6b9c0fe629d5f970f1363ba6f7234928cf4","observation_id":"371c4c60-a1df-4233-aed0-23db6c2333ec","resolution":{"observed_at":"2026-08-04T19:12:08.715022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.841648Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.841648Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:eb8ed777a6539e7ef0768cb956e33cf614ee00ea8a6679ac1ca837b7de72a90e","observation_id":"0e2ed8a1-565b-4dc8-b25c-9c1d4edf28e2","resolution":{"observed_at":"2026-08-04T19:12:08.841648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.926105Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.926105Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:866dc8bb0c9d64aecf72374fb7df39bc6a24442d3c54a2da5ba5b6719ef40ce0","observation_id":"1247807c-82d0-41a9-8f1a-c2843c78c22b","resolution":{"observed_at":"2026-08-04T19:12:08.926105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T11:42:09.155993Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2509.09396."}