{"as_of":"2026-08-19T01:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:711b05ee723d306b98ef569ec2325c6ed7520631d16ef512ff0f52baf2fb88a8","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:01:23.147046Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13083/citation-record","integrity":"/paper/2607.13083/integrity","json":"/paper/2607.13083/citation-record.json","paper":"/paper/2607.13083"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.20947","last_updated":"2025-06-15T21:44:25Z","snapshot_observed_at":"2026-08-16T13:47:22.319152Z","submitted_at":"2024-05-31T15:44:33Z","title":"OR-Bench: An Over-Refusal Benchmark for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20947","snapshot_observed_at":"2026-08-02T07:01:19.315752Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:19.315752Z"},"links":{"cited_paper":"/paper/2405.20947","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:09aff96c934bd66d954e0ee3d9d1e5c07c4b863722f145264e8aaeb40ade4e1f","observation_id":"af5421f9-5c79-4bd3-909e-28d7a610d778","resolution":{"observed_at":"2026-08-02T07:01:19.315752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:19.498726Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:19.498726Z"},"links":{"citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:c8aa4c00c68772faf67b59e304465f30d54c162641aebfdc812220b2562c3055","observation_id":"f7ef4e9a-452b-4073-a590-901d3f6eefe4","resolution":{"observed_at":"2026-08-02T07:01:19.498726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03555","last_updated":"2026-06-29T12:43:12Z","snapshot_observed_at":"2026-08-11T14:43:18.260011Z","submitted_at":"2026-01-07T03:49:48Z","title":"SCRIBE: Structured Mid-Level Supervision for Tool-Using Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03555","snapshot_observed_at":"2026-08-02T07:01:19.651690Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:19.651690Z"},"links":{"cited_paper":"/paper/2601.03555","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:b49680cb81de7e950bc0cf63264d6a9d1ff633356bd666916d3eaa3999229600","observation_id":"d4d35aed-bf20-45e4-8ac7-d0cb115867fd","resolution":{"observed_at":"2026-08-02T07:01:19.651690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:19.768759Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:19.768759Z"},"links":{"citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:d3e899ea82261d67c2b247ffac7a8c583027b4e98b10270335453b8e34a3791a","observation_id":"4f1c9d35-4cd3-44ad-b3ff-bab706e418c4","resolution":{"observed_at":"2026-08-02T07:01:19.768759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.28052","last_updated":"2026-03-30T05:33:50Z","snapshot_observed_at":"2026-08-11T05:18:08.192130Z","submitted_at":"2026-03-30T05:33:50Z","title":"Meta-Harness: End-to-End Optimization of Model Harnesses","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.28052","snapshot_observed_at":"2026-08-02T07:01:20.047229Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:20.047229Z"},"links":{"cited_paper":"/paper/2603.28052","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:4a263af3d94a38fec9a11d55ec2dab6f520475d618a6691ab165bd1dc44472fb","observation_id":"662be392-25cb-4fda-a729-5dbf7a3ac4d7","resolution":{"observed_at":"2026-08-02T07:01:20.047229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19827","last_updated":"2025-08-27T12:25:29Z","snapshot_observed_at":"2026-08-17T20:53:44.539612Z","submitted_at":"2025-08-27T12:25:29Z","title":"Analysing Chain of Thought Dynamics: Active Guidance or Unfaithful Post-hoc Rationalisation?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19827","snapshot_observed_at":"2026-08-02T07:01:20.213268Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:20.213268Z"},"links":{"cited_paper":"/paper/2508.19827","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:619ad0f72b22a5fd561555e649ee8f04fcf813dbe25bf5c117b713d07b1b4c07","observation_id":"b2382074-deff-4c7a-a6d4-0d34431547a0","resolution":{"observed_at":"2026-08-02T07:01:20.213268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:20.358148Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:20.358148Z"},"links":{"citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:7538429f4c332b5cba545d654bf1c5835a4666666c0cd9b41fc244b0bb47f45b","observation_id":"0c42fcc9-aff9-47f8-83a0-0293f9a6fefa","resolution":{"observed_at":"2026-08-02T07:01:20.358148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25492","last_updated":"2026-05-25T06:54:44Z","snapshot_observed_at":"2026-08-12T16:53:10.120337Z","submitted_at":"2026-05-25T06:54:44Z","title":"SafetyRepro: Configuration-Conditional Rank Instability on Alignment Benchmarks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25492","snapshot_observed_at":"2026-08-02T07:01:20.541311Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:20.541311Z"},"links":{"cited_paper":"/paper/2605.25492","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:45596c9873fa21134d0bd192b6c0772ba9d216430b1002cc06243ceaad1ef02e","observation_id":"3b8334a4-eacb-4c28-8943-1f898beebaf5","resolution":{"observed_at":"2026-08-02T07:01:20.541311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25850","last_updated":"2026-05-18T15:11:47Z","snapshot_observed_at":"2026-08-11T12:18:53.491481Z","submitted_at":"2026-04-28T16:55:02Z","title":"Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25850","snapshot_observed_at":"2026-08-02T07:01:20.674740Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:20.674740Z"},"links":{"cited_paper":"/paper/2604.25850","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:e26079d62ff2de64c5da097c1480cb13558ab4dc1d704f9238cb88ef456741a7","observation_id":"f4a52139-6642-4601-b802-6722bdf0fd23","resolution":{"observed_at":"2026-08-02T07:01:20.674740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.24834","last_updated":"2026-05-24T02:58:21Z","snapshot_observed_at":"2026-08-18T21:26:56.213230Z","submitted_at":"2026-05-24T02:58:21Z","title":"Reflect-Guard: Enhancing LLM Safeguards against Adversarial Prompts via Logical Self-Reflection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24834","snapshot_observed_at":"2026-08-02T07:01:20.817475Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:20.817475Z"},"links":{"cited_paper":"/paper/2605.24834","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:45cc8398331348082bbb74c605f318333c9d09ba0ad3a569d1f7d0b57496c50a","observation_id":"e5520ea9-d240-4176-85c2-40c56431da6d","resolution":{"observed_at":"2026-08-02T07:01:20.817475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.07283","last_updated":"2019-02-15T18:15:37Z","snapshot_observed_at":"2026-08-15T04:30:37.145207Z","submitted_at":"2018-12-18T10:42:13Z","title":"You Cannot Fix What You Cannot Find! An Investigation of Fault Localization Bias in Benchmarking Automated Program Repair Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.07283","snapshot_observed_at":"2026-08-02T07:01:20.951539Z","title":"Bissyandé, Dongsun Kim, Jacques Klein, and Yves Le Traon","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:20.951539Z"},"links":{"cited_paper":"/paper/1812.07283","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:1dc4f8005d4e5f9e6f1cdac22e84bc56f0826715d7b42ee96bc5cf4fdc9b9744","observation_id":"83cb1264-bb3c-481a-95f8-6be96b296c21","resolution":{"observed_at":"2026-08-02T07:01:20.951539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:21.021689Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:21.021689Z"},"links":{"citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:a2c33e3da4d394ad928ba6d1753f522085eb6718beeb347f339ca5808e7c6b81","observation_id":"44c67161-c09e-403a-8f6a-256350610aac","resolution":{"observed_at":"2026-08-02T07:01:21.021689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.04585","last_updated":"2019-02-24T08:12:46Z","snapshot_observed_at":"2026-08-17T04:25:53.281214Z","submitted_at":"2018-03-13T01:15:39Z","title":"Categorizing Variants of Goodhart's Law","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.04585","snapshot_observed_at":"2026-08-02T07:01:21.137326Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:21.137326Z"},"links":{"cited_paper":"/paper/1803.04585","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:bbaabcb9c2ad4e213dfd86cc0ef3fa2645a579ef6942fc224ac81d34ff7046b8","observation_id":"d3862ee3-275f-4aa3-8a1b-9ae35985df42","resolution":{"observed_at":"2026-08-02T07:01:21.137326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-08-16T00:13:58.777607Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-02T07:01:21.354832Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:21.354832Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:cfb2f94e05924f889a9ad48a51d5f59c84c247dab5d25e5cc29ab15d1c8eaaa8","observation_id":"949024c6-0e48-453d-b1ed-46b951b70c33","resolution":{"observed_at":"2026-08-02T07:01:21.354832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-18T11:17:18.104754Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.05922","snapshot_observed_at":"2026-08-02T07:01:21.515063Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:21.515063Z"},"links":{"cited_paper":"/paper/2606.05922","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:37905dcf32338e5b58f71f070be7c1812abf5275940b318bd9a8a0e782676f86","observation_id":"75082944-7ea8-4635-a2f9-65ab8894e5ce","resolution":{"observed_at":"2026-08-02T07:01:21.515063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:21.678296Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:21.678296Z"},"links":{"citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:4bd6b3fc9e48a9a8eacb03c637d561684b21a2b6877e7222baaf249b7448cdb2","observation_id":"b8868949-339a-43c0-835c-d4bee6e7e779","resolution":{"observed_at":"2026-08-02T07:01:21.678296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09252","last_updated":"2026-05-20T19:57:19Z","snapshot_observed_at":"2026-08-17T02:01:44.434991Z","submitted_at":"2026-05-10T01:37:40Z","title":"LLM Agents Already Know When to Call Tools -- Even Without Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09252","snapshot_observed_at":"2026-08-02T07:01:22.001527Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:22.001527Z"},"links":{"cited_paper":"/paper/2605.09252","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:c4e4fb5a4411b4d367f9269ebb03e0c91ccc622f694ea60731cb46273e46aac6","observation_id":"27ecff90-29e8-47fd-80d3-a35eab35a43d","resolution":{"observed_at":"2026-08-02T07:01:22.001527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.15127","last_updated":"2026-06-19T06:10:08Z","snapshot_observed_at":"2026-08-15T02:16:24.183428Z","submitted_at":"2026-06-13T05:41:57Z","title":"Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.15127","snapshot_observed_at":"2026-08-02T07:01:22.131040Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:22.131040Z"},"links":{"cited_paper":"/paper/2606.15127","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:330d88b1b13132d5856e874036279a5f89a37a6ba7afef8734d8afb90593fa67","observation_id":"6c8c60fb-bb4c-4cbc-bdd1-5eb025eeb94b","resolution":{"observed_at":"2026-08-02T07:01:22.131040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22480","last_updated":"2026-06-02T16:57:10Z","snapshot_observed_at":"2026-08-16T15:01:30.190840Z","submitted_at":"2026-02-25T23:40:22Z","title":"VeRO: A Harness for Agents to Optimize Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.22480","snapshot_observed_at":"2026-08-02T07:01:22.313861Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:22.313861Z"},"links":{"cited_paper":"/paper/2602.22480","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:352673f557107cecef633f52ce0d92ea99ac71b2dd000bf9e5254d8fa7053892","observation_id":"af67fb16-db73-489c-a556-c8d266d60bea","resolution":{"observed_at":"2026-08-02T07:01:22.313861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:22.439401Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:22.439401Z"},"links":{"citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:e1bfb7c547a3aa4b208741e5e76ed8f8284a08a71cba22be1e6642ce17a12367","observation_id":"4f1244d6-2d8a-4511-8359-fa9953162476","resolution":{"observed_at":"2026-08-02T07:01:22.439401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:22.578939Z","title":"Whitson and Adam D","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:22.578939Z"},"links":{"citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:26ff35673f91cb370ddde0b123882968210faf9dd378b55e59d2db6231c78dbe","observation_id":"f2b6b363-19e1-4878-b8b1-d4691d625625","resolution":{"observed_at":"2026-08-02T07:01:22.578939Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.22166","last_updated":"2026-05-27T04:34:36Z","snapshot_observed_at":"2026-07-06T23:32:30.578213Z","submitted_at":"2026-05-21T08:36:49Z","title":"Adapting the Interface, Not the Model: Runtime Harness Adaptation for Deterministic LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.22166","snapshot_observed_at":"2026-08-02T07:01:22.724744Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:22.724744Z"},"links":{"cited_paper":"/paper/2605.22166","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:526ea73ac277ba3eee858cd655e0b4af4a2e18143be8455d097f5d83ff90faa3","observation_id":"f7eb97d0-ab92-4840-aa81-2c947bc2927b","resolution":{"observed_at":"2026-08-02T07:01:22.724744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03113","last_updated":"2026-04-06T12:00:57Z","snapshot_observed_at":"2026-08-02T10:59:30.390238Z","submitted_at":"2026-04-03T15:35:47Z","title":"PAFT: Preservation Aware Fine-Tuning for Minimal-Edit Program Repair","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.03113","snapshot_observed_at":"2026-08-02T07:01:22.844569Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:22.844569Z"},"links":{"cited_paper":"/paper/2604.03113","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:59254c7c6bc0e9b1c09ec51b256f05c3928e5fbf2d47646a078faa8a4d12a174","observation_id":"2325e54d-7d58-4c2b-9e4d-774778e6dacf","resolution":{"observed_at":"2026-08-02T07:01:22.844569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:22.927585Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:22.927585Z"},"links":{"citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:d1266c4e573e7557dcaf7740915c2c3823ba4fce6a39014661bd4da49eaafd86","observation_id":"5056d85c-be0b-4dd2-9a6e-b88e4fdee633","resolution":{"observed_at":"2026-08-02T07:01:22.927585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.00920","last_updated":"2026-05-14T23:56:29Z","snapshot_observed_at":"2026-08-15T10:00:59.764088Z","submitted_at":"2025-11-30T14:54:12Z","title":"Reward Auditor: Inference on Reward Modeling Suitability in Real-World Perturbed Scenarios","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.00920","snapshot_observed_at":"2026-08-02T07:01:23.147046Z","title":"this matters","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:23.147046Z"},"links":{"cited_paper":"/paper/2512.00920","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:cc576017849ba3d6fef82854775b0ad0cead92eca49195ccd53910ea1818bca7","observation_id":"0e1aaed2-53ac-4a13-8bc1-9161665f35a8","resolution":{"observed_at":"2026-08-02T07:01:23.147046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.13085","last_updated":"2025-03-05T21:08:30Z","snapshot_observed_at":"2026-08-16T16:29:40.254423Z","submitted_at":"2022-09-27T00:32:44Z","title":"Defining and Characterizing Reward Hacking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.13085","snapshot_observed_at":"2026-08-02T07:01:21.816420Z","title":"Appeared at NeurIPS 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:21.816420Z"},"links":{"cited_paper":"/paper/2209.13085","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:160cf2c722b2989d59995970c4bb54bc58c98661bf4b82152f00d6d6a8cf9742","observation_id":"f950cb56-c969-4987-acb1-fb549a5108ee","resolution":{"observed_at":"2026-08-02T07:01:21.816420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:23.034755Z","title":"InThe Thirteenth International Conference on Learning Represen- tations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:23.034755Z"},"links":{"citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:c34a2e2f34fa7a879a89ad517479ad8daabbc700bdd2b6bbb19770a3549e19ed","observation_id":"856a6a25-a61c-47ea-be25-8fd08d07a997","resolution":{"observed_at":"2026-08-02T07:01:23.034755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05963","last_updated":"2026-04-07T14:56:38Z","snapshot_observed_at":"2026-08-11T05:10:57.828287Z","submitted_at":"2026-04-07T14:56:38Z","title":"QiMeng-PRepair: Precise Code Repair via Edit-Aware Reward Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05963","snapshot_observed_at":"2026-08-02T07:01:19.894262Z","title":"arXiv:2604.05963 [cs.SE]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:19.894262Z"},"links":{"cited_paper":"/paper/2604.05963","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:9aee76ed2cf028affbfef2dbfd11ecb1d505244138ac988a86463ad1d40ca0f3","observation_id":"e9f73dff-2960-4a24-8cf7-a864352ab80a","resolution":{"observed_at":"2026-08-02T07:01:19.894262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-14T17:46:33.969066Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2607.13083."}