{"as_of":"2026-08-10T05:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2dca31aa332f6a982e32162cbd94c24ece412f5d2dc8d06116a1c078514a5184","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T00:59:08.647382Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25987/citation-record","integrity":"/paper/2607.25987/integrity","json":"/paper/2607.25987/citation-record.json","paper":"/paper/2607.25987"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.09024","last_updated":"2025-04-18T14:30:31Z","snapshot_observed_at":"2026-08-02T12:38:54.249632Z","submitted_at":"2024-10-11T17:39:22Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09024","snapshot_observed_at":"2026-08-01T00:59:07.360105Z","title":"Amazon Bedrock User Guide","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:07.360105Z"},"links":{"cited_paper":"/paper/2410.09024","citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:a1848e85f0996e83f8954e88c374782288b5def47958d5961c1b33e7a71d5de5","observation_id":"f5032b95-a6bf-4513-b8b8-9130276caed2","resolution":{"observed_at":"2026-08-01T00:59:07.360105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15817","last_updated":"2024-05-17T17:17:45Z","snapshot_observed_at":"2026-07-06T16:24:30.545494Z","submitted_at":"2023-09-25T17:08:02Z","title":"Identifying the Risks of LM Agents with an LM-Emulated Sandbox","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15817","snapshot_observed_at":"2026-08-01T00:59:07.737179Z","title":"Identifying the risks of lm agents with an lm-emulated sandbox.arXiv preprint arXiv:2309.15817,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:07.737179Z"},"links":{"cited_paper":"/paper/2309.15817","citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:bece61ad80c79063e5cc3bfba77cf9fbf70f6aea260b50a1ee21f207a26736e9","observation_id":"af6a9c7b-1a57-4199-9968-4ffc3d18cb43","resolution":{"observed_at":"2026-08-01T00:59:07.737179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13208","last_updated":"2024-04-19T22:55:23Z","snapshot_observed_at":"2026-08-10T04:45:11.275468Z","submitted_at":"2024-04-19T22:55:23Z","title":"The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13208","snapshot_observed_at":"2026-08-01T00:59:07.824949Z","title":"Together AI Documentation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:07.824949Z"},"links":{"cited_paper":"/paper/2404.13208","citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:e5f9f8edd7b1099eb51aa76be6c5ca1730b7a318fe162337eac06f69dc7e1e2a","observation_id":"e501860c-869b-4a37-af8f-7800225657f8","resolution":{"observed_at":"2026-08-01T00:59:07.824949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09102","last_updated":"2025-03-01T19:06:35Z","snapshot_observed_at":"2026-08-04T17:29:52.046121Z","submitted_at":"2024-10-09T12:52:41Z","title":"Instructional Segment Embedding: Improving LLM Safety with Instruction Hierarchy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09102","snapshot_observed_at":"2026-08-01T00:59:07.912538Z","title":"Instructional segment embedding: Improving llm safety with instruction hierarchy.arXiv preprint arXiv:2410.09102,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:07.912538Z"},"links":{"cited_paper":"/paper/2410.09102","citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:a1631decd5428b7f64389febf08de2fb763d82513b82b8e1b55c3feb37378061","observation_id":"43fbe682-5dd9-4eea-9218-0ed9431fa3b7","resolution":{"observed_at":"2026-08-01T00:59:07.912538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:08.014238Z","title":"xAI Inference REST API Overview","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:08.014238Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:706836322bcbad551ff0ba3c765c37b546f0ecd2a6a488b6329c15eb9bd8a1fb","observation_id":"862c8ff8-9db9-4972-99d6-16918a393b08","resolution":{"observed_at":"2026-08-01T00:59:08.014238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:08.113657Z","title":"Injecagent: Benchmarking indirect prompt injections in tool-integrated large language model agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:08.113657Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:5054825689b9af48cc4c452fa8b0e4f05f00eb20f87fb00e828aa983dcea09d7","observation_id":"e1190ddb-bff2-498e-a945-c7cfd206eb0a","resolution":{"observed_at":"2026-08-01T00:59:08.113657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02644","last_updated":"2025-05-30T03:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-03T16:30:47Z","title":"Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02644","snapshot_observed_at":"2026-08-01T00:59:08.246438Z","title":"Agent security bench (asb): Formalizing and benchmarking attacks and defenses in llm-based agents.arXiv preprint arXiv:2410.02644,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:08.246438Z"},"links":{"cited_paper":"/paper/2410.02644","citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:14a31cb887d3bd028b68b037c6a6afa8c9305ced642a9da78d1f03aa553f3b88","observation_id":"d2ac8360-d29e-428f-bcd8-2bf4a99ab2e3","resolution":{"observed_at":"2026-08-01T00:59:08.246438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:08.287438Z","title":"Iheval: Evaluating language models on following the instruction hierarchy","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:08.287438Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:92ad75efabf6cc08b14576e85799bcdd7092f664898fc81e9dd747a4f7a86c20","observation_id":"192de2ae-f253-4f5a-934a-b6eb726b09f8","resolution":{"observed_at":"2026-08-01T00:59:08.287438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-01T00:59:08.374290Z","title":"Instruction-following evaluation for large language models.arXiv preprint arXiv:2311.07911,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:08.374290Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:ee26819fc43783d44fbb1ad08f884b725cc324b57d2df8a529f790720798d0b8","observation_id":"a3197632-d4fb-4b55-97e1-0e4b6dc65067","resolution":{"observed_at":"2026-08-01T00:59:08.374290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:08.488331Z","title":"Y denotes primary coverage, P denotes partial or adjacent coverage, and – denotes not a primary focus","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:08.488331Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:2abc6e91264ae16f21e046162eb9003bc56a62227aaf21b494466d136421d90e","observation_id":"8ed0d429-a201-41f9-9f3c-46d76671d181","resolution":{"observed_at":"2026-08-01T00:59:08.488331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:08.573160Z","title":"11 Table 7: Model providers and exact LiteLLM identifiers for all 37 model variants","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:08.573160Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:e9a5932e3817b787258f4c7ca0cacaf9baecd016d8eb59b842b6661405e6baa5","observation_id":"ddba0c7b-0bf6-4259-994b-7297486fefdb","resolution":{"observed_at":"2026-08-01T00:59:08.573160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:07.575558Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:07.575558Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:1756ac31a47d783189d7503d30b44e4a1c3d3c29525f37a0476809a8c396ce8e","observation_id":"ecdbc884-167c-4563-86d6-355642116961","resolution":{"observed_at":"2026-08-01T00:59:07.575558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:07.438286Z","title":"LiteLLM: Open-source library and ai gateway for calling llm providers","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:07.438286Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:96a38163f2544ee3176b08532639c3e4a5deae84b1378c61875fc5203b327b04","observation_id":"612054c2-2e3e-4896-a039-cf4e4abbce49","resolution":{"observed_at":"2026-08-01T00:59:07.438286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:07.682201Z","title":"Infobench: Evaluating instruction following ability in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:07.682201Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:444b9b9933221c2f36d6118f032a1b06771e3cda5dad3fad5a1a478494f4c2a2","observation_id":"4f575bf0-1f27-49fd-a761-31bfc0883ea9","resolution":{"observed_at":"2026-08-01T00:59:07.682201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:07.505407Z","title":"Ih-challenge: A training dataset to improve instruction hierarchy on frontier llms.arXiv preprint arXiv:2603.10521,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:07.505407Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:b977e00ceab011127dca269ee49aa19b852d6270043a79aaf2ff70d6f28146a7","observation_id":"0cb2c6de-60f5-4edf-be89-7bccc48680a0","resolution":{"observed_at":"2026-08-01T00:59:07.505407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T00:59:08.647382Z","title":"no action required","venue":null,"work_id":null,"year":2029},"citing_paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications","version":2},"reference_index":8192,"source":"pdf_text","source_observed_at":"2026-08-01T00:59:08.647382Z"},"links":{"citing_paper":"/paper/2607.25987"},"observation_digest":"sha256:ce29b9e789e5ada5fbaca26ff165b517ee3b2261d7b48fc66057d7e3ee5b9509","observation_id":"beab5425-507b-4bef-b8f7-e1ce267c1226","resolution":{"observed_at":"2026-08-01T00:59:08.647382Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25987","last_updated":"2026-07-29T14:39:56Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-05T01:41:53.354572Z","submitted_at":"2026-07-28T17:06:13Z","title":"IH-Benchmark: A Conflict-Centered Benchmark for Instruction-Hierarchy Robustness in LLM Applications"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2607.25987."}