{"as_of":"2026-08-10T00:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9e4d3b29decc0629ec9a2f5b19552878656963a26873b8100bc014f122cf4a90","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:10:44.120366Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06377/citation-record","integrity":"/paper/2608.06377/integrity","json":"/paper/2608.06377/citation-record.json","paper":"/paper/2608.06377"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-07T04:10:43.127049Z","title":"Anthropic","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.127049Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:0ac7a734463eb7fbc3e92ad89fb4b6e996e954176a9a7da820ab1b1e28ec5f0c","observation_id":"de5fff26-e8b1-47a2-bcc3-f095138614c9","resolution":{"observed_at":"2026-08-07T04:10:43.127049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-07T04:10:43.503102Z","title":"Mor Geva, Daniel Khashabi, Elad Segal, Tushar Khot, Dan Roth, and Jonathan Berant","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.503102Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:2bf6de7ddab2df03bffa6e0dd953ab2816152a7d7d28fc5146129da7019d98f5","observation_id":"6e938e8c-db6b-4dc0-ac0c-5762692f62be","resolution":{"observed_at":"2026-08-07T04:10:43.503102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:10:43.574558Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.574558Z"},"links":{"citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:d4b50024e75153c954f3ffffbfe680a814b53e31e2ef4609d1d8dcbd13e11b6e","observation_id":"ebb65bb2-77a6-48d0-b336-fc58a81573cc","resolution":{"observed_at":"2026-08-07T04:10:43.574558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15815","last_updated":"2026-04-19T06:21:12Z","snapshot_observed_at":"2026-08-04T00:23:39.759653Z","submitted_at":"2025-08-16T20:33:09Z","title":"User-Assistant Bias in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15815","snapshot_observed_at":"2026-08-07T04:10:43.689310Z","title":"the moon is made of marshmallows","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.689310Z"},"links":{"cited_paper":"/paper/2508.15815","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:6905e66e8c523a76642e1940236701facb015b7be2819a0f13214aaebc8c4277","observation_id":"4d82cb14-4d33-4725-bd02-00f969e27112","resolution":{"observed_at":"2026-08-07T04:10:43.689310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09527","last_updated":"2022-11-17T13:43:20Z","snapshot_observed_at":"2026-07-06T14:19:47.424778Z","submitted_at":"2022-11-17T13:43:20Z","title":"Ignore Previous Prompt: Attack Techniques For Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09527","snapshot_observed_at":"2026-08-07T04:10:43.752073Z","title":"North Am","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.752073Z"},"links":{"cited_paper":"/paper/2211.09527","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:f0f9753684244dd4060dbf87de084e0f6a76ccd8dc271994399be09e62d781ec","observation_id":"89561fec-e23d-4a63-a641-293eab41b16d","resolution":{"observed_at":"2026-08-07T04:10:43.752073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:10:44.446845Z","title":null,"venue":null,"work_id":"8920c1c7-e477-48c7-9f48-83ac2c24c3cf","year":null},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.838984Z"},"links":{"citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:c60b016f4dc3e9d59cb9f184ebe969433e2e3b5cc62de44e94113edb741e0b57","observation_id":"f6d5ff6d-3413-4f9d-87c4-f67d0d645c0f","resolution":{"observed_at":"2026-08-07T04:10:44.536920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13743","last_updated":"2025-08-19T11:30:52Z","snapshot_observed_at":"2026-08-05T18:53:44.682428Z","submitted_at":"2025-08-19T11:30:52Z","title":"Sycophancy under Pressure: Evaluating and Mitigating Sycophantic Bias via Adversarial Dialogues in Scientific QA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13743","snapshot_observed_at":"2026-08-07T04:10:44.016598Z","title":"Siyan Zhao, Zhihui Xie, Mengchen Liu, Jing Huang, Guan Pang, Feiyu Chen, and Aditya Grover","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:44.016598Z"},"links":{"cited_paper":"/paper/2508.13743","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:bdd17de10e79e89fa92cd508421c55326ca688747b22baa7a2aaa46a456c336d","observation_id":"6757a1d3-49ee-44ec-a07c-bcd9837e1cbe","resolution":{"observed_at":"2026-08-07T04:10:44.016598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T04:10:43.266892Z","title":"DeepSeek-AI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.266892Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:71b6e35814bcb783c4b3242450b979e314b34c4d52f2d766e28c30d0b0d722a3","observation_id":"11c4f194-8b8c-4dc9-8b93-a3cd0d378853","resolution":{"observed_at":"2026-08-07T04:10:43.266892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:10:44.649846Z","title":null,"venue":null,"work_id":"5c6ae050-41fd-41cc-8171-ab706376c6d9","year":null},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.423326Z"},"links":{"citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:c8e6e6b5cc3a5b252c62fd90508a64a142ea0706a2588a1ecfb466fd0bebc217","observation_id":"c5bd237e-3b6e-4762-9592-bbeaf23a7bb4","resolution":{"observed_at":"2026-08-07T04:10:44.758253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.02234","last_updated":"2026-07-02T14:33:07Z","snapshot_observed_at":"2026-07-07T00:07:42.752664Z","submitted_at":"2026-07-02T14:33:07Z","title":"Purified OPSD: On-Policy Self-Distillation Without Losing How to Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.02234","snapshot_observed_at":"2026-08-07T04:10:43.931332Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.931332Z"},"links":{"cited_paper":"/paper/2607.02234","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:89ad08fb9d137f3c1617d9936894dc4580cc4cf88a49e7a0e8d4d4d513695d98","observation_id":"a2ffcca9-4f3c-4ee8-9a5e-e6bd2b924f5c","resolution":{"observed_at":"2026-08-07T04:10:43.931332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21318","last_updated":"2025-04-30T05:05:09Z","snapshot_observed_at":"2026-08-08T08:43:53.657438Z","submitted_at":"2025-04-30T05:05:09Z","title":"Phi-4-reasoning Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21318","snapshot_observed_at":"2026-08-07T04:10:43.082824Z","title":"Loubna Ben Allal, Anton Lozhkov, Elie Bakouch, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:43.082824Z"},"links":{"cited_paper":"/paper/2504.21318","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:e46fa785724829eeab69b8c8666e8aed234b87a840c4bb9bc6dff0562fb5e007","observation_id":"dce39efe-da83-462a-b9b7-a328143600b6","resolution":{"observed_at":"2026-08-07T04:10:43.082824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-07T20:24:25.671681Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-08-07T04:10:44.120366Z","title":"Wei Zhou, Xiongwei Zhu, Zelin Xu, Bo Dong, Lixue Gong, Yongyuan Liang, Meng Chu, Leigang Qu, Lingdong Kong, Wei Liu, and Tat-Seng Chua","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:44.120366Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2608.06377"},"observation_digest":"sha256:4b49ac68741874657221ae4c5a554ba159b78e954032c6ef721928d9bcc81bc7","observation_id":"ad3daa9e-4fa4-4c73-a3e0-ae48bf3b87fe","resolution":{"observed_at":"2026-08-07T04:10:44.120366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.06377","last_updated":"2026-08-06T17:59:58Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T23:13:37.474425Z","submitted_at":"2026-08-06T17:59:58Z","title":"Learning When to Trust via Selective Context Preference Optimization"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2608.06377."}