{"as_of":"2026-08-09T20:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0732d049fb72dffc3ffa4f7ec8af94f03045d542e3d6850297d1286d99e8251e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:46:29.139910Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T11:09:46.403899Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":"2402.05369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-07-04T11:09:46.403899Z","title":"Noise contrastive alignment of language models with explicit re- wards","venue":null,"work_id":"f7ff9d0f-7c6d-48d2-ace0-145809644beb","year":2024},"citing_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T09:16:17.150383Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2411.10442"},"observation_digest":"sha256:5942037e32283902f88fc464a71bb88db8ae70430ba301a749f0de7dcfd6a3c8","observation_id":"1e8abeb4-b1da-40b0-8643-d6329ca3d9d8","resolution":{"observed_at":"2026-05-16T09:16:17.381760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-08-09T17:46:29.139910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00814","last_updated":"2025-05-19T08:24:51Z","snapshot_observed_at":"2026-08-09T17:35:35.604319Z","submitted_at":"2025-02-02T14:50:25Z","title":"Disentangling Length Bias In Preference Learning Via Response-Conditioned Modeling","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T17:46:29.139910Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2502.00814"},"observation_digest":"sha256:3b081eb76499603ef4ed8a308b07702447f849bf9cd170b394a3e01d7c3f3922","observation_id":"5e2afa0f-02b2-4f15-b42a-8db7b9025f3f","resolution":{"observed_at":"2026-08-09T17:46:29.139910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":"2402.05369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-07-04T11:09:46.403899Z","title":"Noise contrastive alignment of language models with explicit re- wards","venue":null,"work_id":"f7ff9d0f-7c6d-48d2-ace0-145809644beb","year":2024},"citing_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-05-11T20:23:30.763794Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2502.01456"},"observation_digest":"sha256:204f22c3c2b22e2dd5139b98e8e2632069f07b8d480e350d4af243c2cfb0f69b","observation_id":"b5c9c597-900b-4ab4-b3cd-9c53d75baebd","resolution":{"observed_at":"2026-05-11T20:23:30.969028Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-08-07T13:52:20.611227Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20771","last_updated":"2025-05-27T06:22:50Z","snapshot_observed_at":"2026-08-09T13:46:00.091267Z","submitted_at":"2025-05-27T06:22:50Z","title":"Bridging the Gap: Self-Optimized Fine-Tuning for LLM-based Recommender Systems","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:52:20.611227Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2505.20771"},"observation_digest":"sha256:cc6f9e23125e358fb9c8ce470bde0def5f9176b7fcef11a80658a356bdbc15b4","observation_id":"c104be5e-9b8c-4c35-81e7-578f138446b5","resolution":{"observed_at":"2026-08-07T13:52:20.611227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":"2402.05369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-07-04T11:09:46.403899Z","title":"Noise contrastive alignment of language models with explicit re- wards","venue":null,"work_id":"f7ff9d0f-7c6d-48d2-ace0-145809644beb","year":2024},"citing_paper":{"arxiv_id":"2604.24536","last_updated":"2026-04-27T14:33:45Z","snapshot_observed_at":"2026-07-06T23:10:33.821313Z","submitted_at":"2026-04-27T14:33:45Z","title":"Generating Place-Based Compromises Between Two Points of View","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-08T03:36:31.695964Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2604.24536"},"observation_digest":"sha256:ce2184b9068aef13c2c78bfc2b9bece81c545e6d16fec75723dbf14bf01fd15e","observation_id":"f9e65153-ab2f-4397-8d09-18cabf6c0429","resolution":{"observed_at":"2026-05-11T22:01:12.238577Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":"2402.05369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-07-04T11:09:46.403899Z","title":"Noise contrastive alignment of language models with explicit re- wards","venue":null,"work_id":"f7ff9d0f-7c6d-48d2-ace0-145809644beb","year":2024},"citing_paper":{"arxiv_id":"2605.10622","last_updated":"2026-05-11T14:16:25Z","snapshot_observed_at":"2026-07-06T23:22:32.858399Z","submitted_at":"2026-05-11T14:16:25Z","title":"Vocabulary Hijacking in LVLMs: Unveiling Critical Attention Heads by Excluding Inert Tokens to Mitigate Hallucination","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-12T05:15:34.156717Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2605.10622"},"observation_digest":"sha256:38534925fa986cd2a51845fd34f8a8dffa2c231a08802645b0cef51bb1114ac6","observation_id":"a3ab9b5e-2649-429d-bcb5-248393799ab6","resolution":{"observed_at":"2026-05-12T05:16:24.403876Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":"2402.05369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-07-04T11:09:46.403899Z","title":"Noise contrastive alignment of language models with explicit re- wards","venue":null,"work_id":"f7ff9d0f-7c6d-48d2-ace0-145809644beb","year":2024},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":1},"reference_index":193,"source":"pdf_text","source_observed_at":"2026-06-26T08:09:57.542558Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:3bff1ae6b4a7e08675809d539ad61120d10b51473048bd9494df0eb9a3ebb20f","observation_id":"6269784e-a327-4681-930b-1d2a157821ef","resolution":{"observed_at":"2026-07-04T11:09:46.405656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-08-02T10:27:18.419953Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards.arXiv Preprint arXiv:2402.05369, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":2},"reference_index":193,"source":"pdf_text","source_observed_at":"2026-08-02T10:27:18.419953Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:1ae2d1480078efe0d26d5b5fe5d484b37b94e0e5732f074d3f34f180461c03a1","observation_id":"4046892d-135b-4bdb-aa6c-ca77c0fe9f84","resolution":{"observed_at":"2026-08-02T10:27:18.419953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-07-11T13:53:36.775836Z","title":"arXiv preprint arXiv:2402.05369 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04763","last_updated":"2026-07-26T14:17:18Z","snapshot_observed_at":"2026-08-02T10:24:43.977557Z","submitted_at":"2026-07-06T07:56:53Z","title":"Multi-Turn On-Policy Distillation with Prefix Replay","version":1},"reference_index":293,"source":"arxiv_source","source_observed_at":"2026-07-11T13:53:36.775836Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2607.04763"},"observation_digest":"sha256:032172f81653d8c5304d542b5ea9f9dcd83b307714feb1d16b34442f24aa62fb","observation_id":"4f1c9101-492b-4ae0-bc59-328fc940dac4","resolution":{"observed_at":"2026-07-11T13:53:36.775836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-08-02T08:41:06.965268Z","title":"arXiv preprint arXiv:2402.05369 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04763","last_updated":"2026-07-26T14:17:18Z","snapshot_observed_at":"2026-08-02T10:24:43.977557Z","submitted_at":"2026-07-06T07:56:53Z","title":"Multi-Turn On-Policy Distillation with Prefix Replay","version":3},"reference_index":294,"source":"arxiv_source","source_observed_at":"2026-08-02T08:41:06.965268Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2607.04763"},"observation_digest":"sha256:c7a97f12bca5604314a19d52f826f0ff431592d10e4c2f04e4c92dae37562ff9","observation_id":"69b85677-5c3c-4ec0-873b-d2d14fe8df94","resolution":{"observed_at":"2026-08-02T08:41:06.965268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05369","snapshot_observed_at":"2026-08-01T07:28:30.320945Z","title":"arXiv preprint arXiv:2402.05369 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21453","last_updated":"2026-07-24T02:14:44Z","snapshot_observed_at":"2026-08-03T14:01:50.133228Z","submitted_at":"2026-07-23T15:55:29Z","title":"Test-Time Scaling via Error Localization","version":2},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-08-01T07:28:30.320945Z"},"links":{"cited_paper":"/paper/2402.05369","citing_paper":"/paper/2607.21453"},"observation_digest":"sha256:509f080176ae467cd1fc9d69f38402bacb6900050567c25b85776016103e8739","observation_id":"e33543b3-8a5e-4dd0-b16f-dcb1677bdaab","resolution":{"observed_at":"2026-08-01T07:28:30.320945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.05369/citation-record","integrity":"/paper/2402.05369/integrity","json":"/paper/2402.05369/citation-record.json","paper":"/paper/2402.05369"},"outbound":[],"paper":{"arxiv_id":"2402.05369","last_updated":"2024-10-30T07:29:40Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T15:33:34.682108Z","submitted_at":"2024-02-08T02:58:47Z","title":"Noise Contrastive Alignment of Language Models with Explicit Rewards"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2402.05369."}