{"as_of":"2026-08-09T23:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5243d454f181b7310ffe9aaee40e351271994928191808d6e030e969764e123b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:15:18.352301Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T16:18:01.698451Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":"2410.02197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, G","venue":null,"work_id":"43d53d4e-6b6a-439c-b001-56d60f968045","year":null},"citing_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-07T05:53:12.643515Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-17T16:18:01.560780Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2410.18451"},"observation_digest":"sha256:832b5ca2bf33a7142312f0f1404ff6ea27ad368d9ce24029b1fe29f4bf4d3e42","observation_id":"dd59daf8-f9fa-4de9-af3a-ee60d8c2581c","resolution":{"observed_at":"2026-05-17T16:18:01.700871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-08-07T15:15:18.352301Z","title":"General preference modeling with preference representations for aligning language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15710","last_updated":"2025-05-21T16:21:29Z","snapshot_observed_at":"2026-08-08T20:58:02.100576Z","submitted_at":"2025-05-21T16:21:29Z","title":"Advancing LLM Safe Alignment with Safety Representation Ranking","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:18.352301Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2505.15710"},"observation_digest":"sha256:8c164aec0436789c8c65ae19bd06066ff50c21536afcd7b8d4a6e8fda7c5fc7e","observation_id":"512519c3-7e96-443f-9916-7cb34fcf72c8","resolution":{"observed_at":"2026-08-07T15:15:18.352301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-08-06T18:52:38.799899Z","title":"Zhang, G","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07855","last_updated":"2026-06-22T14:01:09Z","snapshot_observed_at":"2026-08-09T05:40:24.839933Z","submitted_at":"2025-07-10T15:38:17Z","title":"DPO Unchained: Your Training Algorithm is Secretly Disentangled in Human Choice Theory (and its Loss' Convexity is Dispensable)","version":4},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T18:52:38.799899Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2507.07855"},"observation_digest":"sha256:73968d7580ec57c00af4d1d06ec78ca215d8e13ad37fd629b05d4cba03963d3f","observation_id":"87ebc61f-baca-466e-855a-47b090309761","resolution":{"observed_at":"2026-08-06T18:52:38.799899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-08-06T12:54:38.169486Z","title":"General preference modeling with preference rep- resentations for aligning language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21391","last_updated":"2025-07-30T04:49:38Z","snapshot_observed_at":"2026-08-09T18:53:55.200265Z","submitted_at":"2025-07-28T23:52:53Z","title":"Multimodal LLMs as Customized Reward Models for Text-to-Image Generation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T12:54:38.169486Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2507.21391"},"observation_digest":"sha256:ef1979bfedcdde7c6b815ee15fdad95eaae8fa92ae57b18c597fb98b78b688be","observation_id":"a5e53093-eb1b-4ff2-9218-0079c8c509a9","resolution":{"observed_at":"2026-08-06T12:54:38.169486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":"2410.02197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, G","venue":null,"work_id":"43d53d4e-6b6a-439c-b001-56d60f968045","year":null},"citing_paper":{"arxiv_id":"2605.07724","last_updated":"2026-06-03T12:55:17Z","snapshot_observed_at":"2026-07-06T23:20:06.574823Z","submitted_at":"2026-05-08T13:27:23Z","title":"Curated Synthetic Data Doesn't Have to Collapse: A Theoretical Study of Generative Retraining with Pluralistic Preferences","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-11T02:30:14.693348Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2605.07724"},"observation_digest":"sha256:75b2bd85677d37a072a6fb9eb8ddc6abd162fbcc5fbf90ab7215e5a5c7b16dd2","observation_id":"37073495-2332-4e24-ac41-4e3b58d7e906","resolution":{"observed_at":"2026-05-11T02:30:54.367385Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment","version":3},"cited_work":{"arxiv_id":"2410.02197","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.02197","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, G","venue":null,"work_id":"43d53d4e-6b6a-439c-b001-56d60f968045","year":null},"citing_paper":{"arxiv_id":"2605.09214","last_updated":"2026-05-09T23:17:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-09T23:17:46Z","title":"Fast Rates for Offline Contextual Bandits with Forward-KL Regularization under Single-Policy Concentrability","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-12T03:47:14.379908Z"},"links":{"cited_paper":"/paper/2410.02197","citing_paper":"/paper/2605.09214"},"observation_digest":"sha256:62673abf833dbc0eb3b4fbd65b919f4f9af685d1215c7d8b077fe8313e017ddc","observation_id":"4fb04080-5ac2-4387-bc6d-42bedcb39faa","resolution":{"observed_at":"2026-05-12T06:56:30.944683Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.02197/citation-record","integrity":"/paper/2410.02197/integrity","json":"/paper/2410.02197/citation-record.json","paper":"/paper/2410.02197"},"outbound":[],"paper":{"arxiv_id":"2410.02197","last_updated":"2025-06-11T13:11:12Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T04:22:55Z","title":"Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2410.02197."}