{"as_of":"2026-08-15T19:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e5d836d03aaf05945429bcb480387fdc09c07f263af89617aaad900a7fb082d0","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:15:46.465735Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17122/citation-record","integrity":"/paper/2505.17122/integrity","json":"/paper/2505.17122/citation-record.json","paper":"/paper/2505.17122"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-08-14T14:27:25.466650Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-07T15:15:46.155225Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.155225Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:a255bf562868c04aa593dd444a169491a56d69636248f75aaed5226a3351ead1","observation_id":"dba8227b-b72d-479f-bde8-1c13692362b6","resolution":{"observed_at":"2026-08-07T15:15:46.155225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-13T15:15:10.681693Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18451","snapshot_observed_at":"2026-08-07T15:15:46.159882Z","title":"Skywork-reward: Bag of tricks for reward modeling in llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.159882Z"},"links":{"cited_paper":"/paper/2410.18451","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:e6399a300f5a24c8f1d8cc18bc727edb929be6a78a9a59ca517bc121e6edc7a4","observation_id":"7d2ed43c-03db-40a8-bb27-85e3106ca46d","resolution":{"observed_at":"2026-08-07T15:15:46.159882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01377","last_updated":"2024-07-16T03:24:39Z","snapshot_observed_at":"2026-08-14T00:28:11.851309Z","submitted_at":"2023-10-02T17:40:01Z","title":"UltraFeedback: Boosting Language Models with Scaled AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01377","snapshot_observed_at":"2026-08-07T15:15:46.165537Z","title":"Ultrafeedback: Boosting language models with high-quality feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.165537Z"},"links":{"cited_paper":"/paper/2310.01377","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:823fd63c0110a2023ce0e321f483b1f0ab8b89e1ca0fc78e8fcc8742762b6aa8","observation_id":"8cd1976d-7b7e-4604-8e5c-92cb51178a8f","resolution":{"observed_at":"2026-08-07T15:15:46.165537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-08-10T12:03:10.373653Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T15:15:46.171527Z","title":"Brown, Jack Clark, Sam McCandlish, Chris Olah, and Jared Kaplan","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.171527Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:c91e0080ad2c8a486ee378ab274e0ef8277fdf3b8523a27dfacfe02b8e88afe6","observation_id":"d28a6798-21be-4253-ae69-eba4f9d6140c","resolution":{"observed_at":"2026-08-07T15:15:46.171527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T15:15:46.176534Z","title":"Brown, Jack Clark, Sam McCandlish, Chris Olah, Benjamin Mann, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.176534Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:d71499f6d0991ca9634f4330b46b8c70b76235f9de38df185cf3092542c8baf6","observation_id":"88d0f485-409f-4db0-9ac5-9536f135504c","resolution":{"observed_at":"2026-08-07T15:15:46.176534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:47.071680Z","title":null,"venue":null,"work_id":"7d7ef845-82e5-4ee0-8898-e0c8f8b12110","year":2022},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.182023Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:740abd34ffc101dc58428eac3126d4ba44f3742984d6066f840344de5dc6352a","observation_id":"cf6db343-9acf-4e71-8fe9-75b41c3e3b86","resolution":{"observed_at":"2026-08-07T15:15:47.074771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:47.061123Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":"728aed9e-ad5e-4734-9267-d6c77c36b40e","year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.186148Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:930f3651011306299d01861de96e2e35e3a63dbdb423502361001e54fbcac42e","observation_id":"90b915a2-73f1-4b6a-b678-03d3275cabb1","resolution":{"observed_at":"2026-08-07T15:15:47.064401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11704","last_updated":"2025-05-23T16:32:54Z","snapshot_observed_at":"2026-08-15T10:11:25.632969Z","submitted_at":"2024-09-18T05:13:18Z","title":"From Lists to Emojis: How Format Bias Affects Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11704","snapshot_observed_at":"2026-08-07T15:15:46.189911Z","title":"From lists to emojis: How format bias affects model alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.189911Z"},"links":{"cited_paper":"/paper/2409.11704","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:67ed18d48a6202e699b77111b335947bdd45d9c5c10be2a09d80fdb40112eb9f","observation_id":"bdd6cb4c-e052-4261-b266-da5ac02872ac","resolution":{"observed_at":"2026-08-07T15:15:46.189911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:47.051106Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"2eb8ec09-af41-442a-bd5b-9fa95646db20","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.194999Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:8f3cf92afe5896ed60679e50a6c1ce8058fe9c9f1421938ab2af5244366b61f8","observation_id":"78f9a988-9b9a-4100-9941-4c68a102176d","resolution":{"observed_at":"2026-08-07T15:15:47.054824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:47.039554Z","title":"Disentangling length from quality in direct preference optimization","venue":null,"work_id":"cbdba7f0-ee49-453b-969e-0e789b73addd","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.198963Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:75c46aba23594a2c466767395f0ac8ad8ea11e79192cad5deb80aa37efb80466","observation_id":"0c05f996-aa3d-40b2-97b6-ba0cb90335e9","resolution":{"observed_at":"2026-08-07T15:15:47.043879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-08-12T21:18:02.964833Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-07T15:15:46.203797Z","title":"KTO: model alignment as prospect theoretic optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.203797Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:8470a6614989009f28277cfc53718d10bfd10a98f052a0c2e477b71df1f327ec","observation_id":"aaa623f8-5777-4bc0-9e76-25b3c7eaf379","resolution":{"observed_at":"2026-08-07T15:15:46.203797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-15T03:01:41.971978Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-07T15:15:46.208143Z","title":"Smith, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.208143Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:7969a99fb1b56a9986b73ecee043c034d059c5b70c18032d50a931487166add1","observation_id":"14be7723-3d69-4534-914b-b17772787e2b","resolution":{"observed_at":"2026-08-07T15:15:46.208143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:47.022010Z","title":"Predictive pipelined decoding: A compute-latency trade-off for exact LLM decoding","venue":null,"work_id":"88795d7b-1ea5-4995-b909-54c60927054c","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.213130Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:54b9769d4d61879251091d32ffa01a33e613fc02fc577a2a947ea91acc999e38","observation_id":"36fbaf91-6663-49fb-bc1a-4bf3cc467387","resolution":{"observed_at":"2026-08-07T15:15:47.026558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16844","last_updated":"2024-07-17T13:59:48Z","snapshot_observed_at":"2026-08-13T04:09:46.591351Z","submitted_at":"2024-02-26T18:59:28Z","title":"Think Big, Generate Quick: LLM-to-SLM for Fast Autoregressive Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16844","snapshot_observed_at":"2026-08-07T15:15:46.217676Z","title":"Asano, and Babak Ehteshami Bejnordi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.217676Z"},"links":{"cited_paper":"/paper/2402.16844","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:ca3617ddfcd8383a8461eb11285d50cc47cba132465b29bb45f00486b6236c9a","observation_id":"80188a3d-4398-4158-af0d-294f3c38082b","resolution":{"observed_at":"2026-08-07T15:15:46.217676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10666","last_updated":"2024-12-16T10:48:28Z","snapshot_observed_at":"2026-08-13T08:40:16.675246Z","submitted_at":"2024-11-16T02:02:49Z","title":"SAM Decoding: Speculative Decoding via Suffix Automaton","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10666","snapshot_observed_at":"2026-08-07T15:15:46.221364Z","title":"SAM decoding: Speculative decoding via suffix automaton","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.221364Z"},"links":{"cited_paper":"/paper/2411.10666","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:bdad52332632fbd9aae19b14b96141614c399cec7741b20662a4d4fc5f5ce139","observation_id":"3b8f2045-d632-41d8-8738-8ebcedfca088","resolution":{"observed_at":"2026-08-07T15:15:46.221364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01955","last_updated":"2024-07-02T05:14:15Z","snapshot_observed_at":"2026-08-12T23:30:44.206909Z","submitted_at":"2024-07-02T05:14:15Z","title":"S2D: Sorted Speculative Decoding For More Efficient Deployment of Nested Large Language Models","version":1},"cited_work":{"arxiv_id":"2407.01955","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.01955","snapshot_observed_at":"2026-08-07T15:15:46.663222Z","title":"S2D: Sorted Speculative Decoding For More Efficient Deployment of Nested Large Language Models","venue":"cs.CL","work_id":"bbfadb3d-8661-457f-b9a3-c6322380c744","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.226353Z"},"links":{"cited_paper":"/paper/2407.01955","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:91a7a847d94a45d4ab7d536c2ffaa218589b0b0600e34afdffbe66a2fe33b9ae","observation_id":"42994f2b-78f4-42ef-a002-ba94498ea71e","resolution":{"observed_at":"2026-08-07T15:15:46.667015Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:47.010595Z","title":"The unlocking spell on base llms: Rethinking alignment via in-context learning","venue":null,"work_id":"fb887f13-c0f4-45a3-aa4c-1d627d4e4111","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.230848Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:669202536e9a608d70db7c97647574b40e19015c1378281affc4f2e072e61a7b","observation_id":"29734963-f7b4-4944-8d9e-0e41c3a07c99","resolution":{"observed_at":"2026-08-07T15:15:47.015026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05946","last_updated":"2024-06-10T00:35:23Z","snapshot_observed_at":"2026-08-12T23:46:49.092229Z","submitted_at":"2024-06-10T00:35:23Z","title":"Safety Alignment Should Be Made More Than Just a Few Tokens Deep","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05946","snapshot_observed_at":"2026-08-07T15:15:46.235543Z","title":"Safety alignment should be made more than just a few tokens deep","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.235543Z"},"links":{"cited_paper":"/paper/2406.05946","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:63a33f5b58d1386d1220678b89fde69d5947fadfd0138e6b6a42e4e1df9d7877","observation_id":"70a963a9-1809-427e-9e7d-f6048fc901e8","resolution":{"observed_at":"2026-08-07T15:15:46.235543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.241872Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.241872Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:6248d973b99e108bd728730547cb132204b283204c372046860a240c39efce1f","observation_id":"b5578633-572c-42b3-8172-d6d7d4b49a57","resolution":{"observed_at":"2026-08-07T15:15:46.241872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T15:15:46.247561Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.247561Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:bb3b1aeda20f9308d5ed32c8b38d58f75a44d10824904bfca25489277d1b7aee","observation_id":"57406553-5096-4b3f-8ebd-d538567bbf03","resolution":{"observed_at":"2026-08-07T15:15:46.247561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T15:15:46.252669Z","title":"Dai, Anja Hauth, Katie Millican, David Silver, Slav Petrov, Melvin Johnson, Ioannis Antonoglou, Julian Schrittwieser, Amelia Glaese, Jilin Chen, Emily Pitler, Timothy P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.252669Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:bd61105e34b8e5c34446a9be754def58ca8a22b61993d5c53b056c0a08d3bee9","observation_id":"8e0cc3c2-ba1f-4e04-b503-9cce0e585656","resolution":{"observed_at":"2026-08-07T15:15:46.252669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:15:46.267359Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.267359Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:70dac1c447602572a97db76365ceeb8ca57c5f9e00ba722170fb347afbe54a20","observation_id":"51ed382d-c3ad-4485-a917-b07d40cdee5e","resolution":{"observed_at":"2026-08-07T15:15:46.267359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.991802Z","title":"On the weaknesses of reinforcement learning for neural machine translation","venue":null,"work_id":"3e530006-3f12-4d43-ba0d-7db12ef76e00","year":2020},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.279057Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:dd875ead1f584c388538b810866eeeaf9320176a0632300eebb4f8a7fb6bbc14","observation_id":"be6848b4-31e8-4f5b-8cb2-4ba3225c8f7c","resolution":{"observed_at":"2026-08-07T15:15:46.996196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.12729","last_updated":"2020-05-25T16:24:59Z","snapshot_observed_at":"2026-07-06T09:23:23.891393Z","submitted_at":"2020-05-25T16:24:59Z","title":"Implementation Matters in Deep Policy Gradients: A Case Study on PPO and TRPO","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.12729","snapshot_observed_at":"2026-08-07T15:15:46.288418Z","title":"Implementation matters in deep policy gradients: A case study on PPO and TRPO","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.288418Z"},"links":{"cited_paper":"/paper/2005.12729","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:979b0a938749dfab210e15ff14d522e182a2945bf5a995cb12f24b7c545d932c","observation_id":"dc0ec6a0-0fe7-4e1f-8560-d83ff9f57534","resolution":{"observed_at":"2026-08-07T15:15:46.288418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10425","last_updated":"2023-05-17T17:57:10Z","snapshot_observed_at":"2026-08-14T18:51:06.334767Z","submitted_at":"2023-05-17T17:57:10Z","title":"SLiC-HF: Sequence Likelihood Calibration with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10425","snapshot_observed_at":"2026-08-07T15:15:46.299308Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.299308Z"},"links":{"cited_paper":"/paper/2305.10425","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:c72003b52e627a074dfaaabf71a73492193cd50bff9d3e7f362602222ff45bb6","observation_id":"f2cf9eaa-5d02-454e-91db-cc41a6877c14","resolution":{"observed_at":"2026-08-07T15:15:46.299308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.979839Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":"44b98b96-a16e-48c0-9e0e-cc848995bf1a","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.311422Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:22f3b336e9956e9a8a280ab3fb2cab233338fdb88dc8d66ee6bb12c045ffd381","observation_id":"c0afdf0d-fc39-4f31-92dc-09b17d5d8606","resolution":{"observed_at":"2026-08-07T15:15:46.983769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.967971Z","title":"Generalized preference optimization: A unified approach to offline alignment","venue":null,"work_id":"21defffd-502c-4e4d-b182-394255b8b335","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.325992Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:ffca3a4f342372636063d7684420db15411592a1cdf5fb7fa6b3017045b7e007","observation_id":"0fa5c61f-94c3-481a-8301-bcdcf867e642","resolution":{"observed_at":"2026-08-07T15:15:46.971851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16033","last_updated":"2025-09-03T03:41:08Z","snapshot_observed_at":"2026-08-12T22:20:23.233632Z","submitted_at":"2024-10-18T04:38:21Z","title":"TreeBoN: Enhancing Inference-Time Alignment with Speculative Tree-Search and Best-of-N Sampling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16033","snapshot_observed_at":"2026-08-07T15:15:46.338984Z","title":"Treebon: Enhancing inference-time alignment with speculative tree-search and best-of-n sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.338984Z"},"links":{"cited_paper":"/paper/2410.16033","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:708f74c6779503171ea27d6bfc648d10b1a014a44b99f7c091a6e05a663b259b","observation_id":"cbfe94fd-9683-4d9b-802f-3a45d98322da","resolution":{"observed_at":"2026-08-07T15:15:46.338984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08925","last_updated":"2024-12-26T00:15:20Z","snapshot_observed_at":"2026-08-15T03:25:32.357214Z","submitted_at":"2024-02-14T03:56:27Z","title":"MaxMin-RLHF: Alignment with Diverse Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08925","snapshot_observed_at":"2026-08-07T15:15:46.346809Z","title":"Maxmin-rlhf: Alignment with diverse human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.346809Z"},"links":{"cited_paper":"/paper/2402.08925","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:a53bab7ae6527122a7f09aea16b6d111c0d9bb632cb5d2eabf1dbc1ea1f6a37f","observation_id":"096646df-cbfe-410b-b49b-a168e2289500","resolution":{"observed_at":"2026-08-07T15:15:46.346809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.352530Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.352530Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:33d8f2385771b212c69025ca54b2d35d45e65b5774e565712d01ca1fe4cff5cf","observation_id":"5adc1e2e-aa18-4435-b8a5-63735f194c7e","resolution":{"observed_at":"2026-08-07T15:15:46.352530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00898","last_updated":"2024-09-12T22:09:25Z","snapshot_observed_at":"2026-08-13T05:59:40.074744Z","submitted_at":"2023-10-02T04:29:40Z","title":"Enabling Language Models to Implicitly Learn Self-Improvement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00898","snapshot_observed_at":"2026-08-07T15:15:46.356346Z","title":"Enable language models to implicitly learn self-improvement from data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.356346Z"},"links":{"cited_paper":"/paper/2310.00898","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:b5dd3b38159a3abf758d4d73cddc8574adde68490d3bf9eee1e9e2a291c46b91","observation_id":"a4303cc5-e39a-460a-9445-18eeca19d7b1","resolution":{"observed_at":"2026-08-07T15:15:46.356346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.952782Z","title":"Mankowitz, Doina Precup, and Bilal Piot","venue":null,"work_id":"0374daaa-1151-4e98-af34-f6e4ed62acbf","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.361813Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:b7d98d8e2db3c1551a1a7354d1479fd294f30bf90192b30cc5fe3427cd4f6a7d","observation_id":"e723c431-617a-4fe5-b356-22ad22a55e18","resolution":{"observed_at":"2026-08-07T15:15:46.955912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.934729Z","title":"A minimaximalist approach to reinforcement learning from human feedback","venue":null,"work_id":"e3c17a93-8a3d-4e20-a4d1-a17ca2c3d4c3","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.370672Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:55f8f8db9883a8549daf238ed77ecafe21b7a570f680d12c613afaf5de97f9c0","observation_id":"9c33439b-9166-4d30-a133-cedb8c35ee48","resolution":{"observed_at":"2026-08-07T15:15:46.938379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07314","last_updated":"2024-11-12T08:24:10Z","snapshot_observed_at":"2026-08-13T04:21:00.187589Z","submitted_at":"2024-02-11T21:44:21Z","title":"Online Iterative Reinforcement Learning from Human Feedback with General Preference Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07314","snapshot_observed_at":"2026-08-07T15:15:46.376259Z","title":"A theoretical analysis of nash learning from human feedback under general kl-regularized preference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.376259Z"},"links":{"cited_paper":"/paper/2402.07314","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:d7db3a55b1fd8085a5e5a4e900352a8ea1387da7d03f13e4d4ca79335801381a","observation_id":"4a78435b-0abb-422c-95b9-2722526d7a4a","resolution":{"observed_at":"2026-08-07T15:15:46.376259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.924628Z","title":"Llm-blender: Ensembling large language models with pairwise ranking and generative fusion","venue":null,"work_id":"e78aa0b0-ec37-475e-8f48-b69a2928fd58","year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.381354Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:38180ed14d542a755df6cc74f353b919b56f1ab0c54d7ba9bdbd09e2d4b9a002","observation_id":"5b1df7d4-fdc7-47fe-b973-4912033fa0a3","resolution":{"observed_at":"2026-08-07T15:15:46.928505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.914763Z","title":"Liu, and Jialu Liu","venue":null,"work_id":"bb3bca5d-a6bb-4a38-a9b7-942c05dfcb4a","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.385221Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:6318c520f86c1bbf71e4070c87617a6b5e60ab2756690abf32fcb2b1eb224956","observation_id":"a75a1773-5596-48cf-9023-c22a84bf438f","resolution":{"observed_at":"2026-08-07T15:15:46.918214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:15:46.395903Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.395903Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:4ab5192a526759b341690348774f59f5c904e7e18814a2fa3cf66261bb09d152","observation_id":"f9c63e0b-c0fc-4171-ac2c-44ef9c55fbb5","resolution":{"observed_at":"2026-08-07T15:15:46.395903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.905433Z","title":"Helpsteer: Multi-attribute helpfulness dataset for steerlm","venue":null,"work_id":"12247fa9-ef02-41b7-baa5-aa80b4852a9a","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.400708Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:79278733f72021769dd9df47923ac93f6c6b807b1b82a5a0741db5a3a22d4c9e","observation_id":"8f425f02-a243-48fb-a7ec-28fd60e427b8","resolution":{"observed_at":"2026-08-07T15:15:46.908635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.893921Z","title":"Interpretable preferences via multi- objective reward modeling and mixture-of-experts","venue":null,"work_id":"6a2df398-ffdf-4c0c-ade3-e91a91599321","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.404216Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:faa390cf831fcddc0e9e04641d1d707ad9ae41216230158080eb6e8026bfca44","observation_id":"3b914cc7-38cc-4cf4-b2d8-134cc42f01bd","resolution":{"observed_at":"2026-08-07T15:15:46.898167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09583","last_updated":"2025-06-04T08:58:56Z","snapshot_observed_at":"2026-08-02T06:48:43.121988Z","submitted_at":"2023-08-18T14:23:21Z","title":"WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09583","snapshot_observed_at":"2026-08-07T15:15:46.407046Z","title":"Wizardmath: Empowering mathematical reasoning for large language models via reinforced evol-instruct","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.407046Z"},"links":{"cited_paper":"/paper/2308.09583","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:ba1ad24a07ebf457533dd14f5c68f6807d98ac822a0a076798c97ec0d211a85d","observation_id":"213384ad-82ee-49b3-a8c8-1caa91b66d9e","resolution":{"observed_at":"2026-08-07T15:15:46.407046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.410419Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.410419Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:638fd54f079582861f1015be9af2e7293a1fbc53f4e21707c054adbe352729a4","observation_id":"28d70d3c-5a72-4fb9-9e3d-950c56eeb9cc","resolution":{"observed_at":"2026-08-07T15:15:46.410419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11287","last_updated":"2025-02-11T05:41:41Z","snapshot_observed_at":"2026-08-12T22:23:04.429112Z","submitted_at":"2024-10-15T05:10:34Z","title":"Process Reward Model with Q-Value Rankings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11287","snapshot_observed_at":"2026-08-07T15:15:46.413629Z","title":"Process reward model with q-value rankings","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.413629Z"},"links":{"cited_paper":"/paper/2410.11287","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:ebee57f1a34180d2e6b9c67c737711acb0bf695e9da4df22213e17f39ab0b9a4","observation_id":"9e0e3dc3-97e1-4e1e-b2b4-f66c1636120f","resolution":{"observed_at":"2026-08-07T15:15:46.413629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.877094Z","title":"Glore: When, where, and how to improve LLM reasoning via global and local refinements","venue":null,"work_id":"df8cd8eb-388f-433b-965a-1f0e20b06fe6","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.416756Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:cbe9ba205658d7d0ccf192174865febf0f573bd5e832779bbb5c5f8857edb3de","observation_id":"fd190bca-f36f-4e72-8ff7-572712098a4d","resolution":{"observed_at":"2026-08-07T15:15:46.880460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.13085","last_updated":"2025-03-05T21:08:30Z","snapshot_observed_at":"2026-08-14T07:24:06.483860Z","submitted_at":"2022-09-27T00:32:44Z","title":"Defining and Characterizing Reward Hacking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.13085","snapshot_observed_at":"2026-08-07T15:15:46.420808Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.420808Z"},"links":{"cited_paper":"/paper/2209.13085","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:b64835677a9f6a5e088073f082a895c7e79ec2f6eac1caacf256b6599d191e4d","observation_id":"03ae14d6-fb94-4686-9f1a-5dde4f332355","resolution":{"observed_at":"2026-08-07T15:15:46.420808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.866551Z","title":"Arjona-Medina, Michael Gillhofer, Michael Widrich, Thomas Unterthiner, Johannes Brandstetter, and Sepp Hochreiter","venue":null,"work_id":"0a75f6f5-3261-437a-b7cb-2439e288354a","year":2019},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.423969Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:cb62fe353984493ad484376e4e3ac89a17d64217348d51b040e7fc2704260815","observation_id":"5d438329-22eb-47fd-abbe-59d554aa8208","resolution":{"observed_at":"2026-08-07T15:15:46.870280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.854528Z","title":"The effects of reward misspecification: Mapping and mitigating misaligned models","venue":null,"work_id":"dbd203ae-86a2-4048-8355-d37e98d6158f","year":2022},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.427020Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:3f5311889cde02c82b7b4d92557b95ca1ecd5b8d90ca776c279cad99c47a8748","observation_id":"8590a2c0-5e40-4575-bbc1-f14ab7ba74da","resolution":{"observed_at":"2026-08-07T15:15:46.858649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.843388Z","title":"Ball, Oleh Rybkin, Stephen Roberts, Tim Rocktäschel, and Edward Grefenstette","venue":null,"work_id":"bcd536c4-5e48-4952-8551-9ed0915552ac","year":2022},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.430298Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:46f591b406bb58a90c2a60e0483f74ccbd7c1016bfda3634f36febbdaaaf9dcd","observation_id":"54f46a91-c27d-4127-9d08-f25b3ce50ebb","resolution":{"observed_at":"2026-08-07T15:15:46.847364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.433343Z","title":"Correlated proxies: A new definition and improved mitigation for reward hacking, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.433343Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:9d5585582b4d5b72e4348c928beb39773bc9bbc75382fc8c08cf4ccc532a07c7","observation_id":"406f1a71-0f7a-4a3b-89d3-d2544b369b2a","resolution":{"observed_at":"2026-08-07T15:15:46.433343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.825063Z","title":"Inform: Mitigating reward hacking in RLHF via information-theoretic reward modeling","venue":null,"work_id":"0f26cf80-21c6-4b0a-9531-0c20d6cf7b20","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.436570Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:87267ea6082e0eadeece4c8fe1b54967dfb8a8212c86b55c5bd17dd73e04e8c6","observation_id":"cea58e23-3821-423b-96db-e25b04135b23","resolution":{"observed_at":"2026-08-07T15:15:46.829352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16475","last_updated":"2024-12-21T04:07:17Z","snapshot_observed_at":"2026-08-13T04:40:46.902476Z","submitted_at":"2024-12-21T04:07:17Z","title":"When Can Proxies Improve the Sample Complexity of Preference Learning?","version":1},"cited_work":{"arxiv_id":"2412.16475","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.16475","snapshot_observed_at":"2026-08-07T15:15:46.504789Z","title":"When Can Proxies Improve the Sample Complexity of Preference Learning?","venue":"cs.LG","work_id":"89a788e0-67f8-4480-8624-5233f8505813","year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.439486Z"},"links":{"cited_paper":"/paper/2412.16475","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:47ce8b04a4e1787fac2cef75dfa4849b9dbcf2456cb4ae0955e8942fff25d549","observation_id":"80e08e02-5c8f-49fd-9790-1f82d1c7f942","resolution":{"observed_at":"2026-08-07T15:15:46.510460Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07863","last_updated":"2024-11-12T11:18:43Z","snapshot_observed_at":"2026-08-15T18:13:42.319653Z","submitted_at":"2024-05-13T15:50:39Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07863","snapshot_observed_at":"2026-08-07T15:15:46.442619Z","title":"Rlhf workflow: From reward modeling to online rlhf","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.442619Z"},"links":{"cited_paper":"/paper/2405.07863","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:513785eefe4e0ae2795fc691a130034924d506e75d4f4ce25d464389e5b0a598","observation_id":"d803e9ca-2919-40ff-b1af-1d9199def227","resolution":{"observed_at":"2026-08-07T15:15:46.442619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.446051Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.446051Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:6e5b24993034df9f55c4888c6478e4ecdf91f5fa7c682d6e55843de7166e2017","observation_id":"be2fa502-7c37-4c8e-8f45-2e9ed6e3baf4","resolution":{"observed_at":"2026-08-07T15:15:46.446051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.805166Z","title":"Patterson, Joseph Gonzalez, Urs Hölzle, Quoc V","venue":null,"work_id":"737ab87d-841b-4da7-b36f-b23d9f9f70e0","year":2022},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.448967Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:bc2901a5c8fbf66f4b53e297927a645beeb4b54aebcb26c24b3280a6e79b91a6","observation_id":"4e11cece-30f0-48d4-9926-ead2d5b0d7e2","resolution":{"observed_at":"2026-08-07T15:15:46.809151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-08-12T12:08:23.520312Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-07T15:15:46.451629Z","title":"Openrlhf: An easy-to-use, scalable and high-performance rlhf framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.451629Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:54e67867effbca8f4eeaae127608a29a125c9390329b52952fa0e1a9161d5991","observation_id":"17ab31b6-f920-40fa-8e10-4b4deff297ea","resolution":{"observed_at":"2026-08-07T15:15:46.451629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.455296Z","title":"Iterative preference learning from human feedback: Bridging theory and practice for rlhf under kl-constraint, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.455296Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:5f2a10fc9e87b6aaa64fb8155161ca1e52c67b0d6bdd0a32270f814f13b3dc55","observation_id":"dc602100-b4fc-47c2-9193-c4e43c8c19b9","resolution":{"observed_at":"2026-08-07T15:15:46.455296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.458257Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.458257Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:744e78b4bca378e6e23e13892aec47a2276c7aee15872b00d0b2ab72ff220fe5","observation_id":"75172685-d121-4f34-a808-f78df1158f0f","resolution":{"observed_at":"2026-08-07T15:15:46.458257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.462329Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.462329Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:e85ec74f69f14e226cb075a6a3ccde283263ea78b1f912f5ec84c4d2d16e6a50","observation_id":"b6032cc0-7331-424c-9e6d-7ad104a6d1c8","resolution":{"observed_at":"2026-08-07T15:15:46.462329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.769602Z","title":"Understanding dataset difficulty with V-usable information","venue":null,"work_id":"9a8ac17a-1697-41b5-98a4-0e6249ea9ab1","year":2022},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.465735Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:e9ace4c9d256145d58b7592faf814bda9e5d3c319012743690ab9cbc8c9f3c65","observation_id":"d1aa69f0-b56e-4868-ab57-addb7a5ebd00","resolution":{"observed_at":"2026-08-07T15:15:46.773272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:15:46.364907Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:46.364907Z"},"links":{"citing_paper":"/paper/2505.17122"},"observation_digest":"sha256:41339ca6b4aff63116a5b22b457f03093b77ed2c2bfcd2f4903fea5adbdc8a4b","observation_id":"0f4afe28-e1cd-4cad-a579-c1e49c088abb","resolution":{"observed_at":"2026-08-07T15:15:46.364907Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17122","last_updated":"2025-05-21T17:59:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T23:38:32.695642Z","submitted_at":"2025-05-21T17:59:02Z","title":"Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":35,"verified_exact":2,"verified_fuzzy":21},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2505.17122."}