{"as_of":"2026-08-14T11:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5996eedbb3caf1edd7dd2174726948b363b8d6aa7153fcaac399c8e5bbc2e978","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:33:15.002562Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.08466/citation-record","integrity":"/paper/2508.08466/integrity","json":"/paper/2508.08466/citation-record.json","paper":"/paper/2508.08466"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:33:13.661566Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:13.661566Z"},"links":{"citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:476b4afcc52aa70dd9b64312e5aad4c5dd9d370e65193cbadb000f513954c743","observation_id":"a1c8a340-b8c4-4479-85d6-65ecd3fdf3de","resolution":{"observed_at":"2026-08-05T21:33:13.661566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:33:13.717146Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:13.717146Z"},"links":{"citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:9d6720b4b706ca89230576bae3995e335c375fd8a4a0161b26189ccb8579519a","observation_id":"a4d42081-0833-4a1c-b5e2-a4f356c616a9","resolution":{"observed_at":"2026-08-05T21:33:13.717146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12036","last_updated":"2023-11-22T00:02:49Z","snapshot_observed_at":"2026-08-13T05:46:47.001229Z","submitted_at":"2023-10-18T15:21:28Z","title":"A General Theoretical Paradigm to Understand Learning from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12036","snapshot_observed_at":"2026-08-05T21:33:13.809159Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:13.809159Z"},"links":{"cited_paper":"/paper/2310.12036","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:dc3cb6d9f3ce5e404f5999093c122c23767b71343a8266e91e91c59935c48a7f","observation_id":"fec1937c-8fd6-4e10-b526-f01cd2d18c30","resolution":{"observed_at":"2026-08-05T21:33:13.809159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T21:33:13.895668Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:13.895668Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:2c89cd8b9ad3fb28d7652a9ca41dee9a4c20857e2f378715242d752cfebc944b","observation_id":"7a1e7560-c6e8-4f19-a690-fbd49563bdaf","resolution":{"observed_at":"2026-08-05T21:33:13.895668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06857","last_updated":"2026-08-03T10:27:28Z","snapshot_observed_at":"2026-08-14T02:07:06.135730Z","submitted_at":"2024-09-10T20:45:43Z","title":"What is the Role of Small Models in the LLM Era: A Survey","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06857","snapshot_observed_at":"2026-08-05T21:33:13.933222Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:13.933222Z"},"links":{"cited_paper":"/paper/2409.06857","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:53d11709a1247036c25c5a953335e4debec8d7764886d7028aa36b54c9074907","observation_id":"d3065ade-670d-4596-94af-13ed7bee8f6d","resolution":{"observed_at":"2026-08-05T21:33:13.933222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06266","last_updated":"2024-09-14T23:09:07Z","snapshot_observed_at":"2026-08-12T23:04:50.432150Z","submitted_at":"2024-08-12T16:24:51Z","title":"Anchored Preference Optimization and Contrastive Revisions: Addressing Underspecification in Alignment","version":5},"cited_work":{"arxiv_id":"2408.06266","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.06266","snapshot_observed_at":"2026-08-05T21:33:15.362510Z","title":"Anchored Preference Optimization and Contrastive Revisions: Addressing Underspecification in Alignment","venue":"cs.LG","work_id":"95b3966a-c804-4382-9087-e0a71c6ce4ac","year":2024},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.007798Z"},"links":{"cited_paper":"/paper/2408.06266","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:7ebd33aa08bca04885c35152730544ef18e0f07cfbbb950b51e7d73732a0aecf","observation_id":"9957bac6-a38d-431e-8935-3b7927d24df4","resolution":{"observed_at":"2026-08-05T21:33:15.409840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-05T21:33:14.093113Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.093113Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:f959d41c41d7acb3a2de513b39e08eacc43fac211024d79692473721e26fa6bd","observation_id":"a349f246-6048-441a-af15-2f7c2e04f7bb","resolution":{"observed_at":"2026-08-05T21:33:14.093113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00856","last_updated":"2024-06-05T08:15:12Z","snapshot_observed_at":"2026-08-13T04:28:58.806092Z","submitted_at":"2024-02-01T18:51:54Z","title":"Towards Efficient Exact Optimization of Language Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00856","snapshot_observed_at":"2026-08-05T21:33:14.147588Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.147588Z"},"links":{"cited_paper":"/paper/2402.00856","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:d2fc2da41a67a3a8991a4995df43c40133fe14719c35f98263d94feb26ee38bb","observation_id":"a96aa0da-8eff-4ea9-b056-c1e09d4268bd","resolution":{"observed_at":"2026-08-05T21:33:14.147588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:33:14.183442Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.183442Z"},"links":{"citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:d36c5ab72a661a0e8ebc51af3fc9e08a8649107b138ad86401d6e9f58420dd92","observation_id":"28e58887-3cd0-4674-a756-7ebe4a899221","resolution":{"observed_at":"2026-08-05T21:33:14.183442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:33:14.239825Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.239825Z"},"links":{"citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:a517abcb1cb3d085f256defe22a9fa95b28a83212302c5bda4407c5692415f1f","observation_id":"fc3d78eb-8f11-40c2-bd73-bd94f0ed84bf","resolution":{"observed_at":"2026-08-05T21:33:14.239825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05882","last_updated":"2024-06-09T18:41:05Z","snapshot_observed_at":"2026-08-13T10:47:08.487989Z","submitted_at":"2024-06-09T18:41:05Z","title":"Distributional Preference Alignment of LLMs via Optimal Transport","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05882","snapshot_observed_at":"2026-08-05T21:33:14.325390Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.325390Z"},"links":{"cited_paper":"/paper/2406.05882","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:229f5415288d7993f107f34068354aed9599dac6994402626011758f5771a2a7","observation_id":"92dc04f4-e126-4cce-8711-346323c799db","resolution":{"observed_at":"2026-08-05T21:33:14.325390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:33:15.559629Z","title":null,"venue":null,"work_id":"8688e903-5c95-405d-b08b-5d7d31b16bb8","year":2013},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.391997Z"},"links":{"citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:b62a673c36c9f25ecf1277fb57c260ac2122483f7e4c69c3718fb64d51bf2770","observation_id":"47d1bf11-542b-47d3-8d30-3bb7b62214e2","resolution":{"observed_at":"2026-08-05T21:33:15.644753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-05T21:33:14.507155Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.507155Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:c9424491cde5d2470ba4b3fd63806c8e44a2df3cbb51f587406a0373e8e2e323","observation_id":"0b776026-6ff1-4919-9074-7634ca861ecf","resolution":{"observed_at":"2026-08-05T21:33:14.507155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19159","last_updated":"2024-09-09T04:39:31Z","snapshot_observed_at":"2026-08-13T00:43:17.870166Z","submitted_at":"2024-03-28T06:03:47Z","title":"Disentangling Length from Quality in Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19159","snapshot_observed_at":"2026-08-05T21:33:14.576084Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.576084Z"},"links":{"cited_paper":"/paper/2403.19159","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:bacc148e41cf3aa7503c708f0482adb5a07ef6945878a9ce9c15c2d624364946","observation_id":"3cc6d8ee-4de4-4718-ae7a-cdf3005b8489","resolution":{"observed_at":"2026-08-05T21:33:14.576084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-05T21:33:14.639533Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.639533Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:cbdeffb08c273971f6b8bc592f411f87f36d3653228f2b8fea020372df05a2f1","observation_id":"2fc2dc83-5dfc-4a65-8c15-2dc86ed03009","resolution":{"observed_at":"2026-08-05T21:33:14.639533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:33:14.706971Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.706971Z"},"links":{"citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:611e205de4244d577f02bfdde33771b5266037edea5b72b99bca6ec129136055","observation_id":"a9a94c3e-2939-4782-921f-467cd972511c","resolution":{"observed_at":"2026-08-05T21:33:14.706971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16216","last_updated":"2026-05-16T18:30:31Z","snapshot_observed_at":"2026-08-12T16:47:35.127541Z","submitted_at":"2024-07-23T06:45:52Z","title":"Reinforcement Learning for LLM Post-Training: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16216","snapshot_observed_at":"2026-08-05T21:33:14.784455Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.784455Z"},"links":{"cited_paper":"/paper/2407.16216","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:158b2d81ca3a7f2aac9318f34b6b62b61ce923d205b443392965d1070bafbb05","observation_id":"e3f38a03-98a7-4fcc-8e31-0856c86913a3","resolution":{"observed_at":"2026-08-05T21:33:14.784455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10425","last_updated":"2023-05-17T17:57:10Z","snapshot_observed_at":"2026-08-13T11:40:02.795309Z","submitted_at":"2023-05-17T17:57:10Z","title":"SLiC-HF: Sequence Likelihood Calibration with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10425","snapshot_observed_at":"2026-08-05T21:33:14.871864Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.871864Z"},"links":{"cited_paper":"/paper/2305.10425","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:922c442696848bcce71e5b37ce2bee96efd0d61789f497e3b004043bd881bcab","observation_id":"5fd91298-c1f0-4ab7-ae4c-bcc8c72fe381","resolution":{"observed_at":"2026-08-05T21:33:14.871864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-05T21:33:14.923297Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:14.923297Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:2ea482bf7ab74b23423e77d12ea7367fa7c284850ac9f1c22255550f664b198f","observation_id":"786d5b9f-dc2f-4472-8ab3-ac935a616e90","resolution":{"observed_at":"2026-08-05T21:33:14.923297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11206","last_updated":"2023-05-18T17:45:22Z","snapshot_observed_at":"2026-08-08T19:18:06.171048Z","submitted_at":"2023-05-18T17:45:22Z","title":"LIMA: Less Is More for Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11206","snapshot_observed_at":"2026-08-05T21:33:15.002562Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T21:33:15.002562Z"},"links":{"cited_paper":"/paper/2305.11206","citing_paper":"/paper/2508.08466"},"observation_digest":"sha256:b9ad34841c67ec79b53e135cc152a081be97d26e38ffbcd20ba4d29628c08243","observation_id":"96741aac-5abd-42cd-a100-32adcd6410b9","resolution":{"observed_at":"2026-08-05T21:33:15.002562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.08466","last_updated":"2025-08-11T20:53:37Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T06:41:24.244484Z","submitted_at":"2025-08-11T20:53:37Z","title":"Enhancing Small LLM Alignment through Margin-Based Objective Modifications under Resource Constraints"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2508.08466."}