{"as_of":"2026-08-10T13:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d9847e154c1dacf70fe0cce14958de2e827fcff03f2147b818274d3ee25ba858","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:50:14.253577Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.23557/citation-record","integrity":"/paper/2505.23557/integrity","json":"/paper/2505.23557/citation-record.json","paper":"/paper/2505.23557"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.688614Z","title":"local” Assumptions 4.2 and 4.4 are satisfied. Given that Assumption 4.4 is based on “ignoring","venue":null,"work_id":"c3f0241e-c6cc-4cd2-80f9-86ff48f5dd25","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.971210Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:5c5ca561683423d3f43e9f14719df5a1503ed3c28874751260134f90e9b62b6f","observation_id":"07e8a8fd-4c78-48ab-8946-564c4430a597","resolution":{"observed_at":"2026-08-07T12:50:15.768250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.865038Z","title":"J., Rohatgi, D., Zhang, C., Simchowitz, M., Ash, J","venue":null,"work_id":"4c180383-7fa2-43b3-8f10-3bb88f82793b","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.085135Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:b1043612851baca00a4a09fef58ea87f3327b7ac547493fb9e762e60a5feb83a","observation_id":"f71d4177-68a3-4219-88b1-932075eb51c2","resolution":{"observed_at":"2026-08-07T12:50:15.950799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:13.409774Z","title":"S., and Bag- nell, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.409774Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:b5740c539d2ec4f6642132945efb704219333958d027fce2887496d9b52b8b8e","observation_id":"394fcf52-97d4-42ea-8a37-96cd55ca27e9","resolution":{"observed_at":"2026-08-07T12:50:13.409774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T12:50:13.880712Z","title":"M., Stiennon, N., Wu, J., Brown, T","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.880712Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:4be7e7326384e575bcfff6dfc59334a0bfd8d2adb08da3c9382a071a20820343","observation_id":"a485c698-e5b9-4dab-a966-6ad3f2d8e46d","resolution":{"observed_at":"2026-08-07T12:50:13.880712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.461825Z","title":"reversed","venue":null,"work_id":"75c9c174-0b4b-4aa7-8921-100b4bd183f7","year":2025},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:14.086477Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:dea4f3b57f16295389e9fe29a7b15517d471171884bad67a08ec1b96d1a8eeba","observation_id":"f1591904-80c7-4fd9-8aa8-92561bf2707c","resolution":{"observed_at":"2026-08-07T12:50:15.566421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.268468Z","title":"Let ε=θ−θ ⋆","venue":null,"work_id":"e8352e4c-e091-45ae-948c-66c9bed13637","year":2017},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:14.146385Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:98961c9fcc412a802fd6bb0fbeaf6fa1a31f412628dd4e9c75d7b7f90f4adce9","observation_id":"4ef90a22-24ef-4481-86a2-ddcc144b3c92","resolution":{"observed_at":"2026-08-07T12:50:15.345434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:15.109666Z","title":"spiky” along some directions. Due to those distant vertices, the center would become a worse estimator than DP, since the “average","venue":null,"work_id":"b8eb95fa-bf49-4f79-b8e8-ebbe8623e256","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:14.253577Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:22b30ae7c86071667ae76f57786517da45b26c11c85fe61ec18459fde2ebc30d","observation_id":"f77b728b-d1a5-4650-9678-e7ca3ab4fada","resolution":{"observed_at":"2026-08-07T12:50:15.176348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:50:12.536863Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":1946,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.536863Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:60452c9513f4fcbaf0ac641c15641d84c1f9c4088411c537f1e6e29d6e2b6633","observation_id":"27ac98e9-f633-453c-9266-84c860a289f5","resolution":{"observed_at":"2026-08-07T12:50:12.536863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:12.815217Z","title":"Gorbatovski, A., Shaposhnikov, B., Sinii, V ., Malakhov, A., and Gavrilov, D","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":1952,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.815217Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:dd1e16f9d0b507352b21ac8280591738ff63f3c9bd95df135884dda89d08280c","observation_id":"d7c51675-d737-444d-981c-bbb66bcb436a","resolution":{"observed_at":"2026-08-07T12:50:12.815217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02612","last_updated":"2024-06-19T17:08:13Z","snapshot_observed_at":"2026-07-06T18:09:46.934515Z","submitted_at":"2024-05-04T08:43:45Z","title":"Learning Linear Utility Functions From Pairwise Comparison Queries","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02612","snapshot_observed_at":"2026-08-07T12:50:12.685227Z","title":"Ge, L., Juba, B., and V orobeychik, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.685227Z"},"links":{"cited_paper":"/paper/2405.02612","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:7e219e3d6fefcbdc696a4000e7d2b06adf790fe36c3502017a45c157bf37870c","observation_id":"8c545c67-5315-4b54-baca-17bdbba71ada","resolution":{"observed_at":"2026-08-07T12:50:12.685227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18282","last_updated":"2025-06-03T20:18:22Z","snapshot_observed_at":"2026-08-10T12:39:44.668328Z","submitted_at":"2025-01-30T11:41:13Z","title":"Leveraging Sparsity for Sample-Efficient Preference Learning: A Theoretical Perspective","version":4},"cited_work":{"arxiv_id":"2501.18282","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.18282","snapshot_observed_at":"2026-08-07T12:50:14.379589Z","title":"Leveraging Sparsity for Sample-Efficient Preference Learning: A Theoretical Perspective","venue":"cs.LG","work_id":"29536d14-9a9d-4979-9e07-8c1b9f8c6735","year":2025},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.817113Z"},"links":{"cited_paper":"/paper/2501.18282","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:7d0b349c84d73ecbcdd7c6812bd505b973ffa1865d6a27e4edd3395927ad2c58","observation_id":"fce61919-11eb-4a8d-a430-2dc5df42afa5","resolution":{"observed_at":"2026-08-07T12:50:14.442149Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:16.051450Z","title":"Orpo: Monolithic prefer- ence optimization without reference model","venue":null,"work_id":"30865d36-505f-4045-b398-834e73364c61","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.968757Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:498cc89240fdc9b2798cbd02cbefd1b8d03311eee8621e6d7749fa3983239f5a","observation_id":"74163a85-31a4-4e68-bac6-0f4dbfa3ff99","resolution":{"observed_at":"2026-08-07T12:50:16.164514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:12.391013Z","title":"URL https://epubs.siam.org/ doi/10.1137/141000671","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.391013Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:51c4eeb18c40c5d1a88a2fedebac93c4c87da9f2851a2ad4755fce13ed762be5","observation_id":"d7e98598-0844-42c3-ac38-0568f46db10c","resolution":{"observed_at":"2026-08-07T12:50:12.391013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10571","last_updated":"2024-09-14T11:39:13Z","snapshot_observed_at":"2026-07-06T19:16:14.638445Z","submitted_at":"2024-09-14T11:39:13Z","title":"ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood","version":1},"cited_work":{"arxiv_id":"2409.10571","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.10571","snapshot_observed_at":"2026-08-07T12:50:14.533308Z","title":"ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood","venue":"cs.LG","work_id":"9bbeed96-22ce-440d-9f72-4c223c4a214c","year":2024},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.733014Z"},"links":{"cited_paper":"/paper/2409.10571","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:a3631c907a29358d28b952ce36f6c1fd6e5852a531826c84dc0856e8ec0b4803","observation_id":"eb7675bc-1ff7-49e9-a7d8-6e4ebaff4ace","resolution":{"observed_at":"2026-08-07T12:50:14.583926Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:13.180091Z","title":"URL http://dx.doi.org/10.1145/3372885","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.180091Z"},"links":{"citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:4f83c8088a0a2469f6acc3decdbcf39cc977feee0f090104fd665b2b35c0716c","observation_id":"b0645b99-4a94-49f4-b1c1-9edbe5dad173","resolution":{"observed_at":"2026-08-07T12:50:13.180091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:50:13.633918Z","title":"Touvron, H., Martin, L., Stone, K., Albert, P., Almahairi, A., Babaei, Y ., Bashlykov, N., Batra, S., Bhargava, P., Bhosale, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.633918Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:2fbbdc032ca13ba66e6f6b7505ebd3fdbdd66a6f1711e1bfb3fc4174368b40ba","observation_id":"0bdb7b64-d646-437e-922b-a90d85e046aa","resolution":{"observed_at":"2026-08-07T12:50:13.633918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:50:13.319522Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.319522Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:20215d4a485b0b111af25257326392754f6280901117c445b194338867cfaa02","observation_id":"6beabf82-1c55-4fe9-8b17-8e6e0773cab5","resolution":{"observed_at":"2026-08-07T12:50:13.319522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T12:50:12.309997Z","title":"Constitutional ai: Harmlessness from ai feedback.arXiv preprint arXiv:2212.08073,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:12.309997Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:93962960546f0f3d4d68ae53c47b7fc606ad1b2b76515f7d283f8def7dc03a93","observation_id":"c10156df-c108-4b20-813e-4d25d0cbdaf0","resolution":{"observed_at":"2026-08-07T12:50:12.309997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05749","last_updated":"2024-05-28T23:25:15Z","snapshot_observed_at":"2026-08-10T05:17:53.947932Z","submitted_at":"2024-02-08T15:33:09Z","title":"Generalized Preference Optimization: A Unified Approach to Offline Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05749","snapshot_observed_at":"2026-08-07T12:50:13.529395Z","title":"D., Zheng, Z., Calandriello, D., Munos, R., Rowland, M., Richemond, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:13.529395Z"},"links":{"cited_paper":"/paper/2402.05749","citing_paper":"/paper/2505.23557"},"observation_digest":"sha256:db648e2485c4be4c6eac22410895d3a5615080dfb8ecc6cb01ae2cf3a249f4a7","observation_id":"ba1dbab5-2129-42cb-9ed6-8fe0fa6d62b7","resolution":{"observed_at":"2026-08-07T12:50:13.529395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23557","last_updated":"2025-05-29T15:33:43Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-10T12:40:02.934627Z","submitted_at":"2025-05-29T15:33:43Z","title":"Learning Parametric Distributions from Samples and Preferences"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":6},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2505.23557."}