{"as_of":"2026-08-19T13:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5b74affb9b0115e13061f30e0f0c670b5a03a36c85d9cd32b2a42c5137e6dfa2","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:54:02.564230Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T18:18:46.456767Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T18:23:50.834907Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"cited_work":{"arxiv_id":"2411.14871","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.14871","snapshot_observed_at":"2026-06-29T18:23:50.834907Z","title":"Prioritize denois- ing steps on diffusion model preference alignment via explicit denoised distribution estimation.arXiv preprint arXiv:2411.14871","venue":null,"work_id":"de15bdee-61a4-4a62-acdb-b22e6f2bcb7e","year":2024},"citing_paper":{"arxiv_id":"2605.09433","last_updated":"2026-05-10T09:13:40Z","snapshot_observed_at":"2026-08-13T13:45:00.284853Z","submitted_at":"2026-05-10T09:13:40Z","title":"Offline Preference Optimization for Rectified Flow with Noise-Tracked Pairs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T02:10:27.595446Z"},"links":{"cited_paper":"/paper/2411.14871","citing_paper":"/paper/2605.09433"},"observation_digest":"sha256:2fa372ffadc29a7e02cdfc54fac4781195a05fe00c37e837a8ae471f8a7661d9","observation_id":"129b5c4a-d693-4153-bdd2-f3a363f0aa61","resolution":{"observed_at":"2026-05-12T02:11:15.491627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"cited_work":{"arxiv_id":"2411.14871","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.14871","snapshot_observed_at":"2026-06-29T18:23:50.834907Z","title":"Prioritize denois- ing steps on diffusion model preference alignment via explicit denoised distribution estimation.arXiv preprint arXiv:2411.14871","venue":null,"work_id":"de15bdee-61a4-4a62-acdb-b22e6f2bcb7e","year":2024},"citing_paper":{"arxiv_id":"2605.27736","last_updated":"2026-05-26T22:20:51Z","snapshot_observed_at":"2026-08-02T16:25:15.479630Z","submitted_at":"2026-05-26T22:20:51Z","title":"Explicit Critic Guidance for Aligning Diffusion Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-29T18:18:46.456767Z"},"links":{"cited_paper":"/paper/2411.14871","citing_paper":"/paper/2605.27736"},"observation_digest":"sha256:6d4adc0b2083b8afac7566e55ea2523f0fbe268b340f4cb334d73d57c9c726e4","observation_id":"794a93ca-94ab-4678-b4fc-017d4e8955e6","resolution":{"observed_at":"2026-06-29T18:23:50.836500Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.14871/citation-record","integrity":"/paper/2411.14871/integrity","json":"/paper/2411.14871/citation-record.json","paper":"/paper/2411.14871"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.357366Z","title":"Direct preference optimization with an offset","venue":null,"work_id":"f7b7e8d8-5459-4287-a385-4c0a33035016","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.328719Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d8c0bcd88ae84a1d455c6777f5970955ed61d912b5addcff878ab339827fbc00","observation_id":"22725af1-acb7-4d2d-a6fd-c89201d470d2","resolution":{"observed_at":"2026-08-12T14:54:03.361116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.345370Z","title":"A general theoretical paradigm to understand learning from human prefer- ences","venue":null,"work_id":"52388a0c-0062-4583-b866-5849b65527c3","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.333011Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:61d5fca3670aa5e32b7d0aab37fc9b6d83bc35d6b1cfa8d99d9c30a4353bed54","observation_id":"758c0570-25e7-4605-b00b-594ec78088a3","resolution":{"observed_at":"2026-08-12T14:54:03.349920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17956","last_updated":"2025-05-25T15:23:18Z","snapshot_observed_at":"2026-08-16T13:48:43.532292Z","submitted_at":"2024-05-28T08:35:48Z","title":"Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17956","snapshot_observed_at":"2026-08-12T14:54:02.336960Z","title":"Hybrid preference optimization: Augmenting di- rect preference optimization with auxiliary objectives","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.336960Z"},"links":{"cited_paper":"/paper/2405.17956","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:a469e399165e97d4c6f6d91d5f16a86b6e426b0dad41b0df2e04290896a72f3d","observation_id":"782e039f-5c30-418e-8e6a-d57dbd4ec1ab","resolution":{"observed_at":"2026-08-12T14:54:02.336960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.334050Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":"e3b407b9-4a76-4df6-a3d1-0905e54bf94a","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.341510Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:66daeaa23ace7f64118bb4a307999d552ff600a9382ee451e85654657f12ada4","observation_id":"2b999349-b618-4dcf-aa84-00c42f6e70ad","resolution":{"observed_at":"2026-08-12T14:54:03.337692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.323766Z","title":"Align your latents: High-resolution video syn- thesis with latent diffusion models","venue":null,"work_id":"d458be26-7741-4c34-a6c9-686492d18f0e","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.345351Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:19d0f92eb9a7f7093ac3c7f4a9997d1e7ba928442a6f22959377f821e85526ec","observation_id":"a2d26ae7-6a78-43e0-9af1-c9c96ac649ba","resolution":{"observed_at":"2026-08-12T14:54:03.327456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.313313Z","title":"Kwok, Ping Luo, Huchuan Lu, and Zhenguo Li","venue":null,"work_id":"b45999fd-c946-4cdb-b6ff-73bd4acdedbf","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.349389Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:37b8a635abdf4c9e1d6746b663ea5d0b51c1e7a68e6f121a24326960ac3ea531","observation_id":"b024a3bf-2de2-4a2f-a352-6998ee14252e","resolution":{"observed_at":"2026-08-12T14:54:03.316856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.303160Z","title":"Self-play fine-tuning converts weak language models to strong language models","venue":null,"work_id":"8b92cc44-5d00-47d7-9257-ff5d0ea7ac61","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.353167Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:3c6b0b1e11da953a88e9ffddf837d7797c6bbaf6f156acd40f5353c999d8f0dd","observation_id":"977027d9-7eb1-4016-957b-b518703b7e01","resolution":{"observed_at":"2026-08-12T14:54:03.306807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.292048Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":"8eec6b2e-4092-4d6e-8f72-4bdd9ab182b4","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.357155Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:68bb25aff97c2f154ec432795c8a693270b2c7eb98c03256944d88fafcc03b25","observation_id":"bac95065-43eb-497d-8324-21ca538c3fcd","resolution":{"observed_at":"2026-08-12T14:54:03.296275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.281113Z","title":"Diffu- sion models beat gans on image synthesis","venue":null,"work_id":"9ec30fe5-271a-4284-b21d-44e13ffc31fb","year":2021},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.360853Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:9e326ef6681a8da2865294e551d6d13bb874ec0c5e0a96c60c7b164ff426751c","observation_id":"0ec493cb-2a78-4ba7-b681-a34471d88dec","resolution":{"observed_at":"2026-08-12T14:54:03.284796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.269856Z","title":"Scaling rectified flow transformers for high- resolution image synthesis","venue":null,"work_id":"2650e26a-a531-497a-af97-82fc1ce98c29","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.364610Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:cfd24fff51e6fcd71a79c40c0278d6433438e95b3689fedebf75f39e00f80071","observation_id":"f928534c-1c43-4ec2-864a-e6c50512e18e","resolution":{"observed_at":"2026-08-12T14:54:03.273670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-08-17T15:29:47.883677Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-12T14:54:02.368175Z","title":"KTO: model align- ment as prospect theoretic optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.368175Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:97300021c3f0b8f09d3fd5f49dfd430d7cbfca4198db69e7b5bcc0efccaa9076","observation_id":"36ffea07-be43-4871-96e4-e8a918ea1218","resolution":{"observed_at":"2026-08-12T14:54:02.368175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.257456Z","title":"DPOK: reinforcement learning for fine-tuning text-to-image diffusion models","venue":null,"work_id":"6da004c1-47fa-46b4-ae1b-ce1401d1c593","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.372209Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:80078275c34be2da36b32c7a446f29d914f6b40e488a041d01ca9a2cf7046da1","observation_id":"fbf4ed89-55b6-4bb7-ae79-6042745a5556","resolution":{"observed_at":"2026-08-12T14:54:03.262275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.246729Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":"49f96d01-2ed7-4190-b6e6-d8a1136a36cd","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.375831Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:5334197a455e1db8ac2b6c5974b64ed84e2fbff190ce2f09bf30bd8f20ffdf8c","observation_id":"4dd6b9a1-9c3f-448c-b2d1-a494f4c22d5f","resolution":{"observed_at":"2026-08-12T14:54:03.250381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.234970Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"d294bca0-1ec0-4bc4-b98c-99173efcef0a","year":2018},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.379462Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:4efb43a6769be93175462ef86537be81cead12d2880024638c91d73e17d24b9a","observation_id":"f405a09f-a8b8-4f0c-b4f1-24aedc49ec4e","resolution":{"observed_at":"2026-08-12T14:54:03.239054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.220880Z","title":"Brandt, and Tomer Michaeli","venue":null,"work_id":"c6f1c3d5-4b10-463c-9007-23676779dfff","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.382998Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:b269fd5275662c51cf7eec8e18598805ba625ad0a3b92ec98d47c9f14cf43606","observation_id":"f5386393-9f77-45d0-a062-e91a442a7eaa","resolution":{"observed_at":"2026-08-12T14:54:03.225438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.208945Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"be094e1b-1edd-416c-8399-9fb72f33c9dc","year":2020},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.386341Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:5be805565b4984a65d1d79260ff26e0b84503b12f0d766162e9cc5fd7e6d43de","observation_id":"0fd283bb-8947-4ec0-a147-71c10288706d","resolution":{"observed_at":"2026-08-12T14:54:03.212698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.197434Z","title":"Estimation of non-normalized statis- tical models by score matching","venue":null,"work_id":"a16dae4c-0bee-4e25-9c4f-426ca666cd6b","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.389563Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:3d3ffe9a8d206d2506e5cd76c841dfb5f083653d616984e885c97a5764588b3c","observation_id":"7ed99fb3-f4b9-4cb6-b824-6b90756f9817","resolution":{"observed_at":"2026-08-12T14:54:03.201515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.186396Z","title":"Reward learning from human preferences and demonstrations in atari","venue":null,"work_id":"a6a68606-e05c-49b5-8f91-21f1712c946f","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.393106Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:c08ab97f70db64593bf7dddd3e2ef93cda8c9481207b9d559d4bcb87a89eaaee","observation_id":"056ea50f-2def-42a5-b416-ba63338c3fbf","resolution":{"observed_at":"2026-08-12T14:54:03.190321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.175048Z","title":"Ryzhakov, Andrei Chertkov, and Ivan V","venue":null,"work_id":"bf34a595-d134-4beb-bcbd-579630dfb960","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.396691Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:6c4694c4a9ca938c3d15a51c10eb57036514051402de21e8c2194fa585993425","observation_id":"7cde6093-e2e3-4bba-999e-833d799616a2","resolution":{"observed_at":"2026-08-12T14:54:03.178944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.162918Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"79b93ed6-fdb7-4060-92d4-0e3c5c39f5af","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.400628Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:6a04108544412212c17573238332a46724ad7237767f1b416511c6741506b2a2","observation_id":"aecd68b4-bbf9-4011-8345-bf2be980306c","resolution":{"observed_at":"2026-08-12T14:54:03.167644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.151662Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"fcd7fb1d-6bb9-4a09-b3b9-b7b0e67349ba","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.404196Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:b01919ddcbbaca5536eb22a0c8887d025e3b5ddf19d38bd119ad2ef457351417","observation_id":"3832647f-04d5-48aa-aa2f-e45e5d773dd8","resolution":{"observed_at":"2026-08-12T14:54:03.155479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.140957Z","title":"Bradley Knox and Peter Stone","venue":null,"work_id":"cfa5c999-5fae-44b2-93cb-05b28f04de49","year":2009},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.408019Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:c8986653dc721be0de0c7854d621e35af40c8c226b21d27f1dfde7a26389ee70","observation_id":"b884d6d8-9432-4400-bca9-162639bd102b","resolution":{"observed_at":"2026-08-12T14:54:03.144654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.130097Z","title":"Dif- fusion models already have A semantic latent space","venue":null,"work_id":"b6ffd0f3-ae3d-483e-ab82-a0859628fbc0","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.411697Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d43b28c12a61ddc4d5da41f7c2d9707f7b0fcaa81607001924c79927047b5d43","observation_id":"590c7101-782e-441d-a9f4-6deb5e9fec30","resolution":{"observed_at":"2026-08-12T14:54:03.133590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04465","last_updated":"2024-10-11T19:43:11Z","snapshot_observed_at":"2026-08-16T14:03:12.919020Z","submitted_at":"2024-04-06T01:23:23Z","title":"Aligning Diffusion Models by Optimizing Human Utility","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04465","snapshot_observed_at":"2026-08-12T14:54:02.415254Z","title":"Aligning diffusion models by optimizing human utility","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.415254Z"},"links":{"cited_paper":"/paper/2404.04465","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d966557f47c7ac35d8c8ea2c826522b1908b8efefc138ef83f31b889a5893e2a","observation_id":"b436b6c6-7288-4fef-ba06-b6de3f4005e6","resolution":{"observed_at":"2026-08-12T14:54:02.415254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-16T13:45:25.207129Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-12T14:54:02.419272Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.419272Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:678258a66dc8e71886aab5823b9f99733d795e93e73b90da1bda16ac3edb8de7","observation_id":"c77e5e8a-10a2-4e8d-ad7e-01794de62aae","resolution":{"observed_at":"2026-08-12T14:54:02.419272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.120055Z","title":"Let’s verify step by step","venue":null,"work_id":"cab51ed1-799f-4cac-a8ea-a771e9c71162","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.423053Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:e811edce9947c075f08a67640cfa55eaccd2337ab10acbf8d47386c2682b95f2","observation_id":"7c60fc4c-8778-483e-bb79-a872fd7fb5c3","resolution":{"observed_at":"2026-08-12T14:54:03.123512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.108979Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":"561f88f1-9237-4c36-998b-c47fb81ac32f","year":2016},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.426479Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:0e17caf560509d588e6cb7c3612c6d3b11c590e61c90e9522477e352a31dc3cc","observation_id":"78f53924-dca5-4739-b167-d2751c617350","resolution":{"observed_at":"2026-08-12T14:54:03.113164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.430101Z","title":"Alignment of diffusion models: Fun- damentals, challenges, and future","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.430101Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:83837d46c1c949b57968e9afccabae4b4dc6e2ce4a4b1c05cf7bd10104f78b84","observation_id":"77126f30-7f1f-424c-8a20-51262ab6e257","resolution":{"observed_at":"2026-08-12T14:54:02.430101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.097837Z","title":"Interpretation and generalization of score matching","venue":null,"work_id":"632ddb77-125a-4885-b591-e83f581bdfed","year":2009},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.433620Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:75b68821dd9d71b2767ee608a6eca2042a3b562dcb56704de0661d86459ac89e","observation_id":"bb3b29a4-363d-41e5-a3be-f53fd5a16684","resolution":{"observed_at":"2026-08-12T14:54:03.101748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.085990Z","title":"Ho, Robert Tyler Loftin, Bei Peng, Guan Wang, David L","venue":null,"work_id":"5a64b624-d75c-4a67-95cb-16bb678852a2","year":2017},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.437239Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:1523857db0d26b695aaf5f8e54143c391c944ab25779f1d9a9121079d10c5bbe","observation_id":"e39b0d5b-9dfe-46f8-9c06-104af849cfbf","resolution":{"observed_at":"2026-08-12T14:54:03.090375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.074320Z","title":"Simpo: Simple preference optimization with a reference-free reward","venue":null,"work_id":"84de6106-89a4-4066-a866-06d969855a68","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.441028Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d6ac242a1a83683bbcea05e005ca329f6370192bba25bdd56649f330eef032b4","observation_id":"e95140c4-4e3a-4518-8ae4-c28102384ea7","resolution":{"observed_at":"2026-08-12T14:54:03.078511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-12T14:54:02.444437Z","title":"Riedmiller","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.444437Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:37c4a4af5c9b788da335dc926e682b5b8e61c730add6227d7ec1ab13b2ca2d40","observation_id":"200028e2-5bd6-4e26-bcfc-ac7eedcff526","resolution":{"observed_at":"2026-08-12T14:54:02.444437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.062568Z","title":"Lillicrap, Tim Harley, David Silver, and Koray Kavukcuoglu","venue":null,"work_id":"2b1351d3-27cd-4e43-8bdf-d2c5187745e6","year":2016},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.448722Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:3aa78ba71805eb2efdb9589c481acfbd1eb316d79fdabad17b7077d64cb9bbac","observation_id":"ca13e3af-9670-479c-9189-6df280cc26ba","resolution":{"observed_at":"2026-08-12T14:54:03.066456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.050309Z","title":null,"venue":null,"work_id":"6e62987b-aa5d-4810-a4db-a45a47ba5299","year":2022},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.452354Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:0c2ecb50cbb07d710602b6829f279219ea514e70d9daf4c2d123d8f0896d6fa7","observation_id":"45738fa3-cb80-498a-9e4b-6e39974ca1fc","resolution":{"observed_at":"2026-08-12T14:54:03.054846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-12T14:54:02.456141Z","title":"Sdxl: Improving latent diffu- sion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.456141Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:6d728a378b32ec9a6f30a5d987b37bd11280a47f960e89934deb5562fef7da86","observation_id":"26eb8468-259e-4d7e-9703-d63950bece0a","resolution":{"observed_at":"2026-08-12T14:54:02.456141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.037812Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"d8faa775-1270-4628-b0db-bc0f3594bec7","year":2021},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.460432Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:b5b60abce69ad009f84346dd3ee5db9523f07bc237f2944cb8c71fcbfa792124","observation_id":"cd834621-b559-4394-b718-9ad409ca307c","resolution":{"observed_at":"2026-08-12T14:54:03.042107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.026920Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":"aa2a28c6-07f2-4011-972f-9a32db466652","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.464075Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:e88a0833fc8fdade60aa87f95abee8ce0efd698b2fe567f476f942520debcfa9","observation_id":"c30638c4-523f-41f1-b562-b0ab06fb12a4","resolution":{"observed_at":"2026-08-12T14:54:03.030862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.015800Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"5e7c0baa-0b1c-4041-b399-a38471d41d84","year":2022},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.467621Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:68f21a2e5bc051cf4a9bca94a3731b7dfda0bd7a49db0b4c1a7b7a2fbecc1681","observation_id":"9087a192-90d2-47f3-8c34-8827eff92f0f","resolution":{"observed_at":"2026-08-12T14:54:03.019811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03715","last_updated":"2024-04-04T17:56:41Z","snapshot_observed_at":"2026-08-17T02:24:53.749690Z","submitted_at":"2024-04-04T17:56:41Z","title":"Direct Nash Optimization: Teaching Language Models to Self-Improve with General Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03715","snapshot_observed_at":"2026-08-12T14:54:02.471071Z","title":"Direct nash optimization: Teaching language models to self-improve with general preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.471071Z"},"links":{"cited_paper":"/paper/2404.03715","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:43baab69a40b6e76d9cc3682ff91bbde91991c02c108c6d81f0233664892abfb","observation_id":"62b9beb5-4704-4174-b168-8ce82ef453e4","resolution":{"observed_at":"2026-08-12T14:54:02.471071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:03.004209Z","title":"Jordan, and Philipp Moritz","venue":null,"work_id":"c38cffbd-44de-4408-8081-7f7b8e6d4103","year":2015},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.475762Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:a36895b58a77c7313e7728abb61dd062d18c4f3a66331c66b9542ada8047145e","observation_id":"e5f3d85d-3c8b-4930-b489-719eb29f2f50","resolution":{"observed_at":"2026-08-12T14:54:03.007942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T14:54:02.479171Z","title":"Proximal policy optimiza- tion algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.479171Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:484ba38aa0c1c869e63d33d5792a55737de11e5f1dc8b4ac00e0038714d6936a","observation_id":"ea3662ea-bf7e-4387-9349-092eefed81cc","resolution":{"observed_at":"2026-08-12T14:54:02.479171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.993649Z","title":"Denoising diffusion models on model-based latent space","venue":null,"work_id":"2ec023ea-7ca2-4bf9-b676-f7ad39ca2db3","year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.483369Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:5ebcaeefe31acf91f3280ab3e0d3201090af574d02ac5f56484b5e5d3c68dfec","observation_id":"65a1d783-c4c5-4063-be56-8316d973431f","resolution":{"observed_at":"2026-08-12T14:54:02.997501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.980791Z","title":"Riedmiller","venue":null,"work_id":"af54bfcc-780a-441e-827c-c9e8c7bdd513","year":2014},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.486970Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:a175ce35fa2e699f7548387c35e891e599be1fe941dcf7706597f183533be6cf","observation_id":"65bb36dc-fe03-4a92-b4c8-cc40f26a37e0","resolution":{"observed_at":"2026-08-12T14:54:02.985577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.967729Z","title":"Weiss, Niru Mah- eswaranathan, and Surya Ganguli","venue":null,"work_id":"b7782cc6-8db7-46a8-bac5-cb5bf2ce794e","year":2015},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.490776Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d778828081b1e247696d5cea95326161f58d5c89aaf1fa7be2c0b9effa3380d0","observation_id":"f3d2bf19-de5e-4fd2-bc05-c103e2f9413d","resolution":{"observed_at":"2026-08-12T14:54:02.974017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.957004Z","title":"Prefer- ence ranking optimization for human alignment","venue":null,"work_id":"4f2fee34-7d46-4a2a-a613-7969be4634d7","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.494331Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:2af020c49884786fbe15fafb84a672d10ee97c812c351c196255e53113425594","observation_id":"dbf00f3e-f92a-4071-b3ad-45c6f05b7845","resolution":{"observed_at":"2026-08-12T14:54:02.960541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.946360Z","title":"De- noising diffusion implicit models","venue":null,"work_id":"3b15be80-40f8-4494-85f9-f4dd28225782","year":2021},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.497907Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:56c683c9a3107b8982d9199300960b19d0e0b875924026af5af8752835690530","observation_id":"74007324-9572-4c4a-a723-9014230ea04b","resolution":{"observed_at":"2026-08-12T14:54:02.949774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.936403Z","title":"Kingma, Abhishek Kumar, Stefano Ermon, and Ben Poole","venue":null,"work_id":"281a1954-4b21-4425-b35f-32db9e029276","year":2021},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.501599Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:b7b02124283a8caa8dbc0eacee7757cf90096db18717c2d6aaee5f939967e541","observation_id":"699b4337-a8ff-4baf-a400-5005f27dd5da","resolution":{"observed_at":"2026-08-12T14:54:02.939942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.925867Z","title":"Ziegler, Ryan Lowe, Chelsea V oss, Alec Radford, Dario Amodei, and Paul F","venue":null,"work_id":"57e3638f-b3e0-43fe-8e42-c4f32f9bfd80","year":2020},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.505121Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:a1ff6344b3c02734badf5b177366cb874325334d766edc9983a42016f66f37b5","observation_id":"e71875a0-0ec2-4b2c-b1c2-4c31cca034d3","resolution":{"observed_at":"2026-08-12T14:54:02.929645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.915116Z","title":"Sutton and Andrew G","venue":null,"work_id":"9b6b6d8a-14c3-4ffa-94ef-681634983c63","year":1998},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.508614Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:5847b1cdb0ae9b3d0a6b0cb76b088f19acfd1c6402e8f7f8bfa573c9c5bbff9f","observation_id":"9f894b4a-0b23-46ff-80dc-3688956261a3","resolution":{"observed_at":"2026-08-12T14:54:02.918825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.904322Z","title":"A connection between score matching and denoising autoencoders","venue":null,"work_id":"07e66f93-7f2f-4048-8e2f-c448c0722556","year":2011},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.512300Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:838930c68a1b76528493b6753da0a083175e554afb4c81d39b76f1d9e118fdc4","observation_id":"b0ffe050-9b4a-4c6f-8e4d-36a5a2812329","resolution":{"observed_at":"2026-08-12T14:54:02.907950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.893693Z","title":"Diffusion model alignment using direct preference op- timization","venue":null,"work_id":"db5018b3-7d93-4b84-8018-b3fe0f03c825","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.516015Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:0bf723844188a595997929001dc242feaea8498e67cff7f24c93ee9fc52a6aff","observation_id":"00ec18d6-3d41-43a9-ba98-3860f67799ff","resolution":{"observed_at":"2026-08-12T14:54:02.897621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-08-16T15:13:42.128297Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-12T14:54:02.519982Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.519982Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:8f6dcd6aea76bac3273ea858798abe06f8eb747aeabc4432b864fd8d349f4c8c","observation_id":"43d4b163-c4ba-45ed-beb8-06a5d4369a6a","resolution":{"observed_at":"2026-08-12T14:54:02.519982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.882844Z","title":"Dueling network architectures for deep reinforcement learning","venue":null,"work_id":"6eb2103a-4166-41a3-979b-7edebc2be9d0","year":2016},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.523781Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:fe8c649258c797481346ca6815fecdeb5cb67205411277453e488e4e270ebba9","observation_id":"a8a6af0c-b7eb-4f3c-9282-bd5bd90e023e","resolution":{"observed_at":"2026-08-12T14:54:02.886959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.872162Z","title":"Waytowich, Vernon Lawh- ern, and Peter Stone","venue":null,"work_id":"fa6bb08e-c773-4f56-bbb2-01cc3ba7996f","year":2018},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.527351Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:d6b51be39f5b02c2bb121697cce7c35591dd02d79895621c56eaeedf6edc0f91","observation_id":"fae401ae-e706-462a-83c9-3e53b52aba3a","resolution":{"observed_at":"2026-08-12T14:54:02.875924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.861091Z","title":"β-dpo: Direct preference optimization with dynamic β","venue":null,"work_id":"3a0b2c37-0cbc-4271-88c5-ab2e90e028c1","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.531043Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:cb697966a731b1b46c31c9242853b47463a8671079280bfc97a2af15bf9b394c","observation_id":"17af7ddc-68cc-48ca-a6e1-43804bed4ab4","resolution":{"observed_at":"2026-08-12T14:54:02.864885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-14T02:46:25.655503Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-12T14:54:02.534776Z","title":"Human pref- erence score v2: A solid benchmark for evaluating human preferences of text-to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.534776Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:358e0a661dd8b6d82e233637f911f71b81f4ea92f4e9bbc5e5053fe6927323ba","observation_id":"ed101848-77b0-44db-a3fb-01f7ef36eb0c","resolution":{"observed_at":"2026-08-12T14:54:02.534776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.849916Z","title":"Using human feedback to fine-tune diffusion models without any reward model","venue":null,"work_id":"adfe4859-3ed2-4d11-aff2-9ae92c90fd58","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.538484Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:3cfc510fa493b80b0b82c57c818a2eca1dd8a30a8502785fb8fec9151a83cf9e","observation_id":"5cef9c92-4497-4018-9253-8d9bfb2eb68d","resolution":{"observed_at":"2026-08-12T14:54:02.853808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.837761Z","title":"Diffusion models: A comprehen- sive survey of methods and applications","venue":null,"work_id":"f6f86f15-5374-46f1-b59b-e9847637468f","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.541992Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:dadf5de19c69c890b1e4c314a02c83704086d4ce727502acd12c554af0388eb8","observation_id":"53cef9b3-aff9-4609-86b0-0d88016a0b12","resolution":{"observed_at":"2026-08-12T14:54:02.841657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.826500Z","title":"A dense reward view on aligning text-to-image diffusion with preference","venue":null,"work_id":"8b71f193-b3d9-47dc-af97-83fda606b44a","year":2024},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.545504Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:99dd77341b8e6ed0b09e45d6bdf776282c019fc0f4322a159982c0e74b988097","observation_id":"8b9fbbf3-1f98-450b-9fd6-2178a3f15a72","resolution":{"observed_at":"2026-08-12T14:54:02.830317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-16T15:41:15.724777Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-12T14:54:02.549137Z","title":"RRHF: rank re- sponses to align language models with human feedback without tears","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.549137Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:a3346e22670b8ff4858dd4bcb54243fddfd79307d3b6a1a95412439e44b481cb","observation_id":"c2b5b6be-1713-44b7-9968-af7c7e415bc3","resolution":{"observed_at":"2026-08-12T14:54:02.549137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-16T00:15:57.597094Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-12T14:54:02.552889Z","title":"Ziegler, Nisan Stiennon, Jeffrey Wu, Tom B","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.552889Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:ecfb5fb67c0b5750eecf889df1f33b1a2789877e83b6b1bbe9d065a55dc6f825","observation_id":"38561138-6703-4579-9d18-eb5170f7a1ef","resolution":{"observed_at":"2026-08-12T14:54:02.552889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.815421Z","title":"Derivation of the Loss Function Defined in Eq","venue":null,"work_id":"774cc2a0-b98a-44a9-8c18-aa8ad6acf5dd","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.556868Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:c22435f5d130e481c2ca37fb08eae0968b385de02c8e23a082458c86e5436466","observation_id":"22bceab4-0537-47e5-bb51-3cae2fefbeb1","resolution":{"observed_at":"2026-08-12T14:54:02.819504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.803292Z","title":null,"venue":null,"work_id":"d1986d98-da9b-4e2d-bf3f-5d5d6306be20","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.560578Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:1874f3040020f13fcb1a8b8add7020871f757ce8d1ce43bcd1d76462307e44e1","observation_id":"584f6e90-b1a3-4f74-a811-2ac38b14fd7e","resolution":{"observed_at":"2026-08-12T14:54:02.807475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:54:02.789679Z","title":"Implementation Details We employ a constant learning rate with a warm-up sched- ule, finalizing at 2.05 × 10−5","venue":null,"work_id":"631745c2-3097-4001-b719-ab218d613269","year":null},"citing_paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T14:54:02.564230Z"},"links":{"citing_paper":"/paper/2411.14871"},"observation_digest":"sha256:e24bada3e06216e9d618f8670aadd18e2397923b69c3e2f05b00b4cb6fae0320","observation_id":"edc19149-b908-4958-8d5d-9ec5f162aea6","resolution":{"observed_at":"2026-08-12T14:54:02.795707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.14871","last_updated":"2025-03-13T02:36:28Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T15:22:42.641737Z","submitted_at":"2024-11-22T11:45:33Z","title":"Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":49},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 2 inbound Pith citation observations for arXiv:2411.14871."}