{"as_of":"2026-08-19T13:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aee5656b1c393d97d2c34512454e062c5c5dae49af596acc5db89fa8f49ed246","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T19:48:17.049547Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:34:44.686328Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T00:23:55.444823Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"cited_work":{"arxiv_id":"2605.15855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15855","snapshot_observed_at":"2026-08-05T00:23:55.444823Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","venue":"cs.CV","work_id":"4060f788-ddc2-43e3-bee3-c62797f89e15","year":2026},"citing_paper":{"arxiv_id":"2608.00765","last_updated":"2026-08-01T16:59:49Z","snapshot_observed_at":"2026-08-14T12:06:05.541264Z","submitted_at":"2026-08-01T16:59:49Z","title":"RAGOCR: Optical Compression of Retrieval-Augmented Text via Visual Representation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T00:23:54.855176Z"},"links":{"cited_paper":"/paper/2605.15855","citing_paper":"/paper/2608.00765"},"observation_digest":"sha256:5043b1c782ab329ebc48593156b6606df47c2a03f9c4ab52b71d32de74989476","observation_id":"800e6608-2c88-48a3-80f0-49efb6a095a1","resolution":{"observed_at":"2026-08-05T00:23:55.517186Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15855","snapshot_observed_at":"2026-08-10T21:10:19.884241Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06768","last_updated":"2026-08-07T03:41:58Z","snapshot_observed_at":"2026-08-17T03:32:13.545113Z","submitted_at":"2026-08-07T03:41:58Z","title":"Explore or Converge? Stage-Guided Per-Step Optimization for Diffusion Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T21:10:19.884241Z"},"links":{"cited_paper":"/paper/2605.15855","citing_paper":"/paper/2608.06768"},"observation_digest":"sha256:049099c902e0ed9e14420b149d677971b076802138270810e1ab8d769201c4f5","observation_id":"b303e609-b644-420d-8275-3eb5c8c5c215","resolution":{"observed_at":"2026-08-10T21:10:19.884241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15855","snapshot_observed_at":"2026-08-15T14:34:44.686328Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06794","last_updated":"2026-08-07T04:35:26Z","snapshot_observed_at":"2026-08-19T02:19:45.975376Z","submitted_at":"2026-08-07T04:35:26Z","title":"PAST: Prompt-Adaptive Sampling Termination for Efficient Diffusion Model","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T14:34:44.686328Z"},"links":{"cited_paper":"/paper/2605.15855","citing_paper":"/paper/2608.06794"},"observation_digest":"sha256:7ea0eab05422e94e014b194edb1ac8fde4c4f07c7b1d4eee7891d67ef7faeb42","observation_id":"deabb4af-042c-4d5f-be6f-48b1b3f49ed3","resolution":{"observed_at":"2026-08-15T14:34:44.686328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15855","snapshot_observed_at":"2026-08-11T19:27:32.280009Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09322","last_updated":"2026-08-10T09:02:13Z","snapshot_observed_at":"2026-08-19T10:43:20.682873Z","submitted_at":"2026-08-10T09:02:13Z","title":"Diffusion Image Editing via Asynchronous Token Decoding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T19:27:32.280009Z"},"links":{"cited_paper":"/paper/2605.15855","citing_paper":"/paper/2608.09322"},"observation_digest":"sha256:8844ea8fb288482d9ded500e1897f97c722ce4476d0e23de8af06dad7ac6db85","observation_id":"ef9ea5d0-b9ea-4b21-b32f-8d6691654e0b","resolution":{"observed_at":"2026-08-11T19:27:32.280009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.15855/citation-record","integrity":"/paper/2605.15855/integrity","json":"/paper/2605.15855/citation-record.json","paper":"/paper/2605.15855"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2305.13301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-07-08T19:25:32.506868Z","title":"Training Diffusion Models with Reinforcement Learning","venue":"cs.LG","work_id":"67684dda-3930-452a-b91a-36cbb8e2e219","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:b222959955edea1df8686e74cb2b35a17dc300aa06d22a972c77bb29cd0306a9","observation_id":"5bcb7de9-18ad-47d6-a362-0833bbd1c3e4","resolution":{"observed_at":"2026-05-20T19:48:57.308257Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A sur- vey on generative diffusion models.IEEE transactions on knowledge and data engineering, 36(7):2814–2830","venue":null,"work_id":"6c044453-8740-4492-970b-65087b312318","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:24f0c0c88bed1fd33e920ad18b18ac0dd558c9a9f177cd555d64f6a75202fdcb","observation_id":"ccfbb829-fc36-466e-acac-6930ea490396","resolution":{"observed_at":"2026-05-20T19:48:57.842876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07771","last_updated":"2024-04-11T14:07:25Z","snapshot_observed_at":"2026-08-19T12:28:19.175972Z","submitted_at":"2024-04-11T14:07:25Z","title":"An Overview of Diffusion Models: Applications, Guided Generation, Statistical Rates and Optimization","version":1},"cited_work":{"arxiv_id":"2404.07771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.07771","snapshot_observed_at":"2026-07-03T07:37:45.361675Z","title":"arXiv preprint arXiv:2404.07771 , year=","venue":null,"work_id":"0f9d887c-c591-4ae1-8d5e-5f4b652b0fa6","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2404.07771","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:36d8098103e9b3bf45306e1bb56c346d7e9ed6150bd87e97bdb959bf29840d4c","observation_id":"1cd3e7a2-3dc1-4e11-b13c-2c4d5a69fbd2","resolution":{"observed_at":"2026-05-20T19:48:57.302386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dif- fusiondet: Diffusion model for object detection","venue":null,"work_id":"2aaacce4-2116-4276-85ef-7eba2a79e982","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:4f38303a11c13e060b6c7b7d4ee327004450ad2187f0c92e71e508e7a10fbad5","observation_id":"f4680a21-ac6f-434d-bdbf-2c55ae1100dd","resolution":{"observed_at":"2026-05-20T19:48:57.841045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion models in vision: A survey","venue":null,"work_id":"b9422494-f8eb-4488-ac83-f61c02dda518","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:f3095d5bc5088776696bb9797c2794a4b18794d814b0b82fdf4f24c3673ca3d5","observation_id":"bd2739b0-60cc-4a61-b68e-89f31175bda5","resolution":{"observed_at":"2026-05-20T19:48:57.839134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09244","last_updated":"2024-08-16T23:59:29Z","snapshot_observed_at":"2026-08-16T14:34:38.657827Z","submitted_at":"2023-12-14T18:59:04Z","title":"Helping or Herding? Reward Model Ensembles Mitigate but do not Eliminate Reward Hacking","version":3},"cited_work":{"arxiv_id":"2312.09244","doi":"10.48550/arxiv.2312.09244","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09244","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"J., Fisch, A., Heller, K., Pfohl, S., Ramachandran, D., Shaw, P., and Berant, J","venue":"arXiv (Cornell University)","work_id":"0d3df61b-eeb7-4a01-98a5-de379e1ac583","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2312.09244","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:1226896634d4931a9f87d41689f1ebab962b0024c310ede2463ab35b470b3bc7","observation_id":"e39bdd7b-6892-43cb-a10e-85be05c618c2","resolution":{"observed_at":"2026-05-20T19:48:57.332773Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:20.318631+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:20.318631+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dpok: Reinforcement learning for fine-tuning text-to-image diffu- sion models.Advances in Neural Information Processing Systems, 36:79858–79885","venue":null,"work_id":"61583724-76b6-42cf-a614-b4510aad7979","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:13667de5073296c692074d95104ebac31a740f7add25b9a039f2878c7eef5dec","observation_id":"cc18749b-a09b-4589-be41-c605af67c372","resolution":{"observed_at":"2026-05-20T19:48:57.837363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Re- inforcement learning for fine-tuning text-to-image diffusion models.Advances in Neural Information Processing Sys- tems, 36","venue":null,"work_id":"76d112b5-4e92-4c34-8d52-e81ace22e370","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:a376ebc752d2639799d3155de027525ecac245ff2cce2ec48ec992be6d96603c","observation_id":"135ba8d6-484a-43f4-873e-e5abd472cc61","resolution":{"observed_at":"2026-05-20T19:48:57.835544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning for generative ai: State of the art, opportunities and open research challenges.Journal of Artificial Intelligence Research, 79:417–446","venue":null,"work_id":"fbc6b8df-2564-49eb-8204-1db4aa7d7fa8","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:9392709dfd7f1e27ac2635f112612c1658400d135867e35c8ef882ba0ec6a200","observation_id":"2e0a1158-f96f-4f29-8c63-2cc891fbc0e3","resolution":{"observed_at":"2026-05-20T19:48:57.833747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Re- flective policy optimization.International Conference on Machine Learning","venue":null,"work_id":"06e014d6-0af1-48ec-971d-f303323c7120","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:ca532750659bd8c2a423b65b23453b15159eece8a0c9d078ac9f2cb4b07f5841","observation_id":"2545ebc2-28a1-4326-b73e-c60f6f9a2b8f","resolution":{"observed_at":"2026-05-20T19:48:57.831612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":"4eb4523d-2025-466c-8a4a-db007f15872b","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:6f0e6e95dae3e003ffa115c77db7fda78a87d959a5ba0feffafc8bcb2e080cca","observation_id":"3b7a36d4-23a0-49ab-8fc6-b763b125d5b4","resolution":{"observed_at":"2026-05-20T19:48:57.829903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04281","last_updated":"2020-04-03T19:08:25Z","snapshot_observed_at":"2026-08-18T21:04:11.907492Z","submitted_at":"2019-10-09T22:32:23Z","title":"Integrating Behavior Cloning and Reinforcement Learning for Improved Performance in Dense and Sparse Reward Environments","version":2},"cited_work":{"arxiv_id":"1910.04281","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.04281","snapshot_observed_at":"2026-07-04T01:29:22.882961Z","title":"Integrating behavior cloning and reinforcement learning for improved performance in dense and sparse reward environments","venue":null,"work_id":"814e1170-7444-41ea-8c19-dd3c758f61c8","year":1910},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/1910.04281","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:f7066a3efef57615d085f6e33279552a50f6389b4653556241b0649e10cd362b","observation_id":"2fdfeb35-f613-4952-8c49-d2c8a44c354d","resolution":{"observed_at":"2026-05-20T19:48:57.317233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.09281","last_updated":"2019-11-11T14:18:31Z","snapshot_observed_at":"2026-08-14T00:33:35.701152Z","submitted_at":"2019-10-21T12:06:28Z","title":"Dealing with Sparse Rewards in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.09281","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.09281","snapshot_observed_at":"2026-07-04T15:29:55.594907Z","title":"Dealing with sparse rewards in reinforcement learning","venue":null,"work_id":"906de8dd-dca7-4ded-a470-00299b47049d","year":1910},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/1910.09281","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:b9b73ce6e50794d0bfdfc52afdf98cabe08e0b6315db3fb648642766088bd8d9","observation_id":"ce1b4e95-c112-4510-8d56-4328a4dbab63","resolution":{"observed_at":"2026-05-20T19:48:57.311552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in Neural Information Processing Systems, 30","venue":null,"work_id":"0f2c89bf-499c-4fdc-8f31-a0ef3a50dfbd","year":2017},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:789fd72a0f9823bc0c46a95de87c246936b189b95c331cfe8b15ab82262d4f04","observation_id":"2fcf6550-5140-41b0-a1d7-923102585f33","resolution":{"observed_at":"2026-05-20T19:48:57.817030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:32:56.450074Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851","venue":null,"work_id":"45e032a6-e71b-4525-83cc-6d1e7dd474d8","year":2020},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:67f8fffbb43862c3faddd3c59fd1f53e7de7245077cdd2050b6b73cad3302711","observation_id":"1a24358b-e2d5-47ca-a75c-33039563bae6","resolution":{"observed_at":"2026-05-20T19:48:57.821871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-08-18T00:41:06.039123Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2210.02303","doi":"10.48550/arxiv.2210.02303","metadata_source":"pith","pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","venue":"cs.CV","work_id":"bb20d241-dc6f-4b0a-b071-fd43a2cbd57f","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:96c21e4953dcbaba2d459e7edcb02dc3385e7a680afa6da9f57fcc63c2cc031e","observation_id":"03ce1bc0-f3c7-4728-9eac-b4c1c98b4d93","resolution":{"observed_at":"2026-05-20T19:48:57.341223Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:59.676131+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:59.676131+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video dif- fusion models.Advances in Neural Information Processing Systems, 35:8633–8646","venue":null,"work_id":"e9ccfce4-a929-4797-8b8f-c2362b7bcf7f","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:170de3ac2c2d7f3a2ab7bcd1faf11b56d2937b8a10cb493bd960294deda55e70","observation_id":"820bd6b8-1e48-4294-b46e-a63293967081","resolution":{"observed_at":"2026-05-20T19:48:57.828131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reward hacking in reinforcement learning and rlhf: A multidisciplinary exami- nation of vulnerabilities, mitigation strategies, and alignment challenges","venue":null,"work_id":"886550e5-74c1-4150-8a66-66577800c0f9","year":2025},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:33058eb82d3b15594c9236a501951e9b4a99271f8a2033385532a840caac3619","observation_id":"feb5cc73-2e30-4ccf-8c7a-595a64f29687","resolution":{"observed_at":"2026-05-20T19:48:57.798412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dif- fusion reward: Learning rewards via conditional video dif- fusion","venue":null,"work_id":"fc4eaf1b-a994-400c-9b27-7c0f74168eef","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:71e811d3ad1aef24e9fc2db5da038736a9052245b1cd1b782d31bdb69225dfbd","observation_id":"a3325f06-d978-4d3b-94cc-1951244ba7e8","resolution":{"observed_at":"2026-05-20T19:48:57.800132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion model-based image editing: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence","venue":null,"work_id":"6668125e-66d2-4a55-aba6-2f050fc00120","year":2025},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:6351e5f2abebc5480eca58c031d8b4fbd53c47b4bbd6146635d8864a292dcb9e","observation_id":"24a48e48-3fb1-4844-9d57-78672cc942a7","resolution":{"observed_at":"2026-05-20T19:48:57.819867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13826","last_updated":"2024-03-06T01:55:14Z","snapshot_observed_at":"2026-08-18T11:10:46.772759Z","submitted_at":"2024-03-06T01:55:14Z","title":"Measuring Diversity in Co-creative Image Generation","version":1},"cited_work":{"arxiv_id":"2403.13826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.13826","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring di- versity in co-creative image generation","venue":null,"work_id":"853868e7-02ed-45af-a5af-9ca41dbf9c28","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2403.13826","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:db6cb999d0b987938f884dd4316a1fd3d11dadffa5d99a68d9668ac8cbe5d062","observation_id":"e0bfdc6d-64e5-40ec-bf8f-0591e3837307","resolution":{"observed_at":"2026-05-20T19:48:57.338492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Holodiffusion: Training a 3d diffusion model using 2d images","venue":null,"work_id":"9fbc2a1d-b72c-4e20-b3de-9307b5120a8f","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:32bc1971633c0c56e558208c70d29ac2b35b239dca6ead618cb13ad3d0ce17e7","observation_id":"e9e903b1-bb29-417e-bbd6-b938137d6e03","resolution":{"observed_at":"2026-05-20T19:48:57.796486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05803","last_updated":"2025-04-17T12:23:46Z","snapshot_observed_at":"2026-08-16T12:59:21.543180Z","submitted_at":"2025-01-10T09:10:30Z","title":"Test-time Alignment of Diffusion Models without Reward Over-optimization","version":3},"cited_work":{"arxiv_id":"2501.05803","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.05803","snapshot_observed_at":"2026-07-02T16:27:08.351367Z","title":"Test- time alignment of diffusion models without reward over- optimization","venue":null,"work_id":"4c5e9e32-b6bf-4545-a38f-be72ee8c1e32","year":2025},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2501.05803","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:cd44262608d7f11f00250b5ad76c264a9b0df6cdc72ba00c48bfa5258a1254f1","observation_id":"659cff2e-f249-4ff5-9109-cf4335076c5f","resolution":{"observed_at":"2026-05-20T19:48:57.344161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Variational diffusion models.Advances in neural infor- mation processing systems, 34:21696–21707","venue":null,"work_id":"5827254a-8c7b-4842-98fb-b0816c59b781","year":2021},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:b66f04c4567c8f75664e694c1c48bde572b01e51cfa2143a7cef177dbb52f4c6","observation_id":"8d51bc0f-df24-4786-b634-890e7d98c517","resolution":{"observed_at":"2026-05-20T19:48:57.794774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation.Ad- vances in Neural Information Processing Systems","venue":null,"work_id":"5dc5efde-7a82-4aff-ade1-7dccd9efb73d","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:c2409af02f4f275337d0241791f8baf2749fcf2fcb9ad8bf4d2097ca451eafdc","observation_id":"a8720526-3bcf-4794-87e9-993099d1ca9c","resolution":{"observed_at":"2026-05-20T19:48:57.790557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved precision and recall met- ric for assessing generative models.Advances in Neural In- formation Processing Systems, 32","venue":null,"work_id":"2d6b7afc-beea-43c1-8acf-0e1ac660f788","year":2019},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:69359406dee1b1670cfd27faf65c08f55acc576beaf54c2d291f4939d1aab4f6","observation_id":"4fd0689c-1a7a-4ba4-8c8a-ff92eae7f2a1","resolution":{"observed_at":"2026-05-20T19:48:57.824089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aligning diffusion mod- els by optimizing human utility.Advances in Neural Infor- mation Processing Systems, 37:24897–24925","venue":null,"work_id":"0f3d1178-f47b-476a-8bfe-f01e6938b63f","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:2454c1b7dac8c459648d9f34fc97fb4c10c3c248615b1984fc648d28b39238d3","observation_id":"9335e1c7-c2a3-47d1-b080-5b63029c8805","resolution":{"observed_at":"2026-05-20T19:48:57.826112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-16T13:45:25.207129Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":"2406.04314","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-07-04T06:39:38.330848Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":"96b35c7e-471c-4216-8c52-62bb40d52ae4","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:5c28a9c00d016c1d6bdbb17982abd3adff25539885bc2817e9f29051a85e4ccb","observation_id":"c77785a1-63fa-4b32-874d-9484b904a438","resolution":{"observed_at":"2026-05-20T19:48:57.326419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"No-reference image quality assessment based on spatial and spectral entropies.Signal Processing: Image communica- tion, 29(8):856–863","venue":null,"work_id":"6ce6c965-68f1-4cc2-9646-5bc37deac95b","year":2014},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:1bd4eee86b243e1bebb894c84d9f43d30dd543b6940d432223fb051a414cf5ed","observation_id":"447ea7be-bcc3-40ac-95bc-2aa795f89557","resolution":{"observed_at":"2026-05-20T19:48:57.788614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepcache: Accelerating diffusion models for free","venue":null,"work_id":"7ad6af45-a588-4ba9-bc45-ba7ad5ed1516","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:40e6b63bfee3ccf97b4438a659b71f4910f50f6952f068473bf204148e565ad2","observation_id":"df099ab6-8009-494e-89b6-045612f2282c","resolution":{"observed_at":"2026-05-20T19:48:57.777784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Inform: Mitigating reward hacking in rlhf via information-theoretic reward modeling","venue":null,"work_id":"8a80ab4f-904f-4c16-8d63-09645f46185e","year":2025},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:aca1d5a3be8f03a44a9b9265c7d799c18bbfb44c6b36a04595aa5f6e96562921","observation_id":"0a993b5e-2a98-4313-9795-8538109036db","resolution":{"observed_at":"2026-05-20T19:48:57.779881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"No-reference image quality assessment in the spa- tial domain.IEEE Transactions on Image Processing, 21 (12):4695–4708","venue":null,"work_id":"6b3800f9-d751-4d6e-b5bc-ea751d16da44","year":2012},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:f534431a9f036898785f09c7eb99cbb6b2c4ab59e25a0a190191ecd82ed93b30","observation_id":"737cf6e0-d5db-45d4-afdd-feaf4fb2bcec","resolution":{"observed_at":"2026-05-20T19:48:57.775807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"completely blind","venue":null,"work_id":"a0757c1d-dfc8-439a-94ff-d62db93362c8","year":2012},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:43c6d6ca86568b805874f1420a0275364f8faa88faf348d75081ac3bbba3fedf","observation_id":"9805fa92-95c3-489a-b8a1-15e769819751","resolution":{"observed_at":"2026-05-20T19:48:57.773502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":"2112.10741","doi":"10.48550/arxiv.2112.10741","metadata_source":"pith","pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","venue":"cs.CV","work_id":"34430d19-7919-48ce-88a5-17b3bfe2192e","year":2021},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:e789077bf10e5f386603d99c1e92f49cf4c0a8aeacd9e76bab9f8b8abc4c14ce","observation_id":"27547f44-9da5-4373-9bda-b4c76be63de9","resolution":{"observed_at":"2026-05-20T19:48:57.335429Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-21T20:52:26.23702+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T20:52:26.23702+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21666","last_updated":"2025-05-27T18:46:21Z","snapshot_observed_at":"2026-08-13T11:17:54.901511Z","submitted_at":"2025-05-27T18:46:21Z","title":"Efficient Controllable Diffusion via Optimal Classifier Guidance","version":1},"cited_work":{"arxiv_id":"2505.21666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21666","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient controllable dif- fusion via optimal classifier guidance","venue":null,"work_id":"f17948e8-f7a3-46c6-a726-758f6af58f3b","year":2025},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2505.21666","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:735612890d0e6938910c0cbff553f43d7ccbc781c75fa6c00edc1d2f4e0f869d","observation_id":"dbf1b86c-b20a-40c2-b057-910954ff97af","resolution":{"observed_at":"2026-05-20T19:48:57.286646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Markov decision processes.Handbooks in Operations Research and Management Science, 2:331– 434","venue":null,"work_id":"df695ce2-3efa-4580-8d43-203850b3556a","year":1990},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:bfb7e3f49bbfe4f108cb9729218f1f92d8564bcef3a8bd09d6395601dcbcae3b","observation_id":"e7a12db2-04fd-4761-8fe6-fed9875f37ce","resolution":{"observed_at":"2026-05-20T19:48:57.782021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"1dd14fbb-2c9c-4ae9-8cce-0a09d208be92","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:4f6be2c38a2879f9f94fbf2e4614c85a3c1cf88049e46b85f7f05dee4c12b59b","observation_id":"407fdf8c-d242-46cf-b305-9554e7a866f5","resolution":{"observed_at":"2026-05-20T19:48:57.784099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":"2204.06125","doi":"10.48550/arxiv.2204.06125","metadata_source":"pith","pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","venue":"cs.CV","work_id":"0c6a768b-70b8-4242-bb0e-459f1008c9fc","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:4b1afb196b906369e16725aa3b262980dc773f72133fb98ee009e22c809c56da","observation_id":"2e3819f6-0f8c-4acb-bf67-aab2c2bd08f7","resolution":{"observed_at":"2026-05-20T19:48:57.320043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:38:17.101149+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:38:17.101149+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning by playing solving sparse reward tasks from scratch","venue":null,"work_id":"50b1e955-c1f2-45f8-b3cf-56cfedcfac84","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:00f66ae90b54ed4ac00a4f2f65eccc1d070232108e2e7ee662824e7b5f4b680d","observation_id":"eb0541e8-4aa8-42d8-8158-e5e48ba79560","resolution":{"observed_at":"2026-05-20T19:48:57.764453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"194d1c8a-6e74-4cf0-9c1c-216878aafa4b","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:8eaa878a8cbcf0dbfe28b8bd17256440d4a3b25d1d819135b4ee8741e7866835","observation_id":"3f73eceb-cbfc-4da3-ace7-5ce04fe79f1c","resolution":{"observed_at":"2026-05-20T19:48:57.766741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"873de0dd-8406-4260-ada8-f3c47176133c","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:2993418325f9610883c7c905543ed0a94a56d0528649e00c9d7132bc2e09b817","observation_id":"6b4474c8-117b-4f4d-8e24-e7d418a1d37b","resolution":{"observed_at":"2026-05-20T19:48:57.771392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Silhouettes: a graphical aid to the in- terpretation and validation of cluster analysis.Journal of Computational and Applied Mathematics, 20:53–65","venue":null,"work_id":"fe3421c0-5341-4551-b08f-df9d980d3ffb","year":1987},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:d0b76d461128c978db9c57457e3381e51873b7fa2f66aa5175ea30a0040de360","observation_id":"a67cc0e1-303e-4690-822c-dd5590b4512b","resolution":{"observed_at":"2026-05-20T19:48:57.744326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural information processing systems, 35:36479–36494","venue":null,"work_id":"ffecb178-3062-4aef-9394-27c90a85ed08","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:1ad80ab16e1fabcd33ed69ae75ac7181513d73ecc3795c4068018b7e70b51f50","observation_id":"1128b4b9-5073-4f4d-81ae-1a46f13ba6ed","resolution":{"observed_at":"2026-05-20T19:48:57.757268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved techniques for training gans.Advances in neural information processing systems, 29","venue":null,"work_id":"eafc3c99-a3e5-4ebb-8868-15d6fdbc72a2","year":2016},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:623479846e1076a9a987ccffe2d35ea40ebbf4906695182b01b140ab099a673d","observation_id":"b15f4320-755c-4cb4-a9d8-9f5089e23cf9","resolution":{"observed_at":"2026-05-20T19:48:57.759596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models.Advances in neural in- formation processing systems","venue":null,"work_id":"76c74871-2d5f-4a20-be5c-d0ca249192fe","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:85fcaa070115f4baeaf3112dc341b82bd41fff2e5aa722a79f6c3a095578c0ac","observation_id":"b5158451-e2c6-4c5d-8726-e0b2e8c470b9","resolution":{"observed_at":"2026-05-20T19:48:57.754912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:8555c852ed5e223c801eee74833a073172d3e4d8b752619edcb77fe0f37c75c1","observation_id":"ec9f9c63-5958-4602-85dc-abe14a9b4ca9","resolution":{"observed_at":"2026-05-20T19:48:57.329746Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Defining and characterizing reward gam- ing.Advances in Neural Information Processing Systems, 35:9460–9471","venue":null,"work_id":"5909eee8-3001-428b-b90d-9ed6c2be49cd","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:2380357b5f3630817408571c25b3a262de56563c0cd09466f65d01897e98b893","observation_id":"77fb2339-f8e7-420c-8b4f-efd13fe239aa","resolution":{"observed_at":"2026-05-20T19:48:57.762057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Defining and characterizing reward gam- ing.Advances in Neural Information Processing Systems, 35:9460–9471","venue":null,"work_id":"e9d61ef7-ac64-4421-8ae6-e90b621c3861","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:83167ca34b382aac10a39e39495c14e1d0405604489578f461084e4a7a6a4ed1","observation_id":"cd81aee5-8a30-43df-bf2e-624c424c7ed1","resolution":{"observed_at":"2026-05-20T19:48:57.768978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"d926a72f-21d1-431d-9474-31d3dbbb3a1e","year":2015},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:5ab2b92f3858a80547f3256ee582bf3f151bb2483d4cec3cce6971ebfbd4ea3a","observation_id":"0b920364-e15d-46ee-8616-8ee9ec7651ae","resolution":{"observed_at":"2026-05-20T19:48:57.786570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18881","last_updated":"2024-10-02T05:22:07Z","snapshot_observed_at":"2026-08-16T13:48:17.878399Z","submitted_at":"2024-05-29T08:39:39Z","title":"Inference-Time Alignment of Diffusion Models with Direct Noise Optimization","version":3},"cited_work":{"arxiv_id":"2405.18881","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.18881","snapshot_observed_at":"2026-07-04T13:29:52.088515Z","title":"Inference-time alignment of diffusion models with direct noise optimization","venue":null,"work_id":"a2a9b9c8-9d83-4c22-825a-431387340136","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2405.18881","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:077ab4a7547e347140b39e437c37c6991f3de991eb86a7c377639defce04d960","observation_id":"0444539c-d75f-4c77-85a3-acfdf72f57b5","resolution":{"observed_at":"2026-05-20T19:48:57.291608Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13734","last_updated":"2024-07-18T17:35:32Z","snapshot_observed_at":"2026-08-16T13:32:57.699401Z","submitted_at":"2024-07-18T17:35:32Z","title":"Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review","version":1},"cited_work":{"arxiv_id":"2407.13734","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13734","snapshot_observed_at":"2026-07-05T17:51:14.851401Z","title":"Understanding reinforcement learning-based fine-tuning of diffusion models: A tutorial and review","venue":"cs.LG","work_id":"a22cff4a-9d87-46bd-8d73-d48374c743ef","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2407.13734","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:ffcf23d27808c0954438bbb803aaa6b1d1d08d2e62c36e5d689533687406af0c","observation_id":"63087ef6-f5ab-4105-ad07-bbb4736bc16d","resolution":{"observed_at":"2026-05-20T19:48:57.305447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visualizing data using t-sne.Journal of machine learning research, 9 (11)","venue":null,"work_id":"25a0860c-46fa-4fac-8842-2b7b4d4f6c86","year":2008},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:f4dad2df6de6c9eb1eea6980467b06283d1e12c746501182b061ea72b9f4774a","observation_id":"2cac8b13-bfa6-4075-8bd0-de36f0c05fc2","resolution":{"observed_at":"2026-05-20T19:48:57.752447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":"bd46a656-436c-41e5-9a39-5e473caf92eb","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:404b01b691df96191b5c8722f13afbd2bb02a7ac4c1af1c11843fada0f29c80f","observation_id":"abda76e1-ab2e-4fc0-bd6e-9d5f5107b27c","resolution":{"observed_at":"2026-05-20T19:48:57.749288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep-reinforcement-learning-based autonomous uav navi- gation with sparse rewards.IEEE Internet of Things Journal, 7(7):6180–6190","venue":null,"work_id":"cf7340b8-f8f6-4102-9c2f-384df4c8941f","year":2020},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:7b1419842e8d7b19d58afe325ff55b635d06e9c276df1dc8f1121137369307d2","observation_id":"4c3336c2-a1ee-433d-9678-22bbdf32d63d","resolution":{"observed_at":"2026-05-20T19:48:57.746932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.08404","last_updated":"2026-08-03T02:35:28Z","snapshot_observed_at":"2026-08-19T07:44:52.713149Z","submitted_at":"2026-02-09T09:05:46Z","title":"TEAM: Temporal-Spatial Consistency Guided Expert Activation for MoE Diffusion Language Model Acceleration","version":3},"cited_work":{"arxiv_id":"2602.08404","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.08404","snapshot_observed_at":"2026-07-04T01:39:23.987540Z","title":"Team: Temporal-spatial consistency guided expert activation for moe diffusion language model acceleration","venue":"cs.CL","work_id":"d732de23-5078-4795-ba07-c69f6ad3ac91","year":2026},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2602.08404","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:2f39b6796b6659387edea4846662593b55d90864b832616ced187c3523cf3d30","observation_id":"257b259f-93f7-4fd9-a2f5-e179c0a14efc","resolution":{"observed_at":"2026-05-25T03:01:59.936669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-14T02:46:25.655503Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2306.09341","doi":"10.48550/arxiv.2306.09341","metadata_source":"pith","pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","venue":"cs.CV","work_id":"40702548-f094-4c67-a5db-a62f426f852e","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:3640b4c11f5f538d3cb0fda0048758494ba9a1a0c48ca79940aea579ac998a20","observation_id":"5eba3af8-bb76-46be-8b49-81d7b20884a7","resolution":{"observed_at":"2026-05-20T19:48:57.298828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-15T14:08:11.306027+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T14:08:11.306027+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffir: Efficient diffusion model for image restoration","venue":null,"work_id":"7d44631c-ef9e-43ec-a179-1d0a21a4f737","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:2175c615a3e973570f6768d8c0a841b3f37821e9823682e402fcd77b2b9185cb","observation_id":"307ba49e-b2cf-4914-a7f6-4bb9562866c6","resolution":{"observed_at":"2026-05-20T19:48:57.880287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dymo: Training-free diffusion model alignment with dynamic multi-objective scheduling","venue":null,"work_id":"ef8d8916-28bb-4921-87fd-76d00c93f883","year":2025},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:10315eadf640267b5669c81965d82791bb14f70312d5999ec4a79440591fa186","observation_id":"466da5dc-a5ed-4ebc-8ac9-0b7cbe1262b9","resolution":{"observed_at":"2026-05-20T19:48:57.882159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on video dif- fusion models.ACM Computing Surveys, 57(2):1–42","venue":null,"work_id":"e4e98aa3-473a-42c9-8e31-eae044f5b6fb","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:ff6b4373e4bdf14e87da4a3f8dc6ad2906882a19892375a2e52405ea59ab96f9","observation_id":"b49e4063-6029-4b37-943f-e0f5cfc219dd","resolution":{"observed_at":"2026-05-20T19:48:57.874259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation.Advances in Neural Information Pro- cessing Systems","venue":null,"work_id":"61c7dd95-e976-451a-94e0-48861aa0dbce","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:61ee13984e298690b2cf7b0015fdc48fca302558b839a7ab252daddfd88a29dc","observation_id":"9c3585fe-e11f-4e7b-95a5-af1d66069cc0","resolution":{"observed_at":"2026-05-20T19:48:57.876157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dream3d: Zero-shot text-to-3d synthesis using 3d shape prior and text-to-image diffusion models","venue":null,"work_id":"0c9bac59-1f4f-47ec-9bf7-612d551cf003","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:79dd9daaebe1331811fb59c74dced2c81ae03e05ea850a33b061a9338667c65e","observation_id":"0064e5d0-b387-42e0-a4f7-cf8f0492bd0d","resolution":{"observed_at":"2026-05-20T19:48:57.878023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Versatile diffusion: Text, images and variations all in one diffusion model","venue":null,"work_id":"57e87b76-b0cb-45c4-b38b-2be52c8701ed","year":2023},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:bb8270a96562cd03f40ca79bb42df99a3a36063b64c02d64051148f2684c328a","observation_id":"d451510c-e91f-4077-90e8-442cce488153","resolution":{"observed_at":"2026-05-20T19:48:57.883994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09974","last_updated":"2024-08-19T13:21:46Z","snapshot_observed_at":"2026-08-16T13:25:31.848551Z","submitted_at":"2024-08-19T13:21:46Z","title":"The Exploration-Exploitation Dilemma Revisited: An Entropy Perspective","version":1},"cited_work":{"arxiv_id":"2408.09974","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.09974","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The exploration- exploitation dilemma revisited: An entropy perspective","venue":null,"work_id":"2f282766-af32-4259-96d7-639e7cc9688a","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2408.09974","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:c21beff33cf90f5baf227c43cdf461f74ed4d1f482afa598036d84aa261edaa5","observation_id":"bb487ac0-3dd8-4dc8-9d17-1ab800ffaca7","resolution":{"observed_at":"2026-05-20T19:48:57.295846Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Entropy-adaptive diffusion policy optimiza- tion with dynamic step alignment","venue":null,"work_id":"7e4f1016-7e31-46bf-832a-c42c7c1aafaa","year":1924},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:c7f19d2bc87ebcff353f8bfa99410cd53f12f8be0b64aa84cc0215f328c8a4eb","observation_id":"cd1c5c24-7720-4129-95ea-f650676ffa48","resolution":{"observed_at":"2026-05-20T19:48:57.865650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Using human feedback to fine-tune diffusion models without any reward model","venue":null,"work_id":"d3444519-49cf-438d-878a-627fc0d52593","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:ab81b505b8931d6e579ae3f566a72d16e200f6c9f1ca66f548fab07584ae4e59","observation_id":"9c3382a6-86ba-495e-b24b-07294f3eaa40","resolution":{"observed_at":"2026-05-20T19:48:57.867425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A novel multi-step reinforcement learning method for solving reward hacking.Applied Intelligence, 49 (8):2874–2888","venue":null,"work_id":"2eed6db4-f50e-4fed-96e7-4a809f46301b","year":2019},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:234554506d7ee368844a526f8f6e40ded70ab2f7692ad391a400504a2f988505","observation_id":"1477834b-e9f6-49f8-8ff0-89fbe958803b","resolution":{"observed_at":"2026-05-20T19:48:57.869645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"aa9ae80a-d5e0-426b-b673-f35a002b4282","year":2018},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:83edd9ad898ff79473522f093ac3ec97bd7b23a3a98f8b1e227daacee69e2842","observation_id":"3259f9a6-1279-4ed6-985d-a7fc22732510","resolution":{"observed_at":"2026-05-20T19:48:57.862026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Confronting reward overoptimiza- tion for diffusion models: A perspective of inductive and pri- macy biases","venue":null,"work_id":"7b8397cd-a3b7-4b4f-b879-828ece0c10a9","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:67bd6d9d52895adf62095106363fa0db606fc7948aaca1e14c2b1be37d39e8d1","observation_id":"58892d7a-8ed7-445e-9942-f925e4f15021","resolution":{"observed_at":"2026-05-20T19:48:57.858446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alphaholdem: High-performance artificial intelli- gence for heads-up no-limit poker via end-to-end reinforce- ment learning","venue":null,"work_id":"f9db3d3f-5792-4bde-b43c-d6159535b25a","year":2022},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:26aa49f1ad1eba1fcbe20bbd29d2d6f9c85e98d1553f287a5b7dcc328bc98b90","observation_id":"c186831c-21fe-4e44-a8a6-00d7b8825565","resolution":{"observed_at":"2026-05-20T19:48:57.860290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d shape generation and completion through point-voxel diffusion","venue":null,"work_id":"25c66d0f-0c9d-4217-91e2-40733dad9edf","year":2021},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:fbe29f6adedde43346a174710b064a6b44d040417441a2ac6bfd985fe960a30b","observation_id":"89ac76cb-2e2d-47d0-aca5-6887a594870f","resolution":{"observed_at":"2026-05-20T19:48:57.863765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mixture of global and local experts with diffusion transformer for con- trollable face generation","venue":null,"work_id":"bd824f35-88c2-41c0-9d62-6b54e846e1cd","year":2025},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:abc0b879d234aae5c7d9121020d5ab58efecf0d8d8541e2ffca3d8a053475a48","observation_id":"1da7ee14-bb16-44f4-9687-cc58c01966fe","resolution":{"observed_at":"2026-05-20T19:48:57.871500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5850.5990","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"RL Fine-Tuning in Diffusion Models Existing diffusion models [4, 5, 24, 59, 62] primarily approximate the data distribution through denoising reconstruction loss","venue":null,"work_id":"4f9dcbe3-439c-4524-861f-4dcece414a2a","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:732ee2efaf044adc218f63512004057ba13ab1c21cb67b2ebe955ca81bc351a4","observation_id":"b61469d5-4d07-4b3c-a32c-238dde804236","resolution":{"observed_at":"2026-05-20T19:48:57.314460Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"•(1) Visualization Experiments.See Fig","venue":null,"work_id":"71b9fbb6-ad54-4ec3-a580-2d089a491da7","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:62fb367646775e00bf34edae5713eb825ebf713f66481729815ac26efb887d10","observation_id":"e5304a71-38a6-474e-b7c1-7228977c2d35","resolution":{"observed_at":"2026-05-20T19:48:57.854117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b166c490-d985-44bc-93b1-c589c5c6d9bb","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:3be38cf47c13902f36daad2b9c9f47c724ffb14cc909168263254ac0506260a9","observation_id":"565b7ff3-7f0e-43a3-a3a0-ff88e0c7121f","resolution":{"observed_at":"2026-05-20T19:48:57.848394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proof of Theorem 1","venue":null,"work_id":"67755487-5571-4ed2-9183-018805652b6b","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:e593e9692aa76c8fb71f3da4deffd7cef55f29e6154484278434ead5d5ee22da","observation_id":"499adcd8-b8ad-451c-8512-8c13e58f7071","resolution":{"observed_at":"2026-05-20T19:48:57.850498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5a36c738-c645-4292-bc82-69e59089a83a","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:922517ff34bd794bbc7be012ecbc505fd2fe3d21d21f162f677cf4ec779c13c4","observation_id":"068f1f5f-4784-4562-83e5-e23d0104f116","resolution":{"observed_at":"2026-05-20T19:48:57.846447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Therefore, componentwise, Cov x(i) t , x(j) t+τ = √¯αt ¯αt+τ Σij + r ¯αt+τ ¯αt (1−¯αt)δ ij","venue":null,"work_id":"13f47198-bfd5-4c6c-bca9-1dec9b2df323","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:01d8bc8aa41425e89eb641ee016e7b4a6c40e731b9f74c4874d42e583745089a","observation_id":"356c7317-dbc0-47eb-ae78-f52bcb9075aa","resolution":{"observed_at":"2026-05-20T19:48:57.852435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"756e0136-85de-49f0-a6b3-fbe3e4e9a1d6","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:9b8d840120638ee92ae18ba926f04db776b5c9d236d187999135b9c2a4720029","observation_id":"a2d4b130-1e26-4dc0-9b74-8d9874997bac","resolution":{"observed_at":"2026-05-20T19:48:57.844618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f12b07ca-4550-4945-ae25-8368bcf0bc38","year":null},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:d38a350a4b229c940b89502e56ad959973b37cd1effba17a016e750532365f91","observation_id":"499868ac-56b4-44b2-842b-e36e7024ba94","resolution":{"observed_at":"2026-05-20T19:48:57.855751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":4,"verified_exact":17,"verified_fuzzy":56},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 4 inbound Pith citation observations for arXiv:2605.15855."}