{"as_of":"2026-08-17T18:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:200ebcf4fe529c75a6914f54b60fd8c9fddb017462bd43abe27a890e23705848","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:42:22.457966Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:10:44.244790Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T07:14:20.959214Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"cited_work":{"arxiv_id":"2508.21016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21016","snapshot_observed_at":"2026-06-30T07:14:20.959214Z","title":"Inference-time alignment control for diffusion models with reinforcement learning guidance","venue":null,"work_id":"cb0aeaa8-80a2-4b68-8b5a-e8737cdce98b","year":2025},"citing_paper":{"arxiv_id":"2509.16117","last_updated":"2026-02-16T17:14:06Z","snapshot_observed_at":"2026-08-17T17:00:34.924478Z","submitted_at":"2025-09-19T16:09:33Z","title":"DiffusionNFT: Online Diffusion Reinforcement with Forward Process","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T16:54:30.953199Z"},"links":{"cited_paper":"/paper/2508.21016","citing_paper":"/paper/2509.16117"},"observation_digest":"sha256:15108d421a07f0e074dabbf74083bbcf642a1de23318930f8c679b07460a979b","observation_id":"6674a156-2fbb-43f2-9c5f-0341df19c5b6","resolution":{"observed_at":"2026-05-13T16:54:31.010581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"cited_work":{"arxiv_id":"2508.21016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21016","snapshot_observed_at":"2026-06-30T07:14:20.959214Z","title":"Inference-time alignment control for diffusion models with reinforcement learning guidance","venue":null,"work_id":"cb0aeaa8-80a2-4b68-8b5a-e8737cdce98b","year":2025},"citing_paper":{"arxiv_id":"2605.04494","last_updated":"2026-05-06T04:50:42Z","snapshot_observed_at":"2026-07-31T05:58:54.504742Z","submitted_at":"2026-05-06T04:50:42Z","title":"Towards General Preference Alignment: Diffusion Models at Nash Equilibrium","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T16:54:58.732444Z"},"links":{"cited_paper":"/paper/2508.21016","citing_paper":"/paper/2605.04494"},"observation_digest":"sha256:edd712f7f116175334ccba7f904dff4604777d8f4aaf00325f6e55ebfbd6ec15","observation_id":"a4fb9b96-bf1d-4ddb-bb27-01dc1c977e51","resolution":{"observed_at":"2026-05-11T17:56:06.972632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"cited_work":{"arxiv_id":"2508.21016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.21016","snapshot_observed_at":"2026-06-30T07:14:20.959214Z","title":"Inference-time alignment control for diffusion models with reinforcement learning guidance","venue":null,"work_id":"cb0aeaa8-80a2-4b68-8b5a-e8737cdce98b","year":2025},"citing_paper":{"arxiv_id":"2606.30376","last_updated":"2026-06-29T14:37:36Z","snapshot_observed_at":"2026-08-07T13:52:35.062571Z","submitted_at":"2026-06-29T14:37:36Z","title":"FlowAWR: Online Adaptive Flow Reinforcement via Advantage-Weighted Rectification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T07:10:44.244790Z"},"links":{"cited_paper":"/paper/2508.21016","citing_paper":"/paper/2606.30376"},"observation_digest":"sha256:a3648dd91b971d73a231da24528f714c1e0b3457828371b74ad9a9a5b1796c0e","observation_id":"fb3adc17-f5fd-4baa-a50b-90e33b0a143d","resolution":{"observed_at":"2026-06-30T07:14:20.961281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.21016/citation-record","integrity":"/paper/2508.21016/integrity","json":"/paper/2508.21016/citation-record.json","paper":"/paper/2508.21016"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.129723Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.129723Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:2d34c152778138f1d90dadd6236b3c8dad26565f9672cdbec3a3ae282c2a7743","observation_id":"adfc3e4c-ff7a-411f-b5c9-795c3ef9f0f3","resolution":{"observed_at":"2026-08-05T14:42:22.129723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.135394Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.135394Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:cb08424ca356dcd7018b40d1dbb4e7c463aff7d3855687d283c6079f0a25fd7f","observation_id":"7749846b-3fe2-4b42-adb7-26910a877101","resolution":{"observed_at":"2026-08-05T14:42:22.135394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.662899Z","title":null,"venue":null,"work_id":"250e2621-bbc4-4fca-90bb-9242d26f7700","year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.143215Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:a5cf07e5491e0ef66966c35d62dd87bc576b0695f3ec698666ba71148b7ffec6","observation_id":"3458c617-ac39-4146-87a9-0dfe06b458d1","resolution":{"observed_at":"2026-08-05T14:42:23.668973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-05T14:42:22.148482Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.148482Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:1a4e6480dfc667f2ce9076efa742cc3d86262bed343694e585fc2c61d2b3789f","observation_id":"6f991acc-92d2-4ab6-87ba-6bb34af8a437","resolution":{"observed_at":"2026-08-05T14:42:22.148482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09000","last_updated":"2024-08-23T17:21:35Z","snapshot_observed_at":"2026-08-16T13:25:56.177351Z","submitted_at":"2024-08-16T20:00:55Z","title":"Classifier-Free Guidance is a Predictor-Corrector","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09000","snapshot_observed_at":"2026-08-05T14:42:22.154328Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.154328Z"},"links":{"cited_paper":"/paper/2408.09000","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:6b020f80336d97579328606a5a4095704699cde799dbd972c8e270d7e928c227","observation_id":"ed72c517-5e42-4777-91cf-93adc6dd41f1","resolution":{"observed_at":"2026-08-05T14:42:22.154328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21834","last_updated":"2026-04-12T01:02:59Z","snapshot_observed_at":"2026-08-12T16:49:14.171023Z","submitted_at":"2025-06-27T00:47:07Z","title":"PrefPaint: Enhancing Medical Image Inpainting through Expert Human Feedback","version":2},"cited_work":{"arxiv_id":"2506.21834","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21834","snapshot_observed_at":"2026-08-05T14:42:23.290665Z","title":"PrefPaint: Enhancing Medical Image Inpainting through Expert Human Feedback","venue":"cs.CV","work_id":"8d6c8abf-d4cb-4f53-9f80-721295c46e61","year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.160551Z"},"links":{"cited_paper":"/paper/2506.21834","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:bd57ceed4b43d3b4a00655bf3cd452d5dccf9aafb8b9de8f2c7faaaefb247272","observation_id":"56785e19-4ba3-4acd-8221-afbd7bc3d6ac","resolution":{"observed_at":"2026-08-05T14:42:23.298058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.167273Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.167273Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:94197ffb5426cb8db667b743d95fd0c7c9ed5fc2485066b78b1b4dff56750fdc","observation_id":"304f57c7-e897-46a5-b7c1-f449696b9cb4","resolution":{"observed_at":"2026-08-05T14:42:22.167273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01527","last_updated":"2022-06-15T20:58:09Z","snapshot_observed_at":"2026-08-16T17:37:26.106371Z","submitted_at":"2021-12-02T18:59:58Z","title":"Masked-attention Mask Transformer for Universal Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01527","snapshot_observed_at":"2026-08-05T14:42:22.172732Z","title":"G.; Kirillov, A.; and Girdhar, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.172732Z"},"links":{"cited_paper":"/paper/2112.01527","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:b7cbd8592194ea428f9314780bd733fc294255438d6634d447c6c4a213c39d39","observation_id":"7b737d5e-61b9-4f3b-9691-8ab6edf40637","resolution":{"observed_at":"2026-08-05T14:42:22.172732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.179641Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.179641Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:5a5f848f635dd738318207472a1d93dda7e9da56c8cd5d5c03e97feff3011b81","observation_id":"cddf071c-3a23-402e-b3d8-965bcde8eeaf","resolution":{"observed_at":"2026-08-05T14:42:22.179641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08070","last_updated":"2024-09-12T04:39:16Z","snapshot_observed_at":"2026-08-16T13:43:49.389556Z","submitted_at":"2024-06-12T10:40:10Z","title":"CFG++: Manifold-constrained Classifier Free Guidance for Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08070","snapshot_observed_at":"2026-08-05T14:42:22.185076Z","title":"Y.; Nam, H.; and Ye, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.185076Z"},"links":{"cited_paper":"/paper/2406.08070","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:97c5e268945735df559183dbecb09ed2e85aa744d0d1af588e4dd10491b3b5ff","observation_id":"4c8f76b2-7df2-467d-ba51-cc68b1d6ada2","resolution":{"observed_at":"2026-08-05T14:42:22.185076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17400","last_updated":"2024-06-21T16:45:11Z","snapshot_observed_at":"2026-08-06T10:08:54.816113Z","submitted_at":"2023-09-29T17:01:02Z","title":"Directly Fine-Tuning Diffusion Models on Differentiable Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17400","snapshot_observed_at":"2026-08-05T14:42:22.194389Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.194389Z"},"links":{"cited_paper":"/paper/2309.17400","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:11177c73a680928a43e29fc685fb8fa77179f95344e4caad5cae2ac21ac24d01","observation_id":"1f3cbfdb-5f44-4ee7-81a6-de6417e866a0","resolution":{"observed_at":"2026-08-05T14:42:22.194389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-08-17T04:59:59.434643Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-05T14:42:22.199726Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.199726Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:b0fa5e9d3bb73739ccded0bd09087351a6aa518c17b77b1076638b314960422e","observation_id":"5465019d-c0e2-4632-a8c3-1667283e239f","resolution":{"observed_at":"2026-08-05T14:42:22.199726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.633201Z","title":null,"venue":null,"work_id":"63640091-07be-4c03-baee-bf986fe81b7c","year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.204773Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:f1d9f1f9ca50e2ea052837c392700e4c67158957975e473be578d8ac8367c8ef","observation_id":"7c02521e-4250-43a0-93f6-f6e08bd8a148","resolution":{"observed_at":"2026-08-05T14:42:23.638508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-08-13T01:47:21.043519Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-05T14:42:22.209359Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.209359Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:8d429aa8aa4b8d8f2ffa942ede10afbfcd4cb79849f08d0e4a58a36d59313571","observation_id":"c0a4618d-1253-49ef-b432-cdf07356bcb5","resolution":{"observed_at":"2026-08-05T14:42:22.209359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06061","last_updated":"2025-02-09T22:45:15Z","snapshot_observed_at":"2026-08-09T18:00:02.961549Z","submitted_at":"2025-02-09T22:45:15Z","title":"Online Reward-Weighted Fine-Tuning of Flow Matching with Wasserstein Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06061","snapshot_observed_at":"2026-08-05T14:42:22.214222Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.214222Z"},"links":{"cited_paper":"/paper/2502.06061","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:cdad309abc14cbe390ed9aa1cd6ed91fc82c933abb6d1fb8535b1d30498c746b","observation_id":"5b73787a-0011-4fb3-8fcf-a88a0e1b9001","resolution":{"observed_at":"2026-08-05T14:42:22.214222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18886","last_updated":"2025-04-03T09:03:32Z","snapshot_observed_at":"2026-08-16T12:47:15.960378Z","submitted_at":"2025-03-24T16:59:57Z","title":"CFG-Zero*: Improved Classifier-Free Guidance for Flow Matching Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18886","snapshot_observed_at":"2026-08-05T14:42:22.219088Z","title":"Y.; Yeh, R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.219088Z"},"links":{"cited_paper":"/paper/2503.18886","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:b95ada2114f5f776a1a0e919ebb7dfa132d37ce8a583a199e9d6a4604e1e82c4","observation_id":"8575a2c6-fc01-49ce-b6a8-64bd81386868","resolution":{"observed_at":"2026-08-05T14:42:22.219088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23458","last_updated":"2025-05-29T14:06:50Z","snapshot_observed_at":"2026-08-15T15:01:05.530251Z","submitted_at":"2025-05-29T14:06:50Z","title":"Diffusion Guidance Is a Controllable Policy Improvement Operator","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23458","snapshot_observed_at":"2026-08-05T14:42:22.223628Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.223628Z"},"links":{"cited_paper":"/paper/2505.23458","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:84e0ea7b9c4966e9ab580fbf61a7fab0a91df228ea525ee9628c64ca01e1f6aa","observation_id":"56e107ec-6e8c-4c85-a1b2-0b52646da785","resolution":{"observed_at":"2026-08-05T14:42:22.223628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.614856Z","title":null,"venue":null,"work_id":"8c3368cf-1660-49db-b111-ecb6adc99f8d","year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.228358Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:774c937887f039335b915b05652bfe22d85c7f5762703512a34d2f2d79e4a7ca","observation_id":"76ed0a85-9501-4c3c-abaf-e9390e43b717","resolution":{"observed_at":"2026-08-05T14:42:23.620552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20639","last_updated":"2025-06-26T15:46:40Z","snapshot_observed_at":"2026-08-17T13:30:15.045823Z","submitted_at":"2025-06-25T17:35:47Z","title":"DiffuCoder: Understanding and Improving Masked Diffusion Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20639","snapshot_observed_at":"2026-08-05T14:42:22.236761Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.236761Z"},"links":{"cited_paper":"/paper/2506.20639","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:21fdf9070134b09ff2140d90643928aefac182ec73bdf5ecd5910b67727131fe","observation_id":"221f89fb-3a73-4331-9671-19a81ecf03de","resolution":{"observed_at":"2026-08-05T14:42:22.236761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.241643Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.241643Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:fc52e674ce9ce641cbbd71ea954a168b6a3167a5c08ab718160d867a729d35af","observation_id":"768c7664-f57e-49fb-87f7-e3afe05f5220","resolution":{"observed_at":"2026-08-05T14:42:22.241643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T14:42:22.246069Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.246069Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:bb8352f367787050dc80fe6be7ce0174ac9aee11d915eea241ed8efbcb580c3e","observation_id":"b05b307f-f8b5-4cab-87c5-c840d0a02599","resolution":{"observed_at":"2026-08-05T14:42:22.246069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.587404Z","title":null,"venue":null,"work_id":"4b5300fb-4100-46cd-aeb3-f20e43698222","year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.250855Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:5013919995911c10c17356e0d3b8fc349404ae32dfca073b40765545e2e33cd8","observation_id":"c97259dd-7afb-4d2e-ba2f-0afb4f919504","resolution":{"observed_at":"2026-08-05T14:42:23.593229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.570607Z","title":null,"venue":null,"work_id":"5e521874-d5b7-449b-b9d2-a0bbb2b7b853","year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.255448Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:ebcd3418b210d21699252c1553119b02e0d6399fe46e393f09fc19d71e5c5caf","observation_id":"828132b4-1a46-49e5-a446-68bfdcad2680","resolution":{"observed_at":"2026-08-05T14:42:23.575591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01569","last_updated":"2023-11-23T17:07:58Z","snapshot_observed_at":"2026-08-16T15:36:12.925339Z","submitted_at":"2023-05-02T16:18:11Z","title":"Pick-a-Pic: An Open Dataset of User Preferences for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01569","snapshot_observed_at":"2026-08-05T14:42:22.259928Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.259928Z"},"links":{"cited_paper":"/paper/2305.01569","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:8f9f725ba22178d34a00dedd0d03d73a21373dd32d0d499b44828bea65d52271","observation_id":"61bcc3c4-df59-47f4-a972-b591474cea3b","resolution":{"observed_at":"2026-08-05T14:42:22.259928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T14:42:22.264641Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.264641Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:69ad451cf1d0aeeda4b7786958eed5e5a7e5289b89909a6854fbd2f42ee5c96b","observation_id":"2e1a7866-4c6d-4c1a-90a4-0b68584b0c53","resolution":{"observed_at":"2026-08-05T14:42:22.264641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-05T14:42:22.270001Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.270001Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:3cb348147dd4da5fe895d321f5b1d20f229996b6581ff60d7669a34a868696c3","observation_id":"a1195b3a-2b1b-4f4f-bce8-e7854c0f46bf","resolution":{"observed_at":"2026-08-05T14:42:22.270001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-05T14:42:22.275222Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.275222Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:1ba9ba5ff1b8fa82e9e3d130fd39257199724014f644562adeb0619a191a8583","observation_id":"0e181c30-f54a-4486-95be-d5e9ec5dbe92","resolution":{"observed_at":"2026-08-05T14:42:22.275222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-16T13:45:25.207129Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-05T14:42:22.280733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.280733Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:39835bb11961243c3d5db6c68ba395f9d0fc2f0c2ee676ebc182dca47c0bf725","observation_id":"9e3f21ad-9081-4c4f-b264-8e22dd71db05","resolution":{"observed_at":"2026-08-05T14:42:22.280733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T14:42:22.285749Z","title":"T.; Ben-Hamu, H.; Nickel, M.; and Le, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.285749Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:6a5d99c091cfb7071421249b633f52b55296e60add9ec0a51de66013c8eb102d","observation_id":"2057f0dc-e59f-4592-9d2d-d65e6146a1fa","resolution":{"observed_at":"2026-08-05T14:42:22.285749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.291508Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.291508Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:bd965c06c80a0f3270d57bb57c0cd3c3f3084df33abed73aff76eb8fb01bd3d9","observation_id":"052041bf-f72c-4588-b694-ec3c62b8be08","resolution":{"observed_at":"2026-08-05T14:42:22.291508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06782","last_updated":"2025-02-12T10:07:07Z","snapshot_observed_at":"2026-08-14T20:48:09.219568Z","submitted_at":"2025-02-10T18:58:11Z","title":"Lumina-Video: Efficient and Flexible Video Generation with Multi-scale Next-DiT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06782","snapshot_observed_at":"2026-08-05T14:42:22.295895Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.295895Z"},"links":{"cited_paper":"/paper/2502.06782","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:f58ae0591c7fcd11c2f5039ea4ef3ad2a836276c9e704283c7d3718fbf67fcfd","observation_id":"60d87b09-6a4d-4dd1-8425-f695b0ec1a0c","resolution":{"observed_at":"2026-08-05T14:42:22.295895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-13T10:15:00.293616Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-08-05T14:42:22.301547Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.301547Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:a2e615d07f72dbac1a7d47e29249b2482d8a6f739aeee542420280b8bad08751","observation_id":"281d1151-1fa6-4a4e-9e2b-8c1f98fa3d35","resolution":{"observed_at":"2026-08-05T14:42:22.301547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-05T14:42:22.307315Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.307315Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:213347fde82b0cd33de337f1c92e74c93a4def4bb3a186baa1aa15f9274942fe","observation_id":"b12ae850-7b16-4c10-805f-31fbfd4f1039","resolution":{"observed_at":"2026-08-05T14:42:22.307315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.312178Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.312178Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:2dee238477f804d780187c56ef332fa2c137a061309b73dceb96f83f85feae1d","observation_id":"9e942faf-4539-4ea9-8ff8-5bc4e1c193c7","resolution":{"observed_at":"2026-08-05T14:42:22.312178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.543835Z","title":null,"venue":null,"work_id":"5e7b28c8-96dd-43ce-aeea-20a428543fc4","year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.317146Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:4a3ebac0f2d921945ce83cd5c139d0ec155ed1fbecb3a69632439a1bab20e2b6","observation_id":"0c62698a-b136-4733-ab0f-6bb80427dfe0","resolution":{"observed_at":"2026-08-05T14:42:23.548625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.526297Z","title":null,"venue":null,"work_id":"e1452e44-94c5-4f2b-b4c5-ea4dae529739","year":1999},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.321701Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:3dc9e9b5a73c70856fd7e4df9fbcbcd1f580792620ef678e841c4720f2700073","observation_id":"74cf2b01-4e6b-4cbe-990c-f68593a31c32","resolution":{"observed_at":"2026-08-05T14:42:23.531113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-08-13T13:59:34.315271Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-05T14:42:22.326127Z","title":"???? Simple and Scalable Off-Policy Reinforcement Learning","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.326127Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:eaa9af54c2eb43dc2ad81ccb94d48e606582b67ab3e763d6e7aec61c3211517f","observation_id":"0e5c2df1-3b3f-40ed-9854-8c2889f00b69","resolution":{"observed_at":"2026-08-05T14:42:22.326127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-05T14:42:22.330799Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.330799Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:b2fe9e21b720c0d81284d331c92af6be035c501243f0749b17b052d11ef4fb7c","observation_id":"4c5bd75d-e8e1-49e2-aa06-5ac443293669","resolution":{"observed_at":"2026-08-05T14:42:22.330799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.509985Z","title":null,"venue":null,"work_id":"99fd320b-1dc9-4009-ab4e-de34c5b08cfa","year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.335656Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:62548423b49978b353a7b575ea1c14164b06b3a2b7bc63210b6f41e8b69e2c09","observation_id":"7cdceb0a-4e7e-4be4-8d08-d5f493990d01","resolution":{"observed_at":"2026-08-05T14:42:23.514920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-05T14:42:22.340041Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; Krueger, G.; and Sutskever, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.340041Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:5c33e00d9cf90175bf01d42bbd1770f3979b41bdd88cfea8be71c6b09968bbaf","observation_id":"0c2b9ab9-deeb-41f9-b4e5-624a56116996","resolution":{"observed_at":"2026-08-05T14:42:22.340041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12358","last_updated":"2024-08-12T21:13:35Z","snapshot_observed_at":"2026-08-16T13:59:41.097676Z","submitted_at":"2024-04-18T17:37:02Z","title":"From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12358","snapshot_observed_at":"2026-08-05T14:42:22.344947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.344947Z"},"links":{"cited_paper":"/paper/2404.12358","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:1311d15a6b761bd1dbabb78016e3fbcd5c28f6a26943f3ee555945a84b0ef083","observation_id":"506981d4-0316-4bc6-be19-363c8232b831","resolution":{"observed_at":"2026-08-05T14:42:22.344947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.349971Z","title":"D.; Ermon, S.; and Finn, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.349971Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:016d4ba66e7a5f753b051109b236cc7018b1b6bd79f9514b08f314e49bc3c028","observation_id":"410a884b-1889-4fa0-8759-aa64e1820ae6","resolution":{"observed_at":"2026-08-05T14:42:22.349971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.354571Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.354571Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:3e41f581c3011f7f83278656b2e681d14824fa3e20dbf536cb6207b154957e4b","observation_id":"7f58168f-ffa2-4e1a-8301-abe13d006b47","resolution":{"observed_at":"2026-08-05T14:42:22.354571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:22.359936Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.359936Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:d21d63ff39bba5cc24044c98a0db945bfbb237ed3b2a8215e85733c3480f90dd","observation_id":"b21c10ea-7e63-4108-8bec-b8b4d627db30","resolution":{"observed_at":"2026-08-05T14:42:22.359936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.461814Z","title":null,"venue":null,"work_id":"65ec95b4-6910-4aff-a1b8-ea1664eb5627","year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.364590Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:2424e3b21c38060e761771bc3456177986b3375ff16d271d2cb775a542063e5c","observation_id":"6aaf30ea-0ec4-44a1-9d12-f3031577a7fd","resolution":{"observed_at":"2026-08-05T14:42:23.467023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.444610Z","title":null,"venue":null,"work_id":"3d1c7fa8-63e7-462f-aafe-ac3b20135dd2","year":2021},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.369687Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:bb5af627c9baf1155e137919f201224a94d5cc8887ea53c4966d6b66be9b99f5","observation_id":"2cee3b5a-d185-456f-922c-40af865bfa62","resolution":{"observed_at":"2026-08-05T14:42:23.450161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T14:42:22.375167Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.375167Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:c73cf476865e2d8480d533a4283a3ac4692b72ccb42816c4806247adebbf7569","observation_id":"a1d1980c-d34a-4fce-90d4-86515ab12e5a","resolution":{"observed_at":"2026-08-05T14:42:22.375167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T14:42:22.381637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.381637Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:e654b0d526d016c405ebfe591f7098bedf5c355e2355eab0c2f0be40087c5660","observation_id":"fe7eb3a0-829a-4352-9bdd-6173339a1843","resolution":{"observed_at":"2026-08-05T14:42:22.381637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02819","last_updated":"2025-06-08T05:40:55Z","snapshot_observed_at":"2026-08-16T12:53:07.867186Z","submitted_at":"2025-03-04T17:46:51Z","title":"Feynman-Kac Correctors in Diffusion: Annealing, Guidance, and Product of Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02819","snapshot_observed_at":"2026-08-05T14:42:22.387984Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.387984Z"},"links":{"cited_paper":"/paper/2503.02819","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:43db41d95d5a80dd7d26940e12a8f948939b7e79a819348a7db82b8e03e18c35","observation_id":"e1e67a8e-2637-4a3f-b8ca-b11796ff644a","resolution":{"observed_at":"2026-08-05T14:42:22.387984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T14:42:22.393601Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.393601Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:9103306bc6d222ced935e2c97540b2e9e781d95a23cc9f9a537d7c2ccc020cc4","observation_id":"6863f946-2ed8-4327-879a-be101727b78e","resolution":{"observed_at":"2026-08-05T14:42:22.393601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-05T14:42:22.399991Z","title":"P.; Kumar, A.; Ermon, S.; and Poole, B","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.399991Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:7752a6e3f17f915af2921b7ebc5cbb5cdf550942f188339c8952f226ad699521","observation_id":"6961d1a9-94a6-4f57-8a5c-a70ea13c91c4","resolution":{"observed_at":"2026-08-05T14:42:22.399991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02407","last_updated":"2025-04-22T10:49:31Z","snapshot_observed_at":"2026-08-16T12:44:20.479001Z","submitted_at":"2025-04-03T08:57:15Z","title":"F5R-TTS: Improving Flow-Matching based Text-to-Speech with Group Relative Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02407","snapshot_observed_at":"2026-08-05T14:42:22.405894Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.405894Z"},"links":{"cited_paper":"/paper/2504.02407","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:fd86bb788051e966861317cedbc6614c6d20438a065fd7380391ff63db9accb1","observation_id":"c4e63a3a-d6be-4b11-9a66-f6f111ac4947","resolution":{"observed_at":"2026-08-05T14:42:22.405894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00482","last_updated":"2024-03-11T14:27:48Z","snapshot_observed_at":"2026-08-17T02:46:52.486829Z","submitted_at":"2023-02-01T14:47:17Z","title":"Improving and generalizing flow-based generative models with minibatch optimal transport","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00482","snapshot_observed_at":"2026-08-05T14:42:22.410951Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.410951Z"},"links":{"cited_paper":"/paper/2302.00482","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:227ca3ecd128c4be1566b10335f8d0ea28dba06875d54b6271afc0c5138a73cb","observation_id":"353e51e4-fb10-4da7-9abe-5c4b661d1f2c","resolution":{"observed_at":"2026-08-05T14:42:22.410951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18548","last_updated":"2025-03-13T16:48:34Z","snapshot_observed_at":"2026-08-16T12:55:19.473782Z","submitted_at":"2025-02-25T15:56:56Z","title":"What is the Alignment Objective of GRPO?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18548","snapshot_observed_at":"2026-08-05T14:42:22.416055Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.416055Z"},"links":{"cited_paper":"/paper/2502.18548","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:fe8e4a353ba54ef737369e2b3c27d084ed48b420853845dee1df00afe74427cd","observation_id":"abe3e218-3c61-4a80-9874-7cd98d65b5ff","resolution":{"observed_at":"2026-08-05T14:42:22.416055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.428553Z","title":null,"venue":null,"work_id":"da222169-17d0-403f-a5cb-3c03c7025897","year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.421027Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:9249beb43bfaa88661b4d19dc0fe959f75a69345270174ab66f8fbd9fa40d4eb","observation_id":"68f4abfb-8c0b-4976-8c74-286b39d2b6ef","resolution":{"observed_at":"2026-08-05T14:42:23.433202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T14:42:22.425577Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.425577Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:fa826599492c89e7dd37ae1adfe68fa4e16666ff904dcae107fe9419c299bbd2","observation_id":"62bb897e-36e3-40ae-8ca4-72e9363200ce","resolution":{"observed_at":"2026-08-05T14:42:22.425577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.412719Z","title":null,"venue":null,"work_id":"a1d19360-04ff-4078-8fbd-6eadf9f1e812","year":1992},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.430721Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:3aea7ca5a93924ffbcfede80da354177ffc8dc9fdf009f6c04b676130aa0fcaa","observation_id":"44622b7b-0a22-457a-b400-959c20f5e6e8","resolution":{"observed_at":"2026-08-05T14:42:23.417523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.393589Z","title":null,"venue":null,"work_id":"8689402d-5410-4384-8077-1b917d3d9553","year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.435770Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:286b98f2031f014d0a94d781f941e322cd946d398071c7a48d717be69d472ce6","observation_id":"cca8fd07-7dfe-4271-b53f-18e569c19dd2","resolution":{"observed_at":"2026-08-05T14:42:23.399598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T14:42:22.441703Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.441703Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:dcba8270ce92d179751465a9bb6f0fbb706933cb81d2c3e16535d53e64901239","observation_id":"8be7027c-db0b-463f-8eef-c1cfa47eaa20","resolution":{"observed_at":"2026-08-05T14:42:22.441703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.372974Z","title":null,"venue":null,"work_id":"96d1ec55-a9be-467d-8045-e4721f3f7793","year":2007},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.447275Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:9f8257ae3a657de8f6d4d6d84903e9992b5dfeb18237eda792010d74e1eca8a9","observation_id":"6fc77f98-4575-4218-8e62-c84e9a7b0553","resolution":{"observed_at":"2026-08-05T14:42:23.378995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13443","last_updated":"2023-12-07T20:49:03Z","snapshot_observed_at":"2026-08-16T14:41:09.188831Z","submitted_at":"2023-11-22T15:07:59Z","title":"Guided Flows for Generative Modeling and Decision Making","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13443","snapshot_observed_at":"2026-08-05T14:42:22.452258Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.452258Z"},"links":{"cited_paper":"/paper/2311.13443","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:fe3af26b6e4ea4d496785bdb62c8eb9e9fe9eec69670147d6e9b83e54a47415c","observation_id":"8011e350-6a7b-424d-8960-13d85d075101","resolution":{"observed_at":"2026-08-05T14:42:22.452258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:42:23.352771Z","title":null,"venue":null,"work_id":"b8238eef-3ed8-491f-8d79-cc65726263c7","year":2025},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.457966Z"},"links":{"citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:d70b6e1c3774e51ccd8ff7ff0b552b7ffd42d6e1b058ab1389f6f361fac0acee","observation_id":"1bc722fa-6767-4acd-b577-a6dde6f7111c","resolution":{"observed_at":"2026-08-05T14:42:23.358216Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T15:46:00.474608Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 3 inbound Pith citation observations for arXiv:2508.21016."}