{"as_of":"2026-08-10T15:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fdb3adeaed308037d8d977bb5bdb78eb848e101b0c9b9f918353fe1fb5ed3b56","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:29:12.477304Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T18:33:52.933672Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T18:38:53.000576Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2502.01819","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01819","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D., and Tang, W","venue":null,"work_id":"7535c391-610f-45a5-aab5-733842c622e9","year":2025},"citing_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-06T11:11:00.378627Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-11T18:45:16.641012Z"},"links":{"cited_paper":"/paper/2502.01819","citing_paper":"/paper/2505.05470"},"observation_digest":"sha256:515257bdc01fcfda82e455eacf55a742c10f3615ac2b4a3d37ab4938f6f1a630","observation_id":"4e45631e-d946-4b7a-b80d-c6d1cbbcb9e7","resolution":{"observed_at":"2026-05-11T18:45:16.728520Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2502.01819","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01819","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D., and Tang, W","venue":null,"work_id":"7535c391-610f-45a5-aab5-733842c622e9","year":2025},"citing_paper":{"arxiv_id":"2603.00918","last_updated":"2026-05-10T14:01:21Z","snapshot_observed_at":"2026-07-06T22:47:24.369805Z","submitted_at":"2026-03-01T04:39:09Z","title":"Improving Text-to-Image Generation with Intrinsic Self-Confidence Rewards","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-15T18:40:18.940889Z"},"links":{"cited_paper":"/paper/2502.01819","citing_paper":"/paper/2603.00918"},"observation_digest":"sha256:5c5b0b79d83c313bd83daa245f58e809eb3e7395256bab92c443fea74aee0156","observation_id":"6c6aee69-8f73-4a82-999d-d86651382aeb","resolution":{"observed_at":"2026-05-15T18:41:28.922983Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2502.01819","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01819","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D., and Tang, W","venue":null,"work_id":"7535c391-610f-45a5-aab5-733842c622e9","year":2025},"citing_paper":{"arxiv_id":"2605.05530","last_updated":"2026-05-07T00:18:55Z","snapshot_observed_at":"2026-07-06T23:18:07.750358Z","submitted_at":"2026-05-07T00:18:55Z","title":"Energy Generative Modeling: A Lyapunov-based Energy Matching Perspective","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-09T16:05:00.985070Z"},"links":{"cited_paper":"/paper/2502.01819","citing_paper":"/paper/2605.05530"},"observation_digest":"sha256:e3d9156f4689c7bfba80af6950f1b65322a05f6b8336df906827a138351d99d6","observation_id":"24c327ab-edde-46d3-8a47-fe166e38ee92","resolution":{"observed_at":"2026-05-11T16:36:08.216028Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2502.01819","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01819","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D., and Tang, W","venue":null,"work_id":"7535c391-610f-45a5-aab5-733842c622e9","year":2025},"citing_paper":{"arxiv_id":"2605.15803","last_updated":"2026-05-15T09:56:40Z","snapshot_observed_at":"2026-07-06T23:27:01.213106Z","submitted_at":"2026-05-15T09:56:40Z","title":"Embedding-perturbed Exploration Preference Optimization for Flow Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-20T18:33:52.933672Z"},"links":{"cited_paper":"/paper/2502.01819","citing_paper":"/paper/2605.15803"},"observation_digest":"sha256:1dcb945ac28e9a63b15023eb27a73a158ad2917319bb3cb7082667a873767ea9","observation_id":"0e4474a6-2ce3-46b3-9e89-59faa507c1ae","resolution":{"observed_at":"2026-05-20T18:38:53.002168Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01819/citation-record","integrity":"/paper/2502.01819/integrity","json":"/paper/2502.01819/citation-record.json","paper":"/paper/2502.01819"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-09T14:29:11.815314Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:11.815314Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:5bcc5f1972225c181e804936defbe1b8b36e6faab97e50d60bf529d66d56af87","observation_id":"9ad45e5c-fefb-4c69-b1fe-a6645a2c7d85","resolution":{"observed_at":"2026-08-09T14:29:11.815314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11215","last_updated":"2023-04-15T22:24:53Z","snapshot_observed_at":"2026-07-06T13:55:19.848757Z","submitted_at":"2022-09-22T17:55:01Z","title":"Sampling is as easy as learning the score: theory for diffusion models with minimal data assumptions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11215","snapshot_observed_at":"2026-08-09T14:29:11.949366Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:11.949366Z"},"links":{"cited_paper":"/paper/2209.11215","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:6a5d347b35a90a67bd6c9a35490bd9e6a28706763826fd9f57003ab9361c332c","observation_id":"8908ba33-e341-4015-9331-03746b77f918","resolution":{"observed_at":"2026-08-09T14:29:11.949366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13362","last_updated":"2024-09-19T20:42:34Z","snapshot_observed_at":"2026-08-10T07:03:48.005627Z","submitted_at":"2023-01-31T01:37:48Z","title":"Optimizing DDPM Sampling with Shortcut Fine-Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13362","snapshot_observed_at":"2026-08-09T14:29:12.102481Z","title":"and Lee, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.102481Z"},"links":{"cited_paper":"/paper/2301.13362","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:f85305439eec11c73f47b349f6a681a897195418162dd6ed0a86e5916d5393ab","observation_id":"6e0fa41b-a1e7-49e7-9910-ac1c14611548","resolution":{"observed_at":"2026-08-09T14:29:12.102481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16381","last_updated":"2023-11-01T04:48:26Z","snapshot_observed_at":"2026-08-09T13:57:01.633043Z","submitted_at":"2023-05-25T17:35:38Z","title":"DPOK: Reinforcement Learning for Fine-tuning Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16381","snapshot_observed_at":"2026-08-09T14:29:12.106970Z","title":"Dpok: Reinforcement learning for fine-tuning text-to-image dif- fusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.106970Z"},"links":{"cited_paper":"/paper/2305.16381","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:bdbb29c0262a739cae874a48a9eb0f5e5f8edb2974cc336ddb95b1e132423ef9","observation_id":"9d31d82f-5625-46b9-8dbc-719afcb9dcc9","resolution":{"observed_at":"2026-08-09T14:29:12.106970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04832","last_updated":"2025-08-10T14:23:13Z","snapshot_observed_at":"2026-08-09T09:19:48.529688Z","submitted_at":"2024-09-07T13:55:45Z","title":"Reward-Directed Score-Based Diffusion Models via q-Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04832","snapshot_observed_at":"2026-08-09T14:29:12.111582Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.111582Z"},"links":{"cited_paper":"/paper/2409.04832","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:0d062e2351a260c938e6d29f6f038d337c20fc6a36bd7290de9baf0fc7e44913","observation_id":"7b140705-6248-492b-a55b-9936f0285c30","resolution":{"observed_at":"2026-08-09T14:29:12.111582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09611","last_updated":"2023-12-29T10:15:15Z","snapshot_observed_at":"2026-08-10T13:12:19.702351Z","submitted_at":"2022-12-19T16:50:41Z","title":"Optimizing Prompts for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09611","snapshot_observed_at":"2026-08-09T14:29:12.116193Z","title":"Optimizing prompts for text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.116193Z"},"links":{"cited_paper":"/paper/2212.09611","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:63b9ba5ac20b3a949d2afa965f0ab160e3965d783529d7fe18fa4ca68d82d194","observation_id":"8c78c11f-a17a-4084-bb14-1053003b7e95","resolution":{"observed_at":"2026-08-09T14:29:12.116193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:29:13.473343Z","title":null,"venue":null,"work_id":"1a8d895f-184a-45e8-9ad2-e681f85c1ea9","year":2002},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.128862Z"},"links":{"citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:dbca3db9fd456fdb862aad242448e6bc8447a701e3dd172950c0512803e8d5c0","observation_id":"318bb216-e0e6-40c9-ab84-9732adb0c691","resolution":{"observed_at":"2026-08-09T14:29:13.477786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-09T14:29:12.137957Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.137957Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:985128a78a290ec675b1896f519630a7b69fa7740af552c4c5296bf3898e9df0","observation_id":"188b076e-de43-4217-8cb8-be549dd71121","resolution":{"observed_at":"2026-08-09T14:29:12.137957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-09T14:29:12.142340Z","title":"Hierarchical text-conditional image generation with clip latents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.142340Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:a0c2ab31cf60335565f259eb5bc7d58578a9c3e0a456545a8792c0a182560f56","observation_id":"bd203227-8bd3-4fd9-a681-d2e6ad307b98","resolution":{"observed_at":"2026-08-09T14:29:12.142340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00588","last_updated":"2024-12-09T21:30:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-01T02:47:50Z","title":"Diffusion Policy Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00588","snapshot_observed_at":"2026-08-09T14:29:12.146870Z","title":"Z., Lidard, J., Ankile, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.146870Z"},"links":{"cited_paper":"/paper/2409.00588","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:28176a71fb068e111e229fc6d4592cfc694317d2a08edfa5832cff0aaa0fb200","observation_id":"13bba21e-6c31-49c1-a0a5-6c9196c3db35","resolution":{"observed_at":"2026-08-09T14:29:12.146870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00512","last_updated":"2022-06-07T09:17:35Z","snapshot_observed_at":"2026-08-09T18:51:51.917654Z","submitted_at":"2022-02-01T16:07:25Z","title":"Progressive Distillation for Fast Sampling of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00512","snapshot_observed_at":"2026-08-09T14:29:12.151666Z","title":"and Ho, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.151666Z"},"links":{"cited_paper":"/paper/2202.00512","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:7d53d853135b0b7b2b7c7263eb2c9a26f77d639a886fa1084d7ac102cff7f3e7","observation_id":"b655a89a-93fb-4e3d-840d-8e4b5978885c","resolution":{"observed_at":"2026-08-09T14:29:12.151666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11807","last_updated":"2020-06-21T14:10:47Z","snapshot_observed_at":"2026-08-10T14:08:49.626998Z","submitted_at":"2020-06-21T14:10:47Z","title":"Improving Image Captioning with Better Use of Captions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11807","snapshot_observed_at":"2026-08-09T14:29:12.282159Z","title":"Improving image captioning with better use of captions","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.282159Z"},"links":{"cited_paper":"/paper/2006.11807","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:af67071e2a9728bf827675cb25c737b3d42bdf9fc416fe9ffff862f7ba35f3f9","observation_id":"f1e74cfb-e291-45f9-a336-5b54ba8f2d88","resolution":{"observed_at":"2026-08-09T14:29:12.282159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-09T14:29:12.359251Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.359251Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:fe838f06b4d1a67bebb74433c2ed51546bdb6a43e2ef6e6dded3faade1dc0f71","observation_id":"cefcffbe-160d-4714-8c1b-bc54d8e64a5e","resolution":{"observed_at":"2026-08-09T14:29:12.359251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08005","last_updated":"2022-06-16T00:01:39Z","snapshot_observed_at":"2026-08-06T05:01:09.365741Z","submitted_at":"2021-11-15T05:41:12Z","title":"Solving Inverse Problems in Medical Imaging with Score-Based Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08005","snapshot_observed_at":"2026-08-09T14:29:12.412419Z","title":"Solving inverse problems in medical imaging with score-based generative models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.412419Z"},"links":{"cited_paper":"/paper/2111.08005","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:1ea75f9208c0c7a5063695301ac3d5d8c0ed533a0724eacff0b25ad9f5d989ef","observation_id":"2eed287d-df1d-4f4f-b63e-981d1047143d","resolution":{"observed_at":"2026-08-09T14:29:12.412419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07487","last_updated":"2025-07-05T11:10:29Z","snapshot_observed_at":"2026-08-10T04:09:31.647896Z","submitted_at":"2024-02-12T08:52:35Z","title":"Score-based Diffusion Models via Stochastic Differential Equations -- a Technical Tutorial","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07487","snapshot_observed_at":"2026-08-09T14:29:12.423240Z","title":"and Zhao, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.423240Z"},"links":{"cited_paper":"/paper/2402.07487","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:5f83437c2f5fef898f4dff5e54a9b943be97cc3d14f8e014c8515f22bc2f45ed","observation_id":"547aceb9-289b-4e0c-8fd9-df5eac3c48b9","resolution":{"observed_at":"2026-08-09T14:29:12.423240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-07-06T17:34:28.430476Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-09T14:29:12.427168Z","title":"L., Tseng, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.427168Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:fa25b3443380caa01a3ff23dc827abab9ccbb7f5451265acedd882a1542574d9","observation_id":"68fbedcb-4df2-4a7d-8e21-43ba93e5d1a7","resolution":{"observed_at":"2026-08-09T14:29:12.427168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11564","last_updated":"2024-11-03T01:51:57Z","snapshot_observed_at":"2026-07-06T19:17:13.095667Z","submitted_at":"2024-09-17T21:28:51Z","title":"Preference Tuning with Human Feedback on Language, Speech, and Vision Tasks: A Survey","version":2},"cited_work":{"arxiv_id":"2409.11564","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.11564","snapshot_observed_at":"2026-08-09T14:29:12.917789Z","title":"Preference Tuning with Human Feedback on Language, Speech, and Vision Tasks: A Survey","venue":"cs.CL","work_id":"0338f7e2-ade3-4290-b1b5-33d497e5fa0a","year":2024},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.431395Z"},"links":{"cited_paper":"/paper/2409.11564","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:c1e5591ea30b7b9f464850555a63eeb81476841cce1ed2a3abdb658dd43b0a9e","observation_id":"71d5a541-b706-4bb9-9431-0d7e780f0a85","resolution":{"observed_at":"2026-08-09T14:29:12.924859Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02923","last_updated":"2022-03-06T09:47:01Z","snapshot_observed_at":"2026-07-06T12:44:48.852327Z","submitted_at":"2022-03-06T09:47:01Z","title":"GeoDiff: a Geometric Diffusion Model for Molecular Conformation Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02923","snapshot_observed_at":"2026-08-09T14:29:12.435649Z","title":"Geodiff: A geometric diffusion model for molecular con- formation generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.435649Z"},"links":{"cited_paper":"/paper/2203.02923","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:318ad85ac2311b04ad9c338e0ea2530cea7ceb654c5c9ed03a9ab084cbdbb518","observation_id":"155c2cbe-35a1-495b-9c67-dcdddbc2b032","resolution":{"observed_at":"2026-08-09T14:29:12.435649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00626","last_updated":"2024-10-31T11:39:25Z","snapshot_observed_at":"2026-07-06T18:39:03.315371Z","submitted_at":"2024-06-30T08:52:17Z","title":"Maximum Entropy Inverse Reinforcement Learning of Diffusion Models with Energy-Based Models","version":2},"cited_work":{"arxiv_id":"2407.00626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.00626","snapshot_observed_at":"2026-08-09T14:29:12.690749Z","title":"Maximum Entropy Inverse Reinforcement Learning of Diffusion Models with Energy-Based Models","venue":"cs.LG","work_id":"baa4a015-8ab3-4f93-b236-195720e88248","year":2024},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.439940Z"},"links":{"cited_paper":"/paper/2407.00626","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:4b1c356e89ca844c53d1bb2ccfaa5c6b8e231301be5662450060bf5ef610e0b9","observation_id":"5a7f53eb-6642-4d76-9d21-89c598da81b0","resolution":{"observed_at":"2026-08-09T14:29:12.769275Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10210","last_updated":"2024-02-15T18:59:18Z","snapshot_observed_at":"2026-08-06T16:28:32.870218Z","submitted_at":"2024-02-15T18:59:18Z","title":"Self-Play Fine-Tuning of Diffusion Models for Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10210","snapshot_observed_at":"2026-08-09T14:29:12.444589Z","title":"Self-play fine-tuning of diffusion models for text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.444589Z"},"links":{"cited_paper":"/paper/2402.10210","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:54d91cf2827ec057d8a9ce1d585d5bc88973964409d8122fcca0b63909222203","observation_id":"00abb90a-3f36-4d01-a015-2da311d0e575","resolution":{"observed_at":"2026-08-09T14:29:12.444589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13902","last_updated":"2023-02-25T20:30:35Z","snapshot_observed_at":"2026-08-10T13:42:43.630470Z","submitted_at":"2022-04-29T06:32:38Z","title":"Fast Sampling of Diffusion Models with Exponential Integrator","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.13902","snapshot_observed_at":"2026-08-09T14:29:12.448838Z","title":"and Chen, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.448838Z"},"links":{"cited_paper":"/paper/2204.13902","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:91bb5d39b5a6417e71cf04ef6629082ffc1b138809316f075e3c5267bb0bb56e","observation_id":"6625498d-78cf-4fa1-9122-0b04808df995","resolution":{"observed_at":"2026-08-09T14:29:12.448838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05564","last_updated":"2023-03-23T11:50:36Z","snapshot_observed_at":"2026-08-10T05:19:58.148559Z","submitted_at":"2022-06-11T16:57:23Z","title":"gDDIM: Generalized denoising diffusion implicit models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.05564","snapshot_observed_at":"2026-08-09T14:29:12.454146Z","title":"gddim: Generalized denoising diffusion implicit models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.454146Z"},"links":{"cited_paper":"/paper/2206.05564","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:e55178a4b40179efd5f93580587bb46fe605665ffaa4b628695dea28e6367ff9","observation_id":"a6e1ead3-d69c-4063-80ae-077782e590de","resolution":{"observed_at":"2026-08-09T14:29:12.454146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08400","last_updated":"2024-09-12T21:12:21Z","snapshot_observed_at":"2026-08-10T07:55:55.333973Z","submitted_at":"2024-09-12T21:12:21Z","title":"Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08400","snapshot_observed_at":"2026-08-09T14:29:12.459033Z","title":"D., and Tang, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.459033Z"},"links":{"cited_paper":"/paper/2409.08400","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:0dd58b7d9c22136db2933070fa60c7abd5fc350d0280e53c46fb45e687810ee4","observation_id":"c27a3190-1fc2-4762-aa19-1da2beda719d","resolution":{"observed_at":"2026-08-09T14:29:12.459033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:29:13.458304Z","title":"predicted x0","venue":null,"work_id":"dc81cf38-3ada-448e-8ca6-e4a4de71c1ab","year":2021},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.464031Z"},"links":{"citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:925fbbcf802b6d0e682fb03b44f66f7cb01417accdc59d0f9d542872530d32c4","observation_id":"fd453468-5b45-4d12-9523-fdef139f399e","resolution":{"observed_at":"2026-08-09T14:29:13.463637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:29:13.443321Z","title":"predicted x0","venue":null,"work_id":"c7363274-2f78-49e2-92b6-7bad0cc27e42","year":2021},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.468113Z"},"links":{"citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:c57f728ca1985f7f4d89119566c7e278f3e181aac7ed1a9abf0944247083f269","observation_id":"561c8ab2-6f62-410f-9e1a-749fb9e94e0b","resolution":{"observed_at":"2026-08-09T14:29:13.447926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:29:13.426730Z","title":"We adopt two ways of derivations: (a) Notice that, if we treat the ˆxθ (t, Xt) as a constant in (38) (or assume that it does not change w.r.p","venue":null,"work_id":"a52c3cef-05ed-4677-aa26-0777316656e9","year":2016},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.477304Z"},"links":{"citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:c70835445c10a4e677c5ed1cb89f2204598bf02ef863d9e1fc66fd7d5ea61deb","observation_id":"c14b68ca-c56b-414b-8899-dbbe163014b8","resolution":{"observed_at":"2026-08-09T14:29:13.432515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:29:12.419252Z","title":"Fine-tuning of diffusion models via stochastic control: entropy regularization and beyond","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.419252Z"},"links":{"citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:b0c568e4c0df9a6a1233eb92ad08370f258616d85f1ec670c378f52134924e24","observation_id":"23460e6b-4a91-4898-9901-f3cdde308fc1","resolution":{"observed_at":"2026-08-09T14:29:12.419252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-09T14:29:12.133392Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.133392Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:2ae960bbf2f309386b7c15fabeff81215bd2fdb9306eda5d452ed8769acbf126","observation_id":"99790938-35c3-4b29-af97-657a3b53ebff","resolution":{"observed_at":"2026-08-09T14:29:12.133392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T14:29:12.192879Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.192879Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:b105e3bd9baf0f3dc83a28bfc565aca6a037d6f1782a25a977d9200d7830a967","observation_id":"f003bc6f-d8b6-4a98-aeef-f1bde2c43243","resolution":{"observed_at":"2026-08-09T14:29:12.192879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17400","last_updated":"2024-06-21T16:45:11Z","snapshot_observed_at":"2026-08-06T10:08:54.816113Z","submitted_at":"2023-09-29T17:01:02Z","title":"Directly Fine-Tuning Diffusion Models on Differentiable Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17400","snapshot_observed_at":"2026-08-09T14:29:12.019456Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.019456Z"},"links":{"cited_paper":"/paper/2309.17400","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:b4b0846890ddfd7c2c1570f166e66b966d497a181589e58e7dd9badd9d277cc6","observation_id":"198a0a69-340c-42b8-8ad4-d38c508af818","resolution":{"observed_at":"2026-08-09T14:29:12.019456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-09T14:29:12.120433Z","title":"P., Poole, B., Norouzi, M., Fleet, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.120433Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:b1cb7cd697f7ac51b364dcf411af82126f671ad7b926461f40f8b73c775d1f73","observation_id":"5097f194-b6d8-435f-a81e-d766c142c8af","resolution":{"observed_at":"2026-08-09T14:29:12.120433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08861","last_updated":"2025-01-07T18:12:27Z","snapshot_observed_at":"2026-08-07T18:29:43.318422Z","submitted_at":"2024-09-13T14:22:14Z","title":"Adjoint Matching: Fine-tuning Flow and Diffusion Generative Models with Memoryless Stochastic Optimal Control","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08861","snapshot_observed_at":"2026-08-09T14:29:12.091436Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.091436Z"},"links":{"cited_paper":"/paper/2409.08861","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:15ddea8776a45ef5f953384ca363e643a420b060274cea9e13e43ecf896f64e1","observation_id":"d922e02d-ad8e-4824-bfa9-30962aeefab4","resolution":{"observed_at":"2026-08-09T14:29:12.091436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-09T14:29:12.125068Z","title":"J., Shen, Y ., Wallis, P., Allen-Zhu, Z., Li, Y ., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.125068Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:64dbe66a6d952cbd05efc9c73af97cdc7e58d25d8a49b9a3514ddcd9e7a10ec5","observation_id":"9aa508f7-2248-432b-b9c5-1b476b2cb3ea","resolution":{"observed_at":"2026-08-09T14:29:12.125068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-09T14:29:11.879830Z","title":"T., Li, Y ., Lundberg, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:11.879830Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:89de2f6c5bd6ec99efe175fea9c83645e3c26bf3ac302873116e289d1293922b","observation_id":"27a024c8-43f9-48a7-85ab-26a0c86d5cb3","resolution":{"observed_at":"2026-08-09T14:29:11.879830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-09T14:29:12.096528Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T14:29:12.096528Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2502.01819"},"observation_digest":"sha256:005633a94588435bff773542df03a13e922319c9b095fd4e4b636dc7c343505a","observation_id":"8082898e-1517-48f2-a77b-5a873d46bf2d","resolution":{"observed_at":"2026-08-09T14:29:12.096528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T19:12:28.575818Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 4 inbound Pith citation observations for arXiv:2502.01819."}