{"as_of":"2026-08-16T16:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55b195cbaa40231c02983921d2f4a820a3512eabd0ab33f55db2b3c8705151c3","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:06:05.638607Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:44:36.655600Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-08T22:54:25.513562Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"cited_work":{"arxiv_id":"2412.18164","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18164","snapshot_observed_at":"2026-08-08T22:54:25.513562Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","venue":"cs.LG","work_id":"dd85871c-c38c-4cc2-b76e-9a0f626654f0","year":2024},"citing_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T22:54:24.883208Z"},"links":{"cited_paper":"/paper/2412.18164","citing_paper":"/paper/2502.04297"},"observation_digest":"sha256:bd005cc4a06a294697500314b1d33bc41b251b7bdec3c74f0f7e9aa3ab3d880a","observation_id":"f14339bd-36ae-4dd6-914c-2cd9e7c7f5ac","resolution":{"observed_at":"2026-08-08T22:54:25.519427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18164","snapshot_observed_at":"2026-08-15T16:44:36.655600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.655600Z"},"links":{"cited_paper":"/paper/2412.18164","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:0c45d1ab405cf3f8798e95d15e9df27bac4bcfc2d531cbbaceeb4500c8c7fdcc","observation_id":"86941e3d-e0ef-4513-8728-6c54adc717d2","resolution":{"observed_at":"2026-08-15T16:44:36.655600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18164/citation-record","integrity":"/paper/2412.18164/integrity","json":"/paper/2412.18164/citation-record.json","paper":"/paper/2412.18164"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:04.782289Z","title":"A green colored rabbit","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.782289Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:b9f86f6a2fbc0109f2d28fcfc2499c028fc91757d9d018ea632c7eb9087614ad","observation_id":"fa8d8526-c9d5-4a48-9711-e329351a6f43","resolution":{"observed_at":"2026-08-11T05:06:04.782289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.716665Z","title":"A survey on deep learning tools dealing with data scarcity: definitions, challenges, solutions, tips, and applications","venue":null,"work_id":"65bc9618-063b-4e42-870a-fae4b23a6b5a","year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.788282Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:49ca063d775aeb8dd54bcd2e859a9baaf3ee714f2577c81295caa99a80167680","observation_id":"35a1e955-2099-498d-a264-aa358315b02c","resolution":{"observed_at":"2026-08-11T05:06:07.724952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.692741Z","title":"A systematic review on data scarcity problem in deep learning: solution and applications","venue":null,"work_id":"0ff3213c-2c43-4113-a340-8d4bc859d25b","year":2022},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.793262Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:b91a5a2d29f1aa447a6aa9b0b3d44ecf3404758f15051f8540f985947ccee973","observation_id":"7cb003e6-f3e9-4279-916e-22b647fd6006","resolution":{"observed_at":"2026-08-11T05:06:07.702913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.674018Z","title":"An optimal control perspective on diffusion-based generative modeling","venue":null,"work_id":"f9972aa9-380a-4333-b215-999a070fba0a","year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.798016Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:b1e0bd89c666ea6545214f295a26272fdd7037744d59634791fdcb158d738c87","observation_id":"e74cd2a1-5d11-4afe-960e-c0b1cdb8248f","resolution":{"observed_at":"2026-08-11T05:06:07.679097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:04.803028Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.803028Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:6bca0868e6648541f83bb2c8f64d0a19591371f161f0e0fa1ed204791c2eba2c","observation_id":"a2902d7f-bfbc-4139-9078-8eab43d1dc4c","resolution":{"observed_at":"2026-08-11T05:06:04.803028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.651117Z","title":"Four wolves in the park","venue":null,"work_id":"e73015ba-443a-4641-af59-208ac20fe635","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.809937Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:03ccab19fed344c05d86a5f0ebafbd8acde62515ad24a2c3abee989db7c3aa33","observation_id":"ac9987fa-ff55-4780-89a5-92475bf9f1e6","resolution":{"observed_at":"2026-08-11T05:06:07.655404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.636725Z","title":"Global optimality guarantees for policy gradient methods","venue":null,"work_id":"1eb22ce4-1ae1-4731-b597-71ddc3149189","year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.815989Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:bdaf59c2a4a67c0b13fa393302835a1d7d8ceeb8beff5b365bb6dcea1ec1ad30","observation_id":"9e31e720-ff2c-4690-b87a-92848b4a9223","resolution":{"observed_at":"2026-08-11T05:06:07.641024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.620862Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":"570ee174-4957-47d9-9e06-ac97e6466358","year":null},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.820459Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:933b5cda9e4c4371fa8e36af3a5e63eaf183b2c862b15af24aa67c1935d83f17","observation_id":"0350f03f-1020-4464-a58d-f3ff84418e95","resolution":{"observed_at":"2026-08-11T05:06:07.625573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.08921","last_updated":"2019-07-29T20:26:16Z","snapshot_observed_at":"2026-08-14T16:04:02.994968Z","submitted_at":"2019-07-21T06:36:43Z","title":"LQR through the Lens of First Order Methods: Discrete-time Case","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.08921","snapshot_observed_at":"2026-08-11T05:06:04.831742Z","title":"LQR through the lens of first order methods: Discrete-time case","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.831742Z"},"links":{"cited_paper":"/paper/1907.08921","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:cedc534bdc3e9a2526dfea31d294cad8758d0d267a5d2ea9e4456da4ec76084a","observation_id":"15e89844-91f6-4bf6-9409-39799aec455b","resolution":{"observed_at":"2026-08-11T05:06:04.831742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.585845Z","title":"Fast global convergence of natural policy gradient methods with entropy regularization","venue":null,"work_id":"62ce1c42-d62d-4835-9c9d-061fe9a2684d","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.837340Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:5e38e1a84e08c6f8e8cd561b6208a6dc076e0d00e22cb395d3684ea06e96449c","observation_id":"0d4699b2-d9ea-4e58-8f6a-ebc841be060e","resolution":{"observed_at":"2026-08-11T05:06:07.590426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15807","last_updated":"2023-09-27T17:30:19Z","snapshot_observed_at":"2026-08-16T14:57:07.361681Z","submitted_at":"2023-09-27T17:30:19Z","title":"Emu: Enhancing Image Generation Models Using Photogenic Needles in a Haystack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15807","snapshot_observed_at":"2026-08-11T05:06:04.841586Z","title":"Emu: Enhancing image generation models using photogenic needles in a haystack","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.841586Z"},"links":{"cited_paper":"/paper/2309.15807","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:ca3534719aec1013332c89a0ad60dff4ab7483cdd49278639ed86a051795e417","observation_id":"8e618e5d-9bc6-47c5-ae61-5e3af5a42fad","resolution":{"observed_at":"2026-08-11T05:06:04.841586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.573177Z","title":"Diffusion models beat GANs on image synthesis","venue":null,"work_id":"874479ae-60f5-48b0-827b-befbd09dbc67","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.846998Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:fc0193b74d2c5edd532ad4bb5381e492da11821452fa4e9425d405774a722537","observation_id":"cf9e6dc4-c718-4532-a845-95c29af2eb94","resolution":{"observed_at":"2026-08-11T05:06:07.577362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.558715Z","title":"Jovanovi´ c","venue":null,"work_id":"ea0e0351-29c6-4ba6-ab66-e92e7d482f9f","year":2020},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.851635Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:2d7d4ba4a76458cd2de8c600f95f5a728ae06f7ab2a316fbfca774377cb6e2cc","observation_id":"b9f9fa83-6185-486a-9735-a35f71bb01cd","resolution":{"observed_at":"2026-08-11T05:06:07.563427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05908","last_updated":"2021-01-03T16:56:46Z","snapshot_observed_at":"2026-08-14T21:52:07.048587Z","submitted_at":"2016-06-19T21:02:30Z","title":"Tutorial on Variational Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05908","snapshot_observed_at":"2026-08-11T05:06:04.856708Z","title":"Tutorial on variational autoencoders","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.856708Z"},"links":{"cited_paper":"/paper/1606.05908","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:00ee30dee074e5ebb84e31ac3c195bc92f23e1ef45183abf0a791f313b218843","observation_id":"e664c4c4-ffd5-46b6-8b40-ab5ffdf39b72","resolution":{"observed_at":"2026-08-11T05:06:04.856708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.540709Z","title":"Adjoint matching: Fine- tuning flow and diffusion generative models with memoryless stochastic optimal control","venue":null,"work_id":"e6326f02-630e-406b-bff2-05c000d7b3bd","year":2025},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.869885Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:c27b620ace5676ed002ebfb753c4c41899f3115598a95d121340803cc83a5b7b","observation_id":"3adbb9e3-d812-44ac-8332-bf2b2c959e36","resolution":{"observed_at":"2026-08-11T05:06:07.545293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.522432Z","title":"Generative Adversarial Network (GAN): A general review on different variants of GAN and applications","venue":null,"work_id":"6c6df170-744d-4d75-9d51-82a5f79424d7","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.874450Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:240db90b877d75a06d9a9f3ea9a0591c960f925bf08f0cd9458a627559a81e53","observation_id":"3117154c-ee1e-48a9-999c-56c3a2593c54","resolution":{"observed_at":"2026-08-11T05:06:07.531436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.499952Z","title":"Optimizing DDPM Sampling with Shortcut Fine-Tuning","venue":null,"work_id":"de192bdd-69cc-4dad-9572-583f272cbd33","year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.879296Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:c1e5d22156905d67b7d824cf9c82c7ad7b05d5e3621891a937c5ff99a3c754b5","observation_id":"cc1f9125-9576-43be-a8a7-c16eed7f8d67","resolution":{"observed_at":"2026-08-11T05:06:07.506889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.479348Z","title":"Reinforcement learning for fine-tuning text-to-image diffusion models","venue":null,"work_id":"1b67148d-58a4-4af4-aca2-40fa5521e6aa","year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.884150Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:9bb89f5dbe96500401f442da2a21bd78a0060ad7c60eda8bd9bdeb3213b9b5fc","observation_id":"a21d6073-82a7-4df9-afab-51168ffc2dd6","resolution":{"observed_at":"2026-08-11T05:06:07.486479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.454601Z","title":"Stochastic policy gradient methods: Improved sample complexity for fisher-non-degenerate policies","venue":null,"work_id":"c87cdd2c-f8fb-4003-89ce-180e8a6acd19","year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.889012Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:5f4be41b36479f456ee0f0fea142bcf733e55eaf8a8afa12a33a11405033f71f","observation_id":"e5d4075c-48bb-42f4-b3e7-7493e8d7895c","resolution":{"observed_at":"2026-08-11T05:06:07.465349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.429628Z","title":"Global convergence of policy gradient methods for the linear quadratic regulator","venue":null,"work_id":"ef4d860a-cb33-4b04-8192-c2d7155eec11","year":2018},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.896292Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:b0348098db6fb951921e95a5b0556cc54bccbfacd827efa376953a523c3b8651","observation_id":"958e1eb6-6d35-42bf-9fa4-35036f72a340","resolution":{"observed_at":"2026-08-11T05:06:07.435107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.408216Z","title":"Understanding the limita- tions of conditional generative models","venue":null,"work_id":"c18ae91a-306e-49bb-9723-ab7993ba05e7","year":2020},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.900770Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:4ea737e0d68c6702beac418df1722ed4162bd704d509c9ddc0e01718bbe3d8a3","observation_id":"cdb50f85-04e8-4424-9f49-bab21e9b44d9","resolution":{"observed_at":"2026-08-11T05:06:07.413878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.388356Z","title":"Real analysis: modern techniques and their applications , volume 40","venue":null,"work_id":"efe73667-f7fd-448b-a441-ea1c9c35330f","year":1999},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.905539Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:ee52691511ea75c57972ee9addb295b9006d4220f7313c4751c2ca95bbed1a7a","observation_id":"d32cc061-ec27-4472-9800-ad0e0d8b693a","resolution":{"observed_at":"2026-08-11T05:06:07.396189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.369515Z","title":"Single-timescale actor-critic provably finds glob- ally optimal policy","venue":null,"work_id":"e501094c-6200-4acf-b544-7f290ac630f4","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.910096Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:b0966bab2574b6c2b05f9bddfdda4df9d8f973035d95a38497c4b7ec29bb6e30","observation_id":"6f8fda2d-7f17-4fbc-8ff8-bd9f32408464","resolution":{"observed_at":"2026-08-11T05:06:07.375457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.355460Z","title":"Current strategies to address data scarcity in artificial intelligence-based drug discovery: A comprehen- sive review","venue":null,"work_id":"fd7d01c7-70da-4c4b-a60e-0e2c6675e884","year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.914862Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:b32eb6d39cb4874b80bb075d7f45cdd44425fa22fd860535b19751b3b2ce1b4d","observation_id":"d36365a9-3dc7-4d14-817f-09fc4a655c6f","resolution":{"observed_at":"2026-08-11T05:06:07.360954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:04.919960Z","title":"Scaling laws for reward model overoptimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.919960Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:943f8f5aaf4ab61ee838b65d4c8ed5c50d2c4ef09ad063f5ba1583918a5b22d7","observation_id":"8d718361-ca1f-40b9-bf28-1aedfed08ead","resolution":{"observed_at":"2026-08-11T05:06:04.919960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04832","last_updated":"2025-08-10T14:23:13Z","snapshot_observed_at":"2026-08-16T13:20:32.511696Z","submitted_at":"2024-09-07T13:55:45Z","title":"Reward-Directed Score-Based Diffusion Models via q-Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04832","snapshot_observed_at":"2026-08-11T05:06:04.926215Z","title":"Reward-directed score-based diffusion models via q-learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.926215Z"},"links":{"cited_paper":"/paper/2409.04832","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:04685e219f58a81dfba2ac18b3071741957f21714459b265c5f3231700339b65","observation_id":"429bb7ef-a00d-4b33-93e2-974a1c426035","resolution":{"observed_at":"2026-08-11T05:06:04.926215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2311.14168","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.277849Z","title":"Fast policy learning for linear quadratic regulator with entropy regularization","venue":null,"work_id":"11eec6b3-7d9d-4c18-9d02-314f1b61ea67","year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.932456Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:922436f76326fd963ab3a30f330a685377867a16b79a7f9d3bf1e28d7f5913d7","observation_id":"57ffad3c-dfe0-42ec-b31c-eb9435446269","resolution":{"observed_at":"2026-08-11T05:06:06.292245Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.325496Z","title":"Policy gradient methods for the noisy linear quadratic regulator over a finite horizon","venue":null,"work_id":"4e18bf94-2e96-4bb3-b40a-b91dd056380b","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.940946Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:5c26ad1b87e8e194fbd76576ea4e52967409f80ff002606664e142a37cc80ccf","observation_id":"cfaddf97-f300-4542-ae57-2e2546cc5a57","resolution":{"observed_at":"2026-08-11T05:06:07.331672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08431","last_updated":"2025-04-09T23:06:03Z","snapshot_observed_at":"2026-08-16T15:48:05.583596Z","submitted_at":"2023-03-15T08:08:02Z","title":"Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators","version":5},"cited_work":{"arxiv_id":"2303.08431","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.08431","snapshot_observed_at":"2026-08-11T05:06:06.179433Z","title":"Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators","venue":"cs.LG","work_id":"882955b8-6aa4-492c-a8f6-a6b611f3978d","year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.945285Z"},"links":{"cited_paper":"/paper/2303.08431","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:1bb9125d53ea43929787046dca7d7f708af2c53a9de39dde8b545f79f207d555","observation_id":"787f1481-909c-4515-94f2-add56ddd11f1","resolution":{"observed_at":"2026-08-11T05:06:06.189114Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.300900Z","title":"Neural network-based score estimation in diffusion models: Optimization and generalization","venue":null,"work_id":"251f3e05-aa45-4d39-ae29-4cf3ed2028d7","year":null},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.953970Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:a377c549fae108dcf21d734529c644f97e5213318c1bcfd0dd291cbed99121bc","observation_id":"b8977c91-d17f-4511-bcf1-e66d12679e0b","resolution":{"observed_at":"2026-08-11T05:06:07.310274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.264361Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":"fa8984b1-2a02-4927-96e6-986401449c63","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.963607Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:9253d180836acdf6d9b0af65ea22ec1ce308bd86f0d8f1c3a7d106cf1565a927","observation_id":"6b737c60-0ec3-4a3d-bff2-5bdb588350ca","resolution":{"observed_at":"2026-08-11T05:06:07.271391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.285990Z","title":null,"venue":null,"work_id":"942ef89f-81ea-4d2f-bdbc-eaae15fbc8d0","year":null},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.958632Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:4aa7fe0dacb4cef5a443b50df33a5c24cac0bccb20c9278ba7b60446cd65225b","observation_id":"89053cc6-0578-45ca-8ee4-2d02fc3cbdc3","resolution":{"observed_at":"2026-08-11T05:06:07.290472Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.238976Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"360991e3-a14a-4701-a57b-6740ec33d30d","year":2022},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.977254Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:0c44af960e2e3049b6a64347d97dcd52a82b9a0c345a2f04ee52504ee7de1a46","observation_id":"00c53f23-3c15-4773-b868-1b93a5ca0573","resolution":{"observed_at":"2026-08-11T05:06:07.243895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:04.971817Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.971817Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:0fa7b3b5297bd7a46c93908913c5b3639b277c137610d834da5414b04a0bb63c","observation_id":"28a1d883-c37e-4644-8e0f-f552c78108b4","resolution":{"observed_at":"2026-08-11T05:06:04.971817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.193012Z","title":"Neural tangent kernel: Convergence and general- ization in neural networks","venue":null,"work_id":"26e03907-97d7-401f-9a21-12f8690dbf17","year":2018},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.990535Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:9b94072647ff2a2f04cc9b63e314686e53dfe93f669d08ddb5cd0c1c3730367e","observation_id":"601a6abe-edaa-416b-8f98-f660a9f81b26","resolution":{"observed_at":"2026-08-11T05:06:07.199561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.209176Z","title":"Estimation of non-normalized statistical models by score matching","venue":null,"work_id":"a59eb6a5-d473-444f-99bb-4f6a7b306e3b","year":2005},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.982094Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:0d698f009da1f4351c5f9ffc69895595188f31d42ed63be13eb19219b2dd947f","observation_id":"aea09c14-654b-4a9a-9702-0e0fc8dd7a93","resolution":{"observed_at":"2026-08-11T05:06:07.214037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12192","last_updated":"2023-02-23T17:34:53Z","snapshot_observed_at":"2026-07-06T14:55:12.100148Z","submitted_at":"2023-02-23T17:34:53Z","title":"Aligning Text-to-Image Models using Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12192","snapshot_observed_at":"2026-08-11T05:06:05.033870Z","title":"Aligning text-to-image models using human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.033870Z"},"links":{"cited_paper":"/paper/2302.12192","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:91127f0126a1dd6200f625bd58e2c4141411e0fe2693d447e55275c6f6989f07","observation_id":"1bcb12c3-f9ef-491f-b28a-7dd1d49ecf8d","resolution":{"observed_at":"2026-08-11T05:06:05.033870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.156754Z","title":"Provably efficient reinforcement learning with linear function approximation","venue":null,"work_id":"0c4b0fbf-bfa4-4df7-84b3-29c702c5a65b","year":2020},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.995683Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:410541ad93c88f3546375756882121e81011a2d0fcfd2f26504674314d07a141","observation_id":"fc9744f6-4f71-47bb-9ecd-27d9e7456071","resolution":{"observed_at":"2026-08-11T05:06:07.174749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.110635Z","title":"Neural trust region/proximal policy optimization attains globally optimal policy","venue":null,"work_id":"e7e5785c-5de7-49b4-8a4f-e989ac0b0963","year":2019},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.084852Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:0dc98afd07d347bab9e668edf7a4ae7b5168dc84549afa98d7cc4b93ad1bd2ab","observation_id":"59165ce3-98dd-46df-beae-8750a6abbf16","resolution":{"observed_at":"2026-08-11T05:06:07.115842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.130092Z","title":"Towards non-asymptotic convergence for diffusion- based generative models","venue":null,"work_id":"6ec42fbd-0d25-4b52-a975-120b965e2d68","year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.041803Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:5b43f2960f4cddbd7658e8b4c973896e63fc072379df93c5c08a27ca41460282","observation_id":"3c51fad4-025a-468a-b697-6e7453a2862b","resolution":{"observed_at":"2026-08-11T05:06:07.134563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10959","last_updated":"2025-04-23T00:10:54Z","snapshot_observed_at":"2026-08-16T13:42:34.894306Z","submitted_at":"2024-06-16T14:31:26Z","title":"Convergence Analysis for Entropy-Regularized Control Problems: A Probabilistic Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10959","snapshot_observed_at":"2026-08-11T05:06:05.108862Z","title":"On convergence analysis of policy iteration algorithms for entropy-regularized stochastic control problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.108862Z"},"links":{"cited_paper":"/paper/2406.10959","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:e75fc12e8684bb8ea914e25e93d2090b13f7d581e86a7d06d0a02c2f11aea991","observation_id":"bfcca9c3-49bd-4da1-80ca-1652a208d86d","resolution":{"observed_at":"2026-08-11T05:06:05.108862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.074768Z","title":"An improved analysis of (variance-reduced) policy gradient and natural policy gradient methods","venue":null,"work_id":"145de6d2-4c76-41f4-947e-cede099c8768","year":2020},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.096063Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:a84a5daefcd196a720c6f24ccfcf605a8102304d8e542a423db41a2d63094214","observation_id":"21592397-21b0-4be7-b569-78ecbe28682b","resolution":{"observed_at":"2026-08-11T05:06:07.079791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.031101Z","title":"Global expo- nential convergence of gradient methods over the nonconvex landscape of the linear quadratic regulator","venue":null,"work_id":"358a35bd-45fb-4d17-9aac-1f6fe4ac7648","year":2019},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.164753Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:00934cd2fbebe35d8f5b1d7985b196bab7eca97b010ce905417e3903e2d49c1f","observation_id":"a7493859-4bc6-4a7e-8991-0a77bf8aa73f","resolution":{"observed_at":"2026-08-11T05:06:07.036962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.051358Z","title":"Bartlett, and Martin J","venue":null,"work_id":"a6255261-6baf-418e-9fbb-e726a65665a2","year":2019},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.145548Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:9330f48b905c4d70e75e3a1d763b9b0f60a3fefa317dfa4537100c00dd8ee87f","observation_id":"7e995353-f2fe-4f4f-9ae7-ad80e8743982","resolution":{"observed_at":"2026-08-11T05:06:07.056214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05966","last_updated":"2024-07-08T14:05:03Z","snapshot_observed_at":"2026-08-16T13:36:09.446614Z","submitted_at":"2024-07-08T14:05:03Z","title":"On Bellman equations for continuous-time policy evaluation I: discretization and approximation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05966","snapshot_observed_at":"2026-08-11T05:06:05.203938Z","title":"On Bellman equations for continuous-time policy evaluation I: discretiza- tion and approximation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.203938Z"},"links":{"cited_paper":"/paper/2407.05966","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:f81df07d3721bed594530dc03c1b26ba04492349c40b6bf040f4aa4dc0ab2f03","observation_id":"4a6f0fe6-733d-4045-81fc-db085f31bbf0","resolution":{"observed_at":"2026-08-11T05:06:05.203938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.010620Z","title":"Improved sample complexity analysis of natural policy gra- dient algorithm with general parameterization for infinite horizon discounted reward markov decision processes","venue":null,"work_id":"788a4a3d-765f-4993-ac89-a3f1cb7b2326","year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.195795Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:0fb6d104cf68251897c2fbbd9bc619138b0fea1f02ea7a86822c22f8acd86f7a","observation_id":"503e6792-8832-4c44-b414-e07b3b97ebbb","resolution":{"observed_at":"2026-08-11T05:06:07.018645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-11T05:06:05.226583Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.226583Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:2a5fe2db38d7ad5452ba86fdef6ffa4c8504ce1f4442785fff81f35a3d816d4f","observation_id":"4d4fc512-6f82-4781-8bc7-6d5abb622394","resolution":{"observed_at":"2026-08-11T05:06:05.226583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:05.220440Z","title":"Sora: Creating video from text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.220440Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:c4f28fda1ecb80de9cc073365189ca4c9771d4df7d756138487907136caba6fc","observation_id":"17d66263-da56-45e9-a19c-687d07e549ee","resolution":{"observed_at":"2026-08-11T05:06:05.220440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-11T05:06:05.242869Z","title":"Hierarchical text- conditional image generation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.242869Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:8cf9c1015a0a9f995c76f153e70d7bdb7b332123ac7de3fb75bc6e43e5f27120","observation_id":"f959cd35-34d0-498a-a66d-0d8933c02134","resolution":{"observed_at":"2026-08-11T05:06:05.242869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:05.235851Z","title":"Random features for large-scale kernel machines","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.235851Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:14fb6b5f538652204d4db6f0683be7488060965d0f67da580cfb8560ea503226","observation_id":"02957637-6a41-49b4-a8bd-4292a31d0272","resolution":{"observed_at":"2026-08-11T05:06:05.235851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:05.255728Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.255728Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:454601c9f76134f39630cbead2dd7e0749d4d943f58c0add93891b493f520c03","observation_id":"2ffaaf0d-b06c-4dba-9a64-b8a739bbb37a","resolution":{"observed_at":"2026-08-11T05:06:05.255728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.966858Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":"a4be6673-4d42-42ac-a059-df083af20ee2","year":2022},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.247189Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:de0c991c72a1c64abaec6726a73c27c1c66df102668544164d90fc02cf84c95f","observation_id":"52a93bb1-b5a8-4bb7-95bc-062aecf02d32","resolution":{"observed_at":"2026-08-11T05:06:06.973206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:05.273826Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.273826Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:bb802f9c4d46b003f7296fdb3f959955cf4651ecbb64b29c192fb392cf405f56","observation_id":"168015d2-f089-46c7-b55e-8d9704752e3e","resolution":{"observed_at":"2026-08-11T05:06:05.273826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.926627Z","title":"Low-rank adaptation for fast text-to-image diffusion fine-tuning","venue":null,"work_id":"670dc3bb-f270-4755-bc7b-55f8f555b19f","year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.260408Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:2a478558dc1ec736ef13c71da6b946e07735cc00b19cecc86fa99799cfee4d6f","observation_id":"539e4eaa-c2d2-45ee-98ed-960bad2cf1bc","resolution":{"observed_at":"2026-08-11T05:06:06.934866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.890698Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":"8abbe846-5ed2-4969-889c-50a3da314ff3","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.283957Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:c07372ac32c095b9bf8801cd9763b505ef228daa250edfddd8a0ea1129cd7ef3","observation_id":"f4d21df3-4525-4f25-b01f-28f399decc63","resolution":{"observed_at":"2026-08-11T05:06:06.895826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:05.278921Z","title":"Generative modeling by estimating gradients of the data distribution","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.278921Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:235582cf1e6d41d74810d7f64eced2b12eb0c368cbbcb88e7f941b2a69e634a0","observation_id":"a58279c3-5623-449c-a46c-d19a4c82bd0f","resolution":{"observed_at":"2026-08-11T05:06:05.278921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10264","last_updated":"2021-12-19T21:47:04Z","snapshot_observed_at":"2026-08-13T17:12:23.615709Z","submitted_at":"2021-12-19T21:47:04Z","title":"Exploration-exploitation trade-off for continuous-time episodic reinforcement learning with linear-convex models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10264","snapshot_observed_at":"2026-08-11T05:06:05.304761Z","title":"Exploration-exploitation trade-off for continuous-time episodic reinforcement learning with linear-convex models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.304761Z"},"links":{"cited_paper":"/paper/2112.10264","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:78d1260a3bc0f0ecba7f31af35fbe4113272af6f95c12e5ca71f1acb31168dda","observation_id":"667f8fb7-24ad-431f-8a4b-2cb942244e39","resolution":{"observed_at":"2026-08-11T05:06:05.304761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:05.288274Z","title":"Support vector machines","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.288274Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:ee813d73258a4d79f14946e459d2468aa7d0350394a462b03478e70714b1792f","observation_id":"cd84866f-5688-4c4a-a113-f206db659669","resolution":{"observed_at":"2026-08-11T05:06:05.288274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:05.365150Z","title":"Fine-tuning of diffusion models via stochastic control: entropy regularization and beyond","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.365150Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:f8323527904a0e4283e687f790717404c55093cf5caf9b4da81b182a781199cf","observation_id":"5e6f4510-01a0-4f55-af16-e69ca2f95973","resolution":{"observed_at":"2026-08-11T05:06:05.365150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.866332Z","title":"Optimal scheduling of entropy regularizer for continuous-time linear-quadratic reinforcement learning","venue":null,"work_id":"8a994760-9cdc-4d2a-a8b2-0bea3d318d12","year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.347833Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:a33f3ca44ebd68c8582fc2d76f98429cd82989cbd3dc3c36608b219e687c034a","observation_id":"dad2ee27-4993-4e4d-95ac-467de4b2b2eb","resolution":{"observed_at":"2026-08-11T05:06:06.871493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.849243Z","title":"Feedback efficient online fine- tuning of diffusion models","venue":null,"work_id":"11addce1-d998-476b-8596-7bf66392561c","year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.384745Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:f9bab4e6330164f3539f28ce72c4573452d3b0bafd8cc01c34a1c3de14e811b0","observation_id":"4b0dd730-8fef-4e84-8a1d-b8ef90f36887","resolution":{"observed_at":"2026-08-11T05:06:06.853852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13734","last_updated":"2024-07-18T17:35:32Z","snapshot_observed_at":"2026-08-16T13:32:57.699401Z","submitted_at":"2024-07-18T17:35:32Z","title":"Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13734","snapshot_observed_at":"2026-08-11T05:06:05.371203Z","title":"Understanding reinforcement learning-based fine-tuning of diffusion models: A tutorial and review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.371203Z"},"links":{"cited_paper":"/paper/2407.13734","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:73154c724fdab96ec942bbd0f2ed27d3397a0b7f12dfd3212e9cc7d11c8b3014","observation_id":"9e412924-b024-47c8-9f43-ff86adb32b95","resolution":{"observed_at":"2026-08-11T05:06:05.371203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.832452Z","title":"Diffusion model alignment using direct pref- erence optimization","venue":null,"work_id":"a9e50428-f67b-4c6f-8ac7-cda600dcff87","year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.412058Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:f9dd8574eb4a0cbf3cd8f6f95ed641239448bd9852423df5345f62179ee6640f","observation_id":"fa2cf287-f0b6-4139-b824-e35eaca26f05","resolution":{"observed_at":"2026-08-11T05:06:06.838016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19673","last_updated":"2024-05-31T18:34:35Z","snapshot_observed_at":"2026-08-16T13:47:56.044799Z","submitted_at":"2024-05-30T03:57:29Z","title":"Bridging Model-Based Optimization and Generative Modeling via Conservative Fine-Tuning of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19673","snapshot_observed_at":"2026-08-11T05:06:05.398473Z","title":"Bridging model-based optimization and generative modeling via conservative fine-tuning of diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.398473Z"},"links":{"cited_paper":"/paper/2405.19673","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:f9db84cf9da10b312b4d7fd7f4f64c506c680353009f1410f6089e1e0088566d","observation_id":"a5cf05a3-2809-43d7-a9b3-c4c162083f2a","resolution":{"observed_at":"2026-08-11T05:06:05.398473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.773445Z","title":"Neural policy gradient methods: Global optimality and rates of convergence","venue":null,"work_id":"e655d079-6eea-4cd7-a072-59b3b73e6826","year":2020},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.464752Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:239333abdb2d721a28e52621fb03111e2a371e137f07daf15b6e0d6c6e9ae6cc","observation_id":"5287573f-d3b6-4adc-acbf-3f7d532e7989","resolution":{"observed_at":"2026-08-11T05:06:06.781968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.810891Z","title":"Reinforcement learning in continuous time and space: A stochastic control approach","venue":null,"work_id":"73d0de8d-50c6-422a-b081-5321bd5e6ed9","year":2020},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.428931Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:234b2e59be43c95d33f09e23c6b5baf02de0efcaa4d0885c015803139f63f894","observation_id":"80d3efde-abf2-4a1b-83a8-0f6ada74f749","resolution":{"observed_at":"2026-08-11T05:06:06.815846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.733570Z","title":"On the convergence rates of policy gradient methods","venue":null,"work_id":"c37f5bb0-5769-47f9-a5d6-00368880d932","year":2022},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.475538Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:cdd82ee7e070b3fd6de3a6731c288bef1b1d071c24018b9d95a591364d4fb0b1","observation_id":"f61ee642-85a2-41b2-bad2-ca0047b8c096","resolution":{"observed_at":"2026-08-11T05:06:06.740111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:05.470180Z","title":"De novo design of protein structure and function with rfdiffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.470180Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:71d93fc3f4c1ade9c7aaa52f1b1fee182e3c9b28fee2b75faf0ef4c9214c453d","observation_id":"cd62b26a-a901-4a97-b1be-7059df215b7c","resolution":{"observed_at":"2026-08-11T05:06:05.470180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.690104Z","title":"Doubly robust off-policy actor-critic: Convergence and optimality","venue":null,"work_id":"a1fde996-7c09-4fed-a697-4065ef060925","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.490494Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:213e4f4dc2d39f3f5d8187f04a0237b5cdc925da1c9c55478c8023e6526ea57a","observation_id":"f7d49c05-905e-4b5d-95e4-97cf6e00748e","resolution":{"observed_at":"2026-08-11T05:06:06.696704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.707710Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"219d08ae-4fcf-4a57-8bbd-8b0c27bc8e34","year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.480696Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:f418b7ca24fea3ece7b3ba18736f370c8b05ff12ed1694362cca463c34bd0556","observation_id":"eee13c1a-6374-44aa-a353-5beb502f1939","resolution":{"observed_at":"2026-08-11T05:06:06.714562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.644749Z","title":"Some fine properties of backward stochastic differential equations","venue":null,"work_id":"9547c3c8-9b0d-450a-9af4-a59fda44976e","year":2001},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.544757Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:feed1b5cf79d076e2082c217336aa67a9922681d43b0d6189078472c20f774ee","observation_id":"ef0c28ac-8c30-4151-8782-b730a223912a","resolution":{"observed_at":"2026-08-11T05:06:06.651255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.663604Z","title":"Policy mirror descent for regularized reinforcement learning: A generalized framework with linear convergence","venue":null,"work_id":"5f836fb9-f6de-411f-a4b3-8fc9e29c11bc","year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.504748Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:977c238b2c627502934c52c7717f1e34cc87a42ccbd967a24907c8584a5cf5b0","observation_id":"d6af2827-3c8c-4cdd-8d65-fbcbd6e29c15","resolution":{"observed_at":"2026-08-11T05:06:06.672312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.589872Z","title":"Variational policy gradient method for reinforcement learning with general utilities","venue":null,"work_id":"00f0b980-4194-4df0-8b0e-8e2b41f09ccd","year":2020},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.578991Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:668943f48f6e93cc2f3387d2429c0a83f4a616fe3ba538a6f4b5949205624f43","observation_id":"941658cb-3559-4e9e-b81f-f6688f64c35e","resolution":{"observed_at":"2026-08-11T05:06:06.602432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.617077Z","title":"Backward stochastic differential equations","venue":null,"work_id":"655b767b-e701-4a16-a38f-fdd3cef22fcf","year":2017},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.571548Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:4a669564d196956aca51753fa6f3b3a135a68136ad3477cf9953e6b1cedbfa3f","observation_id":"7be320c7-903d-435c-90a1-538fe2dbc0d1","resolution":{"observed_at":"2026-08-11T05:06:06.631399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08400","last_updated":"2024-09-12T21:12:21Z","snapshot_observed_at":"2026-08-16T13:18:59.832527Z","submitted_at":"2024-09-12T21:12:21Z","title":"Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08400","snapshot_observed_at":"2026-08-11T05:06:05.597764Z","title":"Scores as actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.597764Z"},"links":{"cited_paper":"/paper/2409.08400","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:138df12f675cf76fc71990cf12965d9862b6b718b24f915a524c4834f1789452","observation_id":"c0f187bd-8675-4452-9bc2-fd375ebfa5a5","resolution":{"observed_at":"2026-08-11T05:06:05.597764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.570296Z","title":"Provably efficient actor-critic for risk-sensitive and robust adversarial RL: A linear-quadratic case","venue":null,"work_id":"0ae412db-47df-4117-9448-57cdaa63baa6","year":2021},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.587750Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:aa981b1728f5ec2476c6e00bd692e4b1a51a4dd53e19ce5b6ac2d9f1e606cabd","observation_id":"26d2adc9-7017-480a-b1f6-663ab75d96a3","resolution":{"observed_at":"2026-08-11T05:06:06.574629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05816","last_updated":"2025-04-14T17:34:46Z","snapshot_observed_at":"2026-08-16T15:56:00.499549Z","submitted_at":"2023-02-11T23:30:50Z","title":"A Policy Gradient Framework for Stochastic Optimal Control Problems with Global Convergence Guarantee","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05816","snapshot_observed_at":"2026-08-11T05:06:05.612435Z","title":"A policy gradient framework for stochastic optimal control problems with global convergence guarantee","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.612435Z"},"links":{"cited_paper":"/paper/2302.05816","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:a8a0c05af96b359ad57e4f1866aa5bd2d61d9e84166657fc53ada1d4ac360732","observation_id":"7f7ba3cb-de81-422d-89ca-aa4de99dd92f","resolution":{"observed_at":"2026-08-11T05:06:05.612435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12120","last_updated":"2025-02-24T02:16:23Z","snapshot_observed_at":"2026-08-16T13:42:02.545988Z","submitted_at":"2024-06-17T22:00:26Z","title":"Adding Conditional Control to Diffusion Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12120","snapshot_observed_at":"2026-08-11T05:06:05.605157Z","title":"Adding conditional control to diffusion models with reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.605157Z"},"links":{"cited_paper":"/paper/2406.12120","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:64d02b441e8acb1405c204b098b5140b8b04bf65378f46aeb973a6d401511f1c","observation_id":"f3511787-1050-4708-9488-ff946b21a301","resolution":{"observed_at":"2026-08-11T05:06:05.605157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17208","last_updated":"2025-01-24T00:35:16Z","snapshot_observed_at":"2026-08-16T14:15:03.367730Z","submitted_at":"2024-02-27T04:57:23Z","title":"Solving Time-Continuous Stochastic Optimal Control Problems: Algorithm Design and Convergence Analysis of Actor-Critic Flow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17208","snapshot_observed_at":"2026-08-11T05:06:05.638607Z","title":"Solving time-continuous stochastic optimal control problems: Algorithm design and convergence analysis of actor-critic flow","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.638607Z"},"links":{"cited_paper":"/paper/2402.17208","citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:d695d662c80d819bb5b6f1a3709f467bd4364a7b18583abf504629770b26b0a8","observation_id":"18c3c241-21f8-4dea-aaa3-736faae3942a","resolution":{"observed_at":"2026-08-11T05:06:05.638607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:06.540249Z","title":"Single timescale actor-critic method to solve the linear quadratic regulator with convergence guarantees","venue":null,"work_id":"9cba79c5-ee2d-419c-af16-29db8af09263","year":2023},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:05.627699Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:d2f0288d240a8a283d446eb09e8e81d3bc78c6e796808e9771f6c91dc222816b","observation_id":"0be7e781-41a6-4c3c-969a-e7849765117d","resolution":{"observed_at":"2026-08-11T05:06:06.550221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:06:07.598668Z","title":null,"venue":null,"work_id":"dd270ff8-4de7-4dc5-afdc-95edab92fdcc","year":null},"citing_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T05:06:04.826248Z"},"links":{"citing_paper":"/paper/2412.18164"},"observation_digest":"sha256:7be0c45a99a32148b46a5d2b4b624d2947a634b81370dff090ca6f6bb5719033","observation_id":"1dde8b53-9889-4672-af7e-be11d868b13a","resolution":{"observed_at":"2026-08-11T05:06:07.606570Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":2,"verified_fuzzy":49},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 2 inbound Pith citation observations for arXiv:2412.18164."}