{"as_of":"2026-08-16T00:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:830f0a4a7f7864e4b10db869fbe7f72fc128123fe979d1e2901ce17bdeca0fae","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:44:36.855313Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.02528/citation-record","integrity":"/paper/2509.02528/integrity","json":"/paper/2509.02528/citation-record.json","paper":"/paper/2509.02528"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.861772Z","title":"A tail inequality for suprema of unbounded empirical processes with applications to markov chains","venue":null,"work_id":"a98c6485-283a-460e-9952-74b539faad4b","year":2008},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.574676Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:58cf58554dbc68c4df77c4ecf56cae350a6ebae18b4f344b5f4734bf29708d0a","observation_id":"ce35b655-a1a8-4db1-b4df-c9f628aeb06a","resolution":{"observed_at":"2026-08-15T16:44:37.866601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.846901Z","title":null,"venue":null,"work_id":"c0ddad55-68a5-434f-95d4-3f05858dd226","year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.579570Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:22df62910ae6aa91cd793021b68c951bbf8f7487b8808874ff37b7e43d35ffa3","observation_id":"a6ea8990-d4fe-4572-be22-84bc2b3ff7b3","resolution":{"observed_at":"2026-08-15T16:44:37.852251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05780","last_updated":"2019-09-05T02:31:13Z","snapshot_observed_at":"2026-08-14T19:03:27.034761Z","submitted_at":"2018-06-15T01:35:03Z","title":"Surprising Negative Results for Generative Adversarial Tree Search","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05780","snapshot_observed_at":"2026-08-15T16:44:36.584243Z","title":"Azizzadenesheli, B","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.584243Z"},"links":{"cited_paper":"/paper/1806.05780","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:1ac347a6f0b6e80356aa90a4ac6ebbc4fe02bb65ebf244bb0dd719109319c840","observation_id":"2e81c948-05bc-48b6-a9c7-f80e217370dd","resolution":{"observed_at":"2026-08-15T16:44:36.584243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.832919Z","title":null,"venue":null,"work_id":"5494da17-8678-4a4f-8eab-83843d538dbe","year":2005},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.589195Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:7125bb110e2d02eb08efa256482fddf0a8554a2841d2df858dad9b6603478e80","observation_id":"bba7200c-4b76-4ce5-bbf4-44609ff0e3a6","resolution":{"observed_at":"2026-08-15T16:44:37.837493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20686","last_updated":"2025-05-27T03:58:50Z","snapshot_observed_at":"2026-08-09T17:00:52.421557Z","submitted_at":"2025-05-27T03:58:50Z","title":"Accelerating RL for LLM Reasoning with Optimal Advantage Regression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20686","snapshot_observed_at":"2026-08-15T16:44:36.593554Z","title":"Brantley, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.593554Z"},"links":{"cited_paper":"/paper/2505.20686","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:74240d4ad5149529e6656643468f4a2aa16e5da6f99289fafb0b1e252912fb4a","observation_id":"66c207b8-7aa6-4645-a53a-88af4e9fa20e","resolution":{"observed_at":"2026-08-15T16:44:36.593554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-15T16:44:36.598281Z","title":"Black, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.598281Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:0af0c499a21d88834e597a74fd277b3f4ea5db3adea1a4ab7f1654c15d7edbeb","observation_id":"3edd4543-5a71-4fbf-a4af-38c8c0b488bf","resolution":{"observed_at":"2026-08-15T16:44:36.598281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.818111Z","title":"Approximation variationnelle des probl \\`e mes aux limites","venue":null,"work_id":"8800fcbe-b1a2-460c-9d00-368c7e042756","year":1964},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.603337Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:aa2fc7975fe5fbf757693317c425eb0d845310a639440da0856517a440c51655","observation_id":"f5a455da-2a25-47b4-b2b4-3055f47e7556","resolution":{"observed_at":"2026-08-15T16:44:37.822868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.607399Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.607399Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:28052e831a8e90fe06a68f7773a610020eb8236c15e8a571e174a1e5e542087b","observation_id":"5db587be-6eb7-48db-997a-5668af502f1a","resolution":{"observed_at":"2026-08-15T16:44:36.607399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.794108Z","title":null,"venue":null,"work_id":"1385e557-a47d-4507-9f67-5c2a5403366f","year":1951},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.611684Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:84051b38e4f635ccdbac1ecd97d27b31abb57b031c7181c4044d7a610ba2fcd9","observation_id":"5b33d044-71e8-48e4-af55-04559caf6201","resolution":{"observed_at":"2026-08-15T16:44:37.798980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.779565Z","title":"Tail bounds via generic chaining","venue":null,"work_id":"d695832b-9644-419d-b269-97747ed953a5","year":2015},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.616019Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:c8928d885fc35aba722f7aef3afd395b23cae0c0078c9ecdb85b9188d0379d8a","observation_id":"357fdbad-4e84-4e50-bb3d-e06777dadda4","resolution":{"observed_at":"2026-08-15T16:44:37.784130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.764550Z","title":"Dhariwal and A","venue":null,"work_id":"20c3aa8b-a361-411d-a5b6-fd4e418718d2","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.620527Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:846e89b01e2812d5c61f6499c60a41d59a097a6b8f9c36c21da6bbf3fba6f351","observation_id":"aab51627-1e16-4a97-8e84-3dca7ef1dc5b","resolution":{"observed_at":"2026-08-15T16:44:37.769689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.748695Z","title":null,"venue":null,"work_id":"9fb7d638-ec30-4454-a37d-5676d78647aa","year":2018},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.624739Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:a0cd85e796914907ee7d82940ec5f99ecc31d01a249b8323c5ae20f58f38376d","observation_id":"24deabe8-76ca-41a4-99f5-e158d3960904","resolution":{"observed_at":"2026-08-15T16:44:37.753577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13362","last_updated":"2024-09-19T20:42:34Z","snapshot_observed_at":"2026-08-13T12:54:43.328196Z","submitted_at":"2023-01-31T01:37:48Z","title":"Optimizing DDPM Sampling with Shortcut Fine-Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13362","snapshot_observed_at":"2026-08-15T16:44:36.629752Z","title":"Fan and K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.629752Z"},"links":{"cited_paper":"/paper/2301.13362","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:10169ee1ab4d826bcbc613f8897937485b8e4ac942a9da4f8bf25657b339e0e8","observation_id":"1f32e9d0-15c2-45a8-ba95-835510272c6c","resolution":{"observed_at":"2026-08-15T16:44:36.629752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.733969Z","title":null,"venue":null,"work_id":"18a940c0-08b7-42a1-be46-004ddd0551ea","year":1977},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.634175Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:3f8ad5c18fdea42645337571b677e80251586b3ae25736f11acb7ec1ad5bd3c4","observation_id":"d9804de7-6b84-4161-9bb0-0592b1e077f2","resolution":{"observed_at":"2026-08-15T16:44:37.738600Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.05744","last_updated":"2021-03-09T22:34:13Z","snapshot_observed_at":"2026-08-11T03:35:57.528946Z","submitted_at":"2021-03-09T22:34:13Z","title":"Deep neural network approximation for high-dimensional parabolic Hamilton-Jacobi-Bellman equations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.05744","snapshot_observed_at":"2026-08-15T16:44:36.638288Z","title":"Grohs and L","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.638288Z"},"links":{"cited_paper":"/paper/2103.05744","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:e1a0d440126cfcd85b7ddcc085eaeb6898edd92b5f39befc420c3ce8859227aa","observation_id":"16f0848d-8fed-4a6c-a665-7a39131a2566","resolution":{"observed_at":"2026-08-15T16:44:36.638288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04832","last_updated":"2025-08-10T14:23:13Z","snapshot_observed_at":"2026-08-14T22:54:40.783486Z","submitted_at":"2024-09-07T13:55:45Z","title":"Reward-Directed Score-Based Diffusion Models via q-Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04832","snapshot_observed_at":"2026-08-15T16:44:36.642599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.642599Z"},"links":{"cited_paper":"/paper/2409.04832","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:1132c61171e154487487f96e9d122e01629a5e6d7bdcf42109accbf5f13d0b8b","observation_id":"0d6da94f-2dbe-468f-9296-fb9fcfe3e5e5","resolution":{"observed_at":"2026-08-15T16:44:36.642599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.717766Z","title":null,"venue":null,"work_id":"918cf4eb-6d11-4b58-a6e4-a0fd157a7ff6","year":2020},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.646957Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:7918d44d88aeed3a7d5f768ea0530db1c9eaa77e46f17faa16217b763a665034","observation_id":"efe4ebd1-85f6-4f42-8577-660cb3ee0856","resolution":{"observed_at":"2026-08-15T16:44:37.723557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.701456Z","title":null,"venue":null,"work_id":"c7710c0d-36b9-4835-8bb3-2b3974b99652","year":1950},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.651274Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:9a82195340aba5e72cc52d4e5d5cca79aac806c668676f6a8cba01b03557fa76","observation_id":"5e7f336f-cef4-419c-8c8e-a94b77f526eb","resolution":{"observed_at":"2026-08-15T16:44:37.706807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18164","snapshot_observed_at":"2026-08-15T16:44:36.655600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.655600Z"},"links":{"cited_paper":"/paper/2412.18164","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:7e5e77bd1f73c33f412917a0a495f033cc05bb4e05949e22d1d573ba7ad07875","observation_id":"86941e3d-e0ef-4513-8728-6c54adc717d2","resolution":{"observed_at":"2026-08-15T16:44:36.655600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-15T03:09:17.358218Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-08-15T16:44:36.660336Z","title":"Islam, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.660336Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:566bfc19cc4b1902a1af84a7b2c97ac659078219faf262dad14f9a87ac6afcfe","observation_id":"581b27d2-9b22-4ada-8b96-78cca4a8b197","resolution":{"observed_at":"2026-08-15T16:44:36.660336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.686461Z","title":null,"venue":null,"work_id":"560ae4fb-fdc8-4b85-885c-68b61e5ab338","year":2020},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.664682Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:4b02c642d772c6ee8e08f1bf4774bf28d551afbecacba186c7dadd35ecd9dd81","observation_id":"7ff8cc8d-fada-4d31-afbe-1c2f2bfe6a60","resolution":{"observed_at":"2026-08-15T16:44:37.690904Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.668860Z","title":"Jia and X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.668860Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:412f457ddf5717ec6cd8a8046e79cb6a434547d3c7e0cb533425378b42890739","observation_id":"056644f1-4f77-4a11-bcce-3ccfd8d8673e","resolution":{"observed_at":"2026-08-15T16:44:36.668860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.673059Z","title":"Jia and X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.673059Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:7b950a23d42d95b163b75de00dff978be2845d4c9c9ce68fc047bfa43f50c81c","observation_id":"348ebea6-7878-4707-a245-fc2007bb9851","resolution":{"observed_at":"2026-08-15T16:44:36.673059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.677418Z","title":"Jia and X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.677418Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:e1a6a26df7e2ff6a8e9cfd29801e1245d1fc2e97e2c0a61d8072fb67b533507d","observation_id":"24f46d19-dba4-4178-bcee-82886277c09f","resolution":{"observed_at":"2026-08-15T16:44:36.677418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.643764Z","title":null,"venue":null,"work_id":"2e83daa5-416c-4588-81b7-1ef2918da841","year":2005},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.681658Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:505ff89ebcb29699f876989d14fa87e788300fec6203e216512df39553048b93","observation_id":"84d92b7d-6826-4887-bbd7-4d64bced1a9f","resolution":{"observed_at":"2026-08-15T16:44:37.648077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.630134Z","title":"Korshunova, N","venue":null,"work_id":"9b5aead8-b18d-4979-8078-f71ddc583ae9","year":2022},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.685931Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:d4032d3a5cfe6d53032e6f1c00ec8c74fe3ec2ea0cbdd2dcdfa93810b770c35b","observation_id":"86cfa3e9-2e88-447a-9a5c-ac0ebecdb789","resolution":{"observed_at":"2026-08-15T16:44:37.634586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.614755Z","title":"Kakade and J","venue":null,"work_id":"2f721cfa-77b4-49b9-8b7a-699dfc03897d","year":2002},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.690568Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:0aaa58095f63bbb3774ad23af1f3c4ac80f3094b5b06e31112852d1b17cc5fdb","observation_id":"9a58790a-e4fc-4fff-9dcc-634caceb5191","resolution":{"observed_at":"2026-08-15T16:44:37.619924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.598815Z","title":"Koltchinskii","venue":null,"work_id":"ecbf6c4c-d672-4a12-8d24-94e62d745116","year":2008},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.694800Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:2a2f9a0e1e1a569e14ae7dd6cc69b0f1d1bb4fcaa7fc40253344081d0398c152","observation_id":"227bb8ea-8bc6-4517-b426-a2a0bb38f526","resolution":{"observed_at":"2026-08-15T16:44:37.603426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.583384Z","title":null,"venue":null,"work_id":"0284342f-49eb-4c46-aa30-fdf4cc8a6e9b","year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.699081Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:fecd5e5bf9bfbb985656776d6c0261c919ad12525d8d433db33b0dfda1f2b0c2","observation_id":"42a7b6b8-ca5f-48cb-892d-cef824af496c","resolution":{"observed_at":"2026-08-15T16:44:37.588155Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06897","last_updated":"2021-11-13T02:25:51Z","snapshot_observed_at":"2026-08-14T08:14:56.543685Z","submitted_at":"2021-10-13T17:26:31Z","title":"Machine Learning For Elliptic PDEs: Fast Rate Generalization Bound, Neural Scaling Law and Minimax Optimality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06897","snapshot_observed_at":"2026-08-15T16:44:36.703386Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.703386Z"},"links":{"cited_paper":"/paper/2110.06897","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:0313e929eb79d9fcadfc79269ff257c2a5e49a20f823d95e875b8ad16fef6403","observation_id":"66dfb0aa-481a-4a23-92ab-a2b26db2bc0f","resolution":{"observed_at":"2026-08-15T16:44:36.703386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.568823Z","title":null,"venue":null,"work_id":"23813c05-6531-4d1c-b17b-f158cf05dd9d","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.707821Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:c54b0491f4e890d0271a39906cb5f2de0e123929b07e137376c0f11f474ce5ae","observation_id":"3a182fd1-1462-4625-bcbb-8be9fead9435","resolution":{"observed_at":"2026-08-15T16:44:37.573562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1305.4825","last_updated":"2016-09-17T09:42:53Z","snapshot_observed_at":"2026-08-15T00:17:08.643949Z","submitted_at":"2013-05-21T14:02:51Z","title":"Learning subgaussian classes : Upper and minimax bounds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1305.4825","snapshot_observed_at":"2026-08-15T16:44:36.712015Z","title":"Lecu \\'e and S","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.712015Z"},"links":{"cited_paper":"/paper/1305.4825","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:0794b262861ec9ced3dede66f34ca03c14d93e482b8f319dc04d422ffab004d9","observation_id":"85f2a205-f404-4abe-b49f-e97c7cff4591","resolution":{"observed_at":"2026-08-15T16:44:36.712015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04991","last_updated":"2025-08-08T02:46:14Z","snapshot_observed_at":"2026-08-14T22:55:26.892507Z","submitted_at":"2024-09-08T06:05:51Z","title":"Estimates of the numerical density for stochastic differential equations with multiplicative noise","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04991","snapshot_observed_at":"2026-08-15T16:44:36.716547Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.716547Z"},"links":{"cited_paper":"/paper/2409.04991","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:0dca50d0efe06b4828b9f3cb17bb1e68b29a43b9221ac8ad30ef47f654878788","observation_id":"f38cec05-2977-4b70-91a6-479ccf2ed169","resolution":{"observed_at":"2026-08-15T16:44:36.716547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.553853Z","title":"Madelung","venue":null,"work_id":"b1e2cc5f-a4d0-4a52-86ad-847212b64edc","year":1927},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.720978Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:ef7d40b3808fdd9f64f07c9ce20348119857be3c9d6a94d28af5c8d9afed311c","observation_id":"eacea762-4c8f-4b48-a435-b039fbcbacee","resolution":{"observed_at":"2026-08-15T16:44:37.558758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.539699Z","title":"Munos and P","venue":null,"work_id":"25b0812e-f436-4666-bdde-76ad96ce2f3b","year":1997},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.725555Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:d683f835962b0425536b25cbcc16942eae085d67d8ded44e603aa44c61d727bc","observation_id":"4475f4d1-ef11-4fa7-ac43-d3afba11cd90","resolution":{"observed_at":"2026-08-15T16:44:37.544291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.729788Z","title":"Mendelson","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.729788Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:e66079e1eb66dab9ceb1189d53ff2fd211f439fb92b7862ac684ceccb693bff2","observation_id":"fb479064-3351-45b3-9509-d31099310be8","resolution":{"observed_at":"2026-08-15T16:44:36.729788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.515448Z","title":"Muhle-Karbe, J","venue":null,"work_id":"d266904c-08b1-4e6e-a389-d568141776be","year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.734279Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:168d2cb1e35099895fef08f1f4aad7703c0de08e1d2278d4dec475108b828129","observation_id":"1710e4d7-edad-49d5-b291-03d653ba5764","resolution":{"observed_at":"2026-08-15T16:44:37.520532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-15T15:12:28.568209Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04297","snapshot_observed_at":"2026-08-15T16:44:36.738417Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.738417Z"},"links":{"cited_paper":"/paper/2502.04297","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:ef993ff7c21dd52c65a61aa705ceb8c4f5c4f586513641f0b543b1aadd44cd15","observation_id":"e4051267-c4d5-497c-8c65-eecdcd60cc37","resolution":{"observed_at":"2026-08-15T16:44:36.738417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.501681Z","title":"Optimal oracle inequalities for projected fixed-point equations, with applications to policy evaluation","venue":null,"work_id":"0823aa7a-8a2c-45b2-a86a-e6e8edef5348","year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.742846Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:905d03faf8c6e321d4c66ea444e75e16c38f2a49f56e293bcfbbd35125ceed00","observation_id":"089c8cea-3fa2-487d-ade6-293c0721c48e","resolution":{"observed_at":"2026-08-15T16:44:37.506171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.746982Z","title":"Menozzi, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.746982Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:7ce5e2dd090a011e8676ed9d962e28dad469e2576b978c323c32b60e0e64cb2f","observation_id":"7be2d523-daa4-4493-a051-62d319c03827","resolution":{"observed_at":"2026-08-15T16:44:36.746982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05966","last_updated":"2024-07-08T14:05:03Z","snapshot_observed_at":"2026-08-12T23:26:43.962881Z","submitted_at":"2024-07-08T14:05:03Z","title":"On Bellman equations for continuous-time policy evaluation I: discretization and approximation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05966","snapshot_observed_at":"2026-08-15T16:44:36.751413Z","title":"Mou and Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.751413Z"},"links":{"cited_paper":"/paper/2407.05966","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:a42d4e26360cba2e709b3a3c723d8a7386a6084010b2096dbd2e26b48d318d43","observation_id":"0e4bb261-589d-4c82-bc20-338bd2824240","resolution":{"observed_at":"2026-08-15T16:44:36.751413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.478837Z","title":"Nemirovski, A","venue":null,"work_id":"857628d7-e95a-4849-8b72-fa3b0e980f6b","year":2009},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.755747Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:fbe5622525ffd5db0a20b7a37f799e5896117fb3bf4688a540564256994e7efa","observation_id":"d40c9c10-e1b2-49ce-a523-11bd20dc49ad","resolution":{"observed_at":"2026-08-15T16:44:37.483121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.463645Z","title":"The Malliavin calculus and related topics","venue":null,"work_id":"26cf432f-8145-424f-9576-5e5a7a402a4d","year":2006},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.760228Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:b1a9425d68a0810dcca5246a248905219e364b2a7c9896633ba8fee05172b6bb","observation_id":"1cf5d741-49f8-4b6f-b147-d7e3e7dc64ea","resolution":{"observed_at":"2026-08-15T16:44:37.469223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.449082Z","title":"Ouyang, J","venue":null,"work_id":"770e5d90-12cd-40d3-8069-f7404c405da0","year":2022},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.764450Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:aa06cedfac61845b4ea97924e5c50081d32277e48e04047e76e8fc99a649f934","observation_id":"47be84e9-3cdf-4645-afd0-945a359f1801","resolution":{"observed_at":"2026-08-15T16:44:37.454023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.434525Z","title":null,"venue":null,"work_id":"7b96fbdc-120f-484c-a4ac-71a3badb3197","year":2016},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.768422Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:101c6a7904275a1c6605f1056a04988919b1e60ead44f8bae90c74bde3c01755","observation_id":"9711309c-3e0d-4b1d-a1ac-fcfb2a64a428","resolution":{"observed_at":"2026-08-15T16:44:37.438840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.420340Z","title":"Sirignano and K","venue":null,"work_id":"21cc72c4-0ff8-457f-9661-d97d4856898c","year":2018},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.772563Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:266153c9fa56803d71e5812e57d029803837d941490a9498a003dd151d1255c6","observation_id":"91b4fd3d-bd46-4ed0-b514-dacffc647c89","resolution":{"observed_at":"2026-08-15T16:44:37.424838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-15T16:44:36.776671Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.776671Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:f0a366c117fc3e3d1baa7602d88d29e8d5c83fb53cd48b5cc8df7176da86a694","observation_id":"f5efafcc-9ee1-400b-b60d-7a2fc52a5f62","resolution":{"observed_at":"2026-08-15T16:44:36.776671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-15T16:44:36.781087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.781087Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:7a9989e31d8818db26509644f3f7ac28b4afe107e65cb116733d8f0e51c5803b","observation_id":"d685b4b0-985a-4518-99ea-b9695def74be","resolution":{"observed_at":"2026-08-15T16:44:36.781087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.785848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.785848Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:86f35ef2f94b0174fd7489abfb0b36905bb62757d894b722978c9e9706017dbe","observation_id":"85048588-d7ea-45fd-afb4-2a59d9356843","resolution":{"observed_at":"2026-08-15T16:44:36.785848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.407019Z","title":"Theodorou, J","venue":null,"work_id":"511472ca-43b8-4412-bd86-56e69e3e19d5","year":2010},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.790041Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:93e355a92ca1a0c173fa2d657cf441fd224eda297b193f16af63220af1044ebc","observation_id":"2c9fda2c-941c-4e37-b2c2-7afdd0c9cf02","resolution":{"observed_at":"2026-08-15T16:44:37.411284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.393247Z","title":null,"venue":null,"work_id":"fb01a10f-a853-48d5-b139-164022bd4df4","year":2006},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.795153Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:990295cc2d950254b42a86887abe578e94e43a1aab315597b15cface8a32fe0f","observation_id":"15bce076-6d95-4e1a-afc8-82eee8824747","resolution":{"observed_at":"2026-08-15T16:44:37.397552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.379802Z","title":"Tang and R","venue":null,"work_id":"e0a69557-3b73-4578-894b-740bd6fbc5e2","year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.799325Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:356eaecec027806ee5f707dba8cadb7441742346d253a57d1ecbdbd8836de9eb","observation_id":"94fc095e-107d-4a16-9724-9c243e65ea04","resolution":{"observed_at":"2026-08-15T16:44:37.384029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-13T04:12:17.261671Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-15T16:44:36.803558Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.803558Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:f8e3c67f45a11037b4b175af3bd28b5157a742c5ad4cfb2aed2d4b9ac23bcc36","observation_id":"6ee942e2-c912-4809-a2e2-485bb3e2e01f","resolution":{"observed_at":"2026-08-15T16:44:36.803558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16359","last_updated":"2024-07-18T08:21:54Z","snapshot_observed_at":"2026-08-13T04:10:18.627858Z","submitted_at":"2024-02-26T07:24:32Z","title":"Feedback Efficient Online Fine-Tuning of Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16359","snapshot_observed_at":"2026-08-15T16:44:36.807712Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.807712Z"},"links":{"cited_paper":"/paper/2402.16359","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:506659b00cebbb9d4d3a61fe2d570721fe914b018a3c3bff0a3656d96c9c7dc8","observation_id":"bd38fb5c-88b1-4662-a24a-be437b15d194","resolution":{"observed_at":"2026-08-15T16:44:36.807712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13734","last_updated":"2024-07-18T17:35:32Z","snapshot_observed_at":"2026-08-12T23:19:15.417284Z","submitted_at":"2024-07-18T17:35:32Z","title":"Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13734","snapshot_observed_at":"2026-08-15T16:44:36.812472Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.812472Z"},"links":{"cited_paper":"/paper/2407.13734","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:137cb7d00c4d39c8f40711f45c4910ba5bc8a32c7b0391ec6c9f1041f2bce135","observation_id":"2e624b8a-a421-4994-b9c7-48d723e40b17","resolution":{"observed_at":"2026-08-15T16:44:36.812472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.816826Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.816826Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:6b4dc152f67829906eba2a38d38b1b2b67edf91c14068cbff4f221bd315a5399","observation_id":"fbdc3ec1-920a-40dc-8ae6-028382bbec99","resolution":{"observed_at":"2026-08-15T16:44:36.816826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.355587Z","title":"Weisz, P","venue":null,"work_id":"e70c8bcd-2c6c-4cb4-bcd5-421841839ccf","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.821225Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:81b190025c0569e9536dc350d0b859ae4d01d87566a8c1b22d1f4a459bec3e0c","observation_id":"45695990-f541-4903-b0cf-45e7ee65ed2e","resolution":{"observed_at":"2026-08-15T16:44:37.360790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.340595Z","title":null,"venue":null,"work_id":"ddb8fbaa-4194-4ed0-b897-9c7e922e17d1","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.825462Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:df08c983c9ff6de97d454f21e4f8de5667d516c255d4fbeb9314b7b055fef986","observation_id":"dea01282-61f6-4be2-b549-28e660392cfc","resolution":{"observed_at":"2026-08-15T16:44:37.345095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.325902Z","title":"Xie and N","venue":null,"work_id":"96d219d1-d197-48fd-b75a-7a1e5415fd68","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.829886Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:7cdbb4e0a96b46c3c4584cd807e707c5c54014ac4d05e3b5b0cdb886a923ebe9","observation_id":"1dd41a41-61cc-4e4f-8b26-754abea3338e","resolution":{"observed_at":"2026-08-15T16:44:37.331166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.833885Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.833885Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:4fb067dde34f868a49c7d7ebe1745c14e3f66da92dc58bab9895c161072ca52b","observation_id":"d7f0b92b-6c5a-4521-8406-67beed504235","resolution":{"observed_at":"2026-08-15T16:44:36.833885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-15T03:50:46.755327Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01819","snapshot_observed_at":"2026-08-15T16:44:36.837980Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.837980Z"},"links":{"cited_paper":"/paper/2502.01819","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:1bd0e1ed87338f139f74163823b798ed62659e8ccea85f51314b174137b6f859","observation_id":"6829bc90-f340-4ee5-89d3-ea9de10cd911","resolution":{"observed_at":"2026-08-15T16:44:36.837980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.312368Z","title":null,"venue":null,"work_id":"27153cbf-2abc-45d2-a15c-da4cd9403a16","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.842390Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:2d36e550ff6b475347a4b9f23da29c252b816e25fa2853d9afbd64bbf63d715b","observation_id":"c10bce38-5728-4ab9-a8eb-f6c8654d5aad","resolution":{"observed_at":"2026-08-15T16:44:37.316649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-16T00:15:57.597094Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-15T16:44:36.846633Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.846633Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:daa80664d365e159ff7fd3f8a817c5c16ed8d08949a3a89089ca7ae65a485239","observation_id":"afce878f-7cf4-4d11-bce1-aaed7f9bd41e","resolution":{"observed_at":"2026-08-15T16:44:36.846633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.298632Z","title":"Ziemann, S","venue":null,"work_id":"37f713c8-052c-416a-ac22-9ea069103bfb","year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.851181Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:5c101b0bcad39bc8d6cb34d6308117ef125dff0faec29803027152a6e5154029","observation_id":"e63fec42-085c-47d9-85ea-aa283a46723c","resolution":{"observed_at":"2026-08-15T16:44:37.302837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.284102Z","title":null,"venue":null,"work_id":"faa05cc0-3db2-41a8-84a6-be9a83ae55bf","year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.855313Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:cd3c66c044a391f04dc9a5ddb3f9ad4a91c1c86c7ffb3659cd970a2bec1fb103","observation_id":"469d4b30-c38b-4926-bffb-249dc77554b5","resolution":{"observed_at":"2026-08-15T16:44:37.289119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T16:35:06.682530Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2509.02528."}