{"as_of":"2026-08-11T01:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9e27816ca30e535a3960f709a01747d3826c7f8be1ff86a32fa1f8944de3b3db","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T18:15:37.117367Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.24001/citation-record","integrity":"/paper/2605.24001/integrity","json":"/paper/2605.24001/citation-record.json","paper":"/paper/2605.24001"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.184025Z","title":"𝑠ref istrainedfor10,000stepsviaDSMonsamplesfrom 𝑞0 (Adam,lr=3 ×10−4, batch 2,048)","venue":null,"work_id":"b1a4bb18-3b99-49e5-b7fc-e2d669479478","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:9c2ec0396941cba6f120dadb45183e9b170321e43ab3a7a923d45ae62588d213","observation_id":"6a14986b-f2ae-4bca-925c-3ab731aaec60","resolution":{"observed_at":"2026-07-08T05:44:36.185784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.218842Z","title":"𝑔𝜃 is initialised by regressing against 30-step DDIM samples from𝑠ref using matched noise (3,000 steps, Adam, lr=10−3, batch 2,048)","venue":null,"work_id":"c41c5b16-c59c-4365-83e3-4e9611e944b6","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:fe35ad768187bfcc1c6bbbbeb23b3c5c1dfdc885af96b5ff70c49e03676831af","observation_id":"38e7a0cd-7c1a-4a70-adbb-5e86383272f5","resolution":{"observed_at":"2026-07-08T05:44:36.220256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.230494Z","title":"The two methods differ only in𝑠target: Method Reward location DI++ endpoint𝑥 0 only Didrevery noise level via DRS Evaluation","venue":null,"work_id":"83bf6af3-c5f0-4ce7-9e9d-1250937f8df8","year":2023},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:a2d8bb6605c3a959d926b9b2f02fa8d977c7bb477382151124d2f6df2816d935","observation_id":"e7b2232c-b405-4adf-b569-0f0d3eaebea4","resolution":{"observed_at":"2026-07-08T05:44:36.231862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2200.1100","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T15:05:47.839636Z","title":"Text-alignment metrics","venue":null,"work_id":"4dfc247c-148c-43d5-83fa-e90efefe4f5f","year":2021},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:e4e590ad8f2ee8d98f33cd29a6414a2f49f22fc420a3a84db61d0c15c0dc3c85","observation_id":"fc8499f2-4ddd-4aa2-b7a7-b134866d8320","resolution":{"observed_at":"2026-07-01T15:05:47.840970Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.196297Z","title":null,"venue":null,"work_id":"bb7406bf-f183-4abc-9a75-a27bdad02f34","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:fc4b2af91b059cd4042472180f3b93db35864aa12828f2041117742f6f3f62c8","observation_id":"ff794f6e-5fef-48a0-a67b-dd8a59f92cc7","resolution":{"observed_at":"2026-07-08T05:44:36.197485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.194219Z","title":null,"venue":null,"work_id":"366a201a-eb3c-4e15-b1d8-9f3e183e3056","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:19233733df3b7af07256ade5bcd9482b3c64f366cae4c293e6b988064ae233af","observation_id":"c1aee23b-4616-49b5-a416-6c590e30f3df","resolution":{"observed_at":"2026-07-08T05:44:36.195594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.181484Z","title":null,"venue":null,"work_id":"9c8d723d-1e68-4a51-a781-fa08ce92df74","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:3d4f2cc67808b23aadcbea69e9b15bbb339810963e3e1aa96262a1e2b5b074d1","observation_id":"9151d766-81da-43c6-919b-d1ad970c5e5c","resolution":{"observed_at":"2026-07-08T05:44:36.183279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.203366Z","title":null,"venue":null,"work_id":"bb3a0864-a4e1-4ce8-a8dc-e3fa723441e4","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:df4f3adbd8c8a8b2d513521c0b1c3ed3cc9608d56c067ab443266a57fc71900a","observation_id":"0f093dba-6701-434d-b8ef-2a9b853a52d8","resolution":{"observed_at":"2026-07-08T05:44:36.204438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.201730Z","title":null,"venue":null,"work_id":"d5e48154-ea6a-4554-9453-7bd9b2c7951b","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:64c39d6e4c556f3a140cab365708259555beb6bd723a4c738830c38e17ccd9e3","observation_id":"fdafc603-26aa-4f83-819b-0a6c23b7a2b5","resolution":{"observed_at":"2026-07-08T05:44:36.202790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.204983Z","title":null,"venue":null,"work_id":"84fc9a54-ecaa-469c-90a8-dcd3f5861845","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:4889130985b615298fb936f9d321a02f520250c626d78128024a996dea4d6c30","observation_id":"eaae68d9-4155-42ac-95d9-cc5a06ed4848","resolution":{"observed_at":"2026-07-08T05:44:36.206079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.228561Z","title":null,"venue":null,"work_id":"9703cd38-4a9c-4a3b-8045-25faacba22db","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:4f5eacc9aec38cb9aedaebcbc526d7b16e2705d512f0ece0c0d865b19d166af9","observation_id":"72eb4696-cc1b-4fac-85f1-cd92c3c51b80","resolution":{"observed_at":"2026-07-08T05:44:36.229614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.224912Z","title":null,"venue":null,"work_id":"96f38a86-ffab-4ace-9f3d-4c3d44ef0448","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:3181d9f1e8baac385a99984f71be548c9d722dd9e23dac7f53a2227cffcd6855","observation_id":"ec7c13c3-76dd-4f79-9fbb-75356cbbce01","resolution":{"observed_at":"2026-07-08T05:44:36.226126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.232435Z","title":null,"venue":null,"work_id":"a74df921-a8b6-4f6a-a6d2-8230e9b5aff3","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:72bb4468f8f7d8d9925ae4a8e3c6f074b49f8ae745b12654559bfb23323e7f9b","observation_id":"52d39989-41b4-4fb5-a857-00f78278a216","resolution":{"observed_at":"2026-07-08T05:44:36.233501Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.186419Z","title":null,"venue":null,"work_id":"db710637-809b-45ac-b90e-67a76954c961","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:723d509918c618a251b340241cb98c985fc4e9a794f3ab5f4e9edc89c8a941a2","observation_id":"c447fbfe-36f9-4d9c-bd30-b68578bb77cf","resolution":{"observed_at":"2026-07-08T05:44:36.187680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.222876Z","title":null,"venue":null,"work_id":"7855aea7-4c9c-4808-8846-2bad6813e8c7","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:f2c11ec257cf0c7c5f9e436736a896278fbd09b91887cd40b342e2ec95cfdace","observation_id":"af10cf5e-809b-44bc-a2b1-da113752f1e9","resolution":{"observed_at":"2026-07-08T05:44:36.224294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.208647Z","title":"Z-Image comparison:","venue":null,"work_id":"4a9e33ff-e749-4695-b588-8c84a7281125","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:02e8123a4669b0a282be35912e23aa2c15741482306bd1b7effb7c5af57f7221","observation_id":"d4b98ebe-d4a1-493c-b642-12c3454e2ce0","resolution":{"observed_at":"2026-07-08T05:44:36.209867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.198137Z","title":null,"venue":null,"work_id":"bb6e73ed-3311-411c-8c89-3e73a3677616","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:1d837692195ea172548fb911a4780b2ff2fec065a0328cd9d6e7e7d03b0c9bfd","observation_id":"f97f2b6c-b682-4796-b2bb-66fa9c74f36d","resolution":{"observed_at":"2026-07-08T05:44:36.199340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.190155Z","title":null,"venue":null,"work_id":"f52f7b6c-aecf-4e8e-b5f6-1666d4bc1679","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:244c2924430e62749a820c8b0287b1595c6915dcccf5c74fc7a5237328ce1385","observation_id":"f57d6081-c72b-421b-bcdd-6048b44bcd3f","resolution":{"observed_at":"2026-07-08T05:44:36.191364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.234025Z","title":"Figure 7 — Temperature Ablation","venue":null,"work_id":"4dc7822d-8a2c-4f2c-97b2-4413eef133a1","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:24b8030ffc9f3749d251ec3649faf3f7d3c8b8a0b6e7ed4cb3dc86ec4046a987","observation_id":"cbc051a9-74f4-42cf-9cb5-8480684b8e20","resolution":{"observed_at":"2026-07-08T05:44:36.235070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.188368Z","title":null,"venue":null,"work_id":"1d31a7dd-d3b8-4b0f-be98-2b0d0a93c45d","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:2e9252a40ccf384eb942bd4f58c1716df420404ba1f37984c8dfaf1b2cd3d95b","observation_id":"af58d504-459e-4201-99a0-a1454d4d8175","resolution":{"observed_at":"2026-07-08T05:44:36.189590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.192091Z","title":null,"venue":null,"work_id":"2eb8ba42-dfde-46c2-8c2c-2226088b4790","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:36865e3eb3934680f5aa38963977279351e9745a014aaba45345707523a6aefa","observation_id":"931b2666-3d21-49a1-9971-40f7086683be","resolution":{"observed_at":"2026-07-08T05:44:36.193502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.220940Z","title":null,"venue":null,"work_id":"380a0427-8c04-4195-9e76-dad8e5155060","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:3d58d229221f6db7cd1ed25878f1b0e23d826d0633f3e859d07b4bd03ffbea51","observation_id":"a40b9974-a0ef-4574-9032-dbdca23c1dc6","resolution":{"observed_at":"2026-07-08T05:44:36.222157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.226664Z","title":null,"venue":null,"work_id":"455e4665-7dcd-4853-be61-9485d0351ae1","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:bdb1ccd76d4fb60886dd44c8f7c38d34daff6a96689fefc64a3b356c499b036f","observation_id":"df0f3877-57af-491e-9f71-cb68d8fd67b4","resolution":{"observed_at":"2026-07-08T05:44:36.227771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.199936Z","title":null,"venue":null,"work_id":"3170f22e-07ac-4d4a-b084-1f09560be9ba","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:4b5c810590019f3b430e37517f7ed02ce1b710b59486f2110955671762ed0dd4","observation_id":"a43e705f-1dd5-4704-9a11-508b0c4211c7","resolution":{"observed_at":"2026-07-08T05:44:36.201181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.214823Z","title":null,"venue":null,"work_id":"87e7bc54-c747-4be6-9e32-738d4e9de753","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:7a612cc699f452d198224150489a0294b2164c1fcf832aa9ba37056cd8a16050","observation_id":"0b25ffdf-f042-4e45-be16-80f16c2d8b35","resolution":{"observed_at":"2026-07-08T05:44:36.216448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.206666Z","title":null,"venue":null,"work_id":"4acf1b1e-d4e7-4344-8079-f1722b0a60b8","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:a4bbb4fd28390646dbe791268145a1316240fa34816bce868fa8256c030d122b","observation_id":"e87af3ff-6a48-4436-9a0b-f1afb78e5d61","resolution":{"observed_at":"2026-07-08T05:44:36.207938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.217101Z","title":null,"venue":null,"work_id":"cf78172e-8432-407f-a291-5e39ecae5bd5","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:4b8160551695a0e85c090cfb1f3fb7d48af593245f997cc1688617426b59d72b","observation_id":"188c89b6-81ae-449a-9507-bb95e8fd4799","resolution":{"observed_at":"2026-07-08T05:44:36.218251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.179175Z","title":null,"venue":null,"work_id":"fc43de64-9779-4766-b5df-a3d73e9b137e","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:89aedc5e3466ec0b999848a4140c1329ecf114d6beaa25529ea41b0f76ace3cb","observation_id":"99ba93af-1204-4f85-a7de-c96318e8a56c","resolution":{"observed_at":"2026-07-08T05:44:36.180717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.212804Z","title":null,"venue":null,"work_id":"ada40040-3323-45d7-9f9c-2d8606c0d3be","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:649b90574359da06f9a279c838eb27ec0ff95ee9215966f2f0c6d30e9840d263","observation_id":"b333dd30-6e9a-435a-ad45-a2915617e52f","resolution":{"observed_at":"2026-07-08T05:44:36.214138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.210646Z","title":null,"venue":null,"work_id":"d30944e7-e7a0-4ba4-803f-21561e23c549","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:bb63ca5fa5c7afa65fb0a501bd119b33ec280d6d9a8e2eabbefed2f2bf748bf3","observation_id":"2005f284-ffd8-46ab-9034-6306454c3ea1","resolution":{"observed_at":"2026-07-08T05:44:36.211884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.235609Z","title":null,"venue":null,"work_id":"12ad3397-0abb-4d4b-a323-2e39c1543d76","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:b932563e852e06c8c648cdb9eb5ad8404d86d974d76506fe8b46b8aa82152199","observation_id":"02bbcc04-bf46-4018-bf15-be88a9ae769c","resolution":{"observed_at":"2026-07-08T05:44:36.236675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2605.24001."}