{"as_of":"2026-08-09T05:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:91230936f68d0ed09fbb1895cd29c4e7586fea9a7734e778df0321f07041732f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:49:45.309170Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:39:38.330848Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":"2406.04314","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-07-04T06:39:38.330848Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":"96b35c7e-471c-4216-8c52-62bb40d52ae4","year":2024},"citing_paper":{"arxiv_id":"2501.13918","last_updated":"2025-10-27T08:22:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-23T18:55:41Z","title":"Improving Video Generation with Human Feedback","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T15:30:02.578430Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2501.13918"},"observation_digest":"sha256:15a07181087be76ec9e29bf6b1afb1d85a19aca081f3d7138dff3d41edce1fcc","observation_id":"10994389-e781-44da-9703-e15bf6d91809","resolution":{"observed_at":"2026-05-13T15:30:02.732151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":"2406.04314","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-07-04T06:39:38.330848Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":"96b35c7e-471c-4216-8c52-62bb40d52ae4","year":2024},"citing_paper":{"arxiv_id":"2503.12575","last_updated":"2026-04-05T16:16:05Z","snapshot_observed_at":"2026-07-06T20:53:31.919637Z","submitted_at":"2025-03-16T17:06:00Z","title":"BalancedDPO: Adaptive Multi-Metric Alignment","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T23:37:55.154902Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2503.12575"},"observation_digest":"sha256:1198e8dc8e6ecbb061da932d8be91608037ae56f7b87e65fcd07254bef78916e","observation_id":"46008356-5e90-4b3f-92b1-4650c19aa5da","resolution":{"observed_at":"2026-05-22T23:42:16.586536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":"2406.04314","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-07-04T06:39:38.330848Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":"96b35c7e-471c-4216-8c52-62bb40d52ae4","year":2024},"citing_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-06T11:11:00.378627Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-11T18:45:16.641012Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2505.05470"},"observation_digest":"sha256:a6a47331e9c8336e31caf74c96258bc5d3ee3026ee25d48e16d91814501eeab0","observation_id":"8701c302-a574-4a62-be56-481ec6092fd8","resolution":{"observed_at":"2026-05-11T18:45:16.971344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":"2406.04314","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-07-04T06:39:38.330848Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":"96b35c7e-471c-4216-8c52-62bb40d52ae4","year":2024},"citing_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-07-31T14:51:03.625964Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-11T22:28:24.929046Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2505.07818"},"observation_digest":"sha256:ab0d2925a98e192ec2f6b2636f941fc3f2e8978a7bc49863d5b14333ffbe6e4c","observation_id":"22a8705e-4e9f-4749-a376-3564740d0eea","resolution":{"observed_at":"2026-05-11T22:28:28.248699Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-07T14:49:45.309170Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step.arXiv preprint arXiv:2406.04314, 2(3), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17618","last_updated":"2025-05-23T08:25:46Z","snapshot_observed_at":"2026-08-07T23:07:43.441669Z","submitted_at":"2025-05-23T08:25:46Z","title":"Scaling Image and Video Generation via Test-Time Evolutionary Search","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:45.309170Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2505.17618"},"observation_digest":"sha256:0e582cc48e9571df65b2d8e563a90e03ce1b8d80e922e3a6770a797366190252","observation_id":"38dbfa4d-b793-48dc-a7c5-21f504a0b8cd","resolution":{"observed_at":"2026-08-07T14:49:45.309170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-07T14:25:26.144841Z","title":"Aesthetic post-training diffusion models from generic preferences with step-by-step preference optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19196","last_updated":"2025-05-25T15:43:54Z","snapshot_observed_at":"2026-08-08T17:20:26.690914Z","submitted_at":"2025-05-25T15:43:54Z","title":"Step-level Reward for Free in RL-based T2I Diffusion Model Fine-tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:26.144841Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2505.19196"},"observation_digest":"sha256:bb1dc210cdfce5885123d0c0f178ba3793e04a835d1beade6dc27a36b8899d6c","observation_id":"7ddc2152-916d-4b1e-b35e-103cb7023a17","resolution":{"observed_at":"2026-08-07T14:25:26.144841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-07T13:25:05.411402Z","title":"Aesthetic post-training diffusion models from generic preferences with step-by-step preference optimization.arXiv preprint arXiv:2406.04314,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22008","last_updated":"2025-05-28T06:15:41Z","snapshot_observed_at":"2026-08-07T13:15:11.850487Z","submitted_at":"2025-05-28T06:15:41Z","title":"Align-DA: Align Score-based Atmospheric Data Assimilation with Multiple Preferences","version":1},"reference_index":1926,"source":"pdf_text","source_observed_at":"2026-08-07T13:25:05.411402Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2505.22008"},"observation_digest":"sha256:f5e9c07113dc67bd147c83cf852c201b17ca4be0c695dd46971bf5252e2ed6ca","observation_id":"c9b8effa-4baa-4c73-a76e-2eaec840d3e6","resolution":{"observed_at":"2026-08-07T13:25:05.411402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-07T13:09:40.253118Z","title":"Aesthetic post-training diffusion models from generic preferences with step-by-step preference optimization.arXiv preprint arXiv:2406.04314, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22569","last_updated":"2025-05-28T16:45:07Z","snapshot_observed_at":"2026-08-07T22:08:43.402119Z","submitted_at":"2025-05-28T16:45:07Z","title":"ImageReFL: Balancing Quality and Diversity in Human-Aligned Diffusion Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:09:40.253118Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2505.22569"},"observation_digest":"sha256:10c0bacbd3fc854915082a4067a5481a2d1fa6e0c76880a69dbd423c0bf69421","observation_id":"5c4bb27f-0cfe-4b52-9382-bcb7a4776523","resolution":{"observed_at":"2026-08-07T13:09:40.253118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-07T11:47:00.600957Z","title":"Step-aware prefer- ence optimization: Aligning preference with denoising per- formance at each step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01511","last_updated":"2025-06-02T10:18:09Z","snapshot_observed_at":"2026-08-08T15:41:36.251205Z","submitted_at":"2025-06-02T10:18:09Z","title":"Enhancing Diffusion-based Unrestricted Adversarial Attacks via Adversary Preferences Alignment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:47:00.600957Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2506.01511"},"observation_digest":"sha256:89b2f49b8252a3f0eaab4c38606f5ed189d72bc196c66101b75fe6f9614a2513","observation_id":"04fd1a4d-7037-4407-a05a-267e226ce8c3","resolution":{"observed_at":"2026-08-07T11:47:00.600957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-07T04:29:38.396893Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step.arXiv preprint arXiv:2406.04314, 2(3), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10639","last_updated":"2025-06-12T12:25:37Z","snapshot_observed_at":"2026-08-08T15:16:39.506526Z","submitted_at":"2025-06-12T12:25:37Z","title":"GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:29:38.396893Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2506.10639"},"observation_digest":"sha256:c82f47367a5fb34ab21e5f272d1f748c15413658f878002421d1bbdb478f7bf9","observation_id":"7b4eefa4-3d83-4a02-bd26-529ca2228b3a","resolution":{"observed_at":"2026-08-07T04:29:38.396893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-07T00:30:41.767912Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step.arXiv preprint arXiv:2406.04314, 2(3), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13846","last_updated":"2025-06-26T16:39:32Z","snapshot_observed_at":"2026-08-09T03:08:09.368495Z","submitted_at":"2025-06-16T17:59:40Z","title":"Fake it till You Make it: Reward Modeling as Discriminative Prediction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:41.767912Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2506.13846"},"observation_digest":"sha256:8f9afbea48e5c9e9c438be9e2bb9686ada6a5b7144b8a651760c518cfe72b4fc","observation_id":"5ee3f4d7-01c7-4f6d-a7d5-70ed869f45d7","resolution":{"observed_at":"2026-08-07T00:30:41.767912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-06T17:54:45.840939Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11554","last_updated":"2025-08-03T03:07:39Z","snapshot_observed_at":"2026-08-07T16:40:56.177031Z","submitted_at":"2025-07-14T02:59:28Z","title":"Inversion-DPO: Precise and Efficient Post-Training for Diffusion Models","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:54:45.840939Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2507.11554"},"observation_digest":"sha256:9caef6e1f76d77a1ed6b1d5ae7162fa0a871dc6d986f5b42796e14dd5f80543d","observation_id":"ab1c7732-9397-4f3f-8d79-0f73a6069d34","resolution":{"observed_at":"2026-08-06T17:54:45.840939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-06T12:10:08.345491Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step.CoRR, abs/2406.04314, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22058","last_updated":"2025-07-29T17:59:04Z","snapshot_observed_at":"2026-08-06T15:57:37.748671Z","submitted_at":"2025-07-29T17:59:04Z","title":"X-Omni: Reinforcement Learning Makes Discrete Autoregressive Image Generative Models Great Again","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T12:10:08.345491Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2507.22058"},"observation_digest":"sha256:1a44de509db86da36756b981c4167ba9ef45b77585b44805b042fb202fbae457","observation_id":"6649138f-042a-4dc8-9a84-75eda51b6484","resolution":{"observed_at":"2026-08-06T12:10:08.345491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-06T11:32:41.949449Z","title":"Step-aware prefer- ence optimization: Aligning preference with denoising per- formance at each step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22604","last_updated":"2025-07-30T12:19:01Z","snapshot_observed_at":"2026-08-06T11:32:38.916172Z","submitted_at":"2025-07-30T12:19:01Z","title":"ShortFT: Diffusion Model Alignment via Shortcut-based Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:32:41.949449Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2507.22604"},"observation_digest":"sha256:6178ce13ad9f0948d59a0178715d1be68ec2ede7867f63e527a997ff44690abb","observation_id":"f277eed4-bd71-49b1-b5b2-b9c8abba75c7","resolution":{"observed_at":"2026-08-06T11:32:41.949449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-05T20:06:47.388338Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11255","last_updated":"2025-08-15T06:43:46Z","snapshot_observed_at":"2026-08-08T07:02:19.422958Z","submitted_at":"2025-08-15T06:43:46Z","title":"FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait Animation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:47.388338Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2508.11255"},"observation_digest":"sha256:0defa6e6f70816f687ffa9cdbb68d433562687000fca02f22ba6adf25b93c6eb","observation_id":"3481ddd6-cc35-43e0-9868-f0e26542ff32","resolution":{"observed_at":"2026-08-05T20:06:47.388338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-08-05T14:42:22.280733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21016","last_updated":"2025-08-28T17:18:31Z","snapshot_observed_at":"2026-08-06T03:08:28.577840Z","submitted_at":"2025-08-28T17:18:31Z","title":"Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T14:42:22.280733Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2508.21016"},"observation_digest":"sha256:b89d2c4ab65852090789cdc37db8fe9deb99e233ddd6cf7b923a7b78e17fe978","observation_id":"9e3f21ad-9081-4c4f-b264-8e22dd71db05","resolution":{"observed_at":"2026-08-05T14:42:22.280733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":"2406.04314","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-07-04T06:39:38.330848Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":"96b35c7e-471c-4216-8c52-62bb40d52ae4","year":2024},"citing_paper":{"arxiv_id":"2605.04494","last_updated":"2026-05-06T04:50:42Z","snapshot_observed_at":"2026-07-31T05:58:54.504742Z","submitted_at":"2026-05-06T04:50:42Z","title":"Towards General Preference Alignment: Diffusion Models at Nash Equilibrium","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T16:54:58.732444Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2605.04494"},"observation_digest":"sha256:4d1fefd14de82f6e44387e7483a73933412198a4ca76c34a25a3d7bf9e1ac06a","observation_id":"5cc7a5a7-ad25-4918-8313-ab7ea734846f","resolution":{"observed_at":"2026-05-11T17:56:06.868203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":"2406.04314","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-07-04T06:39:38.330848Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":"96b35c7e-471c-4216-8c52-62bb40d52ae4","year":2024},"citing_paper":{"arxiv_id":"2605.09433","last_updated":"2026-05-10T09:13:40Z","snapshot_observed_at":"2026-07-06T23:21:30.897592Z","submitted_at":"2026-05-10T09:13:40Z","title":"Offline Preference Optimization for Rectified Flow with Noise-Tracked Pairs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T02:10:27.595446Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2605.09433"},"observation_digest":"sha256:6d26a219ec79025ee31594bcf80db3237d4aa3b2fbeacc3b990ca266d4672ab2","observation_id":"3b0eff0b-43ac-43ac-ab1c-0133c052b09e","resolution":{"observed_at":"2026-05-12T02:11:15.534956Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":"2406.04314","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-07-04T06:39:38.330848Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":"96b35c7e-471c-4216-8c52-62bb40d52ae4","year":2024},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-07-06T23:27:05.961780Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:7d414cec4a2a313cd9cb86f5c0145d7fa7d2d31f31b5b011b3db1aacfba447fa","observation_id":"c77785a1-63fa-4b32-874d-9484b904a438","resolution":{"observed_at":"2026-05-20T19:48:57.326419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization","version":3},"cited_work":{"arxiv_id":"2406.04314","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.04314","snapshot_observed_at":"2026-07-04T06:39:38.330848Z","title":"Step-aware preference optimization: Aligning preference with denoising performance at each step","venue":null,"work_id":"96b35c7e-471c-4216-8c52-62bb40d52ae4","year":2024},"citing_paper":{"arxiv_id":"2606.21498","last_updated":"2026-06-19T14:50:22Z","snapshot_observed_at":"2026-08-06T22:06:36.715595Z","submitted_at":"2026-06-19T14:50:22Z","title":"Balancing Performance and Diversity in GRPO Autoregressive Text-to-Image Post-Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T14:14:45.547957Z"},"links":{"cited_paper":"/paper/2406.04314","citing_paper":"/paper/2606.21498"},"observation_digest":"sha256:bedcc8ea5f23b62742735ce2a335c9e4bec1f38a704d359fa449af1dedc6f303","observation_id":"440fc27a-7370-4ef9-83a2-1ef7205665ef","resolution":{"observed_at":"2026-07-04T06:39:38.332570Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2406.04314/citation-record","integrity":"/paper/2406.04314/integrity","json":"/paper/2406.04314/citation-record.json","paper":"/paper/2406.04314"},"outbound":[],"paper":{"arxiv_id":"2406.04314","last_updated":"2025-03-25T17:06:27Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T20:07:18.681767Z","submitted_at":"2024-06-06T17:57:09Z","title":"Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2406.04314."}