{"as_of":"2026-08-11T11:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c6253a5a911cbaee78a0a959e750cd70794a0a8d7144d949d30e0b7a18d535a3","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:09:01.822336Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T21:47:20.112331Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:39:45.924030Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2507.21802","last_updated":"2026-03-20T17:20:12Z","snapshot_observed_at":"2026-08-01T16:12:11.335962Z","submitted_at":"2025-07-29T13:40:09Z","title":"MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE","version":6},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T13:27:50.031781Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2507.21802"},"observation_digest":"sha256:c0a8923e3eea02399dcd06beed164a8f570f3493c48717eb1b37589293bc2f49","observation_id":"aa41ecd4-f187-471c-8c5d-4737894c39c5","resolution":{"observed_at":"2026-05-13T13:27:50.078729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2509.20427","last_updated":"2025-12-10T16:37:54Z","snapshot_observed_at":"2026-08-07T08:10:15.764742Z","submitted_at":"2025-09-24T17:59:04Z","title":"Seedream 4.0: Toward Next-generation Multimodal Image Generation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T16:39:00.828442Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2509.20427"},"observation_digest":"sha256:037de05f6e91d981c6d7e33dba2f8bf165d9e42ce736a703081fda97f257e2a4","observation_id":"0f9c6109-5bb3-4599-9e82-6fd95e2f7a29","resolution":{"observed_at":"2026-05-12T16:39:00.896443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2510.16888","last_updated":"2025-11-04T13:15:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-19T15:38:06Z","title":"Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T18:01:19.748677Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2510.16888"},"observation_digest":"sha256:7d36c981180209864a7bb1a98b7016bb3beb8b8cb8fa33e2575c016b42216a3a","observation_id":"88b1eb00-efe6-485c-8474-5262e6456e6c","resolution":{"observed_at":"2026-05-21T18:01:19.893657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-08-03T21:47:20.112331Z","title":"Rewarddance: Reward scaling in visual generation.arXiv preprint arXiv:2509.08826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.13649","last_updated":"2026-07-03T19:09:38Z","snapshot_observed_at":"2026-08-06T17:42:18.711494Z","submitted_at":"2025-11-17T17:59:54Z","title":"Distribution Matching Distillation Meets Reinforcement Learning","version":5},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T21:47:20.112331Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2511.13649"},"observation_digest":"sha256:0256aefdd6fe408864ca8348c277d6d7be7cb250cfa1723aad475984d3991852","observation_id":"5bc90bef-5c59-4c41-accd-9ced908fd7a5","resolution":{"observed_at":"2026-08-03T21:47:20.112331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2512.04678","last_updated":"2025-12-28T11:15:39Z","snapshot_observed_at":"2026-08-04T14:52:25.854038Z","submitted_at":"2025-12-04T11:12:13Z","title":"Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-16T18:17:54.943863Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2512.04678"},"observation_digest":"sha256:f043d46168b1225019d299fb36af15cbf35efda73e2e464459f01249423cc6b1","observation_id":"53be49cc-2695-4ae0-a27a-2e225b9edff9","resolution":{"observed_at":"2026-05-16T18:17:55.054498Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2512.13507","last_updated":"2025-12-23T17:38:46Z","snapshot_observed_at":"2026-08-10T07:54:14.758787Z","submitted_at":"2025-12-15T16:36:52Z","title":"Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T01:35:37.817082Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2512.13507"},"observation_digest":"sha256:5cacdead24cca763d43e38b0c0b57850ef8c4ab79a6e18a65bdd3bb36782791f","observation_id":"8e67035b-89db-48f8-9eda-19f252874dad","resolution":{"observed_at":"2026-05-16T01:35:37.891530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2602.11146","last_updated":"2026-05-22T14:43:10Z","snapshot_observed_at":"2026-08-09T18:10:40.681435Z","submitted_at":"2026-02-11T18:57:29Z","title":"Beyond VLM-Based Rewards: Diffusion-Native Latent Reward Modeling","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-25T06:41:33.493927Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2602.11146"},"observation_digest":"sha256:dbd1c71554b5d4f3ddaf72258b05f9934fec3942c30447650efec9d3514be29e","observation_id":"38ee40f4-d9f5-422d-b436-c1dd5598246c","resolution":{"observed_at":"2026-05-25T06:45:26.073726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-08-11T10:01:39.973258Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T13:34:36.248186Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2604.14148"},"observation_digest":"sha256:d90d5a8e6bbfdeaffbda157c8d2602b1c1db128e46fbd23378b66ab4a0952edb","observation_id":"ee3ef21c-0e70-4519-894f-780fdc8f522d","resolution":{"observed_at":"2026-05-10T13:35:26.276205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2604.25427","last_updated":"2026-04-28T09:34:51Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T09:34:51Z","title":"A Systematic Post-Train Framework for Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-07T16:58:33.014401Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2604.25427"},"observation_digest":"sha256:0e733b9c63f26c2fc702b26b9b04c316c986a224e1ba7634cfbd906ab1e8e02e","observation_id":"e7328192-0136-46d3-8da4-955bba962ac0","resolution":{"observed_at":"2026-05-11T23:26:20.184788Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2604.27505","last_updated":"2026-05-20T07:08:10Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:54:39Z","title":"Leveraging Verifier-Based Reinforcement Learning in Image Editing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-07T08:00:33.307429Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2604.27505"},"observation_digest":"sha256:cf4e14f914ba9809b15e24f2289c726ae3031034a5a7da1c0a685f5ea9b51759","observation_id":"055871ed-053e-4653-a29e-8ef0bf1af01f","resolution":{"observed_at":"2026-05-12T10:06:27.520658Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2604.27505","last_updated":"2026-05-20T07:08:10Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:54:39Z","title":"Leveraging Verifier-Based Reinforcement Learning in Image Editing","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-21T09:11:02.183133Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2604.27505"},"observation_digest":"sha256:a449de50270b00ea8150d9e21187e3269f8e749628ba28c8106f38e9faa14f14","observation_id":"5eaba5f4-7dea-4564-b3bc-8bb8268a148c","resolution":{"observed_at":"2026-05-21T09:14:05.973733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.05922","last_updated":"2026-05-12T06:25:12Z","snapshot_observed_at":"2026-07-06T23:18:26.864785Z","submitted_at":"2026-05-07T09:30:58Z","title":"Think, then Score: Decoupled Reasoning and Scoring for Video Reward Modeling","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T07:37:52.346280Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.05922"},"observation_digest":"sha256:b03b7e9d08b17293189e9a5eb75c6563224e7002a312bf48cbb485b3eb48b144","observation_id":"b1b1e6f1-ac7f-48aa-bf61-77fe883a442c","resolution":{"observed_at":"2026-05-13T07:42:30.786573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.10983","last_updated":"2026-05-13T08:00:49Z","snapshot_observed_at":"2026-07-06T23:22:52.369277Z","submitted_at":"2026-05-09T04:41:02Z","title":"TMPO: Trajectory Matching Policy Optimization for Diverse and Efficient Diffusion Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T07:36:16.811765Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.10983"},"observation_digest":"sha256:07b72f61f1598fa0130ca7473ceaf7765d251346e8828e84a4d301dc619685be","observation_id":"18e9cbc2-15da-49eb-b302-ae263df069f0","resolution":{"observed_at":"2026-05-13T07:37:29.181018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.10983","last_updated":"2026-05-13T08:00:49Z","snapshot_observed_at":"2026-07-06T23:22:52.369277Z","submitted_at":"2026-05-09T04:41:02Z","title":"TMPO: Trajectory Matching Policy Optimization for Diverse and Efficient Diffusion Alignment","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T22:01:21.695270Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.10983"},"observation_digest":"sha256:05010022ba6b696352872f8a939998d4a8a5a7275b2fcacdbdadf799acc6df12","observation_id":"89a90e18-c6af-43be-ab91-cb40c0d2ff94","resolution":{"observed_at":"2026-05-14T22:03:02.863836Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.11723","last_updated":"2026-05-28T12:50:43Z","snapshot_observed_at":"2026-08-01T23:43:09.636688Z","submitted_at":"2026-05-12T08:08:33Z","title":"CaC: Advancing Video Reward Models via Hierarchical Spatiotemporal Concentrating","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T06:00:31.582714Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.11723"},"observation_digest":"sha256:4c4d2c1770f9868d5a14b347f25110b1a3e46ac6eb070fa96ffa9b5ad9c9451e","observation_id":"a3dbd52d-cab0-45e8-b875-8a9872158d8c","resolution":{"observed_at":"2026-05-13T06:02:22.029828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.11723","last_updated":"2026-05-28T12:50:43Z","snapshot_observed_at":"2026-08-01T23:43:09.636688Z","submitted_at":"2026-05-12T08:08:33Z","title":"CaC: Advancing Video Reward Models via Hierarchical Spatiotemporal Concentrating","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-30T22:38:43.102769Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.11723"},"observation_digest":"sha256:662e0fca33a5201bdeaa7c163e65a0986569d28db20a13e4db51e0f58f68a239","observation_id":"68a52997-103e-422e-81c8-d98091d48fc1","resolution":{"observed_at":"2026-07-01T13:55:45.300168Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.15055","last_updated":"2026-05-14T16:49:09Z","snapshot_observed_at":"2026-08-09T08:30:11.806142Z","submitted_at":"2026-05-14T16:49:09Z","title":"DiffusionOPD: A Unified Perspective of On-Policy Distillation in Diffusion Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T21:20:23.420424Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.15055"},"observation_digest":"sha256:de4451ea3f9c27cbcec36c623ea200db7d057ad065cf294c74e65634aae99b53","observation_id":"dadec1d0-7167-44be-bfb7-631db441c849","resolution":{"observed_at":"2026-07-01T14:25:46.853546Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2605.16951","last_updated":"2026-05-16T12:05:39Z","snapshot_observed_at":"2026-08-02T16:28:04.937142Z","submitted_at":"2026-05-16T12:05:39Z","title":"Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T20:44:54.356658Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2605.16951"},"observation_digest":"sha256:68c37a3d8375b727813aa4248f711f0685bb9c87fbe309df34c01b1734fd437f","observation_id":"cfaf8c48-414d-495c-b4fb-a7cb715e6ad4","resolution":{"observed_at":"2026-05-19T20:47:45.836625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.00267","last_updated":"2026-05-29T18:57:57Z","snapshot_observed_at":"2026-07-06T23:41:01.066075Z","submitted_at":"2026-05-29T18:57:57Z","title":"StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-06-28T22:45:58.629263Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.00267"},"observation_digest":"sha256:fc9a515a7e86e571d1b25f32d92bc7c51ddbd231e934ee111d44538fa824ea86","observation_id":"bc19bdb5-f87f-4e3f-8b2b-b1779a76eed8","resolution":{"observed_at":"2026-07-01T19:25:59.831028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.00583","last_updated":"2026-05-30T07:21:40Z","snapshot_observed_at":"2026-08-06T21:04:24.758200Z","submitted_at":"2026-05-30T07:21:40Z","title":"Improving Visual Representation Alignment Generation with GRPO","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T19:24:09.597127Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.00583"},"observation_digest":"sha256:23982cbd39f1ec1022809d3c94406b52b652e81325ebbc924c69e7ba3257bb36","observation_id":"485db53f-e8ef-480a-bb21-91d596b0bdc5","resolution":{"observed_at":"2026-06-28T19:32:35.129428Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.02884","last_updated":"2026-06-01T20:56:24Z","snapshot_observed_at":"2026-08-06T19:01:40.676359Z","submitted_at":"2026-06-01T20:56:24Z","title":"Are we really tilting? The mechanics of reward guidance in flow and diffusion models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T15:20:52.980868Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.02884"},"observation_digest":"sha256:0decc73ac68107b77b2e1b255d07d54d97e6abdfd90c1fd2aa9bf0a360cceb10","observation_id":"876aee65-1061-4fbc-b3d5-b22c4f1ad8aa","resolution":{"observed_at":"2026-07-01T22:26:18.153780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.09076","last_updated":"2026-07-14T12:46:55Z","snapshot_observed_at":"2026-07-17T23:19:03.633221Z","submitted_at":"2026-06-08T06:20:12Z","title":"Z-Reward: Beyond Scalar Rewards by Internalizing Reasoning into Score Distributions","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-27T17:30:57.001021Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.09076"},"observation_digest":"sha256:cd5359da9990ad231ab9e19d8ca7c9afebaf418a01aed99709b8d9ec3ab71fa7","observation_id":"1c45d939-a4dd-476c-9e57-1990a9cbc875","resolution":{"observed_at":"2026-07-03T00:07:27.944548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-15T10:53:37.186361Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09076","last_updated":"2026-07-14T12:46:55Z","snapshot_observed_at":"2026-07-17T23:19:03.633221Z","submitted_at":"2026-06-08T06:20:12Z","title":"Z-Reward: Beyond Scalar Rewards by Internalizing Reasoning into Score Distributions","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-15T10:53:37.186361Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.09076"},"observation_digest":"sha256:11d77ee12e967a8e43d4c1f4a0671821dc72b1cbf7289ac7928c6d0a2c88f8a3","observation_id":"6e797adc-88a9-454b-89af-7a97da480d64","resolution":{"observed_at":"2026-07-15T10:53:37.186361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:270d38ae1e21d676a7dfd3a87054acf0f1e6aa2ac72efa52f7da9635036c2a3e","observation_id":"494cc52e-0a45-4538-8d3d-0487d70aa0d5","resolution":{"observed_at":"2026-07-04T10:09:45.413050Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.23626","last_updated":"2026-06-22T17:19:58Z","snapshot_observed_at":"2026-08-02T21:31:41.183160Z","submitted_at":"2026-06-22T17:19:58Z","title":"DiT-Reward: Generative Representations for Text-to-Image Reward Modeling","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-06-26T08:35:04.038960Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.23626"},"observation_digest":"sha256:5d1657a0d23d9824751c7fd297d4d8f049d4f56cd2fa749d99a56925f773e544","observation_id":"0b5713ab-4f56-45d7-9d42-b547b47d54e2","resolution":{"observed_at":"2026-07-04T10:39:45.925822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.27771","last_updated":"2026-08-06T03:19:05Z","snapshot_observed_at":"2026-08-09T23:09:50.329093Z","submitted_at":"2026-06-26T06:56:54Z","title":"NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T05:00:04.037802Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.27771"},"observation_digest":"sha256:6efc69228779325b1053c93839e74d985d4453e6cb51a8e93d6376551c49b88e","observation_id":"47831f1c-db81-48f8-b061-18d80119d225","resolution":{"observed_at":"2026-06-29T19:03:51.757351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-12T11:38:13.566600Z","title":"Rewarddance: Reward scaling in visual generation.arXivpreprint arXiv:2509.08826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27771","last_updated":"2026-08-06T03:19:05Z","snapshot_observed_at":"2026-08-09T23:09:50.329093Z","submitted_at":"2026-06-26T06:56:54Z","title":"NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T11:38:13.566600Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.27771"},"observation_digest":"sha256:ff1b9aef2a09c6f7754a3c9d82a9e9a0903e8dd8bb24c29e74187e67138f88d9","observation_id":"a16b5dda-0a53-42b1-9613-000a8c0c17a9","resolution":{"observed_at":"2026-07-12T11:38:13.566600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-08-02T09:56:25.929049Z","title":"Rewarddance: Reward scaling in visual generation.arXivpreprint arXiv:2509.08826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.27771","last_updated":"2026-08-06T03:19:05Z","snapshot_observed_at":"2026-08-09T23:09:50.329093Z","submitted_at":"2026-06-26T06:56:54Z","title":"NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T09:56:25.929049Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.27771"},"observation_digest":"sha256:df86c9abb96b585d14c05bc2eeed8ed5ae498803c268f39ba0421cf8570aab03","observation_id":"c62e0581-9e0c-43ee-b72f-9b3456248803","resolution":{"observed_at":"2026-08-02T09:56:25.929049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-08-02T00:41:12.594851Z","title":"RewardDance: Reward scaling in visual generation.arXiv preprint arXiv:2509.08826, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-09T09:38:01.959634Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.594851Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:2c42072ed3636d0b0b1fb375d1b6a0979ce9e9e3219e7a0dc37da483526c48ca","observation_id":"99a15030-df7d-4c09-b32d-139e4a24111f","resolution":{"observed_at":"2026-08-02T00:41:12.594851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-08-01T16:12:23.899000Z","title":"2509.08826 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18091","last_updated":"2026-07-20T15:55:33Z","snapshot_observed_at":"2026-08-08T05:09:32.008781Z","submitted_at":"2026-07-20T15:55:33Z","title":"SciForma: Structure-Faithful Generation of Scientific Diagrams","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-01T16:12:23.899000Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2607.18091"},"observation_digest":"sha256:6941f952a8eec2638b7dca93ce516f246b7c76cb6344dc2dfa4172c7bc516e1f","observation_id":"25d55f6b-63ee-43f3-b764-9312d1880f41","resolution":{"observed_at":"2026-08-01T16:12:23.899000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.08826/citation-record","integrity":"/paper/2509.08826/integrity","json":"/paper/2509.08826/citation-record.json","paper":"/paper/2509.08826"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.04233","last_updated":"2024-05-07T11:52:49Z","snapshot_observed_at":"2026-08-10T19:52:47.076746Z","submitted_at":"2024-05-07T11:52:49Z","title":"Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04233","snapshot_observed_at":"2026-08-04T20:08:55.396895Z","title":"Vidu: a highly consistent, dynamic and skilled text-to-video generator with diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.396895Z"},"links":{"cited_paper":"/paper/2405.04233","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:d9ec05b33f597025c71eed884944b1790133fee0733aa02da0f32dd24c7078d3","observation_id":"86905ea5-c022-43bb-8b50-c37819f87f6f","resolution":{"observed_at":"2026-08-04T20:08:55.396895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:55.529478Z","title":"Improving image generation with better captions.Computer Science","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.529478Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:81a46f4527b2b5b215520b1182cd4cf7bc4c5db7014a9da2b05b26a4ad6ae29d","observation_id":"ea855739-cf41-40b2-aa1e-1d10a6592d1f","resolution":{"observed_at":"2026-08-04T20:08:55.529478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-04T20:08:55.650307Z","title":"Training diffusion models with reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.650307Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:08d8be5ee1ea682cf796140a79fc55e5ceccb68d43e88a80a1b7de09e9c48e35","observation_id":"132c6830-d12c-43f7-9156-dddaf4ed4d40","resolution":{"observed_at":"2026-08-04T20:08:55.650307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-04T20:08:55.746553Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.746553Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:753e29928072874ec369b80690caa8edd648d0cef6c34948669c1138323564c1","observation_id":"7efa567e-ef00-4989-a064-45e848d36bbf","resolution":{"observed_at":"2026-08-04T20:08:55.746553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:55.865292Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.865292Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:28ef9242b6cf8b7a02e51995a6e892c851844940395e92f5ac70153c50bc501a","observation_id":"3abdd8b0-0899-4016-a961-6a5bcadc57df","resolution":{"observed_at":"2026-08-04T20:08:55.865292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:55.944987Z","title":"Video generation models as world simulators.OpenAI Blog, 1(8):1, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:55.944987Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:d3d3964f35fc341e025c22854c151ba744744dbaeab501ed1c4b5953f8d038c8","observation_id":"c3a37bb2-8a9b-4395-8d20-11ff4747b2f4","resolution":{"observed_at":"2026-08-04T20:08:55.944987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-04T20:08:56.030031Z","title":"Pixart-α: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.030031Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:960eab273ffe6d564c4061a5bb54c7d289dc9dc3a52941256b614b24a9ea472c","observation_id":"0f4bcd2d-bb19-4f13-b4b8-18379f110cfc","resolution":{"observed_at":"2026-08-04T20:08:56.030031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:56.108706Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models.CoRR, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.108706Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:588441805fc46f19b42b3ef2670539ecb81d712d45c8d289d0cabb3c827c8581","observation_id":"e91579b9-d6e5-4c0c-9e9d-818bfe04fc4c","resolution":{"observed_at":"2026-08-04T20:08:56.108706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06554","last_updated":"2024-10-16T04:48:08Z","snapshot_observed_at":"2026-08-05T02:22:02.033882Z","submitted_at":"2024-10-09T05:17:08Z","title":"The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06554","snapshot_observed_at":"2026-08-04T20:08:56.202728Z","title":"The accuracy paradox in rlhf: When better reward models don’t yield better language models.arXiv preprint arXiv:2410.06554, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.202728Z"},"links":{"cited_paper":"/paper/2410.06554","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:8b89536e709e0cf8235b9c6d87fe481df2def93c01f438aeb26a610b1677c3b3","observation_id":"b272c883-8db7-4937-86eb-367ad3b86f30","resolution":{"observed_at":"2026-08-04T20:08:56.202728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-04T20:08:56.309210Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling.arXiv preprint arXiv:2412.05271, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.309210Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:677fcf86eb73b8b5d6c310b917de3578bb2921bf7f674615a572c3b70d0fee9c","observation_id":"486d1163-e00a-4ea2-9d8a-5cf8cd809e93","resolution":{"observed_at":"2026-08-04T20:08:56.309210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-04T20:08:56.415726Z","title":"Raft: Reward ranked finetuning for generative foundation model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.415726Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:b38d2596e4ce771552df5b63d9384b2489e79207e9844a8ba71027d0d7491727","observation_id":"e2b42bf0-44f1-4691-ad5a-fc91b0429d1a","resolution":{"observed_at":"2026-08-04T20:08:56.415726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:56.497198Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.497198Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:d01b0fd7c14b8bd3b2be8a1b34654f181c309bb5c9a1c2a41f067df8f8336f73","observation_id":"e8c40eb9-35e7-4a24-aa42-90d44b3ff2ab","resolution":{"observed_at":"2026-08-04T20:08:56.497198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:56.572535Z","title":"Reinforcement learning for fine-tuning text-to-image diffusion mod- els","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.572535Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:1c8e75b735370a1fdbfc74d48a11455c74018f318a20f4d482f6b020a83446ab","observation_id":"1382ada2-b0c5-4221-8d9c-7225d5b6876a","resolution":{"observed_at":"2026-08-04T20:08:56.572535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11346","last_updated":"2025-06-28T11:46:35Z","snapshot_observed_at":"2026-07-06T21:09:50.780345Z","submitted_at":"2025-04-15T16:19:07Z","title":"Seedream 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11346","snapshot_observed_at":"2026-08-04T20:08:56.678650Z","title":"Seedream 3.0 technical report.arXiv preprint arXiv:2504.11346, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.678650Z"},"links":{"cited_paper":"/paper/2504.11346","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:726a3f754c2802993c153630cb5a041952a8c0811bf88594dbac3a7ae97edacd","observation_id":"c4bbc6c6-5620-430b-94b2-27eedc40a862","resolution":{"observed_at":"2026-08-04T20:08:56.678650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09113","last_updated":"2025-06-28T11:58:23Z","snapshot_observed_at":"2026-08-09T02:36:54.979612Z","submitted_at":"2025-06-10T17:56:11Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09113","snapshot_observed_at":"2026-08-04T20:08:56.802057Z","title":"Seedance 1.0: Exploring the boundaries of video generation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.802057Z"},"links":{"cited_paper":"/paper/2506.09113","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:9663d07af1417310ae862f63c67b4c063a24e93c7191ef5d10895d25082454e1","observation_id":"e1ed9b66-e8ca-4b34-9f27-5433927eb701","resolution":{"observed_at":"2026-08-04T20:08:56.802057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07703","last_updated":"2025-03-10T17:58:33Z","snapshot_observed_at":"2026-07-06T20:50:09.622181Z","submitted_at":"2025-03-10T17:58:33Z","title":"Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07703","snapshot_observed_at":"2026-08-04T20:08:56.884737Z","title":"Seedream 2.0: A native chinese-english bilingual image generation foundation model.arXiv preprint arXiv:2503.07703, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.884737Z"},"links":{"cited_paper":"/paper/2503.07703","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:97046a5cfbac7942c75dd648a6b844567ea647047e817ad925a33b3e12cb34c4","observation_id":"da4d94ab-2adb-47a2-8c1f-a6dcf2fc3c85","resolution":{"observed_at":"2026-08-04T20:08:56.884737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:56.953258Z","title":"Veo.https://deepmind.google/models/veo/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:56.953258Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:1b088ca86302ca647411474bce53e5c96e845103ec4d5bbaf44799bdc7aa127f","observation_id":"d6e63974-c7c7-459b-a90b-de923f36774b","resolution":{"observed_at":"2026-08-04T20:08:56.953258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04713","last_updated":"2025-03-20T00:04:47Z","snapshot_observed_at":"2026-07-06T19:46:41.798193Z","submitted_at":"2024-11-06T05:02:29Z","title":"Multi-Reward as Condition for Instruction-based Image Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04713","snapshot_observed_at":"2026-08-04T20:08:57.041134Z","title":"Multi-reward as condition for instruction-based image editing.arXiv preprint arXiv:2411.04713, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.041134Z"},"links":{"cited_paper":"/paper/2411.04713","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:d29e62d0c3f50f11699cf805a02c39a20d251c867840923b91e79a971c94a238","observation_id":"301b6b30-f1d6-4a81-8021-787bedd2734f","resolution":{"observed_at":"2026-08-04T20:08:57.041134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-04T20:08:57.137515Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.137515Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:8a5fb028612188d8264f646fba934106765aa2c2db6d5cec9ee61c6cea518c67","observation_id":"9093d8ed-5bfb-4fb1-b9d5-4663fcf14436","resolution":{"observed_at":"2026-08-04T20:08:57.137515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.228352Z","title":"A simple and effective reinforcement learning method for text-to-image diffusion fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.228352Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:2f6bb04385e02b9d2d02f4ca7d086e703104bf0c95235326d86ec671d276987c","observation_id":"32d7c0f9-754f-47c4-b243-f3d6527613a3","resolution":{"observed_at":"2026-08-04T20:08:57.228352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.297593Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.297593Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:1854363bd0bea437a900b4aa8ccf446f5cb44af92ab5c205ca976d3f2efba023","observation_id":"31caed26-a32f-4c1d-a531-0594ffda0736","resolution":{"observed_at":"2026-08-04T20:08:57.297593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.397897Z","title":"Ideogram.https://about.ideogram.ai/1.0., 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.397897Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:9c2d93a633d7d3b62cd01e85d607428517704a98a005abb7e7d68e523a1f4ac3","observation_id":"79c2c946-32a1-47a5-a3c1-8ee6c77af671","resolution":{"observed_at":"2026-08-04T20:08:57.397897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.483267Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation.Advancesin neural information processing systems, 36:36652–36663, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.483267Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:c48bb5b0ee8f2169fac4cc5a8aabc3c7808f9cf193e4483ec70723ab82484d5c","observation_id":"b88cd1fa-c9b6-41d9-aa71-bf3d89cbaa92","resolution":{"observed_at":"2026-08-04T20:08:57.483267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.585056Z","title":"klingai.https://app.klingai.com/cn/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.585056Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:9f16ae68d9704b343d55866e1b29bca189e9ae2b57ccb8848733c97dc773fb41","observation_id":"200e654a-6de4-4478-86be-48c758073b93","resolution":{"observed_at":"2026-08-04T20:08:57.585056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-04T20:08:57.666163Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.666163Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:0b2e1f96b3284d394cde8b060f4e7af4832f3a6f560cb00176a6e03ca0bdf659","observation_id":"836d2260-1b27-41f8-82c9-82b7380589d3","resolution":{"observed_at":"2026-08-04T20:08:57.666163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.744104Z","title":"Flux: Official inference repository for flux.1 models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.744104Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:0e9dc66023397a5b583d107297ceb9983f4580a0829c0e5655548b86aa6826f4","observation_id":"af1ebe2a-2734-4c43-a81c-231af56b104d","resolution":{"observed_at":"2026-08-04T20:08:57.744104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.838549Z","title":"Flux.https://github.com/black-forest-labs/flux, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.838549Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:3addf0373ef57fee4bd6c7745c021c51114f768d4a9067dd7eaba867db7be641","observation_id":"94a153bb-e4c9-46f1-bbac-6a8c7f108c32","resolution":{"observed_at":"2026-08-04T20:08:57.838549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:57.926797Z","title":"Controlnet++: Improving conditional controls with efficient consistency feedback: Project page: liming-ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:57.926797Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:2ce1d1b1dc54f54f3e122b680387b9cad7b17b1fdf1200285c7e7a24e0119ffd","observation_id":"8e4c83b1-f2ed-44cd-91a9-df9a6b582506","resolution":{"observed_at":"2026-08-04T20:08:57.926797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02370","last_updated":"2025-05-05T05:19:40Z","snapshot_observed_at":"2026-08-07T15:56:30.594748Z","submitted_at":"2025-05-05T05:19:40Z","title":"SuperEdit: Rectifying and Facilitating Supervision for Instruction-Based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02370","snapshot_observed_at":"2026-08-04T20:08:58.003125Z","title":"Superedit: Rectifying and facilitating supervision for instruction-based image editing.arXiv preprint arXiv:2505.02370, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.003125Z"},"links":{"cited_paper":"/paper/2505.02370","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:ae4ca749254f834883e073a1fba0df5202021cad324159b9135ab7fc2ce2f0ae","observation_id":"fba2b18b-871c-4917-8670-bbc8e802f8ee","resolution":{"observed_at":"2026-08-04T20:08:58.003125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05195","last_updated":"2025-07-21T21:23:51Z","snapshot_observed_at":"2026-07-06T19:47:07.442952Z","submitted_at":"2024-11-07T21:39:51Z","title":"Exploring How Generative MLLMs Perceive More Than CLIP with the Same Vision Encoder","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05195","snapshot_observed_at":"2026-08-04T20:08:58.110097Z","title":"Exploring how generative mllms perceive more than clip with the same vision encoder.arXiv preprint arXiv:2411.05195, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.110097Z"},"links":{"cited_paper":"/paper/2411.05195","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:9b22cfe4336cc9fd08e53b6a2fe3ae4d31ca939143c91996e6f3c33bfef9a251","observation_id":"980525a9-64b4-4034-bc9c-1b258ed6ce7a","resolution":{"observed_at":"2026-08-04T20:08:58.110097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:58.185503Z","title":"An inverse scaling law for clip training.Advancesin Neural Information Processing Systems, 36:49068–49087, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.185503Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:da6edd410907adec508484291899e41e9724d6c56030b1247bc93e1137aa9ee4","observation_id":"40a2ebf7-fa29-4820-92fe-524f2545a508","resolution":{"observed_at":"2026-08-04T20:08:58.185503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05472","last_updated":"2025-05-11T18:47:18Z","snapshot_observed_at":"2026-08-04T22:02:38.792513Z","submitted_at":"2025-05-08T17:58:57Z","title":"Mogao: An Omni Foundation Model for Interleaved Multi-Modal Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05472","snapshot_observed_at":"2026-08-04T20:08:58.270191Z","title":"Mogao: An omni foundation model for interleaved multi-modal generation.arXiv preprint arXiv:2505.05472, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.270191Z"},"links":{"cited_paper":"/paper/2505.05472","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:5b14a8f2c7c9a9f4d8bae52ba1ab505c1d84032db6283b8dfe9dca6e553bbeb0","observation_id":"9e56985d-a38c-4a4a-bc8a-387d8247ca8e","resolution":{"observed_at":"2026-08-04T20:08:58.270191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-04T20:08:58.373978Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.373978Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:8d9371d542b6f89ed44b163ef8024729e01ca88262a166031327d7104ad89c62","observation_id":"dbb474ed-47dd-4165-879f-85a61565a7b8","resolution":{"observed_at":"2026-08-04T20:08:58.373978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-06T11:11:00.378627Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-08-04T20:08:58.469893Z","title":"Flow-grpo: Training flow matching models via online rl.arXiv preprint arXiv:2505.05470, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.469893Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:088d10310e0ae4e9b859a69f8849098ca668cee90a4b5d49e8a0b01a7cc81f4c","observation_id":"8fa26720-2d27-44f9-ab9f-4fc28f386f7a","resolution":{"observed_at":"2026-08-04T20:08:58.469893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13918","last_updated":"2025-10-27T08:22:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-23T18:55:41Z","title":"Improving Video Generation with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13918","snapshot_observed_at":"2026-08-04T20:08:58.572097Z","title":"Improving video generation with human feedback.arXiv preprint arXiv:2501.13918, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.572097Z"},"links":{"cited_paper":"/paper/2501.13918","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:cff5aadea14cee3c09ebd4d7a30e4e2d807b241c4940ca46194deaa8bacd2531","observation_id":"dcf4dd50-8905-4504-afa9-b61b94c65d46","resolution":{"observed_at":"2026-08-04T20:08:58.572097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:58.678868Z","title":"Inference-time scaling for generalist reward modeling.arXiv preprint arXiv:2504.02495, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.678868Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:d7013c7f075477de4bd758e8c9a668d3fc9dfc5bf1a758465a47d421cabd1b63","observation_id":"b90777e3-0f54-4c9f-b360-3e758cd57151","resolution":{"observed_at":"2026-08-04T20:08:58.678868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:58.744034Z","title":"lumalabs.https://lumalabs.ai/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.744034Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:dcf74fb32090a647c073a360add363d59d36ef57409e28ef3c78e3992fbf6140","observation_id":"d26e027a-12f0-4535-b7df-455007611c6f","resolution":{"observed_at":"2026-08-04T20:08:58.744034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-08-04T20:08:58.832391Z","title":"Step-video-t2v technical report: The practice, challenges, and future of video foundation model.arXiv preprint arXiv:2502.10248, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.832391Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:428eed64e8a401461149b5f5de79383c7badffc21e6bf8383ff71ae538512a5b","observation_id":"e5445f7e-d9e2-48ea-89bf-662cbd1b64c2","resolution":{"observed_at":"2026-08-04T20:08:58.832391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-07-06T20:22:04.328179Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09732","snapshot_observed_at":"2026-08-04T20:08:58.890930Z","title":"Inference-time scaling for diffusion models beyond scaling denoising steps","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.890930Z"},"links":{"cited_paper":"/paper/2501.09732","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:371173e7f5bafce8acee0e26bb24b58b4d879889025645dad853ef4d3ddcd873","observation_id":"873f0fa2-ce1c-463e-81ea-5695252c4ed2","resolution":{"observed_at":"2026-08-04T20:08:58.890930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03789","last_updated":"2025-08-22T08:53:37Z","snapshot_observed_at":"2026-08-07T20:35:27.515637Z","submitted_at":"2025-08-05T17:17:13Z","title":"HPSv3: Towards Wide-Spectrum Human Preference Score","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03789","snapshot_observed_at":"2026-08-04T20:08:58.995776Z","title":"Hpsv3: Towards wide-spectrum human preference score","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:58.995776Z"},"links":{"cited_paper":"/paper/2508.03789","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:2382ebb808c3c25422c8f608e8c769982cfcbb0c407b3479f8b54e0e9dd768d2","observation_id":"3930fdb3-dd8b-4d9a-abf8-1030b39d043a","resolution":{"observed_at":"2026-08-04T20:08:58.995776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.094853Z","title":"midjourney.https://www.midjourney.com/home, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.094853Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:3d3d5508e446e8c02215d5315aacf148609b0bf4ce73d9d1a28e5438d4d4b61a","observation_id":"69192038-94c5-445a-bf15-8916ef183f2f","resolution":{"observed_at":"2026-08-04T20:08:59.094853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.185710Z","title":"Inference-time text-to-video alignment with diffusion latent beam search.arXiv preprint arXiv:2501.19252, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.185710Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:9658c9d0126ca790ebb8464f12a67dd1983885c2bf2c71ca7a0c0285141507d8","observation_id":"d0664f12-d885-48ec-a8de-318928b50deb","resolution":{"observed_at":"2026-08-04T20:08:59.185710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.294363Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.294363Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:c099149e3315834e7b633e3d241d02f31e2e7002a2a183539cf22c8f0fde6647","observation_id":"668c5b5a-e40c-4444-9aaf-14c4c7247767","resolution":{"observed_at":"2026-08-04T20:08:59.294363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-04T20:08:59.377336Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.377336Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:c578aa8de99b84e8fd2b05ee56dba89017d698af1faf75dd53ed3f3c5f3e6504","observation_id":"866901a6-8d1e-4f11-9f59-ecec90bfcced","resolution":{"observed_at":"2026-08-04T20:08:59.377336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-04T20:08:59.470265Z","title":"Hierarchical text-conditional image generation with clip latents.arXiv preprint arXiv:2204.06125, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.470265Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:d53df68ee97b84d01eb26e151d6494634df788005273a6ee979b31ffa9c7d4c4","observation_id":"977bd8af-fed2-4656-ba94-2b087858437a","resolution":{"observed_at":"2026-08-04T20:08:59.470265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.549832Z","title":"What makes a reward model a good teacher? an optimization perspective.arXiv preprint arXiv:2503.15477, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.549832Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:bf42b5c88df6f87549cc88507473c5347be3c94c31c7a4c923c3b70c85d7273f","observation_id":"efc721e4-fdb0-4f99-a5ea-fab919a1130e","resolution":{"observed_at":"2026-08-04T20:08:59.549832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.607627Z","title":"recraft.https://www.recraft.ai/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.607627Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:3ccd29e71f341a493332db052f9815acd3789d76c9311973decc6e095d58b12f","observation_id":"e3b317e8-9a99-42d8-87b3-6274f9ad808e","resolution":{"observed_at":"2026-08-04T20:08:59.607627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.703606Z","title":"Byteedit: Boost, comply and accelerate generative image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.703606Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:6c90ba1c6799dd5d43cf6596bf691da9b17dd95dc340ab1fa94856fb8f51fd12","observation_id":"81fb23ff-d3e2-4f00-99b9-c2f63a0f3a80","resolution":{"observed_at":"2026-08-04T20:08:59.703606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.800075Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.800075Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:a0a0ea54ca9b6095564b673625595bee2cc661dd523fd7e7f2a935cadbc39221","observation_id":"5da2af02-3f3f-409f-baf2-707e228638a6","resolution":{"observed_at":"2026-08-04T20:08:59.800075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:08:59.895610Z","title":"Runway.https://runwayml.com/research/introducing-runway-gen-4, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.895610Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:c5ea2016a51d3bff185218e75be44f038e71db9fca34f90b295896d1fb675588","observation_id":"f14a6ad6-6c8e-4c6e-bb67-41c035ef8863","resolution":{"observed_at":"2026-08-04T20:08:59.895610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08685","last_updated":"2025-05-05T03:31:30Z","snapshot_observed_at":"2026-08-11T03:47:05.420581Z","submitted_at":"2025-04-11T16:46:20Z","title":"Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08685","snapshot_observed_at":"2026-08-04T20:08:59.968870Z","title":"Seaweed-7b: Cost-effective training of video generation foundation model.arXiv preprint arXiv:2504.08685, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T20:08:59.968870Z"},"links":{"cited_paper":"/paper/2504.08685","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:1b4d69c8f171106dce7e612f79e57f3194952ee2085544be2ba4226761ab19db","observation_id":"064fc98f-5828-48a3-ba5a-292bb297fa5d","resolution":{"observed_at":"2026-08-04T20:08:59.968870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:00.052186Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.052186Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:77eec35bc58529d5d8a5c5da832c48ad7bbc43d37478dc3e4d6adbf5f193f830","observation_id":"d208184c-7791-4c8a-a987-fc85114cded9","resolution":{"observed_at":"2026-08-04T20:09:00.052186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-04T20:09:00.112624Z","title":"Score-based generative modeling through stochastic differential equations.arXiv preprint arXiv:2011.13456, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.112624Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:42a44921b472396c5254486becca1ab6dd76ba9ed2531774a1b331cb69b6d6ae","observation_id":"83058bb5-07f5-4989-a8b5-0a2f1f9925b6","resolution":{"observed_at":"2026-08-04T20:09:00.112624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06525","last_updated":"2024-06-10T17:59:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-10T17:59:52Z","title":"Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06525","snapshot_observed_at":"2026-08-04T20:09:00.245755Z","title":"Autoregressive model beats diffusion: Llama for scalable image generation.arXiv preprint arXiv:2406.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.245755Z"},"links":{"cited_paper":"/paper/2406.06525","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:f6ca526fd2a4935087bdea047c3b4fd0b8547220eb7169cac1f7d37ca2677327","observation_id":"a6df593d-ba6d-4eeb-a27b-ee3828f84c4b","resolution":{"observed_at":"2026-08-04T20:09:00.245755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:00.340485Z","title":"Diffusion model alignment using direct preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.340485Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:c150d33183598d02fe074891c62cc4956ed5358966c414087a36204a29833603","observation_id":"4b61a4f2-c478-4e5b-bc2e-49d7706edeef","resolution":{"observed_at":"2026-08-04T20:09:00.340485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-04T20:09:00.409906Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.409906Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:b1c405b0309703cd2e522f82690da63fd8af6004322c2b3acd32244499e34af5","observation_id":"02bedef1-7f2a-4ce3-bb51-59c74b8c2387","resolution":{"observed_at":"2026-08-04T20:09:00.409906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10527","last_updated":"2025-05-18T17:45:31Z","snapshot_observed_at":"2026-08-11T04:55:17.296477Z","submitted_at":"2025-05-15T17:38:37Z","title":"WorldPM: Scaling Human Preference Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10527","snapshot_observed_at":"2026-08-04T20:09:00.504202Z","title":"Worldpm: Scaling human preference modeling.arXiv preprint arXiv:2505.10527, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.504202Z"},"links":{"cited_paper":"/paper/2505.10527","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:6d81183534da0c748b33caa527a0881e9a050f0990fb7d78be2b1c1a992c07e3","observation_id":"c6887f61-aa82-4a10-9f0e-16a07b78309b","resolution":{"observed_at":"2026-08-04T20:09:00.504202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-04T20:09:00.588199Z","title":"Emu3: Next-token prediction is all you need.arXiv preprint arXiv:2409.18869, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.588199Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:6ded1062440af6f833f330fb1ed7fe9b1c0ff0829018462d1764b001332b2cc4","observation_id":"de72a69d-f92c-4349-9115-e5f9f698a074","resolution":{"observed_at":"2026-08-04T20:09:00.588199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:00.663870Z","title":"Unified multimodal chain-of-thought reward model through reinforcement fine-tuning.arXiv preprint arXiv:2505.03318, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.663870Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:53bbc2cf4723acac42186d272d8376937b3cf7bd96006b009cadb7ef9a4804b8","observation_id":"6efd3f03-2a1b-4d8e-b84f-c6ee7772ab80","resolution":{"observed_at":"2026-08-04T20:09:00.663870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05584","last_updated":"2025-02-14T01:21:57Z","snapshot_observed_at":"2026-07-06T19:29:27.705770Z","submitted_at":"2024-10-08T00:52:03Z","title":"Rethinking Reward Model Evaluation: Are We Barking up the Wrong Tree?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05584","snapshot_observed_at":"2026-08-04T20:09:00.786327Z","title":"Rethinking reward model evaluation: Are we barking up the wrong tree?arXiv preprint arXiv:2410.05584, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.786327Z"},"links":{"cited_paper":"/paper/2410.05584","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:7235ce0f8469fc4516ffaf57ebccac714a7fdf168c737d1986bcb15f32047f8e","observation_id":"efae6b3f-4095-4f72-8914-968501479d83","resolution":{"observed_at":"2026-08-04T20:09:00.786327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-04T20:09:00.883913Z","title":"Qwen-image technical report.arXiv preprint arXiv:2508.02324, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.883913Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:cdf13ccf859cfb71d382028848c7f8dfb5846b749482e83b4bba78a209ddf12e","observation_id":"eb924bd3-99c4-4e38-a602-3e7f9fda43e7","resolution":{"observed_at":"2026-08-04T20:09:00.883913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14420","last_updated":"2023-08-22T12:26:07Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T10:09:03Z","title":"Human Preference Score: Better Aligning Text-to-Image Models with Human Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14420","snapshot_observed_at":"2026-08-04T20:09:00.976315Z","title":"Better aligning text-to-image models with human preference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:00.976315Z"},"links":{"cited_paper":"/paper/2303.14420","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:fd387428a83bbf58142c8236ad21c365f020325dbca5d2b89d30ccd0b75b19b0","observation_id":"46e3a5f9-eca2-47eb-a390-548ed9974217","resolution":{"observed_at":"2026-08-04T20:09:00.976315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.048080Z","title":"Human preference score: Better aligning text-to-image models with human preference","venue":null,"work_id":null,"year":2096},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.048080Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:4ab794bbb770e04a5d3da6884d7b0e4a613258c1d5218076aa41d6faae86a62d","observation_id":"2d92b21d-ec74-43a2-b9b2-9b58ff1aa849","resolution":{"observed_at":"2026-08-04T20:09:01.048080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.130666Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.130666Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:7c253f211aee37cc70a22fda5a4b12b7d28711aceeaad4db60d5ad26ba1e65c6","observation_id":"aa80b625-a1c6-4678-a710-15e30fb59008","resolution":{"observed_at":"2026-08-04T20:09:01.130666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21059","last_updated":"2026-01-05T02:39:01Z","snapshot_observed_at":"2026-08-11T09:26:15.802106Z","submitted_at":"2024-12-30T16:24:09Z","title":"VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21059","snapshot_observed_at":"2026-08-04T20:09:01.179272Z","title":"Visionreward: Fine-grained multi-dimensional human preference learning for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.179272Z"},"links":{"cited_paper":"/paper/2412.21059","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:602a93e5ff07e0ef8097b97af19089e65ed49a244d84027804c2ed2d1880cfce","observation_id":"5101a8db-ce9f-4fd1-bb50-799474662b82","resolution":{"observed_at":"2026-08-04T20:09:01.179272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04950","last_updated":"2025-04-07T11:34:48Z","snapshot_observed_at":"2026-08-09T18:50:35.357492Z","submitted_at":"2025-04-07T11:34:48Z","title":"A Unified Pairwise Framework for RLHF: Bridging Generative Reward Modeling and Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04950","snapshot_observed_at":"2026-08-04T20:09:01.240055Z","title":"A unified pairwise framework for rlhf: Bridging generative reward modeling and policy optimization.arXiv preprint arXiv:2504.04950, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.240055Z"},"links":{"cited_paper":"/paper/2504.04950","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:0b58ff197cc64b125ff27c0493ed49b963448b78f3627ab2b10ecae18e4524cc","observation_id":"96ff8a98-aaa1-4426-84c9-7d72a24e8711","resolution":{"observed_at":"2026-08-04T20:09:01.240055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-08-10T06:20:33.458844Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-08-04T20:09:01.340171Z","title":"Dancegrpo: Unleashing grpo on visual generation.arXiv preprint arXiv:2505.07818, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.340171Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:5fe7f17defce741c2d79f0a60c09f9af5acab7de6575db3afcd15201a7b46e6b","observation_id":"04c91260-2b23-467c-90c4-d1a0b87aea58","resolution":{"observed_at":"2026-08-04T20:09:01.340171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.438578Z","title":"Schedule on the fly: Diffusion time prediction for faster and better image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.438578Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:7ab6738ed32a520dd194dec43950f61ac005a7bdfd9131731a000366e6a02d91","observation_id":"b0c408f1-1a71-4588-a01e-4be385e58372","resolution":{"observed_at":"2026-08-04T20:09:01.438578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.521145Z","title":"Make pixels dance: High-dynamic video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.521145Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:79a0a23e26ae2633a0e28cc88495257ec781a71874a4f71aa971137900844460","observation_id":"a019f125-4279-4470-a980-f33dec0ff0f8","resolution":{"observed_at":"2026-08-04T20:09:01.521145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.617649Z","title":"Onlinevpo: Align video diffusion model with online video-centric preference optimization.arXiv preprint arXiv:2412.15159, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.617649Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:feca5d7f2dac56e929e18d7e612df4560f974ee6341e4147feb88d85cd77658a","observation_id":"14d30f9e-c529-4d55-86ff-ac7fe409c8c4","resolution":{"observed_at":"2026-08-04T20:09:01.617649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:09:01.735214Z","title":"Unifl: Improve latent diffusion model via unified feedback learning.Advances in Neural Information Processing Systems, 37:67355–67382, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.735214Z"},"links":{"citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:fff343d1baa91ffd3abe94d5fb8a124cf0613e20ea2e39093324f7f21c69832a","observation_id":"844e159e-4617-4f71-98e5-b22ea819c96f","resolution":{"observed_at":"2026-08-04T20:09:01.735214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-11T04:34:07.318549Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-04T20:09:01.822336Z","title":"Fine-tuning language models from human preferences.arXiv preprint arXiv:1909.08593, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-04T20:09:01.822336Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2509.08826"},"observation_digest":"sha256:6d730c9f2c165df70c4d274b5db61f21171efa776fd8655c13708ba69c263e3d","observation_id":"a1fc5e6d-cd38-4165-878f-3d41f14e96dd","resolution":{"observed_at":"2026-08-04T20:09:01.822336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T13:17:31.643163Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":72,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 30 inbound Pith citation observations for arXiv:2509.08826."}