{"as_of":"2026-08-10T14:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0b80481838b746de88af0d3f0918d3d92fd1f7aae32e2fc4ed57e1c372b20404","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":33,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T12:27:47.932904Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:08:22.301987Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T23:51:23.877344Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2311.04145"},"observation_digest":"sha256:2f69ec609d94cd039d37766eedc04e63da90d7f20546b06efa754a076da7d754","observation_id":"280f688d-2333-4a01-b8eb-c1b3d00dbdf1","resolution":{"observed_at":"2026-05-17T23:51:24.060207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"reference_index":186,"source":"pdf_text","source_observed_at":"2026-05-13T13:43:11.024069Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2402.17177"},"observation_digest":"sha256:5abda977b9c19a375e8734700cba2330d7a8df1d84c357f4ef2bf2e66d1c49d1","observation_id":"9de333e7-261f-4c71-814f-a6189ca5bbbc","resolution":{"observed_at":"2026-05-13T13:43:11.271213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-05-13T02:06:23.410241Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2404.02101"},"observation_digest":"sha256:5c6bdc9700d8acafa3fbe02562b1d162a571cd3974f22b16eb65392d05be942a","observation_id":"b3ee7103-220d-4f5e-9dc5-395356b3e0d3","resolution":{"observed_at":"2026-05-13T02:06:23.587705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2412.14803","last_updated":"2025-05-04T04:28:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T12:48:40Z","title":"Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-12T18:38:11.110166Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2412.14803"},"observation_digest":"sha256:119dc38d9a1f4f1dee66a05c95b82ec8cc205d1eee16d74a51ddcd98f1827093","observation_id":"e867b2ac-66b0-4c0e-9456-3ad609691e8c","resolution":{"observed_at":"2026-05-12T18:38:11.296554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-10T12:27:47.932904Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16550","last_updated":"2025-03-26T17:59:18Z","snapshot_observed_at":"2026-08-10T12:20:54.893289Z","submitted_at":"2025-01-27T22:48:36Z","title":"PhysAnimator: Physics-Guided Generative Cartoon Animation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T12:27:47.932904Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2501.16550"},"observation_digest":"sha256:b477b0f378d750dcf3de0b04a93a388da8aacb4dd05c223b253ec410f5235ba7","observation_id":"1a5fdd04-4ce2-4153-9099-5d48615e26b3","resolution":{"observed_at":"2026-08-10T12:27:47.932904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-10T11:17:24.740435Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-10T11:09:58.679558Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.740435Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:c14ed2ebc4bef383208610bdc90db32d44c548d541fc8f33e9d54cbba5fd506e","observation_id":"ad45eb0c-e1c2-46d8-9716-2eb1cc99efbc","resolution":{"observed_at":"2026-08-10T11:17:24.740435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-09T21:50:38.444944Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18982","last_updated":"2025-01-31T09:28:07Z","snapshot_observed_at":"2026-08-10T04:19:27.689866Z","submitted_at":"2025-01-31T09:28:07Z","title":"OmniPhysGS: 3D Constitutive Gaussians for General Physics-Based Dynamics Generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T21:50:38.444944Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2501.18982"},"observation_digest":"sha256:f4df36ef9ede1e91599ff9c77f3905b18882443a62184d609485884fdb58ce6c","observation_id":"c4287770-89b2-437b-a397-0e76d9716def","resolution":{"observed_at":"2026-08-09T21:50:38.444944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-09T16:42:11.047947Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01101","last_updated":"2025-02-17T05:49:03Z","snapshot_observed_at":"2026-08-09T16:32:38.931306Z","submitted_at":"2025-02-03T06:45:00Z","title":"VidSketch: Hand-drawn Sketch-Driven Video Generation with Diffusion Control","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T16:42:11.047947Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2502.01101"},"observation_digest":"sha256:f350906b659273d7e34904ac5894b6e925dc3c84113aeb0c28b5e1b955d24c05","observation_id":"0433f412-4ab3-44b6-a761-bb07c0e58e1a","resolution":{"observed_at":"2026-08-09T16:42:11.047947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-08T00:02:56.746313Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08639","last_updated":"2025-02-12T18:55:36Z","snapshot_observed_at":"2026-08-09T23:14:28.470569Z","submitted_at":"2025-02-12T18:55:36Z","title":"CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T00:02:56.746313Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2502.08639"},"observation_digest":"sha256:0d5daeedeb50b5e4b8626cf7b5f0bc219b497e7f652516d72b245a32d591d2a1","observation_id":"866547a4-cdd9-4e22-a574-04109815eb0b","resolution":{"observed_at":"2026-08-08T00:02:56.746313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T00:53:53.855965Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2503.07598"},"observation_digest":"sha256:6b4c3eac5a3bea3419fb92e77618bacd84d0b78c8d0ea8e98e593ceb72dd30bc","observation_id":"7af76aaa-1253-415a-b791-e08e6d92b745","resolution":{"observed_at":"2026-05-16T00:53:54.072091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2504.18576","last_updated":"2026-04-24T20:54:23Z","snapshot_observed_at":"2026-07-06T21:14:57.707919Z","submitted_at":"2025-04-22T20:58:22Z","title":"DriVerse: Navigation World Model for Driving Simulation via Multimodal Trajectory Prompting and Motion Alignment","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T17:50:59.797593Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2504.18576"},"observation_digest":"sha256:2befbf3ec24b81e9a5bda6dee317c16f603ed4305be8a6db0957c5504f6b6c14","observation_id":"39eb1e77-0228-4df2-911b-f524723c8380","resolution":{"observed_at":"2026-05-22T17:51:54.746635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-07T15:12:00.756816Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15973","last_updated":"2025-05-21T19:44:58Z","snapshot_observed_at":"2026-08-09T22:34:17.522518Z","submitted_at":"2025-05-21T19:44:58Z","title":"An Exploratory Study on Multi-modal Generative AI in AR Storytelling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:00.756816Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2505.15973"},"observation_digest":"sha256:c583f6b0194818f6a9bf3d2cb7aa975d291ae4c62a9a6325a135e5897bdc5898","observation_id":"5e47fd2c-d8dd-4aa0-a0f1-eff3369826b8","resolution":{"observed_at":"2026-08-07T15:12:00.756816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-07T14:01:03.409169Z","title":"Control- A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning.arXiv preprint arXiv:2305.13840, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20287","last_updated":"2025-05-26T17:59:03Z","snapshot_observed_at":"2026-08-08T15:17:55.449062Z","submitted_at":"2025-05-26T17:59:03Z","title":"MotionPro: A Precise Motion Controller for Image-to-Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:03.409169Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2505.20287"},"observation_digest":"sha256:e0a0f2e0c8627062d69f678afa0a645e8451dc11f697970178e3479b9d3dedc6","observation_id":"0be76838-8be6-4e89-8bb3-0b843dbf6371","resolution":{"observed_at":"2026-08-07T14:01:03.409169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-07T13:28:09.669138Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21876","last_updated":"2026-05-28T08:11:37Z","snapshot_observed_at":"2026-08-07T13:18:12.902974Z","submitted_at":"2025-05-28T01:45:26Z","title":"EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:09.669138Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2505.21876"},"observation_digest":"sha256:343452b9bb9f94f0ba1c73f10874478e8f0b77c8150579fb4069152729620bc8","observation_id":"6265bb98-6f1b-4913-b877-b4e52f862804","resolution":{"observed_at":"2026-08-07T13:28:09.669138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-07T12:35:24.670951Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24253","last_updated":"2025-05-30T06:19:47Z","snapshot_observed_at":"2026-08-09T06:21:13.971589Z","submitted_at":"2025-05-30T06:19:47Z","title":"Interactive Video Generation via Domain Adaptation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:24.670951Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2505.24253"},"observation_digest":"sha256:4df8a3ee551fb04fe2ac8987ca425942b056ee548092c8250c1671ee7e6da0fb","observation_id":"68360018-16aa-456e-a8ba-faf14a0f6bfd","resolution":{"observed_at":"2026-08-07T12:35:24.670951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-06T23:12:53.285283Z","title":"Control-a-video: Controllable text-to-video diffusion models with motion prior and reward feedback learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19348","last_updated":"2026-07-08T01:33:00Z","snapshot_observed_at":"2026-08-09T02:19:01.382750Z","submitted_at":"2025-06-24T06:20:15Z","title":"When Distillation Breaks Motion Control: Restoring Generative Trajectories for Fast Video Generators","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:12:53.285283Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2506.19348"},"observation_digest":"sha256:09322046fdafd2f144fa6eca36e0db98d2b0a88fd0a79265c634fb0f8f621f64","observation_id":"10f03514-d42c-4e74-83a9-e630447132f2","resolution":{"observed_at":"2026-08-06T23:12:53.285283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-06T15:40:17.683695Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15292","last_updated":"2025-07-24T13:26:19Z","snapshot_observed_at":"2026-08-07T05:46:43.750771Z","submitted_at":"2025-07-21T06:47:44Z","title":"EndoControlMag: Robust Endoscopic Vascular Motion Magnification with Periodic Reference Resetting and Hierarchical Tissue-aware Dual-Mask Control","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:40:17.683695Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2507.15292"},"observation_digest":"sha256:fdb15db433559018d285f55c3731ad34ebf48c9af40eec06b0c727b8c2602314","observation_id":"8a7a2673-c916-48ea-9f68-c39579bb1386","resolution":{"observed_at":"2026-08-06T15:40:17.683695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2602.13669","last_updated":"2026-04-22T07:41:44Z","snapshot_observed_at":"2026-07-06T22:45:53.926021Z","submitted_at":"2026-02-14T08:32:38Z","title":"EchoTorrent: Towards Swift, Sustained, and Streaming Multi-Modal Video Generation","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T22:20:16.320171Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2602.13669"},"observation_digest":"sha256:156505dca11980ef1477c7a6aed574f45543e7efafaf5e642d533fb101f03d81","observation_id":"5555296c-c5d0-467e-a650-d84d77d99eb3","resolution":{"observed_at":"2026-05-15T22:20:22.235144Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-14T21:09:36.040879Z","title":"arXiv preprint arXiv:2305.13840 (2023) 4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.14526","last_updated":"2026-06-28T22:57:12Z","snapshot_observed_at":"2026-08-10T14:27:22.776378Z","submitted_at":"2026-03-15T18:07:29Z","title":"LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T21:09:36.040879Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2603.14526"},"observation_digest":"sha256:a80bd110c282480f06d70862a771f4fa69cb4778bec3c3e4b495c9931017ee47","observation_id":"6a639890-01dd-4c01-a990-a90f8e36c5d4","resolution":{"observed_at":"2026-07-14T21:09:36.040879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2603.29092","last_updated":"2026-05-19T01:55:09Z","snapshot_observed_at":"2026-08-02T07:26:05.311068Z","submitted_at":"2026-03-31T00:15:36Z","title":"TrajectoryMover: Generative Movement of Object Trajectories in Videos","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T00:19:36.166355Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2603.29092"},"observation_digest":"sha256:7623d43544b7fe060d2e935bfb052621d3c38ceef93fce2de82762e70ca18db0","observation_id":"963b8f16-2487-4a69-9323-5706928ec06b","resolution":{"observed_at":"2026-05-14T00:23:29.619402Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2603.29092","last_updated":"2026-05-19T01:55:09Z","snapshot_observed_at":"2026-08-02T07:26:05.311068Z","submitted_at":"2026-03-31T00:15:36Z","title":"TrajectoryMover: Generative Movement of Object Trajectories in Videos","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T11:05:30.004725Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2603.29092"},"observation_digest":"sha256:9227f5601bf18f0f075f9dc33e727deb7fa5ba14d79553f4e969deda5e7b3d87","observation_id":"dc539390-1a74-46f5-8cfd-14337854069a","resolution":{"observed_at":"2026-05-21T11:10:02.273692Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2604.02467","last_updated":"2026-04-27T18:17:15Z","snapshot_observed_at":"2026-08-02T13:43:39.563153Z","submitted_at":"2026-04-02T18:58:56Z","title":"VERTIGO: Visual Preference Optimization for Cinematic Camera Trajectory Generation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T21:14:42.021240Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2604.02467"},"observation_digest":"sha256:eb9517c19238388e1f5dd177d226f198ac2ac17cc8f4be61be8f430af7f179b6","observation_id":"0b8f6de3-841f-41a7-90c5-78395243a1d5","resolution":{"observed_at":"2026-05-13T21:18:17.214760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2604.19679","last_updated":"2026-06-29T16:38:23Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T16:57:23Z","title":"MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T02:55:09.008954Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2604.19679"},"observation_digest":"sha256:5818f9ea5f6fbb0306fdba421ec2710c6cb97d53cfde851c9709afac49e43573","observation_id":"5a377280-6e9d-4670-998b-c61a273fe260","resolution":{"observed_at":"2026-05-11T12:46:27.987657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.10543","last_updated":"2026-05-25T17:58:28Z","snapshot_observed_at":"2026-08-02T23:34:29.256048Z","submitted_at":"2026-05-11T13:23:14Z","title":"TIE: Time Interval Encoding for Video Generation over Events","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T04:26:23.558427Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.10543"},"observation_digest":"sha256:1a0dffd8eac43adb55ccb57c4ff243cfd4b7c7b6b9028eda4c3f2654792e78cd","observation_id":"5af1e70f-c28f-4b46-90d5-accaab4d1253","resolution":{"observed_at":"2026-05-12T06:16:28.071650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.10543","last_updated":"2026-05-25T17:58:28Z","snapshot_observed_at":"2026-08-02T23:34:29.256048Z","submitted_at":"2026-05-11T13:23:14Z","title":"TIE: Time Interval Encoding for Video Generation over Events","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T22:47:55.768380Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.10543"},"observation_digest":"sha256:2d41f45ef7583adcaa2f5c04ba11119596ee9b5ff0ac0807c51fb57e82dad3cc","observation_id":"b3a478e2-0c81-4b5d-b64f-9e7129a9deab","resolution":{"observed_at":"2026-07-01T13:45:45.966257Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.15116","last_updated":"2026-05-14T17:29:35Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:29:35Z","title":"DriveCtrl: Conditioned Sim-to-Real Driving Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T21:06:06.548538Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.15116"},"observation_digest":"sha256:c55d34d99e119e77ca2e2382283e3bad68a1223731f08e6b6d6eb6576675c335","observation_id":"da9572a3-4278-46c2-a49a-467768c04d03","resolution":{"observed_at":"2026-06-30T21:15:04.792745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.15256","last_updated":"2026-05-14T17:52:03Z","snapshot_observed_at":"2026-08-06T12:51:31.154504Z","submitted_at":"2026-05-14T17:52:03Z","title":"ReactiveGWM: Steering NPC in Reactive Game World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T16:32:57.227291Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.15256"},"observation_digest":"sha256:07d1168b58de10da92dabc31fc8f4c8cc4a4bb560d5ac2eb0b9430ae1f961820","observation_id":"184c5922-45a2-49bf-a756-be55cbf6ce69","resolution":{"observed_at":"2026-05-19T16:33:08.255618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.23602","last_updated":"2026-05-22T13:11:23Z","snapshot_observed_at":"2026-08-02T15:51:31.409896Z","submitted_at":"2026-05-22T13:11:23Z","title":"GlowGS: Generative Semantic Feature Learning for 3D Gaussian Splatting in Nighttime Glow Scenes","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T04:59:57.934468Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.23602"},"observation_digest":"sha256:6eb4a9d88d6b175544a9f30fe8eed51f4c32adbe7498b0cdf112c95c8add9645","observation_id":"539acb2b-9844-462f-b9e9-dbdf4976ab41","resolution":{"observed_at":"2026-05-25T05:00:21.448039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2605.29509","last_updated":"2026-05-28T07:31:22Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:31:22Z","title":"KGEdit: Ambiguity-Aware Knowledge Graphs for Training-Free Precise Video Generation and Editing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T08:46:56.390567Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2605.29509"},"observation_digest":"sha256:8e79ee37659ff4a4e471e4511bf2938671efda056914e81c891adf06f59e7291","observation_id":"3b51de1b-3ff5-4d0a-80b9-b1a8d76c729b","resolution":{"observed_at":"2026-06-29T08:53:16.145069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2606.02586","last_updated":"2026-05-11T16:42:10Z","snapshot_observed_at":"2026-08-05T10:31:48.098328Z","submitted_at":"2026-05-11T16:42:10Z","title":"Fewer, Better Frames: A Compute-Normalized Proof of Concept for Coherence-First World-Model Rendering with Model-Guided FSR4 Frame Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T22:23:32.586583Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2606.02586"},"observation_digest":"sha256:be194d4d2fbb9908d2ad22efca9beb5f556214ec633e455fc56c57d081261e91","observation_id":"77c00844-e55f-42b1-af7c-2754800aaaac","resolution":{"observed_at":"2026-06-30T22:25:06.905310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2606.13432","last_updated":"2026-06-11T14:58:28Z","snapshot_observed_at":"2026-08-07T08:13:15.764180Z","submitted_at":"2026-06-11T14:58:28Z","title":"OmniDirector: General Multi-Shot Camera Cloning without Cross-Paired Data","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-27T07:11:06.592722Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2606.13432"},"observation_digest":"sha256:41f23a733492e607e10224b82501a30244151d25143dfb3ba927da12ce2efe4d","observation_id":"1ed944a4-e1c5-4b70-aec3-21328f7ec536","resolution":{"observed_at":"2026-07-03T14:08:22.303472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":"2305.13840","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-03T14:08:22.301987Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"321f338a-78e3-419f-81b0-cce38abc7207","year":2023},"citing_paper":{"arxiv_id":"2606.29020","last_updated":"2026-06-27T17:38:21Z","snapshot_observed_at":"2026-07-07T00:03:02.476882Z","submitted_at":"2026-06-27T17:38:21Z","title":"Semantic-Aware, Physics-Informed, Geometry-Grounded Weather Video Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T09:19:50.748415Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2606.29020"},"observation_digest":"sha256:97956406c64ed982a5483a5db5b4f4beecc23cd12c9a230e60ac793f71c1661e","observation_id":"81c939f4-78cf-4879-91f1-a9353615b0ea","resolution":{"observed_at":"2026-06-30T09:24:32.498002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-07-11T09:28:19.511968Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05056","last_updated":"2026-07-06T13:29:28Z","snapshot_observed_at":"2026-08-06T03:32:27.768727Z","submitted_at":"2026-07-06T13:29:28Z","title":"Consistent and Editable: A Balanced Framework for Text-Guided Video Editing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T09:28:19.511968Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2607.05056"},"observation_digest":"sha256:b343717e8b69ea9988f75fc61ee5fc7ae194affe95300ad6cd39ca6541b7bc59","observation_id":"292ce81a-d339-4c47-b250-a5930df2e200","resolution":{"observed_at":"2026-07-11T09:28:19.511968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.13840/citation-record","integrity":"/paper/2305.13840/integrity","json":"/paper/2305.13840/citation-record.json","paper":"/paper/2305.13840"},"outbound":[],"paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T15:31:13.189124Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 33 inbound Pith citation observations for arXiv:2305.13840."}