{"as_of":"2026-08-13T01:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:282f158a26d9e9324d1262ebefca360ba588c2ff464560ecb5adb46b1c72b405","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:03:42.668361Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:15:09.778793Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T15:36:10.046788Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16819","snapshot_observed_at":"2026-08-11T23:15:09.778793Z","title":"Pathways on the image man- ifold: Image editing via video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02700","last_updated":"2025-03-27T21:38:09Z","snapshot_observed_at":"2026-08-12T15:54:04.110044Z","submitted_at":"2024-12-03T18:59:56Z","title":"Motion Prompting: Controlling Video Generation with Motion Trajectories","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T23:15:09.778793Z"},"links":{"cited_paper":"/paper/2411.16819","citing_paper":"/paper/2412.02700"},"observation_digest":"sha256:21cffbd74d9f10358e41ba8fbce10c9908d127ecb94c9c33c32487e7daf549c8","observation_id":"de530a60-27cf-4c8c-be28-2804485ab5cb","resolution":{"observed_at":"2026-08-11T23:15:09.778793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16819","snapshot_observed_at":"2026-08-10T22:42:02.146112Z","title":"arXiv preprint arXiv:2411.16819 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00975","last_updated":"2025-01-01T22:58:06Z","snapshot_observed_at":"2026-08-12T15:01:13.075727Z","submitted_at":"2025-01-01T22:58:06Z","title":"CoordFlow: Coordinate Flow for Pixel-wise Neural Video Representation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:42:02.146112Z"},"links":{"cited_paper":"/paper/2411.16819","citing_paper":"/paper/2501.00975"},"observation_digest":"sha256:3d9426d28fc89af3e3c3e835b340b63249b5741b8cfbec02109018118119f997","observation_id":"752c903c-5cb3-4a44-b5df-b21603204e77","resolution":{"observed_at":"2026-08-10T22:42:02.146112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16819","snapshot_observed_at":"2026-08-07T11:14:07.381242Z","title":"Rotstein, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03107","last_updated":"2025-06-11T06:11:36Z","snapshot_observed_at":"2026-08-12T03:38:38.010211Z","submitted_at":"2025-06-03T17:39:47Z","title":"ByteMorph: Benchmarking Instruction-Guided Image Editing with Non-Rigid Motions","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:07.381242Z"},"links":{"cited_paper":"/paper/2411.16819","citing_paper":"/paper/2506.03107"},"observation_digest":"sha256:32a4c37211e64055ac8821ca0106b909a9de0fca58136860d0167811b650c7b7","observation_id":"442379f8-4627-4e92-8491-bd02285338ba","resolution":{"observed_at":"2026-08-07T11:14:07.381242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"cited_work":{"arxiv_id":"2411.16819","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16819","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pathways on the image manifold: Image editing via video generation","venue":null,"work_id":"b7b5803b-fae8-4fb9-b103-ab643a9a9b8e","year":2025},"citing_paper":{"arxiv_id":"2605.00707","last_updated":"2026-05-01T14:51:52Z","snapshot_observed_at":"2026-08-10T21:03:33.146040Z","submitted_at":"2026-05-01T14:51:52Z","title":"PhysEdit: Physically-Consistent Region-Aware Image Editing via Adaptive Spatio-Temporal Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-09T19:33:13.609552Z"},"links":{"cited_paper":"/paper/2411.16819","citing_paper":"/paper/2605.00707"},"observation_digest":"sha256:d4d09010c21085314256e6603af6c727c5ec005eab8dad9cd803b94656a4757e","observation_id":"f6a70f58-3cd7-4c6c-ac87-244984b2d65f","resolution":{"observed_at":"2026-05-11T15:36:10.052212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.16819/citation-record","integrity":"/paper/2411.16819/integrity","json":"/paper/2411.16819/citation-record.json","paper":"/paper/2411.16819"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.13044","last_updated":"2025-08-07T00:23:46Z","snapshot_observed_at":"2026-08-13T00:50:05.562780Z","submitted_at":"2024-03-19T17:59:58Z","title":"Magic Fixup: Streamlining Photo Editing by Watching Dynamic Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13044","snapshot_observed_at":"2026-08-12T13:03:42.357048Z","title":"Magic fixup: Stream- lining photo editing by watching dynamic videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.357048Z"},"links":{"cited_paper":"/paper/2403.13044","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:dc8cb9212206b39c64535e5fe359041e3e17e9319b33899a522cb0c2e51dfaf8","observation_id":"e4fc2d6c-4229-44f4-b323-9dce1aa802d6","resolution":{"observed_at":"2026-08-12T13:03:42.357048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-12T13:03:42.363176Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.363176Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:6a26aeb0c7edecb11eebe63320a769d32dfcacb2ed239d9cb91eab5662a1b4d2","observation_id":"0773e211-3941-434e-90cb-5149ee17a483","resolution":{"observed_at":"2026-08-12T13:03:42.363176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.665869Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":"83bdf751-a990-436c-88ed-3c23b1cb8af9","year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.369474Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:67748a35699f242ff2eb982ffe253e9444a6768904b87a8738f8db0051394bfb","observation_id":"d6f7601a-c6c8-424c-8c7c-d9bb5f68d179","resolution":{"observed_at":"2026-08-12T13:03:43.671159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.648885Z","title":"Ledits++: Limitless image editing using text-to-image models","venue":null,"work_id":"eb7c55dc-de60-4664-9a00-35e32ac415de","year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.374535Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:69d1629d12831abb8f387275a4afdf9a3ec467bc497609eb366d24f6b32a044d","observation_id":"42cfcd9b-d979-4570-916f-7035a1521d57","resolution":{"observed_at":"2026-08-12T13:03:43.654246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.379896Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.379896Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:d30be9376ad0bff2ee8a1d7e956a3f830455f14c61daccfe3f97fc360b230ebd","observation_id":"1bf72d2b-626f-43ce-b18a-52df43869c71","resolution":{"observed_at":"2026-08-12T13:03:42.379896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.621318Z","title":"Utd- mhad: A multimodal dataset for human action recognition utilizing a depth camera and a wearable inertial sensor","venue":null,"work_id":"50d32e91-d5ed-4ce9-ad86-f7a566a0db49","year":2015},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.385729Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:e305652842ba18415aae87785a976301f34a431ca8abb8e8c9e8d1e3f01d79fa","observation_id":"165e1c10-7e83-4038-85e4-53ae0c4489f9","resolution":{"observed_at":"2026-08-12T13:03:43.626982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.604758Z","title":"Panda-70m: Captioning 70m videos with multiple cross-modality teachers","venue":null,"work_id":"608081a2-a455-4ce8-8bd6-4181345ff928","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.391762Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:6a902718439903012019dc4b7bbc5d5b8bf1704dfd508e03fcb174c6076c1426","observation_id":"ade26f42-fe38-4de9-afff-d6a8cbf68d32","resolution":{"observed_at":"2026-08-12T13:03:43.610231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.589408Z","title":"Anydoor: Zero-shot object-level image customization","venue":null,"work_id":"7a093dfb-7e6c-4bc6-a2da-f451d9d9d1dc","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.396716Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:363db0a431f79fe111d33d144dfff1277fd308a42c629205c19dd653f7ec01ba","observation_id":"84fd8238-6381-43b1-a163-3b71053ab84f","resolution":{"observed_at":"2026-08-12T13:03:43.594014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.573540Z","title":"Adversar- ial video generation on complex datasets","venue":null,"work_id":"c6a08908-8c0c-4b83-bb7b-7899ebdf4ae4","year":2019},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.401704Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:0d8f9e5cfe17b30587ca5130507a2c6bd1e9507bc51ab1a6df2f041def723682","observation_id":"152444be-1e9e-41fd-a98a-0a9b9dac8147","resolution":{"observed_at":"2026-08-12T13:03:43.578807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.407129Z","title":"Instructblip: Towards general- purpose vision-language models with instruction tuning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.407129Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:7ad1f75394e0c63133cfd6b603199c29d02f2b79607ac94fabb1141c4d716ff6","observation_id":"dd2bab7b-7676-45f8-88a1-6e75c585153e","resolution":{"observed_at":"2026-08-12T13:03:42.407129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.544928Z","title":"Ld- mvfi: Video frame interpolation with latent diffusion mod- els","venue":null,"work_id":"335a7297-d524-4977-b71f-8e7a779e7441","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.413074Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:a648fc32634b76c951b5f58384ecaf6855cb85464eeed3b7545b32c10aa3cd34","observation_id":"220a843a-dc0a-4634-998e-6d2e285c64b6","resolution":{"observed_at":"2026-08-12T13:03:43.549823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-12T13:03:42.418868Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.418868Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:412c869989d425e672ac6465d492adf92a43a52fe3af1b3343140061881069dd","observation_id":"ef151495-79a7-4779-b843-0e4be18f2f0c","resolution":{"observed_at":"2026-08-12T13:03:42.418868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.424789Z","title":"Structure and content-guided video synthesis with diffusion models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.424789Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:1c569f1121147880b0bf9f8d1c4f7430b3736cfc71fffa06593be7ee6a4346e3","observation_id":"b8873226-f96c-4ca3-9c5a-e404d479ac70","resolution":{"observed_at":"2026-08-12T13:03:42.424789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.517095Z","title":"Ques- tion aware vision transformer for multimodal reasoning","venue":null,"work_id":"0bfe9a39-a237-4186-8cce-767faa339ef6","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.430484Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:5234bc43bc2f46e336a30949d668d7283e0ceb0af97db3c92ff2111eeefe2263","observation_id":"d726a5e8-21e2-4d2a-8a04-c6662e628fb6","resolution":{"observed_at":"2026-08-12T13:03:43.522520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.497980Z","title":"High-fidelity and freely controllable talking head video generation","venue":null,"work_id":"72a177c3-727d-4618-8109-6e49457c00a0","year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.435672Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:3f73e745b666eaded2ba1f5b7e86c8596fc6a56ca5d28ca4440baea3d44a7c95","observation_id":"3855ff65-908a-493c-bb15-d314394dd40d","resolution":{"observed_at":"2026-08-12T13:03:43.503740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-12T13:03:42.440461Z","title":"World models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.440461Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:76a7c2e9d64b8f2125dab5396bf4f937facd9306c5b78b610119ca9841b5327b","observation_id":"57132d42-7f07-47af-8cfa-62665a57eaaf","resolution":{"observed_at":"2026-08-12T13:03:42.440461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-12T13:03:42.445475Z","title":"Ltx-video: Realtime video latent diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.445475Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:ad96ef81dd77eaeb84ee4491eb7000df9e800879d51406047258aa1d4af11cde","observation_id":"ca6dd560-d756-4805-963b-9e87fb8768ed","resolution":{"observed_at":"2026-08-12T13:03:42.445475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-12T13:03:42.450594Z","title":"Prompt-to-prompt im- age editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.450594Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:77d2cd00805531a77f278d877838d83bf4b210cfca4b85f70976657aebc4ec52","observation_id":"f9af0729-b5d8-4ce2-9465-271584785188","resolution":{"observed_at":"2026-08-12T13:03:42.450594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.456126Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.456126Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:e7f1e28e6514eb15572f63eb692cb909dc5644962c0cd0f78d2cdefbf98670b1","observation_id":"a97c6dd7-ff96-4641-ab07-95fa46754059","resolution":{"observed_at":"2026-08-12T13:03:42.456126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17525","last_updated":"2025-03-11T02:16:29Z","snapshot_observed_at":"2026-08-12T23:55:19.887605Z","submitted_at":"2024-02-27T14:07:09Z","title":"Diffusion Model-Based Image Editing: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17525","snapshot_observed_at":"2026-08-12T13:03:42.461127Z","title":"Diffusion model-based image editing: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.461127Z"},"links":{"cited_paper":"/paper/2402.17525","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:29f6b0a1de6da3dcb539a67c7280f2ab647c5541f6cd1b7820da53b80683a698","observation_id":"3ec78507-a934-4f82-b7ff-33b378244eef","resolution":{"observed_at":"2026-08-12T13:03:42.461127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.470049Z","title":"An edit friendly ddpm noise space: Inversion and manipulations","venue":null,"work_id":"78a70ad4-811b-46b7-a0d3-457b966fec1e","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.466301Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:f2c3cf921ac8839477d112e7fa8bd61461ca66083d11a2d3ca0253e26d2f78c9","observation_id":"8a3402be-6ac9-4fe0-bf05-b04b5483f0df","resolution":{"observed_at":"2026-08-12T13:03:43.475363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.453090Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":"b3da31f4-5660-40bf-aec6-1d03d157ff4e","year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.471013Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:dd738d1a5552d6e3cb87143377e86f6581ca1514eb1ccfdb0fb5b3ab0a029750","observation_id":"5dc7be91-e2d7-4191-b632-b07a9c85d254","resolution":{"observed_at":"2026-08-12T13:03:43.458943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18406","last_updated":"2024-03-27T09:48:23Z","snapshot_observed_at":"2026-08-13T00:44:02.445153Z","submitted_at":"2024-03-27T09:48:23Z","title":"An Image Grid Can Be Worth a Video: Zero-shot Video Question Answering Using a VLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18406","snapshot_observed_at":"2026-08-12T13:03:42.476031Z","title":"An image grid can be worth a video: Zero- shot video question answering using a vlm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.476031Z"},"links":{"cited_paper":"/paper/2403.18406","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:dc9ff594dec598c035b5d61a88d02092ced9d7d2c02bee299e3d2459d10a687c","observation_id":"e5cf8de0-ccc8-423a-9787-1e93e48ffe9a","resolution":{"observed_at":"2026-08-12T13:03:42.476031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08629","last_updated":"2025-07-22T12:07:56Z","snapshot_observed_at":"2026-08-11T17:39:30.344593Z","submitted_at":"2024-12-11T18:50:29Z","title":"FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08629","snapshot_observed_at":"2026-08-12T13:03:42.481239Z","title":"Flowedit: Inversion-free text-based editing using pre-trained flow models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.481239Z"},"links":{"cited_paper":"/paper/2412.08629","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:aeb83daba099c30ef6212722032df94af8aec9dd3447992e5368f9f97e2c73d5","observation_id":"48ab27d8-124a-47bd-8d58-f088bec1c59f","resolution":{"observed_at":"2026-08-12T13:03:42.481239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.485686Z","title":"Vivid-1-to-3: Novel view synthesis with video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.485686Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:19752aa108351246a20ce35ff4fa9363ddb9bd2494d7b575253bd8d0ddaa3bcb","observation_id":"de6cd86d-a346-449c-b5ae-38a3256620bd","resolution":{"observed_at":"2026-08-12T13:03:42.485686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.423182Z","title":"Flux.1-dev","venue":null,"work_id":"49223f5a-65a1-46e7-9a26-525108e2cc26","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.489912Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:87964397b538df5185d02276d7cdcb99b1fbb06e925cd3e0acb274194af3cc7b","observation_id":"3e951c99-ae96-40b6-b4f8-501ed889f707","resolution":{"observed_at":"2026-08-12T13:03:43.428093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.405197Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"1118a3ac-3918-433b-8b71-a37224d37247","year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.494324Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:17b458dea0ae057119fd8b3d3638cb03d668b9d158efb607f70f8f2c9540a37f","observation_id":"e78f4de0-9277-418c-af03-a18643159101","resolution":{"observed_at":"2026-08-12T13:03:43.410869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-12T13:03:42.498599Z","title":"Sora: A review on background, technology, limitations, and opportunities of large vision models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.498599Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:597017a0f6fe36469d5952933cf877b5150a673e296820789384d3745f0ce7b9","observation_id":"5cc8aee5-45ae-4c40-ab10-76d8b285aa90","resolution":{"observed_at":"2026-08-12T13:03:42.498599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.385687Z","title":"Readout guidance: Learning con- trol from diffusion features","venue":null,"work_id":"74137827-7f33-4cf5-99bb-d7fd54f3cd04","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.503760Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:90d714a36d228a829d726a3eaa780c253d9152d0e725234ba34adbd8fb14ca12","observation_id":"f3c23fa1-07a3-40cc-8f30-b34df763990b","resolution":{"observed_at":"2026-08-12T13:03:43.392025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-08T06:35:17.078531Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-12T13:03:42.509620Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equa- tions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.509620Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:b50378da89afc48a0e868f35f6975811fbe9d9d8bbf31ccf7bf951a492223539","observation_id":"5d22a3ac-55af-4d60-9c4c-d05ba71e2e61","resolution":{"observed_at":"2026-08-12T13:03:42.509620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.366345Z","title":"SDEdit: Guided image synthesis and editing with stochastic differ- ential equations","venue":null,"work_id":"3f4f973b-1ea2-486e-aea7-de1da24b3783","year":2022},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.514551Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:78e7469418d3ee87146a531295a607c1cd2aac62dcbd83a2ac912bc63f38349c","observation_id":"82c1c8b5-6db3-4f17-b0b8-d0f096aeb254","resolution":{"observed_at":"2026-08-12T13:03:43.371908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.346996Z","title":"Null-text inversion for editing real im- ages using guided diffusion models","venue":null,"work_id":"31d67667-b15f-4687-b255-10a2e6859d1d","year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.519398Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:03da1e31a5a9b835ae391ab5f287a08d8a5bf97f461a6bee8c86fe768f21bd3f","observation_id":"283d51ee-88ad-47a5-912e-e164e3ee97e5","resolution":{"observed_at":"2026-08-12T13:03:43.352908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.329364Z","title":"Chatgpt-4o (october 2024 version)","venue":null,"work_id":"964fd4f1-3c50-455c-b34a-0a05fd1b174c","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.524322Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:1ce716928758119cbc279d165a3dea7ab8c796884a3a6bec02c59f7452140754","observation_id":"1358624b-f896-4f45-a863-e97baab53926","resolution":{"observed_at":"2026-08-12T13:03:43.334699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.308877Z","title":"Zero-shot image-to- image translation","venue":null,"work_id":"38fe36b9-29d2-4aa7-9969-e3c532393843","year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.529187Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:c22f98a12491dad2ec2484e528b4e84a7b8b00536c07f9beff061a1284806b87","observation_id":"77d42af5-e189-40fd-8ce0-069d6f5ae355","resolution":{"observed_at":"2026-08-12T13:03:43.317774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.290503Z","title":"Zero-shot image-to- image translation","venue":null,"work_id":"6435434c-7aa2-4be0-abe5-2eabbf4e0176","year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.534313Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:3cf71acf3fa911e87077f4d3cd8a4820d1ba79535959a7c7e823930873448c2b","observation_id":"3f32baff-3c9d-448a-a4a3-70f762b65667","resolution":{"observed_at":"2026-08-12T13:03:43.296963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.539429Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.539429Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:852fd8090d7b0c205752451a49a29c9cf3c9dfdb44f6efc5e8f4603bdad7ff9b","observation_id":"4c486050-2f5d-4b06-93d8-a2c027fb4258","resolution":{"observed_at":"2026-08-12T13:03:42.539429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.544389Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.544389Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:6e388fe70c6c1050a0cb957ddf083b5740748da9cb91a66864d1c9638083fa2d","observation_id":"1b007407-5315-477e-a335-feb633a1b0d8","resolution":{"observed_at":"2026-08-12T13:03:42.544389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.250506Z","title":"Fusecap: Leveraging large language mod- els for enriched fused image captions","venue":null,"work_id":"5f25cb46-f1c5-434f-80e4-5f3cafb395be","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.549157Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:b209af9020b857b5d018150b4fc14dc2fd79a5ccd09eb3c89a875dda41a55413","observation_id":"45ec6892-fa4c-40ba-ae3f-4007af656594","resolution":{"observed_at":"2026-08-12T13:03:43.255449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.553762Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.553762Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:c37f565e22efdaeb981bb3ba8db78a10e83bb74ca07f236e29af5df610164ecc","observation_id":"8e6bf8a1-90f7-4a8c-886f-2eea763bb246","resolution":{"observed_at":"2026-08-12T13:03:42.553762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13722","last_updated":"2024-09-16T04:25:50Z","snapshot_observed_at":"2026-08-13T00:02:05.984746Z","submitted_at":"2024-05-22T15:14:00Z","title":"LightningDrag: Lightning Fast and Accurate Drag-based Image Editing Emerging from Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13722","snapshot_observed_at":"2026-08-12T13:03:42.558656Z","title":"Instadrag: Lightning fast and accurate drag- based image editing emerging from videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.558656Z"},"links":{"cited_paper":"/paper/2405.13722","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:8d64281cd16013d8829d2d31952d804971b18c4ff6f6c7adc14faa028b7e3cc8","observation_id":"af2e7086-fcbf-470d-a2e3-639365b3a765","resolution":{"observed_at":"2026-08-12T13:03:42.558656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11280","last_updated":"2023-01-26T18:14:32Z","snapshot_observed_at":"2026-08-12T12:43:16.845288Z","submitted_at":"2023-01-26T18:14:32Z","title":"Text-To-4D Dynamic Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11280","snapshot_observed_at":"2026-08-12T13:03:42.564528Z","title":"Text-to-4d dy- namic scene generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.564528Z"},"links":{"cited_paper":"/paper/2301.11280","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:4bcfb90af3bff3c32a25f81952c4b128fa75fe11383c1ae0548db4cc101e3a51","observation_id":"e6475bfd-e764-4513-91e5-37146653db74","resolution":{"observed_at":"2026-08-12T13:03:42.564528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.221810Z","title":"Unsupervised learning of video representations us- ing lstms","venue":null,"work_id":"5675a0c6-eebe-4f94-816f-f062cf5c22ca","year":2015},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.571996Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:b73824bb1f16de95190715ed8a756869e8a9f3c7b0e2d217d05d15ce53d79ed4","observation_id":"c8a59a91-001f-4686-a6e7-d99502159623","resolution":{"observed_at":"2026-08-12T13:03:43.227425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.577780Z","title":"Mocogan: Decomposing motion and content for video generation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.577780Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:a4f5415c5774d6fabc5ef8983f499101b890f396a7a083c209ae550957f25083","observation_id":"07a95b5f-ab0e-4390-9bbf-d78f1163432d","resolution":{"observed_at":"2026-08-12T13:03:42.577780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.192813Z","title":"Generating videos with scene dynamics","venue":null,"work_id":"3d88b1db-ada3-4ac4-9a01-aa4abf5ec2b4","year":2016},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.582425Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:61879ad2ace82f14e688d1d478db3b6823f06619e4a97777dafa7754dffaa7c3","observation_id":"7ccccc65-dfb0-4d91-ab45-89514c484806","resolution":{"observed_at":"2026-08-12T13:03:43.197967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-12T13:03:42.587146Z","title":"Cogvlm: Visual expert for pretrained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.587146Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:b91e196d3069cf42acac8d174764309e54ddd74bd82cb9e0d3900f557bd7bac3","observation_id":"c9b05143-1491-4162-b3e6-62c7a56d6240","resolution":{"observed_at":"2026-08-12T13:03:42.587146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.592708Z","title":"Cogvlm: Visual expert for pretrained language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.592708Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:0b4668aa62e45e87281de75cf4041cbd9d9a9f896cfc906ae0cf7af2caf0bbc4","observation_id":"9ff0167a-e77d-49dc-8c61-c06bc833d06b","resolution":{"observed_at":"2026-08-12T13:03:42.592708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18212","last_updated":"2025-03-20T06:59:54Z","snapshot_observed_at":"2026-08-13T00:20:02.035293Z","submitted_at":"2024-04-28T15:07:53Z","title":"Paint by Inpaint: Learning to Add Image Objects by Removing Them First","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18212","snapshot_observed_at":"2026-08-12T13:03:42.597752Z","title":"Paint by inpaint: Learning to add image objects by removing them first","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.597752Z"},"links":{"cited_paper":"/paper/2404.18212","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:7088835777a7265d327bf92f86e6a2789862d8847b6f7dbce5aec9ebebda231a","observation_id":"d13b37bd-d72e-442c-93ab-ef80b35d5e9b","resolution":{"observed_at":"2026-08-12T13:03:42.597752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-12T13:03:42.602874Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.602874Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:166d19c851fb5ff54285167df2fb0d24ec7a485b6096f12c6ebe9e1cf0f91829","observation_id":"8baa8e32-8cce-444f-8792-1c797ac3b317","resolution":{"observed_at":"2026-08-12T13:03:42.602874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.164746Z","title":"Magicbrush: A manually annotated dataset for instruction- guided image editing","venue":null,"work_id":"00d7b507-c9d7-473d-8e36-66a29ca59b46","year":2024},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.608556Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:d2278f858350efb48ef0d3e2fb63f8728d15b779e8d6d489a584686c3d2fa5f3","observation_id":"5ca67d77-9fb0-4c71-8a2c-cddbfd1255dd","resolution":{"observed_at":"2026-08-12T13:03:43.170989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.613718Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.613718Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:d80239fb768a2586ab5f55dbb8f54b9592dbb73e82ebfae69ec93ccb1d9f16bc","observation_id":"cc9e5616-2040-4d4c-99fb-c77fce9283f7","resolution":{"observed_at":"2026-08-12T13:03:42.613718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.134569Z","title":"Physdreamer: Physics-based inter- action with 3d objects via video generation","venue":null,"work_id":"29ed5d47-af0e-4969-8348-dc5b44173f67","year":2025},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.619167Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:8bdcfaabf3c981d79b0fb4a4ca573ee50b8804478d40219e4395d40a57f0b729","observation_id":"3790a139-b54f-4107-846a-d194dcc239de","resolution":{"observed_at":"2026-08-12T13:03:43.140854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.118572Z","title":"The selected edit is:x","venue":null,"work_id":"63bb9287-bcb0-486d-99ef-335473f933de","year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.624742Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:7890ed66a56217d27c7a009a718e90d49f3aa14782f130a048b8bcfb7798b5f9","observation_id":"f3d20bbc-8da4-4a27-80ef-201b6ac5c230","resolution":{"observed_at":"2026-08-12T13:03:43.123121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.103891Z","title":"A small brown teddy bear sitting in LOCATION","venue":null,"work_id":"2f009ab9-ea74-46ef-8039-91c5fd993e6f","year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.630577Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:4fac079ce883e2cafa294d9f775374651d12731dbaf1e1770a19f12769eca4bf","observation_id":"f3c3209c-bb70-440f-918d-68e70765e2ea","resolution":{"observed_at":"2026-08-12T13:03:43.108447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.088712Z","title":"A tennis ball lies in LOCATION","venue":null,"work_id":"592d5785-1610-4d0a-a723-8ee1b5992c01","year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.635993Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:243e35522889494d1be3579b5a927f09bc628b98cd3ca0a75414dfacfc18d77d","observation_id":"841edde5-4890-4e11-bc56-ca159ea4ba05","resolution":{"observed_at":"2026-08-12T13:03:43.093233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.071095Z","title":"The teddy bear slowly rips, revealing stuffing coming out","venue":null,"work_id":"42ec99f3-433b-4620-abbc-b6c9e921da68","year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.641225Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:fec4caef2bb6533a4971e5583aad76cb7a7cf77d793013d924628b8e5d259bff","observation_id":"9f619eff-fd3e-4912-b372-b84fced70e44","resolution":{"observed_at":"2026-08-12T13:03:43.077033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.049671Z","title":"The tennis ball gradually transforms into a ripe red tomato","venue":null,"work_id":"50a2803f-ecb7-45c0-9851-22606f752eb6","year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.646561Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:e746fb0167d6dd5a4a695d76e84804acd76ee0fccb8d216c84b6456acc4378e9","observation_id":"af6606cf-d10a-4d67-8b75-3a926b2a2b9a","resolution":{"observed_at":"2026-08-12T13:03:43.055559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.030516Z","title":"The sun is setting, and artificial lights replace it","venue":null,"work_id":"b62c2deb-7d66-423c-ba8c-64ba6e0d38c3","year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.651726Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:5c351e4fa15ad37be55af50b1aeeadd75d4ca2169b7efff962a72d0aed042cef","observation_id":"e8fc0c96-7cf7-4104-885f-c96a2b517c88","resolution":{"observed_at":"2026-08-12T13:03:43.036961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:43.012319Z","title":null,"venue":null,"work_id":"8657de2e-d025-4301-992b-ad8157ffd05a","year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.656576Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:567d44047d3a54028e6a4a3e6963f6a5741192db8d92a8ca63a1e11c1189a90e","observation_id":"4a89e8eb-e6ad-452f-86f9-b26040ce27cc","resolution":{"observed_at":"2026-08-12T13:03:43.018047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.993252Z","title":null,"venue":null,"work_id":"2880fde0-c589-4fc3-b8b5-47d1db026b51","year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.662757Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:83b57e11bb7e7cad3a6f11f13e08968885409343918f8e893e39400883dabb45","observation_id":"2ce02bf8-66c0-4979-ab48-fea1955f3d73","resolution":{"observed_at":"2026-08-12T13:03:42.999027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:03:42.973500Z","title":"Nothing moves","venue":null,"work_id":"908f81b9-511a-40ea-8352-4ce1dcb53fda","year":null},"citing_paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T13:03:42.668361Z"},"links":{"citing_paper":"/paper/2411.16819"},"observation_digest":"sha256:5f256a0a70f52269ba3cabdd1adb4398a11eebbae923525af0aa0a07a75531a3","observation_id":"bc479d56-4e9e-48e7-b94a-9e47a236726e","resolution":{"observed_at":"2026-08-12T13:03:42.980709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.16819","last_updated":"2025-03-20T07:02:30Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T23:56:25.602718Z","submitted_at":"2024-11-25T16:41:45Z","title":"Pathways on the Image Manifold: Image Editing via Video Generation"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 4 inbound Pith citation observations for arXiv:2411.16819."}