{"as_of":"2026-08-09T02:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f9d762add8747327c9d8118e606ea02131c741689cbf1e465c2f67d50cb4b545","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:30:04.553334Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17985/citation-record","integrity":"/paper/2607.17985/integrity","json":"/paper/2607.17985/citation-record.json","paper":"/paper/2607.17985"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-01T16:30:00.429471Z","title":"Blattmann, Tim Dockhorn, Sumith Kulal, Daniel Mendelevitch, Maciej Kilian, and Dominik Lorenz","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.429471Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:fdcb812e531e3caa45962893d971c9930981404773327413266a5b23958096b7","observation_id":"62c2ad04-0d31-48f4-9872-71f78fa01e0e","resolution":{"observed_at":"2026-08-01T16:30:00.429471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:00.458702Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.458702Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:e826c4eb15de79e85947d2648ab52709e0885203a4981779008a5c04761ffd6c","observation_id":"1e104759-3959-497d-b6e0-ba8b7fc1b8e5","resolution":{"observed_at":"2026-08-01T16:30:00.458702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02436","last_updated":"2025-04-03T09:50:50Z","snapshot_observed_at":"2026-08-07T16:12:03.138083Z","submitted_at":"2025-04-03T09:50:50Z","title":"SkyReels-A2: Compose Anything in Video Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02436","snapshot_observed_at":"2026-08-01T16:30:00.510556Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.510556Z"},"links":{"cited_paper":"/paper/2504.02436","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:e4159bd6d09b24fabc26695e5e8b5a49822dcc32518c112751114ae6045aceb6","observation_id":"78d4f218-73d2-4042-bb9a-9381a80e5282","resolution":{"observed_at":"2026-08-01T16:30:00.510556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:00.570190Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.570190Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:b1c03aef2f8d9448de914e53a3aa827d585049593dedd0bd9a8fde334e032a95","observation_id":"692d5f19-cbb4-448c-ab76-7a842c9e7242","resolution":{"observed_at":"2026-08-01T16:30:00.570190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03233","last_updated":"2026-01-06T18:24:41Z","snapshot_observed_at":"2026-07-06T22:40:51.136169Z","submitted_at":"2026-01-06T18:24:41Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03233","snapshot_observed_at":"2026-08-01T16:30:00.642094Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.642094Z"},"links":{"cited_paper":"/paper/2601.03233","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:f59212e51a5f6d2fb6e72790e7b352569857878d13e033e218d77a4debfc5c21","observation_id":"48d1ccee-a491-44e1-9614-3f43aff0d163","resolution":{"observed_at":"2026-08-01T16:30:00.642094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:00.753393Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.753393Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:6f94669d1a296a6727b93ab4c28092a9a9d31277b0a4bed4d7de2a28838f71b6","observation_id":"33604e0c-5e7e-403e-8167-433a2f741184","resolution":{"observed_at":"2026-08-01T16:30:00.753393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15275","last_updated":"2024-06-25T16:57:27Z","snapshot_observed_at":"2026-07-06T18:04:33.726854Z","submitted_at":"2024-04-23T17:59:43Z","title":"ID-Animator: Zero-Shot Identity-Preserving Human Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15275","snapshot_observed_at":"2026-08-01T16:30:00.853862Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.853862Z"},"links":{"cited_paper":"/paper/2404.15275","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:6b4726a4b4b534d57c18bebae31996dadcb84808778dfb2af09031e45e58fb99","observation_id":"fcbc52fa-fe1e-4f81-b417-bd20cd291dba","resolution":{"observed_at":"2026-08-01T16:30:00.853862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-01T16:30:00.947807Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.947807Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:07849df10a4eb98ba164c57ad348eda4f4aa755a31db1cf4fe5ca2d658212047","observation_id":"4363859b-038d-4234-a026-37895a06a231","resolution":{"observed_at":"2026-08-01T16:30:00.947807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.030597Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.030597Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:b27fef48b7af9ec0ea0e5b809fbd07909433fc0037674e02e7c430417edc7d5c","observation_id":"aaaafe40-a2ec-47ca-894b-49bc6ba74b91","resolution":{"observed_at":"2026-08-01T16:30:01.030597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.108811Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.108811Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:7c57b01579c8668c4a253ffdeb5d7fcf0446a0dc42226fb333d7d0bde4872aaa","observation_id":"3205ed26-bd19-4a6c-8447-70f85fa45cf8","resolution":{"observed_at":"2026-08-01T16:30:01.108811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-08T15:15:48.227139Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04512","snapshot_observed_at":"2026-08-01T16:30:01.157173Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.157173Z"},"links":{"cited_paper":"/paper/2505.04512","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:f26c336a82db3b0190da3650fe3041866798c8907d5576a2da73b6d39d68f410","observation_id":"63374138-3231-45c3-9427-fbcf3959b7d1","resolution":{"observed_at":"2026-08-01T16:30:01.157173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.212680Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.212680Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:74fdeb5c9dce361bd80ae3bec071bdb6dc5fb3e413e9a3b3492ba45f3654f3e5","observation_id":"09d71504-c4d6-4c7b-a13a-6dc963a3bf6f","resolution":{"observed_at":"2026-08-01T16:30:01.212680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.300612Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.300612Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:18707ae312892cdc0fd08b3fa6b18eef7b3b3072adc4f37659241f016c5e3b8c","observation_id":"697bf589-f47c-4cfa-89b0-8a8c7b8cdd4b","resolution":{"observed_at":"2026-08-01T16:30:01.300612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18664","last_updated":"2024-11-27T15:59:48Z","snapshot_observed_at":"2026-08-02T00:08:30.121502Z","submitted_at":"2024-11-27T15:59:48Z","title":"Spatiotemporal Skip Guidance for Enhanced Video Diffusion Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18664","snapshot_observed_at":"2026-08-01T16:30:01.410540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.410540Z"},"links":{"cited_paper":"/paper/2411.18664","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:c51025de8232a6181c7fea00c42434c124694d1c6a63e08613ddcb9bed786dbc","observation_id":"44926563-879f-4ec5-9ab8-35b9736413b3","resolution":{"observed_at":"2026-08-01T16:30:01.410540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.592084Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.592084Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:03a13f4da580593dd7870d30cfc03f1af7f1f5903228754bc94ca110b5bf50bc","observation_id":"b8678673-6ceb-40a0-bc80-e830a302d51d","resolution":{"observed_at":"2026-08-01T16:30:01.592084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:01.855436Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.855436Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:f92a7dfd8241f02ee489e19e3859676e210138f74f34ca652c16b11b55947cc4","observation_id":"b5c60c1d-9ff4-46a9-ab68-9b2626726cfb","resolution":{"observed_at":"2026-08-01T16:30:01.855436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.011707Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.011707Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:04e8ce2b935a615ab20cd2c715ba0d069084eb23d876a68319695bbf35301490","observation_id":"60b17d2a-3e2f-4cb6-a7b1-48a2bca50daf","resolution":{"observed_at":"2026-08-01T16:30:02.011707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11079","last_updated":"2025-04-10T10:24:37Z","snapshot_observed_at":"2026-08-08T15:16:17.586525Z","submitted_at":"2025-02-16T11:02:50Z","title":"Phantom: Subject-consistent video generation via cross-modal alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11079","snapshot_observed_at":"2026-08-01T16:30:02.172800Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.172800Z"},"links":{"cited_paper":"/paper/2502.11079","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:b3e90f5256ef528ac7d465055f9d55c86e68d6d39734e2551584d2a2cf926d77","observation_id":"95c4ed9a-fded-45a9-8f3e-332d66048293","resolution":{"observed_at":"2026-08-01T16:30:02.172800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.279990Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.279990Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:e7088fd8af9028bb1987c1bf92c61ab2c2ca0ed2698944b80497c136004d94b6","observation_id":"20599548-f0ad-4f56-8112-7477de1fc060","resolution":{"observed_at":"2026-08-01T16:30:02.279990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.414882Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.414882Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:6b259d26dfd645bd02e86908d549a811f2c6b53ab1cc0034352cf5c89dabbf86","observation_id":"432c8137-e1ec-4db4-810f-b94a983a9826","resolution":{"observed_at":"2026-08-01T16:30:02.414882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-01T16:30:02.524792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.524792Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:ea2049a2d4274375b3c6519834783cba7f2fcede2d1ac34dd5af266d71d0a270","observation_id":"46da6c95-c055-4615-8e89-39d88256335f","resolution":{"observed_at":"2026-08-01T16:30:02.524792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.637753Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.637753Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:f8dc6a445d4a2aa91041484e55f9e10cc540c6a2566b6c605ae7a0b82062e8b2","observation_id":"a3fe3430-f316-40ec-94a9-5dd286bf86e0","resolution":{"observed_at":"2026-08-01T16:30:02.637753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:02.766100Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.766100Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:9ca3d5440dbc8bf37828a51fc3b27e05ca4d63d0a08ea44c373000c764865743","observation_id":"38424cb4-39d0-49d2-970e-cec544a10353","resolution":{"observed_at":"2026-08-01T16:30:02.766100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-01T16:30:02.915052Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:02.915052Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:9daa40eb65252b731b1f2d639f263a892aa5939ce9db302de622e01a656fc616","observation_id":"c51012ff-39c7-4e09-8270-b7c23790c11b","resolution":{"observed_at":"2026-08-01T16:30:02.915052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07519","last_updated":"2024-02-02T16:15:22Z","snapshot_observed_at":"2026-08-06T23:08:20.817133Z","submitted_at":"2024-01-15T07:50:18Z","title":"InstantID: Zero-shot Identity-Preserving Generation in Seconds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07519","snapshot_observed_at":"2026-08-01T16:30:03.029124Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.029124Z"},"links":{"cited_paper":"/paper/2401.07519","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:04ab276772f809d07c4529c7c32426ef8a7095cb3c0bf875dab5951765e687ca","observation_id":"9ffa9875-30ed-4ce8-8806-d2d0fd10fc29","resolution":{"observed_at":"2026-08-01T16:30:03.029124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:03.142391Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.142391Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:41d4f9b85175294182e194e8e724f2d5b2ebdc911d734fa4f2a15b64f1c5751b","observation_id":"71063fc1-03b5-485c-9aaa-1987537acbf5","resolution":{"observed_at":"2026-08-01T16:30:03.142391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:03.302371Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.302371Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:c9541aeca52650e3868f1e6d2cb9ff3b6623058cc08ba8b7c801fea58efa8979","observation_id":"19d622e7-2c87-45ad-9b42-7881c18895de","resolution":{"observed_at":"2026-08-01T16:30:03.302371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T16:30:03.466687Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.466687Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:2c2ee88104214b24de426f3e37389f3d870bd7b8b4c3035edb74df0d5d2dc1bb","observation_id":"cd7b591c-86cf-4368-a3a3-bed8b3ddf4ff","resolution":{"observed_at":"2026-08-01T16:30:03.466687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-01T16:30:03.585565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.585565Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:03a58d8e65a411200dc750662e2d0db69a927909d39ecd889fc304cef3d0d9e1","observation_id":"8390885e-8528-48cd-a290-9380c0237e21","resolution":{"observed_at":"2026-08-01T16:30:03.585565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-01T16:30:03.704291Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.704291Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:08545021cfe63a1818a2eb638e1026cc5b737259aad0801f1ec1f71b8eecff8d","observation_id":"c54403e0-d6a2-49bf-a8c8-713562b9674b","resolution":{"observed_at":"2026-08-01T16:30:03.704291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:30:03.779522Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.779522Z"},"links":{"citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:bee95d8f4748a499c474606abda020d34e377d5d627400908b0969e04c0bfac8","observation_id":"23c989a7-31be-4d9c-aa8f-7dd1e13e19ca","resolution":{"observed_at":"2026-08-01T16:30:03.779522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-03T19:47:26.577384Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.22699","snapshot_observed_at":"2026-08-01T16:30:03.927817Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:03.927817Z"},"links":{"cited_paper":"/paper/2511.22699","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:b4919ff16b9af1b1a0fa853b2ddcbf947d9c1d107920153c235a6939567ddc4c","observation_id":"1921c729-8b41-4951-a22c-dcc4d34f5bbf","resolution":{"observed_at":"2026-08-01T16:30:03.927817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16855","last_updated":"2025-04-01T08:48:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-22T04:40:24Z","title":"GME: Improving Universal Multimodal Retrieval by Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16855","snapshot_observed_at":"2026-08-01T16:30:04.128293Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:04.128293Z"},"links":{"cited_paper":"/paper/2412.16855","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:4c23659cfeb58bd78b80dc73377c47f30b54032738dc2cdffda244746cfa3736","observation_id":"46cdcb53-b3d8-41b4-b2cd-1fa2bca5199d","resolution":{"observed_at":"2026-08-01T16:30:04.128293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13995","last_updated":"2025-02-19T06:50:27Z","snapshot_observed_at":"2026-08-07T18:06:33.363289Z","submitted_at":"2025-02-19T06:50:27Z","title":"FantasyID: Face Knowledge Enhanced ID-Preserving Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13995","snapshot_observed_at":"2026-08-01T16:30:04.250929Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:04.250929Z"},"links":{"cited_paper":"/paper/2502.13995","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:50080b34a7b62c1026f070d301369691a267c3d63eba478d80e9f5bffc1ec947","observation_id":"dc0b91e6-fa3c-4772-9ac4-29365237e992","resolution":{"observed_at":"2026-08-01T16:30:04.250929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-01T16:30:04.412387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:04.412387Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:918636dd5e5cfcc4ffdbda4ba9740a7d1dbe14a1b75039f2f31788b94f0f3c78","observation_id":"7d29063b-980b-41c3-aa6c-e2e477edfe10","resolution":{"observed_at":"2026-08-01T16:30:04.412387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14151","last_updated":"2025-07-02T11:55:35Z","snapshot_observed_at":"2026-08-07T16:55:11.462308Z","submitted_at":"2025-03-18T11:17:32Z","title":"Concat-ID: Towards Universal Identity-Preserving Video Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14151","snapshot_observed_at":"2026-08-01T16:30:04.553334Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:04.553334Z"},"links":{"cited_paper":"/paper/2503.14151","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:527245ebdd546ff3e2d358a8becd9f3db31aad3e5acdaa17c4b7cd1d999fbba5","observation_id":"3f81bf54-63c4-4c42-8e08-ccca8efde4db","resolution":{"observed_at":"2026-08-01T16:30:04.553334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-01T16:30:00.798434Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:00.798434Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:5c38a9edcc98331a857b3e991289311da89a08cafb8daf9add60d9bdb682c280","observation_id":"70bee08d-2902-4e5e-939f-eb6aaec530e9","resolution":{"observed_at":"2026-08-01T16:30:00.798434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-08-01T16:30:01.743389Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T16:30:01.743389Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2607.17985"},"observation_digest":"sha256:7967574259788463f8cf1b4487e53f140c3ad278743f5881b258691c3c1ba8de","observation_id":"ba7228ea-e629-4140-99db-114b9735c5c2","resolution":{"observed_at":"2026-08-01T16:30:01.743389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17985","last_updated":"2026-07-20T14:16:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T15:15:32.999700Z","submitted_at":"2026-07-20T14:16:49Z","title":"Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2607.17985."}