{"as_of":"2026-08-16T10:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3cc6465f2b8fb5ff7c0a46929af279ef83cc7ce24c7ab9ac4257c2d423facccf","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:39:47.548878Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T20:17:47.060199Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":"2303.04761","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-p2p: Video editing with cross- attention control","venue":null,"work_id":"992fb0d5-f233-4443-97a9-806ea0165cc0","year":2023},"citing_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-15T03:17:05.670808Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T20:17:47.001786Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2307.10373"},"observation_digest":"sha256:44202727785a7b85cbe3f3824cf564393c1af963e27fbf97351ac1fc0870d094","observation_id":"81b66ff6-2e61-4f02-ad2c-6083a6d9195c","resolution":{"observed_at":"2026-05-17T20:17:47.062381Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-08-12T14:39:47.548878Z","title":"Video-p2p: Video editing with cross-attention control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15028","last_updated":"2024-11-22T15:59:48Z","snapshot_observed_at":"2026-08-13T14:40:35.265546Z","submitted_at":"2024-11-22T15:59:48Z","title":"FloAt: Flow Warping of Self-Attention for Clothing Animation Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T14:39:47.548878Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2411.15028"},"observation_digest":"sha256:507e83d4d846fda94e9b771bd89303cec023ff3c60b58e5fc7fcf48846e18d01","observation_id":"2fd7c236-1925-4b94-a661-f6c03147b115","resolution":{"observed_at":"2026-08-12T14:39:47.548878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-08-11T12:12:57.647242Z","title":"Video-p2p: Video editing with cross-attention control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14531","last_updated":"2024-12-19T05:02:30Z","snapshot_observed_at":"2026-08-13T11:11:08.711036Z","submitted_at":"2024-12-19T05:02:30Z","title":"Consistent Human Image and Video Generation with Spatially Conditioned Diffusion","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T12:12:57.647242Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2412.14531"},"observation_digest":"sha256:071486521eb83cd49db3a11a3754b01a29ade402c5015c7e018b01526911c559","observation_id":"a7d9edc9-c832-4005-a374-ff8164259c21","resolution":{"observed_at":"2026-08-11T12:12:57.647242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":"2303.04761","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-p2p: Video editing with cross- attention control","venue":null,"work_id":"992fb0d5-f233-4443-97a9-806ea0165cc0","year":2023},"citing_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-08-15T12:21:16.936063Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T18:42:02.940250Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2503.21755"},"observation_digest":"sha256:00b326faeefbc18c3e1c2e54e2c436834101413787bcd87e63e2fe984e45cbb8","observation_id":"2bd06f04-49e6-4f92-ad6f-eca2bbb6fb48","resolution":{"observed_at":"2026-05-14T18:42:03.074904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-08-07T04:22:13.871207Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10762","last_updated":"2025-06-12T14:44:25Z","snapshot_observed_at":"2026-08-11T20:52:39.651214Z","submitted_at":"2025-06-12T14:44:25Z","title":"Integrating Large Language Models into Text Animation: An Intelligent Editing System with Inline and Chat Interaction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:22:13.871207Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2506.10762"},"observation_digest":"sha256:148d65d2cfac1317763ff9f47ec5942ff11a0fda202586fc8a391a27a772d92e","observation_id":"8929f83e-c1ff-4e3d-a9af-0787df720596","resolution":{"observed_at":"2026-08-07T04:22:13.871207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-08-05T20:44:07.995101Z","title":"Video-p2p: Video editing with cross-attention control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09983","last_updated":"2025-08-13T17:56:26Z","snapshot_observed_at":"2026-08-14T13:24:06.090661Z","submitted_at":"2025-08-13T17:56:26Z","title":"Story2Board: A Training-Free Approach for Expressive Storyboard Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T20:44:07.995101Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2508.09983"},"observation_digest":"sha256:6a86834624b6253433850a63a22dcda916a86b797c7b7fc5cb174a407181bf9b","observation_id":"94ed9319-11c3-43be-a9f5-5183252eefbc","resolution":{"observed_at":"2026-08-05T20:44:07.995101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":"2303.04761","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-p2p: Video editing with cross- attention control","venue":null,"work_id":"992fb0d5-f233-4443-97a9-806ea0165cc0","year":2023},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-08-14T17:24:46.631419Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:6d1525b7d336c1c17d0ba36a1ba531300706bd1138e11b5f87430e3bef2c821f","observation_id":"7889899e-2ff5-42f7-aa71-d3fb15b7034c","resolution":{"observed_at":"2026-05-10T22:55:52.044352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":"2303.04761","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-p2p: Video editing with cross- attention control","venue":null,"work_id":"992fb0d5-f233-4443-97a9-806ea0165cc0","year":2023},"citing_paper":{"arxiv_id":"2604.13841","last_updated":"2026-04-15T13:13:04Z","snapshot_observed_at":"2026-08-10T22:31:16.747126Z","submitted_at":"2026-04-15T13:13:04Z","title":"DiffMagicFace: Identity Consistent Facial Editing of Real Videos","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T13:00:14.782905Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2604.13841"},"observation_digest":"sha256:b7450302eb775aa33d933fc9b5cf15c9ed137f0a7f9f4b3fb4dabbc1b39a6b25","observation_id":"6b97e093-803a-4720-800d-ce38d621a76a","resolution":{"observed_at":"2026-05-10T13:00:24.132275Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-08-05T00:27:02.339910Z","title":"arXiv preprint arXiv:2303.04761 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00769","last_updated":"2026-08-01T17:03:07Z","snapshot_observed_at":"2026-08-12T17:57:11.463557Z","submitted_at":"2026-08-01T17:03:07Z","title":"ChordVideo: One-Step, Training-Free, Temporally Consistent Video Editing via Low-Energy Transport","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T00:27:02.339910Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2608.00769"},"observation_digest":"sha256:c7f965e3331f32fa89dc92ca66b938c85910c056f717f07a51475b7d880818e2","observation_id":"d4643605-2db9-4a0a-adca-cd3d644431e7","resolution":{"observed_at":"2026-08-05T00:27:02.339910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2303.04761/citation-record","integrity":"/paper/2303.04761/integrity","json":"/paper/2303.04761/citation-record.json","paper":"/paper/2303.04761"},"outbound":[],"paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T15:52:18.509984Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2303.04761."}