{"as_of":"2026-08-09T15:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e6c8d5ddb427e6522c2c6b91ae7e7f05647e0c3daaada8c4fbac99d43f81cc46","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:59:35.266101Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T11:34:37.702024Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":"2305.10874","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video generation","venue":null,"work_id":"c8bb167e-7070-4097-9fdb-a94d84cba240","year":2023},"citing_paper":{"arxiv_id":"2406.03520","last_updated":"2024-10-03T17:24:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T17:53:55Z","title":"VideoPhy: Evaluating Physical Commonsense for Video Generation","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-05-20T11:34:37.599691Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2406.03520"},"observation_digest":"sha256:7183e99766104d68406e316404f21b8f9700bf066c0c6d5a73febdaaf400dc04","observation_id":"532c46f3-6ed1-43f3-8103-8712c7bd60d1","resolution":{"observed_at":"2026-05-20T11:34:37.704069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-07T13:59:35.266101Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20292","last_updated":"2025-06-03T10:11:00Z","snapshot_observed_at":"2026-08-07T13:53:16.552171Z","submitted_at":"2025-05-26T17:59:46Z","title":"OpenS2V-Nexus: A Detailed Benchmark and Million-Scale Dataset for Subject-to-Video Generation","version":4},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T13:59:35.266101Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2505.20292"},"observation_digest":"sha256:40407b570fa3d915d8704952cd7bde0183e4693cb648e10bde7e4baf650d3bef","observation_id":"c5788791-343a-4a42-b610-91b72e515481","resolution":{"observed_at":"2026-08-07T13:59:35.266101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-06T21:28:50.065412Z","title":"Videofactory: Swap at- tention in spatiotemporal diffusions for text-to-video gener- ation.arXiv preprint arXiv:2305.10874, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.24121","last_updated":"2026-06-16T06:12:45Z","snapshot_observed_at":"2026-08-09T09:29:22.989737Z","submitted_at":"2025-06-30T17:58:34Z","title":"TextMesh4D: Zero-shot Text-to-4D Mesh Generation","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:50.065412Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2506.24121"},"observation_digest":"sha256:65f85447018dc580acf3271766895b8274a696d0df5c8fa14587155cc1262f83","observation_id":"d06e90c2-55dd-4d97-b791-7ce4f5559953","resolution":{"observed_at":"2026-08-06T21:28:50.065412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-06T21:28:18.331975Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-07T22:12:22.087190Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:18.331975Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:f7c212932507ffff2f683065b90753958ab078fbcc037f9275a09e4163e3b25c","observation_id":"d299757f-a3c3-43ad-86ee-fdca42af45cb","resolution":{"observed_at":"2026-08-06T21:28:18.331975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-06T18:51:29.322880Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video gen- eration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07202","last_updated":"2025-07-09T18:20:33Z","snapshot_observed_at":"2026-08-07T10:10:34.633901Z","submitted_at":"2025-07-09T18:20:33Z","title":"A Survey on Long-Video Storytelling Generation: Architectures, Consistency, and Cinematic Quality","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T18:51:29.322880Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2507.07202"},"observation_digest":"sha256:3c8895819b833810808327debb9f7fc12c96d770c67dc0360fb5ae145d397b51","observation_id":"cfc808d4-8e26-44b4-83a7-5c2aba9e5c35","resolution":{"observed_at":"2026-08-06T18:51:29.322880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-05T20:20:40.408942Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10771","last_updated":"2025-08-14T15:55:49Z","snapshot_observed_at":"2026-08-07T17:36:52.163388Z","submitted_at":"2025-08-14T15:55:49Z","title":"AEGIS: Authenticity Evaluation Benchmark for AI-Generated Video Sequences","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T20:20:40.408942Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2508.10771"},"observation_digest":"sha256:14a26b0d8b053bcdb813c14128bdeddc91bcc5f971ccc0d9e01e8864d5bdb35c","observation_id":"c1512bc3-fb6e-4207-aee3-43338d15919a","resolution":{"observed_at":"2026-08-05T20:20:40.408942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-05T16:32:30.901204Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.18271","last_updated":"2026-05-27T17:09:12Z","snapshot_observed_at":"2026-08-08T16:31:30.207031Z","submitted_at":"2025-08-25T17:59:40Z","title":"ObjFiller3D: Scaling 3D Object Inpainting to Dense Multi-View Consistency","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T16:32:30.901204Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2508.18271"},"observation_digest":"sha256:57cd352892a2fa4662f8a3ce229cde93380851222ded8c02bf70e2562c7414e2","observation_id":"4b8f6296-d361-4a00-84b4-4ba3751f0150","resolution":{"observed_at":"2026-08-05T16:32:30.901204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":"2305.10874","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video generation","venue":null,"work_id":"c8bb167e-7070-4097-9fdb-a94d84cba240","year":2023},"citing_paper":{"arxiv_id":"2604.02799","last_updated":"2026-04-03T07:09:55Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T07:09:55Z","title":"UNICA: A Unified Neural Framework for Controllable 3D Avatars","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-13T19:47:13.052204Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2604.02799"},"observation_digest":"sha256:4771f7179ba12faff4e7799380bd96e078757d42b473a26ad8227f91ab484a7c","observation_id":"0c99a30f-fd9e-415b-ab35-3235bac5faa3","resolution":{"observed_at":"2026-05-13T19:48:11.255188Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":"2305.10874","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video generation","venue":null,"work_id":"c8bb167e-7070-4097-9fdb-a94d84cba240","year":2023},"citing_paper":{"arxiv_id":"2605.05895","last_updated":"2026-07-31T14:44:20Z","snapshot_observed_at":"2026-08-05T23:14:25.356148Z","submitted_at":"2026-05-07T09:08:32Z","title":"Detecting AI-Generated Videos with Spiking Neural Networks","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-09T16:15:42.113951Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2605.05895"},"observation_digest":"sha256:25b0176bd97aeef461a72a7c60bfcbb6b1a90cac944be3c25573ad04396d2fae","observation_id":"4a9695ad-c41e-40c6-b1a4-01a26f35a35b","resolution":{"observed_at":"2026-05-11T16:31:12.328250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-03T02:25:01.702234Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video generation.arXiv preprint arXiv:2305.10874, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.05895","last_updated":"2026-07-31T14:44:20Z","snapshot_observed_at":"2026-08-05T23:14:25.356148Z","submitted_at":"2026-05-07T09:08:32Z","title":"Detecting AI-Generated Videos with Spiking Neural Networks","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T02:25:01.702234Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2605.05895"},"observation_digest":"sha256:a6c9a25ce314cbbbaf35130765e8f6297c48c50e0a9161298ca253e01a288d51","observation_id":"824d2951-fae7-4812-972e-8320785a452d","resolution":{"observed_at":"2026-08-03T02:25:01.702234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-02T06:23:48.054091Z","title":"2024 , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12752","last_updated":"2026-07-15T04:28:35Z","snapshot_observed_at":"2026-08-07T19:36:05.834855Z","submitted_at":"2026-07-14T13:19:06Z","title":"Hallo4D: Multi-Modal Hallucination Mitigation for Consistent Spatio-Temporal Generation","version":2},"reference_index":207,"source":"arxiv_source","source_observed_at":"2026-08-02T06:23:48.054091Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2607.12752"},"observation_digest":"sha256:4ceaa2b7f123d06f87ce3878f54248ac893988a39ea64586abe139743593d314","observation_id":"1f389f1e-0f8a-4008-899c-9103a5bf502d","resolution":{"observed_at":"2026-08-02T06:23:48.054091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-03T16:36:48.967450Z","title":"Videofactory: Swap at- tention in spatiotemporal diffusions for text-to-video gener- ation.arXiv preprint arXiv:2305.10874, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28955","last_updated":"2026-07-31T02:19:25Z","snapshot_observed_at":"2026-08-09T00:03:40.272087Z","submitted_at":"2026-07-31T02:19:25Z","title":"Retrieval-Driven Training-Free AI-Generated Video Attribution","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T16:36:48.967450Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2607.28955"},"observation_digest":"sha256:7fb5c0ce35188c08ec14b6a9817d2bbe83937d570d63498113a667657ad49e10","observation_id":"e7c544ed-a4d6-4341-b448-2587a11b1bdc","resolution":{"observed_at":"2026-08-03T16:36:48.967450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-03T16:20:04.584508Z","title":"Videofactory: Swap at- tention in spatiotemporal diffusions for text-to-video gener- ation.arXiv preprint arXiv:2305.10874, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28974","last_updated":"2026-07-31T02:53:07Z","snapshot_observed_at":"2026-08-08T15:14:40.508964Z","submitted_at":"2026-07-31T02:53:07Z","title":"RAID: Towards Robust AI-Generated Image Detection with Bit-Reversed Images","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T16:20:04.584508Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2607.28974"},"observation_digest":"sha256:508dcac840625e552f8e54f2522e1773d6042b166ae9e2f95546f74334de0e02","observation_id":"8c187cd9-4c89-44ba-8d5c-d7695cb93257","resolution":{"observed_at":"2026-08-03T16:20:04.584508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-06T00:24:41.080064Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01334","last_updated":"2026-08-02T15:54:54Z","snapshot_observed_at":"2026-08-09T03:53:59.478499Z","submitted_at":"2026-08-02T15:54:54Z","title":"SphereVideo: Prototype-anchored Hyperspherical Boundary for Continual AI-generated Video Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:24:41.080064Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2608.01334"},"observation_digest":"sha256:88a22103eacc92f7393a5ae82e1da1f2a7f3b4b974f869276be69934371a7742","observation_id":"c23c8670-7780-4b06-a1a1-8747df9e688f","resolution":{"observed_at":"2026-08-06T00:24:41.080064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.10874/citation-record","integrity":"/paper/2305.10874/integrity","json":"/paper/2305.10874/citation-record.json","paper":"/paper/2305.10874"},"outbound":[],"paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T15:15:33.423007Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2305.10874."}