{"as_of":"2026-08-14T16:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:142fbd552dbbce2e41f1dc6fc96769906ecb4e3f41338956ae1e1184e8d65fd7","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:28:22.437209Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T03:20:56.717829Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T04:37:37.467863Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"cited_work":{"arxiv_id":"2507.00162","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00162","snapshot_observed_at":"2026-07-03T04:37:37.467863Z","title":"3 Lu, Y ., Liang, Y ., Zhu, L., and Yang, Y","venue":null,"work_id":"3fa82b2f-b4e3-4b3b-8990-fc0b2b47cd1f","year":2025},"citing_paper":{"arxiv_id":"2509.22622","last_updated":"2025-10-13T22:41:26Z","snapshot_observed_at":"2026-07-06T22:30:55.313733Z","submitted_at":"2025-09-26T17:48:24Z","title":"LongLive: Real-time Interactive Long Video Generation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-15T03:52:59.287555Z"},"links":{"cited_paper":"/paper/2507.00162","citing_paper":"/paper/2509.22622"},"observation_digest":"sha256:4d2a6924862921cbcbf3523ff50294511ef20aeb4f21215798dd2738a95b98d9","observation_id":"01e804f2-7fd9-43f0-ae9e-ece3c2098adf","resolution":{"observed_at":"2026-05-15T03:52:59.381889Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"cited_work":{"arxiv_id":"2507.00162","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00162","snapshot_observed_at":"2026-07-03T04:37:37.467863Z","title":"3 Lu, Y ., Liang, Y ., Zhu, L., and Yang, Y","venue":null,"work_id":"3fa82b2f-b4e3-4b3b-8990-fc0b2b47cd1f","year":2025},"citing_paper":{"arxiv_id":"2602.02958","last_updated":"2026-05-05T23:46:52Z","snapshot_observed_at":"2026-08-13T20:12:55.440957Z","submitted_at":"2026-02-03T00:54:32Z","title":"Quant VideoGen: Auto-Regressive Long Video Generation via 2-Bit KV-Cache Quantization","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T07:58:24.456859Z"},"links":{"cited_paper":"/paper/2507.00162","citing_paper":"/paper/2602.02958"},"observation_digest":"sha256:3b4c74c5a559062e3b77517d4a6584d166dcdcf1b33c5b87ce1a17fd32371127","observation_id":"a127a3ae-393b-4aa4-9d14-8a632b43beb6","resolution":{"observed_at":"2026-05-16T08:00:44.670329Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"cited_work":{"arxiv_id":"2507.00162","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00162","snapshot_observed_at":"2026-07-03T04:37:37.467863Z","title":"3 Lu, Y ., Liang, Y ., Zhu, L., and Yang, Y","venue":null,"work_id":"3fa82b2f-b4e3-4b3b-8990-fc0b2b47cd1f","year":2025},"citing_paper":{"arxiv_id":"2605.06509","last_updated":"2026-05-07T16:21:34Z","snapshot_observed_at":"2026-08-06T11:28:24.405584Z","submitted_at":"2026-05-07T16:21:34Z","title":"FreeSpec: Training-Free Long Video Generation via Singular-Spectrum Reconstruction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T13:11:46.079614Z"},"links":{"cited_paper":"/paper/2507.00162","citing_paper":"/paper/2605.06509"},"observation_digest":"sha256:a7dc46bfb0b4152c1c3b377a3665c807933e419fdee0db29600de885b98be6ae","observation_id":"f12cc8e4-ac70-4240-85b2-c795a7ae594b","resolution":{"observed_at":"2026-05-11T18:56:07.727516Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"cited_work":{"arxiv_id":"2507.00162","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00162","snapshot_observed_at":"2026-07-03T04:37:37.467863Z","title":"3 Lu, Y ., Liang, Y ., Zhu, L., and Yang, Y","venue":null,"work_id":"3fa82b2f-b4e3-4b3b-8990-fc0b2b47cd1f","year":2025},"citing_paper":{"arxiv_id":"2606.10671","last_updated":"2026-08-04T12:43:00Z","snapshot_observed_at":"2026-08-07T23:11:38.667750Z","submitted_at":"2026-06-09T10:22:18Z","title":"FadeMem: Distance-Aware Memory Consolidation for Autoregressive Video Diffusion","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-27T13:44:44.550033Z"},"links":{"cited_paper":"/paper/2507.00162","citing_paper":"/paper/2606.10671"},"observation_digest":"sha256:a609c0794ceb6869143e221ace8541bc1e746417216cf187ea3fdce27b6a6746","observation_id":"f1f415e7-6bd6-4c02-a9c0-263e7b966a4f","resolution":{"observed_at":"2026-07-03T04:37:37.469275Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00162","snapshot_observed_at":"2026-08-01T15:29:45.047486Z","title":"Lu and Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18436","last_updated":"2026-07-20T18:37:58Z","snapshot_observed_at":"2026-08-06T20:51:47.915284Z","submitted_at":"2026-07-20T18:37:58Z","title":"Surprise Forcing: What to Remember, When to Skip in Long Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T15:29:45.047486Z"},"links":{"cited_paper":"/paper/2507.00162","citing_paper":"/paper/2607.18436"},"observation_digest":"sha256:aa0cd4a77827452c03d5af07cb204f13e4166c7ec3d76241a782fb49e5ec4200","observation_id":"69f8b9b1-d6eb-4005-9f34-3028e07adef4","resolution":{"observed_at":"2026-08-01T15:29:45.047486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00162","snapshot_observed_at":"2026-07-30T11:31:14.992002Z","title":"arXiv preprint arXiv:2507.00162 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27110","last_updated":"2026-08-03T12:29:16Z","snapshot_observed_at":"2026-08-13T11:42:06.738085Z","submitted_at":"2026-07-29T16:38:47Z","title":"FreqForcing: Autoregressive Long Video Generation via Spectral Self-Anchoring","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-30T11:31:14.992002Z"},"links":{"cited_paper":"/paper/2507.00162","citing_paper":"/paper/2607.27110"},"observation_digest":"sha256:2ab55ff06698378ffdc344ba32283f0bf372d317e41b5b094562df35c8f963dc","observation_id":"288a5ad2-47f1-4070-bacb-99443b9d2eb4","resolution":{"observed_at":"2026-07-30T11:31:14.992002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00162","snapshot_observed_at":"2026-08-04T03:20:56.717829Z","title":"arXiv preprint arXiv:2507.00162 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27110","last_updated":"2026-08-03T12:29:16Z","snapshot_observed_at":"2026-08-13T11:42:06.738085Z","submitted_at":"2026-07-29T16:38:47Z","title":"FreqForcing: Autoregressive Long Video Generation via Spectral Self-Anchoring","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T03:20:56.717829Z"},"links":{"cited_paper":"/paper/2507.00162","citing_paper":"/paper/2607.27110"},"observation_digest":"sha256:d8a97b899a6f520b834b362db4a8a66831b6d02f8727fad565a6962248a37b5b","observation_id":"082ffe14-c3b0-4caf-a1cd-8aec2c2e46ce","resolution":{"observed_at":"2026-08-04T03:20:56.717829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.00162/citation-record","integrity":"/paper/2507.00162/integrity","json":"/paper/2507.00162/citation-record.json","paper":"/paper/2507.00162"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-06T21:28:15.221400Z","title":"Wan: Open and advanced large-scale video generative models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:15.221400Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:552d39f9a7cfe139b5afefff745984bdb094ac41b26db55044d8ad8912804300","observation_id":"2ce7fdb8-3c1a-4507-ba1a-1e7d120261d9","resolution":{"observed_at":"2026-08-06T21:28:15.221400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-06T21:28:15.282525Z","title":"Ltx-video: Realtime video latent diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:15.282525Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:f29d84fe532360b7a37b150369112782b941b3ae6d10cfc2e8dd26419a4a7cd5","observation_id":"b33eadd8-6f5f-4075-a16a-34d2f2c416d4","resolution":{"observed_at":"2026-08-06T21:28:15.282525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:15.426694Z","title":"Videocrafter2: Overcoming data limitations for high- quality video diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:15.426694Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:c93933ae3c36f13a057a73aa2c28f8a91627c8ec7b444703cbce68ab6a229620","observation_id":"24190649-129a-4cee-be66-022e54924218","resolution":{"observed_at":"2026-08-06T21:28:15.426694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T21:28:15.570271Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:15.570271Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:785e8084d6867fedfebc66e1b9bb2367afdc13e9bbb326cc67ecf011a6057549","observation_id":"a0b97a3b-4584-46a5-bc6c-c4ef34057c36","resolution":{"observed_at":"2026-08-06T21:28:15.570271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T21:28:15.730523Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:15.730523Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:6bcfe32d168fcbab1e994aa63f1d8f0b7fd4a39874c2f86cdb83db3a445cd8ed","observation_id":"c93ad4f6-8ef6-49bd-b38b-63b1990a569b","resolution":{"observed_at":"2026-08-06T21:28:15.730523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15813","last_updated":"2023-11-27T13:39:44Z","snapshot_observed_at":"2026-08-14T10:17:21.842065Z","submitted_at":"2023-11-27T13:39:44Z","title":"FlowZero: Zero-Shot Text-to-Video Synthesis with LLM-Driven Dynamic Scene Syntax","version":1},"cited_work":{"arxiv_id":"2311.15813","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.15813","snapshot_observed_at":"2026-08-06T21:28:23.064765Z","title":"FlowZero: Zero-Shot Text-to-Video Synthesis with LLM-Driven Dynamic Scene Syntax","venue":"cs.CV","work_id":"dd8a1953-27d3-44f1-bb17-3901f2d9b806","year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:15.890002Z"},"links":{"cited_paper":"/paper/2311.15813","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:39d1931ef0c5006024d849d7b975d3416c1965606c807024e8d48743547a0243","observation_id":"cdb39ab0-bcd9-4445-b8ae-dbef2862782e","resolution":{"observed_at":"2026-08-06T21:28:23.114951Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16111","last_updated":"2024-03-24T12:04:06Z","snapshot_observed_at":"2026-08-13T14:10:52.103936Z","submitted_at":"2024-03-24T12:04:06Z","title":"EVA: Zero-shot Accurate Attributes and Multi-Object Video Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16111","snapshot_observed_at":"2026-08-06T21:28:16.013019Z","title":"Eva: Zero-shot accu- rate attributes and multi-object video editing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:16.013019Z"},"links":{"cited_paper":"/paper/2403.16111","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:1f41b59ff3525a46f24d6edd564e71d0b3f31ac270554c396744df837a7a0cde","observation_id":"c36ee13b-89db-40ef-83a0-9820f256d52a","resolution":{"observed_at":"2026-08-06T21:28:16.013019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-13T14:41:45.809481Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T21:28:16.154124Z","title":"Hunyuanvideo: A systematic framework for large video generative models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:16.154124Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:aebbc9610b718acd92731b3b1b46f9065178d912a9b96ebd302f15afe9e90c34","observation_id":"41819807-9d9e-46a8-ada7-1ae3d2dea362","resolution":{"observed_at":"2026-08-06T21:28:16.154124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10248","snapshot_observed_at":"2026-08-06T21:28:16.301869Z","title":"Step-video-t2v technical report: The practice, challenges, and future of video foundation model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:16.301869Z"},"links":{"cited_paper":"/paper/2502.10248","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:7c91e212c85dbe35a9ac2ff2d7192cdf74df54cbd0c07dda7583b7070ccbfe1a","observation_id":"9fdc8272-3823-4d94-85ca-fa91d0c951a3","resolution":{"observed_at":"2026-08-06T21:28:16.301869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T21:28:16.402862Z","title":"Cosmos world foundation model platform for physical ai,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:16.402862Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:0196d83217ff7ff4435794d2ca6bf13f1b883ca89374a63e57721a8c6fa0f3d5","observation_id":"04808656-9896-405a-b698-c4a2c9708aa9","resolution":{"observed_at":"2026-08-06T21:28:16.402862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-14T11:08:32.950294Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-06T21:28:16.552459Z","title":"Movie gen: A cast of media foundation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:16.552459Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:e0f8ef0395bbed31bbeb49f7a89e7976662c992420efd536b327ca36c108d4fc","observation_id":"d342d1ca-3627-48bb-950b-6b4d559ff64e","resolution":{"observed_at":"2026-08-06T21:28:16.552459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:16.666716Z","title":"Pyramidal flow matching for efficient video generative modeling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:16.666716Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:0f66532e840177d2c497cad1554b314bd03f7ec8f0b91227e5eb1d7542b94842","observation_id":"9e9fe8d8-03a0-4017-9774-5b2b18d2c49e","resolution":{"observed_at":"2026-08-06T21:28:16.666716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-13T21:19:07.777045Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-06T21:28:16.764873Z","title":"Open-sora plan: Open-source large video generation model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:16.764873Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:f13bea8aefc88b1215d0794708921332953b3fb9bc9a2f74035a76ad2b94033e","observation_id":"69ba4e81-e137-4deb-8adf-488c89d5e855","resolution":{"observed_at":"2026-08-06T21:28:16.764873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T21:28:16.899831Z","title":"Stable video IEEE TRANSACTIONS ON PATTERN ANAL YSIS AND MACHINE INTELLIGENCE 13 diffusion: Scaling latent video diffusion models to large datasets,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:16.899831Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:89f8d4b243d73a47c2abaca72fe4eeda4ada72178a510e66344f2e2bcc2e5abf","observation_id":"f8caa70b-f6d1-4bcc-be9a-29b8319f8807","resolution":{"observed_at":"2026-08-06T21:28:16.899831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:28.356022Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation,","venue":null,"work_id":"08d6e213-8bbd-4b85-bc24-8ce8ca120f4f","year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:17.019088Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:2a3db4a6480d1f2ae07b614717d0dc867fe9d0aeb9cabf45f5985a7d501c2acb","observation_id":"edb146d1-e841-448a-a721-ccba4955b29c","resolution":{"observed_at":"2026-08-06T21:28:28.477196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:28.120556Z","title":"Frozen in time: A joint video and image encoder for end-to-end retrieval,","venue":null,"work_id":"04e27495-4903-4022-bedd-3ff20c635545","year":2021},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:17.179027Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:dfad893a9005ddad8669c3fd66a4808f3837000a39a277ca2a83dce161692fe3","observation_id":"e122004c-32d0-42ca-8a43-b79a3b5ea4a7","resolution":{"observed_at":"2026-08-06T21:28:28.229536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:27.845752Z","title":"Panda-70m: Captioning 70m videos with multiple cross-modality teachers,","venue":null,"work_id":"12f138a0-fbeb-480c-a1d5-c20c1d57ce5d","year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:17.326832Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:789b284d90bfce1b34c95358cca6b8d5295d3e96433ea21effb872869b1c8824","observation_id":"0db352a3-8c72-478b-a31a-381862af21fb","resolution":{"observed_at":"2026-08-06T21:28:27.975348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:27.567562Z","title":"Koala-36m: A large-scale video dataset improving consistency between fine-grained conditions and video content,","venue":null,"work_id":"79834c4e-ac34-40b3-93e7-c028d5372f16","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:17.470898Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:e89f1792a365f1ee97b5b1ed0489281bbbd7da4c24adfd9fe79317748711cb39","observation_id":"db65461e-d42a-4def-b4db-4f2684fc347f","resolution":{"observed_at":"2026-08-06T21:28:27.711328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02629","last_updated":"2024-08-05T16:53:23Z","snapshot_observed_at":"2026-08-13T15:06:39.861200Z","submitted_at":"2024-08-05T16:53:23Z","title":"VidGen-1M: A Large-Scale Dataset for Text-to-video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02629","snapshot_observed_at":"2026-08-06T21:28:17.589175Z","title":"Vidgen-1m: A large- scale dataset for text-to-video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:17.589175Z"},"links":{"cited_paper":"/paper/2408.02629","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:8c9611d6ab85e7ac54c9bbb1e55eb172ee9e7524be7a1d353f2f9f74e9a27423","observation_id":"ccb936a4-6747-4788-a868-d7a8dd1ba52a","resolution":{"observed_at":"2026-08-06T21:28:17.589175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:27.339676Z","title":"Hoigen-1m: A large-scale dataset for human-object interaction video generation,","venue":null,"work_id":"a04456eb-0886-40f6-8494-2050622bb6fd","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:17.731239Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:71985ac043e7373a10155d056be33fe057a68c584749d5cc86d37381533d65fb","observation_id":"82dcbefc-cc1d-46d8-b19f-8774bae2e6ea","resolution":{"observed_at":"2026-08-06T21:28:27.455567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08380","last_updated":"2024-11-13T07:05:40Z","snapshot_observed_at":"2026-08-14T07:35:16.273803Z","submitted_at":"2024-11-13T07:05:40Z","title":"EgoVid-5M: A Large-Scale Video-Action Dataset for Egocentric Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08380","snapshot_observed_at":"2026-08-06T21:28:17.840081Z","title":"Egovid-5m: A large-scale video- action dataset for egocentric video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:17.840081Z"},"links":{"cited_paper":"/paper/2411.08380","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:d2b5b314bac6600e0277e78dc2d77222f6e8279551484908e16c7af312f9745e","observation_id":"e2e62075-90b9-442d-8a0f-54f627e3b7a1","resolution":{"observed_at":"2026-08-06T21:28:17.840081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14773","last_updated":"2025-04-16T13:38:58Z","snapshot_observed_at":"2026-08-13T18:13:05.895663Z","submitted_at":"2024-03-21T18:27:29Z","title":"StreamingT2V: Consistent, Dynamic, and Extendable Long Video Generation from Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14773","snapshot_observed_at":"2026-08-06T21:28:17.968982Z","title":"Stream- ingt2v: Consistent, dynamic, and extendable long video genera- tion from text,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:17.968982Z"},"links":{"cited_paper":"/paper/2403.14773","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:5836eced460eb1cb388de8e41b37e4d4d185407708d9a56cda16d8a393779c26","observation_id":"fae491bf-41bc-4086-9491-558190c6829e","resolution":{"observed_at":"2026-08-06T21:28:17.968982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04233","last_updated":"2024-05-07T11:52:49Z","snapshot_observed_at":"2026-08-13T00:13:12.479004Z","submitted_at":"2024-05-07T11:52:49Z","title":"Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04233","snapshot_observed_at":"2026-08-06T21:28:18.123749Z","title":"Vidu: a highly consistent, dynamic and skilled text-to-video generator with diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:18.123749Z"},"links":{"cited_paper":"/paper/2405.04233","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:cac2e076c3ffdcd79a9cf2dd7dea50aaf36755c0a1c198784e0f007ffad8b184","observation_id":"bf5f1056-59cb-49c0-84c8-15847e188534","resolution":{"observed_at":"2026-08-06T21:28:18.123749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04277","last_updated":"2024-10-14T07:20:01Z","snapshot_observed_at":"2026-08-13T06:05:51.161533Z","submitted_at":"2024-06-06T17:25:33Z","title":"VideoTetris: Towards Compositional Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04277","snapshot_observed_at":"2026-08-06T21:28:18.217598Z","title":"Videotetris: Towards compositional text-to- video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:18.217598Z"},"links":{"cited_paper":"/paper/2406.04277","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:26837d6d59d06ad16a151b78f6c06b4291a5e957b54c4161132e6dd653eded9c","observation_id":"4355f95f-23e8-4deb-8a1e-ed8ee5ed3192","resolution":{"observed_at":"2026-08-06T21:28:18.217598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10874","last_updated":"2024-04-24T11:22:00Z","snapshot_observed_at":"2026-08-13T11:39:34.773518Z","submitted_at":"2023-05-18T11:06:15Z","title":"Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10874","snapshot_observed_at":"2026-08-06T21:28:18.331975Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:18.331975Z"},"links":{"cited_paper":"/paper/2305.10874","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:5edfe98ed761bb0eabe64a18829df8fa5978952abfeb31b4377178b8f1773fb7","observation_id":"d299757f-a3c3-43ad-86ee-fdca42af45cb","resolution":{"observed_at":"2026-08-06T21:28:18.331975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09414","last_updated":"2024-01-17T18:55:12Z","snapshot_observed_at":"2026-08-13T04:40:23.947408Z","submitted_at":"2024-01-17T18:55:12Z","title":"Vlogger: Make Your Dream A Vlog","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09414","snapshot_observed_at":"2026-08-06T21:28:18.411462Z","title":"Vlogger: Make your dream a vlog,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:18.411462Z"},"links":{"cited_paper":"/paper/2401.09414","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:257d13b9b4a19644350a49e572116f0f616fddbd1ca7447921479f85cccd5c39","observation_id":"2a479394-fe5a-41ec-a1dc-ec33a7dcd28b","resolution":{"observed_at":"2026-08-06T21:28:18.411462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:27.032524Z","title":"Packing input frame contexts in next- frame prediction models for video generation,","venue":null,"work_id":"a08a90b9-4937-4ef2-b6bc-ce3c8fc52d24","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:18.525263Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:6b1a15bb4ac4ff4697817df66d794a97bbf8cb129504d147afdb35122f1810f2","observation_id":"c961208f-4caf-45f3-b9f0-fc5060bbb6e4","resolution":{"observed_at":"2026-08-06T21:28:27.221828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19325","last_updated":"2025-05-18T02:27:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T03:38:06Z","title":"Long-Context Autoregressive Video Modeling with Next-Frame Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19325","snapshot_observed_at":"2026-08-06T21:28:18.672018Z","title":"Long-context autoregres- sive video modeling with next-frame prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:18.672018Z"},"links":{"cited_paper":"/paper/2503.19325","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:5ace6dcf00de1a363a39edf9f54e1ae45c0ac18c7d0525c09dfd93bd73220dd3","observation_id":"fc028002-6754-4513-b5db-4430847817b3","resolution":{"observed_at":"2026-08-06T21:28:18.672018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10589","last_updated":"2025-03-13T17:40:07Z","snapshot_observed_at":"2026-08-13T05:58:35.441148Z","submitted_at":"2025-03-13T17:40:07Z","title":"Long Context Tuning for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10589","snapshot_observed_at":"2026-08-06T21:28:18.785749Z","title":"Long context tuning for video generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:18.785749Z"},"links":{"cited_paper":"/paper/2503.10589","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:3078bb33300998d5a087aeafa3bd561a67ffe4256a4ee781086651865f36c4f9","observation_id":"41cc4d12-e0c1-4e9f-a56e-e0932c9f53ad","resolution":{"observed_at":"2026-08-06T21:28:18.785749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:26.729084Z","title":"One-minute video generation with test-time training,","venue":null,"work_id":"0f35d8b0-77d7-45d7-83f5-1696501572ea","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:18.917599Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:fdc182e05d01d452ffa995b0bbc40fb6f663c4f5af433255dcc8a26ee09cf1c7","observation_id":"7acca514-c91b-4d75-bfe9-013ae10bbcf4","resolution":{"observed_at":"2026-08-06T21:28:26.919774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01549","last_updated":"2025-02-03T17:30:19Z","snapshot_observed_at":"2026-08-14T01:07:43.919441Z","submitted_at":"2025-02-03T17:30:19Z","title":"VideoRAG: Retrieval-Augmented Generation with Extreme Long-Context Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01549","snapshot_observed_at":"2026-08-06T21:28:19.020765Z","title":"Vide- orag: Retrieval-augmented generation with extreme long-context videos,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:19.020765Z"},"links":{"cited_paper":"/paper/2502.01549","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:2a3a271da9a7c89531131707b6d54f09dca07ea312eaa6cb46463ecfedbf7cdd","observation_id":"e0f65253-23a0-415d-b066-d037399649a2","resolution":{"observed_at":"2026-08-06T21:28:19.020765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06173","last_updated":"2025-06-07T09:44:59Z","snapshot_observed_at":"2026-08-10T21:03:35.979874Z","submitted_at":"2025-01-10T18:52:11Z","title":"VideoAuteur: Towards Long Narrative Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06173","snapshot_observed_at":"2026-08-06T21:28:19.136053Z","title":"Videoauteur: Towards long narrative video generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:19.136053Z"},"links":{"cited_paper":"/paper/2501.06173","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:321eaea012fcb8fc9a0489660f095aa1eb19cc4a6c905411c8ef8efc8280b7ed","observation_id":"fd08887b-78b4-451c-a06a-826baa946492","resolution":{"observed_at":"2026-08-06T21:28:19.136053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09600","last_updated":"2024-12-12T18:59:01Z","snapshot_observed_at":"2026-08-13T06:08:40.399835Z","submitted_at":"2024-12-12T18:59:01Z","title":"Owl-1: Omni World Model for Consistent Long Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09600","snapshot_observed_at":"2026-08-06T21:28:19.220810Z","title":"Owl-1: Omni world model for consistent long video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:19.220810Z"},"links":{"cited_paper":"/paper/2412.09600","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:d861baae366f9d9c75845139f6cdb07874c9a659b3cf502c9d4eece6e7b8b729","observation_id":"afaa5112-3b18-4d13-8659-1d6170e9e2e7","resolution":{"observed_at":"2026-08-06T21:28:19.220810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15169","last_updated":"2024-01-30T16:44:20Z","snapshot_observed_at":"2026-08-13T05:42:52.392821Z","submitted_at":"2023-10-23T17:59:58Z","title":"FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15169","snapshot_observed_at":"2026-08-06T21:28:19.322246Z","title":"Freenoise: Tuning-free longer video diffusion via noise reschedul- ing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:19.322246Z"},"links":{"cited_paper":"/paper/2310.15169","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:499073df37cde6e8575933ed08244814fe88ed94cf2d3b52b03c1ac1a9f30f70","observation_id":"afb0d3ca-4a8a-492a-8835-67f1d9e551d9","resolution":{"observed_at":"2026-08-06T21:28:19.322246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18264","last_updated":"2023-05-29T17:38:18Z","snapshot_observed_at":"2026-08-13T11:30:06.083037Z","submitted_at":"2023-05-29T17:38:18Z","title":"Gen-L-Video: Multi-Text to Long Video Generation via Temporal Co-Denoising","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18264","snapshot_observed_at":"2026-08-06T21:28:19.447426Z","title":"Gen- l-video: Multi-text to long video generation via temporal co- denoising,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:19.447426Z"},"links":{"cited_paper":"/paper/2305.18264","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:c15ad8b3b8f5f0b7b5a46bed7363f1c7f85e3dc7a981c45f62043022db039ab6","observation_id":"9d2747e3-76a0-4025-a990-8618a86839b0","resolution":{"observed_at":"2026-08-06T21:28:19.447426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:26.425615Z","title":"Fifo-diffusion: Generating infinite videos from text without training,","venue":null,"work_id":"a2aceff5-53f2-469c-a462-6cd30ed0b3c8","year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:19.556077Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:a8d7a2027de10786daeca3f28504a3863ff502ae7761e45622994218c47952bf","observation_id":"dc0ddd81-6183-40f7-a67e-c47d890890a4","resolution":{"observed_at":"2026-08-06T21:28:26.575563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13501","last_updated":"2025-03-18T13:55:22Z","snapshot_observed_at":"2026-08-13T00:49:36.373000Z","submitted_at":"2024-03-20T10:58:58Z","title":"VSTAR: Generative Temporal Nursing for Longer Dynamic Video Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13501","snapshot_observed_at":"2026-08-06T21:28:19.734775Z","title":"Vstar: Generative temporal nursing for longer dynamic video synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:19.734775Z"},"links":{"cited_paper":"/paper/2403.13501","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:cfe330e091cd86467f6ddff3063c82dfa2a07906fccfab540d7887fb02a6cfc5","observation_id":"de424fbc-6695-4332-8a16-332fbce34c51","resolution":{"observed_at":"2026-08-06T21:28:19.734775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15894","last_updated":"2025-08-07T08:48:51Z","snapshot_observed_at":"2026-08-07T17:57:38.872776Z","submitted_at":"2025-02-21T19:28:05Z","title":"RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15894","snapshot_observed_at":"2026-08-06T21:28:19.852766Z","title":"Riflex: A free lunch for length extrapolation in video diffusion transformers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:19.852766Z"},"links":{"cited_paper":"/paper/2502.15894","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:7177c9fc48d395403793afb0734bca56684f3593ebabd6ee5c6562d2b8538359","observation_id":"00a2abcb-7784-483e-b30c-71aa8e29d261","resolution":{"observed_at":"2026-08-06T21:28:19.852766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:26.184759Z","title":"Ditctrl: Exploring attention control in multi-modal diffusion transformer for tuning-free multi-prompt longer video generation,","venue":null,"work_id":"3907e0e8-7c91-48fe-97f4-1d45e42f211a","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:20.005918Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:852007945c5a989d58a30595854bdc889837d9f71faa4be1a1aaed83498ab718","observation_id":"b3eea461-f04d-49bd-aa81-069931577419","resolution":{"observed_at":"2026-08-06T21:28:26.307223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:25.930711Z","title":"Freepca: Integrating consistency information across long-short frames in training-free long video generation via principal component analysis,","venue":null,"work_id":"aa28d3b2-cb3d-4651-9c4e-65a94409ae67","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:20.154442Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:3d6de7c9fb073f672f51b9fa8622ebb3efc8322d2512c0f4ea01fe21b4b2c308","observation_id":"daefc0bc-2522-48ef-992f-0e2d6db3ec20","resolution":{"observed_at":"2026-08-06T21:28:26.047890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:25.619471Z","title":"Longdiff: Training-free long video generation in one go,","venue":null,"work_id":"de2b4318-3f6e-4674-a0b9-5afb99268cc6","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:20.255627Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:50e0267bf30dfefaae03dbed841590a45aab112efe4a78449cdf49f5d6934c44","observation_id":"ea815aa8-ba0a-4b24-b012-975b9a98a140","resolution":{"observed_at":"2026-08-06T21:28:25.746149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16400","last_updated":"2025-05-23T19:01:04Z","snapshot_observed_at":"2026-08-07T16:48:25.007109Z","submitted_at":"2025-03-20T17:54:37Z","title":"ScalingNoise: Scaling Inference-Time Search for Generating Infinite Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16400","snapshot_observed_at":"2026-08-06T21:28:20.374842Z","title":"Scalingnoise: Scaling inference-time search for generating infinite videos,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:20.374842Z"},"links":{"cited_paper":"/paper/2503.16400","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:ba370e9cc9bad8d17929a7d874122f55fb504229ef70b6f422de876854f092e1","observation_id":"735ce1ec-a436-4289-a66d-c024f76510f8","resolution":{"observed_at":"2026-08-06T21:28:20.374842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:20.523811Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:20.523811Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:c5ddc85f81a86df75096c11874f387f1f4c24bfddee19e0303bca14ae01a8537","observation_id":"7aad83fb-6083-4d1a-aff2-bcfb6f190395","resolution":{"observed_at":"2026-08-06T21:28:20.523811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-08-14T11:04:59.421484Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-08-06T21:28:20.657347Z","title":"Lavie: High-quality video gen- eration with cascaded latent diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:20.657347Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:0e7e92442a26ad67d1f63e59333af7176d1741d65cc934fc7d0c0cde96830296","observation_id":"0602d0b4-8907-47f9-b33f-68db20144779","resolution":{"observed_at":"2026-08-06T21:28:20.657347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:25.366380Z","title":"Video generation models as world simulators,","venue":null,"work_id":"d92da5a9-4aeb-4c8c-ae5a-21bd9a2d5212","year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:20.808585Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:07fd53c7b3a8bab0d966e10f0e81fbffd8ea89bfad2ebfa27bc8df043737b2fe","observation_id":"0ace6662-491a-4208-9662-4c78eee2717c","resolution":{"observed_at":"2026-08-06T21:28:25.495021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:20.934356Z","title":"Scalable diffusion models with trans- formers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:20.934356Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:56944ca5f91bfce3ae388bd5924fcca2f75048e0cdc2180f576d6ed7941fbddc","observation_id":"94acd663-db90-478e-8f00-008f6f3cde50","resolution":{"observed_at":"2026-08-06T21:28:20.934356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:21.054260Z","title":"Mochi 1,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.054260Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:061c90f8e1b4fb5e4a866f27c2887ac4577edaa04ec4efbec2af266365890222","observation_id":"040b9501-9a40-4f4b-8401-ec8b20be4687","resolution":{"observed_at":"2026-08-06T21:28:21.054260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:25.136347Z","title":"From slow bidirectional to fast autoregres- sive video diffusion models,","venue":null,"work_id":"c12a53b0-1666-49d5-ae3b-ac15e178c5be","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.162601Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:eda04bf9041a2bb0224e9bf82f38956c4ae71e473a19ee31389df14e8f6850bc","observation_id":"f3efe54a-445f-4b71-89bb-5d9892471eb0","resolution":{"observed_at":"2026-08-06T21:28:25.279119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13211","last_updated":"2025-05-19T14:58:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-19T14:58:50Z","title":"MAGI-1: Autoregressive Video Generation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13211","snapshot_observed_at":"2026-08-06T21:28:21.303740Z","title":"Magi-1: Autoregressive video generation at scale,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.303740Z"},"links":{"cited_paper":"/paper/2505.13211","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:64dd6cd2211db8851d81045cc702aa067a954518fc1b3c5ae7adcdd9ed6a468e","observation_id":"be12feb3-f01b-4f39-b3b5-85bdbe0046dd","resolution":{"observed_at":"2026-08-06T21:28:21.303740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T21:28:21.428425Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.428425Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:2222959b44bcc9199ab7ff593d44ddaf1b86bb337004522fabb9c59cc74683f9","observation_id":"66704f10-6a40-47ea-a08a-a6e6d46d63dd","resolution":{"observed_at":"2026-08-06T21:28:21.428425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-06T21:28:21.554272Z","title":"Flow matching for generative modeling,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.554272Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:e51944b2ca0f8a8dbd86f86642a8bd7f1ceb22c3dd188b3793f29857028be31b","observation_id":"b43e80f8-61c3-4638-962d-e0d86fa4976f","resolution":{"observed_at":"2026-08-06T21:28:21.554272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:21.660252Z","title":"Spargeattn: Accurate sparse attention accelerating any model inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.660252Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:2ad02ee0a83cca64c7a46fed40de166e5fb654475dc9e84fab1ccce2dfcad14e","observation_id":"8ae1d6ee-fd80-4770-83ef-7dd3ff43f43e","resolution":{"observed_at":"2026-08-06T21:28:21.660252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:21.695969Z","title":"Flashvideo: Flowing fidelity to detail for efficient high-resolution video generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.695969Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:0aa073f236a556ee85023bb3d47f7f598d382440ec787c53b2537606b7e904cd","observation_id":"04e5a5c7-d299-4b30-b076-3c2723f7eb05","resolution":{"observed_at":"2026-08-06T21:28:21.695969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04507","last_updated":"2025-06-04T23:21:39Z","snapshot_observed_at":"2026-08-12T05:38:58.830320Z","submitted_at":"2025-02-06T21:17:09Z","title":"Fast Video Generation with Sliding Tile Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04507","snapshot_observed_at":"2026-08-06T21:28:21.748673Z","title":"Fast video generation with sliding tile attention,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.748673Z"},"links":{"cited_paper":"/paper/2502.04507","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:2608761d40d8cc2b72f1609a525b26a08a26881f55dc27250e3ff92a7d1e29fd","observation_id":"8ca339f6-2c30-409e-a198-7bc0785987aa","resolution":{"observed_at":"2026-08-06T21:28:21.748673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01776","last_updated":"2025-04-27T00:10:11Z","snapshot_observed_at":"2026-08-13T13:28:15.450370Z","submitted_at":"2025-02-03T19:29:16Z","title":"Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01776","snapshot_observed_at":"2026-08-06T21:28:21.806986Z","title":"Sparse videogen: Accelerating video dif- fusion transformers with spatial-temporal sparsity,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.806986Z"},"links":{"cited_paper":"/paper/2502.01776","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:916210c3cf092deac3b8c48e3959358d15f7092d8b8da2018ed4631eb96606f9","observation_id":"44e63883-ca03-4026-8c47-1279fea49fa5","resolution":{"observed_at":"2026-08-06T21:28:21.806986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:24.868146Z","title":"Certain topics in telegraph transmission theory,","venue":null,"work_id":"d5a3fbce-5f90-4aba-a131-cea4a83fb05c","year":2009},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.861043Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:e14d55ea4821d2a3d81637106af7f00ea75081f53958db9040a35db087504096","observation_id":"ce5f7225-2710-46c5-9ad0-1fdc455ee14b","resolution":{"observed_at":"2026-08-06T21:28:25.028146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:24.582999Z","title":"Communication in the presence of noise,","venue":null,"work_id":"63452c30-2e36-4422-bc00-119e5aacaa48","year":2006},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.926387Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:0f445eaca7b9f033228e3b9a7941d0c0cd538e4b2cae3fed2208cadf23e2323d","observation_id":"e232028b-1808-4320-adba-374654ecf9bc","resolution":{"observed_at":"2026-08-06T21:28:24.700179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07537","last_updated":"2024-07-25T09:10:52Z","snapshot_observed_at":"2026-08-13T05:03:53.783074Z","submitted_at":"2023-12-12T18:59:16Z","title":"FreeInit: Bridging Initialization Gap in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07537","snapshot_observed_at":"2026-08-06T21:28:21.954794Z","title":"Freeinit: Bridg- ing initialization gap in video diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:21.954794Z"},"links":{"cited_paper":"/paper/2312.07537","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:ad41ccb60cddeb41a7bf4781fac52095a36bd6447829c8914815183f1d08acd4","observation_id":"8eefbb7d-6bf2-417c-bdf4-8490c853266e","resolution":{"observed_at":"2026-08-06T21:28:21.954794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:24.333524Z","title":"Free- bloom: Zero-shot text-to-video generator with llm director and ldm animator,","venue":null,"work_id":"7d85aea6-a901-42c0-94f6-6b4b8b8514b3","year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.039108Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:3af57b3a2896fddebfcccaaab2fdd588072cedf8bf60094e0e1d42554abeb27a","observation_id":"067cded9-eddc-46b7-973c-78d7a1982eb5","resolution":{"observed_at":"2026-08-06T21:28:24.416513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:24.092422Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning,","venue":null,"work_id":"76fe4fc1-3a83-4197-b1b4-dc61542e8eba","year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.076293Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:1fc1a4161c81232729d8d80b8fd5dba9a4329b315dc35605260124daf11336f3","observation_id":"dfd9dec7-fe61-4f5b-91f9-d8e5fd0800e9","resolution":{"observed_at":"2026-08-06T21:28:24.230976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17982","last_updated":"2023-11-29T18:39:01Z","snapshot_observed_at":"2026-08-14T12:25:36.801905Z","submitted_at":"2023-11-29T18:39:01Z","title":"VBench: Comprehensive Benchmark Suite for Video Generative Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17982","snapshot_observed_at":"2026-08-06T21:28:22.113060Z","title":"Vbench: Comprehensive benchmark suite for video generative models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.113060Z"},"links":{"cited_paper":"/paper/2311.17982","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:198438bc54507eb940bbdb8786843c46c086b9ad4d8deb3104fb7d1d840dc9d1","observation_id":"975c9967-78f9-4993-b917-94f9c112bf94","resolution":{"observed_at":"2026-08-06T21:28:22.113060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:22.153344Z","title":"Emerging properties in self-supervised vision transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.153344Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:1154478105eec0e49734d43128d22e6a4249398838104049daec17398d750f26","observation_id":"e30719a5-08d2-45b2-a5df-6db8c5aebedb","resolution":{"observed_at":"2026-08-06T21:28:22.153344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:22.193553Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.193553Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:ae020f67f187566c8cb265a830bc7db7d64e116f6ef32615d084b5bfe6d6cd80","observation_id":"277ae37c-1814-45e7-8059-766c38852b67","resolution":{"observed_at":"2026-08-06T21:28:22.193553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:23.843450Z","title":"Amt: All-pairs multi-field transforms for efficient frame inter- polation,","venue":null,"work_id":"a0315e15-7f44-46c5-a4f8-05811a04255f","year":2023},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.229719Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:19e06a9d58690eaa12e6b1d633e6a668247bd81f75ab2e0ddb4b2e1330388818","observation_id":"35c9e954-1977-465c-9546-e1bd92293131","resolution":{"observed_at":"2026-08-06T21:28:23.914962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:23.645519Z","title":"Musiq: Multi- scale image quality transformer,","venue":null,"work_id":"74715c40-edf7-4559-a44e-12d88d581bc6","year":2021},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.258340Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:7e821c6243f531c5b97b5d4b1085c6b7c54a451f66d27e32c772c0215bcd0398","observation_id":"35383f24-07fe-424b-a3cb-bccf7dfbf213","resolution":{"observed_at":"2026-08-06T21:28:23.770090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:23.518721Z","title":"Perceptual quality assessment of smartphone photography,","venue":null,"work_id":"42abda7c-2372-42fc-943d-6c139037f1c4","year":2020},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.288066Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:7a9aa46da23be7f5d0841fb4a4056674969b5ca11b6362d690ea6e8a4b4c5837","observation_id":"171fa689-7fcc-4271-872c-d42dcf8054d1","resolution":{"observed_at":"2026-08-06T21:28:23.531391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:23.422233Z","title":"aesthetic-predictor,","venue":null,"work_id":"fbd0a289-0202-476b-addc-b342bb4bf70d","year":2024},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.316700Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:ab3dda3cd3ab176f4f82e05808ea2cbd81fd7f8aacbebb0a9c03e26d9069f8bc","observation_id":"e053efed-d5f4-4bf5-a064-25c3b22fe0bc","resolution":{"observed_at":"2026-08-06T21:28:23.463351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-08-06T21:28:22.346620Z","title":"Vace: All- in-one video creation and editing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.346620Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:b7dc884247fb1a26c8b68f84cdc207fc4876b22d35d9e86dd45bd240d350a2df","observation_id":"2072fb8c-e869-406a-9948-8cf07a4bcd35","resolution":{"observed_at":"2026-08-06T21:28:22.346620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:23.309114Z","title":null,"venue":null,"work_id":"79ee7ca4-9401-4ab8-8983-7ba02aff4d97","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.384626Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:4e61f5a71e69d87d223ed530c6926cb9e6d9d6884b1ac68f5a9f3d44591023b5","observation_id":"8cde7a6a-c1f5-4307-97f9-decce5c00cc3","resolution":{"observed_at":"2026-08-06T21:28:23.362592Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:28:23.208268Z","title":"Pika.art,","venue":null,"work_id":"020ba59e-03b9-438b-9a0e-342320e83c7c","year":2025},"citing_paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T21:28:22.437209Z"},"links":{"citing_paper":"/paper/2507.00162"},"observation_digest":"sha256:cde7aa97cefe34c7a714a17399ab61638a5d6a85e0106c529cbec8fc02968e5c","observation_id":"3b0c7387-0dea-41af-962a-b2454d2154d9","resolution":{"observed_at":"2026-08-06T21:28:23.233072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.00162","last_updated":"2025-06-30T18:11:21Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T10:16:31.065357Z","submitted_at":"2025-06-30T18:11:21Z","title":"FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 7 inbound Pith citation observations for arXiv:2507.00162."}