{"as_of":"2026-08-21T05:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ff3ead36e2a89a01d2655fabbe825e649f60197baf56005775adb65010da7630","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:38:30.329076Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:28:55.548089Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-08-12T15:00:31.779652Z","title":"LARP: Tokenizing videos with a learned autoregressive generative prior","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14762","last_updated":"2025-04-03T02:29:28Z","snapshot_observed_at":"2026-08-20T04:29:44.245479Z","submitted_at":"2024-11-22T06:50:44Z","title":"Efficient Long Video Tokenization via Coordinate-based Patch Reconstruction","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T15:00:31.779652Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2411.14762"},"observation_digest":"sha256:978ac86551bb3f872f985fc08c6158a634c98f8e1e20c2a0d325fee7e4540462","observation_id":"5e73021d-f44d-4ac8-8af3-0535260537c7","resolution":{"observed_at":"2026-08-12T15:00:31.779652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-08-11T21:30:08.494766Z","title":"Larp: Tokenizing videos with a learned autoregressive generative prior","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04432","last_updated":"2024-12-05T18:53:04Z","snapshot_observed_at":"2026-08-14T13:59:34.648701Z","submitted_at":"2024-12-05T18:53:04Z","title":"Divot: Diffusion Powers Video Tokenizer for Comprehension and Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T21:30:08.494766Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2412.04432"},"observation_digest":"sha256:198ba71e858c69000b67a20b2d63f5f23bb6d682b5dffe056a900e73991e950b","observation_id":"8fabbf4d-909f-490c-900e-0d38893bd01c","resolution":{"observed_at":"2026-08-11T21:30:08.494766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-08-11T17:59:36.661509Z","title":"Larp: Tokenizing videos with a learned autoregressive generative prior","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10443","last_updated":"2025-03-11T03:19:42Z","snapshot_observed_at":"2026-08-19T05:16:04.103836Z","submitted_at":"2024-12-11T13:48:06Z","title":"SweetTok: Semantic-Aware Spatial-Temporal Tokenizer for Compact Video Discretization","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T17:59:36.661509Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2412.10443"},"observation_digest":"sha256:2fd46369f79a898bcf11a1a530d62cd41cad16f73aa2e18cf1ebb3e48662c91a","observation_id":"40f906bf-7435-48b5-99db-ea375161fe36","resolution":{"observed_at":"2026-08-11T17:59:36.661509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-08-10T19:48:08.219120Z","title":"Larp: Tokenizing videos with a learned autoregressive generative prior.arXiv preprint arXiv:2410.21264,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09755","last_updated":"2025-01-16T18:59:04Z","snapshot_observed_at":"2026-08-14T07:17:14.314435Z","submitted_at":"2025-01-16T18:59:04Z","title":"Learnings from Scaling Visual Tokenizers for Reconstruction and Generation","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-10T19:48:08.219120Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2501.09755"},"observation_digest":"sha256:fa52fafad6d479cc8c8ef977c2cc1ea3b2b8881d9dd741a217a2585927eb0efa","observation_id":"33d2fd40-5049-4518-a1e4-e766afda89cb","resolution":{"observed_at":"2026-08-10T19:48:08.219120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-08-15T20:38:30.329076Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12489","last_updated":"2025-05-21T04:44:19Z","snapshot_observed_at":"2026-08-17T20:11:15.369850Z","submitted_at":"2025-05-18T16:22:58Z","title":"Video-GPT via Next Clip Diffusion","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T20:38:30.329076Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2505.12489"},"observation_digest":"sha256:628dd321b4701808fb76d56786a58e00ccc16dababcec3e71868a936f571448e","observation_id":"950114c0-1f65-481b-82ab-c6ec39114caf","resolution":{"observed_at":"2026-08-15T20:38:30.329076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-08-15T18:46:10.844791Z","title":"Larp: Tokenizing videos with a learned autoregressive generative prior.arXiv preprint arXiv:2410.21264, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18898","last_updated":"2025-06-23T17:59:14Z","snapshot_observed_at":"2026-08-15T23:43:47.561047Z","submitted_at":"2025-06-23T17:59:14Z","title":"Vision as a Dialect: Unifying Visual Understanding and Generation via Text-Aligned Representations","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T18:46:10.844791Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2506.18898"},"observation_digest":"sha256:6058798fd09abe92bbfc8f428229fe12f70177961357b08bab8ddc245ff0f912","observation_id":"4bbb3b56-c0b8-4258-bde4-a770d0ebed82","resolution":{"observed_at":"2026-08-15T18:46:10.844791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":"2410.21264","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-07-03T20:28:55.548089Z","title":"Larp: Tokeniz- ing videos with a learned autoregressive generative prior","venue":null,"work_id":"2badaf55-95a4-4bff-b4bd-b1eeb13def8a","year":2024},"citing_paper":{"arxiv_id":"2512.11321","last_updated":"2026-05-12T04:50:53Z","snapshot_observed_at":"2026-08-10T21:23:14.950037Z","submitted_at":"2025-12-12T06:45:02Z","title":"KeyframeFace: Language-Driven Facial Animation via Semantic Keyframes","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T22:46:51.954117Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2512.11321"},"observation_digest":"sha256:0110a3623b1c60e26deee276a94a0f3c8f57d3e5911bfb2aa0431ae0d6a7f8b6","observation_id":"5d22831f-0601-4971-85ce-c9510b584922","resolution":{"observed_at":"2026-05-16T22:48:38.138963Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":"2410.21264","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-07-03T20:28:55.548089Z","title":"Larp: Tokeniz- ing videos with a learned autoregressive generative prior","venue":null,"work_id":"2badaf55-95a4-4bff-b4bd-b1eeb13def8a","year":2024},"citing_paper":{"arxiv_id":"2605.06137","last_updated":"2026-05-29T13:39:42Z","snapshot_observed_at":"2026-07-06T23:18:41.400741Z","submitted_at":"2026-05-07T12:35:51Z","title":"Autoregressive Visual Generation Needs a Prologue","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T13:52:42.834440Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2605.06137"},"observation_digest":"sha256:403184282e67da8c079fa6444a91e5a6512dec48216f50c460b05b0e9a4bb07e","observation_id":"279410c1-ee40-4d46-97ca-00152d5f588c","resolution":{"observed_at":"2026-05-11T18:51:06.123795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":"2410.21264","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-07-03T20:28:55.548089Z","title":"Larp: Tokeniz- ing videos with a learned autoregressive generative prior","venue":null,"work_id":"2badaf55-95a4-4bff-b4bd-b1eeb13def8a","year":2024},"citing_paper":{"arxiv_id":"2605.06137","last_updated":"2026-05-29T13:39:42Z","snapshot_observed_at":"2026-07-06T23:18:41.400741Z","submitted_at":"2026-05-07T12:35:51Z","title":"Autoregressive Visual Generation Needs a Prologue","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T23:36:51.148162Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2605.06137"},"observation_digest":"sha256:6d18950f21a26e155d3bf1cf2df3e0ebf01eab2aa90a7071271eeb4ef162a2da","observation_id":"9397069a-2688-4461-b4d7-2bc2f727b23d","resolution":{"observed_at":"2026-07-01T13:15:46.137396Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":"2410.21264","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-07-03T20:28:55.548089Z","title":"Larp: Tokeniz- ing videos with a learned autoregressive generative prior","venue":null,"work_id":"2badaf55-95a4-4bff-b4bd-b1eeb13def8a","year":2024},"citing_paper":{"arxiv_id":"2606.03578","last_updated":"2026-06-02T12:47:14Z","snapshot_observed_at":"2026-07-06T23:43:50.943530Z","submitted_at":"2026-06-02T12:47:14Z","title":"Diffusing in the Right Space: A Systematic Study of Latent Diffusability","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-28T10:44:24.318786Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2606.03578"},"observation_digest":"sha256:2379b9cbedafcc60d7c8845337eb24fc0f2654dbfab8646460ca111b5999112a","observation_id":"b939ef1f-3d11-4877-814d-3e94c29ee631","resolution":{"observed_at":"2026-07-02T02:46:27.641875Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":"2410.21264","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-07-03T20:28:55.548089Z","title":"Larp: Tokeniz- ing videos with a learned autoregressive generative prior","venue":null,"work_id":"2badaf55-95a4-4bff-b4bd-b1eeb13def8a","year":2024},"citing_paper":{"arxiv_id":"2606.06158","last_updated":"2026-06-04T13:31:12Z","snapshot_observed_at":"2026-08-17T10:49:43.276208Z","submitted_at":"2026-06-04T13:31:12Z","title":"Adaptive Tokenisation Via Temporal Redundancy Masking And Latent Inpainting","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T02:55:00.586061Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2606.06158"},"observation_digest":"sha256:de863a8fedc46358229d28d0af1a9752a950f36b4178bbe7bb35ab1fcc061544","observation_id":"487082ec-3b6a-4076-8152-4ed14b3ca30d","resolution":{"observed_at":"2026-07-02T11:46:56.089570Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":"2410.21264","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-07-03T20:28:55.548089Z","title":"Larp: Tokeniz- ing videos with a learned autoregressive generative prior","venue":null,"work_id":"2badaf55-95a4-4bff-b4bd-b1eeb13def8a","year":2024},"citing_paper":{"arxiv_id":"2606.17590","last_updated":"2026-06-16T06:52:52Z","snapshot_observed_at":"2026-08-13T12:30:51.704665Z","submitted_at":"2026-06-16T06:52:52Z","title":"TivTok: Broadcasting Time-Invariant Tokens for Scalable Video Tokenization","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-06-27T01:20:32.508409Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2606.17590"},"observation_digest":"sha256:1bae5ce670adecda8bd9366b0b9eaa4a9bd22c620afabd2bdc6639e83dbb79a5","observation_id":"f46ea481-0bc4-47e3-a2a2-407cecf4b184","resolution":{"observed_at":"2026-07-03T20:28:55.549434Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21264","snapshot_observed_at":"2026-08-02T02:51:46.641264Z","title":"Larp: Tokenizing videos with a learned autoregressive generative prior.arXiv preprint arXiv:2410.21264, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14088","last_updated":"2026-07-15T17:59:23Z","snapshot_observed_at":"2026-08-18T20:31:00.689212Z","submitted_at":"2026-07-15T17:59:23Z","title":"VideoRAE: Taming Video Foundation Models for Generative Modeling via Representation Autoencoders","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T02:51:46.641264Z"},"links":{"cited_paper":"/paper/2410.21264","citing_paper":"/paper/2607.14088"},"observation_digest":"sha256:666fbf006293a5f435661245ca3740b588b16482b8cfa45db1e0c866e6acee27","observation_id":"6385974f-1d7d-427e-9122-1a17fa270dae","resolution":{"observed_at":"2026-08-02T02:51:46.641264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.21264/citation-record","integrity":"/paper/2410.21264/integrity","json":"/paper/2410.21264/citation-record.json","paper":"/paper/2410.21264"},"outbound":[],"paper":{"arxiv_id":"2410.21264","last_updated":"2025-06-16T22:06:19Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T20:25:52.505798Z","submitted_at":"2024-10-28T17:57:07Z","title":"LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2410.21264."}