{"as_of":"2026-08-09T22:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b8d1fc2640638562c119d73903efd27ef85c10cea461384033523faa4c769cd","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:51:12.716760Z","state":"measured"},{"denominator":85,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":85,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T10:20:15.291981Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T09:03:26.247342Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00500","snapshot_observed_at":"2026-08-08T10:20:15.291981Z","title":"Video latent flow matching: Optimal polynomial projections for video interpolation and extrapolation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.08150","last_updated":"2025-02-12T06:30:01Z","snapshot_observed_at":"2026-08-09T01:42:36.516995Z","submitted_at":"2025-02-12T06:30:01Z","title":"Force Matching with Relativistic Constraints: A Physics-Inspired Approach to Stable and Efficient Generative Modeling","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T10:20:15.291981Z"},"links":{"cited_paper":"/paper/2502.00500","citing_paper":"/paper/2502.08150"},"observation_digest":"sha256:d10f53b5e1734c3a37a147eb94dd826a22c143ba2728b646f0cd333e4a12e602","observation_id":"f5e19cf0-bfaf-408a-8806-cba79c7c5210","resolution":{"observed_at":"2026-08-08T10:20:15.291981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00500","snapshot_observed_at":"2026-08-06T14:43:26.067995Z","title":"Video latent flow matching: Optimal polynomial projections for video interpolation and extrapolation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18107","last_updated":"2025-07-24T05:37:08Z","snapshot_observed_at":"2026-08-08T23:17:58.783602Z","submitted_at":"2025-07-24T05:37:08Z","title":"T2VWorldBench: A Benchmark for Evaluating World Knowledge in Text-to-Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:43:26.067995Z"},"links":{"cited_paper":"/paper/2502.00500","citing_paper":"/paper/2507.18107"},"observation_digest":"sha256:83deb08cfc5d1f3a263675cf2c21f2cbd187cba1255fcc8977618a145dfc17e8","observation_id":"9bec5562-9131-44ae-a44c-c4234785d5e4","resolution":{"observed_at":"2026-08-06T14:43:26.067995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"cited_work":{"arxiv_id":"2502.00500","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00500","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6f212466-9d8b-4ec9-aa5d-c30842287904","year":2025},"citing_paper":{"arxiv_id":"2604.15911","last_updated":"2026-04-17T10:11:39Z","snapshot_observed_at":"2026-07-06T23:03:21.422544Z","submitted_at":"2026-04-17T10:11:39Z","title":"Efficient Video Diffusion Models: Advancements and Challenges","version":1},"reference_index":223,"source":"pdf_text","source_observed_at":"2026-05-10T08:28:29.706249Z"},"links":{"cited_paper":"/paper/2502.00500","citing_paper":"/paper/2604.15911"},"observation_digest":"sha256:53636d76b9f0d8cad6b2cba58e08270fdc554e7e00fcec7ab593b7610b0587bf","observation_id":"06f4c2cb-fc55-401c-925d-18233e8c0f92","resolution":{"observed_at":"2026-05-10T09:03:26.249272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00500/citation-record","integrity":"/paper/2502.00500/integrity","json":"/paper/2502.00500/citation-record.json","paper":"/paper/2502.00500"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T18:51:12.281466Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.281466Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:41508175c50a30050b03eaae96d6fa510e796bb6d675b163b8757f9ad42adf91","observation_id":"6af0b641-410a-4975-988c-6e8977cf1310","resolution":{"observed_at":"2026-08-09T18:51:12.281466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15571","last_updated":"2023-03-09T15:18:40Z","snapshot_observed_at":"2026-08-08T19:32:58.342274Z","submitted_at":"2022-09-30T16:30:31Z","title":"Building Normalizing Flows with Stochastic Interpolants","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15571","snapshot_observed_at":"2026-08-09T18:51:12.299432Z","title":"Building normalizing flows with stochas- tic interpolants","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.299432Z"},"links":{"cited_paper":"/paper/2209.15571","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:c4ff240f03b7010e16dfec38ff2207cab47c46100cf6dede9da6003dbdd9a3f8","observation_id":"c800193f-17a1-4405-8ebf-6d22c31da520","resolution":{"observed_at":"2026-08-09T18:51:12.299432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-09T18:51:12.316963Z","title":"π0: A vision- language-action flow model for general robot control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.316963Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:77c8d8845e342baca2903ad67a5e8226256dc3a6eb1905b402516934b35acdfc","observation_id":"63c2f44b-e780-46bc-878f-5f0e7c546cb1","resolution":{"observed_at":"2026-08-09T18:51:12.316963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04711","last_updated":"2022-07-11T08:50:19Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T08:50:19Z","title":"Matching Normalizing Flows and Probability Paths on Manifolds","version":1},"cited_work":{"arxiv_id":"2207.04711","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.04711","snapshot_observed_at":"2026-08-09T18:51:14.352213Z","title":"Matching Normalizing Flows and Probability Paths on Manifolds","venue":"stat.ML","work_id":"90947c9e-45dd-4c67-a78b-cc1ae5b8b7b6","year":2022},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.321640Z"},"links":{"cited_paper":"/paper/2207.04711","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:4ab8dd8c6ebcfd03b0ffa0a578309d2604fa9b39de081eaf9a34c5e82d487cf7","observation_id":"ba2f7e52-b4d8-4a0f-b289-c63bc1d56cb0","resolution":{"observed_at":"2026-08-09T18:51:14.358647Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:51:12.325926Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.325926Z"},"links":{"citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:233a0c2bce71bd59ffc4520f1b5b0731125e62e30fc2ef3d2a229bad2a2c5756","observation_id":"0d497e98-039b-4472-bf90-51fe33f769ed","resolution":{"observed_at":"2026-08-09T18:51:12.325926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02207","last_updated":"2023-04-05T03:43:38Z","snapshot_observed_at":"2026-08-05T13:33:02.149756Z","submitted_at":"2023-04-05T03:43:38Z","title":"Algorithm and Hardness for Dynamic Attention Maintenance in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02207","snapshot_observed_at":"2026-08-09T18:51:12.335719Z","title":"Algorithm and hardness for dynamic attention maintenance in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.335719Z"},"links":{"cited_paper":"/paper/2304.02207","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:896a4824f3d40bb2b8cd7e23561e4b8aa222b4675aab06cb249d959cd2ab72c7","observation_id":"4c6160c4-d3c4-4439-a760-9e807a3fd8a0","resolution":{"observed_at":"2026-08-09T18:51:12.335719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07602","last_updated":"2024-12-01T06:39:41Z","snapshot_observed_at":"2026-08-07T22:02:40.620185Z","submitted_at":"2024-11-12T07:24:41Z","title":"Circuit Complexity Bounds for RoPE-based Transformer Architecture","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07602","snapshot_observed_at":"2026-08-09T18:51:12.345981Z","title":"Circuit complexity bounds for rope-based transformer architecture","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.345981Z"},"links":{"cited_paper":"/paper/2411.07602","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:5630a583573dd7ddc3e5c553ac425153337dd7de826212a4941d502d3be1a444","observation_id":"9e706923-b6e9-41b2-a509-395c8d1185dd","resolution":{"observed_at":"2026-08-09T18:51:12.345981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17107","last_updated":"2025-03-05T07:29:42Z","snapshot_observed_at":"2026-07-06T20:11:46.794148Z","submitted_at":"2024-12-22T17:39:32Z","title":"Grams: Gradient Descent with Adaptive Momentum Scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17107","snapshot_observed_at":"2026-08-09T18:51:12.351082Z","title":"Grams: Gradient descent with adaptive momentum scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.351082Z"},"links":{"cited_paper":"/paper/2412.17107","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:da0089aa0a069ab3621a7d8b074a43ee03dca6c35181b8e3a2921abe01b5691c","observation_id":"01ce11ff-3a59-4f64-ba60-78b87ae80665","resolution":{"observed_at":"2026-08-09T18:51:12.351082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10165","last_updated":"2025-02-24T08:42:25Z","snapshot_observed_at":"2026-07-06T19:32:51.287674Z","submitted_at":"2024-10-14T05:18:02Z","title":"HSR-Enhanced Sparse Attention Acceleration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10165","snapshot_observed_at":"2026-08-09T18:51:12.356722Z","title":"Hsr-enhanced sparse attention acceleration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.356722Z"},"links":{"cited_paper":"/paper/2410.10165","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:f01498768316ba817fb96e02081ff5c11b7aafb290126ee34af294a42fe34209","observation_id":"eae4695d-3855-4cec-969b-ec3967cf4b5a","resolution":{"observed_at":"2026-08-09T18:51:12.356722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04997","last_updated":"2024-06-05T20:31:17Z","snapshot_observed_at":"2026-08-05T15:54:15.679904Z","submitted_at":"2024-02-07T16:15:36Z","title":"Generative Flows on Discrete State-Spaces: Enabling Multimodal Flows with Applications to Protein Co-Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04997","snapshot_observed_at":"2026-08-09T18:51:12.361996Z","title":"Generative flows on discrete state-spaces: Enabling multimodal flows with applications to protein co-design","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.361996Z"},"links":{"cited_paper":"/paper/2402.04997","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:470d4fb86f68f56aad4d2ba34e9bd22369b69798263d85ec921be293f27a5582","observation_id":"d8b6aa66-dd2c-4c3b-bb21-6a9028de736d","resolution":{"observed_at":"2026-08-09T18:51:12.361996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-09T18:51:12.367004Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.367004Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:2b39e7ca2f30e639d140ef3dde484091999d367ae9d427a9ab793b8accfec971","observation_id":"ea98afbe-940e-4b2a-8bc0-72c3180ed187","resolution":{"observed_at":"2026-08-09T18:51:12.367004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.04508","last_updated":"2024-02-08T00:26:31Z","snapshot_observed_at":"2026-07-06T13:40:05.327378Z","submitted_at":"2022-08-09T02:29:42Z","title":"Training Overparametrized Neural Networks in Sublinear Time","version":2},"cited_work":{"arxiv_id":"2208.04508","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.04508","snapshot_observed_at":"2026-08-09T18:51:14.191407Z","title":"Training Overparametrized Neural Networks in Sublinear Time","venue":"cs.LG","work_id":"e18c358d-bbbc-41a1-8ace-40c804d18853","year":2022},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.372033Z"},"links":{"cited_paper":"/paper/2208.04508","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:2f8acbd3d1667354ac5de7029e1e1b1f6425c135edec0ccbad8b240d67899bd4","observation_id":"1f7a4694-355c-46d5-a045-2484bd3352cc","resolution":{"observed_at":"2026-08-09T18:51:14.197964Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T18:51:12.377990Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.377990Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:0215c3c75a4ff886302c46891dd0afb83a0f82677366bd30435c716204e5041c","observation_id":"f829a717-98fa-4457-8de9-888de3424e97","resolution":{"observed_at":"2026-08-09T18:51:12.377990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10411","last_updated":"2023-04-26T15:34:52Z","snapshot_observed_at":"2026-07-06T15:17:59.640907Z","submitted_at":"2023-04-20T15:50:35Z","title":"Attention Scheme Inspired Softmax Regression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10411","snapshot_observed_at":"2026-08-09T18:51:12.383189Z","title":"Attention scheme inspired softmax regression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.383189Z"},"links":{"cited_paper":"/paper/2304.10411","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:99ff5d46295b9d9b526e624bfdf2b31d7fff4abf74062f4cb0d5f620741982d1","observation_id":"d21917a0-f6c7-42a0-aeec-9d28995f6155","resolution":{"observed_at":"2026-08-09T18:51:12.383189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12462","last_updated":"2023-10-19T04:41:01Z","snapshot_observed_at":"2026-07-06T16:35:27.763870Z","submitted_at":"2023-10-19T04:41:01Z","title":"Unmasking Transformers: A Theoretical Approach to Data Recovery via Attention Weights","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12462","snapshot_observed_at":"2026-08-09T18:51:12.389438Z","title":"Unmasking transform- ers: A theoretical approach to data recovery via attention weights","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.389438Z"},"links":{"cited_paper":"/paper/2310.12462","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:8a923b5d5e38c47c14dc6ae62aeca66a243feeee5b170e1a8f64044fdb981b61","observation_id":"95a9c632-0286-431e-b53e-3875e65c56c5","resolution":{"observed_at":"2026-08-09T18:51:12.389438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01663","last_updated":"2024-11-03T19:18:57Z","snapshot_observed_at":"2026-08-04T01:28:55.753197Z","submitted_at":"2024-11-03T19:18:57Z","title":"Unlocking the Theory Behind Scaling 1-Bit Neural Networks","version":1},"cited_work":{"arxiv_id":"2411.01663","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.01663","snapshot_observed_at":"2026-08-09T18:51:14.106704Z","title":"Unlocking the Theory Behind Scaling 1-Bit Neural Networks","venue":"cs.LG","work_id":"f795e43b-4fc2-49bb-9ce8-7589884f25bf","year":2024},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.395250Z"},"links":{"cited_paper":"/paper/2411.01663","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:9c42d776c0709ed24426bd64514d663172abcad668cadded3519c5556b3b6f45","observation_id":"ba8e1e0c-0891-4bcc-9622-46b62f1da4c5","resolution":{"observed_at":"2026-08-09T18:51:14.112128Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02690","last_updated":"2025-02-12T14:32:46Z","snapshot_observed_at":"2026-08-09T12:41:39.057624Z","submitted_at":"2024-04-03T12:37:34Z","title":"How Sparse Attention Approximates Exact Attention? Your Attention is Naturally $n^C$-Sparse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02690","snapshot_observed_at":"2026-08-09T18:51:12.401249Z","title":"Attention is naturally sparse with gaussian distributed input","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.401249Z"},"links":{"cited_paper":"/paper/2404.02690","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:60fb190a2cfdb4a3e1a833d4c8311e67d5aeac83c2c4c38bd84f0fe7ab6d1a32","observation_id":"6120744c-586e-439d-a8fd-b7678f16d20e","resolution":{"observed_at":"2026-08-09T18:51:12.401249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-09T18:51:12.406832Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.406832Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:fb886a45bf19ca5abc708db98b4899fb04e1e5111d25476853d8298f1cc2eac9","observation_id":"2bc464b5-cdcf-4eb1-b255-08297f966297","resolution":{"observed_at":"2026-08-09T18:51:12.406832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.12037","last_updated":"2022-08-05T17:35:04Z","snapshot_observed_at":"2026-07-06T13:24:10.141302Z","submitted_at":"2022-06-24T02:24:41Z","title":"How to Train Your HiPPO: State Space Models with Generalized Orthogonal Basis Projections","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.12037","snapshot_observed_at":"2026-08-09T18:51:12.412377Z","title":"How to train your hippo: State space models with generalized orthogonal basis projections","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.412377Z"},"links":{"cited_paper":"/paper/2206.12037","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:993e8de8e5e87da328afd5653af223928706ddbffb27805d338222efa3b4b37d","observation_id":"845beaca-b00b-46d7-aa82-b78bca54f53f","resolution":{"observed_at":"2026-08-09T18:51:12.412377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14036","last_updated":"2024-10-16T06:33:44Z","snapshot_observed_at":"2026-07-06T18:34:03.037351Z","submitted_at":"2024-06-20T06:56:35Z","title":"Towards Infinite-Long Prefix in Transformer","version":2},"cited_work":{"arxiv_id":"2406.14036","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.14036","snapshot_observed_at":"2026-08-09T18:51:14.021058Z","title":"Towards Infinite-Long Prefix in Transformer","venue":"cs.LG","work_id":"61071d6a-d089-4e1c-abbc-bd933ff0fa01","year":2024},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.417685Z"},"links":{"cited_paper":"/paper/2406.14036","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:cdc6971dec8c3dc62fcc3b26f59cfcb6e9c4f420ae5a4fe92e520c69bc87a4eb","observation_id":"0a5c11ae-5939-4b2c-89d7-a44bb36310cd","resolution":{"observed_at":"2026-08-09T18:51:14.026529Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15595","last_updated":"2024-11-05T10:02:42Z","snapshot_observed_at":"2026-07-06T18:50:00.486434Z","submitted_at":"2024-07-22T12:33:27Z","title":"Discrete Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15595","snapshot_observed_at":"2026-08-09T18:51:12.422579Z","title":"Discrete flow matching","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.422579Z"},"links":{"cited_paper":"/paper/2407.15595","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:a82a69d9c49215559d534fb2894c46bb4a8e647bea93025b13e669b99c061248","observation_id":"17093f03-1d81-4fe0-8d1d-4eb6b7fdfe4b","resolution":{"observed_at":"2026-08-09T18:51:12.422579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07418","last_updated":"2023-09-14T04:23:40Z","snapshot_observed_at":"2026-07-06T16:18:17.458740Z","submitted_at":"2023-09-14T04:23:40Z","title":"A Fast Optimization View: Reformulating Single Layer Attention in LLM Based on Tensor and SVM Trick, and Solving It in Matrix Multiplication Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07418","snapshot_observed_at":"2026-08-09T18:51:12.427596Z","title":"A fast optimization view: Reformulating single layer attention in llm based on tensor and svm trick, and solving it in matrix multiplication time","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.427596Z"},"links":{"cited_paper":"/paper/2309.07418","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:2068f134cda71b483d5529caf6fd2c6967ead0b16b4013766432152c6e031f18","observation_id":"1586c74b-fec8-4e79-af17-e626c4bab00e","resolution":{"observed_at":"2026-08-09T18:51:12.427596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03549","last_updated":"2023-09-07T08:12:58Z","snapshot_observed_at":"2026-07-06T16:15:35.656382Z","submitted_at":"2023-09-07T08:12:58Z","title":"Reuse and Diffuse: Iterative Denoising for Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03549","snapshot_observed_at":"2026-08-09T18:51:12.432955Z","title":"Reuse and diffuse: Iterative denoising for text-to-video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.432955Z"},"links":{"cited_paper":"/paper/2309.03549","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:3fceeb797f7a8061d1def565ac86208431c371777bfb06c654f4b03052af7557","observation_id":"8866abfd-1cf4-44a0-995f-5f9e30ebd939","resolution":{"observed_at":"2026-08-09T18:51:12.432955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-09T18:51:12.438333Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.438333Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:f335511a6d83760aab7580e5114013d9009416a9dc6180a93e0b3b53761e0bd9","observation_id":"c07daa71-678d-40c6-9237-0131b35c870d","resolution":{"observed_at":"2026-08-09T18:51:12.438333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:51:12.442922Z","title":"Iterative α-(de) blending: A minimalist deterministic diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.442922Z"},"links":{"citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:a76d7bd1eb33f8949fb3fc618ccaa1a01cfcba23ca310979c7726eed71a69507","observation_id":"456e2335-38eb-4453-8122-48805da212a1","resolution":{"observed_at":"2026-08-09T18:51:12.442922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03828","last_updated":"2024-06-26T20:50:18Z","snapshot_observed_at":"2026-08-03T16:52:43.091217Z","submitted_at":"2024-04-04T23:08:43Z","title":"Outlier-Efficient Hopfield Layers for Large Transformer-Based Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03828","snapshot_observed_at":"2026-08-09T18:51:12.447317Z","title":"Outlier-efficient hopfield layers for large transformer-based models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.447317Z"},"links":{"cited_paper":"/paper/2404.03828","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:9e77944ea0756b32cc81cdfeb9be709bec6614def180ee1bd8e37825157004f0","observation_id":"275fd026-3a01-4cc7-aaee-786b0ddfb439","resolution":{"observed_at":"2026-08-09T18:51:12.447317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-09T18:51:12.451472Z","title":"Imagen video: High definition video generation with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.451472Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:d4f2630469c4099ec4365ad0035bc913a6c24c893dbb119785e58b83ed4f8b96","observation_id":"730229c8-2d7c-4a79-9540-638c66243a35","resolution":{"observed_at":"2026-08-09T18:51:12.451472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05869","last_updated":"2023-12-01T17:43:06Z","snapshot_observed_at":"2026-07-06T16:29:55.892584Z","submitted_at":"2023-10-09T17:05:25Z","title":"HyperAttention: Long-context Attention in Near-Linear Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05869","snapshot_observed_at":"2026-08-09T18:51:12.456504Z","title":"Hyperattention: Long-context attention in near-linear time","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.456504Z"},"links":{"cited_paper":"/paper/2310.05869","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:c6d5d414147cd7f65b44688494e42535c6482e3802b0e41b2ffb55cba8f5e6ad","observation_id":"38e48125-b958-4152-a2db-d651a175ad34","resolution":{"observed_at":"2026-08-09T18:51:12.456504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04520","last_updated":"2024-06-01T00:49:17Z","snapshot_observed_at":"2026-07-06T17:26:35.513723Z","submitted_at":"2024-02-07T01:58:21Z","title":"On Computational Limits of Modern Hopfield Models: A Fine-Grained Complexity Analysis","version":5},"cited_work":{"arxiv_id":"2402.04520","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.04520","snapshot_observed_at":"2026-08-09T18:51:13.852964Z","title":"On Computational Limits of Modern Hopfield Models: A Fine-Grained Complexity Analysis","venue":"cs.LG","work_id":"9ab9c3ca-a642-4fc8-834e-63fef5f6c4f4","year":2024},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.461749Z"},"links":{"cited_paper":"/paper/2402.04520","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:b619eddf6e66e3da1b427c6663b6095bc8175a91a6f9cca31dcc0f18a5777045","observation_id":"bf5a88e9-1b76-44df-b93f-ada138e44f3f","resolution":{"observed_at":"2026-08-09T18:51:13.858035Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20313","last_updated":"2024-12-11T15:42:13Z","snapshot_observed_at":"2026-08-04T08:56:57.976209Z","submitted_at":"2024-05-30T17:53:50Z","title":"Sequence-Augmented SE(3)-Flow Matching For Conditional Protein Backbone Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20313","snapshot_observed_at":"2026-08-09T18:51:12.466663Z","title":"Sequence-augmented se (3)-flow matching for conditional protein backbone generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.466663Z"},"links":{"cited_paper":"/paper/2405.20313","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:b17c2f8d0e5c357a0254c7d251269f3ebcb261d88858fb3e585fa10205e2bd5b","observation_id":"167824db-5569-445c-aee8-3410c5d64353","resolution":{"observed_at":"2026-08-09T18:51:12.466663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16525","last_updated":"2025-06-05T23:04:39Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T16:12:17Z","title":"Fundamental Limits of Prompt Tuning Transformers: Universality, Capacity and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16525","snapshot_observed_at":"2026-08-09T18:51:12.471856Z","title":"Fundamental limits of prompt tuning transformers: Universality, capacity and efficiency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.471856Z"},"links":{"cited_paper":"/paper/2411.16525","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:783d9bb0510cdea55c721dc3b5eb36558e0a9a90c60656de2ab7fd2bc61a0ae5","observation_id":"8a4fceec-ddc9-4c56-968a-f85de8a9c26d","resolution":{"observed_at":"2026-08-09T18:51:12.471856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23126","last_updated":"2024-10-31T16:02:34Z","snapshot_observed_at":"2026-07-06T19:42:21.306600Z","submitted_at":"2024-10-30T15:35:51Z","title":"Provably Optimal Memory Capacity for Modern Hopfield Models: Transformer-Compatible Dense Associative Memories as Spherical Codes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23126","snapshot_observed_at":"2026-08-09T18:51:12.477750Z","title":"Provably optimal memory capacity for modern hopfield models: Transformer-compatible dense associative memories as spherical codes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.477750Z"},"links":{"cited_paper":"/paper/2410.23126","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:f8ceeae6ca3509d21863ae1611fb8fb7d4af507f56c52bcb1f2c559d8bdaed6b","observation_id":"01ee5a8c-1253-45b4-aea5-acdd2166511d","resolution":{"observed_at":"2026-08-09T18:51:12.477750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01079","last_updated":"2024-10-31T16:59:13Z","snapshot_observed_at":"2026-08-09T10:17:58.792913Z","submitted_at":"2024-07-01T08:34:40Z","title":"On Statistical Rates and Provably Efficient Criteria of Latent Diffusion Transformers (DiTs)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01079","snapshot_observed_at":"2026-08-09T18:51:12.483902Z","title":"On statistical rates and provably efficient criteria of latent diffusion transformers (dits)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.483902Z"},"links":{"cited_paper":"/paper/2407.01079","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:a29c679bc35eb808f8af56defeebcf24e747783953539368c291f55bd926fc99","observation_id":"65d94744-53fa-4127-87fd-69d328c1bad5","resolution":{"observed_at":"2026-08-09T18:51:12.483902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06358","last_updated":"2024-07-08T19:58:59Z","snapshot_observed_at":"2026-08-07T01:27:15.618968Z","submitted_at":"2024-07-08T19:58:59Z","title":"MiraData: A Large-Scale Video Dataset with Long Durations and Structured Captions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06358","snapshot_observed_at":"2026-08-09T18:51:12.489164Z","title":"Miradata: A large-scale video dataset with long durations and structured captions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.489164Z"},"links":{"cited_paper":"/paper/2407.06358","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:e221cbda286cdbfde84192d93208b9ac7ea747bf6e4069b30b9eb7aeed242139","observation_id":"0464e479-621f-4718-9ce0-85088e4a6c8c","resolution":{"observed_at":"2026-08-09T18:51:12.489164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09960","last_updated":"2023-09-13T18:52:02Z","snapshot_observed_at":"2026-07-06T15:17:41.309684Z","submitted_at":"2023-04-19T20:45:01Z","title":"A Latent Space Theory for Emergent Abilities in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09960","snapshot_observed_at":"2026-08-09T18:51:12.494508Z","title":"A latent space theory for emergent abilities in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.494508Z"},"links":{"cited_paper":"/paper/2304.09960","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:afb1fad5cb10e8479a939bf0db76659cdba8b9bf3f6a3dd6f0557808f6783e84","observation_id":"6e068fc1-440d-4087-ae2a-866705288b5b","resolution":{"observed_at":"2026-08-09T18:51:12.494508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:51:12.499746Z","title":"Pyramidal flow matching for efficient video generative modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.499746Z"},"links":{"citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:c959ec8048255fc279a337c718dd818156a510d1ccc4fb4579858ddec10ccffc","observation_id":"50139ca6-f736-4297-ad90-fdde1a76de00","resolution":{"observed_at":"2026-08-09T18:51:12.499746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-09T18:51:12.505546Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.505546Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:15df0d772a2fcad91c9269649fde0c19ca5da9025b2e9533b7d5c860159bc38a","observation_id":"07cbbba7-8202-424d-8335-0b1d4b1f9f0a","resolution":{"observed_at":"2026-08-09T18:51:12.505546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-09T18:51:12.520853Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.520853Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:5b00f92ffe87a20c29b93bb3fc50138511e7da0ec3db0e23cc056cdaa302e957","observation_id":"97772010-702e-4ba4-8a74-923fe8fe48f9","resolution":{"observed_at":"2026-08-09T18:51:12.520853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-09T18:51:12.526127Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.526127Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:d12c8798923143034e421bdd3354f612a2d98a11b42beb382d473d0b5c8e7bca","observation_id":"a2ae1e6b-f5b6-496b-9ed8-265d98519558","resolution":{"observed_at":"2026-08-09T18:51:12.526127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-09T18:51:12.530801Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.530801Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:1b8bbfa05ca1e7839038ead328c41328b67c1aed8667be94c603c292db43b5c9","observation_id":"8182ae29-b31f-4f92-be82-94872d95fac7","resolution":{"observed_at":"2026-08-09T18:51:12.530801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-09T18:51:12.535773Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.535773Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:7cf1fdc417ac98a33c05252623742cfc4606e99575147719cf284e92e757cbcc","observation_id":"e8b3f769-5d16-49d0-8aba-b3a01f2205fa","resolution":{"observed_at":"2026-08-09T18:51:12.535773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-09T18:51:12.540832Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.540832Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:6a1e9c491b5c94cbec5d815a9046409b39067a1df9086b6a79f26e9476fd055d","observation_id":"dae7ec00-a5ed-4832-8c2f-a01daaf32cc2","resolution":{"observed_at":"2026-08-09T18:51:12.540832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:51:12.549904Z","title":"Fine-grained attention i/o complexity: Comprehensive analysis for backward passes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.549904Z"},"links":{"citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:aec7793b4e596960bce2b6710d6ce956fcf2576c25afd09fe41afe39b89134f1","observation_id":"074447ec-2eed-4e3c-81d3-5ee5aa03e0e6","resolution":{"observed_at":"2026-08-09T18:51:12.549904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05219","last_updated":"2024-10-16T06:55:47Z","snapshot_observed_at":"2026-07-06T18:11:38.755996Z","submitted_at":"2024-05-08T17:11:38Z","title":"Conv-Basis: A New Paradigm for Efficient Attention Inference and Gradient Computation in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05219","snapshot_observed_at":"2026-08-09T18:51:12.554321Z","title":"Conv-basis: A new paradigm for efficient attention inference and gradient computation in transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.554321Z"},"links":{"cited_paper":"/paper/2405.05219","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:6824a432edf3fa919e25ddac9f923513002ede0356fb9466677ca25dca07a9d1","observation_id":"5919c294-831d-40be-ad7c-8dcd6bd7a5ce","resolution":{"observed_at":"2026-08-09T18:51:12.554321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11261","last_updated":"2025-02-26T18:44:29Z","snapshot_observed_at":"2026-07-06T19:33:34.819837Z","submitted_at":"2024-10-15T04:35:56Z","title":"Beyond Linear Approximations: A Novel Pruning Approach for Attention Matrix","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11261","snapshot_observed_at":"2026-08-09T18:51:12.558692Z","title":"Beyond linear approximations: A novel pruning approach for attention matrix","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.558692Z"},"links":{"cited_paper":"/paper/2410.11261","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:655ba975350312dc83db31cb223fb5bab46c5ee1cf9a37e5854b6f582154cbad","observation_id":"6a8dba0f-26dc-47ee-81fe-0e856ea6a27b","resolution":{"observed_at":"2026-08-09T18:51:12.558692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12151","last_updated":"2024-10-18T03:36:03Z","snapshot_observed_at":"2026-08-09T17:26:15.959147Z","submitted_at":"2024-08-22T06:40:32Z","title":"A Tighter Complexity Analysis of SparseGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12151","snapshot_observed_at":"2026-08-09T18:51:12.563693Z","title":"A tighter complexity analysis of sparsegpt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.563693Z"},"links":{"cited_paper":"/paper/2408.12151","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:9c0e7046721c88bf0c1eaf18ca57788ddf3870e1379dcdad9ac212f3e7425fe5","observation_id":"ee11c8bf-1a34-472e-8003-a5d64362549c","resolution":{"observed_at":"2026-08-09T18:51:12.563693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09375","last_updated":"2025-02-20T10:24:53Z","snapshot_observed_at":"2026-08-09T18:03:24.702047Z","submitted_at":"2024-10-12T05:54:17Z","title":"Looped ReLU MLPs May Be All You Need as Practical Programmable Computers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09375","snapshot_observed_at":"2026-08-09T18:51:12.568700Z","title":"Looped relu mlps may be all you need as practical programmable computers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.568700Z"},"links":{"cited_paper":"/paper/2410.09375","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:d7f4aa071a58686dc3f56a77c899c3c4e66a0802909303fbe5813dab78bd0189","observation_id":"4b20c657-646f-4e98-b58d-a11c647ed748","resolution":{"observed_at":"2026-08-09T18:51:12.568700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13233","last_updated":"2024-10-15T04:11:19Z","snapshot_observed_at":"2026-07-06T19:05:14.227812Z","submitted_at":"2024-08-23T17:16:43Z","title":"Multi-Layer Transformers Gradient Can be Approximated in Almost Linear Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13233","snapshot_observed_at":"2026-08-09T18:51:12.574010Z","title":"Multi-layer transformers gradient can be approximated in almost linear time","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.574010Z"},"links":{"cited_paper":"/paper/2408.13233","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:338858ef122ea6bbc5cae81a6045f4424a3d45179888b3fbf24186cfc843aacc","observation_id":"9a1db7f4-7127-4770-819a-455185e40407","resolution":{"observed_at":"2026-08-09T18:51:12.574010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:51:12.579116Z","title":"Tensor attention train- ing: Provably efficient learning of higher-order transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.579116Z"},"links":{"citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:da8e96b9bfd71116a224915f83c19fce625b920a34628aaf1fee0bbec6ea2c56","observation_id":"94c4d354-adf6-4c95-93f9-a0f09fa81a13","resolution":{"observed_at":"2026-08-09T18:51:12.579116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13624","last_updated":"2023-11-22T09:58:01Z","snapshot_observed_at":"2026-07-06T16:51:15.252642Z","submitted_at":"2023-11-22T09:58:01Z","title":"A Theoretical Insight into Attack and Defense of Gradient Leakage in Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13624","snapshot_observed_at":"2026-08-09T18:51:12.584992Z","title":"A theoretical insight into attack and defense of gradient leakage in transformer.arXiv preprint arXiv:2311.13624,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.584992Z"},"links":{"cited_paper":"/paper/2311.13624","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:ab8029b500b4cc9b64eb6ed62549d38daf069e633394295fe17c43c6acee6a5a","observation_id":"b5716e0b-f2e2-4132-b004-b96a53659e80","resolution":{"observed_at":"2026-08-09T18:51:12.584992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04722","last_updated":"2024-01-09T18:53:20Z","snapshot_observed_at":"2026-07-06T17:13:25.341853Z","submitted_at":"2024-01-09T18:53:20Z","title":"U-Mamba: Enhancing Long-range Dependency for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04722","snapshot_observed_at":"2026-08-09T18:51:12.591030Z","title":"U-mamba: Enhancing long-range dependency for biomedical image segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.591030Z"},"links":{"cited_paper":"/paper/2401.04722","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:ff8145097adc4f335c3259f64d6e3c36db3ce4135d61c78ebdcc469248a5ba41","observation_id":"7d5a548f-d140-4bce-9b8a-a9c3eadfa46c","resolution":{"observed_at":"2026-08-09T18:51:12.591030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02371","last_updated":"2025-02-13T10:13:24Z","snapshot_observed_at":"2026-08-07T10:03:56.902190Z","submitted_at":"2024-07-02T15:40:29Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02371","snapshot_observed_at":"2026-08-09T18:51:12.597034Z","title":"Openvid-1m: A large-scale high-quality dataset for text-to-video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.597034Z"},"links":{"cited_paper":"/paper/2407.02371","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:6c81828eb2151b17d4454015dcf5d940308fd52c2dafd5f36b23b8afa03c5232","observation_id":"14198139-1258-479d-9114-18ec5d1cc5c1","resolution":{"observed_at":"2026-08-09T18:51:12.597034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-09T03:17:30.671491Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-09T18:51:12.602618Z","title":"Movie gen: A cast of media foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.602618Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:1fc6aa3e42d82891e5a123ff42d75dbbb5d1d86572bd5d050e97584af19eacfe","observation_id":"0950bc12-d5bc-4a4f-978d-90274c9b11bc","resolution":{"observed_at":"2026-08-09T18:51:12.602618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02491","last_updated":"2024-11-08T11:56:04Z","snapshot_observed_at":"2026-08-08T14:24:36.827111Z","submitted_at":"2024-02-04T13:37:21Z","title":"VM-UNet: Vision Mamba UNet for Medical Image Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02491","snapshot_observed_at":"2026-08-09T18:51:12.608172Z","title":"Vm-unet: Vision mamba unet for medical image segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.608172Z"},"links":{"cited_paper":"/paper/2402.02491","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:e55f8b94057508ac7381ab58b5e11d77015d3e63aa63975cdb7f00b0b89eefb2","observation_id":"aad184f0-85ae-4566-80c1-08c0d1a69e0b","resolution":{"observed_at":"2026-08-09T18:51:12.608172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04620","last_updated":"2025-08-31T18:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-05T16:23:20Z","title":"Learning to (Learn at Test Time): RNNs with Expressive Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04620","snapshot_observed_at":"2026-08-09T18:51:12.613250Z","title":"Learning to (learn at test time): Rnns with expressive hidden states","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.613250Z"},"links":{"cited_paper":"/paper/2407.04620","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:9ea8a7e0177a9603d8e8e31c2711c082bf349c6d4c9dc070c0c7e7bdd05c4998","observation_id":"944061cb-4734-4739-bc5b-6f9587321694","resolution":{"observed_at":"2026-08-09T18:51:12.613250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-09T18:51:12.618117Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.618117Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:ce4afd27ab94c90de1f7c712a4a5c41189dc25b8f6526a81ff16692fe9075fdc","observation_id":"570c1f67-3bd3-405d-ad24-8c55cfba5333","resolution":{"observed_at":"2026-08-09T18:51:12.618117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-08-08T15:17:09.772737Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-09T18:51:12.623362Z","title":"Discov- ering the gems in early layers: Accelerating long-context llms with 1000x input token reduction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.623362Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:528e77f8ace0234fae2f9b7645022cfef094ddf97248ce3a77fdb3bd6178b7a8","observation_id":"3cdd9fd9-efc2-4b49-9c86-9d50509efbad","resolution":{"observed_at":"2026-08-09T18:51:12.623362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-09T18:51:12.628590Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.628590Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:399cd74e9b185f811631a1e19905304d518dcac4fde1156160a673e2f0950c0e","observation_id":"d40c4db2-dd58-4c9c-bd51-e10faf21fbc9","resolution":{"observed_at":"2026-08-09T18:51:12.628590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-09T18:51:12.633389Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.633389Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:c693d6634ca05b4b919a87608b769414b0a8f0428903b4bb6b9fb01f98b19299","observation_id":"f85aaa3f-a2c4-4eff-977f-01ce469039eb","resolution":{"observed_at":"2026-08-09T18:51:12.633389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-09T18:51:12.638582Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.638582Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:614a81bf658c00f83e9897bbb0751a8c37612a99470e4b31271b78db5d3c8115","observation_id":"5e4c3a22-d409-4299-b950-1b010bad3eac","resolution":{"observed_at":"2026-08-09T18:51:12.638582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.11775","last_updated":"2019-11-11T21:51:11Z","snapshot_observed_at":"2026-08-07T12:23:46.977643Z","submitted_at":"2019-08-30T15:05:02Z","title":"Transformer Dissection: A Unified Understanding of Transformer's Attention via the Lens of Kernel","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.11775","snapshot_observed_at":"2026-08-09T18:51:12.643324Z","title":"Transformer dissection: a unified understanding of transformer’s attention via the lens of kernel","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.643324Z"},"links":{"cited_paper":"/paper/1908.11775","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:63ef1ee9cd75e62358d42d477ab40661883dd40c626f3e8c1a4435f0140dc329","observation_id":"aba66129-1961-4240-88c2-3e8f6932a5a8","resolution":{"observed_at":"2026-08-09T18:51:12.643324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00482","last_updated":"2024-03-11T14:27:48Z","snapshot_observed_at":"2026-07-06T14:47:04.817434Z","submitted_at":"2023-02-01T14:47:17Z","title":"Improving and generalizing flow-based generative models with minibatch optimal transport","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00482","snapshot_observed_at":"2026-08-09T18:51:12.648022Z","title":"Improving and generalizing flow-based generative models with minibatch optimal transport","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.648022Z"},"links":{"cited_paper":"/paper/2302.00482","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:c3954af66fe752dbfb0d3433f7460e17633e82c76db9911791a22d4a8de675e5","observation_id":"15fcf0b0-6f73-479f-9dc0-e1699dc9b9e7","resolution":{"observed_at":"2026-08-09T18:51:12.648022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02905","last_updated":"2024-06-10T17:59:07Z","snapshot_observed_at":"2026-07-06T17:55:16.774337Z","submitted_at":"2024-04-03T17:59:53Z","title":"Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02905","snapshot_observed_at":"2026-08-09T18:51:12.652631Z","title":"Visual autore- gressive modeling: Scalable image generation via next-scale prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.652631Z"},"links":{"cited_paper":"/paper/2404.02905","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:79165c98521519755d3e434a95ae6c3533e7b5555190a5a2f1b5cbcc2985f998","observation_id":"696a1ae1-0d7b-4aaa-8bd2-763aabcea349","resolution":{"observed_at":"2026-08-09T18:51:12.652631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15821","last_updated":"2023-12-25T22:24:49Z","snapshot_observed_at":"2026-08-05T03:40:24.447729Z","submitted_at":"2023-12-25T22:24:49Z","title":"Audiobox: Unified Audio Generation with Natural Language Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15821","snapshot_observed_at":"2026-08-09T18:51:12.656812Z","title":"Audiobox: Unified audio generation with natural language prompts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.656812Z"},"links":{"cited_paper":"/paper/2312.15821","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:0c71a7c1103565793bc4e1592d8801d9aeab4be4b047c9f8267ea1cfef1dab08","observation_id":"2415d845-f9a1-4ae3-bb0b-742007a90c25","resolution":{"observed_at":"2026-08-09T18:51:12.656812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-09T18:51:12.661385Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.661385Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:ca9336b6385cb5d25eeb5c02eabc43550090402733491ff1defc2756cc0bdfd3","observation_id":"7724a64a-a882-49d0-aab7-7ecb0a37dd25","resolution":{"observed_at":"2026-08-09T18:51:12.661385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-09T18:51:12.672171Z","title":"Internvid: A large-scale video-text dataset for multimodal understanding and generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.672171Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:ba9f69b463f8ee6abe59f1968fdb62d140aaa628fab73ea60387ee16171c5ea0","observation_id":"9559f07b-405e-443b-a987-5ea42ef568f3","resolution":{"observed_at":"2026-08-09T18:51:12.672171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16549","last_updated":"2025-04-12T02:49:32Z","snapshot_observed_at":"2026-08-03T22:17:09.271827Z","submitted_at":"2024-11-25T16:32:11Z","title":"In-Context Deep Learning via Transformer Models","version":2},"cited_work":{"arxiv_id":"2411.16549","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16549","snapshot_observed_at":"2026-08-09T18:51:12.876717Z","title":"In-Context Deep Learning via Transformer Models","venue":"cs.LG","work_id":"55ee2fdc-e2f9-47d9-8023-231e86ad9e6d","year":2024},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.678153Z"},"links":{"cited_paper":"/paper/2411.16549","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:cb4dfa36b7149bb245f8ce85a36bfcfc762308bd44a40b60ad93762368f87690","observation_id":"9e403c17-ca42-45d1-85b9-0af2cc98bac4","resolution":{"observed_at":"2026-08-09T18:51:12.884550Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-09T18:51:12.683117Z","title":"Emergent abilities of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.683117Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:a431cb027137897f1bf0ed775ad402043a4b593fd8dc9a8303c5c5d8cb145211","observation_id":"2e13c0c8-f9f0-4e44-9d19-7d680d48e64d","resolution":{"observed_at":"2026-08-09T18:51:12.683117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:51:14.493022Z","title":"Do large language models have compositional ability? an investigation into limitations and scalability","venue":null,"work_id":"eedbd31a-6f33-405e-89fe-e1a474a699d6","year":2024},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.688603Z"},"links":{"citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:f71774d16c21320d3a44740e0b0eeb10dd07296f00805ddde961c672df1ba04d","observation_id":"769e5247-9c64-4803-90c9-57c4838e8eae","resolution":{"observed_at":"2026-08-09T18:51:14.499247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15017","last_updated":"2024-02-22T23:29:42Z","snapshot_observed_at":"2026-08-02T15:10:58.175549Z","submitted_at":"2024-02-22T23:29:42Z","title":"Towards Few-Shot Adaptation of Foundation Models via Multitask Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15017","snapshot_observed_at":"2026-08-09T18:51:12.694813Z","title":"Towards few-shot adaptation of foundation models via multitask finetuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.694813Z"},"links":{"cited_paper":"/paper/2402.15017","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:322652ad4ee6f0b54adffd14047b4b753780589d651f79b7107a0c595ce64027","observation_id":"33f60b34-2448-47ac-9f04-f0f22cc17c7b","resolution":{"observed_at":"2026-08-09T18:51:12.694813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10077","last_updated":"2020-02-25T03:12:57Z","snapshot_observed_at":"2026-07-06T08:46:09.705605Z","submitted_at":"2019-12-20T19:49:32Z","title":"Are Transformers universal approximators of sequence-to-sequence functions?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10077","snapshot_observed_at":"2026-08-09T18:51:12.699988Z","title":"Are transformers universal approximators of sequence-to-sequence functions? arXiv preprint arXiv:1912.10077 ,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.699988Z"},"links":{"cited_paper":"/paper/1912.10077","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:d15b3c1e8ec13a3733f074c650af8a1140b2a2027ce946b23ad8d71b7439bd62","observation_id":"88569954-70d3-4fc7-8e03-801cf35823aa","resolution":{"observed_at":"2026-08-09T18:51:12.699988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-09T18:51:12.705952Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.705952Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:898cf2c83cc696d1b0b8125b80e4c68b84b26d9db6c7dffa1c19395ef505047c","observation_id":"8f7620f5-a210-4b4a-867d-49bb1f9cc6dc","resolution":{"observed_at":"2026-08-09T18:51:12.705952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-09T18:51:12.711072Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.711072Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:e02f2157b02f0c8c15203e8a33d817267683bf7492d99cabcb42acbb29e7e386","observation_id":"5b5795f6-c5c0-4ac9-bdab-d452d09a7998","resolution":{"observed_at":"2026-08-09T18:51:12.711072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11018","snapshot_observed_at":"2026-08-09T18:51:12.716760Z","title":"Magicvideo: Efficient video generation with latent diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.716760Z"},"links":{"cited_paper":"/paper/2211.11018","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:7f0995ec412061ca3b5fac4322627aa3b76356ab5037733bf8e23b6300a4f8e3","observation_id":"b3ecc15b-a7b0-4eee-a528-b1c88a9fc62a","resolution":{"observed_at":"2026-08-09T18:51:12.716760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06061","last_updated":"2025-02-28T20:36:37Z","snapshot_observed_at":"2026-08-04T00:16:33.227284Z","submitted_at":"2024-12-08T20:29:06Z","title":"Curse of Attention: A Kernel-Based Perspective for Why Transformers Fail to Generalize on Time Series Forecasting and Beyond","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06061","snapshot_observed_at":"2026-08-09T18:51:12.515735Z","title":"Curse of attention: A kernel-based perspective for why transformers fail to generalize on time series forecasting and beyond","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.515735Z"},"links":{"cited_paper":"/paper/2412.06061","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:bbcbea95208acd14219248ccee4e63609dbf0f5942f014b67712ff567b90f72d","observation_id":"cbc01840-9ca6-42bb-a828-392175214f38","resolution":{"observed_at":"2026-08-09T18:51:12.515735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03827","last_updated":"2024-11-10T19:25:40Z","snapshot_observed_at":"2026-07-06T17:55:53.304768Z","submitted_at":"2024-04-04T23:05:30Z","title":"Uniform Memory Retrieval with Larger Capacity for Modern Hopfield Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03827","snapshot_observed_at":"2026-08-09T18:51:12.666613Z","title":"Uniform mem- ory retrieval with larger capacity for modern hopfield models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.666613Z"},"links":{"cited_paper":"/paper/2404.03827","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:9279be2b4883c49962ddd171ba9ed9c92299d033d725460c0c6f2eb12c135554","observation_id":"5e0dea50-d831-40cf-bb09-587e5e236dd4","resolution":{"observed_at":"2026-08-09T18:51:12.666613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-08-09T15:04:43.257424Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-08-09T18:51:12.310707Z","title":"Latent-shift: Latent diffusion with temporal shift for efficient text-to-video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.310707Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:6d56e8e72407a9f6e38a5b70b02be6f9d80f253391b69acbd477f337f9692669","observation_id":"17e836da-35d6-4cb3-a5a7-12d589985c06","resolution":{"observed_at":"2026-08-09T18:51:12.310707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-09T18:51:12.330646Z","title":"ediff-i: Text- to-image diffusion models with an ensemble of expert denoisers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.330646Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:4e0674102fe010babf034b3c93d8fc53905f3bfa59efd9bc353619393380a605","observation_id":"545203ea-5b61-4c9c-bb9d-7c1da1fc867e","resolution":{"observed_at":"2026-08-09T18:51:12.330646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09469","last_updated":"2025-03-09T07:14:46Z","snapshot_observed_at":"2026-08-01T16:25:27.501679Z","submitted_at":"2024-02-12T05:52:06Z","title":"Fourier Circuits in Neural Networks and Transformers: A Case Study of Modular Arithmetic with Multiple Inputs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09469","snapshot_observed_at":"2026-08-09T18:51:12.545706Z","title":"Fourier circuits in neural networks: Unlocking the potential of large language models in mathematical reasoning and modular arithmetic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.545706Z"},"links":{"cited_paper":"/paper/2402.09469","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:a3a169761e243c5a270002c02b81895c9a89814460eb095d6f22f90ee061af03","observation_id":"fb542a59-e055-4bf5-b0c5-a5da46059bf9","resolution":{"observed_at":"2026-08-09T18:51:12.545706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13673","last_updated":"2025-05-19T11:12:27Z","snapshot_observed_at":"2026-08-08T23:24:12.994765Z","submitted_at":"2023-05-23T04:28:16Z","title":"Physics of Language Models: Part 1, Learning Hierarchical Language Structures","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13673","snapshot_observed_at":"2026-08-09T18:51:12.304755Z","title":"Physics of language models: Part 1, context-free grammar","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.304755Z"},"links":{"cited_paper":"/paper/2305.13673","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:785bcd842c5500c8a811b61c65bd9d1e6614350ed5ee2411ceeb26bbf7ccff83","observation_id":"e3ca042b-d2f5-4015-b096-c463efc476b5","resolution":{"observed_at":"2026-08-09T18:51:12.304755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08675","last_updated":"2016-09-27T21:21:49Z","snapshot_observed_at":"2026-08-06T22:24:48.588621Z","submitted_at":"2016-09-27T21:21:49Z","title":"YouTube-8M: A Large-Scale Video Classification Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08675","snapshot_observed_at":"2026-08-09T18:51:12.288213Z","title":"Youtube-8m: A large-scale video classification benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.288213Z"},"links":{"cited_paper":"/paper/1609.08675","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:c0578370b60c3df0fde524fcf086c5ae9359b0a8bbd621171ab984a8d35373a2","observation_id":"9b765ee8-2348-45a6-897b-ce08226d70d8","resolution":{"observed_at":"2026-08-09T18:51:12.288213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04497","last_updated":"2024-02-07T00:45:31Z","snapshot_observed_at":"2026-08-09T22:39:59.118786Z","submitted_at":"2024-02-07T00:45:31Z","title":"The Fine-Grained Complexity of Gradient Computation for Training Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04497","snapshot_observed_at":"2026-08-09T18:51:12.294022Z","title":"The fine-grained complexity of gradient computation for training large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.294022Z"},"links":{"cited_paper":"/paper/2402.04497","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:7549cf346701b7da68abd34fa528c085bfe666c8c1134aac58083dde3e45e5a9","observation_id":"f4362ce4-9f9f-4884-9c5c-e09568f6ebf7","resolution":{"observed_at":"2026-08-09T18:51:12.294022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T18:42:02.330645Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":75,"verified_exact":5,"verified_fuzzy":1},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 3 inbound Pith citation observations for arXiv:2502.00500."}