{"as_of":"2026-08-10T00:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:889ef7e29343971bbe151bcb4d77c8f0eb01f7fb93486d8938763e1562865b1f","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:41:31.165907Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T00:56:18.867382Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:07:55.884435Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2506.07280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07280","snapshot_observed_at":"2026-07-03T10:07:55.884435Z","title":"From generation to generalization: Emergent few-shot learning in video diffusion models","venue":null,"work_id":"3439d19e-44bb-4d6a-9260-36135e5cb358","year":2025},"citing_paper":{"arxiv_id":"2509.20328","last_updated":"2025-09-29T20:44:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-24T17:17:27Z","title":"Video models are zero-shot learners and reasoners","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T02:16:45.554252Z"},"links":{"cited_paper":"/paper/2506.07280","citing_paper":"/paper/2509.20328"},"observation_digest":"sha256:e8a4c26255c9b79d2f6a5bb48830e81ab2ad8c8fb4361501847f8a97fdcedd16","observation_id":"88ce5459-4164-4a44-985c-3275a995d336","resolution":{"observed_at":"2026-05-14T02:16:45.793856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2506.07280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07280","snapshot_observed_at":"2026-07-03T10:07:55.884435Z","title":"From generation to generalization: Emergent few-shot learning in video diffusion models","venue":null,"work_id":"3439d19e-44bb-4d6a-9260-36135e5cb358","year":2025},"citing_paper":{"arxiv_id":"2605.06487","last_updated":"2026-05-07T16:08:22Z","snapshot_observed_at":"2026-08-05T13:25:41.333282Z","submitted_at":"2026-05-07T16:08:22Z","title":"3D MRI Image Pretraining via Controllable 2D Slice Navigation Task","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T13:11:40.290900Z"},"links":{"cited_paper":"/paper/2506.07280","citing_paper":"/paper/2605.06487"},"observation_digest":"sha256:850f705f9b72f4386b39433748c5adbb28243ec879397951664dc51baf720df6","observation_id":"7cf32b5c-478a-4a61-b240-98418763a06a","resolution":{"observed_at":"2026-05-11T18:56:07.772282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2506.07280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07280","snapshot_observed_at":"2026-07-03T10:07:55.884435Z","title":"From generation to generalization: Emergent few-shot learning in video diffusion models","venue":null,"work_id":"3439d19e-44bb-4d6a-9260-36135e5cb358","year":2025},"citing_paper":{"arxiv_id":"2606.12072","last_updated":"2026-06-10T13:40:19Z","snapshot_observed_at":"2026-08-02T21:32:50.432496Z","submitted_at":"2026-06-10T13:40:19Z","title":"World Model Self-Distillation: Training World Models to Solve General Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T10:16:35.511426Z"},"links":{"cited_paper":"/paper/2506.07280","citing_paper":"/paper/2606.12072"},"observation_digest":"sha256:771b07295a8d0f63a1b947423ab25f96a35553f579f529c41e635956c7de01e9","observation_id":"3e64fb90-010c-41ad-a446-94516e9c90d5","resolution":{"observed_at":"2026-07-03T10:07:55.886161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07280","snapshot_observed_at":"2026-07-13T00:56:18.867382Z","title":"arXiv preprint arXiv:2506.07280 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09024","last_updated":"2026-07-10T01:09:06Z","snapshot_observed_at":"2026-08-03T20:31:54.523048Z","submitted_at":"2026-07-10T01:09:06Z","title":"Video Generation Models are General-Purpose Vision Learners","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T00:56:18.867382Z"},"links":{"cited_paper":"/paper/2506.07280","citing_paper":"/paper/2607.09024"},"observation_digest":"sha256:20bbcb8548be2ae16266fde88cc9da4b7ed80ccdc99e6d0da53222bc0e150ece","observation_id":"46f2b52c-3de1-473c-9ffb-ab0dfdc56485","resolution":{"observed_at":"2026-07-13T00:56:18.867382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07280/citation-record","integrity":"/paper/2506.07280/integrity","json":"/paper/2506.07280/citation-record.json","paper":"/paper/2506.07280"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.07279","last_updated":"2025-03-25T03:36:21Z","snapshot_observed_at":"2026-08-05T02:24:21.044775Z","submitted_at":"2024-11-11T18:59:45Z","title":"The Surprising Effectiveness of Test-Time Training for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07279","snapshot_observed_at":"2026-08-07T05:41:30.938318Z","title":"The surprising effectiveness of test-time training for few-shot learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.938318Z"},"links":{"cited_paper":"/paper/2411.07279","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:5197916de06fb9a520784fe597c3044f793684d5b0ae40299b08f5a5bb15162d","observation_id":"0348a0c4-89a8-4461-b629-bd6a23b83746","resolution":{"observed_at":"2026-08-07T05:41:30.938318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:30.943273Z","title":"Sequential modeling enables scalable learning for large vision models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.943273Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:6740008e1c11cb69da1ba6805f56d7550b0821fc33b513777c84d93e132d2814","observation_id":"6511dde1-026f-43da-a121-bdb3bbbd27a6","resolution":{"observed_at":"2026-08-07T05:41:30.943273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.00647","last_updated":"2022-09-01T17:59:33Z","snapshot_observed_at":"2026-08-09T03:13:10.006481Z","submitted_at":"2022-09-01T17:59:33Z","title":"Visual Prompting via Image Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.00647","snapshot_observed_at":"2026-08-07T05:41:30.946687Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.946687Z"},"links":{"cited_paper":"/paper/2209.00647","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:0305b33f827c62b403bd6c973c2d91f662447842a12f2fe1c5665ff15e16f84c","observation_id":"f2952e48-e6eb-479a-92d9-58e4bf31d0f7","resolution":{"observed_at":"2026-08-07T05:41:30.946687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.873824Z","title":"How I got a record 53.6% on ARC-AGI-Pub using Sonnet 3.5.1","venue":null,"work_id":"819ba7f8-7531-4692-ae2c-9c7b9d785167","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.950556Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:27844dc1cc7cd4f7b1b83870778527863193c5884acf0435b6527c2280a25ae2","observation_id":"fb8220b0-4864-4f24-b987-69929aa5ffc1","resolution":{"observed_at":"2026-08-07T05:41:31.877379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T05:41:30.953970Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.CoRR, abs/2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.953970Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:3a4cf3373a9c207a796f7ec0ed58903b7e6221de6889770e0f2d5e85bb7ac0af","observation_id":"a7ccd42a-13c9-4c17-b516-d26b57255dcc","resolution":{"observed_at":"2026-08-07T05:41:30.953970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-07-06T08:34:41.399203Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-08-07T05:41:30.957711Z","title":"On the measure of intelligence.arXiv preprint arXiv:1911.01547, 2019","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.957711Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:078263271377bf9683a8bb2e67cd917442e0a8ec5a568651e0dc239f607686fd","observation_id":"e6a0b3b6-99d4-4692-af26-24af1f14a934","resolution":{"observed_at":"2026-08-07T05:41:30.957711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04604","last_updated":"2025-01-08T05:24:50Z","snapshot_observed_at":"2026-08-04T14:31:04.378756Z","submitted_at":"2024-12-05T20:40:28Z","title":"ARC Prize 2024: Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04604","snapshot_observed_at":"2026-08-07T05:41:30.961599Z","title":"Arc prize 2024: Technical report.arXiv preprint arXiv:2412.04604, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.961599Z"},"links":{"cited_paper":"/paper/2412.04604","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:23cb12696b2db4de31b738fa7ef603a2a2b7d96c5394a21ae0a16cb24f17fbc3","observation_id":"e221e75a-56e9-4563-9461-5552967a257e","resolution":{"observed_at":"2026-08-07T05:41:30.961599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05468","last_updated":"2025-04-07T19:58:25Z","snapshot_observed_at":"2026-08-07T16:07:48.235247Z","submitted_at":"2025-04-07T19:58:25Z","title":"Studying Image Diffusion Features for Zero-Shot Video Object Segmentation","version":1},"cited_work":{"arxiv_id":"2504.05468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.05468","snapshot_observed_at":"2026-08-07T05:41:31.442131Z","title":"Studying Image Diffusion Features for Zero-Shot Video Object Segmentation","venue":"cs.CV","work_id":"3c40e829-7bf4-4d77-b75b-e1443840f7bd","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.965067Z"},"links":{"cited_paper":"/paper/2504.05468","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:f20f764d6d36a55569a0a21a34ce7d6aad956a81567213e09116585312a6ed6e","observation_id":"a12b027f-b994-496d-b99f-78c593889d8b","resolution":{"observed_at":"2026-08-07T05:41:31.446083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.863962Z","title":"A survey on in-context learning","venue":null,"work_id":"2af92452-ecf4-4094-a7ad-8737727a2bde","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.968855Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:04fb334ca15758c8d6a32c6edf75f8084f4aeebe36d75e28aa42ac95c36db2d0","observation_id":"41106a4a-3377-444f-914b-f7487777f1f9","resolution":{"observed_at":"2026-08-07T05:41:31.867256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-09T03:17:30.671491Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-07T05:41:30.972332Z","title":"Movie gen: A cast of media foundation models.CoRR, abs/2410.13720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.972332Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:bcf25d130fcb0cbe60c85030d78b1379e6eedc1623c66ee0c84bd219ce6ce796","observation_id":"a3fe0e59-0e33-44af-aae3-f965ae67eb2d","resolution":{"observed_at":"2026-08-07T05:41:30.972332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T05:41:30.975917Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.CoRR, abs/2501.12948, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.975917Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:53cf5c047bb23326b0896761ce44f2e4d320c4faa8d141567628fe5a1cbba3c6","observation_id":"04720d12-ca3c-42f6-995d-695c57328949","resolution":{"observed_at":"2026-08-07T05:41:30.975917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T05:41:30.979426Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.CoRR, abs/2403.05530, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.979426Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:2232449fc1841ccea133dd1b3e6df9411b278a9bc2effb09402ab8c4dae08e48","observation_id":"dd993c70-04d6-439f-a489-cedf0b72ca68","resolution":{"observed_at":"2026-08-07T05:41:30.979426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-07T05:41:30.982950Z","title":"Cosmos world foundation model platform for physical ai.CoRR, abs/2501.03575, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.982950Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:bf923cf17ead78177e89ebde3cd1368cafcf52190270d4746bac0a4ef6f89c86","observation_id":"1194eee9-5f64-4a62-b271-043a3751e3ce","resolution":{"observed_at":"2026-08-07T05:41:30.982950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02399","last_updated":"2022-10-05T17:18:28Z","snapshot_observed_at":"2026-08-04T09:09:48.463217Z","submitted_at":"2022-10-05T17:18:28Z","title":"Phenaki: Variable Length Video Generation From Open Domain Textual Description","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02399","snapshot_observed_at":"2026-08-07T05:41:30.986777Z","title":"Phenaki: Variable length video generation from open domain textual description.CoRR, abs/2210.02399, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.986777Z"},"links":{"cited_paper":"/paper/2210.02399","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:280c3df004e341818d479ce33de09608cb63eb680d67c526ffc0c731ca16977c","observation_id":"0481c6eb-1835-421b-8778-291367bb911b","resolution":{"observed_at":"2026-08-07T05:41:30.986777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T05:41:30.990512Z","title":"Brown et al","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.990512Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:94af786fab6f906b59c55bec734bb965377b2d9e1ac8aba04e4d0e99843ad7ca","observation_id":"cff8b1f4-dd36-486e-afd6-a90a77f5da0b","resolution":{"observed_at":"2026-08-07T05:41:30.990512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-07T05:41:30.993883Z","title":"Ltx-video: Realtime video latent diffusion.CoRR, abs/2501.00103, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.993883Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:ff1f863e8ba281e6459c672884f3f3a8d18e9ca0c325e2c6bda201db2ce48f43","observation_id":"8fb64557-a41c-4537-9f74-e5d8777e0df9","resolution":{"observed_at":"2026-08-07T05:41:30.993883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T05:41:30.997415Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:30.997415Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:0a906c567217973869291d0284a7dfa3c52b850fa53873a99b652a3243440239","observation_id":"66ca8194-ef71-4773-bd79-63cb2d32e5ad","resolution":{"observed_at":"2026-08-07T05:41:30.997415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.854118Z","title":null,"venue":null,"work_id":"d53981db-d25a-4090-98cc-629c8c076a0f","year":1989},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.001301Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:d4edd95ae3a837fe9b8c271d622250c226737ef0507e59394a4ef9d9e71b9881","observation_id":"41ab125b-d277-4229-8703-468c4b842815","resolution":{"observed_at":"2026-08-07T05:41:31.857522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.004496Z","title":"The free-energy principle: a unified brain theory?Nature reviews neuroscience, 11(2):127–138, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.004496Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:3369a579e4b5a33db687f14793bc23bce798442d120814345b5843a6dc9907c0","observation_id":"c66b55ef-4c3f-45f6-99b2-0ba148981f3a","resolution":{"observed_at":"2026-08-07T05:41:31.004496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.007829Z","title":"Instructdiffusion: A generalist modeling interface for vision tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.007829Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:b78ec5c801ec52a7758ac357c28f7eddc253fbf8b4df93628aeb595d73885a76","observation_id":"67829754-744a-4d5b-9ea8-e744880cbd0e","resolution":{"observed_at":"2026-08-07T05:41:31.007829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15463","last_updated":"2022-05-30T23:20:33Z","snapshot_observed_at":"2026-07-31T16:40:04.719200Z","submitted_at":"2022-05-30T23:20:33Z","title":"Few-Shot Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15463","snapshot_observed_at":"2026-08-07T05:41:31.011153Z","title":"Few-shot diffusion models.CoRR, abs/2205.15463, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.011153Z"},"links":{"cited_paper":"/paper/2205.15463","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:52a7596d86fe9fd158d6a65708ab50a5f226c86bceb397b3b7d190d2ed14cad8","observation_id":"9fe6de16-f95a-4d18-b878-08bc7cc51ae1","resolution":{"observed_at":"2026-08-07T05:41:31.011153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.731734Z","title":null,"venue":null,"work_id":"3aae1735-42e1-48e7-80e6-c922f22c4f7f","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.014756Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:237285d7602e87a23004b8e189d992f5353bd665a539b4c03186710ab6833488","observation_id":"a9968bef-1eca-470f-b0ac-684b9c07a69e","resolution":{"observed_at":"2026-08-07T05:41:31.734798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.721926Z","title":"The llama 3 herd of models.arXiv e-prints, pages arXiv–2407, 2024","venue":null,"work_id":"f5f4d483-db31-4ff9-9730-eb1869174829","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.017893Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:931282ffab9d09d3a256b38d549925fd6a58dff4b8602505f8057b856faf9909","observation_id":"fac107e4-a1ec-4815-a42a-e723c5a92d76","resolution":{"observed_at":"2026-08-07T05:41:31.725623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.711025Z","title":"Gem: A generalizable ego-vision mul- timodal world model for fine-grained ego-motion, object dynamics, and scene composition control.CVPR, 2025","venue":null,"work_id":"97951e34-8f40-440a-a298-1adbb895fa69","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.021049Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:c14fd3c1945c7f40afabb92aa68e3a4706eef45a7d08f404a889719d36c049f0","observation_id":"d20e1074-9e58-42ed-9d6b-bf2282e772a6","resolution":{"observed_at":"2026-08-07T05:41:31.715712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04320","last_updated":"2025-07-01T20:00:27Z","snapshot_observed_at":"2026-08-09T05:21:16.525940Z","submitted_at":"2025-02-06T18:59:00Z","title":"ConceptAttention: Diffusion Transformers Learn Highly Interpretable Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04320","snapshot_observed_at":"2026-08-07T05:41:31.024475Z","title":"Conceptattention: Diffusion transformers learn highly interpretable features.CoRR, abs/2502.04320, February 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.024475Z"},"links":{"cited_paper":"/paper/2502.04320","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:cf4a4b6bd263554cc158d5af083a3ff39535830f9753f9aec1d6262dd62adbe6","observation_id":"e5d4b584-b4d5-4ec3-9d37-32aeef6aa1bb","resolution":{"observed_at":"2026-08-07T05:41:31.024475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.028208Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.028208Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:b98073deb4d191e0b0636c9f6d110df1adc371968d4708c86690aab444d4162c","observation_id":"24c97894-2354-4203-8680-26b925224050","resolution":{"observed_at":"2026-08-07T05:41:31.028208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-07T05:41:31.031550Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers.CoRR, abs/2205.15868, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.031550Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:1be12aaeb052c40a4ccc4bf4c62c3f71ab04451a893965536814018c53c6b4f3","observation_id":"1b2a258c-a87d-46cf-a217-23cba86ef8d9","resolution":{"observed_at":"2026-08-07T05:41:31.031550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.035012Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.035012Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:54c4d8199cb0a8287a4d3d18abc1bb5937813d4878146ae49e48a7b52f15e740","observation_id":"871eb699-84b9-4723-b0f0-b38910bbac91","resolution":{"observed_at":"2026-08-07T05:41:31.035012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13269","last_updated":"2024-08-19T03:31:19Z","snapshot_observed_at":"2026-07-06T15:58:08.777051Z","submitted_at":"2023-07-25T05:39:21Z","title":"LoraHub: Efficient Cross-Task Generalization via Dynamic LoRA Composition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13269","snapshot_observed_at":"2026-08-07T05:41:31.038292Z","title":"Lo- rahub: Efficient cross-task generalization via dynamic lora composition.arXiv preprint arXiv:2307.13269, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.038292Z"},"links":{"cited_paper":"/paper/2307.13269","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:c727a03b13297343fa2c62ed3b6868688ede874145f8689fea64e265970fb5ce","observation_id":"3b29580e-2e53-47c1-9b1b-a1f72d26afbe","resolution":{"observed_at":"2026-08-07T05:41:31.038292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.041881Z","title":"World and human action models towards gameplay ideation.Nature, 638(8051):656–663, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.041881Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:b17d45782c7cc495eee1a5baa75082b81bb5a272c6a54bc5061bcaea3668b3dd","observation_id":"59ae6f48-dc4c-4fa6-8498-5b85dd3fb20f","resolution":{"observed_at":"2026-08-07T05:41:31.041881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.684805Z","title":"Flux.1-dev","venue":null,"work_id":"b8be83b4-31f0-4738-a075-6db0fab6b44c","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.045332Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:9134b421597370f7ddaa137149b52e2c8a5c68591d4cdf222b538a6f283a824c","observation_id":"2bac4585-920e-43ab-8355-c4b405e25684","resolution":{"observed_at":"2026-08-07T05:41:31.687864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-07-06T03:42:37.507458Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-07T05:41:31.048650Z","title":"Belongie, Lubomir D","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.048650Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:a59b82048504b0caeb5b43596864ee38330a79ee3790d3cc7c1abfa2450eb125","observation_id":"d6f6f6e8-80bc-4147-b11e-4ab67da20b9f","resolution":{"observed_at":"2026-08-07T05:41:31.048650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10406","last_updated":"2025-07-20T08:44:35Z","snapshot_observed_at":"2026-08-07T17:06:58.996059Z","submitted_at":"2025-03-13T14:31:52Z","title":"RealGeneral: Unifying Visual Generation via Temporal In-Context Learning with Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10406","snapshot_observed_at":"2026-08-07T05:41:31.052141Z","title":"Realgeneral: Unifying visual generation via temporal in-context learning with video models.arXiv preprint arXiv:2503.10406, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.052141Z"},"links":{"cited_paper":"/paper/2503.10406","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:438bd4486d38c19da7591b1dd860451e7d7748b29e7ce744d435787757dadbc2","observation_id":"68a26326-f4ad-4c45-8584-08b95c14948d","resolution":{"observed_at":"2026-08-07T05:41:31.052141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05638","last_updated":"2022-08-26T16:23:29Z","snapshot_observed_at":"2026-07-06T13:08:59.614061Z","submitted_at":"2022-05-11T17:10:41Z","title":"Few-Shot Parameter-Efficient Fine-Tuning is Better and Cheaper than In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.05638","snapshot_observed_at":"2026-08-07T05:41:31.055832Z","title":"Few-shot parameter-efficient fine-tuning is better and cheaper than in-context learning.CoRR, abs/2205.05638, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.055832Z"},"links":{"cited_paper":"/paper/2205.05638","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:d5b209e6dd6a1b7aa1b251c8ec7e7007cbb616368605b08db7b33cd29903e1bf","observation_id":"441411b7-2850-41a3-b225-e8d301fcf21f","resolution":{"observed_at":"2026-08-07T05:41:31.055832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05552","last_updated":"2024-07-08T02:00:17Z","snapshot_observed_at":"2026-08-09T16:54:43.672182Z","submitted_at":"2024-07-08T02:00:17Z","title":"Ada-adapter:Fast Few-shot Style Personlization of Diffusion Model with Pre-trained Image Encoder","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05552","snapshot_observed_at":"2026-08-07T05:41:31.059441Z","title":"Ada-adapter:fast few-shot style personlization of diffusion model with pre-trained image encoder.CoRR, abs/2407.05552, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.059441Z"},"links":{"cited_paper":"/paper/2407.05552","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:45ffdc046a1590b437ffb1f68a05d8067129737f68d49b9813057b4f4d6fedaa","observation_id":"ae6c5fc6-e1bb-4699-b617-97775f7d40be","resolution":{"observed_at":"2026-08-07T05:41:31.059441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.675937Z","title":"Tiny imagenet","venue":null,"work_id":"2b2eeaa9-8688-42f5-99ca-c73245bae114","year":2017},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.063162Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:5e7b10093681cb6f1d8b6c3ef439425a8001b639b10485f10d876ac1ff88f6e1","observation_id":"10d516c8-da65-4421-9223-93a00bb9a110","resolution":{"observed_at":"2026-08-07T05:41:31.678832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.666529Z","title":"The conceptarc benchmark: Evaluating understanding and generalization in the arc domain.Trans","venue":null,"work_id":"614b0763-53d5-42a8-ad0e-957bc2b8c70d","year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.066375Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:1d7cd98e30c2b1bada187dddfd71f2da9379da4484f1385deaee8f10a3f2f423","observation_id":"35363675-3a16-4b09-a364-144e08557799","resolution":{"observed_at":"2026-08-07T05:41:31.669753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02271","last_updated":"2024-06-06T14:43:30Z","snapshot_observed_at":"2026-08-08T15:59:09.224957Z","submitted_at":"2024-03-04T17:58:09Z","title":"RIFF: Learning to Rephrase Inputs for Few-shot Fine-tuning of Language Models","version":2},"cited_work":{"arxiv_id":"2403.02271","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.02271","snapshot_observed_at":"2026-08-07T05:41:31.277854Z","title":"RIFF: Learning to Rephrase Inputs for Few-shot Fine-tuning of Language Models","venue":"cs.CL","work_id":"8b6a4a25-8f1e-4050-b04b-2e0be1f8b58f","year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.069534Z"},"links":{"cited_paper":"/paper/2403.02271","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:da0290f33a329a02145e7d922029064757c7f6328e720dd853affeb83bc65810","observation_id":"10ebee83-ba69-4bb6-a8ba-e40e8134b31a","resolution":{"observed_at":"2026-08-07T05:41:31.283528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.657108Z","title":"Dia: A tts model capable of generating ultra-realistic dialogue in one pass","venue":null,"work_id":"c57ae469-d980-45b4-8f05-135f3e273c88","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.073307Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:a233541f7e019ff8cfe08959b8bb4663664b0af5f7e7e79921fcadfd564e02aa","observation_id":"1e13f7f5-a7f7-4a11-9a83-b866ef615b19","resolution":{"observed_at":"2026-08-07T05:41:31.660405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.076515Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.076515Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:6f588839f7800d0ce242785fb6bf86db56b8b198854fd4bb07071d0a1c69dca3","observation_id":"eba69dc2-e832-47e7-9553-4903eeaa4aab","resolution":{"observed_at":"2026-08-07T05:41:31.076515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:41:31.079729Z","title":"GPT-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.079729Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:135df601fd4b99c609bedcde35806f366cbb53f31a63d04e9365481176fc25e4","observation_id":"874ce09a-6a34-4af1-bf17-492ccfe38d7f","resolution":{"observed_at":"2026-08-07T05:41:31.079729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.642003Z","title":"MIT Press, 2022","venue":null,"work_id":"50a4f976-14fc-4e1a-92da-1cdd36cae180","year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.083502Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:0e400eb425ad0f00954380a0b61ba6698f51df071217f0bb005906f32d98b5df","observation_id":"1def0015-5617-4265-8bb6-27536b490489","resolution":{"observed_at":"2026-08-07T05:41:31.645370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13025","last_updated":"2024-12-02T06:40:50Z","snapshot_observed_at":"2026-07-06T19:34:55.594468Z","submitted_at":"2024-10-16T20:33:06Z","title":"LoRA Soups: Merging LoRAs for Practical Skill Composition Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13025","snapshot_observed_at":"2026-08-07T05:41:31.086808Z","title":"Kakade, Eran Malach, and Samy Jelassi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.086808Z"},"links":{"cited_paper":"/paper/2410.13025","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:19447c01c4222881b13d6ef93db2f4395e6f0f1272dfd266df9b53e8ed1e4a8d","observation_id":"ab90e0c9-277b-4b44-a0d1-1fa1584f069f","resolution":{"observed_at":"2026-08-07T05:41:31.086808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18072","last_updated":"2024-10-23T17:56:11Z","snapshot_observed_at":"2026-08-07T10:24:39.020859Z","submitted_at":"2024-10-23T17:56:11Z","title":"WorldSimBench: Towards Video Generation Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18072","snapshot_observed_at":"2026-08-07T05:41:31.090419Z","title":"Worldsimbench: Towards video generation models as world simulators.CoRR, abs/2410.18072, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.090419Z"},"links":{"cited_paper":"/paper/2410.18072","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:47d78ee74ea226a2bb6f2bdf5c6e4f23137ffbe35688f68c6be762ac231b58fa","observation_id":"844d56ca-d5c6-4c49-807f-9fe6defb1c76","resolution":{"observed_at":"2026-08-07T05:41:31.090419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.094235Z","title":"Susskind","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.094235Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:b3777f937ff1e70dfa00fdcbb68999beff3f758a0d6346a6569f1d1deffa61e8","observation_id":"10fb846e-223d-4945-9c33-d234b2e427dc","resolution":{"observed_at":"2026-08-07T05:41:31.094235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.097645Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.097645Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:79b835e3770e25371e317bde970fe634b619c987adb06b837f4639f0ba2c4bdc","observation_id":"1e257c73-67aa-4e54-9935-035cf221317c","resolution":{"observed_at":"2026-08-07T05:41:31.097645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-07-06T13:45:31.237782Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-08-07T05:41:31.100838Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation.CoRR, abs/2208.12242, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.100838Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:af26cdfc7f9824ecd742e00e55e0f4c3f6d37fdb12b5fcffb7da21e5fb77b35e","observation_id":"445a628a-cb3c-466f-90fc-6bf6bc343497","resolution":{"observed_at":"2026-08-07T05:41:31.100838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.619994Z","title":"Crossing the uncanny valley of voice","venue":null,"work_id":"0c088ad2-d853-4fe1-b390-057857991eff","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.104480Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:01dea88013ef7e390ccd091d9d1a62308f77bcb0fc8f4961be6ddc1b62ac22cb","observation_id":"79220935-2fe0-43e3-a193-84ebc349088c","resolution":{"observed_at":"2026-08-07T05:41:31.623588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.609678Z","title":"Emer- gent correspondence from image diffusion.Advances in Neural Information Processing Systems, 36:1363–1389, 2023","venue":null,"work_id":"191f31ec-2b3e-48c5-8d86-99e7a02b2078","year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.107617Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:d66e28fdf10496f15a29a5ded2294a15137dda1925feb6ac6ea963aecf16959c","observation_id":"9ddc00ca-4416-47b6-82f6-6db271f658a7","resolution":{"observed_at":"2026-08-07T05:41:31.613361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.599326Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"cfc7c015-6227-4867-ab54-b16538add9bc","year":2017},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.111170Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:9bf028547860f909df290bb89a28cac7404921b3ef53774d3d6eb3500d2aa5e8","observation_id":"36d57015-2b1e-45a3-83d4-0875288067e0","resolution":{"observed_at":"2026-08-07T05:41:31.602813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16947","last_updated":"2024-05-27T08:39:38Z","snapshot_observed_at":"2026-07-06T18:20:22.759333Z","submitted_at":"2024-05-27T08:39:38Z","title":"Zero-Shot Video Semantic Segmentation based on Pre-Trained Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16947","snapshot_observed_at":"2026-08-07T05:41:31.114364Z","title":"Zero-shot video semantic segmentation based on pre- trained diffusion models.CoRR, abs/2405.16947, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.114364Z"},"links":{"cited_paper":"/paper/2405.16947","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:2f05a8d4a9eb9d5fd3b3649fb7a977c122cb9a5c26ac2ea1c2301abfdd2581de","observation_id":"d12b698c-db14-4fdd-b8f8-85c6a519d4fa","resolution":{"observed_at":"2026-08-07T05:41:31.114364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.117747Z","title":"Images speak in images: A generalist painter for in-context visual learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.117747Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:68636f28a03b0e9de24831647af71e01239a0a553f9972dacf9771228cb87aee","observation_id":"b1bd5879-3624-402e-9b6e-c555a43c721b","resolution":{"observed_at":"2026-08-07T05:41:31.117747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.121040Z","title":"In-context learning unlocked for diffusion models.Advances in Neural Information Processing Systems, 36:8542–8562, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.121040Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:5ba125a391f20747edcfb56f4980d49b47e5b1cb84019c10e740911d814f68fc","observation_id":"6847a085-8b7c-41ca-bd7d-0fdd14ac06e4","resolution":{"observed_at":"2026-08-07T05:41:31.121040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-07T05:41:31.124450Z","title":"Chi, Tatsunori Hashimoto, Oriol Vinyals, Percy Liang, Jeff Dean, and William Fedus","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.124450Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:add42a8009ec43c2744e012c0ea7915498313cf7fc1d3489aa0428d13f88dcad","observation_id":"5de88ffb-3b23-4b47-9563-6a6cfedd9a05","resolution":{"observed_at":"2026-08-07T05:41:31.124450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11340","last_updated":"2024-11-21T14:09:12Z","snapshot_observed_at":"2026-07-06T19:16:51.512681Z","submitted_at":"2024-09-17T16:42:46Z","title":"OmniGen: Unified Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11340","snapshot_observed_at":"2026-08-07T05:41:31.127934Z","title":"Omnigen: Unified image generation.CoRR, abs/2409.11340, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.127934Z"},"links":{"cited_paper":"/paper/2409.11340","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:cd5227638f453d720221d9b1b509592a54e456f6c6b218add13be18df8c6f5eb","observation_id":"89f9a7d8-2fd4-4b3e-8aa0-27e1cefbc6ff","resolution":{"observed_at":"2026-08-07T05:41:31.127934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.578126Z","title":"What matters when repurposing diffusion models for general dense perception tasks?The Thirteenth International Conference on Learning Representations (ICLR), 2025","venue":null,"work_id":"8e7e742a-5ecd-431d-9eea-d65353a826be","year":2025},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.131459Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:4414581755e67b19c3c0962dae61cf24f202332e07d671a54f7bdc2ddd2a1c27","observation_id":"8d80d2ce-80af-4c52-aa80-66ba891ac7d1","resolution":{"observed_at":"2026-08-07T05:41:31.581683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17139","last_updated":"2024-02-27T02:05:29Z","snapshot_observed_at":"2026-08-08T23:43:25.924393Z","submitted_at":"2024-02-27T02:05:29Z","title":"Video as the New Language for Real-World Decision Making","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17139","snapshot_observed_at":"2026-08-07T05:41:31.134881Z","title":"Walker, Jack Parker-Holder, Yilun Du, Jake Bruce, André Barreto, Pieter Abbeel, and Dale Schuurmans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.134881Z"},"links":{"cited_paper":"/paper/2402.17139","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:18aa76d4f438a5e0e8b5d7d0e96dc2765a46dd60287e51268dfac6be4e7463a2","observation_id":"37625214-519f-46b9-9d50-251d091c359f","resolution":{"observed_at":"2026-08-07T05:41:31.134881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-07T05:41:31.138543Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.138543Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:3ff807a1e5a28f53f437364027a666786b6969c28547998a6e9d5f9fe1996890","observation_id":"42e79d60-92ef-444e-8010-d438332c5a31","resolution":{"observed_at":"2026-08-07T05:41:31.138543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.141898Z","title":"Scene parsing through ade20k dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.141898Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:13b934360701fe761ba49aa0b561f34ccaede8af8a65333c3fdbceea8dfcebc2","observation_id":"2dbf55e9-d5ee-4c44-b893-d6ce772cfe9e","resolution":{"observed_at":"2026-08-07T05:41:31.141898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.561948Z","title":"Semantic understanding of scenes through the ade20k dataset.International Journal of Computer Vision, 127(3):302–321, 2019","venue":null,"work_id":"7fe312a2-0d0f-4246-8180-d34f0f318c04","year":2019},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.145142Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:ab78680fae3051ef43f128427c9a3c0fe1466f05108ee2637876655a8df674ab","observation_id":"d9336de3-c5b4-480b-8fd5-28403e13fd93","resolution":{"observed_at":"2026-08-07T05:41:31.565880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.550514Z","title":"This is impractical, as it requires 17 visually distinct colors","venue":null,"work_id":"b1be98c2-4b07-4c53-84e2-9770c5b1fa1e","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.148629Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:257f7b4f0379eaa93e196316ec1584b5c13def595a1238aef9c787f674ee6cf6","observation_id":"0a631846-db9f-4345-9780-d5127e95c136","resolution":{"observed_at":"2026-08-07T05:41:31.554990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.539408Z","title":"However, this increases inference costs by nearly a factor of 20, which is prohibitive for our setup where inference speed is already a bottleneck","venue":null,"work_id":"dbf2d4a3-0e66-4a41-9f2a-8c1cde75aafa","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.151920Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:609f4c75bd8661fc2b4c20cc4ed39589e21d7e5b767ced0e41fe5db39da8a1cb","observation_id":"92fb84dc-0f4c-4d51-9733-6dd64eed3900","resolution":{"observed_at":"2026-08-07T05:41:31.543173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.529240Z","title":null,"venue":null,"work_id":"cb3dcb9e-d141-4b64-baea-cdb7b55171e5","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.155259Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:a14e51ffb72eea97991dcc3862867a1dd32c5fed7dc0fba1a8a8f9a9042ec9f1","observation_id":"055368f1-d590-45ee-9fcc-d150ade68e5e","resolution":{"observed_at":"2026-08-07T05:41:31.532560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.519441Z","title":null,"venue":null,"work_id":"618fad3a-40fb-47c3-b4aa-25ae82b4dff5","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.158561Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:95c25c1a9c5841ce7e7b7442535e716ea94d94e3d306d1f9c044218e53940133","observation_id":"7a1916ad-60c0-4feb-a264-55fd681c7d33","resolution":{"observed_at":"2026-08-07T05:41:31.522803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.509003Z","title":null,"venue":null,"work_id":"6b93b21c-4a2c-4eaa-b421-8983c033b6b7","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.161776Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:0dfbd4713fca4dccaad99b0cb59a943d946ee33e42c87e1ab8ab8211152ff70c","observation_id":"67d6b4cd-1777-4c38-a140-ff00ce3dce88","resolution":{"observed_at":"2026-08-07T05:41:31.512744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:31.498796Z","title":"segment animals","venue":null,"work_id":"c32ef45c-4fb5-4a85-9082-390a4d60d81b","year":null},"citing_paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:31.165907Z"},"links":{"citing_paper":"/paper/2506.07280"},"observation_digest":"sha256:8a479de52cb8cbbc9fa4d80918bc24a52fce2bc9e60bdd22c00ec2aaaa9f288d","observation_id":"deeb5fd9-6c0f-43ac-8ede-674ea125f838","resolution":{"observed_at":"2026-08-07T05:41:31.502352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07280","last_updated":"2025-06-10T11:37:10Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T17:26:05.683665Z","submitted_at":"2025-06-08T20:52:34Z","title":"From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 4 inbound Pith citation observations for arXiv:2506.07280."}