{"as_of":"2026-08-11T05:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:005e8f8f02cf77a1034a8e3a83fd99a654cdf0fca1c7b1d3cd2f72038c00479a","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:12:00.862819Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.10562/citation-record","integrity":"/paper/2501.10562/integrity","json":"/paper/2501.10562/citation-record.json","paper":"/paper/2501.10562"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.615564Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.615564Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:f1025207852a251061eee3b26a32780a908fe7460590dd95b2b4dbd477262e45","observation_id":"34b7e444-995b-4dac-9099-7ce414a2442a","resolution":{"observed_at":"2026-08-10T19:12:00.615564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.620442Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.620442Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:9d008063a1f0dbd5d0ea909ff58e294a1fe9c5dd7a39177c171803631344b2e2","observation_id":"cde82a9b-7c3a-4a63-b954-232bbbf096ba","resolution":{"observed_at":"2026-08-10T19:12:00.620442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09762","last_updated":"2021-04-20T05:00:24Z","snapshot_observed_at":"2026-08-11T04:01:03.857911Z","submitted_at":"2021-04-20T05:00:24Z","title":"Learning Semantic-Aware Dynamics for Video Prediction","version":1},"cited_work":{"arxiv_id":"2104.09762","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.09762","snapshot_observed_at":"2026-08-10T19:12:01.124406Z","title":"Learning Semantic-Aware Dynamics for Video Prediction","venue":"cs.CV","work_id":"81beb979-7f7a-4303-bb56-fb98df279941","year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.626657Z"},"links":{"cited_paper":"/paper/2104.09762","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:896090eac39065035872b52e7480e3923dbdcb55524283bb37ce9f650c845c8a","observation_id":"1478cc16-1f52-458f-aa34-52d989bca75f","resolution":{"observed_at":"2026-08-10T19:12:01.128807Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-10T19:12:00.631663Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.631663Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:d843a0a26339b61cb4b27a9271b2a1073ad6ee10f65fe7e407369c0fe2dd168b","observation_id":"f7ef1ca2-ea6d-4e80-b9b2-1044dbd08155","resolution":{"observed_at":"2026-08-10T19:12:00.631663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.740287Z","title":"W.; Fidler, S.; and Kreis, K","venue":null,"work_id":"37373976-a1ac-4dd1-9ab3-08dd6d064eef","year":2023},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.635979Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:b675ea1f2c917cbc12c2f51a577aad3af3d3a228b86ff4b3da2afc4812f37efd","observation_id":"7b4328b3-d7a5-4873-86f8-053ef5eb8795","resolution":{"observed_at":"2026-08-10T19:12:01.743985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.729473Z","title":null,"venue":null,"work_id":"5a4fb344-331a-4638-b61a-1847edb4c75a","year":2024},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.641400Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:aa6dcfcab9868c87dacd9786d7673406c794050cc8cbef75a4104f29edf9f22f","observation_id":"b2b210d6-a808-41bd-8140-4757438c2218","resolution":{"observed_at":"2026-08-10T19:12:01.732696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.716936Z","title":null,"venue":null,"work_id":"82a4a5de-39fd-40ea-8259-c1e6dde074a9","year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.646310Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:6266e6c19234827f24e1949be1b51e5f77eec10f847de41e0390799ab27bc8b3","observation_id":"db6d33ca-69c8-43d8-9322-68bb850951f7","resolution":{"observed_at":"2026-08-10T19:12:01.721156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.705698Z","title":null,"venue":null,"work_id":"8dd5fe45-40ac-436d-984b-3a3fe9d48811","year":2018},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.650810Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:0920c39db81d20ca6c2b42aff5229e83f1846fbbeae96511d9068d62711b1ae2","observation_id":"71b49f66-17e2-4248-8521-7e1b9447c8e9","resolution":{"observed_at":"2026-08-10T19:12:01.709511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.694185Z","title":"L.; et al","venue":null,"work_id":"4b932a14-e4e2-49e7-83eb-ef8ac5da683c","year":2017},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.655300Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:be11ac5eb76c37eeabd7dca7a825eac6ece43a1b448cfa37c5df1b600fe828e7","observation_id":"c53490b4-1c6a-4b31-b4d8-7b4d2fb2a2ee","resolution":{"observed_at":"2026-08-10T19:12:01.697558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-10T19:12:00.658902Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.658902Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:365dd531bc389d995c25b96c7b84eae7fd7cdcc854bd18d11a575faf440b604f","observation_id":"1781eaec-217d-415a-a948-b46b45dcdf17","resolution":{"observed_at":"2026-08-10T19:12:00.658902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.683029Z","title":"Mitra , N.; and Vedaldi, A","venue":null,"work_id":"61d4b220-8f57-4007-8325-af21fc842937","year":2020},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.663333Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:c1a24e9e547480884a3caa0f0967be2dde45a3bd7ed97b74a51c9ece02943a92","observation_id":"5c36d657-5fda-470f-b0dd-db088e791844","resolution":{"observed_at":"2026-08-10T19:12:01.686464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13052","last_updated":"2020-11-23T10:31:22Z","snapshot_observed_at":"2026-08-08T07:06:12.589881Z","submitted_at":"2019-07-30T16:22:39Z","title":"GENESIS: Generative Scene Inference and Sampling with Object-Centric Latent Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13052","snapshot_observed_at":"2026-08-10T19:12:00.666818Z","title":"R.; Jones, O","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.666818Z"},"links":{"cited_paper":"/paper/1907.13052","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:fcf09a2ec205fcc3a83b13684bb6ea196e976bb315f9ab79b48b863fe775c4dc","observation_id":"1682f7dd-19c4-4d14-90d9-a42ce57ed40f","resolution":{"observed_at":"2026-08-10T19:12:00.666818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.670452Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.670452Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:5de0deaaa65b7f38c65b1bd073ecb8736cbf3205aabe25bf54c8270712149682","observation_id":"a6e9c318-8dd7-44ce-9c43-05d87afe719b","resolution":{"observed_at":"2026-08-10T19:12:00.670452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.664761Z","title":null,"venue":null,"work_id":"6ef9a326-a7fb-43bd-9b41-38d9bc2c98b7","year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.673558Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:e9fb20b77a009bf3aa55eb7292def37232b874e329c11ef5765786aad65818c4","observation_id":"b2f27158-28d3-420d-b954-3e2d712a8e13","resolution":{"observed_at":"2026-08-10T19:12:01.668110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.676777Z","title":"J.; Gnanapragasam, D.; Golemo, F.; Herrmann, C.; Kipf, T.; Kundu, A.; Lagun, D.; Laradji, I.; Liu, H.-T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.676777Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:2ffd379e0e2cc4e69ad71f086d05766dad0404bcd15d2961da4908c355e57ff8","observation_id":"2151b1d0-ea92-4cd2-a1bc-78337da06cfd","resolution":{"observed_at":"2026-08-10T19:12:00.676777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11894","last_updated":"2022-08-06T10:09:47Z","snapshot_observed_at":"2026-08-09T08:50:52.153302Z","submitted_at":"2022-06-23T17:59:33Z","title":"MaskViT: Masked Visual Pre-Training for Video Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.11894","snapshot_observed_at":"2026-08-10T19:12:00.680046Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.680046Z"},"links":{"cited_paper":"/paper/2206.11894","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:cb932b6f320479b11ab83230985f16b38e8ba2d947053d583bcfa075b39febb4","observation_id":"2ff272dc-15b2-48ce-9973-9880e6cf7f4b","resolution":{"observed_at":"2026-08-10T19:12:00.680046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.684206Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.684206Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:be7d89ff62e3e3d7829cd6feb9af949fcc2a29927dae07fac928d932080fc17c","observation_id":"a4d541c1-d695-4450-8001-1bb138a0cf78","resolution":{"observed_at":"2026-08-10T19:12:00.684206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.639011Z","title":null,"venue":null,"work_id":"f5443391-0dbc-4a4b-b916-5ff857c1b627","year":2020},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.688020Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:6111dc4d9d2769a0bf6b352413d8e13248fad5c9dcda44d57189615257fb835c","observation_id":"55fda505-595e-40eb-86ea-dbb474f08ff4","resolution":{"observed_at":"2026-08-10T19:12:01.642804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09051","last_updated":"2021-06-16T18:00:12Z","snapshot_observed_at":"2026-07-06T11:20:02.840666Z","submitted_at":"2021-06-16T18:00:12Z","title":"Unsupervised Video Prediction from a Single Frame by Estimating 3D Dynamic Scene Structure","version":1},"cited_work":{"arxiv_id":"2106.09051","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.09051","snapshot_observed_at":"2026-08-10T19:12:01.054493Z","title":"Unsupervised Video Prediction from a Single Frame by Estimating 3D Dynamic Scene Structure","venue":"cs.CV","work_id":"ec06686a-61fb-45f6-a350-6a75d000fdf0","year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.691896Z"},"links":{"cited_paper":"/paper/2106.09051","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:ebe331001b486dacb674b9ae361c14a97c1f7d9a6ce3f4884b25dd0dec87efdf","observation_id":"a721a53a-213f-4d82-b88e-6e6305429114","resolution":{"observed_at":"2026-08-10T19:12:01.058382Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.696103Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.696103Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:077d6af7d3bee71bcce87f7f934dd0e84908c63dff96df16a8b10ef75c2e444b","observation_id":"376dbf54-87b8-4cbb-a065-1643dc9de6ba","resolution":{"observed_at":"2026-08-10T19:12:00.696103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.620654Z","title":null,"venue":null,"work_id":"87a2cb0b-8176-4aa9-b652-a41cd25806a5","year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.699356Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:779e8f579e3fe4b35b607e32b8bb140ecb352e514bfbc5b55fb09c9b84bd98ba","observation_id":"c7a1cf49-3235-459b-92d6-f4719bc233a6","resolution":{"observed_at":"2026-08-10T19:12:01.623866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07696","last_updated":"2022-11-14T08:38:19Z","snapshot_observed_at":"2026-08-09T13:27:02.122300Z","submitted_at":"2022-06-15T17:44:47Z","title":"Diffusion Models for Video Prediction and Infilling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07696","snapshot_observed_at":"2026-08-10T19:12:00.702480Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.702480Z"},"links":{"cited_paper":"/paper/2206.07696","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:81e8c5c425fa47f1511012a08d91dbe7527570ce2fd357f26adef16e6850f9ea","observation_id":"de3a78de-3d9d-4058-a147-fbc62b033534","resolution":{"observed_at":"2026-08-10T19:12:00.702480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.609246Z","title":null,"venue":null,"work_id":"45cb6b8d-2067-4c6d-8d64-4e11df58e9e2","year":2010},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.706139Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:478a218cc54583b1c061ae95ac4acd8b640ebb1201eb4499a43ab7cdad95a182","observation_id":"c86019ad-2c36-4151-89d5-1531977e08a0","resolution":{"observed_at":"2026-08-10T19:12:01.612776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.596306Z","title":"F.; and Niebles, J","venue":null,"work_id":"2f0093f6-8966-4edd-b2be-8880d558a693","year":2018},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.709434Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:a7806d95c3a80a205f24553ecc63328392d3f1ef07538843cd484bdda857872f","observation_id":"0693bc14-d62c-4b0c-9d82-bdf2032a7507","resolution":{"observed_at":"2026-08-10T19:12:01.600470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.584852Z","title":null,"venue":null,"work_id":"3bf8f398-6d00-46bf-b72b-57eba0820e44","year":2019},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.712669Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:3b9e14c43550b1afe7dd686147802a9bbf63d83255aa29932b23966fce12eb9d","observation_id":"110e6c6a-ea94-4c4d-afb7-20f834d2c2b0","resolution":{"observed_at":"2026-08-10T19:12:01.588621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.571824Z","title":null,"venue":null,"work_id":"24ce67fa-4b8d-4184-a1fd-0b9a1fc80d87","year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.715982Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:774614a778a603cca52a33906617e11f81d319531566eae32ff44cde0c498ea5","observation_id":"7ef83283-1257-4321-8e35-132751f03175","resolution":{"observed_at":"2026-08-10T19:12:01.576116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12594","last_updated":"2022-03-15T09:26:44Z","snapshot_observed_at":"2026-08-08T21:44:10.341982Z","submitted_at":"2021-11-24T16:10:46Z","title":"Conditional Object-Centric Learning from Video","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.12594","snapshot_observed_at":"2026-08-10T19:12:00.719119Z","title":"F.; Mahendran, A.; Stone, A.; Sabour, S.; Heigold, G.; Jonschkowski, R.; Dosovitskiy, A.; and Greff, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.719119Z"},"links":{"cited_paper":"/paper/2111.12594","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:1dafb089056321f96cbc35e5b874b76b0cbba66937b6ee2b657c9023272bc632","observation_id":"a0f22dc8-a667-455f-9dd9-f5f4f266f7a3","resolution":{"observed_at":"2026-08-10T19:12:00.719119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.723131Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.723131Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:77a25a295fcd1fe68582b126c21192bbcbfe1b3e22ad4375400710269b8e44d5","observation_id":"45880b88-b8b9-4b61-b18f-037dffda2fdd","resolution":{"observed_at":"2026-08-10T19:12:00.723131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.449483Z","title":null,"venue":null,"work_id":"0f5cb0c5-0057-4096-ab31-e0832ca040e0","year":2023},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.726796Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:a3d6a1a5e844508629e2c6218879be409810fcf3598e48bf80e0bbf351a21768","observation_id":"d67ecac5-3908-461a-8d4d-5f3220e20ee4","resolution":{"observed_at":"2026-08-10T19:12:01.520920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06697","last_updated":"2021-04-14T08:39:38Z","snapshot_observed_at":"2026-08-11T03:01:10.116319Z","submitted_at":"2021-04-14T08:39:38Z","title":"Revisiting Hierarchical Approach for Persistent Long-Term Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.06697","snapshot_observed_at":"2026-08-10T19:12:00.730407Z","title":"Y.; Huang, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.730407Z"},"links":{"cited_paper":"/paper/2104.06697","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:55b5b6afc016f4496d1e7d826696f3ca10428d7a43f340ed189d1ba081f11428","observation_id":"708e11ab-f399-476e-8291-4d50f3afb7f9","resolution":{"observed_at":"2026-08-10T19:12:00.730407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.408707Z","title":"A.; Hu, W.; Sun, Z.; and Fisher, R","venue":null,"work_id":"86ac9eb0-bca6-44f6-94b9-f318da64dbdb","year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.734374Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:052b372ec9197fb2de6e3065a16590ca4d51ee156911fdf76bccdeb159231e4c","observation_id":"8df5e86c-603e-4745-b29e-e86b9ee198e6","resolution":{"observed_at":"2026-08-10T19:12:01.412276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.397108Z","title":null,"venue":null,"work_id":"1ece5249-ad6e-4362-a45e-b8a6f7f77d4a","year":2023},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.737988Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:2ed5607ed344562da78a89de5cd58c2d98f57f8bd870dc4d6fef6faa78e55dc7","observation_id":"d8cca79f-3973-4d16-9b54-8c91516bb5f8","resolution":{"observed_at":"2026-08-10T19:12:01.400625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-10T19:12:00.741699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.741699Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:ca99c4e3ac3ea2978712a92d20465a1250f33e356b05147608b9ddfb17fb0b82","observation_id":"243c72f3-89c6-4e49-8062-336c750967d4","resolution":{"observed_at":"2026-08-10T19:12:00.741699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.385551Z","title":null,"venue":null,"work_id":"328a8b3d-2d4e-4e20-bb96-8026c093187c","year":2020},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.745703Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:b1a55a2b9eb17bf64063f563faea4223f3e99c1bf1cd8a81aaa9469df572d809","observation_id":"9b72b4d0-6049-4693-9f96-b90e4b83b262","resolution":{"observed_at":"2026-08-10T19:12:01.389384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.374494Z","title":null,"venue":null,"work_id":"cf81fc19-bdab-46ae-9c7c-bf71185e83cb","year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.749627Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:3c8d05d5a52fc41f9be46a3c04a22f7a443764c7001bf9e8554d7ac8a47c39b6","observation_id":"dff6c148-91cc-4c07-8643-98ab259ae4e5","resolution":{"observed_at":"2026-08-10T19:12:01.378200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.753793Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.753793Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:40f93cdd12d527324c0bb47b84ff899431c8e055dc6a937e2de2fb683909e1a8","observation_id":"b35a081b-9db5-4b72-b9ac-99c59e41fc7e","resolution":{"observed_at":"2026-08-10T19:12:00.753793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.356265Z","title":null,"venue":null,"work_id":"cb690bf1-4077-415f-84c9-33806f6f7edc","year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.757729Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:5ccfc91a2c06c5a2afde366dcfc3a4fe54261fdb80001160939b9c931776a0b5","observation_id":"01eb8782-3050-4c79-bc43-1d3f65aa1721","resolution":{"observed_at":"2026-08-10T19:12:01.360234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09972","last_updated":"2024-05-22T05:05:38Z","snapshot_observed_at":"2026-08-10T13:04:49.713390Z","submitted_at":"2023-05-17T06:11:10Z","title":"Real-Time Flying Object Detection with YOLOv8","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09972","snapshot_observed_at":"2026-08-10T19:12:00.762202Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.762202Z"},"links":{"cited_paper":"/paper/2305.09972","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:9ceb7cab386008185ed34c0ab5b3fbb22d48a57ba45f5c8444364773de1363d3","observation_id":"ce8521ec-156d-4a36-a35b-cac900f83482","resolution":{"observed_at":"2026-08-10T19:12:00.762202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.767658Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.767658Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:7465d7e080c4a610983fe21291fca3ee4147b654175a7301f46bc78d14db850b","observation_id":"0eb53038-eb3c-4e0a-9d66-7549179fa784","resolution":{"observed_at":"2026-08-10T19:12:00.767658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.337239Z","title":"S.; Duckworth, D.; Mahendran, A.; Van Steenkiste, S.; Pavetic, F.; Lucic, M.; Guibas, L","venue":null,"work_id":"e011bb6b-b168-499b-af2e-319083cca9b2","year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.771370Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:96c5d2931c6347dac6333d3ac23afcd4d41e988a955be359bb1a096a5f4e1ddc","observation_id":"35f7e572-db53-4842-bb90-9cc1d7526fed","resolution":{"observed_at":"2026-08-10T19:12:01.341938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.323404Z","title":null,"venue":null,"work_id":"1793eb74-ac9f-4243-bcd4-212295015c78","year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.774773Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:cc739cd165f087d71a1cbd5057389f8ffe243506f7534d2ef4a6b78394f680e2","observation_id":"3bd93940-89de-4fec-9d68-365cbfa5ea25","resolution":{"observed_at":"2026-08-10T19:12:01.327466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.309937Z","title":null,"venue":null,"work_id":"cd50dfe5-fab2-4c88-b8cb-3214fbc62546","year":2004},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.778098Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:dfe11f95e4af367720bf0630ba6bfed02f3a341496abaa09b0b13e2e755a5d66","observation_id":"0f87c975-61e8-459b-9045-85ec99f65953","resolution":{"observed_at":"2026-08-10T19:12:01.313926Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16701","last_updated":"2024-05-26T21:31:59Z","snapshot_observed_at":"2026-08-06T14:07:11.023335Z","submitted_at":"2024-05-26T21:31:59Z","title":"Detail-Enhanced Intra- and Inter-modal Interaction for Audio-Visual Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2405.16701","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.16701","snapshot_observed_at":"2026-08-10T19:12:00.981823Z","title":"Detail-Enhanced Intra- and Inter-modal Interaction for Audio-Visual Emotion Recognition","venue":"cs.CV","work_id":"258d160e-bb7d-4c5f-ac3e-6cb083c93c9c","year":2024},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.781291Z"},"links":{"cited_paper":"/paper/2405.16701","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:a8482a9ed4eccc9266c283ca8221472465d3578c0d59d63182b6e21482b8e8fb","observation_id":"57287d82-040f-478f-adb3-c25dd1cdbf25","resolution":{"observed_at":"2026-08-10T19:12:00.985837Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.785213Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.785213Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:8c859ccb11a8ee13ca2562e6fc69b46ac7d9fb3d99d0074adbba0052b4771830","observation_id":"cfeba866-00c7-46be-8466-e7fc2ee992df","resolution":{"observed_at":"2026-08-10T19:12:00.785213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.288369Z","title":null,"venue":null,"work_id":"c9473af2-9c44-4ba4-a564-2892413dc79b","year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.788416Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:b2c6b167d0616527a03c79058cf0eb97d73288480f8a6465015bdbdf9a1f6c8d","observation_id":"bf7c238b-eeaf-4468-8315-a3285fe154be","resolution":{"observed_at":"2026-08-10T19:12:01.292381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.275856Z","title":null,"venue":null,"work_id":"565340cd-7174-4582-b325-1b7947173215","year":2015},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.791966Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:c50a5b07be713be848901e4cc0bce26fbe5f694c1f4654da74fea7bb00cc31ba","observation_id":"12e6bc15-07cd-4c35-8b3e-7ce37b376049","resolution":{"observed_at":"2026-08-10T19:12:01.279894Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03684","last_updated":"2023-03-16T08:41:44Z","snapshot_observed_at":"2026-08-08T22:10:16.674772Z","submitted_at":"2023-03-07T06:54:48Z","title":"MOSO: Decomposing MOtion, Scene and Object for Video Prediction","version":2},"cited_work":{"arxiv_id":"2303.03684","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.03684","snapshot_observed_at":"2026-08-10T19:12:00.957131Z","title":"MOSO: Decomposing MOtion, Scene and Object for Video Prediction","venue":"cs.CV","work_id":"afead3d1-af5b-41bb-93e1-eb3ed17e854b","year":2023},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.795575Z"},"links":{"cited_paper":"/paper/2303.03684","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:1b44274f11def1e3657f68acc7770d13309e5516d27b90c245238d41437c0a84","observation_id":"e2f09dfd-95e8-4d5a-beb5-466fc5ca42a0","resolution":{"observed_at":"2026-08-10T19:12:00.963180Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.262913Z","title":null,"venue":null,"work_id":"1fc43bdb-c713-45e7-8edf-965ea4810c6c","year":2017},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.799263Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:23062a0c01a957af598690bd860d4e33a691b68187bf0f1c13925a87e025ce35","observation_id":"44ecdb73-0743-4ae0-871e-5df70e4cfc5c","resolution":{"observed_at":"2026-08-10T19:12:01.267045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.802415Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.802415Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:1e1110209ecad6ef785aa50ccb04472e162f1b40f7a405a274a7f0a156e6db0d","observation_id":"40ac56cf-189d-403d-b48e-307c99dea313","resolution":{"observed_at":"2026-08-10T19:12:00.802415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.243302Z","title":null,"venue":null,"work_id":"54038aac-e860-45b4-90e7-7fdadbcc3e13","year":2023},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.805645Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:0a7a481f4b6d9a546870267aae56461848b3d7619d05cbd7d30e24b2a5b064a1","observation_id":"ee0530c4-ab16-40ce-a107-396e1d8aec86","resolution":{"observed_at":"2026-08-10T19:12:01.247723Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09985","last_updated":"2024-01-18T14:01:20Z","snapshot_observed_at":"2026-08-07T06:47:36.460071Z","submitted_at":"2024-01-18T14:01:20Z","title":"WorldDreamer: Towards General World Models for Video Generation via Predicting Masked Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09985","snapshot_observed_at":"2026-08-10T19:12:00.808685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.808685Z"},"links":{"cited_paper":"/paper/2401.09985","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:cb73e06392977cf2c5ee4f6116bd9e805964638a20b700bab5498c9e9ed3cb10","observation_id":"731b2e92-dd2b-4633-9fd8-c2a8f12de4f4","resolution":{"observed_at":"2026-08-10T19:12:00.808685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.232363Z","title":null,"venue":null,"work_id":"feac972c-5679-42d2-938b-43f594723301","year":2018},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.812321Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:561a602eb6d2d404da2faf8087ee8b976ce58651a20f6b51b176569db7676a43","observation_id":"d73ca3f8-ab90-4624-a7e7-dff70218ea7b","resolution":{"observed_at":"2026-08-10T19:12:01.236014Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.221035Z","title":null,"venue":null,"work_id":"bb584218-696f-4d00-9887-5fcd890efa9b","year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.815805Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:776570679b893d9c4625e32df12cbe1e8b5a6ba9c7f34f7debb1004b5ffa10b6","observation_id":"2e86f117-e119-4586-b973-9bc23059dab2","resolution":{"observed_at":"2026-08-10T19:12:01.224521Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.819616Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.819616Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:5cda8106299d905d50fe35f0a4056a25488a570063dbfff641b4e924ee897382","observation_id":"136dbce8-162e-4b1c-9010-d13d42ebc288","resolution":{"observed_at":"2026-08-10T19:12:00.819616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15223","last_updated":"2024-10-31T08:58:08Z","snapshot_observed_at":"2026-08-07T05:55:25.949233Z","submitted_at":"2024-05-24T05:29:12Z","title":"iVideoGPT: Interactive VideoGPTs are Scalable World Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15223","snapshot_observed_at":"2026-08-10T19:12:00.823669Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.823669Z"},"links":{"cited_paper":"/paper/2405.15223","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:b4389bf681aee71dae525ea2e05020304efb5eaaee0d0fff55797f7f42b0c0c3","observation_id":"b993cd75-f9fe-4ebb-af8d-5d0ce1d344bc","resolution":{"observed_at":"2026-08-10T19:12:00.823669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05861","last_updated":"2023-01-21T02:46:41Z","snapshot_observed_at":"2026-08-06T08:41:59.988489Z","submitted_at":"2022-10-12T01:53:58Z","title":"SlotFormer: Unsupervised Visual Dynamics Simulation with Object-Centric Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05861","snapshot_observed_at":"2026-08-10T19:12:00.827939Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.827939Z"},"links":{"cited_paper":"/paper/2210.05861","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:8394b344b02867145eeb7f3d0e33bcadc71ef1ae2889896aacf0631314df1222","observation_id":"fb83e268-8432-4c17-92d3-c771a680fb6f","resolution":{"observed_at":"2026-08-10T19:12:00.827939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.200371Z","title":null,"venue":null,"work_id":"fbdaefd2-d156-42f1-8da1-edbe02ebecd1","year":2020},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.832411Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:950f80b4f8865232415c721cd1c06721f71c1315676d3d33776bc6adad58e649","observation_id":"e4bf5742-8409-40a4-8536-82634ce66835","resolution":{"observed_at":"2026-08-10T19:12:01.204009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10157","last_updated":"2021-09-14T21:20:06Z","snapshot_observed_at":"2026-07-06T11:02:11.424356Z","submitted_at":"2021-04-20T17:58:03Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10157","snapshot_observed_at":"2026-08-10T19:12:00.836494Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.836494Z"},"links":{"cited_paper":"/paper/2104.10157","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:a26473c6fa43b52372002434354f88000af001777bcff8fb5dea9d33fe893979","observation_id":"4b198112-90d9-4891-948b-ad7ee10cbf87","resolution":{"observed_at":"2026-08-10T19:12:00.836494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.188451Z","title":null,"venue":null,"work_id":"09c5c259-3c92-4b0f-aefd-d24909000d72","year":2024},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.841045Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:c8c44258a41b11cc08aad4d74c013c810d2581faab931ef6c86f2d7f964ba9d3","observation_id":"9a3a7f49-e38f-4b34-b57e-a88384f26216","resolution":{"observed_at":"2026-08-10T19:12:01.192103Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01442","last_updated":"2020-03-08T00:09:07Z","snapshot_observed_at":"2026-07-06T08:26:38.349660Z","submitted_at":"2019-10-03T13:16:36Z","title":"CLEVRER: CoLlision Events for Video REpresentation and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01442","snapshot_observed_at":"2026-08-10T19:12:00.845267Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.845267Z"},"links":{"cited_paper":"/paper/1910.01442","citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:c86a464ccd288a1d9c3905da41fce6bf0c09183f25180b9ddd03d0423711a884","observation_id":"1bf6766c-1d2d-431b-9269-5beac04ebeaa","resolution":{"observed_at":"2026-08-10T19:12:00.845267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.174489Z","title":null,"venue":null,"work_id":"5e888f93-4e99-47e4-aab4-d2ca2e067879","year":2023},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.849808Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:16c937113d5d9d843151d3aab2b24e07a71050ea0bddd3d6a33e8c11738fb851","observation_id":"a68c3a44-f866-49e1-9940-29f3e5b47131","resolution":{"observed_at":"2026-08-10T19:12:01.178441Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:00.854344Z","title":"A.; Shechtman, E.; and Wang, O","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.854344Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:d230255e8e1217146e2d8675dc46609fa5a5ec00f37b887b0b20798dca72cef5","observation_id":"70de0eba-ef67-429d-abed-ffde51895065","resolution":{"observed_at":"2026-08-10T19:12:00.854344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.152512Z","title":null,"venue":null,"work_id":"890a464f-e41d-45c2-8c11-0478a86d3754","year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.858456Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:b06f8fd1a4479c9c0c80fcdffdb017b6c489711992cc1966a77a083222c11ef1","observation_id":"57e7cd46-d9e8-469b-811b-fc38f5018014","resolution":{"observed_at":"2026-08-10T19:12:01.157873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:12:01.138789Z","title":null,"venue":null,"work_id":"53703e13-aba1-43ae-a69e-78ba03951e99","year":2022},"citing_paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T19:12:00.862819Z"},"links":{"citing_paper":"/paper/2501.10562"},"observation_digest":"sha256:148f0bff0dc75ff231d2b9be62d9e357a18f8baafbab7fea33022f07ce81b073","observation_id":"d3bc3516-81e5-4683-8f7e-cf07c07c4739","resolution":{"observed_at":"2026-08-10T19:12:01.143346Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.10562","last_updated":"2025-01-17T21:36:06Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T04:00:34.032253Z","submitted_at":"2025-01-17T21:36:06Z","title":"On the Benefits of Instance Decomposition in Video Prediction Models"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":54,"verified_exact":3,"verified_fuzzy":6},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 0 inbound Pith citation observations for arXiv:2501.10562."}