{"as_of":"2026-08-10T15:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d15cfdb29fdd5066f12622caa50a8a5fde4d43ee3fda1cb9639c51d3e9b39ca","coverage":[{"denominator":4,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T19:02:58.334606Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T05:06:51.911350Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T22:26:16.871558Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"cited_work":{"arxiv_id":"2512.02473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.02473","snapshot_observed_at":"2026-07-23T02:24:07.287208Z","title":"World- pack: Compressed memory improves spatial consistency in video world modeling","venue":null,"work_id":"7189f30b-0520-472f-9975-bcf5a9cdd481","year":2025},"citing_paper":{"arxiv_id":"2603.28489","last_updated":"2026-07-04T13:25:12Z","snapshot_observed_at":"2026-08-05T11:17:52.410204Z","submitted_at":"2026-03-30T14:23:45Z","title":"Video Generation Models as World Models: Efficient Paradigms, Architectures and Algorithms","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T01:35:14.878069Z"},"links":{"cited_paper":"/paper/2512.02473","citing_paper":"/paper/2603.28489"},"observation_digest":"sha256:86a58bb637797f4eb1a954e73667b6c90733c2befd1d00de8bfb64c44e862c36","observation_id":"c852ae1e-1959-48d3-a3ca-0ad895e1d01a","resolution":{"observed_at":"2026-07-23T02:24:07.287208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"cited_work":{"arxiv_id":"2512.02473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.02473","snapshot_observed_at":"2026-07-23T02:24:07.287208Z","title":"World- pack: Compressed memory improves spatial consistency in video world modeling","venue":null,"work_id":"7189f30b-0520-472f-9975-bcf5a9cdd481","year":2025},"citing_paper":{"arxiv_id":"2605.11367","last_updated":"2026-05-12T00:42:27Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-12T00:42:27Z","title":"3D-Belief: Embodied Belief Inference via Generative 3D World Modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T02:24:35.901673Z"},"links":{"cited_paper":"/paper/2512.02473","citing_paper":"/paper/2605.11367"},"observation_digest":"sha256:cdc3d5d6e55f41d06cd720470cf3fb18a6684ef6089b887b00673721822692a3","observation_id":"cc832dd2-2c11-4718-abc2-5c13483ce825","resolution":{"observed_at":"2026-07-23T02:24:07.287208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"cited_work":{"arxiv_id":"2512.02473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.02473","snapshot_observed_at":"2026-07-23T02:24:07.287208Z","title":"World- pack: Compressed memory improves spatial consistency in video world modeling","venue":null,"work_id":"7189f30b-0520-472f-9975-bcf5a9cdd481","year":2025},"citing_paper":{"arxiv_id":"2605.30855","last_updated":"2026-06-01T09:19:36Z","snapshot_observed_at":"2026-08-06T20:31:32.180972Z","submitted_at":"2026-05-29T05:21:33Z","title":"Robust Dreamer: Deviation-Aware Latent Gaussian Memory for Action-Controlled AR Video Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T22:56:35.530309Z"},"links":{"cited_paper":"/paper/2512.02473","citing_paper":"/paper/2605.30855"},"observation_digest":"sha256:818a8de4b515414d9d4f1b197fe9d0ee5421c1caf632261c1897da3d8a175fe2","observation_id":"4e2b1992-ddc7-4d38-bb4c-934c1637d505","resolution":{"observed_at":"2026-07-23T02:24:07.287208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"cited_work":{"arxiv_id":"2512.02473","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.02473","snapshot_observed_at":"2026-07-23T02:24:07.287208Z","title":"World- pack: Compressed memory improves spatial consistency in video world modeling","venue":null,"work_id":"7189f30b-0520-472f-9975-bcf5a9cdd481","year":2025},"citing_paper":{"arxiv_id":"2606.02436","last_updated":"2026-06-01T16:08:43Z","snapshot_observed_at":"2026-08-02T13:17:50.493694Z","submitted_at":"2026-06-01T16:08:43Z","title":"Geometry-Aware Implicit Memory for Video World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T15:27:55.009337Z"},"links":{"cited_paper":"/paper/2512.02473","citing_paper":"/paper/2606.02436"},"observation_digest":"sha256:214a9f10dca6a39778cd097f98d6ef10c4a07186079de25266fc1627fd905014","observation_id":"26ec7362-ebf3-4b74-bef0-f33fd14571c0","resolution":{"observed_at":"2026-07-23T02:24:07.287208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02473","snapshot_observed_at":"2026-08-02T02:52:16.285758Z","title":"Oshima, Y","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14076","last_updated":"2026-07-15T17:48:48Z","snapshot_observed_at":"2026-08-02T02:52:11.633120Z","submitted_at":"2026-07-15T17:48:48Z","title":"From Pixels to States: Rethinking Interactive World Models as Game Engines","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T02:52:16.285758Z"},"links":{"cited_paper":"/paper/2512.02473","citing_paper":"/paper/2607.14076"},"observation_digest":"sha256:54290569851a938458868fcdcb60f86f4cf8dc70b89591eaee59edf6b57ebb26","observation_id":"29d0d4f7-77c2-431b-90e5-77c8443a447c","resolution":{"observed_at":"2026-08-02T02:52:16.285758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02473","snapshot_observed_at":"2026-08-08T11:36:53.759915Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05523","last_updated":"2026-08-06T02:01:05Z","snapshot_observed_at":"2026-08-10T06:28:50.347787Z","submitted_at":"2026-08-06T02:01:05Z","title":"HERA: Historical Evidence Routing Adapter for Physical Prediction in Latent World Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T11:36:53.759915Z"},"links":{"cited_paper":"/paper/2512.02473","citing_paper":"/paper/2608.05523"},"observation_digest":"sha256:1de768f8a4e7abe6293bcc7e04149c95cab870505c233d3351889a324db15c29","observation_id":"db8c1613-e503-40d2-b9cf-7ffcdb043739","resolution":{"observed_at":"2026-08-08T11:36:53.759915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02473","snapshot_observed_at":"2026-08-10T05:06:51.911350Z","title":"WorldPack: Compressed memory improves spatial consistency in video world modeling.arXiv preprint arXiv:2512.02473, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07408","last_updated":"2026-08-07T16:55:57Z","snapshot_observed_at":"2026-08-10T15:12:51.971684Z","submitted_at":"2026-08-07T16:55:57Z","title":"Addressable Memory for Video World Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T05:06:51.911350Z"},"links":{"cited_paper":"/paper/2512.02473","citing_paper":"/paper/2608.07408"},"observation_digest":"sha256:8e9b1ab4212b1f65209b6904074f1a4840fab709fd96840963ff84d8792a4875","observation_id":"866ad531-9c4e-4db8-952d-3b7609f609b1","resolution":{"observed_at":"2026-08-10T05:06:51.911350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.02473/citation-record","integrity":"/paper/2512.02473/integrity","json":"/paper/2512.02473/citation-record.json","paper":"/paper/2512.02473"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:02:58.098957Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-03T19:02:58.098957Z"},"links":{"citing_paper":"/paper/2512.02473"},"observation_digest":"sha256:6153805f1908d5c060eb292698ab4f135e1e47a5eb318f5b5d5f6a96a8548573","observation_id":"d754992f-9b92-4b04-9444-35b797fd9894","resolution":{"observed_at":"2026-08-03T19:02:58.098957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:02:58.144876Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-03T19:02:58.144876Z"},"links":{"citing_paper":"/paper/2512.02473"},"observation_digest":"sha256:863b2f559c4272c86c6ba5879f742af2f9976d8ef2d0fa45fe7ed6b620bbb9b2","observation_id":"c576bb4c-0bcf-471c-8990-1e5501232e90","resolution":{"observed_at":"2026-08-03T19:02:58.144876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:02:58.234514Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-03T19:02:58.234514Z"},"links":{"citing_paper":"/paper/2512.02473"},"observation_digest":"sha256:8ddd70a89997dae7c0d59982821b2015454b0aa84585a6de71c19e015c07b34a","observation_id":"01693f28-1a5b-4941-bf18-aac7101cd6e9","resolution":{"observed_at":"2026-08-03T19:02:58.234514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T19:02:58.334606Z","title":"WorldPack significantly improves perceptual quality compared to the baseline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-03T19:02:58.334606Z"},"links":{"citing_paper":"/paper/2512.02473"},"observation_digest":"sha256:20df1cc1896f39deab30af3442b44dfc60ced94fa882b2a675cecab7e9202aa5","observation_id":"e9d89cf6-640a-4160-9147-e58c1b5d9f42","resolution":{"observed_at":"2026-08-03T19:02:58.334606Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.02473","last_updated":"2026-07-22T11:47:21Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T04:00:25.183173Z","submitted_at":"2025-12-02T07:06:23Z","title":"WorldPack: Dynamic Frame Compression for Long-context Video World Modeling"},"reference_resolution":{"displayed":4,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":4},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 4 of 4 outbound references and 7 inbound Pith citation observations for arXiv:2512.02473."}