{"as_of":"2026-08-09T07:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2400dfb4e69ea1a269e15ac178a3ed7aa26227a065214a1fbb90a965f15e6fcf","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T00:14:59.569131Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T22:54:01.434942Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-09T00:14:59.569131Z","title":"Golling, T., Heinrich, L., Kagan, M., Klein, S., Leigh, M., Osadchy, M., and Raine, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03933","last_updated":"2025-02-06T10:16:27Z","snapshot_observed_at":"2026-08-09T00:09:34.598348Z","submitted_at":"2025-02-06T10:16:27Z","title":"HEP-JEPA: A foundation model for collider physics using joint embedding predictive architecture","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T00:14:59.569131Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2502.03933"},"observation_digest":"sha256:035a0911ae83ae1322b6018f8fd06850c2ecaf05ce449bc5e9dccd22888fbc83","observation_id":"ab95dbd2-51b2-4d76-b5d3-f2ec68c15207","resolution":{"observed_at":"2026-08-09T00:14:59.569131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-08T20:07:43.743498Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05169","last_updated":"2025-06-24T07:03:53Z","snapshot_observed_at":"2026-08-08T19:58:44.059965Z","submitted_at":"2025-02-07T18:53:03Z","title":"Flopping for FLOPs: Leveraging equivariance for computational efficiency","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T20:07:43.743498Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2502.05169"},"observation_digest":"sha256:ed409bc4634a826839289acd41bc570b7c074873c8a8ec7463d27fbb2a17a503","observation_id":"c9d461e5-a4b4-466e-8fa4-a76e70df02ef","resolution":{"observed_at":"2026-08-08T20:07:43.743498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-08T17:46:20.572357Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05857","last_updated":"2025-09-11T03:59:01Z","snapshot_observed_at":"2026-08-08T17:37:48.265283Z","submitted_at":"2025-02-09T11:28:57Z","title":"EgoAgent: A Joint Predictive Agent Model in Egocentric Worlds","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T17:46:20.572357Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2502.05857"},"observation_digest":"sha256:3f6a35094e3881aea3fe9050053b92972cd81c2a8d22824f0d71ac796715975c","observation_id":"666131fe-3f33-46f3-bc47-c1fc4814381d","resolution":{"observed_at":"2026-08-08T17:46:20.572357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T21:51:15.876843Z","title":"Learning and leveraging world mod- els in visual representation learning.arXiv preprint arXiv:2403.00504,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09356","last_updated":"2025-06-04T14:07:47Z","snapshot_observed_at":"2026-08-08T11:15:58.406521Z","submitted_at":"2025-02-13T14:21:03Z","title":"Galileo: Learning Global & Local Features of Many Remote Sensing Modalities","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T21:51:15.876843Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2502.09356"},"observation_digest":"sha256:e4769d98470b71ce99cc412c3ada84a11a507f5a3160867c9df3d2a0745dc089","observation_id":"50b6e713-4e3c-4b7d-976e-3493833bb0b2","resolution":{"observed_at":"2026-08-07T21:51:15.876843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T15:42:08.579604Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14235","last_updated":"2025-05-20T11:42:26Z","snapshot_observed_at":"2026-08-09T06:17:38.740164Z","submitted_at":"2025-05-20T11:42:26Z","title":"Toward Embodied AGI: A Review of Embodied AI and the Road Ahead","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:42:08.579604Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2505.14235"},"observation_digest":"sha256:1bd93a5e738d9c05ae9daaf1ea4108aa292ac2debf0eccf75fee76f4684cc4db","observation_id":"f79ec40c-044a-4dbb-bf12-8ec53645cdff","resolution":{"observed_at":"2026-08-07T15:42:08.579604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T10:50:50.711002Z","title":"Learning and leveraging world models in visual representation learning.arXiv preprint arXiv:2403.00504,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04363","last_updated":"2025-06-04T18:22:40Z","snapshot_observed_at":"2026-08-07T10:41:45.061614Z","submitted_at":"2025-06-04T18:22:40Z","title":"WorldPrediction: A Benchmark for High-level World Modeling and Long-horizon Procedural Planning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.711002Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2506.04363"},"observation_digest":"sha256:633d5cbbcbb0bb97e6eef94725ed7212c9d713a51e7dee0e5916c52f9795857e","observation_id":"3bb57699-b973-40f7-90e2-5082aa8596bf","resolution":{"observed_at":"2026-08-07T10:50:50.711002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2506.10137","last_updated":"2026-04-19T14:49:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T19:32:41Z","title":"Self-Predictive Representations for Combinatorial Generalization in Behavioral Cloning","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T09:15:45.511104Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2506.10137"},"observation_digest":"sha256:ed1490295862d0f0e37deca25cad02728c578ebd6297ecc6c88c7f2cf6ce087b","observation_id":"55e27c9b-9eed-403d-9abe-847c6b28278f","resolution":{"observed_at":"2026-05-19T09:17:14.031185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-06T23:34:35.739408Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-09T00:13:56.083722Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.739408Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:835b08c8087bf9bdb0395da462f2178eb652ec257dfb289b492e549b74d659be","observation_id":"fe9b8ed9-e92e-44c5-8d57-8c22feb906e1","resolution":{"observed_at":"2026-08-06T23:34:35.739408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-06T15:15:59.550313Z","title":"Learning and leveraging world models in visual representation learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16477","last_updated":"2025-07-22T11:35:27Z","snapshot_observed_at":"2026-08-08T12:10:16.101475Z","submitted_at":"2025-07-22T11:35:27Z","title":"Adaptive Bayesian Single-Shot Quantum Sensing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:59.550313Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2507.16477"},"observation_digest":"sha256:5b12a975d5f391bf899bc867d0d8123633a5399274fc7ebb9c985f8ea31d41f0","observation_id":"2142393f-cdf3-4047-b9e9-62bba6d2dbd4","resolution":{"observed_at":"2026-08-06T15:15:59.550313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-05T21:02:04.066353Z","title":"Learning and leveraging world models in visual representation learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09561","last_updated":"2025-08-13T07:29:40Z","snapshot_observed_at":"2026-08-09T02:42:53.914860Z","submitted_at":"2025-08-13T07:29:40Z","title":"Edge General Intelligence Through World Models and Agentic AI: Fundamentals, Solutions, and Challenges","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T21:02:04.066353Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2508.09561"},"observation_digest":"sha256:a882026b25a1c8253729a7c32337a47da0c223ff40ba09f048d3c848c04ef701","observation_id":"8c4b7613-9c3b-405e-9ea1-38a9af354aa6","resolution":{"observed_at":"2026-08-05T21:02:04.066353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2602.23058","last_updated":"2026-05-17T06:55:06Z","snapshot_observed_at":"2026-07-06T22:47:11.228912Z","submitted_at":"2026-02-26T14:42:53Z","title":"GeoWorld: Geometric World Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-21T11:39:15.308355Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2602.23058"},"observation_digest":"sha256:74e3b021daa2a0414c611b0ab38afdf797ef4d0c240c6c9c7dd7f7c14cd66acc","observation_id":"d514b024-71e7-4bcf-ae08-9e502997257c","resolution":{"observed_at":"2026-05-21T11:40:03.305541Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2603.07083","last_updated":"2026-04-14T13:41:32Z","snapshot_observed_at":"2026-07-06T22:48:13.053749Z","submitted_at":"2026-03-07T07:41:28Z","title":"Dreamer-CDP: Improving Reconstruction-free World Models Via Continuous Deterministic Representation Prediction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T14:46:18.645009Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2603.07083"},"observation_digest":"sha256:cd1b84c6ef22b15ac3b7523bc0358e67d37541a3a5a75de4deb7f890cae8aef2","observation_id":"af72e11f-7161-4f5c-84ef-5a4d88bde945","resolution":{"observed_at":"2026-05-15T14:50:05.116144Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-07-15T13:23:57.354325Z","title":"Learning and leveraging world models in visual representation learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07245","last_updated":"2026-06-29T07:33:52Z","snapshot_observed_at":"2026-07-15T13:23:56.926410Z","submitted_at":"2026-03-07T14:55:00Z","title":"The Lov\\'{a}sz Local Lemma: Foundations and Applications","version":7},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-15T13:23:57.354325Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2603.07245"},"observation_digest":"sha256:0d5df9e3d28d25188657006abdcb5c896933fb460bbf1383395140c3fc77dd19","observation_id":"ea28cad9-d805-4107-88ef-2ed58f723149","resolution":{"observed_at":"2026-07-15T13:23:57.354325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-07-13T14:05:26.303000Z","title":"Learning and leveraging world models in visual representation learning.arXiv preprint arXiv:2403.00504, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.01985","last_updated":"2026-05-29T16:27:50Z","snapshot_observed_at":"2026-07-13T14:05:19.455452Z","submitted_at":"2026-04-02T12:48:36Z","title":"World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T14:05:26.303000Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2604.01985"},"observation_digest":"sha256:0a9a7095d200f549a8841b881bcd3e4e426a7a6f72a4311e731735cc0dc21307","observation_id":"77608f92-3d42-4d3f-84fc-aca1fb80b64e","resolution":{"observed_at":"2026-07-13T14:05:26.303000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2604.06155","last_updated":"2026-04-20T15:01:48Z","snapshot_observed_at":"2026-08-06T08:19:07.908309Z","submitted_at":"2026-04-07T17:54:22Z","title":"Toward Consistent World Models with Multi-Token Prediction and Latent Semantic Enhancement","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T19:28:33.350491Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2604.06155"},"observation_digest":"sha256:4cf20d55645bb130d6fa78d8ca94f17d8e354039b548271e29ace2c8f64f67bf","observation_id":"bfe5b756-c5e9-489b-b8cb-06e6f31b28ed","resolution":{"observed_at":"2026-05-10T22:55:49.618449Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.03245","last_updated":"2026-05-05T00:26:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-05T00:26:57Z","title":"Text-Conditional JEPA for Learning Semantically Rich Visual Representations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T17:58:43.650308Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.03245"},"observation_digest":"sha256:11a3900022287f3cde34a7f2cba45e3c17f4b1e186bc6c8e66196076908614c6","observation_id":"2e316451-1292-403a-9c68-42a607d3890f","resolution":{"observed_at":"2026-05-12T10:51:30.669233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.05586","last_updated":"2026-05-07T02:11:26Z","snapshot_observed_at":"2026-08-07T18:58:17.371194Z","submitted_at":"2026-05-07T02:11:26Z","title":"AeroJEPA: Learning Semantic Latent Representations for Scalable 3D Aerodynamic Field Modeling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-09T15:53:39.074115Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.05586"},"observation_digest":"sha256:83a60582e09d9b0cd72408f2b2fe63472478a49aeebddda62c8ba2f698d48893","observation_id":"97cf2300-0297-4178-aee3-a1a1c256227f","resolution":{"observed_at":"2026-05-11T16:36:09.268171Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.07199","last_updated":"2026-05-08T03:47:44Z","snapshot_observed_at":"2026-08-05T15:54:57.136857Z","submitted_at":"2026-05-08T03:47:44Z","title":"Three-in-One World Model: Energy-Based Consistency, Prediction, and Counterfactual Inference for Marketing Intervention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T02:45:08.315949Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.07199"},"observation_digest":"sha256:a6907aeaf33e2813ae07aa553af3b31efad24d846ba2112496ff2c5776c610ca","observation_id":"0ac542cf-51b9-4b4e-ab99-c002c070c6be","resolution":{"observed_at":"2026-05-11T02:45:56.722986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.21800","last_updated":"2026-05-20T22:58:15Z","snapshot_observed_at":"2026-07-06T23:32:10.472558Z","submitted_at":"2026-05-20T22:58:15Z","title":"stable-worldmodel: A Platform for Reproducible World Modeling Research and Evaluation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T08:57:19.834179Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.21800"},"observation_digest":"sha256:eaecb4992b117b3321795334e0becced38ee23bc53e1f65f164d5835241cd6ea","observation_id":"e15ea76d-f0a4-4cbf-891e-a37ec1d21076","resolution":{"observed_at":"2026-05-22T09:01:20.317075Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.26282","last_updated":"2026-05-25T19:06:51Z","snapshot_observed_at":"2026-08-02T12:16:30.744884Z","submitted_at":"2026-05-25T19:06:51Z","title":"Scaling World-Model Reinforcement Learning Through Diffusion Policy Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T22:46:27.179341Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.26282"},"observation_digest":"sha256:1eca9cf49ede4552422ccbf3178a144bb6f7a6fa3e3d4f3a5406e33edefa8964","observation_id":"06811cd5-d8df-4689-8b43-e50da9c52169","resolution":{"observed_at":"2026-06-29T22:54:01.436526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":"2403.00504","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-06-29T22:54:01.434942Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":"0974cefb-8c98-40ab-bb67-68f26d00ed2a","year":2024},"citing_paper":{"arxiv_id":"2605.26478","last_updated":"2026-05-26T02:35:08Z","snapshot_observed_at":"2026-08-02T15:14:06.593016Z","submitted_at":"2026-05-26T02:35:08Z","title":"Efficient On-policy Visual-RL via Stochastic Decoupled Policy Gradient","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T17:34:41.053725Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2605.26478"},"observation_digest":"sha256:16181ce0078a8ae82c84714f28309a3c008d9e7b2f74b396ad4103ce05fbf751","observation_id":"b0a6b739-b7b2-4d13-b0b2-535669071ff7","resolution":{"observed_at":"2026-06-29T18:03:48.594049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-07-11T22:20:52.422988Z","title":"arXiv preprint arXiv:2403.00504 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04011","last_updated":"2026-07-04T20:13:38Z","snapshot_observed_at":"2026-08-06T03:55:35.624754Z","submitted_at":"2026-07-04T20:13:38Z","title":"Separating Representation from Reconstruction Enables Scalable Text Encoders","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-11T22:20:52.422988Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2607.04011"},"observation_digest":"sha256:b1e542e7f7cc9c33ec5f32410ace8b6d5dcdeee5331153b92949a39f72a781c5","observation_id":"2574f0cd-bd8d-4b30-aaf4-6750e568f37e","resolution":{"observed_at":"2026-07-11T22:20:52.422988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-08T18:42:36.975241Z","title":"Learning and leveraging world models in visual representation learning.arXiv preprint arXiv:2403.00504, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04378","last_updated":"2026-08-05T02:38:20Z","snapshot_observed_at":"2026-08-09T03:59:51.044695Z","submitted_at":"2026-08-05T02:38:20Z","title":"Helping Music Co-Creation Agents 'Listen' Well: Hierarchical Self-Supervised World Models for Understanding and Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T18:42:36.975241Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2608.04378"},"observation_digest":"sha256:60e6af4ac9f0902266478ecfa12dbd224d8effd27b23e3dfa8f119fa4987cd05","observation_id":"ec1dd9e5-264d-4417-b06f-3f8a9553fca9","resolution":{"observed_at":"2026-08-08T18:42:36.975241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T23:47:03.495059Z","title":"Learning and leveraging world models in visual representation learning.arXiv preprint arXiv:2403.00504, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05774","last_updated":"2026-08-06T09:09:16Z","snapshot_observed_at":"2026-08-09T07:11:00.601255Z","submitted_at":"2026-08-06T09:09:16Z","title":"SR-JEPA: Learning Predictive Latent State in 3D Scenes","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T23:47:03.495059Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2608.05774"},"observation_digest":"sha256:1853261ac3aa0de6c2eca15666661b02bdb89f63ee1ebd9be667faa015bf3e0e","observation_id":"d1c13e67-c5d0-4a44-868a-e50868c7a153","resolution":{"observed_at":"2026-08-07T23:47:03.495059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-07T13:26:05.346601Z","title":"arXiv preprint arXiv:2403.00504 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06174","last_updated":"2026-08-06T15:38:55Z","snapshot_observed_at":"2026-08-09T07:12:22.957356Z","submitted_at":"2026-08-06T15:38:55Z","title":"Support Operation Factorization: Compositional Readout of Frozen Vision Encoders under Controlled Interventions","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:26:05.346601Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2608.06174"},"observation_digest":"sha256:69d0c0816f754de52f9d1d2153e51b83b19d5e48058e6b38012dae4911b5a672","observation_id":"700efa35-9b9f-459d-b5a9-e33df4471b86","resolution":{"observed_at":"2026-08-07T13:26:05.346601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.00504/citation-record","integrity":"/paper/2403.00504/integrity","json":"/paper/2403.00504/citation-record.json","paper":"/paper/2403.00504"},"outbound":[],"paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 25 inbound Pith citation observations for arXiv:2403.00504."}