{"as_of":"2026-08-09T01:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ef4d5c14baa4631243ac6a282a8b079be74bb67cbe4051fe2f266b74e3ab1a17","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T18:43:48.452812Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T02:49:58.824241Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.04085","snapshot_observed_at":"2026-08-02T02:49:58.824241Z","title":"Unique lives, shared world: Learning from single-life videos.arXiv preprint arXiv:2512.04085, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14228","last_updated":"2026-07-15T18:00:31Z","snapshot_observed_at":"2026-08-08T15:48:16.739576Z","submitted_at":"2026-07-15T18:00:31Z","title":"SeeSE3: Emergence of 3D Space in Vision Features","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T02:49:58.824241Z"},"links":{"cited_paper":"/paper/2512.04085","citing_paper":"/paper/2607.14228"},"observation_digest":"sha256:cd05bcb516323f2ccbfb2c29d52eccc3ea54ce40f7f4edc75853eacb5e6603fd","observation_id":"78791446-e291-4a38-bbda-d49a52715330","resolution":{"observed_at":"2026-08-02T02:49:58.824241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.04085/citation-record","integrity":"/paper/2512.04085/integrity","json":"/paper/2512.04085/citation-record.json","paper":"/paper/2512.04085"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-03T18:43:42.785374Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:42.785374Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:e835c007e8f6e82461df61177dcf1badf5911899d40a192b3b2addfbe7640e5d","observation_id":"d0f71884-f2f3-45f8-92b9-84c6650352e1","resolution":{"observed_at":"2026-08-03T18:43:42.785374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:42.886340Z","title":"Cross-view completion models are zero-shot correspondence estimators","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:42.886340Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:cd17d876e8a6b098108ee638ee073204a20c070747b9684873fe0aa889a19a1b","observation_id":"b0e0356e-481e-43f4-b05d-654ba05a840d","resolution":{"observed_at":"2026-08-03T18:43:42.886340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:43.057083Z","title":"Anonymous lives dataset - a private dataset","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.057083Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:4ceeeab34bc87bf379cf9f1abf4675d93ae6f06b4a50e34ef623e75e69e73024","observation_id":"e9be2665-004d-41a1-97e3-80ece0b92599","resolution":{"observed_at":"2026-08-03T18:43:43.057083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:43.177119Z","title":"Hpatches: A benchmark and evaluation of handcrafted and learned local descriptors","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.177119Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:d50703e1cd401f280e852aca81b364bc609a8840bdea8277ae7a20a45c46be72","observation_id":"2345a7ba-8277-4c94-bd4b-2d461cd01700","resolution":{"observed_at":"2026-08-03T18:43:43.177119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:43.343526Z","title":"Revis- iting model stitching to compare neural representations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.343526Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:d9a63abe2ecb1ad00b1345abcc6eb21c9893c87fa07bf428bc324a623de836a9","observation_id":"1e076b5f-6cb3-47c4-847a-b4bfd6569704","resolution":{"observed_at":"2026-08-03T18:43:43.343526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:43.447799Z","title":"JAX: composable transformations of Python+NumPy programs, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.447799Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:37f4d1edd0d95b86aa94383b4d290e89f757db83fd73b61c847c74edbe6dac43","observation_id":"0f6644c6-34e0-4167-a825-707b40c89189","resolution":{"observed_at":"2026-08-03T18:43:43.447799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15212","last_updated":"2025-07-09T16:58:07Z","snapshot_observed_at":"2026-08-06T10:25:48.518948Z","submitted_at":"2024-12-19T18:59:51Z","title":"Scaling 4D Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15212","snapshot_observed_at":"2026-08-03T18:43:43.563351Z","title":"Scal- ing 4d representations.arXiv preprint arXiv:2412.15212,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.563351Z"},"links":{"cited_paper":"/paper/2412.15212","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:34d9a6dc8f1d031c14be01e03ad30d383049fd7a59760784a0e55a76c6a82ecc","observation_id":"b38649bd-72f1-4353-8d6a-7c3454b70b61","resolution":{"observed_at":"2026-08-03T18:43:43.563351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:43.697566Z","title":"Learning from one continuous video stream","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.697566Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:b835ee549cb05ffe2915257842011c80bb77afa41fb8943e11ed2e3d9551d925","observation_id":"cebf9dcd-facd-4f96-8752-bcdee61a0f42","resolution":{"observed_at":"2026-08-03T18:43:43.697566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:43.785687Z","title":"Multidimensional scal- ing.Measurement, judgment and decision making, pages 179–250, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.785687Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:528207616dd7da22f3f02573632b690f1daa01dd0d8779eb9b6b6cbf240e4826","observation_id":"ea419e8d-713e-4162-85f1-1bdaa8aa51c6","resolution":{"observed_at":"2026-08-03T18:43:43.785687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:43.870676Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.870676Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:1e426283f603a8e2f02b677dc93226b11721b52efebb0fd4feecf8dce2cdc105","observation_id":"0d3a55bf-52c6-448e-b3fe-f64ba782dc9f","resolution":{"observed_at":"2026-08-03T18:43:43.870676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-03T18:43:43.944884Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodality, long context, and next generation agentic capabilities.arXiv preprint arXiv:2507.06261, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:43.944884Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:f01ff7eb6451175cdcf248577352a98db2918eb38f3e237aaa4f688c991cd701","observation_id":"8efb2bb3-a2b4-4e3f-94f3-9f4e4771c1ca","resolution":{"observed_at":"2026-08-03T18:43:43.944884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:44.041736Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:44.041736Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:8a8eded4034166ee2864dacbcb5fd4e0a34119d8d983bba6c570f4e9c94cd89b","observation_id":"15290a38-33d0-46fe-8282-ccd670e8f7f3","resolution":{"observed_at":"2026-08-03T18:43:44.041736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:44.136913Z","title":"Rescaling egocentric vision: Collection, pipeline and challenges for epic-kitchens-100.IJCV, 130: 33–55, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:44.136913Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:a2ccfa4ae6aa0ddba33528de903213e70c5cecaacbe642d82cc1094c75eb10d9","observation_id":"2bd1dc4c-28a4-4898-bc3b-41aa6fb89f53","resolution":{"observed_at":"2026-08-03T18:43:44.136913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:44.249398Z","title":"Depthcues: Evaluating monoc- ular depth perception in large vision models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:44.249398Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:ddc3ab7c1b029f07e35b72589d429ad11e049dc4ebfd4256c498181786b3bd55","observation_id":"3c1825e6-fe21-436a-95d9-875ca8a5522c","resolution":{"observed_at":"2026-08-03T18:43:44.249398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:44.364161Z","title":"Project aria: A new tool for egocentric multi- modal ai research, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:44.364161Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:1266ce4b9c700985d58e9151b651d3e091935693e4c62004502b90fd24591471","observation_id":"8a784ceb-68d4-401b-b3fe-14c47fc8f673","resolution":{"observed_at":"2026-08-03T18:43:44.364161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:44.479834Z","title":"Ego4d: Around the World in 3,000 Hours of Egocentric Video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:44.479834Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:c72b7bbfb61e476158736e5b69e823ae97bb5bc6130c68c451e4c98bcd20346b","observation_id":"345b8eff-b409-4689-824a-713f80c8c5f2","resolution":{"observed_at":"2026-08-03T18:43:44.479834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:44.636196Z","title":"Siamese masked autoencoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:44.636196Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:b45c6c1c9c65fbc86a1343542cf23037f60b0334269960a541df86ebb1e47884","observation_id":"3d4e05e7-6dd2-4359-82bf-b549c552dffd","resolution":{"observed_at":"2026-08-03T18:43:44.636196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:44.752914Z","title":"Learning from streaming video with orthogonal gradients","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:44.752914Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:aa50d58b3bcd701e0e1ab85eb43155046f760d48a93ce8909d2c6634a04efb68","observation_id":"bff055b0-3124-4ee5-800d-421ebf6fa16c","resolution":{"observed_at":"2026-08-03T18:43:44.752914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:44.872548Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:44.872548Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:0448942bb477e079c899db8249c011f09d0440fe82b78ad58b16361f3690f0f6","observation_id":"3c2612e7-4568-44b5-b85e-f9ae19604444","resolution":{"observed_at":"2026-08-03T18:43:44.872548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:45.012341Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:45.012341Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:15b5d0f4a5056788bbd11f8a6bde3dd27450d55aad6039f189625a8680f434a8","observation_id":"d0a18343-580e-4cd3-b99e-2240788a5706","resolution":{"observed_at":"2026-08-03T18:43:45.012341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07987","last_updated":"2024-07-25T09:33:50Z","snapshot_observed_at":"2026-08-06T11:02:06.607024Z","submitted_at":"2024-05-13T17:58:30Z","title":"The Platonic Representation Hypothesis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07987","snapshot_observed_at":"2026-08-03T18:43:45.114739Z","title":"The platonic representation hypothesis.arXiv preprint arXiv:2405.07987, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:45.114739Z"},"links":{"cited_paper":"/paper/2405.07987","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:37045087e65343634b29219018b48f2587af2d3079fcf538978a79e3248fdaef","observation_id":"bbb50894-4253-4d50-81ed-63ccde9bdd94","resolution":{"observed_at":"2026-08-03T18:43:45.114739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:45.214117Z","title":"Space-time correspondence as a contrastive random walk","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:45.214117Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:6b2eb5fe518b87e45168a7fc1a15ba664063e0d9960f23985c24cf7ad25a8eed","observation_id":"dd45bd5a-dd67-4f94-897e-d9b820dd2445","resolution":{"observed_at":"2026-08-03T18:43:45.214117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:45.335134Z","title":"Harnessing the universal geometry of embeddings.arXiv preprint arXiv:2505.12540, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:45.335134Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:a78b10d519b5ee7af8f46722e3ff5825586dca33a19e6dacc5182969d9fdadf5","observation_id":"e0e2176b-3a79-4a33-a8af-345c30cd1986","resolution":{"observed_at":"2026-08-03T18:43:45.335134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-03T18:43:45.428913Z","title":"The kinetics hu- man action video dataset.arXiv preprint arXiv:1705.06950,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:45.428913Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:15fe07117c2f0051717ef4aa13a0ad7ee24102af33fe27a50ba8e2cce95f6512","observation_id":"7a7dcb8e-061c-499c-ae8b-53ea6a8e57fc","resolution":{"observed_at":"2026-08-03T18:43:45.428913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:45.557725Z","title":"Similarity of neural network representa- tions revisited","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:45.557725Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:53825ae78cbe81ee27fa7fe7cecb416fa5f0a986f014d2235bdebb17711ef7b3","observation_id":"cd5c822c-65c9-42d1-a76f-e03254b74426","resolution":{"observed_at":"2026-08-03T18:43:45.557725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-03T18:43:45.692285Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:45.692285Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:bcf9663fb6f74ad782e88a0f57bae953920653856abe585b735eb465d47e385c","observation_id":"e75bcb48-0fba-48bd-87d3-3df781f908bd","resolution":{"observed_at":"2026-08-03T18:43:45.692285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:45.786606Z","title":"Egoloc: Revisiting 3d object local- ization from egocentric videos with visual queries","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:45.786606Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:2a8d3897eb1c2e761cba631088b27ebf06d72f57037531a32e3bc7a1727a55e9","observation_id":"c771b4e1-7b6f-40dd-bd4d-69d6af4c22ad","resolution":{"observed_at":"2026-08-03T18:43:45.786606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:45.868553Z","title":"Do vision and language encoders represent the world similarly? InCVPR, pages 14334–14343, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:45.868553Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:fd4230ec8f1e1f1fdac3f2ff66bd22e1ff890d288035137c8899f7bc61144496","observation_id":"90259259-6b4e-42e2-b1b2-3db7857a0347","resolution":{"observed_at":"2026-08-03T18:43:45.868553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-03T18:43:46.015923Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:46.015923Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:341feabdbe5e34ab9fabc58c0988c13682b73cbf00e803a7eb0477ec6ecab499","observation_id":"8c62fc1d-9ab1-4878-b1ca-97a9cb2521de","resolution":{"observed_at":"2026-08-03T18:43:46.015923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:46.141290Z","title":"Hd-epic: A highly-detailed egocentric video dataset","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:46.141290Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:d28db6337f3db8f3da5052b1e521cb4b30af88b5e9f173c71e9ddadb7ed11c78","observation_id":"8d4b319d-d7b9-4357-94b7-78d3b3050ac9","resolution":{"observed_at":"2026-08-03T18:43:46.141290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-03T18:43:46.272822Z","title":"The 2017 davis challenge on video object segmentation.arXiv preprint arXiv:1704.00675, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:46.272822Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:0b4b3efee95ed12a62b06403bf7bfe73285462e5293f07afdc5854f43183f2bc","observation_id":"a64c078b-b297-478a-b2c0-97afc9406d0b","resolution":{"observed_at":"2026-08-03T18:43:46.272822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:46.401996Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:46.401996Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:a0cc3de5c506f3fc5cf775a82d401dfbff850b53275325256918fcc7d0680c37","observation_id":"38116f7f-9000-46ec-a9b9-9fb5a053505c","resolution":{"observed_at":"2026-08-03T18:43:46.401996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:46.477003Z","title":"It’s a (blind) match! towards vision-language correspon- dence without parallel data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:46.477003Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:942ddd0702e827bd9ac40ff6d4f3edd3572e8b7fd485ca6261cc0e8911a58848","observation_id":"f228106f-4937-4929-a836-0d7420e05a5f","resolution":{"observed_at":"2026-08-03T18:43:46.477003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:46.588204Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:46.588204Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:70a40e28820e95b0883b6ca63a7db4188bfdf3f6f2a86c0afb299ca14dd0d276","observation_id":"95cac456-d049-4a6f-8825-cfbed178b8fd","resolution":{"observed_at":"2026-08-03T18:43:46.588204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:46.724155Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:46.724155Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:7eb8dd982beb1e2806efa4bd6c72cb9cf697f3c7487d9743364cc18a932e4324","observation_id":"ee81fe1d-9fbc-4c8e-9a60-79a36c7c50f9","resolution":{"observed_at":"2026-08-03T18:43:46.724155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:46.833035Z","title":"Raft: Recurrent all-pairs field transforms for optical flow, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:46.833035Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:dc23a6fd8f7fba04063af15356a67f8318d46ea6acb843acbc65e9e8de559e31","observation_id":"ae6a3812-6b19-46c7-b35e-d125de2ccbe2","resolution":{"observed_at":"2026-08-03T18:43:46.833035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16282","last_updated":"2025-06-13T13:11:45Z","snapshot_observed_at":"2026-08-07T17:56:15.257964Z","submitted_at":"2025-02-22T16:27:31Z","title":"Understanding the Emergence of Multimodal Representation Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16282","snapshot_observed_at":"2026-08-03T18:43:47.010177Z","title":"Understanding the emergence of multimodal representation alignment.arXiv preprint arXiv:2502.16282,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:47.010177Z"},"links":{"cited_paper":"/paper/2502.16282","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:71b36ba9469d3ac4d22bb1e3d13b845b9db9550c04652bf865bc68a4de7762b4","observation_id":"0b11eb7f-38f9-4e8d-b97d-0ccb776346f8","resolution":{"observed_at":"2026-08-03T18:43:47.010177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:47.081888Z","title":"VideoMAE: Masked autoencoders are data-efficient learners for self-supervised video pre-training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:47.081888Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:ee82c9ef26959f8e5c563f26f4a35185c298ab862cefdc5ff16f4456676aa728","observation_id":"0e52d83a-1086-45c3-b0df-5b534970b4af","resolution":{"observed_at":"2026-08-03T18:43:47.081888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:47.183623Z","title":"EPIC Fields: Marrying 3D Geometry and Video Understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:47.183623Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:a423bfa2d19804b21f7024604a18d6c265088731c51990c49499bc27127d727d","observation_id":"c5e628e1-be0c-4f0c-a354-902f0db8c435","resolution":{"observed_at":"2026-08-03T18:43:47.183623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:47.284316Z","title":"Is ImageNet worth 1 video? learning strong image encoders from 1 long unlabelled video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:47.284316Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:5cb09145ecdb23f0758c44b7de17de59f3eb308181c44bb80c8aea436754a433","observation_id":"817f61fe-51af-4f6a-a3f0-523fcf6943d3","resolution":{"observed_at":"2026-08-03T18:43:47.284316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:47.392070Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:47.392070Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:ae3bf2e53a1581ab796bc9ec62ce054b47f682e07cecba1793471106ee79a528","observation_id":"bbfff031-e699-440d-b3bc-d430ca9de95a","resolution":{"observed_at":"2026-08-03T18:43:47.392070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:47.502142Z","title":"Croco: Self-supervised pre-training for 3d vision tasks by cross-view completion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:47.502142Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:37471cfa47e237dfbd780bb56db66d4c0099d7da0ccd4fda3dda09fe2034cc6a","observation_id":"9cf923c1-1fdc-4664-88aa-b1c28fdb196f","resolution":{"observed_at":"2026-08-03T18:43:47.502142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:47.816440Z","title":"Croco v2: Improved cross-view completion pre- training for stereo matching and optical flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:47.816440Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:890ac8ce4152f88c8347b5007460ad2ef0b7885d258e4f9cde203ae761280fd7","observation_id":"85cca23e-31a8-471d-99d5-4b3d2084baf9","resolution":{"observed_at":"2026-08-03T18:43:47.816440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-03T18:43:47.983776Z","title":"Qwen3-omni technical report.arXiv preprint arXiv:2509.17765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:47.983776Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:316638d8c66d65469c34860473fbe94e84c0b8530d5c7a59a41698f2ffa1ca08","observation_id":"855413cd-ec50-497a-88fb-fff89b001534","resolution":{"observed_at":"2026-08-03T18:43:47.983776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:48.086198Z","title":"Learn- ing streaming video representation via multitask training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:48.086198Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:3eaca106616fbe8ed2b1ca0e05a1e9115f19c43ac50035a1ce069677e4319f8d","observation_id":"c2c01370-3153-4360-8b3e-1089b2725883","resolution":{"observed_at":"2026-08-03T18:43:48.086198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:48.192255Z","title":"Depth any- thing v2, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:48.192255Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:cd8aa7097c6fe5296f097db290b370bf60f6d9955cd997bcff31a7ef31cb1ce0","observation_id":"1352ab2b-c073-46fb-a9c9-eeedcc706f86","resolution":{"observed_at":"2026-08-03T18:43:48.192255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:48.317953Z","title":"Assess- ing and learning alignment of unimodal vision and language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:48.317953Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:f5fac57d14266b86e1d1f15f781139326e439b323d638c72525a93bf308692e5","observation_id":"ab289efd-c97a-4002-877b-3310a670425d","resolution":{"observed_at":"2026-08-03T18:43:48.317953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:48.452812Z","title":"non-life","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:48.452812Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:39ebe0e586606eb6ce4a4b3686ba96e4d99539be4455ac05392ce16616eb2135","observation_id":"a6f744ba-c303-405e-9799-401841590eb2","resolution":{"observed_at":"2026-08-03T18:43:48.452812Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T18:43:47.657177Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T18:43:47.657177Z"},"links":{"citing_paper":"/paper/2512.04085"},"observation_digest":"sha256:5402068aa62079813854e5338dd0cf2170818be3e5bcae955bb122872f4beddc","observation_id":"c2c61063-88b5-44b0-b7bc-f8132d54fea1","resolution":{"observed_at":"2026-08-03T18:43:47.657177Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.04085","last_updated":"2026-05-26T17:38:05Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T12:33:34.943380Z","submitted_at":"2025-12-03T18:59:57Z","title":"Unique Lives, Shared World: Learning from Single-Life Videos"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":47,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2512.04085."}