{"as_of":"2026-08-20T10:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:861d31080ae8bae4f93f7431f816471c0060f06dd7e716a4a22d33f6b98fccd1","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T19:28:40.097236Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.00706/citation-record","integrity":"/paper/2606.00706/integrity","json":"/paper/2606.00706/citation-record.json","paper":"/paper/2606.00706"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Self-supervised learning from im- ages with a joint-embedding predictive architecture","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:8fc1ea1babd8d7b5e659994a4ee3859069d22bae58bc980fff122ac1aab0703f","observation_id":"6dc5a693-6cd6-4246-94e3-f0b97e0b017d","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Anysat: One earth observation model for many resolutions, scales, and modalities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:15a7bb6c86e857d54c631242883c7e313da9cb5160ceb962961ebff75e6bb42a","observation_id":"7cb5b3cb-66b8-4ec6-a7a0-ca0ade9b2fe3","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.08544","last_updated":"2025-11-14T08:38:32Z","snapshot_observed_at":"2026-08-18T08:21:10.395771Z","submitted_at":"2025-11-11T18:21:55Z","title":"LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics","version":3},"cited_work":{"arxiv_id":"2511.08544","doi":"10.48550/arxiv.2511.08544","metadata_source":"pith","pith_arxiv_id":"2511.08544","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics","venue":"cs.LG","work_id":"b2114616-92b2-4b9a-80db-89bda6422f4e","year":2025},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"cited_paper":"/paper/2511.08544","citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:d831ec4c25fde9af1068d81c6284f124852d320ce98bb4fe4cce81403b4929ad","observation_id":"a9d889b6-5657-4d55-9405-7b14095deae9","resolution":{"observed_at":"2026-06-28T19:32:34.935135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:37.72859+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:37.72859+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04906","last_updated":"2022-01-28T12:23:37Z","snapshot_observed_at":"2026-08-12T14:02:29.797842Z","submitted_at":"2021-05-11T09:53:21Z","title":"VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":"2105.04906","doi":"10.48550/arxiv.2105.04906","metadata_source":"pith","pith_arxiv_id":"2105.04906","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised Learning","venue":"cs.CV","work_id":"dd0c07ab-b662-43f9-8bb4-3a74ae17a824","year":2021},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"cited_paper":"/paper/2105.04906","citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:c495cffacabe90518a4a01d1d57a01058e2a93d75fce5b05799efd64bf41c369","observation_id":"60e44f25-10e7-4863-98e1-5d133f6a153e","resolution":{"observed_at":"2026-06-28T19:32:34.932466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:38.808927+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:38.808927+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Mul- tilabel remote sensing image retrieval using a semisupervised graph-theoretic method","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:f83a05af56c03a7b9ac697e7dad4cf9fd4c2419c7bc76f88919f8bb8f5094c75","observation_id":"f8e584a2-47e0-4f0b-993c-31b461de86b8","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Cmir-net: A deep learning based model for cross-modal retrieval in remote sensing.Pattern Recognition Letters, 131:456–462, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:4a8c5d4998f3a202f80520f9479b9ccc4f1551266c6a070fd88282317d8f058e","observation_id":"4269ee31-049a-4fc2-8cdc-4ed1fe3be991","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Boosting cross-modal re- trieval in remote sensing via a novel unified attention network.Neural Networks, 180: 106718, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:91038cb265a8c5a2703b26cba8d35b8d00c0e89e7af502ee8fb9360d3b4d9a6b","observation_id":"d432ca81-5c19-422a-9fcd-66c8a01cc071","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Rejepa: A novel joint-embedding predictive architecture for efficient remote sensing image re- trieval","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:efc2fe6efeb28917cc9f4d6b838dab035a32111652cba673fe1e5f17c2340cb9","observation_id":"95b8df18-0c67-4a51-9a60-b662af2fa803","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"X-jepa: A novel joint learning cross-modal predictive alignment framework for remote sensing image retrieval","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:0199e7ce788d149d0ab8595678058ce59ae90cee95bbe28383df27d034a1ccdc","observation_id":"379825f3-eaeb-46d5-a687-dc1f4ca84a81","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Satmae: Pre-training transformers for temporal and multi-spectral satellite imagery","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:89860c494efbec59902d9bcfb412250998256ef0ad6b99bd0e23c9bacac4d90f","observation_id":"0bd9ae57-257b-437f-b56f-02462672c7de","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13518","last_updated":"2026-04-15T06:04:45Z","snapshot_observed_at":"2026-07-06T23:01:28.082506Z","submitted_at":"2026-04-15T06:04:45Z","title":"From Alignment to Prediction: A Study of Self-Supervised Learning and Predictive Representation Learning","version":1},"cited_work":{"arxiv_id":"2604.13518","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.13518","snapshot_observed_at":"2026-06-28T19:32:34.941673Z","title":"From Alignment to Prediction: A Study of Self-Supervised Learning and Predictive Representation Learning","venue":"cs.LG","work_id":"103e41f3-dcdb-4229-b21c-9a91fe5e81fc","year":2026},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"cited_paper":"/paper/2604.13518","citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:cc3154afc3ecb0b52c37a30df51c0ea7db0aa17cfec3d678a4cf58d02c6a5a1b","observation_id":"916123d8-83ea-4c25-bcb5-b887d24238a8","resolution":{"observed_at":"2026-06-28T19:32:34.942989Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Croma: Remote sensing repre- sentations with contrastive radar-optical masked autoencoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:497749a1789a77e16efc5211c446510b71b52dafb97598ffda4329b4cfed0728","observation_id":"01a754f4-8ee5-4c58-a14e-6759dd221bee","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Skysense: A multi-modal remote sens- ing foundation model towards universal interpretation for earth observation imagery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:526a041939847ab968f807a03e87b5e03cbd3987e1272475ef5e44d2ac14dc7d","observation_id":"0765c8e5-dfc6-463b-948d-a9f6bb98dd2c","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"X-clpa: A contrastive learning and pro- totypical alignment-based crossmodal remote sensing image retrieval.Expert Systems with Applications, 308:131169, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:7a6321b43ac3d35596d027ba680f821b835694ba95c561f2f116f95b6e43dd8b","observation_id":"900bc715-6ac5-40cc-a947-e02f2246fe4a","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.14104","last_updated":"2026-08-17T11:40:20Z","snapshot_observed_at":"2026-08-20T08:15:11.001940Z","submitted_at":"2025-09-17T15:47:18Z","title":"CSMoE: An Efficient Remote Sensing Foundation Model with Soft Mixture-of-Experts","version":2},"cited_work":{"arxiv_id":"2509.14104","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.14104","snapshot_observed_at":"2026-08-18T03:17:15.671235Z","title":"Csmoe: An efficient remote sens- ing foundation model with soft mixture-of-experts.arXiv preprint arXiv:2509.14104, 2025","venue":null,"work_id":"a6687f68-ac7a-4ceb-b09e-f74d77af9a8d","year":2025},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"cited_paper":"/paper/2509.14104","citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:5dfe382498e26f26ab734c21b54599041381b007fb273dd96221ec3ab7b89cbf","observation_id":"66f20dfa-8e1d-455c-9026-4de34a07c507","resolution":{"observed_at":"2026-08-18T03:17:15.671235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Explor- ing masked autoencoders for sensor-agnostic image retrieval in remote sensing.IEEE Transactions on Geoscience and Remote Sensing, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:83cbcee62496e3be88a1d7188a0b1923505e39a4aaabdb89fc05caae89d00683","observation_id":"e5c90e20-599f-41c8-bb35-7734b664ff14","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Geomeld: Toward semantically grounded foundation models for remote sensing","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:53d6c88eae447bec900e08d009f5bf58ff78471928b416a117bd9c9dc6f56255","observation_id":"0a698709-8a68-4046-ae8e-ead15660dc0f","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:a2b57b3031e638df3e30b8558725197d9ad433db82914b0d0f28c8e973e6037d","observation_id":"46b91055-c326-4589-919c-bc4b40a76a02","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"OT-PFCNet: A generative pre-alignment framework for cross-domain remote sensing retrieval","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:274d500798eeac0b0928cde04ec94eca4885a92189425d7277c0e481e7defd32","observation_id":"0b50fbaa-000e-4e87-8660-3aeb354454aa","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:b2a83d42b72486dcc3a149438fd758ffb0439f7c19dffcc89f56d4cebb801cbc","observation_id":"8bd5a32c-de64-4151-b653-8feb3b60594e","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:1c292854d8ad7472266c10641021cc0f13d15b6e73f4a18ed7652f80c37cc80b","observation_id":"2c22207d-aa69-4b06-8368-e382ff268801","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Image retrieval from remote sensing big data: A survey.Information Fusion, 67:94–115, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:f23286be0a9b8ba00aaef8bf899c834f99ad317863e185dbcd4c244504d1fd54","observation_id":"3eb9f827-d89c-4539-abf6-1732194ae63a","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:4a653f3d2b2da75abbeb8bf328bebb555ef72379daafe13a03a84db57571e351","observation_id":"3a817393-e32e-4fc0-9f47-f69c22850ff5","resolution":{"observed_at":"2026-06-28T19:32:34.940455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Cross-source image retrieval based on ensemble learning and knowledge distillation for remote sensing images","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:60afb82f477693ec650838cdacdfa3c051c2c2d4021f07f55df8f42cece338ee","observation_id":"3b6f4d99-cb9d-4747-9061-d69620a60e28","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Rethinking transformers pre-training for multi-spectral satellite imagery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:ce2c9b7d29a6df635c2272b0188081a1e191c20da022086bb41db21f429a6312","observation_id":"6ed75f5d-a88f-4bb4-bbe6-8b554344081b","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Reed, Ritwik Gupta, Shufan Li, Sarah Brockman, Christopher Funk, Brian Clipp, Kurt Keutzer, Salvatore Candido, Matt Uyttendaele, and Trevor Darrell","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:3bf1cfc3ae4e41500cad05c5901f18dff2869a792a889b4c7e2d29dbda288d5e","observation_id":"3c215f7c-17d0-4c55-b781-2cabb73af49f","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Performance evaluation of single-label and multi-label remote sensing image retrieval using a dense labeling dataset.Remote Sensing, 10(6):964, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:f3cdd6b621881428993c14ab085f320e9b024c32489501e55a6acb12e853cc73","observation_id":"c0edd712-ffaa-4516-8875-80689198929d","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Multilabel remote sensing image retrieval based on fully convolutional network.IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing, 13: 318–328, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:7583de9b6f49e05526c00c2af4aa199fa85e8a7052b9c37e33d876e7aabd7adc","observation_id":"79437e88-f693-4e50-ba68-4e408713d834","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:2e001af8b7801019f3c7ae113d43fb06c20efad74f6ea538dabfa85be898992a","observation_id":"36b70e65-8c6a-4342-b769-417188afadfd","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Bigearthnet: A large-scale benchmark archive for remote sensing image understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:e6aa57518532eabf9304e764f76a0fcccd5a7fbdaa779e11581e94bb41c35105","observation_id":"efb00ba1-b3ca-4af6-a2c2-c68daf3c4f33","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:659886ce4b03642371f5438a5507af97fdd33cf70747ea7f577ef401b8272e46","observation_id":"b6e90a69-ca17-4f90-933b-afcb55c52c38","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"A novel self-supervised cross- modal image retrieval method in remote sensing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:81004ee2762e77c3bce30dfda9904feef722da74776135910e92762aa2685245","observation_id":"d439082d-55c8-4a5d-8bb5-dd70e85ff74a","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:1ea723966355fb675d4d7922b4a957cd23eb792767cf580e099640172bc1fbf6","observation_id":"2eb170c5-59e7-42b4-b1f5-1d0ae79f1bce","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Cross-scale mae: A tale of multiscale exploitation in remote sensing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:92ce7fb1d000d54b16a9db96981596f8a26698ffd362ebd8d99ad4222636d665","observation_id":"974ca763-0235-40cc-8c94-a9ce3d17c6b3","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"A survey of deep learning based remote sensing image retrieval.Remote Sensing, 14(5):1323, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:197f69c0df5bca8eb4830afbea80e61286df4e8ecd74d9f766dd62b43cd8b94c","observation_id":"7b9cd411-203c-483c-bf64-23dc73e2c457","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Albrecht, and Xiao Xiang Zhu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:746b5fa6cb893dc9259f6e07854cb27d7f9743084807b609e1b5030d83cfbef1","observation_id":"19dc9480-02b7-48a1-b0d3-0a316aefc637","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Albrecht, Nassim Ait Ali Braham, Chenying Liu, Zhitong Xiong, and Xiao Xiang Zhu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:b420d7209fe97738be3984eff4b2dc65367bebe70f5d4af6e135f5ecc0458a6d","observation_id":"93220c9c-4fb3-416c-8adc-fc4f6477d7db","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Robust cross-modal remote sensing image retrieval via maximal correlation augmentation.IEEE Transactions on Geoscience and Remote Sensing, 62:1–17, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:5047cb9b28a5fafa9f2348c124336eff3c84362ffadf4077a75177a5128e1bb6","observation_id":"ddd6527c-8ff3-4394-8723-5ac1fcdb1c9d","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:bd98d53700c3c0b179973ae62f3c46e9b7f6a14848dcaac248645242b7f157ca","observation_id":"788e5c79-2755-4ce8-b55d-1f063707c3af","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":"Frequency-guided mutual distillation for lightweight cross-modal remote sensing im- age retrieval.IEEE Transactions on Geoscience and Remote Sensing, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:3b6a6e01d69f742745175fad142759fb6de4f37c562c8290818ca7b11884597d","observation_id":"5c6b9449-bc6c-43dc-af51-2f22ee0566a2","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:d1494ff0f2f04b58828c319bcf6d3cb11a3484466c7025fc344e4c10ac237503","observation_id":"4f2fccf8-64e1-45e8-919a-8106512dea95","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:28:40.097236Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:60adc458ab45f77d45eafb9c8428b908c63c6e5022b58bc854e721e471c65094","observation_id":"0e7f7235-11a0-4882-8907-709af3b93da8","resolution":{"observed_at":"2026-06-28T19:28:40.097236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2475.5575","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:32:34.936413Z","title":null,"venue":null,"work_id":"3fb86a94-3c75-4f77-b537-2a5b94733c35","year":2024},"citing_paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T19:28:40.097236Z"},"links":{"citing_paper":"/paper/2606.00706"},"observation_digest":"sha256:30558a071abcb4345107d20e2c5dcf809e2ddaca7268448db0f93f060af28a89","observation_id":"5c1ab454-53ef-4449-a511-5dcdf83cdbb4","resolution":{"observed_at":"2026-06-28T19:32:34.937867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.00706","last_updated":"2026-06-06T17:41:51Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T13:24:20.233463Z","submitted_at":"2026-05-30T12:29:46Z","title":"CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2606.00706."}