{"as_of":"2026-08-10T10:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6c4c87874f6b1876b1ce0ea30a2da926b435cc449586e2e84fe58ddc2b0ceff2","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:29:54.475780Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:08:13.297661Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:08:16.157991Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"cited_work":{"arxiv_id":"2505.14951","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14951","snapshot_observed_at":"2026-08-06T17:08:16.157991Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","venue":"cs.CV","work_id":"67e1da3b-c710-45f3-a23e-0fbfe242a9ab","year":2025},"citing_paper":{"arxiv_id":"2507.13385","last_updated":"2025-07-15T22:57:29Z","snapshot_observed_at":"2026-08-08T18:52:34.675853Z","submitted_at":"2025-07-15T22:57:29Z","title":"Using Multiple Input Modalities Can Improve Data-Efficiency and O.O.D. Generalization for ML with Satellite Imagery","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T17:08:13.297661Z"},"links":{"cited_paper":"/paper/2505.14951","citing_paper":"/paper/2507.13385"},"observation_digest":"sha256:1a398588c0f8a4954f18e428d90bc808b56ce520f178672f908656c0012ec415","observation_id":"d834033a-ee40-40b4-b0da-f4d01a61f1b0","resolution":{"observed_at":"2026-08-06T17:08:16.257595Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14951/citation-record","integrity":"/paper/2505.14951/integrity","json":"/paper/2505.14951/citation-record.json","paper":"/paper/2505.14951"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:58.305908Z","title":"Multimae: Multi-modal multi-task masked autoen- coders","venue":null,"work_id":"b1bb6476-9431-4153-b267-534f211ecdd9","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.356112Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:0434044794dd9057b859a134997e4723593484f65e6e53306eb1e8769575842d","observation_id":"8abeaa84-cf6c-43ad-a98e-ef34afc4c09e","resolution":{"observed_at":"2026-08-07T15:29:58.407649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:58.095597Z","title":"Satlaspretrain: A large- scale dataset for remote sensing image understanding","venue":null,"work_id":"844fb2a3-7a60-4070-a20f-f8a238844346","year":2023},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.441077Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:19cba735d045b51d0bbd1456b45a4ccbd6fbe0c443446b3520b002a4a93c5e49","observation_id":"103c181d-ca92-4271-8cde-eb9fe46fa57a","resolution":{"observed_at":"2026-08-07T15:29:58.180477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.877451Z","title":"HLS Multi Temporal Crop Classification, 2023","venue":null,"work_id":"504f7f3c-5262-4743-b4a1-52450773425e","year":2023},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.579948Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:6d702456b627f847d1d69133d7934f5aba748c407ca259b30895c3ff0d597836","observation_id":"c043bd61-342e-4b5a-ba6b-0810ce526277","resolution":{"observed_at":"2026-08-07T15:29:57.934653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.785748Z","title":"Satmae: Pre-training transformers for tem- poral and multi-spectral satellite imagery.NeurIPS, 35:197– 211, 2022","venue":null,"work_id":"73d9abda-02c1-4290-b3da-c26c4d9a48e5","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.695559Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:e53285ff2c8feeff78a1e8b4e5bf5337255852553faff771f0bb85560a32d701","observation_id":"bd5c0250-b76b-41cf-a2a9-afe910db9356","resolution":{"observed_at":"2026-08-07T15:29:57.830678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:51.806284Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.806284Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:8e8f6d25df5edf0cc8b704e05ec2cef0d9b1e480b98a1092ba0ad5918bd59efc","observation_id":"9b296322-03bd-43ea-9227-6a46225e8db9","resolution":{"observed_at":"2026-08-07T15:29:51.806284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T15:29:51.936537Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:51.936537Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:57d32cda0cbff4a40203e1b37659adf1ee3e2109ec98023f119ef2aefe2609db","observation_id":"25c6e75f-a217-47e4-9a8c-886635a3df7e","resolution":{"observed_at":"2026-08-07T15:29:51.936537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.632818Z","title":"Croma: Remote sensing representations with contrastive radar- optical masked autoencoders.NeurIPS, 36, 2024","venue":null,"work_id":"a8327077-c6d1-4cc0-a928-9b37617b66bf","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.090685Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:33e71721c255a280783a2cf8a1f4a56f72345a63a6c2c0ff2ca81d6ddb58fca5","observation_id":"c654ea9e-0232-4f7c-9d08-ac6cba409b5a","resolution":{"observed_at":"2026-08-07T15:29:57.696017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.538348Z","title":"Skysense: A multi-modal remote sens- ing foundation model towards universal interpretation for earth observation imagery","venue":null,"work_id":"060e7665-d75d-4fdb-a4f6-8fe3c365af1b","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.205724Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:ed125930e21c5984310a0ad5f9ad8a775606aceb1c5c066d234e6ffb1829f3bd","observation_id":"30ef9799-0805-4057-a7a9-a770b8ee3c4c","resolution":{"observed_at":"2026-08-07T15:29:57.586494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.424559Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"ffe875f4-3086-4873-a51a-459d1b2ef07c","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.368114Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:ed1f849f0e146438ff15d5c35eae5f690a0074a6857a228cb0b84cbc0bdb8de4","observation_id":"b3ff44e5-cb70-4706-9018-9270e62cfc1c","resolution":{"observed_at":"2026-08-07T15:29:57.495808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.291177Z","title":null,"venue":null,"work_id":"b7df32ca-7468-4e70-8adc-f18208dbfe43","year":2019},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.502692Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:cc11f18f4b01d3848967d206a2a7574dca96aded6b9fe6b7155cb7a41f40059f","observation_id":"ece778ca-2009-45ec-b9bd-77e3778c8ff3","resolution":{"observed_at":"2026-08-07T15:29:57.344291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06687","last_updated":"2025-07-10T16:14:55Z","snapshot_observed_at":"2026-08-05T01:14:41.251997Z","submitted_at":"2024-08-13T07:27:02Z","title":"Masked Image Modeling: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06687","snapshot_observed_at":"2026-08-07T15:29:52.563283Z","title":"Masked image mod- eling: A survey.arXiv preprint arXiv:2408.06687, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.563283Z"},"links":{"cited_paper":"/paper/2408.06687","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:e1e241297781c4f736ab478bd615ef57de986e80a9508ef6d6d504c13e9913b7","observation_id":"304e5bbc-e06a-4e57-a0d0-9a73b31ece0c","resolution":{"observed_at":"2026-08-07T15:29:52.563283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.157890Z","title":"Masked autoencoders that listen","venue":null,"work_id":"6325d475-7b54-4620-a852-1e250cb7ddac","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.631096Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:9ac92e90d2a543ea02c8e044a774524cd470bcc2bc14044f249f641d7e5c43aa","observation_id":"80fee846-169f-4578-8233-add4a506f278","resolution":{"observed_at":"2026-08-07T15:29:57.218245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18660","last_updated":"2023-11-08T18:25:24Z","snapshot_observed_at":"2026-07-06T16:39:52.551576Z","submitted_at":"2023-10-28T10:19:55Z","title":"Foundation Models for Generalist Geospatial Artificial Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18660","snapshot_observed_at":"2026-08-07T15:29:52.735664Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.735664Z"},"links":{"cited_paper":"/paper/2310.18660","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:b4115508086eed35d24c25df2618519715c65ca00929b13e8e9d410c781e36af","observation_id":"fc78dbde-2c4c-4696-a112-9268c208b36a","resolution":{"observed_at":"2026-08-07T15:29:52.735664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:57.024513Z","title":"Geo- bench: Toward foundation models for earth monitoring","venue":null,"work_id":"186c194a-ae34-4703-b7c7-c877dd1a2981","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.814349Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:225fc0391677ad9146387daa00fee1741fcc4f96a2df801b1d28bae0995fa121","observation_id":"f32c05a6-7d51-483e-9d03-e173e48032d4","resolution":{"observed_at":"2026-08-07T15:29:57.077347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.920564Z","title":"Multimodality helps unimodality: Cross- modal few-shot learning with multimodal models","venue":null,"work_id":"749ad3f0-0485-45b4-93d2-040d7b92b5db","year":2023},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.905682Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:57c207a751f656a075d390e28732cbe088e06bfa1b1a27fa15d7a01b773935a9","observation_id":"8630e3c1-09c5-41f1-ba7a-9154ef8524be","resolution":{"observed_at":"2026-08-07T15:29:56.960366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.802533Z","title":"Re- moteclip: A vision language foundation model for remote sensing.IEEE Transactions on Geoscience and Remote Sensing, 2024","venue":null,"work_id":"02446a81-4ddc-40b6-9423-11a60d5e0450","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:52.967460Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:c3d263c375a70f9e594a0445fa424226602ad230ae8b59d12beb8de0aeb21ba7","observation_id":"b2ea4498-0e3e-4906-af59-5968c43aef6a","resolution":{"observed_at":"2026-08-07T15:29:56.854441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.628026Z","title":"A convnet for the 2020s","venue":null,"work_id":"968fd43d-650c-4e42-a2ec-037a383c91d3","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.017671Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:5a5b0b6c209478f2d959600e0966d65a567fd390742b6345ca28c5612e4624b3","observation_id":"bb8b4295-8a4b-41c9-aa36-d00daf446721","resolution":{"observed_at":"2026-08-07T15:29:56.716250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02771","last_updated":"2024-07-29T10:35:50Z","snapshot_observed_at":"2026-08-06T10:55:27.379554Z","submitted_at":"2024-05-04T23:16:48Z","title":"MMEarth: Exploring Multi-Modal Pretext Tasks For Geospatial Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02771","snapshot_observed_at":"2026-08-07T15:29:53.100039Z","title":"Mmearth: Explor- ing multi-modal pretext tasks for geospatial representation learning.arXiv preprint arXiv:2405.02771, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.100039Z"},"links":{"cited_paper":"/paper/2405.02771","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:f8c95bbbbca3ca8b3046f3c724e1b5648117d32409e95094a7274211944990a0","observation_id":"c22a0db8-849d-439d-aecf-b0511898dd12","resolution":{"observed_at":"2026-08-07T15:29:53.100039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.360829Z","title":"Rethinking transformers pre-training for multi- spectral satellite imagery","venue":null,"work_id":"9062fd94-7b4b-4762-a6a8-577811e34f77","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.188818Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:66b99208e7afd4e75dbb396ed9f75e81a2acb3964b05bffa3f904b304d9c9757","observation_id":"0b75565f-c42a-4228-a242-2406af6445e1","resolution":{"observed_at":"2026-08-07T15:29:56.488338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18536","last_updated":"2024-09-27T08:15:14Z","snapshot_observed_at":"2026-08-10T01:42:30.307799Z","submitted_at":"2024-09-27T08:15:14Z","title":"How Effective is Pre-training of Large Masked Autoencoders for Downstream Earth Observation Tasks?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18536","snapshot_observed_at":"2026-08-07T15:29:53.273043Z","title":"How effective is pre-training of large masked au- toencoders for downstream earth observation tasks?arXiv preprint arXiv:2409.18536, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.273043Z"},"links":{"cited_paper":"/paper/2409.18536","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:215785b277f191d572f5a3e457aa623729ea5606354d575b0bd9f0a256d1ca5a","observation_id":"e462cdb5-2da5-49d6-8a8c-83fdd31691ce","resolution":{"observed_at":"2026-08-07T15:29:53.273043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:56.174928Z","title":"Ssl4eo-l: Datasets and foundation models for landsat imagery.Advances in Neural Information Processing Systems, 36:59787–59807,","venue":null,"work_id":"78b00f5d-fb58-4c5e-a418-d5848143f73f","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.395956Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:63ea345bf7efe0c5bfcedd6cf2bca83178271c2cab33031f162b2c5c8a13f971","observation_id":"10cc8de0-b885-4996-908d-29d742858b71","resolution":{"observed_at":"2026-08-07T15:29:56.258370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.907617Z","title":"Torch- geo: deep learning with geospatial data","venue":null,"work_id":"9b337b1b-defb-4d4c-a32f-2fbb73f05a0f","year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.526054Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:43bf68263c3d9b98677c49134a5e2eb5a8a57e004d2a473e281acb96d5540c8d","observation_id":"c21eeaab-db24-4163-bf4a-aab4f24a837e","resolution":{"observed_at":"2026-08-07T15:29:56.024179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.780548Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":"51c1cb3f-51c4-4fab-9093-97e31f193d31","year":2023},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.660442Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:9f1f03e10d1003149a4db00f0f126a4118513b954e99d758abb3957d1a5d088a","observation_id":"9ae240aa-34bf-4b6a-9d9d-a9fb5259c9f6","resolution":{"observed_at":"2026-08-07T15:29:55.826704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:53.749122Z","title":"Simmim: A simple framework for masked image modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.749122Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:ee3ee2851311d240a7196cd08e840557443b262213ebb25f55aa3ed30dfde33c","observation_id":"3d7d1e59-244a-4fbc-9c51-2f5aef01a770","resolution":{"observed_at":"2026-08-07T15:29:53.749122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04936","last_updated":"2024-04-02T21:45:06Z","snapshot_observed_at":"2026-07-06T14:03:17.645948Z","submitted_at":"2022-10-10T18:09:35Z","title":"EarthNets: Empowering AI in Earth Observation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04936","snapshot_observed_at":"2026-08-07T15:29:53.796800Z","title":"Earthnets: Empowering ai in earth obser- vation.arXiv preprint arXiv:2210.04936, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.796800Z"},"links":{"cited_paper":"/paper/2210.04936","citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:3725977d43c7f1b4e51379665fd6fa094bea23cb6f03487fa77b7f0c6e9a0f11","observation_id":"0222f482-3379-4dda-a424-a4dd1b8dc624","resolution":{"observed_at":"2026-08-07T15:29:53.796800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.652904Z","title":"Neural plasticity-inspired foundation model for observing the earth crossing modalities.arXiv e-prints, pages arXiv–2403, 2024","venue":null,"work_id":"4bca076d-bc13-4d06-a4d9-ada31905d378","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.836145Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:5c64cb6d933d7cd43310ce7e504060f54ba1449c0e89312fbc46710b6fb5b708","observation_id":"b9a84169-9ba2-4401-bc9c-325d5c3bb5e0","resolution":{"observed_at":"2026-08-07T15:29:55.694192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.545133Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"9477833d-7878-453e-9d45-594573daa679","year":2024},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.918881Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:428e141661cb7c6b70aaf7e441383d3dc3b77627110af03e29d45970056e22bf","observation_id":"d41d6eb0-0403-463d-8662-0eba0f109097","resolution":{"observed_at":"2026-08-07T15:29:55.589747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.444161Z","title":null,"venue":null,"work_id":"f60e40b4-f2bd-463d-b204-f5b71b116350","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:53.993947Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:c49088188cc1149e125806b04bc025cabc5813f0986e56c4d3366a5b04398c11","observation_id":"95d7c543-69a8-48b5-8026-4be353fd28b1","resolution":{"observed_at":"2026-08-07T15:29:55.493268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.318066Z","title":null,"venue":null,"work_id":"405c2e1e-ac44-40b4-b2dd-9bd41b086253","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.050525Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:76e3e1723311dd91aa89afd9927e6e002ff5f29a02fc7168be660f329686406e","observation_id":"f6b4b861-4512-4648-8e56-2911dac23509","resolution":{"observed_at":"2026-08-07T15:29:55.391866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:55.115621Z","title":null,"venue":null,"work_id":"89fb5d9a-d716-4937-9c54-36943700a23f","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.147522Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:fbc119e612d603a76877517e9c806f5bb094d2fea621be8d6c238e0bb72f9412","observation_id":"ab13c586-0fcc-453f-9e67-00bb951be622","resolution":{"observed_at":"2026-08-07T15:29:55.238206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:54.975249Z","title":"Overall, [14] comprises multiple modified versions of standard geospatial datasets for classification and segmen- tation tasks","venue":null,"work_id":"b9d937f4-b303-4cd6-9397-3432931f0713","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.249838Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:bdd52ac00777cae497b5a3dccc075b734dba209196d1a05ac536e71e52ea2de9","observation_id":"53335596-d842-4a59-8443-1322123d38b7","resolution":{"observed_at":"2026-08-07T15:29:55.031397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:54.850278Z","title":"Pre-training objective We pre-train our approach (depicted in Figure 2) using six input modalities: RGB, IRED, SIRED, EB, DEPTH, and SEG","venue":null,"work_id":"637c98be-6524-41cc-91bd-f0a5f8ae84dd","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.305152Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:dad34098ab5efc623ae14acf08c8769b73ff310343fae7fbf5b2ce551a7b0c91","observation_id":"79d90d38-e04f-4499-af64-20188460bc06","resolution":{"observed_at":"2026-08-07T15:29:54.918948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:54.742444Z","title":"Fine-tuning setups for segmentation and classification EO tasks","venue":null,"work_id":"c05eece1-485d-4f7a-a1c6-4a8a4230a298","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.372481Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:206292d372ff85fd048a2f4676574582073aefb23baf27cd54140f2be8288482","observation_id":"d187ac60-e375-4b51-93e7-a4a2f9d796aa","resolution":{"observed_at":"2026-08-07T15:29:54.788137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:54.660278Z","title":"Pre-training visualisations Masked input Prediction Masked input Prediction TargetTarget RGBDEPTHSEGRGBDEPTHSEG Figure 5","venue":null,"work_id":"2ae2dc06-a53a-406a-a318-c0ccacf7db5b","year":null},"citing_paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:29:54.475780Z"},"links":{"citing_paper":"/paper/2505.14951"},"observation_digest":"sha256:040631d7520ef0655574647cd2d5c08f3a90343d79aec2b22b84abe909c49395","observation_id":"744ff84f-45e1-41f5-adf1-1287d2c7d4c4","resolution":{"observed_at":"2026-08-07T15:29:54.690361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14951","last_updated":"2025-05-20T22:24:36Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:24:24.725679Z","submitted_at":"2025-05-20T22:24:36Z","title":"MultiMAE Meets Earth Observation: Pre-training Multi-modal Multi-task Masked Autoencoders for Earth Observation Tasks"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2505.14951."}