{"as_of":"2026-08-14T01:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:517d818e2f859e7dd80b37de349e2874c871be66322ccf150a3b6a71f0346f64","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:59:15.600353Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.03531/citation-record","integrity":"/paper/2602.03531/integrity","json":"/paper/2602.03531/citation-record.json","paper":"/paper/2602.03531"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:11.522239Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:11.522239Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:b9e73e6d0ec91007e3cfc09be6614e2f71ea051ba5495f47a8dfe892e53d7161","observation_id":"2c13e963-8602-440e-86c2-95e9cf134037","resolution":{"observed_at":"2026-08-03T04:59:11.522239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:11.674649Z","title":"Baevski, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:11.674649Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:57c9582ae55d594f879da2c02d0ad343014d9224bdd4130d9f528c2a8681e879","observation_id":"cb5b0b07-54e9-4570-9dfe-f3a0f8d60105","resolution":{"observed_at":"2026-08-03T04:59:11.674649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:11.880012Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:11.880012Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:56fc7f8739162d8faecc7f3e942f8fbdfd6f9905ddfa5531ce0d0fed9829f39a","observation_id":"519a924a-112f-48ba-a97d-0fc74a4bda72","resolution":{"observed_at":"2026-08-03T04:59:11.880012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.06377","last_updated":"2021-12-19T19:23:25Z","snapshot_observed_at":"2026-08-12T16:27:34.120981Z","submitted_at":"2021-11-11T18:46:40Z","title":"Masked Autoencoders Are Scalable Vision Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.06377","snapshot_observed_at":"2026-08-03T04:59:11.993388Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:11.993388Z"},"links":{"cited_paper":"/paper/2111.06377","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:d507c800b99a556b3c818e2f52664d5bfe57e83c7504135abd2dbbaef07110c9","observation_id":"aeff167f-9537-4111-9f93-2ee15444b121","resolution":{"observed_at":"2026-08-03T04:59:11.993388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-13T15:48:10.912957Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-08-03T04:59:12.109849Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:12.109849Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:5243a4f772d811604764f45a795402fa9e718040ba966bb60e9fb862d23a0e86","observation_id":"84bd7a97-51a2-4b91-8160-7386219d12b8","resolution":{"observed_at":"2026-08-03T04:59:12.109849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:12.234021Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:12.234021Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:b57c2dec2c74044a48555d20e2bdd37f8ac5d2cfa0428b28113fd8c2dec1e8ea","observation_id":"9708857c-ffc9-490e-a745-dab554fbeb03","resolution":{"observed_at":"2026-08-03T04:59:12.234021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:12.430485Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:12.430485Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:d24118df4605846d3a651f6657c1c6dd4e5dcd6c8e146e0b8a0ffb8cb441e5d3","observation_id":"bc9cb709-1abd-4320-bb99-655ca1552d09","resolution":{"observed_at":"2026-08-03T04:59:12.430485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:12.601474Z","title":"Devlin, M.-W","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:12.601474Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:9401552af4d738547562d54408e206b9e1231dffc7d752ef932267a1c99f2f52","observation_id":"7572bd5a-4aa5-47ab-91e5-5a7e3ae957f8","resolution":{"observed_at":"2026-08-03T04:59:12.601474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-03T04:59:12.751669Z","title":"Dosovitskiy, L","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:12.751669Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:cb17e23dd7856929d7d3d1fa14e5def9183964182e23496508004538a65a53c4","observation_id":"16c5470b-0125-473d-9062-81245dc8d95d","resolution":{"observed_at":"2026-08-03T04:59:12.751669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14391","last_updated":"2025-04-10T07:50:15Z","snapshot_observed_at":"2026-08-13T04:34:33.961106Z","submitted_at":"2024-01-25T18:49:57Z","title":"Rethinking Patch Dependence for Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14391","snapshot_observed_at":"2026-08-03T04:59:12.894218Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:12.894218Z"},"links":{"cited_paper":"/paper/2401.14391","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:00c15807e36a12d47379baf0c6c1e86f195e5b910cd3206132732ada5852dd5b","observation_id":"35e9024e-fef1-44c0-ab2a-2b5e7e68b37f","resolution":{"observed_at":"2026-08-03T04:59:12.894218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.13137","last_updated":"2023-03-31T09:26:28Z","snapshot_observed_at":"2026-08-13T15:36:14.968124Z","submitted_at":"2022-05-26T04:00:42Z","title":"MixMAE: Mixed and Masked Autoencoder for Efficient Pretraining of Hierarchical Vision Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.13137","snapshot_observed_at":"2026-08-03T04:59:12.999852Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:12.999852Z"},"links":{"cited_paper":"/paper/2205.13137","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:d7f97d84014720ae3df4fc1569043007930ab50d87b8da53766f049ba8e22a81","observation_id":"f09b81c0-9607-43d2-9615-61b5b9cef401","resolution":{"observed_at":"2026-08-03T04:59:12.999852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:13.181730Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:13.181730Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:3606aec6ed07a8b1995688ee28c0896d276b21ef5bdc38644f6951caa1e4cc2c","observation_id":"4ff20df1-da28-4928-885a-26a9782692f5","resolution":{"observed_at":"2026-08-03T04:59:13.181730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03670","last_updated":"2022-02-09T18:33:57Z","snapshot_observed_at":"2026-08-13T16:45:05.643797Z","submitted_at":"2022-02-08T06:15:07Z","title":"How to Understand Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03670","snapshot_observed_at":"2026-08-03T04:59:13.288595Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:13.288595Z"},"links":{"cited_paper":"/paper/2202.03670","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:908343643f157c4745c614ca09fde1bdafe23322f0ac6e8f635d6100633b121d","observation_id":"350b9094-50ce-4f40-bfad-e1b8604da574","resolution":{"observed_at":"2026-08-03T04:59:13.288595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:13.377750Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:13.377750Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:5f21da0e0125f32ee0ed6ce09b61219cc4879f181473c5703172ab1d266124d4","observation_id":"99518f37-e5ac-47b3-9023-8a7725a88bb5","resolution":{"observed_at":"2026-08-03T04:59:13.377750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:13.550968Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:13.550968Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:323189fb137c95c7a374ea9a70e232a5f69ad9579a2cd780781d400ad6de88ab","observation_id":"0e3df566-62af-468a-a578-59a6025a3fe9","resolution":{"observed_at":"2026-08-03T04:59:13.550968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:13.716581Z","title":"Vincent, H","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:13.716581Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:d200c639d2fb6ddc8c0d2bb5ad7b274972799d71102bed684ef60056258e7eee","observation_id":"dbcf0612-34ce-480f-87ae-feca490f3cc8","resolution":{"observed_at":"2026-08-03T04:59:13.716581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:13.784579Z","title":"Ramesh, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:13.784579Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:7b833e8345ff56e80c8c71ae1b4a449c26da9af8908745ac5f70f9b2ad411408","observation_id":"79a3c67a-c515-4ae1-96a9-c0898d8127b8","resolution":{"observed_at":"2026-08-03T04:59:13.784579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:13.837133Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:13.837133Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:95297e4a4aed71fb2bdec85b19ad1af897a3f49011f28643fefbbcb568e6a899","observation_id":"c32fb169-648e-4a0f-98e5-1330b0e4a0b1","resolution":{"observed_at":"2026-08-03T04:59:13.837133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07832","last_updated":"2022-01-27T09:20:49Z","snapshot_observed_at":"2026-07-06T12:08:39.149450Z","submitted_at":"2021-11-15T15:18:05Z","title":"iBOT: Image BERT Pre-Training with Online Tokenizer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07832","snapshot_observed_at":"2026-08-03T04:59:13.942090Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:13.942090Z"},"links":{"cited_paper":"/paper/2111.07832","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:ec302a6ba5668356fe3433c846ade2f391c9f39c227656db15133bc5b00ac571","observation_id":"11d18450-eeb7-44e5-ba5c-0fd587b4f2d6","resolution":{"observed_at":"2026-08-03T04:59:13.942090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:14.000496Z","title":"Kong and X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:14.000496Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:36522b20801423fa4e9ff49035e1cd9bf7bf99d0ba301a2ef2e33cb8bd87515b","observation_id":"601615dc-5c69-4b90-a2eb-ca9c2b1fffec","resolution":{"observed_at":"2026-08-03T04:59:14.000496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01994","last_updated":"2023-12-08T08:07:29Z","snapshot_observed_at":"2026-08-13T05:58:30.375384Z","submitted_at":"2023-10-03T12:08:15Z","title":"Understanding Masked Autoencoders From a Local Contrastive Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01994","snapshot_observed_at":"2026-08-03T04:59:14.086346Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:14.086346Z"},"links":{"cited_paper":"/paper/2310.01994","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:8995e7df40c0de1c25e6df59e46528d68128b8f9fb7f490a869596f58af342b4","observation_id":"7e1b43f3-9444-4f31-8d54-84888133235a","resolution":{"observed_at":"2026-08-03T04:59:14.086346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:14.271585Z","title":"van der Maaten and G","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:14.271585Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:a8ff5f4732579ff0d5b1d2d501dadab5311c027f34f761fb2e729a14272dd567","observation_id":"a0150bab-1a37-4367-ac49-c5926f429629","resolution":{"observed_at":"2026-08-03T04:59:14.271585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1209.0523","last_updated":"2013-04-29T17:49:08Z","snapshot_observed_at":"2026-07-06T02:54:54.690936Z","submitted_at":"2012-09-04T03:59:43Z","title":"Angles between subspaces and their tangents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1209.0523","snapshot_observed_at":"2026-08-03T04:59:14.318126Z","title":"Zhu and A","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:14.318126Z"},"links":{"cited_paper":"/paper/1209.0523","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:3abbc6109ba0af2ebe69f89cac75e0c4a64d6231bddb9f6696dd665864661096","observation_id":"1c5ff8c0-8668-49fe-9149-269a8f85b76a","resolution":{"observed_at":"2026-08-03T04:59:14.318126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00928","last_updated":"2020-05-31T16:59:40Z","snapshot_observed_at":"2026-08-10T11:20:26.295031Z","submitted_at":"2020-05-02T21:45:27Z","title":"Quantifying Attention Flow in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00928","snapshot_observed_at":"2026-08-03T04:59:14.527871Z","title":"Abnar and W","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:14.527871Z"},"links":{"cited_paper":"/paper/2005.00928","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:1f29efdc1697e1a8f5bfa8f7e8a88be40db357d46e803d5e75bb84139d9f8eb8","observation_id":"de3a762a-f2c3-4df9-9c55-292fd0d3c534","resolution":{"observed_at":"2026-08-03T04:59:14.527871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:14.673392Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:14.673392Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:87b64917ff24da7ab74d30eb955a52327a4b2ecda47f87b1da180b6b39d6d05b","observation_id":"fa6fbb19-676f-4862-9e8c-031de56f4ae5","resolution":{"observed_at":"2026-08-03T04:59:14.673392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:14.874209Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:14.874209Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:77e3e5b80931279766ec0b296519c916e5e87fe11b391aaeee4857c3601026d7","observation_id":"56c293ba-c4bb-43e2-b710-127e6e822559","resolution":{"observed_at":"2026-08-03T04:59:14.874209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-03T04:59:15.011599Z","title":"Kirillov, E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:15.011599Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:3dd8e7ca85151e11236ab6b78cb54013ca189f83241c2f46e50203779a5a81c2","observation_id":"e3782464-2202-4636-82a6-2d84e7e99efc","resolution":{"observed_at":"2026-08-03T04:59:15.011599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.12261","last_updated":"2019-03-28T20:56:37Z","snapshot_observed_at":"2026-08-13T18:06:38.507585Z","submitted_at":"2019-03-28T20:56:37Z","title":"Benchmarking Neural Network Robustness to Common Corruptions and Perturbations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.12261","snapshot_observed_at":"2026-08-03T04:59:15.229792Z","title":"Hendrycks and T","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:15.229792Z"},"links":{"cited_paper":"/paper/1903.12261","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:64f138334d3fdd0c53c67177cfa6199fc1f18ab6ac9b772c017e893005751cd2","observation_id":"ebf8225e-5bf3-42f7-8a3c-4d53749e193c","resolution":{"observed_at":"2026-08-03T04:59:15.229792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:15.416075Z","title":"Hendrycks, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:15.416075Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:60ed3999d23ecfc33b4d33d911a110c14c743adc7e45ee0a13d911d421620a93","observation_id":"a693f477-7f8d-459b-a05a-05affc0a5b0a","resolution":{"observed_at":"2026-08-03T04:59:15.416075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:59:15.600353Z","title":"Hendrycks, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:15.600353Z"},"links":{"citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:6dd57b6fc4864df49db108ed56227f7f1fee83d42bdc9c22b197eab756850f10","observation_id":"3ebb9ea5-dc5e-4335-a6b7-3d34672e3729","resolution":{"observed_at":"2026-08-03T04:59:15.600353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T12:56:24.517658Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2602.03531."}