{"as_of":"2026-08-17T20:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:373767bcaa75ac7f779593c648b6d879ef8108329abdb97ba35c723bbbb4e6fe","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:04:25.391939Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15746/citation-record","integrity":"/paper/2411.15746/integrity","json":"/paper/2411.15746/citation-record.json","paper":"/paper/2411.15746"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.060296Z","title":"Asano, Christian Rupprecht, and Andrea Vedaldi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.060296Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:89f0765e8a19e995f5fd8dd134a023f664a879d170cb3e41a2f8cdf3ed2fd39f","observation_id":"2bccd7cc-8a6f-412d-b944-65154ae78664","resolution":{"observed_at":"2026-08-12T14:04:25.060296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.343276Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":"3f9e95bf-9878-40ac-a92c-34100529a21f","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.065171Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:671df97d1f0b4fcaaeff239332c94ce59324a670b726720aae0f9d44f0c26bf3","observation_id":"3e3efe8f-192f-4413-b5da-c9048eb83cfd","resolution":{"observed_at":"2026-08-12T14:04:26.347538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.325294Z","title":"BEit: BERT pre-training of image transformers","venue":null,"work_id":"11f44744-a77b-4b47-a8fa-6f726094d0db","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.069810Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:c55809a555d40e64b46665224e118cbe4fc023b8d8fbc2ccf3f5dd6bdb918cf2","observation_id":"c4106495-22bd-46a9-8f59-93c26e194aa9","resolution":{"observed_at":"2026-08-12T14:04:26.332029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.074337Z","title":"Unsupervised learn- ing of visual features by contrasting cluster assignments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.074337Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:204659562186c6fef446c849fe82cac5f6482972c48b26e0e99dfdf714f94748","observation_id":"7e9a66e3-3a6f-4d3e-bb15-687447495b88","resolution":{"observed_at":"2026-08-12T14:04:25.074337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.079390Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.079390Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:8698197b2c304b57887917113a957bcc2058f2772a4a041c65e3dabbc66af2c4","observation_id":"44eb8de0-e690-4137-af4f-ead3c15ea580","resolution":{"observed_at":"2026-08-12T14:04:25.079390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.00790","last_updated":"2025-03-22T21:25:12Z","snapshot_observed_at":"2026-08-17T06:17:17.735453Z","submitted_at":"2022-06-01T22:46:34Z","title":"Efficient Self-supervised Vision Pretraining with Local Masked Reconstruction","version":3},"cited_work":{"arxiv_id":"2206.00790","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.00790","snapshot_observed_at":"2026-08-12T14:04:25.487535Z","title":"Efficient Self-supervised Vision Pretraining with Local Masked Reconstruction","venue":"cs.CV","work_id":"9163e492-87de-4a45-8eab-1fc931790641","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.084499Z"},"links":{"cited_paper":"/paper/2206.00790","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:87caf73c1ca8c9f288864688c512cf49c9a4d486756e8302e64722dd1407c371","observation_id":"f3e9acc0-1c77-475c-8225-b1e9ba923b94","resolution":{"observed_at":"2026-08-12T14:04:25.491864Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.090265Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.090265Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:b7bfd1a7ece9c5307a888f65d39957d8bbcb61954ff114b66cbfddfb90b7f1ff","observation_id":"52dd3f71-bc1c-4bad-ab48-d073ead63718","resolution":{"observed_at":"2026-08-12T14:04:25.090265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.271817Z","title":"Exploring simple siamese rep- resentation learning","venue":null,"work_id":"dcc5dc26-32a2-446b-ab3d-a158dc3baa4a","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.095855Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:76ab9e18fa2ecd27c3dfae8875c93e6ab2eeda4d9863a5b442e10b7bcb95e90f","observation_id":"a6d8a846-3fbf-4e45-b6c4-bf7821d0a028","resolution":{"observed_at":"2026-08-12T14:04:26.276654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.258859Z","title":"Context autoencoder for self- supervised representation learning","venue":null,"work_id":"5a344b84-c12f-4985-9173-5d08adc8b849","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.101755Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:9fcbaae0cf1047fc22d0ac03f23139fb7e8baef41ed7e69d088acfb795389c5b","observation_id":"9c47df7c-d3bb-4e64-9677-7a795859d84b","resolution":{"observed_at":"2026-08-12T14:04:26.263450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.243714Z","title":"Dalal and B","venue":null,"work_id":"d0373d52-7f15-417a-8826-988c3e40b025","year":2005},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.106527Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:18ee4bdbe5494daf46f739519952dcda482f5e3a677212c23638bd1063b0ed81","observation_id":"9c1ed7c5-d8c6-4732-848d-2a78b13b7e77","resolution":{"observed_at":"2026-08-12T14:04:26.249408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.228484Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding","venue":null,"work_id":"04ad9ed5-0e62-43f8-bc23-a9882629c3a8","year":2019},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.110594Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:6813ecfc85e3acf2f9625801269d6d408234fa6f6852762a5aa2404bbb337253","observation_id":"e24ecf00-64e4-4c94-bbf3-a0b7e0647bad","resolution":{"observed_at":"2026-08-12T14:04:26.234776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.213626Z","title":null,"venue":null,"work_id":"016bd798-808f-48c9-a2ed-5ea6589c0b1b","year":2015},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.114640Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:0df94e777902aa6d830752794d7e23dbafab7ce91c3dd1d95c51eda85b4a9bee","observation_id":"d8d641b9-f394-4372-b32a-6817dac5c8d3","resolution":{"observed_at":"2026-08-12T14:04:26.218436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.193243Z","title":"Bootstrapped masked autoencoders for vision bert pretraining","venue":null,"work_id":"8057e319-f3fe-41ce-8df0-723a45f57432","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.119838Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:8400a1df310ded4ec72504e8fa524a3bb3d148c5e7bf05cacdba861b85d88127","observation_id":"90de3fc6-f1e2-4e96-adf2-38ea1ab5d3ac","resolution":{"observed_at":"2026-08-12T14:04:26.200563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.178113Z","title":"Peco: Perceptual codebook for bert pre-training of vision transformers","venue":null,"work_id":"cebabeb6-18a7-4bdd-8f68-679d61f92ad0","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.123842Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:b1582c123c16cf2edaa0e1b6b1152b937e946e46f53376133c72055eba922ce1","observation_id":"f48001fc-ea14-48da-a36e-cdc4988c1874","resolution":{"observed_at":"2026-08-12T14:04:26.181675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.166365Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"51452c6c-96ba-42e1-843c-88ec6e7022ee","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.128233Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:288323b9a152dde8cb6478486cbe79d6f9a1559075bf4e715e92213506cf1985","observation_id":"674ae8ea-eed7-4bb3-96e9-ffdeae51c13c","resolution":{"observed_at":"2026-08-12T14:04:26.169857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.155132Z","title":"With a little help from my friends: Nearest-neighbor contrastive learning of visual representations","venue":null,"work_id":"1197858e-1d3c-418f-9ae9-fc220c93d1c2","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.131947Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:1e41dc55cf7fd79657eaf74dbbd9fa87aa7b98856fcbbe3580b46f2366914ad8","observation_id":"43d0a2e5-04de-4c66-9eab-9560b426cf6f","resolution":{"observed_at":"2026-08-12T14:04:26.159225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.136017Z","title":"Whitening for self-supervised representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.136017Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:857c271002045abdc4ec8b871065749cdb848ba290e7651295b1a43129ca5488","observation_id":"16566af1-258d-4ede-bde8-e559fd64590d","resolution":{"observed_at":"2026-08-12T14:04:25.136017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11016","last_updated":"2022-10-20T04:49:56Z","snapshot_observed_at":"2026-08-16T18:59:29.227434Z","submitted_at":"2022-10-20T04:49:56Z","title":"Towards Sustainable Self-supervised Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11016","snapshot_observed_at":"2026-08-12T14:04:25.140960Z","title":"Towards sustainable self-supervised learn- ing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.140960Z"},"links":{"cited_paper":"/paper/2210.11016","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:fedcf2e8e7cccb3b77f0453702a184626d3fa7c0a7272ae36dcb90892b45f542","observation_id":"5f91a77a-cdba-4d6e-94da-982044917bf4","resolution":{"observed_at":"2026-08-12T14:04:25.140960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.145392Z","title":"Un- supervised representation learning by predicting image rota- tions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.145392Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:d0417b9ea5ecf2d81602d5469764df001c55cd9e740f83b69c58f230c313087c","observation_id":"fcadd465-4ed8-4b68-bc9c-0abf29230c13","resolution":{"observed_at":"2026-08-12T14:04:25.145392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02677","last_updated":"2018-04-30T21:53:41Z","snapshot_observed_at":"2026-08-09T05:23:26.365677Z","submitted_at":"2017-06-08T16:51:53Z","title":"Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02677","snapshot_observed_at":"2026-08-12T14:04:25.150310Z","title":"Accurate, large mini- batch sgd: Training imagenet in 1 hour","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.150310Z"},"links":{"cited_paper":"/paper/1706.02677","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:21027c6d8a176a933e77f5e64bb3b556f25f87fbf7dc0000ce0900110571e9d4","observation_id":"617b3666-26f2-47ee-b98f-7d19622d2fd0","resolution":{"observed_at":"2026-08-12T14:04:25.150310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.128871Z","title":"Richemond, Elena Buchatskaya, Carl Doersch, Bernardo ´Avila Pires, Zhaohan Guo, Moham- mad Gheshlaghi Azar, Bilal Piot, Koray Kavukcuoglu, R´emi Munos, and Michal Valko","venue":null,"work_id":"8587b55f-7175-4c3b-8217-9d6026341202","year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.154476Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:da0515d25f72da6434bcb106652fd12907cc1a074e5413196d780b88bcf84f65","observation_id":"80b4f584-a28b-47d4-a434-1afe08d00001","resolution":{"observed_at":"2026-08-12T14:04:26.133073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.113608Z","title":"Mask r-cnn","venue":null,"work_id":"e9c4bf37-2b18-4e56-8d01-181d50fe1883","year":2017},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.158769Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:e15ccd9c251f4b7dd62188f8599fec1f10defaba5c03a1cdb7517d72c2bc8d94","observation_id":"3ea07373-12c9-4988-9f0f-527e2328050b","resolution":{"observed_at":"2026-08-12T14:04:26.118694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.162530Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.162530Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:6d00a14bd13524eac841c73b12b1b3836e2025bd2c272d074f8cabbecd4e7b99","observation_id":"633f1f6d-e520-48a9-822f-cf0bddbaf119","resolution":{"observed_at":"2026-08-12T14:04:25.162530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.087955Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"fb1fa663-76a1-4407-a06d-70aac5abea06","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.166996Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:3b8db8fa48a582d04c4a8a4fb4993c766fa705d28cacadf09709f6fbbf0da368","observation_id":"2f9db356-e5f8-4e0b-bea9-2312bfe85f38","resolution":{"observed_at":"2026-08-12T14:04:26.091979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.075588Z","title":"H ´enaff, Skanda Koppula, Jean-Baptiste Alayrac, Aaron van den Oord, Oriol Vinyals, and Jo˜ao Carreira","venue":null,"work_id":"0a9e6b96-0614-4419-a75f-196096d1d237","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.171011Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:8e51034a5371b3c29b7d56e312226092829e680979d5040ef4d42f4a7c4e2999","observation_id":"bb39384a-f3df-4cca-8a04-0a7571b77917","resolution":{"observed_at":"2026-08-12T14:04:26.079924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.063128Z","title":"Benchmarking neu- ral network robustness to common corruptions and perturba- tions","venue":null,"work_id":"fcddd6f9-041a-45dd-b946-b97703a4f2be","year":2019},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.178242Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:ad7b1ae8d6bc2815e447cf1d28563a543e026bef2600e93c1af1a9dc12621960","observation_id":"61d26aa2-8ea3-4784-be9f-bc31dbd2d37d","resolution":{"observed_at":"2026-08-12T14:04:26.067797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.050839Z","title":"The many faces of robustness: A criti- cal analysis of out-of-distribution generalization","venue":null,"work_id":"a1844c02-3146-46e4-8bc4-5121f73f0cfd","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.183406Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:1a8a645501aeced64ef2ef57fefe34e9d4116e306c73dc7f5b34f800bd1ecdce","observation_id":"11e105f7-ffa0-4125-8736-91b3cb60c756","resolution":{"observed_at":"2026-08-12T14:04:26.055168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.036971Z","title":"Natural adversarial examples","venue":null,"work_id":"1ddacc87-44fe-4bf2-86b6-3b05bd061941","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.190406Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:58def8119656a9b4a7dd556d1dfd6f0afeb4b08c790d6e2fcb31de204d3d104c","observation_id":"031ab2b9-15b1-4d15-a299-6bea818ec001","resolution":{"observed_at":"2026-08-12T14:04:26.042065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.019799Z","title":"Green hierarchical vision transformer for masked image modeling","venue":null,"work_id":"1ddba9a2-cf41-4364-bbf5-945899aa0ae4","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.195851Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:64eefdf82b7d6520e7cd2baef97407957e7e7c5c07982d3556f2b2b8747acb0e","observation_id":"f14ae98d-9f48-4e7d-b74a-d3a4fce01928","resolution":{"observed_at":"2026-08-12T14:04:26.024670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:26.006775Z","title":"Contrastive masked autoencoders are stronger vision learners","venue":null,"work_id":"82a9c668-8efd-4224-bf8e-7265331d1f15","year":2024},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.200995Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:2511ac3a8d9219702493b7697527cf768bb304fa4c712e4ba39c05d16e43cd05","observation_id":"ad48ad89-1438-43c4-a95c-88a3a4421cb6","resolution":{"observed_at":"2026-08-12T14:04:26.011029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.994957Z","title":"Mean shift for self-supervised learning","venue":null,"work_id":"82bf6838-2a11-4ce4-8546-ffd00c455b69","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.204799Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:08c398dd3ffaa462464883a9425feecbaf57eaed156c5d4246abf439c5cd6c11","observation_id":"a7d578ce-a379-4122-b481-87567cf8df58","resolution":{"observed_at":"2026-08-12T14:04:25.999077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.982888Z","title":"Colorization as a proxy task for visual understanding","venue":null,"work_id":"7a652263-389a-4a3e-9df1-39f117dab62d","year":2017},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.209023Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:9a3fb24757cc5849f2fd0225cad47371a0ca2432eeb7676a945607cf445ea57e","observation_id":"6b791629-2ce3-46cb-9fcc-7c99cef5a20b","resolution":{"observed_at":"2026-08-12T14:04:25.987025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.969979Z","title":"Semmae: Semantic-guided mask- ing for learning masked autoencoders","venue":null,"work_id":"7379b0db-9bf8-4131-8f82-2a58ed941e1f","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.214024Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:48c63a717e1839bbac2a71570b709dd1fc5de5e480873160feb1cc00da9ac71c","observation_id":"b3920c9a-f62f-42dc-966e-e10ef39197f1","resolution":{"observed_at":"2026-08-12T14:04:25.974848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.956911Z","title":"Exploring plain vision transformer backbones for object de- tection","venue":null,"work_id":"852539ba-5060-4dde-81d7-0be95b91ca86","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.219025Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:577a387ea7aff36794a9862b160ebbe79b8f6a5bf77be3837786b3b2763f53d7","observation_id":"fab8c5f1-5960-4843-a0bd-4172c725e8a7","resolution":{"observed_at":"2026-08-12T14:04:25.961698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.944626Z","title":"Sere: Exploring feature self-relation for self-supervised trans- former","venue":null,"work_id":"010b5224-4807-424e-b379-32572cb6d062","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.223966Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:4c1f0998ebb34f0c3605b52f7606f9c5d8015eaa881b14f75012a8fc8442031d","observation_id":"f59492a7-ddf6-463a-aca7-ca0654328d68","resolution":{"observed_at":"2026-08-12T14:04:25.949093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.930572Z","title":"Improving pixel-based mim by reduc- ing wasted modeling capability","venue":null,"work_id":"21f4c809-a121-48ac-8379-4dfc16fc42aa","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.228781Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:b15bb1baa3a36fff15e0a44b17d7cc60c23ee9efe6dea48b88f916f5a972dacd","observation_id":"9be18984-6f44-46ec-b832-0e5fbea75dd0","resolution":{"observed_at":"2026-08-12T14:04:25.935382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.915503Z","title":"Swin trans- former: Hierarchical vision transformer using shifted win- dows","venue":null,"work_id":"b07323a5-dd51-42c6-a6f5-5308ed10e265","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.234845Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:c4e581617f0f5529e874aa76b92db7dbb877dc8cef91d7124ec5a88183210e04","observation_id":"b291b8fb-75aa-4f25-841e-a18a55273bf8","resolution":{"observed_at":"2026-08-12T14:04:25.919971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.901670Z","title":"Good helper is around you: attention-driven masked image modeling","venue":null,"work_id":"8f4dca6c-eb97-48a9-a770-bb8fc9bfdd94","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.243006Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:f5d57592ea24ae85a1a22b7b751d606781932a97e7683a4cc50f0505a6cad632","observation_id":"738b9f9c-328e-4437-aa13-7fcee33b9f67","resolution":{"observed_at":"2026-08-12T14:04:25.906531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05871","last_updated":"2023-05-10T03:39:24Z","snapshot_observed_at":"2026-08-16T15:34:18.136866Z","submitted_at":"2023-05-10T03:39:24Z","title":"Medical supervised masked autoencoders: Crafting a better masking strategy and efficient fine-tuning schedule for medical image classification","version":1},"cited_work":{"arxiv_id":"2305.05871","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.05871","snapshot_observed_at":"2026-08-12T14:04:25.438897Z","title":"Medical supervised masked autoencoders: Crafting a better masking strategy and efficient fine-tuning schedule for medical image classification","venue":"cs.CV","work_id":"63879bcc-8e9e-49ff-971c-0651b7c7bd5a","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.248429Z"},"links":{"cited_paper":"/paper/2305.05871","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:ceff4e4b819af5b0f2b5fc818ed56403bfc404122bd8eb99b4ae9c7ca2e545f8","observation_id":"39d863d2-703e-4bbe-827d-089056567ab9","resolution":{"observed_at":"2026-08-12T14:04:25.445902Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.889863Z","title":"Unsupervised learning of visual representions by solving jigsaw puzzles","venue":null,"work_id":"eb6e610e-82b3-4cdb-ac77-980d29bcef2a","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.253574Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:3c6a3a20cd0db888b697898c45831d481532f1e5f7f154d6a4af7490aac144e2","observation_id":"6d04ffe2-d2ae-4b4c-b8d6-ca9d18e834a8","resolution":{"observed_at":"2026-08-12T14:04:25.893814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.877531Z","title":"Rep- resentation learning by learning to count","venue":null,"work_id":"0138f83b-3c8e-4757-95c3-9bb187eeaa95","year":2017},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.260598Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:2399b48f3471039b05fa84f63494469534bac44d8ab387620b61645402b86570","observation_id":"e60217be-cb57-4352-8bb4-c83f3195f509","resolution":{"observed_at":"2026-08-12T14:04:25.881460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.865808Z","title":null,"venue":null,"work_id":"609c0d87-56f2-43ad-b9ba-894c2d783ed0","year":2016},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.264939Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:26af2381f3ca58e69f9511e4e537311fa8acb9e83967d890c7cebcf6e5741e8d","observation_id":"7d293d9c-fd60-4d5d-8820-0bfc8c8966c1","resolution":{"observed_at":"2026-08-12T14:04:25.869451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.853846Z","title":"Spatilly consistent representation learning","venue":null,"work_id":"c0e23e50-5cde-478d-a6ce-d902102b1e5a","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.269393Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:dd0dda5dcfbd775fb7f5069353a95566f5d7d464445e2eb6a0a7566001fa8779","observation_id":"36b2b755-3756-40c0-9719-929f9f1b7d48","resolution":{"observed_at":"2026-08-12T14:04:25.858390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.273384Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.273384Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:e7ec960e43944e857e140b3eeeda49b7b03e9b5fd28a25f694992f960e071775","observation_id":"cb806cc4-5b98-4ef4-b9bf-d147f6683a33","resolution":{"observed_at":"2026-08-12T14:04:25.273384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.825707Z","title":"Siamese image modeling for self-supervised vision represen- tation learning","venue":null,"work_id":"fa5f2a3c-0277-4f5d-a4c9-506edd29cfc6","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.277542Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:24151a73e2bec1f31cb2089ad04f74d9153fb5ef2ec388dced70dbf0094c44c4","observation_id":"0c93578f-ec66-4034-a1dc-699683100f96","resolution":{"observed_at":"2026-08-12T14:04:25.830565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.812539Z","title":"Designing bert for convolutional net- works: Sparse and hierarchical masked modeling","venue":null,"work_id":"01c78768-4536-46a8-8810-ca23546a09f1","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.281332Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:38aa8a220e8481804f5c4764c81becf1c6afb9f74662701284ebfe9406d27c38","observation_id":"c9d93243-e6b6-418f-921c-f0a248540a3c","resolution":{"observed_at":"2026-08-12T14:04:25.817189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.285136Z","title":"Un- derstanding self-supervised learning dynamics without con- trastive pairs","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.285136Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:ef96bfbfb73bdd7436e5cff68d983dc3b2639f3ad1add342fbdff997b242e704","observation_id":"6d50f181-2b0f-4804-a2b0-d4696453d775","resolution":{"observed_at":"2026-08-12T14:04:25.285136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.790416Z","title":"Integrally pre-trained transformer pyramid net- works","venue":null,"work_id":"9ee05e6a-b39b-41e6-a5bd-0554ba0409ed","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.289029Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:d626e07a6d20f160068e6dc4d17d2813a30112f2c4242bb0c1a4761ff4b84a0a","observation_id":"4f4f65ac-425c-4dc9-82e2-e4475e54be8f","resolution":{"observed_at":"2026-08-12T14:04:25.797021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.776961Z","title":"The inaturalist species classification and de- tection dataset","venue":null,"work_id":"c64602a4-7dba-49a1-ba97-55056b22820f","year":2018},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.292877Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:cc7ea2d93b766da89523665bcab6fabb733a80f0de8ea9e0f55fbc9ec8242c18","observation_id":"fb7d6a68-c627-4fdd-b932-2c3e7830624e","resolution":{"observed_at":"2026-08-12T14:04:25.781465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.296581Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.296581Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:9ce68d47b91860ef2130daf31df7054da1a823983661bc960d0121a69921ee5a","observation_id":"a72511aa-a8b9-4454-b6bb-21ceb3d01316","resolution":{"observed_at":"2026-08-12T14:04:25.296581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.744903Z","title":"Hard patches mining for masked image modeling","venue":null,"work_id":"1e069944-6105-43eb-9e02-6aa98edc73ad","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.300435Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:502781404eb88ee228b0216b0b70723025e513a2e3e966e48975aa57e8cee524","observation_id":"dbfc8f51-aa6a-45b7-b4c0-177346278afe","resolution":{"observed_at":"2026-08-12T14:04:25.749887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.732069Z","title":"Masked image modeling with local multi-scale reconstruction","venue":null,"work_id":"d2f6e730-782a-44e4-956e-4c654c804d5d","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.305337Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:a30f70dbc024117bfcbd12e03f2261d6d69df57988121f30764e9c91fe400a84","observation_id":"1e2a2ea2-92d5-44eb-8219-92933d5e3d07","resolution":{"observed_at":"2026-08-12T14:04:25.736618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.718751Z","title":"Videomae v2: Scaling video masked autoencoders with dual masking","venue":null,"work_id":"1ce1537b-fb4d-4a1c-a905-c154d5708b09","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.309486Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:699f427cfcb534fefb914ddca0c86ea9c314d754b5a64ab9e802df8273e05daa","observation_id":"83fb4ee3-cda8-415a-8c54-4e29c5cb9615","resolution":{"observed_at":"2026-08-12T14:04:25.723029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.705207Z","title":"Image as a foreign language: BEiT pretraining for vision and vision-language tasks","venue":null,"work_id":"80e5e441-497a-4847-835e-6648bede471f","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.313865Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:9b484f251ea1cceea42575d643131f598c4d2d8e106603d9aeec694e676db844","observation_id":"1ed67277-4974-4c41-bb3d-969c5d729932","resolution":{"observed_at":"2026-08-12T14:04:25.709844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.318359Z","title":"Dense contrastive learning for self-supervised visual pre-training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.318359Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:69ccc691ca0a5b329dc2632bdf00eaf41272dba35fc3fdb47a767ba2afa44864","observation_id":"7412b265-c806-48ff-a1ae-24de520983a7","resolution":{"observed_at":"2026-08-12T14:04:25.318359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.686665Z","title":"Masked feature predic- tion for self-supervised visual pre-training","venue":null,"work_id":"176ec5bd-7f94-486b-8ef4-e50c62f6c380","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.322543Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:76815ef27dcd80a8a70d5419fad20d15c2f92e3cd6bd2c4933d8c32538e3922a","observation_id":"941597ec-cff8-4213-a946-b96e1ab3d26e","resolution":{"observed_at":"2026-08-12T14:04:25.690945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.672272Z","title":"Mvp: Multimodality-guided visual pre-training","venue":null,"work_id":"11a64e00-e3b0-4359-bbda-8001b29848d6","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.326918Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:00d2b00240ae2e43b70e5c9b520b57ea88395eb5a3cf8ab2ed07bf8bcedfbce2","observation_id":"1193d7e2-4761-4512-a50c-2556fe7a91fd","resolution":{"observed_at":"2026-08-12T14:04:25.676463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.332140Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.332140Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:2f714eccc5a7c46d39454714b020e5d41d2454cf4e034edc4fb61b203f3ee9d0","observation_id":"6d69a7ef-83ca-4447-bc48-e5b1016b7a19","resolution":{"observed_at":"2026-08-12T14:04:25.332140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.652562Z","title":"Yu, and Dahua Lin","venue":null,"work_id":"dc27c744-7666-493d-8f20-9933e106ce21","year":2018},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.337255Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:a6834f2ec491de3f958a9c3b326ea813615669042c948b21222d2d34ff9f8335","observation_id":"90b19df7-f470-4e87-b5e5-19ee7ae10560","resolution":{"observed_at":"2026-08-12T14:04:25.657743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.639212Z","title":"Masked frequency modeling for self-supervised visual pre-training","venue":null,"work_id":"fa5e35b9-f416-4ba1-851c-3f74f9f33656","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.341598Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:49fc6a8091b32c18a216eb852bee4ba7a59ae45ef27ce46b44d502081bdb0955","observation_id":"c2dc7739-a5e3-4f22-9316-52b851e3fc90","resolution":{"observed_at":"2026-08-12T14:04:25.643627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.346250Z","title":"Propagate yourself: Exploring pixel-level consistency for unsupervised visual representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.346250Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:d4fd559b56238075d198777cbf602afc63524b83c3eb529a1a0e3613b71da0df","observation_id":"320adb59-c527-4179-a8cd-ac98cd6ca448","resolution":{"observed_at":"2026-08-12T14:04:25.346250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.612451Z","title":"Simmim: A simple framework for masked image modeling","venue":null,"work_id":"f6440763-07e4-484f-a955-86cd6cf3773a","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.350270Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:6d80b6cd9ca6a699fdcf8ea6ec6975d4dbf199e3cd39f128089f4143b62a68e2","observation_id":"8bd18fb5-db7c-486e-abed-ef1bf6132069","resolution":{"observed_at":"2026-08-12T14:04:25.616936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.355759Z","title":"Decoupled contrastive learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.355759Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:62948c058eb97d076c9c5c9faab0b2c16a214600a837650f1901bf24fdc1dc23","observation_id":"3f32d29e-44b8-4289-b398-2adad61d0196","resolution":{"observed_at":"2026-08-12T14:04:25.355759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.593841Z","title":"Masked image modeling with denoising contrast","venue":null,"work_id":"68ea80be-d52a-405f-aa06-132a86f3d488","year":2023},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.359221Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:195ff57a16845bafc58298609567c5d091c6475fe8dd9ac29b5867205089b018","observation_id":"08c6b604-da5d-4403-bf85-2433b525c4ed","resolution":{"observed_at":"2026-08-12T14:04:25.597640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.582695Z","title":"Barlow twins: Self-supervised learning via redundancy reduction","venue":null,"work_id":"7f90c8cc-c677-48db-abc5-d15d25ccff9c","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.362262Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:b309ae459b5fe97ea35c2470d734381e82a0c0bde3f327138c6091a21ae2f4f1","observation_id":"a8cac60f-f6f9-4584-bfa2-d927175fc651","resolution":{"observed_at":"2026-08-12T14:04:25.586176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.365726Z","title":"Colorful image colorization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.365726Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:ab87960e7468caba046ea64d456b64fc20374b344f8166ee27a4b75d2be5f6bd","observation_id":"9d5a0101-932d-4f12-8a5f-e1261ace4b63","resolution":{"observed_at":"2026-08-12T14:04:25.365726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.556856Z","title":"Self-supervised visual representations learning by contrastive mask prediction","venue":null,"work_id":"dec65298-2cd9-448a-8b34-f1bc6d04a7c4","year":2021},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.369349Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:1601e7046119cd4d56788f698ae99bb859bf1bd38cb11683366538634a1c2dc6","observation_id":"05c1ab6e-1719-47b0-8788-978f8577906f","resolution":{"observed_at":"2026-08-12T14:04:25.560677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.543963Z","title":"Scene parsing through ade20k dataset","venue":null,"work_id":"69927802-2945-44b9-8596-a900ee4e752e","year":2017},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.373702Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:8d82a672d28e5c71164921e433cfbcc5e1c671344dfb7694d171a31b3617e484","observation_id":"f7f6fd94-fa99-485e-af32-3d2902071600","resolution":{"observed_at":"2026-08-12T14:04:25.548049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.529798Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":"1bcd92d4-cf93-461e-b6a5-5d67231274f9","year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.378002Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:f541f4441bd35ecc7bfcd54b5a05d37e9caf86fbfdeab9e5dcd73ad14ea4f6bc","observation_id":"12caf166-cbb3-43ba-81cf-b2de5941de28","resolution":{"observed_at":"2026-08-12T14:04:25.534334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14415","last_updated":"2022-03-27T23:42:05Z","snapshot_observed_at":"2026-08-16T17:11:27.772691Z","submitted_at":"2022-03-27T23:42:05Z","title":"Mugs: A Multi-Granular Self-Supervised Learning Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14415","snapshot_observed_at":"2026-08-12T14:04:25.383655Z","title":"Mugs: A multi- granular self-supervised learning framework","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.383655Z"},"links":{"cited_paper":"/paper/2203.14415","citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:78630f0450ad1660f6a7e2850dccfe494befaf6f944b48fbd0119fdf06d44a10","observation_id":"4e32713c-f7b5-49ff-b52d-df709da6d0af","resolution":{"observed_at":"2026-08-12T14:04:25.383655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.516574Z","title":"In implementation, we use a greedy strategy to find the approximate solution of Eq","venue":null,"work_id":"a5439236-c3c1-4ffa-abce-0169a3234d31","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.388265Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:76c4b7cc0e16eab3e9f8cc54d0b935147aebe357752786a808795b0b11d56039","observation_id":"b1cbc46e-aa21-41cf-8606-0c6a506349c7","resolution":{"observed_at":"2026-08-12T14:04:25.521266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:04:25.501244Z","title":"13 and Tab","venue":null,"work_id":"7b7875b0-372e-479e-b98b-1efbac315cf5","year":null},"citing_paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:25.391939Z"},"links":{"citing_paper":"/paper/2411.15746"},"observation_digest":"sha256:73c1db6133b3aff84af9f56c66fdc82d6fc83e4bad9174ce673206b68ea7d97d","observation_id":"89cdec21-848d-46a1-ac1f-70dadeb3c42a","resolution":{"observed_at":"2026-08-12T14:04:25.505498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15746","last_updated":"2024-11-24T07:48:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T20:13:19.353797Z","submitted_at":"2024-11-24T07:48:20Z","title":"PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":2,"verified_fuzzy":50},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2411.15746."}