{"as_of":"2026-08-18T08:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:44e5b063458f01bd6150aa22fe237771fd683ee77ec440305189496f1cfbe728","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:22:07.357901Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-23T19:03:21.257416Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":"2205.03892","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convmae: Masked convolution meets masked autoencoders","venue":null,"work_id":"bb793e1f-8a06-4ac9-801d-cadbfd24cd93","year":2022},"citing_paper":{"arxiv_id":"2410.07442","last_updated":"2024-10-11T08:46:46Z","snapshot_observed_at":"2026-08-13T23:37:36.107987Z","submitted_at":"2024-10-09T21:19:52Z","title":"Self-Supervised Learning for Real-World Object Detection: a Survey","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-23T19:02:11.415329Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2410.07442"},"observation_digest":"sha256:dc01ff2cc0e8ebbdba17744674f56cd3ab34ee6bc213e0274d2763e1ed5cae21","observation_id":"e0a9416d-af29-487a-bc92-546f7827ad68","resolution":{"observed_at":"2026-05-23T19:03:21.260419Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-08-10T22:02:14.423243Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.03005","last_updated":"2025-01-06T13:30:16Z","snapshot_observed_at":"2026-08-17T01:22:34.922657Z","submitted_at":"2025-01-06T13:30:16Z","title":"PiLaMIM: Toward Richer Visual Representations by Integrating Pixel and Latent Masked Image Modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:02:14.423243Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2501.03005"},"observation_digest":"sha256:e147d94866f711638dabda1e3e2ff136f88c6b2d2eff9399a58e17debc3e0b8c","observation_id":"2d5d574d-b178-4bd9-99bf-22b199494f06","resolution":{"observed_at":"2026-08-10T22:02:14.423243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-08-08T10:06:34.074670Z","title":"Convmae: Masked convolution meets masked autoencoders,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.08200","last_updated":"2025-05-20T17:03:50Z","snapshot_observed_at":"2026-08-14T04:07:05.925940Z","submitted_at":"2025-02-12T08:24:36Z","title":"ActiveSSF: An Active-Learning-Guided Self-Supervised Framework for Long-Tailed Megakaryocyte Classification","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T10:06:34.074670Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2502.08200"},"observation_digest":"sha256:83db64c540fb1387c987bce0b388f6f7dfb98d52ad6cf3c02ad240ab0ff76d9a","observation_id":"7fded294-2c4d-417e-9ce9-ffed97e02e23","resolution":{"observed_at":"2026-08-08T10:06:34.074670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-08-07T12:05:03.367690Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00679","last_updated":"2025-08-31T12:02:44Z","snapshot_observed_at":"2026-08-18T01:36:10.023342Z","submitted_at":"2025-05-31T19:12:34Z","title":"A versatile foundation model for cine cardiac magnetic resonance image analysis tasks","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:03.367690Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2506.00679"},"observation_digest":"sha256:31cfced2145d3b3de8a948f21ac3ce563ed2e6edea0c905cbed44fa177fa2f5e","observation_id":"299f38b3-5ff3-4046-80c7-404472f43127","resolution":{"observed_at":"2026-08-07T12:05:03.367690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-08-06T17:14:29.724280Z","title":"https://doi.org/10.48550/arXiv.2205.03892 25 He, K., Chen, X., Xie, S., Li, Y., Dollar, P., Girshick, R.,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11400","last_updated":"2025-07-15T15:11:15Z","snapshot_observed_at":"2026-08-09T18:05:56.322750Z","submitted_at":"2025-07-15T15:11:15Z","title":"The model is the message: Lightweight convolutional autoencoders applied to noisy imaging data for planetary science and astrobiology","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:14:29.724280Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2507.11400"},"observation_digest":"sha256:80bd25f6ac1dbb3f83251dc162efb7d2ce1557e08fd8f09762a157d5c0f9bc0f","observation_id":"28dde501-d4ab-419f-9e82-b091b26344a5","resolution":{"observed_at":"2026-08-06T17:14:29.724280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-08-05T23:57:22.879807Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05505","last_updated":"2025-08-07T15:37:26Z","snapshot_observed_at":"2026-08-16T01:24:11.232667Z","submitted_at":"2025-08-07T15:37:26Z","title":"Symmetry Understanding of 3D Shapes via Chirality Disentanglement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T23:57:22.879807Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2508.05505"},"observation_digest":"sha256:812b476d0edb17bc1f4610c4a8f92871ab8255d939e7dcfefc08f459f0dbbb4a","observation_id":"85791453-2bb2-477f-925f-bb7e3ea62595","resolution":{"observed_at":"2026-08-05T23:57:22.879807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":"2205.03892","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convmae: Masked convolution meets masked autoencoders","venue":null,"work_id":"bb793e1f-8a06-4ac9-801d-cadbfd24cd93","year":2022},"citing_paper":{"arxiv_id":"2509.15642","last_updated":"2026-05-13T09:44:42Z","snapshot_observed_at":"2026-08-14T16:24:45.529305Z","submitted_at":"2025-09-19T06:07:53Z","title":"UNIV: Unified Foundation Model for Infrared and Visible Modalities","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T16:28:48.494939Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2509.15642"},"observation_digest":"sha256:e7cae191f38ce80c938986ebbd8829858010caf5c07b8a38c3557c8389516306","observation_id":"53301122-e33a-4ca9-8e36-8d2968edc846","resolution":{"observed_at":"2026-05-18T16:31:37.170898Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-08-03T04:59:12.109849Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.03531","last_updated":"2026-06-19T03:46:09Z","snapshot_observed_at":"2026-08-14T12:21:47.191352Z","submitted_at":"2026-02-03T13:48:34Z","title":"Robust Representation Learning in Masked Autoencoders","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:59:12.109849Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2602.03531"},"observation_digest":"sha256:29ba5b484bdba94203d442595828acc5b9422742678a42bb492218a479a5a6fc","observation_id":"84bd7a97-51a2-4b91-8160-7386219d12b8","resolution":{"observed_at":"2026-08-03T04:59:12.109849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-07-13T21:45:59.210064Z","title":"arXiv preprint arXiv:2205.03892 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.19964","last_updated":"2026-06-24T14:47:21Z","snapshot_observed_at":"2026-08-13T20:05:04.059027Z","submitted_at":"2026-03-20T14:05:44Z","title":"2K Retrofit: Entropy-Guided Efficient Sparse Refinement for High-Resolution 3D Geometry Prediction","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T21:45:59.210064Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2603.19964"},"observation_digest":"sha256:2b439432caf8d814a8550d7be7ad99b0e12f15f2957ac9918430365c2cec17ee","observation_id":"3382b962-7af6-4170-b77b-b37e2623da64","resolution":{"observed_at":"2026-07-13T21:45:59.210064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":"2205.03892","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convmae: Masked convolution meets masked autoencoders","venue":null,"work_id":"bb793e1f-8a06-4ac9-801d-cadbfd24cd93","year":2022},"citing_paper":{"arxiv_id":"2604.21681","last_updated":"2026-04-23T13:45:32Z","snapshot_observed_at":"2026-08-17T10:13:53.819413Z","submitted_at":"2026-04-23T13:45:32Z","title":"Sapiens2","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T21:59:43.755956Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2604.21681"},"observation_digest":"sha256:f3e299500bc2022a2ef840774eaa8d0786b8226c154c6b2169b1c0fe82f5e4d6","observation_id":"c78957a7-ed69-4c0e-a869-0a30f8092764","resolution":{"observed_at":"2026-05-11T14:21:06.801534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":"2205.03892","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convmae: Masked convolution meets masked autoencoders","venue":null,"work_id":"bb793e1f-8a06-4ac9-801d-cadbfd24cd93","year":2022},"citing_paper":{"arxiv_id":"2604.27499","last_updated":"2026-04-30T06:50:25Z","snapshot_observed_at":"2026-08-16T05:17:25.263367Z","submitted_at":"2026-04-30T06:50:25Z","title":"Towards All-Day Perception for Off-Road Driving: A Large-Scale Multispectral Dataset and Comprehensive Benchmark","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-07T08:52:27.345411Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2604.27499"},"observation_digest":"sha256:4d0636a62e8f5d8aff5b390446e73e9e7e586193bf1b7b0805f53326508d6d29","observation_id":"b8a04de4-43d7-4d39-aaec-3523bfff0bfa","resolution":{"observed_at":"2026-05-12T09:56:26.592399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03892","snapshot_observed_at":"2026-08-16T00:22:07.357901Z","title":"arXiv , langid =:2205.03892 , primaryclass =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12084","last_updated":"2026-08-12T14:07:09Z","snapshot_observed_at":"2026-08-16T00:50:45.268717Z","submitted_at":"2026-08-12T14:07:09Z","title":"NAE: Normalizing AutoEncoder","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T00:22:07.357901Z"},"links":{"cited_paper":"/paper/2205.03892","citing_paper":"/paper/2608.12084"},"observation_digest":"sha256:1332aa6656787941187cda16cf8a876b37147c9887e799d8d79515a664f250bf","observation_id":"fea9c5c5-67c6-48a8-a711-94271ac71974","resolution":{"observed_at":"2026-08-16T00:22:07.357901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2205.03892/citation-record","integrity":"/paper/2205.03892/integrity","json":"/paper/2205.03892/citation-record.json","paper":"/paper/2205.03892"},"outbound":[],"paper":{"arxiv_id":"2205.03892","last_updated":"2022-05-19T16:28:37Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T18:54:04.411327Z","submitted_at":"2022-05-08T15:12:19Z","title":"ConvMAE: Masked Convolution Meets Masked Autoencoders"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2205.03892."}