{"as_of":"2026-08-10T20:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:64b762414b2f9f57f1f9117ae8d702a7823b0c35c63cf1cae8dd3adc3f7d7e2f","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T18:11:36.820808Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T18:22:40.908929Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"cited_work":{"arxiv_id":"2603.15553","doi":"10.48550/arxiv.2603.15553","metadata_source":"arxiv_reference","pith_arxiv_id":"2603.15553","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lowe, Anthony Fuller, Sageev Oore, Evan Shelhamer, and Graham W","venue":"arXiv (Cornell University)","work_id":"4e13a8fe-22f2-4d32-9347-3d90cf2e74f6","year":2026},"citing_paper":{"arxiv_id":"2605.27734","last_updated":"2026-05-26T22:16:42Z","snapshot_observed_at":"2026-07-06T23:37:27.309837Z","submitted_at":"2026-05-26T22:16:42Z","title":"Learn from your own latents and not from tokens: A sample-complexity theory","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-29T18:22:40.908929Z"},"links":{"cited_paper":"/paper/2603.15553","citing_paper":"/paper/2605.27734"},"observation_digest":"sha256:5c8659d8f1bd1b9b1158ef246dbe28b250e3f83895d4030c9d53e2d4671dd236","observation_id":"ce7f5390-7e11-499e-8dbe-da175cbf9e71","resolution":{"observed_at":"2026-07-28T03:24:07.946935Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.15553/citation-record","integrity":"/paper/2603.15553/integrity","json":"/paper/2603.15553/citation-record.json","paper":"/paper/2603.15553"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:29.210899Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:29.210899Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:c8806aa2fdc5e1dffedd54357a3f4c717b2a234cd00630d1eb04f33de5bb035a","observation_id":"18bee48b-d9e4-4cb3-b148-efbb9429ccdb","resolution":{"observed_at":"2026-08-02T18:11:29.210899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-02T18:11:29.452431Z","title":"V-JEPA 2 : Self-supervised video models enable understanding, prediction and planning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:29.452431Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:864201c6448a283f6f29f152b64197e70d36c0d5d243162648400674a80184d0","observation_id":"d247fa89-3dd1-4fcb-8121-5ef947af325a","resolution":{"observed_at":"2026-08-02T18:11:29.452431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-19836-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MultiMAE : Multi-modal multi-task masked autoencoders","venue":"Lecture notes in computer science","work_id":"68e14240-7fd5-46c9-b215-e5eaaf698482","year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:29.683986Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:a20165cabae47a7e8e767df8802acdc1c1abde9c57aa9fa710189db103f4dc6d","observation_id":"c0ac3c1d-1f9f-4ef0-a149-cd6b3a7aaff1","resolution":{"observed_at":"2026-08-02T18:14:01.667586Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:29.851651Z","title":"data2vec: A general framework for self-supervised learning in speech, vision and language","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:29.851651Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:c5692d6e346adaaa6a85121c2b12502ce752ef92391ea026876bc2d8a3f940e7","observation_id":"d0603e70-837d-46f9-978c-da6b660ba355","resolution":{"observed_at":"2026-08-02T18:11:29.851651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:30.029383Z","title":"Efficient self-supervised learning with contextualized target representations for vision, speech and language","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:30.029383Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:aa34ac04295fc9c05dc6c2b0c0cc181a90ac3ed3e19de020e9d4d178c086bc41","observation_id":"0eae655d-7ef3-4661-afa2-58bee82b38c5","resolution":{"observed_at":"2026-08-02T18:11:30.029383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:30.196630Z","title":"BEiT : BERT pre-training of image transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:30.196630Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:277590c3b111f339feb6a12834111dd0cdc03f3c267d418f0f260cc3a1610e5d","observation_id":"d38da3f2-cee3-4fb6-960c-43e0f6d53e44","resolution":{"observed_at":"2026-08-02T18:11:30.196630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:30.322996Z","title":"VICR eg: Variance-invariance-covariance regularization for self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:30.322996Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:95f72c4dae3788d0755ac019d00e6520aaaf04fdfd377539c8c83836e5888389","observation_id":"1d6c3cf7-91a0-4e9e-b83c-80879498ee89","resolution":{"observed_at":"2026-08-02T18:11:30.322996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08471","last_updated":"2024-02-15T18:59:11Z","snapshot_observed_at":"2026-08-07T02:30:11.447693Z","submitted_at":"2024-02-15T18:59:11Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08471","snapshot_observed_at":"2026-08-02T18:11:30.414325Z","title":"Revisiting feature prediction for learning visual representations from video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:30.414325Z"},"links":{"cited_paper":"/paper/2404.08471","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:e2b97ea89c88c3ecd5e63493dc0f507c6f214d778a104a26a3c73f3b3f6502e9","observation_id":"f05c5a5b-3571-4d06-a373-5267761aa2b7","resolution":{"observed_at":"2026-08-02T18:11:30.414325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:30.502236Z","title":"Network dissection: Quantifying interpretability of deep visual representations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:30.502236Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:3407ca3a1f0980ec5c32b43681844a0ca8a15227034bde522d2f429e0aa3448c","observation_id":"d01e3447-c6c5-48e5-91f5-7e5e6b1dba94","resolution":{"observed_at":"2026-08-02T18:11:30.502236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:30.666291Z","title":"Perception encoder: The best visual embeddings are not at the output of the network","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:30.666291Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:dbaf07e24207649d3f51f253d49812445fe448556ff01a0ccbd332488ab8b451","observation_id":"9c449a7b-8984-4324-be02-f1542ad9e2e8","resolution":{"observed_at":"2026-08-02T18:11:30.666291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:30.866017Z","title":"Unsupervised learning of visual features by contrasting cluster assignments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:30.866017Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:5d8e291cee22136630fe13502f3329a8295e08f1bb20659193b8ab2b786bbb73","observation_id":"a1488339-433d-40c6-b160-0830ae32b827","resolution":{"observed_at":"2026-08-02T18:11:30.866017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:31.076011Z","title":"VL-JEPA : Joint embedding predictive architecture for vision-language","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:31.076011Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:44cd13c7a43e49f508ebc5e809d4e09cf9a47db894944c5a04d435b163b348ce","observation_id":"95542cd8-85fd-48e1-8926-503b63be653f","resolution":{"observed_at":"2026-08-02T18:11:31.076011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:31.171750Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:31.171750Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:7b3fde06baf70f5775b9c47d7d369258faa2777dc4cc7924093d281a0f491e18","observation_id":"de46d121-3c87-4948-8f92-97a88d4497bc","resolution":{"observed_at":"2026-08-02T18:11:31.171750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:31.263324Z","title":"Exploring simple siamese representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:31.263324Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:5c2a849847609acd3114ea3945196e24c3ca4f2c1867d1b81a97149f27593992","observation_id":"da0b1bda-5792-428e-a505-3d7b63da41ec","resolution":{"observed_at":"2026-08-02T18:11:31.263324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-02T18:11:31.349964Z","title":"Improved baselines with momentum contrastive learning","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:31.349964Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:085fb4c36cc18179c4a09caefd95b0dee1e422a7f0738766360b3a7cf48cb89b","observation_id":"7224f578-c4a7-4146-ba08-dc423747c860","resolution":{"observed_at":"2026-08-02T18:11:31.349964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:31.534879Z","title":"Whatever next? P redictive brains, situated agents, and the future of cognitive science","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:31.534879Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:d1a83bd2636d4da333585848211248bc893269564000c882afc2c68fce9378d9","observation_id":"81c4f058-da6a-4c57-abdd-737aa5bf2dc6","resolution":{"observed_at":"2026-08-02T18:11:31.534879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:31.661063Z","title":"SatMAE : Pre-training transformers for temporal and multi-spectral satellite imagery","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:31.661063Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:6b8e054cea2d71b266eb3e3aa16be872cabbcdc0704306e1eab6dc862dc89147","observation_id":"c0268c35-b832-42e2-b9be-273f7b2e33d0","resolution":{"observed_at":"2026-08-02T18:11:31.661063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:31.807163Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:31.807163Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:277bb3e85444f610a173d4b62bc186b6596139b1440cedefb63894c7e03bf13a","observation_id":"5fca9b85-bd2e-4b04-8f4c-bf50fc2fbe3e","resolution":{"observed_at":"2026-08-02T18:11:31.807163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:31.869311Z","title":"Vision transformers need registers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:31.869311Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:5a92928f6cea391091985bd88791a77c260bab3ba698d28c0706b2fd23cd1cb7","observation_id":"f26cfb88-23fe-4de7-896a-f9a1b3284b40","resolution":{"observed_at":"2026-08-02T18:11:31.869311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:31.957030Z","title":"Cluster and predict latents patches for improved masked image modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:31.957030Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:e0b11c55e66f95ae4e2f2d486c7f424fefae42ee0ca1e9261caf9fee5aafa2f4","observation_id":"c762cf80-7862-41d6-bbfb-ca0a3c0136b6","resolution":{"observed_at":"2026-08-02T18:11:31.957030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:32.048632Z","title":"BERT : Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:32.048632Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:d31faeaa7f5b7297c7a0b75a5bf26e231c0844b9ffb249c23b06659c3b46a380","observation_id":"f9b24dcb-f8e8-4c84-92a2-5ce40b2f7b8f","resolution":{"observed_at":"2026-08-02T18:11:32.048632Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i1.25130","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PeCo : Perceptual codebook for BERT pre-training of vision transformers","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"afa1868c-c9ca-4e90-8c4d-0f6a96ffbc33","year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:32.129066Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:f06cc24cbade261508380dbc661dc5b9847b099ce5424301c6147a3b719ad534","observation_id":"1eb7519a-7ea8-4101-a300-294955f63fab","resolution":{"observed_at":"2026-08-02T18:14:01.087057Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:32.280847Z","title":"Brain-JEPA : Brain dynamics foundation model with gradient positioning and spatiotemporal masking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:32.280847Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:8ff62f044e3d708d9eb798839e7b9bcf72e6df65d423619eab8640d3930a703a","observation_id":"0156d54c-500b-41be-abc8-7e82f0fce037","resolution":{"observed_at":"2026-08-02T18:11:32.280847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:32.409536Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:32.409536Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:8899b440d7c2c52dedcc1f217a018153a704c1f15bf52267b371d182eb39fa77","observation_id":"297ce068-989e-4153-a91d-7fcbc1e0d228","resolution":{"observed_at":"2026-08-02T18:11:32.409536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:32.591978Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:32.591978Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:da22abf77663da6d499f544520e08837975ecb46f117b4cefad1084998f6b4cf","observation_id":"0281bf68-2698-4417-9314-ce56e293da97","resolution":{"observed_at":"2026-08-02T18:11:32.591978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15830","last_updated":"2024-01-11T13:16:43Z","snapshot_observed_at":"2026-07-06T16:53:05.949503Z","submitted_at":"2023-11-27T13:53:53Z","title":"A-JEPA: Joint-Embedding Predictive Architecture Can Listen","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15830","snapshot_observed_at":"2026-08-02T18:11:32.731145Z","title":"A-JEPA : Joint-embedding predictive architecture can listen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:32.731145Z"},"links":{"cited_paper":"/paper/2311.15830","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:3c5297321c9cbe9b7a0632729ef5064bc47ccd728de802135e9bbb9320864b73","observation_id":"7293d926-4e4f-48a8-87ef-f1512d31f6cd","resolution":{"observed_at":"2026-08-02T18:11:32.731145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:32.851759Z","title":"A theory of cortical responses","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:32.851759Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:22097528b3d3ba403d1055e18a0ec843c2e544a0b7236e43ce6215958d519518","observation_id":"375095c0-685d-414b-b901-3d6b9c78c3ae","resolution":{"observed_at":"2026-08-02T18:11:32.851759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:32.911817Z","title":"Predictive coding under the free-energy principle","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:32.911817Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:e0b10e44a2d018ddf030411f5ea35ca5e5f097a53d8bae747df00a6ff3f3b6c2","observation_id":"8dc64a0d-3bb4-4195-9bc5-ef14d90cc6e1","resolution":{"observed_at":"2026-08-02T18:11:32.911817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.004366Z","title":"Efros, and Ken Goldberg","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.004366Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:4d7e79062e55bd728babe374ed140021db50d88b9fb095fa764cc44b70a60950","observation_id":"92a5c9ac-ff94-4d76-b864-33f17b49327c","resolution":{"observed_at":"2026-08-02T18:11:33.004366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.091202Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.091202Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:e45f2da2c1f567e85a22035b96d98c249d497bdf7320eb13120280c88e45313f","observation_id":"fc3ccd06-9916-496c-ba15-200225472452","resolution":{"observed_at":"2026-08-02T18:11:33.091202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.172484Z","title":"Bootstrap your own latent - a new approach to self-supervised learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.172484Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:9c062f540f5cdc34c2f957c8e124e373ce639d091b99563ca82d9d3489cb76a0","observation_id":"17b20157-9a04-4135-bc30-2755082e0d70","resolution":{"observed_at":"2026-08-02T18:11:33.172484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.235754Z","title":"Using a joint-embedding predictive architecture for symbolic music understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.235754Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:86e277a05a5adfea5170c1b7085adecad4b108129983041e7226107dd2e37b5e","observation_id":"23b9543a-56a2-4ba7-ad40-af9724657e0f","resolution":{"observed_at":"2026-08-02T18:11:33.235754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.351373Z","title":"ColorMAE : Exploring data-independent masking strategies in masked autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.351373Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:164c5e3961186e4b892db529c9b27777a06cddea2b2ea678bded37e549fd6ee4","observation_id":"8932240c-19fe-4e43-a54f-5b8d64e79287","resolution":{"observed_at":"2026-08-02T18:11:33.351373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.443481Z","title":"Generic decoding of seen and imagined objects using hierarchical visual features","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.443481Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:6862475ecc9238da54f5649e4f7efbe317d615c8d340e282f9bcc1a93f72f507","observation_id":"7f65a7fa-d9a0-4a95-9106-12b57c27c6b7","resolution":{"observed_at":"2026-08-02T18:11:33.443481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.525813Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.525813Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:8f5f11f4d0654ea64b19c485227ab6c912086b855b3871688d1be09151eb6622","observation_id":"edc5d7ed-d262-4d7f-95ad-db45745762fc","resolution":{"observed_at":"2026-08-02T18:11:33.525813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.619013Z","title":"Masked autoencoders that listen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.619013Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:4b17708a2e30175fabb8a19ba05c64895ffc52fa9c9346b44f84e41bdbc450f6","observation_id":"51708e83-013f-45b9-9b75-b5bc0a72eeeb","resolution":{"observed_at":"2026-08-02T18:11:33.619013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.709301Z","title":"iNaturalist 2021 competition dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.709301Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:6509dba6e8203d96989c5fa233794be8e7a28978734b0b228c1ac5eff29d27ac","observation_id":"5a69a273-0218-467c-b0c4-8674467412ff","resolution":{"observed_at":"2026-08-02T18:11:33.709301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.802202Z","title":"Keller and Thomas D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.802202Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:8ee5494e6e742ac1477f5a1dab463fe0ac3ae5c11f1d2d3bc7de4053585a803e","observation_id":"3ed5ace7-2cd9-46e4-ad09-4390a11608f7","resolution":{"observed_at":"2026-08-02T18:11:33.802202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.863867Z","title":"Similarity of neural network representations revisited","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.863867Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:0b80378b754e3e255a7fb54eb4753dfa8805de5ed4567e45beab7c55fb8204f5","observation_id":"dcbd919f-a40d-4d2a-b041-ce0717bfa430","resolution":{"observed_at":"2026-08-02T18:11:33.863867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:33.909423Z","title":"M3- JEPA : Multimodal alignment via multi-gate M o E based on the joint-embedding predictive architecture","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.909423Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:65f2f36f6e9f732947e848e149ab7ab4ce12b2fdcea960515a6240c440a5d760","observation_id":"16d8fc61-e45b-4203-8990-70865d3a94ad","resolution":{"observed_at":"2026-08-02T18:11:33.909423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-4180","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lepori, Alexa R","venue":null,"work_id":"958def0a-dd4c-472b-959f-e2b851a83baa","year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:33.968060Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:5aad904a8580141f7ef36426502a4bcf352bd01011f8cc2f74f02d37910a8733","observation_id":"b5a91463-8f67-4990-bf10-85434b7457bc","resolution":{"observed_at":"2026-08-02T18:14:00.768949Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08871","last_updated":"2023-01-21T03:20:23Z","snapshot_observed_at":"2026-08-09T21:39:51.501306Z","submitted_at":"2023-01-21T03:20:23Z","title":"Ti-MAE: Self-Supervised Masked Time Series Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08871","snapshot_observed_at":"2026-08-02T18:11:34.065674Z","title":"Ti-MAE : Self-supervised masked time series autoencoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.065674Z"},"links":{"cited_paper":"/paper/2301.08871","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:98df20f46b692ecfc0354e7b50718fce718c5381b2f2aae0f063e7b60226a8cd","observation_id":"7f8f99cf-b842-4eb7-8844-4a7f6e856fca","resolution":{"observed_at":"2026-08-02T18:11:34.065674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-0077","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Connecting joint-embedding predictive architecture with contrastive self-supervised learning","venue":null,"work_id":"603c1fc7-9dd5-4d4f-81f7-a7661863e467","year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.110945Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:7e70392233978ca8c84e00a686e780426449f35946deb01cfe538cffbfa85698","observation_id":"dd5906c9-216d-4206-bc48-b887d9578549","resolution":{"observed_at":"2026-08-02T18:14:00.455143Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41467-025-61399-5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-supervised predictive learning accounts for cortical layer-specificity","venue":"Nature Communications","work_id":"061c16f0-06d2-43bb-9d27-9460dacd8302","year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.168349Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:6acf353deec09ac40a76fd0a3872ffdc22bb5124a50de26e97e1d489bf698bae","observation_id":"8158b104-a566-4010-8aed-699e38424d9d","resolution":{"observed_at":"2026-08-02T18:14:00.175118Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-02T18:18:49.11791+00:00","source":"paper_reference_links","state":"open"},"event_date":"2025-10-22","event_type":"correction","notice_doi":"10.1038/s41467-025-65076-5","provenance":{"observed_at":"2026-07-11T02:57:25.91959+00:00","source":"crossref","source_record_id":"10.1038/s41467-025-65076-5->10.1038/s41467-025-61399-5:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.223967Z","title":"Nguyen, Phanwadee Sinthong, and Jayant Kalagnanam","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.223967Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:49da53d208429df876fd9cc965863f5f1fc24c12fb57e08e31694572a67cbee9","observation_id":"a5cc06e4-7e2e-4fbe-b0fd-590a7fa8ebd8","resolution":{"observed_at":"2026-08-02T18:11:34.223967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.302191Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.302191Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:caa13c7d65f60e1a5fa50842702464ce5ee6fc28f5ff55eba84a7c53c61ed626","observation_id":"471bda98-8e27-433e-9940-341e2cfbb0f6","resolution":{"observed_at":"2026-08-02T18:11:34.302191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.391466Z","title":"What do self-supervised vision transformers learn? In The Eleventh International Conference on Learning Representations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.391466Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:a88365eb188c252c39fbcd282bf8c0b631803df6d9ebc947cac01e4e84b9ea19","observation_id":"8b323aa8-e3b6-4818-9ae8-51a9f317e1df","resolution":{"observed_at":"2026-08-02T18:11:34.391466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.453132Z","title":"Do vision transformers see like convolutional neural networks? In M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.453132Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:5714256cec25c882514d77f731363947aec05b2bd0e99bf969a83b28fe85efbb","observation_id":"21c98df7-0f67-4d78-b3cc-5ab0ba3ff9a8","resolution":{"observed_at":"2026-08-02T18:11:34.453132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.506697Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.506697Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:83e1c9d6b9d1538b6736814470bb8914b0d95171a06a0810de09b25deff5aaa0","observation_id":"a56f0952-8a5e-48e1-82e8-008a2c3cf49d","resolution":{"observed_at":"2026-08-02T18:11:34.506697Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18226","last_updated":"2025-08-25T17:23:27Z","snapshot_observed_at":"2026-08-09T15:11:51.417497Z","submitted_at":"2025-08-25T17:23:27Z","title":"Disentangling the Factors of Convergence between Brains and Computer Vision Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18226","snapshot_observed_at":"2026-08-02T18:11:34.562853Z","title":"Vo, Camille Couprie, Patrick Labatut, Piotr Bojanowski, Valentin Wyart, and Jean-Rémi King","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.562853Z"},"links":{"cited_paper":"/paper/2508.18226","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:64013dd318d7c3934d93725b0c7cef543d63ee51ba12d85c754abaa26906bc3f","observation_id":"2bb69e30-2fa9-4bb7-baf2-92169d872803","resolution":{"observed_at":"2026-08-02T18:11:34.562853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.665019Z","title":"Stem-JEPA: A Joint-Embedding Predictive Architecture for Musical Stem Compatibility Estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.665019Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:1818d6a0f24b28264040848588b3c58e4c118f660ce3a0f8a69abc508153706c","observation_id":"c19b29b5-25ed-435d-8514-07779facaae5","resolution":{"observed_at":"2026-08-02T18:11:34.665019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.707005Z","title":"Berg, and Li Fei-Fei","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.707005Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:771481c7b5b99922aaa9a71b9ca6c4ac8c3aa69c6d76ecc63cd8d57e950c599c","observation_id":"636bdd98-f83c-4043-9bce-718815705187","resolution":{"observed_at":"2026-08-02T18:11:34.707005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18405","last_updated":"2025-02-25T17:56:25Z","snapshot_observed_at":"2026-08-07T17:49:27.851199Z","submitted_at":"2025-02-25T17:56:25Z","title":"Enhancing DNA Foundation Models to Address Masking Inefficiencies","version":1},"cited_work":{"arxiv_id":"2502.18405","doi":"10.48550/arxiv.2502.18405","metadata_source":"pith","pith_arxiv_id":"2502.18405","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Enhancing DNA Foundation Models to Address Masking Inefficiencies","venue":"cs.LG","work_id":"410c9218-02da-4b9b-90de-ec04d0815361","year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.757247Z"},"links":{"cited_paper":"/paper/2502.18405","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:f9a031699dbbf0e832506bf392a4b826248c81c81cc07c31f243f996963a2843","observation_id":"5d2dba60-6c81-4e14-b752-d1f2cb375750","resolution":{"observed_at":"2026-08-02T18:13:59.677290Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-02T18:11:34.817490Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.817490Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:380f85571060ad153d1a3c1ca34fcda333f051ce8b531942374324332aba8ae2","observation_id":"aa0398d6-fac2-4096-a31a-9b14344a15c5","resolution":{"observed_at":"2026-08-02T18:11:34.817490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.878790Z","title":"Segmenter: Transformer for semantic segmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.878790Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:9971bfa73bd240c5cb9b01659c99f44c3d84829268a1162f4e0a2b7ac3feb588","observation_id":"e6e4b740-b659-4d7b-832b-6be76ddf97e1","resolution":{"observed_at":"2026-08-02T18:11:34.878790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.938506Z","title":"RoFormer : Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.938506Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:b46d075a979a34665602e3e1395498b73c22c54a1ff0f0a82ffb143158a04122","observation_id":"beee27cc-1806-4823-8f8f-f53b09e3df06","resolution":{"observed_at":"2026-08-02T18:11:34.938506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:34.998145Z","title":"Many-two-one: Diverse representations across visual pathways emerge from a single objective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:34.998145Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:569f738a5e5195f9caead349acd3e130c9ed5cf6b798fb82bf01202c3ad737a2","observation_id":"eaa2b578-04aa-4ef6-b87a-e4a94ac5199d","resolution":{"observed_at":"2026-08-02T18:11:34.998145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:35.059330Z","title":"T- JEPA : Augmentation-free self-supervised learning for tabular data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.059330Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:96f97ed2e65b8fe0a91198298618465efe64a73f39cc6e6d67113c90dc968284","observation_id":"c8bc09e6-7362-4317-81af-3460eb340b36","resolution":{"observed_at":"2026-08-02T18:11:35.059330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-07T10:46:08.274157Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-02T18:11:35.115163Z","title":"Pereira, and William Bialek","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.115163Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:e1056817b4cd9eb9a1840386677dd280046d861c5b83edc94499585de592784a","observation_id":"17a5a9d2-574d-4d27-a0ef-de7d4175cfcc","resolution":{"observed_at":"2026-08-02T18:11:35.115163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02915","last_updated":"2025-06-25T08:38:27Z","snapshot_observed_at":"2026-08-10T06:26:17.946083Z","submitted_at":"2025-06-25T08:38:27Z","title":"Audio-JEPA: Joint-Embedding Predictive Architecture for Audio Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02915","snapshot_observed_at":"2026-08-02T18:11:35.194361Z","title":"Audio-JEPA : Joint-embedding predictive architecture for audio representation learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.194361Z"},"links":{"cited_paper":"/paper/2507.02915","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:f783ed34dcc119492d98643505defef4b5133d26637d3426c0752517a381920f","observation_id":"72f1a689-e70f-43c9-9a42-817712dc2b54","resolution":{"observed_at":"2026-08-02T18:11:35.194361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-02T18:11:35.284551Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.284551Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:6aa2ccf067c160d515e713c0646c79947986f51a41fce7f4e83e84cbc0f0fd4e","observation_id":"606058f3-d65f-4693-bd93-857cf8c5000c","resolution":{"observed_at":"2026-08-02T18:11:35.284551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:35.349275Z","title":"The iNaturalist species classification and detection dataset","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.349275Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:55f1eea9f06e53914d3a093a7e30d59d9e721ee35407b0301a84ef6b37049a04","observation_id":"86202b4b-092b-4f7b-956b-31d3ef825465","resolution":{"observed_at":"2026-08-02T18:11:35.349275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14137","last_updated":"2026-04-25T14:06:10Z","snapshot_observed_at":"2026-07-06T21:59:25.077202Z","submitted_at":"2025-07-18T17:59:55Z","title":"Franca: Nested Matryoshka Clustering for Scalable Visual Representation Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14137","snapshot_observed_at":"2026-08-02T18:11:35.535321Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.535321Z"},"links":{"cited_paper":"/paper/2507.14137","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:0e49cf655d3a154bc6f4600bf6ee7720d2b08a610ab55a4050b855450a02b986","observation_id":"b6385984-f60b-4c8b-83b5-9e4ad4322733","resolution":{"observed_at":"2026-08-02T18:11:35.535321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:35.578435Z","title":"Vilas, Timothy Schauml\\\" o ffel, and Gemma Roig","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.578435Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:da0bd2e6435c7fd580a2424fc27d6be5324f6de3038f27ca0265e7c687f248b5","observation_id":"94c4f850-4359-4d6c-847c-a162c0cc2f87","resolution":{"observed_at":"2026-08-02T18:11:35.578435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:35.669815Z","title":"VideoMAE V2 : Scaling video masked autoencoders with dual masking","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.669815Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:3f491b9a69ad6984aec1f82fcb70e6d163767cc28b64c790c1162e5059d63f9b","observation_id":"fbaf706c-6761-4a4d-9a5b-d1bd61fce922","resolution":{"observed_at":"2026-08-02T18:11:35.669815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:35.821661Z","title":"Delving into masked autoencoders for multi-label thorax disease classification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.821661Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:59193d67f8f252896eb2f110ca013cc95752fbec0911526e941e70146c0fe10a","observation_id":"635896ef-ca1f-457e-bb53-1e8f20f6f82e","resolution":{"observed_at":"2026-08-02T18:11:35.821661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:35.896948Z","title":"SimMiM : A simple framework for masked image modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.896948Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:439f42e1c2e82c8f9a79bd0c4d6902a295df9ee00fc4d0fb9dc30edc9973f8e1","observation_id":"a77a0207-ce9c-4f49-9640-e610fc975697","resolution":{"observed_at":"2026-08-02T18:11:35.896948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:35.986653Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:35.986653Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:61ce22fe7a1a2ed1d8461a4a812fe794bfbc659d7322ade3d358c1265391cefc","observation_id":"58d59caf-5ed9-4705-885a-f2d09b3997af","resolution":{"observed_at":"2026-08-02T18:11:35.986653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:36.071764Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.071764Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:bef0aa779796807b4327b6a605870cf10ab0195ada676a8aa70f6046d378c226","observation_id":"d0b741c7-508e-47b5-bace-b818be333507","resolution":{"observed_at":"2026-08-02T18:11:36.071764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:36.168431Z","title":"Learning efficient coding of natural images with maximum manifold capacity representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.168431Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:b3831b3399a3dc21c319b97fb565c21bd85b53990e60106bb13adc0f51719f23","observation_id":"21ceca00-2079-4633-adb5-02626f2c7a14","resolution":{"observed_at":"2026-08-02T18:11:36.168431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:36.227181Z","title":"WavJEPA : Semantic learning unlocks robust audio foundation models for raw waveforms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.227181Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:3550a67e5bdaf55ac2a3b60cb9299f167edad7ea600d3778caf1d99463cd173a","observation_id":"f16e4ff2-4e3d-484f-b7cb-c624da0d4e8f","resolution":{"observed_at":"2026-08-02T18:11:36.227181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:36.283945Z","title":"Barlow twins: Self-supervised learning via redundancy reduction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.283945Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:9582add79a0ea4bfe6a686451983374eb800625baa9e73a49bde50dbecc82f5c","observation_id":"b98c6f57-aaec-47ab-9c9f-0ef7bad1604e","resolution":{"observed_at":"2026-08-02T18:11:36.283945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:36.379036Z","title":"Zeiler and Rob Fergus","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.379036Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:889ac663805a20c3253a668e14657e036302d969b8b5f49806efc255ed737fa0","observation_id":"042d9855-8606-4259-9779-a76cedd8c603","resolution":{"observed_at":"2026-08-02T18:11:36.379036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04867","last_updated":"2020-02-21T13:36:15Z","snapshot_observed_at":"2026-08-09T06:48:42.729935Z","submitted_at":"2019-10-01T17:06:29Z","title":"A Large-scale Study of Representation Learning with the Visual Task Adaptation Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04867","snapshot_observed_at":"2026-08-02T18:11:36.446282Z","title":"A large-scale study of representation learning with the visual task adaptation benchmark","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.446282Z"},"links":{"cited_paper":"/paper/1910.04867","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:13b45e2d4d4666ba4663d205b8bdb75c4824fb5c84ab929a78a5a6551b1ff6c7","observation_id":"9b464598-bf78-4593-9734-3a7f9c71a1d1","resolution":{"observed_at":"2026-08-02T18:11:36.446282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:36.541452Z","title":"Point- M2AE : Multi-scale masked autoencoders for hierarchical point cloud pre-training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.541452Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:fcc778a3a8bba7d7e689c8c3f85cad74b64f25aa88a3cded222b3a9fca904fe2","observation_id":"4beaa4b3-cdd2-4992-b885-e654194a4e74","resolution":{"observed_at":"2026-08-02T18:11:36.541452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6856","last_updated":"2015-04-15T19:06:41Z","snapshot_observed_at":"2026-07-06T04:04:23.841822Z","submitted_at":"2014-12-22T01:14:01Z","title":"Object Detectors Emerge in Deep Scene CNNs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6856","snapshot_observed_at":"2026-08-02T18:11:36.595814Z","title":"Object detectors emerge in deep scene CNNs","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.595814Z"},"links":{"cited_paper":"/paper/1412.6856","citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:0ee7aa2c896bf77b516d19655c0f28fee0ad03a0fdbee16da788dcd3b1864824","observation_id":"09ac78ce-a600-478f-9bb0-69b0bf51c448","resolution":{"observed_at":"2026-08-02T18:11:36.595814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:36.659332Z","title":"Scene parsing through ADE20K dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.659332Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:27a7222c2150b52b2c6ccd99ab954ed4a88fd16d9e3f6c28276be0e75261f7dd","observation_id":"f39ee132-783b-480a-9573-8360c415062e","resolution":{"observed_at":"2026-08-02T18:11:36.659332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:36.754520Z","title":"Image BERT pre-training with online tokenizer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.754520Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:5678b50456ff6289a187c8f1adfa82863401621a89cd73311f022fb0016262f4","observation_id":"4492f70b-79fa-46d6-a6c0-1cec19fb4966","resolution":{"observed_at":"2026-08-02T18:11:36.754520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:11:36.820808Z","title":"Self pre-training with masked autoencoders for medical image classification and segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-02T18:11:36.820808Z"},"links":{"citing_paper":"/paper/2603.15553"},"observation_digest":"sha256:9178fd8c3b3e22fa928bf12a329f39c9bb8855a24b16973b31618a6f3880f0c2","observation_id":"a5b58b76-fe6b-4958-a2ca-b2ba9bd480f5","resolution":{"observed_at":"2026-08-02T18:11:36.820808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.15553","last_updated":"2026-07-27T17:51:19Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:44:18.918530Z","submitted_at":"2026-03-16T17:13:27Z","title":"Self-Distillation of Hidden Layers for Self-Supervised Representation Learning"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":71,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 1 inbound Pith citation observation for arXiv:2603.15553."}