{"as_of":"2026-08-11T11:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b028250ff158f8b31160b52fb39466d59b37d3ee38f2445385e46ed33892e601","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:18:45.340289Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04213/citation-record","integrity":"/paper/2608.04213/integrity","json":"/paper/2608.04213/citation-record.json","paper":"/paper/2608.04213"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:44.792265Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:44.792265Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:021db7f3660ce613f7962453772dda515c4d06906bc85b11740b2ccb1e228891","observation_id":"77a89cac-a733-4df7-8b0b-37b0af407447","resolution":{"observed_at":"2026-08-08T00:18:44.792265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.644967Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":"7fd3f15d-c409-4521-8672-4c6f454ea595","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:44.873795Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:7479eb51609f7cdb85592d40dfa3bde5b08d59c822a716b97a39deac58e01b85","observation_id":"bad07fbf-2434-4149-b688-29faf4ee90b1","resolution":{"observed_at":"2026-08-08T00:18:46.650898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.629585Z","title":"Proceedings of the 37th International Conference on Machine Learning , series =","venue":null,"work_id":"83f55a2b-9528-4a86-81d1-94ed85ddc8e0","year":2020},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:44.931537Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:3d0bc4e1953c31f7f24d9f6478b23c8ed33e9039160166866dddd0f209d2a2df","observation_id":"3a96e4b2-0a7c-442f-be67-ca24d4580dc5","resolution":{"observed_at":"2026-08-08T00:18:46.634329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:44.956656Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:44.956656Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:14ecf02bffb3b10ab0b4ad29a657031bf2ab2de9b71adec31a1c2ffe8c496fba","observation_id":"d9ad3b3b-f4a9-479b-87f9-e39169cb6749","resolution":{"observed_at":"2026-08-08T00:18:44.956656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.029760Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.029760Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:3c106cd28a81c6954393a9b6103bbea58f978516bce468ece90add244ce787dd","observation_id":"b02117a2-826e-4f27-ba81-fc03aec4b06a","resolution":{"observed_at":"2026-08-08T00:18:45.029760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.592545Z","title":"Proceedings of the 38th International Conference on Machine Learning , series =","venue":null,"work_id":"25fb4181-0345-4b61-a847-7b9304649079","year":2021},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.090726Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:49cbc31c8fbe7f2910226b44f5b5f1cff7fb0bd9280bc34de912036d53578945","observation_id":"3038ff0c-6712-45fa-b6f8-f709151f42c8","resolution":{"observed_at":"2026-08-08T00:18:46.597649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.095929Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.095929Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:aae00ccdd1019306858bb13b839a6a34c17f9f65e628ca9cf5342e6104a4a742","observation_id":"b53b90a2-0d01-4350-88ae-9e349fb41a21","resolution":{"observed_at":"2026-08-08T00:18:45.095929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.102094Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.102094Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:119913a2b392cf5ce3d97ae6db2598ae413193ef1f87ceb122b3096be1838255","observation_id":"f3bb4ad2-770b-4d89-91be-f71e59054333","resolution":{"observed_at":"2026-08-08T00:18:45.102094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.554628Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":"18904388-46d1-4376-920a-ec8da6098e3e","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.107653Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:11439b83805571c0103eeddc89c6e1793fc24e54b1cef9db46efd7b9b31a658a","observation_id":"05070b09-9a91-41d8-b4d3-11a79415307d","resolution":{"observed_at":"2026-08-08T00:18:46.560324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.536002Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":"0f156c91-27f0-4817-aa10-dae723ede9c4","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.111997Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:339e1a2bfbe61824d1d5718b008136b10a86cb63892c41df670bd008b2283f82","observation_id":"b7c45e48-fb6d-4112-b4d0-1de75f7a3a0b","resolution":{"observed_at":"2026-08-08T00:18:46.542406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.521356Z","title":"Proceedings of the 38th International Conference on Machine Learning , series =","venue":null,"work_id":"4dd0f949-47a2-4d4e-9257-51ec1188b232","year":2021},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.116631Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:9a8383a439b0a3452af6c200ba7a177b0d9959926f29dab6fa9e2b10b2978390","observation_id":"c9bdbd74-b4c6-47ad-9b2b-9ae6d771dbec","resolution":{"observed_at":"2026-08-08T00:18:46.525885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.505930Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"bc60ff62-70c9-4565-8589-1186fc4cb4d2","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.121605Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:7b4f62906df573bacef3102c79a8be1a6eeb2696deeca0a76a7d0f2dfeeeaba1","observation_id":"f1b76751-bca4-487c-aaac-e89c0017ed2f","resolution":{"observed_at":"2026-08-08T00:18:46.510739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.439370Z","title":"Proceedings of the 27th International Conference on Machine Learning , pages =","venue":null,"work_id":"459a4d1b-3001-4bf8-ace8-fbd5b1ea33e3","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.126285Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:71403b4b75cd32e5140494f33a45e1f6d5ace83daa411998bbe4611415483f5e","observation_id":"d2b8de9b-7a05-4e7a-9ada-4f84dba766aa","resolution":{"observed_at":"2026-08-08T00:18:46.472031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.302700Z","title":"SIAM Journal on Imaging Sciences , volume =","venue":null,"work_id":"63f962bc-4750-4202-85ad-63898debb37c","year":2009},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.131265Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:70a54c882cdc90a2f2a00263adf339b2133d1bd5e74b466de51d136f25de8b8e","observation_id":"b1b2b08b-2536-4e38-bbdb-dd1c79f7cabc","resolution":{"observed_at":"2026-08-08T00:18:46.361915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.288282Z","title":"SIAM Journal on Scientific Computing , volume =","venue":null,"work_id":"35ab65e8-3004-43d3-bf81-b774eacd6a60","year":1998},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.136361Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:278686b9ba9fae53c3816b953c75713618740c3c49445c6b64b73fc7491b81d4","observation_id":"f9e93872-8a7f-4623-a730-9ee5dcc9fff1","resolution":{"observed_at":"2026-08-08T00:18:46.292743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.273512Z","title":"Foundations and Trends in Optimization , volume =","venue":null,"work_id":"f8f55576-b351-4d8f-8778-33e6d258ccf0","year":2014},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.141304Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:713007b22a39608a1300ed129bd21fb62b1b8c56bb681cadcc7170ef64dc2b4c","observation_id":"1cc2f94d-cae9-4359-8e8b-b69b142e2120","resolution":{"observed_at":"2026-08-08T00:18:46.277915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.258100Z","title":"Communications on Pure and Applied Mathematics , volume =","venue":null,"work_id":"49cc97d1-7647-4a7f-83b4-b603103b9433","year":2004},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.147379Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:55c90b1501a0915d98ed821a795bf6ba89c891201aec293aeca5e48d51cb514d","observation_id":"5059f939-08f1-4666-acc4-0146a1307362","resolution":{"observed_at":"2026-08-08T00:18:46.263234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.185738Z","title":"SIAM Journal on Imaging Sciences , volume =","venue":null,"work_id":"cb3b44ef-c0ae-47d4-a05c-fcbf2ffe182e","year":2015},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.151804Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:aba3524ba6dbcee19f5455f9de9232a5eee9c45abf7314c06fbf403c7991179e","observation_id":"0741ef80-521a-4617-8c44-f9a5c088b250","resolution":{"observed_at":"2026-08-08T00:18:46.245334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.058647Z","title":"Mathematical Programming , volume =","venue":null,"work_id":"a2740a41-d71f-4727-801f-84fdb6a63a82","year":1992},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.157251Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:29b38e48f6427569a4c967196d57f0c762339ad333ab6bc07c97c4919f691349","observation_id":"eac4bf23-1f05-48f4-a4e3-f1a153017814","resolution":{"observed_at":"2026-08-08T00:18:46.107986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-08T00:18:45.161584Z","title":"arXiv preprint arXiv:1607.06450 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.161584Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:c8088d4bcb6fa07603ed5dbc48e8cc9f144c2770ea2b6f1764e82ddc34af8ca5","observation_id":"771a865b-0e3e-49ad-8f77-17267f27d793","resolution":{"observed_at":"2026-08-08T00:18:45.161584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.039736Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"e5a30e84-91c8-4615-9eaa-3211c516bef3","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.185600Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:722368504775f6895f21aa463a881cf4cccf5a9992f43c5fa4e1f1ac26ec7063","observation_id":"6182ec22-1a98-4799-9d13-233ab99ed9d7","resolution":{"observed_at":"2026-08-08T00:18:46.044304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20299","last_updated":"2025-01-14T16:38:36Z","snapshot_observed_at":"2026-08-08T14:38:53.836623Z","submitted_at":"2024-05-30T17:46:23Z","title":"Scaling White-Box Transformers for Vision","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20299","snapshot_observed_at":"2026-08-08T00:18:45.227009Z","title":"arXiv preprint arXiv:2405.20299 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.227009Z"},"links":{"cited_paper":"/paper/2405.20299","citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:d7f2838e724c0c375e2c14b05881d5f98445d29a766f58aa4b10a21f799f35cd","observation_id":"1684edfe-48e2-4086-8002-56413e8af616","resolution":{"observed_at":"2026-08-08T00:18:45.227009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17810","last_updated":"2024-12-23T18:59:21Z","snapshot_observed_at":"2026-08-11T05:06:17.928807Z","submitted_at":"2024-12-23T18:59:21Z","title":"Token Statistics Transformer: Linear-Time Attention via Variational Rate Reduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17810","snapshot_observed_at":"2026-08-08T00:18:45.283513Z","title":"arXiv preprint arXiv:2412.17810 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.283513Z"},"links":{"cited_paper":"/paper/2412.17810","citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:94f07b38436f11f4636feb3805b8bee07eb928854eff60dd5526ba11158dedb8","observation_id":"3f0da1ef-0189-4438-a92f-1393e4089ff7","resolution":{"observed_at":"2026-08-08T00:18:45.283513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16271","last_updated":"2023-08-30T19:02:17Z","snapshot_observed_at":"2026-08-05T20:26:32.082138Z","submitted_at":"2023-08-30T19:02:17Z","title":"Emergence of Segmentation with Minimalistic White-Box Transformers","version":1},"cited_work":{"arxiv_id":"2308.16271","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.16271","snapshot_observed_at":"2026-08-08T00:18:45.444138Z","title":"Emergence of Segmentation with Minimalistic White-Box Transformers","venue":"cs.CV","work_id":"ba21de93-b3b3-4b0f-91d2-c91829c04a26","year":2023},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.289502Z"},"links":{"cited_paper":"/paper/2308.16271","citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:9ed492066e68c63f5856a3d9abb6f59ae79ccd13f00ee0acfe92c3895ddbc289","observation_id":"34b42e2c-3807-4cb3-9fe5-1eac94074b56","resolution":{"observed_at":"2026-08-08T00:18:45.505371Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.023130Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"ecefce82-4de2-401b-a74d-62261c76c1d0","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.294186Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:6513c22c9e1591dfae4b39e916d44569daad8a907ad63f20a2c543ea65642545","observation_id":"ac580f71-88f9-49ca-aa0e-47bdcf7a28d5","resolution":{"observed_at":"2026-08-08T00:18:46.028794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.007143Z","title":null,"venue":null,"work_id":"6a9f9627-7c8c-48a6-9635-65d1cd3da88f","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.298848Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:2e18aa146016f3570c2d34c5374b0c7c27094e58e058479c185cafd9a2c67e66","observation_id":"0e26e5d9-a4bb-40fe-958d-c6322737305e","resolution":{"observed_at":"2026-08-08T00:18:46.012652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.991050Z","title":null,"venue":null,"work_id":"d6d82907-9c44-4ad6-8e1c-b5d40076ebaa","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.303697Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:eb8408b8b89e22fd672bd7f0e9fd3c9976df22592fe319e578e0d56dca64b8f8","observation_id":"2476c983-766b-4aaf-ba13-89dcc56a495d","resolution":{"observed_at":"2026-08-08T00:18:45.996170Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.888434Z","title":"Proceedings of the 42nd International Conference on Machine Learning , series=","venue":null,"work_id":"d7eb5e1f-4fc6-473c-a07c-38c9fc2855ac","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.308227Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:bf9617b2d4432dcbb48e059f1251d5dce16120114dabfc22cbcb45e06d16b3c9","observation_id":"73d3f50d-a107-49a9-ac14-1715a44343e3","resolution":{"observed_at":"2026-08-08T00:18:45.980770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.312651Z","title":"Foundations and Trends in Machine Learning , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.312651Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:bce5b60fec1eda004e463f7d7808ec1501e5de9b4ab7b5685d93f909c98a7bbf","observation_id":"4d44309d-065b-4d18-8299-9ac2c9551bf9","resolution":{"observed_at":"2026-08-08T00:18:45.312651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.317258Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.317258Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:23e7dfe1c5d58069d6046a7681d9b7cded61b228085795f3f412146ceaa484bf","observation_id":"12ba24be-45ac-4037-958f-e84cedc5406c","resolution":{"observed_at":"2026-08-08T00:18:45.317258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.769514Z","title":"IEEE Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"8d331158-10a4-4511-b224-57047e54db8b","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.322108Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:71a692dcdcb1637458d9e46d425a9a6bcd8ba44c713a5d0eac552c97ff0975c6","observation_id":"63d433d6-ddf7-4472-93e1-d63dafe77812","resolution":{"observed_at":"2026-08-08T00:18:45.805662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.326422Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.326422Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:612f8b7c2e354303b51898ea852269d51e5c620a8aa2dfde5b5495767cb06948","observation_id":"b7c75a22-c47a-4753-8241-e6da26a6e859","resolution":{"observed_at":"2026-08-08T00:18:45.326422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.330955Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.330955Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:7dd4244d9b22fcf418859319248f2b3a1f9387dab476cc1210595cb02338448c","observation_id":"a6c21245-a577-40ea-bba6-76d09dca3a00","resolution":{"observed_at":"2026-08-08T00:18:45.330955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.721502Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"6c7272ee-580a-4684-966f-95dad36604e3","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.335506Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:223695230b721c44214299bf74390a262a171da4ea6d784ac385f40464a955d9","observation_id":"19e5219d-a2bf-4b13-9695-c13a3313485b","resolution":{"observed_at":"2026-08-08T00:18:45.736420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.598799Z","title":"SIAM Journal on Scientific Computing , volume =","venue":null,"work_id":"8c17d7cd-53e6-4c81-8dfa-c4193f4b536b","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.340289Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:7b8a7d9b47a7864c558d7f8c4fa485e03b5bbc67f5b4c3e173dd71a2bab37a21","observation_id":"b5dcc336-cf34-493a-b4a7-9dbdbbfb9d36","resolution":{"observed_at":"2026-08-08T00:18:45.648743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T08:02:43.593811Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2608.04213."}