{"as_of":"2026-08-17T19:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dae6ee9fa540f5c5ef002e43a37e7085bee2fa4d92c7c4b1fa9ff1ffa0c6cc1a","coverage":[{"denominator":171,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:51:59.825845Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.19792/citation-record","integrity":"/paper/2504.19792/integrity","json":"/paper/2504.19792/citation-record.json","paper":"/paper/2504.19792"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.405381Z","title":"Gpt- 4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.405381Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:2bf3563f68136be0a099a1b40c891f343528a5d757db03f2d8bac50ec25b26c2","observation_id":"fdef1bc4-0271-42b1-a2f1-2118a8ac0070","resolution":{"observed_at":"2026-08-16T05:51:59.405381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.410182Z","title":"Emergence of inv ariance and disentangle- ment in deep representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.410182Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:5cbbbd67cb4fe20581daf8456962bd52df8751654846284b66413e0af5ab25cd","observation_id":"0a4e69db-15be-4a5b-8508-a5d4af5313ee","resolution":{"observed_at":"2026-08-16T05:51:59.410182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.413964Z","title":"\\alpha-req : Assessing representation quality in self-sup ervised learning by mea- suring eigenspectrum decay","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.413964Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:046bb98a5afb7e3234ba12963b72e07420d9b310740406f519dc8eb86584f00a","observation_id":"a661ad87-e47b-458f-85e6-7ffb9481f630","resolution":{"observed_at":"2026-08-16T05:51:59.413964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.417829Z","title":"S carf: Self-supervised contrastive learning using random feature corruption","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.417829Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:90be4a0c0910fa67f0e8ad6aa13bbe89e428b5e14040a2a0ab26019efa8fd73c","observation_id":"aec29133-436c-4f40-800b-2089b0cfa80b","resolution":{"observed_at":"2026-08-16T05:51:59.417829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.421883Z","title":"Contrastive and non -contrastive self- supervised learning recover global and local spectral embe dding methods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.421883Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:46b8ddbe81d32f2421f8de338e2956206dc8e05acb611b2dd9f30db9226e2882","observation_id":"1650030c-1efe-4e73-81a2-6c05b3779a83","resolution":{"observed_at":"2026-08-16T05:51:59.421883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.426349Z","title":"VICReg: Varia nce-invariance- covariance regularization for self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.426349Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1475a29ce0a099fe9e9faddb6de954ec3cbdd0bbfde3568a314349ce25a68a2e","observation_id":"c1443fd1-ba28-4e3f-a4e9-c2c0b5187986","resolution":{"observed_at":"2026-08-16T05:51:59.426349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.430712Z","title":"Generalized discrimin ant analysis using a ker- nel approach","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.430712Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:dd59bf7370457404194529786cba22830c7970caf2c87f9f7573b4759a45575a","observation_id":"e82ee126-aa27-494e-a356-3d2fc7e8b2a9","resolution":{"observed_at":"2026-08-16T05:51:59.430712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.435324Z","title":"Laplacian eigenmaps f or dimensionality re- duction and data representation","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.435324Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:db0bce353acaf3f2c3191f2073d5620de8d353fee20cb5dbcaaf5d83179a28e3","observation_id":"d0ae8214-9133-4628-8e68-694ff1a1bfac","resolution":{"observed_at":"2026-08-16T05:51:59.435324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.439606Z","title":"Rep resentation learning: A review and new perspectives","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.439606Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:c86261ee80e89a4afa3608bc26b43d36dbeac63e148c9b1709614d1665ce7147","observation_id":"b5894d32-08e7-4377-a5cf-58fc47d00645","resolution":{"observed_at":"2026-08-16T05:51:59.439606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.446101Z","title":"Learning eigenfunctions links spectral embedding and kernel pca","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.446101Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:91b227de4a544f7e649a344b6dc59f5c9e26c1b7412a46197f45030ba36b95ed","observation_id":"d3871cd1-0de4-40ce-a409-f94ed0f29b35","resolution":{"observed_at":"2026-08-16T05:51:59.446101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.450058Z","title":"Mixmatch: A holistic approach to s emi-supervised learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.450058Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:facd0abfffc904bec320f3114e2b6f986cb92a6d281b4730444bdcac0f12c67e","observation_id":"62dde57d-7381-47e0-8972-aa6aec025d2f","resolution":{"observed_at":"2026-08-16T05:51:59.450058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.453793Z","title":"D iscriminative learning for diﬀering training and test distributions","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.453793Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:fb924e432860a2ca6f12f38d6c636b81cde85dc6194b1a28942275e2a3c121a4","observation_id":"ebc1c565-6f05-4d51-921e-2f7f573181d5","resolution":{"observed_at":"2026-08-16T05:51:59.453793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.458295Z","title":"Statistical properties of kernel principal component analysis","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.458295Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:04acc6861b68708db9bb34c4d8f4489ad54668f4824fa298f61896a5ca02e31a","observation_id":"8900ab7d-5d98-4c05-9eb5-dcc19c8730b0","resolution":{"observed_at":"2026-08-16T05:51:59.458295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.462329Z","title":"Demo graphic dialectal vari- ation in social media: A case study of African-American Engl ish","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.462329Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:08fc4dd80321dbac6cc477ba9f83e52c01f4baf07728b46e9539d97dbddb49f7","observation_id":"59f45984-5290-4392-b825-c4805bf2c015","resolution":{"observed_at":"2026-08-16T05:51:59.462329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-16T05:51:59.466515Z","title":"On the opportunities and risks of foundati on models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.466515Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:b113c97b3a2e340401c79db19df16d1831c5a43c5ba24ab5e02242db122bef03","observation_id":"375e5b34-dcd6-40cf-a253-a0ce1ff43602","resolution":{"observed_at":"2026-08-16T05:51:59.466515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.470725Z","title":"Nuanced metrics for measuring unintended bias with rea l data for text clas- siﬁcation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.470725Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:f2c6d64a18d8f693c295ff67dbfcc3f228b5bfdc37f615dba321546b69da6091","observation_id":"413a4cd8-a2ab-43ed-b032-b01858ec6452","resolution":{"observed_at":"2026-08-16T05:51:59.470725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.474317Z","title":null,"venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.474317Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:030aba791f6b170a8a5b286040d197a0fdc4f078c730e09a541bfa432243031a","observation_id":"c6cf725d-7fac-486f-85bb-cb8a6c464070","resolution":{"observed_at":"2026-08-16T05:51:59.474317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.478005Z","title":"Functional analysis, Sobolev spaces and partial diﬀerenti al equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.478005Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:fba961541220ac38eedfd469f70b9bd8e8f1581018635a809e683ab0e61fc22c","observation_id":"d074c82a-7eff-47ae-9a67-fe2f48c853b9","resolution":{"observed_at":"2026-08-16T05:51:59.478005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.481798Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.481798Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:755834c255afbd8542455d760c4106fc8d017544bd4036eb318f8a397c747f87","observation_id":"b0bdf3af-32aa-4d8a-9efa-438df231d4e6","resolution":{"observed_at":"2026-08-16T05:51:59.481798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.485730Z","title":"The SSL interplay: Augmentations, inductive bias, an d generalization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.485730Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1d6e64ed26710a202ebf1a611d38a2c855f146078f1f62da815ba8f7dcd7f706","observation_id":"66ec7fb6-685c-4b76-8984-8fa7e2c5fecc","resolution":{"observed_at":"2026-08-16T05:51:59.485730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-08-17T10:13:54.763177Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-16T05:51:59.489415Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.489415Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:543b72d539ff350a47d8c8c7f9c5e4b60db0624ca8ba14265a617f0d645f4806","observation_id":"88fd8afb-38e6-42ef-a982-c5b1c42da933","resolution":{"observed_at":"2026-08-16T05:51:59.489415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.493604Z","title":"Xgboost: A scalable tr ee boosting system","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.493604Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:de74e9601fd3e4b3e9ae39610179ecf6a72a968352519366907076d8090e83b2","observation_id":"f0fc85f3-064e-4a25-b958-ad990c5136e2","resolution":{"observed_at":"2026-08-16T05:51:59.493604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.497461Z","title":"A sim- ple framework for contrastive learning of visual represent ations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.497461Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:2a241b68186adbaca73e91539d3edeae5e25dfa88d2463850b99d2e12d1d14ad","observation_id":"57797f5c-a713-4d9a-92e1-30322e532483","resolution":{"observed_at":"2026-08-16T05:51:59.497461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.501087Z","title":"Exploring simple siamese re presentation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.501087Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:c35b2560a1b7eaf4141028bf8a3f1b48d82a17b7006c301f5e5d201656088c15","observation_id":"c8031022-6c33-49a0-90cd-8907d6a3e57c","resolution":{"observed_at":"2026-08-16T05:51:59.501087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.505231Z","title":"De constructing denois- ing diﬀusion models for self-supervised learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.505231Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a1dea8302401a1e54fdbf8869ce67ec4041ddaecd1c2d95704a26858f1184068","observation_id":"3e57ab05-08c5-4417-a305-d0e34b96cb49","resolution":{"observed_at":"2026-08-16T05:51:59.505231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.508899Z","title":"Spectral graph theory , volume 92","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.508899Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a8b0daa10588b3cf27536a10526aad62f40f38bce386d578a936fc461eb07bb4","observation_id":"08e7f7a6-42dd-4ed6-940c-96b8c529e15e","resolution":{"observed_at":"2026-08-16T05:51:59.508899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.512411Z","title":"Le, and Christopher D","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.512411Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:7f978ee070fb70a654b382dce208fbed916d9342edddf88cbdf503019402a964","observation_id":"5d051c21-1e5a-4e8b-8026-c1c55bfc5bd0","resolution":{"observed_at":"2026-08-16T05:51:59.512411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.516048Z","title":"Gra- dient descent on neural networks typically occurs at the edg e of stability","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.516048Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a68ab8d1658506d63a1e314974e9f413a88d44d0e28b4fd80abdcc4affd85021","observation_id":"d4cf60df-3e57-4941-9549-4cf582eefbf7","resolution":{"observed_at":"2026-08-16T05:51:59.516048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.519725Z","title":"Diﬀusion maps","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.519725Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:96e89c928435f69a3667012689ace94e33e104044de6e8cced72dc5dcc785af5","observation_id":"fe669262-0f1b-4c02-8443-a9b00b6d0851","resolution":{"observed_at":"2026-08-16T05:51:59.519725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.524073Z","title":"Multinomial goodness -of-ﬁt tests","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.524073Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a1f44dec14122c0d31f682c2a48a8892fd11333c0fd5443b53b2b9db25e016da","observation_id":"ce7e833e-1527-46a0-9302-4c974bc1dcab","resolution":{"observed_at":"2026-08-16T05:51:59.524073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.528804Z","title":"A kernel theory of modern data augmentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.528804Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:0f462982842fb428282ae98b36b574d35f8c850d4b1ad80258b93c654633fe21","observation_id":"daeefab0-298b-482b-9be6-a5c3f8ac1c42","resolution":{"observed_at":"2026-08-16T05:51:59.528804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.533197Z","title":"Fast line ar algebra is stable","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.533197Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:f676b32d426d3c1444d58c4367d4f4b8b10e7686e23f08a4dad56ffe2afc795e","observation_id":"9cedffe6-228d-4f9f-8057-88d46ec3885e","resolution":{"observed_at":"2026-08-16T05:51:59.533197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.543435Z","title":"Neuralef: Deconst ructing kernels by deep neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.543435Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:74cb31debbe24981419b719572f241df19c4aa73b87715d708e7748c1647a3c0","observation_id":"c2d54a50-2d19-464f-acc6-ef2c8f2e82d2","resolution":{"observed_at":"2026-08-16T05:51:59.543435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.552859Z","title":"BERT: Pre- training of deep bidirectional transformers for language u nderstanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.552859Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:d4d204db9f83acfd698d39ad2c385da5d60886bbf0e423e4c7b5610f188385de","observation_id":"bcbacd1f-4dd6-4f3c-bb29-ec80edad405f","resolution":{"observed_at":"2026-08-16T05:51:59.552859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04552","last_updated":"2017-11-29T14:51:40Z","snapshot_observed_at":"2026-08-13T11:54:46.030796Z","submitted_at":"2017-08-15T15:21:53Z","title":"Improved Regularization of Convolutional Neural Networks with Cutout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04552","snapshot_observed_at":"2026-08-16T05:51:59.557905Z","title":"Improved regularization of convolutional neural networks with cutout","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.557905Z"},"links":{"cited_paper":"/paper/1708.04552","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:99c08a8ea109447c0fe2492d6f745e1189ca2c629d6ca9cd3620be2b4c62429a","observation_id":"727b093c-68ac-457c-88c7-5c72768af5ca","resolution":{"observed_at":"2026-08-16T05:51:59.557905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.563084Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.563084Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:9d88480c1ab6d1c0f5e6b91f174e56318c6c38d13e9db547b4a44688284f50c4","observation_id":"5fd7b24a-30f2-4787-897f-d29a20efc7b1","resolution":{"observed_at":"2026-08-16T05:51:59.563084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T05:51:59.566757Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.566757Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:fd57f0451958c86207d28d4796254e1b72885f2d21d52922c0e646e4cf0c9cd9","observation_id":"5d7f5f9f-de98-4f60-b795-fd13235fe6a1","resolution":{"observed_at":"2026-08-16T05:51:59.566757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.08750","last_updated":"2020-07-18T01:20:20Z","snapshot_observed_at":"2026-08-14T18:11:52.942637Z","submitted_at":"2018-10-20T03:50:29Z","title":"Learning Models with Uniform Performance via Distributionally Robust Optimization","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.08750","snapshot_observed_at":"2026-08-16T05:51:59.570488Z","title":"Learning models with uniform perfor- mance via distributionally robust optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.570488Z"},"links":{"cited_paper":"/paper/1810.08750","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1db8358d244755359a3f11e027e69f7edbff44a66a78a4b658fc2cef67bfd42f","observation_id":"8e8a93b5-2f38-48b0-b4fa-e96813b552af","resolution":{"observed_at":"2026-08-16T05:51:59.570488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.574780Z","title":"T owards revealing the mystery behind chain of thought: A theoretical perspective","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.574780Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:30679640decd69f307bdeae5f040f7bd6563abe14e9cab6a125e280fc18a2966","observation_id":"8c2e6fe5-cd58-4b7c-9eb6-481115faa314","resolution":{"observed_at":"2026-08-16T05:51:59.574780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.578477Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.578477Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:6703c1ee2648a3eefaa76f822cdacfbb809098a5605c6969a39565e67b86f40e","observation_id":"10eddf72-ae96-4d3e-a965-444d73e757f8","resolution":{"observed_at":"2026-08-16T05:51:59.578477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.582236Z","title":"Sobolev norm learnin g rates for regularized least-squares algorithms","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.582236Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1db01b067c99c8a1a4d4b3ef10f6ae4bbd8669707b17466e60577ed12f4075e2","observation_id":"ec5abf62-4417-4480-ab80-7462a3413367","resolution":{"observed_at":"2026-08-16T05:51:59.582236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.586084Z","title":"A decision-theoreti c generalization of on-line learning and an application to boosting","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.586084Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:69f805f56fac582937dd14cdccb0c6426736b60e719eb0c4b166f62f1c8daf2e","observation_id":"0ac3d00a-d005-4c04-bd44-408c3dcdb97e","resolution":{"observed_at":"2026-08-16T05:51:59.586084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.589710Z","title":"Latent functional maps: a spectral framew ork for represen- tation alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.589710Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:7f346b31d04fc5397ac3ec37c735dd7a8d37cc5679e972cd21a35dde686e8233","observation_id":"533c15bf-e9d7-46d7-93c4-4d31f6713e2b","resolution":{"observed_at":"2026-08-16T05:51:59.589710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.593655Z","title":"Scaling laws for reward model overop- timization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.593655Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a570aaa33d5950eabd98716a243a2fbf96e966c1cc4de809df933bf54c72ee04","observation_id":"80da0e83-d7ad-4c39-b5be-fe4d9c0494e8","resolution":{"observed_at":"2026-08-16T05:51:59.593655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-16T05:51:59.597815Z","title":"Gemini: A Family of Highly Capable Multimo dal Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.597815Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a34c3b36648f9e62e32ae55bae6098650ad4682cd14fd8963518fba9cc9db028","observation_id":"ee4f14c1-8272-4247-95ae-38ae31af6e85","resolution":{"observed_at":"2026-08-16T05:51:59.597815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.602145Z","title":"Un supervised representa- tion learning by predicting image rotations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.602145Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:e6ad2d759c8b0d3f5f23411b106a9f8f972c4acc38ae178baf2c46c8a2ca771f","observation_id":"7eb8ac5a-9f9d-4ae1-bc4d-c07fdab69b16","resolution":{"observed_at":"2026-08-16T05:51:59.602145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.606947Z","title":"Multiple kernel learn ing algorithms","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.606947Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:01893759868af3a51a258061f46bacccb511d69039edb353d208647e1367ca01","observation_id":"4f076e21-48c3-4b23-8be1-517a790aeaa2","resolution":{"observed_at":"2026-08-16T05:51:59.606947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.611258Z","title":"Generat ive adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.611258Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:07fbfe37f6d563f97f2812381defcbf39d474476f75381ec10164d5ff9e20e7c","observation_id":"7327815e-8dcd-4942-9680-c7f102e22bc4","resolution":{"observed_at":"2026-08-16T05:51:59.611258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.615506Z","title":"Revisit- ing deep learning models for tabular data","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.615506Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:2a58aba4eacdcddbeb23bd01b125c896d38b965b542c1664dcdc8ec93f9e3cec","observation_id":"c48180e3-3c5e-4b23-bbf6-90853450a595","resolution":{"observed_at":"2026-08-16T05:51:59.615506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.619396Z","title":"Bootstrap your own latent - a new approach t o self-supervised learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.619396Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:0954692227ea4dae222a1b4f9ac941d2a984752e517e59318785e5a5943d49ee","observation_id":"2dd5d3b9-4867-4d9e-91e9-eee9c61f9972","resolution":{"observed_at":"2026-08-16T05:51:59.619396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.623468Z","title":"In search of lost domain generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.623468Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1aa9e60b6ae584d4c7b97975d176c69490415a36ef0867a506dbfa745f7d66ee","observation_id":"c9b83419-8f74-4f4a-aa51-17027763daa3","resolution":{"observed_at":"2026-08-16T05:51:59.623468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.627701Z","title":"Characteriz- ing implicit bias in terms of optimization geometry","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.627701Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:518cb2e55cbe1dd092fea9d53dbc4cc6d48615d9c146949c0f1caf6227037f76","observation_id":"f4813ebe-ee89-4306-8ee2-6abad40e1482","resolution":{"observed_at":"2026-08-16T05:51:59.627701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T05:51:59.633365Z","title":"Deepsee k-r1: Incen- 143 tivizing reasoning capability in llms via reinforcement le arning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.633365Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:0b92f16e617968a2d51e33b07c761c4fce1fe99aca174af950f6c74950393760","observation_id":"742f87a5-4a8b-43a6-b3a9-4485707e371e","resolution":{"observed_at":"2026-08-16T05:51:59.633365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.637988Z","title":"Statistical intervals: a guide for practitioners , volume 92","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.637988Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:d807a7061d77780522cc3e7d641404100724ba31cd59ff4a7abef6e19f357d35","observation_id":"c458cc9f-599f-437d-a368-583e748d1471","resolution":{"observed_at":"2026-08-16T05:51:59.637988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.642366Z","title":"Graph representation learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.642366Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1f4c3ccbe100d04dde40c5877744caaae5fdf199ceb35eb241652df48ef084e4","observation_id":"8a60ce10-0a04-4f75-b6b5-b92238230270","resolution":{"observed_at":"2026-08-16T05:51:59.642366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14699","last_updated":"2023-04-08T05:10:00Z","snapshot_observed_at":"2026-08-16T16:13:05.849306Z","submitted_at":"2022-11-27T01:53:29Z","title":"A Theoretical Study of Inductive Biases in Contrastive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14699","snapshot_observed_at":"2026-08-16T05:51:59.649584Z","title":"A theoretical study of induc tive biases in con- trastive learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.649584Z"},"links":{"cited_paper":"/paper/2211.14699","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:91949ff02c603d98881d448a60b3b6e7f7361f4abd36a9bea2e474551ce2059c","observation_id":"f016e92d-27d1-43db-be97-d7a5b7283ae8","resolution":{"observed_at":"2026-08-16T05:51:59.649584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.656043Z","title":"P rovable guarantees for self-supervised deep learning with spectral contrastive loss","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.656043Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a7a4ea45cfc0a565ec03128a8ecd0c5aca6ec965aeefd4a4badb7c34f5866723","observation_id":"a5510de7-6673-42c4-ad44-2a0a8a962e70","resolution":{"observed_at":"2026-08-16T05:51:59.656043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.661248Z","title":"HaoChen, Colin Wei, Ananya Kumar, and Tengyu Ma","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.661248Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:8fefe05a9fc65a1e0b2315588aacaa634d8167a0f0c7b287ee5514dc179d5261","observation_id":"df7244b1-0d64-4e5a-9e36-b11833318a99","resolution":{"observed_at":"2026-08-16T05:51:59.661248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.665836Z","title":"Fairness without demographics in repeated loss minimization","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.665836Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:38b082a7a4c33f47e2eacc046bfd5240f461f6e5b6c1c1d947b9be2125e60325","observation_id":"ed05ceb7-fedf-45fc-8739-7745e921b9ff","resolution":{"observed_at":"2026-08-16T05:51:59.665836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.669324Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.669324Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:782294a5312ebf9effdba1e70760aa6c7abf4a0736c7e2f9dbe3a11b80759194","observation_id":"9d26de3f-497c-46f9-91a5-a1230b45cd05","resolution":{"observed_at":"2026-08-16T05:51:59.669324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.673320Z","title":"D eep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.673320Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1ca2be4a79742bb09cffd0fc3ab1882ca372528027c99844a001a50322f2d150","observation_id":"141e888b-5b18-426c-8926-f43653c7c23e","resolution":{"observed_at":"2026-08-16T05:51:59.673320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.676776Z","title":"Hearst, S.T","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.676776Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:19c0bb62c128c07620bd7df3ef0f04ed8b23b53102e4299b7d07a70a1d79675d","observation_id":"db95eb65-9879-4a7a-bb4b-7a1d94f6128d","resolution":{"observed_at":"2026-08-16T05:51:59.676776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-16T05:51:59.680297Z","title":"Hinton, Oriol Vinyals, and Jeﬀrey Dean","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.680297Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:da4cd7004fa1a803cd766b6fb5d5a4c0e41c3e5c152582094ddfae401b73e30a","observation_id":"704a1269-489d-4772-bfd2-51ee2db99710","resolution":{"observed_at":"2026-08-16T05:51:59.680297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.684627Z","title":"Denoising di ﬀusion probabilistic mod- els","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.684627Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:3bff0e3e0b1703d3ef853aa86147232365c7377770a2b2de129167f7191ccf11","observation_id":"d6a6402d-143c-4f55-aee3-91615656bc22","resolution":{"observed_at":"2026-08-16T05:51:59.684627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.688204Z","title":"TabPFN: A transformer that solves small tabular classiﬁcat ion problems in a sec- ond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.688204Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:56666698329b9618ba73f1c0268f4f5a497d203c071c258cf14d163824460151","observation_id":"84f15c13-64e5-45d7-97f6-f0a6f71b97f7","resolution":{"observed_at":"2026-08-16T05:51:59.688204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.692084Z","title":"Accurate pre- dictions on small data with a tabular foundation model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.692084Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:5b6b9962a90138b659867447c21a61a8a3f278aab5423981f7f307186afc5bd2","observation_id":"18f1d191-16b6-4ffe-82f9-54aa1a8b7381","resolution":{"observed_at":"2026-08-16T05:51:59.692084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.695834Z","title":"Tagging performance corr elates with author age","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.695834Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a2c070c34b6037a7614049e2481e836aad9a78b09fa4006ecac4eff7f01aed38","observation_id":"d6d638d6-5749-472e-a799-200ccc12a7d9","resolution":{"observed_at":"2026-08-16T05:51:59.695834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.700349Z","title":"Correcting sample selection bias by unlabeled d ata","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.700349Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:26dc05c37d9e32bf4adcfb04bbad5899ef9f6354c23562531ca229861ba54f89","observation_id":"49ff9b32-bf0a-4e47-8acb-33699532bc66","resolution":{"observed_at":"2026-08-16T05:51:59.700349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.704607Z","title":"A survey on hallucination in large language models: Principles, tax onomy , challenges, and open questions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.704607Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:2434575bc1ef2d73186e5705e47b66a5cc7ccde504df09a52fe7f2a1ffd6c3ee","observation_id":"73ff7fab-0a24-43a7-a666-b86606f81219","resolution":{"observed_at":"2026-08-16T05:51:59.704607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.709334Z","title":"Improving trans- former optimization through better initialization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.709334Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:f4a1efd1db0ff5428c5fadf8591b3cf245c915818b175c035308a46158a31ab0","observation_id":"9092bd70-c812-43f5-9ff1-d3f1ad7dbe77","resolution":{"observed_at":"2026-08-16T05:51:59.709334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.712812Z","title":"Robust estimation of a location paramete r","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.712812Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1e7f293d1c16526db36cf577501160303b68b01e0d9cd844f736f1ac46e62cf5","observation_id":"5cd1e345-a7f8-448d-b9cc-db421b08578d","resolution":{"observed_at":"2026-08-16T05:51:59.712812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08614","last_updated":"2016-12-10T13:37:06Z","snapshot_observed_at":"2026-08-14T21:42:06.055643Z","submitted_at":"2016-08-30T19:45:09Z","title":"What makes ImageNet good for transfer learning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08614","snapshot_observed_at":"2026-08-16T05:51:59.716820Z","title":"What m akes imagenet good for transfer learning? arXiv:1608.08614, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.716820Z"},"links":{"cited_paper":"/paper/1608.08614","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:caa968d0d108d79ba183432bc2d06c9e81a579848f27a6adc0b2d3e9baa74fab","observation_id":"d65f80c5-0ab7-4d0a-b052-eb2c3a5bcd19","resolution":{"observed_at":"2026-08-16T05:51:59.716820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.721769Z","title":"Position: The platonic representation hypothesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.721769Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:414fd7403481260ef70ccb23287af027352f871391e01c29395db12ea3945874","observation_id":"bea3be3b-aedc-428b-8100-1c8e16d1fcaa","resolution":{"observed_at":"2026-08-16T05:51:59.721769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.725979Z","title":"Estimation of non-normalized statist ical models by score match- ing","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.725979Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:ebbddaa7d32af563b3223062fc8141e38ebcb4c196ef5e8b8c9dc9354480f30e","observation_id":"8a38035b-ad89-4747-b07e-38ce950d5046","resolution":{"observed_at":"2026-08-16T05:51:59.725979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.730395Z","title":"T o wards a learning theory of representation alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.730395Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:6a57adde4777d1cb73a0d128fd48446c9446481c3fa481c369eec12199ba8830","observation_id":"bc86c677-a40b-44ae-9387-d7b035edd728","resolution":{"observed_at":"2026-08-16T05:51:59.730395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.734310Z","title":"Adap- tive mixtures of local experts","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.734310Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:e19f2fc18f6cd8c653589776ae9079a1c79952ce03e2e3a2fbad67021d7240cc","observation_id":"d8f6bed6-1ff2-4df6-b3e5-ed3b4919c72c","resolution":{"observed_at":"2026-08-16T05:51:59.734310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.738471Z","title":"Neu ral tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.738471Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:418b4d9acbf1aaa666c8899da62ce9c99dc9dbb8e8194102232a530c168ea59b","observation_id":"b1501e9f-21a7-4243-8e92-527d45e0e12f","resolution":{"observed_at":"2026-08-16T05:51:59.738471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-16T05:51:59.742570Z","title":"Ope- nai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.742570Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:d6f6f2ef62971c3181843114281bae0fea53576e4e777d37c2f7b1fb0db1172b","observation_id":"33d0dbaf-3505-4101-846c-e8ebe257396e","resolution":{"observed_at":"2026-08-16T05:51:59.742570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.746617Z","title":"Schapire, and Matus Telgarsky","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.746617Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:d886df21510d04ec5991e17a23664527d0700b85c23ce93bd95d441199e664f3","observation_id":"63b0724a-fa9d-447a-b7a8-ecbe0bbd7b1c","resolution":{"observed_at":"2026-08-16T05:51:59.746617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.751055Z","title":"Understanding dimen- sional collapse in contrastive self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.751055Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:7ad9953091f25cc6a87633e5b2391810e1f4f062d9a0fd5d457f386be305c4e9","observation_id":"1c98fe10-79fc-4fe3-aed0-18e772609524","resolution":{"observed_at":"2026-08-16T05:51:59.751055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.754898Z","title":"Johnson, Ayoub El Hanchi, and Chris J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.754898Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:0dd633f62eb2376670b9880b5c423dba3618a4de6bda52d9abdf8d92e0826eef","observation_id":"309f4594-1412-48e9-b602-e441f8397492","resolution":{"observed_at":"2026-08-16T05:51:59.754898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.759249Z","title":"Highly accurate protein structure predic tion with alphafold","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.759249Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:e09def3af0a728efa7e8e808828b40fa02e59756122d64743c95ac8d10c48e03","observation_id":"4ef02d25-2c1c-4de4-84aa-ddf8df94bb9c","resolution":{"observed_at":"2026-08-16T05:51:59.759249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.763680Z","title":"Thinking, fast and slow","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.763680Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:cbad503b568fa2f4110ef8e87f7382312c279ab17fb9bd092fa9d767a46b8de1","observation_id":"17a0227c-9963-4bb7-ac38-6be0c8229a62","resolution":{"observed_at":"2026-08-16T05:51:59.763680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-16T05:51:59.767093Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.767093Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:3b64151b2e77c8324e438572a03759307e224cea563becbf522f90b0e15cc424","observation_id":"d76cfd67-614b-4619-8ad0-ccc247104288","resolution":{"observed_at":"2026-08-16T05:51:59.767093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.771078Z","title":"Supervised contrastive learn- ing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.771078Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:cf63157e7168abf8bf4ff804667830c905bda97cff7f32bca9c2c86cd9b58ab7","observation_id":"43f2640a-7961-49cd-b6df-a931cc468fc2","resolution":{"observed_at":"2026-08-16T05:51:59.771078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.774449Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.774449Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:8bcbbc7bff7831ee4f32f92bff335c8c4cd1c0415bae43f7f83a67e78b969d21","observation_id":"515a613a-f16b-4f6a-ba30-4576cb0802f9","resolution":{"observed_at":"2026-08-16T05:51:59.774449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.778677Z","title":"Kingma and Max Welling","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.778677Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:99a29cecb48c632f6dae6e58979303faf3de9873e9c70f3710c7013dfa96c67d","observation_id":"98e0f7be-826f-46e8-80e6-21276a60eac3","resolution":{"observed_at":"2026-08-16T05:51:59.778677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.782146Z","title":"Wilds: A benchmark of in-the-wild distribution shifts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.782146Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:789c876758695d746c92bee505a8b7cbabcf8a4f095d8c5a15102892f3a84fe5","observation_id":"3bacc212-9f02-4d34-87c6-293a7a202983","resolution":{"observed_at":"2026-08-16T05:51:59.782146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.785730Z","title":"Sim- ilarity of neural network representations revisited","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.785730Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:ff1164cff14f44a9fdc89799423eee048438debf84145652387401fabbe41c84","observation_id":"0bf59d66-35a2-4c2d-aeff-b4ad7fd163c4","resolution":{"observed_at":"2026-08-16T05:51:59.785730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.789500Z","title":"Representational similarity analysis-connecting the branches of systems ne uroscience","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.789500Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:004ce7a9808eca417c98e73c543eda2a09fe3d1fdb8c50f8832af4320c8bd93b","observation_id":"49cb6b2e-d943-412d-ae91-1dc0991c4f57","resolution":{"observed_at":"2026-08-16T05:51:59.789500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.793267Z","title":"Learning multi ple layers of features from tiny images, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.793267Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:79aedcfc23aba20895d5666881f030b7b4eaa7b53e30515b63870d5b5bab46de","observation_id":"176a7b54-b559-40aa-a932-a3621afb9f84","resolution":{"observed_at":"2026-08-16T05:51:59.793267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.796881Z","title":"Imagenet classiﬁcation with deep convolutional neural networks","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.796881Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:bae12e973909fdf7dfb73787ff86eb69227f3531a7d1a806e9275078abad0cf7","observation_id":"ff7ab0d0-4617-4fcb-ac83-0944e07b5ee5","resolution":{"observed_at":"2026-08-16T05:51:59.796881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.800303Z","title":"Temporal ensembling for sem i-supervised learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.800303Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:75ac868ad4e5d609254353343ff8da3f1f9ac0dbab60b24992105211507ef937","observation_id":"7891c4ab-14ba-4572-a7eb-a43bb27c940a","resolution":{"observed_at":"2026-08-16T05:51:59.800303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.804112Z","title":"How we analyzed the compas recidivism algorithm","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.804112Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:11a8ac4bb3307c3e33186d27da2f5b8f8ae1c17902f3e4be1092d57591e9b4ad","observation_id":"09aca944-0df7-4e03-8274-24194f66d32a","resolution":{"observed_at":"2026-08-16T05:51:59.804112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.807672Z","title":"Gradient-based learning applied to document recognition","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.807672Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:560a340796af0e2b7d25ee30efec911d4312248b1ee3626621a693d3ec85d717","observation_id":"0f882aa1-90a8-4e5f-9d17-eaa9d4a340fc","resolution":{"observed_at":"2026-08-16T05:51:59.807672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.811111Z","title":"P redicting what you already know helps: Provable self-supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.811111Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:584a2610937e8c2a542057ff755664d768cd0b5ce7191542a4d7dff3d66409f7","observation_id":"a6cdd1b8-4ddd-4822-9ad7-f300c1453136","resolution":{"observed_at":"2026-08-16T05:51:59.811111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.814532Z","title":"Chain of thought empow- 146 ers transformers to solve inherently serial problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.814532Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:9c06c5bf42d5fd83290353bb28edf536f1ad8d7f5be4d883f1b749ca8cb5a1b2","observation_id":"64dba457-bae9-420d-af64-3b429f90bbe9","resolution":{"observed_at":"2026-08-16T05:51:59.814532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18976","last_updated":"2024-04-29T14:45:28Z","snapshot_observed_at":"2026-08-16T13:56:57.038398Z","submitted_at":"2024-04-29T14:45:28Z","title":"Foundations of Multisensory Artificial Intelligence","version":1},"cited_work":{"arxiv_id":"2404.18976","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.18976","snapshot_observed_at":"2026-08-16T05:52:00.476244Z","title":"Foundations of Multisensory Artificial Intelligence","venue":"cs.LG","work_id":"ffb84fc6-a4e0-43c7-9e2b-a81f0d73bfaf","year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.818173Z"},"links":{"cited_paper":"/paper/2404.18976","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:8718a541b0b6ad961b6ad2bd562149a9a65dc461969e800b32a43760789e28ea","observation_id":"1c7be8b3-3589-4f1a-8be7-281b8a93b123","resolution":{"observed_at":"2026-08-16T05:52:00.483091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.822223Z","title":"Masked pre- diction tasks: a parameter identiﬁability view","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.822223Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:82f49e9c45c8e7594146d987c9632ec73cc4b6aa64d8ea76c738692d7493a92b","observation_id":"1d4c3103-25c3-4167-a1bd-955142a2cb7f","resolution":{"observed_at":"2026-08-16T05:51:59.822223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.825845Z","title":"HaoChen, Adrien Gaidon, and Tengyu Ma","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.825845Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:75bdabc05ae359057d6e6cd0dbcb9fc9de00096a621b072156390c87c106b22c","observation_id":"5ec5248c-69c2-4053-bb69-69ce8c06e9c8","resolution":{"observed_at":"2026-08-16T05:51:59.825845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T10:14:28.605704Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":171},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 100 of 171 outbound references and 0 inbound Pith citation observations for arXiv:2504.19792."}