{"as_of":"2026-08-20T17:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:748ed9d729a55de4b54c830d082674bc4a03786c62f9b0ffdbd623dcaa723fdf","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:35:49.377235Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T20:55:03.949611Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2605.08934","last_updated":"2026-06-16T20:17:16Z","snapshot_observed_at":"2026-08-11T08:05:03.537052Z","submitted_at":"2026-05-09T13:08:07Z","title":"From Mechanistic to Compositional Interpretability","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-12T02:42:26.173782Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2605.08934"},"observation_digest":"sha256:9596d6a1b626c7e7286ba5b8d30b58b3c1fb536b662f1437e995ae39874b5089","observation_id":"874bfd00-bb95-45fc-8c44-9e0058a67dff","resolution":{"observed_at":"2026-05-12T02:46:18.513779Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2605.14764","last_updated":"2026-05-14T12:26:50Z","snapshot_observed_at":"2026-08-12T16:23:02.417907Z","submitted_at":"2026-05-14T12:26:50Z","title":"Compositional Sparsity as an Inductive Bias for Neural Architecture Design","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T20:55:03.949611Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2605.14764"},"observation_digest":"sha256:00416b358f2468ca1e2dd921c79a93cf5008ed20cdb4a286ed5a51a4d9a345ac","observation_id":"9c70c116-e10a-4ea2-b64e-b0bf3286452f","resolution":{"observed_at":"2026-07-01T14:35:46.881494Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2605.25608","last_updated":"2026-05-25T09:02:13Z","snapshot_observed_at":"2026-08-17T10:51:42.402493Z","submitted_at":"2026-05-25T09:02:13Z","title":"Learning Sparse Compositional Functions with Norm-Constrained Neural Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T20:33:03.854188Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2605.25608"},"observation_digest":"sha256:cf93d79093d1b6a0ebb4cf0f250880d311357b445704f93f1308d9c020008d89","observation_id":"2cb45454-5812-42e6-b4ba-d9335a0d6b1e","resolution":{"observed_at":"2026-06-29T20:33:58.324454Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2606.19941","last_updated":"2026-06-18T08:39:07Z","snapshot_observed_at":"2026-08-03T00:29:25.767611Z","submitted_at":"2026-06-18T08:39:07Z","title":"Compositionality Emerges in a Narrow Depth-Connectivity Regime: Architecture Constraints and Solution Manifolds","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T18:22:56.676469Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2606.19941"},"observation_digest":"sha256:052ba5c6348b87c9a431b2c4a375cea666d88e5868505dc84e85967e86891e26","observation_id":"954a043a-8377-4f1d-ba2a-c1fdece242eb","resolution":{"observed_at":"2026-07-04T03:09:29.761198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2606.26705","last_updated":"2026-06-25T07:34:20Z","snapshot_observed_at":"2026-08-09T12:01:27.764764Z","submitted_at":"2026-06-25T07:34:20Z","title":"Algorithmic Foundations of Deep Learning: Complexity-Theoretic Rates and a Characterization of Universal Approximation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T05:19:56.528337Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2606.26705"},"observation_digest":"sha256:253657bceea0fede4f46a10260372998363148d73f52e71d297c841e63a80dcd","observation_id":"f3510f5b-4d76-4733-bbdc-0ec6a85ce116","resolution":{"observed_at":"2026-07-04T13:19:50.617560Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.02550/citation-record","integrity":"/paper/2507.02550/integrity","json":"/paper/2507.02550/citation-record.json","paper":"/paper/2507.02550"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2108.10573","last_updated":"2021-11-24T02:03:49Z","snapshot_observed_at":"2026-08-19T17:25:49.755068Z","submitted_at":"2021-08-24T08:19:05Z","title":"The staircase property: How hierarchical structure can guide deep learning","version":2},"cited_work":{"arxiv_id":"2108.10573","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.10573","snapshot_observed_at":"2026-08-06T20:35:50.453090Z","title":"The staircase property: How hierarchical structure can guide deep learning","venue":"cs.LG","work_id":"7b29fcb8-50e7-44ff-9cc8-8c02f7ccf8ed","year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.772274Z"},"links":{"cited_paper":"/paper/2108.10573","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:8de3a127a0737342cb3dfc0fb86ea4b1d1c7e42fc9dfdbbd47e701d7f832121e","observation_id":"e99bff07-a10d-4722-afad-72238bc9266d","resolution":{"observed_at":"2026-08-06T20:35:50.551112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:00.509052Z","title":"B., and Misiakiewicz, T","venue":null,"work_id":"92c406d4-1d5d-47b1-9ea8-7d038924a383","year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.811795Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:22fc1ac1432937d726b9cc3bf55b46300c765bea2f67eef139d0322a7a855fa7","observation_id":"7cdaa196-698b-4399-ac44-1105d89ca93a","resolution":{"observed_at":"2026-08-06T20:36:00.569728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11055","last_updated":"2023-08-31T21:09:03Z","snapshot_observed_at":"2026-08-19T17:25:19.071612Z","submitted_at":"2023-02-21T23:16:23Z","title":"SGD learning on neural networks: leap complexity and saddle-to-saddle dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.11055","snapshot_observed_at":"2026-08-06T20:35:42.849130Z","title":"Sgd learning on neural networks: leap complexity and saddle-to-saddle dynamics","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.849130Z"},"links":{"cited_paper":"/paper/2302.11055","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:ce5ac19643351c21375b024beb1a2768f5ac38ba8232dad7034a9d755a01ba18","observation_id":"eb208633-a54a-4dbe-b5a0-c6fa7cffcaa3","resolution":{"observed_at":"2026-08-06T20:35:42.849130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:42.930526Z","title":"J., Bambrick, J., Bodenstein, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.930526Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:1ff94a3d2b37658609d441b085b64244c5751a2ef38b955c215d660ff0c3b98b","observation_id":"9ad3c338-a46f-4795-9beb-51881d6f4d6c","resolution":{"observed_at":"2026-08-06T20:35:42.930526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:00.335840Z","title":"Online Learning and Information Exponents : On The Importance of Batch size, and Time / Complexity Tradeoffs , June 2024 a","venue":null,"work_id":"95f84ece-dc93-41d5-b0b3-1ff3838ecd67","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.998566Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:7ac4c6329d0f326b23abd2a78a3feb0b28c1fbe5b7e4271b1c034ba37d1f1bd6","observation_id":"d443a002-135f-450f-b756-feeb276c8daf","resolution":{"observed_at":"2026-08-06T20:36:00.434860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:00.140061Z","title":"Repetita Iuvant : Data Repetition Allows SGD to Learn High-Dimensional Multi-Index Functions , May 2024 b","venue":null,"work_id":"d40f0250-801e-4855-bfa7-8a09583e1eb6","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.110115Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:98e6748df1b1919ebbfe4e7d8b25dca06086af1c05ecb8811e84ec023c267ded","observation_id":"d85e8884-f347-47ae-8b55-5a70f7769c9c","resolution":{"observed_at":"2026-08-06T20:36:00.230962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.934736Z","title":"and Barak, B","venue":null,"work_id":"e84ff43e-0906-4bdf-b0fe-c359255a1884","year":2009},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.214120Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:738b82203a045f75921be067be8b5efaa37673bbe4510827b5637db0e003e685","observation_id":"308e7920-98cb-48e9-8858-01dfa2cc7915","resolution":{"observed_at":"2026-08-06T20:36:00.037713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.721045Z","title":"B., Gheissari, R., and Jagannath, A","venue":null,"work_id":"8bc6c6c1-eb18-44ca-afe9-5918fda28f33","year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.290256Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:a54e9f024676b16fdef80a9fb8e5c1f601d8be32128ee62a6353975d96978a33","observation_id":"19fb3b33-3e57-4038-9fd7-f952535e9bf6","resolution":{"observed_at":"2026-08-06T20:35:59.827444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.538654Z","title":"and Kohler, M","venue":null,"work_id":"aed2c413-11eb-461d-8887-fdd21e6ad82f","year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.381225Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:80979744c4e987477d31b9c7b2a92511c310e70edbb075f8f4e8a1665dfc72c6","observation_id":"442507d7-44e7-43b5-b40a-095677094893","resolution":{"observed_at":"2026-08-06T20:35:59.600703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14711","last_updated":"2023-09-18T17:50:21Z","snapshot_observed_at":"2026-08-16T15:05:11.845771Z","submitted_at":"2023-08-28T17:11:41Z","title":"Fast Feedforward Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14711","snapshot_observed_at":"2026-08-06T20:35:43.474963Z","title":"and Wattenhofer, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.474963Z"},"links":{"cited_paper":"/paper/2308.14711","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:d7a216b7a81f5ff605de75ac97889f156751ad5f230972e29e65513a84ccaf8f","observation_id":"6075bcdb-7196-458f-a53a-448fb0cb73ea","resolution":{"observed_at":"2026-08-06T20:35:43.474963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.372783Z","title":"Deep neural network approximation theory for high-dimensional functions, 2021","venue":null,"work_id":"3c54355d-36a7-4cef-ae20-d1e1f6aeb0a4","year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.568166Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:fafba160b29a6d3286a8652be7fa556daf34865a33bc5a79a94dcc4b9048384b","observation_id":"20c6c8cd-1cd4-4e03-9c35-18764ac29c6c","resolution":{"observed_at":"2026-08-06T20:35:59.440412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11110","last_updated":"2024-06-17T00:19:16Z","snapshot_observed_at":"2026-08-16T13:42:28.158912Z","submitted_at":"2024-06-17T00:19:16Z","title":"How Neural Networks Learn the Support is an Implicit Regularization Effect of SGD","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11110","snapshot_observed_at":"2026-08-06T20:35:43.680310Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.680310Z"},"links":{"cited_paper":"/paper/2406.11110","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:7a7a3fa902dd514b0ac76362e52ede166026bab86978140f3662e39e01d7f46e","observation_id":"fa3d9f13-c2d7-4737-8c8a-4e26292769cf","resolution":{"observed_at":"2026-08-06T20:35:43.680310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.161936Z","title":null,"venue":null,"work_id":"91d07b3c-7633-4068-bcc3-2ab0e5694e6d","year":1981},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.747835Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:d64526dcb906085eb0230da124248424af35a1dd934508160d7be11d4c2d8fa2","observation_id":"527a08e8-4fb0-4857-abc9-e61bed1fe3a6","resolution":{"observed_at":"2026-08-06T20:35:59.268398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.967259Z","title":null,"venue":null,"work_id":"95fefc8b-44d5-4698-90c6-837217d839ed","year":1964},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.876835Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:8a2cb21004725523ff5118ec6031ccdeb6811bf4b40024025f625a32f934a7b7","observation_id":"ca3b217e-5beb-4706-ad45-2aeb9f303f1c","resolution":{"observed_at":"2026-08-06T20:35:59.047724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.789793Z","title":"and Gerstner, W","venue":null,"work_id":"eb057096-5407-43d3-91d5-bd2c0da00632","year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.953307Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:7d0e9b9d908eca3a4187b23f0ddca0e28d1d75acbdc1d3d40a52c9708a962276","observation_id":"1f699ffb-c3e5-48de-9a26-abf4dd73a5dc","resolution":{"observed_at":"2026-08-06T20:35:58.875851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.562056Z","title":null,"venue":null,"work_id":"d6719e9b-fd38-4ed4-a68f-3976c2081f89","year":1901},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.062372Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:c00387e47dc9457baa2bbd21edc7894ad553cdd576cbff8b3bea05d03c0208c7","observation_id":"e74d1236-8fb1-4f9a-866d-2c87da0d6f64","resolution":{"observed_at":"2026-08-06T20:35:58.664776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.413344Z","title":"and Hsu, D","venue":null,"work_id":"4356e105-06ce-4738-9ad1-e3650a3d8099","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.167655Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:3b83d5518e8d63afa6747bc21267e59cb8bad5f54fd3f7074ede701b0f10ee7e","observation_id":"e3caacd7-685c-4619-b310-622b5a651e38","resolution":{"observed_at":"2026-08-06T20:35:58.501369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.210647Z","title":"A., Horvitz, E., Kamar, E., Lee, P., Lee, Y","venue":null,"work_id":"c34ed844-32be-4efa-aff3-8cf57608c82c","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.213489Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:2a1248636c259649404cc139a0b46b8557ff07f0f4a88a38e50532f6ca41e3f5","observation_id":"5c0484e8-b78f-4807-8ae3-4b94923981fa","resolution":{"observed_at":"2026-08-06T20:35:58.321955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:44.279950Z","title":"M., Favero, A., and Wyart, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.279950Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:b889b9a2dff9c7f0a0bbc4e930dc24606afaae94ad4a699f967a2870a7e060de","observation_id":"a1d838dc-cd89-4974-bbdb-d09f874ec05e","resolution":{"observed_at":"2026-08-06T20:35:44.279950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.006211Z","title":"Superposition of many models into one","venue":null,"work_id":"7596d57f-97c1-4a7e-ab1f-0e04ff72169c","year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.320140Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:124f145a45e7e11912f8de475dec83cf19f5b2949e9ad9f6d4ef2b31f73daff4","observation_id":"fa97e1fe-a96d-4c91-941e-f750ba9f1585","resolution":{"observed_at":"2026-08-06T20:35:58.099368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.835502Z","title":"M., Khosla, A., Pantazis, D., Torralba, A., and Oliva, A","venue":null,"work_id":"2c3f5ee1-0614-4772-98a0-4bcffdea81f7","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.388911Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:f177c74b448e9eb844f35f9c8c1ca9ae1f4a4a72c68cdba48cd8b76677621d55","observation_id":"eb0dff58-42b0-4c61-86d7-3713a72e2ea0","resolution":{"observed_at":"2026-08-06T20:35:57.940980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.06128","last_updated":"2023-06-14T14:55:15Z","snapshot_observed_at":"2026-08-16T16:46:20.058476Z","submitted_at":"2022-07-13T11:25:19Z","title":"Compositional Sparsity, Approximation Classes, and Parametric Transport Equations","version":2},"cited_work":{"arxiv_id":"2207.06128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.06128","snapshot_observed_at":"2026-08-06T20:35:50.209534Z","title":"Compositional Sparsity, Approximation Classes, and Parametric Transport Equations","venue":"math.NA","work_id":"7f48d6e8-1ac8-4978-b011-face917ec1bf","year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.452664Z"},"links":{"cited_paper":"/paper/2207.06128","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:49b586a9f5c90c5fb631c9753dcf303209b4f1e21622089b410beddca63c2569","observation_id":"b6f41265-6ec9-4dc5-b182-8dc7bd82f80e","resolution":{"observed_at":"2026-08-06T20:35:50.304551Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.667019Z","title":"F., Gou, Z., Shao, Z., Li, Z., Gao, Z., Liu, A., ..., and Zhang, Z","venue":null,"work_id":"e7340ce7-e383-486a-9dbf-7c8ebf93d114","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.512157Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:9791869cafb4620ebecb3e3d412f5ed48a8df69e4b784d2207719b05e3c302a1","observation_id":"5f63bab7-3ba4-4d82-abae-f1f0c3a7d6e6","resolution":{"observed_at":"2026-08-06T20:35:57.746079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.499700Z","title":"Seeing it all: Convolutional network layers map the function of the human visual system","venue":null,"work_id":"b89348c2-cda0-4d9e-bcf9-75f54dd5a39c","year":2017},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.615708Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:782a3baa833026ec16e5d878961498c121aebfa719a894d3b35790b5245697e1","observation_id":"9c6ee06e-a500-4d24-a9a9-25573103d067","resolution":{"observed_at":"2026-08-06T20:35:57.565716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19150","last_updated":"2024-09-27T21:25:00Z","snapshot_observed_at":"2026-08-16T13:14:37.871507Z","submitted_at":"2024-09-27T21:25:00Z","title":"On the Power of Decision Trees in Auto-Regressive Language Modeling","version":1},"cited_work":{"arxiv_id":"2409.19150","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.19150","snapshot_observed_at":"2026-08-06T20:35:49.967485Z","title":"On the Power of Decision Trees in Auto-Regressive Language Modeling","venue":"cs.CL","work_id":"bcec7195-b335-4410-aca6-df1fe7a32941","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.689412Z"},"links":{"cited_paper":"/paper/2409.19150","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:6884bb46f52293db7c63eae2087ef8f13ae960aa6e1f3568a8c24a206b00f415","observation_id":"a21c5af1-c143-46b1-9914-28cfb916c835","resolution":{"observed_at":"2026-08-06T20:35:50.075447Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.12051","last_updated":"2019-12-28T10:44:16Z","snapshot_observed_at":"2026-08-18T18:31:58.924871Z","submitted_at":"2019-09-26T12:38:41Z","title":"The Implicit Bias of Depth: How Incremental Learning Drives Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.12051","snapshot_observed_at":"2026-08-06T20:35:44.758347Z","title":"The implicit bias of depth: How incremental learning drives generalization","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.758347Z"},"links":{"cited_paper":"/paper/1909.12051","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:6b959e368e001adb427e0c6f7f6f8494f9bb8ad41053ce30eb2c92197fe71a90","observation_id":"8b518776-ef2f-4a79-b39f-86d15618409f","resolution":{"observed_at":"2026-08-06T20:35:44.758347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:44.802137Z","title":"How to construct random functions","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.802137Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:952a2bb39890dd50b88762bf413e27e551e1d78efe5efb0da3db621ff54d765e","observation_id":"af59e188-861f-4fa5-98bf-0dd5f415b7f5","resolution":{"observed_at":"2026-08-06T20:35:44.802137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.302334Z","title":"In-context learning of large language models explained as kernel regression","venue":null,"work_id":"d87c510a-c6ab-4e74-8097-5bbe6a365385","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.867356Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:e6ad308e8d61090f81d9b3e938d907baaeb7f1b56df1f7d7e1204cb94a9ff183","observation_id":"76c74de4-5054-4fa1-9cb9-992d5ce82a8f","resolution":{"observed_at":"2026-08-06T20:35:57.384097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.111768Z","title":"The Elements of Statistical Learning","venue":null,"work_id":"5e38ba4f-7583-4bc4-bac4-b4a9b056a39b","year":2009},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.911215Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:206b9461611546bd80e01737dc708fb569177ba94619f916757b0fd90803d310","observation_id":"2cc0ea4a-dc28-4eac-9237-890b1b95e389","resolution":{"observed_at":"2026-08-06T20:35:57.188360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.918576Z","title":"A., and Lenat, D","venue":null,"work_id":"7a94cb02-a25e-498e-8e29-a4be9bec697c","year":1983},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.976560Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:41d6563df87c9e8482c3b5304fd412ad6c0208646fb79ab600860ba766b6d42d","observation_id":"b8687f2b-90dd-4c2e-8cd4-b80a5d6710af","resolution":{"observed_at":"2026-08-06T20:35:57.005878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.719855Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"d09b06ec-65e0-41cc-bd50-e0ba2c02de0b","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.035769Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:40019cfac29867f464534b1fdab713ff74369daeb8133074dca6d3fe6c35c43a","observation_id":"26872b84-ea83-4f3e-a85e-7c26065e903b","resolution":{"observed_at":"2026-08-06T20:35:56.840878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/wics.1222","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Introduction to manifold learning","venue":"Wiley Interdisciplinary Reviews Computational Statistics","work_id":"3c358f37-58a7-413d-91d4-79a585626106","year":2012},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.111301Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:3866b626207fe8f9d822bc1a93c4cc313c7ba03c85b4e50e1190851830960744","observation_id":"aa00676b-f899-4e2f-8017-62284f9613a7","resolution":{"observed_at":"2026-08-06T20:35:49.676055Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.532467Z","title":"An Introduction to Statistical Learning (2nd Ed.)","venue":null,"work_id":"d3dbe5b4-4c14-4c41-a9cf-6ac63a82f213","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.198883Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:201f2d35ff7caf887151e9ce7889b002f9acf2b88cf92006fc17d7557ccbfad9","observation_id":"ca21cb50-e602-4b66-8cfd-e1c26c98645f","resolution":{"observed_at":"2026-08-06T20:35:56.630270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:45.243438Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.243438Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:b05279be0d8ee712602dd588f2ad1e12cf53e43917285c1ef08ebe82671f5430","observation_id":"2d4f180d-c4e7-46b0-8d99-31847779dd1e","resolution":{"observed_at":"2026-08-06T20:35:45.243438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.379258Z","title":"Deep learning without poor local minima","venue":null,"work_id":"10ec0253-6ac7-4807-9121-921bb134321f","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.300787Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:02a75410d8f6e2de1f0405337731e13af1033c004be42de91bba9ea5493e27f6","observation_id":"e06c74d8-5f58-4fa8-ab5c-7a2c014d8ddc","resolution":{"observed_at":"2026-08-06T20:35:56.423948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.182139Z","title":"T., Wang, J., and Weber, M","venue":null,"work_id":"e37460ec-b6be-4762-9a22-e45644ea6e2e","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.350616Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:687e4273c794194d86bcef177ec16a23c380a663837c0fdf20e70dffb5083828","observation_id":"05dab68f-3e64-400e-bed8-57045b46b039","resolution":{"observed_at":"2026-08-06T20:35:56.278467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.018889Z","title":"and Langer, S","venue":null,"work_id":"d0660c32-6275-402b-8849-ee6bd23e3d0c","year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.429697Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:c6fd6365b3132ba8c3fd6cea2a884633980a5d163d38a98e003b0057d80a4029","observation_id":"72e6be2a-ccd3-4ade-b4af-b0285726b29e","resolution":{"observed_at":"2026-08-06T20:35:56.098996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.842213Z","title":null,"venue":null,"work_id":"f6b2bcb7-cbd8-4883-9e23-592b8f80719a","year":2012},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.521785Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:625218d4214f534fda8a58e2827d822a3cb8f8598a28d2aade31ddc736641b88","observation_id":"731184ab-0d3c-4a20-8af1-19df8db0a9cb","resolution":{"observed_at":"2026-08-06T20:35:55.917425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.702417Z","title":"D., Oko, K., Suzuki, T., and Wu, D","venue":null,"work_id":"28280cd3-6f30-4393-964e-05690ab77607","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.526743Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:923ef6694622d985061786778183a1eb26684b0a9a90f82bab27169460caa95b","observation_id":"7b892b69-2bd8-43f0-9bf4-92808f0f2a1b","resolution":{"observed_at":"2026-08-06T20:35:55.773481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13256","last_updated":"2024-10-11T03:29:14Z","snapshot_observed_at":"2026-08-16T13:24:15.529527Z","submitted_at":"2024-08-23T17:59:03Z","title":"How Diffusion Models Learn to Factorize and Compose","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13256","snapshot_observed_at":"2026-08-06T20:35:45.581706Z","title":"How diffusion models learn to factorize and compose","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.581706Z"},"links":{"cited_paper":"/paper/2408.13256","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:44a4f663462090c6aed8c4e5ac1b00c2117fea61bbb9cb5b21260956e9325b33","observation_id":"c39a7277-4305-41af-8a9d-40b39ba9a403","resolution":{"observed_at":"2026-08-06T20:35:45.581706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.531589Z","title":null,"venue":null,"work_id":"bb106f44-f2f0-4659-b51a-b52e3e690836","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.658428Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:3ecb1a02e07b2a793aa24ae0f8d395fa28518406515c96751cc9ea6a62e38a21","observation_id":"2b082c95-24fa-4b0a-aa38-b8bb59dcafa9","resolution":{"observed_at":"2026-08-06T20:35:55.619673Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10749","last_updated":"2023-05-02T14:16:15Z","snapshot_observed_at":"2026-08-19T19:51:31.689851Z","submitted_at":"2022-10-19T17:45:48Z","title":"Transformers Learn Shortcuts to Automata","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10749","snapshot_observed_at":"2026-08-06T20:35:45.748309Z","title":"T., Goel, S., Krishnamurthy, A., and Zhang, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.748309Z"},"links":{"cited_paper":"/paper/2210.10749","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:cfd3ce1e93d92eeb7d4c72c775743d251555106eb40e4c513a211b088efa5cb4","observation_id":"9a3b1e9c-f6fe-44f1-9d6b-2972aaa0ce8d","resolution":{"observed_at":"2026-08-06T20:35:45.748309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-08-20T14:16:54.482339Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-08-06T20:35:45.863740Z","title":"Auto-regressive next-token predictors are universal learners","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.863740Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:426c213937753b2b81913dc0884e2be9c5948ff5406a495e5355088ae98e867f","observation_id":"5bf35c01-612c-46e8-86fb-028b8ecd4be8","resolution":{"observed_at":"2026-08-06T20:35:45.863740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-1-4615-2696-4_11","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Learning Boolean Functions via the Fourier Transform, pp.\\ 391--424","venue":null,"work_id":"1462c582-a515-4a6d-bda0-0d038724655a","year":1994},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.936074Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:c7c43030d28c48a4d07b96cc1a718d413b158e68190bdc69e2c6653cad154089","observation_id":"b872bbc7-e1f4-4728-9ac9-4f6cc2423fb4","resolution":{"observed_at":"2026-08-06T20:35:49.554609Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.351198Z","title":"and Zhang, H","venue":null,"work_id":"b2c811e9-4c11-4318-b3dc-9189414b26f3","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.015301Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:68fcd815bd69db7af6265b4db56496e81ef99f7cd8b0b2ce41934f06b239e185","observation_id":"a523dd33-fad3-43df-b0a7-c5bcb6b8030b","resolution":{"observed_at":"2026-08-06T20:35:55.417340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.124761Z","title":"Learning real and boolean functions: When is deep better than shallow? CBMM Memo \\#45, arXiv preprint, 2016","venue":null,"work_id":"83150aa1-ab13-424a-a4bf-4348b118758b","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.061469Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:79fa457b6d2c0f893dcf08b23f53d458eeeeff1d8a599a142772a6750ea7310c","observation_id":"f3b0230c-03cb-414f-bdf6-cc9e443e5fef","resolution":{"observed_at":"2026-08-06T20:35:55.236917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01288","last_updated":"2022-11-03T22:44:21Z","snapshot_observed_at":"2026-08-16T16:19:05.583334Z","submitted_at":"2022-11-02T17:10:07Z","title":"Characterizing Intrinsic Compositionality in Transformers with Tree Projections","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01288","snapshot_observed_at":"2026-08-06T20:35:46.153360Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.153360Z"},"links":{"cited_paper":"/paper/2211.01288","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:547eb2df84b3a3c1999a7e6492a99d400aae6c23255e7e05ec2b8ee4d6295e76","observation_id":"6a5cef10-d278-4cc6-bc9d-07fefec90099","resolution":{"observed_at":"2026-08-06T20:35:46.153360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.949368Z","title":null,"venue":null,"work_id":"6a4421e9-6b30-47b5-8ba7-8b35b3efc33e","year":2012},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.263565Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:f50ffda848df403d1ae52841568858c874a596e4564335cad923bec55940cd20","observation_id":"a4fc79cf-eef3-4534-b034-180672d7b69f","resolution":{"observed_at":"2026-08-06T20:35:55.021714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:46.323598Z","title":"and Simon, H","venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.323598Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:ad9a308e2ffa1ab24f97b366f5aba390a73e19e21df7ab742def227644d9f6e1","observation_id":"53d9b589-5bd3-466e-a452-b580c8f717f4","resolution":{"observed_at":"2026-08-06T20:35:46.323598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.800722Z","title":null,"venue":null,"work_id":"a4d60265-63ac-418c-9286-26e9edb36c15","year":2017},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.410812Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:0dc1665d36612e90b2f8f059a6a6549a82b9252b3a86d6fbda8353c17aefd145","observation_id":"a2faf52c-60b9-4365-b77f-f9cc50e680a3","resolution":{"observed_at":"2026-08-06T20:35:54.877809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.615713Z","title":"Gpt-4 technical report","venue":null,"work_id":"478a59ba-7777-4e36-aca0-834dca9b6705","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.492087Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:da6cf1f25ab413e5fe6afb8153cb99c6df5a0d55f28767e935ae9824043a3e77","observation_id":"53accd1a-8ac0-4098-896b-b80c2c4a3632","resolution":{"observed_at":"2026-08-06T20:35:54.699287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.477176Z","title":"The impact of depth on compositional generalization in transformer language models","venue":null,"work_id":"6872ff0c-f5aa-4742-bf45-d3f708b3d0a8","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.600158Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:e2d2132db5569c1a068b28a1f4c7c7590646722f174be161085313fcae1b6144","observation_id":"1bd8dbf2-7bf2-4c65-8658-540cb9037e13","resolution":{"observed_at":"2026-08-06T20:35:54.525671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.310854Z","title":"On efficiently computable functions, deep networks and sparse compositionality","venue":null,"work_id":"2d66df1c-6f96-42aa-a140-0dd5de1ab5fc","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.688775Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:502fbc9bd3c768eb99eeb92209560625e2476c1d75a37bb7c6b636047b3b7016","observation_id":"3ee6e408-b621-4560-b9ed-c18a3c5add67","resolution":{"observed_at":"2026-08-06T20:35:54.401350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:46.837693Z","title":"and Fraser, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.837693Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:05d9fccdeeb0a3a0de01e59a9629ae6e4033f27dd9a68a9800a71bc3c65e475e","observation_id":"3f6dfcf2-09aa-442c-92d5-a62911b0a53f","resolution":{"observed_at":"2026-08-06T20:35:46.837693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.095381Z","title":"Why and when can deep-but not shallow-networks avoid the curse of dimensionality: A review","venue":null,"work_id":"46d88379-5f42-4cf7-a946-47544e90338f","year":2017},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.960322Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:4f31f1dc1b9441d7bb49f9e6355bbbc03179327b4938e49e9b2672231576b7f5","observation_id":"57e211e7-3e12-425a-920c-0e8c70aab84a","resolution":{"observed_at":"2026-08-06T20:35:54.219378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:53.887837Z","title":null,"venue":null,"work_id":"a1f40a0d-cfa9-4304-a9e9-316275c21fa7","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.113257Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:e20abfdd0bd1bf9d5ff93dbd580284f583ae687bbb9f16d6f55125e5c8f9da5a","observation_id":"62a9519f-7ade-4681-88d2-ac007bf95290","resolution":{"observed_at":"2026-08-06T20:35:54.011847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:47.302129Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.302129Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:133e8ddaf4ed21674a7fd204ceb5c4acc5fbffd2f4bff57a6d3ae74c66a7c86d","observation_id":"5de9dea2-4a07-4ecf-88a0-20a7a30923f6","resolution":{"observed_at":"2026-08-06T20:35:47.302129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:47.434826Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.434826Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:75e8b13036365f84f69efda23ff8a086bf7d81057084e8f80623acce0c1b9eac","observation_id":"9b94ad60-0589-408d-a197-5b2699f0ada7","resolution":{"observed_at":"2026-08-06T20:35:47.434826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:53.641909Z","title":"P., Dupont, E., Ruiz, F","venue":null,"work_id":"b5125654-0e63-4fa4-823b-bbbde4fe397d","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.565369Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:8baec6c041df15ba67479ea6c054b8f4d0c32d160f428d5604bdb82c9179dd1a","observation_id":"1b6fdb02-357d-4b19-8c97-c32a4c5abcbf","resolution":{"observed_at":"2026-08-06T20:35:53.778454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:53.445307Z","title":"Nonparametric regression using deep neural networks with ReLU activation function","venue":null,"work_id":"4adb3921-8b20-4163-a031-af14fd921c24","year":2020},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.751370Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:05432a4c7675be26433dc9edc45c18cd4e48632f7b3cfdc31d4e5a4caf8f48e1","observation_id":"75bc159f-009c-421a-8d10-d5932b7a78b3","resolution":{"observed_at":"2026-08-06T20:35:53.541956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:53.231600Z","title":"J., Guez, A., Sifre, L., van den Driessche, G., Schrittwieser, J., Antonoglou, I., Panneershelvam, V., Lanctot, M., Dieleman, S., Grewe, D., Nand, D., et al","venue":null,"work_id":"26e6a7e6-f54d-4c25-88ef-f3364dcd94e9","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.954028Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:dbe95b36140f8d10bf37f722e5724bd6237179998041fe94211a7b4c93124269","observation_id":"820de09c-dec8-4782-85fa-b439b175fbcf","resolution":{"observed_at":"2026-08-06T20:35:53.348298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:48.078364Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.078364Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:9544fe41baf6641a6e392e9f14e7b9632da317dd96352eedc34ac1cead91a827","observation_id":"a318c086-e97c-474a-8e25-6b42054f15bd","resolution":{"observed_at":"2026-08-06T20:35:48.078364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:48.214114Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and go through self-play","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.214114Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:15fb4d71adaf7aaeda8ff2d4e0f2daf3779c461c4e7a8a19d9a6c3bde6232fc0","observation_id":"8bed4428-2811-4aa4-983e-93ecccb2865d","resolution":{"observed_at":"2026-08-06T20:35:48.214114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.977762Z","title":"How sparse attention approximates exact attention?your attention is naturally \\ n c\\ -sparse","venue":null,"work_id":"c5f5e79d-9038-40ad-bdc7-6022ed77f4be","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.368102Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:6e30fc1d65f6879097dd2a329daf78a43e6dcc775ae69b22afce109f0df1de77","observation_id":"d3bb53d1-a788-4c58-af60-6608a47867c5","resolution":{"observed_at":"2026-08-06T20:35:53.097686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.771448Z","title":"and Krause, A","venue":null,"work_id":"98dfe4c7-f200-46f1-a5ed-94a4cb005063","year":2012},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.470090Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:26fca37ffa9579db91e1bfade2d9ba53bded6621bc2dd09e07423657438739e2","observation_id":"9af30030-b52c-4c81-bfab-9e1ad4549106","resolution":{"observed_at":"2026-08-06T20:35:52.871723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:48.615249Z","title":"H., Wu, Y., Le, Q","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.615249Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:467c3307f60903d1ee5ae6f8a9bb0c75452708e4575e966bf75f0a439eb3574a","observation_id":"0840e7a4-581c-4a4c-9758-e4d7727af747","resolution":{"observed_at":"2026-08-06T20:35:48.615249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.521224Z","title":null,"venue":null,"work_id":"a33b7980-816f-413b-a641-fb0dcf759be9","year":1992},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.763584Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:0cabdff7f890874bae0ead2512afbe4778bb8711b429effa7167416d53d50797","observation_id":"3b558b9c-d1a2-4aac-8494-1aac998b0b61","resolution":{"observed_at":"2026-08-06T20:35:52.666672Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.240900Z","title":null,"venue":null,"work_id":"2670e76e-b356-41bb-a145-eb802d82a3a0","year":2013},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.916005Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:1c912f0b8329793a456a84a002e97aac6f1f663f0c31222662db7a229e4a4e7e","observation_id":"ddcfaf34-3b60-4574-8a6a-fc8463b7b1d3","resolution":{"observed_at":"2026-08-06T20:35:52.370428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.032400Z","title":"M., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A","venue":null,"work_id":"c3f82cb5-0660-4230-807b-6136af6eda67","year":2017},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.985402Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:15910bc57d5c33be0ab01fc723a628df1a3f1dbb527cecfede0d5d560c3fa27a","observation_id":"0745daa3-2f6d-4db5-b793-ad5cd5902ec2","resolution":{"observed_at":"2026-08-06T20:35:52.124579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:51.787195Z","title":"and Belinkov, Y","venue":null,"work_id":"91490e0a-bd5a-4dd2-aec5-d9021bcbc001","year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.058097Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:99b83cb045cfee34c3406f16de011976ad468cdffc60bca74c7746084d983cf0","observation_id":"e71a933a-0aff-46f0-84db-9a680a601d64","resolution":{"observed_at":"2026-08-06T20:35:51.909365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:51.544061Z","title":"H., Xia, F., Le, Q., and Zhou, D","venue":null,"work_id":"d09010c7-6ae4-4a8a-af57-5401464e0491","year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.127526Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:5bdd545b84407ccb98dcecff51facaaf0e04f43ffc5bec2b77f757c6acf102ea","observation_id":"c3d7c163-7644-4388-abf8-4c3b4bc90192","resolution":{"observed_at":"2026-08-06T20:35:51.657602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:51.318477Z","title":null,"venue":null,"work_id":"958f5953-6b7a-4ba1-99a9-6e8e119cca66","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.198979Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:10618f421cdbf388cb080db25b17a5a93259b3e920412b47fa0592baa5ec8fd6","observation_id":"6d7a7c77-01ad-407d-88ba-bf5047774d2e","resolution":{"observed_at":"2026-08-06T20:35:51.438853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:51.057172Z","title":"F., Solomon, E","venue":null,"work_id":"d6fb193a-a2de-45e6-9229-a21026b6624a","year":2014},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.247677Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:2596a4cd2bd5dbff07803ef7d8e9449b05b16e977f1a26a2856eacd9fdedb545","observation_id":"3bafaca6-ce83-42fb-a7b4-b03ce3a05a02","resolution":{"observed_at":"2026-08-06T20:35:51.163429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:50.880551Z","title":"L., Cao, Y., and Narasimhan, K","venue":null,"work_id":"fb8579e2-b433-41a6-87b9-abf48d39ddd0","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.298106Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:ff49090826b1df6da828c7ca080c99be25b98b605051348036b8c6ab92e5304c","observation_id":"e372e614-dc5c-4e90-a76a-6aeb54ba28c2","resolution":{"observed_at":"2026-08-06T20:35:50.956001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:50.648041Z","title":"Symmetry induces structure and constraint of learning","venue":null,"work_id":"03817cf3-2be5-468e-9b7d-b0770ac0ea37","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.377235Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:b43a7d00c8dcef99cd7948cdd417fa140dd2eb373b4f1d451a7c11c296e418bb","observation_id":"0c017c28-23e7-48d8-bd84-39a6e78e2187","resolution":{"observed_at":"2026-08-06T20:35:50.757280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T17:25:30.503019Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":5,"verified_fuzzy":40},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 5 inbound Pith citation observations for arXiv:2507.02550."}