{"as_of":"2026-08-18T13:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e980a896a0010248ea15083dd7ebba7b087b34c97966d89812d70dcb0852046","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:35:40.566009Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03294/citation-record","integrity":"/paper/2608.03294/integrity","json":"/paper/2608.03294/citation-record.json","paper":"/paper/2608.03294"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.16873","last_updated":"2026-05-04T15:43:18Z","snapshot_observed_at":"2026-08-12T23:19:07.065640Z","submitted_at":"2026-01-23T16:28:22Z","title":"Provably Learning Attention with Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.16873","snapshot_observed_at":"2026-08-10T04:35:40.460762Z","title":"2026 , note =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.460762Z"},"links":{"cited_paper":"/paper/2601.16873","citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:6108e771c8ac7c3af118abcf10160ad979f5ca58225ea1b2718de2a9a182bc03","observation_id":"c26f6633-2f09-40b8-ade7-8cfbeb2fc914","resolution":{"observed_at":"2026-08-10T04:35:40.460762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.465730Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.465730Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:4d98a0c910a81ad680e254585da846987808ef7ea831f93e6425dce78739c1a4","observation_id":"65df3673-0801-497a-981f-3059b5b6c678","resolution":{"observed_at":"2026-08-10T04:35:40.465730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.471437Z","title":"Tony and Zhang, Anru , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.471437Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:6aca40f874b897f57a4ce022446eed6f8319ae71c9d133e6ccaa1655f9c5b372","observation_id":"3986f063-e877-4c67-816b-f67e7a9ec0f7","resolution":{"observed_at":"2026-08-10T04:35:40.471437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.475557Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.475557Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:370accb46bf627a2eec3e45aa63f5a326300bb81c783e48d0548b40ba6af5a63","observation_id":"7d770188-dc4e-40dd-8435-11b9e4357aa6","resolution":{"observed_at":"2026-08-10T04:35:40.475557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.479899Z","title":"Forty-third International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.479899Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:6b631564247ad0d40d1ab2e6bf87ecfabf86c780d46653ab98a43ad790a3e933","observation_id":"94eeaa46-bebe-4e30-a7d7-4267162c29a9","resolution":{"observed_at":"2026-08-10T04:35:40.479899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.483891Z","title":"Proceedings of the 57th Annual ACM Symposium on Theory of Computing , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.483891Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:6cf8a5b6e9bc0c5733efcba77861b3979bcc9a17ba8db466392a68f8dd8d600e","observation_id":"df922608-4481-45a9-951d-ae04c3490ebe","resolution":{"observed_at":"2026-08-10T04:35:40.483891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.487880Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.487880Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:760a83f65246f07c70a68e9a2b1ff2c46f369ada08f186703ceff465421bc05b","observation_id":"c9a84ddd-b73a-446f-8172-f705a90bce3c","resolution":{"observed_at":"2026-08-10T04:35:40.487880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.491621Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.491621Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:9b7d5db7049e5774f2df0fc55399addc9eaf77351196cc2e1d452cb78efb7236","observation_id":"8c132bbf-cc18-4aab-927e-f6b8b31d59f7","resolution":{"observed_at":"2026-08-10T04:35:40.491621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.495404Z","title":"Linear Algebra and its Applications , volume =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.495404Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:fa5e8fe2771f51622ce7a7060adae5c6c5bc0ea041c5f1f9ac2414f1136b49a1","observation_id":"af55bbe8-fa62-4761-85f2-9b1e00df56ae","resolution":{"observed_at":"2026-08-10T04:35:40.495404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.500524Z","title":"Applied and Computational Harmonic Analysis , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.500524Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:475f359e84646c0d6ee929608623cabca784508601fd290f43bb45f8ef66ea54","observation_id":"dc2ef5bc-012e-4165-962f-68a8f74bfdaa","resolution":{"observed_at":"2026-08-10T04:35:40.500524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.504667Z","title":"Proceedings of the 42nd International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.504667Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:b7fc12e8fab377c54b650d7acbff3937a189b7bc5e05b178893be45828d4d245","observation_id":"b622f7c1-d51a-448c-a343-2d4bb92e55d3","resolution":{"observed_at":"2026-08-10T04:35:40.504667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.508802Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.508802Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:0d5cae7df02beb910b0b7b464ccf70981b463e9a3895f13f2675154225aa6537","observation_id":"167aabe2-7b6c-4eb4-a3b0-33038eca82ae","resolution":{"observed_at":"2026-08-10T04:35:40.508802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.512990Z","title":"Machine Learning , volume =","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.512990Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:699d65c518b05a6cde96109c96888ed6eab181e39f34d68d10702e4d01de476f","observation_id":"4e6a5861-d2f5-422d-927e-e9acdfb14281","resolution":{"observed_at":"2026-08-10T04:35:40.512990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.517219Z","title":"Advances in Neural Information Processing Systems , editor =","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.517219Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:e42d43df554edb0aa1168ddb31d79c230abf7f7ce54ec52c418d1586d83e0805","observation_id":"c10f8202-3723-4724-bf99-22b3c94a0587","resolution":{"observed_at":"2026-08-10T04:35:40.517219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.520945Z","title":"and Meka, Raghu , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.520945Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:5a2fcfea16320013f7dc2dd17108f08ac8cd4eee5e53beaa652210b66ab70dac","observation_id":"63cc6500-b933-4498-8d13-afaff2296fdd","resolution":{"observed_at":"2026-08-10T04:35:40.520945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.524946Z","title":"An Exact Poly-Time Membership-Queries Algorithm for Extracting a Three-Layer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.524946Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:172045d7628ce7d318ad8ed83f433fd66c2fe5fb993a343048f9c72f3041621b","observation_id":"580b97c8-fd72-4211-adfc-32010284bdee","resolution":{"observed_at":"2026-08-10T04:35:40.524946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.528933Z","title":"Stealing Machine Learning Models via Prediction","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.528933Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:4299be72f57b69d817cef052be688fd9078d071714a7456df592f915f439f63d","observation_id":"7230cb89-bc9d-49aa-b6b3-d24ed50f39b2","resolution":{"observed_at":"2026-08-10T04:35:40.528933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.532851Z","title":"29th USENIX Security Symposium (USENIX Security 20) , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.532851Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:30c85ccf967656cbd182c204397cc26dc516ef90d0c8c677de5172b0f485cd0d","observation_id":"3beb66f0-1cae-4438-b978-7c414582558e","resolution":{"observed_at":"2026-08-10T04:35:40.532851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.536757Z","title":"Proceedings of the 41st International Conference on Machine Learning , series =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.536757Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:1ad61524fab1de31053f6b67f919744b6e2693d5e28077863bcb872fac4928e5","observation_id":"8de27fd2-c707-4952-86a8-d45ca239d26b","resolution":{"observed_at":"2026-08-10T04:35:40.536757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.540255Z","title":"Advances in Cryptology -- EUROCRYPT 2025 , editor =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.540255Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:c2f4f2ef4a1a3fcb0882a309cad54f10dc58fea0ad2c9713414d3d2794098d32","observation_id":"fde48822-c90b-4a85-a471-dd7db810b471","resolution":{"observed_at":"2026-08-10T04:35:40.540255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.543869Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.543869Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:29660e8aab3096fe10eccdfd7e86b08cb63a7c801746f4d0188c9eb42fc53964","observation_id":"9a4bbfc1-c0c7-47b1-88cd-25662543fdc7","resolution":{"observed_at":"2026-08-10T04:35:40.543869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.547447Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.547447Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:1ca944b78977f7719acf582c26b071b0005aac26719d6d41aebac3ba28a9bd8d","observation_id":"cabdfeb9-5b0e-473d-a082-4869ddd1e5b8","resolution":{"observed_at":"2026-08-10T04:35:40.547447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.551005Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.551005Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:a651605d4a4630d7c6ca4f7f5b425696a444e2b2c6be17e05d548cbef2b9e6e3","observation_id":"7ef46545-4022-437e-a8ec-3c9f0fcf6995","resolution":{"observed_at":"2026-08-10T04:35:40.551005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.554659Z","title":"Dragan and Moritz Hardt , title =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.554659Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:a2695d2fdf6999d1409e95510086bae4ce47f55effcc5928b34663205d023301","observation_id":"89e55952-eb4e-41ae-b2dd-cef59b9e33b8","resolution":{"observed_at":"2026-08-10T04:35:40.554659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.558258Z","title":"International Conference on the Theory and Application of Cryptology and Information Security , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.558258Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:e9bd8eb9ac32ee14d778ca51bad3a169b9bd653c7406dac4de3dd237a47d372c","observation_id":"5949e40d-2dea-4e46-b236-7f04a01e716d","resolution":{"observed_at":"2026-08-10T04:35:40.558258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04211","last_updated":"2020-02-07T17:44:52Z","snapshot_observed_at":"2026-08-17T12:24:48.299916Z","submitted_at":"2019-08-12T15:48:34Z","title":"On Identifiability in Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.04211","snapshot_observed_at":"2026-08-10T04:35:40.561992Z","title":"arXiv preprint arXiv:1908.04211 , year=","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.561992Z"},"links":{"cited_paper":"/paper/1908.04211","citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:91afd426972a7b461da4bda590bab954f2dcf244cc4fd469737be42c84e20d8e","observation_id":"6fc581b4-b572-4423-82a8-e8121b416603","resolution":{"observed_at":"2026-08-10T04:35:40.561992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:35:40.566009Z","title":"Annual international cryptology conference , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T04:35:40.566009Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:b38cf766bfe979e74283d1221768cec8c94424262ebdefb85c69dcb1597961f2","observation_id":"ab78d523-c55b-421e-9d32-c958ba4c755c","resolution":{"observed_at":"2026-08-10T04:35:40.566009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-07T05:20:15Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T21:41:57.944815Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2608.03294."}