{"as_of":"2026-08-10T10:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:244c0f0cc29a4772293bd1cb87d826c458ef4f4197d4082273ecefb28eed11e3","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:19:32.086306Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06398/citation-record","integrity":"/paper/2506.06398/integrity","json":"/paper/2506.06398/citation-record.json","paper":"/paper/2506.06398"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1906.00587","last_updated":"2019-06-03T05:58:54Z","snapshot_observed_at":"2026-08-09T17:30:00.405338Z","submitted_at":"2019-06-03T05:58:54Z","title":"Unconstrained representation of orthogonal matrices with application to common principle components","version":1},"cited_work":{"arxiv_id":"1906.00587","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.00587","snapshot_observed_at":"2026-08-07T10:19:32.899839Z","title":"Unconstrained representation of orthogonal matrices with application to common principle components","venue":"stat.ME","work_id":"543171ff-2b73-411d-9f68-ef0f36e55052","year":2019},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:30.156526Z"},"links":{"cited_paper":"/paper/1906.00587","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:6591d7fab723de1c78571e0dd374a39fe4e0883ed5ede482bfd0aba2c227a1f0","observation_id":"7ad8bfc7-20ff-40bd-8769-c3b653705cd5","resolution":{"observed_at":"2026-08-07T10:19:32.953160Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:19:33.512288Z","title":"and Mendelson, S","venue":null,"work_id":"080718d8-e6cd-4208-95d7-fe2bb1285408","year":2002},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:30.246368Z"},"links":{"citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:97f78e1a9e43bb196467310bc8a40ff7fe393fd99c8a0ac60a07c789c4280cf4","observation_id":"b3798f3b-b609-4e96-810c-33ba724c48a3","resolution":{"observed_at":"2026-08-07T10:19:33.587061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.12806","last_updated":"2022-12-23T19:17:30Z","snapshot_observed_at":"2026-08-06T03:10:38.937459Z","submitted_at":"2021-05-26T19:49:47Z","title":"A Universal Law of Robustness via Isoperimetry","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.12806","snapshot_observed_at":"2026-08-07T10:19:30.332600Z","title":"and Sellke, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:30.332600Z"},"links":{"cited_paper":"/paper/2105.12806","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:9281121d5cd3e32dd841815676aefba9201f2ec169e0bd3b1776d24a9af053d1","observation_id":"dc171fc4-10e0-47ee-b9bd-4a73c2207481","resolution":{"observed_at":"2026-08-07T10:19:30.332600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00651","last_updated":"2021-07-01T17:59:30Z","snapshot_observed_at":"2026-08-10T08:35:36.769671Z","submitted_at":"2021-07-01T17:59:30Z","title":"AutoFormer: Searching Transformers for Visual Recognition","version":1},"cited_work":{"arxiv_id":"2107.00651","doi":null,"metadata_source":"pith","pith_arxiv_id":"2107.00651","snapshot_observed_at":"2026-08-07T10:19:32.663668Z","title":"AutoFormer: Searching Transformers for Visual Recognition","venue":"cs.CV","work_id":"2247e414-9373-4265-92cf-ff6e2c61544d","year":2021},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:30.410597Z"},"links":{"cited_paper":"/paper/2107.00651","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:8e3a75f907fd3f72eee32ef6fbe3307c962ab8d2147904134a7c9f2d74cab7f0","observation_id":"4c728534-3b2a-451e-b66d-0d34509433ac","resolution":{"observed_at":"2026-08-07T10:19:32.774839Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00641","last_updated":"2021-05-03T06:16:33Z","snapshot_observed_at":"2026-08-09T17:30:03.238836Z","submitted_at":"2021-05-03T06:16:33Z","title":"Naturalistic audio-visual volumetric sequences dataset of sounding actions for six degree-of-freedom interaction","version":1},"cited_work":{"arxiv_id":"2105.00641","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.00641","snapshot_observed_at":"2026-08-07T10:19:32.523992Z","title":"Naturalistic audio-visual volumetric sequences dataset of sounding actions for six degree-of-freedom interaction","venue":"cs.MM","work_id":"a117be28-7056-4abc-96b8-c73b8d6f8052","year":2021},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:30.528890Z"},"links":{"cited_paper":"/paper/2105.00641","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:21bdac45bee3f5fa956bf5a26d29ad975a32cb6e0350a5a4f42de93effbcefe1","observation_id":"ac2c5f3c-aa08-4d11-8ea9-b037cd5082a6","resolution":{"observed_at":"2026-08-07T10:19:32.595687Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:19:33.373188Z","title":null,"venue":null,"work_id":"dfe93212-3622-4c8a-9412-aec7b506fde8","year":2021},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:30.792586Z"},"links":{"citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:c9b96b680f8f99833fd08a81fa9afef625daafe56b445890dad1a4eb8d809ca0","observation_id":"54ce9111-c511-4091-88f4-902a3ec13d5d","resolution":{"observed_at":"2026-08-07T10:19:33.434175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:19:33.235630Z","title":null,"venue":null,"work_id":"172b9899-8c27-4187-bdf8-380da5cf201b","year":2020},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:30.889653Z"},"links":{"citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:5abf8019cc39919ad4220f3a36aec5a501d6cb2246375bde011f8fdc5c895a52","observation_id":"042b9330-00aa-4be9-8d94-0ad9898dab60","resolution":{"observed_at":"2026-08-07T10:19:33.304007Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:19:33.049054Z","title":null,"venue":null,"work_id":"a69a10a2-6291-4133-8f4a-291c4a6fe8cb","year":2021},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:30.920214Z"},"links":{"citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:567821d7f4f76916341800f4a55ebbc0f478f050f70719e8e4ba1ee8ca7c0ae9","observation_id":"10216bbe-cc0d-41a7-b5e1-4748187d990b","resolution":{"observed_at":"2026-08-07T10:19:33.127874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.02496","last_updated":"2021-02-02T11:11:28Z","snapshot_observed_at":"2026-08-06T10:31:27.632134Z","submitted_at":"2020-08-06T07:43:19Z","title":"ConvBERT: Improving BERT with Span-based Dynamic Convolution","version":3},"cited_work":{"arxiv_id":"2008.02496","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.02496","snapshot_observed_at":"2026-08-07T10:19:32.390881Z","title":"ConvBERT: Improving BERT with Span-based Dynamic Convolution","venue":"cs.CL","work_id":"e6659d90-dcde-46e6-999e-b180aa7c7a04","year":2020},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:30.997976Z"},"links":{"cited_paper":"/paper/2008.02496","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:0cccb56a16a18758f15a0880e597aaa6741ed57a6ed0e4f9fa5cccb1e79215eb","observation_id":"d2675f38-6d3c-48e6-81bc-c3b8073fb057","resolution":{"observed_at":"2026-08-07T10:19:32.445067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.12076","last_updated":"2018-05-30T16:50:28Z","snapshot_observed_at":"2026-07-06T06:42:05.870167Z","submitted_at":"2018-05-30T16:50:28Z","title":"Towards Understanding the Role of Over-Parametrization in Generalization of Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.12076","snapshot_observed_at":"2026-08-07T10:19:31.112025Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.112025Z"},"links":{"cited_paper":"/paper/1805.12076","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:b5d9b0cb6d1c665043dbab63257f59b100807051ddc08ea6517b9b099e526524","observation_id":"b04b5812-7f82-4b0c-a0eb-1b8c113e494f","resolution":{"observed_at":"2026-08-07T10:19:31.112025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12409","last_updated":"2022-04-22T18:20:48Z","snapshot_observed_at":"2026-08-07T11:26:24.970964Z","submitted_at":"2021-08-27T17:35:06Z","title":"Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12409","snapshot_observed_at":"2026-08-07T10:19:31.163992Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.163992Z"},"links":{"cited_paper":"/paper/2108.12409","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:880d004e612180903b2a91e9613a51afffd70be4993a4d976604477cb4ab22ec","observation_id":"509fa2d2-c090-4cfa-ae32-e654d9307da2","resolution":{"observed_at":"2026-08-07T10:19:31.163992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-07T10:19:31.246860Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.246860Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:233a4c9dfa53cf5dd35cae4f7f3bacc4a5ecaa43704c7fdbfdaedc9fd16d3303","observation_id":"8c9bd168-5301-482c-8fbd-2d8016df0ff0","resolution":{"observed_at":"2026-08-07T10:19:31.246860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.02155","last_updated":"2018-04-12T18:51:33Z","snapshot_observed_at":"2026-07-06T06:26:51.386842Z","submitted_at":"2018-03-06T13:13:11Z","title":"Self-Attention with Relative Position Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.02155","snapshot_observed_at":"2026-08-07T10:19:31.342489Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.342489Z"},"links":{"cited_paper":"/paper/1803.02155","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:5f52baa00c077b007180802c1bf4b5c71873a743685d4b8a154e0346936d79de","observation_id":"006bdfb4-ff31-4941-8949-ab402362cee8","resolution":{"observed_at":"2026-08-07T10:19:31.342489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-07T10:19:31.465132Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.465132Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:286276e954ffe603993f69dd8c8cd2c89951f4d74442c2f6db2fce7b297cb046","observation_id":"732b4608-62bf-481d-b2c4-5589b82ba0c2","resolution":{"observed_at":"2026-08-07T10:19:31.465132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10739","last_updated":"2020-06-18T17:59:11Z","snapshot_observed_at":"2026-07-06T09:30:32.320227Z","submitted_at":"2020-06-18T17:59:11Z","title":"Fourier Features Let Networks Learn High Frequency Functions in Low Dimensional Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10739","snapshot_observed_at":"2026-08-07T10:19:31.558026Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.558026Z"},"links":{"cited_paper":"/paper/2006.10739","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:649e6c46b4b71a9967c3250000e4620b62a3ff5f06e255b6c0f69712ec4acc28","observation_id":"27c16d0e-8299-4644-922a-4a85167292ac","resolution":{"observed_at":"2026-08-07T10:19:31.558026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06732","last_updated":"2022-03-14T10:35:35Z","snapshot_observed_at":"2026-08-10T04:20:43.440597Z","submitted_at":"2020-09-14T20:38:14Z","title":"Efficient Transformers: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.06732","snapshot_observed_at":"2026-08-07T10:19:31.651037Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.651037Z"},"links":{"cited_paper":"/paper/2009.06732","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:a2e4fccee0bb8847c1fcf9cd80ea64142510801376bb9a941bcaf28a04430418","observation_id":"10f83ea2-3167-47af-be9d-9e55322ee048","resolution":{"observed_at":"2026-08-07T10:19:31.651037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-07T10:19:31.725031Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.725031Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:322a8ffa417d8c614d371bcfa0b91c7017c16475057ff7cfcfa3962544035d24","observation_id":"1a322ae6-6cac-4d3b-ae9c-6b92d9341414","resolution":{"observed_at":"2026-08-07T10:19:31.725031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.04745","last_updated":"2020-06-29T07:55:12Z","snapshot_observed_at":"2026-08-06T10:39:08.684653Z","submitted_at":"2020-02-12T00:33:03Z","title":"On Layer Normalization in the Transformer Architecture","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.04745","snapshot_observed_at":"2026-08-07T10:19:31.818374Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.818374Z"},"links":{"cited_paper":"/paper/2002.04745","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:aca37e36ce7e7f3a59c4c35b0cec5f7c72c2ab238e6da562d1e8b62937bfef98","observation_id":"4a130c54-a35d-459e-a7ab-7aa0a4cda795","resolution":{"observed_at":"2026-08-07T10:19:31.818374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01243","last_updated":"2024-01-19T05:44:28Z","snapshot_observed_at":"2026-07-06T07:18:55.228651Z","submitted_at":"2018-12-04T06:41:46Z","title":"Efficient Attention: Attention with Linear Complexities","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01243","snapshot_observed_at":"2026-08-07T10:19:31.887945Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.887945Z"},"links":{"cited_paper":"/paper/1812.01243","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:5274d0c3a82e29a2e010463110095c6d079c257b8b1bbb357c84e0586a278422","observation_id":"d8d327d9-dd89-41f0-a37d-80218f5ed129","resolution":{"observed_at":"2026-08-07T10:19:31.887945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10077","last_updated":"2020-02-25T03:12:57Z","snapshot_observed_at":"2026-07-06T08:46:09.705605Z","submitted_at":"2019-12-20T19:49:32Z","title":"Are Transformers universal approximators of sequence-to-sequence functions?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10077","snapshot_observed_at":"2026-08-07T10:19:31.995796Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:31.995796Z"},"links":{"cited_paper":"/paper/1912.10077","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:e566743b3f0ac5cb67a4567dad52deef1c052e89b4128cf17c153e06178806ef","observation_id":"84a07a37-1edc-468f-b252-8735743043ca","resolution":{"observed_at":"2026-08-07T10:19:31.995796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05895","last_updated":"2019-12-30T03:53:04Z","snapshot_observed_at":"2026-08-07T19:31:58.707080Z","submitted_at":"2019-10-14T02:23:43Z","title":"Transformers without Tears: Improving the Normalization of Self-Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05895","snapshot_observed_at":"2026-08-07T10:19:32.086306Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:32.086306Z"},"links":{"cited_paper":"/paper/1910.05895","citing_paper":"/paper/2506.06398"},"observation_digest":"sha256:ceb180ca5c671b6dd0f35c5fc1575c774c4284d1cf568864869e23fee72ace3d","observation_id":"c2e63405-5085-4b8d-b3c8-131abe7a4d76","resolution":{"observed_at":"2026-08-07T10:19:32.086306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06398","last_updated":"2025-06-05T23:02:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T17:30:00.913672Z","submitted_at":"2025-06-05T23:02:18Z","title":"Theoretical Analysis of Positional Encodings in Transformer Models: Impact on Expressiveness and Generalization"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":4,"verified_fuzzy":1},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2506.06398."}