{"as_of":"2026-08-14T13:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76d74301ac83c3b0359cf3c673b149a470c982e6528e03514b3efe0d2d6a5257","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:41:01.420244Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.02919/citation-record","integrity":"/paper/2502.02919/integrity","json":"/paper/2502.02919/citation-record.json","paper":"/paper/2502.02919"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-14T05:15:12.190552Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-09T10:41:01.239337Z","title":"L.; Kiros, J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.239337Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:bfc5b90569bce34a11b52b29d3f1b9d60517b0616ab782d94c910018fc42d279","observation_id":"e661855d-07eb-4557-b828-2c81dc1a4a5c","resolution":{"observed_at":"2026-08-09T10:41:01.239337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:02.004120Z","title":null,"venue":null,"work_id":"e2f9c7df-fab7-4092-b9b8-ed977f467dbb","year":2019},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.246337Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:02648d907e01d8e3b696f81ee10a2a471e64d1a641abc36ea1f29b49ad14d9ed","observation_id":"ec137b26-5003-4bd1-b0fd-29606f6bfc7d","resolution":{"observed_at":"2026-08-09T10:41:02.009344Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.251977Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.251977Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:2683f6089be414821e4bb5adfa7a31956a49806f319e88bb78baabb22f7d0b65","observation_id":"ec6f87cd-03b7-44fe-8263-539446193a3d","resolution":{"observed_at":"2026-08-09T10:41:01.251977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.977777Z","title":"J.; Jin, R.; and Shou, M","venue":null,"work_id":"8235bb47-76f9-4114-becf-f465026ac972","year":2023},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.257588Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:70681200218353f1acac343ec086fa337e3c5321b5d7c9d9b9f30febbb373efd","observation_id":"16c3790a-fb14-424e-8ea9-bc6217ab2907","resolution":{"observed_at":"2026-08-09T10:41:01.982712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07155","last_updated":"2019-06-17T17:58:12Z","snapshot_observed_at":"2026-08-03T13:01:27.142233Z","submitted_at":"2019-06-17T17:58:12Z","title":"MMDetection: Open MMLab Detection Toolbox and Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07155","snapshot_observed_at":"2026-08-09T10:41:01.262696Z","title":"C.; and Lin, D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.262696Z"},"links":{"cited_paper":"/paper/1906.07155","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:3db6e8250e3be98098b5d219a44d948fd77e6a7ea5b42e8e618ecbb942de7517","observation_id":"6ee06156-ff64-425f-b760-4c1971901098","resolution":{"observed_at":"2026-08-09T10:41:01.262696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.08534","last_updated":"2023-02-13T15:50:22Z","snapshot_observed_at":"2026-08-13T15:42:29.664753Z","submitted_at":"2022-05-17T17:59:11Z","title":"Vision Transformer Adapter for Dense Predictions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.08534","snapshot_observed_at":"2026-08-09T10:41:01.268204Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.268204Z"},"links":{"cited_paper":"/paper/2205.08534","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:79437824916f799bee5b0a6499fe141ef20f7b6e21404b7ea229bf59a11b64f5","observation_id":"963676bc-1edb-48fd-922d-7aef6b7701bd","resolution":{"observed_at":"2026-08-09T10:41:01.268204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.959348Z","title":null,"venue":null,"work_id":"41e1afe6-95d3-4e08-9f1e-8998ea88bd1f","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.274027Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:c370ff33e1f58ebe617f4c6bde4b3b40afa2c79e8c6393c4258ff7bb0d244f2a","observation_id":"eefb3eef-0b7d-4a45-8348-3a7a6d85e486","resolution":{"observed_at":"2026-08-09T10:41:01.966546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.10882","last_updated":"2023-02-13T01:19:57Z","snapshot_observed_at":"2026-08-10T23:32:09.056322Z","submitted_at":"2021-02-22T10:29:55Z","title":"Conditional Positional Encodings for Vision Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.10882","snapshot_observed_at":"2026-08-09T10:41:01.278794Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.278794Z"},"links":{"cited_paper":"/paper/2102.10882","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:6b962af29446b9d7f2b93ed57469d73800127f045a4c2358ca9eca2a2b33c3e0","observation_id":"2a89c1d7-1ebc-4665-b812-c104c6b8916a","resolution":{"observed_at":"2026-08-09T10:41:01.278794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.944229Z","title":null,"venue":null,"work_id":"3f05d502-3b6f-4634-8c65-471a774b0084","year":2020},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.284003Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:193ac73f767189f3ec6c1e33f701ed136de250081a7cc453632c8023c829ac7c","observation_id":"0e20669a-ab27-43aa-bf4a-b58d34e2d938","resolution":{"observed_at":"2026-08-09T10:41:01.949151Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.288513Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.288513Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:db5bffff538bd26a0e6083c9dfbde19b2b011acc6034df7a8d5456537d0d3dee","observation_id":"f6cab2d6-8f57-4e7f-9bce-75c1ea147823","resolution":{"observed_at":"2026-08-09T10:41:01.288513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-09T10:41:01.293518Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.293518Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:b5b8ae3fc7d856dbb9d8fcc74a1539680399cb271ab239dc169da322cb1d8613","observation_id":"591e8f8a-cc38-47e5-9a9f-73e7ee6af321","resolution":{"observed_at":"2026-08-09T10:41:01.293518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.05704","last_updated":"2022-06-07T19:25:30Z","snapshot_observed_at":"2026-08-13T19:41:04.843117Z","submitted_at":"2021-04-12T17:58:56Z","title":"Escaping the Big Data Paradigm with Compact Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.05704","snapshot_observed_at":"2026-08-09T10:41:01.298875Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.298875Z"},"links":{"cited_paper":"/paper/2104.05704","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:5410b9b5ce5b1c40ff7bd81749cabbc6fd30134d6dcca57bc5f7664f94737332","observation_id":"717870e9-5ab3-4364-a5f6-c01970772fe0","resolution":{"observed_at":"2026-08-09T10:41:01.298875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.303810Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.303810Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:717f8a64249a2ad722bfcc907b9b736c8730a299a1bd942580a07794e86b0f4f","observation_id":"2068eef1-69cf-4add-b4fb-0f2d8febc9c1","resolution":{"observed_at":"2026-08-09T10:41:01.303810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13298","last_updated":"2024-07-16T04:54:56Z","snapshot_observed_at":"2026-08-13T00:49:49.772582Z","submitted_at":"2024-03-20T04:47:13Z","title":"Rotary Position Embedding for Vision Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13298","snapshot_observed_at":"2026-08-09T10:41:01.308538Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.308538Z"},"links":{"cited_paper":"/paper/2403.13298","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:6a8ff33607269708fa75f4f112ec989b87df7dcd57ec3ab755de1b33af9f1fee","observation_id":"f6034912-b7f0-4ccc-b819-7b146fb90ef1","resolution":{"observed_at":"2026-08-09T10:41:01.308538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.313341Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.313341Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:724acf02664952ff326e3fff4564f9b2a685495e8c851e14d589d589790ecc84","observation_id":"0df307c7-248e-4f89-b52d-40080797030a","resolution":{"observed_at":"2026-08-09T10:41:01.313341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.318568Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.318568Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:90dfc507ac6bc9b87c52ed1ac929fd3eb88c3b850af6c178b30930c9e56024a4","observation_id":"de472f31-358d-4b32-9ad3-a6e256d5b830","resolution":{"observed_at":"2026-08-09T10:41:01.318568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.323421Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.323421Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:cc39b6f88644f556952c0fca302b1bc28a35f60064a5a1d1f1b9ca4df4fedda2","observation_id":"21c0907a-0ba6-42d3-8c64-ad4e73036f87","resolution":{"observed_at":"2026-08-09T10:41:01.323421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.328114Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.328114Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:89c4f5057a5fc30ef286fa6156113c36bb7a51f7a9ceec914715429a50464bab","observation_id":"5a1140ae-6822-40c5-b119-1a01ee5eb784","resolution":{"observed_at":"2026-08-09T10:41:01.328114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.332753Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.332753Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:9cc566e7ac79a57e284c5f906a5d87f741458d69287dc3f1185043c4745df2d7","observation_id":"47b62d92-d59e-4398-9df3-b27b436c0e61","resolution":{"observed_at":"2026-08-09T10:41:01.332753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.02155","last_updated":"2018-04-12T18:51:33Z","snapshot_observed_at":"2026-08-13T22:40:49.725132Z","submitted_at":"2018-03-06T13:13:11Z","title":"Self-Attention with Relative Position Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.02155","snapshot_observed_at":"2026-08-09T10:41:01.337970Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.337970Z"},"links":{"cited_paper":"/paper/1803.02155","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:1e5b8553eaf28470759ef8fe039ea0f07832adc8538c0ea340385f5d2638f70c","observation_id":"14eaa9f1-5f2c-4801-9767-c27a832e012b","resolution":{"observed_at":"2026-08-09T10:41:01.337970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.343091Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.343091Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:9e8a409f1a244acd42a946e13b5e5a18a19418c97ee183aab7335e3ed27cfd6c","observation_id":"f0fedcb6-1420-47ea-96b3-e9e676f782b9","resolution":{"observed_at":"2026-08-09T10:41:01.343091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.347656Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.347656Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:a2084dff7250fa1f68d57706616a4dcbb300f167ad11e0ef3b9d6f30e139b00d","observation_id":"487896cd-b4f6-4c1d-b708-342e75481ac1","resolution":{"observed_at":"2026-08-09T10:41:01.347656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.355182Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.355182Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:f4a0fdfd453973151d840c47029d02bec1e2c23957c4c2a155eb60b966284673","observation_id":"e051b9ba-25d3-496d-825d-f5af358bf046","resolution":{"observed_at":"2026-08-09T10:41:01.355182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.810055Z","title":null,"venue":null,"work_id":"73b2e17f-0cc2-4eff-a7bb-b5fe4b41d9c1","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.360381Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:be11e40e9405dff4debf2fea1a4da52f2ac87525547deadce1b2b2ad66652051","observation_id":"85715c03-046f-4f1c-a2f1-ebb7ab802e61","resolution":{"observed_at":"2026-08-09T10:41:01.815849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.792285Z","title":null,"venue":null,"work_id":"cb19443e-adbb-4fec-8501-f6d5bec90cd6","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.365788Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:749c888f5a5b9a30a065fe967e670ef2ad1f2b2fff6afcb7d32940d258171881","observation_id":"f91d2907-7005-45c4-af58-0edc020bdebb","resolution":{"observed_at":"2026-08-09T10:41:01.797329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.774520Z","title":null,"venue":null,"work_id":"81fae7bf-93c5-4dbf-9610-799ffeb4428b","year":2018},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.370892Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:c8a1018bcf32908835dfcf25d17b6d7a96705833f12f607bcb4d49a1ed01102c","observation_id":"81bbc29a-c45d-4554-9e30-7dffb78d04f7","resolution":{"observed_at":"2026-08-09T10:41:01.779959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.757259Z","title":null,"venue":null,"work_id":"a059f7b1-66e8-455c-92e4-29e48c6191be","year":2024},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.375825Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:6654966642cf1382914750a0c9cce75442648fb5a3cb2bf71365bb0a9170a57d","observation_id":"d8969e2a-c39c-4bc5-a0a5-1f28b1d91e35","resolution":{"observed_at":"2026-08-09T10:41:01.762467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.736135Z","title":null,"venue":null,"work_id":"3989dc54-5613-4332-b0aa-88f1718830f3","year":2023},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.380740Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:71e8700258ba474f0af1fa5dfcba95a77b593887d159f3e095ed9a9c2d686fea","observation_id":"ee22e8d4-7482-4705-8de2-fd414c093775","resolution":{"observed_at":"2026-08-09T10:41:01.742833Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.719322Z","title":null,"venue":null,"work_id":"a9fe0f6a-5e33-4452-9811-64d8809d0bae","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.385331Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:942678f7da8796950710301a5dd1822f2950b09397bb3368ea806a9083fb45fe","observation_id":"7903436a-3741-458a-9701-761b25010063","resolution":{"observed_at":"2026-08-09T10:41:01.724563Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.703409Z","title":"E.; Feng, J.; and Yan, S","venue":null,"work_id":"3e5ee391-2c5b-4078-a7e0-717d98913d5a","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.390265Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:12c9c597527d0783639bb5c57ecb02344fb309e45b53bf0d6f0c60983a3f7b51","observation_id":"4ecedc5b-3b8d-46ea-bf31-0f6c09762449","resolution":{"observed_at":"2026-08-09T10:41:01.708349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.687360Z","title":null,"venue":null,"work_id":"78bd2c3f-ce9b-40d3-a064-701494921516","year":2022},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.394845Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:11068c3fed3873620bb3bffd916fe2b0e2433315f93225e08869ac8af23d6286","observation_id":"74b25d0e-f68f-4fb9-9f03-765cd1e38a1b","resolution":{"observed_at":"2026-08-09T10:41:01.692463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.399466Z","title":"H.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.399466Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:6303f3de966dfbc2e773cbf30bb3827e03f20d19833369130a8e3acd357e1a5b","observation_id":"b5f0ee3c-3f15-45f1-a2e3-e3ca2ab611fa","resolution":{"observed_at":"2026-08-09T10:41:01.399466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.658292Z","title":null,"venue":null,"work_id":"5be83c60-ae27-47be-815e-2192aec5c526","year":2019},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.404419Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:fed6f156fd8320b515f5f8b6f03605f7d6c50662b5ff62845987515b33b4e8cf","observation_id":"de705d0b-0541-444a-ac28-c90a3343f01d","resolution":{"observed_at":"2026-08-09T10:41:01.664832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-09T10:41:01.409443Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.409443Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:b9862609ccd521a394e33264de5b323248a12d74a2f504bf56f31dd4ffd7f096","observation_id":"f502618b-00cb-4b64-a0d0-66b3b71f479f","resolution":{"observed_at":"2026-08-09T10:41:01.409443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.414853Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.414853Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:e65bc5fc84459cce0768ac6f763873dcc95a0316fd565d53f1d62c956c4d998b","observation_id":"6cdc534d-677f-4fea-80a0-f0de778b9d9a","resolution":{"observed_at":"2026-08-09T10:41:01.414853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.420244Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.420244Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:aa187dbc547cd024403fd3a6676c7aeff43363b231c0ad1f6dca954a8b1ba1b2","observation_id":"4efd5ca3-de0c-45f2-9cb1-559c22e23405","resolution":{"observed_at":"2026-08-09T10:41:01.420244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T04:46:16.944647Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2502.02919."}