{"as_of":"2026-08-13T22:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e35b85b61b1cdc13519418a589d12e3648b619e8aceb626a34dba77c94c340e0","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:55:38.945614Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:14:28.493489Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-11T15:14:28.639388Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"cited_work":{"arxiv_id":"2509.00421","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00421","snapshot_observed_at":"2026-08-11T15:14:28.639388Z","title":"Memory Limitations of Prompt Tuning in Transformers","venue":"cs.LG","work_id":"89d37065-4de2-429f-9d9b-a5405b74d196","year":2025},"citing_paper":{"arxiv_id":"2608.09558","last_updated":"2026-08-10T12:57:22Z","snapshot_observed_at":"2026-08-13T22:42:51.753405Z","submitted_at":"2026-08-10T12:57:22Z","title":"Training-Free Universal Approximation by Prompting Random Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T15:14:28.493489Z"},"links":{"cited_paper":"/paper/2509.00421","citing_paper":"/paper/2608.09558"},"observation_digest":"sha256:b6d1b9d356d3598f5c6cfcb1ec45cdda38a29180998081b92d480989efe0d5c6","observation_id":"520f5c59-ddea-4682-a1f2-4c902019a962","resolution":{"observed_at":"2026-08-11T15:14:28.643858Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.00421/citation-record","integrity":"/paper/2509.00421/integrity","json":"/paper/2509.00421/citation-record.json","paper":"/paper/2509.00421"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.633154Z","title":null,"venue":null,"work_id":"9180c654-acea-431e-b859-12255cb038aa","year":2019},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:34.380317Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:29ca2bcab0f8bcfb8efc0fbf8e5e5bf72dea779b87aa67a1954fa3d9a8a339e0","observation_id":"d694635f-e379-4a3e-a5d0-f0a115d0e51c","resolution":{"observed_at":"2026-08-05T13:55:43.638901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:34.447067Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:34.447067Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:1ef0c0be0cf0218bb77a5576ef906f23c65734f6ffd2c172ae8781d845629f3e","observation_id":"c9c21f19-3f45-4bb5-9b55-539d37eec7cd","resolution":{"observed_at":"2026-08-05T13:55:34.447067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14820","last_updated":"2024-06-04T15:51:36Z","snapshot_observed_at":"2026-08-13T04:55:09.283448Z","submitted_at":"2023-12-22T16:47:10Z","title":"How Smooth Is Attention?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14820","snapshot_observed_at":"2026-08-05T13:55:34.581643Z","title":"How smooth is attention? In ICML, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:34.581643Z"},"links":{"cited_paper":"/paper/2312.14820","citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:a16468c5b26765c7d23fd2aa51e3432469534d07457a35270d1be93089a35252","observation_id":"1aff418a-db5e-494e-8d9b-aa07aad35ff0","resolution":{"observed_at":"2026-08-05T13:55:34.581643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.602277Z","title":"PLOT : Prompt learning with optimal transport for vision-language models","venue":null,"work_id":"932ab8af-fe96-4887-9356-da5a00b3638e","year":2023},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:34.653505Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:45848610991d5c8b6e5674d08e13768f24ec339537dff574c4032ebaea152b22","observation_id":"e04ea093-c72a-49de-9d2f-d496790744c3","resolution":{"observed_at":"2026-08-05T13:55:43.607342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:34.728891Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:34.728891Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:acb25d5a7335b537b4df0f6cdd58b113c8d4850646e8d597b64299c004830b3a","observation_id":"85bb2937-6ba1-4524-bf49-fdd51f77fc3d","resolution":{"observed_at":"2026-08-05T13:55:34.728891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:34.841926Z","title":"BERT : Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:34.841926Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:ba644b1aa391ecd18382748dee07f24e5398275b747cbd3d157c4b53d022107f","observation_id":"53e2379e-cc00-4e97-83b4-47867ad125b4","resolution":{"observed_at":"2026-08-05T13:55:34.841926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.557185Z","title":"Longrope: extending llm context window beyond 2 million tokens","venue":null,"work_id":"bfc2397b-e5dc-47a1-9b60-19d41e1b4fd0","year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:34.944871Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:d919cdd8f008ad0fec10b75d28d4beca2ca71f9bf9392275805fd0f31c9478fb","observation_id":"53fd1b81-786c-44e8-ad7e-fc5e48784fc5","resolution":{"observed_at":"2026-08-05T13:55:43.563057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:35.008780Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.008780Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:b07f79b330352130d1587c11023282d7953079b3e0b764604a0e59ad3f2ecb2c","observation_id":"78280e05-46b1-4986-9bab-1e6f3bf48fb3","resolution":{"observed_at":"2026-08-05T13:55:35.008780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.531966Z","title":"Attention is not all you need: Pure attention loses rank doubly exponentially with depth","venue":null,"work_id":"a00b0f06-0661-4f4f-9c7e-2262feb64099","year":2021},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.096671Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:793c224f1d5cf34fcd7bf6da75247b16227da9f5e9cd1585b383ecdd3e77880f","observation_id":"b736311c-4d12-413b-8db8-e802608283cc","resolution":{"observed_at":"2026-08-05T13:55:43.539995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:35.173857Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.173857Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:fae2185be3917a40efc62a269f6a94e44dc2298c555deb9910e973a552add17f","observation_id":"3d557c22-a8e9-4852-9bdf-695560e61b69","resolution":{"observed_at":"2026-08-05T13:55:35.173857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.495642Z","title":"Nemesis: Normalizing the soft-prompt vectors of vision-language models","venue":null,"work_id":"a04d02cd-7551-4979-aef3-1b070d41fe36","year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.255746Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:c4bd1480371629413f1b51e2e1e8f04520ec00f0043f353985945b219fb0ed70","observation_id":"bb276da0-81c1-4789-8e6c-9389e573bff8","resolution":{"observed_at":"2026-08-05T13:55:43.501956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.476033Z","title":"Protein multimer structure prediction via prompt learning","venue":null,"work_id":"3c95a70c-be40-4b94-9924-ee7648117c53","year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.334961Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:6af02080cfd24e4b8ffea7bc2e0a68f241226e5fb2202425c0293f2e56f3b1e7","observation_id":"ff051185-7847-4830-b4ba-f7c8002a9ed6","resolution":{"observed_at":"2026-08-05T13:55:43.482920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.450595Z","title":"The emergence of clusters in self-attention dynamics","venue":null,"work_id":"42a8ea66-0f72-4e88-b3e5-18add2029054","year":2023},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.410174Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:702746e47e7cac79c23fdd97dcf85e92a3d012187e3bdcdd3750888fb8e8b185","observation_id":"f896dea3-0b21-4283-8953-23b9b74d6bed","resolution":{"observed_at":"2026-08-05T13:55:43.457179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:35.485603Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.485603Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:37aeb43fb90f50d376be0ee4098d76e0ee8605db19b076ea5f0d14347bde3e65","observation_id":"71c44911-fbc4-44e5-b2d5-903beb01fc65","resolution":{"observed_at":"2026-08-05T13:55:35.485603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:35.576937Z","title":"RULER : What s the real context size of your long-context language models? In First Conference on Language Modeling, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.576937Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:1fe4f602a62018f872c743b10b0a07e361a1547b98178efcf61a9baa105265fa","observation_id":"81025f6f-86ce-4e26-9d09-b3155978e6f8","resolution":{"observed_at":"2026-08-05T13:55:35.576937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.386805Z","title":"Fundamental limits of prompt tuning transformers: Universality, capacity and efficiency","venue":null,"work_id":"ffda97fe-aa9b-4b18-9c47-d6f532952e0a","year":2025},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.649424Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:0f7faa430d632a7a252119e1e1f668289caa316cf6d950641b82d97e3cf971ea","observation_id":"90b3c586-9da8-4093-81b3-c9df080aea44","resolution":{"observed_at":"2026-08-05T13:55:43.409272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.295928Z","title":"Long-context LLM s meet RAG : Overcoming challenges for long inputs in RAG","venue":null,"work_id":"407f30f6-bafb-48a9-9216-c18b246f79ce","year":2025},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.730564Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:69bb1413102bef5692178d43ffeac47944e760e1616b792506b7bf9b8224c881","observation_id":"268a0c3a-8fa1-4b98-a9c1-8e9a4e8927e2","resolution":{"observed_at":"2026-08-05T13:55:43.311848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:43.135027Z","title":"Are transformers with one layer self-attention using low-rank weight matrices universal approximators? In The Twelfth International Conference on Learning Representations, 2024","venue":null,"work_id":"960c8195-8b0f-480d-990b-6d04ccfec0ba","year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.828312Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:b2d972ca37599d00455539104d1cd227cd7d04d3ccfdac719eadead264446262","observation_id":"3c863708-8065-4626-83e4-c4f23d179139","resolution":{"observed_at":"2026-08-05T13:55:43.206793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:42.906698Z","title":"On the optimal memorization capacity of transformers","venue":null,"work_id":"a00ac5bb-7afc-464c-afa9-2d1bb3292dac","year":2025},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.914729Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:16d0415682d9c1c3295c6e3987ff91693e059887a045dac622ebe8573ed3bdaf","observation_id":"8db88d5e-7b9b-42f2-8276-0fdd5514c843","resolution":{"observed_at":"2026-08-05T13:55:43.045649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:35.990437Z","title":"Maple: Multi-modal prompt learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:35.990437Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:50625430b85a357a69c421ddf7390270bb2b45225b0fa2730c33fe9840d96bea","observation_id":"ab847f5e-fac6-4c96-9b69-54011b05c723","resolution":{"observed_at":"2026-08-05T13:55:35.990437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:42.690011Z","title":"The lipschitz constant of self-attention","venue":null,"work_id":"8cc13931-6efc-40ec-8046-2449cb97adda","year":2021},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.066483Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:d9e1859148f37ff4f7131632ba97f4e117b03433065f01fcadf6a4d48adcc044","observation_id":"4dc8cf60-7445-4c6b-acca-d7e08ead0dac","resolution":{"observed_at":"2026-08-05T13:55:42.789501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:42.510454Z","title":"Provable memorization capacity of transformers","venue":null,"work_id":"105ae224-25f9-4a4b-850c-0a8be6f5cfd8","year":2023},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.137919Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:9f94e84e3b5465c6d28d52a6b2013144ad56ad44f7535de069766ec0c4ae29a9","observation_id":"9aeda08e-6145-4df2-bed9-ac77fe37283c","resolution":{"observed_at":"2026-08-05T13:55:42.628313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:36.207745Z","title":"A generalization of hausdorff dimension applied to hilbert cubes and wasserstein spaces","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.207745Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:0cab95affd6801512aa5576a74125ceb03056146c73bbcdee82d015b19530c4e","observation_id":"ba1fefdf-42a9-4e32-bac1-0ef4aa122222","resolution":{"observed_at":"2026-08-05T13:55:36.207745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:36.326563Z","title":"Kloeckner","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.326563Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:077fb8b7d356d7aee077105311572688c859a7f1ddc279f7a5e1f7825502bcca","observation_id":"ca74eb65-47bd-44d8-a216-1faa4a277614","resolution":{"observed_at":"2026-08-05T13:55:36.326563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:36.387037Z","title":"Attention is not only a weight: Analyzing transformers with vector norms","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.387037Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:aa0b6144f14a307a9db3b074e2e3f121984ba3f1bcc143dca36e0bc6146eaf5f","observation_id":"70f6faba-3f95-42a6-baae-f2420adeb2e6","resolution":{"observed_at":"2026-08-05T13:55:36.387037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:36.461868Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.461868Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:76fa9ba98f651ad8108c63718f49b1fa7cc97c7173c4627904e05af0e6e8680f","observation_id":"01de0587-fedd-4116-8f31-1d724929282b","resolution":{"observed_at":"2026-08-05T13:55:36.461868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:36.551798Z","title":"Summary of a haystack: A challenge to long-context LLM s and RAG systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.551798Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:4448df50a2ee0435e35aef9187d08474df1622836043b863665608870603e959","observation_id":"7fadf5e8-ddfb-444b-b2a7-985f82437731","resolution":{"observed_at":"2026-08-05T13:55:36.551798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:36.639752Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.639752Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:662044a4236fbbe5da30a407cd80bcdf95592f271404f101257ac1b76d61f749","observation_id":"c42dbf91-1aa1-4198-9866-d971d4950483","resolution":{"observed_at":"2026-08-05T13:55:36.639752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:36.764183Z","title":"Same task, more tokens: the impact of input length on the reasoning performance of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.764183Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:050c641d58f6a87a3c9e61a90565afa60dd9734ea0d2d295f4a8f02c7da04bd7","observation_id":"c232052a-e76f-4821-bfd3-813004205b28","resolution":{"observed_at":"2026-08-05T13:55:36.764183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:36.835953Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.835953Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:f6fd043d7bec5552ea3e3e8d42b109a9b7d0a29f0c1796cc1f2f2c2d87a9a987","observation_id":"6d07376a-23c1-4fa0-8a63-414d7bd59bf6","resolution":{"observed_at":"2026-08-05T13:55:36.835953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:42.217719Z","title":"Extending context window in large language models with segmented base adjustment for rotary position embeddings","venue":null,"work_id":"4ff1457b-d408-4b6c-b36d-4dbb2325a766","year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.899497Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:626224b133dc05329a3c172f887814798dab024522bfde69923803eeb35e9e2f","observation_id":"9ec11661-2a1d-4b2a-8d9e-293197a2d4a3","resolution":{"observed_at":"2026-08-05T13:55:42.362979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:36.969710Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:36.969710Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:f2d67e8fb2865b8ad65a91b0e56083f7117d50c327c3e81db179ed20032f5f1e","observation_id":"f48d54ef-0e87-41c0-bd99-e7d9c38b668b","resolution":{"observed_at":"2026-08-05T13:55:36.969710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:37.046757Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.046757Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:e6bf3c41428c99c4a30a3d53bd277fba6dac76050799b15e519628416d9b8846","observation_id":"81aa6a6d-de15-4485-850c-ab674ade216a","resolution":{"observed_at":"2026-08-05T13:55:37.046757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:41.918618Z","title":"Liu, Mohammad Saleh, Etienne Pot, Ben Goodrich, Ryan Sepassi, Lukasz Kaiser, and Noam Shazeer","venue":null,"work_id":"68cb13eb-8b21-49e4-93de-6e529442a8b5","year":2018},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.142930Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:2ebae209da423a91f2db60415e0399f9fe316aa403fd659ac432fea0962d1258","observation_id":"590ec142-424a-462b-8b48-a8c38f5ec460","resolution":{"observed_at":"2026-08-05T13:55:42.102232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:37.213765Z","title":"P -tuning: Prompt tuning can be comparable to fine-tuning across scales and tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.213765Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:5b3ab9fe4e262bfe7a39c09bed64320cdd7ee2e66704deae097bca3e7595692e","observation_id":"5ee23938-4888-4b05-a087-2fb716bc79c5","resolution":{"observed_at":"2026-08-05T13:55:37.213765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:41.661271Z","title":"Memorization capacity of multi-head attention in transformers","venue":null,"work_id":"208cd6a6-089a-40da-baf9-38b3f7bfd887","year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.300136Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:ec3f108267b77c5e2e22245e429248a96cd66f47966077080e684b7d44214bd5","observation_id":"d532d426-13b3-4fe5-97dd-0e6e41914ae9","resolution":{"observed_at":"2026-08-05T13:55:41.771357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20561","last_updated":"2025-03-26T13:58:02Z","snapshot_observed_at":"2026-08-13T20:56:15.686363Z","submitted_at":"2025-03-26T13:58:02Z","title":"A Theoretical Framework for Prompt Engineering: Approximating Smooth Functions with Transformer Prompts","version":1},"cited_work":{"arxiv_id":"2503.20561","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.20561","snapshot_observed_at":"2026-08-05T13:55:39.506701Z","title":"A Theoretical Framework for Prompt Engineering: Approximating Smooth Functions with Transformer Prompts","venue":"cs.LG","work_id":"762f7524-19c8-4007-ae7f-13b39b8027ea","year":2025},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.382618Z"},"links":{"cited_paper":"/paper/2503.20561","citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:b142b53a83d58e5b52cc13552670896e3712bbd5cb4f2b4cea6047d8f6fbfeee","observation_id":"42d6cf5f-f323-4985-91b5-c94a54103421","resolution":{"observed_at":"2026-08-05T13:55:39.558086Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"stable/4180661","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:39.360562Z","title":"Convergence of latent mixing measures in finite and infinite mixture models","venue":null,"work_id":"718f6726-5281-40e8-8399-c40d0a2daa8c","year":2013},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.465081Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:285a6a7721bb1aa63fa08026f159d5227f5a5a48f62a9a90b87e53534ccd5061","observation_id":"d3309bd7-8589-4bac-9878-b61b3e916ee9","resolution":{"observed_at":"2026-08-05T13:55:39.420969Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T13:55:37.563055Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.563055Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:abcad43b95fe26f12ee0adf08b7b72b5fa266e688e37fc05b22b4734e26ecd67","observation_id":"1743bff9-50dc-462c-8d04-641f8fe5bb3a","resolution":{"observed_at":"2026-08-05T13:55:37.563055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:41.288259Z","title":"On the role of attention in prompt-tuning","venue":null,"work_id":"48ea08df-d8a0-4545-a4b6-353dd2d2e60a","year":2023},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.630301Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:1f295aeb967c318a3c7e4d5874e1f8091eff731da8961f5c1b8f18b0b3d838e0","observation_id":"7c20c6ae-5f4b-4246-8314-aaeeaad3964c","resolution":{"observed_at":"2026-08-05T13:55:41.507163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:41.053800Z","title":"Prompting a pretrained transformer can be a universal approximator","venue":null,"work_id":"480fc4be-96e1-4eec-9f8a-1f8288086f3a","year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.692313Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:eb6c29b3ae22de9a4cd4f9d848b95f6c301d2e76a7bbda3b98d3259ffd1390ad","observation_id":"d0173a22-322a-401c-b861-4a26d28837af","resolution":{"observed_at":"2026-08-05T13:55:41.120643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:37.777322Z","title":"When do prompting and prefix-tuning work? a theory of capabilities and limitations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.777322Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:98f4416d634d1fa5add0b1a56eca4c13530a1ab6030fed4e802ccec29417c918","observation_id":"70460bc2-92a1-4387-b2e8-4397c38a078d","resolution":{"observed_at":"2026-08-05T13:55:37.777322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:40.897826Z","title":"Sander, Pierre Ablin, Mathieu Blondel, and Gabriel Peyr\\'e","venue":null,"work_id":"e42d5e04-3803-4b93-bac5-5e09439ee6f3","year":2022},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.865485Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:b898598e619690bb461cef5e79fca96d6e7f94b6cbf379004c80553e5775f38d","observation_id":"a225bc07-db4b-459a-ac38-cdf7d78585c5","resolution":{"observed_at":"2026-08-05T13:55:40.967306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:40.750335Z","title":"Optimal transport for applied mathematicians","venue":null,"work_id":"2acce6ec-1708-4790-bf15-ac5568cc6374","year":2015},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:37.970288Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:4be5a5bd414a848bb6ee316655e81e0b5b73f8544ec12b1f83cb53ba0cde1da8","observation_id":"eb5d1de3-61e0-4522-a0ad-033618995047","resolution":{"observed_at":"2026-08-05T13:55:40.800918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:38.052182Z","title":"De PT : Decomposed prompt tuning for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.052182Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:62d032f3557dc551d58bd385677fb3b4f0489acf92106a511cac895860c722b5","observation_id":"65c8f1d0-559a-4140-85b1-2f8d690fd3db","resolution":{"observed_at":"2026-08-05T13:55:38.052182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:38.145382Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.145382Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:dee11bb10c924fa3e7bc75fd3d5fe317c0b268f5bac2acc1f1754cdaf3ef91d2","observation_id":"4d351f30-e34d-4537-a73a-9b27a7303ac2","resolution":{"observed_at":"2026-08-05T13:55:38.145382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:40.582226Z","title":"High-Dimensional Probability: An Introduction with Applications in Data Science","venue":null,"work_id":"5fe91f62-bed3-40e1-bb73-0c038f3006e0","year":2025},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.209019Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:5bc2bb8d81a3aed61c0778caa91e9fe4f3bd556b12bbb39f34603e6d2fc5090f","observation_id":"b7ef253a-77fe-4877-bec2-7d1e52f1d371","resolution":{"observed_at":"2026-08-05T13:55:40.642760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:40.468125Z","title":"Optimal Transport: Old and New, volume 338 of Grundlehren der mathematischen Wissenschaften","venue":null,"work_id":"a6b751c8-8ffb-4dc3-9131-992a5c5d46e3","year":2008},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.281871Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:7ba8ffaa8302a7d334b211430039e48779e284e65cf3164ca0ae36880c318a0f","observation_id":"8a0a8b38-b50c-4e99-8e91-be023be525f8","resolution":{"observed_at":"2026-08-05T13:55:40.540466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:40.318562Z","title":"Universality and limitations of prompt tuning","venue":null,"work_id":"782ef774-0412-400f-953b-790e6593d314","year":2023},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.372158Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:91f7035982ce41a3cdb6697189abdf0d6d06fbe8c3f1447d834880055a14925a","observation_id":"1933e6ce-934d-461f-bd04-ff59eee02673","resolution":{"observed_at":"2026-08-05T13:55:40.365417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:40.192117Z","title":"Multitask prompt tuning enables parameter-efficient transfer learning","venue":null,"work_id":"29089d01-2333-4d4d-a1b6-614c7aa74a53","year":2023},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.478086Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:270ccf05d8e8978842bb99dff986c898fbe412576f81ba6beaa58cab8f0100c7","observation_id":"dbbe1ad9-efc0-4a55-879e-4eebc2ae881a","resolution":{"observed_at":"2026-08-05T13:55:40.237484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:38.559865Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.559865Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:959564dfbcb75c09819b9508a2ea94956716ec79ef679e8bc4d620951abd8471","observation_id":"293b85d7-7d86-4cb1-a897-c1ee4f69217e","resolution":{"observed_at":"2026-08-05T13:55:38.559865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:40.039828Z","title":"Hard prompts made easy: Gradient-based discrete optimization for prompt tuning and discovery","venue":null,"work_id":"a1ca864c-f7ed-4542-b25b-698ca136c70b","year":2023},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.652296Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:decdcb9f28f8b7510001585ff042359e4abe1c03c11372b6f326f3f8f4ac2206","observation_id":"3f5920eb-5cd2-4ca3-8f67-2c93964a77f3","resolution":{"observed_at":"2026-08-05T13:55:40.101391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:38.794844Z","title":"Transformers: State-of-the-art natural language processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.794844Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:05e76ba44f6f49ff11ebb33f4967a7cd601bcf986a1d58b9aee7bdbbc5637529","observation_id":"7684d930-d7e7-4eff-8745-f991de223cea","resolution":{"observed_at":"2026-08-05T13:55:38.794844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:39.898216Z","title":"Scaling vision transformers","venue":null,"work_id":"ed2e49e6-a219-4fa3-85fd-732fbaaf7664","year":2022},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.889770Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:c32ddf266bc23ca68bc05082bc5654d86be1a32a216b28faea2a0923c700af5d","observation_id":"08f3f379-9b75-4315-82c8-e83d8ccf31e0","resolution":{"observed_at":"2026-08-05T13:55:39.958456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:55:39.787028Z","title":"Point transformer","venue":null,"work_id":"1e1b3acc-7187-4e5d-ae8a-bbd19048324b","year":2021},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:38.945614Z"},"links":{"citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:56f2cc9e2227555e8e4802f3a350ed34ee2a865ea4d21e522ad2c2ecfb00502b","observation_id":"05c3ed40-678a-4267-8394-d4ab44d5a479","resolution":{"observed_at":"2026-08-05T13:55:39.831036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":26},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2509.00421."}