{"as_of":"2026-08-14T23:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe6c6abd5c987e3b9d0bd8ee90c676fd2307beff74036c896afd4cbd68e67d42","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:37:55.528782Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.18092/citation-record","integrity":"/paper/2411.18092/integrity","json":"/paper/2411.18092/citation-record.json","paper":"/paper/2411.18092"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1612.00410","last_updated":"2019-10-23T22:47:44Z","snapshot_observed_at":"2026-07-06T05:21:01.935928Z","submitted_at":"2016-12-01T20:12:40Z","title":"Deep Variational Information Bottleneck","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.00410","snapshot_observed_at":"2026-08-12T11:37:55.435638Z","title":"Deep variational information bottleneck","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.435638Z"},"links":{"cited_paper":"/paper/1612.00410","citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:df9f7bed16eeae9a8913ac13b0b3c723044dcc8d568f46ff092f6714affbea27","observation_id":"77939b07-84dd-4a7a-935c-e55c0db2f450","resolution":{"observed_at":"2026-08-12T11:37:55.435638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.840346Z","title":"Computation of channel capacity and rate- distortion functions","venue":null,"work_id":"e7f016d5-a01c-4c25-bdd8-439d07a38876","year":1972},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.441381Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:63beac790f2d63f96683b6e04b72ce34c4836c604cd92f5d774bb96b4483d00e","observation_id":"b74d0c2a-0cf7-48c2-9332-db170e35f881","resolution":{"observed_at":"2026-08-12T11:37:55.845183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.826862Z","title":"Token merging for fast sta- ble diffusion","venue":null,"work_id":"fb996cb9-7afc-4b96-95ad-93234a413a6c","year":null},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.446140Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:5a4e661924bb3f229b59ad9c552d93708a8d75a3dc49dd7f59b024b5592f504f","observation_id":"2a01516a-bdb2-4679-9c36-7cf85d3338ff","resolution":{"observed_at":"2026-08-12T11:37:55.831228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-08-13T04:00:22.647615Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09461","snapshot_observed_at":"2026-08-12T11:37:55.450721Z","title":"Token merging: Your vit but faster","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.450721Z"},"links":{"cited_paper":"/paper/2210.09461","citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:54c4159c0c6abf5f54727b7458aaf118995a48458e6ddf4a12be7c90ade5ccca","observation_id":"a635bddd-4e72-4f24-aa5d-e48390249bc4","resolution":{"observed_at":"2026-08-12T11:37:55.450721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.455509Z","title":"Elements of information theory","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.455509Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:bd26df3d2d153fec882ed02df856f28d37e4d16bdecffe13c2a276c0644a0afe","observation_id":"ad10926a-036e-4729-b7fc-4ba2eb6944a6","resolution":{"observed_at":"2026-08-12T11:37:55.455509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.802380Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"9830423c-891b-4b2c-9b23-17d3bf80ebaa","year":2009},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.459877Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:1f16b9880a4b1d8ab9f14600ec85e45a19e840cd2870aa0dbf471292ccbf434c","observation_id":"19c5020e-ad02-4f8f-b02a-b0fb9ef90db5","resolution":{"observed_at":"2026-08-12T11:37:55.807038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-12T11:37:55.464268Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.464268Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:c4cd7a63234a725fac3e95ee8420cbe74858930b6168e2fe567ea73ee061f850","observation_id":"9f40ade0-efb0-4f36-9666-f12052e757dd","resolution":{"observed_at":"2026-08-12T11:37:55.464268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.787856Z","title":"Adaptive token sampling for efficient vision transformers","venue":null,"work_id":"69e41b8f-f493-4903-8584-84444507e1b9","year":2022},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.469133Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:b09430c508493474f766862c18625b9591dd45c6b6b92bcb4b7b455b4a90a434","observation_id":"0146119f-ce3e-4691-98c8-26dbd4c29c24","resolution":{"observed_at":"2026-08-12T11:37:55.792397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.773819Z","title":"Power-bert: Accelerating bert inference via progres- sive word-vector elimination","venue":null,"work_id":"5c6db11e-1b17-4532-89e6-ca047e54d48a","year":2020},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.473343Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:3b6a9f5a9c4399d94dc39e3fae2c7d72105e09601df4a63c888122234f74ee46","observation_id":"2fcd095d-3a63-41b2-8829-c45a817c7c4c","resolution":{"observed_at":"2026-08-12T11:37:55.778519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.759285Z","title":"Which tokens to use? investigating token reduction in vision transformers","venue":null,"work_id":"6aaa2ead-74cc-4b65-9a08-1320bf6a286b","year":2023},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.477466Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:73ee91a03d7247fcc1e7cdc98df1cc89574cc06d9c1abb4bcd119690c82e527b","observation_id":"ca446039-b967-49d5-9f06-be2899078c8c","resolution":{"observed_at":"2026-08-12T11:37:55.764016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.07003","last_updated":"2021-06-11T20:00:20Z","snapshot_observed_at":"2026-08-11T03:22:35.219403Z","submitted_at":"2020-10-14T12:28:08Z","title":"Length-Adaptive Transformer: Train Once with Length Drop, Use Anytime with Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.07003","snapshot_observed_at":"2026-08-12T11:37:55.481635Z","title":"Length-adaptive trans- former: Train once with length drop, use anytime with search","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.481635Z"},"links":{"cited_paper":"/paper/2010.07003","citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:924b3bc31f01ffc5ef50aaf2ea2edbb559b218ccd8cb28ea58ce50c2df9deb9d","observation_id":"995f5df0-33a1-4dea-b902-a63c0ef6e474","resolution":{"observed_at":"2026-08-12T11:37:55.481635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.745293Z","title":"Learned token pruning for transformers","venue":null,"work_id":"2e6bf110-3d3d-4c47-983b-28abc7396137","year":2022},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.486288Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:d2b6bd876449783603c07f090e65a5a760541fa45fe608c4e1b2517262eb4abd","observation_id":"35598284-7c5a-49a8-af66-9ce1cca6acfe","resolution":{"observed_at":"2026-08-12T11:37:55.749789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-12T11:37:55.490385Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.490385Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:ec2dfaec08191e70814341934f7bfa5e15ae6565e84657a58ba9271eea90d48c","observation_id":"1416ab19-9c89-4010-a2f9-1aea7eb45c8a","resolution":{"observed_at":"2026-08-12T11:37:55.490385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07800","last_updated":"2022-04-13T23:46:08Z","snapshot_observed_at":"2026-08-13T16:40:03.706852Z","submitted_at":"2022-02-16T00:19:42Z","title":"Not All Patches are What You Need: Expediting Vision Transformers via Token Reorganizations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07800","snapshot_observed_at":"2026-08-12T11:37:55.494689Z","title":"Not all patches are what you need: Expediting vision transformers via token reorganizations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.494689Z"},"links":{"cited_paper":"/paper/2202.07800","citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:97770ef7b353055dd3ff7cbb00357e2c229cd7a29a596c3d34f53757f8aa4001","observation_id":"57d6bcf7-97de-47df-af2e-fe5c3a0cbd10","resolution":{"observed_at":"2026-08-12T11:37:55.494689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.499010Z","title":"The pagerank citation ranking: Bringing order to the web","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.499010Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:09de4e1f1763267b0733da4a47d4f65f4de51db86a4407274e191473a818836e","observation_id":"526a95a1-388a-4b82-a96b-32ad7c0ccbc7","resolution":{"observed_at":"2026-08-12T11:37:55.499010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.722502Z","title":"Dynamicvit: Efficient vision trans- formers with dynamic token sparsification","venue":null,"work_id":"1a47c6b0-abed-4c13-98a9-235fafcd3ebd","year":2021},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.502999Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:64f51a0d3ee459181f96d57e44744ce09910430585a724a30e37f871be4c24d8","observation_id":"45dfab83-8f06-430f-8015-59f9b6a1033e","resolution":{"observed_at":"2026-08-12T11:37:55.726987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-12T16:03:20.142135Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-12T11:37:55.507118Z","title":"The information bottleneck method","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.507118Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:6abd0e884f77122fadc989e864a68c45c17e73b559614407af9a4fecd98f9ff6","observation_id":"dd735bfc-7338-4b8a-abe9-9d898480c4e1","resolution":{"observed_at":"2026-08-12T11:37:55.507118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.707862Z","title":"Training data-efficient image transformers & distillation through atten- tion","venue":null,"work_id":"2dd2666c-e1e0-4871-ab2e-044c3e9bd319","year":2021},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.512054Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:446c48e21c867f287308c76faeadb333938af9f3efa0ee594e6b7da2829682c0","observation_id":"bc6bb1cd-050f-4772-b739-4934a446f0c8","resolution":{"observed_at":"2026-08-12T11:37:55.712641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.516369Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.516369Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:d72f0abf0d174d980511f689428777821537f52196a1368b39844baded334b0b","observation_id":"1fa4476c-2ed7-4967-8120-0b28381b7ce5","resolution":{"observed_at":"2026-08-12T11:37:55.516369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.684955Z","title":"Zero- tprune: Zero-shot token pruning through leveraging of the attention graph in pre-trained transformers","venue":null,"work_id":"5b454b0a-028c-459f-b785-33a4433dd6cc","year":2024},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.520546Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:83466caf9ed992b3e1cd3df4d4f08e9476a25e0f39f2f37ec2c418fbfae7e9ed","observation_id":"3aa8e526-b52e-44cd-9d03-aa330081a816","resolution":{"observed_at":"2026-08-12T11:37:55.689649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.670452Z","title":"Evo-vit: Slow-fast token evolution for dynamic vision transformer","venue":null,"work_id":"bc92f164-4f62-42c9-a159-217087e2123a","year":2022},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.524597Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:a24e69727bc0583c60ba5a5949bd2b2107ad922979eb2ba4e39f86c4321a8cd5","observation_id":"3473bb04-f912-4b64-b405-13aa59e36c60","resolution":{"observed_at":"2026-08-12T11:37:55.675631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:37:55.655168Z","title":"VisionTransformer- WithTNT","venue":null,"work_id":"f1b9a607-7f4a-41bb-9582-cbc5ed6bc193","year":2022},"citing_paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:37:55.528782Z"},"links":{"citing_paper":"/paper/2411.18092"},"observation_digest":"sha256:8cc9dd3c57feb0e4bab8cfb9b6b9f108420a6c65aec66a3565a9439a458ac47a","observation_id":"b110e29c-7bb0-4b0c-8ae1-7303aa730825","resolution":{"observed_at":"2026-08-12T11:37:55.660458Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.18092","last_updated":"2025-03-14T16:12:10Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T11:29:15.990994Z","submitted_at":"2024-11-27T07:04:00Z","title":"Training Noise Token Pruning"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2411.18092."}