{"as_of":"2026-08-10T14:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a38c14ebd47a08d53306f36fa312b21dd83ecca54a516d75c66ed20ad23c1eb6","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T11:31:31.024002Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T00:43:44.921189Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T00:44:48.403705Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"cited_work":{"arxiv_id":"2510.04547","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.04547","snapshot_observed_at":"2026-07-09T02:19:37.991895Z","title":"arXiv preprint arXiv:2510.04547 (2025)","venue":null,"work_id":"8cf8a52a-7000-4066-bfe4-8979e93a1b22","year":2025},"citing_paper":{"arxiv_id":"2604.20937","last_updated":"2026-06-19T12:00:35Z","snapshot_observed_at":"2026-08-02T23:37:34.955988Z","submitted_at":"2026-04-22T13:28:53Z","title":"Sink-Token-Aware Pruning for Fine-Grained Video Understanding in Efficient Video LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T00:43:44.921189Z"},"links":{"cited_paper":"/paper/2510.04547","citing_paper":"/paper/2604.20937"},"observation_digest":"sha256:841615abc6cde82f87be1fd1a7a908b1a7cdc7f3b412c7f75fa20d82b3a00953","observation_id":"d04c8671-f049-409a-93b0-74199586b173","resolution":{"observed_at":"2026-07-09T02:19:37.991895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.04547/citation-record","integrity":"/paper/2510.04547/integrity","json":"/paper/2510.04547/citation-record.json","paper":"/paper/2510.04547"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:26.606920Z","title":"Quarot: Outlier- free 4-bit inference in rotated llms.Advances in Neural In- formation Processing Systems, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:26.606920Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:47c04211874498b76717f48a741eb6e8d184a3e652d1dd40036e502be907d2f9","observation_id":"cf9a2423-4647-4732-9f06-0288dde5d6d8","resolution":{"observed_at":"2026-08-04T11:31:26.606920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:26.714960Z","title":"Understanding and overcoming the chal- lenges of efficient transformer quantization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:26.714960Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:6f7bebe2d772130791af9882d38c16cb0a8251e202b98296dd9969b35a342f5b","observation_id":"691e77f4-2bb8-4375-bd14-9cae4ec94940","resolution":{"observed_at":"2026-08-04T11:31:26.714960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:26.871668Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:26.871668Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:46e2d0fbb28c86a60bde006e0a012d9277b35d1d86964fbc97b68751955c8cef","observation_id":"476f6391-cb8e-431e-ad82-d862293e4519","resolution":{"observed_at":"2026-08-04T11:31:26.871668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05265","last_updated":"2025-01-27T13:39:25Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:59:35Z","title":"PrefixQuant: Eliminating Outliers by Prefixed Tokens for Large Language Models Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05265","snapshot_observed_at":"2026-08-04T11:31:27.030374Z","title":"Prefixquant: Eliminating outliers by pre- fixed tokens for large language models quantization.arXiv preprint arXiv:2410.05265, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:27.030374Z"},"links":{"cited_paper":"/paper/2410.05265","citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:266f865d4f80b4adaa7e898ee2f4e6d983feed634c608e2c91899b24373f5e38","observation_id":"99c53b06-a0cf-49df-887f-57ea08141abc","resolution":{"observed_at":"2026-08-04T11:31:27.030374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:27.188083Z","title":"Reproducible scal- ing laws for contrastive language-image learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:27.188083Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:dbe2a53cea1b9ebe5e5e6dc2a915d3ef52126f1a8f65834bb7266b3c3f35830d","observation_id":"c3546a92-d3cc-4a3b-8bf5-78f3784f5d62","resolution":{"observed_at":"2026-08-04T11:31:27.188083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:27.358692Z","title":"Low-bit quantization of neural networks for efficient infer- ence","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:27.358692Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:04acd422aa79a888cdbc05b43449caf6da664d2fa18f197f29bfd30e3c24e9b0","observation_id":"8bb8dfb7-d1f7-4d20-8a40-ee49367ebb9e","resolution":{"observed_at":"2026-08-04T11:31:27.358692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:27.543544Z","title":"Vision transformers need registers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:27.543544Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:4595b29c2b39434c1370f3f41bd2596e7ea95a817899e282dd03db560a8eb9b6","observation_id":"a27d3050-1193-4c57-9147-172f1f750d41","resolution":{"observed_at":"2026-08-04T11:31:27.543544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:27.676870Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:27.676870Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:e4073d0ada386164219a46bf6873f8d857680a79236268f6a1c8ef104223d31b","observation_id":"7ca321b7-4f34-4af0-91c8-ccf9d548af08","resolution":{"observed_at":"2026-08-04T11:31:27.676870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:27.795004Z","title":"GPT3.int8(): 8-bit matrix multiplication for transformers at scale","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:27.795004Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:d12e563d5d12d78b0383e701b20249ee913d01020c200f82874dad40ac61914b","observation_id":"8bf37be2-5ecd-41ab-924e-eba8118774a1","resolution":{"observed_at":"2026-08-04T11:31:27.795004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:27.922868Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:27.922868Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:f12117b1d405cd07c7f080dd9d94c074d49105c961b7ff10528417db8ba6ec05","observation_id":"840e8366-e382-4912-a643-842aecb1faf2","resolution":{"observed_at":"2026-08-04T11:31:27.922868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T11:31:28.040256Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.040256Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:54fa0c102ac53b96f02998beac013eb9760d4b4e26dde3bc8129c6af522ef077","observation_id":"a14d126d-8cfd-474f-bada-57d6f3bae130","resolution":{"observed_at":"2026-08-04T11:31:28.040256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.160933Z","title":"When attention sink emerges in language models: An empirical view","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.160933Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:338e7d80392d358d1ad96a6b2be797fd607c45f2a172eb2b41608396480756c4","observation_id":"f55fbad7-3fa2-43d5-9eaf-fbca32fcdc70","resolution":{"observed_at":"2026-08-04T11:31:28.160933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.283607Z","title":"Atten- tion score is not all you need for token importance indica- tor in kv cache reduction: Value also matters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.283607Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:c477203c73a42c3aee5a9b36c2ba33c58562c8a5819696f5b56f5bc4db24ac66","observation_id":"3a379cc5-ae60-49e6-98af-026275aa428d","resolution":{"observed_at":"2026-08-04T11:31:28.283607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.393870Z","title":"Vision transformers don’t need trained registers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.393870Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:910928052a7a10d8623608d85284ee566dc6fe7f38102cf4b6bbab9c907c93e8","observation_id":"913965a2-e521-479c-82fc-9df5c436d060","resolution":{"observed_at":"2026-08-04T11:31:28.393870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.480682Z","title":"See what you are told: Visual attention sink in large multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.480682Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:056601713e7a0ec1a401ecff19c65af53b06abcd612034d484cb5d4c5d5d43d1","observation_id":"8cc45355-91b8-4824-8bd4-6434f29d3fad","resolution":{"observed_at":"2026-08-04T11:31:28.480682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.547383Z","title":"Openvla: An open- source vision-language-action model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.547383Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:d4c72600841e96669bd0a84d87215a9d083e2d29be7b37cef3f9bc2be70ffd15","observation_id":"eafd1022-cdb5-4c56-8767-5d765fa3fa86","resolution":{"observed_at":"2026-08-04T11:31:28.547383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.623629Z","title":"BERT busters: Outlier dimensions that disrupt transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.623629Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:fa1b5130c5dbd7df2a7b44a3f71f7652651ded0772ecdc1cc499676b4a29ec11","observation_id":"3d7e7b16-e13a-4d75-8623-268484082187","resolution":{"observed_at":"2026-08-04T11:31:28.623629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.704939Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.704939Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:87b1e3a26228703c48ffdfa3ed25508a650cc621a530eb05068d7f84cd153dbe","observation_id":"e5726217-8480-430d-9c05-9e61661f31de","resolution":{"observed_at":"2026-08-04T11:31:28.704939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.782100Z","title":"Repq- vit: Scale reparameterization for post-training quantization of vision transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.782100Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:72a6a6ee0998a75d6fce240afb8d52ceddbabfea4659b537626de771f2e22fe2","observation_id":"07c6a7dd-50ae-4e5e-a0a1-abb3980e56bd","resolution":{"observed_at":"2026-08-04T11:31:28.782100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.838901Z","title":"AWQ: Activation-aware weight quantization for on-device LLM compression and acceler- ation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.838901Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:9963a51860c2ffc7ecf93bf0db51a3893402822f9b64d26080af27169d4371f8","observation_id":"d54a2076-0b40-456d-a412-83d15cae875d","resolution":{"observed_at":"2026-08-04T11:31:28.838901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:28.931119Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:28.931119Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:74baf08df58917cb370acd7c91b8dd2eb035b5e898c272c9deb506e6282e3821","observation_id":"2bd27dd6-91a3-4953-83d6-aa548a13b886","resolution":{"observed_at":"2026-08-04T11:31:28.931119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:29.024922Z","title":"Noisyquant: Noisy bias-enhanced post-training activation quantization for vision transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.024922Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:82d31adec0ef27ca0eb24b5335120228d0a62414aa01cf2d7ee368c9b209f122","observation_id":"1611594c-ed0c-44f4-a439-303df007cc30","resolution":{"observed_at":"2026-08-04T11:31:29.024922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:29.104623Z","title":"Post-training quantization for vision trans- former.Advances in Neural Information Processing Systems,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.104623Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:8e7a3e7d47b5b5769ce5c07d55de19c040aaa521c9ab0abf779a37d12c9eaaae","observation_id":"8f1c21e7-5260-4618-8dcd-5fb50a183af9","resolution":{"observed_at":"2026-08-04T11:31:29.104623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:29.227279Z","title":"Spin- quant: LLM quantization with learned rotations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.227279Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:58ce02c0120c01c68ca82810dad6c459c2c5de2daf60fb3dca1b00ee4913a277","observation_id":"70d1ab92-6986-4ee7-85dc-b438b8a08d5d","resolution":{"observed_at":"2026-08-04T11:31:29.227279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16018","last_updated":"2025-07-21T19:29:03Z","snapshot_observed_at":"2026-08-06T15:17:56.637485Z","submitted_at":"2025-07-21T19:29:03Z","title":"Artifacts and Attention Sinks: Structured Approximations for Efficient Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16018","snapshot_observed_at":"2026-08-04T11:31:29.345098Z","title":"Artifacts and attention sinks: Structured ap- proximations for efficient vision transformers.arXiv preprint arXiv:2507.16018, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.345098Z"},"links":{"cited_paper":"/paper/2507.16018","citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:b67db4933efaa97bd7bc851b8b8ca5d0d30f3444d6118f5b5918f6e62148bc16","observation_id":"ffe15873-87bf-4702-baf9-177afbc04be7","resolution":{"observed_at":"2026-08-04T11:31:29.345098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:29.424619Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.424619Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:2780c8be5dfc7ad6f167544baa4a82e6514e426734edf2fafe9b2869e1a9cfbb","observation_id":"f7921278-5a8e-4740-807c-f6778204048d","resolution":{"observed_at":"2026-08-04T11:31:29.424619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:29.525589Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.525589Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:41e0f5be7b8075431b541d21baf6940e20c14af592993e427c5401298ee53a76","observation_id":"b87999bc-df5c-407f-aa37-3c221f2559e6","resolution":{"observed_at":"2026-08-04T11:31:29.525589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:29.632457Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.632457Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:e1f90d9ffdb0a18e8dabc7c747348cb1a3e67c545c5faf91465b742447e91892","observation_id":"8dae8f19-6f51-4d33-b35d-4247a62cbf62","resolution":{"observed_at":"2026-08-04T11:31:29.632457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:29.707763Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.707763Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:a18348542e8c6ed415f48f73afa9f4ae062c439884ec8062821c5cdf7373b801","observation_id":"09d59209-f1ff-43b3-b214-73b06e039de1","resolution":{"observed_at":"2026-08-04T11:31:29.707763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-04T11:31:29.827005Z","title":"Dinov3.arXiv preprint arXiv:2508.10104, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.827005Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:47e59988b132d39b2d03119617bd184534a5cd7fb45c5a07dcf95c1c6a6aa150","observation_id":"6604e520-b58a-4334-8838-4dcff8208d4f","resolution":{"observed_at":"2026-08-04T11:31:29.827005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:29.920081Z","title":"Prefixing attention sinks can mitigate activation outliers for large language model quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.920081Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:1777c77f579518cdfbee32e3057f4dbf9a53ecb2d0f7039ffe59b7fa92bedae4","observation_id":"7b5daa76-3506-4471-b719-541c91fd5383","resolution":{"observed_at":"2026-08-04T11:31:29.920081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:29.999905Z","title":"Massive activations in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:29.999905Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:167403c56c8e9ef28eb2f2326675d5f86e175d9d63d6671d9ba688965e913b27","observation_id":"fef2cf91-f1cf-4666-848c-22982b995fa7","resolution":{"observed_at":"2026-08-04T11:31:29.999905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:30.068980Z","title":"All bark and no bite: Rogue dimensions in transformer language models obscure representational quality","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.068980Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:b520ae424a94396a02edfd956c6237ac6ecb3b117543087c0da12d81cf16b535","observation_id":"debb88d2-7ee9-48f9-995c-ca3963c93481","resolution":{"observed_at":"2026-08-04T11:31:30.068980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-04T11:31:30.145248Z","title":"Siglip 2: Multilingual vision-language en- coders with improved semantic understanding, localization, and dense features.arXiv preprint arXiv:2502.14786, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.145248Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:8c7a4f57368a97d7435a293c83c941e72d487647f1b72170884c9c30b8678b8c","observation_id":"1d596823-80b8-463c-834a-116c5c7b743e","resolution":{"observed_at":"2026-08-04T11:31:30.145248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:30.268133Z","title":"Fima-q: Post-training quantization for vi- sion transformers by fisher information matrix approxima- tion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.268133Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:2b40c429b3d1d7627113f409eed84e12ee5cdb443fa95e193dea06e0f1c15fed","observation_id":"dff7822f-a195-407e-88ca-d8711c1f23a2","resolution":{"observed_at":"2026-08-04T11:31:30.268133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:30.330013Z","title":"Aphq-vit: Post-training quan- tization with average perturbation hessian based reconstruc- tion for vision transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.330013Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:c1b432c1c05da49e864907366a77429a9e7e75075c6870ae63d7c68e7eb6431b","observation_id":"ca1dafbf-086d-4748-a6ea-f03cec3ceac4","resolution":{"observed_at":"2026-08-04T11:31:30.330013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:30.423544Z","title":"SmoothQuant: Accurate and ef- ficient post-training quantization for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.423544Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:63fa2ef298ecf8dbb965392cfe49e68c94d5b46c66d95099d98986ba2cfbbcd1","observation_id":"ddc472a1-3165-49a3-8fac-2ba75b9afdc2","resolution":{"observed_at":"2026-08-04T11:31:30.423544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:30.490953Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.490953Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:4d14cf7d7f3a3dd1dc226fd55d116f2683a747b711f974e1c49366ccf989ff81","observation_id":"8d1dcf76-8894-4e08-80f8-40d7a517fcfc","resolution":{"observed_at":"2026-08-04T11:31:30.490953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:30.577927Z","title":"Noise or signal: The role of image back- grounds in object recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.577927Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:a7420d693b4ca2fd8b0e0485447700669169a16522e697442aa3f86a94137b8b","observation_id":"6203aa4a-5d77-475c-8394-258a4f2da44f","resolution":{"observed_at":"2026-08-04T11:31:30.577927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14428","last_updated":"2024-05-23T10:54:14Z","snapshot_observed_at":"2026-07-06T18:18:30.066741Z","submitted_at":"2024-05-23T10:54:14Z","title":"Mitigating Quantization Errors Due to Activation Spikes in GLU-Based LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14428","snapshot_observed_at":"2026-08-04T11:31:30.644179Z","title":"Mitigating quantization errors due to activation spikes in GLU-based LLMs.arXiv preprint 2405.14428, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.644179Z"},"links":{"cited_paper":"/paper/2405.14428","citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:c7c542b1715b8058702b102b3e60464c473d9ce2a505b097b8b79fa57e4153de","observation_id":"0a80e300-3a05-4307-b5c3-afbdf1e202a4","resolution":{"observed_at":"2026-08-04T11:31:30.644179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03291","last_updated":"2026-07-28T09:18:13Z","snapshot_observed_at":"2026-07-31T23:52:44.107316Z","submitted_at":"2024-08-06T16:40:04Z","title":"DopQ-ViT: Towards Distribution-Friendly and Outlier-Aware Post-Training Quantization for Vision Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03291","snapshot_observed_at":"2026-08-04T11:31:30.707206Z","title":"Dopq- vit: Towards distribution-friendly and outlier-aware post- training quantization for vision transformers.arXiv preprint arXiv:2408.03291, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.707206Z"},"links":{"cited_paper":"/paper/2408.03291","citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:38b12c67aed930ef0525bde4c93d9133603e6cdfe68f634bf3b9d4a25a74e72e","observation_id":"7855009e-1a87-4611-85ad-8c52484a4743","resolution":{"observed_at":"2026-08-04T11:31:30.707206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:30.775304Z","title":"Ptq4vit: Post-training quantization for vision transformers with twin uniform quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.775304Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:97dfb9bff0add87c3865d3aebeaf08dd7bdf9a44ab82018cccc05f811834b043","observation_id":"21d0e597-5b79-4d57-960a-b7a67d190536","resolution":{"observed_at":"2026-08-04T11:31:30.775304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:30.887867Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.887867Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:15e6d84bd0a6a89a3a635a6dd86c4d45ce76c51edc10152df3d0526a8ce9d731","observation_id":"2df6a712-28f0-452c-845e-aa5c5a4b8e58","resolution":{"observed_at":"2026-08-04T11:31:30.887867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:30.958049Z","title":"w/ outliers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:30.958049Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:06f2250594664e7cae99ef34cff3dcbaf71e1b4f3a9af4226ac150304ff071e4","observation_id":"098a7e42-6498-4971-b54a-4c87f3385676","resolution":{"observed_at":"2026-08-04T11:31:30.958049Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:31:31.024002Z","title":"7 As reported in Tab","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T11:31:31.024002Z"},"links":{"citing_paper":"/paper/2510.04547"},"observation_digest":"sha256:5b51fc8c3299afb8b2aca73eb456f88e11a687a9c12c5277e346525da4ebc8eb","observation_id":"758f99cb-786c-4edf-8d75-ce5f5ec2fa0f","resolution":{"observed_at":"2026-08-04T11:31:31.024002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.04547","last_updated":"2026-07-08T06:28:12Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T18:52:45.747562Z","submitted_at":"2025-10-06T07:27:46Z","title":"Activation Quantization of Vision Encoders Needs Prefixing Registers"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2510.04547."}