{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:LOFFK6ILLSSXJ7VYRBTDJU5DMI","short_pith_number":"pith:LOFFK6IL","schema_version":"1.0","canonical_sha256":"5b8a55790b5ca574feb8886634d3a362158b7a65162f9d54f45919ab3859cea5","source":{"kind":"arxiv","id":"2404.00928","version":1},"attestation_state":"computed","paper":{"title":"Instance-Aware Group Quantization for Vision Transformers","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.LG"],"primary_cat":"cs.CV","authors_text":"Bumsub Ham, Dohyung Kim, Jaehyeon Moon, Junyong Cheon","submitted_at":"2024-04-01T05:12:30Z","abstract_excerpt":"Post-training quantization (PTQ) is an efficient model compression technique that quantizes a pretrained full-precision model using only a small calibration set of unlabeled samples without retraining. PTQ methods for convolutional neural networks (CNNs) provide quantization results comparable to full-precision counterparts. Directly applying them to vision transformers (ViTs), however, incurs severe performance degradation, mainly due to the differences in architectures between CNNs and ViTs. In particular, the distribution of activations for each channel vary drastically according to input i"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2404.00928","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","primary_cat":"cs.CV","submitted_at":"2024-04-01T05:12:30Z","cross_cats_sorted":["cs.LG"],"title_canon_sha256":"378715ad9fd8406cb7588c19cb9b6e5f895c79babbea129423ff70f5d707a04c","abstract_canon_sha256":"4a2b24749d275d290e5370e52d592433cf3ae4ad4bcd9b0fd291acb24b526eb0"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T08:02:58.845589Z","signature_b64":"DZ8k+dPMTG68lg5clUZEq/NNYbgvZ7mkmdgMpmDhAG6H4BDQ9LM+5J/utKysg+Dzq8apC7Kj3WDKfAKhTrYTCA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"5b8a55790b5ca574feb8886634d3a362158b7a65162f9d54f45919ab3859cea5","last_reissued_at":"2026-07-05T08:02:58.845121Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T08:02:58.845121Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Instance-Aware Group Quantization for Vision Transformers","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.LG"],"primary_cat":"cs.CV","authors_text":"Bumsub Ham, Dohyung Kim, Jaehyeon Moon, Junyong Cheon","submitted_at":"2024-04-01T05:12:30Z","abstract_excerpt":"Post-training quantization (PTQ) is an efficient model compression technique that quantizes a pretrained full-precision model using only a small calibration set of unlabeled samples without retraining. PTQ methods for convolutional neural networks (CNNs) provide quantization results comparable to full-precision counterparts. Directly applying them to vision transformers (ViTs), however, incurs severe performance degradation, mainly due to the differences in architectures between CNNs and ViTs. In particular, the distribution of activations for each channel vary drastically according to input i"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2404.00928","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2404.00928/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2404.00928","created_at":"2026-07-05T08:02:58.845185+00:00"},{"alias_kind":"arxiv_version","alias_value":"2404.00928v1","created_at":"2026-07-05T08:02:58.845185+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2404.00928","created_at":"2026-07-05T08:02:58.845185+00:00"},{"alias_kind":"pith_short_12","alias_value":"LOFFK6ILLSSX","created_at":"2026-07-05T08:02:58.845185+00:00"},{"alias_kind":"pith_short_16","alias_value":"LOFFK6ILLSSXJ7VY","created_at":"2026-07-05T08:02:58.845185+00:00"},{"alias_kind":"pith_short_8","alias_value":"LOFFK6IL","created_at":"2026-07-05T08:02:58.845185+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":0,"internal_anchor_count":0,"sample":[]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/LOFFK6ILLSSXJ7VYRBTDJU5DMI","json":"https://pith.science/pith/LOFFK6ILLSSXJ7VYRBTDJU5DMI.json","graph_json":"https://pith.science/api/pith-number/LOFFK6ILLSSXJ7VYRBTDJU5DMI/graph.json","events_json":"https://pith.science/api/pith-number/LOFFK6ILLSSXJ7VYRBTDJU5DMI/events.json","paper":"https://pith.science/paper/LOFFK6IL"},"agent_actions":{"view_html":"https://pith.science/pith/LOFFK6ILLSSXJ7VYRBTDJU5DMI","download_json":"https://pith.science/pith/LOFFK6ILLSSXJ7VYRBTDJU5DMI.json","view_paper":"https://pith.science/paper/LOFFK6IL","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2404.00928&json=true","fetch_graph":"https://pith.science/api/pith-number/LOFFK6ILLSSXJ7VYRBTDJU5DMI/graph.json","fetch_events":"https://pith.science/api/pith-number/LOFFK6ILLSSXJ7VYRBTDJU5DMI/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/LOFFK6ILLSSXJ7VYRBTDJU5DMI/action/timestamp_anchor","attest_storage":"https://pith.science/pith/LOFFK6ILLSSXJ7VYRBTDJU5DMI/action/storage_attestation","attest_author":"https://pith.science/pith/LOFFK6ILLSSXJ7VYRBTDJU5DMI/action/author_attestation","sign_citation":"https://pith.science/pith/LOFFK6ILLSSXJ7VYRBTDJU5DMI/action/citation_signature","submit_replication":"https://pith.science/pith/LOFFK6ILLSSXJ7VYRBTDJU5DMI/action/replication_record"}},"created_at":"2026-07-05T08:02:58.845185+00:00","updated_at":"2026-07-05T08:02:58.845185+00:00"}