{"as_of":"2026-08-20T04:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0975bc06c1a9a6bf29fcd4803220b03259dd32583db47d6a5d6a428c9df333bf","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:18:24.529671Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:26:51.707959Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-16T12:16:17.039197Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"cited_work":{"arxiv_id":"2505.10202","doi":"10.48550/arxiv.2505.10202","metadata_source":"pith","pith_arxiv_id":"2505.10202","snapshot_observed_at":"2026-08-16T12:16:17.039197Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","venue":"cs.CL","work_id":"1fc30a2d-71d2-493f-9cbd-447b4a91e43d","year":2025},"citing_paper":{"arxiv_id":"2608.12026","last_updated":"2026-08-12T13:06:50Z","snapshot_observed_at":"2026-08-19T01:47:20.297286Z","submitted_at":"2026-08-12T13:06:50Z","title":"SoftWater: Class-Aware Rate Allocation for Softmax Quantization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T00:26:51.707959Z"},"links":{"cited_paper":"/paper/2505.10202","citing_paper":"/paper/2608.12026"},"observation_digest":"sha256:69eef81c42600a570750fd882bd14f1ff5b24e4eb3598120d2625d7aed804cbc","observation_id":"985d0610-4d2d-4a68-92e6-acb10f7dc5cf","resolution":{"observed_at":"2026-08-16T00:26:52.160396Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.10202/citation-record","integrity":"/paper/2505.10202/integrity","json":"/paper/2505.10202/citation-record.json","paper":"/paper/2505.10202"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.410534Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.410534Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:37043401aebd3a506247d3d15f33cad3bd1c81bc0415e280a3e9cb939e8f675a","observation_id":"42cc6d94-4609-4d44-af61-e0f1d3a07d91","resolution":{"observed_at":"2026-08-15T21:18:24.410534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.415315Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.415315Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:c4dc943c02a3a709c86c8c3210ff28bd97103f3ac430db500459945e2efcb480","observation_id":"4eeca735-24d4-420f-aa88-e8839e4f4712","resolution":{"observed_at":"2026-08-15T21:18:24.415315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-14T04:51:04.817737Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-15T21:18:24.419564Z","title":"Courville","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.419564Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:df2a4d615ea91cc7a47e6bb06f35ea7ece9d0bca06157cb51f32530833b3c9f8","observation_id":"5affab7c-02f8-4359-9bdc-4d0389aafd3c","resolution":{"observed_at":"2026-08-15T21:18:24.419564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-15T21:18:24.423831Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.423831Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:d80001de907131b942b3f92339774c61b21e147466bced1cddf951a15f4bb2a5","observation_id":"e6562826-835e-4420-b3f7-535d633cb34b","resolution":{"observed_at":"2026-08-15T21:18:24.423831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.951488Z","title":null,"venue":null,"work_id":"f8876c9f-5306-451e-b370-8af109eb6864","year":2021},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.428069Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:df1b678fc639f6b507c7f74afcdc131108ff1448f0618c710d5f3944cd842911","observation_id":"b9d12b2d-6095-442b-8cf7-8dba9dd7b590","resolution":{"observed_at":"2026-08-15T21:18:24.955317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-14T19:37:43.556604Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-15T21:18:24.431797Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.431797Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:caeccb75f54959ed11778f1ad03a758749561da6b1989d049c340804472db93b","observation_id":"f3898a5a-ab0e-4e79-b04a-9d1e78c971ce","resolution":{"observed_at":"2026-08-15T21:18:24.431797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.939205Z","title":null,"venue":null,"work_id":"af67d085-fc56-41ec-a8f7-4467dbd1c5f7","year":2017},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.436209Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:90c190251d36e9c841a4255e901a6e24ee2dbb760affebdbabb176d5baa27f32","observation_id":"c4e643f3-a78c-4f89-a42b-3e4f38c817e1","resolution":{"observed_at":"2026-08-15T21:18:24.942743Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02626","last_updated":"2015-10-30T23:29:27Z","snapshot_observed_at":"2026-08-15T13:34:24.234242Z","submitted_at":"2015-06-08T19:28:43Z","title":"Learning both Weights and Connections for Efficient Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02626","snapshot_observed_at":"2026-08-15T21:18:24.440824Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.440824Z"},"links":{"cited_paper":"/paper/1506.02626","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:4994a11396c88313f5babd059002fca582fdbea2e50a2fc55f7122fff2d227a2","observation_id":"fd25c665-8c3c-4559-900f-b8fde3c5d6b5","resolution":{"observed_at":"2026-08-15T21:18:24.440824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-15T21:18:24.444996Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.444996Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:27e6bb834f1d6e0a0c287b1b3b8f2a706819dd7aa4ece041d4004d17e96a61fc","observation_id":"57d39289-d7b9-4761-bb0b-ea05bc7cba95","resolution":{"observed_at":"2026-08-15T21:18:24.444996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01462","last_updated":"2017-03-11T19:13:52Z","snapshot_observed_at":"2026-08-18T23:56:06.906645Z","submitted_at":"2016-11-04T17:36:20Z","title":"Tying Word Vectors and Word Classifiers: A Loss Framework for Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01462","snapshot_observed_at":"2026-08-15T21:18:24.448944Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.448944Z"},"links":{"cited_paper":"/paper/1611.01462","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:b2a37872d075faf8cda81781063e20c03d5963f679d960a66140044eb357acc5","observation_id":"03b2c2cd-262b-4044-88d7-579d2c4c31c7","resolution":{"observed_at":"2026-08-15T21:18:24.448944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01144","last_updated":"2017-08-05T22:45:19Z","snapshot_observed_at":"2026-08-15T03:05:41.956181Z","submitted_at":"2016-11-03T19:48:08Z","title":"Categorical Reparameterization with Gumbel-Softmax","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01144","snapshot_observed_at":"2026-08-15T21:18:24.453654Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.453654Z"},"links":{"cited_paper":"/paper/1611.01144","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:378a28730c96151dcb9f82a2b17915038648a2e2cec577b453f048df9adf6232","observation_id":"b2432bd2-474c-41da-98cd-e3de97385433","resolution":{"observed_at":"2026-08-15T21:18:24.453654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.2007","last_updated":"2015-03-18T19:41:42Z","snapshot_observed_at":"2026-08-14T23:08:48.224575Z","submitted_at":"2014-12-05T14:26:27Z","title":"On Using Very Large Target Vocabulary for Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.2007","snapshot_observed_at":"2026-08-15T21:18:24.457829Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.457829Z"},"links":{"cited_paper":"/paper/1412.2007","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:66bbfc15c861254a3c010a00bb55392fd2689deaf54becda47a6d12c1e7dc7ce","observation_id":"82dc74e3-94ca-4ab0-b8dd-4c0868a54a75","resolution":{"observed_at":"2026-08-15T21:18:24.457829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.461834Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.461834Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:e03941fe8dfaf0f6131b435fc10d3dcbec65d7e459e2c927f6c9883e9e8ea52c","observation_id":"b2ffcb63-6199-4ed6-b3eb-95f7d5245635","resolution":{"observed_at":"2026-08-15T21:18:24.461834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.465579Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.465579Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:199ee687168b8ea66e16a75d2f95f78ab7300aa821cc5d7a8585fc6cd8256c4b","observation_id":"60dc7f77-d346-4827-9560-4340c40a6e82","resolution":{"observed_at":"2026-08-15T21:18:24.465579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.928764Z","title":null,"venue":null,"work_id":"2233cc8e-9b7f-427a-83e0-83c7b4500c79","year":2017},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.469322Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:60639248215b730e91af44042b5d586b9022b79b81eea1477c2d2fbe3d198aac","observation_id":"68686b63-e9a9-4af6-93e3-535a579aab05","resolution":{"observed_at":"2026-08-15T21:18:24.932374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.917049Z","title":null,"venue":null,"work_id":"799e8bc3-5393-4a42-b291-ca1834a4571b","year":2018},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.473515Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:b1356f21702c94779f85db27532ea14a8f5ab8d8e81aa00c22f9ea7e54830ed7","observation_id":"b62d7131-15f7-4890-9233-fb87a7807033","resolution":{"observed_at":"2026-08-15T21:18:24.920849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-08-18T01:27:11.590348Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-15T21:18:24.477241Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.477241Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:c329461ffaf8f2f862a8c034e0957d2e9620fddc5e4e077c097900afc8a02a3c","observation_id":"ce6043f8-3ae8-4bbd-8495-5b3be7817ab5","resolution":{"observed_at":"2026-08-15T21:18:24.477241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-15T21:18:24.481301Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.481301Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:8733d62f0030748c9b1cc0c66b7961ca41c43107f6046035d73aec4b049341db","observation_id":"3fdaf91a-7873-4863-8bd6-1a85aa345b39","resolution":{"observed_at":"2026-08-15T21:18:24.481301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.905192Z","title":"Marcus, Mary Ann Marcinkiewicz, and Beatrice Santorini","venue":null,"work_id":"67589f52-4887-45da-83a0-b8f8ced8ebd0","year":1993},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.486003Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:53a0d0cb6102a16d1d028733d213936a792e9a08750668f2bf36ed595f7b6163","observation_id":"e1acafc8-4602-485c-8b85-d75248acf651","resolution":{"observed_at":"2026-08-15T21:18:24.909476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.893557Z","title":null,"venue":null,"work_id":"c3fffdae-2b4c-4915-a4c3-aec572feb680","year":2017},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.489731Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:b7d552325d12e6549039bcf7b909bae5e9ed3e6bfdf9c36b40e2de7d9dafb9b9","observation_id":"c71c33e3-32b2-4ba7-8552-6f3ce7570207","resolution":{"observed_at":"2026-08-15T21:18:24.897468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.881916Z","title":null,"venue":null,"work_id":"811fff2b-1600-40a5-9177-241c26fb75a9","year":2010},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.493252Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:8a49edee884a715457771ea362e66d99ded209ec55cf06f4825eabfcb91f0679","observation_id":"206e5a89-8bec-49b8-9322-739afc69e249","resolution":{"observed_at":"2026-08-15T21:18:24.886287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.870923Z","title":null,"venue":null,"work_id":"e3da2e7c-1926-421d-a8e4-079dec9c67d2","year":2009},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.497089Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:d3feda9ed706ebd4b76f51116b2407bf1dfe04b47ed140f4125a3cdf6024f00c","observation_id":"ade839bf-7dc1-4e10-a3de-b69a70a8379b","resolution":{"observed_at":"2026-08-15T21:18:24.874564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.858250Z","title":null,"venue":null,"work_id":"38bf91f6-8d03-44f4-b3f7-4a5123ce06f8","year":2005},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.501028Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:14ef1f3c3d163c8f09c3238e6f97d4a99c534b058e93cf766c14b4756be23c2f","observation_id":"46fd6e34-9419-4b17-babe-e9de3a422573","resolution":{"observed_at":"2026-08-15T21:18:24.862645Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T21:18:24.505437Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.505437Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:bd219b8c85f50fcfa103f9faa6819b07126ad49e5d0edef7e87df5280af4ce5f","observation_id":"21f0a68b-5512-4002-a069-a285804686f2","resolution":{"observed_at":"2026-08-15T21:18:24.505437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.05859","last_updated":"2017-02-21T17:50:20Z","snapshot_observed_at":"2026-08-14T21:43:25.095281Z","submitted_at":"2016-08-20T18:32:05Z","title":"Using the Output Embedding to Improve Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.05859","snapshot_observed_at":"2026-08-15T21:18:24.509783Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.509783Z"},"links":{"cited_paper":"/paper/1608.05859","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:67c4707b765eaaf53daf9b485aca0da7f59ee1548da58982e4357edcad11156a","observation_id":"31439218-63a7-420d-878b-96dc8ae91ca7","resolution":{"observed_at":"2026-08-15T21:18:24.509783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.514648Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.514648Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:7f6ada775caf45f48e346af0fb369bb2f8dacdf3894761b7f69c6c992238379c","observation_id":"1e902cf1-78ba-458b-bd1f-4390ab8179d8","resolution":{"observed_at":"2026-08-15T21:18:24.514648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.518967Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.518967Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:ac0fba0c7a0106cb863db13c51faf6183840bfc5e222a6f419f74086ff139a7b","observation_id":"36d1912d-5019-41e7-9cd4-5853cb9d1492","resolution":{"observed_at":"2026-08-15T21:18:24.518967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:18:24.522661Z","title":"Sainath, Brian Kingsbury, Bhuvana Ramabhadran, Petr Fousek, Petr Novak, and Abdel - rahman Mohamed","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.522661Z"},"links":{"citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:a5a3a3d5bb0638cf7d7eec658e9e12486c16d3064ac8615786017764a86a7d7f","observation_id":"90fe15cc-ea6c-4dab-af39-bd0805568e17","resolution":{"observed_at":"2026-08-15T21:18:24.522661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-15T21:18:24.526083Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.526083Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:32f614a06310c20a6fc60a06523001412c67a58ad4ad1cd3c46447bef7000a42","observation_id":"b2d0dcd4-94a0-4d09-af79-1cfad88b2e17","resolution":{"observed_at":"2026-08-15T21:18:24.526083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00937","last_updated":"2018-05-30T14:58:27Z","snapshot_observed_at":"2026-08-14T20:17:29.355571Z","submitted_at":"2017-11-02T21:14:44Z","title":"Neural Discrete Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00937","snapshot_observed_at":"2026-08-15T21:18:24.529671Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T21:18:24.529671Z"},"links":{"cited_paper":"/paper/1711.00937","citing_paper":"/paper/2505.10202"},"observation_digest":"sha256:3efa4197832a9d09ff878de5c839c9d55e051c589540c3ea5dc79b0a75b58da2","observation_id":"c73622d5-412a-4697-9a0e-302c54b3f22d","resolution":{"observed_at":"2026-08-15T21:18:24.529671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.10202","last_updated":"2025-05-15T11:58:04Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T01:48:06.947224Z","submitted_at":"2025-05-15T11:58:04Z","title":"VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 1 inbound Pith citation observation for arXiv:2505.10202."}