{"as_of":"2026-08-15T17:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:725c31ace9b686d842f8808dbd00ffcfdd3a766db92d85d59257794559c02831","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:58:36.879455Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T07:56:00.180707Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T08:03:14.581676Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"cited_work":{"arxiv_id":"2506.23025","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23025","snapshot_observed_at":"2026-06-29T08:03:14.581676Z","title":"Spectra 1.1: Scaling laws and efficient inference for ternary language models.arXiv preprint arXiv:2506.23025, 2025","venue":null,"work_id":"c001c345-203e-4c0f-b7f7-89ca5c7a06b6","year":2025},"citing_paper":{"arxiv_id":"2605.29705","last_updated":"2026-05-28T10:04:02Z","snapshot_observed_at":"2026-08-07T00:41:33.225628Z","submitted_at":"2026-05-28T10:04:02Z","title":"BitTP: The Lightweight Trajectory Prediction Model with BitLLM for Edge-Devices","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T07:56:00.180707Z"},"links":{"cited_paper":"/paper/2506.23025","citing_paper":"/paper/2605.29705"},"observation_digest":"sha256:f6c848d0d098014dae4e2e749581a6afd16263bf46a60ac20fd641213ef05ea0","observation_id":"4e30dd8c-6d9e-4981-965e-8f1f400d7a6d","resolution":{"observed_at":"2026-06-29T08:03:14.583306Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23025/citation-record","integrity":"/paper/2506.23025/integrity","json":"/paper/2506.23025/citation-record.json","paper":"/paper/2506.23025"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:38.380926Z","title":null,"venue":null,"work_id":"bf07144e-c64f-4eea-95c9-5a1c933189a0","year":2022},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:31.734269Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:45036f124b76c2879f2abc4f42b7701f415df0d793c4bcd1360fd39140d68f81","observation_id":"043f9fd2-3378-42ef-8928-1c0162ce458b","resolution":{"observed_at":"2026-08-06T21:58:38.488170Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:38.175393Z","title":null,"venue":null,"work_id":"526363df-1de9-4f49-a022-c9c00be09e13","year":2025},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:31.834775Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:fa3eefcfd23fca94723214f18963b1ecfcad206f4ec85b256c859cf2cd8dcc63","observation_id":"31e32094-9184-4ef5-b85a-4af7c5319f8b","resolution":{"observed_at":"2026-08-06T21:58:38.265945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:31.911502Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:31.911502Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:e8f8328084f5f908848f9a22d008b964c7c0158a6db90dd45e8e17ee5906d0af","observation_id":"18dc2cab-fef3-4f54-859a-d81e85191989","resolution":{"observed_at":"2026-08-06T21:58:31.911502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-13T00:40:50.161960Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-06T21:58:31.996347Z","title":"Croci, Bo Li, Pashmina Cameron, Martin Jaggi, Dan Alistarh, Torsten Hoefler, and James Hensman","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:31.996347Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:3fddc554aa64d4626c3fb7f32546463e9331a854e641c8102b18bfa177f5c043","observation_id":"2853d9a1-345e-4dfa-aa63-05545243bb85","resolution":{"observed_at":"2026-08-06T21:58:31.996347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:32.074269Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.074269Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:726601896910e58b89c1801b0d9b3ddb53d832088a4c9e22eee719a1ea0dd4e1","observation_id":"01a92cbf-2490-48e8-80d5-b488dc582114","resolution":{"observed_at":"2026-08-06T21:58:32.074269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-14T04:51:04.817737Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-06T21:58:32.172660Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.172660Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:0034e91e8ccb03b118e3910ecd9f7057afec0b928c92c774bcbda09f40d7f618","observation_id":"d1ee3448-2f97-4f2d-9dc6-bfeaa50cc125","resolution":{"observed_at":"2026-08-06T21:58:32.172660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-08-14T19:44:03.879127Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-08-06T21:58:32.216688Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.216688Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:2a9f4eca0119f676ae1d68ae89a59a6231a7c7f56e01e6ad221445b0ce321cfa","observation_id":"5940ab03-f85c-4634-9de9-cce79a301aff","resolution":{"observed_at":"2026-08-06T21:58:32.216688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:32.274923Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.274923Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:1cac3d07ad98db93d9158a2efc88944e4ae84bd4fa0c222316d8f5eeaaca3b38","observation_id":"f8a1a219-c077-4728-8b4e-ddfe7109fddd","resolution":{"observed_at":"2026-08-06T21:58:32.274923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:32.321575Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.321575Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:c40e094f2ac44ffc7d88e3a084c169f122619f6eba55051620edf556b0b603a7","observation_id":"de534ba9-d725-4922-a149-af32acf7edfb","resolution":{"observed_at":"2026-08-06T21:58:32.321575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:37.926758Z","title":null,"venue":null,"work_id":"202a3688-d9f6-4da8-86a0-543bbf5decc9","year":2018},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.370832Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:0dd3677d6a027ed3e3cfd897fdbd978ddb623ac0f6433662afd8842d6748df98","observation_id":"c66afc96-aa07-459f-a274-0d1f24c6dbf8","resolution":{"observed_at":"2026-08-06T21:58:38.038396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00075","last_updated":"2019-04-30T19:43:53Z","snapshot_observed_at":"2026-08-14T16:39:05.844758Z","submitted_at":"2019-04-30T19:43:53Z","title":"On the Use of ArXiv as a Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00075","snapshot_observed_at":"2026-08-06T21:58:32.454216Z","title":"Clement, Matthew Bierbaum, Kevin P","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.454216Z"},"links":{"cited_paper":"/paper/1905.00075","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:23a4fa1bd2b0917584f4b443d0730402a7bf5e81d6302d0d4592e0ba6c1fa13c","observation_id":"7557cc23-80e5-42a1-a5cd-49651c845cac","resolution":{"observed_at":"2026-08-06T21:58:32.454216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-06T21:58:32.570981Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.570981Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:64685033446f7d8a787ea0b74dd8b9df5600866b6d5f6b069449f1217e888707","observation_id":"9e22eb0b-b7f9-462d-808d-bc85989b7dae","resolution":{"observed_at":"2026-08-06T21:58:32.570981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09720","last_updated":"2023-02-28T00:12:34Z","snapshot_observed_at":"2026-08-14T12:30:56.566332Z","submitted_at":"2022-12-19T18:48:33Z","title":"The case for 4-bit precision: k-bit Inference Scaling Laws","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09720","snapshot_observed_at":"2026-08-06T21:58:32.672393Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.672393Z"},"links":{"cited_paper":"/paper/2212.09720","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:1b316b7b9c6da2e42294ae27f06dea7a2ecc5337c7cdbec481e139b23fa978e1","observation_id":"b24b96ee-9cb2-4c1f-a8be-9595a0b2aec9","resolution":{"observed_at":"2026-08-06T21:58:32.672393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-11T21:19:33.078277Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-06T21:58:32.738629Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.738629Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:c5e781d62786135f68001c0cc529be9bbb7ab762ac402f48737b02fc05bdd92a","observation_id":"1fd2de14-4d4f-44a4-accc-9c142150dc9a","resolution":{"observed_at":"2026-08-06T21:58:32.738629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11743","last_updated":"2024-08-21T16:10:41Z","snapshot_observed_at":"2026-08-14T18:46:34.971072Z","submitted_at":"2024-08-21T16:10:41Z","title":"MARLIN: Mixed-Precision Auto-Regressive Parallel Inference on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11743","snapshot_observed_at":"2026-08-06T21:58:32.827124Z","title":"Castro, Jiale Chen, Torsten Hoefler, and Dan Alistarh","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.827124Z"},"links":{"cited_paper":"/paper/2408.11743","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:97d42e3749ce5daa0789c619d73df445e729f7c1f54aaa8c663165511ade6742","observation_id":"fe734b39-930f-4176-a525-f89adae7241c","resolution":{"observed_at":"2026-08-06T21:58:32.827124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14123","last_updated":"2024-03-21T04:31:59Z","snapshot_observed_at":"2026-08-14T05:56:11.889049Z","submitted_at":"2024-03-21T04:31:59Z","title":"AI and Memory Wall","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14123","snapshot_observed_at":"2026-08-06T21:58:32.892001Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.892001Z"},"links":{"cited_paper":"/paper/2403.14123","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:aa58c45c431c890bd7a7ad8b465bb8ac8dc81f0b193ee39ab7f8822cb76aa7cf","observation_id":"f6a3106f-23bd-4367-8473-6d828b051915","resolution":{"observed_at":"2026-08-06T21:58:32.892001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-06T21:58:32.979052Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:32.979052Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:5f7eabaa857d9c6d81885a69b20efcbdf338ff3630a8a8913c76058ef977e5a6","observation_id":"395c0f88-5bd1-4427-9476-5ab598ea55f1","resolution":{"observed_at":"2026-08-06T21:58:32.979052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07304","last_updated":"2024-07-10T01:53:49Z","snapshot_observed_at":"2026-08-13T06:55:37.397718Z","submitted_at":"2024-07-10T01:53:49Z","title":"Inference Performance Optimization for Large Language Models on CPUs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07304","snapshot_observed_at":"2026-08-06T21:58:33.109191Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.109191Z"},"links":{"cited_paper":"/paper/2407.07304","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:e0d612a038f46f8cd9299bd24f9d453f50460b54cd16f3e0e299faafc9531a9a","observation_id":"b36cff78-d508-44b1-b1b1-12d62d7a8d87","resolution":{"observed_at":"2026-08-06T21:58:33.109191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:33.252556Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.252556Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:7478d71da09249a50d2c50221dd3df20c6273ac06bd757c434afc35e3316370a","observation_id":"eac6f8c2-5709-47ae-8a0a-d9a27c70092a","resolution":{"observed_at":"2026-08-06T21:58:33.252556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-06T21:58:33.345161Z","title":"Rae, Oriol Vinyals, and Laurent Sifre","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.345161Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:4147f1c25b3bfc7b0df059cc70cf615ec31c69910777b7b1a8874f9fdd589cc9","observation_id":"c123ad72-3ab9-41d7-bb34-84dec3aa30c4","resolution":{"observed_at":"2026-08-06T21:58:33.345161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-06T21:58:33.466773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.466773Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:c345680ce871b335f2dba5b5e7e2313f15a047327846d327c2a69a6fe8da9bf2","observation_id":"36fa20ab-efa3-44ba-a884-97dd37e055d0","resolution":{"observed_at":"2026-08-06T21:58:33.466773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:33.616644Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.616644Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:ce145acf50d2a1ee47cd1c02aa7fcef17010aa9ba407700c4a674953d772f756","observation_id":"ec326f9f-d017-4383-810f-92a610d37ac2","resolution":{"observed_at":"2026-08-06T21:58:33.616644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.12322","last_updated":"2019-06-13T17:55:30Z","snapshot_observed_at":"2026-08-14T16:24:35.878503Z","submitted_at":"2019-05-29T10:50:32Z","title":"A Study of BFLOAT16 for Deep Learning Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.12322","snapshot_observed_at":"2026-08-06T21:58:33.768061Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.768061Z"},"links":{"cited_paper":"/paper/1905.12322","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:dd7547ad728b79702a3d1535398ac1c8e10d52b646df3f418c111a55cc06cc12","observation_id":"07e6f9ba-7983-4f3e-b55f-e2ca0af43b6a","resolution":{"observed_at":"2026-08-06T21:58:33.768061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-06T21:58:33.897488Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.897488Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:d68fc36f9acab49169e6dbf5b9026db38b8405bf0b4160772b4d07f8a497c26b","observation_id":"e1620616-bb66-4051-bb89-a466468f14ea","resolution":{"observed_at":"2026-08-06T21:58:33.897488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12327","last_updated":"2024-10-11T04:44:55Z","snapshot_observed_at":"2026-08-13T01:17:37.333411Z","submitted_at":"2024-07-17T05:53:20Z","title":"Spectra: Surprising Effectiveness of Pretraining Ternary Language Models at Scale","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12327","snapshot_observed_at":"2026-08-06T21:58:33.986883Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:33.986883Z"},"links":{"cited_paper":"/paper/2407.12327","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:b222e45295843f0a5763dcbfce0037d86189d8a316674cb0652903c7c0fb59bd","observation_id":"eecffa83-f6e9-4163-aecf-1d9b0200a1dc","resolution":{"observed_at":"2026-08-06T21:58:33.986883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-08-06T21:58:34.062944Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.062944Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:fcf6287819a1c3af88b4d2de37b5b38f394983c6031e66b53ef506a93031b5fc","observation_id":"b0cd3050-1600-4ae6-8a3e-6399f56a75cc","resolution":{"observed_at":"2026-08-06T21:58:34.062944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:37.721852Z","title":null,"venue":null,"work_id":"1e7a547d-d017-4383-a1ad-925e48b24bb3","year":2021},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.130776Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:67a952e7d0998163f2064a335ced07bef44b2a852811101db6291de82ce04758","observation_id":"3defb7d4-bbef-4f89-a002-db3a59ac1463","resolution":{"observed_at":"2026-08-06T21:58:37.798446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:34.269003Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.269003Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:acdb76fcd5b73541d8130888e9069b8c379a046074168fa3d9ca4ae307befcec","observation_id":"8baf29ef-435a-4f8c-958d-ec9d4197cd86","resolution":{"observed_at":"2026-08-06T21:58:34.269003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T21:58:34.462687Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.462687Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:3e8e25b6d7a5d07749ff6b10721d8a94f9c10cd4c186303aa249fde7b4041da5","observation_id":"8d612af7-2ee9-41c5-9a18-59f9dcd2285f","resolution":{"observed_at":"2026-08-06T21:58:34.462687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:34.575134Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.575134Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:87b6bac21b2455b6a1a7b64ec071c4bbec9f10234d3c092b8c0f5a696f7f1f7b","observation_id":"84027e9f-2f48-4fa1-8bca-bce4ced1dd74","resolution":{"observed_at":"2026-08-06T21:58:34.575134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-14T15:17:37.878305Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-06T21:58:34.684907Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.684907Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:fbd6f571813265449e8ca02cbd296f4c707ff2ec87f67c1169d6ee763ae495a5","observation_id":"e6a8cc48-9708-4edd-af1d-e0d5f8486afb","resolution":{"observed_at":"2026-08-06T21:58:34.684907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-08-12T13:00:33.339808Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03740","snapshot_observed_at":"2026-08-06T21:58:34.765580Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.765580Z"},"links":{"cited_paper":"/paper/1710.03740","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:a247134c52d20ed3cb765738950521e74bf0c9d18dfdd4008b85c192336dd4f8","observation_id":"c5593d79-5272-4f10-8bad-e857aca2d0dd","resolution":{"observed_at":"2026-08-06T21:58:34.765580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:34.826076Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.826076Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:7a62c8bccb3f581db119fa6930369064e901b5bfcae0c0d83cd746833ce5888f","observation_id":"3d50d194-b400-4bd7-8f73-c5a43bf8e1e2","resolution":{"observed_at":"2026-08-06T21:58:34.826076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:34.890095Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.890095Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:402cb308c1aa084ca048e5ffd8962b9d2fc3afda27f8d47d88bbdf3979d593a9","observation_id":"abb8dc68-6b02-4e90-8d66-810ee027b76f","resolution":{"observed_at":"2026-08-06T21:58:34.890095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02054","snapshot_observed_at":"2026-08-06T21:58:34.952998Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.952998Z"},"links":{"cited_paper":"/paper/1910.02054","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:c468f9e916e1a3aabaccdef0fc6c2b05906dfef56d9405ba96fca4000dd83961","observation_id":"16aa179f-5384-407d-a866-16767bf710ef","resolution":{"observed_at":"2026-08-06T21:58:34.952998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:35.046766Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.046766Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:f75d8c365433ac8747ad9004109376ad51662d7c802f6cbb25c06f55bff540a0","observation_id":"01f9e2af-62a1-4733-94ec-1b461cfe0de2","resolution":{"observed_at":"2026-08-06T21:58:35.046766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00448","last_updated":"2025-04-14T10:11:13Z","snapshot_observed_at":"2026-08-13T04:50:51.273891Z","submitted_at":"2023-12-31T10:53:58Z","title":"Beyond Chinchilla-Optimal: Accounting for Inference in Language Model Scaling Laws","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00448","snapshot_observed_at":"2026-08-06T21:58:35.147343Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.147343Z"},"links":{"cited_paper":"/paper/2401.00448","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:6a46517eb8d47286ce710af7cafb9f3ec14cae796bdc76b3048782ae6ca0adca","observation_id":"b2aa463b-8e76-4e21-9235-7ae63ca4fb51","resolution":{"observed_at":"2026-08-06T21:58:35.147343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-06T21:58:35.267674Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.267674Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:2ae4985d5a8ad7e4a7fdec8c99b8610483d49fd77f483b43cc580d30a797472a","observation_id":"b766b427-9e33-4b96-805e-77fcea5a6a0f","resolution":{"observed_at":"2026-08-06T21:58:35.267674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10818","last_updated":"2024-05-09T13:56:06Z","snapshot_observed_at":"2026-08-13T10:09:46.005593Z","submitted_at":"2023-09-19T17:59:54Z","title":"SlimPajama-DC: Understanding Data Combinations for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10818","snapshot_observed_at":"2026-08-06T21:58:35.356227Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.356227Z"},"links":{"cited_paper":"/paper/2309.10818","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:7be3f0b00a78e91759e11c073dfa65d4e75961b5c63d5f527b237865f3988b73","observation_id":"125a6f85-85df-4446-bcba-a359fa5ae593","resolution":{"observed_at":"2026-08-06T21:58:35.356227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06865","last_updated":"2023-06-12T07:48:53Z","snapshot_observed_at":"2026-08-15T16:27:02.775189Z","submitted_at":"2023-03-13T05:19:28Z","title":"FlexGen: High-Throughput Generative Inference of Large Language Models with a Single GPU","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06865","snapshot_observed_at":"2026-08-06T21:58:35.399130Z","title":"Fu, Zhiqiang Xie, Beidi Chen, Clark Barrett, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.399130Z"},"links":{"cited_paper":"/paper/2303.06865","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:ee9453b5d2837062e697c9f0837c06d58bd99f453d097ad13efde2c0e9720b57","observation_id":"87f419bc-5aec-4698-b04a-d2becef731fd","resolution":{"observed_at":"2026-08-06T21:58:35.399130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06585","last_updated":"2024-04-18T03:12:09Z","snapshot_observed_at":"2026-08-13T05:04:53.813940Z","submitted_at":"2023-12-11T18:17:43Z","title":"Beyond Human Data: Scaling Self-Training for Problem-Solving with Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06585","snapshot_observed_at":"2026-08-06T21:58:35.473834Z","title":"Co-Reyes, Rishabh Agarwal, Ankesh Anand, Piyush Patil, Xavier Garcia, Peter J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.473834Z"},"links":{"cited_paper":"/paper/2312.06585","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:1a6dd0cf259385fe20ae32630ea526ac3865736d76b0d4681394346299a9a76b","observation_id":"500a8237-3561-48aa-9da6-c5369e86188f","resolution":{"observed_at":"2026-08-06T21:58:35.473834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:35.562469Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.562469Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:ff1f7203857e85fb8b80bfa7982987237c8569cb39a9f9829ef32cb04e88f3ba","observation_id":"fe99ede9-18de-4469-9d59-d1c01a1af026","resolution":{"observed_at":"2026-08-06T21:58:35.562469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-14T03:33:46.294739Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-06T21:58:35.673026Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.673026Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:98ba1c52ee355d34137a2eecccaa8f795829a5f10b80a0f44535b9e17c7cf18a","observation_id":"ae9c20c2-53a2-4f50-8791-d073e5264aa0","resolution":{"observed_at":"2026-08-06T21:58:35.673026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:37.496583Z","title":null,"venue":null,"work_id":"1be3560a-bf76-47a9-8f61-98e56da9c893","year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.747733Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:75e12b6f20832a0c5b00c781bd4f26ee66bbae6e6006803d7117d52b33ec1224","observation_id":"3a897b84-1a1f-4030-aaa2-fa4b6a916c3d","resolution":{"observed_at":"2026-08-06T21:58:37.601154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01981","last_updated":"2024-09-03T19:11:11Z","snapshot_observed_at":"2026-08-12T23:50:53.186582Z","submitted_at":"2024-06-04T05:47:17Z","title":"Zyda: A 1.3T Dataset for Open Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01981","snapshot_observed_at":"2026-08-06T21:58:35.866731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.866731Z"},"links":{"cited_paper":"/paper/2406.01981","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:7f5c36a8d7ce39723a8608d1f08f344c73e635746fd0cfe68f14645987d84e2c","observation_id":"75429491-20db-4800-937b-80475b2c6c97","resolution":{"observed_at":"2026-08-06T21:58:35.866731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T21:58:35.969071Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:35.969071Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:032307c3495d0eeb2c5180f5f081d8eaac65317fba9eaec31ef6368131ed1278","observation_id":"b9dd0c37-8359-4947-a37e-51ad00c1f789","resolution":{"observed_at":"2026-08-06T21:58:35.969071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-06T21:58:36.058120Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.058120Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:fd62c3edbcf892b56eb14342bd9969b4febb21d5e7a9d7ec61efaa514d542b9f","observation_id":"da0819bb-ce4c-4d7e-b8ff-9f9e2a87b9c2","resolution":{"observed_at":"2026-08-06T21:58:36.058120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-08-15T04:43:14.762539Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-06T21:58:36.149982Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.149982Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:bd6d6a3aa90fd90397c9770719c840398fe5978ce265e4168545958a1710f4c8","observation_id":"f37302c6-31ab-4993-b7be-c8eaab8c52e0","resolution":{"observed_at":"2026-08-06T21:58:36.149982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-06T21:58:36.240388Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.240388Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:b8c2759ad070750346e94cfde5fcc57a019d35736661ea75f2ce5f9bdd9a32f0","observation_id":"5552d6d7-1b80-4ddd-aa62-0c0713c20f87","resolution":{"observed_at":"2026-08-06T21:58:36.240388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-14T20:46:34.382946Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-08-06T21:58:36.311075Z","title":"Liu, and Matt Gardner","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.311075Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:40ade116f919c3bc2b0c3b097f26c823bca7acbaf371fba896d59c2c9293f6ef","observation_id":"8f5116bc-4633-40ec-96f3-c21e213e3288","resolution":{"observed_at":"2026-08-06T21:58:36.311075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10438","last_updated":"2024-03-29T19:21:58Z","snapshot_observed_at":"2026-08-15T13:13:36.205705Z","submitted_at":"2022-11-18T18:59:33Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10438","snapshot_observed_at":"2026-08-06T21:58:36.390497Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.390497Z"},"links":{"cited_paper":"/paper/2211.10438","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:242bf337f8599752181a617f3f70e41404f2c2f5e0fe7a04dd40d554f7236688","observation_id":"917ace06-7174-4469-a713-81a5d3b91a29","resolution":{"observed_at":"2026-08-06T21:58:36.390497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:36.481514Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.481514Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:c0b74c0c77255ea37135cc07b849dc7328787e829ddbc02b82b95b7d55924fc8","observation_id":"934eafdb-3037-40b1-9ce3-b952250a5c43","resolution":{"observed_at":"2026-08-06T21:58:36.481514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-06T21:58:36.595291Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.595291Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:47b29d36db95e714aaaa71dec29fd0a51e7ef2399ade8613f34bf84075883fe0","observation_id":"825f6e34-122b-4d7a-9d80-0aa45d379904","resolution":{"observed_at":"2026-08-06T21:58:36.595291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-06T21:58:36.679879Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.679879Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:b158bdced0d14d1956c3e2362f9b3801ae3d1e43e6ff9c4c9843a33f6ac13691","observation_id":"7bee2538-7f33-4eb0-968a-d3bfff71fa10","resolution":{"observed_at":"2026-08-06T21:58:36.679879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:36.765576Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.765576Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:d581f6c2ce97d7ab6a99793c5d7f664b310e45b9ce00b7261385cef6ee28cf70","observation_id":"f805acb6-f7d8-4221-bd8c-4ea49f5436ca","resolution":{"observed_at":"2026-08-06T21:58:36.765576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:58:36.879455Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:36.879455Z"},"links":{"citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:efd58825b339ead24e738317b3f8768c67c22228a28b8f81c31f4b07bb9ea280","observation_id":"d239e124-dd9b-4f30-a247-cb214e06d237","resolution":{"observed_at":"2026-08-06T21:58:36.879455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T18:40:13.717087Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 1 inbound Pith citation observation for arXiv:2506.23025."}