{"as_of":"2026-08-12T09:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ca51ba788512370adda0cc96a76dab8d882093a1dd5852ebf09588a93cc74fe","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:46:17.847060Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.19325/citation-record","integrity":"/paper/2412.19325/integrity","json":"/paper/2412.19325/citation-record.json","paper":"/paper/2412.19325"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.674748Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.674748Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:7b3528217628a743d18cab5da1088807e3b5eab16812c27a28dc3fce8d40a9a1","observation_id":"6b047f6d-c614-4c50-8644-3920bd00f4d0","resolution":{"observed_at":"2026-08-11T00:46:17.674748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.465150Z","title":"M., Mallinar, N., Lucas, J., and Nakkiran, P","venue":null,"work_id":"4306a54e-fc87-4d3d-a6dc-261757a560bd","year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.679154Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:977ee366b807586d56a783e23a51ada6a35c6709392fc93fcd45b3971384d5c9","observation_id":"96f9fb34-5070-4468-9e6c-e68f137b8c57","resolution":{"observed_at":"2026-08-11T00:46:18.469270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-10T21:52:49.568983Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-11T00:46:17.682571Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.682571Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:43764cb4dfe310059ac8837651c33e65e14f34cf45cf6ee53d7e80b95109e9e2","observation_id":"322b18c9-c923-4dc8-bf44-04df3d88a268","resolution":{"observed_at":"2026-08-11T00:46:17.682571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.454314Z","title":"and Ge, R","venue":null,"work_id":"847b07af-1cf5-470c-98e2-0202278afa6c","year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.687034Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:a9b2a99db9f22c2a8d93aa714223d63fcfdfd1899b4bae36ad5fec114c26d105","observation_id":"15721e5e-9611-4ae0-bdc5-bc8941b55cb1","resolution":{"observed_at":"2026-08-11T00:46:18.457855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.691055Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.691055Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:1c35e8849d0440b93d5a41089c8a75851170e6c7cdf919cc8fafcced978417e8","observation_id":"85cd3f88-e0ba-406c-94fb-a8302d1f35c2","resolution":{"observed_at":"2026-08-11T00:46:17.691055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.694677Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.694677Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:cbab1b184dd4f7ee8f99c4314ec094a58b0b86123c19114c98b6ba0fb3101f47","observation_id":"fd2f7f04-dbce-4010-a5dc-378c5856032d","resolution":{"observed_at":"2026-08-11T00:46:17.694677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.698823Z","title":"Qlora: Efficient finetuning of quantized llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.698823Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:6e209de5207a821fdeba391353563593d44257003e860e73e92dfc093532e7cf","observation_id":"8acee224-e61f-45b3-ab37-6afcaabda785","resolution":{"observed_at":"2026-08-11T00:46:17.698823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.424646Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"d555ef37-e72f-4f84-8f42-9d65b84da053","year":2020},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.702162Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:999d3edae251b0ec784a728a7a505eae0e17384e034776186ab646348674de67","observation_id":"90982f90-e08c-42ff-ace3-356ac7217f20","resolution":{"observed_at":"2026-08-11T00:46:18.428526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10073","last_updated":"2020-02-14T20:49:40Z","snapshot_observed_at":"2026-07-06T08:31:23.192830Z","submitted_at":"2019-10-22T16:15:58Z","title":"Depth-Adaptive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10073","snapshot_observed_at":"2026-08-11T00:46:17.705612Z","title":"Depth-adaptive transformer","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.705612Z"},"links":{"cited_paper":"/paper/1910.10073","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:475f0a2bcdfe2509af2f810f43bb82312ca4317bc53f3b8208ed61bc0a13c27c","observation_id":"7a1f2f3d-82ee-4962-8c77-b681aacae00f","resolution":{"observed_at":"2026-08-11T00:46:17.705612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.414112Z","title":"Depth-adaptive transformer","venue":null,"work_id":"a7101296-83d3-45ce-b96f-3c1908f69d50","year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.709342Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:18122f738100cb6929ed76204507c356b7bfb69194de8cf6d3956afcc9fc87e3","observation_id":"01883388-384a-4c99-a750-7d3ded7ddc1c","resolution":{"observed_at":"2026-08-11T00:46:18.417577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09034","last_updated":"2023-03-01T20:36:43Z","snapshot_observed_at":"2026-07-06T13:22:13.167692Z","submitted_at":"2022-06-17T22:23:11Z","title":"Towards Better Selective Classification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.09034","snapshot_observed_at":"2026-08-11T00:46:17.712383Z","title":"O., Hajimirsadeghi, H., and Abdi, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.712383Z"},"links":{"cited_paper":"/paper/2206.09034","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:4ba9482dbe6c2b3ba83a0aa2966e22b1330133e7871905e013fcf3c87f448675","observation_id":"01f1c6d6-378d-4c00-b8b7-5689ee95ff32","resolution":{"observed_at":"2026-08-11T00:46:17.712383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.repl4nlp-1.18","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.894052Z","title":"Compressing BERT : Studying the effects of weight pruning on transfer learning","venue":null,"work_id":"e8c556a4-e48f-4cb1-ae03-3d5857c85612","year":2020},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.716115Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:9a0117fffbc3c93fcf12cd639d9399d1816be19387a7d2eb9038ba824295fc7b","observation_id":"f29ba132-eca4-4f0b-9ebe-a2a562def69d","resolution":{"observed_at":"2026-08-11T00:46:17.897772Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.404140Z","title":"and Bagnell, D","venue":null,"work_id":"ab8ee9fe-01bd-4f04-b72c-60599b05615c","year":2012},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.719689Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:8eefd6d6dd14b2f14044cbc83b11011cbed292a3f48b9d5258b54966af91e397","observation_id":"1676788f-3b71-4bd0-afa4-9a2d4e2d8f40","resolution":{"observed_at":"2026-08-11T00:46:18.407527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.392403Z","title":"Minillm: Knowledge distillation of large language models","venue":null,"work_id":"a603c5a2-8b3c-4efc-9674-86e213db0591","year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.722671Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:3c80b73f80e6401b244c989aad17c0b852b64475ddb3f21823912c16447f9bf7","observation_id":"df44c1a0-87cd-48ed-bddb-8de075b5a977","resolution":{"observed_at":"2026-08-11T00:46:18.396723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.726320Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.726320Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:0f3d1285f0209f854bc83aa037066595911655120bd74d2858ab6f893c914c14","observation_id":"1324b66b-8c72-49b3-82fe-39bfe592a3cc","resolution":{"observed_at":"2026-08-11T00:46:17.726320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.01148","last_updated":"2022-07-11T17:42:45Z","snapshot_observed_at":"2026-08-12T05:11:29.795628Z","submitted_at":"2021-03-01T17:31:55Z","title":"E$^2$CM: Early Exit via Class Means for Efficient Supervised and Unsupervised Learning","version":3},"cited_work":{"arxiv_id":"2103.01148","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.01148","snapshot_observed_at":"2026-08-11T00:46:18.151836Z","title":"E$^2$CM: Early Exit via Class Means for Efficient Supervised and Unsupervised Learning","venue":"cs.LG","work_id":"7ad17812-949d-4a69-8b9f-9c8584da5db6","year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.730008Z"},"links":{"cited_paper":"/paper/2103.01148","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:b8c5885bcb65bdced83581c91a6e7e620c05626ff74d2859d1c5bb76491d98b8","observation_id":"9fee3923-b0ff-48b6-aae1-4d7347a0e554","resolution":{"observed_at":"2026-08-11T00:46:18.155873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-20083-0_22","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.881070Z","title":"Learning to Weight Samples for Dynamic Early-Exiting Networks, pp.\\ 362--378","venue":null,"work_id":"68b4b8b9-efe5-4726-a309-b48c381a4e4d","year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.733387Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:88576e0dd6f75cf93f897136ddeb2df08e375d241788dc181c323cdeeb1028e8","observation_id":"478d80c1-bf64-4c51-89be-1974b228c2a7","resolution":{"observed_at":"2026-08-11T00:46:17.886483Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.376061Z","title":"A stitch in time saves nine: A train-time regularizing loss for improved neural network calibration","venue":null,"work_id":"800c039f-557c-4ae2-a294-6aff2038c401","year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.736711Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:42d1c57cb2bc5244ea03af6ffd5409a109e382b4e203a14732b6119a86464ad7","observation_id":"15d7e391-ff2b-4e5a-a3e3-8b403b4187ed","resolution":{"observed_at":"2026-08-11T00:46:18.379899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.739881Z","title":"Why relu networks yield high-confidence predictions far away from the training data and how to mitigate the problem","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.739881Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:b918a829da453107b48ee2abc4976ac9d3e0fd194f07b22d7e745177921503bf","observation_id":"f246554e-ae1f-419f-ae06-701d33132fe9","resolution":{"observed_at":"2026-08-11T00:46:17.739881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-11T00:46:17.742904Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.742904Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:b6ac337f8ca55896a7a6e49631a2eef956cfe28cf95a45ad4d102645635cca01","observation_id":"350ab2d4-c82c-48f0-b7a3-81bee7c71971","resolution":{"observed_at":"2026-08-11T00:46:17.742904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-11T00:46:17.746627Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.746627Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:8e504a88d109d3e53c93ea08a8563222b25c444e609aa6ef6df71a0fb1cf7671","observation_id":"7dc95869-bc47-4ca2-a613-1183204816eb","resolution":{"observed_at":"2026-08-11T00:46:17.746627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02301","last_updated":"2023-07-05T16:59:31Z","snapshot_observed_at":"2026-07-06T15:22:55.122322Z","submitted_at":"2023-05-03T17:50:56Z","title":"Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02301","snapshot_observed_at":"2026-08-11T00:46:17.750351Z","title":"Distilling step-by-step! outperforming larger language models with less training data and smaller model sizes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.750351Z"},"links":{"cited_paper":"/paper/2305.02301","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:9bc1cdab75d7b3fbc29a791c94157f8a7a557ff1a613b059e3f438c3dec520fd","observation_id":"f1c541ca-c9c5-426c-82e6-834f01cb508a","resolution":{"observed_at":"2026-08-11T00:46:17.750351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.364549Z","title":null,"venue":null,"work_id":"02be6067-27a2-4834-a619-256ade3b1fa7","year":2017},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.756173Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:e978076e5628e1c418b2065ffe00f5f5021cc3ac7ca895404fdfdd9dcd81ac10","observation_id":"225c4804-4a31-4c58-b1cc-c248812d257b","resolution":{"observed_at":"2026-08-11T00:46:18.368352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.353275Z","title":"Adaptive deep neural network inference optimization with eenet","venue":null,"work_id":"6a48fe34-049d-48e1-9df2-287acf812054","year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.759713Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:ee977d8c7287582b3ebceaf392e5750913bbb6600b760893ed10f255ef560fd7","observation_id":"006b4c1e-1667-4823-b9cc-9498cb956320","resolution":{"observed_at":"2026-08-11T00:46:18.356918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.341724Z","title":"U., Zhang, D., and Nalisnick, E","venue":null,"work_id":"871c4c4c-8f1f-47e9-b915-74342dadfc86","year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.762670Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:1cd7e050ee7573feea78cb6dd2fe08cfd69ebeaeb91dcc12b512b1c1260957b2","observation_id":"0b9d57b8-1da5-4cb6-8036-d72befded7fc","resolution":{"observed_at":"2026-08-11T00:46:18.345373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.330739Z","title":"To trust or not to trust a classifier","venue":null,"work_id":"ce6d37cb-4ebc-4c64-8f0d-ce6702e5baa1","year":2018},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.765743Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:b0fbe058158066983d2fcfd1fe10fdca791b859d8f909ad6e902a0f5028ce24d","observation_id":"cf48251e-45f3-4ce9-993e-69389c3d6e8f","resolution":{"observed_at":"2026-08-11T00:46:18.334436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-11T00:46:17.769378Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.769378Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:56562ea9401aa45b59c13fc6b70c47650f54b334fd171b7768bb74c1e0d2c4e6","observation_id":"003b5b20-5a2b-4065-b0d0-dcb77daad5d7","resolution":{"observed_at":"2026-08-11T00:46:17.769378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.319794Z","title":"Shallow-deep networks: Understanding and mitigating network overthinking","venue":null,"work_id":"856ef98c-8364-4212-b397-56e1628f5895","year":2018},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.773100Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:a8f44c95eef30f3e8f8214a749be78bbfd187dbcea10cc3476611f8d0e5f486a","observation_id":"7cef64ea-02b0-4d42-a0b4-8e2f6dde263c","resolution":{"observed_at":"2026-08-11T00:46:18.323629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.776544Z","title":"Crafting papers on machine learning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.776544Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:08a8e0f518804008e692854634384efc5c921cc143ebecb901f7057f0c967f2d","observation_id":"61028688-bb4a-4f65-90cb-de91095e7c51","resolution":{"observed_at":"2026-08-11T00:46:17.776544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.302647Z","title":null,"venue":null,"work_id":"4abd039c-8deb-4c27-bd18-1acd9dbfa80b","year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.779898Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:4fc8816319dbfc4b226c0c155421b7fdae705544fba8856fca2eb82456248ca7","observation_id":"1a4b9d83-166f-4033-a52d-428c4eb4a790","resolution":{"observed_at":"2026-08-11T00:46:18.306165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.783342Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.783342Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:184b49c3ec77e0d305aa0c26d53dc8371c28f5216397752a14aa042b873cbd8c","observation_id":"0d783e10-8e7a-4830-8a16-96bba326f3d2","resolution":{"observed_at":"2026-08-11T00:46:17.783342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.786656Z","title":"P., Salakhutdinov, R","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.786656Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:8d967e9457b7d875862694f44e55572714e18684a6cd4425bd34622021d69f33","observation_id":"7a88efa8-2955-4038-b02d-b04f6546180b","resolution":{"observed_at":"2026-08-11T00:46:17.786656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T00:46:17.790117Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.790117Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:89761ebb3ab4ca96752b930af27cffb5621155ff999a23d0d7027f73cd6b7681","observation_id":"f428284a-c002-439f-bc90-01f885e658c6","resolution":{"observed_at":"2026-08-11T00:46:17.790117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-11T00:46:17.793499Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.793499Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:edb04c8ebd0dd0c8b02cddef67c91ccafea5812bb3300d37a10695fbf7b9c764","observation_id":"04dc7294-ab78-4fd3-9355-d82b13b6312d","resolution":{"observed_at":"2026-08-11T00:46:17.793499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.278918Z","title":"Fixing overconfidence in dynamic neural networks","venue":null,"work_id":"56f94e23-b428-421c-8ee2-c731cef75ed1","year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.797035Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:5b1356547a240c3ebfaf3e018d1febba0422910d73d1bedc8577b8283750895c","observation_id":"e424f07b-086b-470a-b623-736677643bdc","resolution":{"observed_at":"2026-08-11T00:46:18.282455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.267479Z","title":"P., Cooper, G","venue":null,"work_id":"b36cac5a-7005-4c8b-a8f6-07203d81c3bf","year":2015},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.800150Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:c1bd27d8c35d2b0ba3cb5e0ec0230a2252a760d5a43c66737c65b205bc325afd","observation_id":"1594f0c1-d798-40fb-87bf-a1687e38929f","resolution":{"observed_at":"2026-08-11T00:46:18.271126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.256060Z","title":"On-the-fly operation batching in dynamic computation graphs","venue":null,"work_id":"d2e6b999-71ff-4161-89d2-ba0f0d0e82c0","year":2017},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.803367Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:c4415b8ee9d586b36b35ebc69c4cd55b3a1d2cee9d11bb69c36bb9ab40322d1b","observation_id":"2522d9bb-0547-44f1-b87d-246eb35c51ac","resolution":{"observed_at":"2026-08-11T00:46:18.259805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.244459Z","title":"W., Zhang, L., Jerfel, G., and Tran, D","venue":null,"work_id":"5a87f68c-6a9f-47fd-9c86-9f358a89ff58","year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.806654Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:e45b8f0ccd9956bb69e990c05a358a61bad257cf58ba869fdbf15f9cbca4e75a","observation_id":"b92c40c8-d9aa-432d-8ed8-f11188968ae6","resolution":{"observed_at":"2026-08-11T00:46:18.248113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.810196Z","title":"Can you trust your model's uncertainty? evaluating predictive uncertainty under dataset shift","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.810196Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:06a6fc7d19203dc5503b43b094aaf6c0f4c05f3aa15eb5b703aff108c93dabd0","observation_id":"42bbcd89-deb3-4f56-a373-22772c741cde","resolution":{"observed_at":"2026-08-11T00:46:17.810196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.04765","last_updated":"2018-03-13T13:02:13Z","snapshot_observed_at":"2026-07-06T06:28:00.254252Z","submitted_at":"2018-03-13T13:02:13Z","title":"Deep k-Nearest Neighbors: Towards Confident, Interpretable and Robust Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.04765","snapshot_observed_at":"2026-08-11T00:46:17.813332Z","title":"and McDaniel, P","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.813332Z"},"links":{"cited_paper":"/paper/1803.04765","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:58978bab2a454d5da77ddcd0aa1a581e41df72fd2fd17fe6c4af1db35a6a3f5a","observation_id":"8edd0389-6668-4b5a-aea0-6ac515b4335c","resolution":{"observed_at":"2026-08-11T00:46:17.813332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08803","last_updated":"2021-09-09T17:57:04Z","snapshot_observed_at":"2026-08-12T06:52:04.409671Z","submitted_at":"2021-04-18T10:22:28Z","title":"Consistent Accelerated Inference via Confident Adaptive Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08803","snapshot_observed_at":"2026-08-11T00:46:17.816920Z","title":"Consistent accelerated inference via confident adaptive transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.816920Z"},"links":{"cited_paper":"/paper/2104.08803","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:bb19236e51df73a4c595cdfba7ff124e77c4b457ca1771006c647c2feff46890","observation_id":"41723cf0-a234-4908-9e1e-2796de5b3e46","resolution":{"observed_at":"2026-08-11T00:46:17.816920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.820743Z","title":"Confident adaptive language modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.820743Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:64fdb5c40c7c8283b11413488dca63e3cd77575cf556a63f2e200ba1ecfd546f","observation_id":"7889afeb-f476-4712-860c-e0e901dd79c1","resolution":{"observed_at":"2026-08-11T00:46:17.820743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-11T00:46:17.823761Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.823761Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:ffb63b695b621e5cdba7356aa00e73a530a796e9297e529e18d84114e11529f0","observation_id":"8d524fcb-9f4c-4b42-a162-1ea91cbabb0d","resolution":{"observed_at":"2026-08-11T00:46:17.823761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.827082Z","title":"and Naganuma, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.827082Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:ca3599c1ef2b5c99b57faf8cc958ac1ee43c2a59304956e982ce07883ab31c3e","observation_id":"cdc59e29-9908-4fb1-9b2a-68050dc67d0b","resolution":{"observed_at":"2026-08-11T00:46:17.827082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.830171Z","title":"Branchynet: Fast inference via early exiting from deep neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.830171Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:49cd636cf881ae060c03b26e4bd7c4b0229f27c2222f1a614928cdffe3f695ed","observation_id":"b00f86cc-a165-4c26-aa23-60b93e71860f","resolution":{"observed_at":"2026-08-11T00:46:17.830171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.214141Z","title":"Open-set recognition: A good closed-set classifier is all you need? 2021","venue":null,"work_id":"b46b1d92-d8ac-4914-aca9-f69029bb641e","year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.833039Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:dc85a4409b7294c954f0315b938acf5b9656080390bb58e6324b25c693560451","observation_id":"f2b11145-d33f-4198-9acc-a5a22a317f94","resolution":{"observed_at":"2026-08-11T00:46:18.218173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01222","last_updated":"2025-09-14T12:53:07Z","snapshot_observed_at":"2026-07-06T16:01:41.830509Z","submitted_at":"2023-08-02T15:28:10Z","title":"Calibration in Deep Learning: A Survey of the State-of-the-Art","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01222","snapshot_observed_at":"2026-08-11T00:46:17.836629Z","title":"Calibration in deep learning: A survey of the state-of-the-art","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.836629Z"},"links":{"cited_paper":"/paper/2308.01222","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:ce61aa455a2cba2e39a85dfe3baf637d8fe0afe7282393a6a07743f1023f74d1","observation_id":"014d507a-7c2b-485a-b489-423324ccc811","resolution":{"observed_at":"2026-08-11T00:46:17.836629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.202212Z","title":"Rethinking calibration of deep neural networks: Do not be afraid of overconfidence","venue":null,"work_id":"62d781bf-69d9-4274-9e95-5f48e4fcbc23","year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.840081Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:1c63183629b10e49fc0de0ed4e5e5d4bf860f572e96f555ae3cb12639a7013fb","observation_id":"4afa6e13-0f3a-411a-9fdf-418dd922f402","resolution":{"observed_at":"2026-08-11T00:46:18.205918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-11T00:46:17.843536Z","title":"Emergent abilities of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.843536Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:e9bf641bff7bd30e287326bd074a39ad414afe0119addb19ecbad9a2da03e2b3","observation_id":"ebf1b9b5-f4bb-4ddd-8288-9940641da336","resolution":{"observed_at":"2026-08-11T00:46:17.843536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.847060Z","title":"Pytorch image models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.847060Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:3334345cff2e75d93abba0cba628033ef7673753565a106a177fc9a50aad2982","observation_id":"d0555f4e-ad26-41fb-ba95-a6a7c57b28a6","resolution":{"observed_at":"2026-08-11T00:46:17.847060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T06:52:36.823395Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":3,"verified_fuzzy":17},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2412.19325."}