{"as_of":"2026-08-09T18:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4abc1c83b7439a83bbd0793aec8c49a61a91cc2c56e0f022c92bcd06a2395c0a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":46,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T15:26:18.959612Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":24,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2404.13501","last_updated":"2024-04-21T01:49:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-21T01:49:46Z","title":"A Survey on the Memory Mechanism of Large Language Model based Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T07:21:39.440092Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2404.13501"},"observation_digest":"sha256:136a7efff96be1e364bda44159d9075fecd3e6e8f5fefacd802ea087b3ce3b03","observation_id":"f881ece7-0004-402a-a558-b6a8cdfae25a","resolution":{"observed_at":"2026-05-15T07:21:39.755184Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:ac50f28f947902be194b9f990b1c02c1a6269e5a485f5839d06a8427ad7cd628","observation_id":"c67e25e3-312e-4b6c-be31-feb3e71905fe","resolution":{"observed_at":"2026-05-15T02:39:33.686744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2410.20791","last_updated":"2026-04-06T19:29:25Z","snapshot_observed_at":"2026-08-03T01:41:19.546733Z","submitted_at":"2024-10-28T07:16:00Z","title":"From Cool Demos to Production-Ready FMware: Core Challenges and a Technology Roadmap","version":3},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-23T19:07:21.016824Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2410.20791"},"observation_digest":"sha256:b8335cf6302a6a60f8839bd0f70db5ea5cc9dc6d9012b967398414d69b219d3e","observation_id":"7c916fd0-fe42-40e1-a36c-67926ae38a7d","resolution":{"observed_at":"2026-05-23T19:08:20.777408Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-09T15:26:18.959612Z","title":"Efficient large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01419","last_updated":"2025-06-04T06:43:40Z","snapshot_observed_at":"2026-08-09T15:20:14.262985Z","submitted_at":"2025-02-03T14:58:11Z","title":"Visual Attention Never Fades: Selective Progressive Attention ReCalibration for Detailed Image Captioning in Multimodal Large Language Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T15:26:18.959612Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2502.01419"},"observation_digest":"sha256:5c3ae0cbb0a05b8563bcb681ea89c877a4bf4288749d2291f6cff624d3b35cd0","observation_id":"b7d85cb7-4d73-4e51-bdfd-5863dc4c2aa4","resolution":{"observed_at":"2026-08-09T15:26:18.959612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-08T13:46:11.428921Z","title":"Efficient large language models: A survey.arXiv preprint arXiv:2312.03863 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09647","last_updated":"2025-03-05T16:14:16Z","snapshot_observed_at":"2026-08-09T11:20:27.104492Z","submitted_at":"2025-02-11T00:04:32Z","title":"Unveiling Simplicities of Attention: Adaptive Long-Context Head Identification","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T13:46:11.428921Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2502.09647"},"observation_digest":"sha256:abe05f919c411330d382794a4cf9df79950aaad371fa3126da4424b58109330c","observation_id":"dc37a957-0548-46d9-ab98-bf9802b373e6","resolution":{"observed_at":"2026-08-08T13:46:11.428921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2505.16278","last_updated":"2026-05-18T09:58:49Z","snapshot_observed_at":"2026-08-01T11:49:26.764186Z","submitted_at":"2025-05-22T06:23:04Z","title":"DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T14:30:47.787654Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2505.16278"},"observation_digest":"sha256:9ff9c0b2199bd4a1e41a3d6c7b5a999b0870723d65b015d6106b0ec2cd76b383","observation_id":"f94a8adf-9117-452c-8120-defff72b0e5f","resolution":{"observed_at":"2026-05-22T14:31:40.679447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-07T14:31:32.512737Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-09T07:37:21.236571Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:32.512737Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:a388d5aa27f99e7af1391ebaaac32a19cb813c5093d9583cc62ff41810e6f4c9","observation_id":"3d0d45d0-175c-4d80-830d-6149eb3feeca","resolution":{"observed_at":"2026-08-07T14:31:32.512737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-07T10:51:51.633694Z","title":"Efficient large language models: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04179","last_updated":"2025-06-04T17:26:31Z","snapshot_observed_at":"2026-08-08T19:35:37.122227Z","submitted_at":"2025-06-04T17:26:31Z","title":"SkipGPT: Dynamic Layer Pruning Reinvented with Token Awareness and Module Decoupling","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T10:51:51.633694Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2506.04179"},"observation_digest":"sha256:21675fdd7e0f0c32fdcc95c6b7f295f65a31650e27e954491db25637333d43b9","observation_id":"d6b78270-85ac-48e4-8724-6d02e4619f28","resolution":{"observed_at":"2026-08-07T10:51:51.633694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-07T10:19:35.095186Z","title":"arXiv preprint arXiv:2312.03863","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06401","last_updated":"2025-06-06T02:40:42Z","snapshot_observed_at":"2026-08-09T09:20:46.645964Z","submitted_at":"2025-06-06T02:40:42Z","title":"Direct Behavior Optimization: Unlocking the Potential of Lightweight LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:19:35.095186Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2506.06401"},"observation_digest":"sha256:3e18e4db115f8cc79c9bf4761a12674051d8afbde30e056b49670d280f5f59c8","observation_id":"0e60339d-5a4a-41cb-b92a-c1acc6c5b01e","resolution":{"observed_at":"2026-08-07T10:19:35.095186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-07T05:34:24.096831Z","title":"Efficient large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07731","last_updated":"2025-06-09T13:15:50Z","snapshot_observed_at":"2026-08-09T00:45:01.971673Z","submitted_at":"2025-06-09T13:15:50Z","title":"NeurIPS 2025 E2LM Competition : Early Training Evaluation of Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:34:24.096831Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2506.07731"},"observation_digest":"sha256:7faaf04f90751bc207c74eedf4decd332441f7d0b58ef0b4072f172e806535d4","observation_id":"adb9d9d7-c967-4860-a65b-ae619bb15522","resolution":{"observed_at":"2026-08-07T05:34:24.096831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-07T05:10:39.570052Z","title":"Efficient large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08669","last_updated":"2025-06-10T10:30:43Z","snapshot_observed_at":"2026-08-08T04:30:56.447904Z","submitted_at":"2025-06-10T10:30:43Z","title":"Enhancing Reasoning Capabilities of Small Language Models with Blueprints and Prompt Template Search","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:10:39.570052Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2506.08669"},"observation_digest":"sha256:6c47314fc6824511aa1c0e1074f0134cad1215462ff4e651c26f950363490adc","observation_id":"17a2411b-9c09-491b-81e1-c191ed6b30d3","resolution":{"observed_at":"2026-08-07T05:10:39.570052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-07T01:09:21.374055Z","title":"Efficient large language models: A survey.arXiv preprint arXiv:2312.03863,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12204","last_updated":"2025-06-13T20:15:58Z","snapshot_observed_at":"2026-08-09T07:59:09.687258Z","submitted_at":"2025-06-13T20:15:58Z","title":"Semantic Scheduling for LLM Inference","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T01:09:21.374055Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2506.12204"},"observation_digest":"sha256:6b5b567cb19d1e44b119423030a84c9f54a4cef78d76ef9feb8f26a63adc3fc2","observation_id":"b0b4398d-94be-4292-9c31-18049f43db74","resolution":{"observed_at":"2026-08-07T01:09:21.374055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-06T17:47:41.990874Z","title":"Efficient large language models: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10026","last_updated":"2025-07-14T08:06:58Z","snapshot_observed_at":"2026-08-06T17:39:12.191621Z","submitted_at":"2025-07-14T08:06:58Z","title":"EAT: QoS-Aware Edge-Collaborative AIGC Task Scheduling via Attention-Guided Diffusion Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:47:41.990874Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2507.10026"},"observation_digest":"sha256:1a708589bacf210e977500e958d152123e0aa1b77735ef978a548bcf143cd8ff","observation_id":"9fedacd3-5301-4453-b94f-2a3702bf1170","resolution":{"observed_at":"2026-08-06T17:47:41.990874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T23:21:25.003665Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05468","last_updated":"2025-08-07T15:11:17Z","snapshot_observed_at":"2026-08-09T14:27:14.474056Z","submitted_at":"2025-08-07T15:11:17Z","title":"TASE: Token Awareness and Structured Evaluation for Multilingual Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T23:21:25.003665Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2508.05468"},"observation_digest":"sha256:0ad86ad9e1656c7b85c4b884962cff3505b501aa801d746247eb471d2a8fdfaa","observation_id":"957296a5-1acc-4ae2-932a-265bc358080a","resolution":{"observed_at":"2026-08-05T23:21:25.003665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T14:33:20.422919Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21228","last_updated":"2025-08-28T21:39:53Z","snapshot_observed_at":"2026-08-06T06:07:09.892510Z","submitted_at":"2025-08-28T21:39:53Z","title":"Decoding Memories: An Efficient Pipeline for Self-Consistency Hallucination Detection","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T14:33:20.422919Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2508.21228"},"observation_digest":"sha256:4a7637003f6c231628182e06e617ce0e369dd65714ac2d4a34f3088a9690429f","observation_id":"944abb55-8cab-4d86-a9a0-aec39d7abd7e","resolution":{"observed_at":"2026-08-05T14:33:20.422919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T12:52:01.691397Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01221","last_updated":"2025-09-04T09:30:16Z","snapshot_observed_at":"2026-08-08T17:37:43.606906Z","submitted_at":"2025-09-01T08:06:49Z","title":"DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T12:52:01.691397Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2509.01221"},"observation_digest":"sha256:36bedb8b6e57ca14aa8f470d9b37060f7899c0fa14ed89146be188c0bda5e68b","observation_id":"f98ecfeb-3a36-4d30-8512-c444a8fa88ca","resolution":{"observed_at":"2026-08-05T12:52:01.691397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2510.25977","last_updated":"2026-04-23T22:27:02Z","snapshot_observed_at":"2026-08-02T11:49:00.583840Z","submitted_at":"2025-10-29T21:22:08Z","title":"NeuronMLP: Efficient LLM Inference via Singular Value Decomposition Compression and Tiling on AWS Trainium","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-18T02:51:19.275111Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2510.25977"},"observation_digest":"sha256:63903b488705dca1fcb1d4d95ce8c2ab739d13df68c7195090328077f93d7c4a","observation_id":"07f81e60-1143-420b-a45b-ddb6c846cfe2","resolution":{"observed_at":"2026-05-18T02:52:21.884286Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-03T09:21:42.553598Z","title":"Efficient large language models: A survey.arXiv preprint arXiv:2312.03863, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14192","last_updated":"2026-07-03T11:26:58Z","snapshot_observed_at":"2026-08-07T15:05:40.772054Z","submitted_at":"2026-01-20T17:51:56Z","title":"Toward Efficient Agents: Memory, Tool learning, and Planning","version":2},"reference_index":123,"source":"pdf_text","source_observed_at":"2026-08-03T09:21:42.553598Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2601.14192"},"observation_digest":"sha256:506d502a091c78f544e8550e86b6a236d7423081924aa4702a255f14b415eff9","observation_id":"6a2f46ae-f827-4651-bef0-7063865becd7","resolution":{"observed_at":"2026-08-03T09:21:42.553598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2602.01997","last_updated":"2026-08-06T07:02:58Z","snapshot_observed_at":"2026-08-09T18:09:27.583507Z","submitted_at":"2026-02-02T11:57:22Z","title":"On the Limits of Layer Pruning for Generative Reasoning in Large Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T08:40:24.822863Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2602.01997"},"observation_digest":"sha256:1067d1c3ad43e3f2240accc7e23f48b7daddcaed7b53b9454a9cca058f06cc3a","observation_id":"937bf638-f0a6-42ee-acb6-fdacb1b4cc1d","resolution":{"observed_at":"2026-05-16T08:40:46.217656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2602.15089","last_updated":"2026-04-07T09:55:13Z","snapshot_observed_at":"2026-08-02T21:47:59.853694Z","submitted_at":"2026-02-16T15:00:15Z","title":"Triplet Feature Fusion for Equipment Anomaly Prediction : An Open-Source Methodology Using Small Foundation Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T21:52:27.888915Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2602.15089"},"observation_digest":"sha256:ee93d10260d28b04bed407657ddb4ae9dc68bd894d42b51b7ee1359351b3ba44","observation_id":"3b288f5e-17fc-4319-afdf-832d40031302","resolution":{"observed_at":"2026-05-15T21:56:40.989807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2603.25383","last_updated":"2026-04-22T09:05:30Z","snapshot_observed_at":"2026-07-06T22:50:37.468743Z","submitted_at":"2026-03-26T12:34:18Z","title":"CLIP-RD: Relative Distillation for Efficient CLIP Knowledge Distillation","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T00:20:36.975106Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2603.25383"},"observation_digest":"sha256:85069b414d16c93bb64f3cad6b8536f7de61d24053be3df2fefddf2138b9ed2b","observation_id":"546db393-9dfb-4383-89c5-c9a5750d74af","resolution":{"observed_at":"2026-05-15T00:23:22.886951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2604.07035","last_updated":"2026-05-18T19:31:30Z","snapshot_observed_at":"2026-07-06T22:55:24.459130Z","submitted_at":"2026-04-08T12:50:52Z","title":"Unified Deployment-Aware Evaluation of Open Reasoning Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T17:49:52.594972Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2604.07035"},"observation_digest":"sha256:d8e2e967fdfd25734ab424f3ae29a3e96952eac86bcee349b9ae1ff852121f2f","observation_id":"da83b55e-56eb-4dc7-abad-db8ccbd05f43","resolution":{"observed_at":"2026-05-11T06:01:01.270847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2604.07035","last_updated":"2026-05-18T19:31:30Z","snapshot_observed_at":"2026-07-06T22:55:24.459130Z","submitted_at":"2026-04-08T12:50:52Z","title":"Unified Deployment-Aware Evaluation of Open Reasoning Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T09:42:33.144129Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2604.07035"},"observation_digest":"sha256:3c99a8b10c8690cbc4bf5a65bbf7aa89f21c93c9c7105455a387e97c6c2700aa","observation_id":"82689292-8553-48f8-bda0-2e92b5a88ca2","resolution":{"observed_at":"2026-05-21T09:44:05.726912Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2604.17227","last_updated":"2026-04-19T03:20:30Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T03:20:30Z","title":"Cloud-native and Distributed Systems for Efficient and Scalable Large Language Models -- A Research Agenda","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-10T06:27:23.580445Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2604.17227"},"observation_digest":"sha256:1fe86749b0784fa0aad4c5c5b6a4d121de90ba21ddb641ea6f243f6703feb1f6","observation_id":"0b92a5b2-d53e-4cbb-90aa-981378b81a51","resolution":{"observed_at":"2026-05-10T06:31:30.836748Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.02829","last_updated":"2026-05-04T17:05:45Z","snapshot_observed_at":"2026-08-08T06:58:46.714670Z","submitted_at":"2026-05-04T17:05:45Z","title":"Compress Then Adapt? No, Do It Together via Task-aware Union of Subspaces","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T18:10:41.778201Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.02829"},"observation_digest":"sha256:0b2d8771a42f636f0cc257a528006002355529364a57088b7e812d9589759224","observation_id":"3494371a-1bef-4b0d-86cf-5492daf91652","resolution":{"observed_at":"2026-05-09T06:45:40.935533Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.04738","last_updated":"2026-05-09T08:06:42Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:35:25Z","title":"OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T18:23:14.935801Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.04738"},"observation_digest":"sha256:e990126217ed276a56d566157e48f284250d871ec9e88c4ae2b353af1d87a07e","observation_id":"780515ae-7217-4263-b25d-88c6ac02bdf5","resolution":{"observed_at":"2026-05-09T06:30:44.243755Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.04738","last_updated":"2026-05-09T08:06:42Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:35:25Z","title":"OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T02:59:00.997742Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.04738"},"observation_digest":"sha256:76280ffb89a515ce7d359b5b61c16dba9394123764f1a65c2321f9d4d6a57ddd","observation_id":"e4086864-4fc8-4b4f-9fe9-fa9cefeb88a2","resolution":{"observed_at":"2026-05-12T03:01:18.166123Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.06548","last_updated":"2026-05-07T16:44:56Z","snapshot_observed_at":"2026-08-04T07:00:09.042412Z","submitted_at":"2026-05-07T16:44:56Z","title":"Continuous Latent Diffusion Language Model","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-08T10:04:09.646578Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.06548"},"observation_digest":"sha256:f4cbeee6fa298d26db683b5cd9692d42849c19962d18fc59eb8cde265e00610e","observation_id":"77eccf07-7179-4649-bec5-97c8f97a3884","resolution":{"observed_at":"2026-05-11T20:11:10.544287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.08876","last_updated":"2026-08-02T00:52:12Z","snapshot_observed_at":"2026-08-06T23:24:39.267150Z","submitted_at":"2026-05-09T10:55:11Z","title":"OTora: A Unified Red Teaming Framework for Reasoning-Level Denial-of-Service in LLM Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T01:57:22.554881Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.08876"},"observation_digest":"sha256:b5f4a61aff907478d0ffa47bfa6c6cdd7a11cb5a2ae269899d48f13731c6febc","observation_id":"1f3178b3-5611-41c9-9c58-43cdd5293b41","resolution":{"observed_at":"2026-05-12T07:46:27.575343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.08876","last_updated":"2026-08-02T00:52:12Z","snapshot_observed_at":"2026-08-06T23:24:39.267150Z","submitted_at":"2026-05-09T10:55:11Z","title":"OTora: A Unified Red Teaming Framework for Reasoning-Level Denial-of-Service in LLM Agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T22:52:54.684185Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.08876"},"observation_digest":"sha256:a5754dfd273957ab7e47a12ecf8a33119f06bde0df69f7e391b3718a8ce49534","observation_id":"433bdf12-0e1b-4f04-b5f3-93caea3d0838","resolution":{"observed_at":"2026-07-01T13:45:45.467485Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-04T05:17:31.244809Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.08876","last_updated":"2026-08-02T00:52:12Z","snapshot_observed_at":"2026-08-06T23:24:39.267150Z","submitted_at":"2026-05-09T10:55:11Z","title":"OTora: A Unified Red Teaming Framework for Reasoning-Level Denial-of-Service in LLM Agents","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T05:17:31.244809Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.08876"},"observation_digest":"sha256:ca4424e1a7b8a471bc793619332606fa28b0030f97051712fa6e4fd2fa6c4efa","observation_id":"b641f171-32e8-480c-af79-a60632b11f34","resolution":{"observed_at":"2026-08-04T05:17:31.244809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.13405","last_updated":"2026-05-13T12:00:11Z","snapshot_observed_at":"2026-07-06T23:24:57.051440Z","submitted_at":"2026-05-13T12:00:11Z","title":"When is Warmstarting Effective for Scaling Language Models?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-14T20:00:47.126736Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.13405"},"observation_digest":"sha256:975ba766297a7018f89acf69bb47fa80f9c340f8e613469f0a7db339ed0bd10b","observation_id":"51e8d4f7-ff39-4b93-a88a-86c1aafbf229","resolution":{"observed_at":"2026-05-14T20:02:53.104922Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.15104","last_updated":"2026-05-20T10:20:54Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:22:42Z","title":"From Text to Voice: A Reproducible and Verifiable Framework for Evaluating Tool Calling LLM Agents","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-21T08:45:56.550821Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.15104"},"observation_digest":"sha256:ae604bc38dbc2a1fd4ff9beeee86ebeda4117a5a69d1255e81f94feff6fdb993","observation_id":"749b13f2-b228-4628-82b8-580fce174359","resolution":{"observed_at":"2026-05-21T08:49:53.649954Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.18597","last_updated":"2026-05-19T03:38:49Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:07:44Z","title":"Latent Action Reparameterization for Efficient Agent Inference","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T10:45:20.306945Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.18597"},"observation_digest":"sha256:48e1d07fc6bc84a154cd5c66092ea6bc2eb09fbb4aa7151ae7687c06ddf9d9c9","observation_id":"b1b11fb2-fafe-485f-b572-1976f07f659b","resolution":{"observed_at":"2026-05-20T10:48:12.863156Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.19394","last_updated":"2026-05-19T05:40:12Z","snapshot_observed_at":"2026-08-02T23:18:14.648216Z","submitted_at":"2026-05-19T05:40:12Z","title":"EmbGen: Teaching with Reassembled Corpora","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T06:34:39.739666Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.19394"},"observation_digest":"sha256:0bf78232f2334b8ef33609e364d9f6911519277069d35857cc615ab5107c2549","observation_id":"06f91f01-caa1-4730-9b11-03040e86f958","resolution":{"observed_at":"2026-05-20T06:38:05.506945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2605.23078","last_updated":"2026-05-21T22:23:38Z","snapshot_observed_at":"2026-08-02T10:30:48.658412Z","submitted_at":"2026-05-21T22:23:38Z","title":"GEMQ: Global Expert-Level Mixed-Precision Quantization for MoE LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-25T05:33:06.719954Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2605.23078"},"observation_digest":"sha256:20608cd638f14bfe74ce629d504f785af8c7eed785089986536faa2a625ad63d","observation_id":"cd89a295-a623-4263-a8e0-fa0fd2fc7cda","resolution":{"observed_at":"2026-05-25T05:36:39.850168Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2606.07632","last_updated":"2026-05-31T05:58:12Z","snapshot_observed_at":"2026-08-07T18:32:05.914142Z","submitted_at":"2026-05-31T05:58:12Z","title":"Evaluation of ML Resource Utilization Requires Model Life Cycle Assessment","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-06-28T17:27:19.467192Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2606.07632"},"observation_digest":"sha256:2649db317186e46143f574a8986a9cb7b52047b86a15ef595632f36ea442a448","observation_id":"5897d9cf-d54e-4d8d-82d6-ba32d7bd5766","resolution":{"observed_at":"2026-07-01T21:06:14.588198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2606.10650","last_updated":"2026-06-09T09:57:48Z","snapshot_observed_at":"2026-08-08T05:40:45.882137Z","submitted_at":"2026-06-09T09:57:48Z","title":"Dynamic Linear Attention","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T13:18:18.331031Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2606.10650"},"observation_digest":"sha256:4af4bbbb577f614471016b02fbeb05d5631d1367c9a9266983e2a93eebd4ddc2","observation_id":"bf4af32d-1f4e-4508-8baf-1ea91200213a","resolution":{"observed_at":"2026-07-03T05:27:39.795371Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2606.21238","last_updated":"2026-06-19T09:05:01Z","snapshot_observed_at":"2026-08-07T12:20:29.118971Z","submitted_at":"2026-06-19T09:05:01Z","title":"Recency/Frequency Adaptive KV Caching for Large Language Model Serving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T13:24:44.218871Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2606.21238"},"observation_digest":"sha256:43fbf31760fffef4f116c55378ff86ea550683dc8f6a2ef12d2c5426eed51131","observation_id":"8b7b1267-ff4b-4dbc-a978-b1bd9d5c8332","resolution":{"observed_at":"2026-07-04T07:29:39.052734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2606.27147","last_updated":"2026-06-25T15:18:31Z","snapshot_observed_at":"2026-07-07T00:01:24.919835Z","submitted_at":"2026-06-25T15:18:31Z","title":"Safe Autoregressive Image Generation with Iterative Self-Improving Codebooks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T05:51:01.446139Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2606.27147"},"observation_digest":"sha256:cd6ab0d17e7281b25f8a4a03f218198aa55fad9b33fc8f88b929e28d359544ed","observation_id":"9901a9a7-6210-4689-863a-a02f9fad655a","resolution":{"observed_at":"2026-07-04T12:49:52.913147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2606.31315","last_updated":"2026-06-30T08:24:05Z","snapshot_observed_at":"2026-08-06T20:36:20.361136Z","submitted_at":"2026-06-30T08:24:05Z","title":"BlockPilot: Instance-Adaptive Policy Learning for Diffusion-based Speculative Decoding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-01T05:59:15.199717Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2606.31315"},"observation_digest":"sha256:3c5c29d2ecaabdd9ace4ff0efc8fbdad95041ba5144ff82f855d52da689a9b2b","observation_id":"1f5c11cf-8d01-4d77-9088-2b6d03f17395","resolution":{"observed_at":"2026-07-01T09:55:41.384304Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":"2312.03863","doi":"10.48550/arxiv.2312.03863","metadata_source":"pith","pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Effi- cient large language models: A survey.arXiv preprint arXiv:2312.03863","venue":"cs.CL","work_id":"d859363b-b3a3-42c5-861b-b3b7776e4ff7","year":2023},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":117,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:68e0e86fd1292f6dbdff3b8341bec1f3ebfb8b674a42dc439938d9143e5145e9","observation_id":"229976d7-c436-4347-81a0-fa0ab7f87b43","resolution":{"observed_at":"2026-07-10T01:36:44.270544Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T14:22:10.21899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-07-14T06:30:16.612345Z","title":"Efficient large language models: A survey.arXiv preprint arXiv:2312.03863, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11175","last_updated":"2026-07-13T07:16:50Z","snapshot_observed_at":"2026-07-16T23:19:14.481825Z","submitted_at":"2026-07-13T07:16:50Z","title":"The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy","version":1},"reference_index":245,"source":"pdf_text","source_observed_at":"2026-07-14T06:30:16.612345Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2607.11175"},"observation_digest":"sha256:cc5c36c6263831ede4bbae1c8cb03f2f6217287c598b0540dba185e181c918e6","observation_id":"b70e6bcf-a08e-4646-8684-be985470a96c","resolution":{"observed_at":"2026-07-14T06:30:16.612345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-02T06:45:14.741063Z","title":"Efficient large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T06:45:14.741063Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:3e1a77d787efd2bb1c8cc59a5220342762923611dc3575f8c849e2a70c7ece59","observation_id":"399498e4-c7cc-4f3e-bdcb-93978b1ec766","resolution":{"observed_at":"2026-08-02T06:45:14.741063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-04T04:23:31.693317Z","title":"Efficient large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12161","last_updated":"2026-08-02T15:57:32Z","snapshot_observed_at":"2026-08-07T15:45:17.594747Z","submitted_at":"2026-07-13T21:10:22Z","title":"Token Reduction Is Not Cost Reduction","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T04:23:31.693317Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2607.12161"},"observation_digest":"sha256:7b06426562a65c6e87f78c24431f882b59ede4c8f4f446f0c74122ff08757fb7","observation_id":"db817337-0139-4590-ad76-a8058ee2b9cf","resolution":{"observed_at":"2026-08-04T04:23:31.693317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-02T11:00:12.321867Z","title":"Efficient large language models: A survey.arXiv preprint arXiv:2312.03863, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22624","last_updated":"2026-06-17T08:51:43Z","snapshot_observed_at":"2026-08-09T01:47:42.522618Z","submitted_at":"2026-06-17T08:51:43Z","title":"CHS-SQL: A Text-to-SQL approach based on Confidence-Guided Heuristic Search Schema Linking process","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T11:00:12.321867Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2607.22624"},"observation_digest":"sha256:f891d3ef749e983317f3c5fd7b472daa108ee2ee25b7eacabe394a379a89ab8b","observation_id":"7f446d23-3496-4481-ab49-d225a2486905","resolution":{"observed_at":"2026-08-02T11:00:12.321867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2312.03863/citation-record","integrity":"/paper/2312.03863/integrity","json":"/paper/2312.03863/citation-record.json","paper":"/paper/2312.03863"},"outbound":[],"paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T01:09:26.116796Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 46 inbound Pith citation observations for arXiv:2312.03863."}