{"as_of":"2026-08-18T21:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:45cd90e72b83cf7d37dea0fc26bcb6eff4a0f55399ea67bcbb108c1e185a26e0","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:49:05.158865Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:07:58.959186Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T07:59:39.580222Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09554","snapshot_observed_at":"2026-08-06T11:07:58.959186Z","title":"Understanding the performance and power of llm inferencing on edge accelerators,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23093","last_updated":"2025-07-30T20:47:22Z","snapshot_observed_at":"2026-08-15T13:19:11.424028Z","submitted_at":"2025-07-30T20:47:22Z","title":"On the Sustainability of AI Inferences in the Edge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:07:58.959186Z"},"links":{"cited_paper":"/paper/2506.09554","citing_paper":"/paper/2507.23093"},"observation_digest":"sha256:331f4ee7b9860802a3567b08f8cbae5804e7c45aefb85dccd983853dc32073b0","observation_id":"09e339dd-26dd-4613-8d3b-302929859ad7","resolution":{"observed_at":"2026-08-06T11:07:58.959186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"cited_work":{"arxiv_id":"2506.09554","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09554","snapshot_observed_at":"2026-07-04T07:59:39.580222Z","title":null,"venue":null,"work_id":"134f23cf-c5ad-4315-8789-2e2dcd7ac60c","year":2025},"citing_paper":{"arxiv_id":"2606.21428","last_updated":"2026-07-09T17:35:35Z","snapshot_observed_at":"2026-08-14T19:40:18.846187Z","submitted_at":"2026-06-19T13:45:45Z","title":"Does Mixture-of-Experts Actually Help Inference on Consumer and Edge Hardware? An Empirical Study","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T12:30:55.628115Z"},"links":{"cited_paper":"/paper/2506.09554","citing_paper":"/paper/2606.21428"},"observation_digest":"sha256:cd0e29f0a7c5a96d355d21e52714f5a9a902f9fc0771d2d1b82587c17b7c6542","observation_id":"056f7926-2373-437c-93e6-ce0d485aa266","resolution":{"observed_at":"2026-07-04T07:59:39.582044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09554","snapshot_observed_at":"2026-07-12T13:05:17.273287Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.21428","last_updated":"2026-07-09T17:35:35Z","snapshot_observed_at":"2026-08-14T19:40:18.846187Z","submitted_at":"2026-06-19T13:45:45Z","title":"Does Mixture-of-Experts Actually Help Inference on Consumer and Edge Hardware? An Empirical Study","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T13:05:17.273287Z"},"links":{"cited_paper":"/paper/2506.09554","citing_paper":"/paper/2606.21428"},"observation_digest":"sha256:1f4d7e3812243a33860c4ed8fe8eee891e883d8fd98d6f5571098e245d05a69b","observation_id":"bfb30276-44c1-4ed4-866f-de8350740453","resolution":{"observed_at":"2026-07-12T13:05:17.273287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09554/citation-record","integrity":"/paper/2506.09554/integrity","json":"/paper/2506.09554/citation-record.json","paper":"/paper/2506.09554"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T04:49:03.534373Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:03.534373Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:9f3deefe1ec77ac31c9bae148bd1bff0a6c226d343b3acf742f3966d5e56bd94","observation_id":"8af69b5d-aa14-4aa8-a383-048688a79ac6","resolution":{"observed_at":"2026-08-07T04:49:03.534373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.928392Z","title":"Plug in the safety chip: Enforcing constraints for llm-driven robot agents,","venue":null,"work_id":"bf0e034f-da5a-4834-a98b-82d729e70f2b","year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:03.625036Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:38f10553a4bfc17def65024dc852c30fa2967d87083de0dc881daad974ecd0a4","observation_id":"9f5b5f4c-0136-46ec-8aab-02981a2b5328","resolution":{"observed_at":"2026-08-07T04:49:06.996503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-07T04:49:03.789514Z","title":"A survey on efficient inference for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:03.789514Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:21ac06a0ed284e16f8837dfc8000692bee2e5bb8161fdd11c4ae037b27fca5c3","observation_id":"620bec5f-18e1-4327-a0c7-fcc3e9d3281c","resolution":{"observed_at":"2026-08-07T04:49:03.789514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00136","last_updated":"2024-10-31T18:34:59Z","snapshot_observed_at":"2026-08-16T13:04:00.359369Z","submitted_at":"2024-10-31T18:34:59Z","title":"LLM-Inference-Bench: Inference Benchmarking of Large Language Models on AI Accelerators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00136","snapshot_observed_at":"2026-08-07T04:49:03.916941Z","title":"Llm-inference-bench,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:03.916941Z"},"links":{"cited_paper":"/paper/2411.00136","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:34ec3243d4e8ae3ea85e8290ad71f51e9d56437f80e6055ac0d3a59ffa25c741","observation_id":"89ecc77c-05b5-476d-8f20-896aca0967b4","resolution":{"observed_at":"2026-08-07T04:49:03.916941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.777089Z","title":"Characterizing the performance of accelerated jetson edge devices for training dnns,","venue":null,"work_id":"87c591d3-2cd4-4341-8687-3b18a12e446c","year":2023},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.079899Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:8556d52cd2d798efd6aebbad9c58d9fa9ac7e63bee68ede07f8da48475dc94a9","observation_id":"b6633e4d-7b70-499f-83b9-4d4bc9029cc4","resolution":{"observed_at":"2026-08-07T04:49:06.859489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15352","last_updated":"2024-12-19T19:38:33Z","snapshot_observed_at":"2026-08-16T15:32:29.154820Z","submitted_at":"2024-12-19T19:38:33Z","title":"Large Language Models on Small Resource-Constrained Systems: Performance Characterization, Analysis and Trade-offs","version":1},"cited_work":{"arxiv_id":"2412.15352","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15352","snapshot_observed_at":"2026-08-07T04:49:05.289918Z","title":"Large Language Models on Small Resource-Constrained Systems: Performance Characterization, Analysis and Trade-offs","venue":"cs.LG","work_id":"0116c9f6-159a-4a96-b998-def850f5e3d9","year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.191036Z"},"links":{"cited_paper":"/paper/2412.15352","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:ef1d3c3d3945a2ba6a6f792d513559d0a9ceac47fc976ad366b3f108d472e6a8","observation_id":"550cf011-0485-43ba-8ed4-d1302fef8095","resolution":{"observed_at":"2026-08-07T04:49:05.357455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.609398Z","title":"A preliminary performance analysis of llm inference on edge accelerators,","venue":null,"work_id":"2b881777-6574-4dbe-a9bb-e957482d3a46","year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.296823Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:7f107bc9e62781e067ab6d6239253b9a13420e167599de93b246e29ca97eed5f","observation_id":"5952f333-940e-4bb0-8077-efa06d8ea389","resolution":{"observed_at":"2026-08-07T04:49:06.675928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.431631Z","title":"Wikitext-2,","venue":null,"work_id":"102cf50c-9ef3-4cde-89e4-8a7fecbcc37c","year":2016},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.415311Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:f9c729a1211f1491209c1ed7fb115be09657dd8ea43a2027e7a91f1199ab76f9","observation_id":"90bfe4cf-22eb-4e00-989f-2a49948496f8","resolution":{"observed_at":"2026-08-07T04:49:06.518047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.242689Z","title":"Longbench,","venue":null,"work_id":"b1d3ef7d-e4d8-423d-8a21-6f6b5432004f","year":2023},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.556604Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:82465afcb6874920aa1dc26dc243989288aecef962c039d21506d4442cce1d2a","observation_id":"32235912-1aff-4d2f-b2b7-0818a9672b08","resolution":{"observed_at":"2026-08-07T04:49:06.334059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:06.092064Z","title":"Gpt3.int8(): 8-bit matrix multiplication for transformers at scale,","venue":null,"work_id":"b5f98bf8-bbb7-4e2c-b2d3-b9e111128c4e","year":2022},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.676505Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:866def5b62631066af24e05c98c5f1f84b45d137b648bc41570ac1dd1c618818","observation_id":"37ed37ed-a5e6-4ed3-a6ea-ef8ce45a6286","resolution":{"observed_at":"2026-08-07T04:49:06.160849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18677","last_updated":"2024-05-20T15:37:36Z","snapshot_observed_at":"2026-08-16T14:38:46.729665Z","submitted_at":"2023-11-30T16:24:42Z","title":"Splitwise: Efficient generative LLM inference using phase splitting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18677","snapshot_observed_at":"2026-08-07T04:49:04.761986Z","title":"Splitwise: Efficient generative llm inference using phase splitting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.761986Z"},"links":{"cited_paper":"/paper/2311.18677","citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:a5248c575566cc7c822131e88460d3b9cd1b87a81a7762a0a662c90d08542465","observation_id":"8315a6d7-71c0-4c55-ab46-ddabf1f332ec","resolution":{"observed_at":"2026-08-07T04:49:04.761986Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:05.958297Z","title":"When compared with INT4, INT8’s power savings range between 20% and 43% (median 32%)","venue":null,"work_id":"d1fafac2-6ab2-492c-a450-0783dc9b6a20","year":null},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.852213Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:201d3aebc8fc482dcef25e3e15105a7a754786b14ad185624c539b7f8f42e169","observation_id":"0f1a1851-5edd-4ea6-b0f6-8c6664812145","resolution":{"observed_at":"2026-08-07T04:49:06.022150Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:05.802188Z","title":"Against INT4, INT8 consistently yields over 27% power savings","venue":null,"work_id":"3bb0ca65-9c51-4f26-9454-36b1fefe9f67","year":null},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:04.987410Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:395cca5ca3ab08585da4ba60ceea3d56781ea2df6893c063a157480ccf99f63b","observation_id":"cc80d7e8-585a-4c02-b903-569a8cb2d6b3","resolution":{"observed_at":"2026-08-07T04:49:05.886948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:05.674870Z","title":"•Energy Consumption: Similarly, INT8 achieves lower energy usage, with a median reduction of 24% compared to FP16 and 55% com- pared to INT4","venue":null,"work_id":"78753113-d5e7-44fe-b75b-7f0402ec09ef","year":null},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:05.068187Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:77938fcd957d1ff6c74564377ced13c49d3e24c8f67a20305b80f656bb64008d","observation_id":"cb242ee6-3e20-4f56-bead-44e9b01bc9a0","resolution":{"observed_at":"2026-08-07T04:49:05.737086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:49:05.488923Z","title":null,"venue":null,"work_id":"8f467591-8821-443a-a19c-55c170f541dc","year":null},"citing_paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:49:05.158865Z"},"links":{"citing_paper":"/paper/2506.09554"},"observation_digest":"sha256:ec80591545ae262c68d2607f989365250345a09052d3556049578b8e026d2f87","observation_id":"dfb5deec-c2a4-4ee6-b37a-dce61653e0fb","resolution":{"observed_at":"2026-08-07T04:49:05.557627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09554","last_updated":"2025-06-12T08:41:13Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-15T09:42:07.056793Z","submitted_at":"2025-06-11T09:36:32Z","title":"Understanding the Performance and Power of LLM Inferencing on Edge Accelerators"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 3 inbound Pith citation observations for arXiv:2506.09554."}