{"as_of":"2026-08-21T02:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:be73bcc0099587ae54ae671d06e9711353f0a27759ad46d392acc39358cdc8d9","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:51:16.342069Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07427/citation-record","integrity":"/paper/2608.07427/integrity","json":"/paper/2608.07427/citation-record.json","paper":"/paper/2608.07427"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.678514Z","title":"Can US infrastructure keep up with AI economy?","venue":null,"work_id":"1f4974e1-db8b-48be-9380-a89521f9330f","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.250855Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:44b782e87e7e60804c1f7907d0fc6703db781547c39b01627d12d0796157a909","observation_id":"e86c4175-46a7-4286-b62e-f555d045ec46","resolution":{"observed_at":"2026-08-10T04:51:17.682845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.665109Z","title":"The future of datacenters,","venue":null,"work_id":"93c25c6f-3d29-4597-8fe8-366f2f8f0dd8","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.255689Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:bd566856268b42a08a58708a981dd61e6ad7f8916c3a779f23de6c11a6b392d3","observation_id":"7d0ca9c2-e7cd-4c01-917e-2319287b237d","resolution":{"observed_at":"2026-08-10T04:51:17.669592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.260016Z","title":"How hungry is AI? Benchmarking energy, water and carbon footprint of LLM inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.260016Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:d9d8ec300047404368ca2ad23fa7f9528e6252456821265fda7879c1eee774e3","observation_id":"fc289954-9359-4e9d-9304-67464b88dc4a","resolution":{"observed_at":"2026-08-10T04:51:16.260016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.650692Z","title":"Artificial intelligence and energy overcon- sumption: Data center electricity demand, cooling burdens, and regional sustainability constraints,","venue":null,"work_id":"81e9db84-cae2-4e1b-a211-f38576d1ac8d","year":2026},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.264462Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:5235d25388a4f064e198ab2d44398394e0ea70efb81d1d9d5448ee3af1a56a40","observation_id":"dd8b3348-8555-4d0f-bf7d-735982898ac6","resolution":{"observed_at":"2026-08-10T04:51:17.655713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.636304Z","title":"Comparative analysis on developed optimization techniques for reducing energy consumption in AI training and inference,","venue":null,"work_id":"b113dea5-a7ca-4de6-8c07-d2279b4886fe","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.268990Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:238adc5c3fe236f4fe15d22cb27406b4b2166c441d5df707c3fc2674bb3bed25","observation_id":"bbc5bbef-a87a-45da-b37f-69c669e01afd","resolution":{"observed_at":"2026-08-10T04:51:17.640829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.273744Z","title":"From prompts to power: Measuring the energy footprints of LLM inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.273744Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:b12de3360ae697d48bfd5362aa8d48af54653a39826511ce8776eb29447b621e","observation_id":"bbb05f71-675b-423b-a571-ba990905c72a","resolution":{"observed_at":"2026-08-10T04:51:16.273744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14903","last_updated":"2024-02-22T18:14:09Z","snapshot_observed_at":"2026-08-18T14:23:11.964976Z","submitted_at":"2024-02-22T18:14:09Z","title":"Tokenization counts: the impact of tokenization on arithmetic in frontier LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14903","snapshot_observed_at":"2026-08-10T04:51:16.278459Z","title":"Tokenization counts: The impact of tokenization on arithmetic in frontier LLMs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.278459Z"},"links":{"cited_paper":"/paper/2402.14903","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:1f2311ae30df33fa94905e544c2d6bf8a2c34252184685e9099a75982c455609","observation_id":"1aeb037a-8a26-4336-9779-2a5426fc744a","resolution":{"observed_at":"2026-08-10T04:51:16.278459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.03825","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.208134Z","title":"How different tokenization algo- rithm impact LLMs and transformer models for binary code analysis,","venue":null,"work_id":"2ff6e0c2-9f68-4cfd-8706-f5859cd3e54d","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.283034Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:f5b14f02cd8d4ce45aa96a4007aecf02eb4e2ff06dc5dba2561da37cadb02ac8","observation_id":"e30abeef-7af0-4cce-90e5-89d990b2da18","resolution":{"observed_at":"2026-08-10T04:51:17.217901Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.286983Z","title":"Harnessing vision-language models for time series anomaly detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.286983Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:136a00bb68e1bb19bcd9cebd09c2fcaf4e51463dea01862cf0ed42bd7db77a58","observation_id":"b4287e23-e609-4ad9-9b7d-6c048b1df8f8","resolution":{"observed_at":"2026-08-10T04:51:16.286983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.291049Z","title":"TokenPowerBench: Benchmarking the power consumption of LLM inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.291049Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:68c454b07937bb5083e575b88cf354a59ca74deded453204b68037debc8a9b00","observation_id":"0d2f52fe-fbe6-4f04-a526-cada29527f67","resolution":{"observed_at":"2026-08-10T04:51:16.291049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:16.294955Z","title":"The ML.ENERGY benchmark: Toward automated inference energy measurement and optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.294955Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:261e892e792cec3278274ef7dac952170ee1874fbaf1ad72a9e653fc743acb0a","observation_id":"cf8957cc-a73d-4287-94c5-1b4f3a91685f","resolution":{"observed_at":"2026-08-10T04:51:16.294955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.622104Z","title":"An energy-efficient vision language model inference with importance-aware token pruning,","venue":null,"work_id":"c70d60f0-c913-449f-a1c6-7894a123beac","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.298990Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:46d26672bb688a016962e9ba5bf784f7d096445186f8b3152eeb48df555a3024","observation_id":"fc361cb8-1430-4d56-8148-8ea9cdff5c19","resolution":{"observed_at":"2026-08-10T04:51:17.626613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05950","last_updated":"2026-07-30T08:22:34Z","snapshot_observed_at":"2026-08-14T20:24:40.199057Z","submitted_at":"2026-03-06T06:32:57Z","title":"Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.05950","snapshot_observed_at":"2026-08-10T04:51:16.303359Z","title":"Energy-driven adaptive visual token pruning for efficient vision-language models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.303359Z"},"links":{"cited_paper":"/paper/2603.05950","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:a7a892daa40944c22c6b605c4f1e0ec884c9f63f23c8c1f24a5661504d35119c","observation_id":"92c823a5-1470-42e2-8e75-c50bdc24a828","resolution":{"observed_at":"2026-08-10T04:51:16.303359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06018","last_updated":"2025-04-25T16:39:41Z","snapshot_observed_at":"2026-08-18T14:41:52.229680Z","submitted_at":"2024-11-09T00:35:29Z","title":"A Picture is Worth A Thousand Numbers: Enabling LLMs Reason about Time Series via Visualization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06018","snapshot_observed_at":"2026-08-10T04:51:16.308177Z","title":"A picture is worth a thousand words: Enabling LLMs reason about time series via visualization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.308177Z"},"links":{"cited_paper":"/paper/2411.06018","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:af9e69ea21b09140b774c2e8da95ca9a615322e0bd9d4860eb328e169603ad7a","observation_id":"f3381d6d-fe4e-4a4e-9902-ea80c3f64b56","resolution":{"observed_at":"2026-08-10T04:51:16.308177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.02523","last_updated":"2026-05-06T17:03:24Z","snapshot_observed_at":"2026-08-14T01:39:54.079191Z","submitted_at":"2026-05-06T17:03:24Z","title":"Edge-Deployable LLM Fine-Tuning on a Single GPU for Telecom Network Troubleshooting","version":1},"cited_work":{"arxiv_id":"2607.02523","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.02523","snapshot_observed_at":"2026-08-10T04:51:16.419521Z","title":"Edge-Deployable LLM Fine-Tuning on a Single GPU for Telecom Network Troubleshooting","venue":"cs.DC","work_id":"597b23a6-a6c3-4c71-a9b9-834953cea6e5","year":2026},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.312840Z"},"links":{"cited_paper":"/paper/2607.02523","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:04a6dd26e980067a9e7c2f82ec8cf81a3d4b8b90a59496f586ccf8e69e3cef4a","observation_id":"23f19057-c6ed-4369-8bdb-6a68b50353a2","resolution":{"observed_at":"2026-08-10T04:51:16.426717Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.607431Z","title":"Zeus: Understanding and optimizing GPU energy consumption of DNN training,","venue":null,"work_id":"80e11e8c-cd4d-466c-90da-1a5a00153326","year":2023},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.317365Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:646691cbcb44fc65728ef10c37d5944fa5f7d71c30e5dc8d9b389466cd292ae5","observation_id":"f42fc48d-43db-4062-b758-6986cc746f6d","resolution":{"observed_at":"2026-08-10T04:51:17.612703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T04:51:16.323125Z","title":"The Llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.323125Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:026d16bd92c2410a322c978909efbc7aadfb48b82d623dc345615759989c561d","observation_id":"d5f6ba40-85f2-42cf-acd7-1412f693b57d","resolution":{"observed_at":"2026-08-10T04:51:16.323125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-10T04:51:16.328390Z","title":"Qwen2.5-VL: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.328390Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:2512865a5887ad262249aea0606b21f12cdb7528529b31492ab11b629fa1bf98","observation_id":"be40f393-fb5b-4a06-a150-58204cb18b2e","resolution":{"observed_at":"2026-08-10T04:51:16.328390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-08-10T04:51:16.333215Z","title":"Pixtral 12B,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.333215Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:2625ac38ed151d62ac45c7f46525200f5399eb1eee32de1a4834b0f0159966b9","observation_id":"8c5fe114-94a8-444f-93aa-c622da1dfad6","resolution":{"observed_at":"2026-08-10T04:51:16.333215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.593710Z","title":"Causal inter- vention sequence analysis for fault tracking in radio access networks,","venue":null,"work_id":"d8464fef-d407-4387-b76f-9c460b7b31d7","year":2025},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.337747Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:b2a1f8535692d1eb0999118063de02ea77559efd94f8c3d3204f39c0a6166fdb","observation_id":"a8f2d798-5472-4240-b21b-e5888612a969","resolution":{"observed_at":"2026-08-10T04:51:17.598284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T04:51:17.579050Z","title":"Cost efficient GPU cluster management for training and inference of deep learning,","venue":null,"work_id":"fbbd46ec-18ec-47e3-a9d4-a0b53043a401","year":2022},"citing_paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T04:51:16.342069Z"},"links":{"citing_paper":"/paper/2608.07427"},"observation_digest":"sha256:5f2e7c4b5b53654b7e365cabb0b34d16427c6523404b99dfd5ce7570b85d612a","observation_id":"bda76dd2-3446-4364-821f-8e760aa0dadd","resolution":{"observed_at":"2026-08-10T04:51:17.583501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.07427","last_updated":"2026-08-07T17:14:45Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-20T11:03:30.809456Z","submitted_at":"2026-08-07T17:14:45Z","title":"A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":8},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2608.07427."}