{"as_of":"2026-08-22T21:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0a93ba58dc2b2a0d8941baf69b4cc372e9694e0f18b98626efb965c5e1ed82bb","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:28:06.924250Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.01625/citation-record","integrity":"/paper/2501.01625/integrity","json":"/paper/2501.01625/citation-record.json","paper":"/paper/2501.01625"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T22:28:06.836993Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.836993Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:737c641443019807a49d081cd1120ec06b46fd61258d931a8c0fd20c41c07088","observation_id":"f7db0863-c7fb-44be-9f72-0b404a44dd9b","resolution":{"observed_at":"2026-08-10T22:28:06.836993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00625","last_updated":"2024-12-29T17:38:32Z","snapshot_observed_at":"2026-08-16T14:30:33.338152Z","submitted_at":"2024-01-01T01:12:42Z","title":"Beyond Efficiency: A Systematic Survey of Resource-Efficient Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00625","snapshot_observed_at":"2026-08-10T22:28:06.840986Z","title":"Beyond efficiency: A systematic survey of resource-efficient large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.840986Z"},"links":{"cited_paper":"/paper/2401.00625","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:d168086ec12a1a12db33b5bd447a03834b2a9ccb4cbc8f473310848dedc12ade","observation_id":"d91e5bba-3d90-43e1-bfcf-e65f9d3bf099","resolution":{"observed_at":"2026-08-10T22:28:06.840986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:06.844915Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.844915Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:4abacd80e32af1d4f30bb35c827fab24009543151928332079b2417c59309052","observation_id":"c4fce5a7-3fb2-46c2-b2df-cd0a49e377a1","resolution":{"observed_at":"2026-08-10T22:28:06.844915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-16T10:03:03.268538Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-10T22:28:06.848223Z","title":"Generating long sequences with sparse transformers","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.848223Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:7c7de97644886bf8aab3f1cd0837dd6dafe99a7651a8cbdfeb7fbe38d551a096","observation_id":"2752e66c-57b6-4b01-b6f8-9c307ed36a70","resolution":{"observed_at":"2026-08-10T22:28:06.848223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T22:28:06.852119Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.852119Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:b63ae96afcd08bb3635269dc7c3987d237fda19866139dab24b74ee39e1744e0","observation_id":"2ab5a22f-1c29-4695-9528-8a24c4b43123","resolution":{"observed_at":"2026-08-10T22:28:06.852119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:06.855781Z","title":"A survey on large language models: Applications, challenges, limitations, and practical usage","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.855781Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:f77b5161fb6b4b0ecaf768cd81c56427ec872f15f3b2299017b49c2e8af9e56c","observation_id":"4dc384f3-1c3f-4d25-af0d-1f0602cba73a","resolution":{"observed_at":"2026-08-10T22:28:06.855781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-08-16T13:36:21.119762Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-10T22:28:06.859112Z","title":"Deberta: Decoding-enhanced bert with disentan- gled attention","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.859112Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:6589116d874d71b5fbe60eeca8320ce734c51a0fd45dd7c3e2b605c1f11f47a4","observation_id":"a3ea3ef7-0bd9-4d39-929d-16274402daa6","resolution":{"observed_at":"2026-08-10T22:28:06.859112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-10T22:28:06.862470Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.862470Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:ce928de0ecf6a0ced18ca2550e898985ac6e4e69ce179f932699ea62d4178425","observation_id":"baf11443-d5ea-4d59-b822-1cfcda6259e4","resolution":{"observed_at":"2026-08-10T22:28:06.862470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:06.865572Z","title":"The distribution of the flora in the alpine zone","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.865572Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:36907c4eb39d9bacff08a21b3e9d9a87e281f6eb18ff2f6b9f8c47b11e45614a","observation_id":"90647f40-be00-4558-85f3-3f2b7338f4c9","resolution":{"observed_at":"2026-08-10T22:28:06.865572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:07.127464Z","title":"Derivation of new readability formulas (automated readability index, fog count and flesch reading ease formula) for navy enlisted personnel","venue":null,"work_id":"6cd66258-8d31-425c-8013-c16c73992ab5","year":1975},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.868929Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:c032ad9af9c89387d1955cb21cf11854d2ca5e2e01cc61d3d683c77d47fbb555","observation_id":"6ce6998c-ffb5-4818-9a47-1a7d84d19979","resolution":{"observed_at":"2026-08-10T22:28:07.130922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-08-18T01:27:11.590348Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-10T22:28:06.872216Z","title":"Albert: A lite bert for self-supervised learning of language representations","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.872216Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:0a5994791d112c6de5f76666a19a424cfde8d26f522526262ad1ac431051ed6b","observation_id":"5bae6feb-fab0-4d11-831e-ca9df87a51d8","resolution":{"observed_at":"2026-08-10T22:28:06.872216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06201","last_updated":"2023-10-09T23:03:24Z","snapshot_observed_at":"2026-08-16T14:53:38.585468Z","submitted_at":"2023-10-09T23:03:24Z","title":"Compressing Context to Enhance Inference Efficiency of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06201","snapshot_observed_at":"2026-08-10T22:28:06.875515Z","title":"Compressing context to enhance inference efficiency of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.875515Z"},"links":{"cited_paper":"/paper/2310.06201","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:e17468527f1329083830330d1cc41c67128d6973653b248e28daba3792203cfd","observation_id":"6c550325-ec6b-4d9e-8c9f-57b8d7b985d2","resolution":{"observed_at":"2026-08-10T22:28:06.875515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12388","last_updated":"2024-10-17T04:09:09Z","snapshot_observed_at":"2026-08-18T11:14:42.688735Z","submitted_at":"2024-10-16T09:13:23Z","title":"Prompt Compression for Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12388","snapshot_observed_at":"2026-08-10T22:28:06.878755Z","title":"Prompt compression for large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.878755Z"},"links":{"cited_paper":"/paper/2410.12388","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:83bb7eafa69d724f30883a05de8233c250a81eeb97b23a7a4ea42fa841071974","observation_id":"e8392a69-cc00-4091-b30d-6b8bb9197ce1","resolution":{"observed_at":"2026-08-10T22:28:06.878755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:06.881967Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.881967Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:f4e216ca226dd3caf8afa3ff1c4431f0045e8882f4cec0cabfcde3bd5b32c96c","observation_id":"41f6f62a-913a-49fa-8213-1430bf698593","resolution":{"observed_at":"2026-08-10T22:28:06.881967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-10T22:28:06.884843Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.884843Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:cf89d1572f08259e724688e028b4a6a9c0f7275cfab9e2a6957bf89baf0e40ed","observation_id":"9042aad3-1166-417e-9763-aeb8745c2849","resolution":{"observed_at":"2026-08-10T22:28:06.884843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-10T22:28:06.888355Z","title":"Large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.888355Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:44f87424cf6f691d5a8495d0c3326d755d3bcf2834b8e6ba6ac2bf1fc467618f","observation_id":"fa4bc757-ae56-4bee-8b41-475ea6961306","resolution":{"observed_at":"2026-08-10T22:28:06.888355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:06.891662Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.891662Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:b0bc155aab43d848523f35ed9227b8e9100ae002c0b9f586cf29742370f347e8","observation_id":"aae909aa-e211-46ff-810e-098d777f878f","resolution":{"observed_at":"2026-08-10T22:28:06.891662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:06.894729Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.894729Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:125a8532224ba5cb21fda00a8fa6e9f86ff74db3b81d820c5f5b9a4bb77e7ce6","observation_id":"fc5c1e00-41d7-4c94-b0d8-82b7a5abc5e5","resolution":{"observed_at":"2026-08-10T22:28:06.894729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03822","last_updated":"2018-06-11T06:10:11Z","snapshot_observed_at":"2026-08-14T19:05:25.482398Z","submitted_at":"2018-06-11T06:10:11Z","title":"Know What You Don't Know: Unanswerable Questions for SQuAD","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03822","snapshot_observed_at":"2026-08-10T22:28:06.898013Z","title":"Know what you don’t know: Unanswerable questions for squad","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.898013Z"},"links":{"cited_paper":"/paper/1806.03822","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:3dab4596598bc18c0e1b45c281f7137f3e8a890b091590aaa4b6783dbe65dae7","observation_id":"8e940835-94cc-4219-8f41-f7d0fa7ce0ac","resolution":{"observed_at":"2026-08-10T22:28:06.898013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:07.100386Z","title":"Benefits and challenges of variable compression ratio (vcr)","venue":null,"work_id":"c3c58ede-340b-4a6a-a052-2b4ffe896af8","year":2003},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.901445Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:8f174f206494976f9c6b712ddeda5a2532ee6c05d39287566a5f5f5901b7ce52","observation_id":"a4850c13-39e5-4e4c-8ea5-9e176a3e650f","resolution":{"observed_at":"2026-08-10T22:28:07.103774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:07.090919Z","title":"A mathematical theory of communication","venue":null,"work_id":"7d044829-9b06-453e-891f-1374e86534b7","year":1948},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.904586Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:7b2d06c0bb2d832e1894a4c0635b68157b1a21c93f175c65170675a3b87bfb4a","observation_id":"c5ac9019-5aae-45bb-9d7d-34fe19f6aedd","resolution":{"observed_at":"2026-08-10T22:28:07.094148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:07.081358Z","title":"A statistical interpretation of term specificity and its application in retrieval","venue":null,"work_id":"402162b3-384d-4fe3-8172-588985e95933","year":1972},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.908374Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:39738f21ad848de62ca5d0275e7b29bcac09ab975aabb5e73e5768977de604cd","observation_id":"905d6db3-aa2e-4c5f-ad26-69824b70d57e","resolution":{"observed_at":"2026-08-10T22:28:07.085280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T22:28:06.911327Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.911327Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:e449b24e937200a36a2d57ce1b37edf55d16e2ee744e1c29c227cc879f624e49","observation_id":"b7fbd42b-6979-4060-b1d6-e771572168d0","resolution":{"observed_at":"2026-08-10T22:28:06.911327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08237","last_updated":"2020-01-02T12:48:08Z","snapshot_observed_at":"2026-07-31T22:49:43.034741Z","submitted_at":"2019-06-19T17:35:48Z","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08237","snapshot_observed_at":"2026-08-10T22:28:06.914534Z","title":"Xlnet: Generalized autoregressive pretraining for language understanding","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.914534Z"},"links":{"cited_paper":"/paper/1906.08237","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:66b55d98e9b1a0df96f9d960363fb829b605bee8924d8f85d5023e4be705a9e3","observation_id":"3b8fe34f-5fbe-4522-a8f3-473e595bb897","resolution":{"observed_at":"2026-08-10T22:28:06.914534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-10T22:28:06.917883Z","title":"Bertscore: Evaluating text generation with bert","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.917883Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:7c92f8e8a362339d5539dfda445b4a00fa02e2de86947f502531c98c9f68538f","observation_id":"7434c874-ae7d-4ebb-8305-66127bbdaa6c","resolution":{"observed_at":"2026-08-10T22:28:06.917883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-10T22:28:06.920982Z","title":"A survey of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.920982Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:1f6fffbe29b5a8f95de311b20fd86b633b36b4b747f396d6c9a933b098216a24","observation_id":"fc372933-1daa-4e33-93b6-a2d3ff9ed954","resolution":{"observed_at":"2026-08-10T22:28:06.920982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:28:07.070130Z","title":"A survey on model compression for large language models","venue":null,"work_id":"3d4f252c-d1ba-45f8-857a-0c84c290d5e6","year":2024},"citing_paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:28:06.924250Z"},"links":{"citing_paper":"/paper/2501.01625"},"observation_digest":"sha256:b58577c8f4de5e66cafff356369e8782a66234b0bec109d568717d170e0e8374","observation_id":"5197d56e-e984-4cb2-a938-17b83fccf727","resolution":{"observed_at":"2026-08-10T22:28:07.075275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.01625","last_updated":"2025-01-03T03:46:51Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T13:00:17.270074Z","submitted_at":"2025-01-03T03:46:51Z","title":"ICPC: In-context Prompt Compression with Faster Inference"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2501.01625."}