{"as_of":"2026-08-09T19:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d117d5888bbb825b6fef5ed59640609e67b163647547b5725250b4ce55a837be","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T04:32:01.436765Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.03589/citation-record","integrity":"/paper/2502.03589/integrity","json":"/paper/2502.03589/citation-record.json","paper":"/paper/2502.03589"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.093806Z","title":"01-ai Model Yi","venue":null,"work_id":"b85acdd5-ab8d-4084-b806-a51bd486f1f9","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.894208Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:8de3ff50b38714a81a8360ff15f2a71e03de20bed9598e15b9bfccb1071d1568","observation_id":"a2ba7df7-36d3-4a78-9046-e1f3f217cef9","resolution":{"observed_at":"2026-08-09T04:32:03.098044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.079563Z","title":"The code of HKVQ","venue":null,"work_id":"187b3624-c611-485d-b260-ef8c3c0e36e4","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.899952Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:dc962d423b24035e18a8a193856df221eacf1ca7229f4297f8c88dce56367247","observation_id":"5854c212-5933-451a-8341-4562f7fa0dec","resolution":{"observed_at":"2026-08-09T04:32:03.084134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.064816Z","title":"Falcon-180B","venue":null,"work_id":"a0e6ef35-51fe-4513-aa3e-d6f6dc307ef8","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.905385Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:105e1da16757a72a76f3bbf368e57b754ccebd539312c8fa959e75aa470f68dd","observation_id":"bd4341a2-d886-43dd-9535-6e9a8572f1c4","resolution":{"observed_at":"2026-08-09T04:32:03.069761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.050397Z","title":"GPT-4 explaining Self-Attention Mechanism","venue":null,"work_id":"b3050b79-888c-4e48-a69a-75a881d1e4c9","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.910371Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:04213ec266bb94e7bf135b8c718ec4781a2a8c8adeb8eeca0888fdb0cddf39dd","observation_id":"e5cb92bd-4660-418d-a5ab-40a8aeae0dcc","resolution":{"observed_at":"2026-08-09T04:32:03.055142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.035870Z","title":"Meta Llama-3.1","venue":null,"work_id":"2605c1b0-a33b-411c-819f-6f9142c7ee42","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.939057Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:0067130044a37c2743ddcddc0e8201ec61fc71daa1572e0c8d6e5e3e46b4ec81","observation_id":"c21cbef9-aa4b-4df8-aa37-214429fbd23d","resolution":{"observed_at":"2026-08-09T04:32:03.040318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.021557Z","title":"Microsoft Phi-3","venue":null,"work_id":"b1fbca8f-7387-4e44-a482-8bde01f8a969","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.963268Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:793a64bbae1a676242b06a80e450b47b555e37c9967e508c50c35d2a99e4440f","observation_id":"9ff9a508-597f-4b3c-a97e-4bc61994a4bf","resolution":{"observed_at":"2026-08-09T04:32:03.026102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.007122Z","title":"Mistral-v0.3","venue":null,"work_id":"72c06fb2-e129-4d39-b4dc-e347be068e68","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.984003Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:01fb09c9939e8267b29faced0e1b711419238b5e0b53e4741de7fb071973219c","observation_id":"163b85a9-07f8-4024-9df5-71603d79ce3b","resolution":{"observed_at":"2026-08-09T04:32:03.011753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.992804Z","title":"Open Compute Project","venue":null,"work_id":"19566981-2096-43b0-9d15-d10d5e0b12f0","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.012004Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:0aea7581d18f9b440b8ccfbef00de3c37f8bfc65d052962a85f899029f48b349","observation_id":"02973831-aee7-4f0b-bda8-4f53338cb54c","resolution":{"observed_at":"2026-08-09T04:32:02.997340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.978512Z","title":null,"venue":null,"work_id":"ef0ad179-a77b-41d8-a429-2eeea050730c","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.031821Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:127a1a363863711d55f2057d3ca1ed1560fd8cae05a54be418293d294814d9f5","observation_id":"6dcc1684-1bd2-40c3-b2b3-f7cd9862d832","resolution":{"observed_at":"2026-08-09T04:32:02.983111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.964230Z","title":"Amazon Web Services","venue":null,"work_id":"7bbda64b-b5cc-4dad-90e0-175660674d98","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.051883Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:35c32ab51e626faab123d2add46f041409bb295191b7b4a8d586f1923ec6e1f5","observation_id":"23e2105c-de90-403f-a26f-480b948be9ee","resolution":{"observed_at":"2026-08-09T04:32:02.968849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.949211Z","title":null,"venue":null,"work_id":"d7694f73-0bf1-4bab-ad8a-26a8ef407698","year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.070817Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:be80efa54a63a766020c8e48a37f98ad76945c9a032764f7078354b88dcbf3e6","observation_id":"0e9fb43d-1b58-494f-86c7-1d6742b9abee","resolution":{"observed_at":"2026-08-09T04:32:02.954404Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.934832Z","title":null,"venue":null,"work_id":"a849b46c-96d1-4882-8bda-83cbd1af9f8d","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.090781Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:d92854a43ee78c8d8fa03e0c572198ebf8d540e11866c4b685f7f701e7993fd1","observation_id":"4acdba96-c182-4a45-8e84-30aa83e51501","resolution":{"observed_at":"2026-08-09T04:32:02.939427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T04:32:01.111833Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.111833Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:b3ac310f34ca5ec8293b066b6aafb405aa363c01c0d8ad6cf1f273f4e4cfbe9c","observation_id":"11043b35-3024-42d6-8f60-8a03c50dccc5","resolution":{"observed_at":"2026-08-09T04:32:01.111833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.920060Z","title":null,"venue":null,"work_id":"15a2a203-76c2-449d-8abb-e2c8787ef587","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.129220Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:11b477a35f3034273987cec8383995ecb121090897c83a977a4f4bd3f4185158","observation_id":"34f3ef10-7653-40f8-8a64-605c83bcb907","resolution":{"observed_at":"2026-08-09T04:32:02.924597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.05685","last_updated":"2018-05-22T13:06:37Z","snapshot_observed_at":"2026-08-08T21:17:23.383530Z","submitted_at":"2018-04-16T13:55:20Z","title":"A Discourse-Aware Attention Model for Abstractive Summarization of Long Documents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.05685","snapshot_observed_at":"2026-08-09T04:32:01.137495Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.137495Z"},"links":{"cited_paper":"/paper/1804.05685","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:7a74e64ad028cffb75b100ec6f412ac8cc293ccc12d548042e93499a6f86929a","observation_id":"1ff33bc0-3d6e-4e1d-8462-35c0521e1580","resolution":{"observed_at":"2026-08-09T04:32:01.137495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.905200Z","title":null,"venue":null,"work_id":"46771f69-5d05-4c3e-b9ad-c5996e884b0f","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.145652Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:95eb595c90fa098de95f7832cd1de8ea4d7b1ab544bfead9e227f154157c92b9","observation_id":"9c1b44c0-fe71-44a6-a672-d123ae50fcf2","resolution":{"observed_at":"2026-08-09T04:32:02.909728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16546","last_updated":"2024-07-02T12:23:37Z","snapshot_observed_at":"2026-07-06T18:20:05.707144Z","submitted_at":"2024-05-26T12:30:20Z","title":"Cocktail: A Comprehensive Information Retrieval Benchmark with LLM-Generated Documents Integration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16546","snapshot_observed_at":"2026-08-09T04:32:01.161788Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.161788Z"},"links":{"cited_paper":"/paper/2405.16546","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:003aef896da1ffaf1749775fd844b459c71fb78545d915ec35f7c0b661ccd0ca","observation_id":"3916f688-24a1-48c6-b73c-ea8ff5124090","resolution":{"observed_at":"2026-08-09T04:32:01.161788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-09T04:32:01.167087Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.167087Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:c65208962c14daa5576e00c808276829dc8982eaf8dd46b4a1bd4a927e9e4c25","observation_id":"40c9fab2-64d4-4312-9ec5-935173b45f97","resolution":{"observed_at":"2026-08-09T04:32:01.167087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.890789Z","title":null,"venue":null,"work_id":"8740785c-a7d7-48aa-9604-9f7d9037cd7c","year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.172720Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:2b0ae47f7b20d8a6666777707b2370d662432bcc0182cff14bff9ba6035561e3","observation_id":"fc836456-25c5-443f-8225-5952f92ded69","resolution":{"observed_at":"2026-08-09T04:32:02.895532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01801","last_updated":"2024-10-29T18:26:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T05:17:08Z","title":"Model Tells You What to Discard: Adaptive KV Cache Compression for LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01801","snapshot_observed_at":"2026-08-09T04:32:01.182854Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.182854Z"},"links":{"cited_paper":"/paper/2310.01801","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:ef206df2c4f5133ed550bf1cc5944b309f9c05db4deb5fb4b874ec3c1d3f9231","observation_id":"88ea88ac-368e-4b14-9b73-62d7d2e45d53","resolution":{"observed_at":"2026-08-09T04:32:01.182854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.875894Z","title":null,"venue":null,"work_id":"d998b95c-d162-4979-9109-f3a249629f71","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.187928Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:8bf8df9cd42aec8ee4980a527d6844a450af4e2f53f4e7662f773df5d5245019","observation_id":"205d1710-fe8e-42da-8476-8cb6c576a0c0","resolution":{"observed_at":"2026-08-09T04:32:02.880794Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14256","last_updated":"2024-05-23T07:37:16Z","snapshot_observed_at":"2026-07-06T18:18:21.334080Z","submitted_at":"2024-05-23T07:37:16Z","title":"ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14256","snapshot_observed_at":"2026-08-09T04:32:01.192677Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.192677Z"},"links":{"cited_paper":"/paper/2405.14256","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:b9c01ee6c9ae420ea2d929603244f1db7cc742cf261984ebfd558f970a12abb1","observation_id":"274878eb-54ab-4a3f-b47c-6cb7c37c1241","resolution":{"observed_at":"2026-08-09T04:32:01.192677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.860809Z","title":"Mahoney, Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"01b514f6-84c5-41ba-b62f-b225117831b2","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.197825Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:0a501e8c9ec66f48c47e52c944eb603b56ef12b19ab33e0acd45f8b03d49ff82","observation_id":"f448ce07-40a7-4590-96ec-aeee0f670564","resolution":{"observed_at":"2026-08-09T04:32:02.865340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17565","last_updated":"2024-12-21T13:55:49Z","snapshot_observed_at":"2026-07-06T18:36:42.830927Z","submitted_at":"2024-06-25T14:02:08Z","title":"MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17565","snapshot_observed_at":"2026-08-09T04:32:01.202215Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.202215Z"},"links":{"cited_paper":"/paper/2406.17565","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:bd2a893c125ce40a02885bbd508706d488687bb6c53b7d9e94ee78c8983e0b0f","observation_id":"08a01091-abe2-435f-a039-308069137136","resolution":{"observed_at":"2026-08-09T04:32:01.202215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11181","last_updated":"2024-01-20T09:43:36Z","snapshot_observed_at":"2026-08-05T23:35:16.350557Z","submitted_at":"2024-01-20T09:43:36Z","title":"Inference without Interference: Disaggregate LLM Inference for Mixed Downstream Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11181","snapshot_observed_at":"2026-08-09T04:32:01.206880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.206880Z"},"links":{"cited_paper":"/paper/2401.11181","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:1f39345b5d0081accebce9a58111890a98f92b35c7834d5055774cad8678cae6","observation_id":"7c56cfd0-de8d-4781-a1f1-ec29bb3f2ef0","resolution":{"observed_at":"2026-08-09T04:32:01.206880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.846551Z","title":null,"venue":null,"work_id":"5c833e26-0904-429f-a343-6a852a7c1833","year":2020},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.211610Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:9eae5d0413b9ad2303cf86404beaa179800bac521cf3e244d2c1f93e82ee277e","observation_id":"97c23686-db7e-4b51-8a8f-ec6db3e583c3","resolution":{"observed_at":"2026-08-09T04:32:02.851131Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.832005Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":"d11b97a3-713e-4220-8683-b17a73c39796","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.215898Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:151028767948cf89bdabbaef74960485dc0c8fe06cdc3bcf2549d49987621dd7","observation_id":"278e1116-92ab-49ce-a207-f6e0189758c4","resolution":{"observed_at":"2026-08-09T04:32:02.836716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08585","last_updated":"2024-12-17T05:40:09Z","snapshot_observed_at":"2026-07-06T20:05:23.685854Z","submitted_at":"2024-12-11T18:03:05Z","title":"TurboAttention: Efficient Attention Approximation For High Throughputs LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08585","snapshot_observed_at":"2026-08-09T04:32:01.220321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.220321Z"},"links":{"cited_paper":"/paper/2412.08585","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:80485b324f5a2d218a6588eb7591862faa825d9b2128f59cfa35eec14a5d77bb","observation_id":"e93c6383-835c-4d41-a09f-8d5f598c669e","resolution":{"observed_at":"2026-08-09T04:32:01.220321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05527","last_updated":"2024-09-30T22:44:58Z","snapshot_observed_at":"2026-08-07T12:20:18.370756Z","submitted_at":"2024-03-08T18:48:30Z","title":"GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05527","snapshot_observed_at":"2026-08-09T04:32:01.224806Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.224806Z"},"links":{"cited_paper":"/paper/2403.05527","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:eeb1aeb28573104164c62e578d2b26ba3e2b235a5c1f3a75315c9e1e82f13744","observation_id":"a312f7a9-8693-4c31-a9e8-20d62d99656f","resolution":{"observed_at":"2026-08-09T04:32:01.224806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.818244Z","title":null,"venue":null,"work_id":"5c90e972-1ddd-4e83-94e2-afd2ad508c41","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.229542Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:ef4ebd861aaa22a78e21964787ec04f3897d0586963469b5618e06ee12914f9d","observation_id":"afd68f26-a247-43aa-8f31-a41cd4897bed","resolution":{"observed_at":"2026-08-09T04:32:02.822612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.804121Z","title":null,"venue":null,"work_id":"7f0fed0b-e88d-477c-951c-fb3faceb78d4","year":1983},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.233899Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:e729d1cf19337ec0838d8bef89fc7569b40eb3dfa80c070c8abacc025d72702f","observation_id":"a1c35189-21a7-4b4e-bfcc-825de178e8ab","resolution":{"observed_at":"2026-08-09T04:32:02.808544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:01.246076Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.246076Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:b6c5f82e0ff6049ebf3b15033e8a5f98960e235f017d81974749cbb02a58af30","observation_id":"34d1d726-cca1-4989-87c7-f656023d394b","resolution":{"observed_at":"2026-08-09T04:32:01.246076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.780571Z","title":null,"venue":null,"work_id":"78f2b712-7e8d-4c1e-8bf9-e1f028be3eb4","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.299578Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:bec233fe01b495ed6ce0e05c2b31c2fbf6429f32cd78e33ada2fbfa6a986a58f","observation_id":"b7313fc8-ecb5-4591-9dca-a8117548d204","resolution":{"observed_at":"2026-08-09T04:32:02.785061Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.765937Z","title":null,"venue":null,"work_id":"319d2fc1-34c9-43ae-85c7-01fd56d857e3","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.330702Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:34c7ee11479700ed6b2e82a5bff44c7856c8a82914179a44d6658dfcbd9e1ee8","observation_id":"a0410b61-cd43-4383-a6a3-a9a0328a870f","resolution":{"observed_at":"2026-08-09T04:32:02.770500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:01.347729Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.347729Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:e35e0782bd0a418f8528e12ed62b492b8eefcef1c3ff67015b05684c78592679","observation_id":"6562a816-020d-4bda-af14-24cbae0127fd","resolution":{"observed_at":"2026-08-09T04:32:01.347729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.194402Z","title":null,"venue":null,"work_id":"7b44b166-a107-4bb4-94a0-620c63a17d8b","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.355654Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:333f41ea757749f5890b2a2126e7c29f75419fda0860c9471b352900bf3cc643","observation_id":"af63ab59-ca79-4cf5-a240-478204840bb5","resolution":{"observed_at":"2026-08-09T04:32:02.199037Z","resolver_source":"arxiv_id_nonexistent","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.742039Z","title":null,"venue":null,"work_id":"c04e3936-1ac7-4b79-b876-7970986aa47f","year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.359758Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:f1c7ba284283f75c5b3948a64ab440a6c1733b623a5e0ef6f584216418cd8894","observation_id":"9491ba51-c74a-4e9a-957d-15551c576bca","resolution":{"observed_at":"2026-08-09T04:32:02.746448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.728003Z","title":null,"venue":null,"work_id":"7fa5587d-5a97-4499-8ece-1d20d8a4913e","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.363656Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:9efa0b03d4b178a5e18c960afe9da0e249d1087e32990ebb89bad62db8dc92b5","observation_id":"677af7c4-5aeb-43c3-825c-e06c4b0a669a","resolution":{"observed_at":"2026-08-09T04:32:02.732455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.713676Z","title":null,"venue":null,"work_id":"9b227b80-7632-4a2b-b18b-2f88d49eae7b","year":2021},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.367667Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:8527808d3889b07099e9d9c76157f2224722dbd9c496763371a36d0dbb60c207","observation_id":"17dabb12-3d8a-4376-a7a3-08931c0a49bc","resolution":{"observed_at":"2026-08-09T04:32:02.718185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.027510Z","title":null,"venue":null,"work_id":"2bf8de8f-e203-4f90-b55d-0fa89fe291ad","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.371430Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:e006a81bddcef3366d5b073c4095205070cd240266b0c31abfea1d9704ece235","observation_id":"faac764e-f192-4b76-a627-ff89abdeb381","resolution":{"observed_at":"2026-08-09T04:32:02.031876Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00079","last_updated":"2025-09-03T14:56:29Z","snapshot_observed_at":"2026-08-07T12:08:57.217593Z","submitted_at":"2024-06-24T02:05:32Z","title":"Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00079","snapshot_observed_at":"2026-08-09T04:32:01.375623Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.375623Z"},"links":{"cited_paper":"/paper/2407.00079","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:a1d1ccb4dade764d848dbe63cc8df7610236b8ba1f1ba6f08a73ca5d7541b462","observation_id":"5f39808e-8b62-4c56-8038-1967e987706c","resolution":{"observed_at":"2026-08-09T04:32:01.375623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.699121Z","title":null,"venue":null,"work_id":"c83318a9-04a9-480e-8a93-439fc5a42180","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.380570Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:2790ce5a627755836224eb36121cb06c45c9490d37c37ef092cdd39684238a3d","observation_id":"40dd6b79-f0f8-4152-837b-ecda2eb40778","resolution":{"observed_at":"2026-08-09T04:32:02.703991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.684509Z","title":null,"venue":null,"work_id":"fd7dd83c-3613-4d4b-94bb-6005739e818c","year":2020},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.385124Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:00461ae56458e64bc9413919991b5ce5e368301c8b5dc750faf8db084e6b3f0f","observation_id":"2047d041-1f96-424a-bcff-546d06e3ae79","resolution":{"observed_at":"2026-08-09T04:32:02.689339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.669965Z","title":null,"venue":null,"work_id":"eb88fae8-502d-4c14-8d60-29333ea7694a","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.389791Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:57f272a30dfdd13676fe610baea15263efc19f98640c45660a0225876cca4f2d","observation_id":"d9d133c9-8e81-4a92-9f7e-cdd4ed11e529","resolution":{"observed_at":"2026-08-09T04:32:02.674377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:01.854744Z","title":null,"venue":null,"work_id":"29ee3450-4c59-467c-9f32-9f09bd6155a8","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.394372Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:ab6447d13fc2b41de2fece8e80fd7eaae76aa2c5993c0bb1299e2fd8b8b610e7","observation_id":"254e552f-d338-4896-9083-775b66e68b27","resolution":{"observed_at":"2026-08-09T04:32:01.859716Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.654730Z","title":null,"venue":null,"work_id":"c6c42a2e-3919-4c7b-8c2d-8596c1a0023d","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.398968Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:e2bee5486e91824e34de0c15fc72991adc3b435b4fd525a4f606d3e2d30795b5","observation_id":"307e8010-7f9a-4177-b493-6f9ae3976a48","resolution":{"observed_at":"2026-08-09T04:32:02.659248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14112","last_updated":"2024-03-04T02:30:21Z","snapshot_observed_at":"2026-07-06T17:20:21.209197Z","submitted_at":"2024-01-25T11:46:38Z","title":"FP6-LLM: Efficiently Serving Large Language Models Through FP6-Centric Algorithm-System Co-Design","version":2},"cited_work":{"arxiv_id":"2401.14112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.14112","snapshot_observed_at":"2026-08-09T04:32:01.537073Z","title":"FP6-LLM: Efficiently Serving Large Language Models Through FP6-Centric Algorithm-System Co-Design","venue":"cs.LG","work_id":"061598f2-013d-46b6-b530-be51d7d5ea77","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.403532Z"},"links":{"cited_paper":"/paper/2401.14112","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:a873f3eadc2e33ce631795e48cf1014acb04df248db5a90cc550778130c91a4b","observation_id":"cca5ef1f-3fee-444d-8c42-d78f9b5e852b","resolution":{"observed_at":"2026-08-09T04:32:01.542534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12532","last_updated":"2024-06-05T09:01:24Z","snapshot_observed_at":"2026-07-06T18:17:08.160308Z","submitted_at":"2024-05-21T06:46:37Z","title":"PyramidInfer: Pyramid KV Cache Compression for High-throughput LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12532","snapshot_observed_at":"2026-08-09T04:32:01.408211Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.408211Z"},"links":{"cited_paper":"/paper/2405.12532","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:6e5c62ea70b4a8e3957e364becfb3e19ec580b1a83fcec5d8bb7ba0f5cabfb4b","observation_id":"cd6b8efe-e3fa-4474-a515-8ec7e9cc7aae","resolution":{"observed_at":"2026-08-09T04:32:01.408211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02328","last_updated":"2024-07-02T14:58:44Z","snapshot_observed_at":"2026-08-05T00:30:49.640680Z","submitted_at":"2024-07-02T14:58:44Z","title":"Efficient Sparse Attention needs Adaptive Token Release","version":1},"cited_work":{"arxiv_id":"2407.02328","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.02328","snapshot_observed_at":"2026-08-09T04:32:01.497646Z","title":"Efficient Sparse Attention needs Adaptive Token Release","venue":"cs.CL","work_id":"9b1f71e9-155d-4151-96ea-905764a08ac0","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.413110Z"},"links":{"cited_paper":"/paper/2407.02328","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:6b4637368109a869ca19c67f763966ec94f3c5e1d51bf756a8b65dd7e8fdb1e4","observation_id":"eea89336-f7b2-4247-a02e-c49c6117cfe8","resolution":{"observed_at":"2026-08-09T04:32:01.504847Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.640172Z","title":null,"venue":null,"work_id":"f5d4428a-8889-46cd-a782-180c74d5e3bd","year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.418143Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:60fb4d2de58c03f0e431e8e93adb8c89430aa60193f4da19eeee7a3c3ae47237","observation_id":"055b31a0-fd46-4bd4-bc6b-e6501e20a04e","resolution":{"observed_at":"2026-08-09T04:32:02.644603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.626127Z","title":null,"venue":null,"work_id":"3afc4639-b5eb-44a6-8306-06d3504a7977","year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.427705Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:f60dd6c32fcd9ed2290504f1979e82609bb3a78de89f1c9ea2838141eecb04c9","observation_id":"b4a436e4-ddd6-4423-af60-93370e252956","resolution":{"observed_at":"2026-08-09T04:32:02.630591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.611880Z","title":null,"venue":null,"work_id":"4e2debc3-b7e7-4891-89a7-c7c104a14304","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.432313Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:1734865d7c924a58e54a17c7947f8c7b1d1cfdfe33ecb000cb64e10df973befa","observation_id":"cbeba9c0-585c-4ec7-a3eb-e10292816068","resolution":{"observed_at":"2026-08-09T04:32:02.616630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18294","last_updated":"2024-06-27T04:40:52Z","snapshot_observed_at":"2026-08-03T16:36:54.993208Z","submitted_at":"2024-06-26T12:26:16Z","title":"Hierarchical Context Pruning: Optimizing Real-World Code Completion with Repository-Level Pretrained Code LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18294","snapshot_observed_at":"2026-08-09T04:32:01.422886Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.422886Z"},"links":{"cited_paper":"/paper/2406.18294","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:8878c5a7dba71053fac16e1d49adcf7903b419119c28ea76203be58df1aae345","observation_id":"16274fcd-7937-4808-8ca9-47af324fe340","resolution":{"observed_at":"2026-08-09T04:32:01.422886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.597844Z","title":null,"venue":null,"work_id":"5a00dfe5-49f8-4896-864f-4d7e2732d367","year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":210,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.436765Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:9adae10b12eb06448fae523f0db6d88301a649334cacc54a688e3870f4f29b57","observation_id":"ad085163-5b7d-4e62-996f-caa301007be1","resolution":{"observed_at":"2026-08-09T04:32:02.602407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.434289Z","title":"In Proceedings of the 29th Symposium on Operating Systems Principles (SOSP ’23)","venue":null,"work_id":"7c34b0e3-6559-4f08-b75b-511130167a4a","year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.272605Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:0a3430027687ec7c4db19e1b1069a86e147df22f7017d603d5bc9011e84399f9","observation_id":"120be18e-c3b2-4a1c-b23e-b089ca252665","resolution":{"observed_at":"2026-08-09T04:32:02.438778Z","resolver_source":"arxiv_id_nonexistent","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:01.178053Z","title":"In Proceedings of the 2024 Conference on Empirical Meth- ods in Natural Language Processing , Yaser Al-Onaizan, Mohit Bansal, and Yun-Nung Chen (Eds.)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.178053Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:1954d3c90d12760d36986fa92f2dd54c03c453225f81fd4fa122bea970b46cef","observation_id":"e22e2b6e-089a-437f-8be9-ea3f7eafbbe0","resolution":{"observed_at":"2026-08-09T04:32:01.178053Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-09T15:11:42.997007Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":4,"verified_fuzzy":11},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2502.03589."}