{"as_of":"2026-08-10T17:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9684d34fb05578c5ac90563d87d913b4eb1b6ef5bc331f7c502b5bfb26dbd9d2","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:45:53.005919Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T14:12:14.160789Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T14:15:55.528918Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"cited_work":{"arxiv_id":"2507.05228","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.05228","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cascade: Token-sharded private llm inference","venue":null,"work_id":"8440fccb-aa43-43bd-b7ad-88c2820cb46a","year":2025},"citing_paper":{"arxiv_id":"2603.09002","last_updated":"2026-04-26T14:13:48Z","snapshot_observed_at":"2026-07-06T22:48:26.306802Z","submitted_at":"2026-03-09T22:46:27Z","title":"Security Considerations for Multi-agent Systems","version":2},"reference_index":253,"source":"pdf_text","source_observed_at":"2026-05-15T14:12:14.160789Z"},"links":{"cited_paper":"/paper/2507.05228","citing_paper":"/paper/2603.09002"},"observation_digest":"sha256:095b01febbd8e46d7d30019e77bd14de44a9147fcb740432811335a0b92b76dd","observation_id":"7cf32ca2-cfd0-4bf5-9a42-a7e035ef68b4","resolution":{"observed_at":"2026-05-15T14:15:55.531509Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.05228/citation-record","integrity":"/paper/2507.05228/integrity","json":"/paper/2507.05228/citation-record.json","paper":"/paper/2507.05228"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:50.288243Z","title":"Privformer: Privacy-preserving transformer with mpc","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:50.288243Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:238e691f0f56d127453d57370a8e856e433fc2c114b73003d49b3d8340659dfe","observation_id":"7e325165-ee62-4652-8763-55ebb32dcf40","resolution":{"observed_at":"2026-08-06T19:45:50.288243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T19:45:50.530748Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:50.530748Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:dbffb6f2a656662b26e948d92e897e1c5b5895df060a5513e9f168ebb25526f6","observation_id":"af97f331-7c9b-41e2-bbea-baf094e3a753","resolution":{"observed_at":"2026-08-06T19:45:50.530748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T19:45:51.003986Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:51.003986Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:9017bb81a45e6b85228754c7cefebe763ef89fb974ebe8b341f50640dd251340","observation_id":"45c53eac-a1dc-4873-922f-e1bc84c03ae8","resolution":{"observed_at":"2026-08-06T19:45:51.003986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:51.925940Z","title":"Puma: Secure inference of llama-7b in five minutes, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:51.925940Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:16cf25c6e159ea0977e7afc246f55d7c4d449e57feffbd0a5f0e18b8b53eccc0","observation_id":"4a0503a3-6f6a-4082-a0ba-326494f7c6f9","resolution":{"observed_at":"2026-08-06T19:45:51.925940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:52.331237Z","title":"Goldreich, S","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.331237Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:e10a81a9377952cc25715aa458b88b31631aaa5959812c72b1d5bcf3251a19a2","observation_id":"d88b4a92-fef8-4d73-a800-f54df17f94a8","resolution":{"observed_at":"2026-08-06T19:45:52.331237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:53.953828Z","title":"Iron: Private inference on transformers","venue":null,"work_id":"f2d8fd0e-6637-4b1c-bc02-d357e7a9a647","year":2022},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.383764Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:85564b7b13eb2301f7c51e19466186373489e5523e6d7bd8f83fcf26b04756d5","observation_id":"af413304-18d0-40c1-b66b-b12f7f36b0a5","resolution":{"observed_at":"2026-08-06T19:45:53.959055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:53.936067Z","title":"Cheetah: Lean and fast secure two-party deep neural network inference","venue":null,"work_id":"ada32213-bf3d-4faf-b2be-d188ab81b055","year":2022},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.414601Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:31c00e3cb9539c39ee8723afa4f5eece39f5dfe7f0ba0fb5ce723d405bb1f7df","observation_id":"f1697e59-de5b-4c43-961b-9604d084a139","resolution":{"observed_at":"2026-08-06T19:45:53.942535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:52.488283Z","title":"Chatgpt for good? on opportunities and challenges of large language models for education","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.488283Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:6f216a220d653539be79dda72933ef544f33c5ae4ca8ee37b42b5b1cf7c9f299","observation_id":"a5845407-6a4b-4af1-bda9-fb37f8ecb6f7","resolution":{"observed_at":"2026-08-06T19:45:52.488283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01452","last_updated":"2023-03-16T06:51:31Z","snapshot_observed_at":"2026-08-10T04:28:49.910532Z","submitted_at":"2022-11-02T19:43:22Z","title":"MPCFormer: fast, performant and private Transformer inference with MPC","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01452","snapshot_observed_at":"2026-08-06T19:45:52.563883Z","title":"Xing, and Hao Zhang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.563883Z"},"links":{"cited_paper":"/paper/2211.01452","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:98dd57087e2a4942582ed40c54d6ab8649a0854a9792adec0dd7bcf122dc9b4b","observation_id":"7a8c0ff3-1848-4c12-9286-fd96b0caccfd","resolution":{"observed_at":"2026-08-06T19:45:52.563883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15707","last_updated":"2024-11-24T04:24:31Z","snapshot_observed_at":"2026-07-06T19:56:04.259325Z","submitted_at":"2024-11-24T04:24:31Z","title":"Nimbus: Secure and Efficient Two-Party Inference for Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15707","snapshot_observed_at":"2026-08-06T19:45:52.624823Z","title":"Nimbus: Secure and efficient two-party inference for transformers, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.624823Z"},"links":{"cited_paper":"/paper/2411.15707","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:650993ed5d960241249876266b78e27e443425873400f2bdc467ede05a98ad02","observation_id":"9aa2a1ba-c5b5-4f3d-883b-56de2de01ccb","resolution":{"observed_at":"2026-08-06T19:45:52.624823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:52.696589Z","title":"ROUGE : A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.696589Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:63e503f8ee94ccbb4bff9f2abd13726274e8f28bde80aab34d2ade22bc9d27f2","observation_id":"302904c1-6681-46da-a494-39ae75e16986","resolution":{"observed_at":"2026-08-06T19:45:52.696589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T19:45:52.725381Z","title":"Roberta: A robustly optimized bert pretraining approach, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.725381Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:31d8368791f2c20005313fb0ffdca9a1424a829bcc7fb86669c1d8c86e7114a5","observation_id":"a92496b1-5fb9-4c9c-91e4-9f818b17154e","resolution":{"observed_at":"2026-08-06T19:45:52.725381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10652","last_updated":"2025-06-10T09:20:09Z","snapshot_observed_at":"2026-08-10T16:28:31.564628Z","submitted_at":"2024-12-14T02:50:30Z","title":"CENTAUR: Bridging the Impossible Trinity of Privacy, Efficiency, and Performance in Privacy-Preserving Transformer Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10652","snapshot_observed_at":"2026-08-06T19:45:52.762541Z","title":"Centaur: Bridging the impossible trinity of privacy, efficiency, and performance in privacy-preserving transformer inference, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.762541Z"},"links":{"cited_paper":"/paper/2412.10652","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:98857f5824898e826ebc3b1202094f0e052f54842f07b79ad86c54fced153261","observation_id":"3263956c-9e92-4389-8028-d14089b05298","resolution":{"observed_at":"2026-08-06T19:45:52.762541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00793","last_updated":"2025-06-09T07:49:24Z","snapshot_observed_at":"2026-08-04T02:49:48.404426Z","submitted_at":"2024-01-01T15:40:35Z","title":"SecFormer: Fast and Accurate Privacy-Preserving Inference for Transformer Models via SMPC","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00793","snapshot_observed_at":"2026-08-06T19:45:52.780241Z","title":"Secformer: Towards fast and accurate privacy-preserving inference for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.780241Z"},"links":{"cited_paper":"/paper/2401.00793","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:450d9758a7bda56d55d68c34c3d698ba4bd11f7bef373db55d27bd4cac63ba37","observation_id":"6f533b07-21f1-48e6-99ca-82dc5c6509c7","resolution":{"observed_at":"2026-08-06T19:45:52.780241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05889","last_updated":"2018-09-30T03:14:16Z","snapshot_observed_at":"2026-08-03T08:53:04.947369Z","submitted_at":"2017-12-16T01:29:49Z","title":"Ray: A Distributed Framework for Emerging AI Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05889","snapshot_observed_at":"2026-08-06T19:45:52.874501Z","title":"Jordan, and Ion Stoica","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.874501Z"},"links":{"cited_paper":"/paper/1712.05889","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:57e2e8933d6acb03a8d277bfe743f0f8edc983452c57887178770181ebdbda87","observation_id":"429f897f-84b8-4051-93bb-cd00a9859a83","resolution":{"observed_at":"2026-08-06T19:45:52.874501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13647","last_updated":"2023-11-22T19:04:04Z","snapshot_observed_at":"2026-07-06T16:51:19.405206Z","submitted_at":"2023-11-22T19:04:04Z","title":"Language Model Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13647","snapshot_observed_at":"2026-08-06T19:45:52.905233Z","title":"Morris, Wenting Zhao, Justin T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.905233Z"},"links":{"cited_paper":"/paper/2311.13647","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:0533d76d25772360766fd9d8e5e33ea364b4dda546d27830634ba19947ba75ac","observation_id":"a65503a7-cfc6-4c30-9bce-6425a725f1a5","resolution":{"observed_at":"2026-08-06T19:45:52.905233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:53.899177Z","title":"BOLT : Privacy-preserving, accurate and efficient inference for transformers","venue":null,"work_id":"411c56a8-30fb-4b7d-ae37-e21f333d9614","year":2023},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.910279Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:48850913a60653750fc906ccd9fc33c8b141dbfe0fa54e6828a04b1c25209b52","observation_id":"6f0c0c8f-9123-49fb-a6ad-be7b1594e461","resolution":{"observed_at":"2026-08-06T19:45:53.907861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:53.870604Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"331579b4-7c6a-4312-8e32-ca25c055e5ac","year":2002},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.916008Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:f540e3400c533572f56569cad9ed3c9e98bf261078efdf37cd73a1f92a023a36","observation_id":"e680d1bd-24e4-4a68-bf62-5824046bda24","resolution":{"observed_at":"2026-08-06T19:45:53.881435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T19:45:52.921852Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.921852Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:916fa135c810ff53049405b7075759c32aab7076d96d959d186eef895ab99cb7","observation_id":"caa66620-2dae-4429-96d0-fe25b683e29b","resolution":{"observed_at":"2026-08-06T19:45:52.921852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41591-023-02459-w","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:53.064365Z","title":"Large language models in medicine","venue":null,"work_id":"14c8d642-b729-4717-ac37-29aaad451a50","year":1930},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.927196Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:a471c5fc0bfb0c5c52df08d340e8b6c0fc0955047cf80a30a1630e11572ae1f7","observation_id":"f59c937a-e58c-41dd-8f7d-490382bbad58","resolution":{"observed_at":"2026-08-06T19:45:53.071285Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18332","last_updated":"2025-05-23T19:39:18Z","snapshot_observed_at":"2026-08-10T15:30:53.980015Z","submitted_at":"2025-05-23T19:39:18Z","title":"An Attack to Break Permutation-Based Private Third-Party Inference Schemes for LLMs","version":1},"cited_work":{"arxiv_id":"2505.18332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18332","snapshot_observed_at":"2026-08-06T19:45:53.232647Z","title":"An Attack to Break Permutation-Based Private Third-Party Inference Schemes for LLMs","venue":"cs.CR","work_id":"42f6b1c3-b1ba-43f7-980a-b7a0c54a201b","year":2025},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.933522Z"},"links":{"cited_paper":"/paper/2505.18332","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:73511c2a2df43ebb5575ce3ed2d5e854b18d1b65b790c9063ab09fd5a0f86be9","observation_id":"8025759c-1d9d-4b83-9e27-0aa6c46d9597","resolution":{"observed_at":"2026-08-06T19:45:53.239409Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11916","last_updated":"2024-05-22T04:04:17Z","snapshot_observed_at":"2026-07-06T18:16:37.476614Z","submitted_at":"2024-05-20T09:52:31Z","title":"Information Leakage from Embedding in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11916","snapshot_observed_at":"2026-08-06T19:45:52.940346Z","title":"Information leakage from embedding in large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.940346Z"},"links":{"cited_paper":"/paper/2405.11916","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:42ef83019afc4263a55d724fcc489e8bfbaeb9b62bb0d4538d63c589d1414020","observation_id":"a10baa12-7af1-4d0b-a40f-d57282231e8b","resolution":{"observed_at":"2026-08-06T19:45:52.940346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-06T19:45:52.945332Z","title":"Smarter, better, faster, longer: A modern bidirectional encoder for fast, memory efficient, and long context finetuning and inference, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.945332Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:3ede704eccfa5414134f28f47a5fe500785f19d6293d4197f73ad6e2b2fca2b0","observation_id":"64f693d6-9714-413d-b883-526d9a99028f","resolution":{"observed_at":"2026-08-06T19:45:52.945332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07735","last_updated":"2024-03-31T11:35:46Z","snapshot_observed_at":"2026-08-09T15:42:34.683862Z","submitted_at":"2023-04-16T09:25:24Z","title":"Permutation Equivariance of Transformers and Its Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07735","snapshot_observed_at":"2026-08-06T19:45:52.951178Z","title":"Permutation equivariance of transformers and its applications, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.951178Z"},"links":{"cited_paper":"/paper/2304.07735","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:d7670e4f7f87b29d32014a5146adc58daba3a3f7cfae37a156637e77e819d598","observation_id":"49077609-c40d-4a01-883d-eeee5149c805","resolution":{"observed_at":"2026-08-06T19:45:52.951178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:52.956851Z","title":null,"venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.956851Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:ffcaf1d6986922bbf60a4246c8155b751f1a962ed2eae0d261afcd41b0a74f29","observation_id":"b2058bf1-fd50-451e-a663-eab68bd15647","resolution":{"observed_at":"2026-08-06T19:45:52.956851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00025","last_updated":"2024-05-08T02:20:09Z","snapshot_observed_at":"2026-08-02T08:43:09.148463Z","submitted_at":"2023-11-14T14:37:23Z","title":"Secure Transformer Inference Protocol","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00025","snapshot_observed_at":"2026-08-06T19:45:52.961959Z","title":"Secure transformer inference protocol, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.961959Z"},"links":{"cited_paper":"/paper/2312.00025","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:29de3c387f2111bbf5f27ca1fac8fae24d36f93c70d8b55c416848de14b0bd6f","observation_id":"663c806a-cfcb-4de3-9538-6e7191a1836b","resolution":{"observed_at":"2026-08-06T19:45:52.961959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18744","last_updated":"2024-05-29T04:06:50Z","snapshot_observed_at":"2026-07-06T18:21:44.232687Z","submitted_at":"2024-05-29T04:06:50Z","title":"PermLLM: Private Inference of Large Language Models within 3 Seconds under WAN","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18744","snapshot_observed_at":"2026-08-06T19:45:52.968823Z","title":"Permllm: Private inference of large language models within 3 seconds under wan, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.968823Z"},"links":{"cited_paper":"/paper/2405.18744","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:dbcab12f96c542ce6757cba99ae710a6841437325a1f466744fb4fe9f46fb68f","observation_id":"6b0d2504-31eb-4706-bd21-24c07e4d7247","resolution":{"observed_at":"2026-08-06T19:45:52.968823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04675","last_updated":"2024-06-14T11:40:52Z","snapshot_observed_at":"2026-08-08T14:38:42.704834Z","submitted_at":"2023-04-10T15:51:30Z","title":"Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04675","snapshot_observed_at":"2026-08-06T19:45:52.975308Z","title":"Multilingual machine translation with large language models: Empirical results and analysis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.975308Z"},"links":{"cited_paper":"/paper/2304.04675","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:9c19d0cea949de5c35dc5bf95bda9bc1184e16c5d0d360625e8c8f8a9a4a5ace","observation_id":"e3a96f83-0b13-45a3-905a-975a562d50ea","resolution":{"observed_at":"2026-08-06T19:45:52.975308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:52.981236Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.981236Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:80863088b8089af4e8d94408f168a5017b4d5f1d5c55c3d2333647e719c249ac","observation_id":"ac0c9113-d010-4efb-a6fd-4f7cba3aba1a","resolution":{"observed_at":"2026-08-06T19:45:52.981236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:52.987503Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.987503Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:c6fd77aea8fabe695f0426dbfd176d38b98393dcd57a36b1e8b1be10e57760be","observation_id":"072d6bd5-33c4-47e3-8fc9-474d5a6df1bf","resolution":{"observed_at":"2026-08-06T19:45:52.987503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:52.994458Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:52.994458Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:2127ff2a83bcee861d8cb2340a8edde7ec3c4669ab7c71adee23da753191846d","observation_id":"c51a0534-cc39-4684-9f46-557e79b0dc1a","resolution":{"observed_at":"2026-08-06T19:45:52.994458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:45:53.000547Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:53.000547Z"},"links":{"citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:431ac89e0e0357ee0b2d4a5f4af39f55e213fd94ec0c181fbe5c8b2abff98dcb","observation_id":"0f1745b8-03d9-4651-8671-4dd0a1637608","resolution":{"observed_at":"2026-08-06T19:45:53.000547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06816","last_updated":"2023-10-10T17:39:03Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:39:03Z","title":"Text Embeddings Reveal (Almost) As Much As Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06816","snapshot_observed_at":"2026-08-06T19:45:53.005919Z","title":"Invernet: An Inversion Attack Framework to Infer Fine-Tuning Datasets through Word Embeddings","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:53.005919Z"},"links":{"cited_paper":"/paper/2310.06816","citing_paper":"/paper/2507.05228"},"observation_digest":"sha256:f9fc2b9b734de367d831b9ceba6713fa5c29748e564bd6980f4d7080eb13ec52","observation_id":"a6489a29-fd66-4883-9515-51c55d624563","resolution":{"observed_at":"2026-08-06T19:45:53.005919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.05228","last_updated":"2025-07-07T17:37:16Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T14:39:18.103621Z","submitted_at":"2025-07-07T17:37:16Z","title":"Cascade: Token-Sharded Private LLM Inference"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":4},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2507.05228."}