{"as_of":"2026-08-10T02:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54688513d5c7e117c5e8bd7b5b95ca5214e798485c4c9e7587fc73fa0a9ade6e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:55:54.011111Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T15:39:56.479057Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T04:09:15.921778Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2401.04088"},"observation_digest":"sha256:5273970d5d6d78e51ca86d6caf4e5e0d6c8f8440b0a06ce80875cd61cff9439d","observation_id":"b7b9dc76-8433-4408-b2b3-edbc5d6a2998","resolution":{"observed_at":"2026-05-24T04:13:53.768565Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2411.08982","last_updated":"2026-05-18T20:44:06Z","snapshot_observed_at":"2026-07-06T19:50:01.724540Z","submitted_at":"2024-11-13T19:18:08Z","title":"Lynx: Enabling Efficient MoE Inference through Dynamic Batch-Aware Expert Selection","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-23T17:04:13.905401Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2411.08982"},"observation_digest":"sha256:5f0408c7aa91d24b2a6ad6f6a03538c06689d98e4544152fddc197e0a62e3d18","observation_id":"57cbe660-d453-4c4b-b85b-fd89038d3988","resolution":{"observed_at":"2026-05-23T17:05:42.962447Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-08T17:55:54.011111Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06888","last_updated":"2025-02-09T08:47:06Z","snapshot_observed_at":"2026-08-08T17:48:01.395094Z","submitted_at":"2025-02-09T08:47:06Z","title":"Klotski: Efficient Mixture-of-Expert Inference via Expert-Aware Multi-Batch Pipeline","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:55:54.011111Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2502.06888"},"observation_digest":"sha256:b009871c6f557775cd99af1416b20f76b46060c4af1fdac5900ea264b9bcf37b","observation_id":"f5067132-b344-48c8-9b72-3580ed10c4d3","resolution":{"observed_at":"2026-08-08T17:55:54.011111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-07T04:58:49.567474Z","title":"and Mazur, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09316","last_updated":"2025-06-17T04:56:46Z","snapshot_observed_at":"2026-08-07T11:02:36.129585Z","submitted_at":"2025-06-11T01:25:06Z","title":"On-the-Fly Adaptive Distillation of Transformer to Dual-State Linear Attention","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:58:49.567474Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2506.09316"},"observation_digest":"sha256:496ffc196e36af079681bfc9cefe8cf12fd304fac708e30cecbe385af14acef3","observation_id":"55ab2dfb-5b33-4648-897b-1a4f4fa7ad5f","resolution":{"observed_at":"2026-08-07T04:58:49.567474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-05T11:48:30.265238Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02408","last_updated":"2025-09-02T15:19:06Z","snapshot_observed_at":"2026-08-09T05:24:20.880549Z","submitted_at":"2025-09-02T15:19:06Z","title":"Cache Management for Mixture-of-Experts LLMs -- extended version","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:48:30.265238Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2509.02408"},"observation_digest":"sha256:9795f72f1ef0b67cecfc5b691600c944d5caee97156854b76035b550e5f0d780","observation_id":"6a3c1a15-ecce-4ede-abb9-dc516e42cffe","resolution":{"observed_at":"2026-08-05T11:48:30.265238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-04T21:51:04.085632Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07727","last_updated":"2025-09-09T13:28:41Z","snapshot_observed_at":"2026-08-09T18:16:28.980674Z","submitted_at":"2025-09-09T13:28:41Z","title":"MoE-Compression: How the Compression Error of Experts Affects the Inference Accuracy of MoE Model?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T21:51:04.085632Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2509.07727"},"observation_digest":"sha256:f3a16a012ea255a60edd0f2380649346e4e349fb2a7c4edaa8ff977795abce78","observation_id":"50f6c9cc-1a75-4bd0-85ca-829cd62620d5","resolution":{"observed_at":"2026-08-04T21:51:04.085632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-04T20:55:18.824902Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08342","last_updated":"2025-09-10T07:28:24Z","snapshot_observed_at":"2026-08-07T12:35:47.179422Z","submitted_at":"2025-09-10T07:28:24Z","title":"Accelerating Mixture-of-Expert Inference with Adaptive Expert Split Mechanism","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:55:18.824902Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2509.08342"},"observation_digest":"sha256:9f109aa1333c5489bd96d7aa57838dd6a484e4c4409aff0bba0b9074f0929313","observation_id":"875b6dce-b865-416e-833d-d33894ade016","resolution":{"observed_at":"2026-08-04T20:55:18.824902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2510.05497","last_updated":"2026-05-12T10:04:18Z","snapshot_observed_at":"2026-07-06T22:31:53.944103Z","submitted_at":"2025-10-07T01:31:39Z","title":"Patterns behind Chaos: Forecasting Data Movement for Efficient Large-Scale MoE LLM Inference","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T09:52:48.027958Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2510.05497"},"observation_digest":"sha256:2b771ac426fb69a133978cecac93bbb444351f5b026ef5d45e749d397473b720","observation_id":"97cdaeee-e4d1-4928-81bc-99f65c599ee5","resolution":{"observed_at":"2026-05-18T09:56:13.364339Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-03T12:12:46.908768Z","title":"Fast inference of mixture-of-experts language models with offloading,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.03992","last_updated":"2026-01-07T15:02:57Z","snapshot_observed_at":"2026-08-09T05:24:11.058314Z","submitted_at":"2026-01-07T15:02:57Z","title":"A Scheduling Framework for Efficient MoE Inference on Edge GPU-NDP Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T12:12:46.908768Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2601.03992"},"observation_digest":"sha256:682cd33a0eb23d4d258ad509fb2e03e9bc2afef56859d41b5541fa6d194571dc","observation_id":"55c79c1e-5af5-4994-ab70-2257e512a681","resolution":{"observed_at":"2026-08-03T12:12:46.908768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2601.21198","last_updated":"2026-05-22T06:53:25Z","snapshot_observed_at":"2026-08-09T02:36:25.829599Z","submitted_at":"2026-01-29T02:51:59Z","title":"ZipMoE: Efficient On-Device MoE Serving via Lossless Compression and Cache-Affinity Scheduling","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-25T07:43:24.937953Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2601.21198"},"observation_digest":"sha256:035153553ef9fa1e95c42d24a25b4eaa92022f6b3c0aaf5c80113db155f4249a","observation_id":"f5ea1806-5533-4d32-b8f8-4fa5b08bc178","resolution":{"observed_at":"2026-05-25T07:45:29.258625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2604.20156","last_updated":"2026-04-22T03:50:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T03:50:52Z","title":"Temporally Extended Mixture-of-Experts Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T00:39:39.492135Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2604.20156"},"observation_digest":"sha256:bdf38ac7d44de32814c16c9ea757cdd28c7bccd016535db3885e16052fe0db59","observation_id":"279b913d-45ce-4afd-96e1-dee673e1c68f","resolution":{"observed_at":"2026-05-10T00:39:48.246838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2604.23150","last_updated":"2026-04-25T05:33:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-25T05:33:03Z","title":"Scaling Multi-Node Mixture-of-Experts Inference Using Expert Activation Patterns","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T08:29:17.149710Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2604.23150"},"observation_digest":"sha256:d25b940b7dac91a37b1c125e5cac6030af29862b5a3a0ea6f406e81db37e0776","observation_id":"f0d89220-01c7-4c6a-8d56-df888f7fefab","resolution":{"observed_at":"2026-05-11T20:36:10.827410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2605.05899","last_updated":"2026-05-07T09:11:41Z","snapshot_observed_at":"2026-08-05T02:12:24.336765Z","submitted_at":"2026-05-07T09:11:41Z","title":"VisMMOE: Exploiting Visual-Expert Affinity for Efficient Visual-Language MoE Offloading","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T16:10:22.588945Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2605.05899"},"observation_digest":"sha256:dd3f1f2decd5dd2042536a3d4c9f152e64c6d2e1177baf4b7a939702595c20b5","observation_id":"d8d31969-13bf-4095-be85-c883a2df96c4","resolution":{"observed_at":"2026-05-11T16:36:06.453365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2605.20179","last_updated":"2026-05-19T17:59:08Z","snapshot_observed_at":"2026-08-06T13:50:23.608176Z","submitted_at":"2026-05-19T17:59:08Z","title":"TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T05:08:07.318040Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2605.20179"},"observation_digest":"sha256:cc16ab42d46806f6a30300aa42af4662eb9b13499f8d6fc0ac963203553e72eb","observation_id":"27eaf72f-a32c-4b38-86b6-2340c878028f","resolution":{"observed_at":"2026-05-20T05:13:03.710574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2605.21427","last_updated":"2026-05-20T17:19:20Z","snapshot_observed_at":"2026-07-06T23:31:51.443407Z","submitted_at":"2026-05-20T17:19:20Z","title":"PALS: Power-Aware LLM Serving for Mixture-of-Experts Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T04:06:32.227076Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2605.21427"},"observation_digest":"sha256:45f2722bc27e8dedc1ec8bddff7fa655d3616d10452640f668ede83b3a870c00","observation_id":"a20efcfd-4283-4bd5-b036-b37f7283b9fc","resolution":{"observed_at":"2026-05-21T04:09:33.685626Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2606.21428","last_updated":"2026-07-09T17:35:35Z","snapshot_observed_at":"2026-08-08T09:53:30.201517Z","submitted_at":"2026-06-19T13:45:45Z","title":"Does Mixture-of-Experts Actually Help Inference on Consumer and Edge Hardware? An Empirical Study","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T12:30:55.628115Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.21428"},"observation_digest":"sha256:cc60c04b7597be5e32857741f9e66710f86fa9014e0be4a983748174eb756730","observation_id":"dd0db0fd-e662-4314-b0aa-de69969497cd","resolution":{"observed_at":"2026-07-04T07:59:39.570551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-12T13:05:17.273287Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.21428","last_updated":"2026-07-09T17:35:35Z","snapshot_observed_at":"2026-08-08T09:53:30.201517Z","submitted_at":"2026-06-19T13:45:45Z","title":"Does Mixture-of-Experts Actually Help Inference on Consumer and Edge Hardware? An Empirical Study","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T13:05:17.273287Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.21428"},"observation_digest":"sha256:48f68c9c7925924fa3252c1253d56d3233de0b7a074eae56917c070e449cf3e3","observation_id":"77fe61f6-e4f1-485d-a0f7-e05a193591eb","resolution":{"observed_at":"2026-07-12T13:05:17.273287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2606.21868","last_updated":"2026-06-20T04:10:34Z","snapshot_observed_at":"2026-08-06T05:17:32.033245Z","submitted_at":"2026-06-20T04:10:34Z","title":"WiSP: A Working-Set View of Mixture-of-Experts Serving on Extremely Low-Resource Hardware","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T12:40:53.103233Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.21868"},"observation_digest":"sha256:00dc27995206b57f40056e483bf078e49829b32f6cabcc985f8402dbf1de2b14","observation_id":"0ad6a6fe-0125-4b4e-8410-e7ef99d3df00","resolution":{"observed_at":"2026-07-04T07:49:39.572738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2606.26287","last_updated":"2026-06-24T18:34:00Z","snapshot_observed_at":"2026-07-07T00:00:36.766142Z","submitted_at":"2026-06-24T18:34:00Z","title":"GeMoE: Gating Entropy is All You Need for Uncertainty-aware Adaptive Routing in MoE-based Large Vision-Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T01:32:40.435742Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.26287"},"observation_digest":"sha256:b2fecddf26e01139f2333ca07e63e00aaf5039c9aa9b6cb3d1d1fe35f91006ee","observation_id":"b47a5de4-1eeb-449d-bbfc-1e1b32b55484","resolution":{"observed_at":"2026-07-04T15:39:56.480301Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":"2312.17238","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-07-04T15:39:56.479057Z","title":"and Mazur, D","venue":null,"work_id":"c673e84b-8374-44ea-aac2-face7b028d20","year":2023},"citing_paper":{"arxiv_id":"2606.29982","last_updated":"2026-06-29T08:57:59Z","snapshot_observed_at":"2026-08-06T21:47:26.917202Z","submitted_at":"2026-06-29T08:57:59Z","title":"Beyond Uniform Experts: Cost-Aware Expert Execution for Efficient Multi-Device MoE Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T04:27:02.915854Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2606.29982"},"observation_digest":"sha256:89eab7f6fb9a73143ca870e4609e6d7fc747f3ab53fd780569c49ae89f5e2ac2","observation_id":"4b72e20b-0132-473b-bccb-7cc1e8163784","resolution":{"observed_at":"2026-06-30T17:14:57.447292Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-04T09:01:16.896518Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02341","last_updated":"2026-08-03T14:57:09Z","snapshot_observed_at":"2026-08-09T05:24:00.051641Z","submitted_at":"2026-08-03T14:57:09Z","title":"Broadcast Rate Limits in Wi-Fi: A Forgotten Bottleneck for Collaborative Edge LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T09:01:16.896518Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2608.02341"},"observation_digest":"sha256:a8c297bbd8a70125d1e6f0252afd09d7f140ec0a241c595dd1afeba81dd9db22","observation_id":"778f6169-e786-4b4a-afd2-887bcfc3461e","resolution":{"observed_at":"2026-08-04T09:01:16.896518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2312.17238/citation-record","integrity":"/paper/2312.17238/integrity","json":"/paper/2312.17238/citation-record.json","paper":"/paper/2312.17238"},"outbound":[],"paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2312.17238."}