{"as_of":"2026-08-12T17:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08aae3ee0e72d7848ae8373817d91ddc5cc353520dab4e156b2db7903a448266","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:53:54.900361Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:16:54.707195Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10375","snapshot_observed_at":"2026-08-04T19:16:54.707195Z","title":"Daop: Data-aware offloading and predictive pre-calculation for efficient moe in- ference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09420","last_updated":"2025-09-11T13:01:55Z","snapshot_observed_at":"2026-08-09T22:37:32.561623Z","submitted_at":"2025-09-11T13:01:55Z","title":"HD-MoE: Hybrid and Dynamic Parallelism for Mixture-of-Expert LLMs with 3D Near-Memory Processing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T19:16:54.707195Z"},"links":{"cited_paper":"/paper/2501.10375","citing_paper":"/paper/2509.09420"},"observation_digest":"sha256:93f2bb512ceb875d9c9910f14ab8905e1a6a4b2969336a414e4c09edf7cdc100","observation_id":"21df77bd-7575-4408-817d-5eea93f53ce4","resolution":{"observed_at":"2026-08-04T19:16:54.707195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.10375/citation-record","integrity":"/paper/2501.10375/integrity","json":"/paper/2501.10375/citation-record.json","paper":"/paper/2501.10375"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.538607Z","title":"Adaptive mixtures of local experts,","venue":null,"work_id":"0f3f0ffe-e283-4f59-920b-426fe5ec030f","year":1991},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.729867Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:08794b7e8bae7b765b52a9c5d298aff185289baaafa2434c315a7a37b2b42938","observation_id":"894331ae-c3df-4084-9cc8-3505bc46112b","resolution":{"observed_at":"2026-08-11T14:53:55.544057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-11T14:53:54.737349Z","title":"Mixtral of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.737349Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:27bcfcc6d71f715764069048480d882a1003c11c6c47594a61a6d2ee8987a6fe","observation_id":"5214bf63-2fa5-4a55-be53-2e50d5a79467","resolution":{"observed_at":"2026-08-11T14:53:54.737349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.522297Z","title":"Shedding the bits: Pushing the boundaries of quantization with minifloats on FPGAs,","venue":null,"work_id":"35720300-5fd3-446c-97b1-16e48d637079","year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.743265Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:7d730499a51b0816c5f00f979b3b260022ac891ef81370573938c8bc268615c1","observation_id":"b55ebed1-3f0c-439e-bcf4-7a5739c71fc1","resolution":{"observed_at":"2026-08-11T14:53:55.527485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14800","last_updated":"2024-05-30T16:24:16Z","snapshot_observed_at":"2026-08-09T05:34:20.536320Z","submitted_at":"2024-02-22T18:56:07Z","title":"Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14800","snapshot_observed_at":"2026-08-11T14:53:54.748614Z","title":"Not all experts are equal: Efficient expert pruning and skipping for mixture-of-experts large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.748614Z"},"links":{"cited_paper":"/paper/2402.14800","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:6ad5d81ac72509713171c25cee5cecbb92a58b64ebac039bbc75ee7fcca7ef2c","observation_id":"b3dba00c-5bcb-4b78-bc43-ea49ad7fb54d","resolution":{"observed_at":"2026-08-11T14:53:54.748614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.507864Z","title":"CRISP: Hybrid structured sparsity for class-aware model pruning,","venue":null,"work_id":"448dc829-eab3-4306-8110-b9e20fe8a88b","year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.754992Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:bd2cc386f23ee1e4f394234f379a1aed1e30be967d9845f96c0aed57b41ac680","observation_id":"cc7b2e55-091e-4fb6-9d11-5009a9f314ae","resolution":{"observed_at":"2026-08-11T14:53:55.512428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.492305Z","title":"SiDA: Sparsity-inspired data-aware serving for efficient and scalable large mixture-of-experts models,","venue":null,"work_id":"b363e167-0a9d-4db4-9fd1-02343130944e","year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.760232Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:5f34023511926c74f2c22d0a8ec044ff9201ea92da548c544173fe84a9a040b2","observation_id":"5c6e9eaa-4d98-4789-a210-b8fb6bc047fd","resolution":{"observed_at":"2026-08-11T14:53:55.497028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.477711Z","title":"Pre-gated MoE: An algorithm-system co-design for fast and scalable mixture-of-expert inference,","venue":null,"work_id":"31144c8c-2d4a-49e2-acd4-e81a3f233a8c","year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.765481Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:1c5229895d4824577130e5a009f2183253c14741305151289c7aa4478ab4afa9","observation_id":"595d1c73-9368-4ee5-bd45-9f8dca3311a6","resolution":{"observed_at":"2026-08-11T14:53:55.482173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.463285Z","title":"AdapMoE: Adaptive sensitivity-based expert gating and management for efficient moe inference,","venue":null,"work_id":"4c676ddc-e23c-4a99-a3e1-7aeef1a39c21","year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.770023Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:33f5faa9118f6a74477563407bf0b83e60de9dc3da4fd6618d865dceb44cc317","observation_id":"988327eb-ba2a-4be7-bd43-49f55dbfc221","resolution":{"observed_at":"2026-08-11T14:53:55.467770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.449192Z","title":"A survey of GPT-3 family large language models including ChatGPT and GPT-4,","venue":null,"work_id":"1120e7d3-a573-46b7-8cb9-c78fa15cb7ec","year":2023},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.774604Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:56c83a3a04272bd4615ef90606fa2de58d523fa70112cbb6f89c9abc6953a787","observation_id":"8507ceb6-87ca-42e7-b37e-b3d082d7d3c9","resolution":{"observed_at":"2026-08-11T14:53:55.453536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T14:53:54.778890Z","title":"LLaMA: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.778890Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:9666d073be7d9bcd4ca70190b8950b048d73a27bb179f977754d6d48e83469c3","observation_id":"539fc3f5-ad92-48ad-8541-e0ace42dea8b","resolution":{"observed_at":"2026-08-11T14:53:54.778890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17238","last_updated":"2023-12-28T18:58:13Z","snapshot_observed_at":"2026-08-09T05:23:39.113435Z","submitted_at":"2023-12-28T18:58:13Z","title":"Fast Inference of Mixture-of-Experts Language Models with Offloading","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17238","snapshot_observed_at":"2026-08-11T14:53:54.783360Z","title":"Fast inference of mixture-of-experts language models with offloading,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.783360Z"},"links":{"cited_paper":"/paper/2312.17238","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:e5e14199b5863f36d2b8025b51e44c62719e77ebab4d12cf5ba5378eb2184958","observation_id":"0aa618c3-99d0-451c-93a7-67e6393df335","resolution":{"observed_at":"2026-08-11T14:53:54.783360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14361","last_updated":"2025-03-12T18:14:21Z","snapshot_observed_at":"2026-08-09T05:22:39.483538Z","submitted_at":"2024-01-25T18:07:50Z","title":"MoE-Infinity: Efficient MoE Inference on Personal Machines with Sparsity-Aware Expert Cache","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14361","snapshot_observed_at":"2026-08-11T14:53:54.788320Z","title":"MoE-Infinity: Activation-aware expert offloading for efficient moe serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.788320Z"},"links":{"cited_paper":"/paper/2401.14361","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:9d653de8a7f2913f372d9b7d30fb7b89c8af081d94014b1d0275ca792b340354","observation_id":"ed2c28e9-8269-41c1-8324-41066309e880","resolution":{"observed_at":"2026-08-11T14:53:54.788320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14352","last_updated":"2025-03-07T11:16:40Z","snapshot_observed_at":"2026-07-06T16:11:06.578398Z","submitted_at":"2023-08-28T06:56:08Z","title":"EdgeMoE: Empowering Sparse Large Language Models on Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14352","snapshot_observed_at":"2026-08-11T14:53:54.794212Z","title":"EdgeMoE: Fast on-device inference of moe-based large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.794212Z"},"links":{"cited_paper":"/paper/2308.14352","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:c7f53250ff09916c26d00a0f91eda4ae0a5ff02dd01aedbf74b903b922c720c8","observation_id":"bfb4e50f-5ee7-413a-9eaa-faa6a961f59a","resolution":{"observed_at":"2026-08-11T14:53:54.794212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07033","last_updated":"2025-05-01T09:58:34Z","snapshot_observed_at":"2026-08-09T13:36:43.757746Z","submitted_at":"2024-02-10T19:54:08Z","title":"Fiddler: CPU-GPU Orchestration for Fast Inference of Mixture-of-Experts Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07033","snapshot_observed_at":"2026-08-11T14:53:54.800871Z","title":"Fiddler: CPU-GPU orchestration for fast inference of mixture-of-experts models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.800871Z"},"links":{"cited_paper":"/paper/2402.07033","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:d00379d71a4aa5610efcbde1b03b58832a08086fb54673c3c51a14625895bdf3","observation_id":"ea942e18-2646-415d-9a1b-fd7842426b9b","resolution":{"observed_at":"2026-08-11T14:53:54.800871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.01667","last_updated":"2022-09-04T18:00:29Z","snapshot_observed_at":"2026-08-10T21:30:58.269678Z","submitted_at":"2022-09-04T18:00:29Z","title":"A Review of Sparse Expert Models in Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.01667","snapshot_observed_at":"2026-08-11T14:53:54.806150Z","title":"A review of sparse expert models in deep learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.806150Z"},"links":{"cited_paper":"/paper/2209.01667","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:d7e6aad0b8404a4015a240194539560ee995fcb2d5e3df380bca98160f0ba72e","observation_id":"d352c0b7-431e-4ad5-8976-171e2cfc135f","resolution":{"observed_at":"2026-08-11T14:53:54.806150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06204","last_updated":"2025-04-09T13:54:59Z","snapshot_observed_at":"2026-08-11T00:43:48.374986Z","submitted_at":"2024-06-26T16:34:33Z","title":"A Survey on Mixture of Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06204","snapshot_observed_at":"2026-08-11T14:53:54.812599Z","title":"A survey on mixture of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.812599Z"},"links":{"cited_paper":"/paper/2407.06204","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:d37dfd4e7780420093019cedee5b3927058daaeffa0a6b8a9dd86c3e89bc6d90","observation_id":"767d8b57-d6e1-4d5c-82cb-0f3f3d364211","resolution":{"observed_at":"2026-08-11T14:53:54.812599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-10T16:18:23.994244Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-11T14:53:54.817456Z","title":"Hellaswag: Can a machine really finish your sentence?","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.817456Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:30c4937099a1867237021540297ec1a13206e76c6e6e40b062049ab28661ada8","observation_id":"5e31448d-3346-4ba4-9e2f-943cd5bc3577","resolution":{"observed_at":"2026-08-11T14:53:54.817456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-11T14:53:54.824549Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.824549Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:11bf627353d1d34ec346d8d932ec765f3413b78f829c6989fd837e46310c19de","observation_id":"0dec7bdf-610e-4202-bad9-3a1f686760ab","resolution":{"observed_at":"2026-08-11T14:53:54.824549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.434458Z","title":"PIQA: Reasoning about physical commonsense in natural language,","venue":null,"work_id":"82919c4b-a169-4d8e-b69a-8d51666bc5aa","year":2020},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.829541Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:421cfe9d8912d2156f64ab5a024a24b626ec093a98285642d6d8db26507d1af9","observation_id":"32f6b235-45f8-4656-8d93-220680d85c79","resolution":{"observed_at":"2026-08-11T14:53:55.439151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.419558Z","title":"Winogrande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":"91db11c8-ecb5-4249-b045-a032dc196085","year":2021},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.834476Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:6c9770b4ce96692f933f4fe044d54086378bc29629d212d9e992f3407b0f06a2","observation_id":"56b7f8a6-602f-4b48-afad-8736af1eebb5","resolution":{"observed_at":"2026-08-11T14:53:55.424160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T14:53:54.840159Z","title":"Training verifiers to solve math word problems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.840159Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:a488b17958b06f9a70ac45d2b16342ef2aa3cdb4421719584f4b9511afd81bc2","observation_id":"c1d839a8-8de7-47f5-9754-645903e25c69","resolution":{"observed_at":"2026-08-11T14:53:54.840159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-11T14:53:54.844918Z","title":"Measuring massive multitask language understand- ing,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.844918Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:839cf4b6a240f5e86b24093ff45f21a2266c1c5f76cc586edd5aa639cc425887","observation_id":"2b9b7004-a29d-4b8e-8c54-573156af9140","resolution":{"observed_at":"2026-08-11T14:53:54.844918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-02T11:13:42.401488Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-11T14:53:54.850108Z","title":"TriviaQA: A large scale distantly supervised challenge dataset for reading comprehension,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.850108Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:5fde55f0e65d2a2f5f01f4660f024d03f3ec4ed78caec8fde63b4d80dfd690a7","observation_id":"36a54ea6-c18a-439e-9992-401f4453a7b7","resolution":{"observed_at":"2026-08-11T14:53:54.850108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.404559Z","title":"Rouge: A package for automatic evaluation of sum- maries,","venue":null,"work_id":"7695db67-af1c-46ec-ac01-ec30ad9163f4","year":2004},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.856235Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:a6854de653928133956681e0caf8ef95803ccd11c637f9735fcf77937a0a2674","observation_id":"70a4491b-e856-4852-bfb6-c91b9b5dd25e","resolution":{"observed_at":"2026-08-11T14:53:55.409657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.388741Z","title":"Transformers: State-of-the-art natural language process- ing,","venue":null,"work_id":"60baa2de-a8ad-4ebe-ac45-5f3a70ecd185","year":2020},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.861034Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:e7cbaa3d691fc8c3b738ae8d025f7dee952d2a31ea74a432ab03851e868671a5","observation_id":"af324c84-3904-4053-bd60-ee5a914b1365","resolution":{"observed_at":"2026-08-11T14:53:55.394250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.372250Z","title":"A framework for few-shot language model evaluation,","venue":null,"work_id":"81f4a148-ba5b-4e54-a1c3-e7bcbb03bc29","year":null},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.865875Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:947e878c36752b94ec5b9452599c61fe924dd535fafd90efd9b0243be1a209a2","observation_id":"c6d66d4b-73d8-4e80-95b1-48ab6ba21c1f","resolution":{"observed_at":"2026-08-11T14:53:55.377405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.353603Z","title":"ShareGPT,","venue":null,"work_id":"c2277790-2969-48a3-96f3-c71ee0c60dee","year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.879049Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:92b8ab3d43e5ea654cc831b5f716e480e076b7e9acea8f843227c8cea839dcff","observation_id":"86588315-eacf-453b-bb83-5555563fef45","resolution":{"observed_at":"2026-08-11T14:53:55.358588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.337664Z","title":"DeepSpeed-MII,","venue":null,"work_id":"f74361be-0d33-4a93-a4b4-1c1cc27fc29d","year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.884137Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:14b3186435cfb2c7b08d5b8d8eac5b485dc952dcb718dbaee23fbd838054beb3","observation_id":"bfd1d06a-c3c0-4c19-8ca1-4c5a772a21e7","resolution":{"observed_at":"2026-08-11T14:53:55.342961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.319995Z","title":"GeForce RTX 4090,","venue":null,"work_id":"d431e7fd-392c-459a-be77-707b55cb7292","year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.888943Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:eaa21ec868c020579e8e02e434d1f36bbf78926b31388340799d7df3b975c282","observation_id":"a67e9f58-4827-401a-9c8b-a4b2adc4ea9d","resolution":{"observed_at":"2026-08-11T14:53:55.325819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.302784Z","title":"[Online]","venue":null,"work_id":"35689781-599e-47a3-b920-5d920563096f","year":2024},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.894539Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:a3ee5a54069a8668d0c68a503c4d614ecfa268f0f881e0835a48f0ff896238c4","observation_id":"0a9b532a-2e72-4122-9c84-21d24e29b490","resolution":{"observed_at":"2026-08-11T14:53:55.308071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:55.283785Z","title":"NVIDIA Hopper H100 GPU: Scaling performance,","venue":null,"work_id":"28aeb57b-b6f7-42d3-99e6-64f6f805b39d","year":2023},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.900361Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:6d5ea955830104968496e4877d8f15771c0d1b7a2d464e42b46e96b5f7bf9584","observation_id":"3f05f789-4759-4ce3-8230-9f4ea368fa09","resolution":{"observed_at":"2026-08-11T14:53:55.290323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:54.872936Z","title":"Available: https://zenodo.org/records/10256836","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:54.872936Z"},"links":{"citing_paper":"/paper/2501.10375"},"observation_digest":"sha256:c466a263c6b2ea99905c59e282163016bc6e34ee0fd68c40913c72f1310daf1b","observation_id":"234ab0fd-483d-4edf-844d-75e5d77a3a3f","resolution":{"observed_at":"2026-08-11T14:53:54.872936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.10375","last_updated":"2025-05-04T09:49:42Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-11T14:48:33.607191Z","submitted_at":"2024-12-16T07:59:21Z","title":"DAOP: Data-Aware Offloading and Predictive Pre-Calculation for Efficient MoE Inference"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2501.10375."}