{"as_of":"2026-08-15T21:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a9980908b783b6e1be83569ed4c17f9481e8b3ec9bac3699672137cfa107f966","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T07:33:31.233659Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08782/citation-record","integrity":"/paper/2607.08782/integrity","json":"/paper/2607.08782/citation-record.json","paper":"/paper/2607.08782"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"The llama 4 herd: Native multimodality with a mixture-of-experts architecture,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:f3f8376953de14e7637bc0dcf974991efca4bd26435fca59a2b09968856447c4","observation_id":"71c0feb2-454e-43a2-a59e-0918221ad819","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:6cbae8000364b43b48bedf9ca21f7e480d68fbf3a94a58c2c7845dc6ef0611b0","observation_id":"48494770-eec2-44f4-8c50-deb0ede79d68","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Qwen2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:aa5cee06aa7d5653527e5a862ef7969845a6fde2d1cdaaf37cadc69390a3b67c","observation_id":"18e0be56-6e26-4f66-a104-7984db799e4c","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:b3e92fc329a8bd64343a653c3dacb7a6add0806c360d38d191cf9a3339167a9e","observation_id":"f3b369a3-e028-4566-b453-de0b06b67d43","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Deepseekmoe: Towards ultimate expert special- ization in mixture-of-experts language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:ce7cd1a41e6131146e868349d3b1269d031b5dffba26b09dcc03541e7f95d14b","observation_id":"2f6b8dd7-222e-4ef7-8749-f57edca5d5d8","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:80df845e62970d2e6a849e7b1dcd548fa8fb595fb83c0d140fdaaa05c6f06bdc","observation_id":"b1b2d8e5-a5d8-4b8f-8d87-71ca2e652886","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:a0b626ae69f95beb95687b880b8113292f64ba2c075503684324718eff037ee5","observation_id":"bea30814-d9e0-4b9b-ba02-7f3b80652752","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:f7ec827caaba88c4e06caf1977a13a67ec8185026373872ae61facb858e7625b","observation_id":"b7145a54-95c9-41ca-a992-a8fa5507a256","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:3d47b1daa905278e0068bde2d3b4c0a125ccfd195e13ec868e8543785815e3b5","observation_id":"32ccd246-4750-4998-a950-14c421ec618e","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Training and serving system of foundation models: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:838d4597bd09ce3ee3b18e0bff8195264f2e7d991c73dc80b3b8ec6d3da1bd94","observation_id":"be38d49d-9f9f-4106-a249-727b50e1c613","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-08-07T09:27:36.420559Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Gshard: Scaling giant models with conditional computation and automatic sharding,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:ca2f07d2e9628b940e4bb8ff4f588ec394f458fd302dc4385144cddd9d8c78fd","observation_id":"0b707fd0-2320-4a08-8605-a777043164e0","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Expert Parallelism Load Balancer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:b39dc6b7bf77ca1a93ef98032c9339b1d99c1eeb0b8d71ab824fa2e81f35cd13","observation_id":"bbe6a236-87ec-4f2a-8ce0-081dd5b14598","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06643","last_updated":"2025-02-10T16:34:36Z","snapshot_observed_at":"2026-08-13T11:48:16.813992Z","submitted_at":"2025-02-10T16:34:36Z","title":"MoETuner: Optimized Mixture of Expert Serving with Balanced Expert Placement and Token Routing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06643","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Moetuner: Optimized mixture of expert serving with balanced expert placement and token routing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2502.06643","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:0b354819edbfcf02d58da14f393ffc756937d859826f48722910bae6d121008f","observation_id":"24f749bb-d31b-4939-8969-0157822bdb8f","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Fastermoe: modeling and optimizing training of large-scale dynamic pre-trained models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:7c780f1c03584f1eb2d43df2d6c061d2399318f84fae635cab99825ca96efe99","observation_id":"cddb2fcc-6a73-4f92-b880-dc3ef26b1bfc","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Flexmoe: Scaling large-scale sparse pre-trained model training via dynamic device placement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:273fc7da42e94ae162b032930105eec5845fc4c43991a445860d9389f7b32a64","observation_id":"c78b379b-df68-4619-8db1-9858a59402b0","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Tutel: Adaptive mixture-of-experts at scale,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:f0dbb7bd9dd570178dd208b4a5f21111d4326033593e2860a397ebe288f019f2","observation_id":"74586f9a-5891-4573-9cb6-2fed3ee064be","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Smartmoe: Efficiently training sparsely-activated models through combining offline and online parallelization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:2fab64eec4caf0a378fe18b8377e85d45a9ab42edba8f0e5915cc76c529cf5a4","observation_id":"fafe8728-0916-4fe6-a9d7-0ef069f784fd","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Janus: A unified distributed training framework for sparse mixture-of-experts models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:0bb8c22b186d9b731fe3c2c6d3a8569f417f6b7aee80bbf6238a182760a66252","observation_id":"ccfb7257-2d96-4479-bd40-be44abe62166","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"A branch-and-price algorithm for the generalized assignment problem,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:86991ad855735d246088037177829823adcc7a35882fc06d7a76e66a3bcabaf7","observation_id":"b107627a-7203-4562-8eaa-cf9274888b8f","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:e38ebe9fbb53a9f29f86a638b240e277c35333eb2db6f6792aaef7f1e39ec0bf","observation_id":"c2005257-f228-46cb-8b67-b80488bd173b","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Not all experts are equal: Efficient expert pruning and skipping for mixture-of-experts large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:73f0dc786fee7906e2b188bb9bdd5f9970063101f76383477029d4d76a9439b3","observation_id":"3d59945a-81e2-4493-ad5b-3d63ea496774","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00945","last_updated":"2024-07-01T03:57:35Z","snapshot_observed_at":"2026-08-15T08:32:31.777777Z","submitted_at":"2024-07-01T03:57:35Z","title":"Efficient Expert Pruning for Sparse Mixture-of-Experts Language Models: Enhancing Performance and Reducing Inference Costs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00945","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Efficient expert pruning for sparse mixture-of-experts language models: Enhancing performance and reducing inference costs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2407.00945","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:c4044dee13689535e8364b522432803562fd67a24c1df7d5f5a378ecf17acc4a","observation_id":"331452d3-39fa-4727-a2c2-478da7597b75","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Ta-moe: topology-aware large scale mixture-of-expert training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:2b347300274032410c99f84ce487915be8f3b889fbf7ec2c17375ad986341302","observation_id":"94ddfb38-3c0e-445f-b4aa-16d41209b88e","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Schemoe: An extensible mixture-of-experts distributed training system with tasks scheduling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:e32cf1b520d762644503269b6b141996a983e0db5686183b4829a60f8739cd86","observation_id":"841e3ee0-2273-4423-8c2f-e9876c47a1e4","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Fsmoe: A flexible and scalable training system for sparse mixture-of- experts models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:359d86c899cdb65ee5ae2e0fd0a36e3e8c836682d0e28dbb7f91e86528c9877f","observation_id":"c1906339-2fb5-4bb6-806a-4533246a13f5","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Pipemoe: Accelerating mixture-of- experts through adaptive pipelining,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:76f1d345b5fc4a6f20213fa25f45ab1416cc8dc9ac7a194d34f2177218871e98","observation_id":"7820b9a8-a016-45c4-81f2-e6c1421539a6","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Klotski: Efficient mixture-of-expert inference via expert- aware multi-batch pipeline,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:d5a5b1911e18bb3fe9a3435a67d6e16f9933a9b785b5f689be17009309891f22","observation_id":"f97f1395-c9a5-4006-8c38-2d3ca225806d","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Parm: Efficient training of large sparsely-activated models with dedicated schedules,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:c09c1970934800a05a209ce312e8d60f371a9c2af7adbbe6015fbc8f77b5e883","observation_id":"f0ba0975-dc1d-4c19-95d6-b7b35fcfc859","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Expertflow: Optimized expert activation and token allocation for efficient mixture-of-experts inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:0dfc67b70fd1b207c092633135d25fc905bb68af8f25f80087d19f8a32ea8126","observation_id":"8a3cca7c-417a-4e5a-95db-0327bfd5738f","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Netmoe: Accelerating moe training through dynamic sample placement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:f8e5e7cc79ea2de85125b92e7b549d5cef149d73b431fe955973ef471c130cf8","observation_id":"d86a64ba-7f11-4099-86a0-2edbbba1cadf","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Communication-efficient sparsely-activated model training via sequence migration and token condensation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:94f38fdbd2d6cf8f31b1ca5ddc60cff3c40bcfd534e2308404674142a0e8fa43","observation_id":"123b17a5-97a2-4d20-b60a-a87de76a0b84","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"{PopFetcher}: Towards accelerated{Mixture-of-Experts} training via popularity based{Expert-Wise}prefetch,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:d51038fea07a5a3ad1855e3ec4e7cf66128c6e72f994012fb8818549089cb48a","observation_id":"4c58dac2-856e-4c2b-b276-5e56a7dfbb84","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:2ae605497f33efdb1dbf065d72d7cc1403e9cd09b0bcd920dac06ad336d1bd6c","observation_id":"a6c6aaf9-5c03-4fac-bdd8-c85e6d8dafb9","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Let’s verify step by step,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:4852a0a6a95341183cd6edf0b849adfa47c8992c03b24f061f834b9b6db36993","observation_id":"e9b0cdf9-1c1d-413d-94f9-79187c4b3fd6","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-13T09:04:30.125777Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:4c64b8bdfd042ab027b22dc233b443d35117c2698c845ad76854015bfea4d449","observation_id":"77e01d70-f73b-4627-ab4e-faddceecc7bb","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Sida: Sparsity-inspired data-aware serving for efficient and scalable large mixture-of-experts models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:c3770f9abc0b19e996d01acfccdfae79a062d8e7ab29e95c16e7345ad23df9d0","observation_id":"e6faae90-ae8f-448d-80ae-182c0136819c","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"D2moe: Dual routing and dynamic scheduling for efficient on-device moe-based llm serving,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:e7c23fc5783ffbcb30415582031831b434d04abbc172e1f52e5bc2784de902c8","observation_id":"c8d1d64e-c068-4277-91ef-084b3ea4656e","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"On tail probabilities for martingales,","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:f767d21cb063922e606192ee23986112089782fec8b103eeedfab765e25db0d0","observation_id":"956de3b5-8403-46fd-b8f7-39f8579d400a","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Approximation-friendly discrepancy rounding,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:73147565ab2be38041d445f40d4f387746cd00521689687be24f25b8b2daf66a","observation_id":"028ef24d-fbed-4d1d-8fe2-e5df50c91534","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Constructive algorithms for discrepancy minimization,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:d249d552a94e9af60377bea64b83a012dbd2b69664fbaf5f2df3ef8412a3430d","observation_id":"4598b9de-4a95-4b56-a6ef-0d41ab7190b2","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Constructive discrepancy minimization by walking on the edges,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:10fa0450e19c931da9b0f8411d2f533d5bb94120f4abfb64a18434ef41403d2b","observation_id":"cca1fb54-86cb-4c2f-9f1b-ae856b7140a1","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:cdb7b034d7daf474d5042d54daefe3eb7aedc4ef0d137b0b47f39fc5eed1cdf1","observation_id":"69dba63c-6654-492c-b57f-959fafb26a4d","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Colossal-ai: A unified deep learning system for large-scale parallel training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:056915781705e1cfdd682816bdd2867af2bc77918f94e9a99d3f5ca9ff7ea8f8","observation_id":"92948a4d-ada3-452c-9b64-82e238762421","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"SciPy 1.0: Fundamental Algorithms for Scientific Computing in Python,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:de1ba4219bbc44c781f9927710061d61ef36af85e6f1725856346191bcbfd8d2","observation_id":"9f6a9bee-96a4-4073-a222-2c0425e81814","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Awq: Activation-aware weight quantization for on-device llm compression and acceleration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:f8e0b124a5cdffaac14bc149fde35ea10ea75ba57614f7f883beee38259198a6","observation_id":"7b0199b4-506e-474d-bfc8-aa45181ed28a","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Mixtral of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:e805f19f0ffd8dc14702bce4608fe21023f4bea8f1687d7458146a076ee7a854","observation_id":"6ad07ccf-7bdb-46fa-9321-6577a8bc15a3","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T07:33:31.233659Z","title":"Deepspeed-moe: Advancing mixture-of-experts inference and training to power next-generation ai scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T07:33:31.233659Z"},"links":{"citing_paper":"/paper/2607.08782"},"observation_digest":"sha256:b8a24905aa35d38d21505fab1e0b6b80f38e5fa50b6cd84bcfb66abb3edb8533","observation_id":"aa84e84b-573e-4dd3-be77-850c19cb1365","resolution":{"observed_at":"2026-07-13T07:33:31.233659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08782","last_updated":"2026-06-13T04:31:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T16:30:44.418205Z","submitted_at":"2026-06-13T04:31:49Z","title":"Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2607.08782."}