{"as_of":"2026-08-16T18:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a9c52b665d2a599e1d1da385c24f3532fb67409dd130490074428355bc31e070","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:51:05.804032Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.13057/citation-record","integrity":"/paper/2608.13057/integrity","json":"/paper/2608.13057/citation-record.json","paper":"/paper/2608.13057"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:07.296255Z","title":"MoonEP: A perfectly balanced expert parallelism library via dynamic redundant experts.https://github.com/ MoonshotAI/MoonEP, 2026","venue":null,"work_id":"8b87c38c-e9e5-4d4d-913c-c4d0f3de0fc1","year":2026},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.530747Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:e278c10efcd7f5020c182bf199f7c9bceb3eca0660094784c2a8693d327f5d14","observation_id":"c0d08f1f-31db-4785-8ed8-e8f2350470f5","resolution":{"observed_at":"2026-08-15T17:51:07.311119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T17:51:05.552359Z","title":"DeepSeek-V3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.552359Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:699155f805a6c0113e301fc38c33f2e690c27dc1626f94df5e2558376bca2f4b","observation_id":"99729812-fe40-44ec-b48a-c25482a62b10","resolution":{"observed_at":"2026-08-15T17:51:05.552359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:07.248813Z","title":"DeepEP: an efficient expert-parallel communication library","venue":null,"work_id":"a9f116d8-60ab-4712-b2c2-ef38f61c53dc","year":2025},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.566979Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:f0c58bceb85369d2f51cd76bb350fca2695c77ca1bbc1b42c26490ac1248235b","observation_id":"e3b2fae4-fc0b-4ee1-9ded-9b8b36ae2b2d","resolution":{"observed_at":"2026-08-15T17:51:07.262431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:07.207874Z","title":"DeepGEMM: clean and efficient FP8 GEMM kernels","venue":null,"work_id":"3c1811ea-d018-439c-a616-7aab2c522213","year":2025},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.583538Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:f6b56853c98e5d04e8c2c8bd8b2939eedadc0d03e6098d2cf104528d231477ee","observation_id":"217c25a4-810d-49ac-a651-abba10fe9db1","resolution":{"observed_at":"2026-08-15T17:51:07.219688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:07.151586Z","title":"EPLB: Expert parallelism load balancer","venue":null,"work_id":"4209a31f-d891-475a-ac42-5c2f0856992d","year":2025},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.596906Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:8071c9d4684f78bb649572c5fd854d8972e1ed225b39a36a901546ec526d325b","observation_id":"12a20f7e-499e-4c43-ac4b-8a5a6eceb992","resolution":{"observed_at":"2026-08-15T17:51:07.171421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:07.096530Z","title":"LPLB: An LP-based load bal- ancer for expert parallelism","venue":null,"work_id":"37685dfb-1c3f-47c6-a3d5-8386afae6948","year":2025},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.610868Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:d588894e70485f3896b21e08755bf1f0c23e10bf4cc928de402e7a46c1c81cb4","observation_id":"be4728b5-d7c7-4216-a6e4-6259a7684fc4","resolution":{"observed_at":"2026-08-15T17:51:07.114689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:07.026384Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.JMLR, 23(120), 2022","venue":null,"work_id":"4b71e455-40e2-447a-8585-72a2cf9f851a","year":2022},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.637837Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:afe40a8ee089e440f2afad73d26848bc96fcffdb3139290b1392037d98b88716","observation_id":"e1bb9362-0767-4c62-b093-e05c68af33ef","resolution":{"observed_at":"2026-08-15T17:51:07.054224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:06.982135Z","title":"Garey and David S","venue":null,"work_id":"40cf775e-b517-4569-bdb6-cccba721e08c","year":1979},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.648439Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:7c4261f179ec9c7032ca52d6a9cc6df8a60d4ce88c54aaca11306005be77e72b","observation_id":"18592202-9154-4e88-bb86-425cebb1af73","resolution":{"observed_at":"2026-08-15T17:51:06.993036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.00735","last_updated":"2026-05-30T13:57:09Z","snapshot_observed_at":"2026-08-13T16:33:10.829186Z","submitted_at":"2026-05-30T13:57:09Z","title":"ViBE: Co-Optimizing Workload Skew and Hardware Variability for MoE Serving","version":1},"cited_work":{"arxiv_id":"2606.00735","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.00735","snapshot_observed_at":"2026-08-15T17:51:06.597622Z","title":"ViBE: Co-Optimizing Workload Skew and Hardware Variability for MoE Serving","venue":"cs.DC","work_id":"6a0d29eb-8452-4c28-ba8e-196a752cc2dd","year":2026},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.664562Z"},"links":{"cited_paper":"/paper/2606.00735","citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:515beb905ab93307250f128d53f5a2521e3a76f6dfe1ebc6e749606130de0e20","observation_id":"7392044b-72ad-4e8c-aab0-fafbdb605e8c","resolution":{"observed_at":"2026-08-15T17:51:06.609265Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:06.937310Z","title":null,"venue":null,"work_id":"b98f3125-1b1c-4c34-9aac-a0255819ce76","year":2006},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.673858Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:db64ec3c96dbe5e13f4f605ef7d8e1876339ab5bd671bdd79ab0cc3b61777217","observation_id":"084c7b5c-d977-4e73-8a7d-2626153073f1","resolution":{"observed_at":"2026-08-15T17:51:06.956167Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.17880","last_updated":"2026-07-20T12:30:27Z","snapshot_observed_at":"2026-08-16T13:40:00.073950Z","submitted_at":"2026-07-20T12:30:27Z","title":"Mixture-of-Experts Serving","version":1},"cited_work":{"arxiv_id":"2607.17880","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.17880","snapshot_observed_at":"2026-08-15T17:51:06.516646Z","title":"Mixture-of-Experts Serving","venue":"cs.DS","work_id":"79e56dcf-3ecc-4190-8950-5f313f038c53","year":2026},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.684119Z"},"links":{"cited_paper":"/paper/2607.17880","citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:d8f230fb2b4bb18f4bf8c3208d4ae8efa1646e5130ec5ddd34689b7f5f4655ef","observation_id":"4cd430e3-9734-4038-98e0-98c33048b18f","resolution":{"observed_at":"2026-08-15T17:51:06.541624Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:06.886684Z","title":"GShard: Scaling gi- ant models with conditional computation and automatic sharding","venue":null,"work_id":"70eb2cef-1e4d-4616-a95a-62143855c43f","year":2021},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.696617Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:6a199a71f271697501346d168c371d63ca154836a70cf4682c8b4fb5aee1359e","observation_id":"cebbbd22-2e74-4303-b99f-0d8f131e19f3","resolution":{"observed_at":"2026-08-15T17:51:06.901403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:05.703170Z","title":"Effi- cient MoE serving in the memory-bound regime: Bal- ance activated experts, not tokens.arXiv preprint arXiv:2512.09277, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.703170Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:48e4e8ebbb03c4fcf07adcec0cb74a4734b2456327abc03fca0a6ff8a9c5cb0e","observation_id":"a0ccf8db-c7f9-4846-92db-ab5aee1c86e4","resolution":{"observed_at":"2026-08-15T17:51:05.703170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:05.710534Z","title":"Least-loaded expert parallelism: Load balancing an imbalanced mixture-of-experts.arXiv preprint arXiv:2601.17111, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.710534Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:b3a6c1ede2cb9f8b1ffcdf3fc2443a2ad2d2832dead4f3335d6ab6f013642b55","observation_id":"9035bb99-9989-482a-ac1f-f040f611533a","resolution":{"observed_at":"2026-08-15T17:51:05.710534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:06.840850Z","title":"Flex- MoE: Scaling large-scale sparse pre-trained model train- ing via dynamic device placement","venue":null,"work_id":"84320b05-b6b7-4c82-b1ac-6a3f3a6ed3e9","year":2023},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.718668Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:a3960581d7111912dfcc603817e9c83cb900ba436a388f0290de11512346cc4d","observation_id":"060bc456-b0af-4d7e-afdb-d013ae6b9acd","resolution":{"observed_at":"2026-08-15T17:51:06.856319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:05.735820Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.735820Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:7362d4b025c909db514e26540c2357b8644d5dc16a635db5379560ee57a68329","observation_id":"18e68760-099c-4393-8b37-ed9d6c2db12f","resolution":{"observed_at":"2026-08-15T17:51:05.735820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-14T08:12:39.448080Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"cited_work":{"arxiv_id":"2606.04101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.04101","snapshot_observed_at":"2026-08-15T17:51:06.223598Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","venue":"cs.DC","work_id":"ddf398c4-0718-4cad-9393-21e18dd67fbe","year":2026},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.745105Z"},"links":{"cited_paper":"/paper/2606.04101","citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:0ef1d462161008beda3cabe4d75dd001b1f4847de3d91040a2bff459e7113c88","observation_id":"7fe449be-b7a9-42af-b4e4-5933f55243fe","resolution":{"observed_at":"2026-08-15T17:51:06.233480Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:06.761271Z","title":"Parallel machine scheduling with splitting jobs.Discrete Applied Mathe- matics, 103(1-3):259–269, 2000","venue":null,"work_id":"767d3d74-bda5-4db8-b781-f6c24ebe4787","year":2000},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.758393Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:97f85ccb456202bb155ca9c9fd3a7ab1ff79a8e248f0dadd3b9c244e95ba472c","observation_id":"50d60cf6-f505-4bbb-b77b-1d089c5fcf27","resolution":{"observed_at":"2026-08-15T17:51:06.777448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:05.769408Z","title":"Taming latency-memory trade-off in MoE- based LLM serving via fine-grained expert offloading","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.769408Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:98a9196687d4c7b1cdf1c59ba90852350026a57f8093f94b90cf130b8796d0b1","observation_id":"af3da88a-436a-4e25-ae08-a94362ea0b34","resolution":{"observed_at":"2026-08-15T17:51:05.769408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.29982","last_updated":"2026-06-29T08:57:59Z","snapshot_observed_at":"2026-08-12T11:37:47.617460Z","submitted_at":"2026-06-29T08:57:59Z","title":"Beyond Uniform Experts: Cost-Aware Expert Execution for Efficient Multi-Device MoE Inference","version":1},"cited_work":{"arxiv_id":"2606.29982","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.29982","snapshot_observed_at":"2026-08-15T17:51:06.018578Z","title":"Beyond Uniform Experts: Cost-Aware Expert Execution for Efficient Multi-Device MoE Inference","venue":"cs.DC","work_id":"4b4587fa-a59a-4202-a1cb-f0adacf86995","year":2026},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.779044Z"},"links":{"cited_paper":"/paper/2606.29982","citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:3e8a4e634f561f7c355ec2dfbea7e3ed93655ea5e96872d3b97fdbd9e5a82323","observation_id":"84356996-908d-4f68-a0c7-e4faa9375a87","resolution":{"observed_at":"2026-08-15T17:51:06.038208Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:51:06.704064Z","title":"SmartMoE: Efficiently training sparsely-activated models through combining offline and online parallelization","venue":null,"work_id":"b0756b3d-093d-42ee-8f69-10b8b1d8ab8e","year":2023},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.791398Z"},"links":{"citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:b58883a73a90aa28adc4668c64670dd862a75fd4710b1d9817cdc0dcc108779e","observation_id":"78c3e655-5296-4842-bda4-46a7fd9791c6","resolution":{"observed_at":"2026-08-15T17:51:06.716425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2608.03676","last_updated":"2026-08-04T13:50:22Z","snapshot_observed_at":"2026-08-07T23:12:17.426863Z","submitted_at":"2026-08-04T13:50:22Z","title":"TAOT: Topology-Aware Optimal Transport for Dynamic Expert Replica Placement in MoE Training","version":1},"cited_work":{"arxiv_id":"2608.03676","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.03676","snapshot_observed_at":"2026-08-15T17:51:05.912328Z","title":"TAOT: Topology-Aware Optimal Transport for Dynamic Expert Replica Placement in MoE Training","venue":"cs.DC","work_id":"29cc2616-8b15-42d6-8f02-2c089814b938","year":2026},"citing_paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:51:05.804032Z"},"links":{"cited_paper":"/paper/2608.03676","citing_paper":"/paper/2608.13057"},"observation_digest":"sha256:5b37b38d7d9b479da95377a3984b1a08f89a1d1f27a4064ebbf109f3b168af21","observation_id":"503da9b6-7ba3-415c-b33c-8055efee9999","resolution":{"observed_at":"2026-08-15T17:51:05.926421Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.13057","last_updated":"2026-08-13T10:21:11Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-16T18:11:30.787588Z","submitted_at":"2026-08-13T10:21:11Z","title":"TEMPO: Makespan-Aware Expert-Parallel Load Balancing Across Memory- and Compute-Bound Regimes"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":4,"verified_fuzzy":11},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2608.13057."}