{"as_of":"2026-08-10T14:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:68c508d23dae9087f9a42cd5aa2eb7369e608b3384e70fbbfc2ffe800ec349ed","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:26.080156Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T15:39:56.514258Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":"2405.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-07-04T15:39:56.514258Z","title":"Dynamic mixture of experts: An auto-tuning approach for efficient transformer models","venue":null,"work_id":"d14f17bf-17d9-4234-9eed-2f53704d5aa4","year":2024},"citing_paper":{"arxiv_id":"2502.15315","last_updated":"2026-04-19T13:09:18Z","snapshot_observed_at":"2026-08-02T11:10:25.267742Z","submitted_at":"2025-02-21T09:10:54Z","title":"Tight Clusters Make Specialized Experts","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-23T02:54:12.217351Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2502.15315"},"observation_digest":"sha256:29bd3109bdf28f388cf2e9ded81c13d271a5ae3362e0dbac8254e6ff5e49bde3","observation_id":"53a8e46f-fa72-428e-8e43-79292a7c7001","resolution":{"observed_at":"2026-05-23T02:55:19.530584Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-08-07T12:35:26.080156Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24593","last_updated":"2025-06-11T10:28:53Z","snapshot_observed_at":"2026-08-09T14:19:35.169817Z","submitted_at":"2025-05-30T13:40:51Z","title":"Decoding Knowledge Attribution in Mixture-of-Experts: A Framework of Basic-Refinement Collaboration and Efficiency Analysis","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:26.080156Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2505.24593"},"observation_digest":"sha256:4e09257e5df36dfc03991bacf66bbf72e96af9f9eb823519a7fa07659d801877","observation_id":"e484b78a-4242-4364-b61b-b39c2e9edfe2","resolution":{"observed_at":"2026-08-07T12:35:26.080156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-08-05T21:55:08.825228Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-09T17:03:23.397293Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.825228Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:422d00fb9af374400e72b7037070d782dd9d484b116c988d4b41740eb1f31299","observation_id":"9c45b934-2f91-40d8-bfcb-6552f3c52bc9","resolution":{"observed_at":"2026-08-05T21:55:08.825228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":"2405.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-07-04T15:39:56.514258Z","title":"Dynamic mixture of experts: An auto-tuning approach for efficient transformer models","venue":null,"work_id":"d14f17bf-17d9-4234-9eed-2f53704d5aa4","year":2024},"citing_paper":{"arxiv_id":"2509.23638","last_updated":"2026-04-16T07:53:37Z","snapshot_observed_at":"2026-08-02T18:57:31.493788Z","submitted_at":"2025-09-28T04:35:12Z","title":"LayerScope: Predictive Cross-Layer Scheduling for Efficient Multi-Batch MoE Inference on Legacy Servers","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T12:38:31.783807Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2509.23638"},"observation_digest":"sha256:be2b6ce7b75aedbf79df24ae1b130d1301d62e0926f57bef367848c35de58959","observation_id":"90aa6063-8ba9-41d1-9f56-773a39372f21","resolution":{"observed_at":"2026-05-18T12:41:22.750752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-08-04T11:34:09.076920Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04033","last_updated":"2026-06-22T22:02:33Z","snapshot_observed_at":"2026-08-08T07:19:32.785815Z","submitted_at":"2025-10-05T04:52:26Z","title":"A global log for medical AI","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-04T11:34:09.076920Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2510.04033"},"observation_digest":"sha256:1ab8a7029c9622deeaf50cce676533aec693c7794eea7ef2a5b56f7fd88b9de8","observation_id":"3009b571-ce6c-4eb5-acbd-07ee44fce063","resolution":{"observed_at":"2026-08-04T11:34:09.076920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-08-03T16:21:31.008497Z","title":"Dynamic mix- ture of experts: An auto-tuning approach for efficient transformer models.arXiv preprint arXiv:2405.14297, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13996","last_updated":"2026-06-01T21:50:10Z","snapshot_observed_at":"2026-08-07T19:01:52.521673Z","submitted_at":"2025-12-16T01:28:57Z","title":"DTop-p MoE: Sparsity-Controlled Dynamic Top-p MoE for Foundation Model Pre-training","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T16:21:31.008497Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2512.13996"},"observation_digest":"sha256:3f08227db06172e6016675f87c272f402c8f984949abc1cf5a090d5bc4a68063","observation_id":"24f1c759-c0b0-4caf-abfb-b9dbef9e1008","resolution":{"observed_at":"2026-08-03T16:21:31.008497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":"2405.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-07-04T15:39:56.514258Z","title":"Dynamic mixture of experts: An auto-tuning approach for efficient transformer models","venue":null,"work_id":"d14f17bf-17d9-4234-9eed-2f53704d5aa4","year":2024},"citing_paper":{"arxiv_id":"2605.14438","last_updated":"2026-05-14T06:33:41Z","snapshot_observed_at":"2026-08-06T21:01:38.107284Z","submitted_at":"2026-05-14T06:33:41Z","title":"BEAM: Binary Expert Activation Masking for Dynamic Routing in MoE","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T01:59:33.047821Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2605.14438"},"observation_digest":"sha256:4dd627ead1fc8c39de709e3a5df85f74a53c8788a648a2d0f89b3c2efa96171f","observation_id":"b5591dc7-841e-4d24-905f-cb3dfbe8cbcf","resolution":{"observed_at":"2026-05-15T01:59:38.695894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":"2405.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-07-04T15:39:56.514258Z","title":"Dynamic mixture of experts: An auto-tuning approach for efficient transformer models","venue":null,"work_id":"d14f17bf-17d9-4234-9eed-2f53704d5aa4","year":2024},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T12:00:35.496822Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:ab7d26f4d176dea19fa830484ee0d3238a51189a5d24cf7b6ac3bb6395abba76","observation_id":"451e832b-0d19-4404-9e54-ec838ce2b527","resolution":{"observed_at":"2026-05-20T12:03:15.193659Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":"2405.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-07-04T15:39:56.514258Z","title":"Dynamic mixture of experts: An auto-tuning approach for efficient transformer models","venue":null,"work_id":"d14f17bf-17d9-4234-9eed-2f53704d5aa4","year":2024},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T18:22:45.702572Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:daa8257f717773996d047767ba1a9516edb2ad504fd288bc8920a966034a2b3c","observation_id":"35d2ee69-2aeb-438f-abf0-96af6b602ae0","resolution":{"observed_at":"2026-06-30T18:25:00.018283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":"2405.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-07-04T15:39:56.514258Z","title":"Dynamic mixture of experts: An auto-tuning approach for efficient transformer models","venue":null,"work_id":"d14f17bf-17d9-4234-9eed-2f53704d5aa4","year":2024},"citing_paper":{"arxiv_id":"2605.31463","last_updated":"2026-05-29T15:52:58Z","snapshot_observed_at":"2026-08-03T10:19:30.254575Z","submitted_at":"2026-05-29T15:52:58Z","title":"PithTrain: A Compact and Agent-Native MoE Training System","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T23:12:14.193089Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2605.31463"},"observation_digest":"sha256:a32221592daa925a225dbc76beab8e6164f1454e29de049fc4a0d77dd42057fc","observation_id":"355a096d-004d-45e3-880c-423195d5ea50","resolution":{"observed_at":"2026-06-28T23:12:46.518740Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":"2405.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-07-04T15:39:56.514258Z","title":"Dynamic mixture of experts: An auto-tuning approach for efficient transformer models","venue":null,"work_id":"d14f17bf-17d9-4234-9eed-2f53704d5aa4","year":2024},"citing_paper":{"arxiv_id":"2606.08814","last_updated":"2026-06-07T20:07:24Z","snapshot_observed_at":"2026-08-02T23:58:50.946844Z","submitted_at":"2026-06-07T20:07:24Z","title":"STAR: Rethinking MoE Routing as Structure-Aware Subspace Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T18:28:35.162934Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2606.08814"},"observation_digest":"sha256:854b365f34b14147975b4e92b915cb0de6a9c93517e4a01a609a444aeafe24e1","observation_id":"de322e12-ec2c-4faf-9858-b1716e0c215d","resolution":{"observed_at":"2026-07-02T23:07:26.926103Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":"2405.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-07-04T15:39:56.514258Z","title":"Dynamic mixture of experts: An auto-tuning approach for efficient transformer models","venue":null,"work_id":"d14f17bf-17d9-4234-9eed-2f53704d5aa4","year":2024},"citing_paper":{"arxiv_id":"2606.26287","last_updated":"2026-06-24T18:34:00Z","snapshot_observed_at":"2026-07-07T00:00:36.766142Z","submitted_at":"2026-06-24T18:34:00Z","title":"GeMoE: Gating Entropy is All You Need for Uncertainty-aware Adaptive Routing in MoE-based Large Vision-Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T01:32:40.435742Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2606.26287"},"observation_digest":"sha256:47db9412db3fd9315383607e229cbc4c8dc564be05412c3805e0eb72224dcc28","observation_id":"ed922655-18c0-4e7f-b4c7-e735a63860d8","resolution":{"observed_at":"2026-07-04T15:39:56.515476Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":"2405.14297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-07-04T15:39:56.514258Z","title":"Dynamic mixture of experts: An auto-tuning approach for efficient transformer models","venue":null,"work_id":"d14f17bf-17d9-4234-9eed-2f53704d5aa4","year":2024},"citing_paper":{"arxiv_id":"2606.29982","last_updated":"2026-06-29T08:57:59Z","snapshot_observed_at":"2026-08-06T21:47:26.917202Z","submitted_at":"2026-06-29T08:57:59Z","title":"Beyond Uniform Experts: Cost-Aware Expert Execution for Efficient Multi-Device MoE Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T04:27:02.915854Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2606.29982"},"observation_digest":"sha256:baa51b060c9f7ecf4a755d3cee4d15cbda5532f5949c7810b8c62dcf3bff2652","observation_id":"20490b7b-c4cc-4db1-a652-fca9da3ff9df","resolution":{"observed_at":"2026-06-30T17:14:57.472706Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2405.14297/citation-record","integrity":"/paper/2405.14297/integrity","json":"/paper/2405.14297/citation-record.json","paper":"/paper/2405.14297"},"outbound":[],"paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T14:47:33.756361Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2405.14297."}