{"as_of":"2026-08-09T19:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c139b6bd4cba73aacd148367f0e27f7dd0837a8859f3d4c3f30145543b7a3a54","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:23:01.959332Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T15:39:56.545642Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-07T14:23:01.959332Z","title":"Moe++: Accelerat- ing mixture-of-experts methods with zero-computation experts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-09T05:11:07.503123Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.959332Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:c26687f54fb5b49a12b0934e0c9f096be3684efc0d5b54f255820d07508feca5","observation_id":"71aaedb7-2d88-46d6-b444-47c72670721f","resolution":{"observed_at":"2026-08-07T14:23:01.959332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-05T21:55:10.476732Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-09T17:03:23.397293Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.476732Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:e4f885d0f81b3e28b245bef1cab1e1f6e268622cf39647bdc5f71aceefe6f04b","observation_id":"60b066d4-cd5a-4f24-bb97-1ac7c5b0d370","resolution":{"observed_at":"2026-08-05T21:55:10.476732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-04T14:50:27.505927Z","title":"MoE++: Accelerating mixture-of-experts methods with zero- computa- tion experts.arXiv preprint arXiv:2410.07348,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02345","last_updated":"2026-07-21T06:35:53Z","snapshot_observed_at":"2026-08-04T14:50:24.826478Z","submitted_at":"2025-09-27T10:45:58Z","title":"Breaking the MoE LLM Trilemma: Dynamic Expert Clustering with Structured Compression","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T14:50:27.505927Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2510.02345"},"observation_digest":"sha256:41a54c3dad0cf175d31d3e41a4d2ea4d9a2e9556c9f94fdf9c414c393aa25e78","observation_id":"85905def-4ea5-47ee-a46e-70d9ec76f4c0","resolution":{"observed_at":"2026-08-04T14:50:27.505927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-03T16:21:31.465156Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13996","last_updated":"2026-06-01T21:50:10Z","snapshot_observed_at":"2026-08-07T19:01:52.521673Z","submitted_at":"2025-12-16T01:28:57Z","title":"DTop-p MoE: Sparsity-Controlled Dynamic Top-p MoE for Foundation Model Pre-training","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T16:21:31.465156Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2512.13996"},"observation_digest":"sha256:55537bc22dc1a020578a13fc6ca9e8f27d362475bd003559b5edcd16e803f904","observation_id":"24186a55-4f05-4d73-90d4-135a963d702b","resolution":{"observed_at":"2026-08-03T16:21:31.465156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2602.12708","last_updated":"2026-04-21T10:44:04Z","snapshot_observed_at":"2026-08-08T06:19:20.150911Z","submitted_at":"2026-02-13T08:21:20Z","title":"Mixture of Predefined Experts: Maximizing Data Usage on Vertical Federated Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T01:54:30.814618Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2602.12708"},"observation_digest":"sha256:017de0ee62aa95620182211c66f73d3a650470ed2bbeb037997751c5078309c1","observation_id":"9f44f3c4-82db-47f7-9b8c-1fa6d85b74e3","resolution":{"observed_at":"2026-05-16T01:57:06.084930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2605.08585","last_updated":"2026-05-09T01:05:34Z","snapshot_observed_at":"2026-07-06T23:20:47.880233Z","submitted_at":"2026-05-09T01:05:34Z","title":"PromptDx: Differentiable Prompt Tuning for Multimodal In-Context Alzheimer's Diagnosis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T01:03:23.712417Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2605.08585"},"observation_digest":"sha256:f23e61b85c784858bbff3226c0c5a2c24638245b0ef11628a682c1a97d9f93ab","observation_id":"a7fea64c-5bf2-4891-9d32-8204ab5c53be","resolution":{"observed_at":"2026-05-12T08:31:24.521393Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2605.14438","last_updated":"2026-05-14T06:33:41Z","snapshot_observed_at":"2026-08-06T21:01:38.107284Z","submitted_at":"2026-05-14T06:33:41Z","title":"BEAM: Binary Expert Activation Masking for Dynamic Routing in MoE","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T01:59:33.047821Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2605.14438"},"observation_digest":"sha256:39417ae7a0c8702eff2f74ac34f7fbcb8bc9e2620343e076e1f949ca7f1bf44b","observation_id":"af064616-f770-404a-bf6c-f6cbf52f64a2","resolution":{"observed_at":"2026-05-15T01:59:38.671477Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T12:00:35.496822Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:9e7a9dab8fc1f8adc86196cd3d36c6db7d275127d813b6a6826b5ba46d91272d","observation_id":"2a71f0ac-5951-4357-8cb4-d3b8b1a84efd","resolution":{"observed_at":"2026-05-20T12:03:15.161526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T18:22:45.702572Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:ce8b5a3dc97bd7b4437819dc013c97951946e1468509bbe74a0b889b1c3a36bc","observation_id":"36ffc0eb-8178-4bbe-b71c-02d2dee019d9","resolution":{"observed_at":"2026-06-30T18:25:00.030441Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2606.26287","last_updated":"2026-06-24T18:34:00Z","snapshot_observed_at":"2026-07-07T00:00:36.766142Z","submitted_at":"2026-06-24T18:34:00Z","title":"GeMoE: Gating Entropy is All You Need for Uncertainty-aware Adaptive Routing in MoE-based Large Vision-Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T01:32:40.435742Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2606.26287"},"observation_digest":"sha256:21161dc03ef1f8f639ef5556d15c394a2326b36accccfbe54689ffca076f391f","observation_id":"0425ad2c-0526-4edb-9692-949509b196cb","resolution":{"observed_at":"2026-07-04T15:39:56.547923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":"2410.07348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-07-04T15:39:56.545642Z","title":"Moe++: Accelerating mixture-of-experts methods with zero-computation experts.arXiv preprint arXiv:2410.07348","venue":null,"work_id":"7ba444bf-cbd6-46c5-b497-a5d15eaae3fc","year":2024},"citing_paper":{"arxiv_id":"2607.00371","last_updated":"2026-07-01T03:11:21Z","snapshot_observed_at":"2026-08-02T15:32:07.000409Z","submitted_at":"2026-07-01T03:11:21Z","title":"MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-02T15:14:36.946247Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2607.00371"},"observation_digest":"sha256:603711a0d0f2becb9af0277553d44870299abe009698cda130a6137eea77719d","observation_id":"f64a9024-9b81-4c66-a70c-9ad90887a5ed","resolution":{"observed_at":"2026-07-02T15:17:07.214080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.07348/citation-record","integrity":"/paper/2410.07348/integrity","json":"/paper/2410.07348/citation-record.json","paper":"/paper/2410.07348"},"outbound":[],"paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T18:32:34.607901Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2410.07348."}