{"as_of":"2026-08-09T20:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:51daf58be3953c18d268cd24dc650c1a1455852bd93778ff02f92392c941abbd","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:21:00.819871Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:39:37.881836Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","snapshot_observed_at":"2026-08-02T07:28:14.092271Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18219","snapshot_observed_at":"2026-08-09T10:21:00.819871Z","title":"M., Huang, Z., Qiu, Z., Wang, Z., and Fu, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03009","last_updated":"2025-06-16T05:27:08Z","snapshot_observed_at":"2026-08-09T14:19:35.717054Z","submitted_at":"2025-02-05T09:11:13Z","title":"Scaling Laws for Upcycling Mixture-of-Experts Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T10:21:00.819871Z"},"links":{"cited_paper":"/paper/2406.18219","citing_paper":"/paper/2502.03009"},"observation_digest":"sha256:fcd026c4b16c45f047f76a52ace956533b2b3e1686d9ec7e5251c3de34cd7dae","observation_id":"86a159af-e51a-4f7d-8607-56031be5fcbe","resolution":{"observed_at":"2026-08-09T10:21:00.819871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","snapshot_observed_at":"2026-08-02T07:28:14.092271Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18219","snapshot_observed_at":"2026-08-07T12:24:25.948999Z","title":"A closer look into mixture-of-experts in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24597","last_updated":"2025-05-30T13:45:19Z","snapshot_observed_at":"2026-08-07T23:31:01.218741Z","submitted_at":"2025-05-30T13:45:19Z","title":"Mixture-of-Experts for Personalized and Semantic-Aware Next Location Prediction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:24:25.948999Z"},"links":{"cited_paper":"/paper/2406.18219","citing_paper":"/paper/2505.24597"},"observation_digest":"sha256:d1bb0dc090738e1a1b1f8261762f2265b7ecbc8cc9d116567d05a4906973fa74","observation_id":"ec443fce-a8f8-4549-9e04-c940d73cd137","resolution":{"observed_at":"2026-08-07T12:24:25.948999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","snapshot_observed_at":"2026-08-02T07:28:14.092271Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18219","snapshot_observed_at":"2026-08-07T06:07:18.709996Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06406","last_updated":"2025-06-25T12:36:55Z","snapshot_observed_at":"2026-08-07T11:49:17.219924Z","submitted_at":"2025-06-06T12:47:29Z","title":"SMAR: Soft Modality-Aware Routing Strategy for MoE-based Multimodal Large Language Models Preserving Language Capabilities","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T06:07:18.709996Z"},"links":{"cited_paper":"/paper/2406.18219","citing_paper":"/paper/2506.06406"},"observation_digest":"sha256:2e97b69dbb84dd844ff126a710afd2253424c5e78c8b493d8ae189f7483fa136","observation_id":"7c5d21b5-ee39-46db-9910-25539fd7d7f2","resolution":{"observed_at":"2026-08-07T06:07:18.709996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","snapshot_observed_at":"2026-08-02T07:28:14.092271Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.18219","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.18219","snapshot_observed_at":"2026-07-04T06:39:37.881836Z","title":"A closer look into mixture-of-experts in large language models","venue":null,"work_id":"c9847286-170d-4bea-92f5-92e4cf056620","year":2025},"citing_paper":{"arxiv_id":"2506.12119","last_updated":"2026-05-17T08:18:55Z","snapshot_observed_at":"2026-08-02T23:22:23.397250Z","submitted_at":"2025-06-13T17:59:05Z","title":"Mixture-of-Experts Can Surpass Dense LLMs Under Strictly Equal Resource","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T00:05:08.916339Z"},"links":{"cited_paper":"/paper/2406.18219","citing_paper":"/paper/2506.12119"},"observation_digest":"sha256:80f8e6ed6731c9c8b1a7d5bbdc696ff34e2dd373c57556407d3e888eb865f85c","observation_id":"e6474934-de1e-434c-a960-ef13542efa22","resolution":{"observed_at":"2026-05-22T00:05:47.615634Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","snapshot_observed_at":"2026-08-02T07:28:14.092271Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18219","snapshot_observed_at":"2026-08-04T23:09:41.548125Z","title":"A closer look into mixture-of-experts in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06807","last_updated":"2025-09-08T15:39:17Z","snapshot_observed_at":"2026-08-09T10:59:34.311406Z","submitted_at":"2025-09-08T15:39:17Z","title":"MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T23:09:41.548125Z"},"links":{"cited_paper":"/paper/2406.18219","citing_paper":"/paper/2509.06807"},"observation_digest":"sha256:5e77cc3d36f992276ea2f85aa7f01bfd796b66679bf56baa0b457e0151a4bfc1","observation_id":"10d452d0-ad48-457a-9e2f-2a8516dd405b","resolution":{"observed_at":"2026-08-04T23:09:41.548125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","snapshot_observed_at":"2026-08-02T07:28:14.092271Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18219","snapshot_observed_at":"2026-08-04T17:57:25.153185Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.153185Z"},"links":{"cited_paper":"/paper/2406.18219","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:91c686ade53992f2060bfe5b95595ae54fcfee60d0be8d7479559b0a2d9b5802","observation_id":"339fbb8d-4a5f-44cb-8f36-47fdd420d8e1","resolution":{"observed_at":"2026-08-04T17:57:25.153185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","snapshot_observed_at":"2026-08-02T07:28:14.092271Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.18219","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.18219","snapshot_observed_at":"2026-07-04T06:39:37.881836Z","title":"A closer look into mixture-of-experts in large language models","venue":null,"work_id":"c9847286-170d-4bea-92f5-92e4cf056620","year":2025},"citing_paper":{"arxiv_id":"2605.20610","last_updated":"2026-05-20T01:55:40Z","snapshot_observed_at":"2026-08-05T11:22:57.551703Z","submitted_at":"2026-05-20T01:55:40Z","title":"Beyond Routing: Characterising Expert Tuning and Representation in Vision Mixture-of-Experts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:18.498128Z"},"links":{"cited_paper":"/paper/2406.18219","citing_paper":"/paper/2605.20610"},"observation_digest":"sha256:1327990a28850dbe2c07adbced4c32e783ef1f27e01d69f809ada275ffd0e26b","observation_id":"a68fe7f1-95c8-46f6-8f5e-d2d02eae5b13","resolution":{"observed_at":"2026-05-21T05:59:41.014829Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","snapshot_observed_at":"2026-08-02T07:28:14.092271Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.18219","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.18219","snapshot_observed_at":"2026-07-04T06:39:37.881836Z","title":"A closer look into mixture-of-experts in large language models","venue":null,"work_id":"c9847286-170d-4bea-92f5-92e4cf056620","year":2025},"citing_paper":{"arxiv_id":"2606.21645","last_updated":"2026-06-19T17:56:44Z","snapshot_observed_at":"2026-08-05T10:02:01.473600Z","submitted_at":"2026-06-19T17:56:44Z","title":"Behavioral and Representational Evidence of Binomial Ordering Preferences in Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-26T14:18:11.215278Z"},"links":{"cited_paper":"/paper/2406.18219","citing_paper":"/paper/2606.21645"},"observation_digest":"sha256:1292c522fe778cf105216db20b857368e2ea06a996ce707d8e2ff419596959f9","observation_id":"febd5a1b-5426-4163-8507-3f86ff78040e","resolution":{"observed_at":"2026-07-04T06:39:37.883108Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2406.18219/citation-record","integrity":"/paper/2406.18219/integrity","json":"/paper/2406.18219/citation-record.json","paper":"/paper/2406.18219"},"outbound":[],"paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T07:28:14.092271Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2406.18219."}