{"as_of":"2026-08-22T15:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fc30c76c39707ceef78d2a400bba56beeffc2650b048121d5601bf22d4e5dbc6","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T17:57:25.255094Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:14:02.870202Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T14:35:55.658485Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10377","snapshot_observed_at":"2026-08-03T04:14:02.870202Z","title":"Dropping experts, recombining neurons: Retraining-free pruning for sparse mixture-of-experts llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05711","last_updated":"2026-07-01T04:46:34Z","snapshot_observed_at":"2026-08-16T15:53:42.438404Z","submitted_at":"2026-02-05T14:37:32Z","title":"OmniMoE: An Efficient MoE by Orchestrating Atomic Experts at Scale","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-03T04:14:02.870202Z"},"links":{"cited_paper":"/paper/2509.10377","citing_paper":"/paper/2602.05711"},"observation_digest":"sha256:f2560c3121c0a6a23e73d38ec5e679796fc510346b8ba22498fec0f56041d939","observation_id":"11382ae6-745f-4052-9da7-9f2f864d48f5","resolution":{"observed_at":"2026-08-03T04:14:02.870202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"cited_work":{"arxiv_id":"2509.10377","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10377","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8c38e87d-3d13-48a4-bea9-a2686b4de461","year":2025},"citing_paper":{"arxiv_id":"2603.06003","last_updated":"2026-04-11T04:36:36Z","snapshot_observed_at":"2026-07-06T22:48:04.438669Z","submitted_at":"2026-03-06T08:02:58Z","title":"EvoESAP: Non-Uniform Expert Pruning for Sparse MoE","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-15T14:34:48.524592Z"},"links":{"cited_paper":"/paper/2509.10377","citing_paper":"/paper/2603.06003"},"observation_digest":"sha256:1f22927c34657871067c3a31ea9797deb52c90f7ecf3a9355c437efd0d8585b6","observation_id":"55a17f90-94f9-499e-97eb-d6f5a6bc7478","resolution":{"observed_at":"2026-05-15T14:35:55.661187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.10377/citation-record","integrity":"/paper/2509.10377/integrity","json":"/paper/2509.10377/citation-record.json","paper":"/paper/2509.10377"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.04836","last_updated":"2023-03-01T22:17:16Z","snapshot_observed_at":"2026-08-18T17:02:34.345199Z","submitted_at":"2022-09-11T10:44:27Z","title":"Git Re-Basin: Merging Models modulo Permutation Symmetries","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.04836","snapshot_observed_at":"2026-08-04T17:57:24.594815Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:24.594815Z"},"links":{"cited_paper":"/paper/2209.04836","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:c90fd05dd7950f9d24b7eb0e1928e892ddf6caff3326c329f74154f85d6274cb","observation_id":"bf48e78e-0b69-4ae9-a2d0-b527a833f4ea","resolution":{"observed_at":"2026-08-04T17:57:24.594815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:24.668959Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:24.668959Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:4e62531233c6c276cc2405e5c035aaed5f8427e65dda5bafb4ca0d38c340cfeb","observation_id":"466e96f0-cd6b-4af6-ba4f-f0e8352ac675","resolution":{"observed_at":"2026-08-04T17:57:24.668959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:24.731000Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:24.731000Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:2beb8e3e5986ecbce699166638cac2c0b891257e35075e34412a42f97428c2ec","observation_id":"2bccc623-be7b-453a-9f6c-9029ea27ee30","resolution":{"observed_at":"2026-08-04T17:57:24.731000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00069","last_updated":"2026-04-18T21:44:35Z","snapshot_observed_at":"2026-08-15T02:30:10.583555Z","submitted_at":"2024-11-26T00:56:18Z","title":"Condense, Don't Just Prune: Enhancing Efficiency and Performance in MoE Layer Pruning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00069","snapshot_observed_at":"2026-08-04T17:57:24.835167Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:24.835167Z"},"links":{"cited_paper":"/paper/2412.00069","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:fb8c93444cc3d3be0fb80c58d8665ffcc607d0cafc36ade495ca1e3d2e94fb8d","observation_id":"18dc9542-dbe7-4ce0-8934-929aa1388199","resolution":{"observed_at":"2026-08-04T17:57:24.835167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:24.895457Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:24.895457Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:99fe1c870f39e02701873e37cf5f3ca52ea270a91d8e9dfda51c64b300f6ef36","observation_id":"627f668c-cf03-4e56-bf81-3ac7bb0a284d","resolution":{"observed_at":"2026-08-04T17:57:24.895457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.00277","last_updated":"2022-06-02T03:44:04Z","snapshot_observed_at":"2026-08-16T16:56:06.467083Z","submitted_at":"2022-06-01T07:09:01Z","title":"Task-Specific Expert Pruning for Sparse Mixture-of-Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.00277","snapshot_observed_at":"2026-08-04T17:57:25.004216Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.004216Z"},"links":{"cited_paper":"/paper/2206.00277","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:8835e590e257f4ab1ee6ff8ad5febf254b6095b00ba3542b5fdb291de205b5f0","observation_id":"908cd80c-7c1c-40df-8dda-7a05ec1c1449","resolution":{"observed_at":"2026-08-04T17:57:25.004216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.019805Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.019805Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:b1dad9fb275f7402ea0fe4cf3e98268c6e9c2560e0e07b4d6860b3dcb216ecec","observation_id":"1d23c995-f4f9-4fcc-8664-25a4f20c7489","resolution":{"observed_at":"2026-08-04T17:57:25.019805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16646","last_updated":"2024-05-30T17:30:42Z","snapshot_observed_at":"2026-08-20T10:44:03.391300Z","submitted_at":"2024-05-26T17:52:58Z","title":"A Provably Effective Method for Pruning Experts in Fine-tuned Sparse Mixture-of-Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16646","snapshot_observed_at":"2026-08-04T17:57:25.024965Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.024965Z"},"links":{"cited_paper":"/paper/2405.16646","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:17aef01ee09b73f13e373fe2144cf85d97492aaef3ef2afe6901efc535d0a2dd","observation_id":"937ebf75-9781-49e1-bfa1-9f6ce591e767","resolution":{"observed_at":"2026-08-04T17:57:25.024965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-08-17T14:44:42.060038Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-04T17:57:25.030025Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.030025Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:0077971177b66670f4017ec00c419d2c5dc9893986cced2947d750c10cc38573","observation_id":"6fa22ee5-0922-44fa-9345-b5d104b3b7e4","resolution":{"observed_at":"2026-08-04T17:57:25.030025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-04T17:57:25.034771Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.034771Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:1e897f27b280e6c80f8b87dca8f56fb4f0dfc9c9bf570fe1889cfb5dfe729080","observation_id":"be2f1e30-cece-42c6-8f40-40d8a7ecbf03","resolution":{"observed_at":"2026-08-04T17:57:25.034771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.047632Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.047632Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:35d0ed996d33f047ae84248c8e92928f4f3dcbbef0f1723bbc3aaf6dbd547c08","observation_id":"042beabb-d61b-4254-8cc3-6117c1bb2b2b","resolution":{"observed_at":"2026-08-04T17:57:25.047632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-08-18T13:55:31.813413Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-04T17:57:25.053312Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.053312Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:c0dba91068b5be7ca8e647975a65e1155b8f0d856fdc27b7f7f9f306c281d8a1","observation_id":"f09e663e-d60c-44cd-af20-4a65f8f92a0c","resolution":{"observed_at":"2026-08-04T17:57:25.053312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.064191Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.064191Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:9e1767dc9e0867b461cf849bc4b02356433f841696a9f74a3ca30d1a5f2e27b6","observation_id":"360a7001-d0d3-4daf-b180-b4ba478c2cb4","resolution":{"observed_at":"2026-08-04T17:57:25.064191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20241","last_updated":"2025-06-25T08:36:12Z","snapshot_observed_at":"2026-08-13T16:56:05.130404Z","submitted_at":"2025-06-25T08:36:12Z","title":"Enhancing Large Language Models through Structured Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20241","snapshot_observed_at":"2026-08-04T17:57:25.068676Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.068676Z"},"links":{"cited_paper":"/paper/2506.20241","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:9408f31417de6bfe1081a4630041518edd7dd96ce1be975f19244127f2567b55","observation_id":"d94c7e28-c8ed-4985-8239-4986049b9868","resolution":{"observed_at":"2026-08-04T17:57:25.068676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.073361Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.073361Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:255a2d0081c099d331da0eb21d8f74d7906cc58c7d01b40df7e3ea5f8e700df9","observation_id":"f5038bc5-5295-49e7-adc2-2e9f36c9abf0","resolution":{"observed_at":"2026-08-04T17:57:25.073361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17298","last_updated":"2025-02-24T16:32:22Z","snapshot_observed_at":"2026-08-22T06:20:03.069108Z","submitted_at":"2025-02-24T16:32:22Z","title":"Delta Decompression for MoE-based LLMs Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17298","snapshot_observed_at":"2026-08-04T17:57:25.077844Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.077844Z"},"links":{"cited_paper":"/paper/2502.17298","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:6ff6caf1d20ebebbcc0fd90560fd257b4477f96a3557e6d6ed3704c4e0ab6027","observation_id":"7bdbe17f-3b3a-4a46-a047-249925abe0b4","resolution":{"observed_at":"2026-08-04T17:57:25.077844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02500","last_updated":"2025-03-17T14:18:42Z","snapshot_observed_at":"2026-08-22T08:19:57.484393Z","submitted_at":"2024-06-04T17:18:40Z","title":"Towards Efficient Mixture of Experts: A Holistic Study of Compression Techniques","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02500","snapshot_observed_at":"2026-08-04T17:57:25.082947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.082947Z"},"links":{"cited_paper":"/paper/2406.02500","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:2f2194b1dd3460c815ea535b4f550e2bf3fbd54ee108ff1b8e175568849ea92e","observation_id":"6aba06ae-3b10-48c2-b60a-d84d17d1e76b","resolution":{"observed_at":"2026-08-04T17:57:25.082947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-04T17:57:25.087985Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.087985Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:91a2ecf9678ab5ffd679ef89ead2ba14fd28a2ed4af6e158fa1a0aad6cb3a005","observation_id":"a83d21a5-8cbe-40cb-b0c2-8cc503c00db2","resolution":{"observed_at":"2026-08-04T17:57:25.087985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.093266Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.093266Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:9b75ceed51e58405503971d7fdd6282a863c8db44c1b5ee9df49b7a699b3d829","observation_id":"a898aaab-472e-45b6-a8bd-490ba004b6a3","resolution":{"observed_at":"2026-08-04T17:57:25.093266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06270","last_updated":"2025-02-22T06:19:05Z","snapshot_observed_at":"2026-08-16T13:11:23.751832Z","submitted_at":"2024-10-08T18:09:38Z","title":"Mixture Compressor for Mixture-of-Experts LLMs Gains More","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06270","snapshot_observed_at":"2026-08-04T17:57:25.097951Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.097951Z"},"links":{"cited_paper":"/paper/2410.06270","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:6aff5842fa43b797ba372d53ecee819cee6e593cdabe5942f6f73ac3888581bb","observation_id":"a31b5f8a-3e13-44aa-86c8-70f30982774c","resolution":{"observed_at":"2026-08-04T17:57:25.097951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-04T17:57:25.103790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.103790Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:0800c4856be616a0667336d2ce2ad5abfe8007de6b7b8e4a1c4fd507a129e649","observation_id":"579d5f38-9307-4dc3-9105-4db8d017c367","resolution":{"observed_at":"2026-08-04T17:57:25.103790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.108836Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.108836Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:540cd2b768e990f18f0eaf5ae3d6ccca288a9674666c68216b2b86f477f19d19","observation_id":"ed0a51ce-2bb7-47f3-a67a-2f571bdd768d","resolution":{"observed_at":"2026-08-04T17:57:25.108836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01334","last_updated":"2024-03-14T11:01:15Z","snapshot_observed_at":"2026-08-20T10:55:28.655861Z","submitted_at":"2023-10-02T16:51:32Z","title":"Merge, Then Compress: Demystify Efficient SMoE with Hints from Its Routing Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01334","snapshot_observed_at":"2026-08-04T17:57:25.113322Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.113322Z"},"links":{"cited_paper":"/paper/2310.01334","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:839242f2288f4ae7e4df0f54d06dc54375b779fe520247d012eeb06bdb1eb84f","observation_id":"1d054ccb-b942-499f-a29d-6e18b595ffc3","resolution":{"observed_at":"2026-08-04T17:57:25.113322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.118540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.118540Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:0ae1bb0551bfc331ed334ac04105ebdc6c8528df40070eb94f7aaabb9406f518","observation_id":"dd9e411a-dd3e-46f0-be74-774c7a56a097","resolution":{"observed_at":"2026-08-04T17:57:25.118540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.122791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.122791Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:59e67c03fd50cd1b8f2d6e519130174d53f004a6d87f538df0ea90d9a7df5e80","observation_id":"efafb95a-c198-4414-bad4-e54edd43d164","resolution":{"observed_at":"2026-08-04T17:57:25.122791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.127723Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.127723Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:9ae798474f0871e5430684cf50012a9f33156e11f8297ec873bf2305a2d8333f","observation_id":"65736905-6bd2-43c5-9f58-6fb9e04ed6bc","resolution":{"observed_at":"2026-08-04T17:57:25.127723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.133608Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.133608Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:d25619d7f8bb53f15fa94e0c040e2a98b476c959b1e037c2adaa1b7fe65ef190","observation_id":"eb438bf1-619e-47cf-a254-589dc0b72d80","resolution":{"observed_at":"2026-08-04T17:57:25.133608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07605","last_updated":"2025-03-10T17:59:03Z","snapshot_observed_at":"2026-08-16T12:51:24.396740Z","submitted_at":"2025-03-10T17:59:03Z","title":"SEAP: Training-free Sparse Expert Activation Pruning Unlock the Brainpower of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07605","snapshot_observed_at":"2026-08-04T17:57:25.137742Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.137742Z"},"links":{"cited_paper":"/paper/2503.07605","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:04014d57289b4f231c1d3da8495539e7612d641c68d5f5ee582ed0a0f22de787","observation_id":"d2ed7b9a-afbb-42ac-a504-ba2da156393d","resolution":{"observed_at":"2026-08-04T17:57:25.137742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-04T17:57:25.142456Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.142456Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:787443d52e9f0cf91ec07eda7f0ecce18451afe405f1a4918cf2c6721914465a","observation_id":"85bede88-5042-444a-81ed-6c89262a02bb","resolution":{"observed_at":"2026-08-04T17:57:25.142456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00945","last_updated":"2024-07-01T03:57:35Z","snapshot_observed_at":"2026-08-16T13:38:16.914876Z","submitted_at":"2024-07-01T03:57:35Z","title":"Efficient Expert Pruning for Sparse Mixture-of-Experts Language Models: Enhancing Performance and Reducing Inference Costs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00945","snapshot_observed_at":"2026-08-04T17:57:25.147648Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.147648Z"},"links":{"cited_paper":"/paper/2407.00945","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:18377bf71de6c95f878fb2491e95b7895afdfa03e17f180f04422ff9090ecb42","observation_id":"b966d609-c9b1-400b-9d19-4d782f931642","resolution":{"observed_at":"2026-08-04T17:57:25.147648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18219","last_updated":"2025-06-21T07:56:18Z","snapshot_observed_at":"2026-08-16T13:39:29.452417Z","submitted_at":"2024-06-26T10:07:57Z","title":"A Closer Look into Mixture-of-Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18219","snapshot_observed_at":"2026-08-04T17:57:25.153185Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.153185Z"},"links":{"cited_paper":"/paper/2406.18219","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:b5d307cc2008951cb6fc5508ff975aa27dd8081134b2d87d0e21207590bee7ea","observation_id":"339fbb8d-4a5f-44cb-8f36-47fdd420d8e1","resolution":{"observed_at":"2026-08-04T17:57:25.153185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14800","last_updated":"2024-05-30T16:24:16Z","snapshot_observed_at":"2026-08-19T18:34:21.827475Z","submitted_at":"2024-02-22T18:56:07Z","title":"Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14800","snapshot_observed_at":"2026-08-04T17:57:25.160350Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.160350Z"},"links":{"cited_paper":"/paper/2402.14800","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:b0c4b89d5a7e836b6b96ed848c5c0b4b4e9d6d26600851a5e29530d67885226f","observation_id":"0283ff76-3549-4e48-8be1-a5c9d2fb79ea","resolution":{"observed_at":"2026-08-04T17:57:25.160350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15558","last_updated":"2024-11-23T13:31:16Z","snapshot_observed_at":"2026-08-13T09:12:29.363596Z","submitted_at":"2024-11-23T13:31:16Z","title":"Reassessing Layer Pruning in LLMs: New Insights and Methods","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15558","snapshot_observed_at":"2026-08-04T17:57:25.164991Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.164991Z"},"links":{"cited_paper":"/paper/2411.15558","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:1acd711b5a5ef8d5c3105a3e98e12dab4ffbb64c2e98195e2f023332769dfcbd","observation_id":"f0dfaeab-3c9a-43e5-82a7-4e052e5f32a5","resolution":{"observed_at":"2026-08-04T17:57:25.164991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.170241Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.170241Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:9e0c5329b0414368c8a7e51fb35d6882c0c9f21d73efe5a95ca479b733c6a8ba","observation_id":"d71b0ce6-75fd-4f3f-8df1-ed15f3101898","resolution":{"observed_at":"2026-08-04T17:57:25.170241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.175846Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.175846Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:0de822891f219e4e4190b81d254014cf4397915ca65e8104f3be0936fe47593e","observation_id":"66f656e5-96d6-49d0-8ef0-1146817ec954","resolution":{"observed_at":"2026-08-04T17:57:25.175846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-14T07:00:02.529732Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-04T17:57:25.180650Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.180650Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:c2b02e07c3e8a84d4ef162fda5d144e6d6110ee83cb264dc92745e8189ed7b66","observation_id":"f0b20185-3194-4438-bf50-8eb0afdb05c2","resolution":{"observed_at":"2026-08-04T17:57:25.180650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.185203Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.185203Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:1cd98e47c1978bad7ff9815dbeeb025429ab9a4a4b3953ad08bd562ffb07b7f2","observation_id":"73e63b12-686f-4254-9ef1-67a4c922ae3b","resolution":{"observed_at":"2026-08-04T17:57:25.185203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08998","last_updated":"2025-03-12T02:17:31Z","snapshot_observed_at":"2026-08-19T09:04:32.084774Z","submitted_at":"2025-03-12T02:17:31Z","title":"From Task-Specific Models to Unified Systems: A Review of Model Merging Approaches","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08998","snapshot_observed_at":"2026-08-04T17:57:25.190738Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.190738Z"},"links":{"cited_paper":"/paper/2503.08998","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:3e162cfca6bcc323925e764f707b9cab7b2d455398f31debdb08d501a6078319","observation_id":"0ccbf1cf-3a24-4622-b68b-147a3b87ef4f","resolution":{"observed_at":"2026-08-04T17:57:25.190738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.195584Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.195584Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:1896edd34c6a24664931a272d5a79f033c690ce1300cd3f4dadfc794425f1a54","observation_id":"dd8df2a2-b520-4b9c-beef-e1ee2c50ed48","resolution":{"observed_at":"2026-08-04T17:57:25.195584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-19T12:32:00.517027Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-04T17:57:25.200825Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.200825Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:fdbd8038d6674e9a866bcb3ac8c468ec181524075bd5514eb2ff02c3645c4040","observation_id":"7abf9dbe-ece2-4d9d-b8d4-98ebfb8a0ddf","resolution":{"observed_at":"2026-08-04T17:57:25.200825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-08-20T04:15:03.506960Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-04T17:57:25.205681Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.205681Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:533f0b3932df8a3265034facc69bbd25cc45c2ab11b8e7d2b74ef1c33dfe0d84","observation_id":"ebb09801-678f-47d2-841b-1f097f2258ae","resolution":{"observed_at":"2026-08-04T17:57:25.205681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.210288Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.210288Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:8c3c6b20b9aa76d61dc225f5f66d725f31e5ae6f4cf53d6c571080443c893682","observation_id":"37f397d3-582a-44e3-8af6-adc426ac2799","resolution":{"observed_at":"2026-08-04T17:57:25.210288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12013","last_updated":"2024-10-15T19:22:27Z","snapshot_observed_at":"2026-08-16T13:09:03.103606Z","submitted_at":"2024-10-15T19:22:27Z","title":"MoE-Pruner: Pruning Mixture-of-Experts Large Language Model using the Hints from Its Router","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12013","snapshot_observed_at":"2026-08-04T17:57:25.214956Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.214956Z"},"links":{"cited_paper":"/paper/2410.12013","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:da42ae7990b3e970c9dc13823ef2cb9d2e7dfbe7e16e4c38817655cb6520f8a7","observation_id":"08c9e74e-3e7c-44c8-9e29-d72f963ee022","resolution":{"observed_at":"2026-08-04T17:57:25.214956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-04T17:57:25.219776Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.219776Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:3a34aa07203f8ed4531e0a30959a0518382be4d73ed630d3e24b890a282c8c0b","observation_id":"3d273610-bb58-42c6-9c14-550ee648fdfe","resolution":{"observed_at":"2026-08-04T17:57:25.219776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01016","last_updated":"2024-11-01T20:37:58Z","snapshot_observed_at":"2026-08-16T13:03:40.201366Z","submitted_at":"2024-11-01T20:37:58Z","title":"MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01016","snapshot_observed_at":"2026-08-04T17:57:25.224160Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.224160Z"},"links":{"cited_paper":"/paper/2411.01016","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:fdc6bed5a455e63ba9968a811fc22b924ccb55522728981a2a46b69c5de950ab","observation_id":"c3df6d3c-33f2-43a4-89fc-75718c3ca28c","resolution":{"observed_at":"2026-08-04T17:57:25.224160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.228652Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.228652Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:c04e3019d2625bd99e155edf04eb5ec6249cf31f5b614db186f3886e42f719b1","observation_id":"1d0156df-6286-4c81-8de3-9e49c397941f","resolution":{"observed_at":"2026-08-04T17:57:25.228652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-04T17:57:25.232821Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.232821Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:ceecd36bad3095103aeba27c756fec5251340a884469f5db9b5925ba53bedf06","observation_id":"9bc4d272-ba4c-4662-8227-240cfce9a586","resolution":{"observed_at":"2026-08-04T17:57:25.232821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.237108Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.237108Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:3f6ccd476903b1aca7a78d3bffe5e4788d6a5fe44a08615362e4af40fd38b6eb","observation_id":"f5d242e3-0bbb-487b-ae5c-e2bf044ea548","resolution":{"observed_at":"2026-08-04T17:57:25.237108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16167","last_updated":"2024-10-22T02:29:22Z","snapshot_observed_at":"2026-08-21T13:01:10.620925Z","submitted_at":"2024-09-24T15:08:41Z","title":"Merging LoRAs like Playing LEGO: Pushing the Modularity of LoRA to Extremes Through Rank-Wise Clustering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16167","snapshot_observed_at":"2026-08-04T17:57:25.241225Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.241225Z"},"links":{"cited_paper":"/paper/2409.16167","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:609699e5ad1bc14de8b1a61833c22b6d503d7995ce90078181d0a40157f37f9d","observation_id":"082a5ad0-e22f-4980-99a6-b3ab8d3e15f9","resolution":{"observed_at":"2026-08-04T17:57:25.241225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15103","last_updated":"2025-06-19T04:00:52Z","snapshot_observed_at":"2026-08-16T04:45:50.225037Z","submitted_at":"2025-01-25T06:56:39Z","title":"Each Rank Could be an Expert: Single-Ranked Mixture of Experts LoRA for Multi-Task Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15103","snapshot_observed_at":"2026-08-04T17:57:25.245487Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.245487Z"},"links":{"cited_paper":"/paper/2501.15103","citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:1c799d7cce47cc40b9c8791e813c226e6362c232f255b26a2d44982fb977ffbd","observation_id":"cf65be58-0a90-4f4b-a38d-d32fbfe1f93c","resolution":{"observed_at":"2026-08-04T17:57:25.245487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.250322Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.250322Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:0d2a3dc6f680fbf14e36347cc692ad70411890a28b941ed32ab3c67b989bf416","observation_id":"52775d87-3003-44ef-999a-08a84882c0a1","resolution":{"observed_at":"2026-08-04T17:57:25.250322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:57:25.255094Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T17:57:25.255094Z"},"links":{"citing_paper":"/paper/2509.10377"},"observation_digest":"sha256:b60e7d3540a4f4189e3253418d4485c416048d02fb81e889c3e07432145aec2e","observation_id":"0a1667ec-1b23-4a51-990d-e3107a455d2a","resolution":{"observed_at":"2026-08-04T17:57:25.255094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.10377","last_updated":"2025-09-12T16:09:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T01:06:20.404584Z","submitted_at":"2025-09-12T16:09:39Z","title":"Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 2 inbound Pith citation observations for arXiv:2509.10377."}