{"as_of":"2026-08-10T05:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fb2d6e4b482849e219884b78576a24f4f343944eed522163de71f15221593bfa","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:59:18.904741Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T17:09:33.923627Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09351","snapshot_observed_at":"2026-08-03T17:09:33.923627Z","title":"Dive into moe: Diversity-enhanced reconstruction of large language mod- els from dense into mixture-of-experts.arXiv preprint arXiv:2506.09351, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10548","last_updated":"2026-05-23T16:19:27Z","snapshot_observed_at":"2026-08-09T18:59:31.056898Z","submitted_at":"2025-12-11T11:27:25Z","title":"Blink: Dynamic Visual Token Resolution for Enhanced Multimodal Understanding","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T17:09:33.923627Z"},"links":{"cited_paper":"/paper/2506.09351","citing_paper":"/paper/2512.10548"},"observation_digest":"sha256:e3fd0ae7d4c7d64a5fcdb96674bf2b01e2e4d7b09878543b1e2cf0345de5f653","observation_id":"c15a0393-fed7-4933-8ab4-c68253dc1815","resolution":{"observed_at":"2026-08-03T17:09:33.923627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09351/citation-record","integrity":"/paper/2506.09351/integrity","json":"/paper/2506.09351/citation-record.json","paper":"/paper/2506.09351"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1803.08375","last_updated":"2026-04-14T12:21:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-22T14:30:17Z","title":"Deep Learning using Rectified Linear Units (ReLU)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08375","snapshot_observed_at":"2026-08-07T04:59:13.489818Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:13.489818Z"},"links":{"cited_paper":"/paper/1803.08375","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:1bc71088155c353a706cc7ace04ccff63596193e8372635fb16ab3ce76474993","observation_id":"37bb7594-ad75-4074-a5da-e7bed7a47b9d","resolution":{"observed_at":"2026-08-07T04:59:13.489818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:13.638648Z","title":"Khatamifard, Minsik Cho, Carlo C Del Mundo, Mohammad Rastegari, and Mehrdad Farajtabar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:13.638648Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:1b73b3e1ff64c347074c5d12331cd975e40f3f414d34a4a9b560bf48f46a8b38","observation_id":"c0317fc8-f6e7-41c0-82e5-89a3a2878695","resolution":{"observed_at":"2026-08-07T04:59:13.638648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:13.756394Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:13.756394Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:34ffae4eabd7a4f98fc2c3d05e76a6a96b7f69e3556a1146094af56904320d66","observation_id":"8947c231-69b6-4036-8705-0ef4500d6af4","resolution":{"observed_at":"2026-08-07T04:59:13.756394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:13.877208Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:13.877208Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:fa7ccada8092956f9e3f8b2ede65443967bf2da8d8b375762116d94b219a2144","observation_id":"d27e84bd-baa8-45b5-b6f9-91ccfeb3d09f","resolution":{"observed_at":"2026-08-07T04:59:13.877208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:21.702444Z","title":null,"venue":null,"work_id":"6723386b-42c1-4c3d-abb4-db9fc7258b20","year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.041580Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:8d20e3342e7a49f320858707fc8ffff4e0d6fa46eec68c5dadc4f85449b9d7fc","observation_id":"6b72537c-c43e-4b78-b3df-9ada06448ac6","resolution":{"observed_at":"2026-08-07T04:59:21.815095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.164066Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.164066Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:507b9bca6b60a8dffd8aa5f1b82939af869c39b34cd0187b485f260ef8e6b78a","observation_id":"d3dd5ae3-1a26-47cc-acb0-30f0de724ee0","resolution":{"observed_at":"2026-08-07T04:59:14.164066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T04:59:14.289861Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.289861Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:cb220d59c7c631a02822a50fdf956abb549f74db104e5d012e8ad6a012fb5eb3","observation_id":"e6a8421c-1077-409b-9583-f88003c00e48","resolution":{"observed_at":"2026-08-07T04:59:14.289861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T04:59:14.407448Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.407448Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:b4b62936fd96bd7371d33190a95a5ebc272b660b8d055fd91fa8e0f552630146","observation_id":"ab7bcf53-64f5-4f3d-955b-7d36302d8d7d","resolution":{"observed_at":"2026-08-07T04:59:14.407448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.497381Z","title":"Smith, and Matt Gardner","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.497381Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:872413d55c858b2c591f910a9ac78d78fd9792dec00f30e00cf6b4ce7594a1b4","observation_id":"bea11bf4-e279-4190-9a23-52cc0acec178","resolution":{"observed_at":"2026-08-07T04:59:14.497381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02628","last_updated":"2023-07-05T19:59:09Z","snapshot_observed_at":"2026-07-06T15:50:49.116859Z","submitted_at":"2023-07-05T19:59:09Z","title":"SkipDecode: Autoregressive Skip Decoding with Batching and Caching for Efficient LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02628","snapshot_observed_at":"2026-08-07T04:59:14.591057Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.591057Z"},"links":{"cited_paper":"/paper/2307.02628","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:3537f22b1c00cc1f24570fe0a4e59723e81634e29de4d8aa146c5f738349873f","observation_id":"f4905ae9-ab05-421f-bcd0-23469d277d8a","resolution":{"observed_at":"2026-08-07T04:59:14.591057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.708247Z","title":"Dolan and Chris Brockett","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.708247Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:5ddb389412a09ceff5d8b3ab9dda957fc9f10f9653ab463b161c760c2c2fb64b","observation_id":"1bbae2ab-6eb4-4670-99c1-d2dad5a30f13","resolution":{"observed_at":"2026-08-07T04:59:14.708247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.820033Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.820033Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:9d75a0d40c693cee2890f60e5ca471ca9d733418ef686424f59b3af87f3e0c61","observation_id":"e5104f6f-56c2-4918-8b24-ad045525579c","resolution":{"observed_at":"2026-08-07T04:59:14.820033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:14.902196Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:14.902196Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:5118ad1af2dfc9ee1065eed80abfa1ab6cd8e0b2c8ce019090dbd0089fa2e91f","observation_id":"67ea4802-e668-4bd2-89b9-bbcc9e3d19cf","resolution":{"observed_at":"2026-08-07T04:59:14.902196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:21.475978Z","title":null,"venue":null,"work_id":"a19b14e0-5d31-481b-8608-383c3533e6a7","year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.047779Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:b954d4e095f1503f002193b056ae147637815e0ab176d5a7dafc61d080d5a686","observation_id":"77bbb43f-5e79-4fb1-a519-e08769290fb0","resolution":{"observed_at":"2026-08-07T04:59:21.582905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.116910Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.116910Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:eeb4219924c2d6ab374de9e42c3885151547caf4e208bae0408f05640eef9d67","observation_id":"a6555135-76ab-42be-9d3a-eb989a28f791","resolution":{"observed_at":"2026-08-07T04:59:15.116910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.219941Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.219941Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:ec889308f76b14fcf75288dc4988a8fc7bb810586bed8fb02f5c34a9d3dd10f6","observation_id":"00148325-c4a5-4cce-af20-e0d1be6754cc","resolution":{"observed_at":"2026-08-07T04:59:15.219941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T04:59:15.311729Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.311729Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:3fe808e825dbfd1f8afeaab9a28ae8353264e81ee5c83b3fd6b6cc21d97c2605","observation_id":"127eaace-2b71-4175-9da8-cc202d6a6819","resolution":{"observed_at":"2026-08-07T04:59:15.311729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.380273Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.380273Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:d4bb4dc6d3bbca35a9abb98eee53dcfba826268256b7cb145a0898cb83fcac1d","observation_id":"14606bf8-8a88-42aa-8175-d6ad549c56bf","resolution":{"observed_at":"2026-08-07T04:59:15.380273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:21.240059Z","title":null,"venue":null,"work_id":"ef9b2054-d024-4097-a6e9-833f6a81c646","year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.446876Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:810efd148d4038f433a3004499aa044764710b45626fbae9963fa80dec843342","observation_id":"cec1d0f5-1f4a-4e2a-8237-5f67467dcfed","resolution":{"observed_at":"2026-08-07T04:59:21.351536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.504085Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.504085Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:5b19f7ed4950a50fb07457422f6197283232be86ea597ce372f9cea3cd5f8e60","observation_id":"373b1bed-98de-430f-b395-f4be64b731b7","resolution":{"observed_at":"2026-08-07T04:59:15.504085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.596728Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.596728Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:7be49862958c727774453d2d119cbb99e8e185c437560762e58f3ace34356bd2","observation_id":"5eab4b33-21e0-4f20-820e-b6bd5cc734f8","resolution":{"observed_at":"2026-08-07T04:59:15.596728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.951445Z","title":null,"venue":null,"work_id":"84156d7c-4828-405a-93e9-196c00477bd6","year":2021},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.697818Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:acb6cd5dcb83d543f8a3728a5b7988b115ad1879ae6925eb4086094074527f3d","observation_id":"4d496967-6a9b-4cc0-a0d6-dcc132602958","resolution":{"observed_at":"2026-08-07T04:59:21.090739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:15.780729Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.780729Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:ccf22fa23a93fd9f90446c840e210d2ae252c19459dcfa729af636111dcebb21","observation_id":"e8821c06-531e-4ec1-aa9b-97c8b76f9fed","resolution":{"observed_at":"2026-08-07T04:59:15.780729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"hash/4495695","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:19.771454Z","title":null,"venue":null,"work_id":"9b1ffc94-2af5-4931-8d2b-5f3ad64d0fe2","year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.856979Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:2b59532d66868922cd7e38c6c7d677dae7987a4cc8e1f5c8a6a12b9f0de2a05e","observation_id":"507896b2-42e8-4640-839c-6544806c7c16","resolution":{"observed_at":"2026-08-07T04:59:19.856135Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.738736Z","title":null,"venue":null,"work_id":"53e66c04-beb1-42ca-9771-89d25e3e169f","year":2017},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:15.944598Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:beec3f9fc9986cbb281d415d0d6f8ddabb90ef3f55bf762a72e762331a569bc4","observation_id":"1e397bac-483b-487e-8883-22e20db0990a","resolution":{"observed_at":"2026-08-07T04:59:20.841792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.044795Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.044795Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:23fb2a111c5bcc575546fd6425485573299b59c4973c7023dbd696df9c3b9e71","observation_id":"e9bb0155-7a2f-422c-8eeb-80d23a0dfbec","resolution":{"observed_at":"2026-08-07T04:59:16.044795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.104181Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.104181Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:326bfe5edc1d790434ac47de6a49ccbafa3ae68ae465b5d9f0b590045812cd99","observation_id":"639d2781-f0e7-4677-b073-d7c61d207ed0","resolution":{"observed_at":"2026-08-07T04:59:16.104181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.195901Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.195901Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:585975dde6073d06c30ad59ec710e11cafcffd6cddf493aa0ff471c3dae3600f","observation_id":"ed48d32f-b813-4ac7-b731-fcf30222ab31","resolution":{"observed_at":"2026-08-07T04:59:16.195901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.274506Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.274506Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:744d6bec6209c2f8746ff4ce6c7181385cb25a401326839b45728c0a697f1a2d","observation_id":"8b6e8ff8-9cb9-4f5e-ae4b-b3e7894e2b56","resolution":{"observed_at":"2026-08-07T04:59:16.274506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.367208Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.367208Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:0d509fc40eb61c4c990e1b817a07f1e078c15385661813994ae3e6ef6befa173","observation_id":"ba791935-a2fe-4609-8983-43893dc6aa51","resolution":{"observed_at":"2026-08-07T04:59:16.367208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02258","last_updated":"2024-04-02T19:28:11Z","snapshot_observed_at":"2026-07-06T17:54:47.689340Z","submitted_at":"2024-04-02T19:28:11Z","title":"Mixture-of-Depths: Dynamically allocating compute in transformer-based language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02258","snapshot_observed_at":"2026-08-07T04:59:16.447110Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.447110Z"},"links":{"cited_paper":"/paper/2404.02258","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:367629d9c66a81f8d38983a139fdd55059fbef61c38acf85166b220bb17fad19","observation_id":"4cdad05e-7c6b-462e-ae20-8333b5309e94","resolution":{"observed_at":"2026-08-07T04:59:16.447110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.541348Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.541348Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:774dd0e043df61139a327e15083d891b320fbef2ece3285a7fccab9461b89a90","observation_id":"8a87c8c3-8b8e-47d3-972a-5c9f13f42391","resolution":{"observed_at":"2026-08-07T04:59:16.541348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:16.652218Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.652218Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:628c006116d04a23133021c90e6c860681c6d05864cca6e4dee01b6dbb7eb160","observation_id":"2d4b0e29-31ef-4716-bc19-588a553b3fe2","resolution":{"observed_at":"2026-08-07T04:59:16.652218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.531585Z","title":null,"venue":null,"work_id":"6d800886-17dc-4d3b-80c6-e702492020b0","year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.715024Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:f2191618b0c92192343cc971f706249a2d08991ab7beab6c48a14ea52c9cae52","observation_id":"202082f7-e1c0-415b-9674-14260c160e2f","resolution":{"observed_at":"2026-08-07T04:59:20.605616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-07T04:59:16.799983Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.799983Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:9cde188ead1740f9659a3eae22b3e7f26a51557753754dc0ede72c30ecf24003","observation_id":"9959500b-304c-453f-aa2f-239419bc37b8","resolution":{"observed_at":"2026-08-07T04:59:16.799983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.112","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"17d86501-66d0-4602-8887-d39b96113758","year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.869577Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:2116f0c23c0cd692a708422604889678af03eeacdbb946c67bbeb084b6a1e93d","observation_id":"25385227-8afc-453e-bb22-ef1ecad93448","resolution":{"observed_at":"2026-08-07T04:59:19.324843Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.582","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"87b969e9-8b65-406c-aca8-aec7bf6ff5a0","year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:16.964224Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:daa0c01f59307998aed5d06c9ac5e9ca661f255add568a0d1c549d9f59313a6a","observation_id":"c4a0bc8f-37a6-482e-8dcb-7e208ec523a6","resolution":{"observed_at":"2026-08-07T04:59:19.176713Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.405496Z","title":null,"venue":null,"work_id":"4b60292a-65ab-4d3f-a44a-257823e2ad18","year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.040583Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:32bbb1a331d62ec565b777c290d6ccb8963dc845aca92c03e99505748dff21ed","observation_id":"06a38402-679c-43c9-9178-4730d80ee0ac","resolution":{"observed_at":"2026-08-07T04:59:20.439941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.102585Z","title":"Manning, Andrew Ng, and Christopher Potts","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.102585Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:d1de123c4637cb41f5c66778faf1b07b9a8919cab50f64d0d51951924f4c1c28","observation_id":"3f2dd55a-a5a3-479f-9664-2302e9a9cb30","resolution":{"observed_at":"2026-08-07T04:59:17.102585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12456","last_updated":"2024-12-12T12:38:12Z","snapshot_observed_at":"2026-08-07T20:41:48.188566Z","submitted_at":"2023-12-16T02:27:00Z","title":"PowerInfer: Fast Large Language Model Serving with a Consumer-grade GPU","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12456","snapshot_observed_at":"2026-08-07T04:59:17.159468Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.159468Z"},"links":{"cited_paper":"/paper/2312.12456","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:bbbdd65f2aaf15af6672d00fe422d8f3dd920ec0d05bc5ba6f7fa31223c80a5f","observation_id":"8865263a-8f4e-44a8-b067-b61b5be100ea","resolution":{"observed_at":"2026-08-07T04:59:17.159468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.279742Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.279742Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:88752fdc1abc97f8183d6a9dbe4211363a31387d781583c3fe6f66eb52253e18","observation_id":"179497e8-1703-414d-be4b-4956a247b389","resolution":{"observed_at":"2026-08-07T04:59:17.279742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.372100Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.372100Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:569e32b0e2e115757cd6ca40acb9ce6fe4ebedc5d320944484627eaba9708407","observation_id":"015f93ed-a837-4aaf-9d22-679c7fa42053","resolution":{"observed_at":"2026-08-07T04:59:17.372100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.460031Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.460031Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:32b3106f7a85d9224fa3958a28b3592c13d23c25c4cc459f876f3bdef7bbe8ff","observation_id":"2a2f30e5-d289-42f7-a748-48f268459595","resolution":{"observed_at":"2026-08-07T04:59:17.460031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06563","last_updated":"2024-06-03T03:58:41Z","snapshot_observed_at":"2026-08-04T06:16:13.927362Z","submitted_at":"2024-06-03T03:58:41Z","title":"Skywork-MoE: A Deep Dive into Training Techniques for Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06563","snapshot_observed_at":"2026-08-07T04:59:17.558603Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.558603Z"},"links":{"cited_paper":"/paper/2406.06563","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:1c3e78c5699d252458fb890d1a62b9f40abae85bded4bf2fd6554d57b0bd8d5b","observation_id":"3d98011d-74f5-4087-8cc7-c93b55c577b7","resolution":{"observed_at":"2026-08-07T04:59:17.558603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.649112Z","title":"Liu, and Matt Gardner","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.649112Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:98c7f2a85fd9e9c608c0d3675ec2a9f120038e4e5d5a19d5a8c8ac1011991b7c","observation_id":"5cb146da-910f-4031-9220-88a847a704dd","resolution":{"observed_at":"2026-08-07T04:59:17.649112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.764546Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.764546Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:9072ab20f0a26facab88b3c93dd0758704a106c611316c1b7948da53324efe80","observation_id":"14cd0d54-fa17-4c12-8bca-33db0bb199da","resolution":{"observed_at":"2026-08-07T04:59:17.764546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:17.859068Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.859068Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:409986d105c66292780938ba80044312c0e241110275194faf6e94ecc05b5ab3","observation_id":"1f36ad3c-02cf-465a-a4f1-d1acab38fb97","resolution":{"observed_at":"2026-08-07T04:59:17.859068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.239644Z","title":null,"venue":null,"work_id":"f10022f8-2d6d-4af6-b3c8-7d796b007ba8","year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:17.923041Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:79af04f96e4369d0957ebc41a00a5d7b12a9375910915759666c4ea792efb4eb","observation_id":"94b988c2-4b57-4531-8303-699529022377","resolution":{"observed_at":"2026-08-07T04:59:20.308910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.038045Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.038045Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:b79582a26a52c4bdcfc06b93b2b5009d33b16c630f9cceb8de61cb1cd73884ad","observation_id":"0fdb92f5-4082-44ad-a6cd-7d7b05258912","resolution":{"observed_at":"2026-08-07T04:59:18.038045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06282","last_updated":"2024-12-12T12:24:18Z","snapshot_observed_at":"2026-08-06T16:06:48.213787Z","submitted_at":"2024-06-10T14:01:21Z","title":"PowerInfer-2: Fast Large Language Model Inference on a Smartphone","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06282","snapshot_observed_at":"2026-08-07T04:59:18.087086Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.087086Z"},"links":{"cited_paper":"/paper/2406.06282","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:54b1f42712827e1d6b56d004cd9bc2d270c22d2090e99ac18cd0f7e2dc469ab1","observation_id":"6af74b8a-00e2-4fe4-9dec-a48a499e844f","resolution":{"observed_at":"2026-08-07T04:59:18.087086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.178728Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.178728Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:1acaf91de9d27a575d7c8c4d547a1f2760bae7a78082239dd8630f30b048903b","observation_id":"b20e2450-e9a1-44e0-97fa-7ab776a8b854","resolution":{"observed_at":"2026-08-07T04:59:18.178728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-07T04:59:18.228663Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.228663Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:d9ee2bf55a3df137a7ece9acf9a99c81cb869e29d34ecb3bdad38075cc27be00","observation_id":"b2a25bf7-fac3-435e-96c7-4f03b93e6421","resolution":{"observed_at":"2026-08-07T04:59:18.228663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12885","last_updated":"2018-10-30T17:32:16Z","snapshot_observed_at":"2026-08-06T02:57:51.203477Z","submitted_at":"2018-10-30T17:32:16Z","title":"ReCoRD: Bridging the Gap between Human and Machine Commonsense Reading Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12885","snapshot_observed_at":"2026-08-07T04:59:18.333558Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.333558Z"},"links":{"cited_paper":"/paper/1810.12885","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:82d57dbe146076f4218c966db29e02cef0a20f8f8eff20e3d7abb5bea86519c6","observation_id":"d265852a-c670-4958-b0d4-57d518d5f8ab","resolution":{"observed_at":"2026-08-07T04:59:18.333558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:20.067852Z","title":null,"venue":null,"work_id":"bf78b86f-ccc4-4587-9ff3-a916ad5129c7","year":2015},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.437127Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:be831469bfb8908902638e14e597838e772ed9766e9f9fc1d848c50106fee208","observation_id":"289adcfe-583f-4bc6-a0c9-759b92a659da","resolution":{"observed_at":"2026-08-07T04:59:20.155012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.508270Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.508270Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:b7ea19ab50e71584ee3bfd6513f89d96426f289b6613aea2fc0f5d9accaa264e","observation_id":"4dcdbeb0-2f3a-4efe-950b-aa2c16006ab6","resolution":{"observed_at":"2026-08-07T04:59:18.508270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.605388Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.605388Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:86f7d8de6e4e9aee53cd437cb16ba4bb8f14a1b10574d17b4ffef493b4a94e21","observation_id":"a7b5f4dc-19f8-4383-a090-edd8bdd301c9","resolution":{"observed_at":"2026-08-07T04:59:18.605388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-06T06:16:16.015146Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-07T04:59:18.685207Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.685207Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:7a709a2c3c8c49f57f7d9b506fcf35f49c8aca408e73f2cbecac7cf6801f42ae","observation_id":"fcbefac7-491d-4fa1-bdf5-25b2764ff8b6","resolution":{"observed_at":"2026-08-07T04:59:18.685207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.782487Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.782487Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:8534a5efa55201af0fcf4fb0ace67a55613f8e96f98da5cff30a09fe7d63b821","observation_id":"ed5bf860-324f-43dd-8793-735663e4f4a4","resolution":{"observed_at":"2026-08-07T04:59:18.782487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:18.904741Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T04:59:18.904741Z"},"links":{"citing_paper":"/paper/2506.09351"},"observation_digest":"sha256:a8ce24322c3b70926ea08e25116ecd10a2980cb2adc01a8645802c113aebd5b3","observation_id":"fb99c6e9-90fd-403b-999c-72945e769f24","resolution":{"observed_at":"2026-08-07T04:59:18.904741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09351","last_updated":"2025-06-11T03:05:24Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T05:26:14.069417Z","submitted_at":"2025-06-11T03:05:24Z","title":"DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:2506.09351."}