{"as_of":"2026-08-16T23:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6af57b573c1fdb20840678f5f3aeaf27125630e7d791b547a21e79ec306b72a6","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:55:13.064504Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T18:22:45.702572Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T16:17:08.639901Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2510.08008","last_updated":"2026-05-15T08:53:04Z","snapshot_observed_at":"2026-08-03T22:05:31.756040Z","submitted_at":"2025-10-09T09:45:45Z","title":"Beyond Sunk Costs: Boosting LLM Pre-training Efficiency via Orthogonal Growth of Mixture-of-Experts","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T20:36:22.974054Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2510.08008"},"observation_digest":"sha256:73b9031cee4f6e3f6365179e67570e003d510df9c894fef07102b8b808df67fb","observation_id":"88da6abf-22c9-40c5-a791-ceb4895750e6","resolution":{"observed_at":"2026-05-21T20:40:36.521036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2604.19835","last_updated":"2026-05-10T18:33:52Z","snapshot_observed_at":"2026-08-15T19:42:17.129212Z","submitted_at":"2026-04-21T05:53:33Z","title":"Expert Upcycling: Shifting the Compute-Efficient Frontier of Mixture-of-Experts","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T03:29:16.555166Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2604.19835"},"observation_digest":"sha256:659aba8de6301ed189f71398431a12964deb7d22784b2f5487e831d23bb2f424","observation_id":"1cf4391e-e513-48dc-b90d-0ede8c0cb014","resolution":{"observed_at":"2026-05-10T03:29:21.508447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2604.19835","last_updated":"2026-05-10T18:33:52Z","snapshot_observed_at":"2026-08-15T19:42:17.129212Z","submitted_at":"2026-04-21T05:53:33Z","title":"Expert Upcycling: Shifting the Compute-Efficient Frontier of Mixture-of-Experts","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-12T02:03:02.654035Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2604.19835"},"observation_digest":"sha256:99439f266bac1ff2f45851bba1a08d8654ad6a9662e6cd7b99bcc7e6fdfc15ad","observation_id":"b61a53bc-fb10-4999-8bab-62856c1f888f","resolution":{"observed_at":"2026-05-12T02:06:15.396431Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2604.23996","last_updated":"2026-04-27T03:23:19Z","snapshot_observed_at":"2026-08-15T05:33:19.595727Z","submitted_at":"2026-04-27T03:23:19Z","title":"SMoES: Soft Modality-Guided Expert Specialization in MoE-VLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-08T04:41:52.098355Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2604.23996"},"observation_digest":"sha256:2bf1ed7aa7bd37967b8d01df6df9b28449b20a66880c2beddb5704b694070492","observation_id":"701af203-5b6b-41f6-8ce2-89c8d2d939ce","resolution":{"observed_at":"2026-05-11T21:36:18.687780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-08-15T21:45:39.578781Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T12:00:35.496822Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:855cca4aec8efc0d8c03a7433dcc2c5a723c329ac05164e2e27425a6382ec982","observation_id":"23095635-0530-4661-aab8-4ce0832d69b3","resolution":{"observed_at":"2026-05-20T12:03:15.157753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2605.18643","last_updated":"2026-06-08T03:38:38Z","snapshot_observed_at":"2026-08-15T21:45:39.578781Z","submitted_at":"2026-05-18T16:50:48Z","title":"Post-Trained MoE Can Skip Half Experts via Self-Distillation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T18:22:45.702572Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2605.18643"},"observation_digest":"sha256:af430a12652d04b73ee72a84004c9459162a199c4b7527a7ae264b916f0db6e0","observation_id":"5797a3b5-4da2-435d-81a7-c52fc706c5dd","resolution":{"observed_at":"2026-06-30T18:25:00.095976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"cited_work":{"arxiv_id":"2508.07785","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.07785","snapshot_observed_at":"2026-07-02T16:17:08.639901Z","title":"Grovemoe: Towards efficient and superior moe llms with adjugate experts.arXiv preprint arXiv:2508.07785","venue":null,"work_id":"d9ee55a9-2e66-4055-8eda-f64e30d074e2","year":2025},"citing_paper":{"arxiv_id":"2606.07404","last_updated":"2026-06-05T15:48:42Z","snapshot_observed_at":"2026-08-14T18:09:34.814683Z","submitted_at":"2026-06-05T15:48:42Z","title":"Reversible Foundations: Training a 120B Sparse MoE through State-Preserving Scaling","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-27T22:55:09.477413Z"},"links":{"cited_paper":"/paper/2508.07785","citing_paper":"/paper/2606.07404"},"observation_digest":"sha256:44338b8b8cfdab3565e84f7ba02fd58e8a34f78948f6400b4001d3cea315d7f5","observation_id":"898f4dbc-f439-49a9-8f51-e5172c780184","resolution":{"observed_at":"2026-07-02T16:17:08.641657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.07785/citation-record","integrity":"/paper/2508.07785/integrity","json":"/paper/2508.07785/citation-record.json","paper":"/paper/2508.07785"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:06.816646Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:06.816646Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:d9a9064e642900cbf4cc3cb23ac572a961a08bf2d5b302193757efbabb755d01","observation_id":"7676596d-c99a-49b2-aa59-78e27fae7dad","resolution":{"observed_at":"2026-08-05T21:55:06.816646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:16.597049Z","title":"AIME Problems and Solutions , 2025","venue":null,"work_id":"a291dae7-656d-4144-80ba-41482f20a4ed","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:06.895195Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:bef79f01caf01d0dd0910f150fe1f2797b2594926a7a2c871b5c56796f32dbcb","observation_id":"c68d5b98-d0ea-47dd-b79a-9a441f6a0837","resolution":{"observed_at":"2026-08-05T21:55:16.682909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:16.397273Z","title":"Alternating Updates for Efficient Transformers","venue":null,"work_id":"93f19d5c-ab8a-4d9b-9811-021adf8184a0","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.011725Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:c1619febce53c826b481686b5892d2b53031d0270aad87c5689cb6bfc09cf500","observation_id":"d02bad1b-39c1-4d8e-ad3b-78ac8b9c324e","resolution":{"observed_at":"2026-08-05T21:55:16.503512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:16.215253Z","title":"MultiPL-E: A Scalable and Polyglot Approach to Benchmarking Neural Code Generation","venue":null,"work_id":"0c2bdb0f-fe90-4f6b-8451-2485e8e41fed","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.127254Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:42822d780af193614c0ab745b37656b8c0cbeca37f482816d6ba98ae19f7f90f","observation_id":"fefeb148-5bf1-4bc4-a7eb-c97d06c60276","resolution":{"observed_at":"2026-08-05T21:55:16.306383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10475","last_updated":"2025-05-15T16:24:45Z","snapshot_observed_at":"2026-08-15T21:06:14.217136Z","submitted_at":"2025-05-15T16:24:45Z","title":"Parallel Scaling Law for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10475","snapshot_observed_at":"2026-08-05T21:55:07.259301Z","title":"Parallel Scaling Law for Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.259301Z"},"links":{"cited_paper":"/paper/2505.10475","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:218f105d88286d30128b12f1a719c536bc25864c99da3d30aa1dbdeae0d6f69d","observation_id":"86c53e88-b9b7-4736-9498-c8f3ad700b54","resolution":{"observed_at":"2026-08-05T21:55:07.259301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T21:55:07.431498Z","title":"Training Verifiers to Solve Math Word Problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.431498Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:2b7fccb8cc2d7ade96ba9a5972697114b6231b2b7d28ea3afacf1a8daa735199","observation_id":"d95b45b3-cd18-4a39-8896-f107b38db248","resolution":{"observed_at":"2026-08-05T21:55:07.431498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14739","last_updated":"2025-03-28T15:21:44Z","snapshot_observed_at":"2026-08-15T17:40:05.031382Z","submitted_at":"2025-02-20T17:05:58Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14739","snapshot_observed_at":"2026-08-05T21:55:07.597205Z","title":"SuperGPQA: Scaling llm evaluation across 285 graduate disciplines","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.597205Z"},"links":{"cited_paper":"/paper/2502.14739","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:9d6f6cfdbb70792b8c3044e0eb842d7e61bab14f21d9a891ec177d87f033097f","observation_id":"fd6e4cf4-29f3-4ed7-ae53-ba6c37202771","resolution":{"observed_at":"2026-08-05T21:55:07.597205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00161","last_updated":"2019-04-16T21:22:39Z","snapshot_observed_at":"2026-08-14T17:09:11.503312Z","submitted_at":"2019-03-01T05:32:01Z","title":"DROP: A Reading Comprehension Benchmark Requiring Discrete Reasoning Over Paragraphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00161","snapshot_observed_at":"2026-08-05T21:55:07.713368Z","title":"DROP: A Reading Comprehension Benchmark Requiring Discrete Reasoning over Paragraphs","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.713368Z"},"links":{"cited_paper":"/paper/1903.00161","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:17295319668b533fadca0a02889ba30703db7bc5583fa81fb8ec663d4686f4fb","observation_id":"4140f997-a7a4-40f2-aab9-82356fc314af","resolution":{"observed_at":"2026-08-05T21:55:07.713368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07985","last_updated":"2024-12-24T04:04:30Z","snapshot_observed_at":"2026-08-16T19:47:24.627230Z","submitted_at":"2024-10-10T14:39:33Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark For Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07985","snapshot_observed_at":"2026-08-05T21:55:07.854608Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.854608Z"},"links":{"cited_paper":"/paper/2410.07985","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:a9e7c861827cb539dc24a90df82c70fa750945841025cd4b2ab469d15596a8b6","observation_id":"46efc729-4bcc-469c-9444-c125fa14dbf2","resolution":{"observed_at":"2026-08-05T21:55:07.854608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T21:55:07.978354Z","title":"Gemma 3 Technical Teport","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:07.978354Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:38012ed9b69e5f7c39518a187df787f161a8a10239412c09300eba2e69bf48c7","observation_id":"37ff43e3-a5ab-4578-99be-a70024fff0e8","resolution":{"observed_at":"2026-08-05T21:55:07.978354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:16.044331Z","title":"Gemini2.5 Pro","venue":null,"work_id":"377fad1e-ecbd-4f2a-b8d6-baf6829eae30","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.124675Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:0ff0b9e250d7050b9e9e310c52522ba5b384b2c0b5eb83e73e530e33b7cc0822","observation_id":"78042d42-7a17-4dbe-a7d3-5e12b995001c","resolution":{"observed_at":"2026-08-05T21:55:16.098969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T21:55:08.272501Z","title":"The Llama 3 Herd of Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.272501Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:7e4c5c75adef2593685b51a6eb55c2853c8e34a37a91daea0a58c053a8ee0752","observation_id":"4bf8e837-e990-457e-be4f-de4e7b9b50d1","resolution":{"observed_at":"2026-08-05T21:55:08.272501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.847069Z","title":"big.LITTLE Processing with ARL Cortex-A15 & Cortex-A7","venue":null,"work_id":"f2bd09b9-ab3f-4a93-a4ff-9d64107ed10a","year":2011},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.447459Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:0702190789e46e51f210af68af34c47cbdf8bfc5e7fca4c49eb1be0690b12c4e","observation_id":"6cb2f381-324d-4b12-b91f-3c0b76008cf6","resolution":{"observed_at":"2026-08-05T21:55:15.902931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03065","last_updated":"2024-01-05T20:53:51Z","snapshot_observed_at":"2026-08-13T22:46:36.295191Z","submitted_at":"2024-01-05T20:53:51Z","title":"CRUXEval: A Benchmark for Code Reasoning, Understanding and Execution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03065","snapshot_observed_at":"2026-08-05T21:55:08.615607Z","title":"CruxEval: A Benchmark for Code Reasoning, Understanding and Execution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.615607Z"},"links":{"cited_paper":"/paper/2401.03065","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:7db8b8299048bb89554b3e6c585c8937d56517e86c636b2b1b54cdc5d416d66d","observation_id":"b13f4784-d55b-4f6d-a596-d08a170f6b85","resolution":{"observed_at":"2026-08-05T21:55:08.615607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14297","last_updated":"2025-03-10T09:17:56Z","snapshot_observed_at":"2026-08-16T14:56:48.448728Z","submitted_at":"2024-05-23T08:18:30Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14297","snapshot_observed_at":"2026-08-05T21:55:08.825228Z","title":"Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.825228Z"},"links":{"cited_paper":"/paper/2405.14297","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:ab18952dbff91e232d37bc0fcd805d1a2ead47ec732c8fb98f71d8508334c79c","observation_id":"9c45b934-2f91-40d8-bfcb-6552f3c52bc9","resolution":{"observed_at":"2026-08-05T21:55:08.825228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14008","last_updated":"2024-06-06T13:19:44Z","snapshot_observed_at":"2026-08-03T03:39:09.398343Z","submitted_at":"2024-02-21T18:49:26Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14008","snapshot_observed_at":"2026-08-05T21:55:08.994598Z","title":"OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:08.994598Z"},"links":{"cited_paper":"/paper/2402.14008","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:7f860318de6136f439bf6d90cf6e0185c11a08cc5b0d6bfdc6105b849edcb41c","observation_id":"6dcf1869-0e67-41e1-ad5c-e49f477b41ca","resolution":{"observed_at":"2026-08-05T21:55:08.994598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T21:55:09.138629Z","title":"Measuring Massive Multitask Language Understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.138629Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:b415a660350be9a3f11ee0d8d53bb1a8a90822970bfa0788a3dc4d1ca39cbbc0","observation_id":"763b8b34-4a12-49be-b432-b80d84a108db","resolution":{"observed_at":"2026-08-05T21:55:09.138629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T21:55:09.306553Z","title":"Measuring Mathematical Problem Solving with the Math Dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.306553Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:d9d14e668b4a2f012cf0c74fc4b9016bb5c3027ff00c7515de194b0533f1b4f8","observation_id":"adead57f-9f1d-4a51-8870-45e2ff57f614","resolution":{"observed_at":"2026-08-05T21:55:09.306553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:09.449759Z","title":"Harder Tasks Need More Experts: Dynamic Routing in MoE Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.449759Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:938a1da15e9dce378b8e038b2799b7404c735caa568812a51083268032db2c85","observation_id":"01b10de9-14d1-4812-9f22-cce7dfc0fc34","resolution":{"observed_at":"2026-08-05T21:55:09.449759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.673204Z","title":"C-Eval: A Multi-Level Multi-Discipline Chinese Evaluation Suite for Foundation Models","venue":null,"work_id":"0a916ee1-e695-4077-bba3-8a1c4b3739a6","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.592352Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:1ee9dd4f0143605fdbc8d02ca2877aa82c1873024ef47975e4dfc0ec76c9ef2e","observation_id":"6d2cc0f5-0bb2-4567-8714-ac502c1b5e85","resolution":{"observed_at":"2026-08-05T21:55:15.766528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05767","last_updated":"2025-06-06T05:51:29Z","snapshot_observed_at":"2026-08-13T21:22:22.224742Z","submitted_at":"2025-06-06T05:51:29Z","title":"dots.llm1 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05767","snapshot_observed_at":"2026-08-05T21:55:09.763377Z","title":"dots.llm1 Technical Report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.763377Z"},"links":{"cited_paper":"/paper/2506.05767","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:311482cf0d168698b337bb5adeb45f732bb758c4cc0b028c1e345fc762028366","observation_id":"7a2fae88-c8b7-441e-a300-6c77883d71e3","resolution":{"observed_at":"2026-08-05T21:55:09.763377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T21:55:09.900691Z","title":"GPT-4o System Card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:09.900691Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:3afb36ace7479375877b507c29910012e0d928189e711f42410d13025695a557","observation_id":"f51f57a4-f0db-4722-a417-97110b83b206","resolution":{"observed_at":"2026-08-05T21:55:09.900691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-16T07:05:57.323612Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-05T21:55:10.077000Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.077000Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:86d569ac3869ce5b735d3eedd43b35294dee5c029c7a662997e4a0cf7132b14c","observation_id":"87d074a1-00cd-4702-aa34-5b9acf2439d7","resolution":{"observed_at":"2026-08-05T21:55:10.077000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-05T21:55:10.279732Z","title":"Mixtral of Experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.279732Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:612ae0b31fb312c9d502821593fa144b69a444da1889e2fba507e8abffff21c5","observation_id":"fe5eb39e-ed16-42fa-b6bb-5cf5b6bb1b45","resolution":{"observed_at":"2026-08-05T21:55:10.279732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-16T13:10:58.115361Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-05T21:55:10.476732Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.476732Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:17e31a48712cc093e583b332e5307af15565ebcea48a0f772d19db201c282048","observation_id":"60b066d4-cd5a-4f24-bb97-1ac7c5b0d370","resolution":{"observed_at":"2026-08-05T21:55:10.476732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.512828Z","title":"Sparse Upcycling: Training mixture-of-experts from dense checkpoints","venue":null,"work_id":"498c8d1f-8589-4af2-a59d-e102420a0e10","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.662607Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:d6775cdbfcc5d6a28b8445ad02df958d54ead4ce751820928130299e7f9e129a","observation_id":"84a7267f-9501-4e0a-acf0-b17ec6c8a55e","resolution":{"observed_at":"2026-08-05T21:55:15.591887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-08-05T21:55:10.829310Z","title":"CMMLU: Measuring Massive Multitask Language Understanding in Chinese","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.829310Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:715a7768da0a79651c144914f8e07b837db6ae3791107fb4902932e2fe3fb791","observation_id":"1f2df3e9-76d1-4a86-8b11-bbd865b874f8","resolution":{"observed_at":"2026-08-05T21:55:10.829310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-11T09:34:38.920981Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-05T21:55:10.966584Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and Benchbuilder Pipeline","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:10.966584Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:4a5ea891aa9d130399898fb7d8e077386a4c51985a715422f21e8ea7a8d5f008","observation_id":"3fb31cec-1f4f-4329-9cfb-9c0669e38bb7","resolution":{"observed_at":"2026-08-05T21:55:10.966584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.349047Z","title":"Let's Verify Step by Step","venue":null,"work_id":"b910b623-3d21-425b-a339-a6072d541249","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.049363Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:c68c847356e2243ab2e4a3e9c23f36fc21e2658279b94e043286d779cbd00281","observation_id":"1ad87fe3-b066-46b6-8953-1a9cb4981def","resolution":{"observed_at":"2026-08-05T21:55:15.410461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-05T21:55:11.110692Z","title":"DeepSeek-V3 Technical Report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.110692Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:fd532e2cbd5212705fca3e018bb290823051eb88b6a5e9c22f14339ca1d408fb","observation_id":"2d888468-3aab-40a5-985e-f451e40346d6","resolution":{"observed_at":"2026-08-05T21:55:11.110692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.198060Z","title":"Is Your Code Generated by ChatGPT Really Correct? Rigorous Evaluation of Large Language Models for Code Generation","venue":null,"work_id":"31c32341-1f65-47e1-99e2-d6c0fe2dda10","year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.192787Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:62abe6c09b000f2beed7d1d55637a053280ecffb59829fbffc072e3a3d634b81","observation_id":"54ae30d0-78ff-41ea-b565-f86c823771c8","resolution":{"observed_at":"2026-08-05T21:55:15.253228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T21:55:11.279905Z","title":"Decoupled Weight Decay Regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.279905Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:87a0e2ef8dec230941487b693771b5fb3b89e59311e8d82fba2a8b7c013e3d49","observation_id":"b96b046b-199a-494b-b1ca-ca55d87d36e4","resolution":{"observed_at":"2026-08-05T21:55:11.279905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:15.030623Z","title":"The Llama 4 herd: The beginning of a new era of natively multimodal AI innovation , 2025","venue":null,"work_id":"375b8418-a70f-40bc-9496-b7bd25a6cfb9","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.389659Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:82d259952e0a95e9f6481e53a6d573d55723d329fbd932fefe1c760ba4676d60","observation_id":"3e22ebaa-1bc4-486b-8595-765cab14ceec","resolution":{"observed_at":"2026-08-05T21:55:15.136131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.858135Z","title":"Mistral-Small-3.1","venue":null,"work_id":"beeb52c8-900a-48ae-9565-a30476fa8119","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.463331Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:126edb60033615f64f8ecf056e002ce904133e1030226ed62e4862865343a1f2","observation_id":"c41a22d5-685c-4201-8fd1-d5395c8cf01e","resolution":{"observed_at":"2026-08-05T21:55:14.940663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19261","last_updated":"2025-03-15T14:50:33Z","snapshot_observed_at":"2026-08-16T12:54:57.584626Z","submitted_at":"2025-02-26T16:06:36Z","title":"Drop-Upcycling: Training Sparse Mixture of Experts with Partial Re-initialization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19261","snapshot_observed_at":"2026-08-05T21:55:11.541674Z","title":"Drop-Upcycling: Training Sparse Mixture of Experts with Partial Re-Initialization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.541674Z"},"links":{"cited_paper":"/paper/2502.19261","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:85f08ec94764d916f22a627f266f69ca7f150fd088ac910ff263ef66ee6f46a2","observation_id":"c7dd9abf-8bae-4531-9603-310de87de6fc","resolution":{"observed_at":"2026-08-05T21:55:11.541674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.723278Z","title":"GPQA: A Graduate-Level Google-Proof Q&Q Benchmark","venue":null,"work_id":"a16a2933-6bc8-42fb-92aa-7e993d65d0db","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.633823Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:98898d6dc54d309a682fe6a4efe8011d02a388fb0611c34142bec3f702f86c08","observation_id":"2a6ac5a3-c867-4bab-8509-570232ed60ab","resolution":{"observed_at":"2026-08-05T21:55:14.776307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.455628Z","title":null,"venue":null,"work_id":"8e96b465-0914-4c80-84aa-6a3fb29f35b2","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.768530Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:8670d5d18c4cf9ed78d43eb065dc777ba50f11de6c2c951c693945ad5facb5ff","observation_id":"44db8fda-58fc-4b25-9cae-de6a99f4b59c","resolution":{"observed_at":"2026-08-05T21:55:14.608392Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.251489Z","title":"MoE Travels 3 , 2025","venue":null,"work_id":"7321cd1b-571a-418c-b365-9a8a1ff0cac0","year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.859201Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:d7e9190ebfc356fa2e88b5294cbb401129a9d91927b5d8176d7b6f6c87c63823","observation_id":"88a5e5cc-9338-4a73-bf29-022355545a49","resolution":{"observed_at":"2026-08-05T21:55:14.354341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02265","last_updated":"2024-11-06T09:15:27Z","snapshot_observed_at":"2026-08-16T13:03:06.425740Z","submitted_at":"2024-11-04T16:56:26Z","title":"Hunyuan-Large: An Open-Source MoE Model with 52 Billion Activated Parameters by Tencent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02265","snapshot_observed_at":"2026-08-05T21:55:11.905074Z","title":"Hunyuan-Large: An Open-Source MoE Model with 52 Billion Activated Parameters by Tencent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.905074Z"},"links":{"cited_paper":"/paper/2411.02265","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:45e7425dec9b5ea7229dd3e917d3a212a59bc689da4dd865a4452f802aa546e1","observation_id":"1ba115c0-06c2-41ad-b018-3de5f41d8e2c","resolution":{"observed_at":"2026-08-05T21:55:11.905074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-05T21:55:11.985304Z","title":"Challenging Big-Bench Tasks and Whether Chain-of-Thought Can Solve Them","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:11.985304Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:03a42b1b46cb10c6f33a634bbf3f485a915dc87839075d431b15a3d9eb026a6c","observation_id":"d881d742-b658-4c7b-9103-eb7fd2a6fc44","resolution":{"observed_at":"2026-08-05T21:55:11.985304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:14.061059Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","venue":null,"work_id":"55d90a9d-c518-4669-8ece-cc8d934db63b","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.071642Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:2bdc0041f8ba5ca269a94be0833487d575940b25e3238e39d316184afdd361cd","observation_id":"cda85eb4-3161-48d4-9fb6-15107936552e","resolution":{"observed_at":"2026-08-05T21:55:14.166527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14711","last_updated":"2025-02-27T16:33:09Z","snapshot_observed_at":"2026-08-14T22:43:45.227916Z","submitted_at":"2024-12-19T10:21:20Z","title":"ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14711","snapshot_observed_at":"2026-08-05T21:55:12.177334Z","title":"ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.177334Z"},"links":{"cited_paper":"/paper/2412.14711","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:b726edd90389abc8ffa237db31d9b3da9ef671a0ca0b00a734ee9ac989d0ede9","observation_id":"878d5138-3799-4e4c-8c82-ff0eabd13369","resolution":{"observed_at":"2026-08-05T21:55:12.177334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-08-16T22:22:41.448725Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-05T21:55:12.283379Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.283379Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:a53a3dfeee66cf7eaea5a15987470ce545fe6533c44cf76a3b7ea99b5d43ba89","observation_id":"1b363cbf-77cf-4047-985d-32cec6091d2d","resolution":{"observed_at":"2026-08-05T21:55:12.283379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:13.823849Z","title":"Parameter-Efficient Sparsity Crafting from Dense to Mixture-of-Experts for Instruction Tuning on General Tasks","venue":null,"work_id":"2c7aada5-16b9-4296-9c7f-02b537747065","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.380426Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:a0f6f826eb872517ee7a13dcb109c1084dbd6443cf7dae72aa93eed49f9ec960","observation_id":"9bebb342-0395-4d26-9fe9-46fa482775ec","resolution":{"observed_at":"2026-08-05T21:55:13.927086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-08-12T12:16:58.791696Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08464","snapshot_observed_at":"2026-08-05T21:55:12.444636Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.444636Z"},"links":{"cited_paper":"/paper/2406.08464","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:b1fee67cc9f9a2aa8de42005958abefaf6aa8a917291830fb7f3dcf72a1dd151","observation_id":"d74ccebb-3105-4eed-a728-3562a9e3ddaf","resolution":{"observed_at":"2026-08-05T21:55:12.444636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:55:13.667496Z","title":"Patil, Ion Stoica, and Joseph E","venue":null,"work_id":"eb1dedc9-5a96-49a8-8ec2-948b8186eae5","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.543077Z"},"links":{"citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:cbb6a6e98cc548d916c06f9bcf92a7ca915aeb54a36def4335cefbc97031039b","observation_id":"554358da-f55a-4dfe-b8c3-e29382ae0344","resolution":{"observed_at":"2026-08-05T21:55:13.743015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T21:55:12.617089Z","title":"Qwen2.5 Technical Report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.617089Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:4dec5398892c47b1f94d8bfd602d3b35448708be42f201f0b078645a109ba669","observation_id":"a8e25cb4-66e2-4655-9723-5cda2318714c","resolution":{"observed_at":"2026-08-05T21:55:12.617089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T21:55:12.751578Z","title":"Qwen3 Technical Report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.751578Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:4c7aa954e85ecf4f2805cc7557ea047b080460b48939659091d960abafc4b353","observation_id":"28a74e1a-399e-4588-b7bd-c20d935ce484","resolution":{"observed_at":"2026-08-05T21:55:12.751578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13233","last_updated":"2024-10-14T03:20:02Z","snapshot_observed_at":"2026-08-16T13:41:35.680539Z","submitted_at":"2024-06-19T05:47:10Z","title":"AdaMoE: Token-Adaptive Routing with Null Experts for Mixture-of-Experts Language Models","version":2},"cited_work":{"arxiv_id":"2406.13233","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13233","snapshot_observed_at":"2026-08-05T21:55:13.242980Z","title":"AdaMoE: Token-Adaptive Routing with Null Experts for Mixture-of-Experts Language Models","venue":"cs.AI","work_id":"b3d4c87c-9c42-4820-a8c5-57aa3f7008de","year":2024},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.848542Z"},"links":{"cited_paper":"/paper/2406.13233","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:61bd667ac7ce18f085864e25aa7236612bd03f66db77f35b3e321415cd574ed6","observation_id":"20139d0c-fe49-4c00-873a-d7cd5f43f916","resolution":{"observed_at":"2026-08-05T21:55:13.290078Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06364","last_updated":"2023-09-18T14:23:02Z","snapshot_observed_at":"2026-08-07T12:51:50.861720Z","submitted_at":"2023-04-13T09:39:30Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06364","snapshot_observed_at":"2026-08-05T21:55:12.954012Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:12.954012Z"},"links":{"cited_paper":"/paper/2304.06364","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:664c9186c84888e17e3d78517336888101c3bfbecd7b5fd8c9f3772b456bdea1","observation_id":"ec54b7b3-8a57-4a66-9565-59282b8f0699","resolution":{"observed_at":"2026-08-05T21:55:12.954012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-05T21:55:13.064504Z","title":"Instruction-Following Evaluation for Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T21:55:13.064504Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2508.07785"},"observation_digest":"sha256:09c6d2cc09e3c79cf2a7621865e47be1884a9a3ecd646a84fa06e0afa9cfc281","observation_id":"83a73289-26f4-4bc6-8d53-1478e10102a8","resolution":{"observed_at":"2026-08-05T21:55:13.064504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.07785","last_updated":"2025-08-11T09:15:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T09:37:41.925640Z","submitted_at":"2025-08-11T09:15:36Z","title":"Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 7 inbound Pith citation observations for arXiv:2508.07785."}