{"as_of":"2026-08-10T05:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2022e1c98afe20df74227e7e950b96a9488bb3485e2a6e84b622189c2d8aa62f","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T21:01:45.680930Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16427/citation-record","integrity":"/paper/2607.16427/integrity","json":"/paper/2607.16427/citation-record.json","paper":"/paper/2607.16427"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.196314Z","title":"Scaling Laws Across Model Architectures:","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.196314Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:f555c8f36eeae42e892c63fcac58492340359a0fbd414be21d9889156e7cb2bd","observation_id":"306b6af1-6f07-4216-9c07-8ab01eaf57c6","resolution":{"observed_at":"2026-08-01T21:01:42.196314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20750","last_updated":"2025-03-26T17:33:38Z","snapshot_observed_at":"2026-08-07T16:34:54.058767Z","submitted_at":"2025-03-26T17:33:38Z","title":"Optimal Scaling Laws for Efficiency Gains in a Theoretical Transformer-Augmented Sectional MoE Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20750","snapshot_observed_at":"2026-08-01T21:01:42.273281Z","title":"arXiv preprint arXiv:2503.20750 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.273281Z"},"links":{"cited_paper":"/paper/2503.20750","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:0ae3e26e2403f8f4bc864e7c850631afb9341990f6e712e5ed68e532d41564d0","observation_id":"43ba4ce7-7cf0-4719-b9f4-3e1febc181cc","resolution":{"observed_at":"2026-08-01T21:01:42.273281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.386683Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.386683Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:c4e44ad1c62da288f2902eba83d0a7463c816eab19777349f17bd4e3ef60c641","observation_id":"f2ce6276-b812-4b4d-bc03-309cb78e18f2","resolution":{"observed_at":"2026-08-01T21:01:42.386683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.533172Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.533172Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:f1b7e172bfc37f811402f02d68785c7f41105d320317450c4bc7a11964af7bb6","observation_id":"197ee4ba-7bfe-485d-a4be-9c9c9bb4beae","resolution":{"observed_at":"2026-08-01T21:01:42.533172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.609177Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.609177Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:92eea8a325b5314002ff812f5d38ccd79288d82a7b929e7a39af2824bf5d502d","observation_id":"b92379b3-cc49-4aa3-949b-1610faaf542a","resolution":{"observed_at":"2026-08-01T21:01:42.609177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.696866Z","title":"IEEE Transactions on Parallel and Distributed Systems , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.696866Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:7ad69769157408fab5ed6384867c044df051e6b6a1984f15bc68e05f96dc6b79","observation_id":"f81a6464-fbf1-4859-a300-a6cedfab4507","resolution":{"observed_at":"2026-08-01T21:01:42.696866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:42.769157Z","title":"JOURNAL OF IEEE TRANSACTIONS ON ARTIFICIAL INTELLIGENCE , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.769157Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:f481bf5a1c299f1639fca02d142d5b5aa7213905e49e862bfbbca6a8d352ede8","observation_id":"25f58908-ae22-4a92-8732-5ca872a8a9ed","resolution":{"observed_at":"2026-08-01T21:01:42.769157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15052","last_updated":"2024-06-28T19:39:45Z","snapshot_observed_at":"2026-08-09T12:02:12.929800Z","submitted_at":"2024-05-23T21:00:53Z","title":"Revisiting MoE and Dense Speed-Accuracy Comparisons for LLM Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15052","snapshot_observed_at":"2026-08-01T21:01:42.897579Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:42.897579Z"},"links":{"cited_paper":"/paper/2405.15052","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:c932b08df5fab26e1a3e99f39bcfe0670a8e9d71445c8e41298e99517027fb9e","observation_id":"e9430e14-a9f1-4186-b8ea-18e2ccd84f87","resolution":{"observed_at":"2026-08-01T21:01:42.897579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.028026Z","title":"Scaling Vision with Sparse Mixture of Experts , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.028026Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:b5e19fcfcdf2acf4865760a856576005060b0ac761a42b80c296b96bdd7538f3","observation_id":"710d82a9-5937-4fb3-a030-56d45b9e30c7","resolution":{"observed_at":"2026-08-01T21:01:43.028026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.135375Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.135375Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:49553e6c7480f38c9e77d03aaf005860d831ce646c6ee32f0a92c3b8d64189f2","observation_id":"6590902d-e0fb-488f-8a8a-f6ca13a33984","resolution":{"observed_at":"2026-08-01T21:01:43.135375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.249370Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.249370Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:7abe46eb5040342249e67ad34e872db5110626981e4ca06e885181a39d42d04d","observation_id":"eb8a1944-7517-4be3-918c-c050228da509","resolution":{"observed_at":"2026-08-01T21:01:43.249370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.346274Z","title":"Le and Geoffrey E","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.346274Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:22f83434b59f3672fb2adc3c266fe41bc6561027e0207dbe41d04d0b2eef66f8","observation_id":"03692010-1474-4107-9c89-1d44a2e84ec4","resolution":{"observed_at":"2026-08-01T21:01:43.346274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.477025Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.477025Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:99bbba94903ff9233e7b880d80e1c771b704b154e82b421b11060a35f0fb99f5","observation_id":"42c3c63b-86a5-4b3e-af61-38fed0f3c557","resolution":{"observed_at":"2026-08-01T21:01:43.477025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.586604Z","title":"The Eleventh International Conference on Learning Representations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.586604Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:41370a92d58104a8d4785f484af1dec84cdc6e6ff76e57f3cdefa8fd4e1a2681","observation_id":"dad253c0-edef-468f-972b-5f79ca131f91","resolution":{"observed_at":"2026-08-01T21:01:43.586604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.703624Z","title":"On the Representation Collapse of Sparse Mixture of Experts , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.703624Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:a924b31e4342238efe90abbffebd44cf4afab9761917c8bc33a6b695270d595d","observation_id":"7bf08ba7-f390-4ffd-962b-d20095dcc995","resolution":{"observed_at":"2026-08-01T21:01:43.703624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-naacl.107","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SimSMoE: Toward Efficient Training Mixture of Experts via Solving Representational Collapse , booktitle =","venue":null,"work_id":"1ef5c950-b47d-4886-8709-d04a795ef04d","year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.812014Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:147effece120c178579d46b2aea6f6daacd3995e89fdabb5eed14ffcde6f305a","observation_id":"6df381eb-d2bd-438f-8ce7-9b20336d7aa4","resolution":{"observed_at":"2026-08-01T21:04:37.940446Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.351","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HyperRouter: Towards Efficient Training and Inference of Sparse Mixture of Experts , booktitle =","venue":null,"work_id":"48124e98-315e-482e-abc2-8f0a6cadae79","year":2023},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.917892Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:44575d29b523ff749e13a6b7a69e9433c443c5224edc8af24f8ad8c2b782b0d9","observation_id":"815987c6-2914-495d-947f-39bee5a5a231","resolution":{"observed_at":"2026-08-01T21:04:37.781518Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:43.998637Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:43.998637Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:8ee5b610fab4b237f50009be76b38c1a986be6d8eaeb746cdb4648b161bde2a2","observation_id":"e91fc752-bf5b-41e2-a028-f5d4337d1bb7","resolution":{"observed_at":"2026-08-01T21:01:43.998637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04444","last_updated":"2025-04-06T11:31:55Z","snapshot_observed_at":"2026-08-07T16:08:14.392149Z","submitted_at":"2025-04-06T11:31:55Z","title":"On the Spatial Structure of Mixture-of-Experts in Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04444","snapshot_observed_at":"2026-08-01T21:01:44.172037Z","title":"Oseledets , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.172037Z"},"links":{"cited_paper":"/paper/2504.04444","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:5dd28a2c883c14cfb59ba071f2d58aea250474248e38c712e7ce8530b3a8b3b8","observation_id":"2966cd7d-3d22-4f3f-8d4f-0a23bdc13775","resolution":{"observed_at":"2026-08-01T21:01:44.172037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.338246Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.338246Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:69fa6c1b944b90be3c3bb928e95f0544bf0f56dcc4380cc0430135c983d4fb82","observation_id":"5dbd08e9-89c2-4412-af7c-5729dd35c667","resolution":{"observed_at":"2026-08-01T21:01:44.338246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14107","last_updated":"2024-09-21T11:25:19Z","snapshot_observed_at":"2026-08-07T19:46:52.081415Z","submitted_at":"2024-09-21T11:25:19Z","title":"Routing in Sparsely-gated Language Models responds to Context","version":1},"cited_work":{"arxiv_id":"2409.14107","doi":"10.48550/arxiv.2409.14107","metadata_source":"pith","pith_arxiv_id":"2409.14107","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Routing in Sparsely-gated Language Models responds to Context","venue":"cs.CL","work_id":"f192581f-e5b9-4c69-a1e1-42eec95e1719","year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.446222Z"},"links":{"cited_paper":"/paper/2409.14107","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:5f39e8d901d753ca770f74d9de72475d005ea042318b35774cc8d55ba0eef19f","observation_id":"1a894290-b6f6-4992-b6f1-f0f802bc0f88","resolution":{"observed_at":"2026-08-01T21:04:37.576067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.579116Z","title":"arXiv preprint arXiv:2406.00023 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.579116Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:a47463fb38e179153c59dd35950208a426f8b8351ca67364e6ad0d785edfdb00","observation_id":"b3eb1676-d9b5-45fa-b5dc-933c48aaa32b","resolution":{"observed_at":"2026-08-01T21:01:44.579116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.724025Z","title":"StableMoE: Stable Routing Strategy for Mixture of Experts , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.724025Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:20444be03e81bb20271227322c13d73567c888325035ac75c71d35c3249750cd","observation_id":"1ba42d76-4540-4001-9202-3e99a26a5a37","resolution":{"observed_at":"2026-08-01T21:01:44.724025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.835247Z","title":"THOR-MoE: Hierarchical Task-Guided and Context-Responsive Routing for Neural Machine Translation , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.835247Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:48c96f735f53780f9f9a1e28610eb3ebe51c35f3a6051783599cd141e1c15ac7","observation_id":"4aca609d-a384-416a-bc03-bf869e737e4c","resolution":{"observed_at":"2026-08-01T21:01:44.835247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:44.967343Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:44.967343Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:ba9c929994cb6c032011abb42e8899c41b282e6d0bf7b4294059acfb97e86a50","observation_id":"6521630b-9f55-44bd-8e4e-519af4ce3809","resolution":{"observed_at":"2026-08-01T21:01:44.967343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.087341Z","title":"Proceedings of the IEEE/CVF international conference on computer vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.087341Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:eefcca0c1870351388174360d781af3669bd880aeff182d8ad2d4a64459defcd","observation_id":"a3716d93-af71-445c-bde2-3fde07e00687","resolution":{"observed_at":"2026-08-01T21:01:45.087341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.156775Z","title":"Cross-Attention is All You Need: Adapting Pretrained Transformers for Machine Translation , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.156775Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:28a393611e0fe3e555c4d555f752eea8233d97e034628196459b68416b108dc7","observation_id":"a178d931-d408-4599-a0bb-1c4d2d7920bd","resolution":{"observed_at":"2026-08-01T21:01:45.156775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.223896Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.223896Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:41dd300f8dff1d3e7f497f836aeb0153323cbf6185f3628963f5f5632a35ca7e","observation_id":"16e9ff11-e312-4341-891e-8a9754355d2e","resolution":{"observed_at":"2026-08-01T21:01:45.223896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.303347Z","title":"Carbonell and Quoc Viet Le and Ruslan Salakhutdinov , editor =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.303347Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:7bec4d7555e7a16c910a32ca0e3c660bcd2d848aa1705ea035a665c51442e527","observation_id":"b2a9e037-6f41-454d-9618-60224c408e70","resolution":{"observed_at":"2026-08-01T21:01:45.303347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.348669Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.348669Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:b2d65aa298d6bbe2ae2af7ed7283b6fee526e3ee7f4e9dd25652b223170dfb1d","observation_id":"c9db6a07-d923-4031-8676-1cbc4775a6bb","resolution":{"observed_at":"2026-08-01T21:01:45.348669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-01T21:01:45.409030Z","title":"arXiv preprint arXiv:1609.07843 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.409030Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:97beb512ffa4a6fc173149d7b4b42dffe939404dab99c56a19d6d3fc16c14f73","observation_id":"c979e64f-b1a2-4efc-85eb-a46977936354","resolution":{"observed_at":"2026-08-01T21:01:45.409030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.449827Z","title":"Manning and Andrew Y","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.449827Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:cd7642237acbf7026284190268a182ee7cc22f6475f0abd1a3c446532c614402","observation_id":"7b22b3fc-ce7d-43b3-b6be-fb1b726ce9ca","resolution":{"observed_at":"2026-08-01T21:01:45.449827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-01T21:01:45.502744Z","title":"arXiv preprint arXiv:1804.07461 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.502744Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:3bdb62d61194f354f48ac028bb47b62edf75b9ef8b6a4f064a8f45bcb6b66312","observation_id":"94f57983-b277-423d-8748-5255bc16dd7d","resolution":{"observed_at":"2026-08-01T21:01:45.502744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07983","last_updated":"2024-11-12T18:08:45Z","snapshot_observed_at":"2026-08-04T05:34:51.547468Z","submitted_at":"2024-11-12T18:08:45Z","title":"Gini Coefficient as a Unified Metric for Evaluating Many-versus-Many Similarity in Vector Spaces","version":1},"cited_work":{"arxiv_id":"2411.07983","doi":"10.48550/arxiv.2411.07983","metadata_source":"pith","pith_arxiv_id":"2411.07983","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Gini Coefficient as a Unified Metric for Evaluating Many-versus-Many Similarity in Vector Spaces","venue":"cs.AI","work_id":"92cbdc6e-b78e-48b5-aeaa-5846703039aa","year":2024},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.560163Z"},"links":{"cited_paper":"/paper/2411.07983","citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:8d28620547d66fae4dd6a5481959e1ddf1f9faff3c391b012692aa999027e81b","observation_id":"825cfe30-6d4b-4711-ae38-d260cbb63a50","resolution":{"observed_at":"2026-08-01T21:04:37.386942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v37i11.26617","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MoEC: Mixture of Expert Clusters , booktitle =","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"7f601f24-2fbd-4219-afd7-c243ee645b08","year":2023},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.624588Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:32f15aa3c57c59a7bc978dd5771cf2907bc273ac9020213d400f0609c97c86a2","observation_id":"361cc15f-a4b3-4256-8aba-1799c31ad435","resolution":{"observed_at":"2026-08-01T21:04:37.303952Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T21:01:45.680930Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T21:01:45.680930Z"},"links":{"citing_paper":"/paper/2607.16427"},"observation_digest":"sha256:532bd6ab3991d34e5259452c8d7fdc62e8dfe55177c23547f81f9df95f1e8a88","observation_id":"a8bf9005-b0ac-45c4-a20a-e491d257c94f","resolution":{"observed_at":"2026-08-01T21:01:45.680930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16427","last_updated":"2026-07-17T18:22:42Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T12:02:22.399950Z","submitted_at":"2026-07-17T18:22:42Z","title":"Multi-level context Modeling for consistent expert selection in Mixture-of-Experts"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.16427."}