{"as_of":"2026-08-09T11:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f170adb8d4ae4c15a5e6989a77b2f4b601dbcad34f6dff0fc5569b85e6f67821","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:11:44.679976Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T23:07:26.954408Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-08-08T11:11:44.679976Z","title":"Llama-moe: Building mixture-of-experts from llama with continual pre-training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-09T10:33:59.337803Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.679976Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:a27ea11355506f60d5211fa37ee337e2cee3c4335fc363492131cff73c610eb8","observation_id":"8f6bc54d-51fa-4d30-a039-f45eec127b6c","resolution":{"observed_at":"2026-08-08T11:11:44.679976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":"2406.16554","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-07-02T23:07:26.954408Z","title":"Barret Zoph, Irwan Bello, Sameer Kumar, Nan Du, Yanping Huang, Jeff Dean, Noam Shazeer, and William Fedus","venue":null,"work_id":"8a60caac-fc1e-4de0-a4e3-8cde6cba8221","year":2022},"citing_paper":{"arxiv_id":"2503.05066","last_updated":"2026-05-11T07:44:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T01:11:39Z","title":"Capacity-Aware Inference: Mitigating the Straggler Effect in Mixture of Experts","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-23T00:41:06.928901Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2503.05066"},"observation_digest":"sha256:ee35482c5b8f9e7bd70412b8cae21201f4f37fd450f640823bbe736a73c86709","observation_id":"b47f7ec8-35ea-4b69-b7ec-e1479ca3f138","resolution":{"observed_at":"2026-05-23T00:42:18.945254Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-08-07T10:51:51.683200Z","title":"Llama-moe: Building mixture-of-experts from llama with continual pre-training, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04179","last_updated":"2025-06-04T17:26:31Z","snapshot_observed_at":"2026-08-08T19:35:37.122227Z","submitted_at":"2025-06-04T17:26:31Z","title":"SkipGPT: Dynamic Layer Pruning Reinvented with Token Awareness and Module Decoupling","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T10:51:51.683200Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2506.04179"},"observation_digest":"sha256:333735f1fe4ec20b9d094edee3a83a4d32007b84e49178a7832a98f2823a4866","observation_id":"98eb3340-97d0-4814-a797-4655cb23ce42","resolution":{"observed_at":"2026-08-07T10:51:51.683200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-08-07T11:16:27.699854Z","title":"arXiv:2406.16554","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05387","last_updated":"2025-06-11T16:08:29Z","snapshot_observed_at":"2026-08-08T01:16:04.570452Z","submitted_at":"2025-06-03T14:25:23Z","title":"Advancing Decoding Strategies: Enhancements in Locally Typical Sampling for LLMs","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:16:27.699854Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2506.05387"},"observation_digest":"sha256:866ff0ba9c9a58a606e256d2f38afbbab9853e382b32fbe3c4bc50a6933bba9e","observation_id":"fd57d111-fff1-4639-9807-85a833381b4b","resolution":{"observed_at":"2026-08-07T11:16:27.699854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-08-06T19:24:08.792099Z","title":"Llama-moe: Building mixture-of-experts from llama with continual pre-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05899","last_updated":"2025-07-08T11:40:21Z","snapshot_observed_at":"2026-08-06T19:13:11.550970Z","submitted_at":"2025-07-08T11:40:21Z","title":"What You Have is What You Track: Adaptive and Robust Multimodal Tracking","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:24:08.792099Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2507.05899"},"observation_digest":"sha256:b491cec19ba44085489d5d2c3c9d6e6cb54e4af14344a3a1889629a95f8fe301","observation_id":"c08b4482-fd4b-4221-ad99-dcfc3ed6430e","resolution":{"observed_at":"2026-08-06T19:24:08.792099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-08-05T11:48:31.650615Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02408","last_updated":"2025-09-02T15:19:06Z","snapshot_observed_at":"2026-08-09T05:24:20.880549Z","submitted_at":"2025-09-02T15:19:06Z","title":"Cache Management for Mixture-of-Experts LLMs -- extended version","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T11:48:31.650615Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2509.02408"},"observation_digest":"sha256:1afc90bbe752cf9828ee32fb2ef87ff1291d68bc12415904247f507b8bd7f785","observation_id":"10ff67a0-a7f8-4099-95ec-b74ad7ce786a","resolution":{"observed_at":"2026-08-05T11:48:31.650615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":"2406.16554","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-07-02T23:07:26.954408Z","title":"Barret Zoph, Irwan Bello, Sameer Kumar, Nan Du, Yanping Huang, Jeff Dean, Noam Shazeer, and William Fedus","venue":null,"work_id":"8a60caac-fc1e-4de0-a4e3-8cde6cba8221","year":2022},"citing_paper":{"arxiv_id":"2509.08470","last_updated":"2026-04-28T12:49:51Z","snapshot_observed_at":"2026-07-31T07:42:25.034469Z","submitted_at":"2025-09-10T10:18:56Z","title":"Joint Learning using Mixture-of-Expert-Based Representation for Speech Enhancement and Robust Emotion Recognition","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-18T18:07:34.965356Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2509.08470"},"observation_digest":"sha256:7297cd0fa0d8c975317f518d55c64cbfc1beceeef81419defedede5d2933e345","observation_id":"49b32749-8ee2-4538-b980-47f77ca29085","resolution":{"observed_at":"2026-05-18T18:11:42.887285Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":"2406.16554","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-07-02T23:07:26.954408Z","title":"Barret Zoph, Irwan Bello, Sameer Kumar, Nan Du, Yanping Huang, Jeff Dean, Noam Shazeer, and William Fedus","venue":null,"work_id":"8a60caac-fc1e-4de0-a4e3-8cde6cba8221","year":2022},"citing_paper":{"arxiv_id":"2605.00515","last_updated":"2026-05-21T12:32:36Z","snapshot_observed_at":"2026-08-05T17:39:35.645676Z","submitted_at":"2026-05-01T08:40:31Z","title":"SpaceMoE: Realizing Distributed Mixture-of-Experts Inference over Space Networks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-09T19:19:29.373341Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2605.00515"},"observation_digest":"sha256:d5d327f2de907fa93aa617928af787fa1ebaf2c2ba87ec2e62cdf311289d0ef9","observation_id":"d2bd2f76-b788-4259-a3a7-debb33b2b07a","resolution":{"observed_at":"2026-05-11T15:46:32.673374Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":"2406.16554","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-07-02T23:07:26.954408Z","title":"Barret Zoph, Irwan Bello, Sameer Kumar, Nan Du, Yanping Huang, Jeff Dean, Noam Shazeer, and William Fedus","venue":null,"work_id":"8a60caac-fc1e-4de0-a4e3-8cde6cba8221","year":2022},"citing_paper":{"arxiv_id":"2605.00515","last_updated":"2026-05-21T12:32:36Z","snapshot_observed_at":"2026-08-05T17:39:35.645676Z","submitted_at":"2026-05-01T08:40:31Z","title":"SpaceMoE: Realizing Distributed Mixture-of-Experts Inference over Space Networks","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T10:18:51.427958Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2605.00515"},"observation_digest":"sha256:943d232c43da554054a6c1aeec51e553db3f3a9a5bc8d816ed4181ca01ca4a92","observation_id":"6454f84f-29bc-4284-ad07-8083e4aeb4a2","resolution":{"observed_at":"2026-05-22T10:21:24.099443Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":"2406.16554","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-07-02T23:07:26.954408Z","title":"Barret Zoph, Irwan Bello, Sameer Kumar, Nan Du, Yanping Huang, Jeff Dean, Noam Shazeer, and William Fedus","venue":null,"work_id":"8a60caac-fc1e-4de0-a4e3-8cde6cba8221","year":2022},"citing_paper":{"arxiv_id":"2605.08292","last_updated":"2026-05-08T09:21:46Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T09:21:46Z","title":"Hierarchical Mixture-of-Experts with Two-Stage Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T01:58:04.218139Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2605.08292"},"observation_digest":"sha256:2f1fa3778cfec77ab9b9a3a613f95b4f49566647486f0706c2984492172e5c5d","observation_id":"7eba4ded-7b8a-4bce-960d-721b26e65e94","resolution":{"observed_at":"2026-05-12T02:01:15.417509Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":"2406.16554","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-07-02T23:07:26.954408Z","title":"Barret Zoph, Irwan Bello, Sameer Kumar, Nan Du, Yanping Huang, Jeff Dean, Noam Shazeer, and William Fedus","venue":null,"work_id":"8a60caac-fc1e-4de0-a4e3-8cde6cba8221","year":2022},"citing_paper":{"arxiv_id":"2606.08814","last_updated":"2026-06-07T20:07:24Z","snapshot_observed_at":"2026-08-02T23:58:50.946844Z","submitted_at":"2026-06-07T20:07:24Z","title":"STAR: Rethinking MoE Routing as Structure-Aware Subspace Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T18:28:35.162934Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2606.08814"},"observation_digest":"sha256:cf620f27dd50e1b352b67931ba5e940984965853f6e7d7e6d1e2c83f06fda546","observation_id":"6694fa8b-d885-4fb0-9403-2d9c89351ea9","resolution":{"observed_at":"2026-07-02T23:07:26.955931Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-07-11T08:35:22.347459Z","title":"Llama-moe: Building mixture-of-experts from llama with continual pre- training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05116","last_updated":"2026-07-06T14:06:25Z","snapshot_observed_at":"2026-08-02T18:01:37.878392Z","submitted_at":"2026-07-06T14:06:25Z","title":"Communication-Aware Placement and Pruning for Efficient Mixture-of-Experts Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T08:35:22.347459Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2607.05116"},"observation_digest":"sha256:3fd76047dff80e0418deee0a00022f9bde3fabf74e35f1dbea17dd8234b772b2","observation_id":"a9d5063a-4740-4c6d-b2cc-80d401e61ba8","resolution":{"observed_at":"2026-07-11T08:35:22.347459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-08-05T00:38:33.524012Z","title":"arXiv:2406.16554","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00574","last_updated":"2026-08-01T10:23:04Z","snapshot_observed_at":"2026-08-07T09:45:34.726642Z","submitted_at":"2026-08-01T10:23:04Z","title":"Relax Within, Balance Across: Geometry-Guided Load Balancing for Vision-Language Mixture-of-Experts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T00:38:33.524012Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2608.00574"},"observation_digest":"sha256:95efb9c80ca4b9215a6fc8a5f009e51196f8eae8e26a0ff12bdea7fe0fceda9f","observation_id":"d8894212-f9b9-487c-bbad-d57313341194","resolution":{"observed_at":"2026-08-05T00:38:33.524012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.16554/citation-record","integrity":"/paper/2406.16554/integrity","json":"/paper/2406.16554/citation-record.json","paper":"/paper/2406.16554"},"outbound":[],"paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2406.16554."}