{"as_of":"2026-08-12T14:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b344927ef67d8d4847bdd9ec7f0e5d343d2098de7eb2d60d8a2f28a2bb6a5a97","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:33:40.263979Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-08-12T06:05:23.730517Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":"ArXiv.org","work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2512.12476","last_updated":"2026-04-11T14:05:07Z","snapshot_observed_at":"2026-08-12T11:22:44.594256Z","submitted_at":"2025-12-13T22:20:51Z","title":"HetRL: Efficient Reinforcement Learning for LLMs in Heterogeneous Environments","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-16T22:21:26.271796Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2512.12476"},"observation_digest":"sha256:ccad1c05928251671a86c1a3e7f8682af5aaec64882ac8bfa465a1b65d61cc0d","observation_id":"9bac683c-ab8e-428f-83f6-c22cf25fc492","resolution":{"observed_at":"2026-05-16T22:23:36.605292Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-08-12T06:05:23.730517Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":"ArXiv.org","work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2604.19241","last_updated":"2026-04-21T08:49:27Z","snapshot_observed_at":"2026-08-12T00:25:37.564977Z","submitted_at":"2026-04-21T08:49:27Z","title":"UniEP: Unified Expert-Parallel MoE MegaKernel for LLM Training","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T02:20:00.625923Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2604.19241"},"observation_digest":"sha256:d1df56ade502882450c7a66f623d54a5adb1d5e865edca99850839f1cff78109","observation_id":"8d7c778e-2d3e-43e1-a02c-b76f054756b3","resolution":{"observed_at":"2026-05-10T02:22:20.798325Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-08-12T06:05:23.730517Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":"ArXiv.org","work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2605.11005","last_updated":"2026-05-10T05:57:05Z","snapshot_observed_at":"2026-08-12T07:44:45.046004Z","submitted_at":"2026-05-10T05:57:05Z","title":"DisagMoE: Computation-Communication overlapped MoE Training via Disaggregated AF-Pipe Parallelism","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T01:08:45.674652Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2605.11005"},"observation_digest":"sha256:b92bd949775ab3d4969ca62a082a84eaafc743adaeae5107feb4ad5e62742d4c","observation_id":"f3d9f39d-42f0-4ce3-8b2b-310170deda5c","resolution":{"observed_at":"2026-05-13T01:52:06.246426Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-08-12T06:05:23.730517Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":"ArXiv.org","work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2605.20982","last_updated":"2026-07-17T08:33:40Z","snapshot_observed_at":"2026-08-02T13:33:38.641735Z","submitted_at":"2026-05-20T10:14:00Z","title":"Diagnosing Overhead in Dispatch Operations: Cross-architecture Observatory","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T02:11:11.003259Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2605.20982"},"observation_digest":"sha256:c6a5c550453f4f87cd54e82c58ed1a41d5974621887705010dc1595e15171e70","observation_id":"eb532d72-1c50-4332-b932-ad5748e901c8","resolution":{"observed_at":"2026-05-21T02:13:55.955085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-08-12T06:05:23.730517Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-08-02T13:33:40.263979Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.20982","last_updated":"2026-07-17T08:33:40Z","snapshot_observed_at":"2026-08-02T13:33:38.641735Z","submitted_at":"2026-05-20T10:14:00Z","title":"Diagnosing Overhead in Dispatch Operations: Cross-architecture Observatory","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T13:33:40.263979Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2605.20982"},"observation_digest":"sha256:e7f89e78ed1289154b6e184afc9d572e858e079be3219d00f8267202fe8823cf","observation_id":"9d7712e8-5e1e-4855-b8d2-651549a2597e","resolution":{"observed_at":"2026-08-02T13:33:40.263979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","snapshot_observed_at":"2026-08-12T06:05:23.730517Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs","version":1},"cited_work":{"arxiv_id":"2504.03871","doi":"10.48550/arxiv.2504.03871","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HeterMoE: Efficient training of mixture-of-experts models on heterogeneous gpus","venue":"ArXiv.org","work_id":"d1a5f223-4c92-416a-8bdd-1545f0ca369b","year":2025},"citing_paper":{"arxiv_id":"2606.26633","last_updated":"2026-06-25T05:50:46Z","snapshot_observed_at":"2026-08-06T17:28:20.433752Z","submitted_at":"2026-06-25T05:50:46Z","title":"Simulating Unified Tensor Resharding in heterogeneous AI systems","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-26T04:00:26.409243Z"},"links":{"cited_paper":"/paper/2504.03871","citing_paper":"/paper/2606.26633"},"observation_digest":"sha256:44d7697b6ecacc98be95375a421083ffa030cbf36440243cac71869837953ebf","observation_id":"f86ca2d7-8180-4d8c-b3b9-67078792f97b","resolution":{"observed_at":"2026-07-04T14:19:54.701427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T09:24:51.239515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.03871/citation-record","integrity":"/paper/2504.03871/integrity","json":"/paper/2504.03871/citation-record.json","paper":"/paper/2504.03871"},"outbound":[],"paper":{"arxiv_id":"2504.03871","last_updated":"2025-04-04T18:55:52Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-12T06:05:23.730517Z","submitted_at":"2025-04-04T18:55:52Z","title":"HeterMoE: Efficient Training of Mixture-of-Experts Models on Heterogeneous GPUs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2504.03871."}