{"as_of":"2026-08-10T12:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:02183778a29cf2a4211bafae2c7cfbe5a976a985d4727d656bf5b83cd80e0d2e","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:37:46.441294Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T06:02:52.244884Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T08:26:48.315943Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"cited_work":{"arxiv_id":"2507.07818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07818","snapshot_observed_at":"2026-07-02T08:26:48.315943Z","title":"Mose: Skill-by-skill mixture-of-experts learning for embodied autonomous machines,","venue":null,"work_id":"759d3d90-f488-40be-ae94-200f23f9b1a3","year":2025},"citing_paper":{"arxiv_id":"2606.04884","last_updated":"2026-06-03T13:46:46Z","snapshot_observed_at":"2026-08-05T09:17:13.256063Z","submitted_at":"2026-06-03T13:46:46Z","title":"D$^3$-MoE:Dual Disentangled Diffusion Mixture-of-Experts for Style-Controllable End-to-End Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T06:02:52.244884Z"},"links":{"cited_paper":"/paper/2507.07818","citing_paper":"/paper/2606.04884"},"observation_digest":"sha256:d792e6bc5bd5c566f3789ab457b0fb5d42abeace45d2dc09edfa4f3ed2ad42e0","observation_id":"6c0db8a3-3f58-49a1-8d04-192b6c2c2481","resolution":{"observed_at":"2026-07-02T08:26:48.317451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07818/citation-record","integrity":"/paper/2507.07818/integrity","json":"/paper/2507.07818/citation-record.json","paper":"/paper/2507.07818"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:43.006424Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.006424Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:41b1cb51c95efb4e41c66f20950a81083f6e9eabc173f9dbf8aebca555a08a58","observation_id":"dd9b177f-34be-43b8-89c5-4f0e9559916c","resolution":{"observed_at":"2026-08-06T18:37:43.006424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T18:37:43.131103Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.131103Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:8f0e152673048550b480f5dd31f62850b5fb74c93a299b1ff260c7876de8d455","observation_id":"41e8ba27-e195-4415-a321-bae0fcf75039","resolution":{"observed_at":"2026-08-06T18:37:43.131103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17834","last_updated":"2024-02-27T19:00:07Z","snapshot_observed_at":"2026-07-06T17:36:27.931373Z","submitted_at":"2024-02-27T19:00:07Z","title":"Stable LM 2 1.6B Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17834","snapshot_observed_at":"2026-08-06T18:37:43.188523Z","title":"Stable lm 2 1.6 b technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.188523Z"},"links":{"cited_paper":"/paper/2402.17834","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:f665f5470d9a51d06951b1b6ea76fdc78173178788916d06340ffa758382380b","observation_id":"226d1cf1-0197-4c11-93c2-7c9e1ece8f0c","resolution":{"observed_at":"2026-08-06T18:37:43.188523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.11027","last_updated":"2020-05-05T09:13:24Z","snapshot_observed_at":"2026-08-08T05:33:42.283828Z","submitted_at":"2019-03-26T17:19:56Z","title":"nuScenes: A multimodal dataset for autonomous driving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.11027","snapshot_observed_at":"2026-08-06T18:37:43.254429Z","title":"Lang, Sourabh Vora, Venice Erin Liong, Qiang Xu, Anush Krishnan, Yu Pan, Giancarlo Baldan, and Oscar Beijbom","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.254429Z"},"links":{"cited_paper":"/paper/1903.11027","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:4d8cbebe45adf42b86248ee337236de71ead0f9ae10c056853fbde5495be9b43","observation_id":"035bce93-1f69-4de4-9c7f-0245ceb4ee3c","resolution":{"observed_at":"2026-08-06T18:37:43.254429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-06T18:37:43.370613Z","title":"Shikra: Unleashing multimodal llm's referential dialogue magic","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.370613Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:79ea186ecf2f55f3e16a605ec76f43ca07b92f6a9169ec65e9ed130d6be3767f","observation_id":"f46c68ad-b279-4d63-8b96-9937854540a5","resolution":{"observed_at":"2026-08-06T18:37:43.370613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10595","last_updated":"2024-12-06T01:54:59Z","snapshot_observed_at":"2026-08-09T19:39:22.676077Z","submitted_at":"2024-04-16T14:20:55Z","title":"Automated Evaluation of Large Vision-Language Models on Self-driving Corner Cases","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10595","snapshot_observed_at":"2026-08-06T18:37:43.421592Z","title":"Automated evaluation of large vision-language models on self-driving corner cases","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.421592Z"},"links":{"cited_paper":"/paper/2404.10595","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:63a1f6912840afad19e75615015f73861048dfa9d9a9a77d936a43c2de55cd88","observation_id":"f75bcb01-631b-40ea-904d-0508db5d7e0d","resolution":{"observed_at":"2026-08-06T18:37:43.421592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:50.279792Z","title":"Driving with llms: Fusing object-level vector modality for explainable autonomous driving","venue":null,"work_id":"84edc16b-d827-41e6-8ad2-1c362d21f06c","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.493213Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:4a5374f1a20f201ae0d9108cd1a8e28299b218fa121dc48518a92d9d00655aa2","observation_id":"37f2feec-768b-4037-bf41-91debb223555","resolution":{"observed_at":"2026-08-06T18:37:50.409725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:49.916595Z","title":"AdaMV-MoE : Adaptive multi-task vision mixture-of-experts","venue":null,"work_id":"dd45012e-e4ca-4b6e-998e-75051e0bf653","year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.577182Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:d5f3097509176ba62a071e1f653b89e2d62e694da4c24ae7af891fbc5efe89f2","observation_id":"17a83839-8f01-40a8-ac31-e33322cd34e4","resolution":{"observed_at":"2026-08-06T18:37:50.091903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-06T18:37:43.654779Z","title":"How far are we to gpt-4v? closing the gap to commercial multimodal models with open-source suites","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.654779Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:eccb02a924db66e0fb23de07a594cff4e58730d3f5743b570aaa83b26ac232f4","observation_id":"3387ea54-5524-4ebf-be5e-7f6bcbaaea40","resolution":{"observed_at":"2026-08-06T18:37:43.654779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:49.632653Z","title":"Qwen-vl-max: A high-performance vision-language model, 2024","venue":null,"work_id":"5922cdfd-71e1-41e3-86cf-76934d91e4a2","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.746929Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:780f5b3a134ebd4a50ff80a3ef5bffb2ffb795f95c98e44691b5418cfed5f5e4","observation_id":"bcd5ea30-12e8-45de-8fbc-928b722b9736","resolution":{"observed_at":"2026-08-06T18:37:49.760319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:43.824536Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.824536Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:9383c356b8d195ebc918e68c243d4988aa11dc78d0e0e9a37f8a35c76d22454f","observation_id":"ceb72f98-e359-465e-8e4e-5268d0b94383","resolution":{"observed_at":"2026-08-06T18:37:43.824536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T18:37:43.912623Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:43.912623Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:13375bbbb64d92381c64dab15938908467fcefa26ca10050fb1d764d951a2bc5","observation_id":"13687786-8b02-4c1c-9bed-2131bd069e15","resolution":{"observed_at":"2026-08-06T18:37:43.912623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:44.005943Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.005943Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:01bcbaf6e13bcbd458104580ba37dd17a33ceb3a55233e913f5267b0aea7699d","observation_id":"f1817b2e-acbc-4aea-97be-fdec8af77a8f","resolution":{"observed_at":"2026-08-06T18:37:44.005943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T18:37:44.073982Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.073982Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:6da7e3098f391ad0c9cb19eb2bdcdb8d83d2fdd8558e560cb55599f33aa9d2a7","observation_id":"1fbd3099-efba-4e77-aba1-8223580de194","resolution":{"observed_at":"2026-08-06T18:37:44.073982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:49.314618Z","title":"From regional to general: A vision-language model-based framework for corner cases comprehension in autonomous driving","venue":null,"work_id":"256c37a2-11ea-44e4-af36-6f72a6026475","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.175293Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:f80dcaf64a5eee3656535a1b5087db8700ef0aaa0278aa344598787c045d9634","observation_id":"37dff330-5c94-4656-9c29-e46c03b36b6c","resolution":{"observed_at":"2026-08-06T18:37:49.466464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:48.520345Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":"f92bd833-5ef1-43aa-bebb-f3a5c2e80a7b","year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.227270Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:3980e3e7161284406b5faa45ba4c6715b87744ec756e55f80e17c71751baad76","observation_id":"c39b43f7-553d-4fa8-b882-a8ce5af221a1","resolution":{"observed_at":"2026-08-06T18:37:48.849077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07689","last_updated":"2025-08-07T06:38:32Z","snapshot_observed_at":"2026-07-06T20:04:48.422043Z","submitted_at":"2024-12-10T17:27:32Z","title":"RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07689","snapshot_observed_at":"2026-08-06T18:37:44.330575Z","title":"Drivemm: All-in-one large multimodal model for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.330575Z"},"links":{"cited_paper":"/paper/2412.07689","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:27289f465ff7e2aa9ced88c3c614f8fd21f1170049ebb164376949b54ebf3092","observation_id":"208520fc-ef92-4241-8d61-1fd602e8cc42","resolution":{"observed_at":"2026-08-06T18:37:44.330575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:48.267777Z","title":"Making large language models better planners with reasoning-decision alignment, 2024 b","venue":null,"work_id":"adc10e4a-5d9f-4daf-be5a-1842f833fada","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.391895Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:2f6c7045d75b8fcac34e007f0d949011c5a0f8e74d458d3d576909b7a982139b","observation_id":"a50447ba-ee14-44df-8cae-aa3de68d0a6a","resolution":{"observed_at":"2026-08-06T18:37:48.360150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:48.098428Z","title":null,"venue":null,"work_id":"05190a47-c7d2-4d84-924a-d7a384ddcf34","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.429974Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:a8afcc61450d8c891ccb3ffabca0324d563f9211d35ddcd0d468fb81874566ca","observation_id":"705c16b4-2634-4fa7-834e-4c878261629f","resolution":{"observed_at":"2026-08-06T18:37:48.176300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10237","last_updated":"2024-09-01T16:39:31Z","snapshot_observed_at":"2026-08-07T06:50:58.775402Z","submitted_at":"2024-04-16T02:35:17Z","title":"Med-MoE: Mixture of Domain-Specific Experts for Lightweight Medical Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10237","snapshot_observed_at":"2026-08-06T18:37:44.507398Z","title":"Moe-tinymed: Mixture of experts for tiny medical large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.507398Z"},"links":{"cited_paper":"/paper/2404.10237","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:b24fb3d7b88af1e50252068c132def76465295f0e42f3e805f6223e7ff770173","observation_id":"08425c3b-cea7-4a62-89f6-060f4486ea08","resolution":{"observed_at":"2026-08-06T18:37:44.507398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-08-07T09:27:36.420559Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-08-06T18:37:44.567764Z","title":"Gshard: Scaling giant models with conditional computation and automatic sharding","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.567764Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:1172ee619e6703ababdc7834dc0346bd295c4aedee78ba4518d3630014e62981","observation_id":"15c83ebb-9597-477f-9ab8-140bf0a5e143","resolution":{"observed_at":"2026-08-06T18:37:44.567764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-06T18:37:44.668987Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.668987Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:fb673fdd7feb4a542d7b10be02e1b85f131ba836ef0e92bf136b270311263c5a","observation_id":"f3024295-eb79-4046-bdc1-e521673d8a7e","resolution":{"observed_at":"2026-08-06T18:37:44.668987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:47.944374Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"8accacb3-403d-461b-9d6e-5fbe4e7c0592","year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.737427Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:e97df52e27f8c47e7dd9c0b0018b8ce794bbcd9a68bf22f442d0b3934c3c6850","observation_id":"08b1fab0-830a-4e8d-b47b-88599f0f41cb","resolution":{"observed_at":"2026-08-06T18:37:48.030031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15947","last_updated":"2024-12-23T08:05:14Z","snapshot_observed_at":"2026-08-06T02:31:58.372974Z","submitted_at":"2024-01-29T08:13:40Z","title":"MoE-LLaVA: Mixture of Experts for Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15947","snapshot_observed_at":"2026-08-06T18:37:44.808524Z","title":"Moe-llava: Mixture of experts for large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.808524Z"},"links":{"cited_paper":"/paper/2401.15947","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:2209cce5e7909cf4d46c2ba65ff55797fcdbac8b38dadef6793e48c7a35b903c","observation_id":"a49f957b-7b22-46b0-8cdf-7bf838e74df8","resolution":{"observed_at":"2026-08-06T18:37:44.808524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:47.738941Z","title":"Moma: Efficient early-fusion pre-training with mixture of modality-aware experts, 2024 b","venue":null,"work_id":"457645f0-4463-42fb-ade2-fd8fa8effde4","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.865125Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:cb7dbe1394e7c5e1608455aecf9ca1f745229adf9c1dfdba99b4587b32daea05","observation_id":"2c2e9f44-4840-4713-a710-4540a1339876","resolution":{"observed_at":"2026-08-06T18:37:47.808005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:44.972759Z","title":"Improved baselines with visual instruction tuning, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:44.972759Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:7e389c2b22e2d84a7f96cc41d72614de4e3e46c45ee94cefea2cb55aaa5eb3c7","observation_id":"e38584df-0703-4f92-bb3a-649120cbda23","resolution":{"observed_at":"2026-08-06T18:37:44.972759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:45.037569Z","title":"Visual instruction tuning, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.037569Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:339b160721672993a1a6effcb22d06bdb2594ea53a9aeb06af41c410b07a1917","observation_id":"8613ffa9-7c0a-45e5-856e-b692bbb3df22","resolution":{"observed_at":"2026-08-06T18:37:45.037569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:45.119217Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.119217Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:2a96a4f9e594cdacb589af1077b987818002c807df6273c011691cfe33cce852","observation_id":"54b403ca-5d3b-4914-8e15-9e01f8d2f9bd","resolution":{"observed_at":"2026-08-06T18:37:45.119217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01415","last_updated":"2023-12-05T05:26:29Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:57Z","title":"GPT-Driver: Learning to Drive with GPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01415","snapshot_observed_at":"2026-08-06T18:37:45.201566Z","title":"GPT -driver: Learning to drive with gpt","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.201566Z"},"links":{"cited_paper":"/paper/2310.01415","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:80db599e2184a3a67186a7384d59fd28ae9f1e326d2a9a4a9f2923c20da9a5f2","observation_id":"7525c862-a7e6-4949-b811-0db14d56237f","resolution":{"observed_at":"2026-08-06T18:37:45.201566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:47.511208Z","title":"Gpt-4v system card","venue":null,"work_id":"ae22ae91-d391-4e91-8687-2fb1f233fefd","year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.275342Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:1b520c60416e3095a77e4606679ba358f6fbe01d9b8180917e5bff7ef88d2eef","observation_id":"c8f031f5-16fd-4c46-9e18-a20906993e08","resolution":{"observed_at":"2026-08-06T18:37:47.608696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03026","last_updated":"2025-04-15T03:45:30Z","snapshot_observed_at":"2026-07-06T16:27:51.438846Z","submitted_at":"2023-10-04T17:59:49Z","title":"LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03026","snapshot_observed_at":"2026-08-06T18:37:45.330042Z","title":"Languagempc: Large language models as decision makers for autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.330042Z"},"links":{"cited_paper":"/paper/2310.03026","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:c70ef198979915482dfbccdb64b5e2ded2263aecdb57b2eb88ae7d6f874d8b50","observation_id":"b4a901a6-6a8b-4ad1-896b-39bd0ebdaf35","resolution":{"observed_at":"2026-08-06T18:37:45.330042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:47.353297Z","title":"Lmdrive: Closed-loop end-to-end driving with large language models","venue":null,"work_id":"cb1369ff-c4e8-4991-abe3-0a67650f7b53","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.416140Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:58e09ec6c6f27407a0b95e30f4be65c110036deeba61ee31ce1afa5deb16817f","observation_id":"8e9f60ed-40dd-46b7-a0a6-c7f113b717c8","resolution":{"observed_at":"2026-08-06T18:37:47.428519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-06T18:37:45.491881Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.491881Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:7bed6d2ef27f48ee6defff379ca300e64be45120f4fc1f12d7f8c1d688fbcf2f","observation_id":"bf62d979-6ff7-4c40-8fc3-0f5d9bc1b76f","resolution":{"observed_at":"2026-08-06T18:37:45.491881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14150","last_updated":"2025-01-16T10:57:44Z","snapshot_observed_at":"2026-07-06T17:06:45.522731Z","submitted_at":"2023-12-21T18:59:12Z","title":"DriveLM: Driving with Graph Visual Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14150","snapshot_observed_at":"2026-08-06T18:37:45.568121Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.568121Z"},"links":{"cited_paper":"/paper/2312.14150","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:8087f6be9c803697c2c1a2967e60713f9f55e574b7d59bff422574680c7e7879","observation_id":"21e183e7-d9bf-463b-b53d-feccc26bf41e","resolution":{"observed_at":"2026-08-06T18:37:45.568121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T18:37:45.673966Z","title":"Qwen2-vl: Enhancing vision-language model's perception of the world at any resolution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.673966Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:bd2168bfab04ee0dc0803172aa375507f33ec93d3ff4bdae03734afbb736f9dc","observation_id":"23b76a4e-41e6-4102-909b-d05e0d7b7417","resolution":{"observed_at":"2026-08-06T18:37:45.673966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01533","last_updated":"2025-04-16T15:12:21Z","snapshot_observed_at":"2026-08-07T03:24:13.032388Z","submitted_at":"2024-05-02T17:59:24Z","title":"OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01533","snapshot_observed_at":"2026-08-06T18:37:45.752864Z","title":"Omnidrive: A holistic llm-agent framework for autonomous driving with 3d perception, reasoning and planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.752864Z"},"links":{"cited_paper":"/paper/2405.01533","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:c5c2b08991f2d66dab6650f3bfc02b6ac9c396f42157657cc9ec99544fddf72d","observation_id":"b07d8080-d6a9-4313-9b60-0fe51ef14d6f","resolution":{"observed_at":"2026-08-06T18:37:45.752864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05332","last_updated":"2023-11-28T09:47:57Z","snapshot_observed_at":"2026-07-06T16:45:11.604296Z","submitted_at":"2023-11-09T12:58:37Z","title":"On the Road with GPT-4V(ision): Early Explorations of Visual-Language Model on Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05332","snapshot_observed_at":"2026-08-06T18:37:45.837334Z","title":"On the road with gpt-4v (ision): Early explorations of visual-language model on autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.837334Z"},"links":{"cited_paper":"/paper/2311.05332","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:490718b33c88579d8b9976ad4d4e9935f87d2b591195400d64060e679fbb43af","observation_id":"ab119678-ae2b-4583-be42-ab3add7e1a52","resolution":{"observed_at":"2026-08-06T18:37:45.837334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:47.172381Z","title":"Two-stage lvlm system: 1st place solution for eccv 2024 corner case scene understanding challenge","venue":null,"work_id":"09fa5a90-e87e-4d32-a80c-1d41c40eaeda","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.918065Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:6bb1c08e05420e50865ba908ba46e75e3944bf645f103e75fca17762c30c3383","observation_id":"d789d401-3624-4b30-a015-00980ab687e3","resolution":{"observed_at":"2026-08-06T18:37:47.244661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-06T18:37:45.972426Z","title":"Minicpm-v: A gpt-4v level mllm on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:45.972426Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:98b4629d39d5f8f2d013e8099b81a7c0118b1eea738166127af6dddfb1c8d4c0","observation_id":"6d778d01-a12e-4015-a18a-b2fe06d7fc4e","resolution":{"observed_at":"2026-08-06T18:37:45.972426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:46.995124Z","title":"Flex-moe: Modeling arbitrary modality combination via the flexible mixture-of-experts","venue":null,"work_id":"e472adea-b839-4561-a749-c7a5f541d0ad","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:46.073957Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:d203b1c93c298841ec7e8d0c9ad293f9138f73b6ceedf5f557a03b028d872c1c","observation_id":"b2be8034-3639-4772-9c79-34d983dd8a63","resolution":{"observed_at":"2026-08-06T18:37:47.083633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:46.195794Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:46.195794Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:ccedf6c86f7aff60f2ccf7eb072ee53d238194dca8fae3052e0e86146f6483f4","observation_id":"e0d118b6-0f14-48c4-b74d-3d9dad7c8798","resolution":{"observed_at":"2026-08-06T18:37:46.195794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07267","last_updated":"2025-05-21T08:38:11Z","snapshot_observed_at":"2026-07-06T19:13:46.489307Z","submitted_at":"2024-09-11T13:43:01Z","title":"MiniDrive: More Efficient Vision-Language Models with Multi-Level 2D Features as Text Tokens for Autonomous Driving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07267","snapshot_observed_at":"2026-08-06T18:37:46.269978Z","title":"Minidrive: More efficient vision-language models with multi-level 2d features as text tokens for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:46.269978Z"},"links":{"cited_paper":"/paper/2409.07267","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:7de0da89e0c66ec21fa72796ed9d4d6220ddfe503ba87b6574158e9c48654ef6","observation_id":"5f813ce0-2054-427d-b11b-70dab2f5dd13","resolution":{"observed_at":"2026-08-06T18:37:46.269978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:46.819887Z","title":"Diversifying the expert knowledge for task-agnostic pruning in sparse mixture-of-experts, 2024 b","venue":null,"work_id":"82a167e8-f4b9-4186-ac97-f3eeb8eee95e","year":2024},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:46.338934Z"},"links":{"citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:c2f489fce88b9f23b849e3abe113f80de785994efaaf48d1d62fadc8486bd025","observation_id":"e04c8bf4-71a5-4603-8a24-c4349f920eec","resolution":{"observed_at":"2026-08-06T18:37:46.894735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.08906","last_updated":"2022-04-29T23:24:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-17T21:39:10Z","title":"ST-MoE: Designing Stable and Transferable Sparse Expert Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.08906","snapshot_observed_at":"2026-08-06T18:37:46.441294Z","title":"St-moe: Designing stable and transferable sparse expert models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T18:37:46.441294Z"},"links":{"cited_paper":"/paper/2202.08906","citing_paper":"/paper/2507.07818"},"observation_digest":"sha256:ce375dd170d85a7cdf8cf0314552b55a13a49fc5f0827eaa2e80df2199ceffab","observation_id":"c3dd1e9b-0d51-4115-8e98-174d7f77f9a8","resolution":{"observed_at":"2026-08-06T18:37:46.441294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07818","last_updated":"2025-08-13T13:45:40Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T10:16:46.598524Z","submitted_at":"2025-07-10T14:48:08Z","title":"MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2507.07818."}