{"as_of":"2026-08-11T00:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c940136080afe2dd7cfb25c9a9320e794334f961a5edf6e7f196c27d8dfcc609","coverage":[{"denominator":10,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T09:39:41.790057Z","state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.31413/citation-record","integrity":"/paper/2606.31413/integrity","json":"/paper/2606.31413/citation-record.json","paper":"/paper/2606.31413"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:39:41.559189Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:41.559189Z"},"links":{"citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:291444068105c09937b269576a50e49d0652b9c5669b9d62fcc24b359a3aabf6","observation_id":"d5087d3f-7591-4879-9769-ffe524f4e762","resolution":{"observed_at":"2026-08-02T09:39:41.559189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:39:41.710284Z","title":"We an- neal the temperature from τ= 1.5 to τ= 0.1 exponentially and keep the final temperature fixed for the last10%of training","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:41.710284Z"},"links":{"citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:5606c51c137afd1d6e7a656fcdf38e7057f0740168e0a3748f14c6385a7aee5c","observation_id":"0bea2c4c-c461-46fb-9587-78a9a61e1c8e","resolution":{"observed_at":"2026-08-02T09:39:41.710284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-02T09:39:40.820382Z","title":"Neil Houlsby, Sebastian Jastrzebski, Andrzej Brooks, Rosanne de Vries, Andrea Guedj, and Grégory Ne- matzadeh","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:40.820382Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:80d65912ea135fd2ec3c1a06ccfb17c3863f57d357560a7b4284fd97668a89ff","observation_id":"8f26d29e-83f5-4dc4-8883-3f8b27412b25","resolution":{"observed_at":"2026-08-02T09:39:40.820382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13628","last_updated":"2024-04-21T11:59:53Z","snapshot_observed_at":"2026-08-10T12:22:41.612612Z","submitted_at":"2024-04-21T11:59:53Z","title":"Mixture of LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13628","snapshot_observed_at":"2026-08-02T09:39:41.330490Z","title":"Xun Wu, Shaohan Huang, and Furu Wei","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:41.330490Z"},"links":{"cited_paper":"/paper/2404.13628","citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:8d516d307a75fa416adc3372b3e6277f4f825f681b0280f9547bfbfdff11f578","observation_id":"b614ac22-c480-4174-b105-baad36f7b618","resolution":{"observed_at":"2026-08-02T09:39:41.330490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09179","last_updated":"2023-11-15T18:15:37Z","snapshot_observed_at":"2026-07-06T16:48:05.271182Z","submitted_at":"2023-11-15T18:15:37Z","title":"SiRA: Sparse Mixture of Low Rank Adaptation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09179","snapshot_observed_at":"2026-08-02T09:39:41.447055Z","title":"12 A Detailed Experimental Results This section provides thefull per-taskresults corre- sponding to the averaged metrics reported in the pa- per","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:41.447055Z"},"links":{"cited_paper":"/paper/2311.09179","citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:130e2b9ef6e0246d6eeeeec8e6d1b817118cb205d1281ff045f29fdf79faeddf","observation_id":"b3628f72-b64c-4699-b113-f208378bbc66","resolution":{"observed_at":"2026-08-02T09:39:41.447055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:39:41.790057Z","title":"This variant tests whether unit-scale routing is sufficient only at inference time, or whether the same behavior is also necessary during training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:41.790057Z"},"links":{"citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:4cfc7b1ffba843affdb417e2945136b1b23f74c556846d148fd4ef60beba9c1b","observation_id":"5cabdc61-f6e3-48f0-913d-d0babd099da8","resolution":{"observed_at":"2026-08-02T09:39:41.790057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-02T09:39:40.490339Z","title":"arXiv preprint arXiv:1308.3432","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:40.490339Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:c004c7528b398c94a6a1f0a582b82c36018becb1ded16e3ddf64e39d8ffe43bf","observation_id":"c253108c-8124-472b-af36-e71244c31e8d","resolution":{"observed_at":"2026-08-02T09:39:40.490339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T09:39:41.154618Z","title":"Zhen Shao and 1 others","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:41.154618Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:91fd8bfcb147d33b9099437fab1ef487eb007696ee70479de028777512689ac5","observation_id":"2ce94de4-e7be-408b-a46f-2568ebb4a7f0","resolution":{"observed_at":"2026-08-02T09:39:41.154618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11157","last_updated":"2024-05-18T03:02:23Z","snapshot_observed_at":"2026-07-06T18:16:03.617132Z","submitted_at":"2024-05-18T03:02:23Z","title":"Towards Modular LLMs by Building and Reusing a Library of LoRAs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11157","snapshot_observed_at":"2026-08-02T09:39:41.028505Z","title":"InNeurIPS 2023 Workshop on Instruction Tuning and Instruction Fol- lowing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:41.028505Z"},"links":{"cited_paper":"/paper/2405.11157","citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:b154c1c2d808e1576c49169a43da634dc66e734f901bf1f2efd658bc95be226b","observation_id":"cb0fcaed-2f1e-4773-8cca-52035dc41c69","resolution":{"observed_at":"2026-08-02T09:39:41.028505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-02T09:39:40.676178Z","title":"Daya Guo, Dejian Yang, Haowei Zhang, and 1 others","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T09:39:40.676178Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2606.31413"},"observation_digest":"sha256:fda7d871968731967e3af4973978c6e1708ca7bd07f16bc3db3c191697bd6ee4","observation_id":"a615d3fe-cb9f-4163-869c-d34c0ee9dd9e","resolution":{"observed_at":"2026-08-02T09:39:40.676178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.31413","last_updated":"2026-07-30T09:24:19Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T12:31:34.352159Z","submitted_at":"2026-06-30T09:40:38Z","title":"Learning to Select, Not Relearn: Hard-Routed Mixtures of Reasoning LoRAs"},"reference_resolution":{"displayed":10,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":10},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 10 of 10 outbound references and 0 inbound Pith citation observations for arXiv:2606.31413."}