{"as_of":"2026-08-14T22:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:67a81bd8a06371446bd19c0dd7e1e8b2449851852985d3079ab94027bde7b673","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:32:45.303935Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.13053/citation-record","integrity":"/paper/2412.13053/integrity","json":"/paper/2412.13053/citation-record.json","paper":"/paper/2412.13053"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.008801Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.008801Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:3e0ecae72a3254e06c77d35b3fcd9b27ccc403546274e057f960365cd5077b48","observation_id":"56018101-3918-40d4-97f8-7da795576cfe","resolution":{"observed_at":"2026-08-11T13:32:45.008801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.015499Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.015499Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:d50659aadcdba5dba3885d8bba871305fae43947755d7b5edd62f9e4d86316c3","observation_id":"3091961d-5de7-40b2-a0da-91bf3da2372c","resolution":{"observed_at":"2026-08-11T13:32:45.015499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.284473Z","title":null,"venue":null,"work_id":"bbf1e67c-8e9b-48bd-ad47-d8fc6eef31e7","year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.022012Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:02efab572b241ff29a8c6b89f36e2cc35f7e25d96cae402cc39280535ec0c3c5","observation_id":"5c1393fb-b153-44df-a984-9f53c62174cb","resolution":{"observed_at":"2026-08-11T13:32:46.292483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.028624Z","title":"B.; D \\' az-Rodr \\' guez, N.; Del Ser, J.; Bennetot, A.; Tabik, S.; Barbado, A.; Garc \\' a, S.; Gil-L \\'o pez, S.; Molina, D.; Benjamins, R.; et al","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.028624Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:bfa81fd24a4b5b5e0776b4828e700764dae0ec7205ffc35252cbbadb0cfeb862","observation_id":"ac545bc6-e45b-41eb-adad-931449baae02","resolution":{"observed_at":"2026-08-11T13:32:45.028624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08328","last_updated":"2019-01-24T02:53:31Z","snapshot_observed_at":"2026-08-14T19:12:43.709138Z","submitted_at":"2018-05-22T00:14:32Z","title":"Verifiable Reinforcement Learning via Policy Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.08328","snapshot_observed_at":"2026-08-11T13:32:45.034503Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.034503Z"},"links":{"cited_paper":"/paper/1805.08328","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:85bb3507389b32a9b12c26d2235fce7d302eb5d5966c3686dc535aadec17226d","observation_id":"49f1c858-e2bc-47a0-866d-a645ed397d7e","resolution":{"observed_at":"2026-08-11T13:32:45.034503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05514","last_updated":"2022-04-12T04:02:17Z","snapshot_observed_at":"2026-08-13T16:04:00.039169Z","submitted_at":"2022-04-12T04:02:17Z","title":"A Comparative Study of Faithfulness Metrics for Model Interpretability Methods","version":1},"cited_work":{"arxiv_id":"2204.05514","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.05514","snapshot_observed_at":"2026-08-11T13:32:45.818295Z","title":"A Comparative Study of Faithfulness Metrics for Model Interpretability Methods","venue":"cs.CL","work_id":"18dfb5ed-4ad9-422b-80df-b48b8f2325c8","year":2022},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.041119Z"},"links":{"cited_paper":"/paper/2204.05514","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:fec2068592a94b1eabacb3fbe28e1ba354a43f5bf62b3c0b911393a10df4c1ef","observation_id":"2fbad8ee-a90e-4543-ad5c-6299fb4ab01f","resolution":{"observed_at":"2026-08-11T13:32:45.824661Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.252397Z","title":null,"venue":null,"work_id":"ece9dd01-0d21-4a8a-870f-10509b78ec58","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.050053Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:902fa8b48a56e36469a456f31530a4377d92834733e79c548a147dbca4d1dd86","observation_id":"f336f205-7aaf-4ae2-a837-a211105622d9","resolution":{"observed_at":"2026-08-11T13:32:46.260221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.233320Z","title":"L.; and Iacca, G","venue":null,"work_id":"7dc8cf8d-c144-45b2-9c44-df86f581d447","year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.055451Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:c462fe52b915ae5fd327d92940966677c6f0293d2e1384b1e11327a5ba2be90c","observation_id":"ed8cbdea-22b9-4516-9c26-a8801507c108","resolution":{"observed_at":"2026-08-11T13:32:46.239110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.217736Z","title":"L.; and Iacca, G","venue":null,"work_id":"1f0c154b-6cda-4ac7-aba6-bbc1c968123b","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.061491Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:56d3b91a9b8eaae569fac8c2af8f3c704d5af51eb4afc36c97087bc6f2a79ecb","observation_id":"52fa2825-6a0c-4cbf-8441-e0fc6a54044b","resolution":{"observed_at":"2026-08-11T13:32:46.222577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15480","last_updated":"2025-01-21T18:49:43Z","snapshot_observed_at":"2026-08-13T04:33:28.557383Z","submitted_at":"2024-01-27T19:05:21Z","title":"Social Interpretable Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2401.15480","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.15480","snapshot_observed_at":"2026-08-11T13:32:45.795206Z","title":"Social Interpretable Reinforcement Learning","venue":"cs.LG","work_id":"f1dd73a3-b4dc-4df4-a637-c9c6f73f34ab","year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.066821Z"},"links":{"cited_paper":"/paper/2401.15480","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:2187332dcb8672b228cc8e9242ea16475c10cd3b90bc7193903241236e73f72c","observation_id":"1a224147-1276-4985-855a-4c69ca67fb28","resolution":{"observed_at":"2026-08-11T13:32:45.800705Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01439","last_updated":"2023-10-25T16:40:27Z","snapshot_observed_at":"2026-08-13T11:25:50.495008Z","submitted_at":"2023-06-02T10:59:44Z","title":"Interpretable and Explainable Logical Policies via Neurally Guided Symbolic Abstraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01439","snapshot_observed_at":"2026-08-11T13:32:45.076871Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.076871Z"},"links":{"cited_paper":"/paper/2306.01439","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:ba6c6a4d2dc7edc6ca7a4fb132c87203350befb5eb3f8b258511c13407c86fcd","observation_id":"c885c4ad-3f4f-4e05-a429-4a6fd4de01c3","resolution":{"observed_at":"2026-08-11T13:32:45.076871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05821","last_updated":"2024-10-28T18:38:00Z","snapshot_observed_at":"2026-08-14T16:26:56.175653Z","submitted_at":"2024-01-11T10:38:22Z","title":"Interpretable Concept Bottlenecks to Align Reinforcement Learning Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05821","snapshot_observed_at":"2026-08-11T13:32:45.082937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.082937Z"},"links":{"cited_paper":"/paper/2401.05821","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:a7b1c71fb655296d5834e70ae13dddce654e15f996eb9c57edc1d48034f4edb2","observation_id":"055e87c2-872c-4614-92e8-bdc72a4e23b6","resolution":{"observed_at":"2026-08-11T13:32:45.082937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09521","last_updated":"2021-04-06T17:28:51Z","snapshot_observed_at":"2026-08-14T17:19:27.764833Z","submitted_at":"2020-09-20T20:41:57Z","title":"Towards Interpretable-AI Policies Induction using Evolutionary Nonlinear Decision Trees for Discrete Action Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09521","snapshot_observed_at":"2026-08-11T13:32:45.088950Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.088950Z"},"links":{"cited_paper":"/paper/2009.09521","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:14a025a634b6b2b2b647392ba9d7d5563be139812e484d56c0af12e7f4fe7c3f","observation_id":"4ca8392b-6662-4264-96f3-61ab9e8e9367","resolution":{"observed_at":"2026-08-11T13:32:45.088950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.200364Z","title":null,"venue":null,"work_id":"38913d00-3e5c-43e9-bc27-356227269588","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.094056Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:81ea65bf55cf17b5d011d3db8be4314a004312f35d1693b2e5d4a11027d22be8","observation_id":"8b210593-1cd6-4d93-9b3a-8cbc2ed0fd3e","resolution":{"observed_at":"2026-08-11T13:32:46.206220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.099000Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.099000Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:13afa87188b23773190250da2a1cdf6de375da6e331dfa7d0b768df1e16dc2a8","observation_id":"83f737ea-fe93-436f-b71b-ebcc9d6d4ba3","resolution":{"observed_at":"2026-08-11T13:32:45.099000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.172304Z","title":"H.; Kovach, T.; Miller, K.; and Dubrawski, A","venue":null,"work_id":"d0b900b8-7bba-493b-a28a-08698b90164e","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.104425Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:946fe75d05da981127e1bea4f266a351978984931ff2387f3e05a01a497932e1","observation_id":"613da353-6400-4451-9fd0-fdf08b7ab0c2","resolution":{"observed_at":"2026-08-11T13:32:46.177711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01290","last_updated":"2018-08-08T21:27:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T09:50:50Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01290","snapshot_observed_at":"2026-08-11T13:32:45.110176Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.110176Z"},"links":{"cited_paper":"/paper/1801.01290","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:5012b6f638867025336978dd7a8ce469371b1f1c13f33901d7276269c776c93e","observation_id":"d8dbd196-c24c-43b1-8bca-99bfe34eaa5a","resolution":{"observed_at":"2026-08-11T13:32:45.110176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.155882Z","title":null,"venue":null,"work_id":"e4699ffa-0e97-47e9-a388-abfad6ff1f42","year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.116774Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:5f252e5b14e5acde63bbf1c619496225381b7f8e0a6349a8e4e49274cd26a458","observation_id":"3f52c25a-c4da-4825-95bb-3b5feb1e0d6b","resolution":{"observed_at":"2026-08-11T13:32:46.161188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.136910Z","title":null,"venue":null,"work_id":"11c2270c-bc12-46a7-9b23-7f883a13c225","year":2022},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.122957Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:89468e26a0c5b449ed3fbbcfedf0e3eb9c0607ac988608777aa07eafcf91ba80","observation_id":"8f1deed5-0d36-42b7-9d88-e060bbfa18f2","resolution":{"observed_at":"2026-08-11T13:32:46.142097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.116823Z","title":null,"venue":null,"work_id":"0a71f1ac-0548-4342-8429-6ee65c124100","year":2020},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.128115Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:22d5e759488a04fd1b1d719461ca1cabd6fae46953b08920d9c78a1b13022a97","observation_id":"d5e2bed2-f5b1-49c3-b492-32a66450d81b","resolution":{"observed_at":"2026-08-11T13:32:46.123423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.095356Z","title":"T.; and Alpayd n, E","venue":null,"work_id":"03d4fc7e-734e-4528-b984-2d4641f4be82","year":2012},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.133882Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:cde89a3ed7c978a8cec27946d59e30da145e6f7c59148dcfeddfb403fd0d8eeb","observation_id":"ebcc9f13-2336-45db-8a0d-062b79ccd815","resolution":{"observed_at":"2026-08-11T13:32:46.100649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10729","last_updated":"2019-07-10T03:45:15Z","snapshot_observed_at":"2026-08-14T16:42:12.664750Z","submitted_at":"2019-04-24T10:24:35Z","title":"Neural Logic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1904.10729","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.10729","snapshot_observed_at":"2026-08-11T13:32:45.703358Z","title":"Neural Logic Reinforcement Learning","venue":"cs.LG","work_id":"9636dff2-9f93-4520-9552-8843d86ab9ee","year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.139164Z"},"links":{"cited_paper":"/paper/1904.10729","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:736897d11855dd6e2b108c0d028d950744d22a76bc6ec72048830f22631cf76e","observation_id":"c915c229-cb12-4324-b72e-26e4cac02390","resolution":{"observed_at":"2026-08-11T13:32:45.709064Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.10963","last_updated":"2021-10-21T08:21:49Z","snapshot_observed_at":"2026-08-13T17:48:58.410697Z","submitted_at":"2021-10-21T08:21:49Z","title":"Neuro-Symbolic Reinforcement Learning with First-Order Logic","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.10963","snapshot_observed_at":"2026-08-11T13:32:45.144657Z","title":"J.; Tatsubori, M.; Munawar, A.; and Gray, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.144657Z"},"links":{"cited_paper":"/paper/2110.10963","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:4f7ee56cbf72774749d14e0ecb74b2ab4c1ae6c293fd8c7cca1789e43697832b","observation_id":"48495234-14e0-45b8-b25f-3b76e1a6a1b0","resolution":{"observed_at":"2026-08-11T13:32:45.144657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14956","last_updated":"2024-05-23T18:07:38Z","snapshot_observed_at":"2026-08-12T23:59:28.062726Z","submitted_at":"2024-05-23T18:07:38Z","title":"Interpretable and Editable Programmatic Tree Policies for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14956","snapshot_observed_at":"2026-08-11T13:32:45.150684Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.150684Z"},"links":{"cited_paper":"/paper/2405.14956","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:2640f3bbc94a829bed0d3376de691317cef0c7088d69808eaf3e8f37c978c9ec","observation_id":"cec939f8-62dc-45ad-8e6b-bf0c0563917d","resolution":{"observed_at":"2026-08-11T13:32:45.150684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12950","last_updated":"2023-05-31T09:08:07Z","snapshot_observed_at":"2026-08-14T02:12:32.650206Z","submitted_at":"2023-01-30T14:50:46Z","title":"Hierarchical Programmatic Reinforcement Learning via Learning to Compose Programs","version":2},"cited_work":{"arxiv_id":"2301.12950","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.12950","snapshot_observed_at":"2026-08-11T13:32:45.642944Z","title":"Hierarchical Programmatic Reinforcement Learning via Learning to Compose Programs","venue":"cs.LG","work_id":"5ce8bb6c-d1e7-41d2-a8be-94b9ad0b47c0","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.157572Z"},"links":{"cited_paper":"/paper/2301.12950","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:aebd9e886ff550189fdcfdef1281d8e2f5fe8148d720a23326d8cc6605569abc","observation_id":"ef7ad309-a82c-4406-9a4f-b630eb0f41dc","resolution":{"observed_at":"2026-08-11T13:32:45.648688Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.073147Z","title":null,"venue":null,"work_id":"179c3f0a-3098-484c-8f54-d022306c0ed8","year":1996},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.166433Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:55ac1025ae570be9430b809a782af4304266f422e41816fa8d85e90b8b149455","observation_id":"91dc8984-f811-4851-bff0-1a38330d83c0","resolution":{"observed_at":"2026-08-11T13:32:46.079664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.042039Z","title":null,"venue":null,"work_id":"aa781c36-482c-478b-99a0-3edf174bda7e","year":2018},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.171934Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:d58393c28d36bd3530459ce37ba7f277e9f5f1293b551cff54bdb93aa617c98e","observation_id":"231f472e-7b28-46de-9543-60196270f286","resolution":{"observed_at":"2026-08-11T13:32:46.053267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:46.018769Z","title":null,"venue":null,"work_id":"aa189d53-b68e-4032-885d-d660cc60424b","year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.177237Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:c321b04c77731eefc6368d27d202d4db783bea1bf6c83a3a0987c34916041b46","observation_id":"f4153a02-103f-40f2-9d34-312c7b5d8f74","resolution":{"observed_at":"2026-08-11T13:32:46.024916Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08609","last_updated":"2024-06-26T16:50:01Z","snapshot_observed_at":"2026-08-13T04:19:40.205440Z","submitted_at":"2024-02-13T17:18:56Z","title":"Mixtures of Experts Unlock Parameter Scaling for Deep RL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08609","snapshot_observed_at":"2026-08-11T13:32:45.182019Z","title":"K.; Precup, D.; and Castro, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.182019Z"},"links":{"cited_paper":"/paper/2402.08609","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:6735f4b9ebb80c8ce193c63b349591f2521931001afe3d0895888d671d243235","observation_id":"91e45054-ce96-40d5-9cd6-b43a458de564","resolution":{"observed_at":"2026-08-11T13:32:45.182019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10041","last_updated":"2023-11-16T17:37:46Z","snapshot_observed_at":"2026-08-13T05:23:42.350506Z","submitted_at":"2023-11-16T17:37:46Z","title":"Interpretable Reinforcement Learning for Robotics and Continuous Control","version":1},"cited_work":{"arxiv_id":"2311.10041","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.10041","snapshot_observed_at":"2026-08-11T13:32:45.598596Z","title":"Interpretable Reinforcement Learning for Robotics and Continuous Control","venue":"cs.RO","work_id":"9817c3db-a8cb-4581-a5b5-e009b6bceaee","year":2023},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.187544Z"},"links":{"cited_paper":"/paper/2311.10041","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:a38a70b36687c463278d49dd2b4260123d0662aa22f5b69de4f69dec376032c5","observation_id":"c08f235b-36cf-45c2-99a2-d82accd3345b","resolution":{"observed_at":"2026-08-11T13:32:45.604647Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.998724Z","title":"D.; Howe, A","venue":null,"work_id":"611e6208-4976-4584-a237-6f8555821c95","year":2001},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.192706Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:e3518e132d6ce318f80e9f2dc8514e2e2e578ea78165bcefa60cd1e96cb5684d","observation_id":"315399f9-01b0-453f-9c19-692468fd8a93","resolution":{"observed_at":"2026-08-11T13:32:46.004564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09122","last_updated":"2021-04-19T08:21:56Z","snapshot_observed_at":"2026-08-13T19:37:40.494853Z","submitted_at":"2021-04-19T08:21:56Z","title":"Probabilistic Mixture-of-Experts for Efficient Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09122","snapshot_observed_at":"2026-08-11T13:32:45.197714Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.197714Z"},"links":{"cited_paper":"/paper/2104.09122","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:86024cb86b17414c239545b8a90f63cfe44160c62f2cb77f250e590c0bb500c4","observation_id":"00df51e9-3f83-425c-9503-fa60fe2fb8de","resolution":{"observed_at":"2026-08-11T13:32:45.197714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.05974","last_updated":"2021-06-10T17:10:56Z","snapshot_observed_at":"2026-08-13T19:05:40.642938Z","submitted_at":"2021-06-10T17:10:56Z","title":"Scaling Vision with Sparse Mixture of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.05974","snapshot_observed_at":"2026-08-11T13:32:45.203218Z","title":"S.; Keysers, D.; and Houlsby, N","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.203218Z"},"links":{"cited_paper":"/paper/2106.05974","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:4cc6731163118e8210061484dd25828c5e39e31e691b55b989c1251d388c090d","observation_id":"11b06ef2-b636-48ca-8a50-fb04bf77a510","resolution":{"observed_at":"2026-08-11T13:32:45.203218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1011.0686","last_updated":"2011-03-16T18:51:21Z","snapshot_observed_at":"2026-08-03T22:17:51.826967Z","submitted_at":"2010-11-02T17:55:55Z","title":"A Reduction of Imitation Learning and Structured Prediction to No-Regret Online Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1011.0686","snapshot_observed_at":"2026-08-11T13:32:45.209139Z","title":"J.; and Bagnell, J","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.209139Z"},"links":{"cited_paper":"/paper/1011.0686","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:8062c576eea2c4ca37b409e318c7efa4cad35896d8ee76e412eaf0d3f2bf43be","observation_id":"f1a6fd87-30bb-450b-8c9d-f57869b34714","resolution":{"observed_at":"2026-08-11T13:32:45.209139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01180","last_updated":"2019-07-02T05:51:04Z","snapshot_observed_at":"2026-08-05T03:40:23.581115Z","submitted_at":"2019-07-02T05:51:04Z","title":"Conservative Q-Improvement: Reinforcement Learning for an Interpretable Decision-Tree Policy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01180","snapshot_observed_at":"2026-08-11T13:32:45.215032Z","title":"M.; Topin, N.; Jamshidi, P.; and Veloso, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.215032Z"},"links":{"cited_paper":"/paper/1907.01180","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:73193c376a233827bbe1bbe867d96ee1da94d61be93e6d92906a2aa119e5c452","observation_id":"922eac69-5746-48f8-8e59-dda09641fe3c","resolution":{"observed_at":"2026-08-11T13:32:45.215032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.220287Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.220287Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:c8f5c611ab42426629f89c3719da18cc33224d56a9cd55f892fe87bd5c37c78f","observation_id":"c9d93b89-7792-486c-b872-6e1678c5f258","resolution":{"observed_at":"2026-08-11T13:32:45.220287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.11251","last_updated":"2021-07-10T01:20:27Z","snapshot_observed_at":"2026-08-14T14:36:35.428307Z","submitted_at":"2021-03-20T21:58:27Z","title":"Interpretable Machine Learning: Fundamental Principles and 10 Grand Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.11251","snapshot_observed_at":"2026-08-11T13:32:45.225767Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.225767Z"},"links":{"cited_paper":"/paper/2103.11251","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:10f62ab7a5678b680a783a022ffefe058c592cce11d153b04fefc64ab025bb01","observation_id":"e21e9ec9-d4a7-46c2-9aac-f4e737005bea","resolution":{"observed_at":"2026-08-11T13:32:45.225767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00731","last_updated":"2019-06-17T04:30:19Z","snapshot_observed_at":"2026-08-14T18:05:20.046729Z","submitted_at":"2018-11-02T04:14:09Z","title":"The age of secrecy and unfairness in recidivism prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00731","snapshot_observed_at":"2026-08-11T13:32:45.231952Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.231952Z"},"links":{"cited_paper":"/paper/1811.00731","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:151c5dde847ddb809c8d88730060a29bb4a5e193c1c37014356f0b2d16a79aaa","observation_id":"5bb6aa8a-c3f3-4557-9b16-8cd84402f500","resolution":{"observed_at":"2026-08-11T13:32:45.231952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-11T13:32:45.237116Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.237116Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:4588fc509d62e0c3871dc5da2af0317037e12ed7cd67e5cfc4fc8682678e7642","observation_id":"82aea2a7-f7ae-4df0-bcd8-ca006b6f3f07","resolution":{"observed_at":"2026-08-11T13:32:45.237116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06107","last_updated":"2024-06-10T08:46:49Z","snapshot_observed_at":"2026-08-12T23:46:39.486185Z","submitted_at":"2024-06-10T08:46:49Z","title":"EXPIL: Explanatory Predicate Invention for Learning in Games","version":1},"cited_work":{"arxiv_id":"2406.06107","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06107","snapshot_observed_at":"2026-08-11T13:32:45.431133Z","title":"EXPIL: Explanatory Predicate Invention for Learning in Games","venue":"cs.AI","work_id":"8a137542-44a3-4e67-ae07-e26c865c2673","year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.242477Z"},"links":{"cited_paper":"/paper/2406.06107","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:59a4562c17b3995c896e9e7b4e93a432934231023d6f8aeb033362b469b768f2","observation_id":"19a8739d-4b31-4d85-9100-610eee34392a","resolution":{"observed_at":"2026-08-11T13:32:45.436766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-11T13:32:45.248037Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.248037Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:96ec3645405d091d70888833c4a754b8beefcd55881c91290191ced5fed409cf","observation_id":"22a1ef4e-c9cb-4c0b-9d10-bdd711804b5e","resolution":{"observed_at":"2026-08-11T13:32:45.248037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.970491Z","title":null,"venue":null,"work_id":"cefb6d5d-13ce-46c3-b992-558d63ecf988","year":2020},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.253495Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:8898489d097db3a468404725b9c3e57a64234a1058821958ad02bd0288681020","observation_id":"6151c00c-357e-4030-9f50-fc2eba1195a6","resolution":{"observed_at":"2026-08-11T13:32:45.975560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.955915Z","title":null,"venue":null,"work_id":"fde848b2-b40e-49c6-b6e6-1b26e9ed5337","year":2021},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.259007Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:abd55b13ce113f96b4b38cf437a073ecafafb3ee868a1fe1f189c1ba7a59dfa5","observation_id":"7db04995-f866-4023-9b74-30d631b6009b","resolution":{"observed_at":"2026-08-11T13:32:45.960591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.939386Z","title":"M.; Kosut, R","venue":null,"work_id":"c26c760e-b49f-41e9-9807-288e7bbae4ab","year":1994},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.264001Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:95ddd416626f895b1b2520b05f0e2c06209fcc5d6da8276bcbbba4d92d4b9c0a","observation_id":"5648963b-dcc5-4a85-b412-fea4ccd2a1d6","resolution":{"observed_at":"2026-08-11T13:32:45.944726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.922713Z","title":null,"venue":null,"work_id":"2fe817db-d429-4f30-8e93-51749b534538","year":2004},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.268973Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:4a4c14161be558780821f9b29f261801bdada54aafaa90ac65fbf39cdc542e01","observation_id":"0dc366ad-3103-4f40-86a5-85f667d03ff8","resolution":{"observed_at":"2026-08-11T13:32:45.927744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.906139Z","title":null,"venue":null,"work_id":"1c8d3a55-3427-473e-ac37-cb7ce58dad10","year":2012},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.274082Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:22032a5387574f355cfdd12ede54b690af301a33bcdbe43c75700e11400875e1","observation_id":"298381fe-b965-4303-a9f1-4942a8ce32e0","resolution":{"observed_at":"2026-08-11T13:32:45.911654Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.889293Z","title":"R.; and Alemzadeh, H","venue":null,"work_id":"e9c865ae-5bfb-4520-92d4-e5c6a4de198c","year":2017},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.279233Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:5fbcdb5ca0df9f656bfaf483bb4ed6b187bcab7595f2772bfd5b8c8fe0568099","observation_id":"fed40590-01f0-4c04-a571-1a0a65b32236","resolution":{"observed_at":"2026-08-11T13:32:45.894922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05431","last_updated":"2021-01-19T20:52:42Z","snapshot_observed_at":"2026-08-14T16:06:37.246059Z","submitted_at":"2019-07-11T18:00:56Z","title":"Imitation-Projected Programmatic Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1907.05431","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.05431","snapshot_observed_at":"2026-08-11T13:32:45.385778Z","title":"Imitation-Projected Programmatic Reinforcement Learning","venue":"cs.LG","work_id":"8ababe92-71bb-47e5-b3bd-41c6f092c8dd","year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.284169Z"},"links":{"cited_paper":"/paper/1907.05431","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:6ffd5b5a0382413d2003a5b746b56ed76720c66c18ee4bc7d8d9dac48cca07ce","observation_id":"dfbb4739-8559-487a-9aee-1a2b896e123a","resolution":{"observed_at":"2026-08-11T13:32:45.393771Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.02477","last_updated":"2019-04-10T09:09:46Z","snapshot_observed_at":"2026-08-14T19:28:23.894824Z","submitted_at":"2018-04-06T22:17:18Z","title":"Programmatically Interpretable Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.02477","snapshot_observed_at":"2026-08-11T13:32:45.289019Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.289019Z"},"links":{"cited_paper":"/paper/1804.02477","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:3cc5077ed943a054b9cbb735faf0c0e94d4781cc95016d827207b2aae9fe6037","observation_id":"c7f6db6b-7ed0-40fe-a688-951d90b2ae18","resolution":{"observed_at":"2026-08-11T13:32:45.289019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.873543Z","title":null,"venue":null,"work_id":"f768dbeb-7dfe-4487-b0a6-9e2ff2903b83","year":2022},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.294230Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:fae9a9bfe68c6128dd175d6a6cb9e5fa1f782d2337436c1a68f4285e1318c820","observation_id":"e52267e0-57e8-401c-ae94-e46e3d609e46","resolution":{"observed_at":"2026-08-11T13:32:45.878692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:32:45.856983Z","title":null,"venue":null,"work_id":"23bedd24-decc-494c-b97d-36e04c7388d5","year":2017},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.299276Z"},"links":{"citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:0f38aa225882588a4af7fc80aef52da4f6de87e66f79fe4009fa8a104f6098f6","observation_id":"91f1d224-3414-4ba9-982e-6186ec594df8","resolution":{"observed_at":"2026-08-11T13:32:45.861916Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18420","last_updated":"2024-06-26T15:15:15Z","snapshot_observed_at":"2026-08-12T23:34:23.987648Z","submitted_at":"2024-06-26T15:15:15Z","title":"Mixture of Experts in a Mixture of RL settings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18420","snapshot_observed_at":"2026-08-11T13:32:45.303935Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T13:32:45.303935Z"},"links":{"cited_paper":"/paper/2406.18420","citing_paper":"/paper/2412.13053"},"observation_digest":"sha256:b98dcea93411d4315fdc1338818432df8231a6aef0a529b2816bc0b7e9a62da6","observation_id":"5c4a2e66-b4d1-429b-a24e-da4f3db4503f","resolution":{"observed_at":"2026-08-11T13:32:45.303935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.13053","last_updated":"2024-12-17T16:15:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T04:27:13.118081Z","submitted_at":"2024-12-17T16:15:04Z","title":"SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":38,"verified_exact":5,"verified_fuzzy":7},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2412.13053."}