{"as_of":"2026-08-08T16:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76e9c81658c4d6a6cfe804c646dc686cbeb6ff157a7b31282b2811792f73c4e7","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:23:17.703821Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T23:09:12.763536Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-08-07T15:23:17.703821Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15345","last_updated":"2025-05-23T11:18:10Z","snapshot_observed_at":"2026-08-07T20:34:34.327158Z","submitted_at":"2025-05-21T10:19:49Z","title":"Hadamax Encoding: Elevating Performance in Model-Free Atari","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:23:17.703821Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2505.15345"},"observation_digest":"sha256:285a4ffa0ce91312ad8a8f0ef424f82d9ad9669a1e64dd5b522dc5e3740bd437","observation_id":"2d0080d0-f5fe-42b8-8221-480264984ada","resolution":{"observed_at":"2026-08-07T15:23:17.703821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-08-07T12:58:50.224254Z","title":"J., Subramanian, K., Wurman, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23150","last_updated":"2025-05-29T06:41:45Z","snapshot_observed_at":"2026-08-07T23:49:30.072079Z","submitted_at":"2025-05-29T06:41:45Z","title":"Bigger, Regularized, Categorical: High-Capacity Value Functions are Efficient Multi-Task Learners","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:58:50.224254Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2505.23150"},"observation_digest":"sha256:1a28818d8d45bee0ee4400eaf7a61ee5383bcf076ce806d3725a2d021441f823","observation_id":"6e598f6e-02ff-41e2-80f0-7de53dca1f64","resolution":{"observed_at":"2026-08-07T12:58:50.224254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-08-06T20:31:07.791190Z","title":"J., Subramanian, K., Wurman, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02712","last_updated":"2025-07-03T15:26:48Z","snapshot_observed_at":"2026-08-08T15:34:11.449065Z","submitted_at":"2025-07-03T15:26:48Z","title":"A Forget-and-Grow Strategy for Deep Reinforcement Learning Scaling in Continuous Control","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:31:07.791190Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2507.02712"},"observation_digest":"sha256:fe15eff71427c531d224be10d47e5e8a3fdabe15b1be5d6b6cce88d78cbb7c89","observation_id":"f4fbd433-1d8f-41b2-8366-2add8b07afcf","resolution":{"observed_at":"2026-08-06T20:31:07.791190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-08-06T18:18:46.104398Z","title":"Simba: Simplicity bias for scaling up parameters in deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08718","last_updated":"2025-07-11T16:19:45Z","snapshot_observed_at":"2026-08-08T04:07:41.428130Z","submitted_at":"2025-07-11T16:19:45Z","title":"On the Effect of Regularization in Policy Mirror Descent","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T18:18:46.104398Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2507.08718"},"observation_digest":"sha256:72255345b9d327fc870afcb182a97c9bddefdd446cbbfba4e2b014aebfc6838b","observation_id":"368842fc-30dc-4514-bb65-fb7dc3696ee5","resolution":{"observed_at":"2026-08-06T18:18:46.104398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-08-06T15:55:34.443170Z","title":"Wurman, Jaegul Choo, Peter Stone, and Takuma Seno","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14736","last_updated":"2025-07-19T19:53:08Z","snapshot_observed_at":"2026-08-06T15:46:49.918611Z","submitted_at":"2025-07-19T19:53:08Z","title":"Balancing Expressivity and Robustness: Constrained Rational Activations for Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T15:55:34.443170Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2507.14736"},"observation_digest":"sha256:9862be528e3c815e92ca287fee27061b77b47ca21ebcb7225868fd7e7e071514","observation_id":"4bfbcbc3-15a9-4769-8931-49954e548b15","resolution":{"observed_at":"2026-08-06T15:55:34.443170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-08-06T04:39:02.901710Z","title":"Simba: Simplicity bias for scaling up parameters in deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03194","last_updated":"2025-08-05T08:03:12Z","snapshot_observed_at":"2026-08-06T11:32:36.516059Z","submitted_at":"2025-08-05T08:03:12Z","title":"Scaling DRL for Decision Making: A Survey on Data, Network, and Training Budget Strategies","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T04:39:02.901710Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2508.03194"},"observation_digest":"sha256:a9f9563c96f287be3fddd7b81158858d00597aef988cf153cf6411ecde766006","observation_id":"6bf65cda-86bb-4f74-8cc7-f8bb7f90a255","resolution":{"observed_at":"2026-08-06T04:39:02.901710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-08-03T06:26:49.906939Z","title":"Lee, H., Lee, Y ., Seno, T., Kim, D., Stone, P., and Choo, J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2601.23075","last_updated":"2026-06-23T21:44:31Z","snapshot_observed_at":"2026-08-03T06:17:20.457387Z","submitted_at":"2026-01-30T15:24:34Z","title":"RN-D: Discretized Categorical Actors for On-Policy Reinforcement Learning","version":2},"reference_index":456,"source":"pdf_text","source_observed_at":"2026-08-03T06:26:49.906939Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2601.23075"},"observation_digest":"sha256:7b6ada03b4665d5876a46dad2091d1a8c3f7ec9c85e71e09dd5231d252123ab4","observation_id":"789c6ba2-c50b-4d84-b762-c08c2fed956e","resolution":{"observed_at":"2026-08-03T06:26:49.906939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2410.09754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simba: Simplicity bias for scaling up parameters in deep reinforcement learning","venue":null,"work_id":"94a05c6d-b7e0-4ddb-b407-1bc38fd6aacf","year":2024},"citing_paper":{"arxiv_id":"2604.04539","last_updated":"2026-05-15T07:15:36Z","snapshot_observed_at":"2026-08-02T17:13:51.910717Z","submitted_at":"2026-04-06T09:03:41Z","title":"FlashSAC: Fast and Stable Off-Policy Reinforcement Learning for High-Dimensional Robot Control","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T20:04:56.512544Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2604.04539"},"observation_digest":"sha256:d6d72efbc87de00e164edd3dd58201dade032b9056c1a1479dcf884097af7645","observation_id":"aa37823c-61fe-4fda-b66f-658cac3c605e","resolution":{"observed_at":"2026-05-10T22:15:49.935041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2410.09754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simba: Simplicity bias for scaling up parameters in deep reinforcement learning","venue":null,"work_id":"94a05c6d-b7e0-4ddb-b407-1bc38fd6aacf","year":2024},"citing_paper":{"arxiv_id":"2604.04539","last_updated":"2026-05-15T07:15:36Z","snapshot_observed_at":"2026-08-02T17:13:51.910717Z","submitted_at":"2026-04-06T09:03:41Z","title":"FlashSAC: Fast and Stable Off-Policy Reinforcement Learning for High-Dimensional Robot Control","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T17:08:31.770889Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2604.04539"},"observation_digest":"sha256:4287a320e63bd38e30135ce77430d703b59e6657d1d5e13b9b26e15bdab73d89","observation_id":"7380ff40-5d3f-48e0-9a10-f1c4a698a078","resolution":{"observed_at":"2026-05-19T17:12:41.381387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2410.09754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simba: Simplicity bias for scaling up parameters in deep reinforcement learning","venue":null,"work_id":"94a05c6d-b7e0-4ddb-b407-1bc38fd6aacf","year":2024},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-06T08:24:06.705324Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T05:33:19.038889Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:f4c884473524d8dddddd9dd451deb8e6bb6d37f46152c3ad32f2ff5243eab181","observation_id":"be1bb9dc-e7a6-4167-a050-86b5f8e121a1","resolution":{"observed_at":"2026-05-12T05:36:24.525705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2410.09754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simba: Simplicity bias for scaling up parameters in deep reinforcement learning","venue":null,"work_id":"94a05c6d-b7e0-4ddb-b407-1bc38fd6aacf","year":2024},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-06T08:24:06.705324Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T06:27:38.643667Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:a0cc5a18cd5ef3c123f5a19a551ee06e320d3713bab43b98099c99390579b187","observation_id":"f38b74cd-9257-4006-b173-984feb108052","resolution":{"observed_at":"2026-05-13T06:32:24.792556Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2410.09754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simba: Simplicity bias for scaling up parameters in deep reinforcement learning","venue":null,"work_id":"94a05c6d-b7e0-4ddb-b407-1bc38fd6aacf","year":2024},"citing_paper":{"arxiv_id":"2605.10236","last_updated":"2026-05-17T21:09:20Z","snapshot_observed_at":"2026-08-06T08:24:06.705324Z","submitted_at":"2026-05-11T09:11:05Z","title":"When Does Non-Uniform Replay Matter in Reinforcement Learning?","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T23:04:12.943222Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2605.10236"},"observation_digest":"sha256:015aa8df8b0256e7694740ff5ddd35ff09fbe2ef56ff80a7f0b43ea2eaf486f3","observation_id":"f5693bc5-6d19-4576-9e5a-f69059016ed3","resolution":{"observed_at":"2026-05-20T23:09:12.767631Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2410.09754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.09754","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simba: Simplicity bias for scaling up parameters in deep reinforcement learning","venue":null,"work_id":"94a05c6d-b7e0-4ddb-b407-1bc38fd6aacf","year":2024},"citing_paper":{"arxiv_id":"2605.11473","last_updated":"2026-05-12T03:40:28Z","snapshot_observed_at":"2026-08-02T04:53:57.647690Z","submitted_at":"2026-05-12T03:40:28Z","title":"TOPPO: Rethinking PPO for Multi-Task Reinforcement Learning with Critic Balancing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T01:48:13.679862Z"},"links":{"cited_paper":"/paper/2410.09754","citing_paper":"/paper/2605.11473"},"observation_digest":"sha256:2978f62df72787de14162f9903dbc500a2d754c6679b03e0375d33f04c74a207","observation_id":"547e4950-ed51-4955-b1d5-9c4976222803","resolution":{"observed_at":"2026-05-13T01:52:05.707461Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.09754/citation-record","integrity":"/paper/2410.09754/integrity","json":"/paper/2410.09754/citation-record.json","paper":"/paper/2410.09754"},"outbound":[],"paper":{"arxiv_id":"2410.09754","last_updated":"2025-05-29T15:02:38Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T19:32:28.772012Z","submitted_at":"2024-10-13T07:20:53Z","title":"SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2410.09754."}