{"as_of":"2026-08-21T17:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86519e2ee8bf6776cc05096f14a8500adc2c0a18d45f184f713da8e14b3f0e00","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:58:05.684205Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15806/citation-record","integrity":"/paper/2411.15806/integrity","json":"/paper/2411.15806/citation-record.json","paper":"/paper/2411.15806"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.198942Z","title":"A Tour of Reinforcement Learning: The View from Continuous Control,","venue":null,"work_id":"edb0b918-5760-46af-a503-5dc88cd5dd4f","year":2019},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.567610Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:cf966300a62047808f7fb9581cd87c6b252ce3db106a9eb79361e37d158f0593","observation_id":"785cd5e4-0509-4189-b0e4-9b8c4b882fe4","resolution":{"observed_at":"2026-08-12T13:58:06.203115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.186934Z","title":"Deep reinforcement learning on variable stiffness compliant control for programming -free robotic assembly in smart manufacturing,","venue":null,"work_id":"b9bbdb2f-78fa-4d3c-8ef5-45d1c890b6ac","year":2024},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.572119Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:acd56f492bd548d2b233dcd381222e2fa3c45cd9d3183eb181325e824fad11dd","observation_id":"7bed4c13-dadd-4623-9d89-6e17f95010bd","resolution":{"observed_at":"2026-08-12T13:58:06.190695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.174679Z","title":"Augmenting reinforcement learning with Transformer -based scene representation learning for decision-making of autonomous driving,","venue":null,"work_id":"d5903beb-ca85-472b-82a9-4e5b3b1da189","year":2024},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.577221Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:d0dfe740b2134aee7a9096b3c7e6a1c9c1a03fc1f8e8d4f3e9dea75c601c6e45","observation_id":"a1efc453-582b-4630-8d16-2c6dfb7c826b","resolution":{"observed_at":"2026-08-12T13:58:06.179234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.161462Z","title":"A review on reinforcement learning: Introduction and applications in industrial process control,","venue":null,"work_id":"bc24543e-8440-4bb8-8823-4fa484f95530","year":2020},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.581734Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:359d73d7c8e506891c80f6b8757bb6a28938496bddf965fc8a8c7a1f8c6845c4","observation_id":"bec882f9-ecb0-4193-88cb-bd22b1749ccc","resolution":{"observed_at":"2026-08-12T13:58:06.166135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.149578Z","title":"An application of reinforcement learning to aerobatic helicopter flight,","venue":null,"work_id":"10c01a7b-3203-41c6-90e1-d56910bc2d43","year":2006},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.585765Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:8f5fb442a249a6e3502edfb41ef34c710d3c6d83cfe9c8723987af0077322d80","observation_id":"4a2d83a1-bcc3-4f1b-9421-3ca89ab7cc1e","resolution":{"observed_at":"2026-08-12T13:58:06.153887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.137989Z","title":"Benchmarking deep reinforcement learning for continuous control,","venue":null,"work_id":"040c15bc-0335-496e-a743-9afb66924bcc","year":2016},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.589583Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:d338c480a379dd3d9ba8282f1b4a5c784fa693072bf2afa65d4d1dfbb4b1da94","observation_id":"b61bc13a-9b71-4f60-afa2-33afeaa74930","resolution":{"observed_at":"2026-08-12T13:58:06.142262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.127136Z","title":"Reinforcement Learning in Continuous State and Action Spaces,","venue":null,"work_id":"dbabd867-7dd1-453d-87e5-45368bdc6deb","year":2012},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.593951Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:e56463cdb72f24adfdc60c3f6ecaebc1e7d257c92101556f13de7e944eeaff19","observation_id":"356d7e1c-0707-4038-9ba1-59fc5799c4f7","resolution":{"observed_at":"2026-08-12T13:58:06.130905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.116160Z","title":"Overview of deep reinforcement learning improvements and applications,","venue":null,"work_id":"69a7dead-b8f1-49d9-a170-d0b74ff96118","year":2021},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.597772Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:52ed115c05e1132a73a52218cfe2a196e5fae07c8b706b106aceda58a0d024e0","observation_id":"27ec2f1f-b7b2-4e92-827d-1762363791b4","resolution":{"observed_at":"2026-08-12T13:58:06.120023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.104026Z","title":"Broad learning system: An effective and efficient incremental learning system without the need for deep architecture,","venue":null,"work_id":"ce924f1e-aeba-4c94-adae-b8592dfdd299","year":2017},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.601434Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:72a65ed9d8036d260fee2cf7dea4e86c691122fb9c30deb79e39900b42588c45","observation_id":"084d5bd7-1ec4-4d83-af55-ef5b8cd246fd","resolution":{"observed_at":"2026-08-12T13:58:06.108043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.092455Z","title":"A survey of actor-critic reinforcement learning: Standard and natural policy gradients,","venue":null,"work_id":"119c71a1-ec05-4953-91ba-262dddfaec03","year":2012},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.605016Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:926300e0cd1db38308357e3532ae392f4eeb8fdbb9d90112b8a50b4c881c7ac1","observation_id":"81ba2bb5-dd89-493b-a670-76ccd6a076a0","resolution":{"observed_at":"2026-08-12T13:58:06.096200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-12T13:58:05.608678Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.608678Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:0227fbf869b6da4a0be86fa505a7960cf9139551676ab7aeeed39b7312a4166e","observation_id":"824043f5-5be4-4cfe-98c1-7cd1a8c87d09","resolution":{"observed_at":"2026-08-12T13:58:05.608678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.081700Z","title":"Soft actor -critic: Off- policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":"501aa7a1-493e-46ea-b5bd-db8f46bdab85","year":2018},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.612901Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:67cc542e26ce99a1c7643d0e784e392af73e762147487d0a467a1a1b9c49d300","observation_id":"810ca7a6-1217-4845-a553-bb933734786d","resolution":{"observed_at":"2026-08-12T13:58:06.085623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.070238Z","title":"Addressing function approximation error in actor-critic methods,","venue":null,"work_id":"7278b632-7f0e-431a-997e-215184864210","year":2018},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.616986Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:761f3fab101c717a2d106789f1ee73eb4763396ddf579fab42dfb73b6b00a546","observation_id":"6e33bfa0-bc43-4891-8d36-7ee240743c8c","resolution":{"observed_at":"2026-08-12T13:58:06.074196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.058382Z","title":"Broad reinforcement learning for supporting fast autonomous IoT,","venue":null,"work_id":"2651c2ef-56f1-4daf-abc4-ce711321bfd8","year":2020},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.620674Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:378db4e4226d36b48e7331c3c5bf7b833e5ea1c1a26752da20f04f40e527a30e","observation_id":"24270904-5c42-42fd-a6cf-e9430664e13c","resolution":{"observed_at":"2026-08-12T13:58:06.062250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.046513Z","title":"Deep reinforcement learning with double q -learning,","venue":null,"work_id":"672bcf0f-a127-4c78-8497-19c187e882eb","year":2016},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.624176Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:bab024346c12432b9169b0cf490a1931f6de26f05830a89907c9d58276493d0a","observation_id":"9ba619c4-8fb2-4570-95f3-00f7a8bb9912","resolution":{"observed_at":"2026-08-12T13:58:06.050668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.035880Z","title":"Efficient Incremental Offline Reinforcement Learning With Sparse Broad Critic Approximation,","venue":null,"work_id":"8110c5fb-9cf3-447e-8003-908e3d6bf302","year":2023},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.627720Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:a7f168584914e04bbcb117ec9c6e7e891f5f0b8842aa43fecb87b1148d47a7d7","observation_id":"6a5e2b10-0ac4-454d-92ce-9ffc75c18161","resolution":{"observed_at":"2026-08-12T13:58:06.039657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.024662Z","title":"Broad learning with reinforcement learning signal feedback: Theory and applications,","venue":null,"work_id":"a9ef949a-f37a-479d-9580-b52a73dcbc6b","year":2021},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.631269Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:a4b746fbfc12d3fba4e7e934fe0692232f68d5bfbcd64ccd08081e6502777bda","observation_id":"41be2256-c8be-40da-835a-0cc62ab4e060","resolution":{"observed_at":"2026-08-12T13:58:06.028429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.012225Z","title":"Reinforcement learning control with knowledge shaping,","venue":null,"work_id":"8104ebee-0276-4ec4-93c5-29bc4810ac16","year":2023},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.635198Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:a5347094d70cddf818c23eb1cf059fa34b03e6da9caae9c5ddb66fd4d4a82af7","observation_id":"0c1c0634-cfc8-4cf8-ba06-34acb3ad3375","resolution":{"observed_at":"2026-08-12T13:58:06.016733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:06.001139Z","title":"Stochastic integrated actor –critic for deep reinforcement learning,","venue":null,"work_id":"7bdbf855-d1bb-495a-937b-afde572ab1f0","year":2022},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.638726Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:04d4a11e145af0bf6511a1174e5151f637387050a9bafb13cfed4ad00232a841","observation_id":"30f18e48-e056-4ffe-be65-fb4f0fde9c0f","resolution":{"observed_at":"2026-08-12T13:58:06.005017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.989307Z","title":"Human -level control through deep reinforcement learning,","venue":null,"work_id":"1d3c0f5a-c9aa-4fce-bbe2-519500b8777d","year":2015},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.642151Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:f963214e02e9e55f839ef7f83fc63c82a71128279dac86f77c1880cfd6a82f01","observation_id":"16447aae-e696-4b21-b1ca-c13935d0df56","resolution":{"observed_at":"2026-08-12T13:58:05.993485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.973481Z","title":"Generalized inverse of a matrix and its applications ,","venue":null,"work_id":"bbffe5f6-0c68-4629-94e5-190758e7c437","year":1972},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.645819Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:492fd37f4ec80560670c7587ab0108ea147c5dcc89e9aa89b922601c64e901d5","observation_id":"b5fde6f8-9597-4521-b716-1e19cce33d6c","resolution":{"observed_at":"2026-08-12T13:58:05.977873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.960701Z","title":"Mujoco: A physics engine for model-based control,","venue":null,"work_id":"ebcc7331-8dc4-4410-b932-e624e081ef56","year":2012},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.649369Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:695aa8fd4115e17989322f8401da971203889d2a9f7be1aebae5f9ea1491aac2","observation_id":"45ea8456-1b7f-42cd-b867-056a243ff26d","resolution":{"observed_at":"2026-08-12T13:58:05.964743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-12T13:58:05.652838Z","title":"OpenAI Gym","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.652838Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:8abfeb8435a3dfc3af850c35cfbabe4987a57316f12c1b6570c6bbc6932f6ccc","observation_id":"e760b116-b7e9-4584-9dee-7a9b60e1757c","resolution":{"observed_at":"2026-08-12T13:58:05.652838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.949328Z","title":"TensorFlow: a system for Large -Scale machine learning,","venue":null,"work_id":"fd60524e-6cb1-4e03-bbdc-f02550c4e39a","year":2016},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.656953Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:c7753a97e0439176d7228efc538543be763c45d05184d8c0a6c68db5597516f4","observation_id":"d9b6dd9c-5c52-4b8f-b69b-d10d4f377536","resolution":{"observed_at":"2026-08-12T13:58:05.953267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.937824Z","title":"Rectified linear units improve restricted boltzmann machines,","venue":null,"work_id":"33de052c-4006-4e36-97cc-cba689c7e902","year":2010},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.660524Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:69a987967c2e868b4a68d75137ecbfb13881d7f2deb753247bf559adcba42f29","observation_id":"bed9e67b-6ee8-462b-9c64-69a265b32b20","resolution":{"observed_at":"2026-08-12T13:58:05.941949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.926171Z","title":"Dynamic event - based tracking control of boiler turbine systems with guaranteed performance,","venue":null,"work_id":"b022fc00-860a-4ca1-bb65-535003516ad6","year":2023},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.664268Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:95d204544f3f5d03172a1784ab70629b5ef0d25c67cf6bdbb04eb65205b0fee8","observation_id":"3f28953d-530b-46aa-abc9-3558d7fa4abb","resolution":{"observed_at":"2026-08-12T13:58:05.930319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.914854Z","title":"Ensemble bootstrapping for q-learning,","venue":null,"work_id":"d1be1003-85a4-46c0-9eb4-0706c1098c40","year":2021},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.667860Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:6e90a61fd758e1da2166bc4495abc6e4ff45f51a98d6d10bc13c36167fad2b45","observation_id":"a7e44d03-0018-47aa-a8ba-dd078cc52521","resolution":{"observed_at":"2026-08-12T13:58:05.918565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.671411Z","title":"Dropout: a simple way to prevent neural networks from overfitting,","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.671411Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:e0bb854b6e313d6f4756e9c33317cefd5143cd790df9d1150e2309ea6eb8d7e8","observation_id":"bcad7502-4363-4525-9470-a148bc399a7d","resolution":{"observed_at":"2026-08-12T13:58:05.671411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.896880Z","title":"Pruned Broad Learning System Based on Sparse Ridge Fusion,","venue":null,"work_id":"e7498f53-d2ba-4240-8a33-a7d1686bbe32","year":2023},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.675956Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:b922e539237c02540da3fe4ce80d1092e0fa6d58d20f6023c45a0c1d100ee996","observation_id":"515f722a-ac8b-4df3-97fb-8402b774715c","resolution":{"observed_at":"2026-08-12T13:58:05.901099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.884824Z","title":"Scaling distributed machine learning with the parameter server,","venue":null,"work_id":"7836d6ed-9441-455a-8db9-d3f426f03565","year":2014},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.680104Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:dbb715c30b802d1ab3dfc76406595a3b0294e0fe6adc41b865920adcc68cf51d","observation_id":"27833c1b-32be-423d-885b-5a2a63f5a862","resolution":{"observed_at":"2026-08-12T13:58:05.888555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1095782","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:58:05.840881Z","title":"Quarl: Quantization for fast and environmentally sustainable reinforcement learning,","venue":null,"work_id":"318c21a4-1c31-40d7-aa37-d22989487ada","year":2022},"citing_paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:58:05.684205Z"},"links":{"citing_paper":"/paper/2411.15806"},"observation_digest":"sha256:d8f981489930d9e7fb377e97c43469c0af4fea6afdafa9970c39d673f69390c4","observation_id":"828ec468-6477-4e50-8b2f-8cab4f408305","resolution":{"observed_at":"2026-08-12T13:58:05.851107Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15806","last_updated":"2025-04-12T14:53:47Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T15:43:04.331819Z","submitted_at":"2024-11-24T12:24:46Z","title":"Broad Critic Deep Actor Reinforcement Learning for Continuous Control"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2411.15806."}