{"as_of":"2026-08-19T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:28234b7b1d6bca09e7c46f62c31fa2fad0dba859e44956a859559617ef150061","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:52:31.735784Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T01:29:22.882961Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1910.04281","last_updated":"2020-04-03T19:08:25Z","snapshot_observed_at":"2026-08-18T21:04:11.907492Z","submitted_at":"2019-10-09T22:32:23Z","title":"Integrating Behavior Cloning and Reinforcement Learning for Improved Performance in Dense and Sparse Reward Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04281","snapshot_observed_at":"2026-08-15T20:52:31.735784Z","title":"Integrating behavior cloning and reinforcement learning for improved per- formance in dense and sparse reward environments,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.06291","last_updated":"2025-05-17T01:31:53Z","snapshot_observed_at":"2026-08-17T11:52:23.736359Z","submitted_at":"2025-05-17T01:31:53Z","title":"Improvement of Optimization using Learning Based Models in Mixed Integer Linear Programming Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:52:31.735784Z"},"links":{"cited_paper":"/paper/1910.04281","citing_paper":"/paper/2506.06291"},"observation_digest":"sha256:4f7169cb78061537bfece8057dee5f40e2f8830872fc0691334c097f4b60fba9","observation_id":"d827501b-a0fe-48b6-b5b8-7de3a6b9ea3e","resolution":{"observed_at":"2026-08-15T20:52:31.735784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04281","last_updated":"2020-04-03T19:08:25Z","snapshot_observed_at":"2026-08-18T21:04:11.907492Z","submitted_at":"2019-10-09T22:32:23Z","title":"Integrating Behavior Cloning and Reinforcement Learning for Improved Performance in Dense and Sparse Reward Environments","version":2},"cited_work":{"arxiv_id":"1910.04281","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.04281","snapshot_observed_at":"2026-07-04T01:29:22.882961Z","title":"Integrating behavior cloning and reinforcement learning for improved performance in dense and sparse reward environments","venue":null,"work_id":"814e1170-7444-41ea-8c19-dd3c758f61c8","year":1910},"citing_paper":{"arxiv_id":"2605.15855","last_updated":"2026-05-15T11:14:13Z","snapshot_observed_at":"2026-08-12T15:32:26.557707Z","submitted_at":"2026-05-15T11:14:13Z","title":"Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T19:48:17.049547Z"},"links":{"cited_paper":"/paper/1910.04281","citing_paper":"/paper/2605.15855"},"observation_digest":"sha256:f7066a3efef57615d085f6e33279552a50f6389b4653556241b0649e10cd362b","observation_id":"2fdfeb35-f613-4952-8c49-d2c8a44c354d","resolution":{"observed_at":"2026-05-20T19:48:57.317233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04281","last_updated":"2020-04-03T19:08:25Z","snapshot_observed_at":"2026-08-18T21:04:11.907492Z","submitted_at":"2019-10-09T22:32:23Z","title":"Integrating Behavior Cloning and Reinforcement Learning for Improved Performance in Dense and Sparse Reward Environments","version":2},"cited_work":{"arxiv_id":"1910.04281","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.04281","snapshot_observed_at":"2026-07-04T01:29:22.882961Z","title":"Integrating behavior cloning and reinforcement learning for improved performance in dense and sparse reward environments","venue":null,"work_id":"814e1170-7444-41ea-8c19-dd3c758f61c8","year":1910},"citing_paper":{"arxiv_id":"2606.11743","last_updated":"2026-06-10T07:20:36Z","snapshot_observed_at":"2026-08-04T03:57:45.233984Z","submitted_at":"2026-06-10T07:20:36Z","title":"TacCoRL: Integrating Tactile Feedback into VLA via Simulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-27T09:51:56.563479Z"},"links":{"cited_paper":"/paper/1910.04281","citing_paper":"/paper/2606.11743"},"observation_digest":"sha256:ee1b9c8cab08c911135636d63e8ec3265879b57e51e2c589427fc61757ca041d","observation_id":"51d8cc07-6db8-4ba3-981e-b530af6308a2","resolution":{"observed_at":"2026-07-03T10:48:02.226789Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04281","last_updated":"2020-04-03T19:08:25Z","snapshot_observed_at":"2026-08-18T21:04:11.907492Z","submitted_at":"2019-10-09T22:32:23Z","title":"Integrating Behavior Cloning and Reinforcement Learning for Improved Performance in Dense and Sparse Reward Environments","version":2},"cited_work":{"arxiv_id":"1910.04281","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.04281","snapshot_observed_at":"2026-07-04T01:29:22.882961Z","title":"Integrating behavior cloning and reinforcement learning for improved performance in dense and sparse reward environments","venue":null,"work_id":"814e1170-7444-41ea-8c19-dd3c758f61c8","year":1910},"citing_paper":{"arxiv_id":"2606.19656","last_updated":"2026-06-17T23:40:45Z","snapshot_observed_at":"2026-08-07T21:06:49.739571Z","submitted_at":"2026-06-17T23:40:45Z","title":"DF-ExpEnse: Diffusion Filtered Exploration for Sample Efficient Finetuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T20:19:15.766523Z"},"links":{"cited_paper":"/paper/1910.04281","citing_paper":"/paper/2606.19656"},"observation_digest":"sha256:4d08a5971bc9e56260bb8db8fe2ab611eebfd0b68b7a65f06f866fd861295584","observation_id":"c42ccdde-2c1a-4ef1-8a4d-99ec7f6deefa","resolution":{"observed_at":"2026-07-04T01:29:22.884235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1910.04281/citation-record","integrity":"/paper/1910.04281/integrity","json":"/paper/1910.04281/citation-record.json","paper":"/paper/1910.04281"},"outbound":[],"paper":{"arxiv_id":"1910.04281","last_updated":"2020-04-03T19:08:25Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T21:04:11.907492Z","submitted_at":"2019-10-09T22:32:23Z","title":"Integrating Behavior Cloning and Reinforcement Learning for Improved Performance in Dense and Sparse Reward Environments"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 4 inbound Pith citation observations for arXiv:1910.04281."}