{"as_of":"2026-08-16T00:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0bd7371da87f81a4f1f926ec933fd3932722f54c1a50cee5756383b00a032b68","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T15:53:32.157604Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:30:33.405381Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T00:30:33.915193Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.01307","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.01307","snapshot_observed_at":"2026-08-12T00:30:33.915193Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","venue":"cs.LG","work_id":"3517f1cb-5072-422b-b727-b1c3f8562f0b","year":2025},"citing_paper":{"arxiv_id":"2608.08158","last_updated":"2026-08-08T14:35:29Z","snapshot_observed_at":"2026-08-14T20:47:59.935303Z","submitted_at":"2026-08-08T14:35:29Z","title":"A Unified Framework for Dynamic Reward Shaping in Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T00:30:33.405381Z"},"links":{"cited_paper":"/paper/2502.01307","citing_paper":"/paper/2608.08158"},"observation_digest":"sha256:78d1c84bb1ed8e09a61dfdf7674d7a4e6ff1605515d836180f04017b66dc2d63","observation_id":"b7ba16a5-905d-445e-8ee6-73f009a8f600","resolution":{"observed_at":"2026-08-12T00:30:33.920720Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01307/citation-record","integrity":"/paper/2502.01307/integrity","json":"/paper/2502.01307/citation-record.json","paper":"/paper/2502.01307"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.666512Z","title":"Barto, Richard S","venue":null,"work_id":"fe38bf16-dbcb-4aca-ab3a-ace48064a983","year":1983},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.723317Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:b01e021b8a5091ffc43ae60d04e43394f9bbf3072fb924d703c1ea82c927c1cc","observation_id":"ca539b16-a978-4f86-b227-c4a58930fbce","resolution":{"observed_at":"2026-08-09T15:53:32.670906Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:33.109615Z","title":"Taylor, and Ann Nowé","venue":null,"work_id":"31471d9d-7e97-4829-8654-317dd0b36b9d","year":2015},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.728137Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:68083ddeb0569a958f2aaf391ae6d2a321fae58841b0e32770213a39c6eb80c0","observation_id":"d0a6af8f-694e-472b-9d9c-10fa0d15fc5d","resolution":{"observed_at":"2026-08-09T15:53:33.113435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.969446Z","title":null,"venue":null,"work_id":"d141b611-3c39-4cec-9b59-356f7521130e","year":2012},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.732529Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:e23f5202cfc569e42d70e32773a50e721be007fb4d2b1ebc2109bd3ed536a44b","observation_id":"8e34cd33-e1cd-47fb-9a16-3e5d30f80580","resolution":{"observed_at":"2026-08-09T15:53:33.047341Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00521-022-07396-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Neural Computing and Applications","work_id":"8f3280ef-f1f9-4ecb-9055-e461922df0bf","year":2022},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.736522Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:577f267793c8fec81df1ca50212908261c6a313546f01ba36fda9e1c641d63da","observation_id":"d036e21c-6d30-4d33-97dd-e0c6e8039f35","resolution":{"observed_at":"2026-08-09T15:53:32.284105Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.826411Z","title":null,"venue":null,"work_id":"290af7d4-990d-47dc-9bb5-504e68e6e350","year":2017},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.740764Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:861d330d31714ee7a9743b4ea24b07fb473aac7958ef6a407174e19552e41bdd","observation_id":"4fb57fc7-c6a4-4377-ad3e-846adc982648","resolution":{"observed_at":"2026-08-09T15:53:32.878896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:31.744642Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.744642Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:9746e92cf6b380423a12d9c0259eba9397683e2d25690d5e628b4ba0e23597eb","observation_id":"27da9c99-abfb-4c81-a7a4-655e2594a991","resolution":{"observed_at":"2026-08-09T15:53:31.744642Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.783538Z","title":"Melham, and Daniel Kroening","venue":null,"work_id":"43b45511-dc4c-4d6d-badc-ebdd7b523c9f","year":2021},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.750137Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:102b6c1a59340ca4e39cbbc9e58a5b8dc35cac1ed4da581ce5a2bf7c5b9cac92","observation_id":"517a11bb-d2b8-490d-a49d-aa0aa849a971","resolution":{"observed_at":"2026-08-09T15:53:32.787309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.771185Z","title":"Laurent, and Nadine Le Fort-Piat","venue":null,"work_id":"6b2b3a0f-fe86-4938-9bc5-657937fc9cf3","year":2006},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.754118Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:1cc30e03830925112aaad2262c127e3ddda1d9a25cf06f34df589401cbbe098c","observation_id":"05e56b6b-e337-4292-aed2-21a0146ecfa3","resolution":{"observed_at":"2026-08-09T15:53:32.775993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-09T15:53:31.757246Z","title":"Riedmiller","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.757246Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:706cbaf02bcf2c8a38a8042ad12bcb7cc85dee5015e8a67a4596643d28d40654","observation_id":"b3e88653-8908-4611-a075-b91676d5afee","resolution":{"observed_at":"2026-08-09T15:53:31.757246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.759759Z","title":null,"venue":null,"work_id":"12c82000-557e-407a-8f4a-0c74965e35d6","year":1990},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.763272Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:9cc7245ba621d22224a0f721839df4f4c755a4852995bd4018d1d5b6ee8c9ce2","observation_id":"78abee11-8c22-4474-831b-f699461d0b96","resolution":{"observed_at":"2026-08-09T15:53:32.763619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.747519Z","title":null,"venue":null,"work_id":"7fcdaa9f-1c6f-4a3f-8641-eabf89553c3b","year":2025},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.766619Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:79b7a188309f09cbd5840f0285d6055dd88cd8d1dde81a2bedf3705bac8b0c2d","observation_id":"50d6bddc-13ad-4f31-8bda-331d9335364b","resolution":{"observed_at":"2026-08-09T15:53:32.751895Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.734661Z","title":"Ng, Daishi Harada, and Stuart J","venue":null,"work_id":"2fdd096c-f402-4445-9984-956746bd39bc","year":1999},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.834229Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:368bf17e3b2ef6240e113a0a35fc422fe3ee0a035fcf58a719c04e5e70f0af1d","observation_id":"4abc8205-a6f3-4a41-a878-3e2ee6017e18","resolution":{"observed_at":"2026-08-09T15:53:32.738373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.721667Z","title":null,"venue":null,"work_id":"07287764-1ae7-4bcf-8822-f64acae7f3b9","year":2021},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.882421Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:918c4707b8519777a87c559859cd5bc0808d9e78389f973d0d7282856da9a706","observation_id":"06282a0c-a527-47de-b42e-00fbf7ed0cdc","resolution":{"observed_at":"2026-08-09T15:53:32.726273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.709659Z","title":"Taylor, and Sonia Chernova","venue":null,"work_id":"d680f2c1-cfdd-4eb4-9246-e625e067e5ac","year":2016},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.930428Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:361260ceede80f9ac4e2ff584bb060d9145b7591fe615bb3b925abdd1d4a24b2","observation_id":"2c64ae1b-9483-4111-a55f-4931da379fe4","resolution":{"observed_at":"2026-08-09T15:53:32.713261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.695694Z","title":null,"venue":null,"work_id":"493689c5-df29-4f42-a342-1e3775bcac64","year":2022},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:32.009046Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:6ef1fb3b7ef6501da539f356f5e423026d12b024be1e8d99c7c876a9738b0691","observation_id":"ef672d9a-60d6-4e2f-9099-f593593cc487","resolution":{"observed_at":"2026-08-09T15:53:32.701059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.680431Z","title":null,"venue":null,"work_id":"7524c353-5dd6-48b4-bcb3-4325448259eb","year":2023},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:32.067072Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:dd378cfad603e0821536e98527bad77353454c47f522e3842dcd165804ab1230","observation_id":"5f1d56ae-afaa-489a-a991-e5e9724ed641","resolution":{"observed_at":"2026-08-09T15:53:32.684648Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.111397Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:32.111397Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:59c2609d0454700ed87dfe1cca3ebcd91f2135909344d59dc85eb4f9a609ea63","observation_id":"64a50466-0a8f-4377-a7f9-ee7578729082","resolution":{"observed_at":"2026-08-09T15:53:32.111397Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.326979Z","title":null,"venue":null,"work_id":"63267924-a78d-4c2f-87ae-7f0239be3ef1","year":2021},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:32.157604Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:5b7305b09ee65d09d151f2f2a10dd2c1f195be2772294cec548d32ce2c79cba8","observation_id":"00ff156b-3326-4267-94aa-3accd532ef45","resolution":{"observed_at":"2026-08-09T15:53:32.331509Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":3,"verified_fuzzy":5},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 1 inbound Pith citation observation for arXiv:2502.01307."}