{"as_of":"2026-08-12T18:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0e58cf9127f29ebfc865895f596d024780466162c6dc2eec95a5e659878b1528","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:12:39.393962Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.03487/citation-record","integrity":"/paper/2507.03487/integrity","json":"/paper/2507.03487/citation-record.json","paper":"/paper/2507.03487"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.00577","last_updated":"2023-11-27T15:57:06Z","snapshot_observed_at":"2026-08-09T16:10:30.032242Z","submitted_at":"2023-06-01T11:45:45Z","title":"TorchRL: A data-driven decision-making library for PyTorch","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00577","snapshot_observed_at":"2026-08-06T20:12:39.323473Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.323473Z"},"links":{"cited_paper":"/paper/2306.00577","citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:2d692e9d6a1578884f6d2e96ba64656ef5e4fb95d40977f8daf11f3136352b8a","observation_id":"39cfc245-b787-46fa-a6c2-5420fe5d9f36","resolution":{"observed_at":"2026-08-06T20:12:39.323473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.327517Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.327517Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:62ac97e0302cfea5745345c24a3755f1cf045d021894625ab8584a5269165b98","observation_id":"061c7f0f-86a3-4ef9-962a-ef010bc44589","resolution":{"observed_at":"2026-08-06T20:12:39.327517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.626855Z","title":"Ciosek, Q","venue":null,"work_id":"9db67d45-2a43-40b6-a397-7549c8d56082","year":2019},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.330579Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:2f7b1300a90ef0604f636c1f5bc00708898ce0d135bdd47b19dd56b44c633aa7","observation_id":"82463abc-c3b9-4648-a200-061b08f70f13","resolution":{"observed_at":"2026-08-06T20:12:39.630531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.615902Z","title":"D'Eramo, D","venue":null,"work_id":"9f696c49-771b-4b00-98b3-8dbcc0cc3062","year":2021},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.333514Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:ff2e09ccb974d05d178e682413802deb8e255ee6d706a49070379f1d629d3887","observation_id":"16bdaace-7a72-4e4f-83b7-5cf7c9a78905","resolution":{"observed_at":"2026-08-06T20:12:39.619884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.603825Z","title":"Eschmann, D","venue":null,"work_id":"f12f54bd-a9ef-41c1-9489-938b969b034f","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.336648Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:2a25368f50c8e7b16dd634a5da5fe0c68223261add50b72c9073f459c279e461","observation_id":"c2fdecae-aaec-4506-ae33-8ca047666330","resolution":{"observed_at":"2026-08-06T20:12:39.607558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.594259Z","title":"Fujimoto, H","venue":null,"work_id":"4cfebc5c-8d83-433e-9345-4c0b0b241826","year":2018},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.340694Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:a654ada4733bcf336b5eca739e20a4a8b8bc4fb8f0a48dd638c61128355c7578","observation_id":"2c126fed-08d2-4600-86b8-32683f442e28","resolution":{"observed_at":"2026-08-06T20:12:39.597486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.343880Z","title":"Haarnoja, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.343880Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:c5af594274a9d10ac44e763669f1660d039f14733b4f9adf943702dbc3110163","observation_id":"724d2cfd-47a7-4142-afe9-ab9b0777c8b8","resolution":{"observed_at":"2026-08-06T20:12:39.343880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.579351Z","title":"Huang, R","venue":null,"work_id":"02f1e4ba-12dd-47ec-80c5-3333a3a5dc45","year":2022},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.346709Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:fe6f1b05d6fe6c7cf710cacd6fec4ef44202144808807875ba05b0f4afa3e7e1","observation_id":"67fde5d9-20bc-4476-9911-b9e2992efb6a","resolution":{"observed_at":"2026-08-06T20:12:39.582532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.569235Z","title":"Liang, R","venue":null,"work_id":"1d39fd53-7592-4ee4-856b-94589dc1dfc6","year":2018},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.349438Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:37c88a61c0613ca33e96aa316bc3fed7f4a6a91926a14a972f782a63b556e4a9","observation_id":"349274ae-85ad-4c60-bdd4-61a23d3defeb","resolution":{"observed_at":"2026-08-06T20:12:39.573841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.559799Z","title":null,"venue":null,"work_id":"323110d1-364c-4276-b2e4-45b8eaec665c","year":2016},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.352183Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:6f81c7608be827f7fff5c851ca2f62a1114d65fb5f76c01dbd8e1c0dbe1626d1","observation_id":"172e5ded-fda5-4aa3-9588-dacc830f0467","resolution":{"observed_at":"2026-08-06T20:12:39.563549Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.550844Z","title":null,"venue":null,"work_id":"497dd112-71cc-4db9-a8c0-4c5d2549ee80","year":2015},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.354942Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:50dfa0397a0b1894a46ba66afd25c15d4b5b7590065f15beba8b45e4d475a2a1","observation_id":"10a5f654-9a6c-4126-b23c-e48e6ff39023","resolution":{"observed_at":"2026-08-06T20:12:39.554209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.541168Z","title":"Raffin, A","venue":null,"work_id":"992d4619-7208-428e-85b0-c7fb88101964","year":2021},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.357646Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:cbaa1696d20a3ff00903f82cec212a9023918abfb4fd42b8f24c68140eb6293f","observation_id":"696ece65-2736-4f35-85ee-be673fd65cb2","resolution":{"observed_at":"2026-08-06T20:12:39.544512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.530591Z","title":null,"venue":null,"work_id":"267e4d47-ddf0-4c2e-bbf5-1250ebff1576","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.360418Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:f38c7a142958e28310b8a9249316ffd4ab0787dd2e844370de8da411de0c18ea","observation_id":"34c5c8bf-1d57-4a89-bb06-93e646a097b9","resolution":{"observed_at":"2026-08-06T20:12:39.534009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T20:12:39.364471Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.364471Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:5b6b3bb7a0485194ce7ea6c8eeaa2e94b8245a8a15c42d2f83352d0131520941","observation_id":"24f3991a-e7dc-45ec-bfec-a1158faa05ca","resolution":{"observed_at":"2026-08-06T20:12:39.364471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.520616Z","title":"Serrano-Mu \\ n oz, D","venue":null,"work_id":"9889eca0-38c4-4ad3-bd09-7add6fe2dfc3","year":2023},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.368580Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:0001a8a5f0d2c132b147402ffa7265ed5f0e16c37be6767c6d7b38a050a355d9","observation_id":"9ecbbc17-c7aa-4d14-a745-c184a2711c61","resolution":{"observed_at":"2026-08-06T20:12:39.524313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.511853Z","title":"Smith, I","venue":null,"work_id":"2c35c322-a3b5-42e4-88ae-c5d41e18870d","year":2023},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.371374Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:3d84da20c7e3f4653fc69199a86ad8a3f8dcccda9c993a4a21389c1beb84b126","observation_id":"6f530449-22aa-4230-a384-26b3bf5b559f","resolution":{"observed_at":"2026-08-06T20:12:39.514910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.501621Z","title":null,"venue":null,"work_id":"f870b593-5411-4e11-b504-e391c375787a","year":2018},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.373848Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:ccdff8b82f71b1c982419054ac0994c09b4c037b45a642b8edebe991289550c5","observation_id":"02505c29-3a4c-4353-a11a-d5adb64be135","resolution":{"observed_at":"2026-08-06T20:12:39.505674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03055","last_updated":"2025-08-20T07:52:22Z","snapshot_observed_at":"2026-08-06T20:40:18.407512Z","submitted_at":"2024-02-05T14:42:45Z","title":"Deep Exploration with PAC-Bayes","version":5},"cited_work":{"arxiv_id":"2402.03055","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.03055","snapshot_observed_at":"2026-08-06T20:12:39.423615Z","title":"Deep Exploration with PAC-Bayes","venue":"cs.LG","work_id":"ee79bac3-457a-4621-a27d-8393402eeecc","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.376428Z"},"links":{"cited_paper":"/paper/2402.03055","citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:504301ecad71ac2499a358cf5f6eb8b20fd50158104ff20efddbf0d7b1a234f7","observation_id":"41b532c0-9ed2-4768-81a4-ae46cd8e0766","resolution":{"observed_at":"2026-08-06T20:12:39.429094Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.491440Z","title":"Todorov, T","venue":null,"work_id":"ffe5342f-e04e-4269-a0ff-2c10c4dfff34","year":2012},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.379432Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:8a3b075ad9ef04d2ad88814c49d9ca07d9a68045181bb58dd5cb168c0cdcfc76","observation_id":"c945b5b7-78c8-4fed-a06c-d7d34ae756af","resolution":{"observed_at":"2026-08-06T20:12:39.494398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-08-12T13:10:57.260306Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T20:12:39.381986Z","title":"Towers, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.381986Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:a9b91a7ece51e0ba3673c12af768625a061fd181c55e3fca6e413b30f833c26f","observation_id":"96f2a5c3-af0b-4775-b5ba-d73dd3ecf20a","resolution":{"observed_at":"2026-08-06T20:12:39.381986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.480870Z","title":null,"venue":null,"work_id":"ffd0af9f-5d59-44ce-8dee-d2597e9dccd0","year":2023},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.385310Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:1db45ef00a467f889947b1bbdf7b72addcbc1b8de6a59d74e5dd7ed9f6e053ff","observation_id":"c0097115-9507-4720-9555-0aaa652a110b","resolution":{"observed_at":"2026-08-06T20:12:39.484506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.471493Z","title":null,"venue":null,"work_id":"4a33b741-e004-4fef-bfe1-ab04344b1266","year":2022},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.388573Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:12253a699e0cd313c95e98d3a2508825a34266eb9fe3ec4bf3e66c27563c2ad8","observation_id":"d4713f1e-3b1f-41e0-bd19-afe8383f2891","resolution":{"observed_at":"2026-08-06T20:12:39.474633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.462154Z","title":null,"venue":null,"work_id":"2c90d79f-4ec0-4504-8f53-6f3b0b681d95","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.391279Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:cf127bfae1d6fe10e2e842c1ab0483d44c0e24c183bfce01286486c41bf63374","observation_id":"e0b3fe47-9d80-462f-90d3-7609ba13b098","resolution":{"observed_at":"2026-08-06T20:12:39.465207Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.452644Z","title":null,"venue":null,"work_id":"b5a27a06-ec24-44c7-9939-8ad59ea23fd0","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.393962Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:0b0ef0155dafadd952d10f4f132bd880a64953b497d5f64e9c219d54a724a613","observation_id":"d58c4c43-a7b0-4978-9952-1768b95557d4","resolution":{"observed_at":"2026-08-06T20:12:39.456356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T18:03:12.584577Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2507.03487."}