{"as_of":"2026-08-09T19:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:34edfb69979f4018d5da8a6ef383552b9daaee1c554c18062f74bcaeb2c6d888","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:20:56.865176Z","state":"measured"},{"denominator":90,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":90,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18488/citation-record","integrity":"/paper/2607.18488/integrity","json":"/paper/2607.18488/citation-record.json","paper":"/paper/2607.18488"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:52.660047Z","title":"2018 , publisher=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:52.660047Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:f1d3aab12520aae5ee37dc8bfd345cbd5d6109f2306770bc6ea232e01082c37a","observation_id":"c8abd960-81f4-49e5-b01b-22079b1945c3","resolution":{"observed_at":"2026-08-01T15:20:52.660047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:52.748285Z","title":"Temporal difference learning and","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:52.748285Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:4db5401df4960bab22556ce9dbdaa5893494b91e537d8cab4abe88e00d633c4d","observation_id":"49d02bf8-4c54-4ef5-9e61-023b86817aa8","resolution":{"observed_at":"2026-08-01T15:20:52.748285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:52.855807Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:52.855807Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:f84a54605d761e8d65963151a5cc175a1dc2dde760beb6752bd4319e6f3f9542","observation_id":"944eb06a-fb23-4329-b04c-dec8232eb34a","resolution":{"observed_at":"2026-08-01T15:20:52.855807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:52.915054Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:52.915054Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:c472e545a29ab95e744de5bbd9fa29bf08805553f4ca166c725726d2edc8ddee","observation_id":"1947b968-f141-4aa4-9afa-eca3dd0a8a79","resolution":{"observed_at":"2026-08-01T15:20:52.915054Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:52.986924Z","title":", title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:52.986924Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:857f9f26029d7946ac7306ce6d544cea5ed280e727eeaede7d004c96d7d80417","observation_id":"5b850354-5504-4826-882c-043eb7bd4546","resolution":{"observed_at":"2026-08-01T15:20:52.986924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:53.019736Z","title":"and Naddaf, Yavar and Veness, Joel and Bowling, Michael , journal=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:53.019736Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:ef9b3f09dadd19cb8e75c5f4fc3edd053c02ac676d3b9c46df9f359c78e6d83a","observation_id":"83460b79-5399-47c0-885a-412f4b7e46b4","resolution":{"observed_at":"2026-08-01T15:20:53.019736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:53.070740Z","title":"Mastering the game of","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:53.070740Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:664c669a7ec806db31b127ca860e7107cf31a7878ef7dc28842327ad41e4c4ee","observation_id":"ce6a2e34-8551-4350-aa35-8ee1239e2733","resolution":{"observed_at":"2026-08-01T15:20:53.070740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:53.238287Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:53.238287Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:da460234464526b75dd35e9ae26102771dbffea7ac32e75d6a22530d7c2049e6","observation_id":"a4284f28-ef05-4253-979c-88003e906e6a","resolution":{"observed_at":"2026-08-01T15:20:53.238287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:53.439441Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:53.439441Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:d8ec60506ee87cae8ffa28f7d7053ac8ba3bfd8a8cb44ef6cf5ca637869f6477","observation_id":"de530681-5dac-43e8-a3df-db5cc989915c","resolution":{"observed_at":"2026-08-01T15:20:53.439441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:53.667832Z","title":"and Bellemare, Marc G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:53.667832Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:1d54efc2f19977d01342c2e09af5266ebe32804f9957f497c2cf5ab78d9489cc","observation_id":"34ea656e-3046-47d5-b7e7-8d6cb2927847","resolution":{"observed_at":"2026-08-01T15:20:53.667832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:53.833048Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:53.833048Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:72f250aa0573862c3fe24c287f40f92961f73d3cccdb1a80addf2aac58c71828","observation_id":"d206bd32-6a12-4574-ae41-daaced2747cf","resolution":{"observed_at":"2026-08-01T15:20:53.833048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.050525Z","title":"and Sutton, Richard S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.050525Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:ee7de581984b6585c270ab0f7d450db222f50affbc944daa28138fe6b4f72d19","observation_id":"54dc2ef5-efa6-492a-a0d8-709e9e1c5d9d","resolution":{"observed_at":"2026-08-01T15:20:54.050525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.130439Z","title":"Journal of Neuroscience , volume=","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.130439Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:612a709ff173e6f0855c7287cc0dc86d39950fc4a536e88397298040d021331d","observation_id":"8ce36c8a-8949-49ed-91b4-a7101fef9913","resolution":{"observed_at":"2026-08-01T15:20:54.130439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.134905Z","title":"Science , volume=","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.134905Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:d8952b714b21acea5b0981dc267fcacdaec6ba121bff49837223588b754f8212","observation_id":"dc3f4b07-e96b-4601-b2c4-7403ae255ab8","resolution":{"observed_at":"2026-08-01T15:20:54.134905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.150912Z","title":"and Adams, James L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.150912Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:d06242810eccc34c963406fc664afdcd85b592b351e54dd7622958b896a3b015","observation_id":"e46796c4-9009-4f3c-ad80-92d89e1ea939","resolution":{"observed_at":"2026-08-01T15:20:54.150912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.252614Z","title":"AAAI , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.252614Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:c6d789082d09ac32b9f4051607315eb1fe9bd6f7a9b8cab9b497219dfa9820d9","observation_id":"4f57d490-e4f6-43f6-8f45-fb51543b299c","resolution":{"observed_at":"2026-08-01T15:20:54.252614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.286703Z","title":"Sebastian , booktitle=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.286703Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:d45dc5f2f0ea6a527e65e601afd6b84a519741dfcc31b8667a8f113a49691d2c","observation_id":"0bc300e6-b690-4bce-b5e8-8d63e76fa176","resolution":{"observed_at":"2026-08-01T15:20:54.286703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.335033Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.335033Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:a0b56da88094671c3f447f07922ece70223b4db9705b6fcd6d2e286a32c28d8d","observation_id":"01c4c62a-cd34-4ce7-8146-877c2aa10aa9","resolution":{"observed_at":"2026-08-01T15:20:54.335033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.376603Z","title":"Conference on Robot Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.376603Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:697219f2421704ae464ff95c4eb0d2f92f82adbd64ea200cb284fb331a0541be","observation_id":"d20ca232-d9be-4b09-9e86-f378de898f71","resolution":{"observed_at":"2026-08-01T15:20:54.376603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.419398Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.419398Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:b678fc9cd41a72edd502071f3f0d2469172c96d1135b0b4b76b25719adb44da8","observation_id":"6065ec00-821a-4e33-bc89-7266386c3c50","resolution":{"observed_at":"2026-08-01T15:20:54.419398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.472046Z","title":"and others , journal=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.472046Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:4004d0d97298d259f6d9d76bea6cb67811bcf58067346fd6e92ccc543d119988","observation_id":"4bdc68ce-f826-4364-b899-29429cebd2eb","resolution":{"observed_at":"2026-08-01T15:20:54.472046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.506490Z","title":"The 10th International Conference on Autonomous Agents and Multiagent Systems-Volume 2 , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.506490Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:5b42aed06955f81149ec5b261f43e645ada135c8172ba8ce6e8eabb9edfe2110","observation_id":"11d717b9-1be7-4767-b476-1639a7c23b2a","resolution":{"observed_at":"2026-08-01T15:20:54.506490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.561315Z","title":", booktitle=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.561315Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:25880e49ff25d41987e68505aae01cff826d553da59dbb3141409a874974b1eb","observation_id":"fe39944e-52f6-429f-8d7b-c2d6c224a18d","resolution":{"observed_at":"2026-08-01T15:20:54.561315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.610297Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.610297Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:71665b7ab0734e63f880da366138bc065304ea61ff106233882f39269460fbb1","observation_id":"a886ff65-5379-44e1-9f00-19777150e900","resolution":{"observed_at":"2026-08-01T15:20:54.610297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.643890Z","title":"The International Journal of Robotics Research , volume=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.643890Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:d768f26a946f4af7164ed5765ac4375bba87a14a75ff593ccc0e23c7493b18b0","observation_id":"81e92fea-354b-4d50-8f31-d505bf224b89","resolution":{"observed_at":"2026-08-01T15:20:54.643890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15245","last_updated":"2021-10-28T16:04:01Z","snapshot_observed_at":"2026-07-06T12:03:06.452840Z","submitted_at":"2021-10-28T16:04:01Z","title":"From Machine Learning to Robotics: Challenges and Opportunities for Embodied Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15245","snapshot_observed_at":"2026-08-01T15:20:54.684330Z","title":"arXiv preprint arXiv:2110.15245 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.684330Z"},"links":{"cited_paper":"/paper/2110.15245","citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:c6ec463de7735280c91a3c76af2b1e14ab9850d4025fb070ee80c462d7e040c1","observation_id":"4dca98ab-d36b-4ffd-bed9-5b448f3b8bb7","resolution":{"observed_at":"2026-08-01T15:20:54.684330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.734089Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.734089Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:3df53437da60e88a2be3024de6fb38e7dc6f1d515604aad5a2f5f9c460d3edb8","observation_id":"8fd735e5-096c-41e2-824f-9023ceec194e","resolution":{"observed_at":"2026-08-01T15:20:54.734089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.782351Z","title":"Brush-Type","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.782351Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:1842e0243c966824ac9d698c9c3f5ff2d54d542c994dadf6fe10803c8b06e17f","observation_id":"8d8be94c-3d92-4abb-9b61-085e67e5c458","resolution":{"observed_at":"2026-08-01T15:20:54.782351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.841480Z","title":"An application of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.841480Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:7ef23eabe07a6d726936558d732fb9d74e480658cbaef55549bdd2d1a272974d","observation_id":"2dadc70f-814f-4b83-886f-023a4d8929fa","resolution":{"observed_at":"2026-08-01T15:20:54.841480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.908580Z","title":"Proceedings 2001 ICRA","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.908580Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:59ea8413dfe6b631db8be804c6aa1dfafd06f5a6276c7ac44330266848c87f9f","observation_id":"023112fb-e3a2-44e9-a74d-4908b28e2190","resolution":{"observed_at":"2026-08-01T15:20:54.908580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:54.973737Z","title":", journal=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:54.973737Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:87e121b7ece6574cc71661de377b4f1565f3eff4dfca65a6ce51f314b21e5403","observation_id":"82e60043-ffc2-4f2b-99d7-9874fede784a","resolution":{"observed_at":"2026-08-01T15:20:54.973737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.038372Z","title":"2019 , journal=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.038372Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:e48497c29b45dcf34fe1c080b326639eefdc1504f36bbb6b97d3d1bbe27dabe9","observation_id":"59fe0a26-bb14-4413-ac0c-7251ed0ae781","resolution":{"observed_at":"2026-08-01T15:20:55.038372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.119084Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.119084Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:b87eacfad6e530abb723331a72982103ce8fa6014ebab4bfa46af5e7e023725e","observation_id":"290e2ec8-ecb8-49ae-8861-7b39cfb09996","resolution":{"observed_at":"2026-08-01T15:20:55.119084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.179193Z","title":"and Silver, David , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.179193Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:8e95843a1a48ad08b09b85e9f42c8c11b1228dac50c45e2ee5b632dc5ebb4b5b","observation_id":"77956805-f609-467b-9333-99b03baf1e5e","resolution":{"observed_at":"2026-08-01T15:20:55.179193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.243170Z","title":"2017 IEEE/RSJ International Conference on Intelligent Robots and Systems , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.243170Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:04f17257b97b2761031f55422cd862f3cd3be4f3b318b267e34a39253a29d598","observation_id":"7e9627c7-f597-41d7-93e0-b401be7098e7","resolution":{"observed_at":"2026-08-01T15:20:55.243170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.330904Z","title":"Sutton and Marlos C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.330904Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:332f09e317e694bc0b0a011b488b8f9a5ef871eb7ed52861d8e825e6f3aeccd5","observation_id":"eba27076-2c0f-4970-860d-cbb8541ec752","resolution":{"observed_at":"2026-08-01T15:20:55.330904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.377981Z","title":"International Conference on Robotics and Automation , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.377981Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:246a002585bdffc081da156e3b615bc64b0b7e7c96d1171c40ff46164394358f","observation_id":"68b47fd9-2d5f-4f2d-9b8b-533e4c0b6754","resolution":{"observed_at":"2026-08-01T15:20:55.377981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.438858Z","title":"Blind Bipedal Stair Traversal via Sim-to-Real Reinforcement Learning , doi =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.438858Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:8ed7608babbe1c05f88631ad1274f7bb54331124c98c1ff1132ee9fae1ee6952","observation_id":"646feddd-52b2-4929-ba2a-d38d37de49d4","resolution":{"observed_at":"2026-08-01T15:20:55.438858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.519719Z","title":"Science Robotics , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.519719Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:dcdbb3cdb60d585d7024a87eda1cab0b7a6d5bf829d3f3e00092af24af4371af","observation_id":"09ce6522-890d-4d26-8612-27f4b38c08ab","resolution":{"observed_at":"2026-08-01T15:20:55.519719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.566704Z","title":"Journal of Machine Learning Research , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.566704Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:17626e9d0101a746a421b0b7f36534d5fe2b13ff6ea216e59d20af641b7e3d9b","observation_id":"3759b0b2-b90e-491f-b49d-1aa780746fee","resolution":{"observed_at":"2026-08-01T15:20:55.566704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.614930Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.614930Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:68c13b07822d6b78a3ac1552d8932452d59bb770c6c4ec64ec252a8999bd67a2","observation_id":"fbbc621e-4931-4246-a816-f877023616da","resolution":{"observed_at":"2026-08-01T15:20:55.614930Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01290","last_updated":"2018-08-08T21:27:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T09:50:50Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01290","snapshot_observed_at":"2026-08-01T15:20:55.663330Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.663330Z"},"links":{"cited_paper":"/paper/1801.01290","citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:9302ee5bb18f0d960010ade69c9cc5ccd9fb9a95a9bd80ab92dda2eaa992e931","observation_id":"856fbe1c-6e93-4ebb-9946-3b892695d728","resolution":{"observed_at":"2026-08-01T15:20:55.663330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.709653Z","title":"and Li, Weiping , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.709653Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:03d5320cb0841185ebaf5cc743909e854c895d0fa0154e6e98ae16de686ef8dc","observation_id":"736a5f02-cfa7-463d-a5da-b5d3a178f42c","resolution":{"observed_at":"2026-08-01T15:20:55.709653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.756139Z","title":"1996 , publisher=","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.756139Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:8e3cbf590d13e4842042d410d1f1e0a9fff524b67e3d6f968c2775c0817c268a","observation_id":"f14a38df-033c-4076-aaaa-d23df13eef14","resolution":{"observed_at":"2026-08-01T15:20:55.756139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.788793Z","title":"1995 , publisher=","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.788793Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:011f3b8f11f4e308728c7a97cd1164f0ab400024e914c88b4769ab44ec207c3c","observation_id":"27707464-f7cd-421d-81b5-db1ef6652629","resolution":{"observed_at":"2026-08-01T15:20:55.788793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.818575Z","title":"2012 , publisher=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.818575Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:929314338edb1f7720bd81afb03357e6cc864ceeae72f8e98c79ab5822a5d738","observation_id":"f4e51dce-529f-4a8f-9953-3a028f4f385a","resolution":{"observed_at":"2026-08-01T15:20:55.818575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.853568Z","title":"and Alindogan, Jedidiah and Anderson, Matthew and Chung, Soon-Jo , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.853568Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:db33e1a01d4fb20bc255e2a128bde6fde561673ac7948a669fd473be9d40dbe1","observation_id":"5485990e-cfc1-4eb9-b2ac-447907331ed6","resolution":{"observed_at":"2026-08-01T15:20:55.853568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.897222Z","title":"doi:10.1126/scirobotics.abm6597 , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.897222Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:8ce4b484e5a2e2a28661f28a7cc7f056e46359dd38e977c744a6efb46af34865","observation_id":"5c8c0d25-2b19-4317-808d-4c1137598d96","resolution":{"observed_at":"2026-08-01T15:20:55.897222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:55.942806Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.942806Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:66901065695e862056b7743f1b50154ecd8ad21d87c813ae45555d153c45469a","observation_id":"e57b6e17-75c7-441f-8a62-7c7416f1027e","resolution":{"observed_at":"2026-08-01T15:20:55.942806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.03085","last_updated":"2022-06-04T07:59:42Z","snapshot_observed_at":"2026-08-08T10:36:31.909439Z","submitted_at":"2020-11-05T20:26:22Z","title":"RealAnt: An Open-Source Low-Cost Quadruped for Education and Research in Real-World Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.03085","snapshot_observed_at":"2026-08-01T15:20:55.979436Z","title":"2020 , url =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:55.979436Z"},"links":{"cited_paper":"/paper/2011.03085","citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:4eab0cbece87cd4eae259f33a5c2f967f699e80f98a48474277ea1878238b46e","observation_id":"bcbba763-0dad-447d-928c-d5b57e5476f7","resolution":{"observed_at":"2026-08-01T15:20:55.979436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.023606Z","title":"Nature Machine Intelligence , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.023606Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:496ac20322779f9b2634d87abeba102321b90debac4fb0895d47f02322311b16","observation_id":"d7ccb2e4-3f79-4cba-85d5-3ccae893b3cc","resolution":{"observed_at":"2026-08-01T15:20:56.023606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.064759Z","title":"2025 , month =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.064759Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:266880103ad168566cea628495179abb6d52c942a1448e191d73895a955b6285","observation_id":"aaf6253c-85f5-4634-af78-713a663adce3","resolution":{"observed_at":"2026-08-01T15:20:56.064759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.123146Z","title":"Policy gradient reinforcement learning for fast quadrupedal locomotion , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.123146Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:bb7d1ae5cfdbbb265fac2200bed8940c870073e414a4da897b180f2b9fe86079","observation_id":"02bbc078-8524-4373-9494-e1cb08126197","resolution":{"observed_at":"2026-08-01T15:20:56.123146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.157693Z","title":"Nature , volume =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.157693Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:81a020cdf7d48366152c2294a0db22739ab6f935f8041bb79173fde7080e7d7e","observation_id":"8e275e34-cff9-4141-983d-41d433d1cbfd","resolution":{"observed_at":"2026-08-01T15:20:56.157693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.181377Z","title":"Jordan and Pieter Abbeel , journal=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.181377Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:4546d0e7719817169d7b8550ab9e20cec3b7e377cd7469bac8698385e8c9759a","observation_id":"bc04d6c7-125b-4e47-a283-720e4d12ee8f","resolution":{"observed_at":"2026-08-01T15:20:56.181377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.197511Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.197511Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:787c3fa4dce1bbca5180933b4a20de637e867fed6d73abe31463fd7e113ac397","observation_id":"a3af842d-715d-49ec-9b41-75fe9bc1de2d","resolution":{"observed_at":"2026-08-01T15:20:56.197511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.280081Z","title":"Sutton and Doina Precup and Satinder Singh , keywords =","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.280081Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:c1bbb6f667c275f52972455a1dd5da1edab381553075e23046d853cb6df395a1","observation_id":"2666696f-dda6-4621-be9c-2e0a6c049039","resolution":{"observed_at":"2026-08-01T15:20:56.280081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.436056Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.436056Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:da28a264b42c322d4e933a63158c4ef0e210374747f61ab252ec2ebb55c60548","observation_id":"3152fa41-cff6-4434-8010-f20a75caeed2","resolution":{"observed_at":"2026-08-01T15:20:56.436056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.477222Z","title":"Temporal Difference Learning for","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.477222Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:f308b9d1921d29332373987f1459d1024ea91a84a47c91a95de9488ba33cc8a0","observation_id":"7f88acf9-2726-4dc5-bff2-b726fd428e91","resolution":{"observed_at":"2026-08-01T15:20:56.477222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.518636Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.518636Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:a41516ca7767cadbbabacd8c986856c9fbacc105f640178d3fa2033291a75557","observation_id":"c7cf4a96-0bd4-4ef6-a44d-5cc4ebe2a510","resolution":{"observed_at":"2026-08-01T15:20:56.518636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.563926Z","title":"2024 , howpublished =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.563926Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:eb83626d5de4cfd0882a6d620b2c2905a93db8d5bcd707919a63934484344352","observation_id":"d3ef6394-10d2-4b79-a2ae-a84744bf964a","resolution":{"observed_at":"2026-08-01T15:20:56.563926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.618650Z","title":"and Honig, Wolfgang and Sukhatme, Gaurav S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.618650Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:fd8331fe83bd57d752fddf0c532df9ddfe7744ca758830a9bc20ed7048e7ae9a","observation_id":"5a645bc7-2ed7-428f-a64d-fa8b14ce47d8","resolution":{"observed_at":"2026-08-01T15:20:56.618650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.624427Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.624427Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:3bce636c3f26da6e802da25c39dfb7741cb9fbb1347a73b975c081bd32c621f8","observation_id":"5edc5fe3-c572-4b39-af8b-7231e33fac65","resolution":{"observed_at":"2026-08-01T15:20:56.624427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.720140Z","title":"2016 , eprint=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.720140Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:f72785c260c05f1f8548d6ec6d3845d479879fba5b8f9bd4d7a648cf7c738f36","observation_id":"3284bf59-13c9-40ae-8d1c-12b38cc461cf","resolution":{"observed_at":"2026-08-01T15:20:56.720140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.768914Z","title":"Science Robotics , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.768914Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:cb5f61202ab2ab7c18eff62a45a26fbb10118ac1d92cf986afde363fa8313108","observation_id":"133d5617-bc32-4884-8340-cd4940bb706c","resolution":{"observed_at":"2026-08-01T15:20:56.768914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.785137Z","title":"The MNIST Database of Handwritten Digit Images for Machine Learning Research [Best of the Web] , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.785137Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:fcb39749548d72b8ea41ab537d3d87152390b8811943200a98ad88b6766d54b9","observation_id":"61a7bdaf-41e7-4df7-9c74-6efed0e720cb","resolution":{"observed_at":"2026-08-01T15:20:56.785137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.795416Z","title":"Proceedings of the 25th ACM SIGKDD International Conference on Knowledge Discovery & Data Mining , pages =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.795416Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:1f583a75f28b4095e075328828bc2365e4437d81c274cd6e0bf9d2a61ffef8fb","observation_id":"c2c6972f-fb82-4374-9ee8-a8da90b24f70","resolution":{"observed_at":"2026-08-01T15:20:56.795416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.799588Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.799588Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:fbf7861f5f4ef55b66db94c23c18b004d6066afb56dcd0cae5d64c4cf28168ce","observation_id":"27b45253-6f6e-4fad-9323-dc9f0e5e9982","resolution":{"observed_at":"2026-08-01T15:20:56.799588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.802416Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.802416Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:78f8efcacdcb398aff10099c0208761a3e3f1ef4cc7e6e04d174892cb871dc9b","observation_id":"dfb3df13-25e0-4256-827f-625504fb9a42","resolution":{"observed_at":"2026-08-01T15:20:56.802416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.07731","last_updated":"2018-09-20T16:46:04Z","snapshot_observed_at":"2026-08-04T18:07:17.262112Z","submitted_at":"2018-09-20T16:46:04Z","title":"Benchmarking Reinforcement Learning Algorithms on Real-World Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.07731","snapshot_observed_at":"2026-08-01T15:20:56.805569Z","title":"Rupam Mahmood and Dmytro Korenkevych and Gautham Vasan and William Ma and James Bergstra , title =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.805569Z"},"links":{"cited_paper":"/paper/1809.07731","citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:045115df44218c53a65650546d45ba24edb2603ef1e2a10a072f24b4cd38e424","observation_id":"6973dec4-4e5c-427a-8cee-e344a69eaaca","resolution":{"observed_at":"2026-08-01T15:20:56.805569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.809331Z","title":"Learning From Delayed Rewards , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.809331Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:03e72f8020330a79df3329eb91f4769d4c223bec8eba87a9b672db720ffc1391","observation_id":"137efd56-9ab6-4397-a2c7-faf64da800a4","resolution":{"observed_at":"2026-08-01T15:20:56.809331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.811920Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.811920Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:aa706665422a5c2e188fd75ccce4b81ee6a14421b2f90c6c8a37d60bc04f25aa","observation_id":"6d4729cd-e67e-4e95-8f4b-27ea7632b55d","resolution":{"observed_at":"2026-08-01T15:20:56.811920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.814769Z","title":"Sutton , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.814769Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:4e798db7924bd5411ff4fc9b861c0ced0f2f000847483ca9c9ec8c5b6c5bc4de","observation_id":"930e57c3-be50-4f58-b836-932aa9886974","resolution":{"observed_at":"2026-08-01T15:20:56.814769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.817529Z","title":"2025 , howpublished =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.817529Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:35be3eeed27a5bfa3be50cdcfdfb041fd0f2cd12faa668c31f8f69384f398122","observation_id":"abcae0db-5530-4c3d-9588-00288afce78e","resolution":{"observed_at":"2026-08-01T15:20:56.817529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.820494Z","title":"Action Space Design in Reinforcement Learning for Robot Motor Skills , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.820494Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:e29f2a6bcbd458f612fb5c6a49c40def205efdf63c97bfa739809cefc716a0e3","observation_id":"c0aa1d58-9734-4f5b-b8f2-9c717d5ed346","resolution":{"observed_at":"2026-08-01T15:20:56.820494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12478","last_updated":"2020-06-22T17:55:03Z","snapshot_observed_at":"2026-08-05T15:38:57.261680Z","submitted_at":"2020-06-22T17:55:03Z","title":"Ecological Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12478","snapshot_observed_at":"2026-08-01T15:20:56.823221Z","title":"Co-Reyes and Suvansh Sanjeev and Glen Berseth and Abhishek Gupta and Sergey Levine , title =","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.823221Z"},"links":{"cited_paper":"/paper/2006.12478","citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:303551274cb5c22ef8e20ef2d1006f47934ee2866c44fef2f944129bb754059a","observation_id":"719f8f1a-74f8-4594-93f8-425c1a7bff99","resolution":{"observed_at":"2026-08-01T15:20:56.823221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.06298","last_updated":"2019-01-03T18:11:15Z","snapshot_observed_at":"2026-07-06T07:21:24.277262Z","submitted_at":"2018-12-15T14:47:21Z","title":"Residual Policy Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.06298","snapshot_observed_at":"2026-08-01T15:20:56.826781Z","title":"Allen and Josh Tenenbaum and Leslie Pack Kaelbling , title =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.826781Z"},"links":{"cited_paper":"/paper/1812.06298","citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:9f583bf46092de2181d93b06f51ad96ad196ac8416ee067028cd7d002805633e","observation_id":"e0a30d5a-4a80-4a67-94d1-99faf60b2f6a","resolution":{"observed_at":"2026-08-01T15:20:56.826781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.830238Z","title":"Transactions of the ASME Journal of Dynamic Systems , url =","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.830238Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:9b141ad9987c4686eabdd90e03d046919ff82b3191052bba82f01ea7f2ccda06","observation_id":"d06bc4b6-2b11-4791-93ee-6a0011110dfa","resolution":{"observed_at":"2026-08-01T15:20:56.830238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.833600Z","title":"Generalization in Reinforcement Learning: Successful Examples Using Sparse Coarse Coding , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.833600Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:597171a8e559726acb21827b8ef1f762953e4f2111944232ab46c0146d4a869f","observation_id":"583f9e14-f20e-439f-a2ba-4401011cf393","resolution":{"observed_at":"2026-08-01T15:20:56.833600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.06907","last_updated":"2017-03-20T18:17:25Z","snapshot_observed_at":"2026-07-06T05:34:29.671061Z","submitted_at":"2017-03-20T18:17:25Z","title":"Domain Randomization for Transferring Deep Neural Networks from Simulation to the Real World","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.06907","snapshot_observed_at":"2026-08-01T15:20:56.836530Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.836530Z"},"links":{"cited_paper":"/paper/1703.06907","citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:0879a379b71ac85a6d912a03fb86a3786767b0fe8dc57ca1bbc05dbb24a69bd3","observation_id":"11229eca-f123-4e48-91c7-218f782ca624","resolution":{"observed_at":"2026-08-01T15:20:56.836530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.839668Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.839668Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:4de8597cbfd33b79c55cfb0f47dfaab6a2d8ec781388c87703da840ed9ee53bb","observation_id":"3b08f251-5764-4b4e-a8c3-b49474c53068","resolution":{"observed_at":"2026-08-01T15:20:56.839668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.842782Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.842782Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:6eccec6bd08cbf3b7784071d3e5478a880023d754e9ae53efcf9bfb186fb76ce","observation_id":"510ca504-c93d-4232-9952-b7b4c4347c2f","resolution":{"observed_at":"2026-08-01T15:20:56.842782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.845694Z","title":"IEEE Transactions on Robotics , month = jan, pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.845694Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:4b7c2066161a92f3d84e7bf920935d8638b5074958661546c022626bc52f49a9","observation_id":"0069de88-dd93-466c-bf52-1df5b9e916c7","resolution":{"observed_at":"2026-08-01T15:20:56.845694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.848463Z","title":"2020 IEEE International Conference on Robotics and Automation (ICRA) , year =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.848463Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:6339dbcae490c598c365a1dc9111745a1bcde5f5ae97e22818b571907c862f58","observation_id":"07f7da2b-e863-4a14-bf21-7678ef7ae70e","resolution":{"observed_at":"2026-08-01T15:20:56.848463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.851492Z","title":"and Korenkevych, Dmytro and Komer, Brent J","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.851492Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:69c71aa3fc59faada524804ad1951e15675d970c640678daf8bf5d8723ce6900","observation_id":"34bb976e-a373-4e94-8aeb-ff57646e406f","resolution":{"observed_at":"2026-08-01T15:20:56.851492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.854146Z","title":"Rupam , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.854146Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:4b1bb2ea068d0005b5682119cca3fc18e3cf3a9758b27111cd1d198e82f7a39c","observation_id":"9ab949ce-dbbd-4de3-8b2d-ac0a26cf853d","resolution":{"observed_at":"2026-08-01T15:20:56.854146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.856856Z","title":"Proceedings of The 4th Conference on Lifelong Learning Agents , pages =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.856856Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:b8453edf6b29d51b4879ff44c0ff9a40aa6c67763d0a1b694072613a3e3fbf46","observation_id":"22a6885c-b819-482c-b283-9bc1c5e99d13","resolution":{"observed_at":"2026-08-01T15:20:56.856856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.859626Z","title":"Science Robotics , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.859626Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:a487ce74896e7aaa91f5ea61d3a12bfbe297096f948caeac7cb7a72ad61c1f49","observation_id":"3eb24fe5-9025-4adf-a5f6-a2feac53fac4","resolution":{"observed_at":"2026-08-01T15:20:56.859626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1126/science.adw1291","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Science , volume =","venue":"Science","work_id":"eaac6e57-3bb8-4a4d-a830-1316d64a1e4d","year":2025},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.862317Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:3576b80d5e7055ada132f4039f69403ad9369d6c3305b51ee3c16f7d83478c0e","observation_id":"3e4d8cf4-9966-4dc1-82ba-a91936fbfd18","resolution":{"observed_at":"2026-08-01T15:24:06.384914Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:20:56.865176Z","title":"and Doleac, J.S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-01T15:20:56.865176Z"},"links":{"citing_paper":"/paper/2607.18488"},"observation_digest":"sha256:80868eed360cd8d7114ff0ff42c64c8ec2815fedef32a7627eae879e5b3d92ce","observation_id":"9bc6223e-d48c-459b-876b-8eaae10e4310","resolution":{"observed_at":"2026-08-01T15:20:56.865176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18488","last_updated":"2026-07-20T20:18:29Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-03T00:09:15.656987Z","submitted_at":"2026-07-20T20:18:29Z","title":"The Open Ant: A Robot Platform for Reinforcement Learning Research"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":2,"unresolved":87,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 0 inbound Pith citation observations for arXiv:2607.18488."}