{"as_of":"2026-08-10T09:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d8c29e3d31bb2d25ecec1a8e9c0697dda5adee5c83ddef125894071ae9f097f","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:38:48.826346Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.21638/citation-record","integrity":"/paper/2507.21638/integrity","json":"/paper/2507.21638/citation-record.json","paper":"/paper/2507.21638"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:50.921982Z","title":"Proprioception is information relating to robot configuration","venue":null,"work_id":"fccb9cfa-5ec6-4b69-a0d1-659d662a1c39","year":2026},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:48.765492Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:1392b085f9857c78a42e76536b60c6493f3d0480db611f232b593a23875d50c5","observation_id":"338d5c96-d2ae-45ce-b5b5-14473711127c","resolution":{"observed_at":"2026-08-06T12:38:50.976202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:51.462949Z","title":"Rihab Gorsane, Omayma Mahjoub, Ruan de Kock, Roland Dubb, Siddarth Singh, and Arnu Pre- torius","venue":null,"work_id":"82c10a80-2dae-428a-802e-10be437a2030","year":2022},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.046601Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:aba975aad31eb3571051eb97564f3b8398369b165200a08c7c4f5a5ddcb2cc41","observation_id":"92cbf6df-ea15-4857-8db8-0c9d5cce467c","resolution":{"observed_at":"2026-08-06T12:38:51.539578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:50.738253Z","title":"Component Formula Default Interpretation / Sweep Speed prefer- ence Pref(v; [vmin, vmax]) [0.06,0.14]m/s Rewards motion within the preferred speed range","venue":null,"work_id":"59d29d30-7601-45f9-b2ab-38f7576af9b9","year":2023},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:48.826346Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:31b0857afaa0e3afc3d073e81811f290fad78304c46b8c1322be4a072822c41e","observation_id":"0bb4ef67-3915-4716-bfda-4106ecd777a0","resolution":{"observed_at":"2026-08-06T12:38:50.824106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.09381","last_updated":"2018-06-29T00:19:24Z","snapshot_observed_at":"2026-08-05T03:37:42.195185Z","submitted_at":"2017-12-26T19:43:59Z","title":"RLlib: Abstractions for Distributed Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.09381","snapshot_observed_at":"2026-08-06T12:38:47.260154Z","title":"Chris Lu, Jakub Kuba, Alistair Letcher, Luke Metz, Christian Schroeder de Witt, and Jakob Foerster","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.260154Z"},"links":{"cited_paper":"/paper/1712.09381","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:7b467c614cf76dcd1c47c89fd8fbe25feb9b8308392577df1b5cdd1a3c79aa86","observation_id":"60c22147-f5e2-4e06-be3f-b1fc088c6c23","resolution":{"observed_at":"2026-08-06T12:38:47.260154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:47.690261Z","title":"Eduardo Pignatelli, Jarek Liesen, Robert Tjarko Lange, Chris Lu, Pablo Samuel Castro, and Laura Toni","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.690261Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:c709899451d366db088d05b78a9adbbd56fb650669cce4e8efce2887f8952ee4","observation_id":"409589a0-401f-436a-9397-dd08dd0129e0","resolution":{"observed_at":"2026-08-06T12:38:47.690261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19396","last_updated":"2024-07-28T04:39:18Z","snapshot_observed_at":"2026-07-06T18:52:51.827101Z","submitted_at":"2024-07-28T04:39:18Z","title":"NAVIX: Scaling MiniGrid Environments with JAX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19396","snapshot_observed_at":"2026-08-06T12:38:47.781512Z","title":"Arrasy Rahman, Elliot Fosong, Ignacio Carlucho, and Stefano V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.781512Z"},"links":{"cited_paper":"/paper/2407.19396","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:4755fd0b142e4117db5dd2a0840e6a30c2807eb66c0f53812a968592803df2a4","observation_id":"1a3fca40-4cbb-49ed-9d0a-418037374cae","resolution":{"observed_at":"2026-08-06T12:38:47.781512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09595","last_updated":"2024-01-03T03:05:25Z","snapshot_observed_at":"2026-08-10T09:55:00.598144Z","submitted_at":"2023-08-18T14:45:22Z","title":"Minimum Coverage Sets for Training Robust Ad Hoc Teamwork Agents","version":2},"cited_work":{"arxiv_id":"2308.09595","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.09595","snapshot_observed_at":"2026-08-06T12:38:49.807772Z","title":"Minimum Coverage Sets for Training Robust Ad Hoc Teamwork Agents","venue":"cs.AI","work_id":"73b276fa-1786-4e79-9fa5-f37e1846ad36","year":2023},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.893527Z"},"links":{"cited_paper":"/paper/2308.09595","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:21de70f7c5b8156701555b805fb575a17f44a50e687645a20f660c97d5c844e8","observation_id":"0194871e-549d-4501-beed-c52e8e1201a2","resolution":{"observed_at":"2026-08-06T12:38:49.950901Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/spe.3207","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"URL https://doi.org/10","venue":"Software Practice and Experience","work_id":"d17382cc-3980-4b54-8f5a-24daa1cff0c9","year":null},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.960704Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:226542b4dab1aaa0ebb47d83fb96adb764b0083838046b0804765cb9602b31bb","observation_id":"4ffe6570-eb67-4bd3-968a-dfe37f36b4a5","resolution":{"observed_at":"2026-08-06T12:38:49.031635Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-08-06T12:38:48.634961Z","title":"Yuke Zhu, Josiah Wong, Ajay Mandlekar, Roberto Martín-Martín, Abhishek Joshi, Soroush Nasiriany, Yifeng Zhu, and Kevin Lin","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:48.634961Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:8a62c7b0fbbd81a72fec2cd1eac90edd0408b8a8df1d82b667ef4082f87a009b","observation_id":"d2909112-0244-44ab-ba2c-96653b0686f6","resolution":{"observed_at":"2026-08-06T12:38:48.634961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:48.238489Z","title":"DOI: 10.1609/aaai.v24i1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:48.238489Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:b2c9c6bd2dde21b6fc81a20fcfb622258cdee3e4b1cea211900fb21339fe396c","observation_id":"cc814b80-c59d-4675-9fdb-ea8821ebf16b","resolution":{"observed_at":"2026-08-06T12:38:48.238489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:48.543894Z","title":"Kevin Zakka, Baruch Tabanpour, Qiayuan Liao, Mustafa Haiderbhai, Samuel Holt, Jing Yuan Luo, Arthur Allshire, Erik Frey, Koushil Sreenath, Lueder A","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:48.543894Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:522f45a757d1ae346ace759a5f44c3ba43b26c2be6c14c15f8c95d69429c10dc","observation_id":"557e457d-86bc-446e-9b5d-605154dae2d9","resolution":{"observed_at":"2026-08-06T12:38:48.543894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2012.22299","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:50.458604Z","title":"Yuanpei Chen, Yaodong Yang, Tianhao Wu, Shengjie Wang, Xidong Feng, Jiechuan Jiang, Zongqing Lu, Stephen Marcus McAleer, Hao Dong, and Song-Chun Zhu","venue":null,"work_id":"1fbf004c-cb35-4cc5-b929-8e053547649c","year":2012},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:46.690196Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:9baeeb4968434c5c3c9e7974882bef0abe6c0e0e65c393f0e5adcaa282e5fe53","observation_id":"8538401f-2784-4144-9cd5-8f640383bf1a","resolution":{"observed_at":"2026-08-06T12:38:50.579145Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1259","last_updated":"2014-10-07T18:08:30Z","snapshot_observed_at":"2026-07-06T03:53:24.366023Z","submitted_at":"2014-09-03T21:03:41Z","title":"On the Properties of Neural Machine Translation: Encoder-Decoder Approaches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1259","snapshot_observed_at":"2026-08-06T12:38:46.821942Z","title":"Filippos Christianos, Georgios Papoudakis, Arrasy Rahman, and Stefano V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:46.821942Z"},"links":{"cited_paper":"/paper/1409.1259","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:620662ad6e33bd34f7da9c46563b5f58f6b94e4e76c95c36420cd5a95df4532d","observation_id":"01aa8147-083d-4c35-8711-8c1a9d9438ca","resolution":{"observed_at":"2026-08-06T12:38:46.821942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-28929-8_2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"DOI: 10.1007/978-3-319-28929-8_2","venue":"SpringerBriefs in intelligent systems","work_id":"0981ac4b-be45-4a57-b72f-7aa099d85979","year":null},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.585885Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:1795c98d224f0eaba5ee2c3300ee154009c3fed23267b97784d61a65c0f81648","observation_id":"39625410-3e9b-434b-b50e-a3f0f59eaab1","resolution":{"observed_at":"2026-08-06T12:38:49.312162Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:48.366746Z","title":"Emanuel Todorov, Tom Erez, and Yuval Tassa","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:48.366746Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:11eb11abe7c6655cc6793508863fe044cce845b289b826bc8b4e7814a15d1e64","observation_id":"9751caa8-d661-4978-8224-1117b768ecdd","resolution":{"observed_at":"2026-08-06T12:38:48.366746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:46.519393Z","title":"Stefano V","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:46.519393Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:7918b841af208d145ab07754d5b287f2ad754227db2c7a6e1286ba9108ae25b8","observation_id":"414267ad-c040-45d7-853f-a839425c73da","resolution":{"observed_at":"2026-08-06T12:38:46.519393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-10T01:55:31.555267Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T12:38:48.099267Z","title":"Neil Savage","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:48.099267Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:0da56aee578683f1e145310d390189cc217ad9224262012c024ac53bd20e3ef2","observation_id":"ef66e1c3-d6dc-4a40-a18f-1987bb5038a1","resolution":{"observed_at":"2026-08-06T12:38:48.099267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:51.093778Z","title":null,"venue":null,"work_id":"2f3326b0-1ffe-415a-a30b-76c0e17664be","year":2026},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:48.708972Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:0e39cc3530fbc5c833808feaf1e62a0d1fca03b3f107a24b1ce5ddd17f2a1b34","observation_id":"454ed1be-b442-4cd3-9d4f-a8b1117e6b7f","resolution":{"observed_at":"2026-08-06T12:38:51.173400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01588","last_updated":"2020-07-26T18:39:26Z","snapshot_observed_at":"2026-08-06T18:05:01.923590Z","submitted_at":"2019-12-03T18:34:03Z","title":"Leveraging Procedural Generation to Benchmark Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01588","snapshot_observed_at":"2026-08-06T12:38:46.903783Z","title":"Leveraging procedural generation to benchmark reinforcement learning.arXiv preprint arXiv:1912.01588,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:46.903783Z"},"links":{"cited_paper":"/paper/1912.01588","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:af19a37a00ecd91d9a4ffe909d07f334de5abf6ec47ec7d06245ce2b7e557f57","observation_id":"be0497ab-3a38-4fa9-a49f-2eeb5dbd12c0","resolution":{"observed_at":"2026-08-06T12:38:46.903783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:51.316330Z","title":"Tuomas Haarnoja, Aurick Zhou, Pieter Abbeel, and Sergey Levine","venue":null,"work_id":"c8a6041d-8b40-4e68-8a2d-ef13f6ca1736","year":2022},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.171968Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:64df258717112ec9d5668247ce55b5d6c0b7c367e67f0da21bee5edf1e7f782d","observation_id":"1eeac36b-1f5f-48e4-9443-803a27b9467a","resolution":{"observed_at":"2026-08-06T12:38:51.390284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:38:47.365223Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.365223Z"},"links":{"citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:8ec5d343c965198fe6689f03a80485b885f011f528d48d924e5069f6e3b44326","observation_id":"71490a6f-ab2a-4f1c-94e6-c2745c4af4c6","resolution":{"observed_at":"2026-08-06T12:38:47.365223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.00506","last_updated":"2019-12-06T22:15:35Z","snapshot_observed_at":"2026-07-06T07:30:36.676799Z","submitted_at":"2019-02-01T18:59:07Z","title":"The Hanabi Challenge: A New Frontier for AI Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.00506","snapshot_observed_at":"2026-08-06T12:38:46.588417Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:46.588417Z"},"links":{"cited_paper":"/paper/1902.00506","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:2fd7f90cfe1178747d6a055255776ef26f9e1ec87fcf8255fc80db1a3b4b83c1","observation_id":"6cedf5e4-2987-4804-8263-b0205314beb1","resolution":{"observed_at":"2026-08-06T12:38:46.588417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.04831","last_updated":"2025-11-06T21:43:02Z","snapshot_observed_at":"2026-08-07T13:59:26.312342Z","submitted_at":"2025-11-06T21:43:02Z","title":"Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.04831","snapshot_observed_at":"2026-08-06T12:38:47.493124Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:47.493124Z"},"links":{"cited_paper":"/paper/2511.04831","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:e540cfff3b774a5a6a7a964f6e83009bdff4562463774f2dae962c1f96758105","observation_id":"4381ebaf-bfbf-461b-8352-e349532158be","resolution":{"observed_at":"2026-08-06T12:38:47.493124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T01:56:04.311570Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":4},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2507.21638."}