{"as_of":"2026-08-21T17:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:25195651aee08452a0bab716e1ae4e39b05caebc9a907afc9f5f05fdebe2e779","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:06:27.178808Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.10593/citation-record","integrity":"/paper/2501.10593/integrity","json":"/paper/2501.10593/citation-record.json","paper":"/paper/2501.10593"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:29.057420Z","title":"Basis for intentions: Efficient inverse reinforcement learning using past experience, 2022","venue":null,"work_id":"90c17cd3-7ff8-4ba3-952a-7097280c68d0","year":2022},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.736762Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:91f62a9a831ad87200a3f24e60d8c0614fb2e27e396c72ae9550a023897f5fcc","observation_id":"d537b2b4-f8f2-4c17-9e38-338ea14f1ee1","resolution":{"observed_at":"2026-08-10T19:06:29.064232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:29.011617Z","title":"Albrecht and Subramanian Ramamoorthy","venue":null,"work_id":"83b6d5f4-7761-43cb-a96c-163fba346632","year":2015},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.746894Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:32d4beccf89875819b00b14c3f42e6791fc0da1d01869ed250429bce8c1ddd1e","observation_id":"7a89f7a3-5005-4e9b-91da-30d964261d5b","resolution":{"observed_at":"2026-08-10T19:06:29.017281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05789","last_updated":"2020-01-09T00:51:44Z","snapshot_observed_at":"2026-08-21T05:44:02.600989Z","submitted_at":"2019-10-13T17:17:52Z","title":"On the Utility of Learning about Humans for Human-AI Coordination","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05789","snapshot_observed_at":"2026-08-10T19:06:26.752581Z","title":"Ho, Thomas L","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.752581Z"},"links":{"cited_paper":"/paper/1910.05789","citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:03c6cea6109349546838ea3b358d70d9dbcfce1dace1432d89ee445816bfddc1","observation_id":"f3242f02-021c-4f88-961e-d0361f63e8e7","resolution":{"observed_at":"2026-08-10T19:06:26.752581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-19T03:09:02.515007Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-10T19:06:26.778989Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.778989Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:34c82fac29689c6969331ec73dc06863a62e69973be451ee1a5d5d0608010de3","observation_id":"28190281-ef35-429a-b64f-fe07fe9e79e9","resolution":{"observed_at":"2026-08-10T19:06:26.778989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.970901Z","title":"Emergent complexity and zero-shot transfer via unsupervised environment design, 2021","venue":null,"work_id":"92de89f1-da9e-47cb-b76e-852a0900898b","year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.786278Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:833de4fddcd41550e70b9cf1f35e82939b045c19fc801d3a2fad3dc558d5234f","observation_id":"4ad79d62-4ff7-4c76-acc4-ab5a830543dd","resolution":{"observed_at":"2026-08-10T19:06:28.978784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.935116Z","title":"Counterfactual multi-agent policy gradients, 2017","venue":null,"work_id":"cdc9767c-750a-4f4e-990f-da1ca927586a","year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.818117Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:2648de633ea8fe2abfdeed7286b2a60e4f9ce3462ec385d42a4735b297304cd5","observation_id":"696fb80f-8639-428e-8cbd-89b48b18b58c","resolution":{"observed_at":"2026-08-10T19:06:28.943528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:26.828973Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.828973Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:39e8c77535e8e75bf31a07ce055bc1fa062203cfcd936b471c4c4021fa15bc2c","observation_id":"18b4baed-7607-44b5-91c4-13a243e35499","resolution":{"observed_at":"2026-08-10T19:06:26.828973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.866787Z","title":"The evolution of cultural evolution","venue":null,"work_id":"c9ea7f54-3f34-421a-ac67-2f336203a0f5","year":2003},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.836328Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:74c2b230e2a50ea4087f1d7ac87d158351cbfaaa419f795f455b4b378a32b300","observation_id":"3694a783-74b9-491e-940f-8dc193a0fc09","resolution":{"observed_at":"2026-08-10T19:06:28.881357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.818646Z","title":null,"venue":null,"work_id":"c6f53cb4-194e-426f-bb89-630f12c1386d","year":2019},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.846414Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:7115ee21553adbc32e33ca1d5c918d028846bd444c4fef791c147c8d1bc3b38f","observation_id":"ba55ccc7-2f1a-4dcd-b82e-cada4a6cc873","resolution":{"observed_at":"2026-08-10T19:06:28.836315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.769638Z","title":"Reinforcement learning with unsupervised auxiliary tasks, 2016","venue":null,"work_id":"09657109-29d0-4086-b899-0526a9864dd3","year":2016},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.857339Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:57d2e8e40e8f16196faec30e9c29e362faa4fb83f39a0189cdb04f3945473578","observation_id":"861f1a24-9d73-4110-b6b9-ea501e3081fd","resolution":{"observed_at":"2026-08-10T19:06:28.781669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.689187Z","title":"Czarnecki, Iain Dunning, Luke Marris, Guy Lever, Antonio Garc´ıa Casta˜neda, Charlie Beattie, Neil C","venue":null,"work_id":"6ac2dc0b-e291-40c3-aa17-02fbd5377052","year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.868220Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:159d85a226dd4c71d29c2eacfda7d33d1fa606d90b7fc111d5f9f35661c409f9","observation_id":"fb0918b5-983d-4fa2-8d0e-2c38e1180c19","resolution":{"observed_at":"2026-08-10T19:06:28.721807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:26.880253Z","title":"Recursive bayesian human intent recognition in shared-control robotics","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.880253Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:c767b2674e37731041dfedc8d8fa3d944852b13bd18ff909ee9737f2a71183a0","observation_id":"f7a2753b-44eb-4b42-bcdf-5aa763ea501e","resolution":{"observed_at":"2026-08-10T19:06:26.880253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.663583Z","title":"Losey, and Dorsa Sadigh","venue":null,"work_id":"6f9f5ee8-142d-4ec9-897b-0572223719ec","year":2020},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.888108Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:067183f17fe55a86e8eb127df907c4bc64815b9c6270113dba6fda412622108c","observation_id":"c21e5ce3-3bbc-4023-9cfc-b3d1657398eb","resolution":{"observed_at":"2026-08-10T19:06:28.670905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.615008Z","title":"Learning dynamics model in reinforcement learning by incorporating the long term future, 2019","venue":null,"work_id":"d30eef33-d4db-4937-aae1-daacf59bad11","year":2019},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.905877Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:1a985ccce04392dbe126c6178c03ff14bea3635796c782d67d376c2ca0a95981","observation_id":"d077819f-cd94-43bc-98e4-fa3b906f03d8","resolution":{"observed_at":"2026-08-10T19:06:28.635298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.587788Z","title":"Multi-agent reinforcement learning with multi- step generative models, 2019","venue":null,"work_id":"4723a8c9-05e7-48ed-b946-5d3cb3e86e6e","year":2019},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.911966Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:eed1bac3851e3c31e0df7a568bafb6f8114726d83839af66026630fdb6b00e6c","observation_id":"6d49a3f2-990c-4dd7-84ad-83ba94f7f69a","resolution":{"observed_at":"2026-08-10T19:06:28.598765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:26.917903Z","title":"Social learning strategies","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.917903Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:78d530d38afd91eb7ab292a0005a0daaebdd35698f4151ed1df7b63ccf1b2c29","observation_id":"6161702c-d913-4fa4-8997-27b3a7f2f943","resolution":{"observed_at":"2026-08-10T19:06:26.917903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.481193Z","title":"Generalization and network design strategies","venue":null,"work_id":"23258ff9-75d4-47cb-85e2-194c0345fe22","year":1989},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.923958Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:77f735fe43e713adbaf14b5195889cbfb4eed031260f128112990f31775ee31d","observation_id":"a56f853e-6062-473d-b088-c8eaa831ca3b","resolution":{"observed_at":"2026-08-10T19:06:28.508780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.421685Z","title":"Rectifier nonlinearities improve neural network acoustic models","venue":null,"work_id":"f268dd05-3f12-4821-b8d1-ea1cbdae83ff","year":2013},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.929333Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:1aa57926cf45072bc3acfdc6fdd49b4209996994566f21a67029b393a768c1ae","observation_id":"129e91d5-557d-48d8-9146-3c3e908aa58e","resolution":{"observed_at":"2026-08-10T19:06:28.453366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.354996Z","title":"Emergence of grounded compositional language in multi- agent populations, 2018","venue":null,"work_id":"2ee42021-2d06-48cf-bb11-6c265e3c8bf1","year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.936560Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:b672b84711c8296fafe7ebe6dc649449973f6554aa79249c89d3b52a752bff68","observation_id":"c26c8b57-50ca-4be1-b317-1a35c8410603","resolution":{"observed_at":"2026-08-10T19:06:28.370840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.319488Z","title":"Emergent social learning via multi-agent reinforcement learning, 2021","venue":null,"work_id":"1e64b488-fb65-4c90-badb-d9f8fdc5655d","year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.947585Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:2caf569af6e724bb8dddedd788c1b19d910ae69ae960d34ea63190f12b9bca75","observation_id":"b61c1c8b-7e1b-4ca6-92ba-9a9ae73d3ceb","resolution":{"observed_at":"2026-08-10T19:06:28.332017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.288905Z","title":"Srinivasa","venue":null,"work_id":"212f2067-f10d-41d7-b917-7dbd83b1aa5d","year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.962941Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:d214614ea9a902b4a3fbaa40e05afb5868532722e3368ec20573d0f70ed211fc","observation_id":"eeae4ba5-5d80-493a-a368-b540d19c68b1","resolution":{"observed_at":"2026-08-10T19:06:28.296403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.232465Z","title":"Albrecht","venue":null,"work_id":"12d75d6e-3b39-4fcc-b5c5-93b0f5fef8be","year":null},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.982192Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:91f59f4a62dd591a4092af2e7b63c720c0fd1f784529ac5a1f1e352e8bd856fc","observation_id":"f00b01da-f6db-4277-9387-0382f7875662","resolution":{"observed_at":"2026-08-10T19:06:28.250550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.162354Z","title":"Tenenbaum, Sanja Fidler, and Antonio Torralba","venue":null,"work_id":"f6c771e1-4804-42c0-9b51-31cb2f24afff","year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.011753Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:acd2e20a5b5c8370c95b512968284084ce98c368d21b6c407b8ddd3337efd74b","observation_id":"dc68b850-5a84-4e86-98e7-7f65d2f45bb3","resolution":{"observed_at":"2026-08-10T19:06:28.181958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.100529Z","title":"Modeling others using oneself in multi-agent reinforcement learning, 2018","venue":null,"work_id":"46279ecf-e6c3-4601-b33c-c506cb892afb","year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.026167Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:4f88d2ebbe345179668f023852b63b83fe8d9b94fe01df62116ba2d75120c551","observation_id":"b08e9966-4202-4252-be82-8c096ead850a","resolution":{"observed_at":"2026-08-10T19:06:28.125248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.034876Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.034876Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:e8ece1fd18d48a5df1d1c766e7292e049aa232b36463a26f94298b5c12efbf1d","observation_id":"2673280f-6d84-4a65-a09b-c6cee5f12feb","resolution":{"observed_at":"2026-08-10T19:06:27.034876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.982048Z","title":"Loss is its own reward: Self-supervision for reinforcement learning, 2017","venue":null,"work_id":"baf03905-ced4-44c2-b68c-0c3b52a97121","year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.046728Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:961890e0cc9050d5230bf7cdabd0e25ea1242391f8df7b687b6362bb0c81a8e1","observation_id":"af535b3f-c668-4f6e-a907-9bba527059b1","resolution":{"observed_at":"2026-08-10T19:06:27.994120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.058046Z","title":"Zhao, Archit Sharma, Karl Pertsch, Jianlan Luo, Sergey Levine, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.058046Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:fab7ea68ac1ce1518c8dd3d4c217acc40647ac8156eeba857f98c8ae013698b8","observation_id":"96d206e5-8946-4903-8469-b644aa0c6ee6","resolution":{"observed_at":"2026-08-10T19:06:27.058046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.072016Z","title":"Message-passing approach for threshold models of behavior in networks","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.072016Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:a3b170b16cf95a7ed10234c7057f9c2fe85746603b8d5408d7bdcb7101a31197","observation_id":"1cbbcdb1-cd8c-42ef-b820-3a27a3bb2390","resolution":{"observed_at":"2026-08-10T19:06:27.072016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.080776Z","title":"Mastering chess and shogi by self-play with a general reinforcement learning algorithm, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.080776Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:49fdfa04a2ac236fc44e0e4cac276d41f382bcf3f8be740ea90e27561a978fee","observation_id":"4068f696-d52e-414c-b6f1-74108fd1f5e1","resolution":{"observed_at":"2026-08-10T19:06:27.080776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.904039Z","title":"Smallwood and Edward J","venue":null,"work_id":"29d682cf-d444-47a9-8ac3-0c49229c47ce","year":1973},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.094921Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:7e80bdf9da57fc5ba4dd7ec3f5e03ba7cb2b1719b15aff779819cef25fff42c1","observation_id":"0e5e48d1-68a2-4b52-bbe4-7563b449296d","resolution":{"observed_at":"2026-08-10T19:06:27.918249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.866963Z","title":"McKee, Matt Botvinick, Edward Hughes, and Richard Everett","venue":null,"work_id":"e8b9aa72-9244-48a3-bb2f-a681466e3fb6","year":2022},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.103156Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:434e92cf17bfc36d59909d440f4c397aaec20b1df8548713c24609ee99cb9411","observation_id":"6d44c7e6-4d02-4634-baa4-49da968a5114","resolution":{"observed_at":"2026-08-10T19:06:27.878794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.109331Z","title":"Pettingzoo: Gym for multi-agent reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.109331Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:dbae1339250d89e8aa395743aadda46f23cc7d5cd027f22010258ea62e186637","observation_id":"be4d5c22-43f9-46aa-8646-0eff70c945bb","resolution":{"observed_at":"2026-08-10T19:06:27.109331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.01753","last_updated":"2019-02-21T01:17:31Z","snapshot_observed_at":"2026-08-18T19:30:03.172889Z","submitted_at":"2019-01-07T11:28:36Z","title":"Paired Open-Ended Trailblazer (POET): Endlessly Generating Increasingly Complex and Diverse Learning Environments and Their Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.01753","snapshot_observed_at":"2026-08-10T19:06:27.125935Z","title":null,"venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.125935Z"},"links":{"cited_paper":"/paper/1901.01753","citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:fa175a8695b9260362dae2acd4d99e5f2582a79a0ad81a095b831e079cfe9172","observation_id":"fe531969-7b1a-44a8-9409-6e6f0018e467","resolution":{"observed_at":"2026-08-10T19:06:27.125935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.825159Z","title":null,"venue":null,"work_id":"7e59051f-53f6-4b41-a118-8dbb105246dd","year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.151138Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:5c2c7694367b9005845f43d72a001c37b70a99a1b9564fec3611dec19ad48a2d","observation_id":"dc7e7e4a-e1b2-4294-bcfd-d658448eb67e","resolution":{"observed_at":"2026-08-10T19:06:27.831658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.770308Z","title":"Towards generalizability of multi-agent reinforcement learning in graphs with recurrent message passing, 2024","venue":null,"work_id":"e934292a-3bed-4021-8ca9-94d5d2d2689d","year":2024},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.166033Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:31d5dcfdd0f6a94366458b69252dd5ea51d41bbbab6a8b23a30c5ea75cb3dbbf","observation_id":"10948f30-246e-4d58-bc53-08f5d4e22f80","resolution":{"observed_at":"2026-08-10T19:06:27.782180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.682370Z","title":"The surprising effectiveness of ppo in cooperative, multi-agent games, 2021","venue":null,"work_id":"57245203-cc6a-48a9-b8f1-9eb7a023459d","year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.178808Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:a8a869e7fea13d6bbea6ca08dcd4ccbe387549d3e5b09b71deceff4fe684e1d1","observation_id":"12201486-51f9-4452-a6b7-4276c427015c","resolution":{"observed_at":"2026-08-10T19:06:27.717210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-08-09T21:21:10.717989Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-08-10T19:06:26.997151Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.997151Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:76afde0d87870441457b5bc6c9bf79e329ab98c3a7326b06d532ce8d446f2240","observation_id":"58a30f00-1af9-4bc3-bc2e-861941e7d3c0","resolution":{"observed_at":"2026-08-10T19:06:26.997151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T13:37:45.994748Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2501.10593."}