{"as_of":"2026-08-10T12:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83b247cabef8eabb07ab5d2fbbf1a4425cd0e9c48b7e18bf03776d51129191b5","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T13:41:33.048760Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.24423/citation-record","integrity":"/paper/2605.24423/integrity","json":"/paper/2605.24423/citation-record.json","paper":"/paper/2605.24423"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.376902Z","title":"org/CorpusID:258845718","venue":null,"work_id":"70a65e7a-124b-4b68-891e-663ad927683c","year":2020},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:1ea048a1432247d2fa5164277e692b354f4470bc0ccd0b803b0aef1eb1606177","observation_id":"2994aa2f-ea39-486b-9bbb-c0ae1fbbb9ca","resolution":{"observed_at":"2026-07-09T01:05:50.377952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":"1606.08415","doi":"10.18653/v1/n19-1122","metadata_source":"pith","pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gaussian Error Linear Units (GELUs)","venue":"cs.LG","work_id":"0466fd22-03a1-4a61-af0a-a900e77bb023","year":2016},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:cd5c1c41e050e976b94e54788729578789e67ee11f3be33aa875679d58f3e047","observation_id":"265e1385-03b7-47fa-b88a-ab2b6308995f","resolution":{"observed_at":"2026-06-30T13:44:40.646681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09846","last_updated":"2017-11-28T16:16:21Z","snapshot_observed_at":"2026-07-06T06:11:24.949724Z","submitted_at":"2017-11-27T17:33:27Z","title":"Population Based Training of Neural Networks","version":2},"cited_work":{"arxiv_id":"1711.09846","doi":"10.48550/arxiv.1711.09846","metadata_source":"pith","pith_arxiv_id":"1711.09846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Population Based Training of Neural Networks","venue":"cs.LG","work_id":"252bc4d9-2cae-4a9a-98ba-b954ab35a78b","year":2017},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/1711.09846","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:6924cd459ae62bc147131a0c64bbbd5011ffff32e42545d8d29d3eaef0305f10","observation_id":"8f643b94-2f42-4010-9287-9968208ae998","resolution":{"observed_at":"2026-06-30T13:44:40.655360Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:52:59.706755+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:52:59.706755+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.378471Z","title":"org/CorpusID:235313679","venue":null,"work_id":"e239de45-dfbc-4fe4-9340-9268e6df01c3","year":2021},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:d8e980f4ee4f5d8aef6e523d15c7bf9d3978f8a727f5e50cc8abc7a6f75a7bca","observation_id":"16824615-afb9-47c1-9d37-92f47a96f050","resolution":{"observed_at":"2026-07-09T01:05:50.379622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.375189Z","title":"Lee, K.-H., Nachum, O., Yang, M","venue":null,"work_id":"dcc422c0-b1d5-4e60-b437-0a1ec6965bc2","year":2022},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:9cd348eaad8571b1692f4df372c9400c12f92a20b2fa836b22efe4175d407f9e","observation_id":"a8845882-9b53-45fb-b7da-d223bc92992c","resolution":{"observed_at":"2026-07-09T01:05:50.376310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07978","last_updated":"2025-02-11T21:52:19Z","snapshot_observed_at":"2026-08-08T20:41:10.087154Z","submitted_at":"2025-02-11T21:52:19Z","title":"A Survey of In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.07978","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07978","snapshot_observed_at":"2026-06-30T13:44:40.651347Z","title":"arXiv preprint arXiv:2502.07978 , year=","venue":null,"work_id":"24545a57-6974-4e7f-9d8e-949eb859bee3","year":2025},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/2502.07978","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:cc023f0f305e41ea4c5ea6a101b49892a68651b090f30eca9e8e017797cc5e7d","observation_id":"9d35b37b-59e1-43eb-9bb7-aa9eedff9f76","resolution":{"observed_at":"2026-06-30T13:44:40.652995Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.380170Z","title":"Nikulin, A., Zisman, I., Zemtsov, A., and Kurenkov, V","venue":null,"work_id":"20af6136-b5cc-4776-a629-e8d02a893e56","year":null},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:54beaa500468a4704b9a44215da2fba47b7f306cc5136b2ab9fd0827e1a8b87e","observation_id":"fdddb94a-055c-40ba-a3a0-bf0bb16f9ce6","resolution":{"observed_at":"2026-07-09T01:05:50.381274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.383558Z","title":"Papoudakis, G., Christianos, F., Sch¨afer, L., and Albrecht, S","venue":null,"work_id":"6326d7b7-72fa-4389-a8db-9373fc065b68","year":2021},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:76f9854a7929414836e84d61be7a576d7588cc89400b8b1615160633d7623c69","observation_id":"3cf610d3-6094-4450-b28e-6c46046c07d0","resolution":{"observed_at":"2026-07-09T01:05:50.384709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.381844Z","title":"Rahman, A., Fosong, E., Carlucho, I., and Albrecht, S","venue":null,"work_id":"5f0f8580-47a6-4610-8648-aafefaae4fe9","year":2023},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:294fb68ffa8ac21a2e3aba47195bede38556b2c09c79d046a83b574e837cd716","observation_id":"094f98ac-c233-4892-81d0-2936901bb134","resolution":{"observed_at":"2026-07-09T01:05:50.382977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.385224Z","title":"Rahman, M., Cui, J., and Stone, P","venue":null,"work_id":"97dc3d27-3c91-41e4-b5ba-7e9c4b96793c","year":2024},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:ab188f890ae5574fd1d1c34a72857086285ffe765d90342add30444aa3651580","observation_id":"8c372c56-e4e3-46d5-9d5f-629fc0451f94","resolution":{"observed_at":"2026-07-09T01:05:50.386230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:701c6a3769bd965cfba3b704c3f8a5ea0c98b84d6a114b63376a3581a4832905","observation_id":"68c6b7eb-5f46-4fe6-a84f-fd68489ca1ed","resolution":{"observed_at":"2026-06-30T13:44:40.650034Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:bf1574eea9dc981d7c2ee43226971375062780be24f64d67ba994f5c9046cae9","observation_id":"1622cf25-36bc-4b78-ac98-ee0b0c320d51","resolution":{"observed_at":"2026-06-30T13:44:40.658304Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.368349Z","title":"13 Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork A","venue":null,"work_id":"dda7b902-c08c-467a-9a8e-8c58cfc46c32","year":2025},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:c6c7af091ca7cc5cda5515df52d0259f39ce913de8b367299852bbde902a4458","observation_id":"297e9e37-ef01-4313-b3fc-9ccc8ac17698","resolution":{"observed_at":"2026-07-09T01:05:50.369574Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.370155Z","title":null,"venue":null,"work_id":"4a1ddf72-79fc-4adf-bbd7-846c7ca05c3d","year":null},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:6d97c639fbfcf92141b2cd020b48a22f4071c70d6f82d55feb0b684f7896b545","observation_id":"257aa6cb-219e-4e42-9005-ebe973523059","resolution":{"observed_at":"2026-07-09T01:05:50.371255Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.371862Z","title":null,"venue":null,"work_id":"9d046a6c-0218-43f3-8ffb-8a69ce897d63","year":2023},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:126818efc7f1ea0fd917365e0f441e821a79d212d69c06fe7ab957b2e95c3957","observation_id":"b726f50b-16e6-439b-8866-9d280035ccb8","resolution":{"observed_at":"2026-07-09T01:05:50.372914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.373448Z","title":"These layers perform channel-wise feature transformation without spatial mixing","venue":null,"work_id":"e71f7f3e-f4d2-428d-bae3-bcee315d0d7f","year":null},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:8bec22ef6a539a477cbb944c5292ee5f61583a8ba6e1bef8ac8cceb8c1d0a7b7","observation_id":"1d53bfb5-76d2-4fab-af37-51755952b90b","resolution":{"observed_at":"2026-07-09T01:05:50.374630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.366619Z","title":"with prior","venue":null,"work_id":"ae7987c1-002a-4eb5-b3b4-bec7752a49ff","year":2014},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:881c621b055429273ec4e3706f809143bdcdbb1130c5aa4dd51c0191242eb6a5","observation_id":"c178aa6a-d8fe-46b7-a1db-799a383de70a","resolution":{"observed_at":"2026-07-09T01:05:50.367729Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":3,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":1,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2605.24423."}