{"as_of":"2026-08-13T18:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2dafc257dc8d5de3388bb18c64463bc8872261e3943bfde30c1aa1d8f818ef14","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:11:16.587910Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00228/citation-record","integrity":"/paper/2506.00228/integrity","json":"/paper/2506.00228/citation-record.json","paper":"/paper/2506.00228"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.13746","last_updated":"2023-10-31T00:06:14Z","snapshot_observed_at":"2026-08-13T13:35:11.276934Z","submitted_at":"2022-11-24T18:23:28Z","title":"Melting Pot 2.0","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13746","snapshot_observed_at":"2026-08-07T12:11:13.910003Z","title":"P., Vezhnevets, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:13.910003Z"},"links":{"cited_paper":"/paper/2211.13746","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:14c5f2c50e7a81d46a31d0388820a1236f1ad68128d5021c64ac50676d23b336","observation_id":"21a3df4e-59ed-4801-bbe1-383d9630ae0d","resolution":{"observed_at":"2026-08-07T12:11:13.910003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.989924Z","title":null,"venue":null,"work_id":"b7e43c76-a13e-4b38-aab8-ee10cf54a50b","year":2018},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.011634Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:c4948b0fa8782dd58a1cb4c7979fd559ba638aa2566a83dc014a9d7668056710","observation_id":"9890b7aa-e2c6-4eb4-a934-b2358fb8764f","resolution":{"observed_at":"2026-08-07T12:11:21.067079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.801924Z","title":null,"venue":null,"work_id":"2f59e4d3-eef5-41c7-8f6b-f3a1a0c6b38d","year":1985},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.093188Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:c9afb0276aa5acb746cbad458365d8ce210d4b2f781ff4dffd0d9aada2a0ed83","observation_id":"4f31128d-047a-462b-81e2-af00671feb3c","resolution":{"observed_at":"2026-08-07T12:11:20.862541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.655808Z","title":null,"venue":null,"work_id":"47a5b624-1247-46b8-b2bf-db4180bd6a84","year":2009},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.156107Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:4cbc675dde5c4074ab8e1a523a381be409b94922a8d7cf2794eab98e47d21e80","observation_id":"4871ed52-95db-46a3-bfbe-0adb79f32873","resolution":{"observed_at":"2026-08-07T12:11:20.717717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.461712Z","title":"J., Leary, C., Maclaurin, D., Necula, G., Paszke, A., VanderPlas, J., Wanderman-Milne, S., & Zhang, Q","venue":null,"work_id":"10f178f2-51b2-430a-8f58-37af9e93a00e","year":2018},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.257188Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:30c40f8e2b510b70e1e82621231bfcf77289b91571ecaf5cde2bed16f9c56419","observation_id":"d89fe5e4-aec0-4ca7-a50d-8efac7df9647","resolution":{"observed_at":"2026-08-07T12:11:20.543953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-07T12:11:14.342823Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.342823Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:43b45e358bf88ca12b5d34f823cac67b5a4a2930af17477569f6f91cbc8f8d86","observation_id":"9fe2ef36-3193-43c3-820e-7a350ad26f42","resolution":{"observed_at":"2026-08-07T12:11:14.342823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.288180Z","title":"L., & Feldman, M","venue":null,"work_id":"733d2692-63aa-4787-8a99-4a443c2ab5d4","year":1981},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.452303Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:24db3eafcd359a94bd688b696f47dccc2074984e1755abe0d91293080cf20db7","observation_id":"f872eca9-dce9-41e5-a22b-a11a2209abbd","resolution":{"observed_at":"2026-08-07T12:11:20.361782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.097539Z","title":null,"venue":null,"work_id":"a53e525b-ecc6-4187-8ba8-239fee7da924","year":2018},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.576770Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:97f3cf0fdc6545a217cce5e005fa0fd31f3274478803bf7cadfc5499aacd1a8e","observation_id":"d22c0bbe-ea69-4e13-b200-8c2a728b17fb","resolution":{"observed_at":"2026-08-07T12:11:20.172866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05162","last_updated":"2023-12-08T16:42:15Z","snapshot_observed_at":"2026-08-13T05:07:07.575436Z","submitted_at":"2023-12-08T16:42:15Z","title":"A Review of Cooperation in Multi-agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05162","snapshot_observed_at":"2026-08-07T12:11:14.721088Z","title":"Z., Islam, U., Willis, R., & Sunehag, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.721088Z"},"links":{"cited_paper":"/paper/2312.05162","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:1ae26df9a066f43e41f467b5fd81e5742f1fbe7005ba54d5c42ad33bf78861b2","observation_id":"75ced97b-248b-4a0c-abb2-8c72f6ae46b4","resolution":{"observed_at":"2026-08-07T12:11:14.721088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.921886Z","title":null,"venue":null,"work_id":"158138c9-d625-43e2-9061-b763809313b0","year":2019},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.797219Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:920b39a391b31c4854fe09fdd8ce664aad59c78a4700f5c1540ab084ecc8e0af","observation_id":"74c673e1-1f46-4db3-b686-3af8084bfc4c","resolution":{"observed_at":"2026-08-07T12:11:19.988255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.775430Z","title":"A., & Leibo, J","venue":null,"work_id":"2b6adec4-b715-415f-868f-35805de15e56","year":2025},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.901379Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:d2c4f2d2aa106893a38db02b0284dadc66650db0b95da2183c2c39a7cbbf4adb","observation_id":"9e83f0b4-239b-48b0-83d7-eef69aab15d6","resolution":{"observed_at":"2026-08-07T12:11:19.830322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.653462Z","title":null,"venue":null,"work_id":"d697661d-16c4-4388-948d-31e36c92229d","year":2018},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.002775Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:9b9d51532a857004badcd817e1af802d5b55a4253476f5165f759c18683561fd","observation_id":"c4fffaba-a455-4641-a5b9-9f351a9e1a21","resolution":{"observed_at":"2026-08-07T12:11:19.706581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.517887Z","title":null,"venue":null,"work_id":"a366a84c-5e91-48b2-ba93-ae79f4657b5b","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.104515Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:a8bd88595ffd4586bbd8dee717b11d3289a9f602b69651a47fc9a4a7090e630f","observation_id":"b296e7e4-1870-4e00-b0fd-bdcd6e53e87b","resolution":{"observed_at":"2026-08-07T12:11:19.573503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.393722Z","title":"Z., Dueñez-Guzman, E","venue":null,"work_id":"d6fdf174-60d9-4caa-b632-4f508f397595","year":2021},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.249337Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:fdb4c6f4cc2ded24a41e9d7396b0a468b6097d5a3f1400f03dba60ec37791b02","observation_id":"ea03b244-352c-4005-83e7-c5ed8782cfcd","resolution":{"observed_at":"2026-08-07T12:11:19.455778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.01068","last_updated":"2018-03-02T14:39:55Z","snapshot_observed_at":"2026-07-06T05:49:43.427852Z","submitted_at":"2017-07-04T17:02:05Z","title":"Maintaining cooperation in complex social dilemmas using deep reinforcement learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.01068","snapshot_observed_at":"2026-08-07T12:11:15.305521Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.305521Z"},"links":{"cited_paper":"/paper/1707.01068","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:4e55362b287d26af40cd4d0ad279f466d1b7af151cf319d57b0d7f19dffa220d","observation_id":"bb177233-f6ff-4583-bb72-6c176464d91c","resolution":{"observed_at":"2026-08-07T12:11:15.305521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.301984Z","title":"M., & Laland, K","venue":null,"work_id":"8a304046-ca60-41cf-86ca-ab89930b722c","year":2012},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.389287Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:605c43362adecc8b62ebafd561c450562a588691f72af30bd1cc68746795be7f","observation_id":"d3f31d28-e60b-4166-84d1-1304d9fcba8b","resolution":{"observed_at":"2026-08-07T12:11:19.352597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.172411Z","title":null,"venue":null,"work_id":"c9694c6d-0cc4-4d2e-9352-16522ee53b05","year":2022},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.435299Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:08d5ef2f3af0c98b7f776a2eb7cb3b234652b7e4ff5b06fcc4930823c5380614","observation_id":"46dc3daa-1ebd-46d9-be32-18c54378099f","resolution":{"observed_at":"2026-08-07T12:11:19.193494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.132322Z","title":null,"venue":null,"work_id":"15bf223e-7959-481b-bb9b-eaa907a5cf3a","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.505391Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:d36a6d180c5a8039f42b38681065bae741a6ab65008538ddf74e33107dd2b054","observation_id":"8dd7abf4-7d84-4235-b877-69e28704bd0c","resolution":{"observed_at":"2026-08-07T12:11:19.143369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:18.974175Z","title":"S., Souly, A., Bandyopadhyay, S., Samvelyan, M., Jiang, M., Lange, R","venue":null,"work_id":"edd17e23-bd1b-4f64-b414-5e4178625b5e","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.612298Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:2290475d0b4880a42eb92a47b851e168213ebb8e7788265b6485341193adebe7","observation_id":"2cf2a67e-164b-40db-82c1-87822df64395","resolution":{"observed_at":"2026-08-07T12:11:19.048742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:18.765888Z","title":null,"venue":null,"work_id":"68861b29-b48d-4380-bf9e-a3280b64f720","year":1971},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.740501Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:9162ae8394024426799e678ca9d6f7ea59521bc9f8af1caf951ba5d4fe2518be","observation_id":"329f953e-3520-49f6-9f70-c90c7de40f29","resolution":{"observed_at":"2026-08-07T12:11:18.856624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:18.569691Z","title":null,"venue":null,"work_id":"f6564adc-e549-444b-8708-4182e3345723","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.872814Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:0fb66db6ccbc30e22467f098a3478a4cf153dbc02ffb451dbc0575c7987ab3c1","observation_id":"c40b56fa-1751-4832-823b-c99cf95f872b","resolution":{"observed_at":"2026-08-07T12:11:18.632753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:18.320977Z","title":null,"venue":null,"work_id":"5231009e-3775-40bd-8b77-46a798e58b6d","year":2021},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.981676Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:46a360c84202d7b42a3fe290078296a5b23c25fd8256c59da17a391fb056471d","observation_id":"cbb68f4d-54ab-407a-9082-b66e9093c6c6","resolution":{"observed_at":"2026-08-07T12:11:18.421534Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-08-12T13:10:57.260306Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-07T12:11:16.127892Z","title":"U., De Cola, G., Deleu, T., Goulao, M., Kallinteris, A., Krimmel, M., KG, A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.127892Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:df834cb53ad8e1d0dfb89bac2c9a215f28b73b6ff12b35ba28a6ae779fe0989a","observation_id":"60054f90-5e71-45c4-914f-bee56d776d3c","resolution":{"observed_at":"2026-08-07T12:11:16.127892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:17.946986Z","title":"P., Duéñez-Guzmán, E","venue":null,"work_id":"d4c79659-c67d-4154-8b8b-03636828a131","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.260881Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:1a2570f110c20a0e6f85f88a7865de519e74419a902def83b58de74556b0d5a3","observation_id":"52784d61-2f72-4f82-87d1-194e0fea8459","resolution":{"observed_at":"2026-08-07T12:11:18.140204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:17.555127Z","title":null,"venue":null,"work_id":"308216ce-bf32-4766-911c-d5366c18a556","year":2020},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.352479Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:55178325f258318eedce22d437eb60ea9f6ab2b81f2813b5d87016521bf9f6f3","observation_id":"fe259235-7db7-46aa-bca3-d83c05ae942e","resolution":{"observed_at":"2026-08-07T12:11:17.697533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:17.225107Z","title":null,"venue":null,"work_id":"510eb93f-3c6e-473d-9c56-b604f5853c26","year":2021},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.483503Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:4bcc89245fb6a0e8b9f9c68c1aec6633a6ee1009ea7b36b60372ad7b4276c598","observation_id":"e5c7d6fe-83da-4753-a2ba-cb75375f7600","resolution":{"observed_at":"2026-08-07T12:11:17.355131Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:17.014779Z","title":"V ., & Plaat, A","venue":null,"work_id":"a8285e00-01e6-4ae3-9d6a-f3b051b65e59","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.587910Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:dd201ea49a0142120519a2438e194bd94a4690354e4dc5904be519844481edaf","observation_id":"a53893f8-368f-4a27-b6d6-90c43068b67e","resolution":{"observed_at":"2026-08-07T12:11:17.092687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-12T14:13:20.756693Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2506.00228."}