{"as_of":"2026-08-22T21:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:051913e9a19f0a138e9e33b3a083f7d1b36ef89976417235d90e2a1365d61c2b","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T17:09:37.436426Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.25076/citation-record","integrity":"/paper/2604.25076/integrity","json":"/paper/2604.25076/citation-record.json","paper":"/paper/2604.25076"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to play trajectory games against opponents with unknown objectives","venue":null,"work_id":"3d80f2dc-f2ed-420f-9698-015a056df370","year":2023},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:327c7a8d170209e8ba121a55251c8bb1e2b2fdb3dfa1d0c28ab4dcf67d39f21f","observation_id":"ba86492d-ac84-4089-b7fb-f327fc67c991","resolution":{"observed_at":"2026-05-27T01:23:21.648082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Foerster, Francis Song, Edward Hughes, Neil Burch, Iain Dunning, Shimon Whiteson, Matthew Botvinick, and Michael Bowling","venue":null,"work_id":"faf3f456-d6c9-49e0-8f49-8396b9db620e","year":2019},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:c7544f02df82fec163cae705ffe3c57a05663e8a1f345597e16ef1f9cead41e3","observation_id":"fb8d3454-5367-4b5b-86fe-a3c0fd45099a","resolution":{"observed_at":"2026-05-27T01:23:21.652259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to play sequential games versus unknown opponents","venue":null,"work_id":"19a3c154-ab65-460d-9a7f-6fd0f7095129","year":2020},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:e4ef63805f44f5e96e8d8c0fc515ed209a6e1452ce7022ac963b75ab6d6714bc","observation_id":"1cf38d66-d5f3-40ee-ba85-a75c3fa88b91","resolution":{"observed_at":"2026-05-27T01:23:21.656188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"At-drone: Benchmarking adaptive teaming in multi-drone pursuit","venue":null,"work_id":"937204cc-dcad-4af4-a2a7-10fefd6a5615","year":2025},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:e47a878e479a73c23add643f07a5cff59c948833a521568cf61a2cee508b977c","observation_id":"9f77bfa5-104a-4fee-a445-c7449f4e72eb","resolution":{"observed_at":"2026-05-27T01:23:21.664032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"other-play","venue":null,"work_id":"fb3a06eb-71a1-44ab-8ad8-92669ec57f40","year":2021},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:ca94842daf862fd9cbb6e01b9ac98cc6548907a4c9b9f93729cdc95f9be967dc","observation_id":"53582493-ba4f-467d-96f3-63a980d7fae0","resolution":{"observed_at":"2026-05-27T01:23:21.675583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Td-gammon, a self-teaching backgammon program, achieves master-level play.Neural Comput., 6(2):215–219, March 1994","venue":null,"work_id":"96df96b4-ba97-4b49-a8df-b991fc883671","year":1994},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:7a73763b2a3a73dbf6538af5ae0a9e355500971dec87522a7612062e63b1a279","observation_id":"af2eba3d-71ba-46cb-967f-1da53279a836","resolution":{"observed_at":"2026-05-27T01:23:21.660114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.378070Z","title":"Trajectory diversity for zero-shot coordination","venue":null,"work_id":"22f50fb4-bc14-4fd3-adfd-a8aa7ce54b18","year":2021},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:3457fc3e20e3179ea51fb5bee4f9ae04d78f70262c52dd6ca1a5994d8b9c996d","observation_id":"aa1e39ef-0050-4b25-8c80-506d6faf1b4e","resolution":{"observed_at":"2026-05-27T01:23:21.667966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Heterogeneous multi-agent zero-shot coordination by coevolution","venue":null,"work_id":"a48f3b02-7f4d-4ffd-a201-f5f0fcbad140","year":2024},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:3481b2962d60ff237e810fad748fe381ecec3ed6cff78822a73bb7d89bbeb75a","observation_id":"583d1763-c9b0-4748-944e-005e6c9f8d5d","resolution":{"observed_at":"2026-05-27T01:23:21.671797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Comprehensive overview of reward engineering and shaping in advancing reinforcement learning applications","venue":null,"work_id":"7ac1b3f2-6825-43ed-8e8a-a08342f3b080","year":2024},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:6858c1cf10145fb1b4e2af7e78f161428e94723f74276734f6a726413a23a105","observation_id":"8112b080-639a-41f4-b15b-05e4751d44b8","resolution":{"observed_at":"2026-05-27T01:23:21.682649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning zero-shot cooperation with humans, assuming humans are biased","venue":null,"work_id":"092c9a74-c0b3-46bd-a3ea-99fd51841dc8","year":2023},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:3b4194cfdb987f545040582d307db64abb100177b234d56a6bf4e922e640f0c8","observation_id":"25c82948-7241-4cde-8839-13ffad695ad8","resolution":{"observed_at":"2026-05-27T01:23:21.693922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"202efd35-1148-4c8d-9b5f-1b1a486fba02","year":2022},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:81f42138d1be791b9891e6de6bec7f0c997c258dd5a4203bad6bd469b2982b03","observation_id":"3ffcbb42-4eba-47d6-b24c-2e85a2e07c5d","resolution":{"observed_at":"2026-05-27T01:23:21.678763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Theory of mind for deep reinforcement learning in hanabi","venue":null,"work_id":"67b9df18-3531-4388-9107-a6c0314668b0","year":2021},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:9dddbc3113264da38da49d4cb928cad498fb63b3ae251abf51c8b07ecc844f2d","observation_id":"3aa11d4a-850c-4a5e-8ea1-0434a61a0f18","resolution":{"observed_at":"2026-05-27T01:23:21.716786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ho, Thomas L","venue":null,"work_id":"40fba45d-f8c9-40a6-910a-f1d51fe82923","year":2020},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:b41d388e53a46660af68f98cbeb01ae827b85751c866ee646b8f6d69c40932a0","observation_id":"4a39509b-55ac-4f28-942f-80d4baba3dbe","resolution":{"observed_at":"2026-05-27T01:23:21.708444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eureka: Human-level reward design via coding large language models","venue":null,"work_id":"679357ac-6bdb-4070-b686-e0bf8ad3eba4","year":2024},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:968e5a61f4479b4240ae62dbb7c6fb1e6ff3cc3fb16128a304f05ec03e6f0566","observation_id":"cdedd4f5-7700-469a-9d7e-d68e87b66153","resolution":{"observed_at":"2026-05-27T01:23:21.686290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa03dbcd-d755-44af-8f31-6967a9975110","year":1979},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:f3e969a2dccd1412c8e7e47ed846b84160b554f6d3e123e7b1cd85d25d69f5b1","observation_id":"8952262a-baa7-468b-ad5a-a39f158d47e3","resolution":{"observed_at":"2026-05-27T01:23:21.720430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1975603f-5f92-43e5-9836-a6d7e5938faa","year":1991},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:a378093e5bb55dba62d736a74c48d1d4f3244ec4e1c2e804b551a6e39c7d5a6d","observation_id":"a881e72a-e3ed-469c-a987-4fc8e17d5308","resolution":{"observed_at":"2026-05-27T01:23:21.712796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The surprising effectiveness of ppo in cooperative, multi-agent games","venue":null,"work_id":"95edbc2b-c6c1-4749-a206-b5ac3f2a553e","year":2022},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:7b54e5a5c4b952795a8c7bbee42a98ea039a0b4f847360e7342bc913f394ca1b","observation_id":"24d8edeb-a4fe-499a-b1dc-7e89241f8a7e","resolution":{"observed_at":"2026-05-27T01:23:21.704713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zsc-eval: An evaluation toolkit and benchmark for multi-agent zero-shot coordination","venue":null,"work_id":"a76d3b41-6d61-4a9f-ab18-95b792d2c492","year":2024},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:ddb54fa5a696ffec522dfe1952a3516f91a561cd6f06c1b0e8e95c3911892964","observation_id":"de521ac0-c31b-47f0-9068-92d76a5262a3","resolution":{"observed_at":"2026-05-27T01:23:21.689778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An efficient end-to-end training approach for zero-shot human-ai coordination","venue":null,"work_id":"08e24b3e-a3f2-405e-b2da-cea84103b5c7","year":2023},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:73a516d4556c510a21201390f0480c4d38fd6bb45102aa1e3acd9cb3365f422d","observation_id":"db19eda7-a250-4443-9ca6-db1ca9baef20","resolution":{"observed_at":"2026-05-27T01:23:21.697549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"folder\"","venue":null,"work_id":"20f09833-6ca6-4b28-a4d4-c2dd1022afbb","year":2010},"citing_paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-07T17:09:37.436426Z"},"links":{"citing_paper":"/paper/2604.25076"},"observation_digest":"sha256:f8815503219065dc051ab46717a3de55ce82d53c5d69711f7fe3507fcd45c2eb","observation_id":"13431839-d067-490b-ac2d-c31e98639d76","resolution":{"observed_at":"2026-05-27T01:23:21.701268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.25076","last_updated":"2026-04-28T00:09:28Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T04:41:48.254357Z","submitted_at":"2026-04-28T00:09:28Z","title":"Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2604.25076."}