{"as_of":"2026-08-23T15:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e90755fd7953ada82dbd30a81bab65da6ff7f3529ebe6abc4a5757f77dbc74dd","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T21:03:10.005335Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.08257/citation-record","integrity":"/paper/2509.08257/integrity","json":"/paper/2509.08257/citation-record.json","paper":"/paper/2509.08257"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:13.818248Z","title":"Mact: Multi-agent col- lision avoidance with continuous transition reinforcement learning via mixup,","venue":null,"work_id":"5d3a8b1a-ba92-40a8-ba87-d197c289d7aa","year":2023},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.428794Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:fa3513d1a49f578dc1dc0b03170875388d6210249f814f57677feb027e60ecf4","observation_id":"0907f83e-50e1-48ce-a247-4fee195e39e5","resolution":{"observed_at":"2026-08-04T21:03:13.881829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:13.634513Z","title":"Hierarchical consensus-based multi-agent reinforcement learning for multi-robot cooperation tasks,","venue":null,"work_id":"7f5e7fef-6350-4bcf-a5d0-e8ce6d23b2c5","year":2024},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.472071Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:96b9c882ebcdc510f40e78fefc222c31fef2e7fa30fd494e2938aa60161e62ff","observation_id":"00750486-9960-455a-9cd1-fb41a2bb6306","resolution":{"observed_at":"2026-08-04T21:03:13.730993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:13.503899Z","title":"Safe multi-agent reinforcement learning for multi-robot control,","venue":null,"work_id":"56114345-f318-4171-99f0-e688c7167a87","year":2023},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.511804Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:1e801cd8c5487a7caf5af604828539b848e235763329675e80610bb58239e098","observation_id":"a00c5503-9c72-4f3e-ae8f-8c1331d5c2d6","resolution":{"observed_at":"2026-08-04T21:03:13.565344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.06440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:10.427239Z","title":"Sigma: Sheaf-informed geometric multi-agent pathfinding,","venue":null,"work_id":"85826205-333c-44cc-8616-65097e43beba","year":2025},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.557373Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:059778f27982e9abe94418230cd8f9f172d8bfd4cca7641eb8e9a0afb702f58c","observation_id":"3dd2b3d7-714e-4ccc-aa34-543621df2062","resolution":{"observed_at":"2026-08-04T21:03:10.466885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:08.601598Z","title":"Inverse reward design,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.601598Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:644d3acee3dab24504dfc263d2e27a9bb269be86627160d91b4fe9cfcd2cf9ad","observation_id":"824cc275-7dcf-426b-a2f7-4037f3efc5e4","resolution":{"observed_at":"2026-08-04T21:03:08.601598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-04T21:03:08.678013Z","title":"Concrete problems in ai safety,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.678013Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:bf675866b4066324f212fa84d2d912b60fc30000d7e049cd2a55f4f696da4d6f","observation_id":"3930d942-e138-4407-8c04-0745baebc372","resolution":{"observed_at":"2026-08-04T21:03:08.678013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:08.722381Z","title":"Multi-agent inverse reinforcement learning,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.722381Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:c3c44bbe5dd53d8413f0cc6be794a7ae2d6418c50ea635773492c1ac5251c3d1","observation_id":"15b67cfd-cd65-4f66-b39b-e5a17b1040bf","resolution":{"observed_at":"2026-08-04T21:03:08.722381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:13.354722Z","title":"Multiagent inverse reinforcement learning for two-person zero-sum games,","venue":null,"work_id":"4155e6da-44cb-4aa3-9665-1aeadb768f16","year":2017},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.752776Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:4e2eedbda5007b500b01dcaaac47951116989e5bf341e907d07fd441c0dd46d5","observation_id":"941f0004-581a-45d3-a2a7-d734df03bfd3","resolution":{"observed_at":"2026-08-04T21:03:13.392639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:13.270047Z","title":"Recent advances in robot learning from demonstration,","venue":null,"work_id":"a5a45e3a-5a85-482e-8ee2-0efa7df2ec37","year":2020},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.798905Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:3438153a75054c1878ebefcefc00a5bd988d09f29862f279f61defebf00a037d","observation_id":"6896d7a9-3072-459c-a2df-9753856a803a","resolution":{"observed_at":"2026-08-04T21:03:13.309722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:08.843145Z","title":"Efficient training of artificial neural networks for autonomous navigation,","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.843145Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:68eaf22c6140a0be4ae78f831bc81ca7c96e8a7a92fb81548cb81ad40a315ef7","observation_id":"518cd559-56c2-4705-9c4b-4862fbb15c2f","resolution":{"observed_at":"2026-08-04T21:03:08.843145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:13.168913Z","title":"Algorithms for inverse reinforcement learning,","venue":null,"work_id":"31a9fa8f-e3e8-4ae1-9e3d-3a5c9bb11128","year":2000},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.889152Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:4bade788d95b131ed87a5e6781e1253e774ad066a7e34287d3c7760300365729","observation_id":"95ce65fd-8fa4-436a-82b3-4a80917bf775","resolution":{"observed_at":"2026-08-04T21:03:13.213703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:13.048424Z","title":"Efficient reductions for imitation learning,","venue":null,"work_id":"1e98a524-bb09-4c4b-8a64-8b67ff11aa78","year":2010},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.934866Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:83756db8cf645f05c2717b09f36638792418710d32fb226b6165035690ecfb50","observation_id":"dfbe8e0d-8b5a-48aa-bab0-6a2a8b6855df","resolution":{"observed_at":"2026-08-04T21:03:13.086941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:08.954056Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:08.954056Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:c515f08f12a77e4fe9aaa910e2e26be65f7ffc80240764e3e2de9f1cba907a48","observation_id":"2587a48c-5488-4dd3-86c3-6700bda7c98e","resolution":{"observed_at":"2026-08-04T21:03:08.954056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:09.000491Z","title":"A survey of imitation learning: Algorithms, recent developments, and challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.000491Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:051193ef2f9377cdf0c1ed1d39db2d2dc68ac1621d41c7db2e6b4bcdf35f32da","observation_id":"a683dc4c-7994-4f60-a207-8e35534995a6","resolution":{"observed_at":"2026-08-04T21:03:09.000491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:09.046333Z","title":"Physics-informed machine learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.046333Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:6494023eb016c8303421b7e2c46bd4cb77db0d1955c576dcf1ddc9c06eef8286","observation_id":"2efa1e87-e73e-4b6c-96a6-2e02bee18952","resolution":{"observed_at":"2026-08-04T21:03:09.046333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:12.827277Z","title":"Multi- agent mdp homomorphic networks,","venue":null,"work_id":"b975123c-ebea-4460-b5c9-51ab9be1907c","year":2021},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.057287Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:a7714763e1b6a4f740b39a8fdaf61392ea7decd628f3d5c82ebb6c95d7c30288","observation_id":"f7bbb757-1ce6-4444-aa20-145607c589e1","resolution":{"observed_at":"2026-08-04T21:03:12.897965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:12.669536Z","title":"Esp: Exploiting symmetry prior for multi-agent reinforcement learning,","venue":null,"work_id":"99cf2b48-c46b-4505-b544-20b700872979","year":2023},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.101997Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:149e4a83c24dd74e21d2f67ef9e8ef35f722a5963de8a356bd0bb570b475e6c0","observation_id":"0a74e371-e19b-43d9-b7cd-d67be3446a71","resolution":{"observed_at":"2026-08-04T21:03:12.728765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:12.561668Z","title":"Exploiting hierarchical symmetry in multi-agent reinforcement learning,","venue":null,"work_id":"87e4d8f2-706f-4c68-9fc4-ad707e614702","year":2024},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.150426Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:c8774f97bf4f0b93f7a7d93bceb3b009e2934fec98607c625ca581090e11c0e5","observation_id":"68792d7d-0947-49e8-b9a2-bef0f276ed5f","resolution":{"observed_at":"2026-08-04T21:03:12.603057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:12.442446Z","title":"Multi-agent generative adver- sarial imitation learning,","venue":null,"work_id":"2211448a-1e6e-4c83-ae76-1f9197a20b86","year":2018},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.193080Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:34d4ea425063a243be3f585b9c86bd132f463ffc30f162f9b27a742e7a2a1cae","observation_id":"d9bc8525-6e2c-4d82-904e-28d88a0d53dd","resolution":{"observed_at":"2026-08-04T21:03:12.483355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:12.330978Z","title":"Multi-agent adversarial inverse rein- forcement learning,","venue":null,"work_id":"ea4a385e-e9bf-466c-a7e9-e8f6f31d96a9","year":2019},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.237814Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:a8f30d41e025bb10c566f39b21fd3b357b4253224a9ade9bd52eabb604864ba5","observation_id":"71ca7897-1f7b-4b0a-b630-3aa005a63d0c","resolution":{"observed_at":"2026-08-04T21:03:12.381265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10525","last_updated":"2020-02-24T20:30:45Z","snapshot_observed_at":"2026-08-22T23:18:38.085973Z","submitted_at":"2020-02-24T20:30:45Z","title":"Scalable Multi-Agent Inverse Reinforcement Learning via Actor-Attention-Critic","version":1},"cited_work":{"arxiv_id":"2002.10525","doi":null,"metadata_source":"pith","pith_arxiv_id":"2002.10525","snapshot_observed_at":"2026-08-04T21:03:10.267990Z","title":"Scalable Multi-Agent Inverse Reinforcement Learning via Actor-Attention-Critic","venue":"cs.MA","work_id":"f3ee0df4-8935-443c-bc08-d5989e942393","year":2020},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.254548Z"},"links":{"cited_paper":"/paper/2002.10525","citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:c17692f81ad05bf9fa2179a11b792bfdf146e2194baa37e9bbd54c6e3794b169","observation_id":"085b8546-bd2d-4549-95a2-999d68ea59e5","resolution":{"observed_at":"2026-08-04T21:03:10.331009Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:12.222720Z","title":"Swarm inverse reinforcement learning for biological systems,","venue":null,"work_id":"a7e34617-04d0-4537-acf8-04f15665bf6c","year":2021},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.299242Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:9b293dbf2265582f64a5c7096b2ca6c56d1b9f15ca52c3002962c76a71324ae2","observation_id":"0e0be43a-a02e-4596-9df4-26fc83565865","resolution":{"observed_at":"2026-08-04T21:03:12.282831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:12.139252Z","title":"Dec-airl: Decentralized adversarial irl for human-robot teaming,","venue":null,"work_id":"3504c85f-b5cf-403b-ab5a-d30ce64e6840","year":2023},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.318237Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:3fff43eeec64079f83e8ecda011387681862627904758731622ac91ee794a58e","observation_id":"18a7015e-03e8-4205-a9ed-17ddae9ced8b","resolution":{"observed_at":"2026-08-04T21:03:12.180241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:11.972561Z","title":"Leveraging partial symmetry for multi-agent reinforcement learning,","venue":null,"work_id":"d0f50b1b-a46c-4595-8c83-7629bbdc890c","year":2024},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.360810Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:e6f35dec2b3768946bd68d5553815020618cc90eb35af81b864c878f8e28ae77","observation_id":"705c8c4c-4cf4-428a-b83a-c0bcbe9a138d","resolution":{"observed_at":"2026-08-04T21:03:12.037289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:11.844352Z","title":"Adaptaug: Adaptive data augmentation framework for multi-agent reinforcement learning,","venue":null,"work_id":"fdd1047a-260a-4fee-b2a3-9270296e17b3","year":2024},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.405126Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:b1e5ba801f1cdefc78cceb92d276df57e3a04fe906fd5116dd5ef6bb1c602375","observation_id":"17ebe379-700c-48a3-a900-c64620695039","resolution":{"observed_at":"2026-08-04T21:03:11.887783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:11.748454Z","title":"Boosting multiagent reinforcement learning via permutation invariant and permutation equivariant networks,","venue":null,"work_id":"0a2b1021-55db-4cc7-92f2-8744717ffd35","year":2022},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.420134Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:b5ac2a98546bf9c1dc0f8972045199671b2155a4e8db0d806124f295a85b209a","observation_id":"ff5a4d43-d463-4436-a407-0b93e5258065","resolution":{"observed_at":"2026-08-04T21:03:11.789882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.08268","last_updated":"2021-05-18T04:35:41Z","snapshot_observed_at":"2026-08-19T17:49:57.336230Z","submitted_at":"2021-05-18T04:35:41Z","title":"Permutation Invariant Policy Optimization for Mean-Field Multi-Agent Reinforcement Learning: A Principled Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.08268","snapshot_observed_at":"2026-08-04T21:03:09.470730Z","title":"Permutation invariant policy optimization for mean-field multi- agent reinforcement learning: A principled approach,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.470730Z"},"links":{"cited_paper":"/paper/2105.08268","citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:853fcb796331534aa8ec3bb391af3eb59cc5a2adb1aeee50ffecd29146f7e7e2","observation_id":"dbc57cc1-42ce-46ee-98d7-ce4c397a7f34","resolution":{"observed_at":"2026-08-04T21:03:09.470730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:11.624964Z","title":"Face completion based on symmetry awareness with conditional gan,","venue":null,"work_id":"27f649b4-e080-4ac2-a783-daae0719af28","year":2023},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.512068Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:9a25768e1ed2a481cee08ba0aca88cf106a70925110721eb81feccfbd04f87b8","observation_id":"5a7a9de3-0560-48ac-a88e-845651741b55","resolution":{"observed_at":"2026-08-04T21:03:11.664880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:11.495535Z","title":"Markov games as a framework for multi-agent reinforce- ment learning,","venue":null,"work_id":"06430cfe-02d3-49d2-a9a2-2d9e9f5f08f8","year":1994},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.588670Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:fc8b4fdb249b928a570f883135cd17b6d34aac732baf728a62e10fd9b232aba3","observation_id":"6dbff58f-bdf5-4540-ba03-ad5b4e3e84c0","resolution":{"observed_at":"2026-08-04T21:03:11.537054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:11.366973Z","title":"Provably efficient learning of transferable rewards,","venue":null,"work_id":"43282445-5236-46b8-89dd-c2f088268545","year":2021},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.641119Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:afce112dda0e157739a885ba578d70294aa76f4add0202a5b7996ac2f3ec2486","observation_id":"52f0e77a-f07c-442f-98f0-f04d1f8968f1","resolution":{"observed_at":"2026-08-04T21:03:11.410919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:11.232976Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games,","venue":null,"work_id":"a93c4034-4cd9-40a4-b9a7-8558af9a94fc","year":2022},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.714081Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:7f22241568927f86f86edf5fd92e01d45c72e00898068c76e8e301d205b6fdbd","observation_id":"961288c7-c507-4bb1-a2f4-d36d287cf0e5","resolution":{"observed_at":"2026-08-04T21:03:11.283186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:11.117443Z","title":"Cooperative pursuit with voronoi partitions,","venue":null,"work_id":"018f40f7-8db2-4e1c-b584-6764168d489a","year":2016},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.823247Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:f1820a0c014c47b419d5c7f17d9a1452be3d28d591ad9851699d3f28c06c9320","observation_id":"ea61c3c4-4cd0-46b3-b8f6-283d6cbd2b9d","resolution":{"observed_at":"2026-08-04T21:03:11.161210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:11.019864Z","title":"Novel type of phase transition in a system of self-driven particles,","venue":null,"work_id":"b0c306ff-9bb3-4817-b3c3-4ab0c1e243f6","year":1995},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.898035Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:e7ac9e850d73146953d9c7bc27ce225a3c12e4c1853c33eb7c9a715ce2164cd0","observation_id":"1e5f702d-3eee-4bbd-b684-041c79f32448","resolution":{"observed_at":"2026-08-04T21:03:11.057783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:10.778865Z","title":"Near-optimal regret bounds for reinforcement learning,","venue":null,"work_id":"21f7d7b6-d6cd-4b27-b3a0-937bbbc57790","year":2008},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:09.965839Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:1dfc30aaa73ae882abdfd7fbbe160feba8583d70913ad44f84187c6aab7d4a1f","observation_id":"f5043053-3e38-42d3-b885-b012a8c7e85c","resolution":{"observed_at":"2026-08-04T21:03:10.958550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:03:10.581597Z","title":"Why is posterior sampling better than optimism for reinforcement learning?","venue":null,"work_id":"fdfc8fbe-5c53-4122-bc2f-ba8b6f4c8312","year":2017},"citing_paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T21:03:10.005335Z"},"links":{"citing_paper":"/paper/2509.08257"},"observation_digest":"sha256:d3215c3297c3e8a70d20cf090127649a988f4e4c9b26e2f7057d6300f56ec1ab","observation_id":"0c770414-ee88-42b2-8b3b-e8e3bbe0e1d9","resolution":{"observed_at":"2026-08-04T21:03:10.651813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.08257","last_updated":"2025-09-11T02:34:59Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-17T05:57:29.462007Z","submitted_at":"2025-09-10T03:28:18Z","title":"Symmetry-Guided Multi-Agent Inverse Reinforcement Learning"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2509.08257."}