{"as_of":"2026-08-15T02:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:27b53dfe059316f20c3ca336d06299eb1e9431ab6e214564ea3f9a0898ded12f","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:54:44.217833Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.02269/citation-record","integrity":"/paper/1908.02269/integrity","json":"/paper/1908.02269/citation-record.json","paper":"/paper/1908.02269"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1901.08492","last_updated":"2019-01-24T16:44:16Z","snapshot_observed_at":"2026-08-14T17:26:23.196006Z","submitted_at":"2019-01-24T16:44:16Z","title":"Feudal Multi-Agent Hierarchies for Cooperative Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.08492","snapshot_observed_at":"2026-08-14T14:54:43.953588Z","title":"Feudal multi-agent hierarchies for cooperative reinforcement learning","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:43.953588Z"},"links":{"cited_paper":"/paper/1901.08492","citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:11e89d5b8ed2ed4256be8522034d2ff3bf4e6a9eec50ab115fd5d561591174f8","observation_id":"31f3c23a-40dd-458b-ad90-a2b0870a94d5","resolution":{"observed_at":"2026-08-14T14:54:43.953588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-14T21:47:20.783705Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-14T14:54:43.962010Z","title":"Layer normalization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:43.962010Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:e6f1da6414efa4a18eaf3bf827decaaa9d6cef50dba8ae1714f7b0227a193138","observation_id":"84970a71-c76f-4102-8a03-f77eca30e11e","resolution":{"observed_at":"2026-08-14T14:54:43.962010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:45.058011Z","title":"The option-critic architecture","venue":null,"work_id":"63e0efc8-b501-4302-b858-11b7a9ba19ff","year":2017},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:43.969778Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:da88a118b00e3207b2910da748a83f7d33a96f364d07e64d9a91b9bdbbe04395","observation_id":"01a9811d-c5d6-4227-aa08-c87f81b65cb1","resolution":{"observed_at":"2026-08-14T14:54:45.063890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:45.033981Z","title":"Measuring collaborative emergent behavior in multi-agent reinforcement learning","venue":null,"work_id":"065d6a4e-fb0b-47d0-b280-1e925ee170ef","year":2018},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:43.982105Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:8f32f2b0ade39bca92b2ad6c725614de78dbad0ce203c1ec0df5a64c9da67742","observation_id":"52f83007-9283-4099-932a-3b46882bad39","resolution":{"observed_at":"2026-08-14T14:54:45.041024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.997164Z","title":"Intrinsically motivated reinforcement learning","venue":null,"work_id":"f74190f6-06e0-4f3a-8762-e6cacf6eec37","year":2005},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:43.990917Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:4d22a68cf6cc7bd51849c3ede6a803b3d7d6912c7eba27e8dc2d80dcacc5c232","observation_id":"f7470be0-522b-41e2-8c3d-701365afbee3","resolution":{"observed_at":"2026-08-14T14:54:45.003405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:43.998984Z","title":"Learning to communicate with deep multi-agent reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:43.998984Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:a170188e10283615664e1f0991bb73722de76a54e9eaf30a868f27327b7c4d78","observation_id":"d39358ca-3cd2-4be1-bddb-c0069c2195fb","resolution":{"observed_at":"2026-08-14T14:54:43.998984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.959951Z","title":"Bayesian action decoder for deep multi-agent reinforcement learning","venue":null,"work_id":"ba495575-9f38-46ba-b139-8265c19e80ee","year":2019},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.006749Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:ee0a88f5391093782c256b320345b2e2b74407583efcaec6c8ac4eb1a8f359a8","observation_id":"25bc1adb-21a0-4e6a-83a1-ab4f9f7070b4","resolution":{"observed_at":"2026-08-14T14:54:44.967010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.935527Z","title":"Counterfactual multi-agent policy gradients","venue":null,"work_id":"6b96851e-9d2c-4ec3-8737-a533629f76c0","year":2018},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.021077Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:93d5c409a98368e8ab69bdb2278b769b08c295e80890baa559c4df2a21d8b289","observation_id":"1c6afe98-c908-4f7a-b777-9f1ce5a37824","resolution":{"observed_at":"2026-08-14T14:54:44.942622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.915392Z","title":"Gupta, Maxim Egorov, and Mykel J","venue":null,"work_id":"d4854fbb-4995-4934-8fc1-66fe87066b6e","year":2017},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.028507Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:1f05deab291fcf78283a552ec8da32340c57f974a871f83776c3e5d7ec0a89f9","observation_id":"a130423e-82d1-4f7a-b308-117e4156787b","resolution":{"observed_at":"2026-08-14T14:54:44.921896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.892187Z","title":"Opponent modeling in deep reinforcement learning","venue":null,"work_id":"f4d31bd0-f242-4845-94bb-4b2b80885435","year":2016},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.041530Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:e818c5caa0e2ee1a02d85b1270d5efefdc08399df1daf7e1a94f38c1c3814915","observation_id":"22556c48-a8d6-4b99-95ff-eafb6a13f8ba","resolution":{"observed_at":"2026-08-14T14:54:44.900238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.05587","last_updated":"2019-08-30T19:33:23Z","snapshot_observed_at":"2026-08-14T18:15:33.274352Z","submitted_at":"2018-10-12T15:54:05Z","title":"A Survey and Critique of Multiagent Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.05587","snapshot_observed_at":"2026-08-14T14:54:44.049340Z","title":"Is multiagent deep reinforcement learning the answer or the question? a brief survey","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.049340Z"},"links":{"cited_paper":"/paper/1810.05587","citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:53b671cfd9ba8516a023723f4c69ad2fa69218cb8a83a282d46dadfaf6697793","observation_id":"129480d0-e810-4143-adda-f77976f36055","resolution":{"observed_at":"2026-08-14T14:54:44.049340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.871512Z","title":null,"venue":null,"work_id":"30977c35-f8a8-4ca0-b3ba-85a9bf7f8a90","year":2019},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.059575Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:15d95dd4647db896bc1f39f75097b733a37e08c43e59426d3c78c2a75a3ad38e","observation_id":"abd0ce00-f827-4af1-bc49-f704efc88603","resolution":{"observed_at":"2026-08-14T14:54:44.877925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.07893","last_updated":"2018-04-09T06:38:13Z","snapshot_observed_at":"2026-08-14T20:01:19.898475Z","submitted_at":"2017-12-21T11:53:35Z","title":"A Deep Policy Inference Q-Network for Multi-Agent Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.07893","snapshot_observed_at":"2026-08-14T14:54:44.066304Z","title":"A deep policy inference q-network for multi-agent systems","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.066304Z"},"links":{"cited_paper":"/paper/1712.07893","citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:cfaa8c265d2ea3afd8c24f23e29684d83ec6a601056c1f78ccda22c8dccca2d8","observation_id":"04cbe614-582f-4f98-bc8a-fa3eb88473ee","resolution":{"observed_at":"2026-08-14T14:54:44.066304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.851329Z","title":"Actor-attention-critic for multi-agent reinforcement learning","venue":null,"work_id":"5cdb6990-40ef-4068-b5e8-42bf2a5ee8c9","year":2019},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.076673Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:1d3e205d1dd0071586f25a248f88d423db9cad058b36842f66311fa2a7a689c1","observation_id":"a10cb208-fce8-49c0-831a-ae2a06cf8f8d","resolution":{"observed_at":"2026-08-14T14:54:44.857945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.083614Z","title":"Categorical reparametrization with gumble-softmax","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.083614Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:9b5d3208085f218604148403cbbb7b0c407c5b50c946774d16b36b17055a0ea9","observation_id":"2b989619-573b-485b-a6a0-5c5e368f7a9e","resolution":{"observed_at":"2026-08-14T14:54:44.083614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.816543Z","title":"Social inﬂuence as intrinsic motivation for multi-agent deep reinforcement learning","venue":null,"work_id":"4a64a1d3-355b-4dbc-9901-412192f5e240","year":2019},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.089869Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:738705484b7f336309cfef4546928c16710be348fc0279de731ecfbb9cfe6331","observation_id":"da6d8119-f219-4ed5-9504-639efdc9fbbe","resolution":{"observed_at":"2026-08-14T14:54:44.823208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.795020Z","title":"Learning attentional communication for multi-agent cooperation","venue":null,"work_id":"af3f5478-b4cf-4a9b-9777-26ae688f615d","year":2018},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.096591Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:cd06db28cb683d83ae6deb89329c4acbdb92092f782b1caa19ece5732a2400b8","observation_id":"1fc2de41-4159-4a4a-a534-53c3c608b89b","resolution":{"observed_at":"2026-08-14T14:54:44.801844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.770990Z","title":"Reinforcement learning: A survey","venue":null,"work_id":"aaa40730-27ce-43a4-8dfb-cbf843ea4497","year":1996},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.105639Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:7d4bddfb5e36552c4efcf8f1fc09305b29afbbf87118ecd42688a031921ac03e","observation_id":"42ebaf7e-bf16-4354-93a7-4a234ef18050","resolution":{"observed_at":"2026-08-14T14:54:44.777650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-14T14:54:44.111235Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.111235Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:e57f9626582ead847f9a87b9f39ed614892101a99242d0e14353a710bf340f01","observation_id":"c93dc2f8-bc49-4efe-afde-4e7b6ccce3df","resolution":{"observed_at":"2026-08-14T14:54:44.111235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11180","last_updated":"2020-04-14T18:11:24Z","snapshot_observed_at":"2026-08-14T16:02:18.784747Z","submitted_at":"2019-07-25T16:39:27Z","title":"Google Research Football: A Novel Reinforcement Learning Environment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11180","snapshot_observed_at":"2026-08-14T14:54:44.120179Z","title":"Google research football: A novel reinforcement learning environment","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.120179Z"},"links":{"cited_paper":"/paper/1907.11180","citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:1e0ea2f08ccc9f654416b241fade70a85ad4abbd105fadc189c8f5f739d3d620","observation_id":"16709973-0c26-4dc5-80e1-a0517f3bb0ad","resolution":{"observed_at":"2026-08-14T14:54:44.120179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.07182","last_updated":"2017-03-05T21:40:51Z","snapshot_observed_at":"2026-08-14T21:24:17.940465Z","submitted_at":"2016-12-21T15:27:06Z","title":"Multi-Agent Cooperation and the Emergence of (Natural) Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.07182","snapshot_observed_at":"2026-08-14T14:54:44.128708Z","title":"Multi-agent cooperation and the emergence of (natural) language","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.128708Z"},"links":{"cited_paper":"/paper/1612.07182","citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:bd4fb51787074b152d33124c54f8fb57b70e22cf0cba39d39a8f796f520e60f6","observation_id":"62416596-1eb8-4359-8097-1aa993049d47","resolution":{"observed_at":"2026-08-14T14:54:44.128708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-14T14:54:44.135861Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.135861Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:c518b277d5369011f788aa71a375fae542629d0bf7c33d88e1b9de12fe99245c","observation_id":"3e95b0af-57b3-4e7d-be15-dd3959467b37","resolution":{"observed_at":"2026-08-14T14:54:44.135861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.144177Z","title":"Markov games as a framework for multi-agent reinforcement learning","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.144177Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:b6422d200fb093c9426c2f51210d1d5896a9e71539e43b00f1e4c5452e8b97ca","observation_id":"befe7fff-7d03-473c-9326-e6b6a947ec6e","resolution":{"observed_at":"2026-08-14T14:54:44.144177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.731914Z","title":"Multi- agent actor-critic for mixed cooperative-competitive environments","venue":null,"work_id":"d71790dc-a81b-4dc3-8273-15d9cb1017b8","year":2017},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.152051Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:aa1be877a706b3911a26ea82845649a3d296f6fbdc46ddb85b6ea18699b0bbce","observation_id":"5f1afdca-1cc3-471a-93f9-dd20ffda956b","resolution":{"observed_at":"2026-08-14T14:54:44.740842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.710418Z","title":"Maven: Multi- agent variational exploration","venue":null,"work_id":"ff233142-93ec-46d6-ab62-bacb1cf883a9","year":2019},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.158250Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:4305e7530c64341690bb68017260e77134654bdcb6169f7a34a916fc0f2e1c3d","observation_id":"6e379780-130d-461f-84e0-42e43404be60","resolution":{"observed_at":"2026-08-14T14:54:44.716233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.691553Z","title":"Emergence of grounded compositional language in multi- agent populations","venue":null,"work_id":"b4b8fd99-b12a-44a1-8726-18a5698aad7b","year":2018},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.163546Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:a28b5640698895245169c48c760f1056fdbd4e075f98e887ebff795ddcc926ac","observation_id":"1096e428-e54c-48df-b0e0-ae19377565ef","resolution":{"observed_at":"2026-08-14T14:54:44.697519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.667255Z","title":"Rectiﬁed linear units improve restricted boltzmann machines","venue":null,"work_id":"57b1d7a3-fc95-42bf-810d-ef49bf8643ba","year":2010},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.169332Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:0e3f9b747d9ebb9c41de2215cb13805b3b4f9f4f5179f93c6edcbf62f231c0d8","observation_id":"ed03b82e-b625-43bb-91d0-25e61f5229d0","resolution":{"observed_at":"2026-08-14T14:54:44.672750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.644854Z","title":"Qmix: Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":"7b94c091-7623-4f06-9a7b-8d056d034eb1","year":2018},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.176891Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:acf649e7df5ee9caf77aad68b82228678cf566ff1d4983ed5709647795abe82a","observation_id":"8e72d5c7-6e71-4109-a574-adae660e8898","resolution":{"observed_at":"2026-08-14T14:54:44.652083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.622112Z","title":"Opponent modeling in real-time strategy games","venue":null,"work_id":"a242e9da-24b5-4413-8c48-006a8d877407","year":2007},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.185152Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:e03a7b0f5f404da4cb8b77eeb3f31827c2560a6e21960be6e37b13aece13df2f","observation_id":"0b089523-2274-4f6f-829a-0aaad85d73a8","resolution":{"observed_at":"2026-08-14T14:54:44.629619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.191177Z","title":"Dropout: a simple way to prevent neural networks from overﬁtting","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.191177Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:5a5d4b2f115deb5d36aed02fb6f7e1cb14cc073504cb83a8a241f03fb4be229a","observation_id":"8fdc0df3-96d1-4a4b-bee7-de972d2b003d","resolution":{"observed_at":"2026-08-14T14:54:44.191177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.571313Z","title":"Learning to share and hide intentions using information regularization","venue":null,"work_id":"21dcc4ed-f298-465c-b32f-169f3746cc1a","year":2018},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.200017Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:d44824f3613bef8b7e0c3e479eaf17fc695b145102f38fd21a76f4e4095e4665","observation_id":"e52cd374-21f5-4329-bc95-5d70881be3f3","resolution":{"observed_at":"2026-08-14T14:54:44.578301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.548668Z","title":"On the theory of the brownian motion","venue":null,"work_id":"c20661eb-7ef5-470f-82bd-0fad6f30eb51","year":1930},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.206855Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:795c02be2fd837a12c1b0a9f445309cf31885288fe3f26e190edeed5201ddcb0","observation_id":"0d2c43a1-ebe2-4d31-b065-4e220b25a4e7","resolution":{"observed_at":"2026-08-14T14:54:44.555735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:54:44.523373Z","title":"MADDPG + policy mask","venue":null,"work_id":"2c7a4474-8493-42a7-a6ce-9f4ebaff7efa","year":1992},"citing_paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T14:54:44.217833Z"},"links":{"citing_paper":"/paper/1908.02269"},"observation_digest":"sha256:a4eeca6d64cb08e56ce04b00904b9e41fec0210d4a74ad520d620103e0ebf4c5","observation_id":"54851eca-7b0a-4646-859b-6c282148b864","resolution":{"observed_at":"2026-08-14T14:54:44.533474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.02269","last_updated":"2020-11-09T16:30:41Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T14:46:36.761000Z","submitted_at":"2019-08-06T17:48:17Z","title":"Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:1908.02269."}