{"as_of":"2026-08-10T04:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:261bc358018bed6929fcaeb3b27919296cb1d28237c970d62a92e9d7d6e25031","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:57:01.718096Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:00:53.877395Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T07:32:09.425973Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06060","snapshot_observed_at":"2026-08-07T11:00:53.877395Z","title":"Training language models for social deduction with multi-agent reinforcement learning.arXiv preprint arXiv:2502.06060, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06366","last_updated":"2025-06-12T10:22:01Z","snapshot_observed_at":"2026-08-09T20:26:32.963470Z","submitted_at":"2025-06-04T08:12:32Z","title":"AI Agent Behavioral Science","version":3},"reference_index":128,"source":"pdf_text","source_observed_at":"2026-08-07T11:00:53.877395Z"},"links":{"cited_paper":"/paper/2502.06060","citing_paper":"/paper/2506.06366"},"observation_digest":"sha256:a2176320d4383bcfdfca9438c3988b66a2466ea1dd494d9ac85ed9b98f75ff11","observation_id":"6f4b43c0-30b2-4d6a-aa41-a68e9ba6cd59","resolution":{"observed_at":"2026-08-07T11:00:53.877395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06060","snapshot_observed_at":"2026-08-07T05:41:58.121890Z","title":"Training language models for social deduction with multi-agent reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07468","last_updated":"2026-07-06T07:31:35Z","snapshot_observed_at":"2026-08-07T05:30:38.669027Z","submitted_at":"2025-06-09T06:35:12Z","title":"Chasing Moving Targets with Online Self-Play Reinforcement Learning for Safer Language Models","version":4},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:58.121890Z"},"links":{"cited_paper":"/paper/2502.06060","citing_paper":"/paper/2506.07468"},"observation_digest":"sha256:4464b091696bbe73f18b21dcd2361e548898f1153082a71485b8eaa38d9550a8","observation_id":"6ed57130-317f-43e1-add1-ca4c61bd1a67","resolution":{"observed_at":"2026-08-07T05:41:58.121890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.06060","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06060","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Karen Liu, and Dorsa Sadigh","venue":null,"work_id":"7e2788f7-8b56-4a3f-bb7d-eea8b029a6d6","year":2025},"citing_paper":{"arxiv_id":"2506.17788","last_updated":"2026-04-10T15:38:19Z","snapshot_observed_at":"2026-08-03T00:01:47.746581Z","submitted_at":"2025-06-21T18:45:28Z","title":"Bayesian Social Deduction with Graph-Informed Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-19T07:27:20.027179Z"},"links":{"cited_paper":"/paper/2502.06060","citing_paper":"/paper/2506.17788"},"observation_digest":"sha256:5fd6b6492d71a29b92a6c42380557d097ef73406328c7d385f4877092835eb77","observation_id":"deb9a075-edd8-439d-a3ea-2abfb0e03a88","resolution":{"observed_at":"2026-05-19T07:32:09.427999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.06060","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06060","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Karen Liu, and Dorsa Sadigh","venue":null,"work_id":"7e2788f7-8b56-4a3f-bb7d-eea8b029a6d6","year":2025},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T09:47:47.051969Z"},"links":{"cited_paper":"/paper/2502.06060","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:5415d8c9ceb38b57a1a2ca8c5dcb5a4edb7650d06a94ff5e4cb48e683749154a","observation_id":"fb4baca6-46fd-4e13-ba7d-a435926ffbd3","resolution":{"observed_at":"2026-05-16T09:50:49.345480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06060","snapshot_observed_at":"2026-08-03T06:46:40.124769Z","title":"K., and Sadigh, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T06:46:40.124769Z"},"links":{"cited_paper":"/paper/2502.06060","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:476d3ddb3505caedfe5565bfb86e786d484910e5fcc5218c3f8826285f3685c8","observation_id":"5d7dd24d-003d-4756-b280-7027d65ebcb3","resolution":{"observed_at":"2026-08-03T06:46:40.124769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06060/citation-record","integrity":"/paper/2502.06060/integrity","json":"/paper/2502.06060/citation-record.json","paper":"/paper/2502.06060"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-08T16:57:01.572507Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.572507Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:a27417639ce8ab6543fa48a80410c3b93c9ce1d8b37930dd3d1ccd9dad01b8a8","observation_id":"c3a65100-2e0f-424c-889b-d3855b56bad2","resolution":{"observed_at":"2026-08-08T16:57:01.572507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"stable/2544265","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.155420Z","title":null,"venue":null,"work_id":"7f77087a-0bfe-49cd-911e-bc02fd2c5e91","year":2008},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.577352Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:4becd74df80b880222f2e8744cc8dee1a556600adc23bda9d66ef5682b40c628","observation_id":"82269cb0-6c43-4206-b60e-bb0349a54d42","resolution":{"observed_at":"2026-08-08T16:57:02.161295Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-08T16:57:01.581162Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.581162Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:dfc984d00a603be7f05bcb477e95456036d98358737fc3b4eff1631f089e48e0","observation_id":"d1411885-52ba-484b-9954-f2d1d1bc9662","resolution":{"observed_at":"2026-08-08T16:57:01.581162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2308.16017","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.055719Z","title":null,"venue":null,"work_id":"e418a437-9ce4-41c9-bcd0-46aeebc8a5eb","year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.585402Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:d85d0a70665cec92bcbec6cddfa29437d68df09b8bf7fd8a6cb238cfc6e39c44","observation_id":"803c69ef-361d-4977-b95c-e6f653a82a6c","resolution":{"observed_at":"2026-08-08T16:57:02.062627Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.443637Z","title":"Ho, Thomas L","venue":null,"work_id":"e15673fe-6687-49d9-b5e4-3ef432655487","year":2019},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.589375Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:b7371b003ade5a5b862621638afc5dd395358f5afe34847ae6ea53aecdcb0fe5","observation_id":"bb82cba9-8dc6-4512-afd3-3031fbd2d34a","resolution":{"observed_at":"2026-08-08T16:57:02.447577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.431034Z","title":null,"venue":null,"work_id":"525df916-9710-4cbf-83a0-2fb416b09040","year":2024},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.592853Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:718be527045db03ded8288826ff322641aedb8cfffcacd3a16450d9793da4cc9","observation_id":"94c093dc-24a3-4329-b144-fe9175949061","resolution":{"observed_at":"2026-08-08T16:57:02.435082Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16306","last_updated":"2024-07-23T09:00:03Z","snapshot_observed_at":"2026-08-10T01:49:12.025136Z","submitted_at":"2024-07-23T09:00:03Z","title":"Optimizing Robotic Manipulation with Decision-RWKV: A Recurrent Sequence Modeling Approach for Lifelong Learning","version":1},"cited_work":{"arxiv_id":"2407.16306","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.16306","snapshot_observed_at":"2026-08-08T16:57:01.901660Z","title":"Optimizing Robotic Manipulation with Decision-RWKV: A Recurrent Sequence Modeling Approach for Lifelong Learning","venue":"cs.RO","work_id":"8bf4a25c-488f-447c-8c7c-227ffae6ce0f","year":2024},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.596395Z"},"links":{"cited_paper":"/paper/2407.16306","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:835b3d29038c1b83e7e0d9145b96ad87d8e7f165a2fe49163afde0bfa8d658f1","observation_id":"a4a05442-3376-414f-8d4f-72ea7717feac","resolution":{"observed_at":"2026-08-08T16:57:01.906110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:01.600162Z","title":"Miller, Sasha Mitts, Adithya Renduchintala, Stephen Roller, Dirk Rowe, Weiyan Shi, Joe Spisak, Alexander Wei, David Wu, Hugh Zhang, and Markus Zijlstra","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.600162Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:1e1cc89277e72c7939593825406fea68123b9d7ccfcef254e699dbc5ca4d780a","observation_id":"e7b51152-717d-48c8-ab6f-73cf92841f4d","resolution":{"observed_at":"2026-08-08T16:57:01.600162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.cogpsych.2014.08.002","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:01.765737Z","title":"Frank and Noah D","venue":null,"work_id":"1be98fd9-d60f-4f09-98ba-cdb5ed63d1f0","year":2014},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.603404Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:1abbab510db9e828631944e23017a9ae3a1b799af322b58e6087d2e9c2d9b27a","observation_id":"1ed4ef97-699d-4132-8d05-361ebe8bf570","resolution":{"observed_at":"2026-08-08T16:57:01.770581Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:01.606357Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.606357Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:3a852f605106089272a7704dd9863c4078d5f789f89d8e373ccc383bbe2559ef","observation_id":"c59bec0d-5c7d-4c24-bccc-d42737c7cbe7","resolution":{"observed_at":"2026-08-08T16:57:01.606357Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.412245Z","title":null,"venue":null,"work_id":"b9f6dd70-f79d-4f85-a5e5-a77d1679fe8a","year":2017},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.609687Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:2a74f12e4387d0da651878f1c7dd9e45f9eecebced90b728fbef8d4b3c69635d","observation_id":"1e5ebcad-1ce4-46a6-8f6a-8bd5b423d22a","resolution":{"observed_at":"2026-08-08T16:57:02.416100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:01.613230Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.613230Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:8220fe428a53796367e0bdc3dc72cdc56b3d778f33c7c7f775c76d53ac59dfea","observation_id":"a762d21c-7fc4-418c-99c3-c0772f6901bd","resolution":{"observed_at":"2026-08-08T16:57:01.613230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.400808Z","title":"Other- Play","venue":null,"work_id":"c7155b02-63be-4e08-8c7b-b5a96496a92b","year":2020},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.616461Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:9d6e0bd2f5061822fe701d455e61229b6acffeabf32fee43f786a581abbd5508","observation_id":"fc7e3208-0a00-472b-894f-b98b816d5e20","resolution":{"observed_at":"2026-08-08T16:57:02.404647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.389726Z","title":null,"venue":null,"work_id":"7fd7bcab-06d1-48cd-8df7-3679d37bdf47","year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.619725Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:342b5eb2dd5c22b9f42672d7db441be15924344d99d5e7507d72455e882449cb","observation_id":"2f7442a0-b8fe-4c37-bea2-a9a0ce36215e","resolution":{"observed_at":"2026-08-08T16:57:02.393663Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08112","last_updated":"2025-05-21T23:53:51Z","snapshot_observed_at":"2026-08-09T17:26:39.051079Z","submitted_at":"2024-07-11T01:08:39Z","title":"How Well Can a Long Sequence Model Model Long Sequences? Comparing Architechtural Inductive Biases on Long-Context Abilities","version":3},"cited_work":{"arxiv_id":"2407.08112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.08112","snapshot_observed_at":"2026-08-08T16:57:01.886171Z","title":"How Well Can a Long Sequence Model Model Long Sequences? Comparing Architechtural Inductive Biases on Long-Context Abilities","venue":"cs.LG","work_id":"2147348b-6d56-4470-b4a7-095803df7414","year":2024},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.623014Z"},"links":{"cited_paper":"/paper/2407.08112","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:87b833d14ba2ee298d99647bb89e401338cfb2b65fc83d1fa2fa86ba5dc4ad53","observation_id":"d7d2303e-97d9-4ec2-946f-28fed295ec62","resolution":{"observed_at":"2026-08-08T16:57:01.890742Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.376554Z","title":null,"venue":null,"work_id":"b708299f-5c78-42dd-9026-8f73d7ae6ba0","year":2022},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.626493Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:4a9cef9f0e6da142c61de4fb7441b5779e2caaf2655a9e5cf395a62ce147aa0e","observation_id":"c50d80ce-5814-4147-a54b-62d404ea2b00","resolution":{"observed_at":"2026-08-08T16:57:02.381313Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.364780Z","title":null,"venue":null,"work_id":"069a3b35-9acd-43b0-ab01-be595291353e","year":2022},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.630031Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:7cc8073556c070b1a917f92b4c6c67b3d6a00f99ca91d93191198ff27969431c","observation_id":"bdcd4efd-7c2d-42bf-aa95-eef8ab8a9cf4","resolution":{"observed_at":"2026-08-08T16:57:02.368836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.353436Z","title":null,"venue":null,"work_id":"97239bc5-df82-4859-a883-441cbe73e6aa","year":2024},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.633097Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:f74eaf54a5027f8e00d5f0adcbf432bce71a01dbd2c537d763358614a05db2be","observation_id":"8d1c974c-6301-415b-bae0-1b9c816eb016","resolution":{"observed_at":"2026-08-08T16:57:02.357294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.01816","last_updated":"2022-01-05T20:54:10Z","snapshot_observed_at":"2026-08-09T15:51:11.185100Z","submitted_at":"2022-01-05T20:54:10Z","title":"Hidden Agenda: a Social Deduction Game with Diverse Learned Equilibria","version":1},"cited_work":{"arxiv_id":"2201.01816","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.01816","snapshot_observed_at":"2026-08-08T16:57:01.870028Z","title":"Hidden Agenda: a Social Deduction Game with Diverse Learned Equilibria","venue":"cs.AI","work_id":"ddd1b788-eff8-47cb-a3ff-263727361f68","year":2022},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.636494Z"},"links":{"cited_paper":"/paper/2201.01816","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:91f3a0c203f85363d31cbe56a522a944be4dfb15f3f97b6f24a050caad391332","observation_id":"d78b4802-27a3-4b01-8284-ce04436d6d68","resolution":{"observed_at":"2026-08-08T16:57:01.874532Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.341632Z","title":null,"venue":null,"work_id":"f3a5c031-5f31-4072-923a-4c52680439a1","year":2024},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.641080Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:00e2cb32508f874b3ff717d71f6398f247f95894ec8ddb4cd3f99e0306259519","observation_id":"b9fab916-f919-4763-9ae0-5c910b4b35ac","resolution":{"observed_at":"2026-08-08T16:57:02.345422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.329709Z","title":null,"venue":null,"work_id":"e63bea8c-087e-4145-88b1-ba7bfdafa7b7","year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.643930Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:813029bcb666a9a8386affe0fb0bf3dcfe2f3d1ece6038d9f63814485529a17d","observation_id":"3635e34f-e469-49e2-8704-34332322c219","resolution":{"observed_at":"2026-08-08T16:57:02.333846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.317358Z","title":null,"venue":null,"work_id":"78489c67-0f9c-4c84-9a96-f9cd38eba222","year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.647151Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:ab121dbb564e3c59f36a465da124cc3c944a0d8a837146eb3924d3eb697a2bbc","observation_id":"f49ff4b5-ac22-446d-8833-4c97c287a483","resolution":{"observed_at":"2026-08-08T16:57:02.321355Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.304951Z","title":null,"venue":null,"work_id":"2e3f42ef-e798-41d7-a741-c26b67d15bdb","year":2017},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.650590Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:833324082f4849a47f301f8c788dee3b724fdaf95ad61ae72336fbe1b1789ec7","observation_id":"5f7ae03b-e11f-4eee-93b8-a7beb62a043e","resolution":{"observed_at":"2026-08-08T16:57:02.308825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:01.653388Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.653388Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:4d600a4217fd7ca73f9d9ed4873ba40fa9345a6f97042b35999ad0230746e510","observation_id":"2b224264-2c23-4853-b5f8-c2f8c8b868a4","resolution":{"observed_at":"2026-08-08T16:57:01.653388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.293137Z","title":null,"venue":null,"work_id":"2053956e-b945-400f-8e8a-f6f544bff215","year":2022},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.656478Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:0b6bb773915f6cc244c08ac4bbbd4967ff6c4db22cfd7fe91658cba421071aad","observation_id":"3995a771-aa8a-4de3-81db-cc6c6b24386f","resolution":{"observed_at":"2026-08-08T16:57:02.297187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00077","last_updated":"2021-06-30T19:59:11Z","snapshot_observed_at":"2026-07-06T11:24:46.448222Z","submitted_at":"2021-06-30T19:59:11Z","title":"Learning to communicate about shared procedural abstractions","version":1},"cited_work":{"arxiv_id":"2107.00077","doi":null,"metadata_source":"pith","pith_arxiv_id":"2107.00077","snapshot_observed_at":"2026-08-08T16:57:01.853028Z","title":"Learning to communicate about shared procedural abstractions","venue":"cs.CL","work_id":"126b8a49-28ce-4715-aca6-892406f45423","year":2021},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.659710Z"},"links":{"cited_paper":"/paper/2107.00077","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:a77f27eb9329228b613e3919d0bd720b935283a50a5597319fd7eb96b0aee73a","observation_id":"a42f230c-1963-4977-9d4d-f9e96780ac98","resolution":{"observed_at":"2026-08-08T16:57:01.858399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.280901Z","title":null,"venue":null,"work_id":"c54ae9f5-9d4d-4a9b-aef8-d499a26d24dc","year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.663363Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:100ac13cd6d1f3cf2f2fc57f9beb5b5d47a9243716da65e96d6c4a89a6462918","observation_id":"2661ece3-9c85-4199-9481-737b0e06edeb","resolution":{"observed_at":"2026-08-08T16:57:02.285251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-08T16:57:01.666917Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.666917Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:dcf4065af2d042fd428c3cecd7a19f16ef9554eb710f7265e9666ac11c784b2c","observation_id":"2fa00c6e-339e-46ec-8bd5-6bd3832d717e","resolution":{"observed_at":"2026-08-08T16:57:01.666917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.269395Z","title":"O’Brien, Carrie J","venue":null,"work_id":"7fefc8db-006a-4cb4-83e8-4c7af9b332c6","year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.670410Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:aa7eccd2cac38c88890d970e3aafcad4908fa5f3aa66e0076851c6fb702ac998","observation_id":"8b0df138-354e-4b88-984c-e67ba61d28ff","resolution":{"observed_at":"2026-08-08T16:57:02.273508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:01.673484Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.673484Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:864206151dbcf138b5f98bdc5282ba4b95b0aa8694fe8af32d734c617fc5078d","observation_id":"6edb8572-601d-4e33-a15a-ab35cc3a17dd","resolution":{"observed_at":"2026-08-08T16:57:01.673484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.250467Z","title":null,"venue":null,"work_id":"1d8a1180-4ad1-4806-ad54-1b3cc1f36969","year":2024},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.676803Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:87dae88922806c0ad8788ae6c2ceac296ad15ad8fb7bbbbc72596ae4881cafd0","observation_id":"5e912628-25be-47fa-a17c-6dcebc2e7e29","resolution":{"observed_at":"2026-08-08T16:57:02.254440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:01.680226Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.680226Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:d795b92bcd3118521dde4e166d8bdffedb76a3560c1b750ed49032ce891942c4","observation_id":"493521fc-d916-4604-ba17-648c2501faa0","resolution":{"observed_at":"2026-08-08T16:57:01.680226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14763","last_updated":"2023-05-24T06:14:31Z","snapshot_observed_at":"2026-07-06T15:32:14.701994Z","submitted_at":"2023-05-24T06:14:31Z","title":"Clever Hans or Neural Theory of Mind? Stress Testing Social Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14763","snapshot_observed_at":"2026-08-08T16:57:01.687133Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.687133Z"},"links":{"cited_paper":"/paper/2305.14763","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:318828329b8ab0133af4f94d16873799e1c3dc7caba5901edd7aec475c900745","observation_id":"2d97236c-f11e-449b-a795-6bae400c00d6","resolution":{"observed_at":"2026-08-08T16:57:01.687133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12397","last_updated":"2023-10-19T00:56:37Z","snapshot_observed_at":"2026-08-09T14:57:22.589761Z","submitted_at":"2023-10-19T00:56:37Z","title":"GPT-4 Doesn't Know It's Wrong: An Analysis of Iterative Prompting for Reasoning Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12397","snapshot_observed_at":"2026-08-08T16:57:01.690429Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.690429Z"},"links":{"cited_paper":"/paper/2310.12397","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:8fb5e0e7fe3f7e201596ab4fde55a6c107b3cd9abe0ce8df558894a5f5ee8f46","observation_id":"5d064cd7-dda9-4876-b173-ef880458fcdb","resolution":{"observed_at":"2026-08-08T16:57:01.690429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-08T16:57:01.694241Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.694241Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:019e5e5175a9577a49e4ccbd3fb81bfea3ea3c7ac5f2bff9db18f27af97ed9a6","observation_id":"19451257-c0e9-4641-92d3-31179d4a4e02","resolution":{"observed_at":"2026-08-08T16:57:01.694241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.231227Z","title":null,"venue":null,"work_id":"43fabfd4-114e-4889-8507-9a596b1ec427","year":2019},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.697776Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:cfd4df941bedbbe5fa63f23f65ebd12cc4a5f03124ab9b7936022bc2c34446c5","observation_id":"a32063cf-a45b-4d49-b935-53e29b1ad566","resolution":{"observed_at":"2026-08-08T16:57:02.235261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.219250Z","title":null,"venue":null,"work_id":"558ba597-367d-42b0-ae7e-8dfa4c804ebf","year":null},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.700924Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:0c120b8e4e06a87f55f69f0fbe3d3c2fb505f0c8172d897e35732faf256a11c3","observation_id":"a8d5c4cb-100f-4c6b-be19-372bff2584bb","resolution":{"observed_at":"2026-08-08T16:57:02.223236Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-07T08:29:46.650400Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-08T16:57:01.707442Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.707442Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:9ab053da649ebaf876c75513c22160e9ed32924e1b28296e953e88884db125ae","observation_id":"6a85906f-9f91-4430-a8e7-fd65d033e350","resolution":{"observed_at":"2026-08-08T16:57:01.707442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-07T08:02:34.857823Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-08T16:57:01.710953Z","title":"elimination cooldown","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.710953Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:d4b388063f74bf60fc05897761c5a74335823e217ea2d260f0b673a2af24249c","observation_id":"d3543e8b-a77b-4390-bea8-73c7e09aeff4","resolution":{"observed_at":"2026-08-08T16:57:01.710953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.181486Z","title":"wait” in a room until something changes in the environment, or “go","venue":null,"work_id":"34be6634-61d7-4279-94ad-de8a150cd84a","year":null},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.718096Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:e28bf26760c64069e2aa5e5fdb8a703bc71baca3d301533379cc4e67fd700af0","observation_id":"7c0458b4-6fb2-4a7d-b06f-00ede8fca473","resolution":{"observed_at":"2026-08-08T16:57:02.185947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.193616Z","title":null,"venue":null,"work_id":"5dbce6dd-1b00-439b-ac15-2eda5ca440cf","year":null},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.714731Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:009984effcddeca93883b09b07566605b209ca5b74ee7b18450648014a52b851","observation_id":"7f886fcd-e415-4c2d-8fdb-38584b05a71a","resolution":{"observed_at":"2026-08-08T16:57:02.197996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-08T16:57:01.683745Z","title":"arXiv:1707.06347 [cs.LG]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.683745Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:18e1036fb9d8334840a3fd6689f872d676cc251f3d79a845165db23762b27c4b","observation_id":"baddf2b3-91c9-4f54-8480-39f1a8382b7b","resolution":{"observed_at":"2026-08-08T16:57:01.683745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:57:02.207082Z","title":"In Advances in Neural Information Processing Systems (NeurIPS)","venue":null,"work_id":"4371f45b-9c7c-447b-b7fb-4e56909a6e5e","year":null},"citing_paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T16:57:01.704144Z"},"links":{"citing_paper":"/paper/2502.06060"},"observation_digest":"sha256:50f2b3946732ab3707c0dce77e0838439e298ac50740248b11069c81d4aa0af2","observation_id":"d16c14f6-979f-4cee-8499-8609add9293b","resolution":{"observed_at":"2026-08-08T16:57:02.211287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.06060","last_updated":"2025-02-09T22:44:45Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T16:50:28.818664Z","submitted_at":"2025-02-09T22:44:45Z","title":"Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":30,"verified_exact":6,"verified_fuzzy":5},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 5 inbound Pith citation observations for arXiv:2502.06060."}