{"as_of":"2026-08-10T05:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6bf43cbac61718f1aade27515d27cfdbd8e91c9a78578b55b9e25c956d77fac3","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:36:12.843668Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19523/citation-record","integrity":"/paper/2607.19523/integrity","json":"/paper/2607.19523/citation-record.json","paper":"/paper/2607.19523"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.19457","last_updated":"2026-02-14T11:42:30Z","snapshot_observed_at":"2026-08-06T03:52:41.836315Z","submitted_at":"2025-07-25T17:42:32Z","title":"GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19457","snapshot_observed_at":"2026-08-01T12:36:10.267086Z","title":"Gepa: Reflective prompt evolution can outperform reinforcement learning.arXiv preprint arXiv:2507.19457,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:10.267086Z"},"links":{"cited_paper":"/paper/2507.19457","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:ac37586a72e50511249176c9fb5117b6c768bf480e6f78e8de848132e1b5e524","observation_id":"afce5e30-3810-43fd-b616-0e2742d6513d","resolution":{"observed_at":"2026-08-01T12:36:10.267086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-01T12:36:10.939373Z","title":"D4rl: Datasets for deep data-driven reinforcement learning.arXiv preprint arXiv:2004.07219,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:10.939373Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:9ea8f60220a792c0ec2fe463a069dbf8d64c2e785b3b9b96e13a02c4d1e56618","observation_id":"0e6af7b0-3c11-4fed-be2a-8c01d6caec69","resolution":{"observed_at":"2026-08-01T12:36:10.939373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22992","last_updated":"2025-06-28T19:44:32Z","snapshot_observed_at":"2026-08-09T11:31:37.358797Z","submitted_at":"2025-06-28T19:44:32Z","title":"MARBLE: A Hard Benchmark for Multimodal Spatial Reasoning and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.22992","snapshot_observed_at":"2026-08-01T12:36:11.078426Z","title":"Marble: A hard benchmark for multimodal spatial reasoning and planning.arXiv preprint arXiv:2506.22992,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:11.078426Z"},"links":{"cited_paper":"/paper/2506.22992","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:885f1fe9891a189da314fdf95c024588856bf4059a9a1543db22144e4cf402e4","observation_id":"f89f6fef-cf17-449d-b882-b044d01dd1b0","resolution":{"observed_at":"2026-08-01T12:36:11.078426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06452","last_updated":"2024-02-19T14:39:07Z","snapshot_observed_at":"2026-07-29T18:39:02.141391Z","submitted_at":"2023-10-10T09:25:44Z","title":"Understanding the Effects of RLHF on LLM Generalisation and Diversity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06452","snapshot_observed_at":"2026-08-01T12:36:11.245333Z","title":"Understanding the effects of rlhf on llm generalisation and diversity.arXiv preprint arXiv:2310.06452,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:11.245333Z"},"links":{"cited_paper":"/paper/2310.06452","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:bf926ad8175bf835f5c1e5dce468d0cb03cbd2bda6a5b9c38405a5da7db2b46c","observation_id":"c829a6af-1648-4c32-b739-84b78005ebf6","resolution":{"observed_at":"2026-08-01T12:36:11.245333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-01T12:36:11.470843Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems.arXiv preprint arXiv:2005.01643,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:11.470843Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:1dfc7ea566b06f8fa553c22614b792ed7cd1fb6eaeab0172ae4a01341654fa81","observation_id":"16923aae-33af-4e0a-b388-7133ba93204c","resolution":{"observed_at":"2026-08-01T12:36:11.470843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:36:11.887984Z","title":"One fish, two fish, but not the whole sea: Alignment reduces language models’ conceptual diversity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:11.887984Z"},"links":{"citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:87e9662ad35d9aef33685befa126feabe72f538bb38db41ec88835c96fa436c0","observation_id":"f0ece43e-d7be-4773-9af5-a08a25aaca6a","resolution":{"observed_at":"2026-08-01T12:36:11.887984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:36:12.113398Z","title":"Do llm agents have regret? a case study in online learning and games.arXiv preprint arXiv:2403.16843,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.113398Z"},"links":{"citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:f80cb5e8d7ab44f091ce38bc918ccf8ed9c96aaf184ec0b7490f27bdafae2cee","observation_id":"fd6c8850-31ea-49cf-8869-08b1b3f52da3","resolution":{"observed_at":"2026-08-01T12:36:12.113398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18160","last_updated":"2025-04-25T08:16:56Z","snapshot_observed_at":"2026-08-07T15:59:17.704558Z","submitted_at":"2025-04-25T08:16:56Z","title":"Offline Learning of Controllable Diverse Behaviors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18160","snapshot_observed_at":"2026-08-01T12:36:12.177892Z","title":"Offline learning of controllable diverse behaviors.arXiv preprint arXiv:2504.18160,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.177892Z"},"links":{"cited_paper":"/paper/2504.18160","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:3adb8fb8a2a48c4be79a989f533765640d094f3fdb1b1aa6ebe548ce29fb6120","observation_id":"62ae9cd7-9a10-4c82-ba49-9080037c237c","resolution":{"observed_at":"2026-08-01T12:36:12.177892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07796","last_updated":"2024-07-11T03:46:35Z","snapshot_observed_at":"2026-08-10T00:35:57.510236Z","submitted_at":"2024-07-10T16:14:34Z","title":"Evaluating Large Language Models with Grid-Based Game Competitions: An Extensible LLM Benchmark and Leaderboard","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07796","snapshot_observed_at":"2026-08-01T12:36:12.257522Z","title":"Evaluating large language models with grid-based game competitions: An extensible LLM benchmark and leaderboard.arXiv preprint arXiv:2407.07796,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.257522Z"},"links":{"cited_paper":"/paper/2407.07796","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:feb4748333ebfd835537b9c5f0c1b650f299fdbedfb07d66eb77edfd5dc4c540","observation_id":"347ec6d5-84a2-47d0-b02c-4a838aa54c0a","resolution":{"observed_at":"2026-08-01T12:36:12.257522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:36:12.357853Z","title":"Chessqa: Evaluating large language models for chess understanding.arXiv preprint arXiv:2510.23948,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.357853Z"},"links":{"citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:a7fd702d158750712f8daa6e6a1edd7150ec73a01aa4a71804d4fad7e143bb8a","observation_id":"362703cf-7d95-4f44-b663-1f445fe8c7fa","resolution":{"observed_at":"2026-08-01T12:36:12.357853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08755","last_updated":"2025-09-10T16:46:11Z","snapshot_observed_at":"2026-08-04T20:10:08.337431Z","submitted_at":"2025-09-10T16:46:11Z","title":"AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08755","snapshot_observed_at":"2026-08-01T12:36:12.420962Z","title":"Agentgym-rl: Training llm agents for long-horizon decision making through multi-turn reinforcement learning.arXiv preprint arXiv:2509.08755,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.420962Z"},"links":{"cited_paper":"/paper/2509.08755","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:7db67e1a1cdd7eda7e9d75f8e695b2d26d67c51ca1927557efa265ff40f885f5","observation_id":"1934517f-cac9-4a64-9ac3-74851e6dce68","resolution":{"observed_at":"2026-08-01T12:36:12.420962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T12:36:12.503627Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.503627Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:2ec4a5dc6abbffbc7350a789bb69b01a000d3e03b97efc8e31e9dbf4f06dd38c","observation_id":"f5e532c6-4ab3-43d1-9178-076df8ed43f8","resolution":{"observed_at":"2026-08-01T12:36:12.503627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17476","last_updated":"2024-05-30T17:15:09Z","snapshot_observed_at":"2026-07-06T18:20:48.343830Z","submitted_at":"2024-05-24T04:56:39Z","title":"How to Leverage Diverse Demonstrations in Offline Imitation Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17476","snapshot_observed_at":"2026-08-01T12:36:12.597503Z","title":"How to leverage diverse demonstrations in offline imitation learning.arXiv preprint arXiv:2405.17476,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.597503Z"},"links":{"cited_paper":"/paper/2405.17476","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:afba1b18f047dba981f97b2121ee7d50d3945617cfbf2aa97dab67fceff15c3e","observation_id":"843f753f-d335-4f27-b7c2-eeeffabd27cc","resolution":{"observed_at":"2026-08-01T12:36:12.597503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18949","last_updated":"2025-05-25T02:52:35Z","snapshot_observed_at":"2026-08-07T14:20:36.717932Z","submitted_at":"2025-05-25T02:52:35Z","title":"The Price of Format: Diversity Collapse in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18949","snapshot_observed_at":"2026-08-01T12:36:12.681644Z","title":"The price of format: Diversity collapse in llms.arXiv preprint arXiv:2505.18949,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.681644Z"},"links":{"cited_paper":"/paper/2505.18949","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:55e33ccab80ef189ce7ac16b75566ea3b8d10faf5d29f2cc7a6ae813a93178ab","observation_id":"546ef691-ef62-4252-9512-6728fa6add49","resolution":{"observed_at":"2026-08-01T12:36:12.681644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01058","last_updated":"2026-05-28T06:23:31Z","snapshot_observed_at":"2026-08-03T05:52:36.155371Z","submitted_at":"2026-02-01T06:53:45Z","title":"Good SFT Optimizes for SFT, Better SFT Prepares for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01058","snapshot_observed_at":"2026-08-01T12:36:12.755535Z","title":"Good sft optimizes for sft, better sft prepares for reinforcement learning.arXiv preprint arXiv:2602.01058,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.755535Z"},"links":{"cited_paper":"/paper/2602.01058","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:4839f02260e003bbd97f0dc774230669bc709cd3de20e992e5217609fdfdaa93","observation_id":"dd8517d9-118c-4693-b629-f7ae8f4bfd2a","resolution":{"observed_at":"2026-08-01T12:36:12.755535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:36:12.843668Z","title":"move\": <action_label>}</action> The JSON key must be","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.843668Z"},"links":{"citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:43b01f39a8fe5dfdc548db5f66118d50e751ebc77aefe094dd95a5856b8119e6","observation_id":"2e02c846-5d54-4d8e-a633-59e6e566deef","resolution":{"observed_at":"2026-08-01T12:36:12.843668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10751","last_updated":"2022-05-11T03:17:44Z","snapshot_observed_at":"2026-08-09T16:07:52.623918Z","submitted_at":"2021-12-20T18:55:16Z","title":"RvS: What is Essential for Offline RL via Supervised Learning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10751","snapshot_observed_at":"2026-08-01T12:36:10.784085Z","title":"Rvs: What is essential for offline rl via supervised learning?arXiv preprint arXiv:2112.10751,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":1978,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:10.784085Z"},"links":{"cited_paper":"/paper/2112.10751","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:44298fefb90245e1823b2d701e821c532f5c13d80b30724b278be0db6315eee8","observation_id":"e8cb85e9-1b8f-4505-bafe-81e03d552cd5","resolution":{"observed_at":"2026-08-01T12:36:10.784085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16673","last_updated":"2025-04-05T08:56:18Z","snapshot_observed_at":"2026-08-09T16:32:46.385866Z","submitted_at":"2024-08-29T16:21:00Z","title":"Preserving Diversity in Supervised Fine-Tuning of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16673","snapshot_observed_at":"2026-08-01T12:36:11.617634Z","title":"Preserv- ing diversity in supervised fine-tuning of large language models.arXiv preprint arXiv:2408.16673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:11.617634Z"},"links":{"cited_paper":"/paper/2408.16673","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:b9806b7f32b389b4dbc95104fb01ee3fb3cf94eb44b1823d48af7e8a708a2829","observation_id":"f85fdf8e-bbee-47d3-9028-4bcd64ee1471","resolution":{"observed_at":"2026-08-01T12:36:11.617634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:36:10.487813Z","title":"Sed-sft: Selectively encouraging diversity in supervised fine-tuning.arXiv preprint arXiv:2602.07464,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:10.487813Z"},"links":{"citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:e1fe79eef4bc85a6223fe3fdc07330b978bb39570bda5dd57c6cfab1702b8fc3","observation_id":"d3c6f4a9-5b75-4101-be29-bcf99b26ebca","resolution":{"observed_at":"2026-08-01T12:36:10.487813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:36:12.023276Z","title":"Attributing mode collapse in the fine-tuning of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:12.023276Z"},"links":{"citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:cc5a02e71c293aed896c3b0b00ecc77da8642aeb507472798064824e2e4b381e","observation_id":"57a024b7-7231-4e20-8eba-43a32a9c4749","resolution":{"observed_at":"2026-08-01T12:36:12.023276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:36:11.356713Z","title":"Llm chess: Benchmarking reasoning and instruction- following in llms through chess.arXiv preprint arXiv:2512.01992,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:11.356713Z"},"links":{"citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:710b3d12417f2deb9957003835a9106f4492f265dc9affe29ced9a42e34b1385","observation_id":"cc0bde1d-6aab-476d-853a-41364ac8003d","resolution":{"observed_at":"2026-08-01T12:36:11.356713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10209","last_updated":"2025-06-11T22:03:19Z","snapshot_observed_at":"2026-08-07T04:29:32.419935Z","submitted_at":"2025-06-11T22:03:19Z","title":"TTT-Bench: A Benchmark for Evaluating Reasoning Ability with Simple and Novel Tic-Tac-Toe-style Games","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10209","snapshot_observed_at":"2026-08-01T12:36:11.742193Z","title":"Ttt-bench: A benchmark for evaluating reasoning ability with simple and novel tic-tac-toe-style games.arXiv preprint arXiv:2506.10209,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:11.742193Z"},"links":{"cited_paper":"/paper/2506.10209","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:88b64926d7998d9e13394cca4a6e762c7b9880cea260fc06d7cabf84fab9025b","observation_id":"8d203cf8-07a4-4a66-a48a-7c24f94d052e","resolution":{"observed_at":"2026-08-01T12:36:11.742193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-01T12:36:10.373328Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback.arXiv preprint arXiv:2204.05862,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:10.373328Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:b42bd23d4f65bb45b5f70aa1b0aaaea3e9b927dfe942662416bfcf49eb7e8cc9","observation_id":"e6b0c72c-0b3c-4188-9c25-0e11b169e95f","resolution":{"observed_at":"2026-08-01T12:36:10.373328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03368","last_updated":"2025-08-18T09:53:16Z","snapshot_observed_at":"2026-08-07T21:23:20.919037Z","submitted_at":"2025-08-05T12:15:59Z","title":"Game Reasoning Arena: A Framework and Benchmark for Assessing Reasoning Capabilities of Large Language Models via Game Play","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03368","snapshot_observed_at":"2026-08-01T12:36:10.643992Z","title":"Game reasoning arena: A framework and benchmark for assessing reasoning capabilities of large language models via game play.arXiv preprint arXiv:2508.03368,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T12:36:10.643992Z"},"links":{"cited_paper":"/paper/2508.03368","citing_paper":"/paper/2607.19523"},"observation_digest":"sha256:428490b46f231b6535b476b3d0136e9c764ab279971f33369e953c83224b0309","observation_id":"3c5fc3b4-ae13-44a5-94e6-d153a273df12","resolution":{"observed_at":"2026-08-01T12:36:10.643992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19523","last_updated":"2026-07-21T19:10:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T11:26:29.786981Z","submitted_at":"2026-07-21T19:10:38Z","title":"When Reasoning Narrows the Move: Diversity Collapse in LLM Game Play"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2607.19523."}