{"as_of":"2026-08-23T04:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:04a359b0436382fcd0684be1def8e743a06143df94c184d0f3454f21179e148e","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:56:09.735750Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:45:52.375209Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19506","snapshot_observed_at":"2026-08-03T16:45:52.375209Z","title":"arXiv preprint arXiv:2508.19506 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28947","last_updated":"2026-07-31T02:05:45Z","snapshot_observed_at":"2026-08-17T03:28:09.745516Z","submitted_at":"2026-07-31T02:05:45Z","title":"Overcoming the Weakest-Link Effect in LLM-Driven Program Optimization via Heterogeneous Edit Recombination","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-03T16:45:52.375209Z"},"links":{"cited_paper":"/paper/2508.19506","citing_paper":"/paper/2607.28947"},"observation_digest":"sha256:ce9e6b1fe202b9e743b365ec159707df7aa2cf24470696bb114bb02b97af528e","observation_id":"94e76f4e-6b06-4507-96fc-82246f1f154f","resolution":{"observed_at":"2026-08-03T16:45:52.375209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.19506/citation-record","integrity":"/paper/2508.19506/integrity","json":"/paper/2508.19506/citation-record.json","paper":"/paper/2508.19506"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.05603","last_updated":"2023-07-10T20:39:41Z","snapshot_observed_at":"2026-08-20T13:31:47.445232Z","submitted_at":"2023-07-10T20:39:41Z","title":"Can You Improve My Code? Optimizing Programs with Local Search","version":1},"cited_work":{"arxiv_id":"2307.05603","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.05603","snapshot_observed_at":"2026-08-15T16:56:09.979629Z","title":"Can You Improve My Code? Optimizing Programs with Local Search","venue":"cs.SE","work_id":"b0543a80-40f1-48eb-a45b-f04a012660f8","year":2023},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.646710Z"},"links":{"cited_paper":"/paper/2307.05603","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:4d8a5451fdeb180522c34a13f2f762644c04329599b30cb4840030ab185908b1","observation_id":"faf427d6-891f-4f44-8b46-ce04328ad008","resolution":{"observed_at":"2026-08-15T16:56:09.985863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:10.049505Z","title":null,"venue":null,"work_id":"5814f7b6-fe9d-4e49-886d-980722d5f907","year":2023},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.680384Z"},"links":{"citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:47288c733da8192d2b7527d7e2025b2e696159cf68062499be64e612a798dd64","observation_id":"45a3fb05-ac12-4e63-93a2-053416057d0a","resolution":{"observed_at":"2026-08-15T16:56:10.054865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10314","last_updated":"2024-05-03T16:15:45Z","snapshot_observed_at":"2026-08-20T13:34:58.565436Z","submitted_at":"2024-01-18T18:52:06Z","title":"LangProp: A code optimization framework using Large Language Models applied to driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10314","snapshot_observed_at":"2026-08-15T16:56:09.684492Z","title":"F., and Hu, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.684492Z"},"links":{"cited_paper":"/paper/2401.10314","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:24a2c5a668d6cd31b52f3244c722fce7a2f76019229a136694073093a5f99893","observation_id":"3a5ff651-88e5-44e0-90d1-65417051c023","resolution":{"observed_at":"2026-08-15T16:56:09.684492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:10.033428Z","title":"Playing nethack with llms: Potential & limitations as zero-shot agents","venue":null,"work_id":"eb70408e-c502-4cf3-8607-beb989f9e970","year":2024},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.689855Z"},"links":{"citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:784425244530ce929afe22d225fd9bd563b76c9d90ec1c95c600c73f17a7cfc9","observation_id":"74670a62-f628-4c59-9872-9ef97c650d83","resolution":{"observed_at":"2026-08-15T16:56:10.038127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00374","last_updated":"2024-04-03T14:26:32Z","snapshot_observed_at":"2026-08-16T18:09:16.622658Z","submitted_at":"2019-03-01T15:40:19Z","title":"Model-Based Reinforcement Learning for Atari","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00374","snapshot_observed_at":"2026-08-15T16:56:09.694824Z","title":"H., Czechowski, K., Erhan, D., Finn, C., Koza- kowski, P., Levine, S., et al","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.694824Z"},"links":{"cited_paper":"/paper/1903.00374","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:45b85b3ff3ce4dc9f1c870883824d919973ad59589e86d1ea1eb0b5dea5b2a59","observation_id":"feb6d4d0-2d94-4a09-95b2-12fa7a79d204","resolution":{"observed_at":"2026-08-15T16:56:09.694824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:09.705039Z","title":"Crafting papers on machine learning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.705039Z"},"links":{"citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:0ffb6005d8f9404b8acd94d791c6c378bfb5ad1ea8ece424a75a16ec94f03c98","observation_id":"30326855-00f8-4aa6-9a74-8cf72b9b2357","resolution":{"observed_at":"2026-08-15T16:56:09.705039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T16:56:09.716423Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.716423Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:a2447bf991a013109b2a96e88032cd9cd53e9f63fd6da79b8bcee31db4ee6a2a","observation_id":"9da6f113-44cb-438d-8d40-7e6434ef3c06","resolution":{"observed_at":"2026-08-15T16:56:09.716423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14100","last_updated":"2023-03-24T16:06:11Z","snapshot_observed_at":"2026-08-16T15:45:34.452341Z","submitted_at":"2023-03-24T16:06:11Z","title":"Errors are Useful Prompts: Instruction Guided Task Programming with Verifier-Assisted Iterative Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14100","snapshot_observed_at":"2026-08-15T16:56:09.720002Z","title":"B., Darvish, K., Aspuru-Guzik, A., Shkurti, F., and Garg, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.720002Z"},"links":{"cited_paper":"/paper/2303.14100","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:5f43dc507ceefa82e9dd030aa96155e48a7f4fae155eca9606d535d61067b0b0","observation_id":"82602e5c-cd67-40d4-a674-33c4b194d83b","resolution":{"observed_at":"2026-08-15T16:56:09.720002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02582","last_updated":"2025-03-04T13:04:48Z","snapshot_observed_at":"2026-08-20T14:11:40.892346Z","submitted_at":"2025-03-04T13:04:48Z","title":"Playing games with Large language models: Randomness and strategy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02582","snapshot_observed_at":"2026-08-15T16:56:09.723764Z","title":"and Walsh, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.723764Z"},"links":{"cited_paper":"/paper/2503.02582","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:348267797777927b685120be4288033f46fe9ce7370815e2130e1e47386981df","observation_id":"64013453-4c08-4135-aea7-d53296b57965","resolution":{"observed_at":"2026-08-15T16:56:09.723764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:10.010873Z","title":"S., Wei, Y ., and Zhang, L","venue":null,"work_id":"41b4bf8b-57ab-4443-a2db-ae0a99503a52","year":2023},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.731775Z"},"links":{"citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:96f55f3d74861d396355fcf271572498614010609d408e485834a8169694d98e","observation_id":"95e97c33-4a92-41de-8b97-01c23c47cff5","resolution":{"observed_at":"2026-08-15T16:56:10.016069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:09.996038Z","title":"Atari Game Setup Pong In Pong, the player controls a paddle on the right side of the screen to deflect the ball into the enemy’s goal","venue":null,"work_id":"49698d37-0d50-468c-8598-69318f3ab59b","year":2025},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.735750Z"},"links":{"citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:e691858f7e5b306f11e7ea5ce70f2f7a752e2f430f9222d498a1896913e13efb","observation_id":"f557ce97-98b1-400b-a41b-da19ba84e38c","resolution":{"observed_at":"2026-08-15T16:56:10.001049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:09.708840Z","title":"Mnih, V ., Kavukcuoglu, K., Silver, D., Graves, A., Antonoglou, I., Wierstra, D., and Riedmiller, M","venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":1976,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.708840Z"},"links":{"citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:09efe7af763e59fa3552d02e72f5853d13d948aeda05ff26db4eb049b63f2192","observation_id":"fc58f2e3-1f2a-41ce-9b32-08623813e8a6","resolution":{"observed_at":"2026-08-15T16:56:09.708840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-15T16:56:09.656512Z","title":"De- cision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.656512Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:c393a37c88219006edba9332a8335bf7bf61b609b1e2dae224f06d941da627bd","observation_id":"8a0f2c1a-1f39-4dad-8c3e-575bd2bd7083","resolution":{"observed_at":"2026-08-15T16:56:09.656512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05990","last_updated":"2024-11-12T05:46:46Z","snapshot_observed_at":"2026-08-20T22:29:11.751345Z","submitted_at":"2024-11-08T22:02:22Z","title":"Game-theoretic LLM: Agent Workflow for Negotiation Games","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05990","snapshot_observed_at":"2026-08-15T16:56:09.676323Z","title":"Hua, W., Liu, O., Li, L., Amayuelas, A., Chen, J., Jiang, L., Jin, M., Fan, L., Sun, F., Wang, W., Wang, X., and Zhang, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.676323Z"},"links":{"cited_paper":"/paper/2411.05990","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:c08ec83f66621c4326fbd0e806287e123fe2491da9026a1dd5b2effd01f08873","observation_id":"081ea4d6-37de-4292-a759-0a58cfe323ea","resolution":{"observed_at":"2026-08-15T16:56:09.676323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04094","last_updated":"2025-03-06T05:06:27Z","snapshot_observed_at":"2026-08-20T14:09:53.234675Z","submitted_at":"2025-03-06T05:06:27Z","title":"Pok\\'eChamp: an Expert-level Minimax Language Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04094","snapshot_observed_at":"2026-08-15T16:56:09.700244Z","title":"L., and Jin, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.700244Z"},"links":{"cited_paper":"/paper/2503.04094","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:0eda0bbb54c44c9308dc52c77778cbd9f2b6bd819b8344811606bdd302b9a8bd","observation_id":"05a9dd97-c0b8-4eed-b876-dfefb73d90f9","resolution":{"observed_at":"2026-08-15T16:56:09.700244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:10.063541Z","title":"Distributed prior- itized experience replay","venue":null,"work_id":"4055d8eb-69a9-492f-aa31-49b091d813d3","year":2018},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.672258Z"},"links":{"citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:88662a1579f0035d9423e28552c87ea86f9a206839f6d511db9ca0f5eda8450b","observation_id":"0146c2a9-f327-41be-9336-86d2b46eb578","resolution":{"observed_at":"2026-08-15T16:56:10.069225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-17T02:57:21.304714Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-15T16:56:09.666539Z","title":"Mas- tering atari with discrete world models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.666539Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:c7eabdda2140f6a979266f83c9881bce8edf4a17cded4c4ecaa2514574338b4e","observation_id":"0de09d53-048b-483f-8b09-7ed9449e537f","resolution":{"observed_at":"2026-08-15T16:56:09.666539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-15T16:56:09.712742Z","title":"E., Adi, Y ., Liu, J., Sauvestre, R., Remez, T., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.712742Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:c60d8d91c5e47d30a204d4141697c731025269c56f5b9a19accbf068036cc1bd","observation_id":"8848344a-f9e7-45e8-b316-a19031198017","resolution":{"observed_at":"2026-08-15T16:56:09.712742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16692","last_updated":"2025-01-29T04:36:03Z","snapshot_observed_at":"2026-08-15T14:33:05.281966Z","submitted_at":"2025-01-28T04:00:35Z","title":"Optimizing Code Runtime Performance through Context-Aware Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16692","snapshot_observed_at":"2026-08-15T16:56:09.652168Z","title":"Op- timizing code runtime performance through context- aware retrieval-augmented generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.652168Z"},"links":{"cited_paper":"/paper/2501.16692","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:1f5cb4ed2b4d197a80ebdd8561fb801db11beb981a96ddd41dca08f8a22ea49a","observation_id":"46ec2b2d-ff89-4a7c-86d2-9d641141b874","resolution":{"observed_at":"2026-08-15T16:56:09.652168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:10.080326Z","title":null,"venue":null,"work_id":"8180685d-60e4-47b2-b7dc-440d8f78da76","year":2021},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.661425Z"},"links":{"citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:9885ca7a0f52a7028f0d721251f7edf65fe6153502011dc88f4cd9b3500c3d56","observation_id":"5fcb0ffe-c254-4fa9-8351-9d06829507fa","resolution":{"observed_at":"2026-08-15T16:56:10.085026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-15T16:56:09.727511Z","title":"V oyager: An open- ended embodied agent with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:09.727511Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2508.19506"},"observation_digest":"sha256:cb3ad6bed06700454aa15c7b1f48c5de1cc84879c38f9c786a5ee04c917dee4e","observation_id":"3b85502a-098a-44f9-957b-0450883caf95","resolution":{"observed_at":"2026-08-15T16:56:09.727511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.19506","last_updated":"2025-08-27T01:30:20Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-20T13:31:05.656391Z","submitted_at":"2025-08-27T01:30:20Z","title":"Learning Game-Playing Agents with Generative Code Optimization"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 1 inbound Pith citation observation for arXiv:2508.19506."}