{"as_of":"2026-08-23T00:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:594e428c5838e704160a1764c7b8f19dc2df43fce603c4a2afef5143202d3023","coverage":[{"denominator":159,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:38:08.555316Z","state":"measured"},{"denominator":103,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":103,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:07:43.000377Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T04:01:01.522619Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"cited_work":{"arxiv_id":"2507.12483","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12483","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"95ff2acb-c3ab-43f9-8b2e-84ae8b691ea9","year":2025},"citing_paper":{"arxiv_id":"2605.22526","last_updated":"2026-05-21T14:18:29Z","snapshot_observed_at":"2026-08-18T01:00:57.676087Z","submitted_at":"2026-05-21T14:18:29Z","title":"\"Refactoring Runaway\": Understanding and Mitigating Tangled Refactorings in Coding Agents for Issue Resolution","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T03:58:08.767022Z"},"links":{"cited_paper":"/paper/2507.12483","citing_paper":"/paper/2605.22526"},"observation_digest":"sha256:a20babc660bcc566a797b4194ce12316dc54536542a3d5e5b73a37ea5b42b92b","observation_id":"5bf9edd6-af47-4414-8257-205ae034b3ad","resolution":{"observed_at":"2026-05-22T04:01:01.525207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12483","snapshot_observed_at":"2026-08-01T12:07:43.000377Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19682","last_updated":"2026-07-22T02:31:10Z","snapshot_observed_at":"2026-08-12T13:45:58.759254Z","submitted_at":"2026-07-22T02:31:10Z","title":"Context Matters: Improving the Practical Reliability of LLM-Based Unit Test Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T12:07:43.000377Z"},"links":{"cited_paper":"/paper/2507.12483","citing_paper":"/paper/2607.19682"},"observation_digest":"sha256:1012c01098bae1c2ac05c87d2a2ebf5c45e52b953011096d96efd88138d67a57","observation_id":"386d3403-272e-4e31-821e-872cf6e56678","resolution":{"observed_at":"2026-08-01T12:07:43.000377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12483","snapshot_observed_at":"2026-07-31T11:28:31.995734Z","title":"A survey of reinforce- ment learning for software engineering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-08-14T07:04:15.228261Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.995734Z"},"links":{"cited_paper":"/paper/2507.12483","citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:27238f855ffb6f747cc617fefc125b63ac7da712cfdf23e07f0c5900e35166ba","observation_id":"bc87c4b4-ffb7-4cd1-9e90-c05fe99ed2b6","resolution":{"observed_at":"2026-07-31T11:28:31.995734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12483/citation-record","integrity":"/paper/2507.12483/integrity","json":"/paper/2507.12483/citation-record.json","paper":"/paper/2507.12483"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:07.994374Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:07.994374Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:c4630744d076026874803cd774eba8322c6511205b1127e9c62776d45d8c2e90","observation_id":"f1e5a34b-c8b5-4d29-a790-411f32e6a9ca","resolution":{"observed_at":"2026-08-06T17:38:07.994374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.000528Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.000528Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:6fc055d46a019febcc90c97920440f9921b58a6d81e642bc6b7f3abd8918f7f2","observation_id":"aad762bb-1134-4cf4-a918-8d0093cf8ec4","resolution":{"observed_at":"2026-08-06T17:38:08.000528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.006078Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.006078Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:e18d18e7b38d2ef90855ee84ae09f90ec918f3b831bcfd8a290c484f7bf6cc16","observation_id":"b03622b7-39e7-492b-adc9-8e1b6d4c8ef3","resolution":{"observed_at":"2026-08-06T17:38:08.006078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-08-18T11:44:22.813405Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-06T17:38:08.011943Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.011943Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:2ac88afe000501a4558385c5c67f6158da42bb8283ef289e5c1e53d5e895db3c","observation_id":"7203cc63-84e6-4e0f-ac27-f640d870e168","resolution":{"observed_at":"2026-08-06T17:38:08.011943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.019421Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.019421Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:409edd30a0bde2bb3df919d9e95652d48f13316fe6b4c8f94783524eb5bab7ed","observation_id":"f3f34d9c-63f4-4085-8c5b-213ea4647ab9","resolution":{"observed_at":"2026-08-06T17:38:08.019421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.026871Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.026871Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:30e5ced33726c4b67018d2e267db409aae60ffb5f0ca1cdc68b5c45d27df5145","observation_id":"53d57ed6-a080-4d90-85ce-b056aadeeb13","resolution":{"observed_at":"2026-08-06T17:38:08.026871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.033451Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.033451Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:86ecd815f6dd3f26a28dd122250037e915d5c6c5698f84c18afefecf2a08f44f","observation_id":"c66d3d8a-586d-4280-b843-3941a9daa3a8","resolution":{"observed_at":"2026-08-06T17:38:08.033451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.038711Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.038711Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:59eb5f07734235a68ce0f98742b8ff433fddd50b64bc759e9bc4404e206d0b51","observation_id":"556b9b5d-9066-4eff-a5d1-0a2d8ba688cf","resolution":{"observed_at":"2026-08-06T17:38:08.038711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.044662Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.044662Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:e73eb94914f39958dff1f91ccedd272db1ff39df5063781fac9d07e40cce2b14","observation_id":"d11f0b6c-9aca-475b-8d96-640fc6a5dbad","resolution":{"observed_at":"2026-08-06T17:38:08.044662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.049594Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.049594Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:37558848ab8e6ce06d5f78896685c77fccf94421194e75b587f8e6ee0f86bf0d","observation_id":"56e56cbb-034b-4cb6-a78c-dc67573bea82","resolution":{"observed_at":"2026-08-06T17:38:08.049594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.057336Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.057336Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:69c112e9f17e1cc735919b3ba8edcc4899d7a6749fdbca8d0ffc3f5333a2dfa4","observation_id":"bf4bf8dd-7bc5-4991-8b6a-f5ee1b79f814","resolution":{"observed_at":"2026-08-06T17:38:08.057336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.062421Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.062421Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a525625ecf50cd72b75b60f7f178ecfa5dc61c39e33a5e2089cfa5932c749556","observation_id":"9afabaad-6b13-41aa-9632-a9917901f3c5","resolution":{"observed_at":"2026-08-06T17:38:08.062421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.067825Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.067825Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:7e55c0043a908685530e71889877664ca68e7ade417b37676978ec6e25bacda2","observation_id":"2b883686-33ec-4add-9af9-9d4d1465244a","resolution":{"observed_at":"2026-08-06T17:38:08.067825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.073851Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.073851Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:58eb3b32a3f70250a645873e30fd3409e9118156e2e1385299f95044db3db89c","observation_id":"04c644a9-132e-4db8-a447-5b959db7b1d0","resolution":{"observed_at":"2026-08-06T17:38:08.073851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.079606Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.079606Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:f1c3fcbf52b9d5e6b50ae20c77092701d3ca58ca7301d16874598cceac2a15a1","observation_id":"0f5540d2-90a6-4fbf-8da8-c8272ad70c00","resolution":{"observed_at":"2026-08-06T17:38:08.079606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.086678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.086678Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:0bc4c6e02334009e3a3bfcd7cc724d858a0fc0a6d25af66c9e1d0d1b269dba5b","observation_id":"55f309b8-b4cc-4276-80a8-581df99d1fe2","resolution":{"observed_at":"2026-08-06T17:38:08.086678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.094151Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.094151Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:2dfa8d5d9cd24e4674d07cf4320446d8319bdc409540ecd58c36f98076282507","observation_id":"e5d8e1a3-5a9c-44ae-a1c6-d91f34fce385","resolution":{"observed_at":"2026-08-06T17:38:08.094151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.101749Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.101749Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:988158cc8d52516d21d3e13b05f35e221356134e8fb54c2251ec55478cac1545","observation_id":"72e8f88b-e148-4fdb-adc8-e3e30c132856","resolution":{"observed_at":"2026-08-06T17:38:08.101749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.107717Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.107717Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a488eb81ebbb1ca5cd277461378a729e80eb81f9569421fc75838673f8c72f25","observation_id":"f58dae0f-f492-42b3-a1b3-aa2fedb044b9","resolution":{"observed_at":"2026-08-06T17:38:08.107717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.113343Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.113343Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:63cfca016eee24d0133b7cc701b9a258558608017dfa632b6aff692f7c03f766","observation_id":"d747ca88-6b1f-4445-89fe-7c4c74177687","resolution":{"observed_at":"2026-08-06T17:38:08.113343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.119245Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.119245Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:6faa550d1c5f36629c361ddceea3afd29a9c306dd357359263b17d5ee095a5a4","observation_id":"d2424ad8-a2c6-4454-9261-d3a27f1b6986","resolution":{"observed_at":"2026-08-06T17:38:08.119245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.126252Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.126252Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:19c50b70b82a44e39cd456387ee098ffa831ed4e6652e341ad12ea6799f6c05a","observation_id":"a3743819-3905-438b-995a-f5f534e444e5","resolution":{"observed_at":"2026-08-06T17:38:08.126252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.131455Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.131455Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:3654325664cded6c65f93796bd24931748d33cf3a88cca6aa94bb890290845b7","observation_id":"9f9a8441-4a31-4bf3-b7ae-2a3f5d042df5","resolution":{"observed_at":"2026-08-06T17:38:08.131455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.136645Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.136645Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a5892090eb4e951a8c2ae29d0f3058d6cb58587e731e0132a807fbfbdcb8af99","observation_id":"fb2e12f3-99da-43c8-870b-98c9323b636e","resolution":{"observed_at":"2026-08-06T17:38:08.136645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.142228Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.142228Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a522d36c8e96f7dde3c941a29809ea4827f158475d05483c983be8739e4b8b33","observation_id":"57be6f25-5500-45da-89dd-280b34ff4efc","resolution":{"observed_at":"2026-08-06T17:38:08.142228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.147544Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.147544Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:2d98b2408565b7d87c5e94c359b2585bf41787ddf33c6db82bf77ac861641d6e","observation_id":"09ae3d32-daa8-4931-80c0-18ebfbf2649a","resolution":{"observed_at":"2026-08-06T17:38:08.147544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.152860Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.152860Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:3467f8a7b4759a52bf9b4b8627bf566064b3816e472d50ed21f6b34c4121df41","observation_id":"b7e2c72d-35dd-4614-8696-27cf8de8e48d","resolution":{"observed_at":"2026-08-06T17:38:08.152860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.158238Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.158238Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:34becdad5d42e08bf923c00f8251351e12901801b2ae0112f2886bc1b5e38b91","observation_id":"c62e3c84-e8e0-424e-9b90-b301508b7a79","resolution":{"observed_at":"2026-08-06T17:38:08.158238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.163085Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.163085Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:8534357d66e16d4696e42d7688052c463459c47324bf00c84a528ee56943a92d","observation_id":"db5a624e-e7e4-44f3-9aea-d5019e81c16a","resolution":{"observed_at":"2026-08-06T17:38:08.163085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.167813Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.167813Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:2fe82cebfbc441653e0fc79314e11d108a2c1e551f7f7e997f0ef62b95edacca","observation_id":"19fee21d-bc29-415f-aa72-caf4046e7747","resolution":{"observed_at":"2026-08-06T17:38:08.167813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.172553Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.172553Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:3616dd724b283e7fea48cf09140c74bf634eedfd10d564cfcf1abaa1b3101c4e","observation_id":"7ea90db8-befc-4538-b4ad-07288911add2","resolution":{"observed_at":"2026-08-06T17:38:08.172553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.177577Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.177577Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:2f1dfc88a9e16933c761ab7e26a949003ad763ea8c2ae88486a5a897001871ab","observation_id":"62c0a4c4-fcca-4e18-acff-0fa8fb4c2b30","resolution":{"observed_at":"2026-08-06T17:38:08.177577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.183691Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.183691Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a805f00ef58d24c743f8a45fdbffffe9f5192c0acfe658cb503dba71dcc15f4e","observation_id":"9514b3d4-1098-4ef9-964c-36e8cf7b1855","resolution":{"observed_at":"2026-08-06T17:38:08.183691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.190478Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.190478Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ddeb991a8a5b4b09ff835238b6e97594212e64f1aed21d87c22a8486d38ddc61","observation_id":"503d5ced-4632-4498-aeb1-9ad8fcb551b6","resolution":{"observed_at":"2026-08-06T17:38:08.190478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.196354Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.196354Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:c3592ef5de8ddce5f3ebef04fbb3659f09f72de1e4d8a7d0c9457172a2711e9c","observation_id":"762dfb1a-ba32-497e-be3d-ac6bc7bb5d36","resolution":{"observed_at":"2026-08-06T17:38:08.196354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.201720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.201720Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5a2e112d0e9c01a28e35f8a1721c38bf09aedd7bf3308bd251e533701a64499c","observation_id":"d3baf35a-b967-4925-b19f-dc8350740c2b","resolution":{"observed_at":"2026-08-06T17:38:08.201720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.206661Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.206661Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:04e4c16fcd26dad7b2857217386771e8a56441a190666bbe17d93821c1634675","observation_id":"38d5d02e-24e2-41f8-b083-68e89ef4e5b0","resolution":{"observed_at":"2026-08-06T17:38:08.206661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.211324Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.211324Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:35de63207943c6174355e3e899d721238bb81c86198198889ea88eb7b29431f8","observation_id":"3660da95-3410-421f-a7e6-d3b41b956e09","resolution":{"observed_at":"2026-08-06T17:38:08.211324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.217458Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.217458Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:2c89ecf4191e040e1ef3a1ab43f13e05854a99dc9282bc779c05fabead0a1481","observation_id":"fdb7cc2c-d03d-4de3-b2bf-8e65970d8770","resolution":{"observed_at":"2026-08-06T17:38:08.217458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.222379Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.222379Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:bfeed57b732bc84cddb48839ee73076a8227d9f90486c83ad4d72d3a8cfbc4fe","observation_id":"c913bca1-916c-4681-9be9-368068f9ee3f","resolution":{"observed_at":"2026-08-06T17:38:08.222379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.227379Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.227379Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:83de928c99dcee192a5b42ada5eeaea776493f7548070ccc768c5e80abe227f6","observation_id":"1e7df1b7-fc3b-4646-a7ef-f7107a8b9f49","resolution":{"observed_at":"2026-08-06T17:38:08.227379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.232280Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.232280Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:893c2a48be4ace38a610bd4ec87d557bad60e710e8baf649a7a74d4c525b971d","observation_id":"192d3d26-d475-4b1a-92d0-61dd3922b12f","resolution":{"observed_at":"2026-08-06T17:38:08.232280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.237242Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.237242Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:fde771d3d6e5593f489846315a1c87011fad5a7fc41e5334c6ca9ccce3c92150","observation_id":"e086b494-b302-4b42-866e-a56b75008fba","resolution":{"observed_at":"2026-08-06T17:38:08.237242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.242011Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.242011Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:1f21919ce149d1d76d9c75ab2770fb84b534fa32773e88175e8184c2033d2ccc","observation_id":"ea75b22e-df36-41dc-988d-66633edf3908","resolution":{"observed_at":"2026-08-06T17:38:08.242011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.246700Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.246700Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:4d6cfdc0814a8fe9621bd75a92473cac51c2eeef588b448a951adaea49106ca3","observation_id":"ae0488c5-56cb-4a14-9a79-b4dd2e31d518","resolution":{"observed_at":"2026-08-06T17:38:08.246700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T17:38:08.251979Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.251979Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:92c923043cd2b4752cf7a4e594dc0c1e8f4a2fdde880ae3fb6a7794bbf2e8295","observation_id":"fc85c82c-3145-4980-b3d5-618c8ed87ef4","resolution":{"observed_at":"2026-08-06T17:38:08.251979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.257408Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.257408Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ebced87a1aaa272569629febed687d37399b37b10b95ed46d2e5f53e53ec0968","observation_id":"35e939d7-1be1-41ec-b738-bb28583c154e","resolution":{"observed_at":"2026-08-06T17:38:08.257408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.262023Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.262023Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:74a8a1cefb419f6977c25b375340642c07f2057119e1f6938a46079410252f9a","observation_id":"402e5fc6-42c8-41c4-9f5d-c7c4db971536","resolution":{"observed_at":"2026-08-06T17:38:08.262023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.268944Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.268944Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ea38701fb2c142beebcf6605774293c388da246a3c62f468f80fb9bfca44130f","observation_id":"78e81e4c-6d70-49e7-b7a5-725045650b90","resolution":{"observed_at":"2026-08-06T17:38:08.268944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.274948Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.274948Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:35edb46751eef585d482de7e6e249ae9b0a5d6ad4ef415d460d48c135c395109","observation_id":"520a0bbd-d346-4eec-a15c-b4a0944d541d","resolution":{"observed_at":"2026-08-06T17:38:08.274948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.280653Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.280653Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:42304170e874076598bf7e6c3d49e22a34666d38b116d5214f81175e1fc350c6","observation_id":"2f59c34c-635d-4d4f-a143-55c23a6aff81","resolution":{"observed_at":"2026-08-06T17:38:08.280653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.288062Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.288062Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:3b41d4ab0ea10129b7aeb1b6e80057935451b4f330f78f873addea4f52a4ae40","observation_id":"d2f4ec0b-0900-4bd6-bd79-4fc0c9b0ceda","resolution":{"observed_at":"2026-08-06T17:38:08.288062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.294598Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.294598Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:610c9fd928f30f3b83da4c180f9c6f8855e81989bd348494e9846fee839320d3","observation_id":"acba14fc-9d83-4ede-9d6a-aed0f3cafe8b","resolution":{"observed_at":"2026-08-06T17:38:08.294598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.300543Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.300543Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5564b5b312bbbd00e17da71695bc7cb14e31d087cb3c6aedeba85af0a939b62b","observation_id":"fb001746-5f25-4ec9-b362-8c3c5d4d243a","resolution":{"observed_at":"2026-08-06T17:38:08.300543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.305405Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.305405Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:45835e533e95cbac062f4afa76e91c0c1b23dbf85ac25eb9e8dddc5cd3ab66fb","observation_id":"e6dd20a9-3365-4268-80da-a6fdc06e26ce","resolution":{"observed_at":"2026-08-06T17:38:08.305405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.310417Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.310417Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:7b68dcd557cf4ca83c505dd7da39d761b978ae6627d70f47ea870201bf316e66","observation_id":"fe02c121-d8e3-4097-bfa7-ffaec80cf6e9","resolution":{"observed_at":"2026-08-06T17:38:08.310417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.315246Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.315246Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5995a09a466f53d8dea499f51ba18ea3a6c5871b75161b57d34c161576c8b4f1","observation_id":"c9294b1a-6dd8-4901-b59d-7ec698ac0829","resolution":{"observed_at":"2026-08-06T17:38:08.315246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.320635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.320635Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:539360b374c4d63d6874756a308c90802c6632e82aa956370a409e98b2e0d1a2","observation_id":"a336ea3f-df88-4003-bc5a-dd90caa7b791","resolution":{"observed_at":"2026-08-06T17:38:08.320635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.325998Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.325998Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:c5c4d32c6e149bf28ee7c32756e49f7bd0732bb9610bb1a0dcd69a257400f4af","observation_id":"b7656314-db60-4b18-b14c-d22b1e2f31d5","resolution":{"observed_at":"2026-08-06T17:38:08.325998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07098","last_updated":"2025-01-22T04:42:10Z","snapshot_observed_at":"2026-08-18T05:16:18.910649Z","submitted_at":"2024-11-11T16:20:27Z","title":"A Multi-Agent Approach for REST API Testing with Semantic Graphs and LLM-Driven Inputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07098","snapshot_observed_at":"2026-08-06T17:38:08.330851Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.330851Z"},"links":{"cited_paper":"/paper/2411.07098","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:70b544be6b20e4e0bf73638bf10b4432985fe33fba5d0afafe4f19cbc67f55b4","observation_id":"699c0644-c4d9-408c-83fd-25478ca38926","resolution":{"observed_at":"2026-08-06T17:38:08.330851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.337643Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.337643Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:fe5e3ca68e1daa9d08c00fb6271075f4ab108caf59ab60c0c7a02b61bfb363ef","observation_id":"4b4fdc91-a376-419c-a3f7-88cbce78bdc8","resolution":{"observed_at":"2026-08-06T17:38:08.337643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.342544Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.342544Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:f3e199e7694dfce5a71c9758ca188e38306c3347000982301df8b5477d203cc5","observation_id":"b27bc9d6-8aec-4c46-9246-17745790e9cf","resolution":{"observed_at":"2026-08-06T17:38:08.342544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.348023Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.348023Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:75227c8a0ebaa89677c1200d42d1f92b757b417ba419d79ac3795643efce7e6e","observation_id":"3500ef3d-0cf3-46f6-870b-2726897ff38f","resolution":{"observed_at":"2026-08-06T17:38:08.348023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-13T07:57:56.087944Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-06T17:38:08.353720Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.353720Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:e91eb24f50d829dd1f2f1418ce9bc141ff91fb62b449f73de137c74e843a3b3c","observation_id":"9a214699-9469-44d6-8f27-34f2804150de","resolution":{"observed_at":"2026-08-06T17:38:08.353720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.360236Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.360236Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:81b12770c5dde45dd6f8e854cbcea32d492f9d9084b7a611247f6b36ba20d9f0","observation_id":"8202110d-2ea6-46cd-a8d5-ea6db0332704","resolution":{"observed_at":"2026-08-06T17:38:08.360236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.365845Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.365845Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a4f7133f26725b041a8914db30eb76a7bf842a63d1ecb028ad8cdb6ae5986ec5","observation_id":"9ee3845b-3c89-4611-82f3-b2d66aa5ee4f","resolution":{"observed_at":"2026-08-06T17:38:08.365845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.370887Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.370887Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:b7ae2e74b55dabfa3ba617cbb57a13a2df0e069334be54478161ed7786b52626","observation_id":"f4630717-59a8-432e-8f34-11dda3c5d5ae","resolution":{"observed_at":"2026-08-06T17:38:08.370887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.377769Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.377769Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:40a2a8dac65ca5885251adc8f1b0e0acb31b34f2a25bc191df831f8645fb8ca5","observation_id":"a535a2eb-1bdd-46c9-bc22-7f64c3786592","resolution":{"observed_at":"2026-08-06T17:38:08.377769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.383947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.383947Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:0db70bd409071cb053d46a792c93660a1eca82e080466fe5a6adc5c800804ff9","observation_id":"a79d0646-dcae-4d73-8ff9-13aa27d99031","resolution":{"observed_at":"2026-08-06T17:38:08.383947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.389616Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.389616Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:20fed236d23684703131fd7efd9b4bf2b943c5691e1c868388cdb45d26a09263","observation_id":"f44ca3fd-0cb1-4783-8445-dec8c8eddfd7","resolution":{"observed_at":"2026-08-06T17:38:08.389616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-08-21T15:57:22.153221Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T17:38:08.395660Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.395660Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:d3177d451e94116875ebfe6946665f88b2f5e535c67390b6398248ab0333bc0a","observation_id":"73b6398c-8e73-4fea-891a-c3bec51a828a","resolution":{"observed_at":"2026-08-06T17:38:08.395660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.402247Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.402247Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5aaffa699e9e1fd7b1fb2701999928c175b2900ee1df489cca1eb521e08d29f6","observation_id":"e5c0c05e-1d8b-4368-9c80-1b3096d3baf8","resolution":{"observed_at":"2026-08-06T17:38:08.402247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.406949Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.406949Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:be9ad4c3d19ba2c757e1f8f451dee024fc40ac1eaa623374e04857c27febba54","observation_id":"f99cc920-0e03-4440-8976-020b63c124ed","resolution":{"observed_at":"2026-08-06T17:38:08.406949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.412353Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.412353Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:c573d08501240bc18fbb808886ed4edbdd97c596960ca8d3e37edf2c4a5523ab","observation_id":"6145d91e-e18a-4cdd-9c78-b9c030482aef","resolution":{"observed_at":"2026-08-06T17:38:08.412353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.418499Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.418499Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:114b4b2d1b4a00736eefb0d6ea1574efb9e6b4228bc561b6021a39769b4fb83f","observation_id":"8107ba2e-281d-4629-9a2e-b3edc646fe66","resolution":{"observed_at":"2026-08-06T17:38:08.418499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.426271Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.426271Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ec5af1e2c87b30f1a119754811f3c20d07a73cfea7e259a3e8420df4894ff4dc","observation_id":"7750164f-ae3c-4661-8422-ac9783907e2c","resolution":{"observed_at":"2026-08-06T17:38:08.426271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.431409Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.431409Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:6349c495849df1c2c6f1d6586d1a43b7e570d0032ae9a26ea5257d26a0d73354","observation_id":"6eac124a-a423-4a1e-b196-1a7b58fa2b2e","resolution":{"observed_at":"2026-08-06T17:38:08.431409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.436800Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.436800Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:993293031606f5e5a46b338bd5583c8e7719fea15a7855204e188825249cb572","observation_id":"7e56b2dc-4185-4c96-b0d3-cfa067dea3ce","resolution":{"observed_at":"2026-08-06T17:38:08.436800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.441321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.441321Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:2119ad1449e823e6533240eb07a3d1a495cf1bd9f5dd4a4a624be1dce8c369ef","observation_id":"9be0dbc0-dffa-4ffc-bd02-7b2bcbd03805","resolution":{"observed_at":"2026-08-06T17:38:08.441321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.446112Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.446112Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:90a2a730e18145d9ea0d3dacee54ab8830e0f34791313c0a53365a320912f1b6","observation_id":"0d74fd91-b732-438e-9738-e3e29007b4d2","resolution":{"observed_at":"2026-08-06T17:38:08.446112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.451743Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.451743Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5f8a9d1bee3c2ae930f7abb861497029c1fb3728d56568dc6e7b084824772735","observation_id":"e0b8066e-ae1b-4b8d-9c37-3bc05e6197c8","resolution":{"observed_at":"2026-08-06T17:38:08.451743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.456723Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.456723Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:554e21097772fb4d649e3459050921f94aa973f9e81e8d233a4699f1a7a7d45a","observation_id":"ff28f647-fce1-4165-b189-c0f6987ee57f","resolution":{"observed_at":"2026-08-06T17:38:08.456723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T17:38:08.462031Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.462031Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:97fddfdfa90629c78bfaca86887e3d58314d36617ba9ca6c2a30bdf88188ae74","observation_id":"8ce1829e-3992-4c40-a77e-ceede585ea50","resolution":{"observed_at":"2026-08-06T17:38:08.462031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.467360Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.467360Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:58713aa876bb1ed6301e8f6a2edb4c6c02374c2a86f69f874e34404caae3ae65","observation_id":"2e7a9fd3-f47e-42ae-b0c6-d0e3959c92e1","resolution":{"observed_at":"2026-08-06T17:38:08.467360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.472983Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.472983Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:012577c174193c62836a093068a4e377613cec9540a18d640cfa321f01df954c","observation_id":"1c77e7fd-1097-4540-899f-aa2cab4421b4","resolution":{"observed_at":"2026-08-06T17:38:08.472983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:16.125395Z","title":null,"venue":null,"work_id":"aa376814-ed43-4d1d-95bb-10e1ab32d4b5","year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.481122Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:9b739c6d242b5eca371c703180f644f8cfc96f8605cc942e60f888801eeb0fff","observation_id":"f86eb583-ce7e-4e79-8006-3b5e96b38c23","resolution":{"observed_at":"2026-08-06T17:38:16.192817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:16.031002Z","title":null,"venue":null,"work_id":"ed991014-918a-43fd-82b2-1038ec9e1515","year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.486218Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:85f729c37dc88c7c32012f2bea416f0b97194367202d8bcc0c29cb0221b138c1","observation_id":"4296c05e-420a-413b-9213-f0a8cae43c78","resolution":{"observed_at":"2026-08-06T17:38:16.089150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.857190Z","title":null,"venue":null,"work_id":"f2c973cb-2193-4088-ac9d-89c171087aec","year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.492636Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:1971c852b074f6bd6924bb64964c6902657fb80b6c57c03ec1a38c32ca6edc45","observation_id":"1f57dd93-6921-4d45-90e5-64f0be791201","resolution":{"observed_at":"2026-08-06T17:38:15.964684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.697271Z","title":null,"venue":null,"work_id":"29c9669a-c8df-4cea-8f3a-c0aeaa1d1edf","year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.497865Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:13efc292d3f73baac41d0a5f544adbbd0825188b004f75afd247ed6449828291","observation_id":"6fe1e250-03d0-4feb-9a94-8866ddc14d8d","resolution":{"observed_at":"2026-08-06T17:38:15.782717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.548421Z","title":null,"venue":null,"work_id":"5089fa1f-5c23-47cf-b7d5-31f7ff316684","year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.503454Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:f7233a0cc09f4b26782db9e6ae919d371daae0d99ba65a6f2b804250df9abc40","observation_id":"4134c3b1-d6c3-4341-9e33-3e33d5e84675","resolution":{"observed_at":"2026-08-06T17:38:15.615355Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.433652Z","title":null,"venue":null,"work_id":"71e2a77d-fdc9-48ea-af4b-bc7793250540","year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.509040Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:95c8632ea8002c41567f24a1730c1755133e61a8335d443cc6a169543f5239d0","observation_id":"81ba4452-2788-4a66-b94d-d10a8932cd8f","resolution":{"observed_at":"2026-08-06T17:38:15.475476Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.283581Z","title":null,"venue":null,"work_id":"4243688e-9170-416a-8fdd-a5c5d3a3823e","year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.514379Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:de0f34cdb79e31b1df69d09f5659d0c0f056b549acef502138ff4741446f7fc8","observation_id":"f8c5dc95-dd24-4e24-8a14-eb920b0f7e6b","resolution":{"observed_at":"2026-08-06T17:38:15.379922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.088335Z","title":null,"venue":null,"work_id":"02fe0bd5-b3e1-4837-ae7e-a621b2f91c02","year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.519190Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:1f16dc6677f1c3aab1104f9f8b9b58e5a2ae04d8bd2bc6d432c5b70a59e5fe0e","observation_id":"9fde0a5d-7b9a-4c35-a6c5-76a45d8c7796","resolution":{"observed_at":"2026-08-06T17:38:15.185745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.932333Z","title":null,"venue":null,"work_id":"11ec7089-8186-4286-8233-a56c5cf69651","year":2008},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.524703Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:2778b90e8b3eb1cf677437522328e7216c82b79335677148b94b59954f9cb3ca","observation_id":"ff42e294-9075-4485-a219-1771b995cdbf","resolution":{"observed_at":"2026-08-06T17:38:15.023233Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.770040Z","title":null,"venue":null,"work_id":"b0427be0-e676-47dd-90e0-247d2a48bf3d","year":2008},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.529989Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:76975cf07c7b102c63d92b6c675c23cc2922b2c9a146aa55d03e58e4e267ff79","observation_id":"05c987ac-b04d-44b2-b11f-636592255608","resolution":{"observed_at":"2026-08-06T17:38:14.831776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.594314Z","title":"Puterman","venue":null,"work_id":"b07da894-a3fc-46a3-bae1-131805be153b","year":1994},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.535424Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:06d557c4e0b91292b1f7a5f1bc147f913f1c03f001cf7c47b13b33b09ad8a347","observation_id":"19d90b25-5d90-421c-85e0-082558da7d06","resolution":{"observed_at":"2026-08-06T17:38:14.672799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.437482Z","title":null,"venue":null,"work_id":"4ca8a17d-ff0b-4e72-936a-31333cac8ba0","year":2014},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.540241Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:af1945768bdf69ff78fa32a744a993c5ba201d27411e93817d57a02129b7f1cd","observation_id":"8c20e6eb-1203-4157-94e1-7cfb937e8dc6","resolution":{"observed_at":"2026-08-06T17:38:14.514205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.267962Z","title":null,"venue":null,"work_id":"43de909c-d21d-41af-943c-1efbba0950c6","year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.545025Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:c85c071bd9a4d3e9b581ce97427683b4b5a2be60b01b02da194a3ffc2d8357a5","observation_id":"92337ec7-20b8-4912-957a-fe33acbe1652","resolution":{"observed_at":"2026-08-06T17:38:14.333038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.109429Z","title":null,"venue":null,"work_id":"aa46d18b-3a7e-4dbf-a99e-f8e5ed8b5591","year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.549929Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:cc959f3fdd6bc59065035332100228cb00ba4cc6c7e8861424fe3d939262f50f","observation_id":"90e083c5-31e1-4c25-8b6b-0a9b8a419abe","resolution":{"observed_at":"2026-08-06T17:38:14.176736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:13.933600Z","title":null,"venue":null,"work_id":"ba58fc68-d8e0-40dc-b4cc-3ab88e7c1735","year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.555316Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:dcdf8a09de7f512bd77a70d835a2081dc1bb47a28bd9f790359d55835d234392","observation_id":"1eb59c02-3a0d-40c9-a1eb-ad1f95621a5f","resolution":{"observed_at":"2026-08-06T17:38:14.025580Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-14T02:11:23.477575Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":159},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 100 of 159 outbound references and 3 inbound Pith citation observations for arXiv:2507.12483."}