{"as_of":"2026-08-09T22:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2699008d0c3d495149fc40f6892d85c465c1f01967def945053a8619b7267dc5","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T21:12:59.453856Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:53:25.916475Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T19:53:27.058819Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"cited_work":{"arxiv_id":"2607.26784","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.26784","snapshot_observed_at":"2026-08-07T19:53:27.058819Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","venue":"cs.LG","work_id":"7d8a8639-bc40-47f0-97c3-c76175a6dc2f","year":2026},"citing_paper":{"arxiv_id":"2608.05987","last_updated":"2026-08-06T13:00:59Z","snapshot_observed_at":"2026-08-09T22:13:02.167401Z","submitted_at":"2026-08-06T13:00:59Z","title":"AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T19:53:25.916475Z"},"links":{"cited_paper":"/paper/2607.26784","citing_paper":"/paper/2608.05987"},"observation_digest":"sha256:3a772373a6af90e0c6628eefc60036509e8f9e141c021ea65423ff24f231603c","observation_id":"711881f7-a651-4888-8f97-894bf50f5a8a","resolution":{"observed_at":"2026-08-07T19:53:27.063688Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.26784/citation-record","integrity":"/paper/2607.26784/integrity","json":"/paper/2607.26784/citation-record.json","paper":"/paper/2607.26784"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10978","last_updated":"2025-10-28T15:11:36Z","snapshot_observed_at":"2026-07-29T19:20:21.974239Z","submitted_at":"2025-05-16T08:26:59Z","title":"Group-in-Group Policy Optimization for LLM Agent Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10978","snapshot_observed_at":"2026-07-30T21:12:59.359390Z","title":"Yao Fu, Dong-Ki Kim, Jaekyeom Kim, Sungryull Sohn, Lajanugen Logeswaran, Kyunghoon Bae, and Honglak Lee","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.359390Z"},"links":{"cited_paper":"/paper/2505.10978","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:6c5b2948d0887f95662251d4357a7078aa19659178873bb735b7d3de7002f3e1","observation_id":"c1fe03a0-f688-48a9-bdc8-d2d1679c3821","resolution":{"observed_at":"2026-07-30T21:12:59.359390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-30T21:12:59.366710Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.366710Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:8385743366a6febc9016132dc69dda1cb7f3d9ad4b9fb642d91741b7e656acd8","observation_id":"c9c878b0-f740-42ec-bfb0-593fc9ed2b90","resolution":{"observed_at":"2026-07-30T21:12:59.366710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:12:59.370562Z","title":"Hierarchy-of-groups policy opti- mization for long-horizon agentic tasks.arXiv preprint arXiv:2602.22817,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.370562Z"},"links":{"citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:ec70d79c7f34c5b9bf8444e01f03bbdaf03f9ead7740b31b06f48066adf6433c","observation_id":"5fd41044-b57f-451d-942c-c34a313e79b7","resolution":{"observed_at":"2026-07-30T21:12:59.370562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:12:59.373942Z","title":"Meta-rl induces explo- ration in language agents.arXiv preprint arXiv:2512.16848,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.373942Z"},"links":{"citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:670461f70034efea027654b6f31824d421533d935772507c0cf4ff4cfad11ca5","observation_id":"2f4c6aba-b412-47bf-820e-799e47818d37","resolution":{"observed_at":"2026-07-30T21:12:59.373942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15155","last_updated":"2026-05-14T17:51:26Z","snapshot_observed_at":"2026-08-06T01:14:44.790846Z","submitted_at":"2026-05-14T17:51:26Z","title":"Self-Distilled Agentic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15155","snapshot_observed_at":"2026-07-30T21:12:59.377118Z","title":"Self-distilled agentic reinforcement learning.arXiv preprint arXiv:2605.15155, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.377118Z"},"links":{"cited_paper":"/paper/2605.15155","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:e83ea57df8d06edec7a47d7df4d2cb3bfb8ba09061a02ef311a0f8eda129095e","observation_id":"a7576976-63a4-4c83-89a4-269ee79ae7c9","resolution":{"observed_at":"2026-07-30T21:12:59.377118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25158","last_updated":"2026-06-04T12:51:52Z","snapshot_observed_at":"2026-08-06T10:33:38.415457Z","submitted_at":"2026-03-26T08:26:38Z","title":"Trace2Skill: Distill Trajectory-Local Lessons into Transferable Agent Skills","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.25158","snapshot_observed_at":"2026-07-30T21:12:59.381111Z","title":"Trace2skill: Distill trajectory-local lessons into transferable agent skills.arXiv preprint arXiv:2603.25158,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.381111Z"},"links":{"cited_paper":"/paper/2603.25158","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:ff09c0424fce27432e48ab49350c1aa876b1d081658d5cf4196ef374c3288491","observation_id":"52253690-8d56-4915-ba29-1014e81f4c93","resolution":{"observed_at":"2026-07-30T21:12:59.381111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25140","last_updated":"2026-03-16T20:49:28Z","snapshot_observed_at":"2026-08-02T12:08:17.149184Z","submitted_at":"2025-09-29T17:51:03Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25140","snapshot_observed_at":"2026-07-30T21:12:59.384535Z","title":"Siru Ouyang, Jun Yan, I Hsu, Yanfei Chen, Ke Jiang, Zifeng Wang, Rujun Han, Long T Le, Samira Daruki, Xiangru Tang, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.384535Z"},"links":{"cited_paper":"/paper/2509.25140","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:d727ce445fbd3b2af48910fb5a5598c99fa0f16009935a0454d21610e49d3359","observation_id":"91a61321-88af-4969-ab41-b190bc5386db","resolution":{"observed_at":"2026-07-30T21:12:59.384535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06614","last_updated":"2026-05-07T17:31:50Z","snapshot_observed_at":"2026-07-06T23:19:05.764765Z","submitted_at":"2026-05-07T17:31:50Z","title":"SkillOS: Learning Skill Curation for Self-Evolving Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06614","snapshot_observed_at":"2026-07-30T21:12:59.388053Z","title":"Skillos: Learning skill curation for self-evolving agents.arXiv preprint arXiv:2605.06614,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.388053Z"},"links":{"cited_paper":"/paper/2605.06614","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:041768af03f1ccdf06726d162510299106b0776f41e0a9dd07cbc0778092dbf2","observation_id":"76ddb756-05b0-4672-a88d-6b70121e391c","resolution":{"observed_at":"2026-07-30T21:12:59.388053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:12:59.391280Z","title":"Webrl: Training llm web agents via self-evolving online curriculum reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.391280Z"},"links":{"citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:03e71ff4bfc44d9abd5913bdb0c221b7d3bf4dbf540d3bc53d786fd844f00495","observation_id":"621de15e-e44f-4f77-91ff-bdeb1b8acde4","resolution":{"observed_at":"2026-07-30T21:12:59.391280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:12:59.394453Z","title":"Autorefine: From trajectories to reusable expertise for continual llm agent refinement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.394453Z"},"links":{"citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:acb561d42ff60fda5e28a26a3182779292d2842773325fa26e0f035ffca7ad10","observation_id":"b14af90f-e9c6-4e11-bc14-f2653b3e5646","resolution":{"observed_at":"2026-07-30T21:12:59.394453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-30T21:12:59.397336Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.397336Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:944ceab47cb421f10f4bf786443296153d6b2f1cec7fcae63ead75e59a07af0d","observation_id":"051619d9-698c-41d2-a156-23f3a22854bc","resolution":{"observed_at":"2026-07-30T21:12:59.397336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06130","last_updated":"2026-05-12T10:25:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-07T12:33:30Z","title":"Skill1: Unified Evolution of Skill-Augmented Agents via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06130","snapshot_observed_at":"2026-07-30T21:12:59.403621Z","title":"Skill1: Unified evolution of skill-augmented agents via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.403621Z"},"links":{"cited_paper":"/paper/2605.06130","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:556ae728c29f181ff18d04fdf421d5136040bcf2153f62babd8600cb819d206b","observation_id":"06dce564-2ccb-414d-864c-37813649e9cd","resolution":{"observed_at":"2026-07-30T21:12:59.403621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06078","last_updated":"2026-05-07T12:00:40Z","snapshot_observed_at":"2026-07-31T11:42:00.304740Z","submitted_at":"2026-05-07T12:00:40Z","title":"Milestone-Guided Policy Learning for Long-Horizon Language Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06078","snapshot_observed_at":"2026-07-30T21:12:59.416855Z","title":"Milestone-guided policy learning for long-horizon language agents.arXiv preprint arXiv:2605.06078, 2026b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.416855Z"},"links":{"cited_paper":"/paper/2605.06078","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:0b96b9182973d07f33299bac49d912d1c55c9e472308e128a99f0366892f1707","observation_id":"d161b1b6-f3e8-44f0-8372-1895d21d9b32","resolution":{"observed_at":"2026-07-30T21:12:59.416855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18449","last_updated":"2025-12-01T00:16:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-25T18:45:04Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18449","snapshot_observed_at":"2026-07-30T21:12:59.425331Z","title":"Rong Wu, Xiaoman Wang, Jianbiao Mei, Pinlong Cai, Daocheng Fu, Cheng Yang, Licheng Wen, Xuemeng Yang, Yufan Shen, Yuxin Wang, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.425331Z"},"links":{"cited_paper":"/paper/2502.18449","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:5c5d8687e69c3010be32ceade423c61c347f05b4cb3e71fc68e78db1d3956b39","observation_id":"2dc2ff19-2d82-4a25-b66a-44a6ea5b63dd","resolution":{"observed_at":"2026-07-30T21:12:59.425331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08755","last_updated":"2025-09-10T16:46:11Z","snapshot_observed_at":"2026-08-04T20:10:08.337431Z","submitted_at":"2025-09-10T16:46:11Z","title":"AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.08755","snapshot_observed_at":"2026-07-30T21:12:59.428554Z","title":"Agentgym-rl: Training llm agents for long-horizon decision making through multi-turn reinforcement learning.arXiv preprint arXiv:2509.08755,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.428554Z"},"links":{"cited_paper":"/paper/2509.08755","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:07e3c24107a0f9fed94e5ecf1e3a05b118998b85aab304219fddf97924dfae2b","observation_id":"4e2c48f9-e951-48b3-8d4a-71238d638059","resolution":{"observed_at":"2026-07-30T21:12:59.428554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.08234","last_updated":"2026-02-09T03:17:17Z","snapshot_observed_at":"2026-07-06T22:45:05.823859Z","submitted_at":"2026-02-09T03:17:17Z","title":"SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.08234","snapshot_observed_at":"2026-07-30T21:12:59.431570Z","title":"Skillrl: Evolving agents via recursive skill-augmented reinforcement learning.arXiv preprint arXiv:2602.08234,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.431570Z"},"links":{"cited_paper":"/paper/2602.08234","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:77232760e9cdf14ffd882400ac58ec696b3b0126d13edf744f94c1b111517c6a","observation_id":"f0700bb3-ee9b-499a-80ae-c4b63f8744ee","resolution":{"observed_at":"2026-07-30T21:12:59.431570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-30T21:12:59.434695Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.434695Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:6a8d9b458a42d7e7c2aab5870a1d2ad4e458a368a6e89be31f50b6074ee8f366","observation_id":"eac22b0e-9bf5-4cfc-be3a-592faf33dd12","resolution":{"observed_at":"2026-07-30T21:12:59.434695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.23904","last_updated":"2026-05-25T17:58:16Z","snapshot_observed_at":"2026-08-05T06:54:08.846880Z","submitted_at":"2026-05-22T17:59:50Z","title":"SkillOpt: Executive Strategy for Self-Evolving Agent Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.23904","snapshot_observed_at":"2026-07-30T21:12:59.437826Z","title":"Skillopt: Executive strategy for self-evolving agent skills.arXiv preprint arXiv:2605.23904,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.437826Z"},"links":{"cited_paper":"/paper/2605.23904","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:b0da79d5cb8d8f05d00eb65ae135bdeff61da86ee590b8c2633952469c18f008","observation_id":"b61be434-2d06-46dd-aa2b-719bbe066079","resolution":{"observed_at":"2026-07-30T21:12:59.437826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-07-30T21:12:59.440916Z","title":"Webshop: Towards scalable real-world web interaction with grounded language agents.Advances in Neural Information Pro- cessing Systems, 35:20744–20757, 2022a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.440916Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:b5f4dcb388737e83b32cd7955c0a9da0f8a6dad22dfa72d02937faf8d24383f8","observation_id":"5eaf3873-1ce2-4aef-ac20-0b124d42ce0b","resolution":{"observed_at":"2026-07-30T21:12:59.440916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.16143","last_updated":"2026-05-15T16:24:16Z","snapshot_observed_at":"2026-08-06T06:27:50.601885Z","submitted_at":"2026-05-15T16:24:16Z","title":"Look Before You Leap: Autonomous Exploration for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.16143","snapshot_observed_at":"2026-07-30T21:12:59.444076Z","title":"Look before you leap: Autonomous exploration for llm agents.arXiv preprint arXiv:2605.16143,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.444076Z"},"links":{"cited_paper":"/paper/2605.16143","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:4110ee2f4061a016a54736a214855db6399c617ff50e38e9f332db94b0361cbd","observation_id":"b2e17167-aedf-42f2-af8b-a9e7e015f472","resolution":{"observed_at":"2026-07-30T21:12:59.444076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.02547","snapshot_observed_at":"2026-07-30T21:12:59.446937Z","title":"The landscape of agentic reinforcement learning for llms: A survey.arXiv preprint arXiv:2509.02547,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.446937Z"},"links":{"cited_paper":"/paper/2509.02547","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:ee029a730fa22c0a4485d01f32957c33604bed12a7d1db210da425bef2ff20f8","observation_id":"7a145b9c-9181-430b-acfa-2b13de815d79","resolution":{"observed_at":"2026-07-30T21:12:59.446937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02474","last_updated":"2026-05-24T19:01:09Z","snapshot_observed_at":"2026-08-03T05:25:38.558727Z","submitted_at":"2026-02-02T18:53:28Z","title":"MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02474","snapshot_observed_at":"2026-07-30T21:12:59.449832Z","title":"Memskill: Learning and evolving memory skills for self-evolving agents.arXiv preprint arXiv:2602.02474, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.449832Z"},"links":{"cited_paper":"/paper/2602.02474","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:4e5e7406db0c8e1be46f73165f566c1e8ade360076b5472280a7b2a5b39d540d","observation_id":"c31621b1-d508-40a7-9c59-a565a6f3e871","resolution":{"observed_at":"2026-07-30T21:12:59.449832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11942","last_updated":"2025-05-30T02:28:21Z","snapshot_observed_at":"2026-08-07T15:43:54.654762Z","submitted_at":"2025-05-17T10:09:11Z","title":"LifelongAgentBench: Evaluating LLM Agents as Lifelong Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11942","snapshot_observed_at":"2026-07-30T21:12:59.453856Z","title":"Lifelongagentbench: Evaluating llm agents as lifelong learners.arXiv preprint arXiv:2505.11942,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.453856Z"},"links":{"cited_paper":"/paper/2505.11942","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:12625392196d8413e258f0ae253fe1693a4a6ca7c559f62024489c844664578d","observation_id":"884533dd-6334-41ee-af77-a2f36bc6e103","resolution":{"observed_at":"2026-07-30T21:12:59.453856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-30T21:12:59.400414Z","title":"Deepseekmath: Pushing the limits of mathemati- cal reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.400414Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:983c9c5a547b4df72ab4f7fb0de6c0f2c4b051e324fb7f63319bcb1ef440745a","observation_id":"ce5cf7ee-9bd5-4544-bea0-a63c0043f712","resolution":{"observed_at":"2026-07-30T21:12:59.400414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:12:59.410183Z","title":"Reinforcement learning for self-improving agent with skill library","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.410183Z"},"links":{"citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:0ebc6dbcb58ef7c86eaca18af1d030a6926c85edee9adce29f07034118cbdea9","observation_id":"9cb6b808-b81d-4065-a5ec-48e0eaf66b4c","resolution":{"observed_at":"2026-07-30T21:12:59.410183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20073","last_updated":"2025-05-26T17:19:30Z","snapshot_observed_at":"2026-08-08T11:44:11.313729Z","submitted_at":"2025-04-24T17:57:08Z","title":"RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20073","snapshot_observed_at":"2026-07-30T21:12:59.413803Z","title":"Ragen: Understanding self-evolution in llm agents via multi-turn reinforcement learning.arXiv preprint arXiv:2504.20073,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.413803Z"},"links":{"cited_paper":"/paper/2504.20073","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:57e1ae063f3374a9e1dcebaa5119ec18f9f5746878a40c2b14e4fed90337d4dd","observation_id":"4af1e024-fd0b-47a0-a885-242921623c03","resolution":{"observed_at":"2026-07-30T21:12:59.413803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03768","last_updated":"2021-03-14T22:44:38Z","snapshot_observed_at":"2026-08-08T17:40:47.037804Z","submitted_at":"2020-10-08T05:13:36Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03768","snapshot_observed_at":"2026-07-30T21:12:59.406582Z","title":"Alfworld: Aligning text and embodied environments for interactive learning.arXiv preprint arXiv:2010.03768,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.406582Z"},"links":{"cited_paper":"/paper/2010.03768","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:1edc8b3bf22d06fddb7c2f9ccb40dd46367c67d8aa0caa9d75212e0c0e36c9a5","observation_id":"f822171c-725d-4a6a-afe9-60b799392731","resolution":{"observed_at":"2026-07-30T21:12:59.406582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21046","snapshot_observed_at":"2026-07-30T21:12:59.362919Z","title":"A survey of self-evolving agents: What, when, how, and where to evolve on the path to artificial super intelligence.arXiv preprint arXiv:2507.21046,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.362919Z"},"links":{"cited_paper":"/paper/2507.21046","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:cfb42b43bbd65eba1368b29bd1765de3e766fb7623355c032b2bf072abaae8d8","observation_id":"7a8d2d8c-6f80-4231-979d-dcf2680be10e","resolution":{"observed_at":"2026-07-30T21:12:59.362919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T21:12:59.351192Z","title":"Yuxin Chen, Yu Wang, Yi Zhang, Ziang Ye, Zhengzhou Cai, Yaorui Shi, Qi Gu, Hui Su, Xunliang Cai, Xiang Wang, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.351192Z"},"links":{"citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:5d2e745d305e80e4b67bc7998a7a92489f90f257e415382d3922157d22456a1e","observation_id":"0701f85b-1ea8-4b58-99bc-4f33f420f26e","resolution":{"observed_at":"2026-07-30T21:12:59.351192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10663","last_updated":"2026-05-11T14:43:56Z","snapshot_observed_at":"2026-08-02T14:48:33.170105Z","submitted_at":"2026-05-11T14:43:56Z","title":"Evolving-RL: End-to-End Optimization of Experience-Driven Self-Evolving Capability within Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10663","snapshot_observed_at":"2026-07-30T21:12:59.355533Z","title":"Evolving- rl: End-to-end optimization of experience-driven self-evolving capability within agents.arXiv preprint arXiv:2605.10663,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-07-30T21:12:59.355533Z"},"links":{"cited_paper":"/paper/2605.10663","citing_paper":"/paper/2607.26784"},"observation_digest":"sha256:1665e3eb1a1cb9dcd0f0a1834f504966a840d8b4aafa8ee5dcea144246cceebd","observation_id":"4d9ba3fa-3322-402a-a4ca-e715ccc16e2f","resolution":{"observed_at":"2026-07-30T21:12:59.355533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.26784","last_updated":"2026-07-29T11:26:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T01:01:14.362201Z","submitted_at":"2026-07-29T11:26:33Z","title":"SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 1 inbound Pith citation observation for arXiv:2607.26784."}