{"as_of":"2026-08-10T01:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8855d09d6a8c3b20aef95e411c63873d5e442aea9da08bae26ef3fa4b1099c5e","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T16:00:52.709643Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T14:04:46.670034Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.09773","snapshot_observed_at":"2026-07-31T14:04:46.670034Z","title":"arXiv preprint arXiv:2607.09773 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28227","last_updated":"2026-07-30T13:58:41Z","snapshot_observed_at":"2026-08-08T13:39:17.708611Z","submitted_at":"2026-07-30T13:58:41Z","title":"Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents","version":1},"reference_index":197,"source":"arxiv_source","source_observed_at":"2026-07-31T14:04:46.670034Z"},"links":{"cited_paper":"/paper/2607.09773","citing_paper":"/paper/2607.28227"},"observation_digest":"sha256:e3cf43280bc16777ed61b05b611a56b75730c2a1c23475ce60b4d71782a83ecc","observation_id":"27aad222-a72a-41cf-9a1b-e6a3de33970a","resolution":{"observed_at":"2026-07-31T14:04:46.670034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.09773/citation-record","integrity":"/paper/2607.09773/integrity","json":"/paper/2607.09773/citation-record.json","paper":"/paper/2607.09773"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:bd31e27568b4f53653d1dde505d9bdc04659a4dd537a1b9a4b117d56fe7bd91a","observation_id":"ed431483-db9b-4367-ac6f-d2adc7b33572","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Xinyuan Wang, Bowen Wang, Dunjie Lu, Junlin Yang, Tianbao Xie, Junli Wang, Jiaqi Deng, Xiaole Guo, Yiheng Xu, Chen Henry Wu, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:0700c338c258a2852ce80238fe4f1f9119d3884614088943140b1557c0c91931","observation_id":"30da3f35-9b80-4151-a2d1-1b1e0cb8d40a","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Zhihong Shao, Peiyi Wang, Qihao Zhu, Runxin Xu, Junxiao Song, Xiao Bi, Haowei Zhang, Mingchuan Zhang, YK Li, Yang Wu, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:da5d75ea0352dd06f93d16d682eff539f2bcc18f3f27530de8e455b010957d45","observation_id":"d5ee4706-7dc8-41a3-9389-79ce4b75d5cb","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:82d51293b63e699e390f3d38a7217bf87317abfec25ede0a5f54f741ae2ea57e","observation_id":"ad25127f-d659-4ace-92ec-b86f0013b9be","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:b200336d89d2e6165acc24b888e2e9b4dcbb046834d5d3db7834bed34380968f","observation_id":"ba6f4292-b5d8-476e-9aca-8823c6ea59a7","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Haolong Yan, Jia Wang, Xin Huang, Yeqing Shen, Ziyang Meng, Zhimin Fan, Kaijun Tan, Jin Gao, Lieyu Shi, Mi Yang, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:8a532ef9c206998768900714f67e257646eea1ea5b4f589ef47de8f0cf12457d","observation_id":"7c85903f-3c22-46ad-8e7f-98ae6e507e37","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Qwen Team","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:1854394e0530dcb4b0b099cebee8652fdb28bfd4acaaffa6e9f42e6af14ebf89","observation_id":"26583e83-970d-4f7d-b981-62d9bd62333b","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Yujia Qin, Yining Ye, Junjie Fang, Haoming Wang, Shihao Liang, Shizuo Tian, Junda Zhang, Jiahao Li, Yunxin Li, Shi- jue Huang, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:ab6e3b8c375ff5934189d584da5effa9d702e282d5dc1c6856994c8ef37141bc","observation_id":"23396511-308e-46b2-bc01-3b095fb38738","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15144","last_updated":"2025-09-01T05:38:34Z","snapshot_observed_at":"2026-07-06T22:15:55.690108Z","submitted_at":"2025-08-21T00:39:12Z","title":"Mobile-Agent-v3: Fundamental Agents for GUI Automation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15144","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Mobile-agent-v3: Foundamental agents for gui automation.arXiv preprint arXiv:2508.15144,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2508.15144","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:8e75bacb4c5c3f4051159264363de77ebc0beebab5b6d7bd036544f221c1edd8","observation_id":"120c9b0d-907d-450a-88f3-61e14e84bc60","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25624","last_updated":"2026-06-08T08:32:35Z","snapshot_observed_at":"2026-08-04T20:10:29.546282Z","submitted_at":"2026-05-25T09:28:03Z","title":"CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25624","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Kimi Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2605.25624","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:fc3988eacff1bfb13932ec401eab44b4001df75d46dd2dc8e1d5c778ff52d878","observation_id":"502f1b07-d573-4f22-acc8-33313231f7e7","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08264","last_updated":"2024-09-13T20:17:13Z","snapshot_observed_at":"2026-08-05T14:11:56.506073Z","submitted_at":"2024-09-12T17:56:43Z","title":"Windows Agent Arena: Evaluating Multi-Modal OS Agents at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08264","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2409.08264","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:907053374ba34fa553e2a96262e48aada93e025e3da7086df886a2f210e34205","observation_id":"9692b6c4-f382-46db-a7cc-936503549022","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15760","last_updated":"2025-02-13T18:55:14Z","snapshot_observed_at":"2026-08-07T22:34:53.289352Z","submitted_at":"2025-02-13T18:55:14Z","title":"Digi-Q: Learning Q-Value Functions for Training Device-Control Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15760","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Digi-q: Learning q-value functions for training device-control agents.arXiv preprint arXiv:2502.15760, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2502.15760","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:d9accf0c9b9fed334553c06f0cc7794dfa8d3b667512b077906168286e93b56a","observation_id":"9c60e594-4b8e-47be-976d-e07e74f2696a","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Webarena: A realistic web environment for building autonomous agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:93b0c1d9c7267b62f0f79c1a53f0bee4c22ec59f19eae1f5ce3b0576e48b2afc","observation_id":"4c40db38-e88f-4f15-944b-6de5e52afe14","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05044","last_updated":"2026-04-14T08:14:14Z","snapshot_observed_at":"2026-08-03T03:21:53.279816Z","submitted_at":"2026-03-05T10:51:34Z","title":"WebFactory: Automated Compression of Foundational Language Intelligence into Grounded Web Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.05044","snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Visualwebarena: Evaluating multimodal agents on realistic visual web tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"cited_paper":"/paper/2603.05044","citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:86a14e952f845c3c5c0b17480e563606166cfa0cb39f66b0e7488eb321c808c0","observation_id":"5680e1c6-393c-4d1b-a1c6-f7c00d71f8d6","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Webagent-r1: Training web agents via end-to-end multi-turn reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:18b4473049a559a26792260152641e02fdbdf2945f11d7b66367cb0d626777af","observation_id":"84f9d961-b2f2-45cc-baff-2608e971f185","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Ui-s1: Advancing gui automation via semi-online reinforcement learning.arXiv preprint arXiv:2509.11543,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:a47837788c9f1f6f31e97220fa5b272a4004531d411ecca57adf203c6e07aed4","observation_id":"b006e2c5-2e0d-400e-a10f-3f7c569761ca","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T16:00:52.709643Z","title":"Efficient multi-turn rl for gui agents via decoupled training and adaptive data curation.arXiv preprint arXiv:2509.23866,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T16:00:52.709643Z"},"links":{"citing_paper":"/paper/2607.09773"},"observation_digest":"sha256:20cd0a2fcf220e3d85f9703d810e8e12c067bb6221903a81f04bc9e0383bdc84","observation_id":"8a8e46ba-7e5e-4102-972c-beca49e2ad4d","resolution":{"observed_at":"2026-07-14T16:00:52.709643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09773","last_updated":"2026-07-07T16:36:25Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T15:19:16.702946Z","submitted_at":"2026-07-07T16:36:25Z","title":"EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 1 inbound Pith citation observation for arXiv:2607.09773."}