Pith. sign in

Paper Citation Record · LEDGER

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents

As of 9 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 1 inbound Pith citation observation for arXiv:2607.09773.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.09773 v1

Coverage vector

measured 17 of 17 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-07-14T16:00:52.709643Z

measured 18 of 18 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-31T14:04:46.670034Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

17 of 17 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved17
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ed431483-db9b-4367-ac6f-d2adc7b33572 · outbound

This paper cites Qwen3-VL Technical Report.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Qwen3-VL Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:bd31e27568b4f53653d1dde505d9bdc04659a4dd537a1b9a4b117d56fe7bd91a

Observation 30da3f35-9b80-4151-a2d1-1b1e0cb8d40a · outbound

This paper cites Xinyuan Wang, Bowen Wang, Dunjie Lu, Junlin Yang, Tianbao Xie, Junli Wang, Jiaqi Deng, Xiaole Guo, Yiheng Xu, Chen Henry Wu, et al.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Xinyuan Wang, Bowen Wang, Dunjie Lu, Junlin Yang, Tianbao Xie, Junli Wang, Jiaqi Deng, Xiaole Guo, Yiheng Xu, Chen Henry Wu, et al

Reference 2

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:0700c338c258a2852ce80238fe4f1f9119d3884614088943140b1557c0c91931

Observation d5ee4706-7dc8-41a3-9389-79ce4b75d5cb · outbound

This paper cites Zhihong Shao, Peiyi Wang, Qihao Zhu, Runxin Xu, Junxiao Song, Xiao Bi, Haowei Zhang, Mingchuan Zhang, YK Li, Yang Wu, et al.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Zhihong Shao, Peiyi Wang, Qihao Zhu, Runxin Xu, Junxiao Song, Xiao Bi, Haowei Zhang, Mingchuan Zhang, YK Li, Yang Wu, et al

Reference 3

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:da5d75ea0352dd06f93d16d682eff539f2bcc18f3f27530de8e455b010957d45

Observation ad25127f-d659-4ace-92ec-b86f0013b9be · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 4

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:82d51293b63e699e390f3d38a7217bf87317abfec25ede0a5f54f741ae2ea57e

Observation ba6f4292-b5d8-476e-9aca-8823c6ea59a7 · outbound

This paper cites Proximal Policy Optimization Algorithms.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Proximal Policy Optimization Algorithms

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:b200336d89d2e6165acc24b888e2e9b4dcbb046834d5d3db7834bed34380968f

Observation 7c85903f-3c22-46ad-8e7f-98ae6e507e37 · outbound

This paper cites Haolong Yan, Jia Wang, Xin Huang, Yeqing Shen, Ziyang Meng, Zhimin Fan, Kaijun Tan, Jin Gao, Lieyu Shi, Mi Yang, et al.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Haolong Yan, Jia Wang, Xin Huang, Yeqing Shen, Ziyang Meng, Zhimin Fan, Kaijun Tan, Jin Gao, Lieyu Shi, Mi Yang, et al

Reference 6

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:8a532ef9c206998768900714f67e257646eea1ea5b4f589ef47de8f0cf12457d

Observation 26583e83-970d-4f7d-b981-62d9bd62333b · outbound

This paper cites Qwen Team.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Qwen Team

Reference 7

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:1854394e0530dcb4b0b099cebee8652fdb28bfd4acaaffa6e9f42e6af14ebf89

Observation 23396511-308e-46b2-bc01-3b095fb38738 · outbound

This paper cites UI-TARS: Pioneering Automated GUI Interaction with Native Agents.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents UI-TARS: Pioneering Automated GUI Interaction with Native Agents

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:ab6e3b8c375ff5934189d584da5effa9d702e282d5dc1c6856994c8ef37141bc

Observation 120c9b0d-907d-450a-88f3-61e14e84bc60 · outbound

This paper cites Mobile-Agent-v3: Fundamental Agents for GUI Automation.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Mobile-Agent-v3: Fundamental Agents for GUI Automation

Reference 9

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:8e75bacb4c5c3f4051159264363de77ebc0beebab5b6d7bd036544f221c1edd8

Observation 502f1b07-d573-4f22-acc8-33313231f7e7 · outbound

This paper cites CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents

Reference 10

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:fc3988eacff1bfb13932ec401eab44b4001df75d46dd2dc8e1d5c778ff52d878

Observation 9692b6c4-f382-46db-a7cc-936503549022 · outbound

This paper cites Windows Agent Arena: Evaluating Multi-Modal OS Agents at Scale.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Windows Agent Arena: Evaluating Multi-Modal OS Agents at Scale

Reference 11

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:907053374ba34fa553e2a96262e48aada93e025e3da7086df886a2f210e34205

Observation 9c60e594-4b8e-47be-976d-e07e74f2696a · outbound

This paper cites Digi-Q: Learning Q-Value Functions for Training Device-Control Agents.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Digi-Q: Learning Q-Value Functions for Training Device-Control Agents

Reference 12

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:d9accf0c9b9fed334553c06f0cc7794dfa8d3b667512b077906168286e93b56a

Observation 4c40db38-e88f-4f15-944b-6de5e52afe14 · outbound

This paper cites Webarena: A realistic web environment for building autonomous agents.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Webarena: A realistic web environment for building autonomous agents

Reference 13

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:93b0c1d9c7267b62f0f79c1a53f0bee4c22ec59f19eae1f5ce3b0576e48b2afc

Observation 5680e1c6-393c-4d1b-a1c6-f7c00d71f8d6 · outbound

This paper cites WebFactory: Automated Compression of Foundational Language Intelligence into Grounded Web Agents.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents WebFactory: Automated Compression of Foundational Language Intelligence into Grounded Web Agents

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:86a14e952f845c3c5c0b17480e563606166cfa0cb39f66b0e7488eb321c808c0

Observation 84f9d961-b2f2-45cc-baff-2608e971f185 · outbound

This paper cites Webagent-r1: Training web agents via end-to-end multi-turn reinforcement learning.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Webagent-r1: Training web agents via end-to-end multi-turn reinforcement learning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:18b4473049a559a26792260152641e02fdbdf2945f11d7b66367cb0d626777af

Observation b006e2c5-2e0d-400e-a10f-3f7c569761ca · outbound

This paper cites Ui-s1: Advancing gui automation via semi-online reinforcement learning.arXiv preprint arXiv:2509.11543,.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Ui-s1: Advancing gui automation via semi-online reinforcement learning.arXiv preprint arXiv:2509.11543,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:a47837788c9f1f6f31e97220fa5b272a4004531d411ecca57adf203c6e07aed4

Observation 8a8e46ba-7e5e-4102-972c-beca49e2ad4d · outbound

This paper cites Efficient multi-turn rl for gui agents via decoupled training and adaptive data curation.arXiv preprint arXiv:2509.23866,.

EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents Efficient multi-turn rl for gui agents via decoupled training and adaptive data curation.arXiv preprint arXiv:2509.23866,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-07-14T16:00:52.709643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:00:52.709643Z digest=sha256:20cd0a2fcf220e3d85f9703d810e8e12c067bb6221903a81f04bc9e0383bdc84

Pith citing papers

Observation 27aad222-a72a-41cf-9a1b-e6a3de33970a · inbound

Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents cites this paper.

Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents

Reference 197

Resolution
unresolved
no resolver link, observed 2026-07-31T14:04:46.670034Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T14:04:46.670034Z digest=sha256:e3cf43280bc16777ed61b05b611a56b75730c2a1c23475ce60b4d71782a83ecc