{"as_of":"2026-08-09T11:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:233d6422e9edd66876c89280e91b1fb45631d715dc82ffbd42d6d49cb5c2b538","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":27,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:41:23.484878Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-05T06:30:40.974506Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-13T09:29:27.173784Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2410.23218"},"observation_digest":"sha256:f10e1c0311960f29901439df73764e67669a6649424ef4ad124de429eade23fc","observation_id":"203bdf8e-6b3f-4c24-99a4-028f8b658963","resolution":{"observed_at":"2026-05-13T09:29:27.559326Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-05T06:30:40.974506Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-05-13T09:29:27.173784Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2410.23218"},"observation_digest":"sha256:bccf9627750db1bee28a259ff606004668eb726664741529f4aa4c0732171d20","observation_id":"910c0bf8-5a2d-477a-a57c-d7a76a740982","resolution":{"observed_at":"2026-05-13T09:29:27.314476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2411.18279","last_updated":"2025-05-06T15:08:00Z","snapshot_observed_at":"2026-07-06T19:57:55.925634Z","submitted_at":"2024-11-27T12:13:39Z","title":"Large Language Model-Brained GUI Agents: A Survey","version":12},"reference_index":225,"source":"pdf_text","source_observed_at":"2026-05-19T11:08:27.472508Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2411.18279"},"observation_digest":"sha256:e5e5987af58c3c254532300a1d162ea3948b403b856868359dec5f9be97ae88a","observation_id":"cf9848dd-af18-4b95-9f38-0a673d1f4c8f","resolution":{"observed_at":"2026-05-19T11:08:27.795458Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2412.04454","last_updated":"2025-05-05T16:17:20Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:58:26Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-18T04:09:41.494136Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2412.04454"},"observation_digest":"sha256:3774cdf5581502a36fcf9d384e728e8b57d146026ad1fc0ee14c8b7d84dacb0f","observation_id":"7dcc62fe-0948-4c94-942d-30ee1f804b8a","resolution":{"observed_at":"2026-05-18T04:09:41.606984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2501.16150","last_updated":"2026-03-27T07:41:10Z","snapshot_observed_at":"2026-08-02T22:37:46.736145Z","submitted_at":"2025-01-27T15:44:02Z","title":"A Comprehensive Survey of Agents for Computer Use: Foundations, Challenges, and Future Directions","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-23T04:59:36.994758Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2501.16150"},"observation_digest":"sha256:89e5e9f128053eb9e1f0e89a0367d4143505aafc07f0d5a0d8df04f0d9c704e1","observation_id":"61b91ecc-67a8-4246-8437-1528df9b433d","resolution":{"observed_at":"2026-05-23T05:02:35.132967Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2504.10458","last_updated":"2025-10-01T04:55:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:45:54Z","title":"GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T02:10:57.976448Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2504.10458"},"observation_digest":"sha256:7ffbaa2019e94e8bf3eaa4a4509db8747077e86c526a8946ef5a3698cc94b535","observation_id":"0805dc93-e587-4b7c-b216-c1b30a6ae671","resolution":{"observed_at":"2026-05-15T02:10:58.111359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-07T15:41:23.484878Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14289","last_updated":"2026-06-05T10:24:33Z","snapshot_observed_at":"2026-08-07T15:34:54.479489Z","submitted_at":"2025-05-20T12:41:05Z","title":"EVA: Evolving Semantic Adversaries for Red-Teaming GUI Agents Against Environmental Injection Attacks","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:23.484878Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2505.14289"},"observation_digest":"sha256:eaae42a387f93f998835a253d636688cbd12b820b21c0499c12bd3eba1576851","observation_id":"8dce3b20-9549-41c0-a833-acad538820bc","resolution":{"observed_at":"2026-08-07T15:41:23.484878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-07T14:51:16.221918Z","title":"Guicourse: From general vision language models to versatile gui agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17399","last_updated":"2025-05-26T11:15:36Z","snapshot_observed_at":"2026-08-09T09:54:37.103525Z","submitted_at":"2025-05-23T02:16:11Z","title":"FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:16.221918Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2505.17399"},"observation_digest":"sha256:b16283ee0f79d1444a045c316480e314003eb01e74983022926c053cc43f4432","observation_id":"c8ef36cf-cf88-451d-bfd8-dcef585bc133","resolution":{"observed_at":"2026-08-07T14:51:16.221918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-07T14:46:14.225971Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17629","last_updated":"2025-05-27T07:41:51Z","snapshot_observed_at":"2026-08-08T14:46:10.484801Z","submitted_at":"2025-05-23T08:39:06Z","title":"TransBench: Breaking Barriers for Transferable Graphical User Interface Agents in Dynamic Digital Environments","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:46:14.225971Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2505.17629"},"observation_digest":"sha256:5da5c3d7e95a57ceaf409b003e9ba6553ab0cdd02049caadd5b8aceef61e93a5","observation_id":"7515d703-06fa-42fc-8832-f34c42c0671d","resolution":{"observed_at":"2026-08-07T14:46:14.225971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-07T14:11:52.468699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19683","last_updated":"2025-05-26T08:44:53Z","snapshot_observed_at":"2026-08-08T09:25:43.689145Z","submitted_at":"2025-05-26T08:44:53Z","title":"Large Language Models for Planning: A Comprehensive and Systematic Survey","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:11:52.468699Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2505.19683"},"observation_digest":"sha256:fddd2dbf9582288349bce2ff85039ea267957ec15ed5e17cc54151cb73ea726a","observation_id":"e82df965-bbd0-4b29-a1bc-42d30b9c11bb","resolution":{"observed_at":"2026-08-07T14:11:52.468699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-07T12:41:20.891907Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23762","last_updated":"2025-05-29T17:59:51Z","snapshot_observed_at":"2026-08-08T14:02:10.449991Z","submitted_at":"2025-05-29T17:59:51Z","title":"ZeroGUI: Automating Online GUI Learning at Zero Human Cost","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:20.891907Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2505.23762"},"observation_digest":"sha256:0f2c16492b0f932cad11dc5124eea6d8cbb2f9b9273e5bf8c72a209f8143e329","observation_id":"d3c5d665-a79c-4501-b05b-96ff8b17e1cf","resolution":{"observed_at":"2026-08-07T12:41:20.891907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-07T11:14:50.302407Z","title":"Guicourse: From general vision language models to versatile gui agents.arXiv preprint arXiv:2406.11317, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03143","last_updated":"2025-06-03T17:59:08Z","snapshot_observed_at":"2026-08-09T07:32:12.903499Z","submitted_at":"2025-06-03T17:59:08Z","title":"GUI-Actor: Coordinate-Free Visual Grounding for GUI Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:50.302407Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2506.03143"},"observation_digest":"sha256:fbd1bbf0e02c1de91b17eaeb7032bf9c22c24020bada651930cc9d2354097735","observation_id":"d46d20ea-9a19-4e5d-a2f0-9d3f6bbf8b5b","resolution":{"observed_at":"2026-08-07T11:14:50.302407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-07T05:25:59.244906Z","title":"Guicourse: From general vision language models to versatile gui agents.arXiv preprint arXiv:2406.11317, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08012","last_updated":"2025-06-09T17:59:57Z","snapshot_observed_at":"2026-08-07T21:54:44.419968Z","submitted_at":"2025-06-09T17:59:57Z","title":"GUI-Reflection: Empowering Multimodal GUI Models with Self-Reflection Behavior","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:25:59.244906Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2506.08012"},"observation_digest":"sha256:e25e757f5834a3fd6a0df91fc2ef6b75ecd2ebf741713d12bdcc00bc17a5d885","observation_id":"3a762ebc-9308-452a-a4c4-4837d38c2ce6","resolution":{"observed_at":"2026-08-07T05:25:59.244906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2506.09373","last_updated":"2026-04-21T11:50:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T03:43:30Z","title":"LPO: Towards Accurate GUI Agent Interaction via Location Preference Optimization","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T09:45:55.674155Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2506.09373"},"observation_digest":"sha256:052d5a30b58cab82c61a4d8afa1760989501f467aecfb703c64431b45930a2ad","observation_id":"0d01ab70-ece9-471f-bf63-673f9f85c9f6","resolution":{"observed_at":"2026-05-19T09:47:13.920538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-06T14:25:32.832933Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19478","last_updated":"2025-07-25T17:59:26Z","snapshot_observed_at":"2026-08-07T22:33:01.602402Z","submitted_at":"2025-07-25T17:59:26Z","title":"MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:25:32.832933Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2507.19478"},"observation_digest":"sha256:4b8d472217cc92dfe6163b9d0eb50a6f23f25c0783d45af88b78ec9187cdb117","observation_id":"f5039d17-565b-4412-bb19-ed50f5980e3d","resolution":{"observed_at":"2026-08-06T14:25:32.832933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-06T10:28:55.877525Z","title":"Guicourse: From general vision language models to versatile gui agents.arXiv preprint arXiv:2406.11317, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23779","last_updated":"2025-07-31T17:59:09Z","snapshot_observed_at":"2026-08-08T14:45:38.446269Z","submitted_at":"2025-07-31T17:59:09Z","title":"Phi-Ground Tech Report: Advancing Perception in GUI Grounding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T10:28:55.877525Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2507.23779"},"observation_digest":"sha256:55127db4450719914f0ce68fbdf00bd44f6ace2819b2baa7f2a06eba927503ad","observation_id":"0db3895d-6fb7-4751-817d-0bd877aea897","resolution":{"observed_at":"2026-08-06T10:28:55.877525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T23:55:47.539500Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04700","last_updated":"2025-08-12T15:11:53Z","snapshot_observed_at":"2026-08-07T09:56:01.664660Z","submitted_at":"2025-08-06T17:58:46Z","title":"SEAgent: Self-Evolving Computer Use Agent with Autonomous Learning from Experience","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:47.539500Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2508.04700"},"observation_digest":"sha256:40175bd0ae187dfa8a3647630d4df7e877eb97be2667931491f5a75f9727c7f6","observation_id":"4c1eec8b-ddbc-4654-8b36-76dfc1f4e07e","resolution":{"observed_at":"2026-08-05T23:55:47.539500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T21:08:17.853475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09456","last_updated":"2026-03-22T02:44:18Z","snapshot_observed_at":"2026-08-05T21:08:15.205232Z","submitted_at":"2025-08-13T03:22:19Z","title":"IAG: Input-aware Backdoor Attack on VLM-based Visual Grounding","version":5},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T21:08:17.853475Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2508.09456"},"observation_digest":"sha256:e54a7709b38cb4e58dc09ebb8d3b632cb5a9758885039149341bcc25ccc0d346","observation_id":"c74f7e48-1889-4e4c-a847-7ca581608255","resolution":{"observed_at":"2026-08-05T21:08:17.853475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T15:18:50.998350Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-08T06:36:18.346761Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:50.998350Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:cab36bf7d40a368426cdab19071d6611df7be2f4d98f9a0a316632dc3f5ddbbf","observation_id":"7693ce73-db26-4be6-956f-e200c9cea4bc","resolution":{"observed_at":"2026-08-05T15:18:50.998350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-04T00:30:23.490027Z","title":"Guicourse: From general vision language models to versatile gui agents.arXiv preprint arXiv:2406.11317, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.00810","last_updated":"2026-06-30T10:43:39Z","snapshot_observed_at":"2026-08-06T18:38:19.524231Z","submitted_at":"2025-11-02T05:34:21Z","title":"GUI-AIMA: Aligning Intrinsic Multimodal Attention with a Context Anchor for GUI Grounding","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T00:30:23.490027Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2511.00810"},"observation_digest":"sha256:2f1da326fc4cdb44b39653cb11b1daeb8bf43af8fbc80b2608188aa1abac2673","observation_id":"0499cf22-1ab0-42e7-acbe-a8bf0d715f14","resolution":{"observed_at":"2026-08-04T00:30:23.490027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-03T23:06:04.595637Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.07332","last_updated":"2026-06-09T21:30:32Z","snapshot_observed_at":"2026-08-07T05:40:52.575532Z","submitted_at":"2025-11-10T17:35:21Z","title":"Grounding Computer Use Agents on Human Demonstrations","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-03T23:06:04.595637Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2511.07332"},"observation_digest":"sha256:d557467cf604814da88825489bed4e297acb633392f53accc2023267f4d17e4b","observation_id":"b1624e81-117c-4a57-a075-11c4bff191bd","resolution":{"observed_at":"2026-08-03T23:06:04.595637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2603.05044","last_updated":"2026-04-14T08:14:14Z","snapshot_observed_at":"2026-08-03T03:21:53.279816Z","submitted_at":"2026-03-05T10:51:34Z","title":"WebFactory: Automated Compression of Foundational Language Intelligence into Grounded Web Agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T16:50:02.527821Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2603.05044"},"observation_digest":"sha256:0d809d0c66e7887381e5fb7ac3ff0fb4af73bdf98bd98dd1ac38f0f98cf8bdc2","observation_id":"9f9e5018-5567-478f-97cd-7b5a9dd2560b","resolution":{"observed_at":"2026-05-15T16:50:10.700369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2604.02345","last_updated":"2026-02-11T17:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-11T17:02:38Z","title":"UI-Oceanus: Scaling GUI Agents with Synthetic Environmental Dynamics","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-16T02:59:27.807789Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2604.02345"},"observation_digest":"sha256:6e9f1b5731ba2367406e36ddd532f7568e20950d7037d8e7e4747bb449ab962a","observation_id":"4163e97a-f55f-4c59-b050-b1f6435735d0","resolution":{"observed_at":"2026-05-16T03:00:31.625016Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2604.09442","last_updated":"2026-04-10T15:58:31Z","snapshot_observed_at":"2026-07-06T22:58:17.167367Z","submitted_at":"2026-04-10T15:58:31Z","title":"UIPress: Bringing Optical Token Compression to UI-to-Code Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T17:21:32.024105Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2604.09442"},"observation_digest":"sha256:c6d8215230e7af1ad93837d0e297b0c4da21bc79fd97c14f9095bc84af8d23c5","observation_id":"a856fb97-7e10-4c13-9540-67e1d128bf57","resolution":{"observed_at":"2026-05-11T07:00:59.275012Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2604.27974","last_updated":"2026-04-30T15:03:56Z","snapshot_observed_at":"2026-07-06T23:13:20.516759Z","submitted_at":"2026-04-30T15:03:56Z","title":"FineState-Bench: Benchmarking State-Conditioned Grounding for Fine-grained GUI State Setting","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-07T07:29:17.916004Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2604.27974"},"observation_digest":"sha256:08181c229f1a1cbaf63ade0b56a90fcddea030d6dab12d0637f3a01fe69a7572","observation_id":"63235862-9932-4699-9c06-bec922620ec9","resolution":{"observed_at":"2026-05-12T10:11:27.765143Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2605.16402","last_updated":"2026-05-13T02:48:52Z","snapshot_observed_at":"2026-07-06T23:27:34.514541Z","submitted_at":"2026-05-13T02:48:52Z","title":"WinDeskGround: A Benchmark for Robust GUI Grounding in Complex Multi-Window Desktop Environments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T22:17:22.560632Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2605.16402"},"observation_digest":"sha256:e5f1b56c0e46cf5e3366cf7cbcbdd69ec909bd43f9a65262e703d06346b9b292","observation_id":"b5864293-4560-4003-8efe-47e96a7e52fc","resolution":{"observed_at":"2026-05-20T22:19:07.622330Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents","version":2},"cited_work":{"arxiv_id":"2406.11317","doi":"10.48550/arxiv.2406.11317","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11317","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Guicourse: From general vision language models to versatile gui agents","venue":"arXiv (Cornell University)","work_id":"0b6d0f6a-9e9c-4079-aec9-ee882b3d93dc","year":2025},"citing_paper":{"arxiv_id":"2605.30884","last_updated":"2026-05-29T06:17:53Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T06:17:53Z","title":"GUI-C$^2$: Coarse-to-Fine GUI Grounding via Difficulty-Aware Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-28T22:52:04.755523Z"},"links":{"cited_paper":"/paper/2406.11317","citing_paper":"/paper/2605.30884"},"observation_digest":"sha256:0e870c0fe596fe4984132b7344fedeea8df6d47b0f822ca8b97424d9016c858a","observation_id":"b1672e8a-5631-4eab-9edf-0bf5927706df","resolution":{"observed_at":"2026-06-28T22:52:44.745309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2406.11317/citation-record","integrity":"/paper/2406.11317/integrity","json":"/paper/2406.11317/citation-record.json","paper":"/paper/2406.11317"},"outbound":[],"paper":{"arxiv_id":"2406.11317","last_updated":"2025-05-30T07:30:07Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-03T01:36:55.704876Z","submitted_at":"2024-06-17T08:30:55Z","title":"GUICourse: From General Vision Language Models to Versatile GUI Agents"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 27 inbound Pith citation observations for arXiv:2406.11317."}