{"as_of":"2026-08-20T13:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:435dc05d1419badd5e147c5ea8edbcc25129a2ab236532b273d2c695082ed6f0","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:17:59.198656Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T14:24:48.938948Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T14:27:24.243476Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"cited_work":{"arxiv_id":"2509.04243","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04243","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning active perception via self- evolving preference optimization for gui grounding","venue":null,"work_id":"3723c0cb-7d97-4b5f-9e16-842e936ab2b7","year":2025},"citing_paper":{"arxiv_id":"2605.15542","last_updated":"2026-05-15T02:27:41Z","snapshot_observed_at":"2026-08-01T22:59:27.797060Z","submitted_at":"2026-05-15T02:27:41Z","title":"DRS-GUI: Dynamic Region Search for Training-Free GUI Grounding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T14:24:48.938948Z"},"links":{"cited_paper":"/paper/2509.04243","citing_paper":"/paper/2605.15542"},"observation_digest":"sha256:113b623adfe6278f46cf3d1494772b81b9e88d0ce6228346c5c3eb073089be7d","observation_id":"f7e38fa0-b9c5-45cd-99db-71c21005896a","resolution":{"observed_at":"2026-05-19T14:27:24.245090Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.04243/citation-record","integrity":"/paper/2509.04243/integrity","json":"/paper/2509.04243/citation-record.json","paper":"/paper/2509.04243"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:17:59.042313Z","title":"arXiv preprint arXiv:2505.20272","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.042313Z"},"links":{"citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:70f0ad47ddf9b91095cad92f16be1591b8537c06cbcfeee993a8e4165dcab6a9","observation_id":"a50b85eb-42ff-4fb8-b63d-7de7fd27ae09","resolution":{"observed_at":"2026-08-05T10:17:59.042313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-05T10:17:59.048480Z","title":"arXiv preprint arXiv:2503.09567","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.048480Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:b91025f182b5db4042ad008e8b4da53ec69aa0432cb0e36d22df38c028d921a4","observation_id":"6e027198-d1b9-4fef-88d9-d6adf7da15b3","resolution":{"observed_at":"2026-08-05T10:17:59.048480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-08-18T02:03:58.046358Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-05T10:17:59.059404Z","title":"arXiv preprint arXiv:2401.10935","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.059404Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:6e3bf1ef72dd7a14a9b0bcadf608f67d47a74fd6ac12d4bfd7a6af2087ceaba2","observation_id":"ec0add16-468f-477e-835c-69dd9f66da52","resolution":{"observed_at":"2026-08-05T10:17:59.059404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05243","last_updated":"2025-06-17T15:06:02Z","snapshot_observed_at":"2026-08-17T12:05:03.684448Z","submitted_at":"2024-10-07T17:47:50Z","title":"Navigating the Digital World as Humans Do: Universal Visual Grounding for GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05243","snapshot_observed_at":"2026-08-05T10:17:59.066630Z","title":"Hong, W.; Wang, W.; Lv, Q.; Xu, J.; Yu, W.; Ji, J.; Wang, Y .; Wang, Z.; Dong, Y .; Ding, M.; et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.066630Z"},"links":{"cited_paper":"/paper/2410.05243","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:b03bbdca4acad9030c8304a60fa15d3e9941856bdbe0aad5640aff08ccb9f2e7","observation_id":"4bd59021-7d4f-4189-a3ea-4b2b0e1c6928","resolution":{"observed_at":"2026-08-05T10:17:59.066630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02716","last_updated":"2024-02-05T04:25:24Z","snapshot_observed_at":"2026-08-15T04:53:46.192738Z","submitted_at":"2024-02-05T04:25:24Z","title":"Understanding the planning of LLM agents: A survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02716","snapshot_observed_at":"2026-08-05T10:17:59.073173Z","title":"arXiv preprint arXiv:2402.02716","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.073173Z"},"links":{"cited_paper":"/paper/2402.02716","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:dd60a77929b04dd0cab15859cadd8a658a3f6083ca43d05e7458c01732a7c2d6","observation_id":"72b709d3-f758-4b82-ba34-795e4ea39d38","resolution":{"observed_at":"2026-08-05T10:17:59.073173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T10:17:59.084357Z","title":"arXiv preprint arXiv:2410.21276","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.084357Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:2f5fa67ef15f1ae8ef3e5374c72ea45294e2d78bee0a7c17754205f7ae01a390","observation_id":"95307b67-6919-4634-96ff-13a2d2c1422e","resolution":{"observed_at":"2026-08-05T10:17:59.084357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07981","last_updated":"2025-04-04T14:25:17Z","snapshot_observed_at":"2026-08-19T03:47:29.021151Z","submitted_at":"2025-04-04T14:25:17Z","title":"ScreenSpot-Pro: GUI Grounding for Professional High-Resolution Computer Use","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07981","snapshot_observed_at":"2026-08-05T10:17:59.093353Z","title":"arXiv preprint arXiv:2504.07981","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.093353Z"},"links":{"cited_paper":"/paper/2504.07981","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:e31468907c42e0145ce7562e9d0cda49bc9123f38a0cc09567d31f41f0a37ed0","observation_id":"a2ea24a2-94db-4886-96be-fa7c27bb4302","resolution":{"observed_at":"2026-08-05T10:17:59.093353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21620","last_updated":"2025-05-24T08:46:08Z","snapshot_observed_at":"2026-08-16T12:01:58.640468Z","submitted_at":"2025-03-27T15:39:30Z","title":"UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21620","snapshot_observed_at":"2026-08-05T10:17:59.101162Z","title":"arXiv preprint arXiv:2503.21620","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.101162Z"},"links":{"cited_paper":"/paper/2503.21620","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:9b0d7e930571baaa382c62953a4aee24191b6ecffb3263a6c3c62d0bee62b0ac","observation_id":"07dac15a-233d-4014-b99e-d37547d24629","resolution":{"observed_at":"2026-08-05T10:17:59.101162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10458","last_updated":"2025-10-01T04:55:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:45:54Z","title":"GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10458","snapshot_observed_at":"2026-08-05T10:17:59.107172Z","title":"arXiv preprint arXiv:2504.10458","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.107172Z"},"links":{"cited_paper":"/paper/2504.10458","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:b499c0c14679b1b9c8b4ee0777ed58a991e2b98594321c42f94980581c0d32db","observation_id":"55c9e07d-5d37-4f98-b557-cd7e69f5f738","resolution":{"observed_at":"2026-08-05T10:17:59.107172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:18:00.272796Z","title":"https: //openai.com/index/o3-o4-mini-system-card/","venue":null,"work_id":"df5a243f-7dd6-4886-94c1-48dd1c36e692","year":2025},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.113099Z"},"links":{"citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:3110be39b1f14bc250303f2b566e433764d482cc3e374637f1616557e2e3dee6","observation_id":"36c9096e-0085-428f-b270-6ec2c5373643","resolution":{"observed_at":"2026-08-05T10:18:00.281563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-08-16T21:34:35.147772Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-05T10:17:59.119944Z","title":"arXiv preprint arXiv:2501.12326","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.119944Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:50c0cd6a0ebea0e66a6b93a4515aefe80589b8ab1196bfbac6c30719ce9eb47a","observation_id":"1deaa277-9d02-46b8-9e0b-489853b93817","resolution":{"observed_at":"2026-08-05T10:17:59.119944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07491","last_updated":"2025-06-23T13:45:50Z","snapshot_observed_at":"2026-08-17T03:46:28.942551Z","submitted_at":"2025-04-10T06:48:26Z","title":"Kimi-VL Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07491","snapshot_observed_at":"2026-08-05T10:17:59.126766Z","title":"arXiv preprint arXiv:2504.07491","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.126766Z"},"links":{"cited_paper":"/paper/2504.07491","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:c0489b6734ae910e1bc7a657e0dd6a0f8cb14eb1b20d4dbc0233eb3d1b359dcb","observation_id":"5191626a-7adf-41c9-bc82-0d25b332f5d3","resolution":{"observed_at":"2026-08-05T10:17:59.126766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-19T18:35:24.681471Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23218","snapshot_observed_at":"2026-08-05T10:17:59.141447Z","title":"arXiv preprint arXiv:2410.23218","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.141447Z"},"links":{"cited_paper":"/paper/2410.23218","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:e6d705592426b16602ab49d1d3318ba3fab0e5fbfa7951800b471c3f3106bffd","observation_id":"832c4ab2-5750-4a4a-8deb-a2f2e34a6f25","resolution":{"observed_at":"2026-08-05T10:17:59.141447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:17:59.146788Z","title":"arXiv preprint arXiv:2505.13227","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.146788Z"},"links":{"citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:01b2fed4f1d986f29bb0b395086b2cb98f9ce2342252712f376611055c5546ad","observation_id":"d2bacd15-d514-4503-ad5b-72b764f494c6","resolution":{"observed_at":"2026-08-05T10:17:59.146788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04454","last_updated":"2025-05-05T16:17:20Z","snapshot_observed_at":"2026-07-06T20:02:21.509050Z","submitted_at":"2024-12-05T18:58:26Z","title":"Aguvis: Unified Pure Vision Agents for Autonomous GUI Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04454","snapshot_observed_at":"2026-08-05T10:17:59.153421Z","title":"arXiv preprint arXiv:2412.04454","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.153421Z"},"links":{"cited_paper":"/paper/2412.04454","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:667986643e69571dfdc09623466849ba2b99a96203fb4c0d130ac8b059198fe1","observation_id":"05b268ee-9e9a-4069-85da-ba16ba02202b","resolution":{"observed_at":"2026-08-05T10:17:59.153421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05791","last_updated":"2025-10-03T23:50:19Z","snapshot_observed_at":"2026-08-15T18:03:42.618145Z","submitted_at":"2025-07-08T08:52:18Z","title":"GTA1: GUI Test-time Scaling Agent","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05791","snapshot_observed_at":"2026-08-05T10:17:59.159913Z","title":"arXiv preprint arXiv:2507.05791","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.159913Z"},"links":{"cited_paper":"/paper/2507.05791","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:b3cfb46b539d58a6aefc5a8e60d027df78713d6d0c2bf3efe71093ea709de152","observation_id":"4ad3a2cb-568a-4a04-93ae-b56b78fbf339","resolution":{"observed_at":"2026-08-05T10:17:59.159913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16256","last_updated":"2025-07-08T08:49:17Z","snapshot_observed_at":"2026-08-17T12:06:09.823661Z","submitted_at":"2024-12-20T07:16:57Z","title":"Aria-UI: Visual Grounding for GUI Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16256","snapshot_observed_at":"2026-08-05T10:17:59.166418Z","title":"arXiv preprint arXiv:2412.16256","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.166418Z"},"links":{"cited_paper":"/paper/2412.16256","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:06b7b458726033673ceb54b7867554c9c64ccfc46176bd804b13855f7990f2e0","observation_id":"22d4f0a1-cba8-44cc-b13e-9f5fc856c6c9","resolution":{"observed_at":"2026-08-05T10:17:59.166418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12370","last_updated":"2025-05-24T03:01:02Z","snapshot_observed_at":"2026-08-17T13:59:43.463445Z","submitted_at":"2025-05-18T11:22:04Z","title":"Enhancing Visual Grounding for GUI Agents via Self-Evolutionary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12370","snapshot_observed_at":"2026-08-05T10:17:59.172567Z","title":"arXiv preprint arXiv:2505.12370","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.172567Z"},"links":{"cited_paper":"/paper/2505.12370","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:e340a47915d6f1ce3cb9781fe909f2069ccae405e58bc72f144bc783fb085944","observation_id":"7abe08bc-6ef1-46e9-ae9c-82cf2434754b","resolution":{"observed_at":"2026-08-05T10:17:59.172567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15436","last_updated":"2025-12-05T05:44:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-21T12:18:15Z","title":"Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15436","snapshot_observed_at":"2026-08-05T10:17:59.179579Z","title":"arXiv preprint arXiv:2505.15436","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.179579Z"},"links":{"cited_paper":"/paper/2505.15436","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:afb64e878ee60be2d3162c662c00fb92450aefff0fe267275ee0db2ee755c5e8","observation_id":"19d5177d-1d48-41d2-bc68-bbb2d52e5a67","resolution":{"observed_at":"2026-08-05T10:17:59.179579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14362","last_updated":"2026-03-01T04:59:56Z","snapshot_observed_at":"2026-08-02T12:23:34.946873Z","submitted_at":"2025-05-20T13:48:11Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14362","snapshot_observed_at":"2026-08-05T10:17:59.185051Z","title":"arXiv preprint arXiv:2505.14362","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.185051Z"},"links":{"cited_paper":"/paper/2505.14362","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:971e096348e58ec09273332cfec33681bf370edf513ea43e928800ae1e0513d1","observation_id":"1290d5e6-8370-49c8-beff-0aa2fa43589b","resolution":{"observed_at":"2026-08-05T10:17:59.185051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-14T11:14:55.351653Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-05T10:17:59.192008Z","title":"arXiv preprint arXiv:2307.13854","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.192008Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:1ffe58b18b041d06556412d56e40f02eea9d03c13b65c7955acd4f41eb1e67fb","observation_id":"aaff90cb-1c79-4cff-8850-bcc83d0c235c","resolution":{"observed_at":"2026-08-05T10:17:59.192008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21457","last_updated":"2026-06-08T14:20:16Z","snapshot_observed_at":"2026-08-16T09:07:53.543053Z","submitted_at":"2025-05-27T17:29:31Z","title":"ACTIVE-o3: Empowering MLLMs with Active Perception via Pure Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21457","snapshot_observed_at":"2026-08-05T10:17:59.198656Z","title":"arXiv preprint arXiv:2505.21457","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.198656Z"},"links":{"cited_paper":"/paper/2505.21457","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:7ec15510dffab765a775842384e2858a3a3f75fda12c89c8fba5a5c48da10a33","observation_id":"ca9b32fc-55d6-44e6-a355-b616183806ab","resolution":{"observed_at":"2026-08-05T10:17:59.198656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-08-19T00:49:04.283297Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-05T10:17:59.134588Z","title":"arXiv preprint arXiv:2312.08935","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.134588Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:55113f6ad16e2bc9217dfd601894861e34fccc77d23b87aefaaec826a9c00bcd","observation_id":"25a6e7b9-77e1-4110-a5d3-99b23f3b1fd7","resolution":{"observed_at":"2026-08-05T10:17:59.134588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:18:00.305986Z","title":"https: //www.anthropic.com/news/developing-computer-use","venue":null,"work_id":"60275936-a5e2-4037-80c3-faa87fcae19a","year":2025},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.028076Z"},"links":{"citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:2e2368bc52ba02f991218026d9049dedb30b1379440077abde49c664b021e1d2","observation_id":"dc214ed5-a72b-4c17-b12c-ba17a143c73f","resolution":{"observed_at":"2026-08-05T10:18:00.312755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T10:17:59.034735Z","title":"5-vl technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:59.034735Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2509.04243"},"observation_digest":"sha256:0217589cecee2504a88835b92aa871b2c3f890fa9d09d62badcdd9e191c697fc","observation_id":"cdaedacc-94d8-4e55-a78f-de3fa83cbb14","resolution":{"observed_at":"2026-08-05T10:17:59.034735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.04243","last_updated":"2025-09-04T14:17:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T11:29:59.034733Z","submitted_at":"2025-09-04T14:17:01Z","title":"Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2509.04243."}