{"as_of":"2026-08-11T03:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:884c8527eaca1b91b2c7e151371282a96a0d5e5ba9f2eaccee825f5e1ff23fc6","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:33:33.396965Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T22:52:04.755523Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T21:37:25.319373Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2507.00008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00008","snapshot_observed_at":"2026-07-02T21:37:25.319373Z","title":"Dimo-gui: Advancing test-time scaling in gui grounding via modality- aware visual reasoning.arXiv preprint arXiv:2507.00008","venue":null,"work_id":"aeac6980-5888-409f-9d1e-f663a41ee21d","year":2025},"citing_paper":{"arxiv_id":"2509.07553","last_updated":"2026-04-03T02:36:28Z","snapshot_observed_at":"2026-07-06T22:26:22.911328Z","submitted_at":"2025-09-09T09:46:01Z","title":"VeriOS: Query-Driven Proactive Human-Agent-GUI Interaction for Trustworthy OS Agents","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-18T18:06:12.349285Z"},"links":{"cited_paper":"/paper/2507.00008","citing_paper":"/paper/2509.07553"},"observation_digest":"sha256:d461942836f5fd78bed213d812ce919911b4d5a91dc2689abf0e12e09dfa52f0","observation_id":"92c1dd39-451d-40b3-a275-ee5a00cf5137","resolution":{"observed_at":"2026-05-18T18:06:42.553383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2507.00008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00008","snapshot_observed_at":"2026-07-02T21:37:25.319373Z","title":"Dimo-gui: Advancing test-time scaling in gui grounding via modality- aware visual reasoning.arXiv preprint arXiv:2507.00008","venue":null,"work_id":"aeac6980-5888-409f-9d1e-f663a41ee21d","year":2025},"citing_paper":{"arxiv_id":"2604.21268","last_updated":"2026-04-23T04:23:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-23T04:23:31Z","title":"Measure Twice, Click Once: Co-evolving Proposer and Visual Critic via Reinforcement Learning for GUI Grounding","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-09T23:05:05.251150Z"},"links":{"cited_paper":"/paper/2507.00008","citing_paper":"/paper/2604.21268"},"observation_digest":"sha256:191839d9d13589240df6f943b2218dd1737f91cdc75145d564396205ab5700ff","observation_id":"2176429e-b6f6-4565-b816-f82147d0cd97","resolution":{"observed_at":"2026-05-11T14:16:06.162349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2507.00008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00008","snapshot_observed_at":"2026-07-02T21:37:25.319373Z","title":"Dimo-gui: Advancing test-time scaling in gui grounding via modality- aware visual reasoning.arXiv preprint arXiv:2507.00008","venue":null,"work_id":"aeac6980-5888-409f-9d1e-f663a41ee21d","year":2025},"citing_paper":{"arxiv_id":"2605.02630","last_updated":"2026-05-04T14:18:46Z","snapshot_observed_at":"2026-08-11T02:22:43.861873Z","submitted_at":"2026-05-04T14:18:46Z","title":"AutoFocus: Uncertainty-Aware Active Visual Search for GUI Grounding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T18:37:48.993080Z"},"links":{"cited_paper":"/paper/2507.00008","citing_paper":"/paper/2605.02630"},"observation_digest":"sha256:841b064fe106a79186ae7b462c929389c1097f751be3cceebab30aaaca50aaf7","observation_id":"1a2bd040-0e64-40b1-a25b-63697d1037d4","resolution":{"observed_at":"2026-05-09T06:20:38.506343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2507.00008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00008","snapshot_observed_at":"2026-07-02T21:37:25.319373Z","title":"Dimo-gui: Advancing test-time scaling in gui grounding via modality- aware visual reasoning.arXiv preprint arXiv:2507.00008","venue":null,"work_id":"aeac6980-5888-409f-9d1e-f663a41ee21d","year":2025},"citing_paper":{"arxiv_id":"2605.06664","last_updated":"2026-05-07T17:59:31Z","snapshot_observed_at":"2026-08-09T05:00:45.971052Z","submitted_at":"2026-05-07T17:59:31Z","title":"BAMI: Training-Free Bias Mitigation in GUI Grounding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T12:20:42.718277Z"},"links":{"cited_paper":"/paper/2507.00008","citing_paper":"/paper/2605.06664"},"observation_digest":"sha256:3d3b44f2c181d031496d2275d6a0800937a9b6953ea41795233cee9dcbb4848e","observation_id":"c5020532-c4f8-4f62-baab-6259f730aa47","resolution":{"observed_at":"2026-05-11T19:16:10.098556Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2507.00008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00008","snapshot_observed_at":"2026-07-02T21:37:25.319373Z","title":"Dimo-gui: Advancing test-time scaling in gui grounding via modality- aware visual reasoning.arXiv preprint arXiv:2507.00008","venue":null,"work_id":"aeac6980-5888-409f-9d1e-f663a41ee21d","year":2025},"citing_paper":{"arxiv_id":"2605.15542","last_updated":"2026-05-15T02:27:41Z","snapshot_observed_at":"2026-08-01T22:59:27.797060Z","submitted_at":"2026-05-15T02:27:41Z","title":"DRS-GUI: Dynamic Region Search for Training-Free GUI Grounding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T14:24:48.938948Z"},"links":{"cited_paper":"/paper/2507.00008","citing_paper":"/paper/2605.15542"},"observation_digest":"sha256:43814e2fabdafcb653193a4ded9c0047caf3cc6c8adc866a42d945e1ebeb74db","observation_id":"334a3e54-5172-47e2-a0b8-e6885bf5099b","resolution":{"observed_at":"2026-05-19T14:27:24.225827Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2507.00008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00008","snapshot_observed_at":"2026-07-02T21:37:25.319373Z","title":"Dimo-gui: Advancing test-time scaling in gui grounding via modality- aware visual reasoning.arXiv preprint arXiv:2507.00008","venue":null,"work_id":"aeac6980-5888-409f-9d1e-f663a41ee21d","year":2025},"citing_paper":{"arxiv_id":"2605.30884","last_updated":"2026-05-29T06:17:53Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T06:17:53Z","title":"GUI-C$^2$: Coarse-to-Fine GUI Grounding via Difficulty-Aware Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-28T22:52:04.755523Z"},"links":{"cited_paper":"/paper/2507.00008","citing_paper":"/paper/2605.30884"},"observation_digest":"sha256:21fc96efa763fd453c9719a4dbf38cc60ee2c9069ac472e87504835d6f08a682","observation_id":"3e9ec6d4-117a-4c54-9394-f9b033b24de7","resolution":{"observed_at":"2026-06-28T22:52:44.709279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2507.00008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00008","snapshot_observed_at":"2026-07-02T21:37:25.319373Z","title":"Dimo-gui: Advancing test-time scaling in gui grounding via modality- aware visual reasoning.arXiv preprint arXiv:2507.00008","venue":null,"work_id":"aeac6980-5888-409f-9d1e-f663a41ee21d","year":2025},"citing_paper":{"arxiv_id":"2606.04046","last_updated":"2026-06-02T07:50:56Z","snapshot_observed_at":"2026-08-06T11:17:23.952215Z","submitted_at":"2026-06-02T07:50:56Z","title":"Dive into the Scene: Breaking the Perceptual Bottleneck in Vision-Language Decision Making via Focus Plan Generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T10:28:41.952330Z"},"links":{"cited_paper":"/paper/2507.00008","citing_paper":"/paper/2606.04046"},"observation_digest":"sha256:d5505610f3c48b8b1137d097362b5f0c354393716a3c2b931ddad6200e77e689","observation_id":"aeda10ac-e232-4589-9ec2-6cbaa5df04bf","resolution":{"observed_at":"2026-07-02T02:56:29.277616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2507.00008","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00008","snapshot_observed_at":"2026-07-02T21:37:25.319373Z","title":"Dimo-gui: Advancing test-time scaling in gui grounding via modality- aware visual reasoning.arXiv preprint arXiv:2507.00008","venue":null,"work_id":"aeac6980-5888-409f-9d1e-f663a41ee21d","year":2025},"citing_paper":{"arxiv_id":"2606.08231","last_updated":"2026-06-06T15:39:29Z","snapshot_observed_at":"2026-08-07T16:58:05.550639Z","submitted_at":"2026-06-06T15:39:29Z","title":"Test-Time Scaling in Multimodal Foundation Models: A Comprehensive Survey of Generation and Reasoning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-06-27T19:36:57.231932Z"},"links":{"cited_paper":"/paper/2507.00008","citing_paper":"/paper/2606.08231"},"observation_digest":"sha256:df4d5048fcaf78ef59976debf83711d3dc59fa8eb4e0a5481539b2e38f48ae7a","observation_id":"7168db5c-e449-43ab-9ef7-368517c3ea7e","resolution":{"observed_at":"2026-07-02T21:37:25.320996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.00008/citation-record","integrity":"/paper/2507.00008/integrity","json":"/paper/2507.00008/citation-record.json","paper":"/paper/2507.00008"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15259","last_updated":"2025-05-24T15:08:35Z","snapshot_observed_at":"2026-08-09T10:59:49.164484Z","submitted_at":"2025-05-21T08:36:18Z","title":"ReGUIDE: Data Efficient GUI Grounding via Spatial Reasoning and Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15259","snapshot_observed_at":"2026-08-07T04:33:31.916301Z","title":"Hyunseok Lee, Jeonghoon Kim, Beomjun Kim, Ji- hoon Tack, Chansong Jo, Jaehong Lee, Cheonbok Park, Sookyo In, Jinwoo Shin, and Kang Min Yoo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:31.916301Z"},"links":{"cited_paper":"/paper/2505.15259","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:d03aa62a1992259270222bd97fe4b5600b03fbcd0c66f60e23061bd0134887d6","observation_id":"2a82d554-41a7-4b17-93ee-0acc4cbabb4a","resolution":{"observed_at":"2026-08-07T04:33:31.916301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06327","last_updated":"2024-08-12T17:44:17Z","snapshot_observed_at":"2026-08-07T04:07:56.293097Z","submitted_at":"2024-08-12T17:44:17Z","title":"VisualAgentBench: Towards Large Multimodal Models as Visual Foundation Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06327","snapshot_observed_at":"2026-08-07T04:33:32.098014Z","title":"Shilong Liu, Zhaoyang Zeng, Tianhe Ren, Feng Li, Hao Zhang, Jie Yang, Qing Jiang, Chunyuan Li, Jian- wei Yang, Hang Su, Jun Zhu, and Lei Zhang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:32.098014Z"},"links":{"cited_paper":"/paper/2408.06327","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:41fbff8ae7d8f2bb209c19f436c79033b4c28d14ac93f58f2c3525eb3af58d97","observation_id":"afce322e-9a9c-40a4-927b-bbe806400440","resolution":{"observed_at":"2026-08-07T04:33:32.098014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00203","last_updated":"2024-08-01T00:00:43Z","snapshot_observed_at":"2026-08-10T14:01:04.459878Z","submitted_at":"2024-08-01T00:00:43Z","title":"OmniParser for Pure Vision Based GUI Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00203","snapshot_observed_at":"2026-08-07T04:33:32.230105Z","title":"Tiange Luo, Lajanugen Logeswaran, Justin John- son, and Honglak Lee","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:32.230105Z"},"links":{"cited_paper":"/paper/2408.00203","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:1a971d9f63906579c716f62994e1d6db3a9c6bed8cc9753d5c82f9373d2f24ae","observation_id":"130a844c-7519-43b8-97b1-61c4f23da4a4","resolution":{"observed_at":"2026-08-07T04:33:32.230105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00684","last_updated":"2025-07-14T17:45:50Z","snapshot_observed_at":"2026-08-07T15:57:19.390563Z","submitted_at":"2025-05-01T17:45:59Z","title":"Visual Test-time Scaling for GUI Agent Grounding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00684","snapshot_observed_at":"2026-08-07T04:33:32.407106Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:32.407106Z"},"links":{"cited_paper":"/paper/2505.00684","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:e0b29ef2518c2144caa47ebd4540cdbebcc74d6773154d37c42c3992b7e896ed","observation_id":"7e860991-4c15-47f5-b1d7-29c4a9e27e16","resolution":{"observed_at":"2026-08-07T04:33:32.407106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13591","last_updated":"2025-09-11T16:37:00Z","snapshot_observed_at":"2026-08-10T18:55:26.350773Z","submitted_at":"2024-11-18T05:47:12Z","title":"Improved GUI Grounding via Iterative Narrowing","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13591","snapshot_observed_at":"2026-08-07T04:33:32.549045Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:32.549045Z"},"links":{"cited_paper":"/paper/2411.13591","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:eb874308a1de8d3c7bbc834d10823a3169bddec5c50277a4a58ac9cb288de14e","observation_id":"f3a24d62-4ef9-4155-97d4-530efea97305","resolution":{"observed_at":"2026-08-07T04:33:32.549045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-07T04:33:32.700462Z","title":"arXiv preprint arXiv:2501.12326","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:32.700462Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:7644b841343373ccc87ae03a62b0b2a7e7fee3936435b0d185e086924abc0357","observation_id":"5d211e3d-4b82-474b-9d26-7e5e6218f9f6","resolution":{"observed_at":"2026-08-07T04:33:32.700462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T04:33:32.861090Z","title":"arXiv preprint arXiv:2408.03314","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:32.861090Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:104db97ed3c014b5b61f9fa0c8ea9aa399adde7ff0a08ee0ce21277c0da06f72","observation_id":"191f691a-510d-4574-b376-16e2a9e460d8","resolution":{"observed_at":"2026-08-07T04:33:32.861090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06470","last_updated":"2025-03-09T06:14:17Z","snapshot_observed_at":"2026-08-07T17:19:24.307173Z","submitted_at":"2025-03-09T06:14:17Z","title":"Think Twice, Click Once: Enhancing GUI Grounding via Fast and Slow Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06470","snapshot_observed_at":"2026-08-07T04:33:32.960951Z","title":"Xingjian Tao, Yiwei Wang, Yujun Cai, Zhicheng Yang, and Jing Tang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:32.960951Z"},"links":{"cited_paper":"/paper/2503.06470","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:2afe0c2205844e5ffc061d2c7527c9c72caacc2e3e599fd88667828128a483dc","observation_id":"858f2c9a-51dd-4ac6-86df-862a148df248","resolution":{"observed_at":"2026-08-07T04:33:32.960951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15425","last_updated":"2025-06-18T12:55:35Z","snapshot_observed_at":"2026-08-06T23:54:02.829320Z","submitted_at":"2025-06-18T12:55:35Z","title":"Understanding GUI Agent Localization Biases through Logit Sharpness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15425","snapshot_observed_at":"2026-08-07T04:33:33.074764Z","title":"Junyang Wang, Haiyang Xu, Jiabo Ye, Ming Yan, Weizhou Shen, Ji Zhang, Fei Huang, and Jitao Sang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:33.074764Z"},"links":{"cited_paper":"/paper/2506.15425","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:09d55e42db900d41606ed29d5901db5863b1adc0f374bb47cd0968c82389fc7d","observation_id":"1c236129-2d25-44ed-9764-9e4966114528","resolution":{"observed_at":"2026-08-07T04:33:33.074764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10458","last_updated":"2025-10-01T04:55:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:45:54Z","title":"GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10458","snapshot_observed_at":"2026-08-07T04:33:33.180717Z","title":"arXiv preprint arXiv:2504.10458","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:33.180717Z"},"links":{"cited_paper":"/paper/2504.10458","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:718011711947d31af1cd36bee6ba15a90e59c96eec23f4517f2c4221d0b3cd75","observation_id":"6609c50f-c3df-4312-94c3-80b6149fd321","resolution":{"observed_at":"2026-08-07T04:33:33.180717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12370","last_updated":"2025-05-24T03:01:02Z","snapshot_observed_at":"2026-08-07T15:43:40.367697Z","submitted_at":"2025-05-18T11:22:04Z","title":"Enhancing Visual Grounding for GUI Agents via Self-Evolutionary Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12370","snapshot_observed_at":"2026-08-07T04:33:33.284288Z","title":"Chaoyun Zhang, Liqun Li, Shilin He, Xu Zhang, Bo Qiao, Si Qin, Minghua Ma, Yu Kang, Qing- wei Lin, Saravan Rajmohan, Dongmei Zhang, and Qi Zhang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:33.284288Z"},"links":{"cited_paper":"/paper/2505.12370","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:41bda3e1694f204c4b1bd47fa818fb57146195336dfb441e29278e17ce1ec210","observation_id":"84e08def-bd90-4c9c-82c6-4b1b919c0d77","resolution":{"observed_at":"2026-08-07T04:33:33.284288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15810","last_updated":"2025-05-22T11:15:23Z","snapshot_observed_at":"2026-08-09T07:15:17.774887Z","submitted_at":"2025-05-21T17:59:09Z","title":"GUI-G1: Understanding R1-Zero-Like Training for Visual Grounding in GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15810","snapshot_observed_at":"2026-08-07T04:33:33.396965Z","title":"arXiv preprint arXiv:2505.15810","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:33.396965Z"},"links":{"cited_paper":"/paper/2505.15810","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:2e6769341d39e16c8d7e1d2e96817e84be9d00fd9441aed8554d921fee3b4746","observation_id":"1e1dae56-7c4c-4c4f-83d1-9467ecb9320d","resolution":{"observed_at":"2026-08-07T04:33:33.396965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06457","last_updated":"2024-08-14T02:41:48Z","snapshot_observed_at":"2026-08-10T11:54:24.942207Z","submitted_at":"2024-02-09T15:02:56Z","title":"V-STaR: Training Verifiers for Self-Taught Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06457","snapshot_observed_at":"2026-08-07T04:33:31.779807Z","title":"Siyuan Hu, Mingyu Ouyang, Difei Gao, and Mike Zheng Shou","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:31.779807Z"},"links":{"cited_paper":"/paper/2402.06457","citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:f25059f6c606dba78273d0cd23e5a863acbb548b3d9d09585111809f5431b552","observation_id":"79f0ab4b-0baf-480c-95dd-b6825caa10d7","resolution":{"observed_at":"2026-08-07T04:33:31.779807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:31.647975Z","title":"Boyu Gou, Ruohan Wang, Boyuan Zheng, Yanan Xie, Cheng Chang, Yiheng Shu, Huan Sun, and Yu Su","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:31.647975Z"},"links":{"citing_paper":"/paper/2507.00008"},"observation_digest":"sha256:e068162910c789408eed87fdd2acaf39e7d9ff7e6708771ad01ff98db3dfcc4b","observation_id":"57525aa9-033f-438c-a0af-816bc015d0ff","resolution":{"observed_at":"2026-08-07T04:33:31.647975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.00008","last_updated":"2025-09-05T17:21:02Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T13:10:34.147706Z","submitted_at":"2025-06-12T03:13:21Z","title":"DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 8 inbound Pith citation observations for arXiv:2507.00008."}