{"as_of":"2026-08-16T18:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96104d44a8b074d9c8a47b84d52d6e18dd959bebdb0701bed578361fbd13311a","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:06:29.182462Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:25:46.524921Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T14:25:46.793890Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"cited_work":{"arxiv_id":"2508.17398","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17398","snapshot_observed_at":"2026-08-15T14:25:46.793890Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","venue":"cs.CL","work_id":"01b5b3a5-09a7-4aa5-ba4f-9454afa95ec9","year":2025},"citing_paper":{"arxiv_id":"2608.10366","last_updated":"2026-08-11T01:45:56Z","snapshot_observed_at":"2026-08-16T01:39:46.189101Z","submitted_at":"2026-08-11T01:45:56Z","title":"DSAgentBench: Can Agents Automate End-to-End Data-Science Workflows in Real Computer Environments?","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:46.524921Z"},"links":{"cited_paper":"/paper/2508.17398","citing_paper":"/paper/2608.10366"},"observation_digest":"sha256:c7b53b57c12a51101efbc57e529884ca3caacac3d73ddbe6d108eafcb5492a5a","observation_id":"975032a0-cb30-4b29-b639-d76b9f12b4db","resolution":{"observed_at":"2026-08-15T14:25:46.798643Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.17398/citation-record","integrity":"/paper/2508.17398/integrity","json":"/paper/2508.17398/citation-record.json","paper":"/paper/2508.17398"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.055514Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.055514Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:ddec326fee45273c5955b19472a199f7b87da83b03238df351a4bc61761b4bde","observation_id":"6db0cebf-5c30-416c-ae04-fd0724e3a2d5","resolution":{"observed_at":"2026-08-15T17:06:29.055514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.061755Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.061755Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:c5be150abac00930cc4449b9c5f1050248e50878e85ae40a72292ed1b4a3e74a","observation_id":"62a11d1b-61de-42bf-9e3f-4171f586146c","resolution":{"observed_at":"2026-08-15T17:06:29.061755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.675270Z","title":"https://openai.com/index/computer-using-agent/","venue":null,"work_id":"ca197fe3-0a35-46b3-9d68-969a7b1d6079","year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.066029Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:f4e4f5d72b05dd8da8d9db7ada94e519dcc9bcc3940a3b1fe9977b714d41d58b","observation_id":"852b5392-32dd-4ed1-9068-a8c46d5b990e","resolution":{"observed_at":"2026-08-15T17:06:29.680324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00906","last_updated":"2025-04-01T15:40:27Z","snapshot_observed_at":"2026-08-12T15:09:43.206186Z","submitted_at":"2025-04-01T15:40:27Z","title":"Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00906","snapshot_observed_at":"2026-08-15T17:06:29.070037Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.070037Z"},"links":{"cited_paper":"/paper/2504.00906","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:9133a010d0ce4994744eeb74a6db28fa112cbbf3d26bb8bb19aa271878ee62ad","observation_id":"a55e5a6c-27c8-496f-887a-63d19b79cac9","resolution":{"observed_at":"2026-08-15T17:06:29.070037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.663462Z","title":null,"venue":null,"work_id":"2ef64d9c-5487-4c85-b1de-9424af98b003","year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.073995Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:4bb044b137a27dbdb6f55bca49509474c0cbe4ff96554726d2b596dba69108db","observation_id":"739e3fd9-2d1c-46f6-b1d4-0a393d9bcf35","resolution":{"observed_at":"2026-08-15T17:06:29.667236Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13648","last_updated":"2019-10-16T13:54:22Z","snapshot_observed_at":"2026-08-14T16:22:59.080240Z","submitted_at":"2019-05-31T14:47:55Z","title":"Scene Text Visual Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13648","snapshot_observed_at":"2026-08-15T17:06:29.077558Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.077558Z"},"links":{"cited_paper":"/paper/1905.13648","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:dc55f36541431b85f33dd8b3a90e395d0cdc98c4e4202c191b80376f113752c9","observation_id":"8fd2e405-9f03-490a-8ed5-6fecb2976baf","resolution":{"observed_at":"2026-08-15T17:06:29.077558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10935","last_updated":"2024-02-23T04:36:51Z","snapshot_observed_at":"2026-08-13T02:23:45.428162Z","submitted_at":"2024-01-17T08:10:35Z","title":"SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10935","snapshot_observed_at":"2026-08-15T17:06:29.081710Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.081710Z"},"links":{"cited_paper":"/paper/2401.10935","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:a15f4693d1df035882aaaf304104048f82237f959ae9bbd33c4d57f65345882a","observation_id":"65ca383c-bbd3-462b-9b3e-101821f48d61","resolution":{"observed_at":"2026-08-15T17:06:29.081710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-15T17:06:29.085661Z","title":"Inderjit Dhillon","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.085661Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:3baee21375bac5dd710fe1ecd3b13201feed0a68015ff1c649a16d7c7f1b6eba","observation_id":"07c00378-6a3c-406a-92da-786dcd2859bc","resolution":{"observed_at":"2026-08-15T17:06:29.085661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.652214Z","title":null,"venue":null,"work_id":"52ced99f-2528-4913-ae0c-6ddf5525e215","year":2003},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.089771Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:813a4c50131fae7c2162d28bf089ac08e82430f839e1ae468c08d530391ad861","observation_id":"22308b35-d2b3-453c-837e-0a6cdbdb029d","resolution":{"observed_at":"2026-08-15T17:06:29.655607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-15T17:06:29.093285Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.093285Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:387a4a58c686cc11f0f6dbe4e12d4f3b9eccdbfc28070db7bc393d413a8eea6f","observation_id":"ec59b558-b3b3-4f64-8dc5-131bbce84782","resolution":{"observed_at":"2026-08-15T17:06:29.093285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.097106Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.097106Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:78dcb8edfd2fc90802232521ec147676503cd16f4e38377a07c3f9eaea02a1ac","observation_id":"7a23d454-c4aa-4672-874c-2643ef8ac1f2","resolution":{"observed_at":"2026-08-15T17:06:29.097106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.08163","last_updated":"2018-03-29T17:42:15Z","snapshot_observed_at":"2026-08-14T19:52:17.945143Z","submitted_at":"2018-01-24T19:47:04Z","title":"DVQA: Understanding Data Visualizations via Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.08163","snapshot_observed_at":"2026-08-15T17:06:29.100555Z","title":"Price, and Christopher Kanan","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.100555Z"},"links":{"cited_paper":"/paper/1801.08163","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:b6489b7709092525554b16a38f9480e1a0bbc1320e170bb66cc792fb0dae8a9e","observation_id":"bc0ae978-9dc1-46ad-812d-ee012adad454","resolution":{"observed_at":"2026-08-15T17:06:29.100555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.07300","last_updated":"2018-02-22T22:50:42Z","snapshot_observed_at":"2026-08-15T22:53:17.165603Z","submitted_at":"2017-10-19T18:01:38Z","title":"FigureQA: An Annotated Figure Dataset for Visual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.07300","snapshot_observed_at":"2026-08-15T17:06:29.107903Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.107903Z"},"links":{"cited_paper":"/paper/1710.07300","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:1b707c6b35437ba135d079356d481276e4db6cc0114db08ab11236781c2eb3f1","observation_id":"eb6864a3-d28b-4d02-b5d3-3a83043d9912","resolution":{"observed_at":"2026-08-15T17:06:29.107903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.111385Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.111385Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:fb91abfcc40d37df828226ec28c82031b081e98ffc9f2555346b7b36be8f5c9c","observation_id":"e5e5bae3-4866-4944-a03c-6d7d7e5a82ae","resolution":{"observed_at":"2026-08-15T17:06:29.111385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.114866Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.114866Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:b998ad47d1bc861e8384164b6f055370784fc3ddaf79225b95ca1a0d9e8c9966","observation_id":"6f8b4b2d-bcdc-471d-b4d6-25d7f089930f","resolution":{"observed_at":"2026-08-15T17:06:29.114866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07981","last_updated":"2025-04-04T14:25:17Z","snapshot_observed_at":"2026-08-16T12:43:56.714748Z","submitted_at":"2025-04-04T14:25:17Z","title":"ScreenSpot-Pro: GUI Grounding for Professional High-Resolution Computer Use","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07981","snapshot_observed_at":"2026-08-15T17:06:29.118377Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.118377Z"},"links":{"cited_paper":"/paper/2504.07981","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:92f437b7a712375348a2ecebe4699d1e522b37928752fa6f64ce5d8d08319b67","observation_id":"c9ea78b5-4fb4-418f-9252-bcfd87dcaa87","resolution":{"observed_at":"2026-08-15T17:06:29.118377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05506","last_updated":"2025-04-10T14:10:05Z","snapshot_observed_at":"2026-08-16T12:43:13.447310Z","submitted_at":"2025-04-07T21:05:06Z","title":"ChartQAPro: A More Diverse and Challenging Benchmark for Chart Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05506","snapshot_observed_at":"2026-08-15T17:06:29.122334Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.122334Z"},"links":{"cited_paper":"/paper/2504.05506","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:b5b21af58e38429a4ebb4c0ec4aeadc8eb71467501a35314306beebb3c931403","observation_id":"e2c02ee2-1509-47f7-9eeb-19684f2744e5","resolution":{"observed_at":"2026-08-15T17:06:29.122334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10244","last_updated":"2022-03-19T05:00:30Z","snapshot_observed_at":"2026-08-11T03:45:43.920485Z","submitted_at":"2022-03-19T05:00:30Z","title":"ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10244","snapshot_observed_at":"2026-08-15T17:06:29.126064Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.126064Z"},"links":{"cited_paper":"/paper/2203.10244","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:ffca66516e29581dc3fc300170fb455c7970c33b8e95634e3b3586c233342d3d","observation_id":"8ca12017-046f-4782-8f56-f8cb7355d80d","resolution":{"observed_at":"2026-08-15T17:06:29.126064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04172","last_updated":"2024-11-04T04:59:45Z","snapshot_observed_at":"2026-08-16T13:36:56.216880Z","submitted_at":"2024-07-04T22:16:40Z","title":"ChartGemma: Visual Instruction-tuning for Chart Reasoning in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04172","snapshot_observed_at":"2026-08-15T17:06:29.130447Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.130447Z"},"links":{"cited_paper":"/paper/2407.04172","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:217691db04a3c76cea40aef37cbe35112b170b1f81ba8ee55e223e6f96822efe","observation_id":"abfde713-9491-4ece-a1a8-7d3545f48070","resolution":{"observed_at":"2026-08-15T17:06:29.130447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12756","last_updated":"2021-08-22T04:27:56Z","snapshot_observed_at":"2026-08-16T18:28:59.132616Z","submitted_at":"2021-04-26T17:45:54Z","title":"InfographicVQA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.12756","snapshot_observed_at":"2026-08-15T17:06:29.134201Z","title":"V Jawahar","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.134201Z"},"links":{"cited_paper":"/paper/2104.12756","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:b7b24ebd243a6be74364d2aa71f0483ef13a97e8a7ed0354d4b22100cbde718a","observation_id":"d09eb8ac-c8c5-4696-843b-113df3a1bb06","resolution":{"observed_at":"2026-08-15T17:06:29.134201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.137928Z","title":"Khapra, and Pratyush Kumar","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.137928Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:a18c70196ef275f2c41feb5eb466a1592311310d51ec9bab951b9c4c8e753981","observation_id":"4445b2ec-2929-4737-88cf-5e763fb986c3","resolution":{"observed_at":"2026-08-15T17:06:29.137928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T17:06:29.141442Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.141442Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:e14e793b2924f0e95f063d1b1e69edfb3e6ea72c80f8f7e044699d2dfab26999","observation_id":"00327445-2a71-417f-9f75-f262d5f7a491","resolution":{"observed_at":"2026-08-15T17:06:29.141442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12326","last_updated":"2025-01-21T17:48:10Z","snapshot_observed_at":"2026-07-06T20:23:58.426780Z","submitted_at":"2025-01-21T17:48:10Z","title":"UI-TARS: Pioneering Automated GUI Interaction with Native Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12326","snapshot_observed_at":"2026-08-15T17:06:29.144940Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.144940Z"},"links":{"cited_paper":"/paper/2501.12326","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:85f3b5e90112b0d82943df2375dbc02a675b04151d062d5e8bfced4af8a730e8","observation_id":"fe48ab61-b241-44e1-af45-f5d5f9e26844","resolution":{"observed_at":"2026-08-15T17:06:29.144940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14573","last_updated":"2025-04-06T20:37:50Z","snapshot_observed_at":"2026-08-13T23:11:04.935073Z","submitted_at":"2024-05-23T13:48:54Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14573","snapshot_observed_at":"2026-08-15T17:06:29.148776Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.148776Z"},"links":{"cited_paper":"/paper/2405.14573","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:2765bd393fdc95e6daba555768ccc553319e35baa5fcfe434a8359cf9ebf8683","observation_id":"d2abe529-db2c-4df6-a365-7130bdeefde1","resolution":{"observed_at":"2026-08-15T17:06:29.148776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.626989Z","title":null,"venue":null,"work_id":"94bcc62b-3396-44ae-9eab-d4f591ed3cac","year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.152784Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:347a6ea801c547f44f2fcef80f1d88c5319c2269e92d4f51da03d2b109d4192c","observation_id":"fd2296e1-d6ca-4a1a-b22b-c5827b0a2819","resolution":{"observed_at":"2026-08-15T17:06:29.630763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-16T13:30:40.207245Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-15T17:06:29.156277Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.156277Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:e97871a2cff464aefcfeee594c0ac45c6cbe8ed26c65ea9c46210ddb88f5bdde","observation_id":"89a0d352-e7fd-453a-84f5-9c2eb5443b92","resolution":{"observed_at":"2026-08-15T17:06:29.156277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18521","last_updated":"2024-06-26T17:50:11Z","snapshot_observed_at":"2026-08-16T13:39:20.937460Z","submitted_at":"2024-06-26T17:50:11Z","title":"CharXiv: Charting Gaps in Realistic Chart Understanding in Multimodal LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18521","snapshot_observed_at":"2026-08-15T17:06:29.160359Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.160359Z"},"links":{"cited_paper":"/paper/2406.18521","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:6a455211760f656f0274fc5c1720037c60360a434fc3e6e3485c31cf2b436cd2","observation_id":"e4d3ef0e-3dba-4370-821f-13ee972dc80e","resolution":{"observed_at":"2026-08-15T17:06:29.160359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.164229Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.164229Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:f26dd4f42ac0ca9a064a43eba8d6e3194dd67fa8d81e50d493a5c7fa2c15b099","observation_id":"29f5a901-da21-43ac-b534-4d36e7b0a6c0","resolution":{"observed_at":"2026-08-15T17:06:29.164229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:06:29.614282Z","title":null,"venue":null,"work_id":"ffdb13f2-b470-4042-aa85-d2e464ab20c5","year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.167791Z"},"links":{"citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:3d243e8325fc8535a114db5dd66f278e84062dce310d1c6e0c64ecd0da1d1fcf","observation_id":"915eddae-f8da-4fc4-9e58-abed5e5420eb","resolution":{"observed_at":"2026-08-15T17:06:29.618818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-14T22:26:00.902198Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-15T17:06:29.171094Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.171094Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:b7495dab9c0551142ed7928722e571bb97e86c58bca361b91a3202e4a2b70b40","observation_id":"8a815838-8a3b-4f86-920d-92d67a685b23","resolution":{"observed_at":"2026-08-15T17:06:29.171094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05791","last_updated":"2025-10-03T23:50:19Z","snapshot_observed_at":"2026-08-15T18:03:42.618145Z","submitted_at":"2025-07-08T08:52:18Z","title":"GTA1: GUI Test-time Scaling Agent","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05791","snapshot_observed_at":"2026-08-15T17:06:29.174844Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.174844Z"},"links":{"cited_paper":"/paper/2507.05791","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:499083dd50571c6cceac69458e1877036ebe620010c0b7b653f3ffc3acb703f1","observation_id":"b158fe53-d3a4-4b7a-b042-55fab4e99064","resolution":{"observed_at":"2026-08-15T17:06:29.174844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-14T11:14:55.351653Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-15T17:06:29.178463Z","title":"Xu, Hao Zhu, Xuhui Zhou, Robert Lo, Abishek Sridhar, Xianyi Cheng, Tianyue Ou, Yonatan Bisk, Daniel Fried, Uri Alon, and Graham Neubig","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.178463Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:45d53f01d32719a709ef9626a8c2b7d0f917885c4ecfa9e37eda6e8f01d71181","observation_id":"69521073-5d7f-422e-a657-7c79303db629","resolution":{"observed_at":"2026-08-15T17:06:29.178463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14179","last_updated":"2025-02-09T15:46:55Z","snapshot_observed_at":"2026-08-16T13:08:10.052556Z","submitted_at":"2024-10-18T05:15:50Z","title":"MultiChartQA: Benchmarking Vision-Language Models on Multi-Chart Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14179","snapshot_observed_at":"2026-08-15T17:06:29.182462Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T17:06:29.182462Z"},"links":{"cited_paper":"/paper/2410.14179","citing_paper":"/paper/2508.17398"},"observation_digest":"sha256:1555e8cf8ca8a51abc3e3f45d55772f35c92a199251df9e2b4eb960d96b306e9","observation_id":"9c0a41ac-21f0-4577-bd44-69c1a3201529","resolution":{"observed_at":"2026-08-15T17:06:29.182462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.17398","last_updated":"2025-08-24T15:11:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T22:38:21.862876Z","submitted_at":"2025-08-24T15:11:44Z","title":"DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2508.17398."}