{"as_of":"2026-08-18T20:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c1150691176eddc7edb15bc005daa652bcfae5d0618db4b621c2a90985709e8","coverage":[{"denominator":242,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:25:39.957770Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10408/citation-record","integrity":"/paper/2608.10408/integrity","json":"/paper/2608.10408/citation-record.json","paper":"/paper/2608.10408"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.488877Z","title":"Attention is All you Need , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.488877Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:285c09f27ed121201dd2d9a471d614b068b5868d7b5457db7bc882e53026efee","observation_id":"983ab64f-1098-452e-9b33-8dba05a33cea","resolution":{"observed_at":"2026-08-15T14:25:39.488877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.493866Z","title":"2014 , edition =","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.493866Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:c60ac666823e060e20ee098f1b4d66d40a555d626e4f9b420979604a6a4bb6b5","observation_id":"9c6abccd-bc0c-4351-88f1-456878a38f83","resolution":{"observed_at":"2026-08-15T14:25:39.493866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.499540Z","title":"IEEE transactions on visualization and computer graphics , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.499540Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:51df8d4779ce83778689004c333cd539b1602d407bc6cd92b9fafd8592b2a1b2","observation_id":"5d4f9468-cf0d-4013-913a-825b013242af","resolution":{"observed_at":"2026-08-15T14:25:39.499540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11931","last_updated":"2024-06-17T13:51:35Z","snapshot_observed_at":"2026-08-14T04:42:19.578053Z","submitted_at":"2024-06-17T13:51:35Z","title":"DeepSeek-Coder-V2: Breaking the Barrier of Closed-Source Models in Code Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11931","snapshot_observed_at":"2026-08-15T14:25:39.504351Z","title":"DeepSeek-Coder-V2: Breaking the Barrier of Closed-Source Models in Code Intelligence , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.504351Z"},"links":{"cited_paper":"/paper/2406.11931","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:14fa71683c546acfeb41f9d4b46d6d2a1617c109a85dfd22839803903cea630b","observation_id":"2da1d6ba-cf56-47bf-8f65-5cc0ba6deb40","resolution":{"observed_at":"2026-08-15T14:25:39.504351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06476","last_updated":"2023-11-19T15:43:58Z","snapshot_observed_at":"2026-08-18T18:57:47.901563Z","submitted_at":"2023-02-08T09:44:51Z","title":"Is ChatGPT a General-Purpose Natural Language Processing Task Solver?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06476","snapshot_observed_at":"2026-08-15T14:25:39.509539Z","title":"arXiv preprint arXiv:2302.06476 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.509539Z"},"links":{"cited_paper":"/paper/2302.06476","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:d7f793fffad00d542cbced1778030ad41917d04c8913047527277eb67c656f1a","observation_id":"354e91fb-10ad-4c50-aa56-f4a57ad8abce","resolution":{"observed_at":"2026-08-15T14:25:39.509539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.514845Z","title":"Language Models are Few-Shot Learners , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.514845Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:db9a352e35a39992dc8f573175f382b415bfcd9dc569da50266ca474accf951f","observation_id":"61da5a68-fb85-47c6-96eb-8c263ade93a2","resolution":{"observed_at":"2026-08-15T14:25:39.514845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.519236Z","title":"Transactions of the Association for Computational Linguistics , volume =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.519236Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:4a9bf7106efcf423d6e400aebabee8172eea89cbd946e89da8f76fabd9034783","observation_id":"dbba4a29-3183-429f-ab3f-743e201c3ab6","resolution":{"observed_at":"2026-08-15T14:25:39.519236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.524227Z","title":"EDA : Easy Data Augmentation Techniques for Boosting Performance on Text Classification Tasks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.524227Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:07f0d32f1762f150ebf4ebab5bef56cb2c8dde02b880eb1d7753d23a8843248e","observation_id":"511eb6ba-0f01-4c50-9c8e-75db434a0354","resolution":{"observed_at":"2026-08-15T14:25:39.524227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.529292Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.529292Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:beb1eb997d28d71c945b193c839b7c5c5f353cf6307288619eb05c67aace2cb7","observation_id":"c14048bb-f74d-4d7c-943c-c0a8c7cf6855","resolution":{"observed_at":"2026-08-15T14:25:39.529292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.534020Z","title":"Injecting Numerical Reasoning Skills into Language Models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.534020Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:fc84b6802d894773766a57a6fb642e3ad1097a3c8dbeb3f50d5874a8122c9d1c","observation_id":"d88fcaf8-c919-4788-b357-fada90764b58","resolution":{"observed_at":"2026-08-15T14:25:39.534020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.539125Z","title":"L ogic2 T ext: High-Fidelity Natural Language Generation from Logical Forms","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.539125Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:055b04801e703bc0b9e6a86fd7e6932ac62e0eeba04390161a370a87cc8d3167","observation_id":"f73a8af1-a4fd-4e11-8311-e2734e9fd99e","resolution":{"observed_at":"2026-08-15T14:25:39.539125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.543697Z","title":"BART : Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.543697Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:7ed6d608fb9c4ca1d930264e158d4f03321c6a7c3ba274052479fa672abc8d99","observation_id":"6c7eaf35-8d13-4790-afc2-fe00b9dbe86c","resolution":{"observed_at":"2026-08-15T14:25:39.543697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.548770Z","title":"A Call for Clarity in Reporting BLEU Scores","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.548770Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:4e650366e8c8da244254091a655214bd5ebe0680baea218818f193a63f01ff40","observation_id":"d45ae968-0e31-40a0-b339-dd5a976f9048","resolution":{"observed_at":"2026-08-15T14:25:39.548770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.553559Z","title":"Aho and Jeffrey D","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.553559Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:c8492f86e1a0409e37dd1ea13495e522b32490a55f40bcac2c5c422561e66713","observation_id":"34c01f6b-c9e7-42b2-9bac-2cd5649a15e4","resolution":{"observed_at":"2026-08-15T14:25:39.553559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.558141Z","title":"Liu , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.558141Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:4a52967a40bd84ad249a6f92268ff5ccc57f65f2ba287b0423b8016c651a0e8e","observation_id":"2084e2c4-7487-4239-9726-e11270531fa1","resolution":{"observed_at":"2026-08-15T14:25:39.558141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.562642Z","title":"Journal of Statistics Education , volume =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.562642Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:da70c9955caaf146d4325ad62af86d50e48746b22dd117cea88ed46091206bb4","observation_id":"95557cbc-e640-49e4-8fb7-c770a7c6cf76","resolution":{"observed_at":"2026-08-15T14:25:39.562642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.566938Z","title":"Irish Educational Studies , volume =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.566938Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:1e8af096f3742c69579042e20fcae9d3b28efa6574f9a98c8879e4da8895e7cc","observation_id":"c0106c22-8256-44e3-9169-7f6202f1563e","resolution":{"observed_at":"2026-08-15T14:25:39.566938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.571485Z","title":"2019 , journal=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.571485Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:c26f5f6a9ae50b7f0ff2b077ee14ee723a46aa9c37cba58e3a180724812e31ff","observation_id":"b37a52be-412a-4d48-a772-3077191ab8fb","resolution":{"observed_at":"2026-08-15T14:25:39.571485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.575698Z","title":"Proceedings of the 13th International Conference on Natural Language Generation , publisher =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.575698Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:d1d9bf1691182810b01b93b66853937441640ffc09835902c94aeb81c2910a1f","observation_id":"ef226e25-94a4-43e2-8fb0-803ade90ecd0","resolution":{"observed_at":"2026-08-15T14:25:39.575698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.580263Z","title":"2021 , type =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.580263Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:b7d34f1a26100dc55bbde3c501bf6e444a3a27182a2869f1851a4e877e374b48","observation_id":"f84b4e41-f1f2-4241-8946-be8461d3e1f2","resolution":{"observed_at":"2026-08-15T14:25:39.580263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.584792Z","title":"and Choudhury, Sagnik Ray and Giles, C","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.584792Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:cb56d1835baa4634516b9c269552a3e77e9e06bb772e8ade9a10c1c335cffae8","observation_id":"b55f43a6-bfac-4c2e-ac0e-8ed58f34e82e","resolution":{"observed_at":"2026-08-15T14:25:39.584792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.589240Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.589240Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:895d6fb47131ec45da50e668d72c4de4357b462fcd9b298ee1f3b3d5557cdac9","observation_id":"bd2d6eea-0f41-4da2-b4ac-16501c5ea107","resolution":{"observed_at":"2026-08-15T14:25:39.589240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.593598Z","title":"Chandra and Dexter C","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.593598Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:bcf7f815b24f2877b3316edee062cda9bba410021d2019702b67d5cc75db983d","observation_id":"c49cc378-3638-4d37-a122-fc4136a68af6","resolution":{"observed_at":"2026-08-15T14:25:39.593598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.597993Z","title":"Scalable training of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.597993Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:d0dcaee81c63d951a6562852d5de29750127b7c039b06cdcf69b99820317e2a8","observation_id":"a39f487f-aa60-4e16-b035-de9e4012f4f7","resolution":{"observed_at":"2026-08-15T14:25:39.597993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.603073Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.603073Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:c1d22fb7726e0a2d14180256fecba3b29a1809faace82d3c9f75660db5dc5db2","observation_id":"0ce1797d-82dd-4135-86ca-b8817541340c","resolution":{"observed_at":"2026-08-15T14:25:39.603073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.607491Z","title":"Tetreault , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.607491Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:8f92b544e58a89dc5918807d0d1ae218d8c693f512e16d44c52e6ccd12ebb811","observation_id":"d4687fb8-c3c4-4aac-8329-d7426d674193","resolution":{"observed_at":"2026-08-15T14:25:39.607491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.612046Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.612046Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:418aa3f82df3f8ad191601b6aff55e1c5d28b33ad30e884922d7046fd7b546c0","observation_id":"de25d929-a716-4cdd-80ed-540284ce7c04","resolution":{"observed_at":"2026-08-15T14:25:39.612046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.616598Z","title":"Proceedings of the IEEE International Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.616598Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:1a0cd5efdaef47f4ee13b195a1c60bf426b17ae944dcea46650e6c4fe0f6c3ca","observation_id":"3906bc30-1e45-4e02-9e00-e74be3a1271a","resolution":{"observed_at":"2026-08-15T14:25:39.616598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.621820Z","title":"2015 , eprint=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.621820Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:369e80af07824513a6b56a566e339bb1ffb9c640f6cd9f812c9d4c3d009ce5d5","observation_id":"e4de9f2c-f56e-4dc9-b57b-32fccf8786fe","resolution":{"observed_at":"2026-08-15T14:25:39.621820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.626141Z","title":"ECCV 2020 , year=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.626141Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:02d60467819c0b9e0c47e628170e9a993246c841b0e09edbe0542d5c2c39e39d","observation_id":"e00d1acf-2846-4c7c-b2b0-05a2c13d340f","resolution":{"observed_at":"2026-08-15T14:25:39.626141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.630578Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.630578Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:4ab34ff6ba3155f8308a531237aa48e365cffcfd174cfdae9cd0b00e796291f9","observation_id":"f3a7700c-cb69-4713-a05d-7a6984e21d5d","resolution":{"observed_at":"2026-08-15T14:25:39.630578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.635030Z","title":"Lawrence Zitnick and Devi Parikh , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.635030Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:48520afedd9d462746e84c45e1576c6e3ae7606d9af4767ad092231244ae0df2","observation_id":"f3d49247-4bf2-4e5d-a0ac-f5d984264e97","resolution":{"observed_at":"2026-08-15T14:25:39.635030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.639536Z","title":"The IEEE Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.639536Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:eb735fb92d1537e3575d9530f01187cba877194daba126b6aa7db979642a7f74","observation_id":"445b3a6f-cb96-489f-a4ea-cb31ebc7730f","resolution":{"observed_at":"2026-08-15T14:25:39.639536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.643822Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.643822Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:1fb1ecf3e8f29eed701231b2f1f54fb3974dd2db46cf03185557bd8668de74fc","observation_id":"5d94683a-a2c3-43f4-bda3-f4d62c297886","resolution":{"observed_at":"2026-08-15T14:25:39.643822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.648266Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.648266Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:112526cec3b59c349785ec5846b6b52d0de21483edc0340161cc94de8a834be9","observation_id":"b160b41c-2380-4d9a-a957-2677b5adc41a","resolution":{"observed_at":"2026-08-15T14:25:39.648266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-18T19:40:05.706404Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-15T14:25:39.652873Z","title":"arXiv preprint arXiv:2004.04696 , year=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.652873Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:b3f9933e0ebbe06c8a6dc2101d5148949203f1443f6246de1eb307fcb34c92f5","observation_id":"ec9f3953-4752-4921-8407-b27f85b7f755","resolution":{"observed_at":"2026-08-15T14:25:39.652873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.658064Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.658064Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:f0f52df7e59a910411fbc6495b7e33e950db35b8850d5bbe8203285fd6b99d2a","observation_id":"563f2f6b-bbd0-4eaf-bccb-429a2c0a0011","resolution":{"observed_at":"2026-08-15T14:25:39.658064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.12840","last_updated":"2019-10-28T17:51:44Z","snapshot_observed_at":"2026-08-16T10:20:20.328151Z","submitted_at":"2019-10-28T17:51:44Z","title":"Evaluating the Factual Consistency of Abstractive Text Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.12840","snapshot_observed_at":"2026-08-15T14:25:39.662932Z","title":"arXiv preprint arXiv:1910.12840 , year=","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.662932Z"},"links":{"cited_paper":"/paper/1910.12840","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:0b6f8ccdbf50d19f36e53ad2851d582dd0c72f40d57bbaaa85512a7b8b590ea5","observation_id":"e1ea5554-99ca-4ac5-80d7-18ef788f0d03","resolution":{"observed_at":"2026-08-15T14:25:39.662932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.669141Z","title":", volume=","venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.669141Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:6bf34cd50ba8b2a38e1f2ce197203df53d1db962cb2a7259b2a9d7bd9650b2c2","observation_id":"b78ff66b-934e-4b5e-b92a-9016dd6bfabc","resolution":{"observed_at":"2026-08-15T14:25:39.669141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-5615","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:40.805711Z","title":"Enhanced Transformer Model for Data-to-Text Generation","venue":null,"work_id":"d5a795e8-57d8-4aa0-9164-b143624776e5","year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.674014Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:88c4cae4af0194f40fcddba31b968515d3e785b0b8eb76fd88b55dfa59516f28","observation_id":"ee7f3ca8-67b1-4e81-9d8c-53e76e4fdd18","resolution":{"observed_at":"2026-08-15T14:25:40.810193Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.678552Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.678552Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:56458e1624c623d9c01bb796e77f05b4d194ec4a4341baabba1b568eae7df313","observation_id":"2c89c47e-0185-4149-9d90-021078e9b3e0","resolution":{"observed_at":"2026-08-15T14:25:39.678552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.682756Z","title":"Logical Natural Language Generation from Open-Domain Tables","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.682756Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:15f1f251596cabe3d1bbfb348e49df5ef89cd57edec4c332cfe5949a76be8489","observation_id":"328e1fd7-39e7-43f5-b9e4-f4ec3d2a7f27","resolution":{"observed_at":"2026-08-15T14:25:39.682756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1603.07771","last_updated":"2016-09-23T15:16:46Z","snapshot_observed_at":"2026-08-14T22:04:32.518538Z","submitted_at":"2016-03-24T22:40:00Z","title":"Neural Text Generation from Structured Data with Application to the Biography Domain","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.07771","snapshot_observed_at":"2026-08-15T14:25:39.687163Z","title":"arXiv preprint arXiv:1603.07771 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.687163Z"},"links":{"cited_paper":"/paper/1603.07771","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:2b8634daea7d979f9fdd6a7be10a8e4b8b6d4d46baa888b56180b0a9e5456606","observation_id":"6940a157-35f7-437d-b96d-e0ac2178d7ce","resolution":{"observed_at":"2026-08-15T14:25:39.687163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.691855Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.691855Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:5ee4323cf1496e55729fa90bdbb9b89101425e08c68a4fc0d3e3ca69d12e2bcc","observation_id":"e52dd40a-eca0-4bba-98b5-c37c346e4642","resolution":{"observed_at":"2026-08-15T14:25:39.691855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.03044","last_updated":"2016-04-19T16:43:09Z","snapshot_observed_at":"2026-08-14T23:00:34.588086Z","submitted_at":"2015-02-10T19:18:29Z","title":"Show, Attend and Tell: Neural Image Caption Generation with Visual Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.03044","snapshot_observed_at":"2026-08-15T14:25:39.697193Z","title":"arXiv preprint arXiv:1502.03044 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.697193Z"},"links":{"cited_paper":"/paper/1502.03044","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:390a83847522aeed786ac74c056d6e2ca0a1d6e5dc21fb55b9ec36a6bd97abf9","observation_id":"69ba891c-1942-407e-b130-029252c1363f","resolution":{"observed_at":"2026-08-15T14:25:39.697193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.702025Z","title":"Long Short-Term Memory , year =","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.702025Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:aa36bfe1eb90fffa2cd6372360f3733833b9d558ec199dcb52e44bf95e95a021","observation_id":"9f8af9fb-3a55-48f4-8291-d41a13eb700f","resolution":{"observed_at":"2026-08-15T14:25:39.702025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03230","last_updated":"2021-06-14T14:09:43Z","snapshot_observed_at":"2026-08-16T18:41:10.851922Z","submitted_at":"2021-03-04T18:55:09Z","title":"Barlow Twins: Self-Supervised Learning via Redundancy Reduction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03230","snapshot_observed_at":"2026-08-15T14:25:39.706430Z","title":"arXiv preprint arXiv:2103.03230 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.706430Z"},"links":{"cited_paper":"/paper/2103.03230","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:60abd61c62f31964f3cd69669ea1cd9ca0f374c725faff762f40a95acb001e04","observation_id":"63d92f2f-584e-49f1-8c28-8d60a301a798","resolution":{"observed_at":"2026-08-15T14:25:39.706430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.710872Z","title":"International Conference on Computer Vision (ICCV) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.710872Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:a728bdec8e6c5c7551c8f27b3846e8319903cbdf1ffc7b0fbd9bee0ab025bec6","observation_id":"fb8c5829-ac07-419a-bb38-98aa52557e91","resolution":{"observed_at":"2026-08-15T14:25:39.710872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.715065Z","title":"Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing , year=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.715065Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:8fe0b5353c248d464d6cfd5aad2af3930e449dc7927a2f20170377f335195e40","observation_id":"5a6d22d6-6bda-4807-8420-939a3b035e97","resolution":{"observed_at":"2026-08-15T14:25:39.715065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.719370Z","title":"ImageNet: A large-scale hierarchical image database , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.719370Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:1d7c1ac8ca58ee6a95f47313aa4eded1e9b5665c6134c4b9589bb0152e997d71","observation_id":"68a1315c-618b-4718-93db-c4b229c51186","resolution":{"observed_at":"2026-08-15T14:25:39.719370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.723613Z","title":"Computer Graphics Forum , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.723613Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:bf30866bf47fd0b021c8ee614832028512f18325c305eea005b98deabbb91a4d","observation_id":"8f04135b-b023-41ec-9add-34ea293f1982","resolution":{"observed_at":"2026-08-15T14:25:39.723613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.727747Z","title":"Proceedings of the 3rd Workshop on Neural Generation and Translation , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.727747Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:1074e693286f77506984cc1448bbe329df23d2846fb51c4c37e8cdbb0a353207","observation_id":"62d8cfb8-1aa8-47be-9ca6-9eca399cec1a","resolution":{"observed_at":"2026-08-15T14:25:39.727747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.732335Z","title":"Advances in neural information processing systems , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.732335Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:6def5b2424030c4eb7709fd636a734558e924a95ed1dc9bfb3530a5096c73804","observation_id":"861b5a0d-faa3-4535-9f55-1e2434a9da4d","resolution":{"observed_at":"2026-08-15T14:25:39.732335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.736894Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.736894Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:5596f448052e4a7c667c5f77399c8542016e21f085c88137cc3898250bc0e802","observation_id":"d03f336e-f195-4a0e-ace5-e80f7e63a72d","resolution":{"observed_at":"2026-08-15T14:25:39.736894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.03221","last_updated":"2019-06-07T16:41:52Z","snapshot_observed_at":"2026-08-14T16:19:06.164954Z","submitted_at":"2019-06-07T16:41:52Z","title":"Data-to-text Generation with Entity Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.03221","snapshot_observed_at":"2026-08-15T14:25:39.741312Z","title":"arXiv preprint arXiv:1906.03221 , year=","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.741312Z"},"links":{"cited_paper":"/paper/1906.03221","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:95345b30ca04a2912a849b88e3a74e5698ab37609e9854fd89b7b63dc976680b","observation_id":"274191a1-016f-4b5b-b35a-9c0b4dbcec6a","resolution":{"observed_at":"2026-08-15T14:25:39.741312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.00838","last_updated":"2016-01-08T23:07:32Z","snapshot_observed_at":"2026-08-14T22:34:03.087746Z","submitted_at":"2015-09-02T19:52:56Z","title":"What to talk about and how? Selective Generation using LSTMs with Coarse-to-Fine Alignment","version":2},"cited_work":{"arxiv_id":"1509.00838","doi":null,"metadata_source":"pith","pith_arxiv_id":"1509.00838","snapshot_observed_at":"2026-08-15T14:25:41.729529Z","title":"What to talk about and how? Selective Generation using LSTMs with Coarse-to-Fine Alignment","venue":"cs.CL","work_id":"b6c1265c-4545-4c1b-8ebe-4841686a4a79","year":2015},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.745752Z"},"links":{"cited_paper":"/paper/1509.00838","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:182ad1b833858f919953439e9fe1030dd67c15c221029779c55be0a2cf75b5c1","observation_id":"9b25c508-f09e-489c-a5c9-580d62a971bc","resolution":{"observed_at":"2026-08-15T14:25:41.734759Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.750464Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.750464Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:0399999e5efd79b7788f1e6b6696d6131b6ea3ca1c89281de1f1e36e306b6155","observation_id":"a5df8dc9-70e7-44a7-a2cd-19407e415727","resolution":{"observed_at":"2026-08-15T14:25:39.750464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.754933Z","title":"Proceedings of the 2020 CHI Conference on Human Factors in Computing Systems , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.754933Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:d526946aa444233a784c636428608356ed09a6b555d884637af74389f5cdbc88","observation_id":"52a3903c-b758-4a3b-bfa0-5fdc0de9ee24","resolution":{"observed_at":"2026-08-15T14:25:39.754933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.759486Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.759486Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:c09959de54af74e6c8cce4604ab8caee894ba08bec4a1ffd2f10d55691596bb3","observation_id":"ef21e896-b0e6-4bf1-8810-6a551be7a6f7","resolution":{"observed_at":"2026-08-15T14:25:39.759486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.07300","last_updated":"2018-02-22T22:50:42Z","snapshot_observed_at":"2026-08-15T22:53:17.165603Z","submitted_at":"2017-10-19T18:01:38Z","title":"FigureQA: An Annotated Figure Dataset for Visual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.07300","snapshot_observed_at":"2026-08-15T14:25:39.763812Z","title":"arXiv preprint arXiv:1710.07300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.763812Z"},"links":{"cited_paper":"/paper/1710.07300","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:7de30105069646cfe440c1e15f35935f934480336dbda08799b9aad6b2f6a0bd","observation_id":"f7493bf5-8515-43f0-98f4-61796f2eec4d","resolution":{"observed_at":"2026-08-15T14:25:39.763812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.769072Z","title":"Information Visualization , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.769072Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:b7753b9de12993b714703eb5aecfe48939cf1334904dfbe689ce50b0c9fd8fab","observation_id":"d8a8f2bd-f413-415f-8722-f65b6865d35e","resolution":{"observed_at":"2026-08-15T14:25:39.769072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.774391Z","title":"and Moore, Johanna D","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.774391Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:97d676d4381e81a1a35c6f647a6e9104e8f60fa997791118e30fb1e79cefc97d","observation_id":"d5b678ed-ed68-450b-bf94-c10ed215c084","resolution":{"observed_at":"2026-08-15T14:25:39.774391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.779367Z","title":"Knowledge and Information Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.779367Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:4dfbf657c794c9191f5df93f6c144c4a5ef2acf1cfa5c0e088e8c75759591904","observation_id":"f30c753e-d9ab-475b-aaa8-56232068b382","resolution":{"observed_at":"2026-08-15T14:25:39.779367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/coli_a_00091","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:40.773270Z","title":"Summarizing Information Graphics Textually","venue":null,"work_id":"9e5157a1-98d6-40ce-bcae-7a7a5cd6a5f8","year":2012},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.783878Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:06a9c74af51661a02adeea09797c19d4a7427a3e6b58c11249d5d9f010b0e342","observation_id":"44fb0bfa-4615-47e8-8c86-bff2b771a539","resolution":{"observed_at":"2026-08-15T14:25:40.777962Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.789276Z","title":"Rossi and Razvan C","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.789276Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:6a52bf5d3e4b7aac7933dd36570cdd01c48e548ae72d5db0ec02209c564c9901","observation_id":"f937dad3-e572-4f17-9fc4-42ae30950bcd","resolution":{"observed_at":"2026-08-15T14:25:39.789276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.793700Z","title":"Neural Text Generation from Structured Data with Application to the Biography Domain","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.793700Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:46ef256449ab70ff39bfc22237c5ea14fcc28bcbe8a5bc499ff3e1eae05c9d3e","observation_id":"31c6db9d-c2e1-49c2-b024-0d8b5681d72f","resolution":{"observed_at":"2026-08-15T14:25:39.793700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.798220Z","title":"Walter , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.798220Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:f235681499b6432d4e21d7c365dee9e6d5af1e89d9a658d787d11b9821cff2cd","observation_id":"c225a6dd-a2c3-4a55-b192-935644e2cccb","resolution":{"observed_at":"2026-08-15T14:25:39.798220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.802650Z","title":"Proceedings of the Joint Conference of the 47th Annual Meeting of the ACL and the 4th International Joint Conference on Natural Language Processing of the AFNLP , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.802650Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:f3cda5280630751d751bebb8b436d2c76f281b9f4c673d88c11a609a45830bdd","observation_id":"122d84ed-fd0c-41be-bdf6-e838f00ba4d8","resolution":{"observed_at":"2026-08-15T14:25:39.802650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.807308Z","title":"Proceedings of the 2017 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.807308Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:4b9f1959019c6dbec0a0d79a4278509643aa7a5d6ce50f34e78b39c3ca2b926a","observation_id":"9e16e733-808d-46b0-b9c6-1dfe05d427b2","resolution":{"observed_at":"2026-08-15T14:25:39.807308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.811690Z","title":"Artificial Intelligence , volume=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.811690Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:9609fbb2f5f7d62b35dd7a46471c422d7fb342a7ca3212818360f2b295b7b419","observation_id":"3425311f-a639-4f64-abc6-691ebda68d6b","resolution":{"observed_at":"2026-08-15T14:25:39.811690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.816707Z","title":"Collective Content Selection for Concept-to-Text Generation","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.816707Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:50fc9598662db174985d539a5f7b42810a47659fa3aeff52f77670933bd41fdd","observation_id":"d2f0fe83-604a-42fe-9a89-b469c4a608e7","resolution":{"observed_at":"2026-08-15T14:25:39.816707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.821589Z","title":"IEEE transactions on visualization and computer graphics , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.821589Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:c3dd19cf00355db39356f082bdff343edf8ca5daf8baa5879efc8d512ae5ef25","observation_id":"5e880444-d8e7-4acb-9ce1-29a69bc3ebf8","resolution":{"observed_at":"2026-08-15T14:25:39.821589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.826607Z","title":"IEEE transactions on visualization and computer graphics , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.826607Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:08386d7db5adbea05d95d76b77991551962ad8b479c2ad60363bc13e6d25bf44","observation_id":"98a4c118-d13d-4f5f-8a86-3dc4552b8943","resolution":{"observed_at":"2026-08-15T14:25:39.826607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.831876Z","title":"IEEE transactions on visualization and computer graphics , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.831876Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:99fe57e9d5d4bb6e94a33e9c942f979566921683da621a300c5e0f1b7e0d91cc","observation_id":"31995651-765f-4b74-8d8f-5439606c7aab","resolution":{"observed_at":"2026-08-15T14:25:39.831876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.836285Z","title":"IEEE transactions on visualization and computer graphics , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.836285Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:1fac2a782c6767c5d4c4457313ddabf480b9f7f5451ab0f158f601e502848c21","observation_id":"e4f24bbd-e9bf-43b4-985f-7247600f5f3b","resolution":{"observed_at":"2026-08-15T14:25:39.836285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.840630Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.840630Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:28b036bc7943b44674531fdd313b274dd3b7689de3ae0ca1f48896aa8337b2e3","observation_id":"1646dfba-13d5-4556-9943-70698c7fade2","resolution":{"observed_at":"2026-08-15T14:25:39.840630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.845131Z","title":"Applying Pragmatics Principles for Interaction with Visual Analytics , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.845131Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:ca645c03cca0378f123275cc89d544291e22c3b4946b274fe30f349b66015f52","observation_id":"519b72bb-e532-4e60-8d8a-dced484b2baf","resolution":{"observed_at":"2026-08-15T14:25:39.845131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3682.25336","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:41.631028Z","title":"2013 , issue_date =","venue":null,"work_id":"8a1f6119-482a-4217-97a4-6f6491985cf0","year":2013},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.854188Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:42a0257ade5f003136e1dc7a4f60b1d9ec0bf780049305082b57cd82b29e42b9","observation_id":"725c3b24-7d6f-4a4c-b0cd-6553bfd68143","resolution":{"observed_at":"2026-08-15T14:25:41.641170Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.858953Z","title":"Proceedings of the 29th annual international ACM SIGIR conference on Research and development in information retrieval , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.858953Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:14de31cbe444a9dcbb1758e9865b3c29aa76157199b0ea1cc0660f5d5f11b5e0","observation_id":"61c905a4-96ed-48bb-82c1-3d87b47a5722","resolution":{"observed_at":"2026-08-15T14:25:39.858953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.864095Z","title":", author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.864095Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:80e479ee8d43266c3c60a15c473cb799aecd9a93287f6daf0ed79420051bc633","observation_id":"7ad7a051-cba8-4878-9539-0f059c037e05","resolution":{"observed_at":"2026-08-15T14:25:39.864095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.868701Z","title":"Proceedings of the Eleventh European Workshop on Natural Language Generation , pages=","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.868701Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:8e58e877cafa918bec262989f4648fcf2d3d255830180d12a63578baf1974b07","observation_id":"e51fb0e4-4cd4-4ce3-adf7-e2eefb26eed9","resolution":{"observed_at":"2026-08-15T14:25:39.868701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.873352Z","title":"International Journal of Human-Computer Studies , volume=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.873352Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:1529bbfaa6ef82a42dc28bdc3d1f0cf1fc6f5312e27bc373408faa8bd5b9174b","observation_id":"8b0676a1-0237-4210-ac83-67c47ac97b31","resolution":{"observed_at":"2026-08-15T14:25:39.873352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.878955Z","title":"Eighth International Natural Language Generation Workshop , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.878955Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:cee55287c07aa60fb7be16100dc37a0cb59567d25c5d3fa52c2078440e331c46","observation_id":"25511cf2-7d0a-4fbf-a949-91c8c04ee177","resolution":{"observed_at":"2026-08-15T14:25:39.878955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.883986Z","title":"ACM Transactions on Computer-Human Interaction (TOCHI) , volume=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.883986Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:e5a1ce608199bd272abd68f5c9b8cd8ebae342218937bbf1167dd9176d9ef2a7","observation_id":"4e90633f-e0ce-4f18-946d-324243ec399e","resolution":{"observed_at":"2026-08-15T14:25:39.883986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.889096Z","title":"Proceedings of NAACL-HLT , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.889096Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:89344a4444be7b1825915f59734c13c5dcb27be3c12faa0888c4c11f1e741873","observation_id":"0e6011c5-e237-48da-a5da-119aede0fc74","resolution":{"observed_at":"2026-08-15T14:25:39.889096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.893637Z","title":"Proceedings of the 40th annual meeting of the Association for Computational Linguistics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.893637Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:667bf0662287d3b6b855f6a7bcd711a4f6e15bbe5918f2daebdab0be3cd99e61","observation_id":"1417d7bd-cf5b-4ea8-b657-9371a6c25cb8","resolution":{"observed_at":"2026-08-15T14:25:39.893637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.897902Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.897902Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:4e29765fd5177841cc8e176ba119c76f1ca636a034ee529818ab3f4fd5660cd3","observation_id":"5d83004d-6537-448d-b7fb-a7e89f88a0d5","resolution":{"observed_at":"2026-08-15T14:25:39.897902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.902288Z","title":"and Surdeanu, Mihai and Bauer, John and Finkel, Jenny and Bethard, Steven J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.902288Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:eb6be557932785361a89bb18e38190c37e0f01359ecc23e7bed6044d847e2365","observation_id":"985229a3-e09c-4a5e-af9a-999284f98eaf","resolution":{"observed_at":"2026-08-15T14:25:39.902288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.906646Z","title":"Proceedings of the 36th international ACM SIGIR conference on Research and development in information retrieval , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.906646Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:666cbdbfaad18b4b1efe96fb97cb8a1335dfb95eaed88e3d714a4cf6fa700de1","observation_id":"20a4c3ae-ef6b-4d94-a2e6-83fcfa1f3881","resolution":{"observed_at":"2026-08-15T14:25:39.906646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.911069Z","title":"Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing (EMNLP) , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.911069Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:181cfffc6430d70a2095c3530d9482f9f2f9360138157eeb3a2bbdb050e64634","observation_id":"9949da39-4091-40da-9728-3e332295b933","resolution":{"observed_at":"2026-08-15T14:25:39.911069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.916376Z","title":"2020 , isbn =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.916376Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:626aa376905a7405797aa9c092ab4c0cc4642c0181ba8f8aa067b8a5dd973b80","observation_id":"4a5fe9db-2a1d-4d0c-8c35-bf27ed26a060","resolution":{"observed_at":"2026-08-15T14:25:39.916376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.920940Z","title":"2021 , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.920940Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:4b01a1f546dae9129004c563c2ed7ae8063a41710f4d746ab5e086d34e0359d5","observation_id":"cea22199-5c96-4625-8495-2ba5e4b4e677","resolution":{"observed_at":"2026-08-15T14:25:39.920940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.08052","last_updated":"2017-07-25T15:42:25Z","snapshot_observed_at":"2026-08-18T19:46:11.460011Z","submitted_at":"2017-07-25T15:42:25Z","title":"Challenges in Data-to-Document Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.08052","snapshot_observed_at":"2026-08-15T14:25:39.925303Z","title":"arXiv preprint arXiv:1707.08052 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.925303Z"},"links":{"cited_paper":"/paper/1707.08052","citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:e13fa72bf1538f58c3fa6a8c607670e0bcb8d78ddc3359d162301341d2245fef","observation_id":"2f8a76b0-700a-4b7e-a5ad-20f8aee3346b","resolution":{"observed_at":"2026-08-15T14:25:39.925303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.930053Z","title":"2021 IEEE Winter Conference on Applications of Computer Vision (WACV) , year=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.930053Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:7bc7b9845a395d8b2c74f2c580c7ed88132d2d4d10cea80fae2d5c02e5e264cb","observation_id":"24a8eb9a-5542-40a6-a1da-91abc3411032","resolution":{"observed_at":"2026-08-15T14:25:39.930053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.934776Z","title":"Proceedings of the 24th annual ACM symposium on User interface software and technology , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.934776Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:a0159f6d552953b1f68c2cf3c40749b7adff0226b7ed2be96243e4723835317d","observation_id":"15e07914-3792-43a2-8e5c-c347259f03e5","resolution":{"observed_at":"2026-08-15T14:25:39.934776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.938947Z","title":"Proceedings of the 2017 CHI Conference on Human Factors in Computing Systems , year=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.938947Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:c053341b36bdd35fcd0a46d72f0620761bcd85ca575df533c3fee1ae526fa508","observation_id":"648e9df6-286a-4a37-becd-120a24303bc2","resolution":{"observed_at":"2026-08-15T14:25:39.938947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.943222Z","title":"CVPR 2021 , year=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.943222Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:f5e34b4fbf24b27d046743cf6a286c778d8e4a8277b04dd4e735cf70d45efd5f","observation_id":"6cd2f388-dc49-4609-83da-62896bda0d7e","resolution":{"observed_at":"2026-08-15T14:25:39.943222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.947754Z","title":"T a P as: Weakly Supervised Table Parsing via Pre-training","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.947754Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:9e80e9dc983f4629e31fc80f782288dcb2a2cf0e44ec6aa08515156007240f6c","observation_id":"8e6da200-a3af-452d-9328-35d2fdcf734b","resolution":{"observed_at":"2026-08-15T14:25:39.947754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.952743Z","title":"STL-CQA : Structure-based Transformers with Localization and Encoding for Chart Question Answering","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.952743Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:e0b7288fd571235c7b32eaee7ace1e4e4920cb34b08e7d4ec0c432b870a4cbcd","observation_id":"f31e18ed-2fd0-474a-86c7-09c71eaa2296","resolution":{"observed_at":"2026-08-15T14:25:39.952743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:25:39.957770Z","title":"Price and Scott Cohen and Christopher Kanan , title =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-15T14:25:39.957770Z"},"links":{"citing_paper":"/paper/2608.10408"},"observation_digest":"sha256:1910776686b32f4fa327fc87978e428813737f51117c65e51c900f2e1e43a8a0","observation_id":"e199aeb2-5f92-48b2-ac3d-e394361f5be7","resolution":{"observed_at":"2026-08-15T14:25:39.957770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.10408","last_updated":"2026-08-11T02:52:23Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T21:26:09.349117Z","submitted_at":"2026-08-11T02:52:23Z","title":"VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":96,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":242},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 100 of 242 outbound references and 0 inbound Pith citation observations for arXiv:2608.10408."}