{"as_of":"2026-08-12T15:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7f82a7d5f285242b59fab718ea15c00d68ca6ce32c054edd07c2072f27474571","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:47:10.445508Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.12821/citation-record","integrity":"/paper/2412.12821/integrity","json":"/paper/2412.12821/citation-record.json","paper":"/paper/2412.12821"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:11.606074Z","title":null,"venue":null,"work_id":"d87a7236-cf19-4652-9394-7b011bf8d85a","year":2019},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.090647Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:ab0cede7961a72306c21eb5d832c7edeee645a66a0bbf0a8487bdb4d2bfe97f9","observation_id":"57d762c4-b27f-4cc7-a289-f7d6e0561fcf","resolution":{"observed_at":"2026-08-11T13:47:11.614076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-11T13:47:10.096934Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.096934Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:e6f9f701d0f8ce9cb764d470bee1c2c32aaa91f97259b2947b29402e41e1c5b6","observation_id":"27e5640b-06de-4c95-a9d4-e183eb8da299","resolution":{"observed_at":"2026-08-11T13:47:10.096934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T13:47:10.104836Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.104836Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:f5605b113ce50e71387c3fcd4d961457ff0b33f8a4bee098e085560fc96ba1f6","observation_id":"86d99e30-a669-4abf-9a63-0cd59c6a7477","resolution":{"observed_at":"2026-08-11T13:47:10.104836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09231","last_updated":"2021-06-17T03:59:45Z","snapshot_observed_at":"2026-08-09T20:16:06.995783Z","submitted_at":"2021-06-17T03:59:45Z","title":"Knowledgeable or Educated Guess? Revisiting Language Models as Knowledge Bases","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09231","snapshot_observed_at":"2026-08-11T13:47:10.111219Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.111219Z"},"links":{"cited_paper":"/paper/2106.09231","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:d36a0cb10c4a3a1c6b2ba3c52f34681fc4a3ce618f313c7c52c458adc780b927","observation_id":"2acebd2b-437a-4ebf-bf76-36fd7cf21456","resolution":{"observed_at":"2026-08-11T13:47:10.111219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03279","last_updated":"2025-03-14T03:56:58Z","snapshot_observed_at":"2026-08-03T17:45:41.205934Z","submitted_at":"2024-05-06T08:52:11Z","title":"Lifelong Knowledge Editing for LLMs with Retrieval-Augmented Continuous Prompt Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03279","snapshot_observed_at":"2026-08-11T13:47:10.117575Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.117575Z"},"links":{"cited_paper":"/paper/2405.03279","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:a153fa845922b114aad3aa76d7a7c45858e9a0b60152a630184eb0c9b9f25c86","observation_id":"a3409c30-25b9-4d57-82f1-0952446c97c4","resolution":{"observed_at":"2026-08-11T13:47:10.117575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-11T13:47:10.125095Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.125095Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:9c3209a7e87670dec9d036c17e48e59096615f65af912a6d3e597f1bb7baf661","observation_id":"04ee6f75-05f0-4f8a-9250-5f0964272050","resolution":{"observed_at":"2026-08-11T13:47:10.125095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08475","last_updated":"2024-04-18T15:46:22Z","snapshot_observed_at":"2026-08-08T18:49:44.756391Z","submitted_at":"2023-10-12T16:32:44Z","title":"Can We Edit Multimodal Large Language Models?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08475","snapshot_observed_at":"2026-08-11T13:47:10.131571Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.131571Z"},"links":{"cited_paper":"/paper/2310.08475","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:3f71e10e11384f9c0c9314c16261b55aa2ff9c9f283e5a1e6dd99aa7fd9afbd8","observation_id":"7eff4c9d-b507-475c-9e65-5b6e8d6e1aca","resolution":{"observed_at":"2026-08-11T13:47:10.131571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08696","last_updated":"2022-03-10T02:28:59Z","snapshot_observed_at":"2026-08-10T23:57:00.263588Z","submitted_at":"2021-04-18T03:38:26Z","title":"Knowledge Neurons in Pretrained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08696","snapshot_observed_at":"2026-08-11T13:47:10.138604Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.138604Z"},"links":{"cited_paper":"/paper/2104.08696","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:b37b5fb3a3850960fb8e7229100c7f6e29b1d27b47c35919fe594c240756cd63","observation_id":"03fd64db-3374-4da9-b0e7-7949c78c742c","resolution":{"observed_at":"2026-08-11T13:47:10.138604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08164","last_updated":"2021-09-08T20:44:44Z","snapshot_observed_at":"2026-08-11T13:50:34.280135Z","submitted_at":"2021-04-16T15:24:42Z","title":"Editing Factual Knowledge in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08164","snapshot_observed_at":"2026-08-11T13:47:10.145803Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.145803Z"},"links":{"cited_paper":"/paper/2104.08164","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:b38c585f725eafa140003c5218017be9f4d2bf4c8941078a72a77f07cfc6f6a2","observation_id":"eb75ac9a-92b2-4ac9-bc13-00bd5b51a2b7","resolution":{"observed_at":"2026-08-11T13:47:10.145803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15349","last_updated":"2025-02-25T03:33:47Z","snapshot_observed_at":"2026-08-09T06:19:58.314147Z","submitted_at":"2024-05-24T08:42:40Z","title":"Everything is Editable: Extend Knowledge Editing to Unstructured Data in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15349","snapshot_observed_at":"2026-08-11T13:47:10.153523Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.153523Z"},"links":{"cited_paper":"/paper/2405.15349","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:85ab2172da3057eb3dfe360683149fdd5d91b381d856eed588c38acf61b21253","observation_id":"78dacf90-394e-4ba2-ab68-ad1ec8baf3d5","resolution":{"observed_at":"2026-08-11T13:47:10.153523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:11.586013Z","title":"R.; Eisenschlos, J","venue":null,"work_id":"cff18537-0410-42c9-a405-3feb8dd405a4","year":2022},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.159375Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:89610a88684b5296ee95780ca9e5b0e374be6e195054b07a2881c0c40c607fd0","observation_id":"da7caa23-9288-43d7-8d3a-67102af4f0e2","resolution":{"observed_at":"2026-08-11T13:47:11.592655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10360","last_updated":"2022-03-17T11:49:55Z","snapshot_observed_at":"2026-07-06T10:51:12.871009Z","submitted_at":"2021-03-18T16:30:26Z","title":"GLM: General Language Model Pretraining with Autoregressive Blank Infilling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10360","snapshot_observed_at":"2026-08-11T13:47:10.164964Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.164964Z"},"links":{"cited_paper":"/paper/2103.10360","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:6f90ba3897ebf57f7b9560df0eefbe6debcbf7e5aca5067a235ae2311c104dee","observation_id":"1501ea66-001f-4f2c-a1cb-5ea90ea239d7","resolution":{"observed_at":"2026-08-11T13:47:10.164964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:11.565661Z","title":null,"venue":null,"work_id":"e5cdee0f-253e-40dd-8a3a-712c5cf36149","year":2021},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.170359Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:ecc3c5df5793efba7235df7cd9731d0611f4f3fe13ea58dfeb9bf76189245173","observation_id":"1a12c068-0f69-42d4-82b7-9587a74d7f73","resolution":{"observed_at":"2026-08-11T13:47:11.572095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-11T13:47:10.175421Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.175421Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:4e0cb9624db5b99617655746562adcb14a9beca0a6d151b23180043850921336","observation_id":"65f8e467-5e81-4938-ad6b-78e18d0eedb4","resolution":{"observed_at":"2026-08-11T13:47:10.175421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.181174Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.181174Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:c7b33620974d3ba2e797c5bdea3c94017768b26be87b65fce33e8e5eb7535ddd","observation_id":"4c0160ef-f15c-43fb-92af-d6447de8b827","resolution":{"observed_at":"2026-08-11T13:47:10.181174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:11.534078Z","title":"J.; Guo, A.; Lin, C.; Grauman, K.; Luo, J.; and Bigham, J","venue":null,"work_id":"226db97e-110d-474a-82f7-15f99fccb940","year":2018},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.187400Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:4ea576a22f801b4ae650b047f5405a139f2ab35f1308a68c182e60bfa1eb4b6c","observation_id":"31153096-82e8-4f23-b1ff-008ad6e131a4","resolution":{"observed_at":"2026-08-11T13:47:11.541472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:11.515131Z","title":null,"venue":null,"work_id":"6c966f2e-b4b6-4d8c-8139-7fd41397b8bf","year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.193425Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:cacef20eb5aab5ad0a08b76c5a8eafd01bb794eab3d6fc6b48af9d7c95a5e2e6","observation_id":"f94cb3a2-22c7-42c0-b3d4-89597eff4937","resolution":{"observed_at":"2026-08-11T13:47:11.521491Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.201824Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.201824Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:3d29c3c3f7b034f4cd5e7ed0e01977574396af0018a3e14cfc39f06640216650","observation_id":"02ea0ffd-bc85-4653-b53d-f27580530fb8","resolution":{"observed_at":"2026-08-11T13:47:10.201824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:11.483161Z","title":null,"venue":null,"work_id":"753b17d2-b432-447d-9b0c-d779d310499c","year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.207211Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:383a9df435b8e7d8d989f54cd7a5265024922813af5e16526a740dfe18aeca7a","observation_id":"ee33cd01-1cbd-4300-ae9d-62e4cfc48e12","resolution":{"observed_at":"2026-08-11T13:47:11.489087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10987","last_updated":"2024-06-05T07:44:30Z","snapshot_observed_at":"2026-08-12T06:10:20.478481Z","submitted_at":"2024-02-16T05:29:59Z","title":"WilKE: Wise-Layer Knowledge Editor for Lifelong Knowledge Editing","version":2},"cited_work":{"arxiv_id":"2402.10987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10987","snapshot_observed_at":"2026-08-11T13:47:10.974515Z","title":"WilKE: Wise-Layer Knowledge Editor for Lifelong Knowledge Editing","venue":"cs.CL","work_id":"29ab651c-da96-4157-a0d1-702837fb09f4","year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.214411Z"},"links":{"cited_paper":"/paper/2402.10987","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:98754ae221fd1cc4b29efb90644c4346bcd566372f75b0e574351e40e9bb1c06","observation_id":"bc06605e-232a-4cd5-991b-00233597906b","resolution":{"observed_at":"2026-08-11T13:47:10.983242Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07350","last_updated":"2024-10-29T09:31:22Z","snapshot_observed_at":"2026-08-04T00:38:50.731587Z","submitted_at":"2024-03-12T06:16:33Z","title":"VLKEB: A Large Vision-Language Model Knowledge Editing Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07350","snapshot_observed_at":"2026-08-11T13:47:10.222440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.222440Z"},"links":{"cited_paper":"/paper/2403.07350","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:b8c61a2c8167e6e1ba3ce402885ac3a073009bc9e700743e481ff8146eb69d58","observation_id":"82aba7c6-01be-4fda-9353-7f14a3081fa3","resolution":{"observed_at":"2026-08-11T13:47:10.222440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09785","last_updated":"2023-01-24T02:12:42Z","snapshot_observed_at":"2026-08-11T01:11:45.889416Z","submitted_at":"2023-01-24T02:12:42Z","title":"Transformer-Patcher: One Mistake worth One Neuron","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.09785","snapshot_observed_at":"2026-08-11T13:47:10.230940Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.230940Z"},"links":{"cited_paper":"/paper/2301.09785","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:19765a5fbafcbaccd8c8f9cbb6758b91b1053c55b44188abf0bc634a9f1d09f9","observation_id":"08d89d71-e613-4d73-8c30-787fed73a53c","resolution":{"observed_at":"2026-08-11T13:47:10.230940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.237346Z","title":"A.; and Manning, C","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.237346Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:73681f762cffddd9ea5b7dc0a558018837d5016ac65223d24ef497f87c37b981","observation_id":"a573891f-1c1b-42bc-a195-196a1ad3941b","resolution":{"observed_at":"2026-08-11T13:47:10.237346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08825","last_updated":"2024-03-08T02:49:12Z","snapshot_observed_at":"2026-08-07T23:37:32.488201Z","submitted_at":"2023-10-13T02:41:55Z","title":"From CLIP to DINO: Visual Encoders Shout in Multi-modal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08825","snapshot_observed_at":"2026-08-11T13:47:10.243345Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.243345Z"},"links":{"cited_paper":"/paper/2310.08825","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:3cfd17d4f2dfaef2e0164e29e643f60fc0f5c4058f3e4c7fb6fa440ffadd1340","observation_id":"f191937e-84f9-4da9-bf32-adca4d8e3361","resolution":{"observed_at":"2026-08-11T13:47:10.243345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.250089Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.250089Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:e7c7a1d9112fbb6e8f2b5f83bb1e3de8cc920bd02ed44b92cc2e46c77c2de5c0","observation_id":"cdbd162f-c4bd-4d82-8127-55e780abe318","resolution":{"observed_at":"2026-08-11T13:47:10.250089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-11T13:47:10.256389Z","title":"X.; and Wen, J.-R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.256389Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:38a5e203590976eaa808adce282051492c9d2d2dd8ec8d120371aac820983161","observation_id":"b4bc3883-d764-4eb1-82da-08ae1fbdef78","resolution":{"observed_at":"2026-08-11T13:47:10.256389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.262655Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.262655Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:ec04bfc2c12781059672b8cde13c090f5b6b9a72b7173353a9c5a44d103c7ee7","observation_id":"766e1baa-824f-42b5-b57a-09616bb18a44","resolution":{"observed_at":"2026-08-11T13:47:10.262655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.267987Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.267987Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:5a137820c3cbe88565bdab6cbbf83df53ca1347d6d39d25e62043493e86d26a6","observation_id":"41db32f5-4695-44d4-b573-4ffb352941e1","resolution":{"observed_at":"2026-08-11T13:47:10.267987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-08-11T03:31:28.001151Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-11T13:47:10.275387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.275387Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:a6301adbbb7f98e8bad254b49d84093f0ef34b307af555072f6f61a8c6c4e751","observation_id":"073f704f-c212-4ad9-a2f0-bc08a0926295","resolution":{"observed_at":"2026-08-11T13:47:10.275387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-11T13:47:10.280761Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.280761Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:60af50d49b428b752d638db4637be91de022a8480b36f244ebcb962b359299a8","observation_id":"45dafc23-fc4b-40a8-acc9-a50c009a4bd7","resolution":{"observed_at":"2026-08-11T13:47:10.280761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-11T13:47:10.287018Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.287018Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:033fc95d572542c6539f1b62442fb50f2ee6ffb002bde7e5372dc7515efad064","observation_id":"ac5fa8b8-05f8-415d-9e88-2166ccb8904e","resolution":{"observed_at":"2026-08-11T13:47:10.287018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.293337Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.293337Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:4bafd5ab57536a2dc091228f4707ee21a0e10ca49da489da7b736d963dd63465","observation_id":"59b5327c-abae-435a-82bf-736f3ddf5a48","resolution":{"observed_at":"2026-08-11T13:47:10.293337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.298715Z","title":"D.; Gong, D.; Parvaneh, A.; Abbasnejad, E.; and van den Hengel, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.298715Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:b02024274de797c3c882fca293824287514b019ac5864c383c8fb69f6e1ae233","observation_id":"e88bf4e2-1f08-4405-94a6-4942ce463bd1","resolution":{"observed_at":"2026-08-11T13:47:10.298715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:11.390117Z","title":null,"venue":null,"work_id":"5fb3a40d-3482-4849-b3aa-b5a81ff6aa67","year":2022},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.307579Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:df8046a4de72d013a24fdff84df130bc2962c95a0f70309f923d0c146290c8c2","observation_id":"1110f87d-3d9f-4555-844f-64c151b7cdcc","resolution":{"observed_at":"2026-08-11T13:47:11.396886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.11309","last_updated":"2022-06-13T23:26:16Z","snapshot_observed_at":"2026-08-11T17:57:13.018546Z","submitted_at":"2021-10-21T17:41:56Z","title":"Fast Model Editing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.11309","snapshot_observed_at":"2026-08-11T13:47:10.316993Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.316993Z"},"links":{"cited_paper":"/paper/2110.11309","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:5c557e6e54dd2f4e8af7eba8b8682fa8c099126a7c5c2cb2b043bbb98c244d90","observation_id":"227c665c-8dee-4679-ba0a-92590c2d9aea","resolution":{"observed_at":"2026-08-11T13:47:10.316993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.323468Z","title":"D.; and Finn, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.323468Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:ea7df76e0a1497a970e2a8b25fc69c94fefc6ee446038ea47aa39aa6995e9474","observation_id":"e592e627-5edd-4870-9d94-6a1aa103d103","resolution":{"observed_at":"2026-08-11T13:47:10.323468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:11.357762Z","title":"O.; Aljundi, R.; and Turner, R","venue":null,"work_id":"0168b560-431d-403f-995f-ac1b7e9c7931","year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.333531Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:5e741fa966c7fb5b057f3e49da3e636d33f9c63fd32cb90e5dffaab9eb6b344f","observation_id":"b2ff7216-49d3-4e20-9187-bc0529ec135e","resolution":{"observed_at":"2026-08-11T13:47:11.365123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.344931Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.344931Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:77e5587fa2715d816412a23615f5a62dc84eeb640103428e436cc69fcaa99632","observation_id":"81eef166-18e5-4cbb-aa5b-207af4f16e00","resolution":{"observed_at":"2026-08-11T13:47:10.344931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17306","last_updated":"2024-03-31T03:52:14Z","snapshot_observed_at":"2026-07-06T17:50:39.208397Z","submitted_at":"2024-03-26T01:28:42Z","title":"Visual Hallucination: Definition, Quantification, and Prescriptive Remediations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17306","snapshot_observed_at":"2026-08-11T13:47:10.353360Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.353360Z"},"links":{"cited_paper":"/paper/2403.17306","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:96552405b60c057ff8d27e657640de5eb6dd5a82a8e0380a790b35728b2d190c","observation_id":"1615e1fd-9215-4dcf-a55e-c9ddf2f5ba7d","resolution":{"observed_at":"2026-08-11T13:47:10.353360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-11T13:47:10.360195Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.360195Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:203d49223d447124abe339c28a39b1d002263b6500bbb8c9b63cb1e78276cf0e","observation_id":"237abd52-3109-4399-9b06-6d6aff07e9f7","resolution":{"observed_at":"2026-08-11T13:47:10.360195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.365886Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.365886Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:140d1102ddaa1e20148adc18cb5445fd8c83b5810ebaaac51d6dea11d322984e","observation_id":"9bdbbf90-0494-4b82-b5ea-a3cb765de3b8","resolution":{"observed_at":"2026-08-11T13:47:10.365886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.372785Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.372785Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:c29d33c33876bd868322c9d4293669995776daef540e99802aaf644345fa2783","observation_id":"abe40325-4611-4a9a-ad7c-443465dafbe8","resolution":{"observed_at":"2026-08-11T13:47:10.372785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02882","last_updated":"2024-06-16T08:50:34Z","snapshot_observed_at":"2026-07-06T18:25:35.827334Z","submitted_at":"2024-06-05T03:00:15Z","title":"Outdated Issue Aware Decoding for Reasoning Questions on Edited Knowledge","version":3},"cited_work":{"arxiv_id":"2406.02882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.02882","snapshot_observed_at":"2026-08-11T13:47:10.651476Z","title":"Outdated Issue Aware Decoding for Reasoning Questions on Edited Knowledge","venue":"cs.CL","work_id":"7526896b-1bd8-49c8-bdc6-7c8a04b6e9a4","year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.378458Z"},"links":{"cited_paper":"/paper/2406.02882","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:357cf5293c32ebe80695cf88defa552b4b1ec260578c64753c4733d54897bffb","observation_id":"2a64d7ea-f3e7-4d9c-b433-4244c22482dd","resolution":{"observed_at":"2026-08-11T13:47:10.659068Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.384048Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.384048Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:636f3dc93979565a13dc2e25efea82028c69f194471e80620dd5b4bc7b6fb54c","observation_id":"6ffc9036-b64e-4176-966c-dc9ad85e40dc","resolution":{"observed_at":"2026-08-11T13:47:10.384048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T13:47:10.390089Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.390089Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:2fa5f5c59787ff0dd09f620bc8fcd717ce34d1f9d1b8cacd45849647a15dc5b1","observation_id":"5bc491af-737c-4f04-af04-66e623f521fb","resolution":{"observed_at":"2026-08-11T13:47:10.390089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.397208Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.397208Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:68bac21cd089eac7bc7220b9668ea8e5b854938aefe335e8669c2f5ca1d665ff","observation_id":"a2d6d42d-8f6f-48d0-aa95-6c7796614c6c","resolution":{"observed_at":"2026-08-11T13:47:10.397208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-11T13:47:10.405307Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.405307Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:0042a67533976c56ede80589544b4040c285880ead6c95743f1baf0471232237","observation_id":"79ddd22b-0ecf-4dfa-a98c-78c32280844b","resolution":{"observed_at":"2026-08-11T13:47:10.405307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-11T13:47:10.411945Z","title":"X.; Zhou, K.; Li, J.; Tang, T.; Wang, X.; Hou, Y.; Min, Y.; Zhang, B.; Zhang, J.; Dong, Z.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.411945Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:222af85b00f6f22655fca41f81c4d3892a59770b0b3e627313452e63253dda7e","observation_id":"7ac46096-a532-4878-a610-ccaae8ad5191","resolution":{"observed_at":"2026-08-11T13:47:10.411945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12740","last_updated":"2023-05-22T06:07:58Z","snapshot_observed_at":"2026-08-06T23:54:34.424656Z","submitted_at":"2023-05-22T06:07:58Z","title":"Can We Edit Factual Knowledge by In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12740","snapshot_observed_at":"2026-08-11T13:47:10.418614Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.418614Z"},"links":{"cited_paper":"/paper/2305.12740","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:6171734b9923154aaa1e075fa226c82174e2d15e92ee9c9cbe83e073a74a6eaf","observation_id":"9345c245-17f6-487c-a1ea-7110f407e48a","resolution":{"observed_at":"2026-08-11T13:47:10.418614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-11T13:47:10.425523Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.425523Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:ebaef49daece20e269ab965627abccc527eb5c63139866468f51a48e527b275c","observation_id":"3e990210-5b83-429c-b849-363c9bed3e82","resolution":{"observed_at":"2026-08-11T13:47:10.425523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.433157Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.433157Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:babb2628618f5c1f874062246ebaa05af3c065e83d23c6478b8d919cb34e6c03","observation_id":"3a88e135-cef5-4d21-af45-50a73ae8a205","resolution":{"observed_at":"2026-08-11T13:47:10.433157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:47:10.445508Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T13:47:10.445508Z"},"links":{"citing_paper":"/paper/2412.12821"},"observation_digest":"sha256:2dbd31d73599b4bd8819c952c6b9f367253aa0c571b35accd0c4fc15cd237339","observation_id":"84a3f000-69f1-4040-93d1-96421dd03946","resolution":{"observed_at":"2026-08-11T13:47:10.445508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12821","last_updated":"2024-12-17T11:41:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T13:39:20.940479Z","submitted_at":"2024-12-17T11:41:49Z","title":"ComprehendEdit: A Comprehensive Dataset and Evaluation Framework for Multimodal Knowledge Editing"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2412.12821."}