{"as_of":"2026-08-23T11:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a73de2118dc6639aa217df8648be7be5b3cc59f41a550a6f0f326426bddfaab","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:37:52.424689Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.09159/citation-record","integrity":"/paper/2509.09159/integrity","json":"/paper/2509.09159/citation-record.json","paper":"/paper/2509.09159"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:50.894535Z","title":"Ok-vqa: A visual question answering benchmark requiring external knowledge,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:50.894535Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:de7eba2f8538d95bc652c05cf8c55285654bb52b0420da199155b6c16bc655dc","observation_id":"a07b7c29-e279-4a51-a306-2446feb57729","resolution":{"observed_at":"2026-08-04T19:37:50.894535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:50.974484Z","title":"Vqa: Visual question answering,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:50.974484Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:442e53c78f8f7639238c0163b211d07c3ca21e04d04f210466f5ec93f6f79be5","observation_id":"83efb83a-0e4e-4ca4-a9f9-82e756f27b18","resolution":{"observed_at":"2026-08-04T19:37:50.974484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.042425Z","title":"Krisp: Integrating implicit and symbolic knowledge for open-domain knowledge-based vqa,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.042425Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:5d4486dd008c11c7ec9260d8654b3f717b701d2f53cfa21bc4e0dddb4ddd5cc6","observation_id":"34b58d61-907a-4d50-a040-4981d09ab56d","resolution":{"observed_at":"2026-08-04T19:37:51.042425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.129782Z","title":"Weakly- supervised visual-retriever-reader for knowledge-based question answer- ing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.129782Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:a8bf451ee6c02f2113e53ff4dd80208ffde3f486ce67ab5bd6c41228bee13fe8","observation_id":"c3eb1eec-27db-40ee-b3e8-274736133fbb","resolution":{"observed_at":"2026-08-04T19:37:51.129782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.230318Z","title":"Conceptnet—a practical commonsense reasoning tool-kit,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.230318Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:5d6b725258bdc3196bf5530a849365ed9bbb450be9b1afecf19971b4cb140a01","observation_id":"f4044ebb-6b00-4c76-86b0-faa91bc68fe1","resolution":{"observed_at":"2026-08-04T19:37:51.230318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.302400Z","title":"Wikidata: a free collaborative knowledgebase,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.302400Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:dbd8c5c32f187a5ca8e2f5874c7353352ee651985fa01a711f9c2ba56852e6bc","observation_id":"88ddd3c4-4808-4004-83d7-e4ac348c7447","resolution":{"observed_at":"2026-08-04T19:37:51.302400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.376819Z","title":"An empirical study of gpt-3 for few- shot knowledge-based vqa,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.376819Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:34f52a34608baa08ceaeccb145ac30829e13728f66bb51bd44231e8146a4b003","observation_id":"bb1bee8b-9f69-4c29-8575-f1c0f40c141c","resolution":{"observed_at":"2026-08-04T19:37:51.376819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.433327Z","title":"Promptcap: Prompt-guided image captioning for vqa with gpt-3,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.433327Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:e01533397678c90a803c6417085b47b4d46a9e00fad6dbb78b2c53a190666277","observation_id":"5e64fde6-2148-4d1a-9d92-bbca0b6975cd","resolution":{"observed_at":"2026-08-04T19:37:51.433327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.513128Z","title":"Prompting large language models with answer heuristics for knowledge-based visual question answering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.513128Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:f7c54a976d85fb6838d88d4a6a32d116f61090433f5857e5a7d37441de0a5e46","observation_id":"0d8122c5-af46-4644-a04a-ac0aa88072fd","resolution":{"observed_at":"2026-08-04T19:37:51.513128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.557955Z","title":"A simple baseline for knowledge-based visual question answering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.557955Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:0f1b92861e9b3e2d1152e71a8046443411612a14f120b888ee27d301a1e3553c","observation_id":"c106c386-860e-4a63-9b91-e974ff84ceef","resolution":{"observed_at":"2026-08-04T19:37:51.557955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15346","last_updated":"2024-07-22T03:05:32Z","snapshot_observed_at":"2026-08-19T00:17:00.788017Z","submitted_at":"2024-07-22T03:05:32Z","title":"Knowledge Acquisition Disentanglement for Knowledge-based Visual Question Answering with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15346","snapshot_observed_at":"2026-08-04T19:37:51.602950Z","title":"Knowledge acquisition disentanglement for knowledge-based visual question an- swering with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.602950Z"},"links":{"cited_paper":"/paper/2407.15346","citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:ee7fb029fc6fe79e42d0c94588c5f4d12438946ad961ff998cfbdc7bf1f6ae20","observation_id":"e3c08c35-b567-4df0-a0eb-ef9653f3374c","resolution":{"observed_at":"2026-08-04T19:37:51.602950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.680808Z","title":"Retrieval augmented visual question answering with outside knowledge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.680808Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:6817ef020a90ac16f27886a795ae7b0f32af30ee30d8f98ab3d9260435183423","observation_id":"6a878b65-fb04-4602-9f6f-9322ad66edc8","resolution":{"observed_at":"2026-08-04T19:37:51.680808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.761216Z","title":"Self-bootstrapped visual-language model for knowledge selection and question answering,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.761216Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:7e5bfa17e730d279f57c2a41777b105797754ff48373ea522fed044573c251fa","observation_id":"25b138ef-8e71-408b-a634-c3d59b477a30","resolution":{"observed_at":"2026-08-04T19:37:51.761216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.820163Z","title":"A-okvqa: A benchmark for visual question answering using world knowledge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.820163Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:b9df3d81cb1859da8ca9737eba08ef88cd83977e44a23b4fbe92bf85232a8bf5","observation_id":"28ebc970-51e9-4b4e-91e3-876325b098ac","resolution":{"observed_at":"2026-08-04T19:37:51.820163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.905895Z","title":"Kat: A knowledge augmented transformer for vision-and-language,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.905895Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:b9ccf187eea819c0f6d64d9fdf42cbd5e8d268ead687f42322d2ada5d07db97b","observation_id":"c8a9a941-a485-47f3-9629-af419ca41048","resolution":{"observed_at":"2026-08-04T19:37:51.905895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:51.972528Z","title":"Revive: regional visual representation matters in knowledge-based visual question answering,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:51.972528Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:375ff882660bdbac034dd70dc44abad6432e47f8b92a3b0ccf4ac481d94d184c","observation_id":"24a25799-80d1-4f9a-b8cd-06ccd8688ecc","resolution":{"observed_at":"2026-08-04T19:37:51.972528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:52.017873Z","title":"Fine-grained late-interaction multi-modal retrieval for retrieval augmented visual question answering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:52.017873Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:bb3ed84d8b6efef2f1e0b35ac33dfce2bfbff4f8164178b947e559c5168e362b","observation_id":"14299f28-0bee-4a3d-a19e-391a7673054b","resolution":{"observed_at":"2026-08-04T19:37:52.017873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:52.068855Z","title":"Deep modular co-attention networks for visual question answering,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:52.068855Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:8ff4ad08c70b96977ff394c7306daa85b8e05c689f58c3de88111907577c1395","observation_id":"96d9d140-9daa-4875-a113-9ee803e1b01b","resolution":{"observed_at":"2026-08-04T19:37:52.068855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:52.128504Z","title":"Plug-and-play vqa: Zero-shot vqa by conjoining large pretrained models with zero training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:52.128504Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:9503638dea1c9aa4e239b4d96ae2d8780c7b732be85541f1cc6a491dd43384ad","observation_id":"4382623b-ad3e-4775-8909-551f8e7d2edf","resolution":{"observed_at":"2026-08-04T19:37:52.128504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:52.211170Z","title":"Webly supervised concept expansion for general purpose vision models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:52.211170Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:a02f5ec49295369b771de862de7b281294a7d6a7d919f503accd7b6ed99108e7","observation_id":"072cbfb6-5098-4b8a-8bbe-c4d8ffdaa415","resolution":{"observed_at":"2026-08-04T19:37:52.211170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T19:37:52.258305Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:52.258305Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:d8d3c33e22bc8ccbdef43090d67c1bb1546ccedfca7f966a16a393bfaf4065bd","observation_id":"5b0c9225-d55c-4870-991a-b3b0090de48c","resolution":{"observed_at":"2026-08-04T19:37:52.258305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-04T19:37:52.344454Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:52.344454Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:cda64bcf270f73e8afe33d9666ef601785e2f67ef9667bbc43465543742eb9c8","observation_id":"22279ef3-9385-4098-8cb8-ca5894b5eac9","resolution":{"observed_at":"2026-08-04T19:37:52.344454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:37:52.424689Z","title":"Instructblip: towards general-purpose vision-language models with instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:52.424689Z"},"links":{"citing_paper":"/paper/2509.09159"},"observation_digest":"sha256:a240d6f889225b8eba6ab92bd0b53297f9c448c4aec4dbea039ce66c6add7f8d","observation_id":"06d52617-1243-4fcc-bdd8-f52df4398ec3","resolution":{"observed_at":"2026-08-04T19:37:52.424689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09159","last_updated":"2025-09-11T05:40:26Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T21:15:19.436903Z","submitted_at":"2025-09-11T05:40:26Z","title":"A Knowledge Noise Mitigation Framework for Knowledge-based Visual Question Answering"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2509.09159."}