{"as_of":"2026-08-16T00:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08c6de440780b1e283dbab9f201621d766082b6c8776093b21e0f5ee247d9260","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:58:01.385743Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.21335/citation-record","integrity":"/paper/2507.21335/integrity","json":"/paper/2507.21335/citation-record.json","paper":"/paper/2507.21335"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.302775Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.302775Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:fc998ab4e3e757ba1bc81d3338256c2bc7746e4b78669f10b26ca0000a8274af","observation_id":"ac221131-ecee-4acd-abb9-c6c86238947d","resolution":{"observed_at":"2026-08-06T12:58:01.302775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.308197Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.308197Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:5a5a1350b8f936dbf2f3368359349b502f2a3a764ae1c12faf6e6f86fb349bc3","observation_id":"7b2211c4-390d-4cbe-ab4b-633b2ec7f258","resolution":{"observed_at":"2026-08-06T12:58:01.308197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.640486Z","title":null,"venue":null,"work_id":"de493874-41a6-4776-8795-be5ef4468805","year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.312144Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:012216b132ff057c025025bd46483aa4e3e90ff6502c3a77069cb5e0b6834376","observation_id":"c5b4d3c0-1a2c-419d-9779-3934d2920ca3","resolution":{"observed_at":"2026-08-06T12:58:01.644291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.315514Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.315514Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:df92dc18cab5c77234cfd50b64d5b348270d6d9c6474c3a1d566b322468208b6","observation_id":"3c9df4a3-3254-4c11-981a-b60aa734bb20","resolution":{"observed_at":"2026-08-06T12:58:01.315514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.619799Z","title":null,"venue":null,"work_id":"520f9932-b2bf-4270-9b5e-64cfbb3363f1","year":2022},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.318678Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:857446435f7fc0051b53710d68560384eb2a849527b7a8b455a6bfa3fda427a3","observation_id":"1aa4f239-c6eb-4355-ac41-6ca8b2f175a7","resolution":{"observed_at":"2026-08-06T12:58:01.623753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.607813Z","title":null,"venue":null,"work_id":"58452693-3603-4734-b35d-b9c04da920ba","year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.321753Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:0e05b8a9808cb43eeaf465d99046df6d2c6ada7a02b0e2513f2a474e1e1285f3","observation_id":"5199c0c7-3b31-4143-83d5-265b25749c74","resolution":{"observed_at":"2026-08-06T12:58:01.611618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.325361Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.325361Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:82f8fa6f98206fb9f9e16259386ee3141abeac0c2d4099e93a4295495fff6883","observation_id":"d36ac070-4fe3-4450-89a3-a821fb33626f","resolution":{"observed_at":"2026-08-06T12:58:01.325361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.328290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.328290Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:fc45f0775f04adbba00d42cfc49521f9313f1f9d5d2aefc64a842b30afea1c62","observation_id":"59166c72-65e1-463d-8dd8-a3576ed1365e","resolution":{"observed_at":"2026-08-06T12:58:01.328290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.584753Z","title":null,"venue":null,"work_id":"0480b878-119e-4bfb-835b-8c04094393b2","year":2020},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.331903Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:77d7ee7d7f8920a506bdc4fff240de39e0b3644e747566bb9d8c4f9bf8404fe1","observation_id":"65ed488e-0ecb-4c9e-bdf8-521923c9701b","resolution":{"observed_at":"2026-08-06T12:58:01.588246Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.573368Z","title":null,"venue":null,"work_id":"1b549cc9-fdff-4015-b7be-6ad6a3a4f7a3","year":2000},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.336014Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:8207a02ca45d019ec98604f84b7a04c8a5d858ccdf0c5a915eec5504e3697b0d","observation_id":"fb94189d-49ff-47d9-9a4a-c8a1f4284759","resolution":{"observed_at":"2026-08-06T12:58:01.576461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.563339Z","title":null,"venue":null,"work_id":"d607e636-4da8-4706-af7a-11c54efc9278","year":1998},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.339423Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:cbae72c7dde970334d4826b87d3d217ba6c35a9d096edbb68c4431028fbd3439","observation_id":"f248bbce-b326-4b73-bf50-53d02b89b04a","resolution":{"observed_at":"2026-08-06T12:58:01.566583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.342128Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.342128Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:42f7002489eeb5e796d1040ed6679e3b6adb8ced5461180b1d7fc99e8d58a98b","observation_id":"4a014d6d-249b-42d1-809f-50a756d54f61","resolution":{"observed_at":"2026-08-06T12:58:01.342128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.345600Z","title":null,"venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.345600Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:7813731466a7e92615619ecffa067642b2fac46e279f4f67f11682642b94a62d","observation_id":"bb6cf1e3-54a8-4f17-9fd0-22aa9bb54271","resolution":{"observed_at":"2026-08-06T12:58:01.345600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T12:58:01.348309Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.348309Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:a00deb1471580c9264c7bcef796db80b2f9d044eb8b7f7f38a8848361546b732","observation_id":"ba70bf8f-c936-463e-ac3e-6320ef72f1d7","resolution":{"observed_at":"2026-08-06T12:58:01.348309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.535448Z","title":null,"venue":null,"work_id":"3d1c6432-2148-4e23-a37c-c97a7286ff56","year":2018},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.351351Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:b76ed53544ea7a016a0b4c17effd2aa6c54db8fbd44f2f522142875a037595dd","observation_id":"eb506337-5b20-4aba-8996-9426aa66869e","resolution":{"observed_at":"2026-08-06T12:58:01.538651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.523928Z","title":null,"venue":null,"work_id":"82e93204-183a-4314-8702-0a22942eadbb","year":1996},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.355186Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:8b65e5435f2db61ecbb560d38864c91adc05488206c83be38ba5bd7315b9a1d3","observation_id":"62763ddb-5de0-4798-877e-a8973016e09a","resolution":{"observed_at":"2026-08-06T12:58:01.527054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.358224Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.358224Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:8dc0e69827b61269028a11b537360be80dab1c793403ff8cf52718bd5e2bd0cf","observation_id":"87b83ab0-41ce-4e1f-bc9f-6cdf1806f9be","resolution":{"observed_at":"2026-08-06T12:58:01.358224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.505434Z","title":null,"venue":null,"work_id":"e6587db0-50ac-431e-8637-6f6a2fb77b2f","year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.361372Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:63a41eb46673b502e41793b402fc632fafb04b833d4bfd877c70a4c9ab87aeca","observation_id":"38ceacf5-03cf-4ce2-8712-f53b785b74fd","resolution":{"observed_at":"2026-08-06T12:58:01.508515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.494526Z","title":null,"venue":null,"work_id":"0bcabf64-60f2-4550-8d58-ef98aeb89e6b","year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.364808Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:d170c92136af0a2f117bacc242ba1e40b8c6a7eee5a20c190ce53a879dd3e032","observation_id":"0707af02-b80a-44d0-b2ac-46492a695fe9","resolution":{"observed_at":"2026-08-06T12:58:01.497499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.481986Z","title":null,"venue":null,"work_id":"2be38aa9-1e80-453a-b127-3ee902c3c781","year":2020},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.367374Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:e2f6acebee8fad316b66f331f4e0fbb6a1a71ef34a5ddcf7aef6d846418c608a","observation_id":"706d9c05-8131-4f5d-8f69-22fa2424b87b","resolution":{"observed_at":"2026-08-06T12:58:01.485368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07490","last_updated":"2019-12-03T19:30:19Z","snapshot_observed_at":"2026-08-14T12:12:43.486524Z","submitted_at":"2019-08-20T17:05:18Z","title":"LXMERT: Learning Cross-Modality Encoder Representations from Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07490","snapshot_observed_at":"2026-08-06T12:58:01.370083Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.370083Z"},"links":{"cited_paper":"/paper/1908.07490","citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:d230524f130066f82ee12708c0e5f02b1e738b7281d581ab0c7c77fe2e7c57aa","observation_id":"91065e8e-bc80-41f5-afc7-13d83357015c","resolution":{"observed_at":"2026-08-06T12:58:01.370083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T12:58:01.372850Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.372850Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:64cc71190b1efcfbc12121328d901c41c5a39c16b8975e500605bda5b02822ad","observation_id":"7d6d7e5d-b647-4e1e-a79f-434632a8a03c","resolution":{"observed_at":"2026-08-06T12:58:01.372850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.470433Z","title":null,"venue":null,"work_id":"121230da-f8f4-4284-96ac-7e2a461c54e6","year":2008},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.376225Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:e4a871ecc42f28f5ee0865ec9adf0a03508fdb02eb6a9fd324c345f7748af16f","observation_id":"50b925df-0b02-4a8b-a625-8c0a8355c21b","resolution":{"observed_at":"2026-08-06T12:58:01.473907Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.459386Z","title":null,"venue":null,"work_id":"b346e9ff-c911-4a68-ab1c-eb18d69d900f","year":2022},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.379266Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:47491c88525ff102767722e0ce9cebe720ca295a83cf6f9967983fb15ca5ae51","observation_id":"b985f387-fc3d-4c59-aa04-4a9677e8d458","resolution":{"observed_at":"2026-08-06T12:58:01.463085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.446722Z","title":null,"venue":null,"work_id":"181ad80b-e975-43ab-9d46-086c96d92a06","year":2019},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.382308Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:8d5b4a219090e33b73ed9b73e4942c861139d67be658b7e647edf3de9c2d2866","observation_id":"5668cf93-4b5c-459e-ad80-fedab7362c86","resolution":{"observed_at":"2026-08-06T12:58:01.450808Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.385743Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.385743Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:f457cc1591e3bfc4c9463b62a228dcdb8ac589457b1776167f9f721c149649ac","observation_id":"cb497a8c-0093-4d53-8c1a-60f62f672650","resolution":{"observed_at":"2026-08-06T12:58:01.385743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T10:20:13.625811Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2507.21335."}