{"as_of":"2026-08-21T22:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2646349a8e2b57422c17858a969cd89c0e3084b3132bef180d1fa890ea51688b","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T04:43:20.831117Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:50:19.280108Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T00:50:19.564824Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"cited_work":{"arxiv_id":"2509.06010","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.06010","snapshot_observed_at":"2026-08-12T00:50:19.564824Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","venue":"cs.CV","work_id":"ae23c111-a4f0-4ad8-9a13-05c0186db608","year":2025},"citing_paper":{"arxiv_id":"2608.07861","last_updated":"2026-08-08T01:58:13Z","snapshot_observed_at":"2026-08-20T16:08:07.187646Z","submitted_at":"2026-08-08T01:58:13Z","title":"How Much Does It Cost to Answer My Question? Benchmarking Cloud VLM-based VQA Systems","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T00:50:19.280108Z"},"links":{"cited_paper":"/paper/2509.06010","citing_paper":"/paper/2608.07861"},"observation_digest":"sha256:2df589563e1e313daa1497bf89683c92ae38818b008a91891278d6b690bf6acc","observation_id":"ed1391d9-df16-421e-b77a-79a1b2965b96","resolution":{"observed_at":"2026-08-12T00:50:19.569534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.06010/citation-record","integrity":"/paper/2509.06010/integrity","json":"/paper/2509.06010/citation-record.json","paper":"/paper/2509.06010"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:23.674550Z","title":"Vision-language model-based polyformer for recognizing visual ques- tions with multiple answer groundings","venue":null,"work_id":"9868ca70-ab90-4a24-9476-de9d9a5abfdd","year":2024},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:18.629579Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:59089d137bae1cb5d24ba43f5a7eb2f56e36d2c879dc6756194510415f5a3203","observation_id":"a71d3b19-4d05-44c9-bd8a-678cf942a4cf","resolution":{"observed_at":"2026-08-05T04:43:23.704356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:23.547105Z","title":"Remote assistance for blind users in daily life: A survey about be my eyes","venue":null,"work_id":"0cc19d82-efc5-442a-b647-8b26e5a7f88a","year":2016},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:18.722461Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:4aed886c0b8956c1c26cecca30ddd1a577f79c02bb7788ffe327ed0c9cd3a8f3","observation_id":"7969617d-6b83-4407-b0c4-90192c9a1b68","resolution":{"observed_at":"2026-08-05T04:43:23.597271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:23.412159Z","title":"Vqa therapy: Exploring answer differences by visually grounding answers","venue":null,"work_id":"1af7bfd8-d248-4b45-9d13-f1dd373aeb3e","year":2023},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:18.812578Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:0a0bd714bfa11ba00177033114effadc7484a2cea86039863212c6d78fb1124f","observation_id":"038400d4-9bfc-4000-91bf-9a075d73091f","resolution":{"observed_at":"2026-08-05T04:43:23.481862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:23.239847Z","title":"Refining pseudo labeling via multi- granularity confidence alignment for unsupervised cross domain object detection.IEEE Transactions on Image Processing, 2025","venue":null,"work_id":"ecee06a6-1499-4ecc-9a5f-5af860456742","year":2025},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:18.934653Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:dc2a5ec292e86622b984a5cf14c91155d3e43cb26881d58787b67d6f000e2883","observation_id":"88fb4172-b046-4b0a-97de-69bb7b728e07","resolution":{"observed_at":"2026-08-05T04:43:23.318942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:23.079629Z","title":"Vqask: a multimodal android gpt- based application to help blind users visualize pictures","venue":null,"work_id":"b7203d1c-665b-4a1d-a1a7-e8332fad4beb","year":2024},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:19.079205Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:77ccb88b3d7d4e5545df0c07d0a5988ec92544e9565bcb46284fe1e272657b56","observation_id":"17b92c3e-06ea-40ea-81ea-36dc0b1b2806","resolution":{"observed_at":"2026-08-05T04:43:23.155782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:22.936025Z","title":"Towards understanding the use of mllm-enabled applications for visual interpretation by blind and low vision people","venue":null,"work_id":"4dfe01aa-81f3-45af-a391-c8590c809906","year":2025},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:19.198124Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:2707503d85cc8abb2e5f2e7b835571663a441f114cdd23f15a9a90dbc23c3046","observation_id":"c35eb609-729a-4598-892a-f983135fa42f","resolution":{"observed_at":"2026-08-05T04:43:23.013945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:22.761037Z","title":"Vizwiz grand challenge: Answering visual questions from blind people","venue":null,"work_id":"34e99916-0679-444f-a9c9-aba165b48ae9","year":2018},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:19.299838Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:599a300b45a7f9ba7db2dd27b97837dceda16f7fe3e470d6cd7b6a84164a4038","observation_id":"61ae3016-6ceb-4779-84ac-d3683cd7abef","resolution":{"observed_at":"2026-08-05T04:43:22.856931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:19.427202Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:19.427202Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:f5d42b55104853381ddd7ac4962df0f771beab1943f351b8ff959b5a0f593965","observation_id":"74eaca94-984d-4733-a645-be52a4ed3189","resolution":{"observed_at":"2026-08-05T04:43:19.427202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:22.599226Z","title":"Consistency and uncertainty: Identifying unre- liable responses from black-box vision-language models for selective visual question answering","venue":null,"work_id":"a6de80ec-8f35-405e-894a-fbb9d4d6f8cd","year":2024},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:19.511234Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:b6e3b9ef9993d866a6d631e357e717600dc5cf1733e585d33464357e6bf05e19","observation_id":"22e64f2a-a691-47bb-921b-5355012f4667","resolution":{"observed_at":"2026-08-05T04:43:22.658833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:22.497915Z","title":"Dual-branch fusion with style modulation for cross-domain few-shot semantic segmentation","venue":null,"work_id":"111837cc-2b20-45e7-84b2-f29b173ff42a","year":2024},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:19.621669Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:7d142edc6262ef6603ab51d834c39ed49f1833b1f3b27926dd5267cc0031af6c","observation_id":"3e5d52a3-e44c-4d03-858f-be4c7f564a44","resolution":{"observed_at":"2026-08-05T04:43:22.540118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:22.345499Z","title":"Natural language understanding and inference with mllm in visual question answering: A survey.ACM Computing Surveys, 57(8):1–36, 2025","venue":null,"work_id":"cd10c5dd-874e-4e3c-b9a7-70d16e2937be","year":2025},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:19.745316Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:4709fee25805f64d19eb5f37f1426451a8b4fc1905ad4ccf2c4c3c6e3ad9e0cf","observation_id":"13112c59-87cd-4b19-bb27-628a24cc6a46","resolution":{"observed_at":"2026-08-05T04:43:22.407626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:22.195029Z","title":"Blip-2: Boot- strapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"7f3966fe-d0a1-47c3-b48b-3af430c1c9f8","year":2023},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:19.846109Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:3e12391ad7a0f6864145e197e74473a43caa074182c710511f0130c744b1a0a6","observation_id":"8a0b82b8-71f9-4ab7-9d16-3712a3cb19fa","resolution":{"observed_at":"2026-08-05T04:43:22.242938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:22.082304Z","title":"Polyformer: Referring image segmentation as sequential polygon generation","venue":null,"work_id":"a24b66e9-2f98-4a8f-85d1-08d284e91f45","year":2023},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:20.005306Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:86e879dfc0d70ae125d06726ba874f398f54cf5c001dd66a02a7fd15d418aa16","observation_id":"59ab5756-76b5-4888-b221-fabfbf80582e","resolution":{"observed_at":"2026-08-05T04:43:22.135019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:22.002303Z","title":"An astute assistive device for mobility and object recognition for visually impaired people.IEEE Transactions on Human-Machine Systems, 49(5):449–460, 2019","venue":null,"work_id":"083ce9df-d2be-4e9a-8673-09947b55a8e8","year":2019},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:20.210949Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:6ddc6165c15ec33bf021e9f14464670b434f302ccf1e53c34856e08c387b75dc","observation_id":"4cc3c410-d558-428a-a2d3-d7f83cd29085","resolution":{"observed_at":"2026-08-05T04:43:22.046250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:21.937629Z","title":"Dynamic conceptional con- trastive learning for generalized category discovery","venue":null,"work_id":"7a465f75-e309-4c62-98bc-343850d32123","year":2023},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:20.357680Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:bf8988e8cc141cead2320f3be7d21966af6143432d3ab809dc9798f4e207a0c1","observation_id":"51efa02b-fb72-4e61-b604-ec675b7df3fa","resolution":{"observed_at":"2026-08-05T04:43:21.954258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:21.814526Z","title":"Advances in few-shot action recognition: A comprehensive review","venue":null,"work_id":"dd9c91d4-abf7-4c03-a5e0-1a14e4d6f7cf","year":2024},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:20.466310Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:245fa67f10cac5e3aa77fec4a6c14d7df7ffa80b760bf6d77838c22d92435dc9","observation_id":"73ebf983-0b0a-4f26-9844-b897620e2f23","resolution":{"observed_at":"2026-08-05T04:43:21.873693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18023","last_updated":"2025-07-21T10:20:03Z","snapshot_observed_at":"2026-08-16T13:15:03.343823Z","submitted_at":"2024-09-26T16:31:50Z","title":"DARE: Diverse Visual Question Answering with Robustness Evaluation","version":2},"cited_work":{"arxiv_id":"2409.18023","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.18023","snapshot_observed_at":"2026-08-05T04:43:20.943411Z","title":"DARE: Diverse Visual Question Answering with Robustness Evaluation","venue":"cs.CL","work_id":"b97b1255-8008-4643-aa5d-6ce909b07379","year":2024},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:20.547086Z"},"links":{"cited_paper":"/paper/2409.18023","citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:7ebb5d0c45ce08e1c73a74bafb0f3653e60fc508538691757cd0f00e58b53e2a","observation_id":"2743f3ba-f3bf-4408-b218-19313375d57a","resolution":{"observed_at":"2026-08-05T04:43:21.034136Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:21.714852Z","title":"the smart vision glasses","venue":null,"work_id":"ae3c04d4-ec98-46dd-8d66-e65f31df1afe","year":2025},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:20.632394Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:16afaa51fd4fb35a1303e6b8b1b92da8b383e18b8aa5be2674c21f212dd49d4a","observation_id":"7cfad7f6-621b-40f6-80f5-cb3990f11da5","resolution":{"observed_at":"2026-08-05T04:43:21.753393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:21.539776Z","title":"A survey of 17 indoor travel assistance systems for blind and visually impaired people.IEEE Transactions on Human-Machine Systems, 52(1):134–148, 2021","venue":null,"work_id":"4b045fef-ef85-4985-a835-83ba1ddc8d20","year":2021},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:20.706463Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:3356e3ae9d8bd73db3195bb532ab697cc5f972f3262236ab8cfe09f137dcdea4","observation_id":"55a58566-607d-42f3-8275-e293688f50dc","resolution":{"observed_at":"2026-08-05T04:43:21.627116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:21.353719Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers","venue":null,"work_id":"235ed484-1237-47c9-8b12-fa4c997441a9","year":2020},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:20.778291Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:a3aef30edfe2fd905d2a3e49e9dcf7c8b3343f1f40aee1115677acd1d4c9b5c5","observation_id":"3793b5f3-9b50-4591-b94c-5f3bf8166f85","resolution":{"observed_at":"2026-08-05T04:43:21.422605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:43:21.150307Z","title":"A survey on vqa: Datasets and approaches","venue":null,"work_id":"cc124c10-8b8b-4ea9-88e9-81b433c74d8b","year":2020},"citing_paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T04:43:20.831117Z"},"links":{"citing_paper":"/paper/2509.06010"},"observation_digest":"sha256:0770061c4e81a1d2784e9f556f035fcbf6519a27931a5684a139032d305e8c38","observation_id":"c3c93b60-2266-480f-a13a-eabe623cbcae","resolution":{"observed_at":"2026-08-05T04:43:21.238294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.06010","last_updated":"2025-09-07T10:58:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T21:58:29.706187Z","submitted_at":"2025-09-07T10:58:17Z","title":"BLaVe-CoT: Consistency-Aware Visual Question Answering for Blind and Low Vision Users"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":1,"verified_fuzzy":19},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 1 inbound Pith citation observation for arXiv:2509.06010."}