{"as_of":"2026-08-14T14:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:88f073d02068698ceaa20b2c71f06eab4c125a6ac3492aa93480d6227a249542","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:51:50.676043Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17467/citation-record","integrity":"/paper/2507.17467/integrity","json":"/paper/2507.17467/citation-record.json","paper":"/paper/2507.17467"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.240712Z","title":"Agrawal, D","venue":null,"work_id":"0e3e35d2-b0cc-46d7-b1ef-39c893cfad27","year":2018},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.530500Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:c9c66560a92d5a701dba014f9b9481f48ab5b6a764d24566719e611e825d28be","observation_id":"61adf578-82b2-41ec-9d48-de2f09b9e7db","resolution":{"observed_at":"2026-08-06T14:51:51.243836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.231340Z","title":"Alper and H","venue":null,"work_id":"3a4171a6-a385-4201-8c61-6603c4d1f2f0","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.534239Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:5ed8a8e1f922a51498c7e90cc9290b5a10ee524acf68375409cb0824c37db15b","observation_id":"aac17287-1032-401c-82ed-7501eba8fa44","resolution":{"observed_at":"2026-08-06T14:51:51.235269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.221988Z","title":"Baltrušaitis, C","venue":null,"work_id":"beb45899-9e6d-4ce9-8c50-c2468b087a42","year":2018},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.537762Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:fc7c2c29fe7d6fb8b3282737fddee52b2e7ec400c0d104f9f2765d7edcf55511","observation_id":"66241f6d-718c-48b2-8819-9645c6864f7c","resolution":{"observed_at":"2026-08-06T14:51:51.225615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.212730Z","title":"Bowman, G","venue":null,"work_id":"13d2d86d-bad4-4344-a25f-68fc6d6c5d97","year":2015},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.541095Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:6f9984c23dd985ab7527c47269be8b832700a7fdf2775ce3fe76be4caeddff96","observation_id":"1d380abc-9c7f-42cf-bdda-c2bc2578985e","resolution":{"observed_at":"2026-08-06T14:51:51.216423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.204061Z","title":null,"venue":null,"work_id":"aa77d560-c78a-48a3-a938-e8fdf36f541b","year":1901},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.544560Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:0f70db952a9f8928043fba07dcdc75479a7a6ada2a9e74f37283d118d8de4ebb","observation_id":"ba84257a-fd28-4242-ad1a-92502925d058","resolution":{"observed_at":"2026-08-06T14:51:51.207438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.195157Z","title":"Conwell, J","venue":null,"work_id":"4f0b8d44-8910-4a6c-82e3-ad6669c0334a","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.547985Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:6a8060d3e8fe2f8213a018c2230cf42dd63c1d0f6f5f675adbad8f8ddfbaffcc","observation_id":"51fbb5c5-584e-4edc-b121-9f2efab44cd3","resolution":{"observed_at":"2026-08-06T14:51:51.198178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.186059Z","title":"Dagan, O","venue":null,"work_id":"33acd548-6789-44b7-a43e-4945ccf5f64f","year":2005},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.551441Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:6812c74fabfc41614573d0e78602d3ce144650fdc0c7b522c5019f36cdfcd811","observation_id":"83c74acf-e084-4ed2-b41c-1f261584818d","resolution":{"observed_at":"2026-08-06T14:51:51.189215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.176695Z","title":"Dettmers, A","venue":null,"work_id":"ad869da6-800b-41dd-aef5-38574d933d76","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.554628Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:ab60208b99c3053aa218c41b506d1f651d779c22e9878868a4679c1357366d4d","observation_id":"1fd248cc-454d-4fcc-97eb-4518746eeedd","resolution":{"observed_at":"2026-08-06T14:51:51.180308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.167845Z","title":"Diwan, L","venue":null,"work_id":"92192869-e22c-43cb-8abf-4833f4a76032","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.557890Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:959a3e0c2a57e037d7fba8135318d8bc52e5d17ae38a3646add2f7faf66518e1","observation_id":"9e6e62f1-0e20-4031-89f5-41ae27063327","resolution":{"observed_at":"2026-08-06T14:51:51.171291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.158206Z","title":"Do, O.-M","venue":null,"work_id":"d6896093-ba47-4ffc-ae48-678b84c965b8","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.560912Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:54276d60c260266139b418c4e0ba5c3d66c3f39aed5fc981dae086211aab72df","observation_id":"470b264a-1ed7-4d7c-b893-a9f462d33fef","resolution":{"observed_at":"2026-08-06T14:51:51.161675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.149875Z","title":null,"venue":null,"work_id":"bafcbdeb-4803-46fb-a476-3403deb77265","year":2025},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.567512Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:e58891272161fa5a506ecbffc76c5f910aee63a00e915780e4d5c6a632315d98","observation_id":"470f1f3f-bef8-468c-86cd-eb91d75221f5","resolution":{"observed_at":"2026-08-06T14:51:51.153106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.141205Z","title":"Goyal, T","venue":null,"work_id":"57fcea7d-db7c-4fd9-98a6-b24ba0cab5ff","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.570897Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:4d636044fc9cc0065f8bdb6dc604850c4596f1a8b034d41cd09bd37640179800","observation_id":"1674a2f0-408d-4340-849b-30437acd6598","resolution":{"observed_at":"2026-08-06T14:51:51.144402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.132743Z","title":null,"venue":null,"work_id":"34ea456d-8446-4dee-9169-a7f457a846c1","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.576964Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:9ab07b33bba688bc9ff87451f9e30346f3a860d18900d602c68160740c254202","observation_id":"0ad876fa-645a-4831-b1a7-46a169fc9abd","resolution":{"observed_at":"2026-08-06T14:51:51.135805Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.124092Z","title":"Hendrycks, C","venue":null,"work_id":"cb15ec45-44f7-4fd3-bcb1-1d660cace103","year":2021},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.580048Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:30b5de5023588b44adcb7780d84267197515d6a3ae8b6acaf707a55dababe2d6","observation_id":"b99f9fd6-ce36-46e2-85b5-50fab5f50fe7","resolution":{"observed_at":"2026-08-06T14:51:51.127401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.114061Z","title":"Jabri, A","venue":null,"work_id":"735f4b3e-7818-4452-b09a-f7f578ce11a6","year":2016},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.582987Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:c9568a08e8843ac9969bd2bf57586abc7eeb56db6a5ed585e32e89d111cc8225","observation_id":"1225beb0-20d3-4f6e-9d90-6c9e96175f89","resolution":{"observed_at":"2026-08-06T14:51:51.117849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.585906Z","title":"Kamath, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.585906Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:98f6ca4f315d2b3cc2aabb7306f9678493ef556f3e61d36c1aed7ac82e2d2d37","observation_id":"a1f2a7ba-7347-4160-b798-f673b7b4fcd1","resolution":{"observed_at":"2026-08-06T14:51:50.585906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.105208Z","title":"Kayser, O.-M","venue":null,"work_id":"2e2b3fc2-9037-40a6-8a50-d8837989b384","year":2021},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.588988Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:b721f2b84553b0dc5af0d28d16065ab248b81984df8506fba53c3c9a4b0d0f86","observation_id":"0be34735-fcbd-44ba-9fcd-4c55cd0b9b4f","resolution":{"observed_at":"2026-08-06T14:51:51.108513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07955","last_updated":"2024-08-15T02:18:08Z","snapshot_observed_at":"2026-08-13T20:35:08.227991Z","submitted_at":"2024-01-15T20:42:16Z","title":"A Study on Large Language Models' Limitations in Multiple-Choice Question Answering","version":2},"cited_work":{"arxiv_id":"2401.07955","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07955","snapshot_observed_at":"2026-08-06T14:51:50.931551Z","title":"A Study on Large Language Models' Limitations in Multiple-Choice Question Answering","venue":"cs.CL","work_id":"1287730d-63b4-4f47-b6da-3deb3720e95e","year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.591975Z"},"links":{"cited_paper":"/paper/2401.07955","citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:741c95ea78bd55143a7657100f5221c29a61b1869fffd8a6009d7b8a7f107122","observation_id":"3c233bd1-64b2-4d1a-af04-dc89e7e17fbc","resolution":{"observed_at":"2026-08-06T14:51:50.935110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.095877Z","title":"Kouwenhoven, K","venue":null,"work_id":"01017ed6-a478-4e1e-9d70-3ba5e931cf00","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.595709Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:fad007c9e10c38a87604af58657ae22a3f33762f454dd2cb1d1f7a2b8f0cbbe5","observation_id":"a3e7a8cd-d157-40b7-8669-82f20315fc0c","resolution":{"observed_at":"2026-08-06T14:51:51.099418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.086457Z","title":"Lapuschkin, S","venue":null,"work_id":"ed83c15e-0d22-44de-83f0-e1c5fd65f622","year":2019},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.601707Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:a0bba1d73590de3df65bb3fbdcf3b6dc5477437df7ace1cb53bebcbba2d9adf2","observation_id":"67082a30-dcca-4f77-a2dc-b8f7ce85ed61","resolution":{"observed_at":"2026-08-06T14:51:51.089812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.077071Z","title":null,"venue":null,"work_id":"aecab9d4-61ce-4d85-ac5a-ecb07a50430f","year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.604686Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:ff785977b1c53fd4c9e1616fb52a92ed439bb66c7aa0106372182ecf870eb774","observation_id":"03ca06ae-1dce-4d34-a581-c05c7217618e","resolution":{"observed_at":"2026-08-06T14:51:51.080285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.607638Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.607638Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:8e066359deca863763d0613b1047d1487207f8086b02a9bb01d3d9cb7b9b1b8e","observation_id":"faebbbd4-82d5-41db-beb7-e381824cc4a1","resolution":{"observed_at":"2026-08-06T14:51:50.607638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.610565Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.610565Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:d22abf21ebc079d03df7f448349f9721e9547999fc8dd30566800b8e7369c485","observation_id":"ab69fc3d-2e51-4fe6-8cd6-95358c8debd8","resolution":{"observed_at":"2026-08-06T14:51:50.610565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.067867Z","title":"Millière and C","venue":null,"work_id":"08ed76c0-c08e-4d1d-9b52-e1b8be5a7bb1","year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.613417Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:9970e1cad685e31b9d231a9a7e73f017aa526cce8b5ec50cd305a005eac74ee5","observation_id":"22701fad-6767-41e6-92f2-ab5308341715","resolution":{"observed_at":"2026-08-06T14:51:51.071184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.048703Z","title":null,"venue":null,"work_id":"5f55644e-15ef-4d65-81d3-cbf9767e10e4","year":2025},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.619402Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:8bd2fe5391dd31691d05ccacd36a895572e4e5bee4c89c9d3d831794cbe08ce8","observation_id":"4d4cc267-c833-4812-b9bb-a2e844eadac7","resolution":{"observed_at":"2026-08-06T14:51:51.052057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.037876Z","title":"Mitchell and D","venue":null,"work_id":"09726462-f0fc-48a3-9595-3c9a0cdbe735","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.622150Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:8f11c4e100caf09f0e4cb6d813367752cd596662b8d38e87d127ad5f81637c8b","observation_id":"f8cea98f-d6b8-410c-9586-0f675163474b","resolution":{"observed_at":"2026-08-06T14:51:51.042135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.027633Z","title":"Muttenthaler, J","venue":null,"work_id":"a4595547-5679-4b65-b683-f2bdae46cf38","year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.624957Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:640347b54066eb745ca6be51df25a4eec25a94dd5db70e8bc93600219abf0448","observation_id":"89d95f19-a1b0-4c32-8760-4c1f0bb0305e","resolution":{"observed_at":"2026-08-06T14:51:51.031359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04231","last_updated":"2023-03-29T08:48:35Z","snapshot_observed_at":"2026-08-13T13:25:23.174477Z","submitted_at":"2022-12-08T12:28:23Z","title":"Harnessing the Power of Multi-Task Pretraining for Ground-Truth Level Natural Language Explanations","version":2},"cited_work":{"arxiv_id":"2212.04231","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.04231","snapshot_observed_at":"2026-08-06T14:51:50.838500Z","title":"Harnessing the Power of Multi-Task Pretraining for Ground-Truth Level Natural Language Explanations","venue":"cs.CV","work_id":"1f5b9e76-5200-44f3-8052-f46ae5f96bc4","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.628101Z"},"links":{"cited_paper":"/paper/2212.04231","citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:e9a21622ee5bde2082e7dd5a7ee0014442fa950669128f549417f79714ed60cc","observation_id":"5978a572-316c-4181-9e77-edbe33f93f06","resolution":{"observed_at":"2026-08-06T14:51:50.844270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.631222Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.631222Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:371b20a1881d357ef6b6f9fee9d630834c81a17dc76e624649827f6d4f470f8c","observation_id":"ed235610-6163-4f84-b16d-d0950dcfb4ce","resolution":{"observed_at":"2026-08-06T14:51:50.631222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.634020Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.634020Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:d6ad3b9e8cdbe5ba059e28bc91a51230b16ce7c09bcdef94ca6aabd450426c56","observation_id":"eb6a3e63-5cd6-43d6-9380-f9511997d53e","resolution":{"observed_at":"2026-08-06T14:51:50.634020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.636974Z","title":"Shiri, X.-Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.636974Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:79d07d62d21a9894233524b806e87683b83e137ffe2878161d191c5748f543d5","observation_id":"247aed77-8d17-43ba-b623-93952b408f3f","resolution":{"observed_at":"2026-08-06T14:51:50.636974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.006927Z","title":"Thrush, R","venue":null,"work_id":"3a93cafd-b4c7-4828-9401-c716728c3cb1","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.642940Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:51b40a523b7b61b037024467bac667ab3406fe1176eb8d5208e92313d47db2d5","observation_id":"4cb86626-ab72-406d-a853-6c6ca4f656bb","resolution":{"observed_at":"2026-08-06T14:51:51.011309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.645687Z","title":"Verhoef, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.645687Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:982c2a24f50ff8d0095271ed9f66cf2305ea899b0bfcbe831004adca31376c5d","observation_id":"991d4357-8b0b-47f1-836f-024aac3c68a1","resolution":{"observed_at":"2026-08-06T14:51:50.645687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.996791Z","title":null,"venue":null,"work_id":"348e3c8d-4601-4df1-bc2e-841cb2e5cd0e","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.648623Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:1148edb5d7a00529aad8fcee23a73a17c9659c8dcd96e66fec5ecb9bb73d14be","observation_id":"db37623d-b3c1-42b2-94f3-79c4c248033c","resolution":{"observed_at":"2026-08-06T14:51:51.000457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.651506Z","title":"my answer is C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.651506Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:d3a86a75193f0988275e511ba339d5976a27381bc6bb6801083e7539b18a6936","observation_id":"248c295d-a541-4f74-b303-f7d3d0022f88","resolution":{"observed_at":"2026-08-06T14:51:50.651506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.654451Z","title":"Weber, E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.654451Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:307ce8561ce471a3fc13c6cb98594dd7d6db15b67dcef06d6a341395b48fa641","observation_id":"f98e0b0f-3cb8-4179-94e9-6401bccdc659","resolution":{"observed_at":"2026-08-06T14:51:50.654451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.987165Z","title":null,"venue":null,"work_id":"d9c30010-d9f9-43a8-9c27-2649399eaba8","year":2022},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.657624Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:c571e9f0d3f356ee36ed2cba50f9ac0bda1a28825bfd6adb71aba6b7c918ab10","observation_id":"58157d25-1cca-4766-9037-6d7de0be2081","resolution":{"observed_at":"2026-08-06T14:51:50.990292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.10582","last_updated":"2019-01-21T03:07:54Z","snapshot_observed_at":"2026-07-06T07:17:07.332183Z","submitted_at":"2018-11-26T18:37:25Z","title":"Visual Entailment Task for Visually-Grounded Language Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.10582","snapshot_observed_at":"2026-08-06T14:51:50.660432Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.660432Z"},"links":{"cited_paper":"/paper/1811.10582","citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:a086625f1302effc0e15ae0d1db0777c302ee36e0f4a39c15fe17c906a6c72a8","observation_id":"539712ab-8c3d-424b-aa00-648877d7836f","resolution":{"observed_at":"2026-08-06T14:51:50.660432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.977980Z","title":"Zhang, V","venue":null,"work_id":"255d6416-8605-4e15-a1d4-6aa6f3db3f38","year":2020},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.663945Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:22e8802e4a66e7721ab7a9fd9a2cb7c6112c7ae7402721edaf7a8728aa9108c8","observation_id":"9bc8f9cd-5eae-4623-a635-38860ab99ed2","resolution":{"observed_at":"2026-08-06T14:51:50.981230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.958719Z","title":null,"venue":null,"work_id":"2e0cb5ac-66b3-4694-b374-a958675e051a","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.670254Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:371f376a6c7a9630df16de311ee99838a848165a3a9533bfba5e5911afba602a","observation_id":"63cb6713-0dc5-49fd-a88f-879d10198ba1","resolution":{"observed_at":"2026-08-06T14:51:50.961867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.968775Z","title":null,"venue":null,"work_id":"4aec01a8-8321-4c27-b9f7-727146608d56","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.673125Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:3ddb7afec10bb26ea321284f9d81df96cfdb371455a4d1614812c0d550181e3f","observation_id":"bedc76e7-7512-480f-bfdc-031d0633b442","resolution":{"observed_at":"2026-08-06T14:51:50.972099Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.949483Z","title":null,"venue":null,"work_id":"8422698d-07c5-452d-b782-3c6cc395a733","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.676043Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:b39575b31005b611e3e8539e6cdfd0a9d7423136e66084a774606723b04450b5","observation_id":"26d15cd2-9656-4eb1-9e83-daa8e40cf9a8","resolution":{"observed_at":"2026-08-06T14:51:50.952632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.017878Z","title":null,"venue":null,"work_id":"d9847db3-a1ad-4456-bd9e-96f3200327c4","year":2024},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":1195,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.639926Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:25ec128f1b994494e29a978237672f3212ec5ed917f0ae3f8ea5ecf4f097dc17","observation_id":"d9109c39-35ff-40b4-ba91-1e86d992d6d4","resolution":{"observed_at":"2026-08-06T14:51:51.021076Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.574067Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.574067Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:17a4199e5c750b619d2689fd974011ba3be7494517c29f99ba46c2ab1b578b9c","observation_id":"7bf8dee9-d1ff-4d1d-b7f9-61a2c4e8a293","resolution":{"observed_at":"2026-08-06T14:51:50.574067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.03744","last_updated":"2021-08-19T09:26:21Z","snapshot_observed_at":"2026-08-13T15:13:10.127553Z","submitted_at":"2020-04-07T23:12:51Z","title":"e-SNLI-VE: Corrected Visual-Textual Entailment with Natural Language Explanations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.03744","snapshot_observed_at":"2026-08-06T14:51:50.564041Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.564041Z"},"links":{"cited_paper":"/paper/2004.03744","citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:ca4cd9fa52861af32cb665c48b9b7783e532af09894e80e9936a04741c12b33f","observation_id":"047f491e-9d67-4e66-8c4c-ab48ac450641","resolution":{"observed_at":"2026-08-06T14:51:50.564041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:51.057979Z","title":null,"venue":null,"work_id":"c27d809e-9a21-40cd-93af-8f1346e48a55","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.616166Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:c31bcea8a64f3622aa5f340e22285bef1f4e43b5eed140e3f23d17ff635d50e5","observation_id":"c5a606e3-b6b8-4be2-8444-8776ec5c2976","resolution":{"observed_at":"2026-08-06T14:51:51.061515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.10013","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:51:50.918388Z","title":null,"venue":null,"work_id":"e1e5c039-8436-46b1-8610-fd6bfd5f7f73","year":null},"citing_paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T14:51:50.598794Z"},"links":{"citing_paper":"/paper/2507.17467"},"observation_digest":"sha256:0c2b583336d7fe27a4c694808b94b9b160cad0878fb371bee762439c1c7766b9","observation_id":"b1b499f7-9bf9-44e0-a5a2-49bcde5cbf6b","resolution":{"observed_at":"2026-08-06T14:51:50.923240Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17467","last_updated":"2025-07-23T12:46:51Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T03:42:52.728365Z","submitted_at":"2025-07-23T12:46:51Z","title":"Probing Vision-Language Understanding through the Visual Entailment Task: promises and pitfalls"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":3,"verified_fuzzy":20},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2507.17467."}