{"as_of":"2026-08-11T02:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:24796e071d1e74d3494a57604d980b9a36cc9a57cf1b091f5b1eb0f168ab0452","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:08:11.949078Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T07:03:38.967856Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T07:16:44.552295Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"cited_work":{"arxiv_id":"2507.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23135","snapshot_observed_at":"2026-07-02T07:16:44.552295Z","title":"Iso- bench: Benchmarking multimodal causal reasoning in visual-language models through procedural plans","venue":null,"work_id":"8ec98dcf-a363-4cd1-92d9-c14bfc195ade","year":2025},"citing_paper":{"arxiv_id":"2605.22903","last_updated":"2026-05-21T17:35:04Z","snapshot_observed_at":"2026-08-07T15:24:22.420892Z","submitted_at":"2026-05-21T17:35:04Z","title":"Seeing without Looking: Do Vision-Language Benchmarks Really Test Vision?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T05:58:35.466105Z"},"links":{"cited_paper":"/paper/2507.23135","citing_paper":"/paper/2605.22903"},"observation_digest":"sha256:4d60812b0a9448b36d03b0d21c45ad50e0d2d604c20e245da26603dff652cc76","observation_id":"bb71e7c2-0b06-4a11-9331-f8655048e47c","resolution":{"observed_at":"2026-05-25T06:00:23.374343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"cited_work":{"arxiv_id":"2507.23135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23135","snapshot_observed_at":"2026-07-02T07:16:44.552295Z","title":"Iso- bench: Benchmarking multimodal causal reasoning in visual-language models through procedural plans","venue":null,"work_id":"8ec98dcf-a363-4cd1-92d9-c14bfc195ade","year":2025},"citing_paper":{"arxiv_id":"2606.04479","last_updated":"2026-06-03T05:53:58Z","snapshot_observed_at":"2026-08-03T21:43:54.545392Z","submitted_at":"2026-06-03T05:53:58Z","title":"Evaluating Reasoning Fidelity in Visual Text Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T07:03:38.967856Z"},"links":{"cited_paper":"/paper/2507.23135","citing_paper":"/paper/2606.04479"},"observation_digest":"sha256:ee41a2d827a2f818052bb131392085f61f8ff9bd7953ad81f9ce15b014d78bbc","observation_id":"4954dfd8-bcb3-44da-a3a1-680c1a743376","resolution":{"observed_at":"2026-07-02T07:16:44.554325Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.23135/citation-record","integrity":"/paper/2507.23135/integrity","json":"/paper/2507.23135/citation-record.json","paper":"/paper/2507.23135"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:16.245029Z","title":null,"venue":null,"work_id":"0ddc63ce-4895-4c53-af9e-ad818e923b3d","year":2018},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:08.616476Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:23c22005823df14fc49272393d1d6aea8d8016c8380bebce88dc1fa636845f47","observation_id":"e7943dac-0e18-4d48-899b-9b9aee6d8048","resolution":{"observed_at":"2026-08-06T11:08:16.354811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:16.015440Z","title":null,"venue":null,"work_id":"785dc3b4-7773-45f2-add2-ecef9b598805","year":2018},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:08.722246Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:dad034053a7336b63c9a354701c3afda2515f79015dab83affd054136a3e0f35","observation_id":"238bad71-0938-4270-b812-051d02b01192","resolution":{"observed_at":"2026-08-06T11:08:16.128884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:08.871600Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:08.871600Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:d7f392a21ccbd3a466af887b2461a8ee9b1dd57150c0e5db2ed9d2bacd1dc816","observation_id":"cbd87005-60de-41c8-a98c-b892af7e5c45","resolution":{"observed_at":"2026-08-06T11:08:08.871600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1457","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"174d8b2f-54a9-42cc-b47b-ba0abbbed10d","year":2019},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:08.971397Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:36c64aa2ae0dd2f6740219c78e76bc17c1689fcf0e16f05647954c484e716a48","observation_id":"ed4fdecc-49b3-48e5-af32-9069940bf7fb","resolution":{"observed_at":"2026-08-06T11:08:13.218674Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.728","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"0be01243-5d7b-40b4-8c7d-351f5971d45b","year":2024},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.070856Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:b0c04cf4e26219266fde83cf2afff3b2830f9cffccb4f1aa4801fe536af260dc","observation_id":"1dba08e5-a72b-411e-87e7-82bd8aba714b","resolution":{"observed_at":"2026-08-06T11:08:13.039025Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.emnlp-main.554","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing","work_id":"9668d87b-cd08-4405-8a06-505396b96ffe","year":2021},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.156499Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:299fc2a056b31c6c610891ba999135a5f0a2424b8ee844a742191b9618a6b278","observation_id":"ad7cdcfb-f0f8-41c3-961a-db279ea6aacf","resolution":{"observed_at":"2026-08-06T11:08:12.852138Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:15.764806Z","title":null,"venue":null,"work_id":"86e10145-bad2-4dd3-8e38-0f13363fdabd","year":2024},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.280362Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:f3855fea6d58ac3cafa78fd22365ad6d75f78388d6c7a86f9c6f4551393066a3","observation_id":"ec0de841-e814-4430-b98a-77d2ad507020","resolution":{"observed_at":"2026-08-06T11:08:15.870940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:15.513787Z","title":null,"venue":null,"work_id":"71facba3-6f57-4c5d-836f-c6c63ae4f6fc","year":2025},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.348308Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:edc8fcb7e0e9da8b79f385770d0b8776a2d3afa4786df6558fd7598b5e07e461","observation_id":"e36b159a-7956-4d42-9169-9a8f81e7199b","resolution":{"observed_at":"2026-08-06T11:08:15.653998Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:15.236268Z","title":null,"venue":null,"work_id":"60bb1fbf-f597-49d7-92f8-50e89f437599","year":2017},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.439731Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:6e027fe17384bfa4447882d97b3e361269c15263e596b68fb57f3abda42e3ac3","observation_id":"d6801dd2-fe1b-4610-9e5d-24e1c0090768","resolution":{"observed_at":"2026-08-06T11:08:15.372891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d15-1114","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"530c3c6b-09aa-45a3-8fc0-976e794976c1","year":2015},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.528081Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:2e6be8ae57a97441e8bc58b82cd43cabd9213fee8c1ce61ac63d3295984b09c0","observation_id":"906c489a-8fc6-4d72-b05e-34edb18216c5","resolution":{"observed_at":"2026-08-06T11:08:12.696872Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:09.616367Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.616367Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:a6d783ce9c13727d9e54f9920cf5ebb6edd9451130ca4eb3e7408d291aae1f05","observation_id":"98ac901b-6d05-4f8c-aab0-609c5b0b3797","resolution":{"observed_at":"2026-08-06T11:08:09.616367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15823","last_updated":"2025-01-07T22:43:28Z","snapshot_observed_at":"2026-08-05T12:43:45.320493Z","submitted_at":"2024-06-22T11:46:04Z","title":"CaT-BENCH: Benchmarking Language Model Understanding of Causal and Temporal Dependencies in Plans","version":3},"cited_work":{"arxiv_id":"2406.15823","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.15823","snapshot_observed_at":"2026-08-06T11:08:13.465278Z","title":"CaT-BENCH: Benchmarking Language Model Understanding of Causal and Temporal Dependencies in Plans","venue":"cs.CL","work_id":"25e71cef-9f74-49b0-ba74-2ba26ae204c3","year":2024},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.684569Z"},"links":{"cited_paper":"/paper/2406.15823","citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:cfaadc27bd18cac038077192ab0e7ed5d7fca6bb011f654289349886e4cd1f36","observation_id":"17a9ea97-3a52-490a-9428-6b143314c160","resolution":{"observed_at":"2026-08-06T11:08:13.530957Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.acl-main.440","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"ab3453a3-6964-45f5-8166-9b7d743c5df0","year":2020},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.779562Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:370ec990fb76592e1d8352d57469c8da6824f7c7cb1eb83e7d9fa75055dd40d2","observation_id":"728ff7f7-6ca5-4357-85ff-28b04ec1a34d","resolution":{"observed_at":"2026-08-06T11:08:12.545216Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-06T11:08:09.866984Z","title":"Sebastian Seung","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.866984Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:bc0a48b5fa79486e6362a1253d5588be3f43e78a14e02759c3eff320e7335a03","observation_id":"706eebb4-cd63-4dc6-ab2f-0fc8f357fe32","resolution":{"observed_at":"2026-08-06T11:08:09.866984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:14.953815Z","title":null,"venue":null,"work_id":"7ddbd0b8-3c34-48b1-9d9e-9bc52fa72ce2","year":2024},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:09.960596Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:4c26386121e49099b4adf119e80e977c21958d78af83e41441d7d27b57703e52","observation_id":"8cf28edb-f1da-4926-abbb-048d01e2e313","resolution":{"observed_at":"2026-08-06T11:08:15.089029Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:14.640265Z","title":null,"venue":null,"work_id":"5586f7bd-fe58-4e4f-9f81-865cd4db225b","year":2017},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.033039Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:fcc2b417f48b1b3fba4302c5cd1d9b4f9b8b45ea667af6ed2b5a20b6bf942883","observation_id":"495bc3a7-2683-41ff-a2f1-9e3f0a41c51e","resolution":{"observed_at":"2026-08-06T11:08:14.784215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:10.126651Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.126651Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:7fdab113324940d4b8aaf303a28210aedba11e46fab80913dfd8c802a2f5545b","observation_id":"d4948281-6c86-4686-ac00-cfa0ecf15dc8","resolution":{"observed_at":"2026-08-06T11:08:10.126651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:14.524862Z","title":null,"venue":null,"work_id":"a59c19ad-f0b1-484d-89f3-776d84794355","year":2014},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.198400Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:80e11f18ec76994e0c1d9e0a3174938733cd8c6e22ae1ca0ed1aa28eb6453b45","observation_id":"503c9dc9-9c76-411d-a01a-9b76c6366699","resolution":{"observed_at":"2026-08-06T11:08:14.556520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.12506","last_updated":"2020-08-04T01:06:26Z","snapshot_observed_at":"2026-07-06T09:07:52.162447Z","submitted_at":"2020-03-27T16:14:27Z","title":"Hybrid Models for Open Set Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.12506","snapshot_observed_at":"2026-08-06T11:08:10.292061Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.292061Z"},"links":{"cited_paper":"/paper/2003.12506","citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:d4b8aec1bb6e684ddebe7f6a8743d52e3999e39d1086d4046ad48a2ecd1f047d","observation_id":"8ba54947-aee4-444c-8e19-9765ea1dea05","resolution":{"observed_at":"2026-08-06T11:08:10.292061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23266","last_updated":"2025-08-25T17:57:34Z","snapshot_observed_at":"2026-07-06T19:42:25.742756Z","submitted_at":"2024-10-30T17:50:23Z","title":"TOMATO: Assessing Visual Temporal Reasoning Capabilities in Multimodal Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23266","snapshot_observed_at":"2026-08-06T11:08:10.355570Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.355570Z"},"links":{"cited_paper":"/paper/2410.23266","citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:59d8444e5563434143f933e2e6d72d38b5c137a504fd2f21f84d9df263d8d023","observation_id":"ffdbdba9-ab23-41ab-b009-7575a0a0e9f7","resolution":{"observed_at":"2026-08-06T11:08:10.355570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10498","last_updated":"2023-11-26T01:15:41Z","snapshot_observed_at":"2026-07-06T13:23:11.566484Z","submitted_at":"2022-06-21T16:15:27Z","title":"PlanBench: An Extensible Benchmark for Evaluating Large Language Models on Planning and Reasoning about Change","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10498","snapshot_observed_at":"2026-08-06T11:08:10.452864Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.452864Z"},"links":{"cited_paper":"/paper/2206.10498","citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:ae5d5043aa2f56b74adaff116abc7d985e0221bf510c197ee2725d9f9612ac31","observation_id":"1f25c7e5-5586-4b32-85a8-31548ce6f10d","resolution":{"observed_at":"2026-08-06T11:08:10.452864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:14.337808Z","title":null,"venue":null,"work_id":"8c6a2311-1367-4058-a673-d1701a2ed0c5","year":2023},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.544040Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:aef5e99d8091efcd826215d7494f7323c879b77540b021197ca2945dc0a01c32","observation_id":"c18b6063-323e-4473-8cef-afe8d2e75aab","resolution":{"observed_at":"2026-08-06T11:08:14.425898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:10.675911Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.675911Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:a5f9f2d7722f7c5f04c0ea5e5244b8761e3c943caca5eb2c7f983be2027687f6","observation_id":"65fa91b9-4748-4025-8577-a8d052696dc1","resolution":{"observed_at":"2026-08-06T11:08:10.675911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-long.310","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"6f270a52-03b5-4756-9456-59c6b2574528","year":2022},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.785122Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:742d3671b5da0c33f8401604d17986f6dfeac672d08707c3953c7633ae6f0d4e","observation_id":"da688ebe-dcb7-450b-84c0-c85cbc6a1c32","resolution":{"observed_at":"2026-08-06T11:08:12.390678Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.06553","last_updated":"2019-07-09T20:25:22Z","snapshot_observed_at":"2026-07-06T07:08:12.503941Z","submitted_at":"2018-10-14T20:51:41Z","title":"Recipe1M+: A Dataset for Learning Cross-Modal Embeddings for Cooking Recipes and Food Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.06553","snapshot_observed_at":"2026-08-06T11:08:10.902894Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:10.902894Z"},"links":{"cited_paper":"/paper/1810.06553","citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:46f21354aa57c5ce9757778b0ef85f502b407fde148653a71fe9dd75c0e8b3f1","observation_id":"7a9095fd-abe9-4cee-b08b-5361ea89fcb4","resolution":{"observed_at":"2026-08-06T11:08:10.902894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:14.130421Z","title":null,"venue":null,"work_id":"a5915636-5f25-4920-a01e-1f5573f9f87b","year":2018},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.017272Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:ddbd79420dbf1f6b9e466cbee320cec4cb6d7563c03e0ff7e546589473550de1","observation_id":"10978e6f-3542-41d6-b335-8e75811559f9","resolution":{"observed_at":"2026-08-06T11:08:14.212119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:11.131509Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.131509Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:2864d902056d1452972856ee4dd0dc867bffcc38ef1ca149eff14e440f0787d7","observation_id":"3d21e9e8-8462-4d44-bfbe-de7190be9c83","resolution":{"observed_at":"2026-08-06T11:08:11.131509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:11.245571Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.245571Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:abf195f99ac32171d40b34b7b4bb01f32bb4d26cdef1cc1b5943e3b1f458447a","observation_id":"f5bd07bc-0c25-4c27-a081-aa109f359e0d","resolution":{"observed_at":"2026-08-06T11:08:11.245571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.emnlp-main.119","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"29fe04d9-f204-4495-8441-0efc2d4ff610","year":2020},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.348931Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:54f5ed271cafdeee5d2129d12e0dc16756494286adaf8c28a37ff86ec2eb306d","observation_id":"38be157e-e06e-4031-af0f-33ba1cb4b65d","resolution":{"observed_at":"2026-08-06T11:08:12.241061Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-eacl.31","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"8a2aba4f-50d6-4b9e-b305-26fcf32222c5","year":2023},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.442271Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:e462412627699741521d08c30ec73e039de2d9740a6199dde8490775b82a6649","observation_id":"8b2c0207-c936-4db4-a2d8-f8c0f54095b7","resolution":{"observed_at":"2026-08-06T11:08:12.084696Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:13.951503Z","title":null,"venue":null,"work_id":"b9ceb68b-16b0-4b93-baca-edc460a9eaea","year":2025},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.516566Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:fe9a824f41efb77de4621040438af5ac8be0ac8911cbe7447198368d4cb541ba","observation_id":"5225fced-662d-4b5a-b0fa-c9cb482052c1","resolution":{"observed_at":"2026-08-06T11:08:14.038976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-10T20:27:17.264761Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-06T11:08:11.607173Z","title":"Liu, Julian Michael, and Mohit Iyyer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.607173Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:e6660787c3b1af93c3ba7893bbec7504983b7a682f08acc579ce6742f13350aa","observation_id":"ca1758e0-256a-4b6e-bdb3-7c4418888108","resolution":{"observed_at":"2026-08-06T11:08:11.607173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:13.781895Z","title":"Corso, Richard Socher, and Caiming Xiong","venue":null,"work_id":"279a36b2-78cd-4a76-b5ce-ce09bb6f086d","year":2018},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.694735Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:2401c2a4ea6b470f45e5f335a1a67e864e50faf37c931fdbbaa6a70b3131311d","observation_id":"b97588fb-6ce9-4180-b4ae-983e5b58fe49","resolution":{"observed_at":"2026-08-06T11:08:13.881903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:13.645269Z","title":null,"venue":null,"work_id":"ca4fffb5-0b1e-41f9-9248-4f9caf4908ad","year":2019},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.786398Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:6d6834e533a841a6bee1eea2a07250810c51ef8881a2bd7119380baa6b00b097","observation_id":"644a32a1-e8f1-45c8-aa9e-4ea9468cff45","resolution":{"observed_at":"2026-08-06T11:08:13.707961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:11.881048Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.881048Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:4ac1b8a97fd3095a024e7d8cbcc6cfc3ff7bc7770de63e318f9ee06ac0507a02","observation_id":"648d808c-6364-4cae-a256-cd275196812d","resolution":{"observed_at":"2026-08-06T11:08:11.881048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:08:11.949078Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T11:08:11.949078Z"},"links":{"citing_paper":"/paper/2507.23135"},"observation_digest":"sha256:6688b82c0d50ee64e7860c94adfbb31d072e3b05add3ef0fc1773eac557a6800","observation_id":"b5747d29-73bf-4d9a-88dc-d441ba7fe7b8","resolution":{"observed_at":"2026-08-06T11:08:11.949078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.23135","last_updated":"2025-07-30T22:30:48Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T20:28:21.914767Z","submitted_at":"2025-07-30T22:30:48Z","title":"ISO-Bench: Benchmarking Multimodal Causal Reasoning in Visual-Language Models through Procedural Plans"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":9,"verified_fuzzy":1},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:2507.23135."}