{"as_of":"2026-08-18T17:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3255a1e77d565985cfc65694932ec545b3dc9c54f6bf511c7fe3fd807543e643","coverage":[{"denominator":129,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:46:43.806230Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.07064/citation-record","integrity":"/paper/2506.07064/integrity","json":"/paper/2506.07064/citation-record.json","paper":"/paper/2506.07064"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.406581Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.406581Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ed52072275defd3958d390062b98109cbecbbe7b1ff0d5e666cdace03b72b16f","observation_id":"a1fd4aae-386f-4b4f-8979-102f0ba8773b","resolution":{"observed_at":"2026-08-07T05:46:43.406581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.410216Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.410216Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:3bc67f52058e758b9b2664be43243481424edbee3f2bad9bacce36ce00794a41","observation_id":"516286a4-6ef6-4c0e-9c7b-c7b3c1bad12d","resolution":{"observed_at":"2026-08-07T05:46:43.410216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.413647Z","title":"Here are the given event: {} You should follow the format like: {} -> EVENT -> EVENT -> EVENT -> EVENT Causal Chain Proposal: Intervention You are an expert in causality","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.413647Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:c36b56ee0dbbe74a74121ec3349187ec45ff612fc33ec54b695ac8b9db9a6843","observation_id":"6b898d6f-0915-41ae-a4d2-5e7a50ba3f79","resolution":{"observed_at":"2026-08-07T05:46:43.413647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.428945Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.428945Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:908563168745755a63b1af1c86461e6ed1e1dbb6d8eaca01217ff21ebc11b12f","observation_id":"8503fb2b-94d9-4d60-9532-2afa96a2dbd6","resolution":{"observed_at":"2026-08-07T05:46:43.428945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.432389Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.432389Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:6f00f9511e8a36ea1a4204a1da396d831c38fb5996691126898a20c34457bd4c","observation_id":"d7bcc5af-101b-486a-94a1-fb87fa3a8444","resolution":{"observed_at":"2026-08-07T05:46:43.432389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11694","last_updated":"2024-12-31T01:38:12Z","snapshot_observed_at":"2026-08-13T10:27:01.324745Z","submitted_at":"2024-11-18T16:15:17Z","title":"Enhancing LLM Reasoning with Reward-guided Tree Search","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11694","snapshot_observed_at":"2026-08-07T05:46:43.398130Z","title":"Takeshi Kojima, Shixiang Shane Gu, Machel Reid, Yu- taka Matsuo, and Yusuke Iwasawa","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.398130Z"},"links":{"cited_paper":"/paper/2411.11694","citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:f34b08f08094822c8e5efe2539020acd41f5a5f0d2e35d755ae348e901648c15","observation_id":"fa67507f-6f74-448c-a283-ebf292b38dd5","resolution":{"observed_at":"2026-08-07T05:46:43.398130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14405","last_updated":"2024-11-25T17:57:55Z","snapshot_observed_at":"2026-08-18T11:40:03.096849Z","submitted_at":"2024-11-21T18:37:33Z","title":"Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14405","snapshot_observed_at":"2026-08-07T05:46:43.402367Z","title":"Shunyu Yao, Jeffrey Zhao, Dian Yu, Nan Du, Izhak Shafran, Karthik R Narasimhan, and Yuan Cao","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.402367Z"},"links":{"cited_paper":"/paper/2411.14405","citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:fe36c21a6d80b46b72ca61b59e89ca9153d73a816af7f0952c09f05857c98941","observation_id":"e937a46e-e25e-47c4-a93e-1d1bc5cdc030","resolution":{"observed_at":"2026-08-07T05:46:43.402367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.520625Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.520625Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:23c3d05b9d5b4c9290a73ca76e2c9379cd4310025ad9982dd64821b377b4eedf","observation_id":"79eb147e-d269-4bda-8ff8-763d13c72530","resolution":{"observed_at":"2026-08-07T05:46:43.520625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.523908Z","title":"Causal Graph Proposal and Com2 Synthesis: Intervention After understanding the causal chains, we need you to create a multiple-choice example","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.523908Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:7ce6af6c6592f9a813a6a113d875618c39314882d03b214705d796474df65b3d","observation_id":"a5c4821f-1298-4beb-a848-6396d25bed6c","resolution":{"observed_at":"2026-08-07T05:46:43.523908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.424945Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.424945Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8ead931326c4b3c67b3d03016c61e66f079794b388e82a8ffd9df07fc368e888","observation_id":"c8cd7060-9bbd-442d-b90e-f9ee4f25d803","resolution":{"observed_at":"2026-08-07T05:46:43.424945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.439181Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.439181Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:3514c0920d2785834ee90966aedbacd0c55431d6f9add537ef3dc667fc1f3f24","observation_id":"4c3d697d-688d-474a-842a-5742ed2aa752","resolution":{"observed_at":"2026-08-07T05:46:43.439181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.442566Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.442566Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:d519d22fefe175999c4febfc2a3c9dbdc05b312cacbc02843769cb0ccfd6ca29","observation_id":"0371274c-8832-4968-a4d2-2e92d36ac422","resolution":{"observed_at":"2026-08-07T05:46:43.442566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.445994Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.445994Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:12a8b6f3dc7d9ed322030552fad327a41238eb9a2a42501223f563fb99ddfa02","observation_id":"54e3ac7e-4bd0-473d-8cd6-21106aa89155","resolution":{"observed_at":"2026-08-07T05:46:43.445994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.449375Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.449375Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8afb4ef530adca3084ced5150b146460648702ad0f68c54b0fd0fbe87daf24f4","observation_id":"41a18d66-3816-4d19-a017-32bae8adfea4","resolution":{"observed_at":"2026-08-07T05:46:43.449375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.452743Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.452743Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:6376e548ef291bf3c02172a1c641c44b4c3aeb26a690b6a4d6f35e97312b7a28","observation_id":"d3a35ce8-7609-4a90-8505-2286c86c78c4","resolution":{"observed_at":"2026-08-07T05:46:43.452743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.456184Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.456184Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ba1c2972c944d74a6c3b276575075065ed8b78e2bba23a941f26b2bf0bf183f5","observation_id":"cc4c40da-bee1-452a-8500-6a372d46afa1","resolution":{"observed_at":"2026-08-07T05:46:43.456184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.459515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.459515Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:74938ecacf5d177c7c4a3d2f01b5c29e19c36040f83725b14650269a0218ced1","observation_id":"f45ca0f9-a795-4360-822f-468be31ae0a2","resolution":{"observed_at":"2026-08-07T05:46:43.459515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.462780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.462780Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:e9af0b3bd531ee8e0e05d348a2fcca7f2e1181a47ae0ea9ba7dfe8f6561aaba1","observation_id":"95d81aeb-5c0a-45cc-94fc-15a87b7229ab","resolution":{"observed_at":"2026-08-07T05:46:43.462780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.466115Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.466115Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:de8ffc60a0686a41f59e4f1ae7b57b0bd940532a9f9425a757c020d3b7abb58e","observation_id":"07b3d645-1453-4bb9-bced-55a5b36af9f3","resolution":{"observed_at":"2026-08-07T05:46:43.466115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.469405Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.469405Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:9b9ef439a967f93911155e79e7668ac897f5c10c7b149466a45397b829d02f1d","observation_id":"28bd4ec9-e6d3-4623-9bb3-23824351758e","resolution":{"observed_at":"2026-08-07T05:46:43.469405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.472908Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.472908Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8887c39f5fc6d0176fcb53ae779f51d1091e9436c65015edf7020d814fa08594","observation_id":"031e02c8-d040-45d1-9802-08b244f7f5da","resolution":{"observed_at":"2026-08-07T05:46:43.472908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.476215Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.476215Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:334ac41c0bc3ffaff1983264e8c61ad9436cb51c29395cbf183889da93bfb974","observation_id":"c86dd821-8428-48e0-8f31-7669deb20847","resolution":{"observed_at":"2026-08-07T05:46:43.476215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.479383Z","title":"Take a causal chian A -> B -> C for example, here are the reference of the reason for the causal transitive problem:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.479383Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ff98ae27b21dbc72074b840a88a4bfd36d33e5b135df1117ff0b13937efbdf10","observation_id":"02f2b986-4683-4122-aabb-ac488a245fea","resolution":{"observed_at":"2026-08-07T05:46:43.479383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.483133Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.483133Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:a54c566c234c94fff752071669ea74b4f6f0ab3ab235689ea7db20bd7dad4ed6","observation_id":"12a095fe-25a3-4459-a866-42967aaabfac","resolution":{"observed_at":"2026-08-07T05:46:43.483133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.486401Z","title":"Here are the given event: {} Just give the chains only","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.486401Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:4bf24b122fef9e3a09186c33e313987330f0e2197b17f4f347cb34adf94d1faf","observation_id":"c357f949-f7b8-493f-a549-6aaa27ce54e8","resolution":{"observed_at":"2026-08-07T05:46:43.486401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.493630Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.493630Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:4883c6fb456958633e13feb851cef9af141b92ff71079578be96692d09042a53","observation_id":"29481e9e-49f6-4317-b3a4-a580c3f84aff","resolution":{"observed_at":"2026-08-07T05:46:43.493630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.496867Z","title":"The intermediate events in the causal chains cannot appear in the question","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.496867Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:351731366ae7d4be5569c0acee2bae0cd728229c55fdcbbaa52c4f26b6e44fcd","observation_id":"ac87bcaf-1eeb-46ff-b6c0-3ef3cbfebf2d","resolution":{"observed_at":"2026-08-07T05:46:43.496867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.500638Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.500638Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:0f9479b871e318183372cada3f5a448479bba04d8153f7cddc9df5aa3b150ec5","observation_id":"58aac345-40e0-4142-a86c-0c9ae85dd62a","resolution":{"observed_at":"2026-08-07T05:46:43.500638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.505851Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.505851Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:fbb0ee1b28f400d6e4ea79e7c5b07d7df0d0e3ccb955fef297459aa7913262d6","observation_id":"60f0d02d-d13d-40fe-abd1-3b22bbd69258","resolution":{"observed_at":"2026-08-07T05:46:43.505851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.513574Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.513574Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:3aab36b71de86627f6d059efe9929a7c4120b2c02c290a0df77a4c6e0f3dbb1a","observation_id":"08f7e2a2-21be-41ca-be61-481cede781b7","resolution":{"observed_at":"2026-08-07T05:46:43.513574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.537000Z","title":"-in the second causal chain, the transit is NOT interrupted by the intervention","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.537000Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:206d87c6699e2c76d8472c66abac1041950dc09729ef8d56d452388924f6c110","observation_id":"a74a723d-c2e9-40e5-9d44-4488300e82b8","resolution":{"observed_at":"2026-08-07T05:46:43.537000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.540312Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.540312Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:69be8be77e59f005e439e92cf212dccf42712e6f9b9a1d229bd175ae58e9b94a","observation_id":"a97ce373-55b1-4fe3-be15-d8d49df3e969","resolution":{"observed_at":"2026-08-07T05:46:43.540312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.543538Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.543538Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:6981b9307fa3ffa552583a31088207494dca5b4734117f0918a3c73839122460","observation_id":"2942cd82-8b9d-44d2-b110-2cdebbca9627","resolution":{"observed_at":"2026-08-07T05:46:43.543538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.546681Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.546681Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:229f532cc4fff0917417adfcc178f57423d96f141a29aaca3d89ac9f520e7cf1","observation_id":"04aed6eb-9ad3-4cb5-88df-b0defc94e4a5","resolution":{"observed_at":"2026-08-07T05:46:43.546681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.557001Z","title":"Causal Graph Proposal and Com2 Synthesis: Counterfactual After understanding the causal chains, we need you to create a multiple-choice example","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.557001Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:adb9ad816b74ca86bd8577777b454906f006ae1d79f1c8954465fb1b8c77cd9d","observation_id":"1c5ed77d-4691-44fb-bfe1-5a0c4f29a709","resolution":{"observed_at":"2026-08-07T05:46:43.557001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.563523Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.563523Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:d22e9462d403e0a69e30d8391de183537194580ff3c57ff5ad0419c0ed6052ea","observation_id":"000d7d64-d507-4d92-a748-fb13a0706252","resolution":{"observed_at":"2026-08-07T05:46:43.563523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.569970Z","title":"If A leads to B not C, what will happen?)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.569970Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:682e74e53500bc0876b7b0c96b987acaef79656321ccdd0c897017f5ba63f087","observation_id":"43268cea-bd3e-4ae0-8137-e38abaa6e4f8","resolution":{"observed_at":"2026-08-07T05:46:43.569970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.573169Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.573169Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:1029b780122748c4753b3727be1f64edabd91921f2743ad6c4801311116be49c","observation_id":"f71c91cf-5709-4462-ad18-de366fc13e99","resolution":{"observed_at":"2026-08-07T05:46:43.573169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.576382Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.576382Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:679f72bb5cc6baae7116af2a00c6bc7a6764e784607f22f3e80e8d02af4ca85e","observation_id":"9b65f11f-0a80-4f66-ac3b-3d5b38776dfb","resolution":{"observed_at":"2026-08-07T05:46:43.576382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.583372Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.583372Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:42fd187697875849870cb401f753397c21f8f6e9c753d8b6c7e4244e3f7259ce","observation_id":"2d6cb294-a0cb-49aa-aaa3-4307b1e6ecad","resolution":{"observed_at":"2026-08-07T05:46:43.583372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.586604Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.586604Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:b9f0e932752cb4cd925b487819ba529dc4f6078220fdb9bc638caef773269b0b","observation_id":"081e3ae6-d688-451f-93d3-a21c945d9066","resolution":{"observed_at":"2026-08-07T05:46:43.586604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.589852Z","title":"Causal Graph Proposal and Com2 Synthesis: Decision After understanding the causal chains carefully, we need you to create a multiple-select example","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.589852Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:3a9fb6e29bacefa09eb68b439ce4f7ae7855b4d86aff2f4e658616d75781d3a5","observation_id":"1925c1e2-f4ae-4863-ad93-4d3bfe224fe9","resolution":{"observed_at":"2026-08-07T05:46:43.589852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.593006Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.593006Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:99bb45de3be08ddbac691e3fb32b60fcaaed81fb35ceca0df6b398d0f81884ba","observation_id":"b7a57e01-9a50-448f-9d24-68a828221d6d","resolution":{"observed_at":"2026-08-07T05:46:43.593006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.596230Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.596230Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:a4c2f05877dbe45c479922d41ee4879839fbf743cbf5ae1a9adb3230c49c8610","observation_id":"8dbbf188-31e2-4359-8a39-f1dc571e0198","resolution":{"observed_at":"2026-08-07T05:46:43.596230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.762753Z","title":null,"venue":null,"work_id":"a68bd88c-808b-49b0-b064-4f5a2667e4e6","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.600191Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:14c0dace1df0fa2c5c93ce32e1378d02cd57eeccca9ec07ed3eddae8b0244ad0","observation_id":"1d79a7d2-d965-49f7-a57a-7c8a66a1ffc7","resolution":{"observed_at":"2026-08-07T05:46:44.766231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.751504Z","title":null,"venue":null,"work_id":"aa7fde0e-6248-4310-9574-8d44d58152a2","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.603661Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:70786db042ee7daf7864c15049de2f8f05f8cab0e0d7c888a932408455537e5f","observation_id":"2241619a-8c44-43e6-803a-577e19153ad8","resolution":{"observed_at":"2026-08-07T05:46:44.755661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.741099Z","title":null,"venue":null,"work_id":"636e768f-1b25-4ca0-a89d-57bd10d96e1d","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.606823Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:69d979c388526a86b94d37791b415ce5b39e446cb71a6431f8938d5c95c8ef24","observation_id":"d714b3d5-d098-468d-aea9-0f531eeed43e","resolution":{"observed_at":"2026-08-07T05:46:44.744430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.731205Z","title":null,"venue":null,"work_id":"c790534b-40f8-41b1-b96d-23a40e4e3885","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.610320Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:63226e79a9e1cf8bf2a7c719243620fe533544bf431ebdc0c864f43b242a6107","observation_id":"e753c40b-ab45-4ce6-9e84-b126c75b14e3","resolution":{"observed_at":"2026-08-07T05:46:44.734736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.720810Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":"c5bc48e0-6652-44cb-b781-6de71759717e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.613567Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:f116347b5e16e5c06cc520223f3cbe1d5bf908d390ac30a616da7d2b77f50244","observation_id":"619fcc26-c906-4a8a-8bb1-3c0cfb42494a","resolution":{"observed_at":"2026-08-07T05:46:44.724466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.710605Z","title":null,"venue":null,"work_id":"19fdf480-09ad-4905-b970-627bb9e6e952","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.620116Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:5c408e79d2c4ba0168b36f7a63e4f1f368a6f34224106a5c2b9f6195582009dc","observation_id":"15fe1977-c3da-4c77-875a-c1a4984af72f","resolution":{"observed_at":"2026-08-07T05:46:44.714215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.700019Z","title":"Causal Graph Proposal and Com2 Synthesis: Transition After understanding the causal chains and the scenario, we need you to create a multiple-choice example","venue":null,"work_id":"679484f0-74fe-4f0a-98e2-3e233e134a94","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.623460Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:d3123065f738a7689df921ab4864679c24c9122ef153c16a1f7b51d1c2a9208b","observation_id":"38b71eee-f45f-4aa8-9bc5-7f2df2674c29","resolution":{"observed_at":"2026-08-07T05:46:44.703940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.627585Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.627585Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:b2476f6e5d87876176e6086576c3ea59f8060c6ed3082ef411567b70fb17e3b5","observation_id":"c70042be-2893-43ae-a240-a07fb643290a","resolution":{"observed_at":"2026-08-07T05:46:43.627585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.689895Z","title":null,"venue":null,"work_id":"53045a2e-07fe-4c6e-87e0-8e20534045f0","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.630839Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:5101f38db4fa8dc6f071b94568081149524295ae8922133cbfe9bf0f9a480941","observation_id":"1e830549-32e0-4d46-aefe-5ab713124a8b","resolution":{"observed_at":"2026-08-07T05:46:44.693445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.634254Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.634254Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8464cddbb3b4513a7e79ed6ecf213d54f9fe9d457fdc702638b59b4922bff949","observation_id":"cc94e312-be9c-48ab-873d-20b5bd20cb04","resolution":{"observed_at":"2026-08-07T05:46:43.634254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.679134Z","title":"-threshold effect: the influence of A on B is not enough for B to cause C","venue":null,"work_id":"efea957b-3d7a-4ccc-aa79-e64f34f83ccc","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.637822Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8692ba50c18fc9049570cb5faae31c24bdd51276bad041c42c93908f40df74a3","observation_id":"618947f1-98bc-4764-aa4a-f658ab84e5e9","resolution":{"observed_at":"2026-08-07T05:46:44.683003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.668654Z","title":null,"venue":null,"work_id":"c072107b-d450-4e3d-9fa6-3e1ba81a876e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.641277Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:280f359972f9a0c8992cc464b252cf865b01f99a805bb0d712dc6390636748ee","observation_id":"576114e2-e806-4759-9760-68b6473e2237","resolution":{"observed_at":"2026-08-07T05:46:44.672073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.658508Z","title":null,"venue":null,"work_id":"eb659f51-b058-4caf-9515-5dc574a43fe0","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.644613Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:534d4dcd8cdee7e1b6dd1eb39b93c5aae406a9d1ef06be7e8cdd8090187c8bf7","observation_id":"3e702613-5cd7-4358-abaa-900601c605f8","resolution":{"observed_at":"2026-08-07T05:46:44.662167Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.647975Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":"2ae9cd8a-d7cb-4ed8-900d-901be07315bc","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.647813Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:2cdca07c9aefbcd4c010f08cbbb0673f7c0e56a564ef9b802b9202cf8aa30770","observation_id":"cd8ff9e8-aef2-4ff1-9e48-102d868b3e62","resolution":{"observed_at":"2026-08-07T05:46:44.651848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.637571Z","title":null,"venue":null,"work_id":"240dff1c-7983-46be-b29c-80f7bb707807","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.651591Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ff16482c16326d7211559ca4d6d5da5bc5f92fda430ed39d8a8b3d017295cfd9","observation_id":"d9010995-74dc-47f4-81ec-ac36ef2f046d","resolution":{"observed_at":"2026-08-07T05:46:44.640969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.655041Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.655041Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:335b18fafbb47a874a5ee1d2756a9b5e79335ba2f654338503b325760a6c3553","observation_id":"10aed4ba-80b0-4b55-a0eb-6cbad5cb8fa5","resolution":{"observed_at":"2026-08-07T05:46:43.655041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.658263Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.658263Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:b0dbee56033ec017697e8550731d6075d276df4255bd8240714d5a303aae8252","observation_id":"7826e87e-d724-48c3-b3ed-3ab4abd98f50","resolution":{"observed_at":"2026-08-07T05:46:43.658263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.627590Z","title":"None of the above","venue":null,"work_id":"5e91b96b-6888-4313-999f-9f395012e014","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.662483Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:679fa0ec06770048e4473d31abb23e1a15da446c2a6bd152d6b3e64cebbdf293","observation_id":"e8d64efb-9c3b-4e50-82a0-671a3e01ee3a","resolution":{"observed_at":"2026-08-07T05:46:44.630974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.617513Z","title":"Ignoring health issues typically leads to worsening conditions","venue":null,"work_id":"ac591aca-2d8a-4869-83b3-4790b54dff5e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.667240Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:eb0936177b4cc7fdf0ee0e43810ecb4a5178731e2bab7f9a3de2445b7599388f","observation_id":"dbe2fcd5-17d4-428b-9dbe-9b1e36c2b8e0","resolution":{"observed_at":"2026-08-07T05:46:44.621297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.607005Z","title":"One possibility is that she could start feeling better due to the body’s natural healing process","venue":null,"work_id":"ec511afe-ed66-443b-a485-d568d353d20f","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.670792Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:02ea9b6b0cf29fb9b7e38f5935a084e64fb532ff94be14103ac863e138202308","observation_id":"fac59214-cfa7-414a-a8b6-8ff23cc32731","resolution":{"observed_at":"2026-08-07T05:46:44.611163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.596678Z","title":"Option A suggests she would feel better, which often isn’t realistic with persistent symptoms","venue":null,"work_id":"0680616d-573b-41c4-bee0-167865b2593c","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.674469Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:c816b4416c2856014d8049eaffa682c3f43a98e8f1def54701453c836c7b6561","observation_id":"ae8eba59-9241-4bfb-b1ce-ca5eac50e170","resolution":{"observed_at":"2026-08-07T05:46:44.600316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.586626Z","title":"If she continues to ignore symptoms, it’s likely her situation will worsen instead of improving","venue":null,"work_id":"7ab517c9-8515-49a9-9ce4-489e5f38e18c","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.678147Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:bd73708feba4df009452d85f197266247e3ba3119995505e3692f869d1d8aa05","observation_id":"3a3dffea-1107-43db-804d-7f9d93935ea2","resolution":{"observed_at":"2026-08-07T05:46:44.590208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.575779Z","title":"By ignoring the symptoms, one possible severe consequence is a sudden health crisis necessitating emergency intervention","venue":null,"work_id":"df19cda4-fa09-48a4-97d4-08f3d8e1e850","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.682687Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:5669d8325357c28816d54aa8b56be655c21fcbf10eb160aa9758f115458690d5","observation_id":"48d5a0f5-04ed-4c03-b821-149823af8b04","resolution":{"observed_at":"2026-08-07T05:46:44.579809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.563292Z","title":"Considering realistic scenarios, ignoring serious symptoms often leads to drastic health declines rather than recovery","venue":null,"work_id":"123ee9d9-7494-41d4-b9d9-6d8462e1f419","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.686576Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:5e42b758b243665eda840a2015605185d26aef81747d8546f76d29b4b04807c0","observation_id":"37f3d135-161a-44f8-81be-97e3f45312a9","resolution":{"observed_at":"2026-08-07T05:46:44.568211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.551408Z","title":"Decison in Com2-main Question What interventions can prevent severe consequences during a hot air ballooning experience that could lead to disastrous outcomes? Options A","venue":null,"work_id":"81c557f7-a7e5-476a-9975-8f718989650e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.690185Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:185b0fafe029a87b0ff82b2b2c1e793cbbddf37a042d1734a79e4832e13acd3a","observation_id":"d753a7ae-9fb7-439e-bc17-9963b571f6db","resolution":{"observed_at":"2026-08-07T05:46:44.555254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.540908Z","title":"I need to focus on preventing issues related to equipment failure and extreme weather","venue":null,"work_id":"eb45a4f1-1573-49c7-a609-96ae19eb1cdc","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.693755Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:df0cc522760be96a3bfa8b860f53501c6cc9b3991681aecddb6d0830c5c59201","observation_id":"03f0e1d3-c1cf-4926-9791-f8f90e1c6965","resolution":{"observed_at":"2026-08-07T05:46:44.544450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.530858Z","title":"Option A refers to equipment checks and could help avert malfunctions, while Option C emphasizes pilot training during severe conditions","venue":null,"work_id":"9e5c357e-0c8f-4f1c-a9d8-24b12c349944","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.698070Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:a05ea71ee74ed9f2ca0bcebef1905f7d2cde288f0edb9976d51855059f2413e4","observation_id":"78ebe1fc-57c2-4b61-a788-96620cd2ca2a","resolution":{"observed_at":"2026-08-07T05:46:44.534529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.521103Z","title":"Both suggest ignoring critical safety precautions and could lead to disastrous outcomes","venue":null,"work_id":"5cbec5ac-4dc2-4562-bf38-91829d2b6fca","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.702583Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:3f6a470a096c46e1b156c2c0fe57d1729d3fffc6b4001b15e9d734c5e7674f83","observation_id":"84d89c0e-c20c-44b9-a1b8-2deab4048078","resolution":{"observed_at":"2026-08-07T05:46:44.524579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.510918Z","title":"Grouping this way highlights which options can truly help prevent severe consequences","venue":null,"work_id":"914b04b5-2c1f-47bf-b46c-52bd5fc615a0","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.706236Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:f569183b4a0e3b6e830c0b11580e85ebe6c89def4570b74cc1a99a2985e8f3f5","observation_id":"2a3b0cbf-0f63-416f-bb37-adb9561e4577","resolution":{"observed_at":"2026-08-07T05:46:44.514659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.499915Z","title":null,"venue":null,"work_id":"34902885-4db7-4650-9dbe-f65cd4a9e560","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.709877Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:13acf2f27e820f8cf0306c7cb06c93a6393342fcd98455af060d787f4df8096f","observation_id":"3399a491-3506-448f-a4e6-69d7fad5af9b","resolution":{"observed_at":"2026-08-07T05:46:44.503529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.489743Z","title":null,"venue":null,"work_id":"f3a0c1ec-a74b-4d28-81e9-60100240884e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.713198Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:627d5b1247da052ecf030d902f259c052d214b9d594b5b5d3161a5b7d7b5dd37","observation_id":"12a7410c-7bb7-4dc1-90a0-499646a1729c","resolution":{"observed_at":"2026-08-07T05:46:44.493311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.478718Z","title":null,"venue":null,"work_id":"2d033e5c-a804-425a-bceb-19ef8d6f2b46","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.717309Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:39cccdec0b38b579d4ee326ffda5a8ee9bb390721ca09a8506489250175e1d75","observation_id":"e19d181a-3a65-447d-81b5-b818a49807c3","resolution":{"observed_at":"2026-08-07T05:46:44.482149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.468493Z","title":null,"venue":null,"work_id":"1ce4ae74-ec05-490a-bb95-2b745736b087","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.721863Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:548828a086623a93386b7ef2c977249744d6738b49eaf4e71b90b3a954b435ae","observation_id":"6f4be258-7ca4-45c7-a38e-b51fc98ab53d","resolution":{"observed_at":"2026-08-07T05:46:44.472045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.458362Z","title":"In this case, the typical behavior of the coin changes significantly compared to a normal environment","venue":null,"work_id":"577533a7-7008-4c99-aad6-7e036606ec8d","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.725715Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:023c024421987ed3b44aa1ecd0d1b7c0aa321c82acc1b0f5f96d4c4adcd4be38","observation_id":"d9ead090-6b34-4408-9616-55c4631bcb11","resolution":{"observed_at":"2026-08-07T05:46:44.462072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.447802Z","title":"Option A suggests the coin lands on a table, which seems unlikely in zero gravity","venue":null,"work_id":"70826063-41e0-4c22-b25f-fb3e5ff6e1c3","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.729766Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:e5502fb10b89e05a0c22110c1012e1d70b1e65eebe84f6c310adece7b397ce07","observation_id":"c6bc47c0-e4de-42f1-b02f-415994d93f25","resolution":{"observed_at":"2026-08-07T05:46:44.451731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.437155Z","title":null,"venue":null,"work_id":"bf2f8aee-0a53-4834-a5a9-0b31f9442588","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.733351Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8edf968948abe1109653c9e4335e3579c830a87b0296e651de40143aaf848270","observation_id":"42d0639f-56f7-4204-8bb2-a64dfb1769eb","resolution":{"observed_at":"2026-08-07T05:46:44.440734Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.426997Z","title":"This aligns with the idea that the coin would continue to drift until it encounters something","venue":null,"work_id":"8e2d3d18-db9e-4baa-bb5e-9d3298881267","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.736851Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:08800bb9a9bc959f52e1e7a1ca4f47be2611fb670968e278a271f90d103d38e6","observation_id":"4fb931e2-3f75-4554-a05f-6119d31eff4a","resolution":{"observed_at":"2026-08-07T05:46:44.430656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.416674Z","title":"I need to correct my reasoning","venue":null,"work_id":"f72a64c4-8118-4422-99d6-1527bdbbdd38","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.740305Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:1cc1da97abb5fbbd4196cc303e17e28a0ceee60856f4df1b8685955ff3d16124","observation_id":"7cf4ec47-c442-435b-9571-070170354967","resolution":{"observed_at":"2026-08-07T05:46:44.420056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.405185Z","title":"Therefore, the only logical outcome is that the coin would drift and potentially collide with something","venue":null,"work_id":"582f8936-a710-4fe8-8748-f66deea97844","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.743723Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:2dc64275de188c5bfdd36b2377548040a5fa4f597dd971a6b914dda2cc9f1bea","observation_id":"b5397b6f-1c7b-455f-b678-3dcc03f21188","resolution":{"observed_at":"2026-08-07T05:46:44.409418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.395183Z","title":"Simon was seen in good spirits before the wedding but became agitated during the ceremony","venue":null,"work_id":"25622c5f-427c-4bb6-b86d-8f2aab7465d0","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.747320Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:2be35c0114bab5e98b3a752359f87c2cf4ca16ddb6d8008ff2713b06db55c2f3","observation_id":"f1a66e9a-2eff-40e3-8301-6ae2d9bff78f","resolution":{"observed_at":"2026-08-07T05:46:44.398838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.382983Z","title":null,"venue":null,"work_id":"9c3fc257-6748-4025-b0de-aae29c53e408","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.750703Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:215df4930b939646e2269e895dafd34bee7b34144a4262e478e94347992a36ee","observation_id":"69665cac-3d85-4aaf-a131-8746445e71e2","resolution":{"observed_at":"2026-08-07T05:46:44.387169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.371643Z","title":"Simon spoke to her maid, Alice, and mentioned ¨jumping a claim,ïndicating a prior relationship","venue":null,"work_id":"5732e2de-60b0-4b17-bbdd-f4581c5508e7","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.754075Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:2821a34bf38ce32506d8ac8f1ea39d1e5695bf6ca4d381c6df60e9b9b31d84e7","observation_id":"71afbee0-1aeb-44b6-92be-722b12e6e3b3","resolution":{"observed_at":"2026-08-07T05:46:44.375705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.360802Z","title":"Simon left the breakfast table shortly after the meal began, dressed in her wedding attire, and was later seen leaving with Francis H","venue":null,"work_id":"09276c27-4fa3-4c9c-a471-b76e62e8b18a","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.757695Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8b209faaa59155f90a4186fc0b30744bb391cd83fc6396a9aa1aff5509d164bf","observation_id":"b0b8bdd2-0ef6-44aa-bdbf-db96c0d63c2e","resolution":{"observed_at":"2026-08-07T05:46:44.364951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.348780Z","title":"Simon’s wedding dress and belongings in the Serpentine, indicating she had left in a hurry","venue":null,"work_id":"2efde9ef-05a3-4967-b4e2-fd5a93b341a7","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.761539Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:d53645fc9a4cf6fe6c134d594744c7d880bed53b3112533a221dafbfede51fc2","observation_id":"9146a024-d60e-4c70-a49b-5e7f6e9c90c0","resolution":{"observed_at":"2026-08-07T05:46:44.353091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.338800Z","title":"elopement)","venue":null,"work_id":"a0988de4-1d67-4caf-9a5a-e4e3c5e9bf79","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.765900Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:0867a7e65431569746a154393b29795a1f7b37d8bece7ddd645372fb6c37d8a2","observation_id":"cfec5eb4-4569-4e6a-aa3d-4858909d2b67","resolution":{"observed_at":"2026-08-07T05:46:44.342224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.328124Z","title":"Options A, B, and D seem proactive, while C could limit the social aspect, and E is dismissive","venue":null,"work_id":"edd33550-5ce0-4b46-b506-b806bb9ce377","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.769389Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:fada0718ae4be330afe7222ec541b5dccd5213619826bac5cde6ad3b60df348b","observation_id":"d1935e6e-5b99-4228-8d98-209eda105e44","resolution":{"observed_at":"2026-08-07T05:46:44.332077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.318305Z","title":null,"venue":null,"work_id":"d2db916b-59a5-4cb6-813c-dfcf92fe2c6f","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.772823Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:afd13c54d3d4640a6dc92294cba34120d628821066ddfbf7efdaf6a52d8cdb54","observation_id":"4f0b596d-19e8-4be2-975b-0d458f51ae17","resolution":{"observed_at":"2026-08-07T05:46:44.321761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.307406Z","title":"For example, ensuring the bride’s emotional well-being could prevent her from feeling the need to elope","venue":null,"work_id":"ab079cc9-9298-459d-bec1-cc064822833a","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.776381Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:951a6a4eb7e2915d7db258d3ccf9401d49eaa3637231cd17818b966258c9563e","observation_id":"84226964-f6df-4e9f-9d21-3983c4b1af47","resolution":{"observed_at":"2026-08-07T05:46:44.311449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.296680Z","title":null,"venue":null,"work_id":"77e15878-5331-4f8c-a63a-da38196bcf99","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":113,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.781733Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:525e59b82432795e3542f200aa6f06fedf8c7920dd3ad2f2d79f7bf59fb67170","observation_id":"7f9f9f3a-c009-4198-9bb3-02308d39d7f6","resolution":{"observed_at":"2026-08-07T05:46:44.300502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.285474Z","title":"Intervention in Com2-hard Crime A valuable coronet, containing thirty-nine beryls, was stolen from Alexander Holder’s home","venue":null,"work_id":"5b07fcac-769b-49ca-aba5-204120101255","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.785921Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:c4d2207200e43dfcaff2e6b44358bb6c6a0821665c5757337795bacb3b485980","observation_id":"01f9faa7-2d00-4cf8-a914-19790ca71a57","resolution":{"observed_at":"2026-08-07T05:46:44.290027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.274584Z","title":null,"venue":null,"work_id":"c788a2bf-146a-4219-b288-0cfbd4b2a0b7","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.789294Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:f157c123b5eeebc2a349a9da27bef0a77885fac3232e628fb1b635690253a1ae","observation_id":"4531ca8b-83b5-4f6d-b146-b7a6a9eb8d07","resolution":{"observed_at":"2026-08-07T05:46:44.278277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.264264Z","title":null,"venue":null,"work_id":"2651c4c9-8355-41bf-85ba-12ca231a2d9a","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":116,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.792591Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:9ceb2916fdbedf9afb86a83132379279295ebb1219883131f7c7721d2cdb5947","observation_id":"77e03450-eaf2-4ad6-9bcb-1361f4eb417b","resolution":{"observed_at":"2026-08-07T05:46:44.267771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.254241Z","title":null,"venue":null,"work_id":"34580276-18d3-4858-9e2c-1b8483d476e3","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":117,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.795912Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:325c3a0004f63008dd8f7f4631fb9f2192468601a2ef62bfdf98731973a34c02","observation_id":"d0ea3148-4918-4e07-95e9-796a36cdc5bc","resolution":{"observed_at":"2026-08-07T05:46:44.257677Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.243980Z","title":null,"venue":null,"work_id":"3305c911-a69b-4add-a030-7bbc200ae93d","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.799386Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:c5e90227da9378a9fc08adc585afd5375d0a1d15036e288ff8ffc35cb3a6633f","observation_id":"d346ce81-7360-4c61-8fb6-8e6c6c44c21d","resolution":{"observed_at":"2026-08-07T05:46:44.247730Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.233695Z","title":null,"venue":null,"work_id":"783900b2-c9e8-43cc-b0e1-860c2dcc5f61","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.802720Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:97af4dfcd87f7f761ce5d04623d88ebe6b99a7258ea78496cb28a88c162482a5","observation_id":"f58b1985-f79e-4f73-a822-ad2fc76cd99a","resolution":{"observed_at":"2026-08-07T05:46:44.237274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.223017Z","title":null,"venue":null,"work_id":"db234145-18c8-4d1d-a0bb-f68aa8bb0378","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":120,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.806230Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:231a4cb40f6876ef432afe901df119eb729b938fbadf2911a41e2ddefcecf266","observation_id":"206188e3-84e9-45e0-80d1-b8542a9908a3","resolution":{"observed_at":"2026-08-07T05:46:44.226638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T11:40:35.480913Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":71,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":129},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 100 of 129 outbound references and 0 inbound Pith citation observations for arXiv:2506.07064."}