{"as_of":"2026-08-16T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37fb1683f0428b10f96dc8224c2ca86c6f4ca091fdddf396aea011d16512c157","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:34:31.684757Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.17180/citation-record","integrity":"/paper/2506.17180/integrity","json":"/paper/2506.17180/citation-record.json","paper":"/paper/2506.17180"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.719426Z","title":"Assessment in science education: A study of teaching effectiveness","venue":null,"work_id":"2dc2f88b-2816-4030-aa09-604b57939177","year":2018},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:27.638495Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:1910f3f47e4e34347b6dde25dbe051c8ad4193672907f586bd07a17942e3e928","observation_id":"c955ac35-2da0-4220-bc05-89b0955cb2b4","resolution":{"observed_at":"2026-08-06T23:34:36.856619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.575435Z","title":"Cbse assessment framework for science, maths and social science classes 9 and 10, 2020","venue":null,"work_id":"43a21a4f-82d0-4da6-840c-dbb426c45d15","year":2020},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:27.847326Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:a8bbc6d0fda61ebd56e56dc31d30e0138f39e95577409bbb5fdfb0c6908d7d0d","observation_id":"6c8dde00-4a1f-49cc-b6f3-e5def3c6f121","resolution":{"observed_at":"2026-08-06T23:34:36.643752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.393481Z","title":"Bloom, Max D","venue":null,"work_id":"2c99e494-2757-4e03-8325-f0747a331753","year":1956},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:27.999453Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:70d385daef7dd6ecad7f8fc13f5db2077b00831bf62e6ff4a28efce48fb735d7","observation_id":"f70a2faf-7ce5-4f9d-9d97-80effefa7046","resolution":{"observed_at":"2026-08-06T23:34:36.467416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.229104Z","title":"Anderson, David R","venue":null,"work_id":"539c9d1f-21d6-4c2d-9466-5944c4b62964","year":2001},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.216326Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:aee9d79d98c1e744a72db04afb4b47d029ef66572ae607a96b3d7db11ec1c68a","observation_id":"cc3aac27-7414-47c1-af97-732c5a7629cf","resolution":{"observed_at":"2026-08-06T23:34:36.304831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.020532Z","title":"Malalgoqa: Pedagogical evaluation of counterfactual reasoning in large language models and implications for ai in education","venue":null,"work_id":"dc5cdeeb-cdf2-43f5-be5c-d06f6c24d11a","year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.287009Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:cd3dbc8c9c7fe051d0c2fbfd78034a704a872febc3e1558221fe37a6d8f43741","observation_id":"4e0c1e0d-557a-4186-b9a5-aec58b7c7245","resolution":{"observed_at":"2026-08-06T23:34:36.115224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:28.419985Z","title":"Thinking, Fast and Slow","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.419985Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:b73bc1262a345a0671bb4426fd81bf660069d54c8c5f66c4ef53b8595c25581d","observation_id":"5fa84c2e-fb64-4a47-ba99-f6ef48232ab1","resolution":{"observed_at":"2026-08-06T23:34:28.419985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.803551Z","title":"Dual-process theories of higher cognition: Advancing the debate","venue":null,"work_id":"03f18803-e67d-4469-a562-911dbf430be3","year":2013},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.635181Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:e2f983106a586a8c9da5a2533dcaafa83dff0088ad395ba0d20fa97189561f97","observation_id":"299d020f-5a79-4b5d-bbbf-7ddbf98535b0","resolution":{"observed_at":"2026-08-06T23:34:35.916792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.680154Z","title":"Bowman, Gabor Angeli, Christopher Potts, and Christopher D","venue":null,"work_id":"64390b1a-3ab5-469f-a894-0a56f8a8deda","year":2015},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.734129Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:c3f2cef56f6920967c89cc09732c0922f44c263b4e09abd69629d0c7b1174d69","observation_id":"ebf56e91-d8d5-4222-b94a-f513544a5419","resolution":{"observed_at":"2026-08-06T23:34:35.740210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.540353Z","title":null,"venue":null,"work_id":"6c9b0075-809f-4dd2-a9fa-e778d003012d","year":2018},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.877039Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:e46b7ea748495526c39ca411b10ea2631678de2ccfde92c77c21a371bb630360","observation_id":"ddecb367-5cf1-4aaa-993a-984ad2228a55","resolution":{"observed_at":"2026-08-06T23:34:35.621043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.354132Z","title":"SQuAD: 100,000+ questions for machine comprehension of text","venue":null,"work_id":"99df018c-744f-40d3-b972-9bb334ec39fb","year":2016},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.049684Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:d59dee937d683c924bd3d9c3009461fa7a3c12960db4ae19e92716c6e9f7046f","observation_id":"c2bccd31-ea7c-4933-9deb-3f9c479135be","resolution":{"observed_at":"2026-08-06T23:34:35.456528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.090314Z","title":"Hutchinson, and Richard G","venue":null,"work_id":"fe5f7928-3580-4b7e-853a-5483da1d6c76","year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.223595Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:92e0b673479c4c64c5ac525d7bb3d41a873da9d8b947a7e7a02c8a6fb8fd9083","observation_id":"b4ec3bf0-a908-4e57-a880-2bf82157f0a2","resolution":{"observed_at":"2026-08-06T23:34:35.200748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.795807Z","title":"CommonsenseQA: A question answering challenge targeting commonsense knowledge","venue":null,"work_id":"b3c50d6b-7ad3-49b8-a98b-5281246f919d","year":2019},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.379705Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:63bc6fd5668873c8d93abf30305fbee539c24ef318b81b1950acf8078fee317c","observation_id":"77217a69-f736-4e16-8949-2b0be8431aa2","resolution":{"observed_at":"2026-08-06T23:34:34.960660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.568512Z","title":"WinoGrande: An adversarial Winograd schema challenge at scale","venue":null,"work_id":"630590ce-049a-4e39-a21e-9717e6825691","year":2020},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.555304Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:f7f3688e56d4b60cfa47ea68d2b7db0160fb9e76b97ffd00a8afcaea455ded44","observation_id":"6c0ef4bf-850f-47b7-b6fc-291edba5b592","resolution":{"observed_at":"2026-08-06T23:34:34.641689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.381034Z","title":"FEVER: A large-scale dataset for fact extraction and verification","venue":null,"work_id":"219d532a-9105-4e26-b8be-93d6f71f83ed","year":2018},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.641483Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:df37a0f04adf05ca71ea646a519832b70513831e71325d4ca3f92c7cd7961e06","observation_id":"c78751fa-86a9-4360-a5a7-7734acbf13ae","resolution":{"observed_at":"2026-08-06T23:34:34.476987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14974","last_updated":"2020-10-03T04:31:06Z","snapshot_observed_at":"2026-08-10T13:25:07.438493Z","submitted_at":"2020-04-30T17:22:57Z","title":"Fact or Fiction: Verifying Scientific Claims","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14974","snapshot_observed_at":"2026-08-06T23:34:29.816345Z","title":"Fact or fiction: Verifying scientific claims","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.816345Z"},"links":{"cited_paper":"/paper/2004.14974","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:f34bb592c7b7137db30020fbb7396270ea8dd74ce2ebbc7351b0085588869f72","observation_id":"591bbfb5-3252-403c-af8e-d41d352e88e8","resolution":{"observed_at":"2026-08-06T23:34:29.816345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T23:34:29.937166Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.937166Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:b3fb5f8dc49f8579e40386912b2da9b40431969ca547d52740948a6e360ffbe9","observation_id":"35b332ff-9fc1-4faa-aa6b-2531285d7808","resolution":{"observed_at":"2026-08-06T23:34:29.937166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T23:34:30.032234Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.032234Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:9ff725390377d0d898d2fc2d71018d2d6a343a081ef5787b3f6b066a798982ff","observation_id":"32d3aeae-e6f9-4c04-9e40-fdcf7673f323","resolution":{"observed_at":"2026-08-06T23:34:30.032234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T23:34:30.125545Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.125545Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:bc12b7bf4c9e34eb628faf27ecd405f6b19f64fe5db7abb564773bd1c8cf4e0e","observation_id":"f3837aa7-8513-464a-bf76-ca83285f287d","resolution":{"observed_at":"2026-08-06T23:34:30.125545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-06T23:34:30.266416Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.266416Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:e47e9e96c5bc41bf5abcc0b3b4dca952913c9aa992d12791190f3993a8a360e6","observation_id":"96a14359-8ee3-4192-b5b0-ed03107b1a3a","resolution":{"observed_at":"2026-08-06T23:34:30.266416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-14T03:45:52.225630Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-06T23:34:30.385458Z","title":"Phi-4 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.385458Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:258c3239c33d264fb5eab69e1712a42d67ef3a1ad42019cead9e8f850705f321","observation_id":"ff585210-453b-490f-8e1d-f95af7e25606","resolution":{"observed_at":"2026-08-06T23:34:30.385458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.207451Z","title":"When one model casts doubt on another: A levels-of-analysis approach to causal discounting","venue":null,"work_id":"4b59d3e4-13ae-44b1-9691-525699f145b0","year":2011},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.554878Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:26d06bea95322d7fe42ead6916ee43dda9bf0a064723ebc4c076a3c1619f5ae9","observation_id":"6b1b6237-cd99-4231-83e4-e464c67bf3dd","resolution":{"observed_at":"2026-08-06T23:34:34.297459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.974121Z","title":"The most common error is incorrectly classifying option (b) as option (a) (176-214 instances across models)","venue":null,"work_id":"74be3df3-0fca-4247-859f-14f3cd4050a2","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.735614Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:354b912484e22e48865c141dbea619fbbd88161a3c9e402e27779cd988423f2a","observation_id":"055c84a6-a36c-421e-ae31-884271148fc2","resolution":{"observed_at":"2026-08-06T23:34:34.094387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.741462Z","title":"Even the largest model, Qwen3-32B, misclassifies option (b) as option (a) in 195 cases (27.1% of all true (b) cases)","venue":null,"work_id":"4fe37f86-50a4-433c-ad45-b3ad4d656f6c","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.887249Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:cd18d403f87d0bdb61c60db9c5129360e1c41122e302b09b1960975447a2b988","observation_id":"871c92f1-1083-405e-a5ba-60a540d572f7","resolution":{"observed_at":"2026-08-06T23:34:33.847413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.537995Z","title":null,"venue":null,"work_id":"e6761b57-bad6-4923-a727-58361644f2db","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.013302Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:15f2a5221d97f350b4e6178ce9800623e87193057bc65de2ddb8993306848f6c","observation_id":"fe6cdd58-1579-48e2-95e8-1f11e5c126c6","resolution":{"observed_at":"2026-08-06T23:34:33.658462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.164703Z","title":"Model family differences suggest that some design and training strategies may better support causal reasoning, particularly in complex domains","venue":null,"work_id":"12120695-b27f-44c1-a7c5-ec61bbda644b","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.082574Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:ff90904f468dcf895b46a65343c9098723cd2253fa02b61f2ca09dd0ab964308","observation_id":"4f8b2fdb-3e17-4b0c-99bd-2b73f6e7ca35","resolution":{"observed_at":"2026-08-06T23:34:33.339491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.923278Z","title":null,"venue":null,"work_id":"839f4c8c-1e7d-465a-814c-f7ba40398a20","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.206215Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:ceade8079e099be0717adb58d86bd22c7ea36aca81a035fd2986ac7479d9b2ad","observation_id":"b4062b7d-825e-4ea3-841f-3f0893eead36","resolution":{"observed_at":"2026-08-06T23:34:33.017115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.732169Z","title":null,"venue":null,"work_id":"174264e3-b3db-483e-ae72-4f6a2c3475b3","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.284075Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:a2f5d46ee8261723fdf1f21a2203e6f50ec10b1900abd7b0714bfd74ad579e0d","observation_id":"47c042e4-5365-4b94-8326-4dc3c76dc8b1","resolution":{"observed_at":"2026-08-06T23:34:32.804755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.428000Z","title":"These t-tests determine whether the differences in similarity are statistically significant or could have occurred by chance","venue":null,"work_id":"021b5b96-78dd-4f97-b39a-cefae500a035","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.431743Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:fef1ceabafce4d34f3c4e10d091429b114d1c456428894d5c8f909e75bccb788","observation_id":"d5df085c-b832-4137-8289-6784299fc9e8","resolution":{"observed_at":"2026-08-06T23:34:32.563860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.215578Z","title":"Yes\" versus all cases where it predicted","venue":null,"work_id":"0e1ec672-d249-4c30-be4a-f256a6a5a8f0","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.532676Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:5505b2e8ac0b1b48d15b3d31ef1da62692b3931d5fe957516fff91d16fb8499b","observation_id":"58740287-4290-4ce3-8d25-b045a34a1198","resolution":{"observed_at":"2026-08-06T23:34:32.318389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.049941Z","title":null,"venue":null,"work_id":"4c1bd1e5-9253-4359-8889-e48266cb43a4","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.612422Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:124a10ccc02f7a3582b8ed870f004f7a4a0770e81cd0ac747ba96209c5b429d8","observation_id":"82369732-23bf-4c32-b2c9-944a32f473f5","resolution":{"observed_at":"2026-08-06T23:34:32.123936Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.911026Z","title":"This pattern represents a fundamental confusion of correlation (semantic similarity) with causation (explanatory relationship)","venue":null,"work_id":"b7143725-f09e-48e7-8e93-7d1103059933","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.684757Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:e650516696e7c568dcc5f6439ba1b36f5cb62fcac4f80b6e02c5e1d796c5fe25","observation_id":"b7dd928c-1127-47ae-bb7d-6a017bf98679","resolution":{"observed_at":"2026-08-06T23:34:31.976303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T16:15:39.805093Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2506.17180."}