{"as_of":"2026-08-09T13:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83c5b617f7e1d316846555a39791894cbf64bfff92eda98ca093ea3e24399930","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:04:37.575936Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:20:53.998837Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20184","snapshot_observed_at":"2026-08-02T22:20:53.998837Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.17229","last_updated":"2026-07-17T10:02:50Z","snapshot_observed_at":"2026-08-08T10:05:43.756350Z","submitted_at":"2026-02-19T10:19:04Z","title":"Mechanistic Interpretability of Cognitive Complexity in LLMs via Linear Probing using Bloom's Taxonomy","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T22:20:53.998837Z"},"links":{"cited_paper":"/paper/2505.20184","citing_paper":"/paper/2602.17229"},"observation_digest":"sha256:9ad3cbbfb8821f9b22e7689fb3fa36ab6784375ca23f84b03a0b8435f4c251e5","observation_id":"13673311-eda7-400a-b9d2-8c8c39141232","resolution":{"observed_at":"2026-08-02T22:20:53.998837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20184/citation-record","integrity":"/paper/2505.20184/integrity","json":"/paper/2505.20184/citation-record.json","paper":"/paper/2505.20184"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.152486Z","title":"By analyzing which concepts are invoked, we assess the knowledge dimension activated during problem-solving and whether the LLM navigates these domains coherently","venue":null,"work_id":"d4e75476-4aa6-4b16-b10b-a9a3852224b6","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.403974Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:b9917d5889896666414bfadd47d7180ecbc857ab27c63e10809123d9a31ce5dc","observation_id":"8a7c8880-5fd9-469d-bcb4-c7d5e50c4e4d","resolution":{"observed_at":"2026-08-07T14:04:43.254905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.955401Z","title":"Thilo Hagendorff, Sarah Fabi, and Michal Kosinski","venue":null,"work_id":"55227775-6291-4468-924f-cbd6a81777cb","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.621929Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:4cf9949708014b7e8441abc509c2a578d7993542c5f99173026876059032323f","observation_id":"0fa765ff-d851-481b-a821-0373e1944790","resolution":{"observed_at":"2026-08-07T14:04:44.055481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:42.740276Z","title":"Representations are critical for logical coherence and traceability in reasoning","venue":null,"work_id":"6148dcb3-637f-4628-907a-6e76951d1d79","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.570182Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:4f395b233a35cf73f3a003b985e5c8e5b8c7103b191c32421cc9b077fd94969f","observation_id":"a4aa73a5-1796-43c5-aa1f-a76b5d6ed06c","resolution":{"observed_at":"2026-08-07T14:04:42.892838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:42.566730Z","title":"A model’s ability to adapt its reasoning across such variants reflects generalization ability—an essential attribute of HOT","venue":null,"work_id":"25fcde98-f856-4184-868e-8ca57ffdca64","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.638056Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:cbe47e81762286f95a00b803bd93ccff2c35ad23acdcd082a0b0ca929bfa6178","observation_id":"2f68695c-0270-47e6-81cb-67b468eebf67","resolution":{"observed_at":"2026-08-07T14:04:42.649080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:42.247120Z","title":"Five Keys","venue":null,"work_id":"1bdf1020-46b3-4da2-b22b-4e3e2ea6833d","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.760718Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:b3c1ec3376f281c37c73798a08c06023175e2dfc2295f4832319daca1f3a04fa","observation_id":"d9d1a54d-e351-4c68-a515-5b41cb3329af","resolution":{"observed_at":"2026-08-07T14:04:42.396321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-07T14:04:34.989895Z","title":"In 2023 IEEE International Con- ference On Artificial Intelligence Testing (AITest) , pages 169–171","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.989895Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:4059faf9c3cd70ada7d044f5b7f1b2b105823a1e3cdd385429bcb315339c2665","observation_id":"30a63fb8-e0f4-41a6-a468-e77e64a0ac3f","resolution":{"observed_at":"2026-08-07T14:04:34.989895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12491","last_updated":"2024-01-23T05:19:47Z","snapshot_observed_at":"2026-08-07T20:24:26.029336Z","submitted_at":"2024-01-23T05:19:47Z","title":"Assessing and Understanding Creativity in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12491","snapshot_observed_at":"2026-08-07T14:04:35.188891Z","title":"ArXiv, abs/2401.12491","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.188891Z"},"links":{"cited_paper":"/paper/2401.12491","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:17f6e5e0b10042e6a993d23565d1e2d58b9dc775ab932f22a24b7c8c1b2b745c","observation_id":"6f285043-ceae-4a7e-b7ac-a08237cb27f7","resolution":{"observed_at":"2026-08-07T14:04:35.188891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.329931Z","title":"Five Keys","venue":null,"work_id":"9b576f2a-b533-4ada-87a0-d5bfa40d2373","year":2019},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.274686Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:e41eac88bb34a37ce9eb4c17eb287e0d84073ae3dd7b4068aefda1a4b935a0ad","observation_id":"eda686bc-321f-44f8-b9d2-085ef43b9912","resolution":{"observed_at":"2026-08-07T14:04:43.413353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:42.986235Z","title":"These skills serve as proxies for prior knowledge and inform whether the LLM draws upon relevant background competence","venue":null,"work_id":"44a7633f-e656-4c13-a7a3-90d51eadf1d5","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.501537Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:8aa4e3beb4d7e236235bebc0a6cdfe0964ef4a565746759586a367bbab1d36d3","observation_id":"fc6c6ce0-d87c-436f-b349-e6e86497d3cf","resolution":{"observed_at":"2026-08-07T14:04:43.061734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:41.855239Z","title":"You should try to understand and retrieve the specific mathematical information in it such as facts, patterns, objects, or contextual information, and decipher these meanings","venue":null,"work_id":"9fc38656-c016-4dc2-88b5-b1ad35811f92","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.856691Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:3321166954b82779e456846d28f28893233519569fee28da8a29dd90e47b9936","observation_id":"bc43f647-0c80-4f11-92ad-366e129e0133","resolution":{"observed_at":"2026-08-07T14:04:42.080713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:41.600606Z","title":"It includes understanding and organizing information, analyzing relationships, drawing conclusions, and distinguishing nuances","venue":null,"work_id":"b3608352-2571-496a-b402-06844c453a3a","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.926296Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:b1742b40acf39f85e5a86e38983adbead92e4d60a3f1dad00e086c1c4817ab6f","observation_id":"f80c2551-b0ae-441d-87f4-f27be7b9cd08","resolution":{"observed_at":"2026-08-07T14:04:41.709139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:41.368127Z","title":"These new expressions should have the same form as the given expressions in the previous generated math problem","venue":null,"work_id":"eeabd7b1-55f8-4f1d-a7e9-3fab2fac2f1e","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.991143Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:cb34daf2a82294903d4f5ef81b9baa12de76fdd448be8a316e063effe285f08d","observation_id":"632569ac-4052-4187-86a6-dc67e329e041","resolution":{"observed_at":"2026-08-07T14:04:41.478200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:41.082935Z","title":"The generated stories must be a mathematical word problem with the corresponding expressions","venue":null,"work_id":"0831139b-bd51-42cd-bdc3-208db0d5b678","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.112437Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:388ed914383f06244ae0d8b7e144355a2ccd93eefd0e2fb5d8d8e3e3ff0c35e6","observation_id":"d90fac4d-e73b-47fc-bc1f-49e61c612496","resolution":{"observed_at":"2026-08-07T14:04:41.250540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:40.845503Z","title":"question","venue":null,"work_id":"adc75a73-f2e0-45d9-8d14-c7909802cd2c","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.212697Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:afe7113286f4ed805d76fc246638bc22777a5b64c165bd3cd376a934cf73803f","observation_id":"4ae966b1-69d3-4983-b64b-2753e21a22c2","resolution":{"observed_at":"2026-08-07T14:04:40.942421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:40.619974Z","title":null,"venue":null,"work_id":"bca14182-e2a2-4fbf-978c-b0b51dc62901","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.299113Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:9ff1800384260ec4677a64c490ed03baa5226d6905bfafaf914ac7d5b1ffd6d2","observation_id":"d7221b4a-69f1-4292-9c7e-b07d16682968","resolution":{"observed_at":"2026-08-07T14:04:40.731850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:40.445411Z","title":null,"venue":null,"work_id":"b661dc49-62e7-4069-9a09-a04ce85b1366","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.371403Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:dbf868df8109cdf5dbc641b83c8f2d0ee4d8c766ec2b40d7c07b68540ffc54d8","observation_id":"097e0f7a-e8c0-4aa7-8a53-1112802d3640","resolution":{"observed_at":"2026-08-07T14:04:40.516278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:40.229498Z","title":null,"venue":null,"work_id":"2deee902-5b5f-41e0-8e24-951b6d003677","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.467020Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:e2a0e281b6166c81d7c285041aff78f2ce45f37d3042c21423741a7135cd4c20","observation_id":"e7cca71a-fa57-4018-81a1-996ea4f8a584","resolution":{"observed_at":"2026-08-07T14:04:40.346332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.986757Z","title":null,"venue":null,"work_id":"8dea3b48-16d1-4740-96d0-a841028f2fbc","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.557122Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:6cc744b3edd5674a508d1e95a8af7f3fe99933b0874a35fd5dcaa1e89bf81d0e","observation_id":"71cfc3bd-c73a-4638-a83b-201870d4932c","resolution":{"observed_at":"2026-08-07T14:04:40.119981Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.787354Z","title":"ID\": null,","venue":null,"work_id":"18d55387-0297-4732-8b9f-50945c4c5a44","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.650966Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:7c39cb419872052384ee189a91f8040782732239a3e090ccb2f4398c79c8d60b","observation_id":"0bd16435-849c-4b77-b423-35024e0a2a0d","resolution":{"observed_at":"2026-08-07T14:04:39.859244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.597615Z","title":null,"venue":null,"work_id":"490101bf-017a-4366-9dab-eb65e6ef2c78","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.725952Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:464934300d5c67a965cfac651d6376fcd441e7e13744a38d33bccf6752216cd5","observation_id":"905ea987-80e9-4efc-ac45-90783e9ccf18","resolution":{"observed_at":"2026-08-07T14:04:39.683488Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.332629Z","title":null,"venue":null,"work_id":"8897e06b-d20e-465e-9f3c-14f4fd403aff","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.802182Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:33b98a4ae532c4d643f1d908a5df76d3909d6dd91775631493701307c6065fed","observation_id":"373900a1-c4ed-414f-acab-352e4fb4840a","resolution":{"observed_at":"2026-08-07T14:04:39.422480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.143432Z","title":null,"venue":null,"work_id":"52a315ff-f123-4b73-b5f1-41154f9882d2","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.871190Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:95f23fb79a083c3f4085b8e2ece948a7e8952c374a85dc8057c423942eda94f2","observation_id":"28bbc1f8-ccd1-4e0f-a597-8346676859cb","resolution":{"observed_at":"2026-08-07T14:04:39.228336Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.925453Z","title":null,"venue":null,"work_id":"e3af36c1-56ba-4f10-b155-f580b3a6b6d1","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.981345Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:c3e65c0bde7db02c013d23abb2c61dc027a174e254cb4de44abbaa5a3f8538d7","observation_id":"79f727b5-a1b4-4900-b207-266a76810f5d","resolution":{"observed_at":"2026-08-07T14:04:39.013489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.709767Z","title":null,"venue":null,"work_id":"a2750143-0a60-4bd1-be8a-38dbf154289d","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.076085Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:d5d6d27068de530ecd50f02f13c9bd22dff2b6ba17be49b268321ae25c73fb3e","observation_id":"fba5fb64-1ef4-447e-8f46-3851e00a2fc2","resolution":{"observed_at":"2026-08-07T14:04:38.843275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.529042Z","title":null,"venue":null,"work_id":"a63b9988-354c-417b-8942-ff371f663239","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.196578Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:1571487597765f52f49d929e2d0f342dd13302df00e491a4c25fccd29ad53a39","observation_id":"daaf974f-20f5-4e54-9b92-d6d3073a526b","resolution":{"observed_at":"2026-08-07T14:04:38.604568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.334207Z","title":null,"venue":null,"work_id":"6e11bc67-c9a0-4cef-81cc-a0ec6255bf68","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.286441Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:130b4bf6dd26e519a30110742231cd53298346c381f219191024319ccea804cc","observation_id":"88110793-a66b-414c-aaa9-dd9f02d9fef1","resolution":{"observed_at":"2026-08-07T14:04:38.445619Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.113814Z","title":null,"venue":null,"work_id":"98c71ab2-add9-417a-94b1-d87a74c348c0","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.367133Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:54a8f2c4eb1344f85d0c08423eec4b3322aa974444a0daff352f02dcc2e89171","observation_id":"acfc7e07-2c28-4479-9c14-bb5374b74b76","resolution":{"observed_at":"2026-08-07T14:04:38.191305Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:37.895604Z","title":null,"venue":null,"work_id":"364b143c-c108-4e11-b950-5f3b290e6a30","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.458862Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:5f4302a12f577a6787414f8c30edf27470583b87c39eb2f19ebade5c255b41b7","observation_id":"237518b0-cf69-410d-8cfa-93d6a34f5c0c","resolution":{"observed_at":"2026-08-07T14:04:38.000547Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:37.749318Z","title":"performance_score","venue":null,"work_id":"d0a755ae-c5ef-4a9e-9a63-6b7671550e61","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.575936Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:d8209c5dd87250ce81026605a8f3cf87406183db76f1096d95f8fddd1b8a0eba","observation_id":"7735d87f-a2ae-410b-84eb-b1424ad23de3","resolution":{"observed_at":"2026-08-07T14:04:37.798360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.503844Z","title":"English language teaching, 3(4):237– 248","venue":null,"work_id":"66593c45-1134-43b1-a3bf-ec07696569a1","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.885086Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:a0def03fd78832a176949fc1ec85ef0ad270f353ed64c1a18a1d3b9ed497fa06","observation_id":"6e3bc5a6-54ea-4d38-a129-9d44eba41060","resolution":{"observed_at":"2026-08-07T14:04:43.595243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01116","last_updated":"2024-03-02T07:49:57Z","snapshot_observed_at":"2026-08-02T18:22:56.733681Z","submitted_at":"2024-03-02T07:49:57Z","title":"MulCogBench: A Multi-modal Cognitive Benchmark Dataset for Evaluating Chinese and English Computational Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01116","snapshot_observed_at":"2026-08-07T14:04:35.106825Z","title":"Inter- national journal of social sciences and humanities, 2(1):24–32","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.106825Z"},"links":{"cited_paper":"/paper/2403.01116","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:5a3149c0bd3a18866920629ad4453c7dcea72126626f3edde8b691a85c164a7b","observation_id":"4f4a0605-e26a-479d-bef5-6bda3f3c3127","resolution":{"observed_at":"2026-08-07T14:04:35.106825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16755","last_updated":"2023-10-25T16:41:15Z","snapshot_observed_at":"2026-07-06T16:38:25.599664Z","submitted_at":"2023-10-25T16:41:15Z","title":"HI-TOM: A Benchmark for Evaluating Higher-Order Theory of Mind Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16755","snapshot_observed_at":"2026-08-07T14:04:34.719074Z","title":"Nature Computational Science, 3(10):833–838","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.719074Z"},"links":{"cited_paper":"/paper/2310.16755","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:41558339b954b416c8bacbd29f558c824b05d59eed27e3dc1cedc477a5f8939c","observation_id":"93bfd8cb-0986-4884-9228-76953960d739","resolution":{"observed_at":"2026-08-07T14:04:34.719074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.737006Z","title":"TOFEDU: The Future of Education Journal, 3(5):1488–1499","venue":null,"work_id":"6a9ec738-9d1f-42a7-ba91-18fc06323fe5","year":2018},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.807017Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:4fd0bea737d64b6a314e411c3f7272e264bae5d3e1e0c2315c0b4fb29c103b03","observation_id":"b6c0dea8-bcd4-4dcd-8b03-81fbd12f337b","resolution":{"observed_at":"2026-08-07T14:04:43.817646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05718","last_updated":"2022-05-11T18:14:33Z","snapshot_observed_at":"2026-07-06T13:09:03.269759Z","submitted_at":"2022-05-11T18:14:33Z","title":"Structured, flexible, and robust: benchmarking and improving large language models towards more human-like behavior in out-of-distribution reasoning tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.05718","snapshot_observed_at":"2026-08-07T14:04:34.565123Z","title":"In Proceedings of the 2025 CHI Conference on Human Factors in Computing Systems, pages 1–23","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.565123Z"},"links":{"cited_paper":"/paper/2205.05718","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:95da776605c9e54d209879d152481afa00a8556c655b7a54e79f62eeb2082a7e","observation_id":"e335ab1c-82d5-46d0-9b99-a5dfdcb741e1","resolution":{"observed_at":"2026-08-07T14:04:34.565123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":3,"unresolved":15,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2505.20184."}