{"as_of":"2026-08-09T20:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4db74110ff3b5f171be8d693eaac823ab9bb12d895ec31a55376c124caa8356a","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:57:58.531823Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04646/citation-record","integrity":"/paper/2608.04646/integrity","json":"/paper/2608.04646/citation-record.json","paper":"/paper/2608.04646"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/0010-0277(85","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:59.284983Z","title":"theory of mind","venue":null,"work_id":"c0ae8cdb-8d57-4ce4-9e0d-d926fa09744f","year":null},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:55.755499Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:405cba5006c89e1946a56f0edd8c384decbea6a144b6233192b293f92fea3f44","observation_id":"3a998c75-ba30-475b-9bbe-ab8b4ef2870a","resolution":{"observed_at":"2026-08-06T19:57:59.325414Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:58:00.419620Z","title":"In: International review of research in mental retardation: Autism (vol","venue":null,"work_id":"f8c4b234-ad03-4f3a-b211-c4b4912dddaf","year":2001},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:55.825151Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:944090e39b618c4009e349509bd42d94e47d0d1c5bd361c71aeb9477988460a7","observation_id":"8586bd55-c918-4eb9-81a4-8132ea053367","resolution":{"observed_at":"2026-08-06T19:58:00.460670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05410","last_updated":"2025-05-08T16:51:43Z","snapshot_observed_at":"2026-07-06T21:21:01.070459Z","submitted_at":"2025-05-08T16:51:43Z","title":"Reasoning Models Don't Always Say What They Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05410","snapshot_observed_at":"2026-08-06T19:57:55.904927Z","title":"https://doi.org/10.48550/arXiv.2505.05410, arXiv:2505.05410 [cs] 14 I.B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:55.904927Z"},"links":{"cited_paper":"/paper/2505.05410","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:d52d6ebe9cb24716e13c4e2280aa525ee079847569d5b8f7711ac70422574b49","observation_id":"6d18e975-e46c-44ff-85d0-654d64217051","resolution":{"observed_at":"2026-08-06T19:57:55.904927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:55.979951Z","title":"In: Ku, L.W., Martins, A., Srikumar, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:55.979951Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:37480d3e0a8fd88ecba597eeb9eb9fc032dc8bea144f6af394cd99bf57a1e6e0","observation_id":"2a904c98-c946-4951-bf12-48ed214c3806","resolution":{"observed_at":"2026-08-06T19:57:55.979951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:56.053707Z","title":"In: Bouamor, H., Pino, J., Bali, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.053707Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:53a0c40653136fe5ecfa21b2fa3a30748c35a97b38458918c00100e515c7d8b1","observation_id":"a4fed512-fd53-4620-be3a-2d1c1f65f55b","resolution":{"observed_at":"2026-08-06T19:57:56.053707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:56.212467Z","title":"children aged 7-10 on advanced tests","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.212467Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:0dd9a44a543bc0d6fd5340e2fe2fa41bc79b43f22d8413b0ed10a01d8706f12c","observation_id":"b6347d50-eb3d-4305-b10b-802e39a29343","resolution":{"observed_at":"2026-08-06T19:57:56.212467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:56.317940Z","title":"Nature645(8081), 633–638 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.317940Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:4d1ff493120a0d635bffe02206ab05cbae0fa8b0646e36838f0f5253c6a6f550","observation_id":"a5901f2b-78e4-472a-b221-145ab6be942a","resolution":{"observed_at":"2026-08-06T19:57:56.317940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:56.442871Z","title":"Philosophical Transactions of the Royal Society B: Biological Sciences380(1932), 20230499 (08 2025)","venue":null,"work_id":null,"year":1932},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.442871Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:9e64147390dfbc88cf9ca92c9745887ff84b5b29581ca46b79dbe4a18a03ac9d","observation_id":"0a18beee-421c-4e8e-a019-dd6780a2ba2e","resolution":{"observed_at":"2026-08-06T19:57:56.442871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:58:00.300647Z","title":"In: COLM (2025)","venue":null,"work_id":"c8b93d14-3de1-463d-a14a-9571d1082dfa","year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.549847Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:6399acfb66c27a54393724d1967def42f7c4f39695cb4cbcec11624cdfcf521e","observation_id":"878fb98d-b2e9-425d-aa69-de4df47a3689","resolution":{"observed_at":"2026-08-06T19:58:00.360383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15421","last_updated":"2023-10-31T17:58:30Z","snapshot_observed_at":"2026-08-06T22:17:55.289636Z","submitted_at":"2023-10-24T00:24:11Z","title":"FANToM: A Benchmark for Stress-testing Machine Theory of Mind in Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15421","snapshot_observed_at":"2026-08-06T19:57:56.664963Z","title":"https://doi.org/10.48550/arXiv.2310.15421, arXiv:2310.15421 [cs]","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.664963Z"},"links":{"cited_paper":"/paper/2310.15421","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:9dd525d06112a0ab1c261842f1391cec10834e7b88ac0de33e36cfbe8431bcf2","observation_id":"8db2ee0f-190a-4eb2-85eb-4c69f7fed3cc","resolution":{"observed_at":"2026-08-06T19:57:56.664963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T19:57:56.756766Z","title":"Pro- ceedings of the National Academy of Sciences121(45), e2405460121 (Nov 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.756766Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:7644256573b61fdd5c7e4e5c63400180010268ae70c0764908f088c90a9ff68b","observation_id":"74b814d5-e1b2-4821-8e66-d3fecded039f","resolution":{"observed_at":"2026-08-06T19:57:56.756766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:58:00.132653Z","title":"In: Carl- son,L.A.,Hölscher,C.,Shipley,T.F.(eds.)Proceedingsofthe33thAnnualMeeting of the Cognitive Science Society, CogSci 2011, Boston, Massachusetts, USA, July 20-23, 2011","venue":null,"work_id":"ec20d777-2174-4017-be41-5e432f4ba3ea","year":2011},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.828121Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:82f14217456b97dfc2adc929ae9a4dde5e252c112f5069f303b4dbe4e70dd3fc","observation_id":"3d70ad9f-2297-4d9b-a8e5-8f820b4a3267","resolution":{"observed_at":"2026-08-06T19:58:00.236442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16468","last_updated":"2025-02-28T19:12:35Z","snapshot_observed_at":"2026-08-07T17:38:32.206554Z","submitted_at":"2025-02-28T19:12:35Z","title":"Towards properly implementing Theory of Mind in AI systems: An account of four misconceptions","version":1},"cited_work":{"arxiv_id":"2503.16468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.16468","snapshot_observed_at":"2026-08-06T19:57:59.675056Z","title":"Towards properly implementing Theory of Mind in AI systems: An account of four misconceptions","venue":"cs.HC","work_id":"12d93efb-0dda-4e7e-8b2a-431651b6bc66","year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.922990Z"},"links":{"cited_paper":"/paper/2503.16468","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:4990edd52536aeb6fc4066ad2e43a8bb143bf1b197f2a6ac09810176315b38a3","observation_id":"002a0f30-4974-4556-9986-3213874b0aad","resolution":{"observed_at":"2026-08-06T19:57:59.784465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:59.933845Z","title":null,"venue":null,"work_id":"aaf96d93-8dc4-4185-82ad-b7aa02a45f15","year":null},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.007310Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:bf50bdfd281897119cf271814e595283294e762799caf2dd5f278bd1f40f8437","observation_id":"fa6cdb68-d817-43f1-b6f1-019868e78b3f","resolution":{"observed_at":"2026-08-06T19:57:59.998996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20339","last_updated":"2025-02-27T18:08:16Z","snapshot_observed_at":"2026-08-07T17:42:05.982836Z","submitted_at":"2025-02-27T18:08:16Z","title":"Thinking Slow, Fast: Scaling Inference Compute with Distilled Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20339","snapshot_observed_at":"2026-08-06T19:57:57.120102Z","title":"https://doi.org/10.48550/arXiv.2502.20339, arXiv:2502.20339 [cs]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.120102Z"},"links":{"cited_paper":"/paper/2502.20339","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:a9018ec5d5061aa936e3ad5b507b0faa1ac144774b9b994c13e117f67a62a346","observation_id":"144c04ea-677e-4c8d-b995-b7a531e3ebed","resolution":{"observed_at":"2026-08-06T19:57:57.120102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.252816Z","title":"Journal of Artificial Intelligence Research84(29) (Dec 2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.252816Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:a08d4a29ac0099d50606761f6b565fe89c5736b4ff7b6980672a27fab0dc43ec","observation_id":"83cb6339-a9e3-4c4b-87e6-0171b20f3385","resolution":{"observed_at":"2026-08-06T19:57:57.252816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.304852Z","title":"ACM Comput","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.304852Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:c71a2315529d0a1408e2e65bedc4816c9e802c89c82a981d69ca30fe832f1ceb","observation_id":"45993953-5fe5-45a6-b6fa-40d4f8d52dd1","resolution":{"observed_at":"2026-08-06T19:57:57.304852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/1745691619896607","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:59.082223Z","title":"Perspectives on Psychological Science15(2), 384–396 (Mar 2020)","venue":null,"work_id":"a94bd402-72fc-4d74-8533-a31c3446ef85","year":2020},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.412475Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:88257bdd3f9a61232b60fe4bea18ad8be687d87209c5cf2abb28e594d59489d2","observation_id":"28303f7c-1c0e-4578-9090-0f53aee498e5","resolution":{"observed_at":"2026-08-06T19:57:59.153911Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.499949Z","title":"Nature568(7753), 477–486 (Apr 2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.499949Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:bcc055e065c4b4d1d5782a0689e4596d616d95303d6f7398b44c1f087b4a26d1","observation_id":"cbff10c5-13e5-47a7-be4b-93b2ba694e97","resolution":{"observed_at":"2026-08-06T19:57:57.499949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bf03395673","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:03:45.533247Z","title":"https://doi.org/10.1007/BF03395673","venue":"The Psychological Record","work_id":"c5376f02-ed9a-4125-b7f5-0a3b86132f1d","year":2009},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.570760Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:bf140ec9c087a5e32b56c8414d6115ad764fdb61a3c62448a419325c0144e037","observation_id":"5a2f44cd-b5ba-4051-8ba4-ebe6bdbd051d","resolution":{"observed_at":"2026-08-06T19:57:59.020214Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.694518Z","title":"In: Graham, Y., Purver, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.694518Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:943635a1d90ad5a96e0559c62f1f63140406f14c6bc6f03a18a839c0b4815c99","observation_id":"5e583de9-3030-4dd0-b2c5-df20d4172eb3","resolution":{"observed_at":"2026-08-06T19:57:57.694518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.16332","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:59.487328Z","title":"Frontiers in Human Neuro- scienceV olume 19 - 2025(2026)","venue":null,"work_id":"571677ae-c6a0-48c5-b3b2-653cd664bb53","year":2026},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.790600Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:d9c638f7e8397f5d52da3bd156c20e80cc253277f15d015ad3725e9eb55eeab4","observation_id":"4d0d79d8-22f4-4378-bf3b-cb081e84939a","resolution":{"observed_at":"2026-08-06T19:57:59.553238Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.878257Z","title":"MindLIX(236), 433–460 (Oct 1950)","venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.878257Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:32850335f64ad5428e30b9b4c9ce9da9b2c87d687b27aae357530569337d3677","observation_id":"b9e01472-e7b5-41ec-b8f9-66f60c7d83c8","resolution":{"observed_at":"2026-08-06T19:57:57.878257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08399","last_updated":"2023-03-14T13:47:26Z","snapshot_observed_at":"2026-08-09T17:51:01.952144Z","submitted_at":"2023-02-16T16:18:03Z","title":"Large Language Models Fail on Trivial Alterations to Theory-of-Mind Tasks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08399","snapshot_observed_at":"2026-08-06T19:57:58.012382Z","title":"https://doi.org/10.48550/arXiv.2302.08399, arXiv:2302.08399 [cs]","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.012382Z"},"links":{"cited_paper":"/paper/2302.08399","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:8ccd1650173f95fdc6b846ffa726d2dfa24109cac009110401b412313d2e30c1","observation_id":"efd59943-ef7c-46cf-a890-1f6a849ee043","resolution":{"observed_at":"2026-08-06T19:57:58.012382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:58.107602Z","title":"In: Ku, L.W., Martins, A., Srikumar, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.107602Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:86a0f436cff87c7b8c238b2e239c7934d00cf719536748676ad518bb0a250ab6","observation_id":"1e5b777d-7d1d-44cb-b457-a1fab35e2e4c","resolution":{"observed_at":"2026-08-06T19:57:58.107602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2505.17348","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:58.748348Z","title":"https://doi.org/10","venue":null,"work_id":"b8c9a104-7c7e-4ec3-a7be-7c79a3f1cc7c","year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.228998Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:099be44b9848eb1fd72c78abcbf1d03b5e6844aec9b1992ea52c3037e79d9c1a","observation_id":"0f5e2818-ceae-4b9a-a7b8-52063225724d","resolution":{"observed_at":"2026-08-06T19:57:58.834524Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-06T19:57:58.331596Z","title":"https://doi.org/10","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.331596Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:da212009a3e0d859744a20d1ca632a0ee9432068fd5be9e0fac12b72846bc260","observation_id":"655a45f1-0959-4cea-8acd-5a28f2ad3d8d","resolution":{"observed_at":"2026-08-06T19:57:58.331596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-06T19:57:58.429893Z","title":"https://doi.org/10.48550/arXiv.2504.13837, arXiv:2504.13837 [cs]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.429893Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:d9657d34fceb597a3f1fa1e00cffae70dcae5c5ad659e1f9f3d3ec6977baa394","observation_id":"6ad5b64e-0781-4f7e-a70f-c0cc519afad6","resolution":{"observed_at":"2026-08-06T19:57:58.429893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-06T19:57:58.531823Z","title":"https://doi.org/10.48550/arXiv.2303.18223, arXiv:2303.18223 [cs]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.531823Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:98ce91b3a521ace7ddbdea09276d0bb1de1cb497865d6f0302722483e111417b","observation_id":"5f23ef2c-ab01-4a65-8aba-91a6a5e24867","resolution":{"observed_at":"2026-08-06T19:57:58.531823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":5,"verified_fuzzy":3},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2608.04646."}