{"as_of":"2026-08-10T03:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:23696ff96aa5262a08237603a32abb6f689c96cebac68f81e0cb57710911b32a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":49,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:11:57.606122Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":176,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"reference_index":184,"source":"arxiv_source","source_observed_at":"2026-05-16T08:12:30.984870Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2309.16797"},"observation_digest":"sha256:eadd526d329f3f552244c9d25e7386124e32867e15f8b59fcafd5265617966c9","observation_id":"7ebc297f-623f-474e-83f2-d993cace0173","resolution":{"observed_at":"2026-05-16T08:12:31.697625Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-05-13T10:36:17.764761Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2401.10774"},"observation_digest":"sha256:ec10b57ac5bf6a78d163f6217e8d66e53bf0e6e98fe517850fa8c646903f4891","observation_id":"83bf78cd-26e0-44dc-b9d9-1f57f27beeb2","resolution":{"observed_at":"2026-05-13T10:36:18.177714Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-08T14:11:57.606122Z","title":"Theory of mind may have spontaneously emerged in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06994","last_updated":"2025-06-09T03:19:09Z","snapshot_observed_at":"2026-08-08T14:04:44.196639Z","submitted_at":"2025-02-10T19:38:36Z","title":"SyncMind: Measuring Agent Out-of-Sync Recovery in Collaborative Software Engineering","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T14:11:57.606122Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2502.06994"},"observation_digest":"sha256:3662f5ae81cd8f069c728ff9a73f7dd7e3a614c9d7614508fa8c1802270abba4","observation_id":"60fe1ccc-95a3-41cf-b7f5-c3cfd7f4ada9","resolution":{"observed_at":"2026-08-08T14:11:57.606122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2506.02387","last_updated":"2026-04-13T08:26:12Z","snapshot_observed_at":"2026-08-04T07:16:14.991803Z","submitted_at":"2025-06-03T02:57:38Z","title":"VS-Bench: Evaluating VLMs for Strategic Abilities in Multi-Agent Environments","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T11:57:08.314088Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2506.02387"},"observation_digest":"sha256:aad9fc85699ded01b99876119bd679c1efdbfa754d12cfac6686d1f1130fcbb8","observation_id":"439ce8ad-d210-49df-999e-122040f2c452","resolution":{"observed_at":"2026-05-19T11:57:16.229278Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-07T11:27:24.257851Z","title":"InProceedings of the 2023 Conference on Empirical Methods in Natural Language Processing, EMNLP 2023, Sin- gapore, December 6-10, 2023, pages 14397–14413","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02461","last_updated":"2025-06-03T05:23:25Z","snapshot_observed_at":"2026-08-09T06:40:39.583356Z","submitted_at":"2025-06-03T05:23:25Z","title":"XToM: Exploring the Multilingual Theory of Mind for Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:27:24.257851Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2506.02461"},"observation_digest":"sha256:b0dca5e3609347a11a97671712a6cec40d3e20903c634add80749c58ea71cb8f","observation_id":"b8e7fb44-2314-44bf-b0f9-3eba03df5ff4","resolution":{"observed_at":"2026-08-07T11:27:24.257851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-07T00:28:24.444328Z","title":"Theory of Mind May Have Spontaneously Emerged in Large Language Models , March 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.444328Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:834a11411d3318fcb63d65d95f1e5ca0435af2eeef3aa82541a8385867a63da8","observation_id":"818afb4d-91ae-48c4-a0b6-0061a4073722","resolution":{"observed_at":"2026-08-07T00:28:24.444328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T22:49:38.859398Z","title":"Theory of mind may have spontaneously emerged in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20664","last_updated":"2025-06-25T17:55:27Z","snapshot_observed_at":"2026-08-09T01:45:09.509848Z","submitted_at":"2025-06-25T17:55:27Z","title":"The Decrypto Benchmark for Multi-Agent Reasoning and Theory of Mind","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:49:38.859398Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2506.20664"},"observation_digest":"sha256:4b64ca30d2f68a763e637d7c9d07feababa8872fea1bb77f1c42a52fceaa0a53","observation_id":"b5176ce3-a507-4e6e-93cc-7aa339c8e6fd","resolution":{"observed_at":"2026-08-06T22:49:38.859398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T22:45:52.871383Z","title":"Theory of mind may have spontaneously emerged in large language models.arXiv preprint arXiv:2302.02083, 4:169, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.20743","last_updated":"2025-06-25T18:10:30Z","snapshot_observed_at":"2026-08-09T03:07:30.066886Z","submitted_at":"2025-06-25T18:10:30Z","title":"A Survey of AI for Materials Science: Foundation Models, LLM Agents, Datasets, and Tools","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T22:45:52.871383Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2506.20743"},"observation_digest":"sha256:d9fe56a520816edfa95104161505459199a374ecc3af6914af6deb26d80d6daf","observation_id":"3db051cc-f060-4333-ac85-9e32efa28e73","resolution":{"observed_at":"2026-08-06T22:45:52.871383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T20:39:04.214279Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02170","last_updated":"2025-07-02T21:53:44Z","snapshot_observed_at":"2026-08-09T05:26:17.885271Z","submitted_at":"2025-07-02T21:53:44Z","title":"Synergizing Logical Reasoning, Knowledge Management and Collaboration in Multi-Agent LLM System","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:39:04.214279Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2507.02170"},"observation_digest":"sha256:a97a5498e1ff8cede138b94dd933bec1b00f68a6c9e2b5a708faa0a5872ba581","observation_id":"9a69d7a8-8997-4c9d-955a-dc06a9ba2835","resolution":{"observed_at":"2026-08-06T20:39:04.214279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2507.02935","last_updated":"2026-04-17T02:59:49Z","snapshot_observed_at":"2026-07-06T21:51:57.075589Z","submitted_at":"2025-06-26T20:44:12Z","title":"Theory of Mind in Action: The Instruction Inference Task in Dynamic Human-Agent Collaboration","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T07:23:56.627581Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2507.02935"},"observation_digest":"sha256:7b21ad3b7eb1e165a0445ea26fd1f79272666cc7fe693f55df86eb7a60da6fed","observation_id":"87536116-4f1f-4bf0-bdc7-99cd2b88fb1f","resolution":{"observed_at":"2026-05-19T07:27:08.601964Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T20:13:56.921317Z","title":"Christelle Langley, Bogdan Ionut Cirstea, Fabio Cuzzolin, and Barbara J Sahakian","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03682","last_updated":"2025-07-04T16:01:27Z","snapshot_observed_at":"2026-08-09T13:05:34.016531Z","submitted_at":"2025-07-04T16:01:27Z","title":"Towards Machine Theory of Mind with Large Language Model-Augmented Inverse Planning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:13:56.921317Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2507.03682"},"observation_digest":"sha256:a6808e2cf190fa4de74d2e52e3188eb3f83c7b53b8e53717802ae15fee317cb3","observation_id":"a7d67963-12f6-4b35-8730-ccb355fcadda","resolution":{"observed_at":"2026-08-06T20:13:56.921317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T17:35:18.429275Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10445","last_updated":"2025-07-14T16:28:00Z","snapshot_observed_at":"2026-08-08T14:51:56.481257Z","submitted_at":"2025-07-14T16:28:00Z","title":"Referential ambiguity and clarification requests: comparing human and LLM behaviour","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:35:18.429275Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2507.10445"},"observation_digest":"sha256:3c751aed1af4ad859e2ab820f1fad386287de20b9b0f7a091cfe514cc48f1128","observation_id":"aa49467c-29a1-4cfd-aefe-e89034e35f02","resolution":{"observed_at":"2026-08-06T17:35:18.429275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T15:26:40.278651Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15788","last_updated":"2025-07-21T16:47:59Z","snapshot_observed_at":"2026-08-09T17:51:45.414225Z","submitted_at":"2025-07-21T16:47:59Z","title":"Small LLMs Do Not Learn a Generalizable Theory of Mind via Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T15:26:40.278651Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2507.15788"},"observation_digest":"sha256:454bac44fd3979a695bcf0dbb4712291d68b63ac527f189315e7c8c700c20e37","observation_id":"1e1dbb0e-a190-4d4b-b6bb-4a1d5eb046ee","resolution":{"observed_at":"2026-08-06T15:26:40.278651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T15:21:18.736835Z","title":"arXiv:2302.02083 [cs]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16196","last_updated":"2025-07-22T03:15:27Z","snapshot_observed_at":"2026-08-09T08:08:37.221157Z","submitted_at":"2025-07-22T03:15:27Z","title":"Do Large Language Models Have a Planning Theory of Mind? Evidence from MindGames: a Multi-Step Persuasion Task","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:21:18.736835Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2507.16196"},"observation_digest":"sha256:069fa186a6146cb010d8840f98e8eab7a87048703d37f1b375e09cd70f49ad61","observation_id":"51ae5e3d-4528-42bc-aa53-5d6a2632d481","resolution":{"observed_at":"2026-08-06T15:21:18.736835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T14:45:42.724363Z","title":"Theory of mind may have spontaneously emerged in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18182","last_updated":"2025-08-04T15:53:52Z","snapshot_observed_at":"2026-08-09T07:56:18.111390Z","submitted_at":"2025-07-24T08:28:17Z","title":"SCOPE: Stochastic and Counterbiased Option Placement for Evaluating Large Language Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:42.724363Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2507.18182"},"observation_digest":"sha256:ce72269bc37289e70dc6cecb946f778158698a36a6e49124bf8669350ad65c0f","observation_id":"c4da330a-b34e-4de7-b732-7b850c1a77d2","resolution":{"observed_at":"2026-08-06T14:45:42.724363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T11:19:15.799794Z","title":", year 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22847","last_updated":"2025-07-30T17:03:59Z","snapshot_observed_at":"2026-08-09T17:44:11.053114Z","submitted_at":"2025-07-30T17:03:59Z","title":"The Incomplete Bridge: How AI Research (Mis)Engages with Psychology","version":1},"reference_index":160,"source":"arxiv_source","source_observed_at":"2026-08-06T11:19:15.799794Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2507.22847"},"observation_digest":"sha256:c5c9c4c83ed74461fe666669df425f986f51007a1fc55c3df26335c0fb898cfc","observation_id":"8efacc87-1684-4144-ad46-b7fe1dae4705","resolution":{"observed_at":"2026-08-06T11:19:15.799794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T11:46:53.206198Z","title":"Frontiers in Robotics and AI, 3:62","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2509.02292","last_updated":"2026-06-28T02:36:12Z","snapshot_observed_at":"2026-08-05T11:46:52.768597Z","submitted_at":"2025-09-02T13:11:24Z","title":"LLMs and their Limited Theory of Mind: Evaluating Mental State Annotations in Situated Dialogue","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-05T11:46:53.206198Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2509.02292"},"observation_digest":"sha256:17cd0e0aa96474ed90a5a561a4042f5a7b6d82a38ea3396f9e14bc2e0f27670a","observation_id":"65b3c992-78f1-4148-a060-f5a327d8142f","resolution":{"observed_at":"2026-08-05T11:46:53.206198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T10:36:06.423054Z","title":"arXiv preprint arXiv:2302.02083, 4:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03940","last_updated":"2025-09-04T07:03:46Z","snapshot_observed_at":"2026-08-08T20:51:35.281735Z","submitted_at":"2025-09-04T07:03:46Z","title":"VoxRole: A Comprehensive Benchmark for Evaluating Speech-Based Role-Playing Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:36:06.423054Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2509.03940"},"observation_digest":"sha256:fc09c1c325ca2972b0994ce95e1440c87928b8049447d2df432ed432eedf941f","observation_id":"2ac3479e-559f-4eb7-959a-cad129263656","resolution":{"observed_at":"2026-08-05T10:36:06.423054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-04T20:21:50.462570Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08705","last_updated":"2025-09-10T15:55:14Z","snapshot_observed_at":"2026-08-09T21:15:14.039268Z","submitted_at":"2025-09-10T15:55:14Z","title":"One Model, Two Minds: A Context-Gated Graph Learner that Recreates Human Biases","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T20:21:50.462570Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2509.08705"},"observation_digest":"sha256:86fd56d54953086cb0b4943230b4a827eba33c5a5513c436f8bddb727d230c41","observation_id":"3b59a820-a089-44ad-9167-90df738e3c22","resolution":{"observed_at":"2026-08-04T20:21:50.462570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2509.13324","last_updated":"2026-05-05T01:57:59Z","snapshot_observed_at":"2026-08-06T22:16:06.921311Z","submitted_at":"2025-08-17T21:56:06Z","title":"Designing Psychometric Bias Measures for ChatBots: An Application to Racial Bias Measurement","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-18T22:12:15.876447Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2509.13324"},"observation_digest":"sha256:9b62b648c95814811f2fcccf8da058e6ae491fc300278ba73ef7df5b07b41869","observation_id":"e61906d8-b39e-4735-a074-1cc1184d5f06","resolution":{"observed_at":"2026-05-18T22:12:51.799106Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-04T12:42:03.440313Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02660","last_updated":"2026-06-09T21:44:21Z","snapshot_observed_at":"2026-08-08T15:08:35.616665Z","submitted_at":"2025-10-03T01:37:32Z","title":"When Researchers Say Mental Model/Theory of Mind of AI, What Are They Really Talking About?","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T12:42:03.440313Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2510.02660"},"observation_digest":"sha256:9b1d0e7a214d2e311b32273cb44235ede820163e1ba19cb3e39e4c7ff02c42ab","observation_id":"6534f454-410e-42ce-b984-86263344e4fa","resolution":{"observed_at":"2026-08-04T12:42:03.440313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-03T07:22:45.534266Z","title":"Theory of mind may have spontaneously emerged in large language models.arXiv preprint arXiv:2302.02083, 4:169,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.22184","last_updated":"2026-06-16T10:57:55Z","snapshot_observed_at":"2026-08-03T08:02:06.264875Z","submitted_at":"2026-01-28T13:34:04Z","title":"Tacit Coordination of Large Language Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T07:22:45.534266Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2601.22184"},"observation_digest":"sha256:55714584ac586e0c6ba16adcf5b186b2bca48fade272ef85224098ab657eaaa8","observation_id":"9fa7ea78-7e23-4709-9fdc-7cc218331595","resolution":{"observed_at":"2026-08-03T07:22:45.534266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2604.02334","last_updated":"2026-01-18T13:09:25Z","snapshot_observed_at":"2026-08-02T08:49:18.381140Z","submitted_at":"2026-01-18T13:09:25Z","title":"Holos: A Web-Scale LLM-Based Multi-Agent System for the Agentic Web","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T13:19:07.715653Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2604.02334"},"observation_digest":"sha256:188430f1ed12cce8e03459991510ab35e96f58b81b4ee03aeb4091fafeb5d041","observation_id":"da056b69-54ac-4304-8a9c-54bad4205d8f","resolution":{"observed_at":"2026-05-16T13:20:57.917204Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2604.04387","last_updated":"2026-04-07T03:27:39Z","snapshot_observed_at":"2026-08-02T10:34:52.699872Z","submitted_at":"2026-04-06T03:32:14Z","title":"Gradual Cognitive Externalization: From Modeling Cognition to Constituting It","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T19:33:50.078604Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2604.04387"},"observation_digest":"sha256:bd0d9351f052a96418b62b23bd90aeff8b050c9346244fbb4db6add1841563fa","observation_id":"ae4278fe-fc73-4da0-bd18-f87ac078a6c0","resolution":{"observed_at":"2026-05-10T22:50:48.069309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2604.17220","last_updated":"2026-06-02T11:51:14Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T03:03:25Z","title":"Dynamics of Cognitive Heterogeneity: Investigating Behavioral Biases in Multi-Stage Supply Chains with LLM-Based Simulation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-10T06:06:48.422940Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2604.17220"},"observation_digest":"sha256:bcb923832192266489cd5735b574fd79fb79ede7104a49cd8c0d7622d3ecb49f","observation_id":"69956e50-598b-462a-8ec1-4cf13063cfcc","resolution":{"observed_at":"2026-05-10T06:11:20.559013Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2604.20582","last_updated":"2026-04-22T14:00:56Z","snapshot_observed_at":"2026-07-31T18:28:35.664344Z","submitted_at":"2026-04-22T14:00:56Z","title":"Trust, Lies, and Long Memories: Emergent Social Dynamics and Reputation in Multi-Round Avalon with LLM Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-09T23:17:21.835439Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2604.20582"},"observation_digest":"sha256:266964b4c40dfcdeefc38aef935b90f204c404bd69f7d78789d39f0e0dc8c9a5","observation_id":"27781969-6e61-4d58-98c2-00c8f521e710","resolution":{"observed_at":"2026-05-11T14:11:05.456589Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2604.23057","last_updated":"2026-06-04T20:56:59Z","snapshot_observed_at":"2026-07-06T23:09:19.041332Z","submitted_at":"2026-04-24T22:56:19Z","title":"Don't Make the LLM Read the Graph: Make the Graph Think","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T11:41:37.667121Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2604.23057"},"observation_digest":"sha256:fd48d3919857f9472a7ef2f60b1a9c792f62cc50a27de871622338e536224806","observation_id":"1cae9632-b97b-423a-ad37-541a76ead2be","resolution":{"observed_at":"2026-05-08T21:44:17.760428Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2604.23198","last_updated":"2026-04-25T08:09:31Z","snapshot_observed_at":"2026-07-06T23:09:29.537323Z","submitted_at":"2026-04-25T08:09:31Z","title":"StoryTR: Narrative-Centric Video Temporal Retrieval with Theory of Mind Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-08T08:04:15.238840Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2604.23198"},"observation_digest":"sha256:71c3133757c1ce3fdbfeb520a5a47a21eb9b0727554a72e49bc8669ea10de933","observation_id":"9840fad6-02c6-48e7-8c51-7f9b00268ce4","resolution":{"observed_at":"2026-05-11T20:46:13.583239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.01329","last_updated":"2026-05-02T08:48:09Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T08:48:09Z","title":"Truth or Tribe: How In-group Favoritism Prioritize Facts in Persona Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-09T14:41:05.398486Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.01329"},"observation_digest":"sha256:6bf017d52a02562c18fbb3da1e51a4046b268aa579533e38bf7ca0b81c471280","observation_id":"c1629171-dab9-4425-8ed1-1df6d9c01445","resolution":{"observed_at":"2026-05-11T16:51:08.654166Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.07462","last_updated":"2026-05-08T09:10:17Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:10:17Z","title":"The Moltbook Files: A Harmless Slopocalypse or Humanity's Last Experiment","version":1},"reference_index":199,"source":"arxiv_source","source_observed_at":"2026-05-11T01:54:49.131461Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.07462"},"observation_digest":"sha256:bf270f25547981160c9d4ee9d655d58be6c2deae47e0497e7ad70fcc8fc3232f","observation_id":"22ca6735-abd6-44bf-8b26-e1bdb4dff4d2","resolution":{"observed_at":"2026-05-11T01:55:50.908671Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.09826","last_updated":"2026-05-15T19:33:36Z","snapshot_observed_at":"2026-08-09T23:09:17.130255Z","submitted_at":"2026-05-11T00:04:19Z","title":"EnactToM: An Evolving Benchmark for Functional Theory of Mind in Embodied Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T04:59:52.659739Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.09826"},"observation_digest":"sha256:761ab6e6abb66360159c2ff002834f6ebc0d5bb24cef31df2f51a4d5ed44fe50","observation_id":"35043146-8204-41b9-a520-3ac5905ff0ac","resolution":{"observed_at":"2026-05-12T05:01:20.886600Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.09826","last_updated":"2026-05-15T19:33:36Z","snapshot_observed_at":"2026-08-09T23:09:17.130255Z","submitted_at":"2026-05-11T00:04:19Z","title":"EnactToM: An Evolving Benchmark for Functional Theory of Mind in Embodied Agents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T23:27:45.394730Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.09826"},"observation_digest":"sha256:d33888b2d14692e6358c4612e618cea6de37f7edac312d708dd72fed472c5b78","observation_id":"50593306-9772-43de-bc61-32be8d8b2cae","resolution":{"observed_at":"2026-05-20T23:29:12.583601Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.19762","last_updated":"2026-05-19T12:37:01Z","snapshot_observed_at":"2026-08-02T21:57:08.320932Z","submitted_at":"2026-05-19T12:37:01Z","title":"What Really Improves Mathematical Reasoning: Structured Reasoning Signals Beyond Pure Code","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-20T05:06:46.360174Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.19762"},"observation_digest":"sha256:a6f99d29c17d0621c4c1aa3d902e3088089dab33a91aff7f7c32120d4f991d47","observation_id":"4c123530-e486-449c-967e-0a5232c58e65","resolution":{"observed_at":"2026-05-20T05:08:05.084361Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.20423","last_updated":"2026-05-19T19:19:26Z","snapshot_observed_at":"2026-08-02T08:56:18.389445Z","submitted_at":"2026-05-19T19:19:26Z","title":"OSCToM: RL-Guided Adversarial Generation for High-Order Theory of Mind","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T07:09:37.399954Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.20423"},"observation_digest":"sha256:ea3c2226229885925fd92ca6915e689e7986bf6f05e36f78fcfa5e2dc7b325dd","observation_id":"986fe9de-1b21-47b2-93e9-f682ad720dd5","resolution":{"observed_at":"2026-05-21T07:09:46.284684Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.21739","last_updated":"2026-05-27T21:10:50Z","snapshot_observed_at":"2026-07-31T20:30:26.731137Z","submitted_at":"2026-05-20T21:06:05Z","title":"AttuneBench: A Conversation-Based Benchmark for LLM Emotional Intelligence","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T08:53:21.922481Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.21739"},"observation_digest":"sha256:05c0ec7e25a0114c9075c0213ff4843aa37f0fff58d2b20128e6f723fdccd861","observation_id":"966f203d-06b8-4cae-ad0b-5488cb8a1429","resolution":{"observed_at":"2026-05-22T08:54:45.612290Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.21739","last_updated":"2026-05-27T21:10:50Z","snapshot_observed_at":"2026-07-31T20:30:26.731137Z","submitted_at":"2026-05-20T21:06:05Z","title":"AttuneBench: A Conversation-Based Benchmark for LLM Emotional Intelligence","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T17:02:35.794126Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.21739"},"observation_digest":"sha256:41ccd8f05b52b8ef65d2ae2bf0972b80593050e5d7ba6cc561472e94b9d897e4","observation_id":"f135b0a1-233c-4de2-863b-acb5a2b5b6aa","resolution":{"observed_at":"2026-06-30T17:04:56.568411Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.22826","last_updated":"2026-04-09T14:02:14Z","snapshot_observed_at":"2026-08-04T15:05:25.435228Z","submitted_at":"2026-04-09T14:02:14Z","title":"Evaluating Large Language Models in a Complex Hidden Role Game","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-25T00:36:49.353675Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.22826"},"observation_digest":"sha256:7fe26635ecf57bca675100e3dc2abe150a21a4c4f877886fe636d62a9c861968","observation_id":"e791bbf4-78ef-4352-a83d-62345b5cff33","resolution":{"observed_at":"2026-05-25T00:40:08.218573Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2605.27593","last_updated":"2026-05-26T19:06:39Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T19:06:39Z","title":"Voluntary Collusion with Secret Tools in Competing LLM Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T17:01:22.732390Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2605.27593"},"observation_digest":"sha256:4781876ca66a24968664292203b3b2e68f2c592f9ef150886f0732db3fc3dbfd","observation_id":"ecab5c85-5f2a-4334-a661-3994de44ea3f","resolution":{"observed_at":"2026-06-29T17:03:40.248399Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2606.05557","last_updated":"2026-06-04T01:11:06Z","snapshot_observed_at":"2026-08-01T18:48:44.625098Z","submitted_at":"2026-06-04T01:11:06Z","title":"AURA: Intent-Directed Probing for Implicit-Need Surfacing in Situated LLM Agents","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-28T02:07:07.135522Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2606.05557"},"observation_digest":"sha256:691706483c1876530d81fc7818bdbb379e6411a60d0215a7cb485c9035c627a3","observation_id":"b657bf33-1ed2-4e48-8b6b-d119c3727766","resolution":{"observed_at":"2026-07-02T12:26:56.986554Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2606.09092","last_updated":"2026-06-08T06:42:12Z","snapshot_observed_at":"2026-07-06T23:48:30.569726Z","submitted_at":"2026-06-08T06:42:12Z","title":"From Shortcuts to Reasoning: Robust Post-Training of Theory of Mind with Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-27T17:42:38.122144Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2606.09092"},"observation_digest":"sha256:6ea471070dafcb41b7fc5e55cbccdd246fd9f66ae972ab443f718e374516327d","observation_id":"2d1685c7-b646-4a5d-881c-45cf02d2f7c9","resolution":{"observed_at":"2026-07-02T23:57:28.251048Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2606.20603","last_updated":"2026-05-20T14:54:09Z","snapshot_observed_at":"2026-08-03T02:28:08.992682Z","submitted_at":"2026-05-20T14:54:09Z","title":"A Survey of Large Language Models for Perception and Measurement of Human Psychology","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T16:59:25.825681Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2606.20603"},"observation_digest":"sha256:498146889845544dde6ecc2bb1461acb60b37ca426bca9b932021020bb17803f","observation_id":"d9c23742-28e3-48dd-a66c-20ddd3e4b0ac","resolution":{"observed_at":"2026-06-30T17:04:57.144776Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2606.23840","last_updated":"2026-06-22T18:22:53Z","snapshot_observed_at":"2026-08-07T18:06:44.563834Z","submitted_at":"2026-06-22T18:22:53Z","title":"Embodied Explainability and Ontological Obstacles: Why We Struggle to Explain the Answers of Large Language Models (LLMs)","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-26T06:54:48.941504Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2606.23840"},"observation_digest":"sha256:d274505bbd1ec7e2b1d14512d4e4a53af597d9dd506618e8db75bf3fe357e287","observation_id":"eb0b92dc-7025-4496-a19e-293b60882bf3","resolution":{"observed_at":"2026-06-26T21:30:03.725211Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2606.27981","last_updated":"2026-06-26T11:30:42Z","snapshot_observed_at":"2026-07-07T00:02:09.217954Z","submitted_at":"2026-06-26T11:30:42Z","title":"ToxiREX: A Dataset on Toxic REasoning in ConteXt","version":1},"reference_index":187,"source":"arxiv_source","source_observed_at":"2026-06-29T04:33:18.794505Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2606.27981"},"observation_digest":"sha256:dbb3885801f3850f284d471a8b55b2d6d9529812df60cd294dd7c39f653b546c","observation_id":"19ab65e3-ada9-46b4-8062-35ecadf5645e","resolution":{"observed_at":"2026-06-29T04:43:07.126975Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2606.28524","last_updated":"2026-06-26T18:21:16Z","snapshot_observed_at":"2026-08-08T19:06:03.069043Z","submitted_at":"2026-06-26T18:21:16Z","title":"Developmental Trajectories of Situation Modeling and Mentalizing in Transformer Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-30T01:32:40.504759Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2606.28524"},"observation_digest":"sha256:57d4c64e3e3fb606813afb0096dd88f234fd0862affd2f95fd1070a1f45b83f8","observation_id":"a06b16e8-868d-4adb-af30-780ec62111cc","resolution":{"observed_at":"2026-06-30T01:34:08.777412Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2606.29495","last_updated":"2026-07-31T15:41:00Z","snapshot_observed_at":"2026-08-06T07:55:36.335589Z","submitted_at":"2026-06-28T16:49:43Z","title":"Cognitive World Model for Progressive BDI/E Trajectory Evaluation of Conversational Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-30T06:53:39.502788Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2606.29495"},"observation_digest":"sha256:d781928eef07560d2f3bfde9101447d4f54fd94954f6c2b445a380ecdf2d0154","observation_id":"c8683c41-d09b-4a34-ba3a-335b740fdc83","resolution":{"observed_at":"2026-06-30T06:54:20.142185Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":"2302.02083","doi":"10.1073/pnas.2405460121","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.1073/pnas.2405460121","venue":"Proceedings of the National Academy of Sciences","work_id":"8e808369-0b35-4b0b-9071-f9065ecc5e0e","year":2024},"citing_paper":{"arxiv_id":"2607.01581","last_updated":"2026-07-02T01:26:09Z","snapshot_observed_at":"2026-07-07T00:07:08.919017Z","submitted_at":"2026-07-02T01:26:09Z","title":"Beyond Skepticism: Evaluating LLMs Pedagogical Intent Reasoning with the Adaptive Pedagogical Vigilance Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-03T15:26:40.974564Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2607.01581"},"observation_digest":"sha256:23ca55336fa1a2522ef66fdb4a4b700d7bd1beaac08cdf5e833b1d44adb77c48","observation_id":"da795e3f-c986-46e1-89fa-c232d5ec6918","resolution":{"observed_at":"2026-07-03T15:28:33.613030Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T22:19:51.800283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-02T11:43:50.574560Z","title":"Theory of mind may have spontaneously emerged in large language models.arXiv preprint arXiv:2302.02083, 4(169):2, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11895","last_updated":"2026-07-15T01:46:04Z","snapshot_observed_at":"2026-08-05T14:25:59.466796Z","submitted_at":"2026-06-11T10:41:23Z","title":"AgentSociety 2: An Integrated Research Environment for Executable Social Science","version":2},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-02T11:43:50.574560Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2607.11895"},"observation_digest":"sha256:9a0fb8522b2379beeb2e7f72866262f1854f9a44683189a7a05041901ce22857","observation_id":"84814518-9829-4235-b250-ee316385be28","resolution":{"observed_at":"2026-08-02T11:43:50.574560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-07-31T21:55:17.619128Z","title":"arXiv preprint arXiv:2302.02083 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27967","last_updated":"2026-07-30T10:14:24Z","snapshot_observed_at":"2026-08-05T12:14:09.489312Z","submitted_at":"2026-07-30T10:14:24Z","title":"MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation","version":1},"reference_index":164,"source":"arxiv_source","source_observed_at":"2026-07-31T21:55:17.619128Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2607.27967"},"observation_digest":"sha256:93b15c9f9c1f94068552fd231e50b6b9a2dcb175412dc99fbb5bf7621e135df2","observation_id":"0e8c9ee2-1ef8-43fc-ab00-8086c5a629c2","resolution":{"observed_at":"2026-07-31T21:55:17.619128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T19:57:56.756766Z","title":"Pro- ceedings of the National Academy of Sciences121(45), e2405460121 (Nov 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-09T04:43:57.399898Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.756766Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:7644256573b61fdd5c7e4e5c63400180010268ae70c0764908f088c90a9ff68b","observation_id":"74b814d5-e1b2-4821-8e66-d3fecded039f","resolution":{"observed_at":"2026-08-06T19:57:56.756766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2302.02083/citation-record","integrity":"/paper/2302.02083/integrity","json":"/paper/2302.02083/citation-record.json","paper":"/paper/2302.02083"},"outbound":[],"paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","latest_version":7,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 49 inbound Pith citation observations for arXiv:2302.02083."}