{"as_of":"2026-08-10T04:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f7dd713cfd0e76f92a190ea1a56ef5baf1f784ea17ab8f093672eda382ee36d9","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:28:26.619534Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.14224/citation-record","integrity":"/paper/2506.14224/integrity","json":"/paper/2506.14224/citation-record.json","paper":"/paper/2506.14224"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T00:28:22.948708Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:22.948708Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:81a930d3537fdd00236622088c40ae85b4baee2db165104fd9a08fac28e36f5f","observation_id":"fd2d8bbe-6533-46ae-956f-67c9aadf7717","resolution":{"observed_at":"2026-08-07T00:28:22.948708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:37.087731Z","title":"Do llms exhibit human-like reasoning? evaluating theory of mind in llms for open-ended responses","venue":null,"work_id":"a26edbff-a4f5-4270-9511-468aa58a4981","year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.009505Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:7302e077057acb0f724e12421f6c48b571edce2a98beacd5f681c488400c4463","observation_id":"87f72791-366a-4e56-a4cb-f8866ea1f799","resolution":{"observed_at":"2026-08-07T00:28:37.218093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T00:28:23.130188Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.130188Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:2fca4268af568d2ddfbec2e6013365e28a00a676b818d09aa71dd2e93e3aa275","observation_id":"aa45be4f-e851-4a68-9d40-da8bbce87f85","resolution":{"observed_at":"2026-08-07T00:28:23.130188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-07T00:28:23.244204Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.244204Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:bb603c54b1a29de2435a2edd7fac75dfbb834301112d79b4476d0a83bc264328","observation_id":"bde74608-22b4-4b74-ada7-4cd6a1224c81","resolution":{"observed_at":"2026-08-07T00:28:23.244204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:36.844882Z","title":"theory of mind","venue":null,"work_id":"9e80d627-94a5-42e2-ab5d-b2e926d8f525","year":1985},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.327105Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:7f657dfd77d54c023b0f1fc27dec49269c37069f59da3926f2779690e72b201e","observation_id":"55c22fba-95c5-4f34-b47d-e88240dd0711","resolution":{"observed_at":"2026-08-07T00:28:36.966034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:36.672275Z","title":null,"venue":null,"work_id":"f0d0d83c-720e-41ce-b1ad-9dbc5421c768","year":2020},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.437074Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:5a5715c8a717ae0db2e7dc85bfbe739147bae727002dd9ef919eb6ee127856bf","observation_id":"31da6107-d971-465d-a0f9-041b363b03ec","resolution":{"observed_at":"2026-08-07T00:28:36.762234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-07T00:28:23.499151Z","title":"T., Li, Y., Lundberg, S., and others","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.499151Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:2f98edae6865a58c28d959bb5f603e75de8c6d7603b0d624ec2b6cc3b1ae4f68","observation_id":"33c20f2f-5e9c-4280-8c2c-499f650af28e","resolution":{"observed_at":"2026-08-07T00:28:23.499151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:23.564854Z","title":"Through the theory of mind's eye: Reading minds with multimodal video large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.564854Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:b5b50e5d9dc329cab7d88b7890440c72891f365c7e180b433075987326ae76f2","observation_id":"c2345e0f-fd69-4acf-b503-ca5bf8d94200","resolution":{"observed_at":"2026-08-07T00:28:23.564854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13831","last_updated":"2023-06-24T01:16:07Z","snapshot_observed_at":"2026-08-08T11:00:02.521037Z","submitted_at":"2023-06-24T01:16:07Z","title":"Minigrid & Miniworld: Modular & Customizable Reinforcement Learning Environments for Goal-Oriented Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13831","snapshot_observed_at":"2026-08-07T00:28:23.677281Z","title":"d., Willems, L., Lahlou, S., Pal, S., Castro, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.677281Z"},"links":{"cited_paper":"/paper/2306.13831","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:d70970219b91f671db44913a23594ec8844e7bf74cbfc9dbd27238980c84aa2d","observation_id":"806965e1-0ce4-4b89-b66d-9da4b55bbcb6","resolution":{"observed_at":"2026-08-07T00:28:23.677281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T00:28:23.776668Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.776668Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:099ed25fc146f7edaf5ed151d4e8e4b0edfbeae342a06711c4eaeed3b6d0b874","observation_id":"35991cdc-34e0-4217-9f59-6aa764bda43f","resolution":{"observed_at":"2026-08-07T00:28:23.776668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.01175","last_updated":"2017-03-31T16:36:53Z","snapshot_observed_at":"2026-07-06T05:21:18.233606Z","submitted_at":"2016-12-04T20:45:42Z","title":"Who is Mistaken?","version":2},"cited_work":{"arxiv_id":"1612.01175","doi":null,"metadata_source":"pith","pith_arxiv_id":"1612.01175","snapshot_observed_at":"2026-08-07T00:28:26.952760Z","title":"Who is Mistaken?","venue":"cs.CV","work_id":"2968325a-b63c-4f4c-a4ab-44c4ebf17936","year":2016},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.869613Z"},"links":{"cited_paper":"/paper/1612.01175","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:7ec784baf0312ad83d5938b0acc54e3add5133eaacb27e7310c3a62dd9b69b27","observation_id":"3cc93695-7564-430b-b4bd-0945222aaadf","resolution":{"observed_at":"2026-08-07T00:28:27.010971Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:36.438719Z","title":"M., and Dillon, M","venue":null,"work_id":"3c85ef96-36fa-461d-a897-3f7c1e580a35","year":2021},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:23.936271Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:b0b295112201b1787ca2ccf6986c3ee01025fd815d59e2658aec7ec82a0c570e","observation_id":"93e44000-eab0-43db-8a37-182334a3cdc5","resolution":{"observed_at":"2026-08-07T00:28:36.582680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:36.223882Z","title":null,"venue":null,"work_id":"ed22d07c-cdda-412e-a002-e9de7a1281f5","year":2017},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.030959Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:2e3d506edacdb3ed0f40053be42af26ab174e545ed5958ea8f1e68f7e50bfc7e","observation_id":"5ca30607-29df-4e9c-8e4e-cc2deb0c23c0","resolution":{"observed_at":"2026-08-07T00:28:36.322279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:35.970619Z","title":"Distributional vectors encode referential attributes","venue":null,"work_id":"a726e2a6-6cdd-42aa-8eb1-569052379ada","year":2015},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.105076Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:f9be7e71c6da9142d2b978fbad935f1f13ba568abe68085cbcb69947c6688c46","observation_id":"54bd068a-a2ce-434b-bfda-c4b6c17ca3da","resolution":{"observed_at":"2026-08-07T00:28:36.092670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T00:28:24.202247Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.202247Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:a636a1a541f4d88d43309083f9deb70f0a9cef5d7a1fa1278b697f6b8fca41cd","observation_id":"19e4d656-eba0-4d4d-a1b5-e51cbc3c0fbc","resolution":{"observed_at":"2026-08-07T00:28:24.202247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:24.323659Z","title":"MMT o M - QA : Multimodal theory of mind question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.323659Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:2d8d2bb97fe49ebf5309ff3a08cb568da72ea6d4abd17b5c847386385793144a","observation_id":"207098c1-491d-41e7-a4c4-791f40507776","resolution":{"observed_at":"2026-08-07T00:28:24.323659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-07T00:28:24.444328Z","title":"Theory of Mind May Have Spontaneously Emerged in Large Language Models , March 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.444328Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:834a11411d3318fcb63d65d95f1e5ca0435af2eeef3aa82541a8385867a63da8","observation_id":"818afb4d-91ae-48c4-a0b6-0061a4073722","resolution":{"observed_at":"2026-08-07T00:28:24.444328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:35.743267Z","title":"Evaluating large language models in theory of mind tasks","venue":null,"work_id":"59aac346-7c7b-4598-b6af-b37d26db52a4","year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.488322Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:130fcdb7227fff8eef6337b8502eab5bedbd09f23d453635a9e92c0020a42c45","observation_id":"9f5bbe94-3938-4c56-af15-3a1a2aa71bfc","resolution":{"observed_at":"2026-08-07T00:28:35.865227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:35.561680Z","title":"What’s in an embedding? Analyzing word embeddings through multilingual evaluation","venue":null,"work_id":"91265ea0-356a-4223-b6bd-1a8894d9c634","year":2015},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.610920Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:2e154a2ecb8a7057eb1c0d247252108b056dd957b3f939ba443a0a9883800646","observation_id":"c790b181-2db8-43eb-8b26-9c26ddab3fa7","resolution":{"observed_at":"2026-08-07T00:28:35.638751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:35.351030Z","title":"Revisiting the evaluation of theory of mind through question answering","venue":null,"work_id":"4eab3d63-c1ff-47cf-ba46-36b869ffa700","year":2019},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.709661Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:8392a3b3e0d1ca66758a8659c1419db8a77a4676aaa4c2a65b439ceca211497d","observation_id":"0582280e-b90f-4db8-99eb-cc394f11f674","resolution":{"observed_at":"2026-08-07T00:28:35.459458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:35.136484Z","title":"Inference-time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":"fa763033-bfe5-4f47-a8e3-f7a1bc5f8973","year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.801191Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:fc91726aa5953961b592bf13e56fb90311bb156066a3e4282d095c79a0b746d8","observation_id":"e4ead157-f5aa-474c-9393-83bf28cea292","resolution":{"observed_at":"2026-08-07T00:28:35.222704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T00:28:24.852810Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.852810Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:aaf8f5c404c00f3a41336fb9db377efa43b10f9e09893090198979974209a815","observation_id":"235e191c-b256-4637-8238-077aaf6fce10","resolution":{"observed_at":"2026-08-07T00:28:24.852810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05241","last_updated":"2024-10-30T18:37:57Z","snapshot_observed_at":"2026-07-06T18:59:00.983278Z","submitted_at":"2024-08-05T20:49:48Z","title":"Large Model Strategic Thinking, Small Model Efficiency: Transferring Theory of Mind in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05241","snapshot_observed_at":"2026-08-07T00:28:24.942418Z","title":"Large model strategic thinking, small model efficiency: transferring theory of mind in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:24.942418Z"},"links":{"cited_paper":"/paper/2408.05241","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:292b53493a7651b8635a3050f16896ec1fac2874236922ea060fa66dcb00b8a1","observation_id":"33ebb050-394e-4dec-92a1-c6fb30297b48","resolution":{"observed_at":"2026-08-07T00:28:24.942418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.72","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:26.733364Z","title":"Towards a holistic landscape of situated theory of mind in large language models","venue":null,"work_id":"6abffc04-6195-4c55-a919-052240565fd4","year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.051440Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:3e75cb5409d75a263f17c87fa0ac3a769b3d64138cea0afcee5f0c4ac4f1dd14","observation_id":"0167ac2f-a22a-4dec-86e7-475019775c64","resolution":{"observed_at":"2026-08-07T00:28:26.780658Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:34.916236Z","title":"A review on machine theory of mind","venue":null,"work_id":"6117eb4f-4703-4828-8086-4f50b9b4ec78","year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.122747Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:d0fb0346a6790137eccf2dc02be38285f12561f494e5b00e33fa9c891948edef","observation_id":"22cdedd6-ae45-4b79-9524-65c4b6c5edd5","resolution":{"observed_at":"2026-08-07T00:28:34.996724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:25.167889Z","title":"Evaluating theory of mind in question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.167889Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:1013f5a77aa54b3290920142e14a1fc378e2948cf46bd791359e5b194af2ef18","observation_id":"3aca20ec-dbf5-4269-bc68-00a205d13a24","resolution":{"observed_at":"2026-08-07T00:28:25.167889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01158","last_updated":"2023-07-18T18:04:08Z","snapshot_observed_at":"2026-08-09T12:12:57.997672Z","submitted_at":"2023-07-03T17:07:18Z","title":"Theory of Mind as Intrinsic Motivation for Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01158","snapshot_observed_at":"2026-08-07T00:28:25.231349Z","title":"Theory of mind as intrinsic motivation for multi-agent reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.231349Z"},"links":{"cited_paper":"/paper/2307.01158","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:53d2141b078c603a0bcc1e4034c0829cac54fe6047f7c5228a7c87bd58e727e9","observation_id":"b432b1bf-fac7-47ec-a019-7ed73ce1fd7b","resolution":{"observed_at":"2026-08-07T00:28:25.231349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:25.311237Z","title":"Neural theory-of-mind? on the limits of social intelligence in large LM s","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.311237Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:cd6d6fb07ff51ea86bdb58bc526e94dbd5b619324968db0f2a9d329912e48f26","observation_id":"c2e44e34-44e8-44a5-ae70-64ebd83a6716","resolution":{"observed_at":"2026-08-07T00:28:25.311237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:34.665065Z","title":"Symmetric machine theory of mind","venue":null,"work_id":"a6bbb7d7-bc08-4c45-ab53-8518b4c513bd","year":2022},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.364111Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:af434b8b0fa3ce27889d28d0b4e922b23e6701a574543ae04f89c425d519166e","observation_id":"13646d49-ec21-4f07-aff8-1b8d7399473e","resolution":{"observed_at":"2026-08-07T00:28:34.793911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:34.442104Z","title":"H., Zhou, X., Choi, Y., Goldberg, Y., Sap, M., and Shwartz, V","venue":null,"work_id":"d3d8ad98-273c-40de-9e76-ba4b3d59dd24","year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.434622Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:d04d5ac17aecd1cfbfcea2b34bf574696c7b140ae8c64cfde1b3283d9378c1e1","observation_id":"0555ea13-19fe-4d7e-957e-33de2bce04a4","resolution":{"observed_at":"2026-08-07T00:28:34.560220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:34.253181Z","title":"Muma-tom: Multi-modal multi-agent theory of mind","venue":null,"work_id":"6bb9d52f-56c9-4a50-b7c3-940e1dbf3bd8","year":2025},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.540625Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:7d4fb51a098c12c186628d004875138ba388e27bf7dbfb542dddd27a616c9884","observation_id":"ee61ebd7-42ca-409b-83f3-bf72f2888641","resolution":{"observed_at":"2026-08-07T00:28:34.338427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:34.086638Z","title":"Agent: A benchmark for core psychological reasoning","venue":null,"work_id":"f53b07ea-498d-4661-bb0f-28645a371437","year":2021},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.668627Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:5a800ae4e3332806ab8de48639b789733054afc7cc121cce5f9fa5bdd7c16168","observation_id":"a596cc83-ea41-43cc-be45-acf1aa7b9b22","resolution":{"observed_at":"2026-08-07T00:28:34.180366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:25.799002Z","title":"and Lernould, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.799002Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:c538e3d72dd6ea2e75596f33b38ace08a7f959fe3672256c3845692c0040d881","observation_id":"5f10b3df-74e7-47a0-9dc2-c389bcb32a5f","resolution":{"observed_at":"2026-08-07T00:28:25.799002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:33.891679Z","title":"W., Albergo, D., Borghini, G., Pansardi, O., Scaliti, E., Gupta, S., Saxena, K., Rufo, A., Panzeri, S., Manzi, G., et al","venue":null,"work_id":"483fbf11-0ca4-48c5-a02b-21e9fa6eab33","year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:25.931531Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:3ca10908ff25d2871c6628274ccedaf96a99c1ec61dc41214e26ed01ac8d1dcc","observation_id":"8025005c-1164-430c-99ad-003536a40d14","resolution":{"observed_at":"2026-08-07T00:28:33.968330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:33.738673Z","title":"Doubao-1.5-pro: Exploring the ultimate balance between model performance and inference efficiency, 2025","venue":null,"work_id":"d8ec423c-d7de-49df-b863-3e6048ad92ef","year":2025},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.016543Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:101d6bcaa4473d9f59e6322533c77f393392a6100253407eb328a067f4bb1712","observation_id":"7dc1d12d-5d3f-4278-8758-95563df25a10","resolution":{"observed_at":"2026-08-07T00:28:33.812277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T00:28:26.094789Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.094789Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:10b84ab33dcc8cd8f25dfff43dd733635a1a0498a3e7c4afaf565438d6c15129","observation_id":"dd9926bf-df0e-4a7b-953c-8bb85c6796e3","resolution":{"observed_at":"2026-08-07T00:28:26.094789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08399","last_updated":"2023-03-14T13:47:26Z","snapshot_observed_at":"2026-08-09T17:51:01.952144Z","submitted_at":"2023-02-16T16:18:03Z","title":"Large Language Models Fail on Trivial Alterations to Theory-of-Mind Tasks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08399","snapshot_observed_at":"2026-08-07T00:28:26.225894Z","title":"Large language models fail on trivial alterations to theory-of-mind tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.225894Z"},"links":{"cited_paper":"/paper/2302.08399","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:2295147267dafdd3d18410d6c3a6c6b62c3827d5518188bc2efee704d2ecd36b","observation_id":"4f45d0ac-3793-4ce4-b70e-57931e169a76","resolution":{"observed_at":"2026-08-07T00:28:26.225894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20320","last_updated":"2023-10-31T09:55:07Z","snapshot_observed_at":"2026-07-06T16:41:03.157136Z","submitted_at":"2023-10-31T09:55:07Z","title":"Theory of Mind in Large Language Models: Examining Performance of 11 State-of-the-Art models vs. Children Aged 7-10 on Advanced Tests","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20320","snapshot_observed_at":"2026-08-07T00:28:26.300936Z","title":"J., van Dijk, B., Kouwenhoven, T., de Valk, W., Spruit, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.300936Z"},"links":{"cited_paper":"/paper/2310.20320","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:6c8fef78bc05225d7b488144521868cbec765c8c326b7565f26020b1119ac738","observation_id":"bfe4c5de-14c3-45f0-a1d0-80c40e5a4c8f","resolution":{"observed_at":"2026-08-07T00:28:26.300936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:32.430818Z","title":null,"venue":null,"work_id":"800885a2-4efc-44a4-8f21-615c2a94c91f","year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.352822Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:dd80181cad4785a4c31172cc922d39b379b55496612ffad079f14aa2faa4163b","observation_id":"99e5bde0-cc33-4141-b767-e98ad2aaf563","resolution":{"observed_at":"2026-08-07T00:28:32.973373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:26.405960Z","title":"Hi- T o M : A benchmark for evaluating higher-order theory of mind reasoning in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.405960Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:c391646a16447d773028dfad860fe74bcaf923dc70c4293cc072db88a96fac4d","observation_id":"86ec5611-5393-48fc-9d03-d633a903a312","resolution":{"observed_at":"2026-08-07T00:28:26.405960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:28:27.197943Z","title":"Tomvalley: Evaluating the theory of mind reasoning of llms in realistic social context","venue":null,"work_id":"80e996c0-8c5a-4975-8db8-a708fd6b35f6","year":null},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.458512Z"},"links":{"citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:fadc63f8008dfe34ac7611c40685dba58097e9ff6479327268093810e49ebdc9","observation_id":"6888fed0-8533-4557-9b08-c80522c948e6","resolution":{"observed_at":"2026-08-07T00:28:28.624645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06044","last_updated":"2024-06-03T10:48:16Z","snapshot_observed_at":"2026-07-06T17:27:41.385431Z","submitted_at":"2024-02-08T20:35:06Z","title":"OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06044","snapshot_observed_at":"2026-08-07T00:28:26.516974Z","title":"OpenToM : A Comprehensive Benchmark for Evaluating Theory -of- Mind Reasoning Capabilities of Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.516974Z"},"links":{"cited_paper":"/paper/2402.06044","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:b3d504aaa02db3a69e1c9285eeaa7edaa46e08c348ae96f07e2febabddaf130a","observation_id":"e0acd5bb-3522-4a1c-a658-4ccc7d573a77","resolution":{"observed_at":"2026-08-07T00:28:26.516974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02559","last_updated":"2024-08-05T15:36:46Z","snapshot_observed_at":"2026-08-09T15:26:49.917615Z","submitted_at":"2024-08-05T15:36:46Z","title":"Evaluating and Enhancing LLMs Agent based on Theory of Mind in Guandan: A Multi-Player Cooperative Game under Imperfect Information","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02559","snapshot_observed_at":"2026-08-07T00:28:26.571658Z","title":"Evaluating and enhancing llms agent based on theory of mind in guandan: A multi-player cooperative game under imperfect information","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.571658Z"},"links":{"cited_paper":"/paper/2408.02559","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:5abd27919a84d47495375fd97ff343152bc3feb5f3df93fdfb6fdcbc4873b102","observation_id":"19cc8dad-7779-48b0-9afa-8716ffd6d1b2","resolution":{"observed_at":"2026-08-07T00:28:26.571658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03051","last_updated":"2023-10-04T06:47:58Z","snapshot_observed_at":"2026-08-09T06:52:55.956380Z","submitted_at":"2023-10-04T06:47:58Z","title":"How FaR Are Large Language Models From Agents with Theory-of-Mind?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03051","snapshot_observed_at":"2026-08-07T00:28:26.619534Z","title":"P., Gupta, A., McKee, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T00:28:26.619534Z"},"links":{"cited_paper":"/paper/2310.03051","citing_paper":"/paper/2506.14224"},"observation_digest":"sha256:68815ff1d5f2e4894afedc73c85340872b3774ef0d546a033d52315b06d8f608","observation_id":"0f8c7b11-1f9e-4f65-a046-f54dbed01f70","resolution":{"observed_at":"2026-08-07T00:28:26.619534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.14224","last_updated":"2025-06-17T06:27:42Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T06:53:57.242931Z","submitted_at":"2025-06-17T06:27:42Z","title":"From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":2,"verified_fuzzy":16},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2506.14224."}