{"as_of":"2026-08-23T20:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d22040132732510386468a71c7697491a397907275eae049a3be2aa1cc7db89c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:37:46.300589Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T17:37:14.719889Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10855","snapshot_observed_at":"2026-08-16T11:37:46.300589Z","title":"Core knowledge deficits in multi-modal language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15085","last_updated":"2025-09-01T02:19:22Z","snapshot_observed_at":"2026-08-16T20:57:28.972393Z","submitted_at":"2025-04-21T13:18:54Z","title":"Cognitive-Inspired Hierarchical Attention Fusion With Visual and Textual for Cross-Domain Sequential Recommendation","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:37:46.300589Z"},"links":{"cited_paper":"/paper/2410.10855","citing_paper":"/paper/2504.15085"},"observation_digest":"sha256:b0905a11d7b907e6074df8134b86e8dcc1a54f6ae8063a5d9459c3903f8d099f","observation_id":"7eabf484-0ee0-481b-aa45-92d2f1652427","resolution":{"observed_at":"2026-08-16T11:37:46.300589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10855","snapshot_observed_at":"2026-08-05T21:10:32.745337Z","title":"D., Vasconcelos, N., Golan, T., Luo, D., and Deng, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10057","last_updated":"2025-08-12T21:38:46Z","snapshot_observed_at":"2026-08-13T13:10:53.109705Z","submitted_at":"2025-08-12T21:38:46Z","title":"Large Language Models Show Signs of Alignment with Human Neurocognition During Abstract Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T21:10:32.745337Z"},"links":{"cited_paper":"/paper/2410.10855","citing_paper":"/paper/2508.10057"},"observation_digest":"sha256:c7c67ef4a5b6d7cd3100a451a2226df09408c0135c2b43414c02b76f2c025754","observation_id":"f7e33dfb-7194-46b9-a96f-1920a69c90fd","resolution":{"observed_at":"2026-08-05T21:10:32.745337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models","version":4},"cited_work":{"arxiv_id":"2410.10855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10855","snapshot_observed_at":"2026-07-02T17:37:14.719889Z","title":"Core knowledge deficits in multi-modal language models","venue":null,"work_id":"1b1d3166-eab5-4fb2-b288-18730b4e780d","year":2025},"citing_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"reference_index":215,"source":"pdf_text","source_observed_at":"2026-05-18T19:19:36.427337Z"},"links":{"cited_paper":"/paper/2410.10855","citing_paper":"/paper/2509.02547"},"observation_digest":"sha256:beb1a0665b82356d11b65969337b3238ae905aa085fd772f6ae17d05504bf611","observation_id":"3d6ebbcf-cb8a-4b44-a044-2f32089f6726","resolution":{"observed_at":"2026-05-18T19:21:48.848590Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10855","snapshot_observed_at":"2026-08-03T20:23:04.626496Z","title":"Core knowledge deficits in multi-modal language models.arXiv preprint arXiv:2410.10855, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20272","last_updated":"2026-07-03T06:27:17Z","snapshot_observed_at":"2026-08-17T16:41:41.611109Z","submitted_at":"2025-11-25T12:58:32Z","title":"VKnowU: Evaluating Visual Knowledge Understanding in Multimodal LLMs","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:04.626496Z"},"links":{"cited_paper":"/paper/2410.10855","citing_paper":"/paper/2511.20272"},"observation_digest":"sha256:8e0dea38f55ad6c8bc0f84f55cfdd4c3214afe4f291f65c1f03a5c08477b18a2","observation_id":"f1a887c0-7353-4b9f-bf56-c24768bc63e2","resolution":{"observed_at":"2026-08-03T20:23:04.626496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10855","snapshot_observed_at":"2026-07-15T13:27:51.848177Z","title":"D., Vasconcelos, N., Golan, T., Luo, D., and Deng, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.07109","last_updated":"2026-05-30T07:36:55Z","snapshot_observed_at":"2026-08-15T13:10:05.470489Z","submitted_at":"2026-03-07T08:40:09Z","title":"Vision Language Models Cannot Reason About Physical Transformation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-15T13:27:51.848177Z"},"links":{"cited_paper":"/paper/2410.10855","citing_paper":"/paper/2603.07109"},"observation_digest":"sha256:bd6a84369f623611672996dec2f065a05701d60dd612d78358afc2a6c4ac89b1","observation_id":"8f00664d-32b3-4c13-9958-ebdb976222c4","resolution":{"observed_at":"2026-07-15T13:27:51.848177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10855","snapshot_observed_at":"2026-07-13T20:17:45.587021Z","title":"arXiv preprint arXiv:2410.10855 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22281","last_updated":"2026-06-16T09:39:03Z","snapshot_observed_at":"2026-08-17T13:44:46.581730Z","submitted_at":"2026-03-23T17:59:42Z","title":"ThinkJEPA: Empowering Latent World Models with Large Vision-Language Reasoning Model","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T20:17:45.587021Z"},"links":{"cited_paper":"/paper/2410.10855","citing_paper":"/paper/2603.22281"},"observation_digest":"sha256:222fcd0011fad9b5a657d7f93d06224430b3b732a92bf3759e794d1a0c751fe1","observation_id":"4944095c-99d7-4a64-9ef2-ebe1ab17662d","resolution":{"observed_at":"2026-07-13T20:17:45.587021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models","version":4},"cited_work":{"arxiv_id":"2410.10855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10855","snapshot_observed_at":"2026-07-02T17:37:14.719889Z","title":"Core knowledge deficits in multi-modal language models","venue":null,"work_id":"1b1d3166-eab5-4fb2-b288-18730b4e780d","year":2025},"citing_paper":{"arxiv_id":"2605.31148","last_updated":"2026-05-29T10:59:26Z","snapshot_observed_at":"2026-08-16T07:59:46.821328Z","submitted_at":"2026-05-29T10:59:26Z","title":"SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T22:47:46.542267Z"},"links":{"cited_paper":"/paper/2410.10855","citing_paper":"/paper/2605.31148"},"observation_digest":"sha256:75a79334acbb1bc6cc98cb0defb2838e0ac0771da4c278dacf398b30ecb45799","observation_id":"34651ba5-d003-4d40-9e8f-04ed8d779eda","resolution":{"observed_at":"2026-07-01T19:16:01.160739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models","version":4},"cited_work":{"arxiv_id":"2410.10855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10855","snapshot_observed_at":"2026-07-02T17:37:14.719889Z","title":"Core knowledge deficits in multi-modal language models","venue":null,"work_id":"1b1d3166-eab5-4fb2-b288-18730b4e780d","year":2025},"citing_paper":{"arxiv_id":"2606.05497","last_updated":"2026-06-03T22:41:11Z","snapshot_observed_at":"2026-08-18T03:33:25.604662Z","submitted_at":"2026-06-03T22:41:11Z","title":"LEVANTE-bench: Multi-Scale Comparison of VLMs to Children Using Cognitive Tasks (or, \"Is Your VLM Smarter Than a 5th Grader?\")","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T06:39:08.246174Z"},"links":{"cited_paper":"/paper/2410.10855","citing_paper":"/paper/2606.05497"},"observation_digest":"sha256:21bc5f4c9e248ed4cd4660906e2c59d6635658213ef0d4f85e7d12f084eb02d9","observation_id":"f48accac-bfc5-41b2-81e5-9b0d75307419","resolution":{"observed_at":"2026-07-02T07:46:46.462794Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models","version":4},"cited_work":{"arxiv_id":"2410.10855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10855","snapshot_observed_at":"2026-07-02T17:37:14.719889Z","title":"Core knowledge deficits in multi-modal language models","venue":null,"work_id":"1b1d3166-eab5-4fb2-b288-18730b4e780d","year":2025},"citing_paper":{"arxiv_id":"2606.07872","last_updated":"2026-06-05T22:06:07Z","snapshot_observed_at":"2026-08-17T14:28:27.436111Z","submitted_at":"2026-06-05T22:06:07Z","title":"VisualFLIP: Do Predictions Depend on Task-Critical Visual Evidence in Multimodal Reasoning?","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-27T21:56:25.350827Z"},"links":{"cited_paper":"/paper/2410.10855","citing_paper":"/paper/2606.07872"},"observation_digest":"sha256:dca7e4c69989a64c626293a05e5119a92b9ebb6a3e6f5af0cbc1c51154b957e5","observation_id":"a884c1e3-21cf-4939-99e6-08f84be51f59","resolution":{"observed_at":"2026-07-02T17:37:14.721403Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.10855/citation-record","integrity":"/paper/2410.10855/integrity","json":"/paper/2410.10855/citation-record.json","paper":"/paper/2410.10855"},"outbound":[],"paper":{"arxiv_id":"2410.10855","last_updated":"2025-06-19T03:48:50Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-21T16:58:10.145625Z","submitted_at":"2024-10-06T20:13:11Z","title":"Core Knowledge Deficits in Multi-Modal Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2410.10855."}