{"as_of":"2026-08-09T23:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f86f9a3c42c5f9caaad358b9275dafc87aa100f4b12ad389862f66e78e03949a","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:06:04.220507Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:31:19.801487Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:58:42.493790Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-08-07T14:31:19.801487Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18536","last_updated":"2025-05-24T06:01:48Z","snapshot_observed_at":"2026-08-07T22:01:21.366221Z","submitted_at":"2025-05-24T06:01:48Z","title":"Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models","version":1},"reference_index":128,"source":"pdf_text","source_observed_at":"2026-08-07T14:31:19.801487Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2505.18536"},"observation_digest":"sha256:2e226b7f2cb63b385ef2de37779bf630ee850fe1e590b0e38ff42fc682b731c3","observation_id":"c71a46a2-925a-48c9-80c1-159d570db7ad","resolution":{"observed_at":"2026-08-07T14:31:19.801487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-08-07T13:35:55.549583Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21327","last_updated":"2025-05-27T15:23:23Z","snapshot_observed_at":"2026-08-08T22:42:35.699276Z","submitted_at":"2025-05-27T15:23:23Z","title":"MME-Reasoning: A Comprehensive Benchmark for Logical Reasoning in MLLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:35:55.549583Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2505.21327"},"observation_digest":"sha256:45831e3cb0229e828a0166a05cf2213c75a1c8d62f908bcc0fdbeb7c5fee628c","observation_id":"60d8943b-51d0-4c67-8ab1-fbec4f246770","resolution":{"observed_at":"2026-08-07T13:35:55.549583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-08-07T12:33:06.268894Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models.arXiv preprint arXiv:2502.00698, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24238","last_updated":"2025-06-02T04:16:04Z","snapshot_observed_at":"2026-08-08T00:06:33.951776Z","submitted_at":"2025-05-30T05:54:36Z","title":"MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:06.268894Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2505.24238"},"observation_digest":"sha256:408201f012544077eb6d3fbf49e5ae05bb930f5cc07e18f15c5cf23d0fa67392","observation_id":"0ac1d8d1-47ac-46b8-a4fa-ba1fb0af3714","resolution":{"observed_at":"2026-08-07T12:33:06.268894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-08-07T05:41:54.389863Z","title":"Huanqia Cai, Yijun Yang, and Winston Hu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07390","last_updated":"2025-06-09T03:25:23Z","snapshot_observed_at":"2026-08-07T05:32:41.495632Z","submitted_at":"2025-06-09T03:25:23Z","title":"Boosting Vulnerability Detection of LLMs via Curriculum Preference Optimization with Synthetic Reasoning Data","version":1},"reference_index":4455,"source":"pdf_text","source_observed_at":"2026-08-07T05:41:54.389863Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2506.07390"},"observation_digest":"sha256:c6bfd6c86565e4ee54ff2941dfb5eed03a74a3d8b458312da95330cf069f17d7","observation_id":"9c436822-d943-4e1f-a1c2-924f170c08be","resolution":{"observed_at":"2026-08-07T05:41:54.389863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-08-06T11:35:10.875843Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22607","last_updated":"2025-07-31T09:09:45Z","snapshot_observed_at":"2026-08-09T20:47:50.407542Z","submitted_at":"2025-07-30T12:23:21Z","title":"VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T11:35:10.875843Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2507.22607"},"observation_digest":"sha256:c8e6732f930c9447e0f4e7b0b3eb4943643fbf5a8a86c966b2e7bdaa8bf1c477","observation_id":"21186ae1-501d-4c0f-aca8-09281ecef484","resolution":{"observed_at":"2026-08-06T11:35:10.875843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-08-03T22:36:09.932091Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.10055","last_updated":"2026-06-02T09:56:13Z","snapshot_observed_at":"2026-08-05T14:12:50.521583Z","submitted_at":"2025-11-13T07:57:10Z","title":"Physical Plausibility Reasoning via HCM-GRPO: Empowering Compact Model for Superior Performance","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T22:36:09.932091Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2511.10055"},"observation_digest":"sha256:b5d1b5aa11290c9010ee286f6bf57e5e338c4203f247bf33165e44f57ccb9d03","observation_id":"82d4b4d0-877f-47f0-855d-f7272efa9c0f","resolution":{"observed_at":"2026-08-03T22:36:09.932091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":"2502.00698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-07-03T16:58:42.493790Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models","venue":null,"work_id":"9ac38395-5074-42fb-a675-5461d2fa67af","year":2025},"citing_paper":{"arxiv_id":"2605.02378","last_updated":"2026-05-04T09:18:19Z","snapshot_observed_at":"2026-07-06T23:15:27.816549Z","submitted_at":"2026-05-04T09:18:19Z","title":"Enhancing Multimodal In-Context Learning via Inductive-Deductive Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T19:21:30.235583Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2605.02378"},"observation_digest":"sha256:80065303f4e7309c0cc791195519f3d1a4a5487b69241bfb03772394572b5191","observation_id":"29de4c11-ee20-4c29-b729-08c2b809fffa","resolution":{"observed_at":"2026-05-09T05:55:31.190380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":"2502.00698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-07-03T16:58:42.493790Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models","venue":null,"work_id":"9ac38395-5074-42fb-a675-5461d2fa67af","year":2025},"citing_paper":{"arxiv_id":"2606.00148","last_updated":"2026-05-29T03:20:05Z","snapshot_observed_at":"2026-07-06T23:40:51.363776Z","submitted_at":"2026-05-29T03:20:05Z","title":"StemBind: When MLLMs Get Lost Between Rules and Instances in Abstract Visual Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T23:15:56.598968Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2606.00148"},"observation_digest":"sha256:536a05e4ce7a194c57b886ed766dde2f6a716859bb4d9087f9702598938536e8","observation_id":"226454fd-a7e1-45c9-9446-a7d9a9157029","resolution":{"observed_at":"2026-06-29T00:12:50.337644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":"2502.00698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-07-03T16:58:42.493790Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models","venue":null,"work_id":"9ac38395-5074-42fb-a675-5461d2fa67af","year":2025},"citing_paper":{"arxiv_id":"2606.11470","last_updated":"2026-06-09T21:59:37Z","snapshot_observed_at":"2026-07-06T23:50:35.052764Z","submitted_at":"2026-06-09T21:59:37Z","title":"The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T12:59:51.091008Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2606.11470"},"observation_digest":"sha256:18fbcff68a7b2d5ce82e2a90041d450cc32c028a81f25a85ce5ad794c9e42188","observation_id":"59705aeb-c08c-4a07-b580-a35532272c24","resolution":{"observed_at":"2026-07-03T05:57:41.642430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":"2502.00698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-07-03T16:58:42.493790Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models","venue":null,"work_id":"9ac38395-5074-42fb-a675-5461d2fa67af","year":2025},"citing_paper":{"arxiv_id":"2607.01707","last_updated":"2026-07-02T04:59:56Z","snapshot_observed_at":"2026-08-02T06:22:23.690891Z","submitted_at":"2026-07-02T04:59:56Z","title":"LASER: A Corrective Lens for LVLMs via Visual Attention Preservation and Sink Suppression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T16:53:43.427625Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2607.01707"},"observation_digest":"sha256:4ef4620c7ad291308db42e1bcda8b93c46d0028d194c89b1c2b01f5e0eef88ec","observation_id":"0f024524-d78f-4914-bc05-efeb83432add","resolution":{"observed_at":"2026-07-03T16:58:42.495183Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00698","snapshot_observed_at":"2026-08-02T06:13:50.663556Z","title":"Mm-iq: Benchmarking human-like abstraction and reasoning in multimodal models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13125","last_updated":"2026-07-18T17:28:17Z","snapshot_observed_at":"2026-08-03T17:18:33.842709Z","submitted_at":"2026-07-14T17:52:05Z","title":"Boogu-Image-0.1: Boosting Open Agentic Multimodal Generation via Understanding under a Minimal Budget","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T06:13:50.663556Z"},"links":{"cited_paper":"/paper/2502.00698","citing_paper":"/paper/2607.13125"},"observation_digest":"sha256:a684b3fcdd8dc8cb0d34c36e3a99ddec26e97ea6799b812b74ccbb9c66cb7cc7","observation_id":"cefddff5-b290-4d9e-8837-d75c549dc05b","resolution":{"observed_at":"2026-08-02T06:13:50.663556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00698/citation-record","integrity":"/paper/2502.00698/integrity","json":"/paper/2502.00698/citation-record.json","paper":"/paper/2502.00698"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T18:06:03.886634Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.886634Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:7252cf8febf22d1418209ad2c7f04b3b7b841149f39eb22c6e94fddb4ff4235a","observation_id":"fc6d63ee-f459-4e6f-972f-e1365e6caf8c","resolution":{"observed_at":"2026-08-09T18:06:03.886634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.283173Z","title":"The Claude 3 Model Family: Opus, Sonnet, Haiku","venue":null,"work_id":"b954ebac-e5c2-4dfb-a7b4-ec5d9ecf032f","year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.892117Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:4f407eb165e6cdbf86d5e986f1d3fb71152186c38025f81778ef89528fb5f7a3","observation_id":"bda3e211-9671-43e7-b55b-1a42373c7a73","resolution":{"observed_at":"2026-08-09T18:06:05.288313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-09T18:06:03.897113Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.897113Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:8ec8eb6f8c9dac6175c1c677e452bc969faddacdcc05c31f5fe626470de4b8dd","observation_id":"dffe1d6e-a602-4e4d-887c-f1540693059a","resolution":{"observed_at":"2026-08-09T18:06:03.897113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-02T13:11:16.882565Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-09T18:06:03.902859Z","title":"Deepseek llm: Scaling open-source language models with longtermism.arXiv preprint arXiv:2401.02954, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.902859Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:d6c1d37da3bd3fff62ce7a623b0e77cb595f4ce0a57ed78071874110bf0f9a74","observation_id":"6838ee51-a742-48c7-a6c8-f2936e1f5ba0","resolution":{"observed_at":"2026-08-09T18:06:03.902859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11468","last_updated":"2025-04-10T16:54:05Z","snapshot_observed_at":"2026-08-05T02:57:13.928237Z","submitted_at":"2025-04-10T16:54:05Z","title":"SFT or RL? An Early Investigation into Training R1-Like Reasoning Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11468","snapshot_observed_at":"2026-08-09T18:06:03.908096Z","title":"Sft or rl? an early investigation into training r1-like reasoning large vision-language models.arXiv preprint arXiv:2504.11468, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.908096Z"},"links":{"cited_paper":"/paper/2504.11468","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:a951a2e22b4c0623676e48c5d54356416a3888f8c55a5ed51367f7f9d5673b5c","observation_id":"8a11ddc1-4f72-4e5d-b363-110f19e12ab5","resolution":{"observed_at":"2026-08-09T18:06:03.908096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-07-06T08:34:41.399203Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-08-09T18:06:03.913307Z","title":"On the measure of intelligence.arXiv preprint arXiv:1911.01547, 2019","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.913307Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:f77aee0c5d7d379b547a75f57116babe07a16514d0df502cb68d993445ef0226","observation_id":"358cd1c6-2971-48ec-b42d-c0c5e8ef1240","resolution":{"observed_at":"2026-08-09T18:06:03.913307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.266693Z","title":"Comparing machines and humans on a visual categorization test.Proceedings of the National Academy of Sciences, 108(43):17621–17625, 2011","venue":null,"work_id":"895e4bdd-1722-4aa3-aacd-4aa66a3ab582","year":2011},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.919052Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:f96aded96f01933e56ac07f283b8f2afd2ebd14d34c72ddd39cfb123568b22c7","observation_id":"214146f6-a64a-48f4-b495-23b53bc898ea","resolution":{"observed_at":"2026-08-09T18:06:05.272176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-09T18:06:03.923444Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.923444Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:eaebf1191bc2dec8715181351821073c0850515036e1f77bc58bcec3a7d35b58","observation_id":"2b16b301-c08c-48e7-8233-95fb54efcc23","resolution":{"observed_at":"2026-08-09T18:06:03.923444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.00120","last_updated":"2019-01-31T23:10:31Z","snapshot_observed_at":"2026-08-07T01:26:17.716952Z","submitted_at":"2019-01-31T23:10:31Z","title":"Learning to Make Analogies by Contrasting Abstract Relational Structure","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.00120","snapshot_observed_at":"2026-08-09T18:06:03.928372Z","title":"Learning to make analogies by contrasting abstract relational structure.arXiv preprint arXiv:1902.00120, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.928372Z"},"links":{"cited_paper":"/paper/1902.00120","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:88a026ce4ade93eb7bde988456434b8555783571bce8969552f943acd42f035c","observation_id":"74444b0b-af22-4982-a8af-78c2b047bdf3","resolution":{"observed_at":"2026-08-09T18:06:03.928372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-09T18:06:03.933538Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.933538Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:59fbc6d080e7b9c349fab185bd6d37e1e10ceb09728315dc2187f9c2c035b693","observation_id":"6fddcb76-3ab2-4f5c-9b99-fe8aa811847c","resolution":{"observed_at":"2026-08-09T18:06:03.933538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-09T18:06:03.938657Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.938657Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:ce3b92093cb10b1703ac5dc10b06fa8d740782c8824ee690704594861cb7e25a","observation_id":"4deb3423-5cbe-4ebb-8166-64d2c7db421c","resolution":{"observed_at":"2026-08-09T18:06:03.938657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13591","last_updated":"2024-04-24T22:32:10Z","snapshot_observed_at":"2026-07-06T18:03:15.097118Z","submitted_at":"2024-04-21T09:15:02Z","title":"MARVEL: Multidimensional Abstraction and Reasoning through Visual Evaluation and Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13591","snapshot_observed_at":"2026-08-09T18:06:03.943931Z","title":"Marvel: Multidimensional abstraction and reasoning through visual evaluation and learning.arXiv preprint arXiv:2404.13591, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.943931Z"},"links":{"cited_paper":"/paper/2404.13591","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:6dd023eff0bf038d328d4b43d8afa84241ae60c8811fbf48a4287b1fde84f0f6","observation_id":"3ef6e551-24ea-4a67-8fcf-528de41938d9","resolution":{"observed_at":"2026-08-09T18:06:03.943931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:03.949106Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge, January 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.949106Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:4fad44fdec0a41a55cb3813aa1e9f201fd399483d3106392c77e76df9bf5f12c","observation_id":"38664aa0-e1c5-4112-b5ee-8646e409633a","resolution":{"observed_at":"2026-08-09T18:06:03.949106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08124","last_updated":"2020-07-16T05:52:16Z","snapshot_observed_at":"2026-08-09T06:25:20.879304Z","submitted_at":"2020-07-16T05:52:16Z","title":"LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08124","snapshot_observed_at":"2026-08-09T18:06:03.953539Z","title":"Logiqa: A challenge dataset for machine reading comprehension with logical reasoning.arXiv preprint arXiv:2007.08124, 2020","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.953539Z"},"links":{"cited_paper":"/paper/2007.08124","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:dead3318c73d91f18ea074ca88add382940d15763d62a0154e9fe3deb816dbc4","observation_id":"86c2aa38-5944-4b0d-8e6b-4603f4b50d5d","resolution":{"observed_at":"2026-08-09T18:06:03.953539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:03.958420Z","title":"Mmbench: Is your multi-modal model an all-around player? InEuropean conference on computer vision, pages 216–233","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.958420Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:43bb8afba64ee6def7bf1d06132642a36f3dbd19f3ba535a92baff1ddb5d41b2","observation_id":"67b9f4cd-4f4b-4bd7-a732-443654d26866","resolution":{"observed_at":"2026-08-09T18:06:03.958420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07895","last_updated":"2024-08-26T02:37:14Z","snapshot_observed_at":"2026-07-06T15:26:46.489500Z","submitted_at":"2023-05-13T11:28:37Z","title":"OCRBench: On the Hidden Mystery of OCR in Large Multimodal Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07895","snapshot_observed_at":"2026-08-09T18:06:03.962984Z","title":"On the hidden mystery of ocr in large multimodal models.arXiv preprint arXiv:2305.07895, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.962984Z"},"links":{"cited_paper":"/paper/2305.07895","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:1c590bf13c3fae69ed3ac33dd6cc2e8519b8df8c02b69526a68133d5fe2d98f8","observation_id":"a15d39fc-d06e-4b6d-9242-c26b4e0c844b","resolution":{"observed_at":"2026-08-09T18:06:03.962984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-09T18:06:03.967371Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts.arXiv preprint arXiv:2310.02255, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.967371Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:79931700b65a1e7c238569ae4cf30bf968a5480a1898d4d3be7c0781018de552","observation_id":"cab5201e-5ff8-449e-860c-17500c72fe40","resolution":{"observed_at":"2026-08-09T18:06:03.967371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12382","last_updated":"2022-04-19T18:41:45Z","snapshot_observed_at":"2026-08-04T11:18:14.993483Z","submitted_at":"2022-01-28T19:24:30Z","title":"Deep Learning Methods for Abstract Visual Reasoning: A Survey on Raven's Progressive Matrices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12382","snapshot_observed_at":"2026-08-09T18:06:03.972475Z","title":"Deep learning methods for abstract visual reasoning: A survey on raven’s progressive matrices.arXiv preprint arXiv:2201.12382, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.972475Z"},"links":{"cited_paper":"/paper/2201.12382","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:180a431923e791065b3856f8989f5e8b39d3206704775b7f48a30792aa57d47d","observation_id":"3943d110-a7db-467c-a159-9b4d43e73e40","resolution":{"observed_at":"2026-08-09T18:06:03.972475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.231580Z","title":"A review of emerging research directions in abstract visual reasoning.Information Fusion, 91:713–736, 2023","venue":null,"work_id":"3f73484f-8505-4c12-891a-9b97647f6d8d","year":2023},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.977070Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:5bdd836d49160467d34317867579b0c68b24a003805a51592b8544bd1edcf1ce","observation_id":"4d10e9e2-5d7d-4ff6-aeef-81b57408ccdc","resolution":{"observed_at":"2026-08-09T18:06:05.236885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.216379Z","title":"Deepiq: A human-inspired ai system for solving iq test problems","venue":null,"work_id":"0a02fa2b-a096-47b9-affc-a6ab590e7493","year":2019},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.981759Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:193d7954c516e18fe4c2c2df3b3783ddac7b371420a7c5be00b8e29169afe96c","observation_id":"0c2f7318-fc21-4c79-84d7-ae9db69c6ec6","resolution":{"observed_at":"2026-08-09T18:06:05.221324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.201268Z","title":"Bongard- logo: A new benchmark for human-level concept learning and reasoning.Advances in Neural Information Processing Systems, 33:16468–16480, 2020","venue":null,"work_id":"1eab4da2-1b5a-4cc5-95fe-779b2774f0de","year":2020},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.986259Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:61ec7c361aba29f7299a54ce93880a5940a0803667a54a240c0818761e047f9f","observation_id":"e4b5421e-9679-48ab-a2f8-be58931aba29","resolution":{"observed_at":"2026-08-09T18:06:05.206273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:03.990607Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.990607Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:c43d8e93302d1fd4c751502c065ab2a8729f476d0ca2adaf368af4301264f554","observation_id":"396a489b-d404-4af2-9e39-0144ed3e722a","resolution":{"observed_at":"2026-08-09T18:06:03.990607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.175792Z","title":"Raven progressive matrices","venue":null,"work_id":"d07516e1-39be-429d-a7aa-ebdb06049822","year":2003},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.995165Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:d63a40ad58b40033e729cf592ea179b3729eaab6421df3f0608b5ed862770d02","observation_id":"26433668-27e8-49cd-a00f-8233b7ac134c","resolution":{"observed_at":"2026-08-09T18:06:05.180552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-09T18:06:03.999938Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:03.999938Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:a680716edc89468b84680fac359bd229b95fbac0278e9d83899a042a3f7e9b8e","observation_id":"ed51ad7c-6072-42c0-9b06-fd3432a68182","resolution":{"observed_at":"2026-08-09T18:06:03.999938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.160461Z","title":"The topography of ability and learning correlations.Advances in the psychology of human intelligence/Erlbaum, 1984","venue":null,"work_id":"959ae41c-8e48-43c8-a298-9efa55854e7d","year":1984},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.004904Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:66a75b569ecf2870ac617b30d749018ad3373003a8b77bb246fd55ca60f18433","observation_id":"24999903-3709-44ec-ba3d-0da7622c8660","resolution":{"observed_at":"2026-08-09T18:06:05.165436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.144613Z","title":"Link-context learning for multimodal llms","venue":null,"work_id":"424f5c1b-80eb-4074-a08e-277f77e59bb3","year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.009645Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:7084a6dc53964afb489cee8925919ccbc57bb8128b6795730e22d0e29a84dce3","observation_id":"71676622-1760-43da-a4df-7d0f17b61eaf","resolution":{"observed_at":"2026-08-09T18:06:05.149595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-09T18:06:04.014290Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.014290Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:f159f8ee8280960dfc441db36e3a2a31ef7ef6c988f12eb427d1e3b60981d04d","observation_id":"260dae39-3c78-4443-b21c-d056ea0a4d2c","resolution":{"observed_at":"2026-08-09T18:06:04.014290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-09T18:06:04.019501Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.019501Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:f5eaf775a70e855d7e31195a906367bf6456cbbfdc674650b51d6cf08f5e3cb7","observation_id":"d585e0d6-6e48-4864-ac66-920e0e235b9d","resolution":{"observed_at":"2026-08-09T18:06:04.019501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.024353Z","title":"Qvq: To see the world with wisdom, December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.024353Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:c107615e2d4528225cddd0d8a6432e83939cf84ea344722d4f3d1e8635ac8581","observation_id":"cca9cd4b-9da9-4032-94bf-49c63db57838","resolution":{"observed_at":"2026-08-09T18:06:04.024353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.119896Z","title":"How much intelligence is there in artificial intelligence? a 2020 update.Intelligence, 87:101548, 2021","venue":null,"work_id":"bdcd2395-74a1-49b8-b129-e4519fd8ab9c","year":2020},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.028818Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:036cf3171064577720f26e92f23cc4a8d583a8d55c2c170f9fcdee50bb994ef2","observation_id":"2bf3c440-69e0-4c2f-964f-01ec255c6499","resolution":{"observed_at":"2026-08-09T18:06:05.124995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-09T18:06:04.033388Z","title":"Qwen2-vl: Enhancing vision- language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.033388Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:d3c2a8612cf97bd9350378ca4cc285fbfc7eb8389431ef87a59ca17957363e7d","observation_id":"cffd74f7-de87-4028-9f86-499fb68d939a","resolution":{"observed_at":"2026-08-09T18:06:04.033388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.104912Z","title":"Learning representations that support extrapolation","venue":null,"work_id":"e5ee99a1-8fec-4a70-b6a7-3cd029f2d67a","year":2020},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.038369Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:c1f6cc2bfd19d5e4ca44404af76b386218ad09b3a4346f49591a83e7e86b44d3","observation_id":"ab7c8d52-68ca-4410-817b-e2a9772b1dd9","resolution":{"observed_at":"2026-08-09T18:06:05.109716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-09T18:06:04.042938Z","title":"A survey on multimodal large language models.arXiv preprint arXiv:2306.13549, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.042938Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:7f7698674deaad1b2d39475139097d7b28c5a3e176eddd58c79441cc01cd57d7","observation_id":"a64fa8b0-7a57-4dd3-9583-863d39926c8f","resolution":{"observed_at":"2026-08-09T18:06:04.042938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.047529Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.047529Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:e5dc6d154fe14a3b510090a8c5a057b610c452c390c27c51d76f9e5e03ad76d9","observation_id":"031b8d0c-73c5-46ea-8651-a9691123dc72","resolution":{"observed_at":"2026-08-09T18:06:04.047529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.079587Z","title":"Raven: A dataset for relational and analogical visual reasoning","venue":null,"work_id":"9b28bd83-a8da-4987-800a-e38b923c59c7","year":2019},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.052333Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:fd4b8d7e65bdb109e938d81caf71a13d40aa8e54825302a5078d131a366941ed","observation_id":"195ca3f1-d2c1-48cd-bb28-255d2332bfaa","resolution":{"observed_at":"2026-08-09T18:06:05.084588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11944","last_updated":"2024-11-04T13:28:48Z","snapshot_observed_at":"2026-07-06T17:18:44.456380Z","submitted_at":"2024-01-22T13:34:34Z","title":"CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11944","snapshot_observed_at":"2026-08-09T18:06:04.057379Z","title":"Cmmmu: A chinese massive multi-discipline multimodal understanding benchmark.arXiv preprint arXiv:2401.11944, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.057379Z"},"links":{"cited_paper":"/paper/2401.11944","citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:09248a51d262f7d496778613be757e0d4b2d48d64b9d378f64498b48abb5afbf","observation_id":"95d1fb53-049e-4b5d-b539-15b734a0a2cb","resolution":{"observed_at":"2026-08-09T18:06:04.057379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.064718Z","title":"Machine number sense: A dataset of visual arithmetic problems for abstract and relational reasoning","venue":null,"work_id":"f03e099f-6189-41cc-8ddb-fcf73ceb53ae","year":2020},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.062557Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:74aa265a71c0174025f21e7d91d89b2308ae698bdec05473fdb45b047aed29e8","observation_id":"bba131e5-a45e-4281-ab74-fb86208af389","resolution":{"observed_at":"2026-08-09T18:06:05.069608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.050039Z","title":"Easyr1: An efficient, scalable, multi-modality rl training framework","venue":null,"work_id":"40063eb2-27e1-4d9b-9a92-c08b4a5c047b","year":2025},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.067238Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:131a3cd2fc0aecb8fe5d82c1ca146e0b58b20780082301121bf33cc8ccec76e1","observation_id":"72cc5841-c2ff-466b-837f-a15c5bf151ca","resolution":{"observed_at":"2026-08-09T18:06:05.055031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.035178Z","title":null,"venue":null,"work_id":"42147364-4490-40ce-8d38-afedc011dc9e","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.072463Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:1c74f520cc3107f0a8623d87819d154e4b0e5cf97275877aeb9aee23f783dcb9","observation_id":"1f91ed44-2fe0-4c90-bd2b-ff72933dc929","resolution":{"observed_at":"2026-08-09T18:06:05.039700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.020348Z","title":null,"venue":null,"work_id":"c8d03065-9c12-4a38-9e5e-58fc539669b3","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.077441Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:2505e5aacaa7a2cb356ce8b9d40300bd05973ceb92fffa085111e88351f6a077","observation_id":"04c2621d-b498-47e5-9c89-fa3948b14f11","resolution":{"observed_at":"2026-08-09T18:06:05.025006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:05.005490Z","title":null,"venue":null,"work_id":"c42c2ea5-0d91-4e17-b5fa-2689ea39ffa0","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.082238Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:6586c11bb176abf4840f2830f6b445df0f069fb3ccc2a98fa6ab7a07d98c2f74","observation_id":"e28739c9-a3c2-444f-be06-e618f855b23d","resolution":{"observed_at":"2026-08-09T18:06:05.010495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.991168Z","title":null,"venue":null,"work_id":"9a721363-97b8-46a8-a2c3-05ffe152b33e","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.086995Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:c27d9dd9209ba1af9d9477abc54b624fd694f2ed7c162732f3f855fb43c19199","observation_id":"49e4fd93-5e76-4ecc-945e-20c4963d3aad","resolution":{"observed_at":"2026-08-09T18:06:04.995615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.976356Z","title":null,"venue":null,"work_id":"3da3dee5-bad9-40f5-8850-0308c9d1d967","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.091982Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:dc15990e796189462ce4f60efa7caf00ae801c751b6ffe685ed2e5b05589062a","observation_id":"ed686d0c-c8e7-47a2-98d4-476723a63c69","resolution":{"observed_at":"2026-08-09T18:06:04.980965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.961837Z","title":null,"venue":null,"work_id":"0c336c3f-a7aa-4e7f-ada5-2c7ef60e074c","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.097359Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:e1cfa1d988d799fab595674356dc292fa4bb226035eb223c89f49294ae6b0e17","observation_id":"d0a2b464-e376-431d-9961-f87c70482cfe","resolution":{"observed_at":"2026-08-09T18:06:04.966469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.947228Z","title":"The pattern seems to be categorization based on function or use","venue":null,"work_id":"4ae476cd-97dc-4952-971b-0cc7b8ecc801","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.101879Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:af39e875f77a5669caa3aba5aab9eb210425757f07b21c6d065569cccd02a534","observation_id":"8fcd1032-48d2-47db-9292-c51fde1ca50f","resolution":{"observed_at":"2026-08-09T18:06:04.951879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.932956Z","title":null,"venue":null,"work_id":"b76f4999-8aeb-41d4-814d-b861e2bf1638","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.106626Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:a86f587b32c7613e63fac31939071147a02e4a39749a0d2577a4cfe797eaa7c8","observation_id":"70c0bb7d-9284-4dae-9818-7f111de08f72","resolution":{"observed_at":"2026-08-09T18:06:04.937339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.918612Z","title":null,"venue":null,"work_id":"30646ff0-d4a2-4550-93cc-5b8255311b4a","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.111388Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:5aadcb02f134302ce13fa3396830c591815af32318c9ebad53e93626526e015c","observation_id":"aa4eed75-4a5f-4939-abed-b1f0d64cbb45","resolution":{"observed_at":"2026-08-09T18:06:04.923086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.904411Z","title":null,"venue":null,"work_id":"8b5415ea-c0d2-4e29-8cca-cca444044309","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.115909Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:783fb36403bd2e36d47c35fced8687985495b03a44725960a2890df9fa32dae9","observation_id":"88c8f5b5-4ea9-4428-ba56-82e3597810e8","resolution":{"observed_at":"2026-08-09T18:06:04.909056Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.889119Z","title":"The pattern seems to be increasing the number of points by one each time, while also increasing the complexity of the connections between these points","venue":null,"work_id":"c21204c5-0433-4851-a319-2e1e1aac6eb5","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.120681Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:91eaefb51608a6b384d8538617d2bc45e91ca74cbaeab80e6bd5289009617b70","observation_id":"80d2efe4-6d31-4b6d-b4f3-7cee78bec5ac","resolution":{"observed_at":"2026-08-09T18:06:04.894331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.874268Z","title":"They seem to rotate or shift","venue":null,"work_id":"2d5b7280-e378-43d9-a734-eec37a425b1e","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.125528Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:3b9f02f9bec64cc9c6cbd0cebc974254a35661563970507c07ab7ec73c71cf8c","observation_id":"bcb80351-fbc7-4646-be45-2b46b734593a","resolution":{"observed_at":"2026-08-09T18:06:04.878976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.859210Z","title":"There’s a sort of flipping or swapping happening","venue":null,"work_id":"6cc2400b-5e32-4ab9-bc50-94ac2e1e330a","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.130293Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:824fac03a36c894853d0b5095d04c7b41e9630d79ac96a7a2160fe093b155a6b","observation_id":"148f5b3b-092a-47c1-beee-41d9e66c12eb","resolution":{"observed_at":"2026-08-09T18:06:04.863995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.842953Z","title":"If you follow the observed changes in connections and circle colors, option C best fits the next step in the sequence","venue":null,"work_id":"aef55d68-cf82-4a2e-a086-eb267fc1e679","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.135674Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:b700296e6661896ad60a5682d0e22bd77b0c2cad7cf229d87a754b20a1537c73","observation_id":"7adc02e0-94b6-4ce5-b3c8-a572a16bd324","resolution":{"observed_at":"2026-08-09T18:06:04.848200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.828302Z","title":null,"venue":null,"work_id":"d9641c78-3d57-4f63-b646-62e3b88221b3","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.140755Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:c1f407ed86b942d9718e38d03d6701684c8a4a036c1a5dbadf9b416e165b1c0e","observation_id":"b7c2639c-8f6c-4ef7-b581-3257db5fa642","resolution":{"observed_at":"2026-08-09T18:06:04.832798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.813608Z","title":"The missing square needs a mixed pair of circles and a triple line base to satisfy both rules within its row and column","venue":null,"work_id":"331a51ee-e402-4195-971d-f9fa3178b3d2","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.145419Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:c42fc5d17cdf1124319322480eccb553b9543c706fc613fa70067634acd430db","observation_id":"b9a7217d-1e9b-4699-99d5-f24a4f3b883f","resolution":{"observed_at":"2026-08-09T18:06:04.818614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.799484Z","title":null,"venue":null,"work_id":"57085c85-acb6-4b74-b421-d0742f894720","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.150544Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:c432975be24361c09beaf3edb9884386cb726a072d50ee0d02f7c42abd8be153","observation_id":"1c4fc662-ed96-45d9-a27b-a83197439836","resolution":{"observed_at":"2026-08-09T18:06:04.803921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.785307Z","title":null,"venue":null,"work_id":"87d91fd9-3a4a-4fa4-824b-c041bfe8ae1c","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.155361Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:933bd97e4adbdac61e57f6ad34a5c893ad9a9b9fbfa350dedfdd38cddb0be5fb","observation_id":"f8353fd6-2f21-48c2-888f-597013efa831","resolution":{"observed_at":"2026-08-09T18:06:04.789868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.771250Z","title":null,"venue":null,"work_id":"7785e66c-3c18-42c3-bf8e-a12c7b585c2c","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.159972Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:628190788220ee084afa0446f4d9722569192ca183bdb1c89af59d75452a47f5","observation_id":"18fc108f-fb67-46b0-914b-e857c42a21ea","resolution":{"observed_at":"2026-08-09T18:06:04.775890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.756628Z","title":null,"venue":null,"work_id":"685fe97d-ac59-4f8f-943f-268b2f517041","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.164532Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:91c6d5f1f7ecab14fee69435090a7899056808e996020519417240955597ceb1","observation_id":"5a2b98ac-677f-48cd-977e-c16421488f68","resolution":{"observed_at":"2026-08-09T18:06:04.761354Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.741792Z","title":null,"venue":null,"work_id":"65cc68ee-3534-42d6-8fcb-ee08042bc995","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.169285Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:9be4959979049d6bd590486b615118cd4a3b2362157813dd78c1fc1bbe38c062","observation_id":"f059f19c-71cd-4347-82ec-c90b5d8b042e","resolution":{"observed_at":"2026-08-09T18:06:04.746513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.727139Z","title":"Now, let’s categorize them: - Category 1: Figures with shapes pointing in a specific direction","venue":null,"work_id":"53437f7b-1fd2-4e7c-8f2d-eb992428f218","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.174242Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:1d81a798dd480640cadcc73513fc4a2c1f74ec54f342155d72402af543bea5dc","observation_id":"236d2c45-d6a5-4e9e-90ca-54aff8f02a41","resolution":{"observed_at":"2026-08-09T18:06:04.731935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.712282Z","title":null,"venue":null,"work_id":"a75be152-63c7-4e65-bff9-bb23a7b68e43","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.178738Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:d4c5a21a8a8cbe826b6865d7092ccc6e69b7e46e48a8ed16220976565f25c67b","observation_id":"e021564c-90c6-499c-a5ae-3f688d62b211","resolution":{"observed_at":"2026-08-09T18:06:04.716964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.697534Z","title":null,"venue":null,"work_id":"abbf8153-c046-46b6-b1ee-6ab1d4a6ceb6","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.183679Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:10cc7678ad3eb339f60e22d9db476b01ab669860c9d4d7d1a116d391cc2c2f8e","observation_id":"4e4815ff-b3e4-45b6-a7a0-035acb71aeeb","resolution":{"observed_at":"2026-08-09T18:06:04.702286Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.682164Z","title":null,"venue":null,"work_id":"0cac0fe1-c956-4096-9788-5a0fdbddc722","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.188175Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:dd0af76a9f0e6f3b1b151e7a8876984203b19af992b2e073dc30262ff0d5c97c","observation_id":"1e0a9b70-0821-44c6-b365-0421305417c2","resolution":{"observed_at":"2026-08-09T18:06:04.687134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.667237Z","title":null,"venue":null,"work_id":"d1145d50-a10b-4aed-b45e-c63387dee107","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.192497Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:44ce5fd07a6725ea73c3ff1e1b36c8f52c0fb4585ff8eca150f8fced6fc1725a","observation_id":"753689fd-775c-4485-97dc-336d6b2faf06","resolution":{"observed_at":"2026-08-09T18:06:04.672023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.648629Z","title":null,"venue":null,"work_id":"e25d3c7e-9794-4b94-a8d6-5013ddfb1a7a","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.197043Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:97c11c9ec01a4912f25d2964e912dcebc446dbcd8ba05be6e1097e70f833b429","observation_id":"dbc16bfe-3120-454c-85b8-706fcb29261e","resolution":{"observed_at":"2026-08-09T18:06:04.654326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.632265Z","title":"Now, let’s group them: - Group 1: Figures that are symmetrical or have a clear pattern","venue":null,"work_id":"f6df5d14-862b-480c-97ca-eb4193796f43","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.201568Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:f6fb7dc7ff802981cb1fc788d582a662c60c2ce1b5cba49e255a2c668cc058d3","observation_id":"78cede7f-745c-4727-b1e5-93c9291830fb","resolution":{"observed_at":"2026-08-09T18:06:04.637270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.616837Z","title":"The middle number (4) is obtained by adding the numbers on opposite sides: 3 + 5 = 8, 6 + 2 = 8, and 4 + 4 = 8","venue":null,"work_id":"5d39d107-e50f-44a8-8140-ea02d590868b","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.206578Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:8e839f1955a1474be5ed9c1b3ebf63486e78491c99c1615567c41929a76a5477","observation_id":"2bc40f9a-e8a6-491e-9946-171821119ee7","resolution":{"observed_at":"2026-08-09T18:06:04.621946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.600731Z","title":"The middle number (6) is obtained by adding the products of the numbers on opposite sides: 15 * 5 = 75, 12 * 4 = 48, and 6 * 6 = 36","venue":null,"work_id":"12469453-e254-436a-936e-895094d0a9b3","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.211342Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:fc38175ae8f2b1a9983401db2345c9e25f99f37871bd571bb50fe97a9fc4f5a2","observation_id":"f5339b44-af68-499e-a8b3-b6642ac9aaa8","resolution":{"observed_at":"2026-08-09T18:06:04.605817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.584913Z","title":"The middle number (7) is obtained by adding the differences of the numbers on opposite sides: 24 - 14 = 10, 6 - 5 = 1, and 7 - 7 = 0","venue":null,"work_id":"fd701b53-c1be-4c65-a2ec-84fc9cc5015d","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.215882Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:5e9303c2d58edaf3649da8b8e0a722dc356bf0b44cce66add72e7e776ac1771d","observation_id":"90933992-c2b7-4714-8277-b5bdbcda446f","resolution":{"observed_at":"2026-08-09T18:06:04.590248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:06:04.566830Z","title":"The middle number is obtained by adding the quotients of the numbers on opposite sides: 1 / 4 = 0.25, 5 / 12 = 0.4167, and 12 / 5 = 2.4","venue":null,"work_id":"c6d8ac4e-262b-4b85-83a7-cc6c0185bd6e","year":null},"citing_paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T18:06:04.220507Z"},"links":{"citing_paper":"/paper/2502.00698"},"observation_digest":"sha256:45647b96fbfe3357e42fa55e1fc3668049f7ea66ffc45dfa6bf509502a048ecc","observation_id":"a74069cb-9fe7-420b-bd69-8714d5423489","resolution":{"observed_at":"2026-08-09T18:06:04.573802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00698","last_updated":"2025-06-04T16:20:49Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T17:59:36.113765Z","submitted_at":"2025-02-02T07:12:03Z","title":"MM-IQ: Benchmarking Human-Like Abstraction and Reasoning in Multimodal Models"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 11 inbound Pith citation observations for arXiv:2502.00698."}