{"as_of":"2026-08-10T12:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab09ef7ffaa179509c33c945d9631b73e7b58156259c761b5813b13b245fa1ec","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:04:36.266807Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.11080/citation-record","integrity":"/paper/2506.11080/integrity","json":"/paper/2506.11080/citation-record.json","paper":"/paper/2506.11080"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1905.13319","last_updated":"2019-05-30T21:28:12Z","snapshot_observed_at":"2026-07-06T07:56:54.143277Z","submitted_at":"2019-05-30T21:28:12Z","title":"MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13319","snapshot_observed_at":"2026-08-07T11:04:33.019433Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.019433Z"},"links":{"cited_paper":"/paper/1905.13319","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ed7f1613e30521ff870e7626815c91c194d0c88441f2260df7a96b21401aeecd","observation_id":"9cbbc84f-f1cd-4c8e-94de-025e13f9b210","resolution":{"observed_at":"2026-08-07T11:04:33.019433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:33.100287Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.100287Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:badc183140e7a28ddfb7cb0487725da2029cf8181e8cf653ff8f04ef92349c42","observation_id":"6fc41757-0bb0-4ca5-9a50-5ec21542d75b","resolution":{"observed_at":"2026-08-07T11:04:33.100287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20330","last_updated":"2024-04-09T15:17:50Z","snapshot_observed_at":"2026-08-07T12:15:30.838846Z","submitted_at":"2024-03-29T17:59:34Z","title":"Are We on the Right Way for Evaluating Large Vision-Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20330","snapshot_observed_at":"2026-08-07T11:04:33.203398Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.203398Z"},"links":{"cited_paper":"/paper/2403.20330","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:264af13274ba4af66b4f490aa243f94b59800acc096c0e6dde719751a8fb58c1","observation_id":"c4c0966f-75f9-43c1-94ef-c43269d723e0","resolution":{"observed_at":"2026-08-07T11:04:33.203398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03361","last_updated":"2024-10-21T04:26:41Z","snapshot_observed_at":"2026-08-06T14:10:56.030769Z","submitted_at":"2024-08-06T17:59:21Z","title":"GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03361","snapshot_observed_at":"2026-08-07T11:04:33.269754Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.269754Z"},"links":{"cited_paper":"/paper/2408.03361","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:1d86f1f08bbf17bdd419491f085878716042b5eb7f732a2e041cecff17ce40bc","observation_id":"faf179a8-d2c9-4552-931e-acdd0bd8466a","resolution":{"observed_at":"2026-08-07T11:04:33.269754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:38.053555Z","title":null,"venue":null,"work_id":"974b6940-c208-4236-8f8e-97b6a2b60b39","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.342134Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:51efa62fe79ea166ab04ff111ffff22da0ea539e26a7c29720313195514b82ab","observation_id":"e79d540c-5bd5-4e1e-b525-ad946d81fda6","resolution":{"observed_at":"2026-08-07T11:04:38.122814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.861199Z","title":null,"venue":null,"work_id":"4c3ca586-e522-43a5-943a-7e44b8c476d4","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.413796Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:b555f0134ea0698e72b985a62d1ca7c5719a61e432a4c03d97ac21d03d7700f9","observation_id":"46b97ec5-2d1c-424f-aaac-7a0c7fe1c17b","resolution":{"observed_at":"2026-08-07T11:04:37.922036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T11:04:33.473651Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.473651Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:9e0290e130c29794452c298827e719f332598191b68e6938c7cb4fb29e950653","observation_id":"45ff32d9-7ea2-4adc-885d-acb2aed40042","resolution":{"observed_at":"2026-08-07T11:04:33.473651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12390","last_updated":"2024-07-03T08:44:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-18T17:59:54Z","title":"BLINK: Multimodal Large Language Models Can See but Not Perceive","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12390","snapshot_observed_at":"2026-08-07T11:04:33.576525Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.576525Z"},"links":{"cited_paper":"/paper/2404.12390","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:04ea87b7274d8a0b7074844a6e4cf8686e5f97caf1768cda25f019c98d18d1a6","observation_id":"6840f7bc-b91c-4ab6-8362-746e39cd4238","resolution":{"observed_at":"2026-08-07T11:04:33.576525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T11:04:33.681836Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.681836Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:cd96c512d3e56765fc6aad8b285d4bd6a617af640b12cc1bd3350d876d10587f","observation_id":"a7295d2f-a5da-461c-bb3a-9925fd622e13","resolution":{"observed_at":"2026-08-07T11:04:33.681836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T11:04:33.753861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.753861Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:8fb23bc3ebfe90680508dae7d775448fe64b6d292bab3e35e8e6c223f2ce64af","observation_id":"79938242-1aaa-48e2-8de3-877f771a804b","resolution":{"observed_at":"2026-08-07T11:04:33.753861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:33.852870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.852870Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:04309d0e839872fafd18704c2a1cda40dcfec5894a951cc5899d7ca0955f1ec5","observation_id":"a1dfed1f-bfa6-46e5-a649-b08ab28235d8","resolution":{"observed_at":"2026-08-07T11:04:33.852870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.662057Z","title":null,"venue":null,"work_id":"810ee9a5-65ff-496a-b4eb-42e1ee14c10b","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:33.952899Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:9a6fcfcef88e0b850a41313997179f29c5d143c6d48ae2b9c4b7929a24d87d16","observation_id":"f3cceeb6-bdc8-40de-8901-36b3e3619c04","resolution":{"observed_at":"2026-08-07T11:04:37.770114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-07T11:04:34.025517Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.025517Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:896bec4a5e698763342be4ae2327e0f5c5b8e35230e8c99a6322f1f1c2a3ca3e","observation_id":"ced02137-89da-4243-82e2-44d681229640","resolution":{"observed_at":"2026-08-07T11:04:34.025517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.099423Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.099423Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:fa98ce0e360a62b49675d4ffa0f9c027c86c1604873c5b87fff8168f38ea2c27","observation_id":"c2780544-60bf-41f8-ae47-dc9314b71fe6","resolution":{"observed_at":"2026-08-07T11:04:34.099423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.194730Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.194730Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:92b9199f65bc71c7a83d1374ff84b3cf4de4bc691619377d93cffe60f9b95a60","observation_id":"d94c870a-ba9f-4acc-8d8c-bd44a87f2ac6","resolution":{"observed_at":"2026-08-07T11:04:34.194730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02718","last_updated":"2024-08-05T17:56:41Z","snapshot_observed_at":"2026-07-06T18:57:09.545013Z","submitted_at":"2024-08-05T17:56:41Z","title":"MMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02718","snapshot_observed_at":"2026-08-07T11:04:34.275314Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.275314Z"},"links":{"cited_paper":"/paper/2408.02718","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:3b509d07af9dc4635b8fd491a5a0b30232e06b88b0ae8a5b518dd7f50603f8f7","observation_id":"de2927ee-074a-4a77-9fda-d5f316e2214b","resolution":{"observed_at":"2026-08-07T11:04:34.275314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.353892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.353892Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:0ee284f6e3c30edd55e61a45cb5ff2aa3c6e281e49f5b903eba433e335a1d5bf","observation_id":"3b4515d8-05fb-458c-aa7c-fd9cf9c1bd68","resolution":{"observed_at":"2026-08-07T11:04:34.353892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.491571Z","title":null,"venue":null,"work_id":"edf7975c-83a3-4e95-9e2e-c0e18c29ab0d","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.481908Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:6c65c870ca91b737a7b7cc2430e7cd850cbfebef5c2c2b94e05e2aa6ee1b7b5d","observation_id":"b38614fb-0d8e-44cd-9e28-7398a53e3386","resolution":{"observed_at":"2026-08-07T11:04:37.549855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.555811Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.555811Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:6d0fd8e829c51efb3a424f08b10dc8ee7b2e64544b5d9a82645bc6aafed1374f","observation_id":"6a764844-966c-4a55-adf4-7d89ad29ec5f","resolution":{"observed_at":"2026-08-07T11:04:34.555811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:34.627505Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.627505Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:e0168f6d00a522eb4be9b0fa87c8cf42005e39b52fcec0e53ff0b698bd398f17","observation_id":"84ea90b2-4610-4482-9b1e-57435bfd7e6f","resolution":{"observed_at":"2026-08-07T11:04:34.627505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0575","last_updated":"2015-01-30T01:23:59Z","snapshot_observed_at":"2026-07-06T03:53:12.119259Z","submitted_at":"2014-09-01T22:29:38Z","title":"ImageNet Large Scale Visual Recognition Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0575","snapshot_observed_at":"2026-08-07T11:04:34.736985Z","title":"Berg, and Li Fei-Fei","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.736985Z"},"links":{"cited_paper":"/paper/1409.0575","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:866e34d7d88361aacc51820f1fa1996e15274890b4807a1f5ed2a019e805f607","observation_id":"ce03bda5-2ee7-4d7d-b199-22debc836638","resolution":{"observed_at":"2026-08-07T11:04:34.736985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.326493Z","title":null,"venue":null,"work_id":"8219a9a0-e4a7-4da7-b7d3-a51eb54c8f5d","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.811098Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:9bffc194f47478d0f46ef2a1b82a08fdc295eca6c916e3ebeae8c0cab1529120","observation_id":"aa645b74-9800-47bf-8a4a-9f9697541a3d","resolution":{"observed_at":"2026-08-07T11:04:37.398739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.134140Z","title":null,"venue":null,"work_id":"8179f505-44b7-41ab-a9c1-210ead33d49b","year":2025},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.906468Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:313ca961d8433b7cf87df88aeb2a4d575fafa707b287d0b18aabc0e08a1b5a45","observation_id":"10dcd35f-3ad8-4473-9d3b-2533e9f33ab9","resolution":{"observed_at":"2026-08-07T11:04:37.245133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T11:04:34.957896Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:34.957896Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:75dc7841c7f41b1f7016cc894a78e024c6f1f77d55c6376166e733608772d0df","observation_id":"91cdb192-d7c1-4429-8c88-834a38467284","resolution":{"observed_at":"2026-08-07T11:04:34.957896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:37.025818Z","title":null,"venue":null,"work_id":"fdaf4b91-048b-465d-b564-fae97e1cda42","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.053070Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:9e9ee58852edf480d2c7e29f1cf29855ce7e1685d0df89fb6845e571ede2e72c","observation_id":"178da340-62c3-46c5-b605-1794e37e26ea","resolution":{"observed_at":"2026-08-07T11:04:37.077215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:35.122944Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.122944Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:0ba2163dc74cd61e89730f33c7f885b95bcf07840a265b47c3fea750df1e3b9a","observation_id":"1ff12e9b-7eac-4590-aa1a-a924fec77b41","resolution":{"observed_at":"2026-08-07T11:04:35.122944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09411","last_updated":"2024-07-02T01:56:14Z","snapshot_observed_at":"2026-08-09T15:18:46.301127Z","submitted_at":"2024-06-13T17:59:52Z","title":"MuirBench: A Comprehensive Benchmark for Robust Multi-image Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09411","snapshot_observed_at":"2026-08-07T11:04:35.321699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.321699Z"},"links":{"cited_paper":"/paper/2406.09411","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:197e5d36d0983316463544c9f01c3693bfc3ecc4fafa852f36ee1dae23f252ec","observation_id":"b143a180-e90c-4d7c-8a66-0230a099cedf","resolution":{"observed_at":"2026-08-07T11:04:35.321699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14804","last_updated":"2024-02-22T18:56:38Z","snapshot_observed_at":"2026-08-08T13:47:36.585273Z","submitted_at":"2024-02-22T18:56:38Z","title":"Measuring Multimodal Mathematical Reasoning with MATH-Vision Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14804","snapshot_observed_at":"2026-08-07T11:04:35.401166Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.401166Z"},"links":{"cited_paper":"/paper/2402.14804","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:28633527403e916e62abfa7210ab9fb9f85d36e463f9d31080d96761875f8bd3","observation_id":"cbe520ed-f158-447a-9e94-ed8fce53cbd6","resolution":{"observed_at":"2026-08-07T11:04:35.401166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T11:04:35.585470Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.585470Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:eaaf85dad4f74ee97d1135692feca4177d746d21302e2f1f41424557426a3731","observation_id":"0a02c4e2-b065-46fe-8300-7b4fba8ddcc1","resolution":{"observed_at":"2026-08-07T11:04:35.585470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10442","snapshot_observed_at":"2026-08-07T11:04:35.660401Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.660401Z"},"links":{"cited_paper":"/paper/2411.10442","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ae5c043d8083df61fb0edcfc295a377a92ac9c0afe3af41633310b7bd82f215e","observation_id":"9697a96f-5196-47ad-9dad-7c8174cf9069","resolution":{"observed_at":"2026-08-07T11:04:35.660401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19314","last_updated":"2025-04-18T19:36:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-27T16:47:42Z","title":"LiveBench: A Challenging, Contamination-Limited LLM Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19314","snapshot_observed_at":"2026-08-07T11:04:35.770013Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.770013Z"},"links":{"cited_paper":"/paper/2406.19314","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:fe74b44f5d2ab22395d9316031b4ca06a881f86fa5d1d5331dda83beb2b4c2ac","observation_id":"6f69844b-b07b-468b-9e95-fa2590d3990c","resolution":{"observed_at":"2026-08-07T11:04:35.770013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T11:04:35.843690Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.843690Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ab430d3737c157374a576ea3b667cbdd7f85b7dfe7b39f7484308ac41f373cea","observation_id":"85842938-03b8-4905-9646-413aee53cda0","resolution":{"observed_at":"2026-08-07T11:04:35.843690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:35.920353Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:35.920353Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:e1696115f7233aaefba280c74e9edb2a99379bdf4ad8d0e8202608ad976d0128","observation_id":"bc046f9a-de8e-4942-814f-7be1158cc679","resolution":{"observed_at":"2026-08-07T11:04:35.920353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00332","last_updated":"2024-11-22T22:27:49Z","snapshot_observed_at":"2026-08-09T21:05:48.710894Z","submitted_at":"2024-05-01T05:52:05Z","title":"A Careful Examination of Large Language Model Performance on Grade School Arithmetic","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00332","snapshot_observed_at":"2026-08-07T11:04:36.030597Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:36.030597Z"},"links":{"cited_paper":"/paper/2405.00332","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:6de07f9193c4e8f711e5718c8ae6fa1eeb012325c15ae9d08af4ec0c9f13bcd4","observation_id":"9a2fe13c-2714-4032-b3f4-6bdb30c1446e","resolution":{"observed_at":"2026-08-07T11:04:36.030597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:36.818905Z","title":null,"venue":null,"work_id":"c059e584-6b08-4d58-9318-baedfeaed827","year":2024},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:36.122616Z"},"links":{"citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:ca5afff5e14ebc905368183507f86ab9fc8c05da1759ecc05328cbe0cc5c1fe7","observation_id":"57dceeea-435a-43b1-87b3-602d38865fa7","resolution":{"observed_at":"2026-08-07T11:04:36.917406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T11:04:36.266807Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:04:36.266807Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2506.11080"},"observation_digest":"sha256:9c8486b3e48e5cefe8b58234c1cd6281a4672eadb944bb24f1679a9fa8f669bd","observation_id":"94a18d1e-2c73-4c44-8f0f-5ff4448a9ece","resolution":{"observed_at":"2026-08-07T11:04:36.266807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11080","last_updated":"2025-06-04T08:42:14Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T01:09:17.696366Z","submitted_at":"2025-06-04T08:42:14Z","title":"MANBench: Is Your Multimodal Model Smarter than Human?"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2506.11080."}