{"as_of":"2026-08-20T08:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3fd04a976b917f57d0dbb11e586c80372452ec15088e87f5af39cb723f86c986","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:58:43.866369Z","state":"measured"},{"denominator":89,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":89,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.12606/citation-record","integrity":"/paper/2412.12606/integrity","json":"/paper/2412.12606/citation-record.json","paper":"/paper/2412.12606"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-11T13:58:42.753991Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.753991Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:ebf66976e9b8ce2e5a65695a2e5a6e668f3f228c868555ca3231b41bf3c97e17","observation_id":"631e9839-7de6-4999-af51-42243f110e65","resolution":{"observed_at":"2026-08-11T13:58:42.753991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:42.761258Z","title":"Nocaps: Novel object captioning at scale","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.761258Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:6e23f7df5ddb5e3bb01e88673d2745d86906c846cf7d7f83575878c26f86a14f","observation_id":"6ddc1952-1dee-4862-9890-42268bd94048","resolution":{"observed_at":"2026-08-11T13:58:42.761258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:42.766447Z","title":"Knowledge-augmented large language models for personalized contextual query suggestion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.766447Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:f5c1844c769b50ec3e57f49ad652b2dae92a4424c0317ed7309d8a5fbf925c6d","observation_id":"0db50ae8-30bd-466e-8375-101706f9fe39","resolution":{"observed_at":"2026-08-11T13:58:42.766447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-11T13:58:42.771551Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.771551Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:175114c306f5fbeceb7bcc28d487a00a46094ad026b330bfb40887981743a213","observation_id":"5311a962-16f2-4570-8bd2-a37e69ed0bd8","resolution":{"observed_at":"2026-08-11T13:58:42.771551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:42.777922Z","title":"Vizwiz: nearly real-time answers to visual questions","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.777922Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:40a6cf37f99fde0de56964fffd10f1f4b03ecf8197a57bf498cc424f8d028d0b","observation_id":"5486a6e1-e0ea-4ddd-be25-ec3ddc781264","resolution":{"observed_at":"2026-08-11T13:58:42.777922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:42.816190Z","title":"Social attention and real-world scenes: The roles of action, competition and social content","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.816190Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:b5bd2ac28cef65a02c74eee1d510f5d6e2add7f33cbe32fd632644b448baf004","observation_id":"33d679d2-e71a-408f-90ba-4a047f57d07b","resolution":{"observed_at":"2026-08-11T13:58:42.816190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:42.922336Z","title":"Scene text visual question answering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.922336Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:0b2dfce070a743ed2739b8b51b30b592659a999f6973f69a3932c53fe140fdca","observation_id":"fa2d7b07-f37b-4e71-95b2-30a075b72697","resolution":{"observed_at":"2026-08-11T13:58:42.922336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:42.973730Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.973730Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:cd63418ab23713c95a680e0ec80e5ecb7d3c1fd816263616faf6ef6548294ff8","observation_id":"65bc4c41-99ff-43cd-913e-d3fdb17c219e","resolution":{"observed_at":"2026-08-11T13:58:42.973730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20094","last_updated":"2025-05-08T00:24:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-28T17:59:01Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20094","snapshot_observed_at":"2026-08-11T13:58:42.979672Z","title":"Scaling synthetic data creation with 1,000,000,000 personas","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.979672Z"},"links":{"cited_paper":"/paper/2406.20094","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:1d3bf147f27d3be798616cbcab87e2f7016138f1388284c36649a7e6874784c7","observation_id":"96c0aac1-fee7-415d-a2cc-9be9d422b595","resolution":{"observed_at":"2026-08-11T13:58:42.979672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-16T01:18:27.067382Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-11T13:58:42.989908Z","title":"Microsoft coco captions: Data collection and evaluation server","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.989908Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:485d1d7587a33a4c61a8e61a90abd1a3d13b6a2c9ab028d661535e0a4c31150e","observation_id":"c9ed0198-6485-442a-a353-993e3df005d6","resolution":{"observed_at":"2026-08-11T13:58:42.989908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:42.995810Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90\\ See https://vicuna","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:42.995810Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:e39c92e73f07063344eb72ab0ecfa1adb386be4f1cbfeaccf849e3ed680ae01f","observation_id":"4c81064e-18ec-427c-9a3a-b3032c52a262","resolution":{"observed_at":"2026-08-11T13:58:42.995810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.000238Z","title":"PSSAT: A perturbed semantic structure awareness transferring method for perturbation-robust slot filling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.000238Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:0c665bdb9d072877662671a1353bcd549a9f79c01b0d01a7fd1c188871280711","observation_id":"f724ad1a-05e0-4adf-8bc0-d98cbcff4c01","resolution":{"observed_at":"2026-08-11T13:58:43.000238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.004443Z","title":"Bridging the kb-text gap: Leveraging structured knowledge-aware pre-training for KBQA","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.004443Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:ead49b176246bb90d1f8ab1ec237268fe126c9fa5204d772e24738f4a921dae8","observation_id":"f9b300c4-d038-414e-817e-b865dc6e5c26","resolution":{"observed_at":"2026-08-11T13:58:43.004443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13542","last_updated":"2024-07-18T09:00:23Z","snapshot_observed_at":"2026-08-20T03:31:35.446193Z","submitted_at":"2024-06-19T13:29:53Z","title":"Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13542","snapshot_observed_at":"2026-08-11T13:58:43.009183Z","title":"Self-play with execution feedback: Improving instruction-following capabilities of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.009183Z"},"links":{"cited_paper":"/paper/2406.13542","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:e7bbf4d86b5610c7063acfed50070bbd5a041ed273767d112e718250e7555d7e","observation_id":"e5cb79ef-19c3-4208-abd5-f210fa180614","resolution":{"observed_at":"2026-08-11T13:58:43.009183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09584","last_updated":"2024-10-12T16:30:51Z","snapshot_observed_at":"2026-08-16T13:10:01.688423Z","submitted_at":"2024-10-12T16:30:51Z","title":"Toward General Instruction-Following Alignment for Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09584","snapshot_observed_at":"2026-08-11T13:58:43.014777Z","title":"Toward general instruction-following alignment for retrieval-augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.014777Z"},"links":{"cited_paper":"/paper/2410.09584","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:77c4543104ab54621949daa17f159d52c630cf0183729260ebaa3b1c3715a5a5","observation_id":"7c1a6041-2196-46a5-bb0b-3d73670fa235","resolution":{"observed_at":"2026-08-11T13:58:43.014777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.019416Z","title":"How abilities in large language models are affected by supervised fine-tuning data composition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.019416Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:a1df0e2f007742933b80e23929a6b24b4efe73d167edf0d4a85fb90550d8375b","observation_id":"d60d531c-25c6-43bc-ab7a-5bff23563ce8","resolution":{"observed_at":"2026-08-11T13:58:43.019416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18676","last_updated":"2024-07-18T08:28:09Z","snapshot_observed_at":"2026-08-16T13:39:18.905300Z","submitted_at":"2024-06-26T18:26:53Z","title":"Understand What LLM Needs: Dual Preference Alignment for Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18676","snapshot_observed_at":"2026-08-11T13:58:43.023100Z","title":"Understand what LLM needs: Dual preference alignment for retrieval-augmented generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.023100Z"},"links":{"cited_paper":"/paper/2406.18676","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:f24d3bc0b23fb184a1871215b65ef49f32b3033a0ddff588887f1c5d44a7a702","observation_id":"df5042c8-e62a-4bba-97bb-331e2d59fb99","resolution":{"observed_at":"2026-08-11T13:58:43.023100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-11T13:58:43.028084Z","title":"Mme: A comprehensive evaluation benchmark for multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.028084Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:b15aac118e6be9dff267aa73134c8798c5de9c2816e92efd5f5ac1666c161dcb","observation_id":"ce3fbb98-f0f9-452c-a837-943f87a1300d","resolution":{"observed_at":"2026-08-11T13:58:43.028084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-11T13:58:43.032618Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.032618Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:ba4d17d7c7d258658e43376d286bd0ab240291e9492c04514785cc1b210d7148","observation_id":"50d0e50e-0f4b-4613-b756-aafce5b4297d","resolution":{"observed_at":"2026-08-11T13:58:43.032618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-11T13:58:43.036585Z","title":"Retrieval-augmented generation for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.036585Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:e63fd22fd14801ccf265da82a852e49451dd6b128b4f4925021fc0b4c03a30f2","observation_id":"46b36204-5aa2-4e16-b841-9c99115a075d","resolution":{"observed_at":"2026-08-11T13:58:43.036585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17452","last_updated":"2024-02-21T12:59:22Z","snapshot_observed_at":"2026-08-15T05:04:59.720326Z","submitted_at":"2023-09-29T17:59:38Z","title":"ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17452","snapshot_observed_at":"2026-08-11T13:58:43.040749Z","title":"Tora: A tool-integrated reasoning agent for mathematical problem solving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.040749Z"},"links":{"cited_paper":"/paper/2309.17452","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:7ebe57a3d716835ff86b0f62b1927066b3f007a50fa39b81dd186aff1926d581","observation_id":"cc64a270-5fbc-4c38-a455-de2c4ff369fa","resolution":{"observed_at":"2026-08-11T13:58:43.040749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.044769Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.044769Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:19f018804e16fcf88a9f651cc8165b355294752c566f4861ee4afe3eaa091344","observation_id":"e997e479-7692-44b4-8c55-1607fe32ac4a","resolution":{"observed_at":"2026-08-11T13:58:43.044769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.048497Z","title":"Retrieval augmented language model pre-training","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.048497Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:de3934d7bdc3e3dad9f578d5df2e20764469c6ccecfc52e744bede5bc517e684","observation_id":"ccb7a151-396f-45c7-a3b9-89981a09fdaf","resolution":{"observed_at":"2026-08-11T13:58:43.048497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.052054Z","title":"Measuring massive multitask language understanding, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.052054Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:83b57103d62b82a19128575e02cdaf4741d877658956ff72de9fe7351de9ac21","observation_id":"e0a6ea6b-b7b0-4799-8294-e37b6f24dee3","resolution":{"observed_at":"2026-08-11T13:58:43.052054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08914","last_updated":"2024-12-27T06:56:18Z","snapshot_observed_at":"2026-08-19T15:30:58.990292Z","submitted_at":"2023-12-14T13:20:57Z","title":"CogAgent: A Visual Language Model for GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08914","snapshot_observed_at":"2026-08-11T13:58:43.080825Z","title":"Cogagent: A visual language model for gui agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.080825Z"},"links":{"cited_paper":"/paper/2312.08914","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:33109e7416fcc55851bd7fadff1ba8ef6a96343b72cfabca3e923e73cf55ea42","observation_id":"364ed6cb-90c8-45e8-92d2-da3cb390859e","resolution":{"observed_at":"2026-08-11T13:58:43.080825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-08-12T13:10:06.472493Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-11T13:58:43.124024Z","title":"Minicpm: Unveiling the potential of small language models with scalable training strategies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.124024Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:a140fd23955aaad41f1c1549de7b694c1534d11df417c3acf526af12bda7a048","observation_id":"ad77c922-77b1-4124-a722-322751767423","resolution":{"observed_at":"2026-08-11T13:58:43.124024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.159622Z","title":"Gqa: A new dataset for real-world visual reasoning and compositional question answering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.159622Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:f64fb1c66c31dd38123d323322847692fb6bd701a76efeeef9fc50c037ec4f44","observation_id":"e02dea2a-04d2-4bda-a884-5c0cefd0488a","resolution":{"observed_at":"2026-08-11T13:58:43.159622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.379753Z","title":"Privacy through pseudonymity in user-adaptive systems","venue":null,"work_id":"23a2fb3c-acc8-40da-ba62-6b341815b776","year":2003},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.243336Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:5edcde5976d4f3471843673bf3d34c07580cb629afedb65bc997807e38b7eb54","observation_id":"9ac19847-373c-4ca8-909a-634e88663deb","resolution":{"observed_at":"2026-08-11T13:58:45.384984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.361483Z","title":"The personalization of conversational agents in health care: systematic review","venue":null,"work_id":"5c8ce7fb-9d07-4bc9-b10f-244ae0853e99","year":2019},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.319941Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:4c1f7185acf91999544dd0ba7cb6e18a05d7b85553972901ba7fbc73369748e9","observation_id":"907f6be3-6733-44c3-aac1-d80a8ec0b777","resolution":{"observed_at":"2026-08-11T13:58:45.367407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11911","last_updated":"2024-08-29T05:14:36Z","snapshot_observed_at":"2026-08-16T14:58:51.412701Z","submitted_at":"2023-09-21T09:22:07Z","title":"InstructERC: Reforming Emotion Recognition in Conversation with Multi-task Retrieval-Augmented Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11911","snapshot_observed_at":"2026-08-11T13:58:43.343235Z","title":"Instructerc: Reforming emotion recognition in conversation with a retrieval multi-task llms framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.343235Z"},"links":{"cited_paper":"/paper/2309.11911","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:10ea3e9ce743f89aa22e6539b9e5623382e4a3bcd7fee03dfbd50fdd1db6312f","observation_id":"73e3cb67-49dc-4fd9-8440-7b50e96a670d","resolution":{"observed_at":"2026-08-11T13:58:43.343235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.347680Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.347680Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:407406f25da367beb97020598fd88b69aa06d46e36c43805ff60ee137604ad7b","observation_id":"793d4109-bf8d-4f38-958d-17ec8cbd96b3","resolution":{"observed_at":"2026-08-11T13:58:43.347680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-11T13:58:43.352206Z","title":"Seed-bench: Benchmarking multimodal llms with generative comprehension","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.352206Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:20abb34a264f04c8a526b43eca763c95c56db54b5f0bbfbb5a07b9522d2c8906","observation_id":"33ec4ec7-2e8e-44df-b580-26553bc8a009","resolution":{"observed_at":"2026-08-11T13:58:43.352206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.357195Z","title":"Llava-med: Training a large language-and-vision assistant for biomedicine in one day","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.357195Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:547482cf546b2a2ea9723132ee0183198f61a9b1b26f5499c132a7df7ef72451","observation_id":"decbbc1e-4929-41c8-991b-1cdfc617645d","resolution":{"observed_at":"2026-08-11T13:58:43.357195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.362599Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.362599Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:d6c5de9a2dea8dda8cde31a8022d898a5f5992d50aa1e1e9e362b8d7c2ae0229","observation_id":"aa1e6da8-23a5-4ea9-a3ed-66faa423fd05","resolution":{"observed_at":"2026-08-11T13:58:43.362599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.367137Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.367137Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:897829af3114ec2cc3cb408b32f4bc19ffc4af26c284d9ee31c7057c159e160d","observation_id":"de88729e-3508-423f-9b79-a41a4cb28dc3","resolution":{"observed_at":"2026-08-11T13:58:43.367137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.294767Z","title":"Lost in the middle: How language models use long contexts","venue":null,"work_id":"ff00befb-56aa-4f36-9491-aaea29152588","year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.371608Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:eac7cbef33dbc754465e3b54bae382c5d283bec69bc5dd25c14786b39ee5701c","observation_id":"d670669c-a953-4a72-b8f4-da5ba2175517","resolution":{"observed_at":"2026-08-11T13:58:45.300438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06281","last_updated":"2024-08-20T03:56:03Z","snapshot_observed_at":"2026-08-17T03:48:18.599994Z","submitted_at":"2023-07-12T16:23:09Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06281","snapshot_observed_at":"2026-08-11T13:58:43.376010Z","title":"Mmbench: Is your multi-modal model an all-around player? arXiv preprint arXiv:2307.06281, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.376010Z"},"links":{"cited_paper":"/paper/2307.06281","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:15ea51bd8f9a777f3282615df4fa19bed8c29aeb79c1b34ea4a7eb94363bd87d","observation_id":"d4963efe-d8da-41c8-b2fe-7f6cf0ae68fb","resolution":{"observed_at":"2026-08-11T13:58:43.376010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-19T16:22:29.898436Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-11T13:58:43.380316Z","title":"Deepseek-vl: towards real-world vision-language understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.380316Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:7fdb93f5ecc0013390b0dfcba5b05186c805481dcc687114ef9234ff577badbd","observation_id":"956bcdb0-e2ac-4c72-ae21-da1b4f4b3499","resolution":{"observed_at":"2026-08-11T13:58:43.380316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.271602Z","title":"Mathvista: Evaluating mathematical reasoning of foundation models in visual contexts","venue":null,"work_id":"2464df8c-54d8-41d9-9db5-a14e6254c057","year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.384529Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:5cd5788af72c95cd79874d58fba5fffb05e88cd834cb5589b12faf30f605d44a","observation_id":"ec5af38d-15a6-4cbf-8acb-fd400bd0d924","resolution":{"observed_at":"2026-08-11T13:58:45.277264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05840","last_updated":"2024-12-31T14:46:47Z","snapshot_observed_at":"2026-08-18T23:26:14.902567Z","submitted_at":"2024-09-09T17:44:00Z","title":"MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05840","snapshot_observed_at":"2026-08-11T13:58:43.388547Z","title":"Mmevol: Empowering multimodal large language models with evol-instruct","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.388547Z"},"links":{"cited_paper":"/paper/2409.05840","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:a28f1953aac206c85713e6da986a7119462a4db8a5be2dcfb152037f856d064a","observation_id":"139e4247-02ee-49aa-8614-fb08a2b9b5d4","resolution":{"observed_at":"2026-08-11T13:58:43.388547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.395478Z","title":"Ok-vqa: A visual question answering benchmark requiring external knowledge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.395478Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:c4cff1ea3ad57f3e97ac87ab86d1f9558e2a0ba5f4ef31f06634e06112fd6c01","observation_id":"bfe620a7-189d-43e7-b06c-39efdddb2ff0","resolution":{"observed_at":"2026-08-11T13:58:43.395478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.401175Z","title":"Docvqa: A dataset for vqa on document images","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.401175Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:022512700b807bc574bde11e5102598ab819c419d5d7a696f32e7b89390ff768","observation_id":"cdf8a596-34c6-4839-9577-e62841dfacdb","resolution":{"observed_at":"2026-08-11T13:58:43.401175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.226832Z","title":"Image segmentation using deep learning: A survey","venue":null,"work_id":"279e7e9d-1154-4af9-9e32-2665f03d4c8f","year":2021},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.406813Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:92a1519f6d24612f073cb19fe9b0097e0ea2d5bef5fff7643c4afed24da56b64","observation_id":"7bcbf7eb-aaf9-48d0-95f1-b16459ea6b88","resolution":{"observed_at":"2026-08-11T13:58:45.232190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.412980Z","title":"Ocr-vqa: Visual question answering by reading text in images","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.412980Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:048847bf87330d67d7c825cbb5a8a62736f16bc4ba0e0edc1c7f63625c4a3cac","observation_id":"3b49774e-6cb4-4e38-a216-a26320933d5a","resolution":{"observed_at":"2026-08-11T13:58:43.412980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.416865Z","title":"Hello gpt-4o, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.416865Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:54994afa619e97147788683ea011d6007f4bc479c10f44d47d81c3db7fe1b587","observation_id":"0c51461b-6eec-41a5-8e58-3564f2884525","resolution":{"observed_at":"2026-08-11T13:58:43.416865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.421003Z","title":"Gpt-4v (ision) system card","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.421003Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:1ace60ce823d401d249b164e46ae98cf5c5f0f44f2bdef9581c06180ec3bd674","observation_id":"1432d1c1-c04b-4546-8341-1fc6e9cce987","resolution":{"observed_at":"2026-08-11T13:58:43.421003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.426610Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.426610Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:329d5bb99d207acdafdf98f99d382596383049c3290fe476518a5b96731bf439","observation_id":"ab66e037-ba83-410e-8621-5b849527edd1","resolution":{"observed_at":"2026-08-11T13:58:43.426610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.135879Z","title":"Generative ai for customizable learning experiences","venue":null,"work_id":"db7f36de-c8ea-40e2-af13-1eacca9af741","year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.431671Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:c2ef51234235ae5efcf672d872cd468cd8dc851b5364ef9b2b5affdc3ff485f4","observation_id":"1eca6387-e2fc-4514-9ecf-ffa51c9adbb7","resolution":{"observed_at":"2026-08-11T13:58:45.142561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01284","last_updated":"2024-07-01T13:39:08Z","snapshot_observed_at":"2026-08-12T06:11:26.786967Z","submitted_at":"2024-07-01T13:39:08Z","title":"We-Math: Does Your Large Multimodal Model Achieve Human-like Mathematical Reasoning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01284","snapshot_observed_at":"2026-08-11T13:58:43.436966Z","title":"We-math: Does your large multimodal model achieve human-like mathematical reasoning? arXiv preprint arXiv:2407.01284, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.436966Z"},"links":{"cited_paper":"/paper/2407.01284","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:0cc469d089f80a91d0d2e861a00b473d9bbeb54cb73c4be55c147dd145455948","observation_id":"c9fc323c-1445-4f4a-9070-cc7a08f6d39b","resolution":{"observed_at":"2026-08-11T13:58:43.436966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.111399Z","title":"Making visual sense of oracle bones for you and me","venue":null,"work_id":"82a12141-8d76-46fd-bbbb-4dc22d4a29fc","year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.490151Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:06fb5aaf565a43f40acedd4b67bab146f692dce3f34214a6a0cc5d5e676450b2","observation_id":"30acb2d4-c609-4195-997b-1ab8eb06d110","resolution":{"observed_at":"2026-08-11T13:58:45.115888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.093780Z","title":"Ai and personalization","venue":null,"work_id":"8e23c505-019d-4adf-98e8-8fde302d7b93","year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.570993Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:b66a6df6addc46d7686dc76d8cdadec203e078df2072fce8783174576cff7b9f","observation_id":"9b92e2db-2933-46b8-8ab4-6842667cd714","resolution":{"observed_at":"2026-08-11T13:58:45.099822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.072288Z","title":"Deep convolutional neural networks for image classification: A comprehensive review","venue":null,"work_id":"c5384591-c060-411f-9258-dcf08f1b7f20","year":2017},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.613724Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:06bf8d1993db3614faa7bb57842fe06673be26e049d9dbca2e2469c4e80684d1","observation_id":"889bbf71-2bea-4062-8c8e-153f4e5f6f13","resolution":{"observed_at":"2026-08-11T13:58:45.079181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.039168Z","title":"Machine translation using deep learning: An overview","venue":null,"work_id":"72fc06e7-c1ad-471b-90d3-5e9d19ddf6c2","year":2017},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.662008Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:441976e51c25b9c64fa94bb06ce60647942ee2315d2d8449da9ce47df36a85e5","observation_id":"e5f14e05-9e2a-4290-a2d9-b6779fea53c1","resolution":{"observed_at":"2026-08-11T13:58:45.046381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08587","last_updated":"2025-02-28T15:16:04Z","snapshot_observed_at":"2026-08-16T13:43:35.911754Z","submitted_at":"2024-06-12T18:47:28Z","title":"CS-Bench: A Comprehensive Benchmark for Large Language Models towards Computer Science Mastery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08587","snapshot_observed_at":"2026-08-11T13:58:43.667833Z","title":"Cs-bench: A comprehensive benchmark for large language models towards computer science mastery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.667833Z"},"links":{"cited_paper":"/paper/2406.08587","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:7e6ebf8f626cd29aa16bf06b94de9d5ed9b304e557cb0593b1f4b8fdbfa7f5d8","observation_id":"dd1931cb-bc27-4197-98e1-5d523fb45990","resolution":{"observed_at":"2026-08-11T13:58:43.667833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:45.010834Z","title":"Social influence and group identity","venue":null,"work_id":"c94e085c-adab-4d15-9e67-8de6463bad4e","year":2021},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.674472Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:1bfb3ab8a9b9da65a7441ba80442d9e945115ba69c6125e8fe8a01f26838fbb2","observation_id":"0395f81f-cf71-4104-90d8-d53fbbbb1e41","resolution":{"observed_at":"2026-08-11T13:58:45.020248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16355","last_updated":"2023-05-25T04:16:07Z","snapshot_observed_at":"2026-08-14T10:09:12.476133Z","submitted_at":"2023-05-25T04:16:07Z","title":"PandaGPT: One Model To Instruction-Follow Them All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16355","snapshot_observed_at":"2026-08-11T13:58:43.681381Z","title":"Pandagpt: One model to instruction-follow them all","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.681381Z"},"links":{"cited_paper":"/paper/2305.16355","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:536da35d746bae153504c25f781ddccbca6d13e359b34334e0ab61b2eede0d9d","observation_id":"43f2169a-d2fa-493c-b9b0-e5d90161c01e","resolution":{"observed_at":"2026-08-11T13:58:43.681381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:44.988942Z","title":"Individuals and groups in social psychology","venue":null,"work_id":"e4ef9dd4-d35b-45ed-b632-b6704197f6a1","year":1979},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.687259Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:3f972dc2a4e196a8ea9a942d4773f5dc5d4222a5ec378792e8bf42f51c8183db","observation_id":"60750400-0c64-49f3-8f2e-8cbe2cf32ed8","resolution":{"observed_at":"2026-08-11T13:58:44.996095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04401","last_updated":"2025-02-08T20:01:56Z","snapshot_observed_at":"2026-08-16T14:20:50.638131Z","submitted_at":"2024-02-06T21:03:52Z","title":"Democratizing Large Language Models via Personalized Parameter-Efficient Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04401","snapshot_observed_at":"2026-08-11T13:58:43.692882Z","title":"Democratizing large language models via personalized parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.692882Z"},"links":{"cited_paper":"/paper/2402.04401","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:61e922981e821c9acdb74620ef80dfb6d3a23d0d4b11c41e41652b96e906e155","observation_id":"82638d57-f78c-46ab-8a9c-edcde57147ad","resolution":{"observed_at":"2026-08-11T13:58:43.692882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-11T13:58:43.698637Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.698637Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:c48f11c5d45df2e7e3df4c0b3b4da295c09866c45555a0ea3904d13a56ed117c","observation_id":"5793f5e4-6056-4073-bed9-6b3f68edb97e","resolution":{"observed_at":"2026-08-11T13:58:43.698637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-11T13:58:43.704364Z","title":"Lamda: Language models for dialog applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.704364Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:a00714a57d0a23f534c499de7b4562222687987b7571e9838e8efa57c4f6a324","observation_id":"3ece82b2-58bc-4f17-a781-52d7e3f880ae","resolution":{"observed_at":"2026-08-11T13:58:43.704364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T13:58:43.710580Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.710580Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:82dc180e38afb3a5a947b1dffd2a229ae1ae469a16cf82aed2ada8f3482196ce","observation_id":"32ac0533-7349-4d3c-bba2-3a8ace65b05a","resolution":{"observed_at":"2026-08-11T13:58:43.710580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-11T13:58:43.716199Z","title":"Cogvlm: Visual expert for pretrained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.716199Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:bb1fac5614ccc5b92cfa9c0fd28983f942fa4d3645a4610df3df68150a350135","observation_id":"dadbc503-a094-43af-b542-441b1a132c0b","resolution":{"observed_at":"2026-08-11T13:58:43.716199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01704","last_updated":"2024-09-03T08:41:31Z","snapshot_observed_at":"2026-08-18T18:59:18.095701Z","submitted_at":"2024-09-03T08:41:31Z","title":"General OCR Theory: Towards OCR-2.0 via a Unified End-to-end Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01704","snapshot_observed_at":"2026-08-11T13:58:43.722047Z","title":"General ocr theory: Towards ocr-2.0 via a unified end-to-end model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.722047Z"},"links":{"cited_paper":"/paper/2409.01704","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:2140921e6b9b332bd57a49e7be33052299114a00061fbacd6c78e60b945ccc1c","observation_id":"c2718c4b-f368-43ac-ba93-365dc2bff340","resolution":{"observed_at":"2026-08-11T13:58:43.722047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09269","last_updated":"2024-11-07T16:43:01Z","snapshot_observed_at":"2026-08-16T14:18:36.432085Z","submitted_at":"2024-02-14T15:55:30Z","title":"Personalized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09269","snapshot_observed_at":"2026-08-11T13:58:43.727204Z","title":"Personalized large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.727204Z"},"links":{"cited_paper":"/paper/2402.09269","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:bd17091b5714b579ed5114bea0cf06702b24a94b89a39c816617833d313895b5","observation_id":"70b9f28f-a92c-4c73-9dc4-84dba104b9f6","resolution":{"observed_at":"2026-08-11T13:58:43.727204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.733135Z","title":"Semantic parsing by large language models for intricate updating strategies of zero-shot dialogue state tracking","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.733135Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:e017735aebbb7fc7f2ebac298d6b7845042678a7ecc549b2bf8280d784e5066f","observation_id":"ecf8f96d-90c7-4adc-a39b-fdaf917d5b6c","resolution":{"observed_at":"2026-08-11T13:58:43.733135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:44.965346Z","title":"A personalized recommendation system with combinational algorithm for online learning","venue":null,"work_id":"8df044b9-814c-4a3f-82ee-c09f2416cfca","year":2018},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.741505Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:9e4e6d60e8500b7fb9f38f5d1d0405eb895b019d57cf3adfef13904d70e01071","observation_id":"4a2840da-cc7c-4548-b54e-a0c574a08145","resolution":{"observed_at":"2026-08-11T13:58:44.973624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09265","last_updated":"2023-06-15T16:39:24Z","snapshot_observed_at":"2026-08-16T15:23:35.593791Z","submitted_at":"2023-06-15T16:39:24Z","title":"LVLM-eHub: A Comprehensive Evaluation Benchmark for Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09265","snapshot_observed_at":"2026-08-11T13:58:43.747092Z","title":"Lvlm-ehub: A comprehensive evaluation benchmark for large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.747092Z"},"links":{"cited_paper":"/paper/2306.09265","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:aab62b3879d2d3d6244e98afb41e333c772e0cffde5610e857c037f72193c67e","observation_id":"c015c35e-0cf1-480d-b8a2-90a4c24c26d5","resolution":{"observed_at":"2026-08-11T13:58:43.747092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04257","last_updated":"2023-11-09T01:56:51Z","snapshot_observed_at":"2026-08-17T11:19:59.774979Z","submitted_at":"2023-11-07T14:21:29Z","title":"mPLUG-Owl2: Revolutionizing Multi-modal Large Language Model with Modality Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04257","snapshot_observed_at":"2026-08-11T13:58:43.753000Z","title":"mplug-owl2: Revolutionizing multi-modal large language model with modality collaboration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.753000Z"},"links":{"cited_paper":"/paper/2311.04257","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:3975c58c79e6151ea49feea78d759c3524a6eae7812f5eeaa54096c2d6c7edcd","observation_id":"d1ed2b6b-03fb-456a-92ec-44953d7b5657","resolution":{"observed_at":"2026-08-11T13:58:43.753000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16006","last_updated":"2024-04-24T17:37:05Z","snapshot_observed_at":"2026-08-18T11:38:20.286256Z","submitted_at":"2024-04-24T17:37:05Z","title":"MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16006","snapshot_observed_at":"2026-08-11T13:58:43.757280Z","title":"Mmt-bench: A comprehensive multimodal benchmark for evaluating large vision-language models towards multitask agi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.757280Z"},"links":{"cited_paper":"/paper/2404.16006","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:0745fbe23d4f5f14d594deab131e7cd4105f4d8533940719e10a282428e45a90","observation_id":"3f4071c6-3d95-48d8-91fc-6fcd2733ea34","resolution":{"observed_at":"2026-08-11T13:58:43.757280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.763019Z","title":"From image descriptions to visual denotations: New similarity metrics for semantic inference over event descriptions","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.763019Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:295e5baf16923678b4dbd8c7d70d7ca1947b881147c88b71c536158be901dd1b","observation_id":"1bbe3653-9142-45ff-968e-cde9f4e7368d","resolution":{"observed_at":"2026-08-11T13:58:43.763019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-11T13:58:43.767347Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.767347Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:44de81f73b0358b8b864cb49130edba0d1e02abd16d6e430f95e67a57a39ea33","observation_id":"76dfa791-c02a-46b1-9785-d0b68b50a7a8","resolution":{"observed_at":"2026-08-11T13:58:43.767347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-18T03:16:44.825874Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-11T13:58:43.771382Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.771382Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:4eb404aaf52049e68b4622b62b6e0f2d25b47d1583b3c6a81536390398fc773f","observation_id":"169bfd2a-f537-4779-8c1e-ffe4530ec6d2","resolution":{"observed_at":"2026-08-11T13:58:43.771382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-08-16T18:17:11.146813Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-11T13:58:43.776877Z","title":"Scaling relationship on learning mathematical reasoning with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.776877Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:8caf79a318cdc9b0c8eb1d0a67b54869abe08f4be9d18bb3932ef1bc36e9bf1a","observation_id":"e2489bfd-bdb8-4413-b276-694b944b2386","resolution":{"observed_at":"2026-08-11T13:58:43.776877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16502","last_updated":"2024-06-13T15:02:39Z","snapshot_observed_at":"2026-08-17T13:10:52.611064Z","submitted_at":"2023-11-27T17:33:21Z","title":"MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16502","snapshot_observed_at":"2026-08-11T13:58:43.782502Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.782502Z"},"links":{"cited_paper":"/paper/2311.16502","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:02d0385f7d4c864c30463d9f2ce876ec17b8427ded7bdc6bd4f41cbce48a572d","observation_id":"8f28d167-8cd8-4186-99c4-4be10471f6a9","resolution":{"observed_at":"2026-08-11T13:58:43.782502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02813","last_updated":"2025-05-22T08:22:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-04T15:31:26Z","title":"MMMU-Pro: A More Robust Multi-discipline Multimodal Understanding Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02813","snapshot_observed_at":"2026-08-11T13:58:43.789098Z","title":"Mmmu-pro: A more robust multi-discipline multimodal understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.789098Z"},"links":{"cited_paper":"/paper/2409.02813","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:f2efa73487d15fe3ef5be63b4c85003f2f7d9cc9acbc7306a029215c0dc658a9","observation_id":"b18da9f8-9b06-43dc-ac0b-bf3b40577730","resolution":{"observed_at":"2026-08-11T13:58:43.789098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03548","last_updated":"2024-05-23T16:34:35Z","snapshot_observed_at":"2026-08-16T13:55:00.543335Z","submitted_at":"2024-05-06T15:11:38Z","title":"MAmmoTH2: Scaling Instructions from the Web","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03548","snapshot_observed_at":"2026-08-11T13:58:43.794129Z","title":"Mammoth2: Scaling instructions from the web, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.794129Z"},"links":{"cited_paper":"/paper/2405.03548","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:8e535143286a4114e208f875988483084213b5b5f76982b687a90ef2ddf0ff8c","observation_id":"0c97adbc-f256-419b-9e92-7da13b58b7e4","resolution":{"observed_at":"2026-08-11T13:58:43.794129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07641","last_updated":"2024-04-16T04:50:08Z","snapshot_observed_at":"2026-08-16T14:53:00.200868Z","submitted_at":"2023-10-11T16:38:11Z","title":"Evaluating Large Language Models at Evaluating Instruction Following","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07641","snapshot_observed_at":"2026-08-11T13:58:43.799919Z","title":"Evaluating large language models at evaluating instruction following","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.799919Z"},"links":{"cited_paper":"/paper/2310.07641","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:4d5f1845c641c8089997f81b6a157601940d8d1ee73778f0a9000fbcb75b8333","observation_id":"02e21430-a93b-4918-aaf4-649a4ea95099","resolution":{"observed_at":"2026-08-11T13:58:43.799919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13601","last_updated":"2024-05-28T05:36:23Z","snapshot_observed_at":"2026-08-16T14:24:48.404762Z","submitted_at":"2024-01-24T17:10:45Z","title":"MM-LLMs: Recent Advances in MultiModal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13601","snapshot_observed_at":"2026-08-11T13:58:43.805154Z","title":"Mm-llms: Recent advances in multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.805154Z"},"links":{"cited_paper":"/paper/2401.13601","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:0531a5c68541ddcad04dfbcb57b03e5679ad4d46e7c9e9273af1c88a3556d5bb","observation_id":"55366806-e098-4c45-8ef3-860f8c55455f","resolution":{"observed_at":"2026-08-11T13:58:43.805154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:44.930928Z","title":"Mathverse: Does your multi-modal llm truly see the diagrams in visual math problems? In European Conference on Computer Vision, pp.\\ 169--186","venue":null,"work_id":"ce7a05be-9125-4731-8dbb-e38ee0b5fd9d","year":2025},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.809774Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:864b6b7d458367cbaffc5ca890ae9a9a952595980dc1f2625dadc019784e0284","observation_id":"a230f91a-5c7f-41a5-9ffb-f731541a4d79","resolution":{"observed_at":"2026-08-11T13:58:44.943283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-11T13:58:43.814376Z","title":"A survey of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.814376Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:774f84ea6d1858193d263ad9e86bda92870e30bb9b455cd88517da485d6412c8","observation_id":"ad5fc014-eec6-4c74-b725-cf8124b49acf","resolution":{"observed_at":"2026-08-11T13:58:43.814376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.819656Z","title":"Object detection with deep learning: A review","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.819656Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:69f83faad4fe4474eedfccd5dfa9e6609eda7f7a3ecb7c7a4c56dfd4f84f6815","observation_id":"f35c8cb9-0359-463d-9ea6-edb9bd87a4cd","resolution":{"observed_at":"2026-08-11T13:58:43.819656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.825922Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.825922Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:f14cf1ee3897c49ce5fd2066538c195db77c86b89f7f75a32d3c0893f4d0f668","observation_id":"befa72f8-d176-40f0-a75f-65648ab78507","resolution":{"observed_at":"2026-08-11T13:58:43.825922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-11T13:58:43.830736Z","title":"Instruction-following evaluation for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.830736Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:54a9aa4d351a97709b865b637eaba2ca20bfa3ebc5fc2bcb47c2d7fa7b1a38c2","observation_id":"89bf8cac-88b6-427d-b616-668b65262bde","resolution":{"observed_at":"2026-08-11T13:58:43.830736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08640","last_updated":"2024-09-25T09:53:13Z","snapshot_observed_at":"2026-08-16T13:26:03.578605Z","submitted_at":"2024-08-16T10:11:05Z","title":"Math-PUMA: Progressive Upward Multimodal Alignment to Enhance Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08640","snapshot_observed_at":"2026-08-11T13:58:43.836724Z","title":"Math-puma: Progressive upward multimodal alignment to enhance mathematical reasoning, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.836724Z"},"links":{"cited_paper":"/paper/2408.08640","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:04b8cac959a1cd3e0800eab7266df8accf7b14a87b47836ac6fab0420da459d2","observation_id":"9ba37466-42e2-47e4-9582-dbb7d810b0e6","resolution":{"observed_at":"2026-08-11T13:58:43.836724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02888","last_updated":"2024-10-25T21:01:05Z","snapshot_observed_at":"2026-08-18T05:16:55.115602Z","submitted_at":"2024-06-05T03:08:46Z","title":"HYDRA: Model Factorization Framework for Black-Box LLM Personalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02888","snapshot_observed_at":"2026-08-11T13:58:43.843207Z","title":"Hydra: Model factorization framework for black-box llm personalization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.843207Z"},"links":{"cited_paper":"/paper/2406.02888","citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:a5928262c81ad2405e6dcc526458d9e2294429b77fa3d2eeda19ce1564acdd0e","observation_id":"97f20e49-4ca3-4fab-852a-f720c084889b","resolution":{"observed_at":"2026-08-11T13:58:43.843207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.848709Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.848709Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:2ea4be8444e71f4ad57c2c818e0c99b23552ce8a75461540bfc370a0fa68c1f2","observation_id":"175a73d8-2690-4578-b94c-0eaceb6d8e94","resolution":{"observed_at":"2026-08-11T13:58:43.848709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.854735Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.854735Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:001bae539bc96a6448e4dc17310a26121bad45af86657d9bff1d0e767c9662be","observation_id":"cb39c316-9209-42af-a770-8112aad90dc6","resolution":{"observed_at":"2026-08-11T13:58:43.854735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.861637Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.861637Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:32a3769fcbdb55b8da775bc521d46766b29655d3f4237727ff591a30d73fe516","observation_id":"800a1a3e-3817-41fb-9ec5-ebd979d6e730","resolution":{"observed_at":"2026-08-11T13:58:43.861637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:58:43.866369Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-11T13:58:43.866369Z"},"links":{"citing_paper":"/paper/2412.12606"},"observation_digest":"sha256:51f9da12b5baf5812135a4b402868c0171cfe4921326a6748ddd5e9c16b7b3a5","observation_id":"f18b5d6a-8c82-4beb-bb2b-35aaa5952579","resolution":{"observed_at":"2026-08-11T13:58:43.866369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12606","last_updated":"2024-12-17T07:06:10Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-19T12:28:31.813610Z","submitted_at":"2024-12-17T07:06:10Z","title":"Multi-Dimensional Insights: Benchmarking Real-World Personalization in Large Multimodal Models"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":75,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 0 inbound Pith citation observations for arXiv:2412.12606."}