{"as_of":"2026-08-09T19:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bfcaff4ad1b078ef3b28d3d75e9d37707786dd6a9762bd479d6e22577bd911d","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:13:26.922092Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05249/citation-record","integrity":"/paper/2608.05249/integrity","json":"/paper/2608.05249/citation-record.json","paper":"/paper/2608.05249"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.949748Z","title":"Introducing GPT-5.4","venue":null,"work_id":"71fe9b4d-8f1c-4ebe-b4b3-186e2c2d53e0","year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.189539Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:297497fc9bbcfb94cd7fa603a254c71e0f9b70090e701b4415eb64b331a94dd9","observation_id":"bbbd0fb4-85f1-454b-b22f-ca54c55ef7ad","resolution":{"observed_at":"2026-08-08T17:13:28.955196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-08T17:13:25.253066Z","title":"Qwen3-VL Technical Report, November 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.253066Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:e3cc853b40f28920f447539d4db49897a28c3d116f707779f19fb8b43c9ebeb3","observation_id":"d4f4be81-3b5c-4eb9-8d6d-d70c159e3316","resolution":{"observed_at":"2026-08-08T17:13:25.253066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05840","last_updated":"2024-12-31T14:46:47Z","snapshot_observed_at":"2026-08-01T14:19:40.337956Z","submitted_at":"2024-09-09T17:44:00Z","title":"MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05840","snapshot_observed_at":"2026-08-08T17:13:25.317701Z","title":"MMEvol: Empowering multimodal large language models with evol-instruct.arXiv preprint arXiv:2409.05840, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.317701Z"},"links":{"cited_paper":"/paper/2409.05840","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:9b877446d0733a2142db8982c3174ac1b1776512697454a1fc043a3cb458199e","observation_id":"eab7a051-d5bd-43fb-9752-d1bf0a820f14","resolution":{"observed_at":"2026-08-08T17:13:25.317701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.805661Z","title":"Mulberry: Empowering MLLM with o1-like reasoning and reflection via collective monte carlo tree search","venue":null,"work_id":"bbb5153b-af7a-46e7-83ed-c63bfe77a971","year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.350439Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:1b326247be2471e4b661f3ad3462a026eba9b9707ae17895e92ebe58bc2d6d18","observation_id":"fa99a0dc-e1d9-476c-a108-b9acad9731f4","resolution":{"observed_at":"2026-08-08T17:13:28.890230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-07T09:36:29.319006Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-08T17:13:25.356753Z","title":"LLaVA-CoT: Let vision language models reason step-by-step.arXiv preprint arXiv:2411.10440, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.356753Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:54e1c224b64009481030d8fd766ecb5f7211299f385a57ce47f193fe70364aeb","observation_id":"aee064f1-f62c-4416-acf7-cba6b9c06572","resolution":{"observed_at":"2026-08-08T17:13:25.356753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08741","last_updated":"2025-03-26T09:01:55Z","snapshot_observed_at":"2026-08-07T17:13:57.698335Z","submitted_at":"2025-03-11T08:25:40Z","title":"Oasis: One Image is All You Need for Multimodal Instruction Data Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08741","snapshot_observed_at":"2026-08-08T17:13:25.434877Z","title":"Oasis: One image is all you need for 14 multimodal instruction data synthesis.arXiv preprint arXiv:2503.08741, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.434877Z"},"links":{"cited_paper":"/paper/2503.08741","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:241ccef5a4407ee7e6590902b0f9cdb13d5405f8e932bcc16ac9c0f680f1ac23","observation_id":"4d77cb9a-dc1b-4476-9f86-10805ddb2bde","resolution":{"observed_at":"2026-08-08T17:13:25.434877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.504828Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.504828Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:c4093f1ae63cff2a17c8b368489c965fd5b1c68711fc481126fe52fbd466eded","observation_id":"c94405ad-f735-413f-b423-fcf14d6c2427","resolution":{"observed_at":"2026-08-08T17:13:25.504828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17746","snapshot_observed_at":"2026-08-08T17:13:25.538597Z","title":"Rubrics as rewards: Reinforcement learning beyond verifiable domains.arXiv preprint arXiv:2507.17746, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.538597Z"},"links":{"cited_paper":"/paper/2507.17746","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:7d1e415c85b9cab6c890f1eebbd55faa108fa25a50639a224e89ce4168197f1d","observation_id":"20378077-12fd-4c83-a0e5-e7f1a8d56942","resolution":{"observed_at":"2026-08-08T17:13:25.538597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.611475Z","title":"Alternating reinforcement learning for rubric-based reward modeling in non-verifiable LLM post-training.arXiv preprint arXiv:2602.01511, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.611475Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:2b4b19ea9532c0452a2d141caf8f795a5b1bb83848177546fa72236ed227b680","observation_id":"d3ed71d4-d9be-44bd-af14-320fad3b5962","resolution":{"observed_at":"2026-08-08T17:13:25.611475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08464","snapshot_observed_at":"2026-08-08T17:13:25.668223Z","title":"Magpie: Alignment data synthesis from scratch by prompting aligned LLMs with nothing.arXiv preprint arXiv:2406.08464, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.668223Z"},"links":{"cited_paper":"/paper/2406.08464","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:e409b9aadcb1805b4bfe29e0a812454b7b468c2945cc85c78e1ae442106ee875","observation_id":"074c7df1-d63a-4cde-be05-0ab561f3d6cd","resolution":{"observed_at":"2026-08-08T17:13:25.668223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.696284Z","title":"InFoBench: Evaluating instruction following ability in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.696284Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:410bf7e7ebfe23cd9ad9d2fd61a47733e6909aa8ce94075c70b8dca30b73f5dd","observation_id":"31454cc5-5533-4379-aa2c-3d8b75e05f3a","resolution":{"observed_at":"2026-08-08T17:13:25.696284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16949","last_updated":"2026-08-01T14:42:28Z","snapshot_observed_at":"2026-08-06T23:10:34.815079Z","submitted_at":"2025-08-23T08:47:31Z","title":"Breaking the Exploration Bottleneck: Rubric-Scaffolded Reinforcement Learning for General LLM Reasoning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.16949","snapshot_observed_at":"2026-08-08T17:13:25.707335Z","title":"Breaking the exploration bottleneck: Rubric-scaffolded reinforcement learning for general LLM reasoning.arXiv preprint arXiv:2508.16949, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.707335Z"},"links":{"cited_paper":"/paper/2508.16949","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:d07c63a97c0d5af4da207cd0c0c1c5e2500854074a8769ccfab6e54e2d63f928","observation_id":"d6f4bcc6-1055-455a-9355-bf3c0db2bbdf","resolution":{"observed_at":"2026-08-08T17:13:25.707335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.790380Z","title":"Cambrian-1: A fully open, vision-centric exploration of multimodal llms.Advances in Neural Information Processing Systems, 37:87310–87356, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.790380Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:e0c4f0e0555635dc3a72fc4b6123906ecbd4aeb463823773b104818d2a48b30a","observation_id":"b3002793-658d-414a-90a3-7f8ac7c7dc11","resolution":{"observed_at":"2026-08-08T17:13:25.790380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.599822Z","title":"Seed 2.0 Model Card","venue":null,"work_id":"495f848d-f667-49b1-bf16-093648542946","year":2026},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.855352Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:7bd21652132b19129e4606011533c730fcada8aaa8e4d87aeaebd6ee8e8765bd","observation_id":"53b67008-da19-4ca7-b9fd-81067528ad38","resolution":{"observed_at":"2026-08-08T17:13:28.605107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11684","last_updated":"2024-06-17T07:55:59Z","snapshot_observed_at":"2026-07-06T17:31:53.996417Z","submitted_at":"2024-02-18T19:26:49Z","title":"ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11684","snapshot_observed_at":"2026-08-08T17:13:25.889313Z","title":"Allava: Harnessing gpt4v-synthesized data for a lite vision-language model.arXiv preprint arXiv:2402.11684, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.889313Z"},"links":{"cited_paper":"/paper/2402.11684","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:883ba0487c04fe4e0b7f2dcd425d582e54ee5a554fdb9038b04500e7bb582962","observation_id":"66725781-3aae-42f1-8df6-8a58e16f5012","resolution":{"observed_at":"2026-08-08T17:13:25.889313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.905148Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.905148Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:9b7cf35e7c862b36e1afcb5e16b1538a9a0a4dcea5dc210e2c7a1a89b9234d0f","observation_id":"cb8a6de7-a0d1-4dac-a638-8042208c8c64","resolution":{"observed_at":"2026-08-08T17:13:25.905148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06783","last_updated":"2023-11-12T09:10:51Z","snapshot_observed_at":"2026-07-06T16:46:10.142093Z","submitted_at":"2023-11-12T09:10:51Z","title":"Q-Instruct: Improving Low-level Visual Abilities for Multi-modality Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06783","snapshot_observed_at":"2026-08-08T17:13:25.910608Z","title":"Q-instruct: Improving low-level visual abilities for multi-modality foundation models.arXiv preprint arXiv:2311.06783, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.910608Z"},"links":{"cited_paper":"/paper/2311.06783","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:02d2b0d50fbf3994823cd49348405685c2969aebaa60728c41d62724d2d30e4b","observation_id":"f225b0fa-d5d9-4574-8a25-a4ac93456240","resolution":{"observed_at":"2026-08-08T17:13:25.910608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.567814Z","title":null,"venue":null,"work_id":"fa2e5e10-39cc-461e-bf94-b551561ce0a8","year":2020},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.916452Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:a2110a91e8cb83e8638537417a775b96c40e8be3629dae4bf79bbdd9f11b9624","observation_id":"78783983-aa1b-438e-b0e4-4bc3bd6c4482","resolution":{"observed_at":"2026-08-08T17:13:28.579043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16101","last_updated":"2023-11-27T18:59:42Z","snapshot_observed_at":"2026-08-08T00:07:32.122707Z","submitted_at":"2023-11-27T18:59:42Z","title":"How Many Unicorns Are in This Image? A Safety Evaluation Benchmark for Vision LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16101","snapshot_observed_at":"2026-08-08T17:13:25.940793Z","title":"How many unicorns are in this image? a safety evaluation benchmark for vision llms.arXiv preprint arXiv:2311.16101, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.940793Z"},"links":{"cited_paper":"/paper/2311.16101","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:d479f447a0e04f5674f6791a6c25452a7ddc914e443bc4d3899214e3b5d4e6f8","observation_id":"2cc8404a-8f16-4ec7-8f39-8bc631564e22","resolution":{"observed_at":"2026-08-08T17:13:25.940793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10292","last_updated":"2024-10-07T19:13:47Z","snapshot_observed_at":"2026-07-06T18:15:24.541427Z","submitted_at":"2024-05-16T17:50:19Z","title":"Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10292","snapshot_observed_at":"2026-08-08T17:13:25.992116Z","title":"Fine-tuning large vision-language models as decision-making agents via reinforcement learning.arXiv preprint arXiv:2405.10292, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.992116Z"},"links":{"cited_paper":"/paper/2405.10292","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:08e599e050e54607acb2c633b979d4d1868675c4439f861434893c41d0da14e7","observation_id":"f1f80f45-9484-4442-bc68-1e528424f735","resolution":{"observed_at":"2026-08-08T17:13:25.992116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:25.996787Z","title":"Vizwiz grand challenge: Answering visual questions from blind people","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.996787Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:69a921785055c7b30f5e25f195011e410e08cb9ae9c4a3d150626c0214921bfa","observation_id":"1d615319-06fa-4995-a5f3-564688c3b98c","resolution":{"observed_at":"2026-08-08T17:13:25.996787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09717","last_updated":"2024-02-15T05:22:04Z","snapshot_observed_at":"2026-08-02T21:09:22.790607Z","submitted_at":"2024-02-15T05:22:04Z","title":"Visually Dehallucinative Instruction Generation: Know What You Don't Know","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09717","snapshot_observed_at":"2026-08-08T17:13:26.001095Z","title":"Visually dehallucinative instruction generation: Know what you don’t know.arXiv preprint arXiv:2402.09717, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.001095Z"},"links":{"cited_paper":"/paper/2402.09717","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:9f6f38846f0adbf66d34a651760c358e1d0eac731296ed2563cf18ff49f0641a","observation_id":"d6621171-0bb7-4cf9-a371-f652107c6574","resolution":{"observed_at":"2026-08-08T17:13:26.001095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.483085Z","title":"Shamma, Michael S","venue":null,"work_id":"c441233d-e283-4cf2-86cc-9850d6686881","year":2016},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.005536Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:16151f33016692ca5b093280249563285bd3209d54cac04bd5ed16ede20b14f4","observation_id":"b6c036b1-8a5a-4a08-810c-667bd23e0559","resolution":{"observed_at":"2026-08-08T17:13:28.534941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.361290Z","title":"Hudson and Christopher D","venue":null,"work_id":"7e9fc7ac-ecec-4c95-9fb5-d291b4fec61d","year":2019},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.011211Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:7678104de7e92d81844f61f99107a124533ece8427c8256ceada46869aa9e123","observation_id":"9ab7595b-4d01-4ca5-ae50-fa5b75d6cea9","resolution":{"observed_at":"2026-08-08T17:13:28.430154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.344700Z","title":"Dvqa: Understanding data visualizations via question answering","venue":null,"work_id":"96ed01bd-d50a-4148-8eb5-d70d8e4aaba7","year":2018},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.016063Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:cf8ee2c8a46751ef4c23b1b111c905da3c6aed37ddae19631f6bad05adea5501","observation_id":"cdfc299c-6d6c-423b-9d5a-1b6f30a74bef","resolution":{"observed_at":"2026-08-08T17:13:28.349913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.327661Z","title":"Donut: Document understanding transformer without ocr","venue":null,"work_id":"50a29af9-99de-41d5-ab65-84dffeba3cd9","year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.020619Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:adf1cb2a4fc8a17f6724ea4d1984b8c3a0f8c25bf16e83247253fc19749b6799","observation_id":"3baaa5d1-c38b-47e8-a1e6-b337a0f28737","resolution":{"observed_at":"2026-08-08T17:13:28.333073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00231","last_updated":"2024-06-02T15:47:16Z","snapshot_observed_at":"2026-07-06T17:37:52.514730Z","submitted_at":"2024-03-01T02:21:30Z","title":"Multimodal ArXiv: A Dataset for Improving Scientific Comprehension of Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00231","snapshot_observed_at":"2026-08-08T17:13:26.025156Z","title":"Multimodal arxiv: A dataset for improving scientific comprehension of large vision-language models.arXiv preprint arXiv:2403.00231, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.025156Z"},"links":{"cited_paper":"/paper/2403.00231","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:6bf1cf59be95741b3cd0bde091944e48fbc95b21f058c83572963d5490d1d73d","observation_id":"c4c2cf58-85e1-4a9c-9d72-cfc0dda00e0d","resolution":{"observed_at":"2026-08-08T17:13:26.025156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.029929Z","title":"A diagram is worth a dozen images","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.029929Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:024dbd485f5f2c653adbfd95f98c30b32fc0ceb4f7eb965f0d3b8af08438feca","observation_id":"181bbf3e-25e8-4479-8ee5-781dc0e59989","resolution":{"observed_at":"2026-08-08T17:13:26.029929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.08199","last_updated":"2025-02-09T21:09:17Z","snapshot_observed_at":"2026-08-09T11:44:57.468967Z","submitted_at":"2022-09-16T23:49:00Z","title":"ScreenQA: Large-Scale Question-Answer Pairs over Mobile App Screenshots","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.08199","snapshot_observed_at":"2026-08-08T17:13:26.034113Z","title":"Screenqa: Large-scale question-answer pairs over mobile app screenshots.arXiv preprint arXiv:2209.08199, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.034113Z"},"links":{"cited_paper":"/paper/2209.08199","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:cfe0643262340a8d20ff32bf0002134dfc0bab59fa9f5b769a0fad26a52a8911","observation_id":"dd9c2897-ffbc-406d-b54b-63c56c1946b3","resolution":{"observed_at":"2026-08-08T17:13:26.034113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17107","last_updated":"2024-02-02T19:44:14Z","snapshot_observed_at":"2026-07-06T15:48:29.049336Z","submitted_at":"2023-06-29T17:08:16Z","title":"LLaVAR: Enhanced Visual Instruction Tuning for Text-Rich Image Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17107","snapshot_observed_at":"2026-08-08T17:13:26.039380Z","title":"Llavar: Enhanced visual instruction tuning for text-rich image understanding.arXiv preprint arXiv:2306.17107, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.039380Z"},"links":{"cited_paper":"/paper/2306.17107","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:debf0b8e72400119ee51723cc0784d22a9748013be05d3f47cc5ab78c9a0aa18","observation_id":"7cab4f00-62f7-40d1-9b1f-c814d20e9488","resolution":{"observed_at":"2026-08-08T17:13:26.039380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.260369Z","title":"Docvqa: A dataset for vqa on document images","venue":null,"work_id":"7372eeff-ef92-4b9d-9a19-a9cdd1949cd6","year":2021},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.044061Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:aa3ce0ffeddffb7fab5ab975440b320541ab0bd4e145beb5f2dea02dda3d8bb5","observation_id":"95793b90-2f10-46b9-b5fd-3a9f5965ed85","resolution":{"observed_at":"2026-08-08T17:13:28.300567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.048832Z","title":"Chartqa: A benchmark for question answering about charts with visual and logical reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.048832Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:6fd7e8ae8685594c4ba1e1dc04132c2e19cdf69891f7ee648165aba6c27761f0","observation_id":"916d1ab7-c5cb-4d7f-97b0-475d858014dc","resolution":{"observed_at":"2026-08-08T17:13:26.048832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.00103","last_updated":"2017-11-09T23:06:14Z","snapshot_observed_at":"2026-08-03T05:45:09.122112Z","submitted_at":"2017-08-31T23:12:15Z","title":"Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.00103","snapshot_observed_at":"2026-08-08T17:13:26.053348Z","title":"Seq2sql: Generating structured queries from natural language using reinforcement learning.arXiv preprint arXiv:1709.00103, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.053348Z"},"links":{"cited_paper":"/paper/1709.00103","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:ecd9b70eac29096f4bd6a911616d7546df3dec5d8f5964460e974e2a5b7ac67f","observation_id":"a365ac9b-178f-478a-86b1-ad3532ab30f7","resolution":{"observed_at":"2026-08-08T17:13:26.053348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.234852Z","title":"Ocr-vqa: Visual question answering by reading text in images","venue":null,"work_id":"fc7062f2-2842-41ba-a40a-80a9015ef4da","year":2019},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.104862Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:da6bf3acec499a904590e4a9621161e8099d4da9ad2cf0b7a79240285c9a104c","observation_id":"c122808b-f685-494f-8df5-042bfd420964","resolution":{"observed_at":"2026-08-08T17:13:28.240012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.200471Z","title":"Compositional semantic parsing on semi-structured tables","venue":null,"work_id":"a7794d75-f23c-43c0-a810-45747c580120","year":2015},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.128073Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:bcc10c5c511391a4132e5b4b4f3a23bbc3d26423aa84b7a6f16af81202d05ba6","observation_id":"f429713f-e621-4efc-b12c-0c68bc3e7a82","resolution":{"observed_at":"2026-08-08T17:13:28.223898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.113258Z","title":"Iconqa: A new benchmark for abstract diagram understanding and visual language reasoning","venue":null,"work_id":"7d0bc77c-845c-42f0-80d6-93e0b131782a","year":2021},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.155115Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:3d5bb19572e1108f3de1afc76ff4972228b2ab0ed4951aa297190b117f309be3","observation_id":"c4c72c40-40e2-46ad-98d8-04d0ad4ce66b","resolution":{"observed_at":"2026-08-08T17:13:28.152949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.098236Z","title":"Clevr: A diagnostic dataset for compositional language and elementary visual reasoning","venue":null,"work_id":"c8eadcac-ef76-48cc-bf58-40efe36b6161","year":2017},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.184297Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:5352ed790aeed9b8f409e4dad3c5a6db63dec0e7ed5f54dc6bcc538418b4f663","observation_id":"e6f73a19-1da4-41bf-a858-a685e4066792","resolution":{"observed_at":"2026-08-08T17:13:28.103105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.083828Z","title":"Tallyqa: Answering complex counting questions","venue":null,"work_id":"06d7dc12-917b-4f54-97cd-b3b3e9df142f","year":2019},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.188249Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:e745c6cc40cb3cc128a2362c6054cd4b3c0eed1eb896d05755aa24e493b4c2dc","observation_id":"6d2607da-9cd2-400c-bd00-8d1fff846d10","resolution":{"observed_at":"2026-08-08T17:13:28.088458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11370","last_updated":"2025-08-20T15:45:11Z","snapshot_observed_at":"2026-08-02T03:18:39.824103Z","submitted_at":"2023-12-18T17:36:20Z","title":"G-LLaVA: Solving Geometric Problem with Multi-Modal Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11370","snapshot_observed_at":"2026-08-08T17:13:26.193653Z","title":"G-llava: Solving geometric problem with multi-modal large language model.arXiv preprint arXiv:2312.11370, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.193653Z"},"links":{"cited_paper":"/paper/2312.11370","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:b11d04b25b275b6e8e50c1b23b27d4ef01e4030946c38b1274244491c82b4ef1","observation_id":"bdfc0a12-ee5f-4e2e-bc30-01955c88abf6","resolution":{"observed_at":"2026-08-08T17:13:26.193653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.198541Z","title":"Measuring multimodal mathematical reasoning with math-vision dataset.Advances in Neural Information Processing Systems, 37:95095–95169, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.198541Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:50d9ce8dfc74399c3519d02e82b839663c2b7942a6c9e8b16ccd9427867a24b9","observation_id":"ab97f596-b2db-4d68-800c-659f9b6dd19c","resolution":{"observed_at":"2026-08-08T17:13:26.198541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.058513Z","title":"Raven: A dataset for relational and analogical visual reasoning","venue":null,"work_id":"102bc6bb-fb20-4725-aeeb-d2e940b25127","year":2019},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.202902Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:609b6c6edb07669d1b1a495e10fc5fd1905cff5d0672cde192862d2d3dd519c8","observation_id":"10dc1878-4909-4f33-b1c1-a9e56435416b","resolution":{"observed_at":"2026-08-08T17:13:28.064382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10286","last_updated":"2020-03-07T17:55:41Z","snapshot_observed_at":"2026-07-06T09:06:42.071993Z","submitted_at":"2020-03-07T17:55:41Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.10286","snapshot_observed_at":"2026-08-08T17:13:26.207581Z","title":"Xing, and Pengtao Xie","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.207581Z"},"links":{"cited_paper":"/paper/2003.10286","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:2d9d203c83c6355db1e2b10cd6e64f64c6dc94546f0cd8847697cc14cd0603f7","observation_id":"e1144657-2cef-4a6f-a92f-c5f128c1b7dc","resolution":{"observed_at":"2026-08-08T17:13:26.207581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.024727Z","title":"Learn to explain: Multimodal reasoning via thought chains for science question answering","venue":null,"work_id":"04585206-f115-42a2-96b6-8e3ea8a7004c","year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.236779Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:040f5793e29094a330d2a8ba61f562f1b3431a4158c975d8851231a2c683509c","observation_id":"f596d7f7-ae26-4293-9dcd-e629250145de","resolution":{"observed_at":"2026-08-08T17:13:28.046794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-08T17:13:26.317500Z","title":"Internvl3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.317500Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:e58c823ebed28039963239628eeb2c6a3b2edcdbbcb36f469151b461c86914d2","observation_id":"63e9de72-b78a-4f9e-965f-0981542128b0","resolution":{"observed_at":"2026-08-08T17:13:26.317500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.928382Z","title":"Qwen3.5.https://qwen.ai/blog?id=qwen3.5, 2026","venue":null,"work_id":"907bceac-33c6-464d-aee2-601cb48f87f8","year":2026},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.415496Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:90d5fe1dc80241fcce8e77d3b382de47d93e4bf70729e5912f43973e82688975","observation_id":"493a1714-0e5d-42b3-9e73-fa73398c8b58","resolution":{"observed_at":"2026-08-08T17:13:27.980922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-08T17:13:26.532378Z","title":"Llava-next-interleave: Tackling multi-image, video, and 3d in large multimodal models.arXiv preprint arXiv:2407.07895, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.532378Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:eabe9c3d36b4628746e749ad0129187d585da1ec916ea2cb99baa244f39d2b4d","observation_id":"0406641e-16e3-4a65-b912-43c1c0791f4d","resolution":{"observed_at":"2026-08-08T17:13:26.532378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.545256Z","title":"Mmbench: Is your multi-modal model an all-around player? In European conference on computer vision, pages 216–233","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.545256Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:22976095f68e488df6b4b732c16766fb49734223325616542405d64de8bc88f3","observation_id":"8e4efd0d-59eb-416a-9989-6e7aa5f279b0","resolution":{"observed_at":"2026-08-08T17:13:26.545256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.881425Z","title":"Mme: A comprehensive evaluation benchmark for multimodal large language models.Advances in Neural Information Processing Systems, 38, 2026","venue":null,"work_id":"62ab48de-a2e2-4fa0-b1c8-f4310df2ee2f","year":2026},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.557534Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:69e1b24ea5d70f8aa9ffb7a2441e523b15374871030800786a76650b3f997f41","observation_id":"54d662d8-e2e9-4e53-bf17-da6b1aebd5cf","resolution":{"observed_at":"2026-08-08T17:13:27.903221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.594626Z","title":"Are we on the right way for evaluating large vision-language models?Advances in Neural Information Processing Systems, 37:27056–27087, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.594626Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:055f25e5bea4f02ccdf7ae98411e6704811fe4c1b1deb7fd66960da91f01abfa","observation_id":"dc02aaa0-93c2-421f-b76f-5ea8d3104256","resolution":{"observed_at":"2026-08-08T17:13:26.594626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.599460Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.599460Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:d2c488a496e0611ae32b4b823ce6d1fb0e3f081a1f3bcb1b75240f3e4e5883ba","observation_id":"c996c68b-0240-4af9-908d-f5fe5e93e808","resolution":{"observed_at":"2026-08-08T17:13:26.599460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.682248Z","title":"Ocrbench: on the hidden mystery of ocr in large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.682248Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:e4352910046ae20aac3bf36a9db9e02c2c3054b1591ce72f840e0b2caa5a421e","observation_id":"b5ac2766-49ff-4252-b7b6-7f1a9bc6296f","resolution":{"observed_at":"2026-08-08T17:13:26.682248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:26.740499Z","title":"Infographicvqa","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.740499Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:a3ecb844d848ee7a447048c9d12104c670f4745466b320d917bf0152d4c71093","observation_id":"f85070c1-1962-4b10-9124-6dbfaace9535","resolution":{"observed_at":"2026-08-08T17:13:26.740499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.694210Z","title":"Charxiv: Charting gaps in realistic chart understanding in multimodal llms.Advances in Neural Information Processing Systems, 37:113569–113697, 2024","venue":null,"work_id":"e2c331b4-bee8-4901-963a-cf61c9f37378","year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.790069Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:bad0d4438566a8d948ba531d306b945c91e1696b8e63eef9a5fe28bff232ba05","observation_id":"bb23239e-eaa4-4e9a-8a53-7063e9784fc6","resolution":{"observed_at":"2026-08-08T17:13:27.747015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.678880Z","title":"Dynamath: A dynamic visual benchmark for evaluating mathematical reasoning robustness of vision language models","venue":null,"work_id":"ae0133c7-2418-4c6c-a459-352fb361b100","year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.808841Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:9a13ac223ffb58b954047aa48a6c45fb3c41b845650c0f3d38ef1b36ec49880a","observation_id":"c5c58c3f-cf17-4536-b405-30d0bd95a173","resolution":{"observed_at":"2026-08-08T17:13:27.683662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04973","last_updated":"2024-07-06T06:48:16Z","snapshot_observed_at":"2026-07-06T18:42:18.289966Z","submitted_at":"2024-07-06T06:48:16Z","title":"LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04973","snapshot_observed_at":"2026-08-08T17:13:26.813213Z","title":"Logicvista: Multimodal llm logical reasoning benchmark in visual contexts.arXiv preprint arXiv:2407.04973, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.813213Z"},"links":{"cited_paper":"/paper/2407.04973","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:10700bb9eaf69a5de1ac8795398df2f8409a8b8c95b9ac75b2a57ceb818eedaa","observation_id":"f055aed7-104b-45c2-b333-5414663d6db0","resolution":{"observed_at":"2026-08-08T17:13:26.813213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15279","last_updated":"2025-04-21T17:59:53Z","snapshot_observed_at":"2026-08-07T16:00:29.784743Z","submitted_at":"2025-04-21T17:59:53Z","title":"VisuLogic: A Benchmark for Evaluating Visual Reasoning in Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15279","snapshot_observed_at":"2026-08-08T17:13:26.818239Z","title":"Visulogic: A benchmark for evaluating visual reasoning in multi-modal large language models.arXiv preprint arXiv:2504.15279, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.818239Z"},"links":{"cited_paper":"/paper/2504.15279","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:d0718b6a3c36f76712fd5fbeb4522e0adca278047c0d6d317cb2c5caf74d5573","observation_id":"9c07e80c-8c6e-4c9b-bf64-63ffcb13b6a7","resolution":{"observed_at":"2026-08-08T17:13:26.818239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12066","last_updated":"2023-02-23T14:43:53Z","snapshot_observed_at":"2026-08-09T17:48:21.480303Z","submitted_at":"2023-02-23T14:43:53Z","title":"Teaching CLIP to Count to Ten","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12066","snapshot_observed_at":"2026-08-08T17:13:26.824188Z","title":"Teaching CLIP to Count to Ten.arXiv preprint arXiv:2302.12066, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.824188Z"},"links":{"cited_paper":"/paper/2302.12066","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:b8acb769589370f9a6aeb7ec717a1c5da11ab7a6e1a5fbdae32d689f0741ec1b","observation_id":"5a064eed-8027-4c0d-aa53-ed40ede678cc","resolution":{"observed_at":"2026-08-08T17:13:26.824188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:27.554060Z","title":"Gemini 3 Flash: Frontier intelligence built for speed","venue":null,"work_id":"f5908791-8dcb-46d5-8eac-60d90a811947","year":2025},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.829420Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:e31d4861468ea20c122578469bd0fe6feb2d17544bb5088c805a504c07a069fe","observation_id":"2e65b108-92c2-4bbe-87e8-bdf2f6443239","resolution":{"observed_at":"2026-08-08T17:13:27.624851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-08T17:13:26.922092Z","title":"usage intent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:26.922092Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:68dbebc695a385e8b0b95bbbbdce0d78ff463b87aa52db3d3ffb76dd1a7194e9","observation_id":"f30d611f-84a1-464d-9887-8b5bbaecf849","resolution":{"observed_at":"2026-08-08T17:13:26.922092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:13:28.626534Z","title":null,"venue":null,"work_id":"91117cef-aed2-4b08-a941-5dc856894563","year":2024},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":772,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.702217Z"},"links":{"citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:5414890853acadaca91e09fbdfab875828aabf22d0b91fa38b774724c1f3e6d6","observation_id":"f90efd05-8d87-4757-830d-b03b58f172ba","resolution":{"observed_at":"2026-08-08T17:13:28.706527Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-08T17:13:25.500185Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T17:13:25.500185Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2608.05249"},"observation_digest":"sha256:d6be9b43451a6ce7ab2aca9c41fefe309d3ae669366572b9484ddb191b2c849e","observation_id":"7117009a-84ae-4a84-bcbf-78d3610513e2","resolution":{"observed_at":"2026-08-08T17:13:25.500185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05249","last_updated":"2026-08-05T15:55:15Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T19:10:50.893366Z","submitted_at":"2026-08-05T15:55:15Z","title":"PRISM: Priority-aware Rubric Internalization via Structured Multimodal Data Synthesis"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 0 inbound Pith citation observations for arXiv:2608.05249."}