{"as_of":"2026-08-20T03:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba10ada94c2d90e75ab7840c5b593da875b54d239d89db6f0b5a3f63f96556bb","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:35:21.395160Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.12511/citation-record","integrity":"/paper/2504.12511/integrity","json":"/paper/2504.12511/citation-record.json","paper":"/paper/2504.12511"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-08-17T03:00:38.806206Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-16T12:35:20.970028Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:20.970028Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:529a09a66fe0e2ed99dcdec2272099e0445a80196ea8929287e7ccda5b1cd61c","observation_id":"68025b43-0464-4867-b2c2-7fe2d824f613","resolution":{"observed_at":"2026-08-16T12:35:20.970028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:20.976571Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:20.976571Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:9689814d3cec6ade6c6092a0154e28c84da20edd84fc5796154a550a6e827d3a","observation_id":"971d8b41-4df4-4969-9786-de5f9b841cf0","resolution":{"observed_at":"2026-08-16T12:35:20.976571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.502198Z","title":null,"venue":null,"work_id":"0b6ac074-c2dc-475b-9684-5ad0298cd662","year":1950},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:20.981714Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:d38e7d40a427309a50744325f37297a7f3b05982ca879b170023c25baa185220","observation_id":"a35703bb-e79f-4492-918b-3e04039a744c","resolution":{"observed_at":"2026-08-16T12:35:23.510369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-16T12:35:20.987180Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:20.987180Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:58a9ead2897516f428cc2f1557161490024924cc958c60fef0812dbf34403091","observation_id":"f2dec945-8430-4f86-97f4-2a7d9065ef80","resolution":{"observed_at":"2026-08-16T12:35:20.987180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:20.992344Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:20.992344Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:a841ac8a526d25e140e829a3d1656f1baef698c4672b3a1345a1d8fbb6be729a","observation_id":"46adfce0-d7a2-497c-b274-b19748daf823","resolution":{"observed_at":"2026-08-16T12:35:20.992344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-16T12:35:20.997296Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:20.997296Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:86627fdfc7382bfdccb9ad4907c71da0b3395d1370422691ab1529e1fb47db24","observation_id":"0f563e24-4244-4240-9f7a-6e6b43552343","resolution":{"observed_at":"2026-08-16T12:35:20.997296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.480314Z","title":null,"venue":null,"work_id":"6dddc403-3e80-488c-a4f0-dddfffe57a7f","year":2019},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.003137Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:ec72e5a5b9a70f2e3afe15956ba264d373f37f71e5abaca716ec4ac5d2697671","observation_id":"dfc7d64f-d5bc-4a2e-b317-651d913864f8","resolution":{"observed_at":"2026-08-16T12:35:23.487820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.007784Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.007784Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:ff2b6ef200d5332877722980873f62b32d102005d7106fd0173570ad9008b309","observation_id":"f73109e5-fdda-445f-88f5-6a6d947276c5","resolution":{"observed_at":"2026-08-16T12:35:21.007784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5220/0012426500003660","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.713679Z","title":null,"venue":null,"work_id":"e110c561-c2bd-443b-8195-0d8b46781555","year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.013608Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:c38d724d6c054d0eaaa450e6b02a491811e75afa24aca9deccbea34bee7d08d8","observation_id":"77d327d9-cdc7-44e3-a2af-4b3caa82be48","resolution":{"observed_at":"2026-08-16T12:35:21.720199Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.441539Z","title":null,"venue":null,"work_id":"12a4099c-ad23-430a-af67-2932903ed5a3","year":2021},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.018305Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:0c5905cc30249cd0d3ec8479106b8fa8e75e0cd68adf8e39ad8c368d7f8b859f","observation_id":"fb138270-234e-4885-8853-8cffffccd4a6","resolution":{"observed_at":"2026-08-16T12:35:23.446627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-17T13:04:04.064087Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-16T12:35:21.022878Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.022878Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:4151f4c3bf69882349af513e49943a0930cd11ac8ac82c0e5e53965ebd62a4e5","observation_id":"ea5dbc63-7c06-4b7c-aecc-6ede8a8f22a9","resolution":{"observed_at":"2026-08-16T12:35:21.022878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12793","last_updated":"2023-11-28T08:52:50Z","snapshot_observed_at":"2026-08-14T06:42:43.375489Z","submitted_at":"2023-11-21T18:58:11Z","title":"ShareGPT4V: Improving Large Multi-Modal Models with Better Captions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12793","snapshot_observed_at":"2026-08-16T12:35:21.028550Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.028550Z"},"links":{"cited_paper":"/paper/2311.12793","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:fc249dac891b0b0419ba7959f194b78c8effde682f1686126f64cb2810b80ecf","observation_id":"fcd5a7f1-b0fa-4b5f-87eb-071ff9ea3f12","resolution":{"observed_at":"2026-08-16T12:35:21.028550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.422425Z","title":null,"venue":null,"work_id":"93d31a84-3045-45da-be40-d986e06d8cbd","year":null},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.034481Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:8b45d8dface2a5c6d91e5f45b95e7a19bbe297420561c1cac073d0fe972d740c","observation_id":"794b07c1-90f3-40d5-88ca-2878b294172a","resolution":{"observed_at":"2026-08-16T12:35:23.428521Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.397207Z","title":null,"venue":null,"work_id":"1b6a5720-3273-4461-a2a6-376061e9b0c0","year":1977},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.045560Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:e23f5e3bca6f846e9ed18c4ccd54c4332cd0c6a2de0f961ec4de9a8b4d18472c","observation_id":"682c3118-2579-40b6-8296-109dfed65943","resolution":{"observed_at":"2026-08-16T12:35:23.402967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.373133Z","title":null,"venue":null,"work_id":"27499a68-70f9-4da0-a3ee-d6b2b9d67232","year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.050751Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:de0e429c680497bc2236bfc86969cf4a6465fd161460371833093fdc0f5ba797","observation_id":"3b39dc9c-8f1d-497f-9553-0081c37d2dc0","resolution":{"observed_at":"2026-08-16T12:35:23.381370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.350963Z","title":null,"venue":null,"work_id":"8c7d271f-0d4a-46a6-b498-0f7194389f90","year":2020},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.055754Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:1876a00a50db2070ce364707ba500a40817c6396df41da958faca0daff03c295","observation_id":"86504ca1-7f9a-4f34-bcfd-22b34803f8cf","resolution":{"observed_at":"2026-08-16T12:35:23.357143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"articles/9002500","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.481647Z","title":null,"venue":null,"work_id":"55c4a657-50eb-441b-8bb5-8f60fbade6d0","year":null},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.061090Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:6d52a26b0323de80a10fd861bf478e49ffc7ba3b579d045791b54284b978db44","observation_id":"3211308f-f078-4c64-8586-b66d19809bf5","resolution":{"observed_at":"2026-08-16T12:35:22.490997Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.327858Z","title":null,"venue":null,"work_id":"8ab2d7d8-c812-42fd-bd60-4e3776417ab4","year":2016},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.065839Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:38c6bd0b39e32c452ee7459c28113a5aa26f5b5d921bd2cb72511fcbfb3285f8","observation_id":"9a54cf9c-6ad1-4c97-99ba-b7d2e3414765","resolution":{"observed_at":"2026-08-16T12:35:23.333917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.308011Z","title":null,"venue":null,"work_id":"c18fa31a-e6ed-480a-81d9-8865c622cd69","year":1963},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.070878Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:189f05efade6e657f34473f4f0bd554d80b8e476303a0f67b28a936c3c381774","observation_id":"d46fde34-58ab-4086-8723-e5872c3b0fa3","resolution":{"observed_at":"2026-08-16T12:35:23.314136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00219","last_updated":"2024-10-22T05:13:15Z","snapshot_observed_at":"2026-08-16T13:38:37.497886Z","submitted_at":"2024-06-28T20:06:30Z","title":"Evaluating Human Alignment and Model Faithfulness of LLM Rationale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00219","snapshot_observed_at":"2026-08-16T12:35:21.075920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.075920Z"},"links":{"cited_paper":"/paper/2407.00219","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:5f457675d238e93d4fc790f83edbb5a12c9f24d1cf2a99073038321cb5e7187c","observation_id":"11d3c59e-b739-4394-83ab-7502b17ab449","resolution":{"observed_at":"2026-08-16T12:35:21.075920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.286484Z","title":null,"venue":null,"work_id":"ab86472e-a473-4bcc-b8f4-4914ca1ca2d3","year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.080899Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:7fbc4a6c5103a04eaee6e732dc742b73bcf51b5ca7bebc196beae8efd5bc70a5","observation_id":"2b2104c7-880e-4fc9-a827-76c06768cd5b","resolution":{"observed_at":"2026-08-16T12:35:23.292838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.262984Z","title":null,"venue":null,"work_id":"5c72aef5-1d14-43be-bbd3-6cb1c2c31f33","year":2017},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.086762Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:29b8f9b65cf5d647d9229f720e3d1628d56088f61df5379dc04f9f2e3a4f527b","observation_id":"2f7b817d-0474-47ed-a177-91aee3d71040","resolution":{"observed_at":"2026-08-16T12:35:23.269817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.237372Z","title":null,"venue":null,"work_id":"5402076c-8388-4b6a-a3b6-c0a5532708ea","year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.091815Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:c476702de2b7a71b62a3483f6553faa7bf1eeb33e3cd87717a65897e7d878ab1","observation_id":"a462f522-63d6-4cd4-b9f0-3edf2beb635d","resolution":{"observed_at":"2026-08-16T12:35:23.244602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.096356Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.096356Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:b1f36fed0796b3d213c0ae2a342876c85becd4b47044cb48e2f23adffbedc650","observation_id":"42f832d4-465a-47ce-bbba-14c454c7ebc7","resolution":{"observed_at":"2026-08-16T12:35:21.096356Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.215323Z","title":null,"venue":null,"work_id":"23e25174-2a27-4306-b96a-7b128a6cbdda","year":2022},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.101110Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:a142b68191a86619700119d2a69d7952da21eb2fe8026f90439cebef32887186","observation_id":"50bd9ffd-9d2a-4def-b36c-c8bb276629af","resolution":{"observed_at":"2026-08-16T12:35:23.223552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.196525Z","title":null,"venue":null,"work_id":"82b1ce3a-5e5b-4763-9a0f-72b8dedfcc42","year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.105889Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:258a5327005b8f9c370bda624bbb3044d76548c0931ff3f9d1b7d3ae768a7e54","observation_id":"63ad12e2-684d-4863-bd95-9be33c5bf46e","resolution":{"observed_at":"2026-08-16T12:35:23.201965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.112040Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.112040Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:342f9cda2bde789c99e57a97db30df9f5356c66881eff08812f838b2795756c9","observation_id":"786d67f5-0f3e-4cd5-8881-23ef7b31008d","resolution":{"observed_at":"2026-08-16T12:35:21.112040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.117013Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.117013Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:8f8d3d263f9767481a6a77b6400a6bf04ea75b09c9d0a7b8d0ee6a81bb11b4c5","observation_id":"f04887c8-ccb6-410a-9dec-1801385bc5a1","resolution":{"observed_at":"2026-08-16T12:35:21.117013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2001.0061","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.373709Z","title":"Gauthier","venue":null,"work_id":"5684691f-5f3a-4aa5-88cd-3a618c0dec29","year":2001},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.121874Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:1867a04f81bc402e7a765c3c18ae966b161834f4b6dd8ae060df2cb401f06a25","observation_id":"fb77807c-3d09-4c99-8786-4f47a12338c7","resolution":{"observed_at":"2026-08-16T12:35:22.384260Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.162194Z","title":null,"venue":null,"work_id":"66df5fa3-5be3-4a09-b38a-ead30ba7d231","year":2020},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.126827Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:800f5624ff3527805e3d79364d2ee322f9e2bf3934bdbd7a8cde6998c36091ea","observation_id":"7fc7ba1e-691e-4e25-a7ec-3a1aa228b0df","resolution":{"observed_at":"2026-08-16T12:35:23.168166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.131608Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.131608Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:eadbf3f1126a994bff51d51c02674f02f4529c3131d0eb2de9971682db3b5824","observation_id":"f03dcd6f-e2fb-45f3-b790-629cb7aeefc9","resolution":{"observed_at":"2026-08-16T12:35:21.131608Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T12:35:21.136411Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.136411Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:d6b6d92ccf52baa65883c9b2898b708c1cda5a4a851f9744e22245e48ba9eba4","observation_id":"ddf4494a-dfc1-4ce0-bb4b-e9eec659b828","resolution":{"observed_at":"2026-08-16T12:35:21.136411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.143824Z","title":"Heaps and S","venue":null,"work_id":"8d0f65f8-42f4-4c5b-b34c-b8b201c1f951","year":1999},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.141793Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:2c9a55dace96c6ddb58cd0de29e686a300e4fe2612fbad4526d8dca9b60c02f5","observation_id":"d6b662bb-cd47-4129-aced-fa8103b97a7c","resolution":{"observed_at":"2026-08-16T12:35:23.148775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.123918Z","title":null,"venue":null,"work_id":"9681eaeb-a4e1-426b-ad3a-488eb9a907b4","year":1940},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.146957Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:54206b4b7ef779024d3443485714c19d2de02087c7bab5d8841d505f38ad23af","observation_id":"f5b9ab28-ef7c-429f-b28d-4e102880be4f","resolution":{"observed_at":"2026-08-16T12:35:23.129463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.100537Z","title":null,"venue":null,"work_id":"25717074-8122-4c49-b6a6-6459800560f9","year":2020},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.152955Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:70774bce5fb5e5cb54fbec4200a4c7c01110973d1397777882b6ba50d8eb5df7","observation_id":"5b52e82f-af47-4bc9-8c44-29189ff7fbbe","resolution":{"observed_at":"2026-08-16T12:35:23.110383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.077195Z","title":null,"venue":null,"work_id":"c88587f1-b22f-4042-bebc-45623c1dc499","year":1935},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.157894Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:885dec4e71c0be4777078363d224316cb22c23087d5af3060a234500ab70b40d","observation_id":"6f36cca6-6afc-4920-8213-876925f43a49","resolution":{"observed_at":"2026-08-16T12:35:23.086699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.162894Z","title":"Shamma, Michael S","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.162894Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:8595eacb3be5a051f93dc4875a21c99eec66eb814f1bc835edb737588b0b4bd5","observation_id":"83c4f8cc-b9b6-4b83-bb9f-b60f6006243e","resolution":{"observed_at":"2026-08-16T12:35:21.162894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1167/jov.23.9.5251","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.613815Z","title":null,"venue":null,"work_id":"b28fb77f-2038-41a0-8f13-9fe84f4b2062","year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.168895Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:2e922c0cb74a43690a4454d3c0883be772280117b7e063aa8c5f72fdb54915dc","observation_id":"f47d35d4-9aa5-467d-beaf-05a421fc422b","resolution":{"observed_at":"2026-08-16T12:35:21.620023Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.058650Z","title":null,"venue":null,"work_id":"304ad43c-263a-4ff9-831d-8d5a90638e19","year":1947},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.176608Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:3059001a8c894163f85f029c8eb748df809a9ea5257b8685dd9d3b0b0a89dafc","observation_id":"fa69771a-8b44-4dae-bbce-4827df4f47d1","resolution":{"observed_at":"2026-08-16T12:35:23.064492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.040402Z","title":null,"venue":null,"work_id":"2f4bd4cc-745a-4124-80a1-bfd2a6bf1832","year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.181595Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:b448f6de6866dddc4a8f4b095e366e9723a9794c4dcd25342453501a63ed717f","observation_id":"9dfe9033-9f92-4b72-a082-3b828fc40187","resolution":{"observed_at":"2026-08-16T12:35:23.046302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-16T12:35:21.187200Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.187200Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:b7c43de737a1e7ee10f38f977dfd282491a1b1ba0662812c373a4753ff07dce4","observation_id":"9202e43d-0cc7-44a7-af69-215a583f9fe6","resolution":{"observed_at":"2026-08-16T12:35:21.187200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:23.018677Z","title":null,"venue":null,"work_id":"daf143a3-6435-45ab-a3b4-02ef519973ff","year":2014},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.193725Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:ab440e66c8de2becb9365ae6bea1d9817907eb80c98eff99c2cd802f289acac6","observation_id":"b764f248-db25-4173-b6fb-a59b467f8b85","resolution":{"observed_at":"2026-08-16T12:35:23.025429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.991113Z","title":null,"venue":null,"work_id":"82060a69-d2a8-4a4f-8f49-a14a37b482b4","year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.198665Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:20dead82a15a3ba7e8a8fd5ef82cc421a6070af9110673017e913ee0c1625770","observation_id":"5b8ad72e-c845-4402-ba7b-0453591ab8f5","resolution":{"observed_at":"2026-08-16T12:35:22.996701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.204507Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.204507Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:4e0f8f0c589a65f0eb73ec4a0d978b4b375c00712fa3f04138c8e090bec31162","observation_id":"df04da35-c75e-42de-a7f5-efbd84371fd4","resolution":{"observed_at":"2026-08-16T12:35:21.204507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-19T16:22:29.898436Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-16T12:35:21.210560Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.210560Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:3f2ce10c8e93806b726f4975fc26dd3dc5e1aaebd3b6f84b78c8f3c0bbf21531","observation_id":"b65a31cd-4e30-452b-a646-192daebc501f","resolution":{"observed_at":"2026-08-16T12:35:21.210560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.953243Z","title":null,"venue":null,"work_id":"32438520-a00d-43f5-9c21-f97c69d8d37e","year":1956},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.216132Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:5a6f10b1c64928948cf2893919c3ec924680d5c953ddbfbc08bd941d86d6f388","observation_id":"a36f93a0-2aaa-4993-b8d6-98b1e5af41cd","resolution":{"observed_at":"2026-08-16T12:35:22.962720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.220948Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.220948Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:58585eca982285634646be2a9af3ea294629e4f86dee3fda9f3ebe976351f2fe","observation_id":"99902b8f-48f9-4f0e-b4f2-220df36df81c","resolution":{"observed_at":"2026-08-16T12:35:21.220948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.931701Z","title":null,"venue":null,"work_id":"1154d667-4e68-4cc0-a661-f9b884477a47","year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.227441Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:6e021e4d1832beea0f5ae1007234f90760231321b9da755c52074807f967bbdd","observation_id":"3b135108-bd60-40d7-9c5d-7832264021b6","resolution":{"observed_at":"2026-08-16T12:35:22.937529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T12:35:21.233824Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.233824Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:56fd904a33848d0e47899267d8e1d01ec6a4203149b37e416f9f922dd361d2c1","observation_id":"06b272dc-4c6f-409d-8625-d8244485247b","resolution":{"observed_at":"2026-08-16T12:35:21.233824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.912429Z","title":null,"venue":null,"work_id":"44b9de2d-b6bf-492b-8798-84c0f7a37523","year":2014},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.240290Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:287fb789f29babe98bdccc9ee85e48e408acd6bdde90a500891c8ba5347e2d13","observation_id":"08fd759a-d57e-4b3b-816b-e784ff0927fb","resolution":{"observed_at":"2026-08-16T12:35:22.917902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.892126Z","title":null,"venue":null,"work_id":"9e53fd25-4c2a-4e7f-b0e4-2187ad1548d2","year":2010},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.246766Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:1e5bf3e58a037236dd1a429ff42dbf79814a32a71f3107ad4e2bfcecedbbc88e","observation_id":"9d64e681-466b-4fdf-b440-4372a24fb072","resolution":{"observed_at":"2026-08-16T12:35:22.898118Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.873383Z","title":null,"venue":null,"work_id":"522a6e7a-2a91-4605-9ea4-dd04bd4c0301","year":2021},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.253029Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:a250a68c06dd378581bc2a1890bf55883e42397f2585271d0a8afc228c15340a","observation_id":"a7ffb18f-49e9-4f57-8e09-7902a9fee66d","resolution":{"observed_at":"2026-08-16T12:35:22.879835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.851194Z","title":null,"venue":null,"work_id":"b7cd87e4-a381-40e4-92ba-4f813dabc30f","year":2013},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.270397Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:f2d22da5fa09edb750102767bc825e6d2d2c1d45613436511038233fe0a6b8a1","observation_id":"be55e272-acf6-4a43-baa4-ab3b800e6b7e","resolution":{"observed_at":"2026-08-16T12:35:22.856393Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.830939Z","title":null,"venue":null,"work_id":"723aaaf4-5d63-4f57-ad5c-5e527f121a86","year":2007},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.277124Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:4512b0c4afd32240d65f01af6cdafcbfaf2e65fb1116c11ffbab5dd83d4dc593","observation_id":"674d2a4c-4bf5-481d-8b68-b2a073f5a2d5","resolution":{"observed_at":"2026-08-16T12:35:22.836254Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.810720Z","title":null,"venue":null,"work_id":"60b97e4c-8200-44cc-a8b9-34d9b4128329","year":2022},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.283860Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:0f66f7bd959aced11123d7e92848e30bcddd19b9f0db3140f466c19430b5e9b4","observation_id":"ac0f8a9e-e232-477f-ac74-8d8c6c39d496","resolution":{"observed_at":"2026-08-16T12:35:22.816694Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.01771","last_updated":"2018-10-03T14:34:37Z","snapshot_observed_at":"2026-08-14T18:19:59.753160Z","submitted_at":"2018-10-03T14:34:37Z","title":"SAVOIAS: A Diverse, Multi-Category Visual Complexity Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.01771","snapshot_observed_at":"2026-08-16T12:35:21.291652Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.291652Z"},"links":{"cited_paper":"/paper/1810.01771","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:68f9dc4297aa9671bdc63ee0791f8492299a272122715151e73335b4f10556e2","observation_id":"fd992b64-8469-41a7-8396-b136277a7acf","resolution":{"observed_at":"2026-08-16T12:35:21.291652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.297720Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.297720Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:aace23b86e9fe4e53488f94cacec4010875c2d3b92776b8bc2a4475175640471","observation_id":"afa7b62a-2870-403d-8f25-4e483e5d25e6","resolution":{"observed_at":"2026-08-16T12:35:21.297720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-16T12:35:21.305347Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.305347Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:062b51092997fc3b2d9bbf42186ceb11cc845d6f5ca60d099c2b768dd85860cd","observation_id":"388c2955-3184-49ea-984a-1b569a5cd5ef","resolution":{"observed_at":"2026-08-16T12:35:21.305347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.312105Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.312105Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:08c56ca36323181b4233ecd97601d02af9837fb11b391866a4058115c78723f5","observation_id":"7b5ba88c-275a-4400-a9ad-bb6cdc2c6165","resolution":{"observed_at":"2026-08-16T12:35:21.312105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.790923Z","title":null,"venue":null,"work_id":"4b025eb2-20a4-4858-86f9-6e1b0851c6a5","year":1980},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.318157Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:ade621de50a4635321eb84ae7ff8313a64f6e68301261e81fd81562450227d7d","observation_id":"b10b5009-e354-4e72-88c1-835528dd0d16","resolution":{"observed_at":"2026-08-16T12:35:22.797177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.771525Z","title":null,"venue":null,"work_id":"322b4905-d12e-4956-a294-4f9333f5a065","year":2007},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.323896Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:0fb404a0b59e865914b4f37ef493109ab13e800ba0626d5bd5cfbe537e000943","observation_id":"f33dfec7-05c5-424c-95c0-a75113975372","resolution":{"observed_at":"2026-08-16T12:35:22.777638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-08-16T07:24:08.156932Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-16T12:35:21.329267Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.329267Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:a15f7365c23acc7790737a0f9ae4090f1e12753da5c4784e689d68dc0ad2b343","observation_id":"28461416-bf8d-48ca-b613-17fc5e996194","resolution":{"observed_at":"2026-08-16T12:35:21.329267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.753391Z","title":null,"venue":null,"work_id":"595be498-4da0-40c9-9111-1a9f40f02a6f","year":2021},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.334896Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:5ff40d3cc7696e5c8b7f0efcb07d0509b0e81867dd0cda3647a5c1ad59d964d3","observation_id":"014a3801-5a73-4781-a9d3-ad66349e7960","resolution":{"observed_at":"2026-08-16T12:35:22.758985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.340804Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.340804Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:84421c8073399da255cbf76979e0fb3d0a2e1ff17ef0d801f4c52849ed21d171","observation_id":"19b9927d-86ea-4c74-a081-52e9ad2ea984","resolution":{"observed_at":"2026-08-16T12:35:21.340804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-16T12:35:21.345944Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.345944Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:124d14141348d38e5f033e3b43cbe95b0f439b97e3c53e4b15d8ae76366513e9","observation_id":"6e2ce8de-f2e6-44f6-8ed2-c57da6828ad2","resolution":{"observed_at":"2026-08-16T12:35:21.345944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-16T12:35:21.354290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.354290Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:f0635cff2428d698201b8a2193df00533a4525478700585135d50241e639897f","observation_id":"2e9b99dd-d0b3-4b37-90a8-7c598d64ec38","resolution":{"observed_at":"2026-08-16T12:35:21.354290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-16T12:35:21.360749Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.360749Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:07186028e125c716150ae38a980191ea71fcfd8f31b5a41ea31c1cf202083d60","observation_id":"bf59f4f8-6dec-40fe-9f29-fb4aac3c6ce7","resolution":{"observed_at":"2026-08-16T12:35:21.360749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.734062Z","title":null,"venue":null,"work_id":"f57d1eb2-6377-4bb1-a4c0-0f1cb6525cce","year":1923},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.366338Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:ce4439636aed0da5715e7c8547970e0a19f8157365d52714e56b0863e19ad983","observation_id":"5608ce56-5378-45cc-b15a-f98ee7a6b98b","resolution":{"observed_at":"2026-08-16T12:35:22.740580Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.717730Z","title":null,"venue":null,"work_id":"1eb9cc14-5bb4-488f-bcd4-b1b3966496d1","year":2016},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.371890Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:a243fe4cd17ea6499626a776fcb30a8ad99c8587172e004cf11d240ced1da142","observation_id":"15db1c4f-0667-40cd-8a35-4090d4e1fbe3","resolution":{"observed_at":"2026-08-16T12:35:22.722556Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1167/14.7.4","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:21.438305Z","title":"Zelinsky","venue":null,"work_id":"b1d12142-f30f-44af-81bd-0e11887fcd6b","year":2014},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.376805Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:07a2c885d3c7b81891e105ac620ad52b2ab561d81ab6b60a34ba8d62e4f4c8c2","observation_id":"54f85aa4-b20f-4fe3-9445-b18ee4c4999e","resolution":{"observed_at":"2026-08-16T12:35:21.444502Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.701286Z","title":null,"venue":null,"work_id":"2850e372-9b27-4c72-81b3-3610db4a1ddc","year":2018},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.382462Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:48067806f75eaac69053cc3c5786fdd6774233401609ab55f05e930059ff368d","observation_id":"647ef3c8-7ae0-4be0-9dcf-53d3d9d4ff69","resolution":{"observed_at":"2026-08-16T12:35:22.706456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14845","last_updated":"2025-02-24T17:06:21Z","snapshot_observed_at":"2026-08-16T13:32:30.183751Z","submitted_at":"2024-07-20T11:19:58Z","title":"Understanding the Relationship between Prompts and Response Uncertainty in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14845","snapshot_observed_at":"2026-08-16T12:35:21.387836Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.387836Z"},"links":{"cited_paper":"/paper/2407.14845","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:d390f651819503d46148ee2349e9e99eacb10ca51bec1370b00483cf2bd93f34","observation_id":"efbd91ca-cfc7-4fa5-bbd1-1a88a35d9838","resolution":{"observed_at":"2026-08-16T12:35:21.387836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:35:22.681602Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"baf5a693-c95a-4d11-875e-1daaaa7eac95","year":2023},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.395160Z"},"links":{"citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:994e3f41b5387eaad79317faa1c085d974f59dc380767659feb69769168f8f8d","observation_id":"79be78fe-d1f4-432e-aedc-a34ae9acc77b","resolution":{"observed_at":"2026-08-16T12:35:22.688219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18565","last_updated":"2023-05-29T18:58:38Z","snapshot_observed_at":"2026-08-07T07:27:51.369423Z","submitted_at":"2023-05-29T18:58:38Z","title":"PaLI-X: On Scaling up a Multilingual Vision and Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18565","snapshot_observed_at":"2026-08-16T12:35:21.039709Z","title":"https://doi.org/10.48550/arXiv.2305.18565","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T12:35:21.039709Z"},"links":{"cited_paper":"/paper/2305.18565","citing_paper":"/paper/2504.12511"},"observation_digest":"sha256:ee1fe7499c29d9c7fe4326d48b02c3bed60efb48f15dd5f996f10984bad440a9","observation_id":"9a526a16-a8ee-45da-8a8a-3f67d97a9286","resolution":{"observed_at":"2026-08-16T12:35:21.039709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.12511","last_updated":"2025-04-16T22:14:27Z","latest_version":1,"primary_category":"cs.HC","snapshot_observed_at":"2026-08-19T01:36:12.578813Z","submitted_at":"2025-04-16T22:14:27Z","title":"Multimodal LLM Augmented Reasoning for Interpretable Visual Perception Analysis"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":5,"verified_fuzzy":2},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2504.12511."}