{"as_of":"2026-08-10T19:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e9cb5667352656ce1c889a0a1e7c68c72285561001fdbbb3a615d59c6121df8","coverage":[{"denominator":83,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":83,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:49:49.696369Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T20:30:26.760966Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T20:33:43.466366Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"cited_work":{"arxiv_id":"2506.16112","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16112","snapshot_observed_at":"2026-07-14T01:19:53.792907Z","title":"Zhang, C.-K","venue":null,"work_id":"811f77d1-730b-407f-bfdd-18323d73d6f5","year":2025},"citing_paper":{"arxiv_id":"2605.15691","last_updated":"2026-05-15T07:26:54Z","snapshot_observed_at":"2026-07-06T23:26:56.013191Z","submitted_at":"2026-05-15T07:26:54Z","title":"SEED: Targeted Data Selection by Weighted Independent Set","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-20T20:30:26.760966Z"},"links":{"cited_paper":"/paper/2506.16112","citing_paper":"/paper/2605.15691"},"observation_digest":"sha256:ff9ed1a9f876bf083fa756630f198898cd564f2753fe92a2ea09f8bf8536d308","observation_id":"91732e73-87bf-4c81-a672-966a5418b2a2","resolution":{"observed_at":"2026-07-14T01:19:53.792907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.16112/citation-record","integrity":"/paper/2506.16112/integrity","json":"/paper/2506.16112/citation-record.json","paper":"/paper/2506.16112"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T23:49:42.891796Z","title":"arXiv:2303.08774 (2023) 1, 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:42.891796Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:daad6373c8c40440958e13354950f4c49c230a7c38fff638ffc99f93b875d2b9","observation_id":"7fe25a14-8c7b-4afb-9eca-601168e92ea4","resolution":{"observed_at":"2026-08-06T23:49:42.891796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:42.964765Z","title":"Advances in neural information processing systems35, 23716– 23736 (2022) 3","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:42.964765Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:2171d2f85f5e79ad5807f2a271404b19db058807577368c0e9529df42e36a945","observation_id":"36c2e79c-68b3-494f-933b-a2b149778869","resolution":{"observed_at":"2026-08-06T23:49:42.964765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T23:49:43.035119Z","title":"arXiv:2309.16609 (2023) 1, 8","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.035119Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:4eabd720b359b7d99d83ec594d0a11ef26f1fa0d1688d9044ee1659aa25dfbc1","observation_id":"d49e3435-9778-46f7-a840-f549ab1af49f","resolution":{"observed_at":"2026-08-06T23:49:43.035119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T23:49:43.092738Z","title":"arXiv:2308.12966 (2023) 1, 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.092738Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:74f833c7af8a18fb1fbd0c28aa3499460391c4b497bea7bd7d0b25a0b377cab0","observation_id":"da979839-586f-462d-ba04-0116d82c64b6","resolution":{"observed_at":"2026-08-06T23:49:43.092738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T23:49:43.141205Z","title":"5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.141205Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:9a84a238242bd88586ecf8b8faea1638c796bb40384f3a8c931a226aef40d5d4","observation_id":"7cf4d515-c085-491c-82bd-06387b065e49","resolution":{"observed_at":"2026-08-06T23:49:43.141205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-06T23:49:43.213504Z","title":"arXiv preprint arXiv:2404.18930 (2024) 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.213504Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:4a67a5bd3c6fb4b28cb410d4acb106f953e1783f4fae4ce2eca81354ab804f2a","observation_id":"8e179af1-4e1f-45ea-ac00-084421a0d89f","resolution":{"observed_at":"2026-08-06T23:49:43.213504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:43.265263Z","title":"Advances in Neural Information Processing Systems35, 32897– 32912 (2022) 4","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.265263Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:a2f3101fb2d74a8950bfe3359992eb317aa1d3d26d2312525b2ce3208269b51e","observation_id":"a9784c3b-4e1f-414f-801d-49f8c2a23183","resolution":{"observed_at":"2026-08-06T23:49:43.265263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-10T17:03:38.042994Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-06T23:49:43.331057Z","title":"arXiv:2401.02954 (2024) 1, 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.331057Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:60933bc10407fccc72bade117b3da1eb8339452bcf6ded27ce647b2bfc1712a9","observation_id":"e87c40bf-f302-4557-ba81-14e3622b0c4e","resolution":{"observed_at":"2026-08-06T23:49:43.331057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:43.384900Z","title":"In: Proceedings of the 23nd annual ACM symposium on User interface software and technology","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.384900Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:85a7a3a3caea9fa34ef97826121f6356743cbafb3eec4b5704e49f2896ec5ded","observation_id":"2e217085-a64f-4223-8d5e-8c40acdd66ac","resolution":{"observed_at":"2026-08-06T23:49:43.384900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:58.807558Z","title":"Advances in neural information processing systems (2020) 1, 3","venue":null,"work_id":"7e4392f1-d13c-4f6b-8cbd-62fe75659ce0","year":2020},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.450799Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:355e843d46b8822de4ecf2a0961c8accfff4aeee078d5d8f22cd97af547d57b3","observation_id":"a36d5b5e-ae5e-43fc-b0b0-b1bb2683b57d","resolution":{"observed_at":"2026-08-06T23:49:59.003425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-06T23:49:43.506654Z","title":"arXiv preprint arXiv:2403.17297 (2024) 3, 8","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.506654Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:50c3de0c9469ae5052883e50f3fea6a72457b4cfd4afc8b3e9d2e2a1a426a1e4","observation_id":"914f874d-3450-4c63-bd8c-1c599db95012","resolution":{"observed_at":"2026-08-06T23:49:43.506654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:58.595383Z","title":"In: European Conference on Computer Vision (2024) 12","venue":null,"work_id":"46150d1b-7ef5-4af5-bc8a-d9c222d4087e","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.562388Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:fe2c7ca0b26029ae81bab1d638dc7e5425a2995860f88d02421e7626aeb5a736","observation_id":"9248eb51-c5ed-406e-b20d-d727c3cc08d7","resolution":{"observed_at":"2026-08-06T23:49:58.687727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:58.456032Z","title":null,"venue":null,"work_id":"f8abc10c-3cfd-48c7-bcfc-e1350d81966f","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.599150Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:fa180c419d6b641d08775f73e487ba5f8c12fab871120f5bbe8b11e5ee01948f","observation_id":"858fd5fb-62af-4459-b8f3-76eeaed92172","resolution":{"observed_at":"2026-08-06T23:49:58.522938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-06T23:49:43.648888Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.648888Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:27e23c1c52e76b611e6a335dd8d599d2d37f070de1def9e5b086b69337603164","observation_id":"eae2e6e9-8a26-4c41-a43e-76fb5a5feab7","resolution":{"observed_at":"2026-08-06T23:49:43.648888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-06T23:49:43.702059Z","title":"arXiv preprint arXiv:2412.05271 (2024) 8 AutoV 17","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.702059Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:966ee6fc448c723aab53b4e474b01ab57a39d94f86715f6d5afa29a87cffa649","observation_id":"bf862400-64d9-45d4-a5ea-98172282bd68","resolution":{"observed_at":"2026-08-06T23:49:43.702059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14238","last_updated":"2024-01-15T15:23:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-21T18:59:31Z","title":"InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14238","snapshot_observed_at":"2026-08-06T23:49:43.738406Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.738406Z"},"links":{"cited_paper":"/paper/2312.14238","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:68bbacbe54f3d968f3461f05794971952da3c4e6344a8f216a9ba8c913b7daec","observation_id":"f57ae639-7fa3-4e4c-a123-a8a8f9ef0006","resolution":{"observed_at":"2026-08-06T23:49:43.738406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:58.190127Z","title":"In: 2009 IEEE conference on computer vision and pattern recognition (2009) 8","venue":null,"work_id":"73acd4af-10b4-4903-8535-7f0ac91f5413","year":2009},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.812871Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:68b2fd68010cb9ed172e813baf0d10cdb8f7574a536a9c6646ec41a8d6dbffa2","observation_id":"82e216dd-75c6-400e-a5c2-da9845ca6098","resolution":{"observed_at":"2026-08-06T23:49:58.361615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T23:49:43.860392Z","title":"arXiv preprint arXiv:2010.11929 (2020) 3","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.860392Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:47d407f5e92a620bc42685f3de0043fb99b85d828b50cc2c155ee0851a90c53a","observation_id":"ecde50a7-c0ee-4cdb-857d-61267f56d095","resolution":{"observed_at":"2026-08-06T23:49:43.860392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:57.961077Z","title":"Journal of Machine Learning Research 23(120), 1–39 (2022) 4, 11","venue":null,"work_id":"c803215b-854d-4a70-897f-b6db04229fe9","year":2022},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:43.908046Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:b8ce96d9be4f7f026a4686f0f3781ea04f15ecfaac7fec4521c56f0e532bbd96","observation_id":"092e7f00-cc7a-413a-b61c-60fc24abcbc6","resolution":{"observed_at":"2026-08-06T23:49:58.084458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:57.701528Z","title":"In: European Conference on Computer Vision (2024) 8, 24","venue":null,"work_id":"52ceade0-e33d-4c60-8485-3927d2b5cd3b","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.022930Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:13c71aa9e61372b99b6912a698bc54c85cebd8d2a41f15c641b741e3c6d20583","observation_id":"98ea93f1-7055-4be2-b78d-634d3a79f353","resolution":{"observed_at":"2026-08-06T23:49:57.822148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:57.446221Z","title":"In: International conference on machine learning","venue":null,"work_id":"a284c924-f51d-40c8-835b-acc88f867ee0","year":2017},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.121056Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:b9abfac7d5401b82b692fdc311930759189110bc04db3914132bda6812d79223","observation_id":"5cee5a21-2960-43c0-8f99-1117ad6c7bf5","resolution":{"observed_at":"2026-08-06T23:49:57.596802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:57.115192Z","title":null,"venue":null,"work_id":"871761f7-8543-43df-b1a0-056f77388a7e","year":2014},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.272524Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:47517dd93f2c89c30679e5d0257a3e7ec658a8b5c1bdc29ccabaacc2257a2d80","observation_id":"981cb9a4-4361-4e37-a508-da18cfcef362","resolution":{"observed_at":"2026-08-06T23:49:57.253595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14683","last_updated":"2024-06-16T18:43:50Z","snapshot_observed_at":"2026-07-06T17:34:03.539565Z","submitted_at":"2024-02-22T16:40:33Z","title":"Visual Hallucinations of Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14683","snapshot_observed_at":"2026-08-06T23:49:44.314634Z","title":"arXiv preprint arXiv:2402.14683 (2024) 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.314634Z"},"links":{"cited_paper":"/paper/2402.14683","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:95c7283d89263de451c95208b696a0b9336e6a67d609153a6af68523ad4da0c8","observation_id":"bb510fe0-5957-4869-8512-70d7d52aad82","resolution":{"observed_at":"2026-08-06T23:49:44.314634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:56.842295Z","title":"In: Proceedings of the IEEE/CVF confer- ence on computer vision and pattern recognition","venue":null,"work_id":"b331bdb3-1a34-411c-b313-7969c52a812f","year":2019},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.329874Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:0531943ab0148c58946ee8dffc9c14d40a975fef7d5b2b3b9f42b00cb6253014","observation_id":"0ca8aaef-774a-4071-9650-b42851c4ebc5","resolution":{"observed_at":"2026-08-06T23:49:56.987557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T23:49:44.396214Z","title":"arXiv preprint arXiv:2410.21276 (2024) 1, 13","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.396214Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:2a17039a160ba00a7e182f3f08b013272a8f7174464182de2c4f443555fef4c0","observation_id":"62c74135-4d56-473b-ae9b-b86fbd702271","resolution":{"observed_at":"2026-08-06T23:49:44.396214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04514","last_updated":"2024-04-06T05:59:02Z","snapshot_observed_at":"2026-07-06T17:56:27.818353Z","submitted_at":"2024-04-06T05:59:02Z","title":"Joint Visual and Text Prompting for Improved Object-Centric Perception with Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04514","snapshot_observed_at":"2026-08-06T23:49:44.479493Z","title":"arXiv preprint arXiv:2404.04514 (2024) 3, 12","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.479493Z"},"links":{"cited_paper":"/paper/2404.04514","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:b5d674538190a64c4f726e6680eb8669980f68eed470fe4028df4e94141cbf35","observation_id":"b698e741-5e69-45fe-b013-9b060e96ccaa","resolution":{"observed_at":"2026-08-06T23:49:44.479493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:44.575867Z","title":"In: Moschitti, A., Pang, B., Daelemans, W","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.575867Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:cbaf68712e0c63fe9b8cdc8e757737e3246e0fb924614dfa996b6a4e3a2efbe6","observation_id":"05785031-19ca-4c4e-93aa-86eb4401ed51","resolution":{"observed_at":"2026-08-06T23:49:44.575867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:56.635788Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"464f370f-406c-485c-828b-5315b4fb9d3a","year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.657554Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:70761e014db356ececc7e794438a10edba65839b6035fca1ceb7bfacb4477bd0","observation_id":"98362437-6bfe-4e3b-8695-8713e9b680e6","resolution":{"observed_at":"2026-08-06T23:49:56.725121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:44.770951Z","title":"Advances in neural information processing systems35, 22199–22213 (2022) 1","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.770951Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:aa07df4636fde9b1777e1b749d6c7737927c6203d156f9fda3617b8fb9d68b03","observation_id":"bc37d831-5862-46fb-bacb-8aa3ed930a20","resolution":{"observed_at":"2026-08-06T23:49:44.770951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:56.401479Z","title":"International journal of computer vision123, 32–73 (2017) 23 18 Zhang et al","venue":null,"work_id":"8062f8a6-07e8-4f5d-9ea4-3a851901a0fe","year":2017},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.862028Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:9ad861014d3a9d0611495c878626730020b5f15bd4197e1d1a7c35cb151e3924","observation_id":"3607bb06-77d0-4f86-905a-ac7eab03c27c","resolution":{"observed_at":"2026-08-06T23:49:56.504451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-06T23:49:44.945349Z","title":"arXiv preprint arXiv:2408.03326 (2024) 1, 3, 8","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:44.945349Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:46768c4dcc9d09f6b4fad72e49be8cdd3303e2bafd14477e2ead6b930b188185","observation_id":"34e3cb2e-889a-431c-85f3-1c04c76070c7","resolution":{"observed_at":"2026-08-06T23:49:44.945349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:56.171506Z","title":"In: International conference on machine learning (2023) 3","venue":null,"work_id":"6331d4f5-1578-468c-aaef-5ea765b37c12","year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.022136Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:6e5621701f886eb452d7eb3b95b307bd3440daf03decc28b5e2a6006e59a1354","observation_id":"25fa2aea-97ec-4c06-8000-c14e77e97d1f","resolution":{"observed_at":"2026-08-06T23:49:56.275499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-06T23:49:45.103890Z","title":"arXiv:2403.18814 (2024) 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.103890Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:278e3acab9a0155dcd50c2d7f348d811af92c607ffdaa4c8b8364220ef57be91","observation_id":"cba208de-dda4-434d-a978-94b6945ff039","resolution":{"observed_at":"2026-08-06T23:49:45.103890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-06T23:49:45.195614Z","title":"arXiv:2305.10355 (2023) 23","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.195614Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:e709ec75d45d177d98e6afefb11d683b40b04d454d5b50c08c34a6231165cee0","observation_id":"a2cb6108-3f01-4498-9e91-3015309545fd","resolution":{"observed_at":"2026-08-06T23:49:45.195614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:55.949502Z","title":"In: Computer vision– ECCV 2014: 13th European conference, zurich, Switzerland, September 6-12, 2014, proceedings, part v 13","venue":null,"work_id":"8b6e273d-a93d-4c5c-9028-b8918e493e20","year":2014},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.242901Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:f9117a8c215e40fc6effaf4476bcd7f78ad099fef3c2e01d7b96103a01b39463","observation_id":"bd7055a6-7215-48ac-8fa2-362ad7eb287c","resolution":{"observed_at":"2026-08-06T23:49:56.040612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:55.741355Z","title":null,"venue":null,"work_id":"4b3a1516-f167-445e-998a-ba2cb63870ec","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.316052Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:66095a525c99e3511559be3df002a364904bdeec1afde359c2aa30d5d3dd9457","observation_id":"f2b298dd-5ea6-4ff7-bfc5-25109bffecb1","resolution":{"observed_at":"2026-08-06T23:49:55.844389Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05963","last_updated":"2024-10-08T12:15:08Z","snapshot_observed_at":"2026-07-06T19:29:42.190813Z","submitted_at":"2024-10-08T12:15:08Z","title":"Training-Free Open-Ended Object Detection and Segmentation via Attention as Prompts","version":1},"cited_work":{"arxiv_id":"2410.05963","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.05963","snapshot_observed_at":"2026-08-06T23:49:50.516730Z","title":"Training-Free Open-Ended Object Detection and Segmentation via Attention as Prompts","venue":"cs.CV","work_id":"7781fc4a-b452-48ba-825b-6b2e67110b27","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.393560Z"},"links":{"cited_paper":"/paper/2410.05963","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:433007a0ebe60acc434bbedcae63596e877a8bda84de6863fcf4a2144664e0bd","observation_id":"6e62c2d9-ad26-40df-88fc-cabaf3c2faed","resolution":{"observed_at":"2026-08-06T23:49:50.613998Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-06T23:49:45.468173Z","title":"arXiv:2310.03744 (2023) 1, 3, 8, 22, 24","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.468173Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:d70f346354a6bd3527efeeea39a043d525b2fef299a836a8980fa9670af37c55","observation_id":"5fbe7f04-c8d2-45fb-81f5-9af8f96f1455","resolution":{"observed_at":"2026-08-06T23:49:45.468173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:55.507409Z","title":"Advances in neural information processing systems (2024) 8","venue":null,"work_id":"57744f78-f9ff-4319-853b-605bb5bc3d37","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.539949Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:dfb8bf51bea2fb3e97f12cc2d45cbe2728d25482f48c1d0f167b9f5cfec284a2","observation_id":"71839e54-cbea-41a2-97e8-bcc8ee73b825","resolution":{"observed_at":"2026-08-06T23:49:55.596531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-06T23:49:45.617503Z","title":"arXiv preprint arXiv:2310.02255 (2023) 8, 24","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.617503Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:e4fa72ae6f87136e65190e63feba759a73c8954e18b636255ebed5f666c51a16","observation_id":"a4251389-5981-4b90-b62d-1ba9bc9617da","resolution":{"observed_at":"2026-08-06T23:49:45.617503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:55.313912Z","title":"In: 2019 international conference on document analysis and recognition (ICDAR)","venue":null,"work_id":"683fed24-82fb-485e-941c-cbd42e1fdf21","year":2019},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.687676Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:27100f824dc7a7bd53cba6ac90de3c1b7106d56b5f40108fff5e548eb8fcc600","observation_id":"31ad7542-aaeb-4ba7-a9be-74bc3164c0c2","resolution":{"observed_at":"2026-08-06T23:49:55.402737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T23:49:45.816843Z","title":"arXiv preprint arXiv:2304.07193 (2023) 22","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.816843Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:26badc8a67fed2549a89d894a0a4374f82a7665418693b4164f99f72582b6e5e","observation_id":"91842637-d3ff-49a2-ad46-658b1adaab72","resolution":{"observed_at":"2026-08-06T23:49:45.816843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:55.102821Z","title":"Advances in neural information processing sys- tems35, 27730–27744 (2022) 7","venue":null,"work_id":"580583d0-145b-49cc-a4f4-5831ee707456","year":2022},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.881314Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:c2f56a5e353cc7e16e2da1510c24a952f0ffe5fca215f91e554f726c678d6591","observation_id":"cd70e068-ccf4-4c56-b65d-eeb70eb1dc11","resolution":{"observed_at":"2026-08-06T23:49:55.200393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:45.941408Z","title":"In: Isabelle, P., Charniak, E., Lin, D","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.941408Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:8eb4431a236aa0b5acb8e8777e5eda44e7b3a0243d18055843c02a329a722469","observation_id":"42cb9477-c251-4144-b7cb-121d2db52b23","resolution":{"observed_at":"2026-08-06T23:49:45.941408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-06T23:49:45.997984Z","title":"arXiv:2304.03277 (2023) 1, 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:45.997984Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:71e97c5536874e21e0b2c51fa8447ca395ceb762713e9ba89d1b4fb76410a1fd","observation_id":"f47a43a0-2844-4d43-aa51-810c20ac5839","resolution":{"observed_at":"2026-08-06T23:49:45.997984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08876","last_updated":"2024-10-14T20:31:13Z","snapshot_observed_at":"2026-08-04T21:17:26.164677Z","submitted_at":"2024-10-11T14:51:00Z","title":"RoRA-VLM: Robust Retrieval-Augmented Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08876","snapshot_observed_at":"2026-08-06T23:49:46.093589Z","title":"arXiv preprint arXiv:2410.08876 (2024) 4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.093589Z"},"links":{"cited_paper":"/paper/2410.08876","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:77f54b41a12da9f3bea3972ec98109098c2614e6b764ab4ad379deb8114b51d6","observation_id":"5ee8edc0-f768-4d7e-a466-2eaf985c89e7","resolution":{"observed_at":"2026-08-06T23:49:46.093589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05814","last_updated":"2025-03-24T23:07:01Z","snapshot_observed_at":"2026-07-06T18:27:45.631190Z","submitted_at":"2024-06-09T15:00:28Z","title":"TIGeR: Unifying Text-to-Image Generation and Retrieval with Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05814","snapshot_observed_at":"2026-08-06T23:49:46.175261Z","title":"arXiv preprint arXiv:2406.05814 (2024) 3 AutoV 19","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.175261Z"},"links":{"cited_paper":"/paper/2406.05814","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:9eb74668e3c3dbf9993b841dcc5c85f8334849827f80190c77d93c7b9efbbf74","observation_id":"b424cf5e-108b-4c48-8869-38dbfcbdc8ba","resolution":{"observed_at":"2026-08-06T23:49:46.175261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.898932Z","title":"In: International conference on machine learning","venue":null,"work_id":"c5a5e6b1-bfd9-4e98-acaa-454d3fe4e870","year":2021},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.255571Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:9002ee4c42ace93ad14a4bed15640bf864d1527ce69f536a9a1cf54dfe5f2884","observation_id":"27898a5e-31e2-4784-9086-665f4e757a77","resolution":{"observed_at":"2026-08-06T23:49:55.013041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.714015Z","title":"OpenAI blog (2019) 3","venue":null,"work_id":"51a406ea-86fe-4320-8352-cbf367231f2a","year":2019},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.319643Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:8c09594d57ce00a96a0f4537fd7d8075e01804e1cd384d1237d0008e6dbe5757","observation_id":"c9d0127c-43fc-4ccf-b142-fd226a57ff10","resolution":{"observed_at":"2026-08-06T23:49:54.789451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.507993Z","title":"In: Proceed- ings of the 26th ACM SIGKDD international conference on knowledge discovery & data mining","venue":null,"work_id":"da862f5e-ed86-4e27-a741-e5a30314b57f","year":2020},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.383795Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:b0c6f9da005be3b139ca5fdedb20cf919a0cf3a089d48578eae17ec44faed676","observation_id":"ca3ec2ee-e277-48fe-8021-0cc8c7cf3709","resolution":{"observed_at":"2026-08-06T23:49:54.575910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:46.451964Z","title":"International Journal of Computer Vision (IJCV)115(3), 211–252 (2015).https://doi.org/10.1007/s11263-015-0816-y 25","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.451964Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:777ce30628cdcf60ea5cce3e11fba2a5975ec7a9c8451ca8d7e590514d385d5a","observation_id":"16950b2b-865f-421f-bd08-7b24a4cc941c","resolution":{"observed_at":"2026-08-06T23:49:46.451964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.279236Z","title":"In: Proceedings of the IEEE/CVF In- ternational Conference on Computer Vision","venue":null,"work_id":"9ddb47cf-bfb1-403e-9d2f-ebafe75897d3","year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.512356Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:792cc681825cfd62e2266eea986880803310fce8ac5875d38e9946b23ecf9f25","observation_id":"3ccbf71f-c489-4c63-9495-eda8dd689392","resolution":{"observed_at":"2026-08-06T23:49:54.373098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:54.093720Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"cccc0c9e-ed8c-4dc5-af70-159de152d42f","year":2019},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.578891Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:1be630351abb935bf7d72245f0cd7b67d2ef07b93bdd1ababff5c94d8763c25d","observation_id":"86d586b0-9680-486c-9e3f-162c30b461de","resolution":{"observed_at":"2026-08-06T23:49:54.177162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.945175Z","title":"In: IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2024, Seattle, WA, USA, June 16-22, 2024","venue":null,"work_id":"00baed5a-93b6-487b-8e6f-349e22043037","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.678317Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:da58bb7ac7ad3dbff6f9df6a5ba279d9a46630dc1e7fe3d5f1b4b4786415d611","observation_id":"2af3891e-4d2e-435e-925d-dd674b779fc4","resolution":{"observed_at":"2026-08-06T23:49:54.017425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.773172Z","title":null,"venue":null,"work_id":"6f9551fa-7712-430a-9d8a-712103a0539c","year":2025},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.778292Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:4792e91b2e154ea35f39034d92311efc342ccf36777460e2c36bc988edcd8d9b","observation_id":"8fa1d37a-00b5-4618-bfef-5bba855dad24","resolution":{"observed_at":"2026-08-06T23:49:53.855989Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T23:49:46.874332Z","title":"arXiv:2312.11805 (2023) 1","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.874332Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:b34d1f13f75ee35c6487f32100c12dc40907bebdc8970288bbe7a5d9519df66b","observation_id":"5ab4e903-be42-4e89-8382-648c3588d80a","resolution":{"observed_at":"2026-08-06T23:49:46.874332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T23:49:46.998208Z","title":"arXiv preprint arXiv:2403.05530 (2024) 1, 13","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:46.998208Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:1836a4720d76b8aa8cacfa5bc1d58573aa7c60de1165a9daee0df8da93162a9e","observation_id":"3d3401e8-2d2e-4e1c-8760-a0d7374bc36d","resolution":{"observed_at":"2026-08-06T23:49:46.998208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.598205Z","title":"Advances in Neural Information Processing Systems (2024) 8","venue":null,"work_id":"5c42b05e-87e7-4c13-9979-202ba20b83a4","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.087536Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:e1de4b7704223ebce96c0b1fc92ee9f42da45f084658455e902dfe7c3156a701","observation_id":"fd8e0cce-8028-491b-9170-f2e60edcfdad","resolution":{"observed_at":"2026-08-06T23:49:53.684287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.440511Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2024) 8, 24","venue":null,"work_id":"2afb52f1-5f22-4468-942a-ca2d5e6f3b64","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.132012Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:f6b9279f1f3147d1d64336486b2dcfaf9c707421cad810f02d8a052122dc5565","observation_id":"a5e28183-a82c-448b-9f78-bb92c0341f09","resolution":{"observed_at":"2026-08-06T23:49:53.529178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T23:49:47.193356Z","title":"arXiv:2302.13971 (2023) 1, 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.193356Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:f40617df782d4a11d971694801576d411a60705b63b76d1aae700860838bd000","observation_id":"b62fed41-5f33-40f5-bc61-a5b9bab7392d","resolution":{"observed_at":"2026-08-06T23:49:47.193356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T23:49:47.285204Z","title":"arXiv preprint arXiv:2307.09288 (2023) 8","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.285204Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:02d443ea690b77b6f3b8a979ee7b361c94d589b3564f05eeedd7eb8d5bef5fbf","observation_id":"00a39c9a-e009-49a8-b779-50e531aa505d","resolution":{"observed_at":"2026-08-06T23:49:47.285204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1411.57262","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.153957Z","title":null,"venue":null,"work_id":"65f46262-3ae4-4917-9f03-c0e2b1feba02","year":2015},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.407683Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:e001f927052df30e7169921af51602fa73712b2ada21d8eb35537b20291d5619","observation_id":"3bee457e-61bd-478f-b247-80d6e6e50ad7","resolution":{"observed_at":"2026-08-06T23:49:50.211516Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.273778Z","title":"Advances in neural information processing systems35, 24824–24837 (2022) 1 20 Zhang et al","venue":null,"work_id":"e5c84bf6-6686-463c-8f94-a2a0d0063e78","year":2022},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.467779Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:e33496d2227c4cd4cbcf7eed777f49eed70b127e97c60956adc23b6cc2376dcd","observation_id":"1b1ae32e-4f21-4040-8688-30b6726a507f","resolution":{"observed_at":"2026-08-06T23:49:53.344363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20454","last_updated":"2025-09-08T21:35:19Z","snapshot_observed_at":"2026-07-06T18:53:39.857584Z","submitted_at":"2024-07-29T23:18:55Z","title":"CoMMIT: Coordinated Multimodal Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20454","snapshot_observed_at":"2026-08-06T23:49:47.581290Z","title":"arXiv preprint arXiv:2407.20454 (2024) 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.581290Z"},"links":{"cited_paper":"/paper/2407.20454","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:0d0215495c5aace2365c3629dbbced5c72baa7179e9d21caeacc196a771c635e","observation_id":"de9d9344-0a43-42a5-bc31-053bb1099ebb","resolution":{"observed_at":"2026-08-06T23:49:47.581290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15310","last_updated":"2024-09-05T08:47:34Z","snapshot_observed_at":"2026-08-05T20:59:08.258366Z","submitted_at":"2024-09-05T08:47:34Z","title":"Visual Prompting in Multimodal Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15310","snapshot_observed_at":"2026-08-06T23:49:47.733190Z","title":"arXiv preprint arXiv:2409.15310 (2024) 1, 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.733190Z"},"links":{"cited_paper":"/paper/2409.15310","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:828249f848ad4d4c84da0e111dd8110cee36ce3ccee0421d32e5462359fcfb35","observation_id":"ee4b47a9-2a6b-4935-b17b-3a2656142bf0","resolution":{"observed_at":"2026-08-06T23:49:47.733190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:53.097983Z","title":"co / datasets / xai - org / RealworldQA[] 8","venue":null,"work_id":"c0670f3b-1e12-4d84-abd3-f345d0ab348f","year":2022},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.838345Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:273712e19ed922dae99ebb729d34168c7354fc030016d897bbe86f03b6b9f7e1","observation_id":"2d1deadb-7a6d-4f8e-9862-258ca63aa7f9","resolution":{"observed_at":"2026-08-06T23:49:53.179415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.952641Z","title":null,"venue":null,"work_id":"7f6b3a4b-9cce-4749-be0d-6947464f9d53","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:47.916466Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:2ac6686ae6c6959bba727c52769db04de1cb8f71bc052cf8af224275deec4a1c","observation_id":"1562428a-527c-49b2-89e7-537142322976","resolution":{"observed_at":"2026-08-06T23:49:52.993558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.793832Z","title":"In: Proceedings of the IEEE/CVF Conference on Com- puter Vision and Pattern Recognition","venue":null,"work_id":"64d7aab5-6952-4849-b49c-1cd1e24ad861","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:48.044615Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:a9913b53326221f4bb6d06e5d6d77377f6387502c5b0d533373fbc5804311ede","observation_id":"d6a43316-922f-42e6-958d-517bb29ceb94","resolution":{"observed_at":"2026-08-06T23:49:52.857659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:48.167803Z","title":"arXiv preprint arXiv:2502.13146 (2025) 4","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:48.167803Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:120a13beec6cd618aefe33581378bd69ee70783c05319a0e1f2fd56a9e8d88c9","observation_id":"f87b5678-d72d-4cdf-be5d-1e3671f9bd4f","resolution":{"observed_at":"2026-08-06T23:49:48.167803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.584940Z","title":"Advances in Neural Information Processing Systems36, 24993–25006 (2023) 3, 4, 8, 12","venue":null,"work_id":"5ca41795-e9ed-433d-b16c-8253906f81eb","year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:48.263139Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:daf0a611a95515e7a746be89178bd37817eda95abbc462d41cf4facf6b610a5e","observation_id":"eae86efb-ae16-46f3-888c-6a9397ec51a1","resolution":{"observed_at":"2026-08-06T23:49:52.715548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.410015Z","title":"In: European conference on computer vision (2016) 8","venue":null,"work_id":"e3287e56-8dac-4866-8f61-03281a1fe86a","year":2016},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:48.378319Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:2ee9d4c63e07e1aa46c75bad474b15d2352f28634748c3e72a41362b6ff63772","observation_id":"e831e6d9-661a-4064-8a45-e0bf0e5e96d2","resolution":{"observed_at":"2026-08-06T23:49:52.490457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.277685Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"1fef5904-f462-4a77-8108-db62ae14d9cf","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:48.477511Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:b8caae71be7d80761c5eda42d73f25f3fe977c0a396da20589cf20f8c246f2b4","observation_id":"6eee4560-a777-4c93-9803-1b092500d740","resolution":{"observed_at":"2026-08-06T23:49:52.344148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03226","last_updated":"2025-03-28T03:19:52Z","snapshot_observed_at":"2026-07-06T19:27:33.934338Z","submitted_at":"2024-10-04T08:26:06Z","title":"Frame-Voyager: Learning to Query Frames for Video Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03226","snapshot_observed_at":"2026-08-06T23:49:48.564539Z","title":"arXiv preprint arXiv:2410.03226 (2024) 6","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:48.564539Z"},"links":{"cited_paper":"/paper/2410.03226","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:3a78b9367ab7c8b504a98626b60685189716d22580037b1fc9eda78b0ee070ec","observation_id":"9e52b349-53d8-4935-9c12-82ce955bb5a3","resolution":{"observed_at":"2026-08-06T23:49:48.564539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-06T23:49:48.654570Z","title":"arXiv preprint arXiv:2308.02490 (2023) 8, 23","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:48.654570Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:398ebe7263c33479575299c9d0bd9832fa1b83b7be2a81a98ff593dfd183a4fb","observation_id":"39c91981-0d00-4d70-b54b-0b83a7d6f421","resolution":{"observed_at":"2026-08-06T23:49:48.654570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.109915Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2024) 8, 23","venue":null,"work_id":"deb49e01-985f-4f1c-b3ef-86bff4a0e2af","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:48.826533Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:04aa2b5868c6d03e2d69dd3f59da18a051c5379400c3b6e6f5a9d5b8b27b935b","observation_id":"fe689ff7-d5fb-469b-9766-e865a4bc2c02","resolution":{"observed_at":"2026-08-06T23:49:52.189741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:52.007847Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":"ff74ee44-c908-4b8b-a17b-d73383c219ca","year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:48.917001Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:179fea98590055e2222b9a09448fc25d5e5a3c3f230c332a89ed59e8e9cb3804","observation_id":"af87111e-c425-43b8-9b2a-771a669aecc3","resolution":{"observed_at":"2026-08-06T23:49:52.047047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.882280Z","title":"Advances in Neural Information Processing Systems36, 20299–20319 (2023) 1, 3","venue":null,"work_id":"abaa8d57-c067-4b87-b7c6-e9633ec100b7","year":2023},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:49.024703Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:8ef5518b72daf60e212853a8f2fc2ff1b917afc68594a266a75074d4928ad1f8","observation_id":"4104aa22-8493-4fc8-a709-44378d9539f8","resolution":{"observed_at":"2026-08-06T23:49:51.929376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.765974Z","title":"In: Proceedings of the 27th ACM International Conference on Multimedia","venue":null,"work_id":"f3bb6f5f-d8ba-4f51-959f-38b7b0e2907d","year":2019},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:49.180790Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:7c67973bc80908cb6779d5f1644ee8d5825ccf4e187e9406187b77e518351ded","observation_id":"e098ef78-1fc0-4e52-8d3c-782bd8074457","resolution":{"observed_at":"2026-08-06T23:49:51.822237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.459924Z","title":"ICLR (2025) 6, 12","venue":null,"work_id":"02636b8b-d029-4bc1-92af-46b23bd25616","year":2025},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:49.269835Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:14e896957481f70fd62abf766bea2e0b40f75d0e6937e80409d9636d29a1faf0","observation_id":"94290b77-91d5-46dd-bd2e-e6dfeabdf314","resolution":{"observed_at":"2026-08-06T23:49:51.628893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.278727Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2024) 3, 12 AutoV 21","venue":null,"work_id":"0e2bed41-8f5f-4f35-abb5-de05ed1506ad","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:49.378233Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:3cf990144cd81c0b4c3e1b9c32158f7b9f2e8d8ef99f70281a8aaef38f74a3c2","observation_id":"5bf82dca-0c49-4916-9cc5-b72111445e1e","resolution":{"observed_at":"2026-08-06T23:49:51.366436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:51.051615Z","title":"Advances in Neural Information Processing Systems37, 118632–118653 (2024) 6","venue":null,"work_id":"61821db3-7cc7-4d86-841d-2d6a65a2a297","year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:49.510556Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:5140f942b8bae3323459ba65f7603a0d9c7693c37f2c8f1e14d115e3de2797b9","observation_id":"ed683ece-5320-4571-9c26-6fcdef680427","resolution":{"observed_at":"2026-08-06T23:49:51.132004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:50.895890Z","title":"In: IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (2022) 1","venue":null,"work_id":"dc0734bb-c7ff-47fa-8f59-95f5414b5ac8","year":2022},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:49.577818Z"},"links":{"citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:40c9d7ee847f6761dbe2c36b8cfd1120e6fd497be628763f9b3253e038aafbcd","observation_id":"96a96328-d5f3-4894-997a-3beafc38e197","resolution":{"observed_at":"2026-08-06T23:49:50.970112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13046","last_updated":"2024-10-31T17:39:34Z","snapshot_observed_at":"2026-08-05T02:05:40.291312Z","submitted_at":"2024-04-19T17:59:48Z","title":"MoVA: Adapting Mixture of Vision Experts to Multimodal Context","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13046","snapshot_observed_at":"2026-08-06T23:49:49.696369Z","title":"CLIP-blind","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs","version":4},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:49.696369Z"},"links":{"cited_paper":"/paper/2404.13046","citing_paper":"/paper/2506.16112"},"observation_digest":"sha256:0ce2375d9fea62b2f6d6e15e393d8434969098b38b869b8861091a6369322c0b","observation_id":"28e97a0e-425d-403f-add9-a6f8a4c99323","resolution":{"observed_at":"2026-08-06T23:49:49.696369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.16112","last_updated":"2026-07-11T03:45:43Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T17:58:30.325831Z","submitted_at":"2025-06-19T08:02:53Z","title":"AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs"},"reference_resolution":{"displayed":83,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":36},"total_outbound_references":83},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 83 of 83 outbound references and 1 inbound Pith citation observation for arXiv:2506.16112."}