{"as_of":"2026-08-05T06:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f033117204b947ae04a739b01efce71c0b3617865d7d1d3132baf87230b35d6f","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T10:31:05.743053Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T14:44:32.242554Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T14:44:59.711636Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2603.14882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.14882","snapshot_observed_at":"2026-07-08T14:44:59.711636Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","venue":"cs.CV","work_id":"b203f4f8-87e9-451b-9d62-7fb164b5f2d8","year":2026},"citing_paper":{"arxiv_id":"2605.25343","last_updated":"2026-05-25T01:57:43Z","snapshot_observed_at":"2026-07-06T23:35:16.647496Z","submitted_at":"2026-05-25T01:57:43Z","title":"Toward Native Multimodal Modeling: A Roadmap","version":1},"reference_index":261,"source":"pdf_text","source_observed_at":"2026-06-29T22:58:38.610609Z"},"links":{"cited_paper":"/paper/2603.14882","citing_paper":"/paper/2605.25343"},"observation_digest":"sha256:b5354babe553958741ed680d751c40c4bbed69c24f71738acee426f4d1ab8b6c","observation_id":"bc148bdd-efd0-49e6-9c82-564e8ed3f352","resolution":{"observed_at":"2026-06-29T23:04:01.864944Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2603.14882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.14882","snapshot_observed_at":"2026-07-08T14:44:59.711636Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","venue":"cs.CV","work_id":"b203f4f8-87e9-451b-9d62-7fb164b5f2d8","year":2026},"citing_paper":{"arxiv_id":"2607.06165","last_updated":"2026-07-07T11:39:57Z","snapshot_observed_at":"2026-08-04T21:06:25.224193Z","submitted_at":"2026-07-07T11:39:57Z","title":"EAGOR: Embodied Reasoning in Omni-direction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-08T14:44:32.242554Z"},"links":{"cited_paper":"/paper/2603.14882","citing_paper":"/paper/2607.06165"},"observation_digest":"sha256:063694335a058e0e3c533372ed488a821258c465060ee7a272393a057aaa928f","observation_id":"2ca7f7bd-a232-4a5d-b24c-c506c11375b3","resolution":{"observed_at":"2026-07-08T14:44:59.712899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.14882/citation-record","integrity":"/paper/2603.14882/integrity","json":"/paper/2603.14882/citation-record.json","paper":"/paper/2603.14882"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data augmentation with noise and blur to enhance the performance of yolo7 ob- ject detection algorithm","venue":null,"work_id":"387ea71a-36de-4a5f-a8ae-ba5e68277207","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:aa3179a756af1e2492ddde54ea19cef006a858ef1dc848f63b12dee198e2e827","observation_id":"c32950ae-fa91-4131-b677-39c5bb600aff","resolution":{"observed_at":"2026-05-15T10:39:57.694263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object detection through search with a foveated visual system.PLoS com- putational biology, 13(10):e1005743","venue":null,"work_id":"639914e6-6564-4908-b376-5b7adf535a42","year":2017},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:870a3c397c26082e69a8d038b5ad167223afa98c539c352013bd6f0eccfbbf24","observation_id":"648f6afc-2a75-4370-afd1-7968eab41f11","resolution":{"observed_at":"2026-05-15T10:39:57.731196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736","venue":null,"work_id":"39acf795-5cf8-436e-9263-403289f4a06c","year":null},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:0bc9e3761e8c0cb2ee87b7b8e97c7aa0f749e15506f9cfa52016eb6cc058fd59","observation_id":"98835792-3e93-48f2-889e-9ae8bbf9883e","resolution":{"observed_at":"2026-05-15T10:39:57.734642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M ¨obius trans- formations revealed.Notices of the American Mathematical Society, 55(10):1226–1231","venue":null,"work_id":"2fb9cedd-d403-49d3-a6fb-c666dfa8ec8f","year":2008},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:536963b90b5818affc0c72e36f9e85bc82f55205140acbbce98d911fc14c70bb","observation_id":"1dc8fe82-bf2c-473a-b38b-23e5989aab5d","resolution":{"observed_at":"2026-05-15T10:39:57.737928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:44f43db077e353cc6a103765e5c7c720748d5f0503bbc5cae051409cad5f9062","observation_id":"f4ae511c-044a-404e-be6e-f055bedf5d7f","resolution":{"observed_at":"2026-05-15T10:35:27.643584Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A summary-statistic representation in peripheral vision ex- plains visual crowding.Journal of vision, 9(12):13–13","venue":null,"work_id":"7ecaa990-83c2-4820-81cc-233757e22078","year":2009},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:31f0005831fcce81fe77ded58604707b7c74f2fc353af54f61d86a7a4dd15fb2","observation_id":"0ffaac07-16ee-4144-bc56-e27e8abf039d","resolution":{"observed_at":"2026-05-15T10:39:57.744724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-07-06T14:06:56.291161Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"cited_work":{"arxiv_id":"2210.09461","doi":"10.48550/arxiv.2210.09461","metadata_source":"pith","pith_arxiv_id":"2210.09461","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Token Merging: Your ViT But Faster","venue":"cs.CV","work_id":"528509bc-2611-4e7f-a772-ea14d25b6dae","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2210.09461","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:dd6b46ca9cd586d6cd8e4a12f4c0da14246e55d6cf7e9e7df7221c1655416ff1","observation_id":"1fb6bdf0-2b41-4cb2-a621-8e85202e8e35","resolution":{"observed_at":"2026-05-15T10:35:27.626152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A general survey on attention mechanisms in deep learning.IEEE transactions on knowledge and data engineering, 35(4):3279–3298","venue":null,"work_id":"77fa4a0a-3724-46bf-8d19-c713b86f7fd0","year":2021},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:1f8c2f52b846298df4fa3fea4fd25c2549c74367d22ed020f93966ee7828f02e","observation_id":"bf716ec9-bd95-46e7-8e6d-d5420f1b131b","resolution":{"observed_at":"2026-05-15T10:39:57.727690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convolutional neural networks develop ma- jor organizational principles of early visual cortex when en- hanced with retinal sampling.Scientific Reports, 14(1):8980","venue":null,"work_id":"9f648215-87f5-4e6e-82da-84a28523d7c7","year":null},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:70d582626a615c43a6b65ca88f9dd6394b03b2bf51ff2a0e2ba3b3ab81a3c456","observation_id":"27e13e15-c2fa-4f89-98ca-3ecb3745ca7b","resolution":{"observed_at":"2026-05-15T10:39:57.741300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instructblip: Towards general-purpose vision- language models with instruction tuning.Advances in neural information processing systems, 36:49250–49267","venue":null,"work_id":"e0e9c2ed-7f40-4152-b2a6-f111f525427e","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:b5943390d14dd55ccf75379cf57f7d96b6f39310f16e42e8d83577b21d9d38a8","observation_id":"f9619b07-9ced-4ece-a261-43bc2bfd7a9f","resolution":{"observed_at":"2026-05-15T10:35:28.672840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The representation of the visual field on the cerebral cortex in monkeys.The Journal of physiology, 159(2):203","venue":null,"work_id":"b7e414a7-b165-4d92-b36c-e405a4366320","year":1961},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:b394ef17438c3edd1e9afc9ff04e6afa6ae55f9ca583f70aeb6dd6edaaae7a2d","observation_id":"e38eead7-ab86-4145-8ce8-c03db7705e70","resolution":{"observed_at":"2026-05-15T10:35:28.674871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PhD thesis, Indian Institute of Technology Gandhinagar","venue":null,"work_id":"e72dcd26-523c-44e7-a190-7c9f6bb7f563","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:0ade08e87be181aa4da34ea3441aec47c415883495003d620baf4439d5ea90d9","observation_id":"836cf222-4930-47d3-b85f-1eeb032470f2","resolution":{"observed_at":"2026-05-15T10:35:28.668644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Modified harris hawk optimization algorithm for mul- tilevel image thresholding","venue":null,"work_id":"c83d45d8-f8fd-4f34-a727-45f51afb506d","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:4e4eb15727a2bd550358f3fe9072020d3b22c92899d2f9e594b3d8585f3cf4a3","observation_id":"9bd20661-793f-4b0d-989c-b17dfc2dee5d","resolution":{"observed_at":"2026-05-15T10:39:57.747620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scribgen: generating scribble art through meta- heuristics","venue":null,"work_id":"2ba75466-1cbf-49c5-a359-ba045335cb86","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:3441cfabaf117a3cb44adf89972321213b19ce2d0ad8342bf758387895ecd55b","observation_id":"29105450-b676-4f6f-bd49-ff593144082d","resolution":{"observed_at":"2026-05-15T10:35:28.666373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07991","last_updated":"2021-06-22T21:21:08Z","snapshot_observed_at":"2026-07-06T09:28:59.431672Z","submitted_at":"2020-06-14T19:34:44Z","title":"Emergent Properties of Foveated Perceptual Systems","version":3},"cited_work":{"arxiv_id":"2006.07991","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07991","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emergent proper- ties of foveated perceptual systems","venue":null,"work_id":"f48abe65-becf-40de-9f10-d3ea1c582c4d","year":2006},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2006.07991","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:951c314fcdc1573f40c1c9ec4e34dce4a73965adc5a78405d7dc78b7fea625fa","observation_id":"f520765a-c60f-4bcf-9cfd-94736ae05b6e","resolution":{"observed_at":"2026-05-15T10:35:27.617377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Image quality assessment: Unifying structure and texture similarity.IEEE transactions on pattern analysis and ma- chine intelligence, 44(5):2567–2581","venue":null,"work_id":"a0965a49-3edf-442a-91c3-feb917c56270","year":2020},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:46d855ab4083f5d1ccdaaaa2d60159f495d93480585dcd071f956b1c4a7d1703","observation_id":"4d725512-2d7f-40e7-a844-d7a0cf57d081","resolution":{"observed_at":"2026-05-15T10:35:28.676882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Selective attention and the organization of vi- sual information.Journal of experimental psychology: Gen- eral, 113(4):501","venue":null,"work_id":"5c3650a1-28df-4c56-871d-bc767a8d0067","year":1984},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:adc210137fbbeb8080a78c74552fc07e1bf28c6a87589e7c9fbfc1d1deb9097d","observation_id":"5413c99f-e089-4148-b28e-19f867774949","resolution":{"observed_at":"2026-05-15T10:35:28.681103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metamers of the ventral stream.Nature neuroscience, 14(9):1195–1201","venue":null,"work_id":"24a2f341-e897-4317-9de3-d9f062fa2c04","year":null},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:ef71bfd001cba6ed79fc957a4f7780663af1c3b24f9bcc3ca5e642055ad8c0ba","observation_id":"5b736cc7-cc00-46f2-8146-f9de1e5efb70","resolution":{"observed_at":"2026-05-15T10:35:28.661486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The free-energy principle: a unified brain the- ory?Nature reviews neuroscience, 11(2):127–138","venue":null,"work_id":"2c6fa31b-9de8-4b99-a1e9-da26278dc9a3","year":2010},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:56d75c88b32719feb6c32efd2076face684c99645d1546e303c7b265f93d6199","observation_id":"c080502c-a7b0-4022-8eb0-79be1878c4b9","resolution":{"observed_at":"2026-05-15T10:35:28.659117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10516","last_updated":"2024-04-01T20:57:45Z","snapshot_observed_at":"2026-07-06T17:45:23.748539Z","submitted_at":"2024-03-15T17:57:06Z","title":"FeatUp: A Model-Agnostic Framework for Features at Any Resolution","version":2},"cited_work":{"arxiv_id":"2403.10516","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.10516","snapshot_observed_at":"2026-07-04T10:19:47.772835Z","title":"Featup: A model- agnostic framework for features at any resolution","venue":null,"work_id":"e8f8c9b1-89ad-4c27-a3f4-dc6df53ca77d","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2403.10516","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:ab2365110d972969745dcba8cca277e4c6c3ca13d3f4a4f1a8002f713b21288d","observation_id":"ed7dd5ed-17e5-4800-a57c-90329ed1a442","resolution":{"observed_at":"2026-05-15T10:35:27.608930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mini-internvl: a flexible-transfer pocket multi-modal model with 5% parameters and 90% perfor- mance.Visual Intelligence, 2(1):32","venue":null,"work_id":"0773d437-b706-428b-8fca-7e08206d25e0","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:a12af6679e58bbf714577c06c0c5cf3bccb6baba87818a878e3be8b78cca3030","observation_id":"749041e1-ea54-4138-ba47-b955f65917e9","resolution":{"observed_at":"2026-05-15T10:39:57.762710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vari- able resolution improves visual question answering under a limited pixel budget","venue":null,"work_id":"4c54a5c9-05a4-4a0e-b93e-e1f73d24eb18","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:5b792b52644232033da5ba353369442fc8c92ba10b01f3a0dcfa93f01d502d04","observation_id":"52dbf0eb-e94f-4dd0-bd72-c73bb32557bf","resolution":{"observed_at":"2026-05-15T10:35:28.650273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"See- ing more with less: Human-like representations in vision models","venue":null,"work_id":"a2e3cc81-d8b5-4be8-92fb-56e534ca6a51","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:c7d762fe8ec376df3bc6141b88df71d90d8226560cb7eabc970622517e5617dd","observation_id":"990b23ff-9a13-40d3-bd34-b84cd34ab078","resolution":{"observed_at":"2026-05-15T10:35:28.654698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answer- ing","venue":null,"work_id":"546a793f-3348-446f-820d-094aef779344","year":2017},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:4344652d3e795575c8b0a5a4721c775be32e2d1f5f37f3d56a4de88b66b50ee1","observation_id":"07a056aa-f506-4a0a-9fdc-862517fda58c","resolution":{"observed_at":"2026-05-15T10:39:57.713950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lvis: A dataset for large vocabulary instance segmentation","venue":null,"work_id":"5651726c-eb27-4242-83c4-899ecab34841","year":2019},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:1e0eb0289b4c71ced03137cb6a428bf51319c11e96f7d377a13a5137a958c84a","observation_id":"0466e7cf-1a37-4ca0-a7a6-6f679a77bec9","resolution":{"observed_at":"2026-05-15T10:35:28.646080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on vision transformer","venue":null,"work_id":"18e6a2a7-24da-48ae-b12d-82387e49a67a","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:c6de21733a11eb5bd8d4366b593dc3757694f3040c2372582630648231caa30c","observation_id":"a5c62fa2-5f0a-4ae3-b774-f519f8053f40","resolution":{"observed_at":"2026-05-15T10:35:28.643977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coco-periph: bridging the gap between human and machine perception in the periphery","venue":null,"work_id":"19e8ec0b-af03-4f7b-b4a1-c859c783b85a","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:7217db629c9092d336c7abfb6e5303d19994992d2bc5afdf54f359475f92d84b","observation_id":"82eb9942-4941-40b6-9882-1069f6e1fec9","resolution":{"observed_at":"2026-05-15T10:35:28.648058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eye movements in natural behavior.Trends in cognitive sciences, 9(4):188–194","venue":null,"work_id":"444e39bc-2d90-48ea-851b-084ffe6443d5","year":2005},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:9fd4a2c31760027580956b7409d1aae15990915d2c39301f5d20679d1a04759d","observation_id":"14c681cd-a103-4d04-a332-dac975a1aea9","resolution":{"observed_at":"2026-05-15T10:35:28.652701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vi- sual prompt tuning","venue":null,"work_id":"a931f630-8d23-4711-858d-13e3f3bed386","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:f821fd37437f82d8da33c67789f7123c2fbdf52817cb8ae7bf75cb940b581fe0","observation_id":"79981c56-12b0-4e38-9522-7e19687406cb","resolution":{"observed_at":"2026-05-15T10:35:28.642204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transformers in vision: A survey.ACM computing surveys (CSUR), 54(10s):1–41","venue":null,"work_id":"87ee5798-f743-438b-8811-a403ee8318ec","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:4842d88ba5e6b3ccd89ca7ed851e306b7077efda59af81f684c24a4c6f4fd838","observation_id":"929a1275-463c-42d0-9969-634425b509b0","resolution":{"observed_at":"2026-05-15T10:35:28.640412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01450","last_updated":"2023-12-03T16:48:09Z","snapshot_observed_at":"2026-08-01T01:50:20.876210Z","submitted_at":"2023-12-03T16:48:09Z","title":"Foveation in the Era of Deep Learning","version":1},"cited_work":{"arxiv_id":"2312.01450","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.01450","snapshot_observed_at":"2026-07-01T22:26:17.680591Z","title":"Foveation in the era of deep learning","venue":null,"work_id":"65b42d6c-f8f6-48bb-94d5-947897f21466","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2312.01450","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:f9371e5c36c178f4c8bb7d05e4a7a4d9e35aa636121f9456aa709491c48241bc","observation_id":"d99382e1-c4b5-440e-8e40-64155488d60f","resolution":{"observed_at":"2026-05-15T10:35:27.662926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Oxford Uni- versity Press","venue":null,"work_id":"ec0163f9-8179-42f2-8917-e0a1d3c6b6d5","year":2009},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:bce410a7c05e60431a3076a387dfc31711e2156b671059790c82ad1798d4161c","observation_id":"d122a807-d21f-4a6a-bf84-9729c95af1f8","resolution":{"observed_at":"2026-05-15T10:35:28.670665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16125","last_updated":"2023-08-02T08:02:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-30T04:25:16Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","version":2},"cited_work":{"arxiv_id":"2307.16125","doi":"10.48550/arxiv.2307.16125","metadata_source":"pith","pith_arxiv_id":"2307.16125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SEED-Bench: Benchmarking Multimodal LLMs with Generative Comprehension","venue":"cs.CL","work_id":"23881ff0-b851-474c-8712-90744cc07a3a","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2307.16125","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:ae46ec8ac89429eb7056087126e53080065b673f669ef107f19bdb3374b9198e","observation_id":"7ca8e6f7-f59b-4d3c-915e-01d66a709c4b","resolution":{"observed_at":"2026-05-15T10:35:27.613119Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":"2408.03326","doi":"10.48550/arxiv.2408.03326","metadata_source":"pith","pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","venue":"cs.CV","work_id":"f5f2452b-f2a9-49ac-b38d-c76e18cdfe49","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:28f2e093b9dace098b021b8d33824b9d25cfeb8b2e77122166c1f7b23875d533","observation_id":"99321951-9ab3-4bcd-938e-2702b5060799","resolution":{"observed_at":"2026-05-15T10:35:27.647915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"0b67aebc-8de9-487f-b4cd-fd2663288141","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:43d2ee2d891a7768addfed6a70356db11aa9ade236852a884008e7be7662eee5","observation_id":"4cc72545-f925-4f5b-9606-645e278c9179","resolution":{"observed_at":"2026-05-15T10:35:28.638366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-02T22:29:36.344544Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":"2403.05525","doi":"10.48550/arxiv.2403.05525","metadata_source":"pith","pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","venue":"cs.AI","work_id":"30da36a4-b9ad-4618-8955-c09232b61343","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:cc91a379ee87564bec05342e5e48b0fa1debadcc8d60bd7ee14899aabf06456a","observation_id":"5063c342-afa5-446b-9dd7-63d8c0d2ed08","resolution":{"observed_at":"2026-05-15T10:35:27.621585Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bio- logically inspired deep learning model for efficient foveal- peripheral vision.Frontiers in Computational Neuroscience, 15:746204","venue":null,"work_id":"f3254e3d-b8a2-4bfd-9af4-ce52aa97317b","year":2021},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:07b4afef9d129f3a9843cbea4c6e9c962b3ff62a570cd9c4deec107974aa5427","observation_id":"30e190e7-0b4c-42d4-871d-2a753af1ae27","resolution":{"observed_at":"2026-05-15T10:35:28.656836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09154","last_updated":"2025-09-11T05:23:22Z","snapshot_observed_at":"2026-08-04T19:38:53.910372Z","submitted_at":"2025-09-11T05:23:22Z","title":"Mind Meets Space: Rethinking Agentic Spatial Intelligence from a Neuroscience-inspired Perspective","version":1},"cited_work":{"arxiv_id":"2509.09154","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09154","snapshot_observed_at":"2026-07-08T14:44:59.715816Z","title":"Mind meets space: Rethinking agentic spatial intelligence from a neuroscience-inspired per- spective","venue":"cs.AI","work_id":"3b07272b-7eb9-49fd-81aa-79ee952f812c","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2509.09154","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:d60e72154b9b928eb7936902ffa0dbafd551702195b137c317e36a21668fcb72","observation_id":"7b332d7e-6c2c-4cf3-ab75-c75b15888d8c","resolution":{"observed_at":"2026-05-15T10:35:27.635083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05299","last_updated":"2025-04-07T17:58:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T17:58:57Z","title":"SmolVLM: Redefining small and efficient multimodal models","version":1},"cited_work":{"arxiv_id":"2504.05299","doi":"10.18653/v1/2025.acl-long.718","metadata_source":"pith","pith_arxiv_id":"2504.05299","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SmolVLM: Redefining small and efficient multimodal models","venue":"cs.AI","work_id":"810cc87f-f6bd-4443-9673-5e30982426b9","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2504.05299","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:b1596604913909c2c101d1111cb34a78bae45cef49437cd0f4470a1ee39d90a9","observation_id":"a03270dc-468f-497d-95dc-4e01ce2af4d9","resolution":{"observed_at":"2026-05-15T10:35:27.604164Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Peripheral vision transformer.Advances in Neural Informa- tion Processing Systems, 35:32097–32111","venue":null,"work_id":"3887646e-32b0-46e6-81fa-c88eb87362cc","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:aad8e856e701e34f51321daebfa8616b98e6959d19de74a8d03789794d4a4d10","observation_id":"3e1398e7-de42-4952-a76d-a94d53d1d51e","resolution":{"observed_at":"2026-05-15T10:35:28.664296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The geometry of m ¨obius transformations","venue":null,"work_id":"3ee45eb4-e2db-4fb9-92fd-0730be7274f9","year":2010},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:b20155edab29c046381cff75c1cd22fc5eeb39aa30925a5217453d9bdbf82d82","observation_id":"ff5e0932-77bb-4a0e-8bf0-8a36035ca3a8","resolution":{"observed_at":"2026-05-15T10:39:57.756118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to search for and detect objects in foveal images using deep learning","venue":null,"work_id":"f3dc4a82-0e85-4c5a-861b-03a37580fe29","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:85379206a6bb303104eeef283167aa6a087b2d1924ae51126ba2f9738558f85d","observation_id":"5b08aeba-4620-41e4-a457-0e53e67a8a2f","resolution":{"observed_at":"2026-05-15T10:39:57.753523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Human peripheral blur is optimal for object recognition.Vision research, 200: 108083","venue":null,"work_id":"ef1a54b1-89ed-4ed0-9fba-44bb8fd5756c","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:c69acbaec424aeb783c8c59828860ebbe8f1c695aeb03b2e923d2afe0abd301a","observation_id":"52f67fdc-44b3-4d3c-bb24-706a049ab5cb","resolution":{"observed_at":"2026-05-15T10:39:57.710594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T00:41:41.595118Z","title":"Dynamicvit: Efficient vision transformers with dynamic token sparsification.Advances in neural information processing systems, 34:13937–13949","venue":null,"work_id":"40b56994-c151-4f5d-b64c-0416c77175b6","year":null},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:253e0982e2425a07899ada3d4a4f45c6a9410919773c772bc328eab822df2445","observation_id":"a94cd915-bce3-4f97-b45c-40659c023607","resolution":{"observed_at":"2026-05-15T10:39:57.750484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Biologically inspired image sampling for electronic eye","venue":null,"work_id":"db52f70c-78d5-4d93-ace8-d3389b12a3a9","year":2010},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:726331bcc356e549a35246da4019ab5b0e6ee65cb0140b14565205a14319ef2c","observation_id":"c74410da-f002-4040-a94e-d837bdc379a8","resolution":{"observed_at":"2026-05-15T10:39:57.723571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robotic materials with bioinspired microstructures for high sensitivity and fast ac- tuation.Advanced Science, 13(15):e09739","venue":null,"work_id":"7909207e-87a9-4ba8-9933-bfa26e47d9de","year":2026},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:d7805070a3ca08fc268abe3b67e8870931100fd34609262e9a812e166b97bbae","observation_id":"eaa78c98-22e2-47ad-9a4c-19cd4889d51e","resolution":{"observed_at":"2026-05-15T10:39:57.717368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A-okvqa: A benchmark for visual question answering using world knowl- edge","venue":null,"work_id":"f3c224e7-97ef-4ea7-b587-e0834689c263","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:177845ecf231ac4ab1ec35a2d2c6b4902d5a270c9e092a1ea393812a06da6028","observation_id":"0218b050-ffb4-4e88-b015-d151fb2e6cf9","resolution":{"observed_at":"2026-05-15T10:39:57.706937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.09093","last_updated":"2022-11-19T05:13:45Z","snapshot_observed_at":"2026-08-03T01:20:09.302039Z","submitted_at":"2022-04-19T18:57:47Z","title":"Behind the Machine's Gaze: Neural Networks with Biologically-inspired Constraints Exhibit Human-like Visual Attention","version":2},"cited_work":{"arxiv_id":"2204.09093","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.09093","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Behind the machine’s gaze: Neural networks with biologically-inspired constraints exhibit human-like visual attention","venue":null,"work_id":"6713fd2c-182d-4f08-bd03-2d6df355c3e8","year":2022},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2204.09093","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:da94c56d1de74d03a0d05cefb79091603edf7b90ad2b6f4910b297b07a2fdacb","observation_id":"d7534fa2-d532-452e-90a6-86752c1da381","resolution":{"observed_at":"2026-05-15T10:35:27.658311Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multivariate stochastic approximation using a simultaneous perturbation gradient approximation.IEEE transactions on automatic control, 37(3):332–341","venue":null,"work_id":"17064360-9ba8-424e-8cbb-ea32a2a44df5","year":2002},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:14dd29987b3dc6b9fe522bb69c98892607a060dc3966d6fab786c279527cce09","observation_id":"f3921aa6-5a35-43f5-ab29-7575a8922137","resolution":{"observed_at":"2026-05-15T10:35:28.678951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pe- ripheral vision and pattern recognition: A review.Journal of vision, 11(5):13–13","venue":null,"work_id":"e110f9a2-4af5-494a-9953-f4f2d5b42e42","year":2011},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:65c53ed98736b3fb65f0681468db80b247f80305ae299aa8804d8c874f1f4ab5","observation_id":"af1f6430-0ad6-415a-82e8-961a673bfa71","resolution":{"observed_at":"2026-05-15T10:39:57.759239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Central and peripheral vision for scene recognition: A neurocomputational model- ing exploration.Journal of vision, 17(4):9–9","venue":null,"work_id":"eb3a70d2-d4c0-49c6-8d0d-a695bfa6d984","year":2017},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:7aaf6fcb6938bfc1410f72c2865f235024d303b2cd1b857931fd58a00a90a174","observation_id":"41923778-ee58-4d55-a2a5-73b6a9255a3f","resolution":{"observed_at":"2026-05-15T10:39:57.697699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":"2409.12191","doi":"10.48550/arxiv.2409.12191","metadata_source":"pith","pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","venue":"cs.CV","work_id":"8abcfe4f-e0fb-44b7-9123-448fac95f90a","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:074c72ea4e415f1ef596a950ef687c2b4e1f38600b4a5badeb4b3ba9bfd4087d","observation_id":"d9ea73e5-70da-456b-bb51-9e6a76e7037c","resolution":{"observed_at":"2026-05-15T10:35:27.630268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:33.884263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers.Ad- vances in neural information processing systems, 33:5776– 5788","venue":null,"work_id":"c0ad32e9-ae32-43cb-b2a4-07a1e372b82a","year":2020},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:dbb496bc566acec0ec4ec8ebfe408896c29a148853b6f603020c751540c586ba","observation_id":"88e62a00-72a6-4ce4-89da-d692cf9e9866","resolution":{"observed_at":"2026-05-15T10:39:57.720624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emulating human-like adaptive vision for efficient and flexible machine visual perception.Nature Machine In- telligence, pages 1–19","venue":null,"work_id":"a786870a-5f42-4fff-aef2-ceb18b21f2ea","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:6aad66c9568ba205d06030e3e7c0daa0aea8829bc5185bed4b28f9f8ddaba891","observation_id":"573345b3-4ac8-47be-95dd-b4a9928691c7","resolution":{"observed_at":"2026-05-15T10:39:57.703051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Controlmllm: Training-free visual prompt learning for multimodal large language models.Advances in Neural Information Processing Systems, 37:45206–45234","venue":null,"work_id":"d1c23c4b-a119-43e7-8e6b-6e826f7cc4b9","year":2024},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:a40163bdc0a40b7e3fa976fd98cde9ea8e4a53b401d485fd9d8a64c7ffb8301e","observation_id":"01a0c6a9-d91f-4ce8-960d-4fdeeda6d0d8","resolution":{"observed_at":"2026-05-15T10:39:57.702339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:0175e5038946b150cd00fc4f3ae59683b4a60feb1b55b70e67a7c2d45218ebde","observation_id":"7cba3786-890d-45cd-ae9c-bc4f6b09d91e","resolution":{"observed_at":"2026-05-15T10:35:27.639521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07704","last_updated":"2023-10-11T17:55:15Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T17:55:15Z","title":"Ferret: Refer and Ground Anything Anywhere at Any Granularity","version":1},"cited_work":{"arxiv_id":"2310.07704","doi":"10.48550/arxiv.2310.07704","metadata_source":"pith","pith_arxiv_id":"2310.07704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferret: Refer and Ground Anything Anywhere at Any Granularity","venue":"cs.CV","work_id":"0db2bf55-f649-4428-bcc9-688724b38e57","year":2023},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"cited_paper":"/paper/2310.07704","citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:6dbc40913f4a7750e4ff1d0914bd1b443e41f00f018a2b89e2c47f4e3207f6ac","observation_id":"ba856bf3-d05e-4a5b-8f09-33256ac6d2d3","resolution":{"observed_at":"2026-05-15T11:29:05.422888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vsi: A visual saliency-induced index for perceptual image quality assess- ment.IEEE Transactions on Image processing, 23(10): 4270–4281","venue":null,"work_id":"9993a25c-9701-44c8-b63d-9375f9599308","year":2014},"citing_paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-15T10:31:05.743053Z"},"links":{"citing_paper":"/paper/2603.14882"},"observation_digest":"sha256:5cb9510404f5da67ab15a5440bc7bade3debf1a6461a81e9df8b2acb9c4dec5c","observation_id":"7e47f42b-2de2-4bdb-9986-2f98378a40c9","resolution":{"observed_at":"2026-05-15T10:39:57.685691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2603.14882","last_updated":"2026-04-26T02:28:07Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:49:10.383198Z","submitted_at":"2026-03-16T06:29:43Z","title":"LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":14,"verified_fuzzy":44},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 2 inbound Pith citation observations for arXiv:2603.14882."}