{"as_of":"2026-08-16T07:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ecdd5c7f42b33ec9a9c6b1dbcd00e1860ead846150708c3358830457dd67df91","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:19:43.691285Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T08:23:29.666893Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T23:55:52.903831Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2509.06461","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06461","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Focusing by contrastive attention: Enhancing vlms’ visual reasoning","venue":null,"work_id":"f5fa2c37-d1be-4c55-bbcd-07fa53fd48d1","year":2025},"citing_paper":{"arxiv_id":"2604.05418","last_updated":"2026-04-16T09:51:53Z","snapshot_observed_at":"2026-08-13T01:46:29.436206Z","submitted_at":"2026-04-07T04:26:59Z","title":"VideoStir: Understanding Long Videos via Spatio-Temporally Structured and Intent-Aware RAG","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T19:15:02.124035Z"},"links":{"cited_paper":"/paper/2509.06461","citing_paper":"/paper/2604.05418"},"observation_digest":"sha256:1ef8bc14b4a0d7be02b20210cd13aa18478fb2fe6b60686319bbf9c6415a6843","observation_id":"5fda0e9e-2c53-4a1f-9083-8218ce0a7761","resolution":{"observed_at":"2026-05-10T23:15:50.082045Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2509.06461","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06461","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Focusing by contrastive attention: Enhancing vlms’ visual reasoning","venue":null,"work_id":"f5fa2c37-d1be-4c55-bbcd-07fa53fd48d1","year":2025},"citing_paper":{"arxiv_id":"2604.06912","last_updated":"2026-04-08T10:12:30Z","snapshot_observed_at":"2026-08-16T04:56:45.065539Z","submitted_at":"2026-04-08T10:12:30Z","title":"Q-Zoom: Query-Aware Adaptive Perception for Efficient Multimodal Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T18:46:26.869644Z"},"links":{"cited_paper":"/paper/2509.06461","citing_paper":"/paper/2604.06912"},"observation_digest":"sha256:d1ec57e4383194bd74f35bbd2711930a3958604ae9c4d3e8a999b93cf094377c","observation_id":"883c2d02-7a73-435e-96b7-daa1a9bd304a","resolution":{"observed_at":"2026-05-10T23:55:52.906909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2509.06461","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06461","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Focusing by contrastive attention: Enhancing vlms’ visual reasoning","venue":null,"work_id":"f5fa2c37-d1be-4c55-bbcd-07fa53fd48d1","year":2025},"citing_paper":{"arxiv_id":"2604.15583","last_updated":"2026-04-24T15:54:27Z","snapshot_observed_at":"2026-08-10T21:44:14.791442Z","submitted_at":"2026-04-16T23:34:51Z","title":"SAGE: Selective Attention-Guided Extraction for Token-Efficient Document Indexing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T08:32:02.222528Z"},"links":{"cited_paper":"/paper/2509.06461","citing_paper":"/paper/2604.15583"},"observation_digest":"sha256:d23386e4ec56f9e9981ae6fa01928546a7a9dc9845a21881c70662308ba7d19f","observation_id":"4049c009-9922-4234-bd67-1e1ff8eebe64","resolution":{"observed_at":"2026-05-10T08:32:52.107088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06461","snapshot_observed_at":"2026-08-01T08:23:29.666893Z","title":"Fo- cusing by contrastive attention: Enhancing vlms’ visual reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21151","last_updated":"2026-07-26T23:23:12Z","snapshot_observed_at":"2026-08-16T00:29:09.440481Z","submitted_at":"2026-07-23T10:35:38Z","title":"V-DEAL: Diagnosing Video Safety De-Calibration as an Understanding-Refusal Coupling Failure","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T08:23:29.666893Z"},"links":{"cited_paper":"/paper/2509.06461","citing_paper":"/paper/2607.21151"},"observation_digest":"sha256:c855f00bdd17007f9683078950896da602f48aa7edd540e0c8f0f103db58c1ea","observation_id":"4b4b0dab-6a3f-4a77-a3dd-70cbd4b3efb0","resolution":{"observed_at":"2026-08-01T08:23:29.666893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.06461/citation-record","integrity":"/paper/2509.06461/integrity","json":"/paper/2509.06461/citation-record.json","paper":"/paper/2509.06461"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.17116","last_updated":"2025-05-30T00:36:37Z","snapshot_observed_at":"2026-08-15T23:29:30.087978Z","submitted_at":"2024-11-26T05:10:04Z","title":"Star Attention: Efficient LLM Inference over Long Sequences","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17116","snapshot_observed_at":"2026-08-15T16:19:43.546665Z","title":"Star attention: Efficient llm inference over long sequences.arXiv preprint arXiv:2411.17116,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.546665Z"},"links":{"cited_paper":"/paper/2411.17116","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:b28e081d6e1e01cf84053cbf414f085f27693b1f1deb6e372f45265463ce343b","observation_id":"d2a5b67c-64f8-4def-9291-00163c139acd","resolution":{"observed_at":"2026-08-15T16:19:43.546665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:19:43.576633Z","title":"Dp-iqa: Utilizing diffusion prior for blind image quality assessment in the wild.arXiv preprint arXiv:2405.19996,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.576633Z"},"links":{"citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:da7ccac87b950f969942e436c6951e40a723c41a9940d8809ec3f0037c1d1ef1","observation_id":"8cac38d7-b8da-48eb-a52e-f7f3d7bafba0","resolution":{"observed_at":"2026-08-15T16:19:43.576633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.18722","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:19:44.175385Z","title":"Vistawise: Build- ing cost-effective agent with cross-modal knowledge graph for minecraft.arXiv preprint arXiv:2508.18722,","venue":null,"work_id":"60c51d29-ce2a-4883-8c69-eaa5ace80aad","year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.583822Z"},"links":{"citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:19d55a1aea0d27ba08c9b397291607ddf9da6a61b26e0a977a532cf4356a7a53","observation_id":"14dc7873-6181-4b8f-bdf6-adac22422ce5","resolution":{"observed_at":"2026-08-15T16:19:44.188584Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:19:43.589372Z","title":"Mrfd: Multi-region fusion decoding with self-consistency for mitigating hallucinations in lvlms, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.589372Z"},"links":{"citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:dbf1bf9f945d4bc1b3f26a8f80e6326f157ff5dcbb4de511c7d1fe95bfdabc3e","observation_id":"646f8f1b-9e21-45f4-b514-4813b9ae1d7d","resolution":{"observed_at":"2026-08-15T16:19:43.589372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07067","last_updated":"2025-05-30T04:41:12Z","snapshot_observed_at":"2026-08-08T09:26:03.922623Z","submitted_at":"2025-03-10T08:51:32Z","title":"DistiLLM-2: A Contrastive Approach Boosts the Distillation of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07067","snapshot_observed_at":"2026-08-15T16:19:43.604994Z","title":"Distillm-2: A contrastive approach boosts the distillation of llms.arXiv preprint arXiv:2503.07067,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.604994Z"},"links":{"cited_paper":"/paper/2503.07067","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:86e33fb4a36eb3828dae64328b96241f0a5adf7d88a1051d86105924b74da7f3","observation_id":"187f8fbc-ac5b-4954-9e73-4c1c971c5b0c","resolution":{"observed_at":"2026-08-15T16:19:43.604994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:19:44.439772Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"f6f7c8c4-d751-46ba-a108-a54bfd9bcecb","year":2025},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.611233Z"},"links":{"citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:144dbc268cc14a7b167067ad92a35758e29b901ef81303eb6935e10002e2e713","observation_id":"130a646e-6e67-4bc7-a161-6c610a1a8fea","resolution":{"observed_at":"2026-08-15T16:19:44.445640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10355","last_updated":"2023-10-26T02:52:40Z","snapshot_observed_at":"2026-08-12T18:48:30.326248Z","submitted_at":"2023-05-17T16:34:01Z","title":"Evaluating Object Hallucination in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10355","snapshot_observed_at":"2026-08-15T16:19:43.616653Z","title":"Evaluating object hallucination in large vision-language models.arXiv preprint arXiv:2305.10355, 2023b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.616653Z"},"links":{"cited_paper":"/paper/2305.10355","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:09df444c2790ec7245e164abf7bad54031676ea2934bb79540f85f381623bafa","observation_id":"4a47b18b-0307-4338-85c3-34e184585a06","resolution":{"observed_at":"2026-08-15T16:19:43.616653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21600","last_updated":"2025-06-19T07:16:18Z","snapshot_observed_at":"2026-08-15T23:28:58.923550Z","submitted_at":"2025-06-19T07:16:18Z","title":"Structured Attention Matters to Multimodal LLMs in Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21600","snapshot_observed_at":"2026-08-15T16:19:43.621986Z","title":"Structured attention matters to multimodal llms in document understanding.arXiv preprint arXiv:2506.21600, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.621986Z"},"links":{"cited_paper":"/paper/2506.21600","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:b8f54668a901546ea2392127f85d7a24928c1873aaf723b7cd16f80952732b78","observation_id":"aacfdf11-dec1-4b6b-9b27-c0d10752de47","resolution":{"observed_at":"2026-08-15T16:19:43.621986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19353","last_updated":"2025-07-25T15:02:45Z","snapshot_observed_at":"2026-08-15T22:12:12.037144Z","submitted_at":"2025-07-25T15:02:45Z","title":"Smooth Reading: Bridging the Gap of Recurrent LLM to Self-Attention LLM on Long-Context Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.19353","snapshot_observed_at":"2026-08-15T16:19:43.627310Z","title":"Smooth reading: Bridging the gap of recurrent llm to self-attention llm on long-context tasks.arXiv preprint arXiv:2507.19353, 2025b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.627310Z"},"links":{"cited_paper":"/paper/2507.19353","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:a061170a485aa98d6ad069bd94c06f0908c2941269fbb80a1fc88b91d10e248d","observation_id":"d5f598cc-4646-4262-ba5c-cb7eec314d56","resolution":{"observed_at":"2026-08-15T16:19:43.627310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12585","last_updated":"2024-11-12T05:09:34Z","snapshot_observed_at":"2026-08-14T17:26:21.499546Z","submitted_at":"2024-01-23T09:33:31Z","title":"SLANG: New Concept Comprehension of Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12585","snapshot_observed_at":"2026-08-15T16:19:43.632137Z","title":"Slang: New concept comprehension of large language models.arXiv preprint arXiv:2401.12585, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.632137Z"},"links":{"cited_paper":"/paper/2401.12585","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:1e42817e0475493b497344961e1481d0add4351e78321cb5562ed1c3140b2152","observation_id":"7f98f819-6a45-47af-a677-3df58c7dc331","resolution":{"observed_at":"2026-08-15T16:19:43.632137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-15T16:19:43.637935Z","title":"Qwen2.5-vl: A powerful vision-language model for seamless computer interaction.arXiv preprint arXiv:2409.12191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.637935Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:d4f2abf7700b9d56b1085b23dc0085e7dbb35dc8791908353fbe7cb4bc6277a3","observation_id":"124d6a33-14e5-470f-bffd-895ff40ab780","resolution":{"observed_at":"2026-08-15T16:19:43.637935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-15T16:19:43.649105Z","title":"Anne M Treisman and Garry Gelade","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.649105Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:8d42a517ce2425298dc9b432d681ad9c8421bce5220921b39e65d52d982aa545","observation_id":"98b367f3-9f44-48ee-b5ea-cbcc583a7662","resolution":{"observed_at":"2026-08-15T16:19:43.649105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14135","last_updated":"2023-12-26T15:20:45Z","snapshot_observed_at":"2026-08-13T04:55:50.785723Z","submitted_at":"2023-12-21T18:55:06Z","title":"V*: Guided Visual Search as a Core Mechanism in Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14135","snapshot_observed_at":"2026-08-15T16:19:43.654520Z","title":"V*: Guided visual search as a core mechanism in multimodal llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.654520Z"},"links":{"cited_paper":"/paper/2312.14135","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:6b845146e79715a093081eb6e573c3dc97af1dd6511c54707e9c8fe5c863d094","observation_id":"61082bcc-5e41-4261-b7f1-0ced4349f1d5","resolution":{"observed_at":"2026-08-15T16:19:43.654520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15296","last_updated":"2025-07-21T06:55:37Z","snapshot_observed_at":"2026-08-15T09:46:13.219743Z","submitted_at":"2025-07-21T06:55:37Z","title":"Butterfly Effects in Toolchains: A Comprehensive Analysis of Failed Parameter Filling in LLM Tool-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15296","snapshot_observed_at":"2026-08-15T16:19:43.660111Z","title":"Butterfly effects in toolchains: A comprehensive analysis of failed parameter filling in llm tool-agent systems.arXiv preprint arXiv:2507.15296,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.660111Z"},"links":{"cited_paper":"/paper/2507.15296","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:6710bdf1ec84c5a66e1727ae80755ea7011dd8947b534d1870412f3fb2d04a71","observation_id":"29a3692e-d7aa-40c3-95ec-cbad89f9a31a","resolution":{"observed_at":"2026-08-15T16:19:43.660111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11063","last_updated":"2025-05-30T06:48:02Z","snapshot_observed_at":"2026-08-13T06:43:52.077582Z","submitted_at":"2025-05-30T06:48:02Z","title":"Who is in the Spotlight: The Hidden Bias Undermining Multimodal Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11063","snapshot_observed_at":"2026-08-15T16:19:43.665830Z","title":"Who is in the spotlight: The hidden bias undermining multimodal retrieval- augmented generation.arXiv preprint arXiv:2506.11063, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.665830Z"},"links":{"cited_paper":"/paper/2506.11063","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:5298e0f1d5048b19ffc4df70eb1a459b22fb343235b4a5b84e5c77b334a1956a","observation_id":"15710224-9697-4d87-abdd-dde34cb5df7c","resolution":{"observed_at":"2026-08-15T16:19:43.665830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17422","last_updated":"2025-02-24T18:54:40Z","snapshot_observed_at":"2026-08-07T17:52:20.236795Z","submitted_at":"2025-02-24T18:54:40Z","title":"MLLMs Know Where to Look: Training-free Perception of Small Visual Details with Multimodal LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17422","snapshot_observed_at":"2026-08-15T16:19:43.672057Z","title":"ISBN 979-8-89176-251-0","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.672057Z"},"links":{"cited_paper":"/paper/2502.17422","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:45a1ad4694f5042f57ea498a7522c561a1df90f73164c7c764efc16b57ebe117","observation_id":"2b0f0b57-98ec-409d-908f-de89a1a19015","resolution":{"observed_at":"2026-08-15T16:19:43.672057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17811","last_updated":"2024-06-05T11:15:04Z","snapshot_observed_at":"2026-08-13T04:09:05.741822Z","submitted_at":"2024-02-27T14:45:04Z","title":"TruthX: Alleviating Hallucinations by Editing Large Language Models in Truthful Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17811","snapshot_observed_at":"2026-08-15T16:19:43.679677Z","title":"Truthx: Alleviating hallucinations by editing large lan- guage models in truthful space.arXiv preprint arXiv:2402.17811, 2024b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.679677Z"},"links":{"cited_paper":"/paper/2402.17811","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:71103b093b878e1ecd497f9e299b33954cf4113ea6a2d3a1843e5d674186ae9b","observation_id":"35db9617-d28d-4013-84a5-d329bcca5bd0","resolution":{"observed_at":"2026-08-15T16:19:43.679677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14709","last_updated":"2024-06-20T20:03:37Z","snapshot_observed_at":"2026-08-14T11:29:53.051866Z","submitted_at":"2024-06-20T20:03:37Z","title":"Factual Dialogue Summarization via Learning from Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14709","snapshot_observed_at":"2026-08-15T16:19:43.685611Z","title":"Factual dialogue summarization via learning from large language models.arXiv preprint arXiv:2406.14709,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.685611Z"},"links":{"cited_paper":"/paper/2406.14709","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:80141fd2f625f1dbebf2f1cc9e4b07244543b8d29b5b3ac94cb0f4682a058001","observation_id":"1131f406-f9cc-4d71-8de2-db2359a9c6ee","resolution":{"observed_at":"2026-08-15T16:19:43.685611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:19:44.398689Z","title":"Write a general description of the image","venue":null,"work_id":"10d8dc98-22b6-4800-80d4-77c29c985807","year":2025},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.691285Z"},"links":{"citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:f261bf38b40f70715065aace969131d91e1c9944762edfa7cefc546fe2b2a4fc","observation_id":"5407da0c-93f8-4459-8bde-453a7b9205a0","resolution":{"observed_at":"2026-08-15T16:19:44.406142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16574","last_updated":"2025-04-23T09:53:01Z","snapshot_observed_at":"2026-08-07T15:59:56.884758Z","submitted_at":"2025-04-23T09:53:01Z","title":"PIS: Linking Importance Sampling and Attention Mechanisms for Efficient Prompt Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16574","snapshot_observed_at":"2026-08-15T16:19:43.565364Z","title":"Frequency-importance gaussian splatting for real-time lightweight radiance field rendering.Multimedia Tools and Ap- plications, 83(35):83377–83401, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":1986,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.565364Z"},"links":{"cited_paper":"/paper/2504.16574","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:80afed6f61a0a3ec2de972b691be07a471317b1569f05539dec6dcf89556b363","observation_id":"a71acdbd-f22b-4bde-a763-d0a731939cb2","resolution":{"observed_at":"2026-08-15T16:19:43.565364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:19:44.422419Z","title":"A-okvqa: A benchmark for visual question answering using world knowledge","venue":null,"work_id":"0e6eeb57-a14a-48c8-a7f0-e64d4ed2bc12","year":2022},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.643196Z"},"links":{"citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:15874152fa07a97af77fb4af9cc1f095e6ede06617a875c395c33b2c308a1c6b","observation_id":"fd73f359-b963-4e7b-9e00-7cb609001b6d","resolution":{"observed_at":"2026-08-15T16:19:44.428222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15280","last_updated":"2024-12-18T04:08:18Z","snapshot_observed_at":"2026-08-16T03:46:56.256084Z","submitted_at":"2024-12-18T04:08:18Z","title":"Context-DPO: Aligning Language Models for Context-Faithfulness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15280","snapshot_observed_at":"2026-08-15T16:19:43.553312Z","title":"Context-dpo: Aligning language models for context-faithfulness.arXiv preprint arXiv:2412.15280,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.553312Z"},"links":{"cited_paper":"/paper/2412.15280","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:f9664865c9d80791767aae833e981e7bad56ca3dcfb9c7597c2b3cdfd798e976","observation_id":"81252269-68f7-455b-acf3-fd21917f19c9","resolution":{"observed_at":"2026-08-15T16:19:43.553312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19602","last_updated":"2025-03-25T12:37:22Z","snapshot_observed_at":"2026-08-07T16:38:32.727220Z","submitted_at":"2025-03-25T12:37:22Z","title":"Innate Reasoning is Not Enough: In-Context Learning Enhances Reasoning Large Language Models with Less Overthinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19602","snapshot_observed_at":"2026-08-15T16:19:43.595045Z","title":"Under review","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.595045Z"},"links":{"cited_paper":"/paper/2503.19602","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:b62f681932a29f64bb066c2bf3ce801ec7c51d53a5961c6ece2aba3ebef70788","observation_id":"8ef3bc0a-87fe-44a9-9505-dca87e350ed1","resolution":{"observed_at":"2026-08-15T16:19:43.595045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03253","last_updated":"2025-07-08T18:15:09Z","snapshot_observed_at":"2026-08-13T02:35:11.434052Z","submitted_at":"2025-07-04T02:19:58Z","title":"RefineX: Learning to Refine Pre-training Data at Scale from Expert-Guided Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03253","snapshot_observed_at":"2026-08-15T16:19:43.559195Z","title":"Decoding by contrasting knowledge: Enhancing large language model confidence on edited facts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.559195Z"},"links":{"cited_paper":"/paper/2507.03253","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:546c984ec19dbb339926e538f0d0580804f6d4b7ed75b88d5595aaf84a5bc87e","observation_id":"a88f0c62-f252-43fa-b6c5-9ca316a74632","resolution":{"observed_at":"2026-08-15T16:19:43.559195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06868","last_updated":"2025-02-08T04:47:17Z","snapshot_observed_at":"2026-08-14T08:19:10.936575Z","submitted_at":"2025-02-08T04:47:17Z","title":"Related Knowledge Perturbation Matters: Rethinking Multiple Pieces of Knowledge Editing in Same-Subject","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06868","snapshot_observed_at":"2026-08-15T16:19:43.570711Z","title":"Lifelong knowledge editing for LLMs with retrieval-augmented continuous prompt learn- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T16:19:43.570711Z"},"links":{"cited_paper":"/paper/2502.06868","citing_paper":"/paper/2509.06461"},"observation_digest":"sha256:1a18136776379583fe0aa88bc5559bf379fdfb79489a3a75603a60dcc7e80f59","observation_id":"8b865cef-0eee-4883-9fe5-13a6aeb0a3a0","resolution":{"observed_at":"2026-08-15T16:19:43.570711Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.06461","last_updated":"2025-09-11T15:24:22Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T23:27:55.481826Z","submitted_at":"2025-09-08T09:20:04Z","title":"Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 4 inbound Pith citation observations for arXiv:2509.06461."}