{"as_of":"2026-08-11T14:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2be2f5af9549c5a7c8fa11da09ce13137a9b8868787978aba449e1ff321f3f3","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:43:56.908824Z","state":"measured"},{"denominator":90,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":90,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T16:10:00.825855Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T15:09:55.172195Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"cited_work":{"arxiv_id":"2507.12883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12883","snapshot_observed_at":"2026-07-04T15:09:55.172195Z","title":"Hrseg: High-resolution visual perception and enhancement for reasoning segmenta- tion.CoRR, abs/2507.12883","venue":null,"work_id":"c5f9fd1a-6116-4b6a-8f15-04e71677bb2b","year":2025},"citing_paper":{"arxiv_id":"2604.15670","last_updated":"2026-07-24T04:48:23Z","snapshot_observed_at":"2026-08-10T23:33:38.130876Z","submitted_at":"2026-04-17T03:48:56Z","title":"PixDLM: A Dual-Path Multimodal Language Model for UAV Reasoning Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T09:20:54.635375Z"},"links":{"cited_paper":"/paper/2507.12883","citing_paper":"/paper/2604.15670"},"observation_digest":"sha256:42c470570d29425e5b84ec9d128d59595a75a0a421775116ad92b3cb4a33192c","observation_id":"1d490a71-82b7-4f5e-9e3f-ea6c6f0788e2","resolution":{"observed_at":"2026-05-10T09:23:37.129948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12883","snapshot_observed_at":"2026-08-02T16:10:00.825855Z","title":"Hrseg: High-resolution visual perception and enhancement for reasoning segmenta- tion.CoRR, abs/2507.12883, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.15670","last_updated":"2026-07-24T04:48:23Z","snapshot_observed_at":"2026-08-10T23:33:38.130876Z","submitted_at":"2026-04-17T03:48:56Z","title":"PixDLM: A Dual-Path Multimodal Language Model for UAV Reasoning Segmentation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T16:10:00.825855Z"},"links":{"cited_paper":"/paper/2507.12883","citing_paper":"/paper/2604.15670"},"observation_digest":"sha256:05341977e0f119b5902d91bdb3fcaccb98bd37680e28b69a9f148696acaa5cfa","observation_id":"163701c9-58a1-4fd9-8e93-6b573c1ceae5","resolution":{"observed_at":"2026-08-02T16:10:00.825855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"cited_work":{"arxiv_id":"2507.12883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12883","snapshot_observed_at":"2026-07-04T15:09:55.172195Z","title":"Hrseg: High-resolution visual perception and enhancement for reasoning segmenta- tion.CoRR, abs/2507.12883","venue":null,"work_id":"c5f9fd1a-6116-4b6a-8f15-04e71677bb2b","year":2025},"citing_paper":{"arxiv_id":"2606.26196","last_updated":"2026-06-24T15:20:32Z","snapshot_observed_at":"2026-07-07T00:00:31.981360Z","submitted_at":"2026-06-24T15:20:32Z","title":"From Structure to Synergy: A Survey of Vision-Language Perception Paradigm Evolution in Multimodal Large Language Models","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-06-26T01:50:54.242508Z"},"links":{"cited_paper":"/paper/2507.12883","citing_paper":"/paper/2606.26196"},"observation_digest":"sha256:7591f2d5609ff0ec1274cbcfef658da38b43c79f3b15006c307d2fed0b9a0794","observation_id":"70a90b17-b560-4412-8e59-10a8514f0276","resolution":{"observed_at":"2026-07-04T15:09:55.174796Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12883/citation-record","integrity":"/paper/2507.12883/integrity","json":"/paper/2507.12883/citation-record.json","paper":"/paper/2507.12883"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T16:43:47.361319Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.361319Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:65393af5c1605ac7ee45e001901f1516b30b42dd72873be33bb8d47370ecf9fd","observation_id":"b4fbaf8d-d552-4755-980f-eae49a54c405","resolution":{"observed_at":"2026-08-06T16:43:47.361319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T16:43:47.409989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.409989Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:e4dfcbeeecff688696c40325a857429666e8561f88f0da527c34d220fa4a235c","observation_id":"d84de3fb-3ff0-4658-8787-7039d56c6a88","resolution":{"observed_at":"2026-08-06T16:43:47.409989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:47.461645Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.461645Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:dc97c12ea6ea3c418a3409a907159483e0efcd05185cc4417adff8fec6acf5b2","observation_id":"672884fe-99a4-42a7-896b-32519588bad6","resolution":{"observed_at":"2026-08-06T16:43:47.461645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:47.529940Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.529940Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:b969de3f9f27a630a6bbc6925859b8c065da0a7682100fcdc1bee908e7cddf0b","observation_id":"dea80ed6-3aee-42f9-87f1-bcdadd986b71","resolution":{"observed_at":"2026-08-06T16:43:47.529940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-10T17:03:38.042994Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-06T16:43:47.866503Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.866503Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:3a9c9c229f4ac4cfb90cf6ac88256f6343d08ef507538a3fe335091252037ba8","observation_id":"eb864c1a-4403-4f41-a3f0-ab3a359467cc","resolution":{"observed_at":"2026-08-06T16:43:47.866503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.005704Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.005704Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:a301b73e84162a2b991954146732ecae83612b986c761dd17acf419420516c72","observation_id":"cb1403f2-b205-4c10-96d8-27a0af9e9390","resolution":{"observed_at":"2026-08-06T16:43:48.005704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.165706Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.165706Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:7f83734243296314804acb2231dea858214efa498170812a64398fd4a27e6f0c","observation_id":"725c9031-d5a6-420e-8090-c16e800c82bd","resolution":{"observed_at":"2026-08-06T16:43:48.165706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.282288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.282288Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:2be9580c765348e0f037e39896af9b7961eba7b4717574f35012f0929dd903f3","observation_id":"ebf61b2a-a83c-4acd-ab1d-3c99fb441e48","resolution":{"observed_at":"2026-08-06T16:43:48.282288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.407356Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.407356Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:52249f2d37b338ab7f3c9c5eb73ea64bad67fe8401c954b48bba55ee94065230","observation_id":"0363cc6b-aa9a-402a-b6c3-aee68be95874","resolution":{"observed_at":"2026-08-06T16:43:48.407356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:48.578756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.578756Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:ef4e5c677b1edfeca8d19859e7bf1521efdf251a16569762b0b0d0a6e1be69e9","observation_id":"33aa40a4-c51e-43df-8c59-7151b73c8215","resolution":{"observed_at":"2026-08-06T16:43:48.578756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.971224Z","title":null,"venue":null,"work_id":"3855df4b-9ad2-4f04-8af7-0e000d920fd8","year":2021},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.692579Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:48068ab7f8583e02dae1a87bac9971f47bc6c255baef15b84b2b5c1640a097e9","observation_id":"688dfb71-fb09-4f1b-9bbb-e3800ede1479","resolution":{"observed_at":"2026-08-06T16:44:03.032249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06512","last_updated":"2024-04-09T17:59:32Z","snapshot_observed_at":"2026-08-06T19:00:20.787763Z","submitted_at":"2024-04-09T17:59:32Z","title":"InternLM-XComposer2-4KHD: A Pioneering Large Vision-Language Model Handling Resolutions from 336 Pixels to 4K HD","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06512","snapshot_observed_at":"2026-08-06T16:43:48.858848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:48.858848Z"},"links":{"cited_paper":"/paper/2404.06512","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:81a67e792a5ec573ac04543a6d41b27e1bf60435bc639610006665bc73136e80","observation_id":"e9fad850-b5ef-4891-9b5d-9be2706e2685","resolution":{"observed_at":"2026-08-06T16:43:48.858848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T16:43:49.003114Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.003114Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:dd5091400011afb649d45f8729acdb49dda7f15e59b5fa4f0e442915e76032ff","observation_id":"351e12bd-1c61-4b65-b8cf-bcdef4f556ec","resolution":{"observed_at":"2026-08-06T16:43:49.003114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T16:43:49.145112Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.145112Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:4176e5130addc401866252aab2e6cbb13a20696e42e2ed58e4a6b585c892c8fc","observation_id":"68d52b33-6259-492f-887b-58d4127d853a","resolution":{"observed_at":"2026-08-06T16:43:49.145112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.799944Z","title":null,"venue":null,"work_id":"dcdf1885-ebde-4aa5-a897-a5476aa3f292","year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.275432Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:d0a7c12cc191ebbf612048d2ab510c3671dd67948b80207ae0deb4c68e2562f3","observation_id":"501aee8e-76be-4d30-8463-3cd87820ad29","resolution":{"observed_at":"2026-08-06T16:44:02.886533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:49.404924Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.404924Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:bdc846756fc5561c41a7ab0e35f2d50b7e6686a81735460f47db1a51ffd9b9bb","observation_id":"1200db5d-9f4c-4582-8970-06e04c404a04","resolution":{"observed_at":"2026-08-06T16:43:49.404924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.645499Z","title":null,"venue":null,"work_id":"91107e66-c044-4289-8ddb-a1544db49999","year":2022},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.518214Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:2c96e64fdc769413bbd1de08ab4023fe4038dcbdf59ef5bb23387defefc68052","observation_id":"9a569c7a-8ef0-4ccd-aa0b-79da15efe202","resolution":{"observed_at":"2026-08-06T16:44:02.703619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12895","last_updated":"2024-03-19T16:48:40Z","snapshot_observed_at":"2026-08-07T02:52:27.054968Z","submitted_at":"2024-03-19T16:48:40Z","title":"mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12895","snapshot_observed_at":"2026-08-06T16:43:49.641010Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.641010Z"},"links":{"cited_paper":"/paper/2403.12895","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:d1b56623205de1ee7e71b8712579faa8e4be62b33e7eb03e5c1abb7909152774","observation_id":"2921b240-0064-4586-9758-4014f25367d4","resolution":{"observed_at":"2026-08-06T16:43:49.641010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.470029Z","title":null,"venue":null,"work_id":"17f93c87-f275-494d-b2c9-b5368ee7ccfb","year":2016},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.804373Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:f66b65b8bb320c0a46cbc15eeaf98987381a8ea015cf459291ba830148055dde","observation_id":"e65ba92e-535c-40c7-bb93-7250167598f4","resolution":{"observed_at":"2026-08-06T16:44:02.540897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02034","last_updated":"2024-10-28T07:40:49Z","snapshot_observed_at":"2026-07-06T18:56:40.234434Z","submitted_at":"2024-08-04T13:55:58Z","title":"Mini-Monkey: Alleviating the Semantic Sawtooth Effect for Lightweight MLLMs via Complementary Image Pyramid","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02034","snapshot_observed_at":"2026-08-06T16:43:49.933618Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:49.933618Z"},"links":{"cited_paper":"/paper/2408.02034","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:1f2f203fb37865b4e872feed41cea475a16213f410a2dddfd3057fadc787203c","observation_id":"2a234bd9-2c76-4500-b588-a30ff55ea878","resolution":{"observed_at":"2026-08-06T16:43:49.933618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13881","last_updated":"2025-03-18T04:23:09Z","snapshot_observed_at":"2026-08-07T16:56:00.215424Z","submitted_at":"2025-03-18T04:23:09Z","title":"MMR: A Large-scale Benchmark Dataset for Multi-target and Multi-granularity Reasoning Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13881","snapshot_observed_at":"2026-08-06T16:43:50.099882Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.099882Z"},"links":{"cited_paper":"/paper/2503.13881","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:963dc5a080d71e30e55b3de12cf0056344e9a1aaf98bb1740b30ec5350f366db","observation_id":"63fa77bf-0abc-490d-96ab-1cf1ac32b99b","resolution":{"observed_at":"2026-08-06T16:43:50.099882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-06T16:43:50.211047Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.211047Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:b837bae87f3b9f44cd5c2370c20ff367d46cefda8ce2e9e8e90d43f8afc356a1","observation_id":"f72c8dae-ea0a-43b7-9c56-e6c3d6d36d1b","resolution":{"observed_at":"2026-08-06T16:43:50.211047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:50.340815Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.340815Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:5a3fb51a54e5d6b69ab99658b190a3b0eeb9b3710d7143b32f1d1e55e0c00524","observation_id":"29862914-a019-4e53-b6fc-cacd9b115cce","resolution":{"observed_at":"2026-08-06T16:43:50.340815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:50.485749Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.485749Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:bbcf9f4855c01ba4be84e2bc59891df79a74d49d9a58bc784ca02b42b09f00a2","observation_id":"64e1f6d4-8342-4ad2-a00b-f88dbd9488ec","resolution":{"observed_at":"2026-08-06T16:43:50.485749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:50.763505Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.763505Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:64ea5db72ef18efd701768a1ae184ac7605bb0f324b5a5a47d9232d83d9aabd2","observation_id":"9bd06a67-3cf1-4d34-93a4-50034163341a","resolution":{"observed_at":"2026-08-06T16:43:50.763505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:50.583947Z","title":"In Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.583947Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:807b09648ca6a046bc78a33ac513f7f06dc2054462ca50394bb206cadcae2eab","observation_id":"6cf22db7-b41a-4579-a74e-82cb939a07e9","resolution":{"observed_at":"2026-08-06T16:43:50.583947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02392","last_updated":"2024-08-28T08:49:57Z","snapshot_observed_at":"2026-07-06T18:40:22.951929Z","submitted_at":"2024-07-02T16:10:55Z","title":"TokenPacker: Efficient Visual Projector for Multimodal LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02392","snapshot_observed_at":"2026-08-06T16:43:51.265156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.265156Z"},"links":{"cited_paper":"/paper/2407.02392","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:8a990dfa33e82231563b2977314c473f97be376ce88ae123d1eaed1f2297d8d1","observation_id":"d3e74dd7-8293-4ec6-9204-f21aaa904a8f","resolution":{"observed_at":"2026-08-06T16:43:51.265156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.972260Z","title":null,"venue":null,"work_id":"acb699d1-6e79-4190-968f-a37f7b04dd14","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.400140Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:79514d9cfc5fb6fcf9534206570a0689c5b68213b1d837e20b5dfea91a131e5a","observation_id":"15a83dc0-2d54-4a39-9301-e5c0132a1d0f","resolution":{"observed_at":"2026-08-06T16:44:02.087465Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:51.049516Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.049516Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:b25fe848cf78940c7f5e92e80606fd4a2777eecc5a7348a984722722909e2cff","observation_id":"5abf3b1b-82de-4d80-99ff-143763e6a20e","resolution":{"observed_at":"2026-08-06T16:43:51.049516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.766571Z","title":null,"venue":null,"work_id":"5e5d5ace-8dd7-4045-a03c-0d9b5237a248","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.643698Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:44a33ad3363f1b9fca23624fd4d814a802e12f214852d6922936bfef2ea70f0c","observation_id":"3c4331e6-03d4-4f23-a643-5ecb019345ac","resolution":{"observed_at":"2026-08-06T16:44:01.882301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:51.781887Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.781887Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:787de861af11e6056cf8b14e723ff13723361fbfd7a6b005aae968bea73ca402","observation_id":"27e3d3c5-f8db-4396-b0e7-312cdbca4cde","resolution":{"observed_at":"2026-08-06T16:43:51.781887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18814","last_updated":"2024-03-27T17:59:04Z","snapshot_observed_at":"2026-07-31T05:41:28.385099Z","submitted_at":"2024-03-27T17:59:04Z","title":"Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18814","snapshot_observed_at":"2026-08-06T16:43:51.508542Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.508542Z"},"links":{"cited_paper":"/paper/2403.18814","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:c20691fa53153bb9121387f46eae93950eb17436a072f1d5ee1afd44cded22f6","observation_id":"3ec79ca1-5eb3-4b50-934a-56290612e0ca","resolution":{"observed_at":"2026-08-06T16:43:51.508542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T16:43:52.052333Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.052333Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:5a81e3c926e61e1db78846c06d3167b6b673853025545331d3d9abc3eea33a96","observation_id":"64823629-5e6c-4283-b269-11d3b5b67136","resolution":{"observed_at":"2026-08-06T16:43:52.052333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:52.205526Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.205526Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:58d42c997971ef13dce7b6e5c3251ca74306c5fee00749e9be9e789a262e0282","observation_id":"3b1d4abd-a982-4152-af09-bcd2ca71b845","resolution":{"observed_at":"2026-08-06T16:43:52.205526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07575","snapshot_observed_at":"2026-08-06T16:43:51.943317Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:51.943317Z"},"links":{"cited_paper":"/paper/2311.07575","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:2952eb9216cd3006cfee489c30f65b4b017ff65dac8576619d5054de0a67a136","observation_id":"45837cd8-55a3-40e9-9089-ce8fddbe13bb","resolution":{"observed_at":"2026-08-06T16:43:51.943317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-06T16:43:52.509406Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.509406Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:916fd26fb77e649bf693f852ae115c3adf55cf2f0381a6f04406b060d380fc40","observation_id":"3db8b887-d3e1-489e-b7b6-f23757780013","resolution":{"observed_at":"2026-08-06T16:43:52.509406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.586888Z","title":null,"venue":null,"work_id":"e9d5f835-672d-4923-aa7d-d2320d4307da","year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.590816Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:1cae627284db0f09caa4b50c5d069ea96d8624ddcbdba163609fbd0fd8aff608","observation_id":"8d58f549-d919-4b75-a5a3-240c9552de7e","resolution":{"observed_at":"2026-08-06T16:44:01.650239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:52.336062Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.336062Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:e1dd7db8d17f1d37554611475eaa7fad16885aa9791df55af30f4f6f916a1a74","observation_id":"e9ff0d91-dbf6-4c3f-9ce0-78077e5ac913","resolution":{"observed_at":"2026-08-06T16:43:52.336062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:52.765354Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.765354Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:7ec0156f9052060554bdb6b16c7ef28be819d048252513daffc61d22d5bf1c2a","observation_id":"27f71173-ea88-459b-bb14-955fe2c93624","resolution":{"observed_at":"2026-08-06T16:43:52.765354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:52.884479Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.884479Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:11ac8ff64ecc3efac0960b113124cd1b200de927745dd4e5b863188ac7d38b96","observation_id":"cb202816-4351-4480-b87c-abb0158eff63","resolution":{"observed_at":"2026-08-06T16:43:52.884479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06520","last_updated":"2026-05-31T09:29:40Z","snapshot_observed_at":"2026-08-07T17:19:13.101842Z","submitted_at":"2025-03-09T08:48:51Z","title":"Seg-Zero: Reasoning-Chain Guided Segmentation via Cognitive Reinforcement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06520","snapshot_observed_at":"2026-08-06T16:43:52.676691Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.676691Z"},"links":{"cited_paper":"/paper/2503.06520","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:031c61a45dd18ea2035d217019683f5aeb8277563279168088bfce4ff6f71ef3","observation_id":"038edbdd-32aa-4dff-a919-2d75aa12626a","resolution":{"observed_at":"2026-08-06T16:43:52.676691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T16:43:53.029321Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.029321Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:cf77fd3e42bea638fad8de175d46224a01f08ec2ebaafa30c4ced99e0ffaaee1","observation_id":"4646c361-0e2a-476a-ad46-67ca93cbcbe7","resolution":{"observed_at":"2026-08-06T16:43:53.029321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12961","last_updated":"2025-02-27T06:09:46Z","snapshot_observed_at":"2026-07-06T19:18:17.523057Z","submitted_at":"2024-09-19T17:59:51Z","title":"Oryx MLLM: On-Demand Spatial-Temporal Understanding at Arbitrary Resolution","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12961","snapshot_observed_at":"2026-08-06T16:43:52.831200Z","title":"arXiv preprint arXiv:2409.12961 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.831200Z"},"links":{"cited_paper":"/paper/2409.12961","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:3fb0acb55cff6bfed3187ef2272e3e80e8b377e30392bd8428f1312d1c0d818a","observation_id":"28d07efb-3f67-463c-a1ed-a519d52b2c8c","resolution":{"observed_at":"2026-08-06T16:43:52.831200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:53.248714Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.248714Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:10f70ac9ddebf47f789e14e0db86717655b7d9048686dfde4f029f74f6479a56","observation_id":"ff919307-73b9-4a23-b184-e4388c49cc7e","resolution":{"observed_at":"2026-08-06T16:43:53.248714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.377524Z","title":null,"venue":null,"work_id":"0867ecec-ef33-44b5-84d7-8a4f2409f77b","year":2021},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:52.945960Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:d5eb47974a341d86cb5965abfbea217e4d58c88cab9704fa01957c56bce8a6f4","observation_id":"3e764c9d-2e63-4cd7-a9c9-fdebabd06aaa","resolution":{"observed_at":"2026-08-06T16:44:01.451004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:53.364850Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.364850Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:08cc6c0e131b61d35e9e3801914b587cea99eab53f9d7a5babdc971559b439f9","observation_id":"8086f695-8a91-44ec-86b8-9eaed92663c4","resolution":{"observed_at":"2026-08-06T16:43:53.364850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-11T01:38:59.827005Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-06T16:43:53.162783Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.162783Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:da717c1eb38fcf685dc95b75675e4ff2fe0270d41eca729471f05ac31bd6f9b7","observation_id":"de16e036-beec-47ee-9e25-c5ac81485b28","resolution":{"observed_at":"2026-08-06T16:43:53.162783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T16:43:53.540519Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.540519Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:d66e7d1921529f226ba6cd07b86809efe6a01c2c23fcf931bfe4a56d047440c2","observation_id":"5653f500-1d51-4c98-be41-21c6fb527e54","resolution":{"observed_at":"2026-08-06T16:43:53.540519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16198","last_updated":"2024-07-23T06:02:30Z","snapshot_observed_at":"2026-07-06T18:50:31.528338Z","submitted_at":"2024-07-23T06:02:30Z","title":"INF-LLaVA: Dual-perspective Perception for High-Resolution Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16198","snapshot_observed_at":"2026-08-06T16:43:53.305279Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.305279Z"},"links":{"cited_paper":"/paper/2407.16198","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:978f8556c08e3a73a795aac82d6450511e521ba2a135cf60b08090c64e07b1f7","observation_id":"1fd773a2-4ec3-4fb1-b3ca-f5417220a7d4","resolution":{"observed_at":"2026-08-06T16:43:53.305279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.989152Z","title":null,"venue":null,"work_id":"d9d38baa-fb25-4493-bac2-f6e3d7719205","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.709651Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:0595afb694cbb5e6b772038e41a56f65639a63021d9fa246533dd9142b59b218","observation_id":"eedfc238-00b9-4297-b8b7-0ea3636b04c0","resolution":{"observed_at":"2026-08-06T16:44:01.088692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:01.181501Z","title":null,"venue":null,"work_id":"c4d5a51a-8a92-4ad9-ab86-348ad3a67a3b","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.489908Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:e61bbb277acfc8d62f140db9debdb542289c65651dd258ea39bed4d466a70bc4","observation_id":"106dab9b-8e00-4ec8-bc73-6c8c335c45ea","resolution":{"observed_at":"2026-08-06T16:44:01.261988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.600225Z","title":null,"venue":null,"work_id":"ef6d3b0d-1037-4b8d-9ebf-a2a24acd807e","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.023358Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:6e4d080ab04f99310c144aa9fe409ec176b842efacce8406a9613d915d0b06e5","observation_id":"5d57e128-0253-47fe-b491-2f685bf3f4bc","resolution":{"observed_at":"2026-08-06T16:44:00.643564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T16:43:53.623603Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.623603Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:7933296681dc715c9a0304f3a026ea84124745ba1f73bcdeff8559e8bee8b334","observation_id":"dc8d151c-281c-4df7-ac28-2e6230376712","resolution":{"observed_at":"2026-08-06T16:43:53.623603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T16:43:54.192003Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.192003Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:6c43a4f5105aa161ef20980bdb255692d09d7669c8c12abd90e4ebf60125f808","observation_id":"a6a33ce5-4d18-4c35-bffc-fa6d17a63187","resolution":{"observed_at":"2026-08-06T16:43:54.192003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.781437Z","title":"InProceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"b175f1da-3683-4d0f-b771-e3d0fad69b45","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.822623Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:de1155454f5d22a7ed4b0d99cf54a736b84984357ccdcbc31c950d825a6c813c","observation_id":"db5dd7a9-8902-450f-97fa-7a4f8e035cc9","resolution":{"observed_at":"2026-08-06T16:44:00.880457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:53.946285Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:53.946285Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:1976cfeb15845f48e5b0e8f25b8f99b5674fcd26c1ebd35f78c0bb1c194de2ff","observation_id":"d77ceb5b-b6e2-40da-97b8-e039dc5c0752","resolution":{"observed_at":"2026-08-06T16:43:53.946285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T16:43:54.487107Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.487107Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:f770aed78cc89e07239d1d74c8e8551f841a5e335df5a257e6dfa30d4d337bfb","observation_id":"fbe7a195-67b3-4392-9ea5-62acedae83b8","resolution":{"observed_at":"2026-08-06T16:43:54.487107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.433298Z","title":null,"venue":null,"work_id":"14d2625d-27f3-48c5-9a33-bbe37ad4116a","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.109627Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:0e3962e68fdafa07b1addff26112a28496d72695e97f027779f328afaba12584","observation_id":"07e3e86f-de02-46fd-905f-db37dd46fc9d","resolution":{"observed_at":"2026-08-06T16:44:00.503622Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18923","last_updated":"2024-10-31T19:44:05Z","snapshot_observed_at":"2026-08-07T00:25:33.233087Z","submitted_at":"2024-10-24T17:11:52Z","title":"SegLLM: Multi-round Reasoning Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18923","snapshot_observed_at":"2026-08-06T16:43:54.686970Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.686970Z"},"links":{"cited_paper":"/paper/2410.18923","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:cb666cf7aca0fd599a7ea082ed1b98461ed49d52afedd80aa60a83703bb9c594","observation_id":"a988da79-d75b-4b85-bae9-d7a0c65a76a1","resolution":{"observed_at":"2026-08-06T16:43:54.686970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-06T16:43:54.271119Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.271119Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:2aa43f9e3b86c1fe1d0aa6c00680bf982f64676bf63362f3c21549bc2e17d869","observation_id":"4c10b730-28df-466e-8ce1-3657ac0127c3","resolution":{"observed_at":"2026-08-06T16:43:54.271119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.252098Z","title":null,"venue":null,"work_id":"258527fb-ee7b-4482-980b-2d8f3f371847","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.346952Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:29b68a15612cf8548d6f6c87b7b068911f1183fa0b3eddff6ed9f8cc464f6bf5","observation_id":"74e8f15e-daf9-457f-ace4-261a43b076f8","resolution":{"observed_at":"2026-08-06T16:44:00.329269Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08394","last_updated":"2024-12-31T05:35:05Z","snapshot_observed_at":"2026-08-06T17:31:18.801416Z","submitted_at":"2024-06-12T16:44:50Z","title":"VisionLLM v2: An End-to-End Generalist Multimodal Large Language Model for Hundreds of Vision-Language Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08394","snapshot_observed_at":"2026-08-06T16:43:54.904999Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.904999Z"},"links":{"cited_paper":"/paper/2406.08394","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:2f91c83bb219b6da947628ef283f67e0621237a599400f15f1cb1dee1ff6e8a8","observation_id":"d3964afb-e158-4a4a-aa01-3eb146b337d8","resolution":{"observed_at":"2026-08-06T16:43:54.904999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:00.084461Z","title":null,"venue":null,"work_id":"7f0a3887-08c2-42e6-843b-06c785c89041","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.599796Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:1aa3b04036fb902ab93931b7327b6c2fae346a516b647fd7c369813da198ede2","observation_id":"539b68c2-4ba6-4fdf-aaca-754c28b92e14","resolution":{"observed_at":"2026-08-06T16:44:00.152992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.320127Z","title":null,"venue":null,"work_id":"91d5fa4f-ddc7-4f63-a792-a0c832ee79fb","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.142594Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:a222f64df4a69bce2c5c29e42335e02ca7a12d9884355dbcae0bae90dca07bcf","observation_id":"29a914b8-afa4-464f-8644-4a66e577f0a5","resolution":{"observed_at":"2026-08-06T16:43:59.408123Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.897466Z","title":null,"venue":null,"work_id":"aeb5f13d-87be-4099-b0d2-7b032692ee20","year":2022},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.751107Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:7c87ef7ab423b75c61057418cc95ad14a459bb1fb780a1e496b14ccf9f2fe2ce","observation_id":"b5cad76f-45dc-436d-b845-5953c04b0e5a","resolution":{"observed_at":"2026-08-06T16:43:59.981747Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14006","last_updated":"2024-12-18T16:20:40Z","snapshot_observed_at":"2026-08-11T12:32:15.020581Z","submitted_at":"2024-12-18T16:20:40Z","title":"InstructSeg: Unifying Instructed Visual Segmentation with Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14006","snapshot_observed_at":"2026-08-06T16:43:54.814425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.814425Z"},"links":{"cited_paper":"/paper/2412.14006","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:54ae0e66ca08660ec6759b9b0144c0fbb0ceb402c2742dd4e0541e30c6829aec","observation_id":"1efbfe80-8fd5-4616-ab54-82ac981fb412","resolution":{"observed_at":"2026-08-06T16:43:54.814425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14141","last_updated":"2024-03-21T05:36:25Z","snapshot_observed_at":"2026-08-10T18:17:01.862399Z","submitted_at":"2024-03-21T05:36:25Z","title":"Empowering Segmentation Ability to Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14141","snapshot_observed_at":"2026-08-06T16:43:55.434020Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.434020Z"},"links":{"cited_paper":"/paper/2403.14141","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:fb06e1dcb3811ea1850c998c3408637a355fe5d4f5ad6efbf0dc2d27881e5576","observation_id":"cbe9196e-3292-48cd-8283-79d7e716a3a3","resolution":{"observed_at":"2026-08-06T16:43:55.434020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.694149Z","title":null,"venue":null,"work_id":"4f956a0c-5ec2-43c0-bf98-4f2e4a61a9ed","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:54.958662Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:4e1708508c54ec0717aa2e892ee12d184eacc533032934aeee7a13848d203b54","observation_id":"449acf4e-b631-4c61-af8f-b0aab5b22db0","resolution":{"observed_at":"2026-08-06T16:43:59.790119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.523021Z","title":"In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"5e7694fe-1fd7-4579-a52b-687c6329aceb","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.032776Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:440076a1ca9acf7d7667aea92104902498a96cf841bdc5cce405a72af92e67b0","observation_id":"c26dfec2-5e5b-4784-803f-88c673a505e8","resolution":{"observed_at":"2026-08-06T16:43:59.608812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05126","last_updated":"2023-10-08T11:33:09Z","snapshot_observed_at":"2026-07-06T16:29:23.853368Z","submitted_at":"2023-10-08T11:33:09Z","title":"UReader: Universal OCR-free Visually-situated Language Understanding with Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05126","snapshot_observed_at":"2026-08-06T16:43:56.033608Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.033608Z"},"links":{"cited_paper":"/paper/2310.05126","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:c4bcd42045e31990c20c9ebd507254e3d084ebead2f7c73c9e823e7abfc7f0a1","observation_id":"0190d4b3-deae-47a2-960d-9ef4e1052993","resolution":{"observed_at":"2026-08-06T16:43:56.033608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T16:43:55.219024Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.219024Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:e13dea08565ee58175bd4deaddd58de724aae3a093ef768ebe59136bcdf10ef3","observation_id":"b19e87cf-09bf-43e5-a0e9-268045be74ea","resolution":{"observed_at":"2026-08-06T16:43:55.219024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17240","last_updated":"2024-01-22T06:53:23Z","snapshot_observed_at":"2026-07-31T19:08:37.289553Z","submitted_at":"2023-12-28T18:58:33Z","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17240","snapshot_observed_at":"2026-08-06T16:43:55.305583Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.305583Z"},"links":{"cited_paper":"/paper/2312.17240","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:1b028f6e48545d187616cebaec2da50523cf1243e8382c4726e84262345e8f39","observation_id":"61131abb-d351-468e-868e-806cff1112c9","resolution":{"observed_at":"2026-08-06T16:43:55.305583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19389","last_updated":"2024-10-01T06:07:24Z","snapshot_observed_at":"2026-07-06T18:38:05.229292Z","submitted_at":"2024-06-27T17:59:01Z","title":"OMG-LLaVA: Bridging Image-level, Object-level, Pixel-level Reasoning and Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19389","snapshot_observed_at":"2026-08-06T16:43:56.223743Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.223743Z"},"links":{"cited_paper":"/paper/2406.19389","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:838c27d43b413526cb97cf29df86e68d0ce503c85c35656fe2196a509a61a4db","observation_id":"2128d1d5-c66d-4c11-a088-7b1be00deb2d","resolution":{"observed_at":"2026-08-06T16:43:56.223743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:59.125314Z","title":null,"venue":null,"work_id":"f2050083-169f-4a9f-9a34-341dd4d1c8fa","year":2022},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.653574Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:a718b38e584ffc51cf4a92e731b35bddd1971ec6761e0c5ef31d3d7017f8c798","observation_id":"77530967-a57f-4950-80c6-a23bcc16844d","resolution":{"observed_at":"2026-08-06T16:43:59.215507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.941217Z","title":null,"venue":null,"work_id":"4c2a0123-d158-476a-9ad5-1d6ca070802d","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.745286Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:7dab44d87a8108867673f75fceb9971332eec63875d572140a90752a379b78c2","observation_id":"e6972c33-94dd-4dc0-8c62-9ff180e0aa40","resolution":{"observed_at":"2026-08-06T16:43:59.035101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.728730Z","title":"IEEE transactions on pattern analysis and machine intelligence 45, 9 (2023), 10870–10882","venue":null,"work_id":"db37e704-a7f6-4d71-bf31-5801434961cb","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:55.891093Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:98c34390b767215985d516a4c9df14c7299291b3864e83993444554055dc090d","observation_id":"1d367824-32af-400b-887c-809811f99219","resolution":{"observed_at":"2026-08-06T16:43:58.832277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.422696Z","title":null,"venue":null,"work_id":"fbbb1705-dbb9-446e-80b8-e6c57a905f0e","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.645201Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:5c3a7a3c106df2f7e65f3a529dffc686d6212d21aa76f581fec78028a6133ecc","observation_id":"820c5c7f-1772-48bc-8ede-e4008de35aae","resolution":{"observed_at":"2026-08-06T16:43:58.484312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04498","last_updated":"2023-12-18T12:15:26Z","snapshot_observed_at":"2026-08-06T14:33:43.511633Z","submitted_at":"2023-11-08T07:15:05Z","title":"NExT-Chat: An LMM for Chat, Detection and Segmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04498","snapshot_observed_at":"2026-08-06T16:43:56.096102Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.096102Z"},"links":{"cited_paper":"/paper/2311.04498","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:67acb8c18830bf38d30c03fbecac26edac2a34403567d9048021362c7693b55d","observation_id":"8df77128-ee58-44d8-88f3-598d45721f14","resolution":{"observed_at":"2026-08-06T16:43:56.096102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03605","last_updated":"2022-07-11T10:30:29Z","snapshot_observed_at":"2026-08-07T03:38:32.486362Z","submitted_at":"2022-03-07T18:55:26Z","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03605","snapshot_observed_at":"2026-08-06T16:43:56.153323Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.153323Z"},"links":{"cited_paper":"/paper/2203.03605","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:4ae19373411c4a66ec48817a426972308ea740d934e068aa6853b3f9f990fdfa","observation_id":"f14cccc8-ccfb-4048-80f6-e27b417d6479","resolution":{"observed_at":"2026-08-06T16:43:56.153323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.060819Z","title":null,"venue":null,"work_id":"ceff6f9e-2698-46d4-b13b-b9e2d801edb4","year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.908824Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:1275584793b36dcab1067a61e5c9bd80ba0cfc8a0211449fca60fd31b43594d3","observation_id":"1a59e300-49da-4caa-aadb-8b592eaaa66d","resolution":{"observed_at":"2026-08-06T16:43:58.123169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:56.327288Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.327288Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:27a250df3a1e946bc28bb467032e081b32d3b48078866b188e88ab05731c4c80","observation_id":"779e050d-3b2c-4fc8-82c0-37fff66d0a0c","resolution":{"observed_at":"2026-08-06T16:43:56.327288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14500","last_updated":"2025-03-16T14:39:54Z","snapshot_observed_at":"2026-08-03T02:01:04.625797Z","submitted_at":"2024-07-18T17:59:17Z","title":"ViLLa: Video Reasoning Segmentation with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14500","snapshot_observed_at":"2026-08-06T16:43:56.438861Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.438861Z"},"links":{"cited_paper":"/paper/2407.14500","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:327c270c7e587231c4d5421c9bb2e6c6d098ef36cfe3039ea9d074c6212a5b36","observation_id":"51c74104-c7d0-4941-bc6f-b74ebc17b510","resolution":{"observed_at":"2026-08-06T16:43:56.438861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.575560Z","title":null,"venue":null,"work_id":"297eb3c0-0cf6-44fe-83ad-4fe7daf51dae","year":2017},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.562407Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:36a5833af8e819568d333c73c6c924a98e7bc96f471998365e0574908e8f01c4","observation_id":"2692be33-23e0-4d03-adc8-036c18703da8","resolution":{"observed_at":"2026-08-06T16:43:58.649122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-06T16:43:56.742905Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.742905Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:331e8f8260be6e0dd2f1788bcd09c54f0bb7ca6a03ccc58b89dfacb93affd25f","observation_id":"ca6fa2cf-931f-4009-9dfa-d76ae7263bb0","resolution":{"observed_at":"2026-08-06T16:43:56.742905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:58.223424Z","title":null,"venue":null,"work_id":"c921c948-0537-4520-b8b5-845605dea0e5","year":2023},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:56.840419Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:d3948f013f33fafcb3bdc79b3841e4bf8aa37663a398cd62ec25a1e5ffd46c05","observation_id":"1a01e4f2-15cd-41e3-9e7e-9001d523c6a2","resolution":{"observed_at":"2026-08-06T16:43:58.280306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:43:47.679285Z","title":"In Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:47.679285Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:16c7b892133a6c619800ae406f8dfbeb43d4b7d24767b467f038a5b4b30b1149","observation_id":"c7dfce56-4a06-4f92-885f-b178596c0dbe","resolution":{"observed_at":"2026-08-06T16:43:47.679285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:44:02.224270Z","title":"In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"fa2cd600-9b20-4b3c-b6be-bd1dc1b48b09","year":null},"citing_paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T16:43:50.913344Z"},"links":{"citing_paper":"/paper/2507.12883"},"observation_digest":"sha256:cc3168073cb8700ba377aa93c54de5f5089bd4162b49fe2789b2d56ff12f6a25","observation_id":"38fafdee-2a21-4060-9ee1-00f714337a4d","resolution":{"observed_at":"2026-08-06T16:44:02.296635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12883","last_updated":"2025-08-13T05:27:53Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T12:18:34.812978Z","submitted_at":"2025-07-17T08:09:31Z","title":"HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":83,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 3 inbound Pith citation observations for arXiv:2507.12883."}