{"as_of":"2026-08-12T14:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:52606ee385e4cdb864da5506dd7ec235f4b9541f83a88c18910873891312a573","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:27:46.110145Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18048/citation-record","integrity":"/paper/2506.18048/integrity","json":"/paper/2506.18048/citation-record.json","paper":"/paper/2506.18048"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T23:27:45.974336Z","title":"Qwen2.5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.974336Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:25caaa0091189e6b19ac533145823370859dcbad9eb3b2474a75cd5e92ff1d02","observation_id":"888e2e60-e219-475c-aaa1-b528e274bd99","resolution":{"observed_at":"2026-08-06T23:27:45.974336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T23:27:45.979535Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.979535Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:b5f056fc581442f8a7629da186b0b74dac556eb216bff360266d350125d33b44","observation_id":"a1cba944-ef9a-4c3a-a1c9-8028410c4f07","resolution":{"observed_at":"2026-08-06T23:27:45.979535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T23:27:45.983521Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.983521Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:6411d10d23af7867ae0e65371be7452b9c10fbbde762620f5543d551b0f71dd1","observation_id":"f2dd7f1e-2c03-4ef2-a355-09707d2a1102","resolution":{"observed_at":"2026-08-06T23:27:45.983521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T18:37:57.419939Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T23:27:45.989262Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.989262Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:ca19327d64f8740440be22c6a3a48775240093077c68225cea878c7747a7e6f2","observation_id":"cba8af1b-81fd-4ced-9f49-ae5ffed51561","resolution":{"observed_at":"2026-08-06T23:27:45.989262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.467214Z","title":"Mini-internvl: a flexible-transfer pocket multi-modal model with 5% parameters and 90% performance,","venue":null,"work_id":"d755db99-c557-4fb7-b040-91d292bb75ab","year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.994230Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:8659c7e87fde79bbd6ec45eba0816cc9767350d8e0397d97faae28ac15eca3b3","observation_id":"90a389ff-562d-4d1b-91ea-8c4c79769133","resolution":{"observed_at":"2026-08-06T23:27:46.470968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:45.999090Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.999090Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:baf71ae8f463eddd17b7f161a662758a7bfd94c786686043afd8521f250da93f","observation_id":"6d3a24bb-b916-4c08-ab3f-7e6750106c24","resolution":{"observed_at":"2026-08-06T23:27:45.999090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T23:27:46.003577Z","title":"Deepseek-v3 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.003577Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:a754241435d3ca956ab0ec73a998aab25ff72ba88e6ccecf4271476bd5b72281","observation_id":"50e3175e-3585-44a1-98de-9522d7dd512d","resolution":{"observed_at":"2026-08-06T23:27:46.003577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:27:46.007744Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.007744Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:1651e3b5fb4a36d6ff5432f290afa8b19eef51d9fd6ef6fbe5b62ac72415e087","observation_id":"e0358bca-d770-4939-a258-2b3bc14b349a","resolution":{"observed_at":"2026-08-06T23:27:46.007744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-06T23:27:46.011940Z","title":"Deepseek-vl2: Mixture-of-experts vision-language models for advanced multimodal understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.011940Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:dc619e85c0d09363bec21a7c038c5fb06297a3097fa7e4757f8130c9c278e304","observation_id":"42dd53b1-eaeb-4e1d-b910-9944b3080290","resolution":{"observed_at":"2026-08-06T23:27:46.011940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.449566Z","title":"Deepseek-vl: Towards real-world vision-language understanding,","venue":null,"work_id":"14ab36fe-5e91-4b22-a21e-1224b9bd092a","year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.016387Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:d469fa26b7cec72cbb276884dd875ebeea12ba255bce5e3cfe492f5fe8502d19","observation_id":"d0fb5213-c107-4e06-92fa-b3a58308bd0f","resolution":{"observed_at":"2026-08-06T23:27:46.453110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.438818Z","title":"Fastvlm: Efficient vision encoding for vision language models,","venue":null,"work_id":"18be5af0-a0d7-455d-b1c2-ef92cb3dea17","year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.019994Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:c8552fdb1e998a29bbcad013cec3653575e4101d126bed222e3d90de1f4de8c0","observation_id":"5f0c31ce-2ba5-405e-8461-e7f9f6165736","resolution":{"observed_at":"2026-08-06T23:27:46.442658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.427754Z","title":"Emoset: A large-scale visual emotion dataset with rich attributes,","venue":null,"work_id":"768c247f-b54f-4245-b051-b061d929f114","year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.023951Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:592fc4cd0f21fead3eb3f696a7e3674c5424285480d98186792296b4eae77fb2","observation_id":"ed8b03db-ccc0-4a2b-9581-1552711e4495","resolution":{"observed_at":"2026-08-06T23:27:46.431841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.027925Z","title":"How far are we to gpt-4v? closing the gap to commercial multimodal models with open-source suites,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.027925Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:fb72791498fc4c36474c4bcd3bb6d467b3e2a2698948f05dcee2870f0959420f","observation_id":"ce9df91b-8665-4023-9d7b-f4c7c11313ee","resolution":{"observed_at":"2026-08-06T23:27:46.027925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T23:27:46.031851Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.031851Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:f556bae5257b4ed7c57665ee064fabb116a2ddc533b01187fd5bcec511c32c4f","observation_id":"206915a0-b4c3-415f-a14c-faa7b1913a53","resolution":{"observed_at":"2026-08-06T23:27:46.031851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T23:27:46.035574Z","title":"Dapo: An open-source llm reinforcement learning system at scale,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.035574Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:a8fc7d43ea9ef7d5368bd805b278dd8eb8be775600d873bd5e854f4c961c2df5","observation_id":"5ed44390-3232-42df-8999-d4f09e64286c","resolution":{"observed_at":"2026-08-06T23:27:46.035574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-06T23:27:46.040045Z","title":"Mobilevlm: A fast, reproducible and strong vision language assistant for mobile devices,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.040045Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:7c51d23891af397bba0993ce0822cdd7d5a0b8b2778b9802180d3d7c65e5420a","observation_id":"e1df0161-d7f3-42f0-8aef-8431d30554c3","resolution":{"observed_at":"2026-08-06T23:27:46.040045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10442","snapshot_observed_at":"2026-08-06T23:27:46.044306Z","title":"Enhancing the reasoning ability of multimodal large language models via mixed preference optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.044306Z"},"links":{"cited_paper":"/paper/2411.10442","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:1dfcdeb9f0488a59af33e4864e9899b8e7d3b827984f99a8b2306579556bd134","observation_id":"89775a5f-8141-4c5f-9d31-b8158f2da8b5","resolution":{"observed_at":"2026-08-06T23:27:46.044306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09498","last_updated":"2025-05-14T15:45:17Z","snapshot_observed_at":"2026-08-07T15:45:23.297247Z","submitted_at":"2025-05-14T15:45:17Z","title":"Flash-VL 2B: Optimizing Vision-Language Model Performance for Ultra-Low Latency and High Throughput","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09498","snapshot_observed_at":"2026-08-06T23:27:46.048132Z","title":"Flash-vl 2b: Optimizing vision-language model perfor- mance for ultra-low latency and high throughput,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.048132Z"},"links":{"cited_paper":"/paper/2505.09498","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:b275d1b5386bfc053771616d3f98a0e191cdb9cfc2f718bc0559c4ed434700e7","observation_id":"c8760376-d25b-4280-92e6-05e754f0d73a","resolution":{"observed_at":"2026-08-06T23:27:46.048132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.410609Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":"9ab0f050-50ed-4044-aa44-87a4afd52836","year":null},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.055921Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:8deb8823ef117e9072639c9878856709b5c95778f53af50be1484e82695b4596","observation_id":"c480aeb5-07ba-42a7-8fbf-2accc3867fe6","resolution":{"observed_at":"2026-08-06T23:27:46.414377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.397793Z","title":"Bluelm: An open multilingual 7b language model,","venue":null,"work_id":"f363c142-2cd2-4fbf-bdbf-be0373f87d3d","year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.065185Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:a748279bd260eca2d8a06eccab19a8b716dd4998266f75c5d2ed5eb06df86fce","observation_id":"d207f646-328b-46ae-86d1-f2c88e1be30d","resolution":{"observed_at":"2026-08-06T23:27:46.401648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T23:27:46.069055Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.069055Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:6675d4606184956cb31a428041d4cddbfa48345be7dab69d5bd5ad05da6c714d","observation_id":"ceb4a625-f154-4dfd-a0d3-1f6ddc62b22b","resolution":{"observed_at":"2026-08-06T23:27:46.069055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-06T23:27:46.073417Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.073417Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:60207f13a6a0b86324221991595a0a9b2b1dabd126739913e373518c0a2c3b06","observation_id":"de30002b-577a-4f35-9999-6e7832abf485","resolution":{"observed_at":"2026-08-06T23:27:46.073417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.386300Z","title":"Visual cot: Advancing multi-modal language models with a comprehensive dataset and benchmark for chain-of-thought reasoning,","venue":null,"work_id":"aa5acb94-9899-4ffc-b926-a1978a065cc0","year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.077559Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:22a6b7d0c484d1027d4a96b7aa61a07e9ab176c4f28e78870cb94f94b4552445","observation_id":"3b9f84a9-5d91-40d6-9fce-e92fbd59d6e5","resolution":{"observed_at":"2026-08-06T23:27:46.390168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.375358Z","title":"Cot-vla: Visual chain-of- thought reasoning for vision-language-action models,","venue":null,"work_id":"f2e4de5f-7210-477c-9a9a-b73fc0b2984d","year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.082144Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:562bb89ece2885f64794c23015c2be57b36cc6704775ff090ec653c88bd6ba05","observation_id":"9bcb828f-6da3-46a2-ba53-51a42189d87b","resolution":{"observed_at":"2026-08-06T23:27:46.379161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T23:27:46.086111Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.086111Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:7f2464ead56ff4d9dc69ba08745b8d8cf09db102e75eaa013fbb61fedbe3b789","observation_id":"ee782dab-a378-4cef-afb2-e68922e5d2a0","resolution":{"observed_at":"2026-08-06T23:27:46.086111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.364689Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":"c53bf386-35b8-4b29-b1a3-c21a1f2b11a4","year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.090218Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:6a5f1803094bcefe0617c75cf1b4b3c288ab553f7bc6214a7d848ef317105b6a","observation_id":"d977a308-3fa7-47c9-a607-864a0119acc8","resolution":{"observed_at":"2026-08-06T23:27:46.368226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03095","last_updated":"2025-02-05T11:41:43Z","snapshot_observed_at":"2026-08-10T20:00:39.129261Z","submitted_at":"2025-02-05T11:41:43Z","title":"Reveal the Mystery of DPO: The Connection between DPO and RL Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03095","snapshot_observed_at":"2026-08-06T23:27:46.094169Z","title":"Reveal the mystery of dpo: The connection between dpo and rl algorithms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.094169Z"},"links":{"cited_paper":"/paper/2502.03095","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:f4227653431580f602dd86714e61b8ea6d19f11fd33e513177226f971c06436b","observation_id":"d4c51025-8c1d-4790-a00e-684a8a9963f4","resolution":{"observed_at":"2026-08-06T23:27:46.094169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-08-12T02:21:51.598634Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-06T23:27:46.098401Z","title":"Understanding r1-zero-like training: A critical perspective,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.098401Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:16b9c89e10f9c1a5cdc182aa8b7d029e2859fec0da22aa4a46dc657b1b674dde","observation_id":"c14be14c-f2bb-49ec-8019-2b136d1f5c00","resolution":{"observed_at":"2026-08-06T23:27:46.098401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05348","last_updated":"2024-08-28T14:26:07Z","snapshot_observed_at":"2026-08-10T14:48:57.090454Z","submitted_at":"2023-11-09T13:18:27Z","title":"u-LLaVA: Unifying Multi-Modal Tasks via Large Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05348","snapshot_observed_at":"2026-08-06T23:27:46.102560Z","title":"u-llava: Unifying multi-modal tasks via large language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.102560Z"},"links":{"cited_paper":"/paper/2311.05348","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:8274f891f0b86c7a8e3e1b2b1ee602cad487cdfb904f3f711f8000e46a8a3380","observation_id":"3e0302b2-4c90-4d32-b153-02826c9f8c20","resolution":{"observed_at":"2026-08-06T23:27:46.102560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.352231Z","title":"Reproducibility companion paper: u-llava: Unifying multi-modal tasks via large language model,","venue":null,"work_id":"f33841f3-9cc7-46e6-88a8-08a8f8754712","year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.106556Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:2b5d2dd720296b42442c8352da6ec5144c16d4a14660f52fbe2158952605b7dd","observation_id":"6fe2d866-1107-4922-acda-7c305a133f15","resolution":{"observed_at":"2026-08-06T23:27:46.357321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.337640Z","title":"Overcoming heterogeneous data in federated medical vision-language pre-training: A triple-embedding model selector approach,","venue":null,"work_id":"bc1c000f-2cdb-48a1-8757-0be5543bae41","year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.110145Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:6b0ef771469eede8af57e36f856a9e053c1b61f4b79d297fee16b3db857680f1","observation_id":"83592d12-7e03-4866-aeeb-60cdca07b7c4","resolution":{"observed_at":"2026-08-06T23:27:46.344292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-06T23:27:46.060328Z","title":"Available: https://arxiv.org/abs/2305.18290","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.060328Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:bea28faf4d4cec54637ba9f56a7263631909665b8581d89dc41184c86b9879bd","observation_id":"cdb15741-233e-411b-970c-9479855144e2","resolution":{"observed_at":"2026-08-06T23:27:46.060328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T20:49:35.253219Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2506.18048."}