{"as_of":"2026-08-18T18:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2ec0aa7f7e8db9bf50e285a724a9d8e3fcb94ca21302f62f401baa0063a41eee","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:22:14.226407Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:21:12.278852Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T17:27:15.553972Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"cited_work":{"arxiv_id":"2505.24718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24718","snapshot_observed_at":"2026-07-02T17:27:15.553972Z","title":"Reinforcing VideoReasoningwithFocusedThinking","venue":null,"work_id":"aff5b822-35f8-42bf-b935-a91783a81346","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":152,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2505.24718","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:eb07e84a2634d62c27c2230322d73501148b64b139dc4b90a76c843b0f00fc5a","observation_id":"11ef9459-0e33-44f8-b644-437f7bf2568f","resolution":{"observed_at":"2026-05-12T08:40:42.109496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24718","snapshot_observed_at":"2026-08-15T23:21:12.278852Z","title":"Reinforcing video reasoning with focused thinking, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-15T23:15:46.193892Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-15T23:21:12.278852Z"},"links":{"cited_paper":"/paper/2505.24718","citing_paper":"/paper/2505.04921"},"observation_digest":"sha256:5512581148ddb1f6182d18eb2b2aeaab6a72c68b2e836acfa4c8ae18971d495a","observation_id":"20a21313-389b-424e-95f4-d4bf0c82cd26","resolution":{"observed_at":"2026-08-15T23:21:12.278852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"cited_work":{"arxiv_id":"2505.24718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24718","snapshot_observed_at":"2026-07-02T17:27:15.553972Z","title":"Reinforcing VideoReasoningwithFocusedThinking","venue":null,"work_id":"aff5b822-35f8-42bf-b935-a91783a81346","year":2025},"citing_paper":{"arxiv_id":"2505.20715","last_updated":"2026-04-18T02:55:33Z","snapshot_observed_at":"2026-08-15T07:57:21.988562Z","submitted_at":"2025-05-27T04:50:07Z","title":"MUSEG: Reinforcing Video Temporal Understanding via Timestamp-Aware Multi-Segment Grounding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T13:13:40.485342Z"},"links":{"cited_paper":"/paper/2505.24718","citing_paper":"/paper/2505.20715"},"observation_digest":"sha256:6bcef0f9c9d4823c82f1949aea9a10779619e38c27f082f15e6bb2e8a472d950","observation_id":"d580f246-b69a-4ce7-9e75-ff8a42927870","resolution":{"observed_at":"2026-05-19T13:17:18.498226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24718","snapshot_observed_at":"2026-08-15T19:00:53.888143Z","title":"Reinforcing video reasoning with focused thinking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18071","last_updated":"2025-06-27T06:32:43Z","snapshot_observed_at":"2026-08-15T18:53:06.234079Z","submitted_at":"2025-06-22T15:39:02Z","title":"MUPA: Towards Multi-Path Agentic Reasoning for Grounded Video Question Answering","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T19:00:53.888143Z"},"links":{"cited_paper":"/paper/2505.24718","citing_paper":"/paper/2506.18071"},"observation_digest":"sha256:86cefe0dcc7fe3ceb0a97f901c5dc52265ac8855dad9beceda60a432f7646f47","observation_id":"f5846c80-5fad-47c0-a4f5-ee604d4987cf","resolution":{"observed_at":"2026-08-15T19:00:53.888143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"cited_work":{"arxiv_id":"2505.24718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24718","snapshot_observed_at":"2026-07-02T17:27:15.553972Z","title":"Reinforcing VideoReasoningwithFocusedThinking","venue":null,"work_id":"aff5b822-35f8-42bf-b935-a91783a81346","year":2025},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-08-06T15:38:05.011922Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2505.24718","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:404f5d61e935aa1ecdcd52e2c58a1f0d87a9b9251448cd836abc6bb852c61f57","observation_id":"64b23fc0-7c1f-43fa-b7cd-ae758657a52e","resolution":{"observed_at":"2026-05-18T00:02:25.240758Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"cited_work":{"arxiv_id":"2505.24718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24718","snapshot_observed_at":"2026-07-02T17:27:15.553972Z","title":"Reinforcing VideoReasoningwithFocusedThinking","venue":null,"work_id":"aff5b822-35f8-42bf-b935-a91783a81346","year":2025},"citing_paper":{"arxiv_id":"2604.05117","last_updated":"2026-04-06T19:22:48Z","snapshot_observed_at":"2026-08-10T20:58:01.238928Z","submitted_at":"2026-04-06T19:22:48Z","title":"Watch Before You Answer: Learning from Visually Grounded Post-Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T20:01:13.305374Z"},"links":{"cited_paper":"/paper/2505.24718","citing_paper":"/paper/2604.05117"},"observation_digest":"sha256:09c5def2969932afd567e370908eb327ebded29469bdae21385224a82ddbbbf8","observation_id":"fa44740c-da3e-4761-9ada-d3c4e94c2d7c","resolution":{"observed_at":"2026-05-10T22:20:46.742418Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"cited_work":{"arxiv_id":"2505.24718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24718","snapshot_observed_at":"2026-07-02T17:27:15.553972Z","title":"Reinforcing VideoReasoningwithFocusedThinking","venue":null,"work_id":"aff5b822-35f8-42bf-b935-a91783a81346","year":2025},"citing_paper":{"arxiv_id":"2605.01324","last_updated":"2026-05-05T09:38:12Z","snapshot_observed_at":"2026-08-15T03:07:07.474908Z","submitted_at":"2026-05-02T08:41:53Z","title":"Beyond Perceptual Shortcuts: Causal-Inspired Debiasing Optimization for Generalizable Video Reasoning in Lightweight MLLMs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T14:30:56.297653Z"},"links":{"cited_paper":"/paper/2505.24718","citing_paper":"/paper/2605.01324"},"observation_digest":"sha256:dd02406e7cc3a24309005eb162fb48237e52bd3193196040d38a43b75c7d8cd7","observation_id":"47928768-5cd9-4810-bb8b-6b6ceda6a724","resolution":{"observed_at":"2026-05-11T16:56:06.417753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"cited_work":{"arxiv_id":"2505.24718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24718","snapshot_observed_at":"2026-07-02T17:27:15.553972Z","title":"Reinforcing VideoReasoningwithFocusedThinking","venue":null,"work_id":"aff5b822-35f8-42bf-b935-a91783a81346","year":2025},"citing_paper":{"arxiv_id":"2606.07433","last_updated":"2026-06-05T16:29:13Z","snapshot_observed_at":"2026-08-01T21:05:06.439607Z","submitted_at":"2026-06-05T16:29:13Z","title":"Watch, Remember, Reason: Human-View Video Understanding with MLLMs","version":1},"reference_index":184,"source":"pdf_text","source_observed_at":"2026-06-27T22:00:28.350003Z"},"links":{"cited_paper":"/paper/2505.24718","citing_paper":"/paper/2606.07433"},"observation_digest":"sha256:5953b01f38634ee9b77fb6a87b187ec76fb1c527da58971221e2daa10d595bab","observation_id":"836b67cd-9967-44af-b27b-fc1230f82719","resolution":{"observed_at":"2026-07-02T17:27:15.555931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24718/citation-record","integrity":"/paper/2505.24718/integrity","json":"/paper/2505.24718/citation-record.json","paper":"/paper/2505.24718"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:22:10.960839Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:10.960839Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:4817d4798477f995744b4947400292002a0605bc650557873d9e2de73db3572c","observation_id":"c9badecf-09ff-4624-b35a-5e04c047cb19","resolution":{"observed_at":"2026-08-07T12:22:10.960839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:22:15.685243Z","title":"R1-v: Reinforcing super generalization ability in vision-language models with less than $3,","venue":null,"work_id":"b8ef9ee0-7bd8-4ecd-ac2f-62fdc374ea68","year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.084671Z"},"links":{"citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:9cb6e1557ebf61cd7b5dd658c8fce90ec42815b9ff4dc5313f108fe8c50f6628","observation_id":"d4ce1a9a-d3b4-49aa-9a09-05aed9e84c1f","resolution":{"observed_at":"2026-08-07T12:22:15.828030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-16T02:03:48.252223Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T12:22:11.183874Z","title":"Vision- r1: Incentivizing reasoning capability in multimodal large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.183874Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:ec52cdaec91ff9cecc7f29acc121fe61cb6960d5a8bc46865df04114d7fd32a5","observation_id":"a8d80d51-c2f5-47cb-a6a5-1ac8e721ad9f","resolution":{"observed_at":"2026-08-07T12:22:11.183874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-13T20:16:31.803514Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T12:22:11.241111Z","title":"Mm- eureka: Exploring the frontiers of multimodal reasoning with rule-based reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.241111Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:82dfdfdbce7d3070e5dc1e44f3405e1c254ba8479ccc6e6be8967e9eda57d6c0","observation_id":"def96e6b-1f53-4bcc-84cc-98fe0f272012","resolution":{"observed_at":"2026-08-07T12:22:11.241111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05132","last_updated":"2025-03-10T01:52:08Z","snapshot_observed_at":"2026-08-14T19:11:11.139675Z","submitted_at":"2025-03-07T04:21:47Z","title":"R1-Zero's \"Aha Moment\" in Visual Reasoning on a 2B Non-SFT Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05132","snapshot_observed_at":"2026-08-07T12:22:11.311509Z","title":"R1-zero’s","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.311509Z"},"links":{"cited_paper":"/paper/2503.05132","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:eb1d133870dec62f64e31a5fc51175717982f2a7ce6e386547f8ea341b0e2e6a","observation_id":"9cef48be-5148-48ee-8727-049a8ab0dbc7","resolution":{"observed_at":"2026-08-07T12:22:11.311509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-08-18T16:51:32.000170Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-08-07T12:22:11.359058Z","title":"Lmm-r1: Empowering 3b lmms with strong reasoning abilities through two-stage rule-based rl,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.359058Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:70052d198c4f817f4e9079d2a9ae14af8b290800c91b63eeb2fa1224bfa4f2d5","observation_id":"77cdd7ca-ef91-47f0-b384-caf56fe79085","resolution":{"observed_at":"2026-08-07T12:22:11.359058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21776","last_updated":"2025-10-22T16:42:24Z","snapshot_observed_at":"2026-08-05T07:15:29.998948Z","submitted_at":"2025-03-27T17:59:51Z","title":"Video-R1: Reinforcing Video Reasoning in MLLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21776","snapshot_observed_at":"2026-08-07T12:22:11.399735Z","title":"Video-r1: Reinforc- ing video reasoning in mllms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.399735Z"},"links":{"cited_paper":"/paper/2503.21776","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:1837a6a7667c43acbe360fb0b292dab3cb5798e9f8628bfe0e128a4c2e57cd86","observation_id":"11a643dc-ec93-43fe-ac47-f4c49d1f0933","resolution":{"observed_at":"2026-08-07T12:22:11.399735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06958","last_updated":"2025-11-11T08:30:00Z","snapshot_observed_at":"2026-08-02T02:31:33.589341Z","submitted_at":"2025-04-09T15:09:27Z","title":"VideoChat-R1: Enhancing Spatio-Temporal Perception via Reinforcement Fine-Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06958","snapshot_observed_at":"2026-08-07T12:22:11.468450Z","title":"Videochat-r1: Enhancing spatio-temporal perception via reinforcement fine-tuning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.468450Z"},"links":{"cited_paper":"/paper/2504.06958","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:dfbf379a1e08720085af1efe62cc0f43c6573811fe13edaa28fe4a26e01b1b11","observation_id":"7c4361f0-b713-4b46-a04a-8ee3ac1a028f","resolution":{"observed_at":"2026-08-07T12:22:11.468450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:22:11.489252Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.489252Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:b206c035085f674dc46e53444efb71578116a43af07f6d0223d781233cc79311","observation_id":"9a269062-f33e-4c8c-8661-ef6baf68d974","resolution":{"observed_at":"2026-08-07T12:22:11.489252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09621","last_updated":"2025-02-13T18:59:46Z","snapshot_observed_at":"2026-08-17T11:53:37.450198Z","submitted_at":"2025-02-13T18:59:46Z","title":"MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09621","snapshot_observed_at":"2026-08-07T12:22:11.542607Z","title":"Mme-cot: Benchmarking chain-of-thought in large multimodal models for reasoning quality, robustness, and efficiency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.542607Z"},"links":{"cited_paper":"/paper/2502.09621","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:8f9e228432a83ffa09b4a15c9e018768817e2769ad828b0373567c6cb31ee5a2","observation_id":"9f385f3f-9ae7-46d2-8098-d70880665cf6","resolution":{"observed_at":"2026-08-07T12:22:11.542607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-13T01:30:54.104133Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-08-07T12:22:11.606319Z","title":"R1-vl: Learning to reason with multimodal large language models via step-wise group relative policy optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.606319Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:17854d19b1df65ff2e0e8c04d9c86f1c48efa8bb2ca9183b6cfba0fd79f9bef5","observation_id":"3c644961-f39d-4b35-85d2-385fb0255c0c","resolution":{"observed_at":"2026-08-07T12:22:11.606319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01442","last_updated":"2020-03-08T00:09:07Z","snapshot_observed_at":"2026-07-06T08:26:38.349660Z","submitted_at":"2019-10-03T13:16:36Z","title":"CLEVRER: CoLlision Events for Video REpresentation and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01442","snapshot_observed_at":"2026-08-07T12:22:11.671883Z","title":"Clevrer: Collision events for video representation and reasoning,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.671883Z"},"links":{"cited_paper":"/paper/1910.01442","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:19d006459632a70832079c400d2266b5446e650fc29c76776ad189b6d0bfcd3b","observation_id":"39800715-77d3-4a6b-8dcb-9616d86a5364","resolution":{"observed_at":"2026-08-07T12:22:11.671883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:22:15.446417Z","title":"Can i trust your answer? visually grounded video ques- tion answering,","venue":null,"work_id":"8131931b-1ff6-4117-8f7d-6e902a66971d","year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.761989Z"},"links":{"citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:aee8eaee8e985cf8090d1c4ab064c542d5910e9cbe12eaefd523a8721964f819","observation_id":"63dc5c0e-fd1e-4515-8820-7df1a7617a02","resolution":{"observed_at":"2026-08-07T12:22:15.577845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12380","last_updated":"2025-01-21T18:56:18Z","snapshot_observed_at":"2026-08-16T20:45:19.595957Z","submitted_at":"2025-01-21T18:56:18Z","title":"MMVU: Measuring Expert-Level Multi-Discipline Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12380","snapshot_observed_at":"2026-08-07T12:22:11.825894Z","title":"Mmvu: Measuring expert-level multi-discipline video understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.825894Z"},"links":{"cited_paper":"/paper/2501.12380","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:ddeb2513fd0039d2582daf4778c28a344b2d03e923797d30000530bc51361cf9","observation_id":"b10404a4-85df-4172-9be5-4bc22869d712","resolution":{"observed_at":"2026-08-07T12:22:11.825894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T12:22:11.951541Z","title":"Openai o1 system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:11.951541Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:138cfabf8434a4ed08b6388fc93482eee63116c3514589dbcd48af3042e75818","observation_id":"76b2b73f-acf5-4bf4-b0e6-2208a7941102","resolution":{"observed_at":"2026-08-07T12:22:11.951541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04964","last_updated":"2023-07-18T08:44:47Z","snapshot_observed_at":"2026-08-16T10:37:13.463130Z","submitted_at":"2023-07-11T01:55:24Z","title":"Secrets of RLHF in Large Language Models Part I: PPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04964","snapshot_observed_at":"2026-08-07T12:22:12.045876Z","title":"Secrets of rlhf in large language models part i: Ppo,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.045876Z"},"links":{"cited_paper":"/paper/2307.04964","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:5739db2c9dffdb98efc00526dbb15b003cbac22fae2b5a9f546bbce31fef6c9d","observation_id":"8070ccbe-b763-47b6-b467-3b9d0d7c8850","resolution":{"observed_at":"2026-08-07T12:22:12.045876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18013","last_updated":"2025-03-23T10:21:14Z","snapshot_observed_at":"2026-08-16T23:37:49.144529Z","submitted_at":"2025-03-23T10:21:14Z","title":"Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18013","snapshot_observed_at":"2026-08-07T12:22:12.120909Z","title":"Vision-r1: Evolving human-free alignment in large vision-language models via vision-guided reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.120909Z"},"links":{"cited_paper":"/paper/2503.18013","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:c963ed0f5a4b85e1c971a093a4a02e28b62f1a0731e00371c7ab5629a36e2e45","observation_id":"0613e258-0573-4692-ae18-f61740a8bef4","resolution":{"observed_at":"2026-08-07T12:22:12.120909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12346","last_updated":"2025-05-18T10:20:59Z","snapshot_observed_at":"2026-08-16T10:20:08.742919Z","submitted_at":"2025-05-18T10:20:59Z","title":"SEED-GRPO: Semantic Entropy Enhanced GRPO for Uncertainty-Aware Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12346","snapshot_observed_at":"2026-08-07T12:22:12.190500Z","title":"Seed-grpo: Semantic entropy enhanced grpo for uncertainty-aware policy optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.190500Z"},"links":{"cited_paper":"/paper/2505.12346","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:c2003adfc5903295b70dc97bc672f9a02367c3091363168a5d84078c2eb6536d","observation_id":"7b4aba80-d73a-4225-914e-cd2b8ce53e20","resolution":{"observed_at":"2026-08-07T12:22:12.190500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-08-14T16:25:22.654846Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07476","snapshot_observed_at":"2026-08-07T12:22:12.277375Z","title":"Videollama 2: Advancing spatial-temporal modeling and audio understanding in video-llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.277375Z"},"links":{"cited_paper":"/paper/2406.07476","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:b754a70d1065b7bfd5727072f4b736110d81b4452767565d4e0fbdb44395ce45","observation_id":"8a5119cd-5d9d-4291-8035-90a5405ecd91","resolution":{"observed_at":"2026-08-07T12:22:12.277375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06720","last_updated":"2023-12-13T04:45:01Z","snapshot_observed_at":"2026-08-16T14:36:02.228601Z","submitted_at":"2023-12-11T02:50:46Z","title":"Audio-Visual LLM for Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06720","snapshot_observed_at":"2026-08-07T12:22:12.360528Z","title":"Audio-visual llm for video understanding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.360528Z"},"links":{"cited_paper":"/paper/2312.06720","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:c8a18ed3af4fffc47891d36eee9c5472665f15946cbc42762b9b145cf1cb9fa4","observation_id":"868cd186-217e-47e2-9345-540ad555343e","resolution":{"observed_at":"2026-08-07T12:22:12.360528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:22:15.321286Z","title":"Visa: Reasoning video object segmentation via large language models,","venue":null,"work_id":"0b2e7fc0-f1f3-47ce-95dd-4e0d791c1bd8","year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.453345Z"},"links":{"citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:47a55bce50e5266409f2c7e78b2e23ee7470c658ba23751334e7ec203395644a","observation_id":"1be92ba5-8340-4a3b-9337-dce1fb7f4931","resolution":{"observed_at":"2026-08-07T12:22:15.384290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12303","last_updated":"2025-06-14T13:17:01Z","snapshot_observed_at":"2026-08-16T12:49:41.967816Z","submitted_at":"2025-03-16T00:25:13Z","title":"Will Pre-Training Ever End? A First Step Toward Next-Generation Foundation MLLMs via Self-Improving Systematic Cognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12303","snapshot_observed_at":"2026-08-07T12:22:12.546086Z","title":"Towards self-improving systematic cognition for next-generation foundation mllms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.546086Z"},"links":{"cited_paper":"/paper/2503.12303","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:51bc2fab4324115ffc65825950a1c968a6c5c122c1d91dd1756fb359b35451f2","observation_id":"87bdd1af-243d-4b5e-b13e-7a70c8daa3c9","resolution":{"observed_at":"2026-08-07T12:22:12.546086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13871","last_updated":"2025-03-19T10:04:22Z","snapshot_observed_at":"2026-08-11T14:38:15.849933Z","submitted_at":"2024-12-18T14:07:46Z","title":"LLaVA-UHD v2: an MLLM Integrating High-Resolution Semantic Pyramid via Hierarchical Window Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13871","snapshot_observed_at":"2026-08-07T12:22:12.643287Z","title":"Llava-uhd v2: an mllm integrating high-resolution feature pyramid via hierarchical window transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.643287Z"},"links":{"cited_paper":"/paper/2412.13871","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:7973875b538023037834bc8a2dd1bac0da279c689dd3d028772d573e383b4a15","observation_id":"7bd86063-dc8f-43ee-b910-3d8236c3ae10","resolution":{"observed_at":"2026-08-07T12:22:12.643287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07961","last_updated":"2024-12-10T22:57:57Z","snapshot_observed_at":"2026-08-16T05:02:58.743063Z","submitted_at":"2024-12-10T22:57:57Z","title":"Forking Paths in Neural Text Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07961","snapshot_observed_at":"2026-08-07T12:22:12.716029Z","title":"Forking paths in neural text generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.716029Z"},"links":{"cited_paper":"/paper/2412.07961","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:86539f41e364a566cc9008230369aa677d0d0f33d2c9c0dbebce4b4845f27724","observation_id":"a68fac34-d6bf-45f2-9f76-6ba773877cc4","resolution":{"observed_at":"2026-08-07T12:22:12.716029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19943","last_updated":"2025-01-13T06:53:56Z","snapshot_observed_at":"2026-08-17T23:02:54.258483Z","submitted_at":"2024-11-29T18:58:22Z","title":"Critical Tokens Matter: Token-Level Contrastive Estimation Enhances LLM's Reasoning Capability","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19943","snapshot_observed_at":"2026-08-07T12:22:12.794644Z","title":"Critical tokens matter: Token-level contrastive estimation enhence llm’s reasoning capability,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.794644Z"},"links":{"cited_paper":"/paper/2411.19943","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:150919ab822d8fcbef3ae30ae895d0b1b0eafd7eebe9a30f5ef6e4570f7116a0","observation_id":"570faee5-66db-4c4e-812c-0e3a9d8f6b1c","resolution":{"observed_at":"2026-08-07T12:22:12.794644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-18T05:01:20.543826Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-07T12:22:12.867048Z","title":"Dapo: An open-source llm reinforcement learning system at scale,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.867048Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:b5975866e3f128dc29d44886046a7d0757c94b2d6e693f0a860591c216df4afa","observation_id":"605d6a0f-b46e-45a6-b1fd-25588ab8c0ca","resolution":{"observed_at":"2026-08-07T12:22:12.867048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:22:15.182751Z","title":"Mvbench: A comprehensive multi-modal video understanding benchmark,","venue":null,"work_id":"8614b6ea-5a44-4fd8-a66c-bf47af155478","year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:12.956300Z"},"links":{"citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:e22484ea64d46a66c70dc8458d445b92ffd5518dab71e8d8e0acc0285f781c8d","observation_id":"0dc28f2d-2237-4f73-bb25-60c69b46ac44","resolution":{"observed_at":"2026-08-07T12:22:15.240891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00476","last_updated":"2024-06-03T04:13:39Z","snapshot_observed_at":"2026-08-12T14:24:43.915700Z","submitted_at":"2024-03-01T12:02:19Z","title":"TempCompass: Do Video LLMs Really Understand Videos?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00476","snapshot_observed_at":"2026-08-07T12:22:13.038077Z","title":"Tempcompass: Do video llms really understand videos?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.038077Z"},"links":{"cited_paper":"/paper/2403.00476","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:73d6a3ec44c27fa444bf08eb1d354432ee25187b6ed4572ce6f5e61089ac7222","observation_id":"cf3020a1-1f48-4b8c-81aa-788731fa7a08","resolution":{"observed_at":"2026-08-07T12:22:13.038077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-07T12:22:13.162144Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.162144Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:003075fa258a0062f19b67d89bfd79dfb43bf3c3aeb8b19768fb0e1050e8018b","observation_id":"bed7a548-6ece-4d28-8108-5f014352f3ba","resolution":{"observed_at":"2026-08-07T12:22:13.162144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:22:15.039427Z","title":"Llama-vid: An image is worth 2 tokens in large language models,","venue":null,"work_id":"c4b213c2-9b1d-4785-ba3b-8ae853c183b4","year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.236797Z"},"links":{"citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:a4ef8c29f615e24e2f9043ad68b0f1a6d22294312151a18052005991cbc2d7db","observation_id":"ff5b7fee-4772-452d-8a82-d0de440785c9","resolution":{"observed_at":"2026-08-07T12:22:15.104174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-07T12:22:13.330350Z","title":"Long context transfer from language to vision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.330350Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:46fc88932a55232218ae1de7a7e7f165ec33920bf4f5ebde96d48a2d6ae5fc8b","observation_id":"708677d5-b6a1-4e7b-88c6-5af249e4da12","resolution":{"observed_at":"2026-08-07T12:22:13.330350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12081","last_updated":"2025-02-17T17:55:55Z","snapshot_observed_at":"2026-08-17T16:20:14.077041Z","submitted_at":"2025-02-17T17:55:55Z","title":"Unhackable Temporal Rewarding for Scalable Video MLLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12081","snapshot_observed_at":"2026-08-07T12:22:13.428738Z","title":"Unhackable temporal rewarding for scalable video mllms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.428738Z"},"links":{"cited_paper":"/paper/2502.12081","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:285717cf5c37cf2242b229b40fe940f4fda5762e90c351752d6b151d46e59ac4","observation_id":"81d94e55-924f-4bef-8a01-09d71e5a273c","resolution":{"observed_at":"2026-08-07T12:22:13.428738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15542","last_updated":"2024-08-28T05:34:14Z","snapshot_observed_at":"2026-08-16T13:23:18.747171Z","submitted_at":"2024-08-28T05:34:14Z","title":"Kangaroo: A Powerful Video-Language Model Supporting Long-context Video Input","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15542","snapshot_observed_at":"2026-08-07T12:22:13.508706Z","title":"Kangaroo: A powerful video-language model supporting long-context video input,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.508706Z"},"links":{"cited_paper":"/paper/2408.15542","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:5f8ea9de87a26a31ce0814201aaf83e7ffa3bd664a8c0fa03c791d25c2fbd97b","observation_id":"6443ad05-adcd-41d2-b2e6-1dc1fa460b2e","resolution":{"observed_at":"2026-08-07T12:22:13.508706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T12:22:13.630605Z","title":"Qwen2. 5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.630605Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:09ad7277d0688756c8879764995a534f00a291459cb1c51e4ce8b8be407ba976","observation_id":"ea08b928-4410-4cbe-9613-cb0320456b33","resolution":{"observed_at":"2026-08-07T12:22:13.630605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09711","last_updated":"2024-05-15T21:53:54Z","snapshot_observed_at":"2026-08-16T21:19:34.047707Z","submitted_at":"2024-05-15T21:53:54Z","title":"STAR: A Benchmark for Situated Reasoning in Real-World Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09711","snapshot_observed_at":"2026-08-07T12:22:13.702673Z","title":"Star: A benchmark for situated reasoning in real-world videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.702673Z"},"links":{"cited_paper":"/paper/2405.09711","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:a90aea8654343160bc79947e6fdffcfa9b31d1a89458ba296efee0876520dcf7","observation_id":"b23e32ea-f4c2-45bd-a21a-5b55d020807b","resolution":{"observed_at":"2026-08-07T12:22:13.702673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15134","last_updated":"2025-05-21T05:39:11Z","snapshot_observed_at":"2026-08-17T17:47:20.877990Z","submitted_at":"2025-05-21T05:39:11Z","title":"The Unreasonable Effectiveness of Entropy Minimization in LLM Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15134","snapshot_observed_at":"2026-08-07T12:22:13.785924Z","title":"The unreasonable effectiveness of entropy minimization in llm reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.785924Z"},"links":{"cited_paper":"/paper/2505.15134","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:00662aa5fc73557c4ffc946bda5d0261d42f15920fcb37689bb3494c8d8075a1","observation_id":"04fb0489-b2e9-4f57-b528-5d163eb5e669","resolution":{"observed_at":"2026-08-07T12:22:13.785924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05812","last_updated":"2025-05-18T13:41:33Z","snapshot_observed_at":"2026-08-18T04:26:01.321574Z","submitted_at":"2025-04-08T08:48:51Z","title":"Right Question is Already Half the Answer: Fully Unsupervised LLM Reasoning Incentivization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05812","snapshot_observed_at":"2026-08-07T12:22:13.915142Z","title":"Right question is already half the answer: Fully unsupervised llm reasoning incentivization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:13.915142Z"},"links":{"cited_paper":"/paper/2504.05812","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:411bc083a354b94eb8bcba7c3401a0550372c6bc8acd4a096eba114cd58583a7","observation_id":"faa37307-72ef-439b-9160-a7171164c542","resolution":{"observed_at":"2026-08-07T12:22:13.915142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19590","last_updated":"2026-05-16T23:13:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-26T07:01:06Z","title":"Learning to Reason without External Rewards","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19590","snapshot_observed_at":"2026-08-07T12:22:14.022769Z","title":"Learning to reason without external rewards,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:14.022769Z"},"links":{"cited_paper":"/paper/2505.19590","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:dbcfa58c80d52572138adcb8473e7eb88e19002ffb0f20937cc08545b81ccf08","observation_id":"059a37cd-0a8a-4db3-8832-8abd7abb548e","resolution":{"observed_at":"2026-08-07T12:22:14.022769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:22:14.098816Z","title":"Scalable best-of-n selection for large language models via self-certainty,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:14.098816Z"},"links":{"citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:ccac19254742a87ae6fc8f7891fbb44e8a5c3b515fe1de448c2410efa5825d42","observation_id":"9a939a17-bd5f-4ae7-8863-1005e0f9acf6","resolution":{"observed_at":"2026-08-07T12:22:14.098816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:22:14.151223Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:14.151223Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:93120936bdb277f13bf7d835e464f5e5fd0851ea38578e5685c4215c681be4ea","observation_id":"cba31ede-d6d4-4a2b-884f-d19b251f9087","resolution":{"observed_at":"2026-08-07T12:22:14.151223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:22:14.892112Z","title":"Trl: Transformer reinforcement learning,","venue":null,"work_id":"4045dafe-d531-456a-9c54-787ff97c62a0","year":2020},"citing_paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:22:14.226407Z"},"links":{"citing_paper":"/paper/2505.24718"},"observation_digest":"sha256:c20499ce7b147de51f633d5b9e71e91d54835fb64494af558d1230be0af824dc","observation_id":"9d76de55-bffc-4eba-982d-7a74f3e6c844","resolution":{"observed_at":"2026-08-07T12:22:14.955173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24718","last_updated":"2025-06-08T14:43:47Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T02:01:36.218531Z","submitted_at":"2025-05-30T15:42:19Z","title":"Reinforcing Video Reasoning with Focused Thinking"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 8 inbound Pith citation observations for arXiv:2505.24718."}