{"as_of":"2026-08-09T22:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e819dda1b2f4ace087781285f2a05a5896babfcc7f63c11b88b76fdd14520464","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:40:36.089127Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T13:24:40.386203Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03704","last_updated":"2025-06-30T20:29:34Z","snapshot_observed_at":"2026-08-08T15:13:22.075804Z","submitted_at":"2024-12-04T20:35:07Z","title":"Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03704","snapshot_observed_at":"2026-08-08T14:40:36.089127Z","title":"Scaling inference-time search with vision value model for improved visual comprehension","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-08T18:40:06.157350Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T14:40:36.089127Z"},"links":{"cited_paper":"/paper/2412.03704","citing_paper":"/paper/2502.06703"},"observation_digest":"sha256:06996066220d66689aee4444de538e774e8ef6b62cfdda68481acd619fa0b253","observation_id":"d5603a6b-9393-46dd-8c6e-5c5d0a5c7a09","resolution":{"observed_at":"2026-08-08T14:40:36.089127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03704","last_updated":"2025-06-30T20:29:34Z","snapshot_observed_at":"2026-08-08T15:13:22.075804Z","submitted_at":"2024-12-04T20:35:07Z","title":"Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03704","snapshot_observed_at":"2026-08-07T14:12:06.014106Z","title":"Scaling inference-time search with vision value model for improved visual comprehension","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19702","last_updated":"2025-05-26T08:54:14Z","snapshot_observed_at":"2026-08-08T16:19:49.539801Z","submitted_at":"2025-05-26T08:54:14Z","title":"Point-RFT: Improving Multimodal Reasoning with Visually Grounded Reinforcement Finetuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:12:06.014106Z"},"links":{"cited_paper":"/paper/2412.03704","citing_paper":"/paper/2505.19702"},"observation_digest":"sha256:f58b4d883ea41f01255e128080226a9123bbb9f5c78d3fc08f9c588985b54457","observation_id":"b69cd9cc-54b3-45bf-9283-819838cacd21","resolution":{"observed_at":"2026-08-07T14:12:06.014106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03704","last_updated":"2025-06-30T20:29:34Z","snapshot_observed_at":"2026-08-08T15:13:22.075804Z","submitted_at":"2024-12-04T20:35:07Z","title":"Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03704","snapshot_observed_at":"2026-08-07T05:54:03.181743Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06729","last_updated":"2025-06-07T09:27:26Z","snapshot_observed_at":"2026-08-07T05:48:30.660932Z","submitted_at":"2025-06-07T09:27:26Z","title":"Mitigating Object Hallucination via Robust Local Perception Search","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:03.181743Z"},"links":{"cited_paper":"/paper/2412.03704","citing_paper":"/paper/2506.06729"},"observation_digest":"sha256:8861395d8d708045afd30689ba6d686ae11cc449f7c54769ebf3c033e55a4661","observation_id":"246c9b34-c7f0-4ca4-bee2-4043cdf08d90","resolution":{"observed_at":"2026-08-07T05:54:03.181743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03704","last_updated":"2025-06-30T20:29:34Z","snapshot_observed_at":"2026-08-08T15:13:22.075804Z","submitted_at":"2024-12-04T20:35:07Z","title":"Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03704","snapshot_observed_at":"2026-08-07T05:52:18.661384Z","title":"Scaling inference-time search with vision value model for improved visual comprehension.arXiv preprint arXiv:2412.03704, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06998","last_updated":"2025-06-08T05:08:32Z","snapshot_observed_at":"2026-08-09T10:47:10.657931Z","submitted_at":"2025-06-08T05:08:32Z","title":"What makes Reasoning Models Different? Follow the Reasoning Leader for Efficient Decoding","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:52:18.661384Z"},"links":{"cited_paper":"/paper/2412.03704","citing_paper":"/paper/2506.06998"},"observation_digest":"sha256:51b221d032a00a23abeed13a8473b776a1159ffb411a123d0fe89c3d2a537c9a","observation_id":"b54b5691-eafa-49dc-87b5-550f54f6c437","resolution":{"observed_at":"2026-08-07T05:52:18.661384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03704","last_updated":"2025-06-30T20:29:34Z","snapshot_observed_at":"2026-08-08T15:13:22.075804Z","submitted_at":"2024-12-04T20:35:07Z","title":"Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03704","snapshot_observed_at":"2026-08-07T04:40:11.741673Z","title":"Scaling inference-time search with vision value model for improved visual comprehension","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10128","last_updated":"2025-06-11T19:16:54Z","snapshot_observed_at":"2026-08-08T03:17:29.512287Z","submitted_at":"2025-06-11T19:16:54Z","title":"ViCrit: A Verifiable Reinforcement Learning Proxy Task for Visual Perception in VLMs","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T04:40:11.741673Z"},"links":{"cited_paper":"/paper/2412.03704","citing_paper":"/paper/2506.10128"},"observation_digest":"sha256:9dd5af1e5e604f308ac4ff6c6d1f72c492cac0200d2e7b7e0c2b10cabc4c5c7f","observation_id":"d0da67b2-01d5-4d05-a158-b71c70f17dfa","resolution":{"observed_at":"2026-08-07T04:40:11.741673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03704","last_updated":"2025-06-30T20:29:34Z","snapshot_observed_at":"2026-08-08T15:13:22.075804Z","submitted_at":"2024-12-04T20:35:07Z","title":"Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03704","snapshot_observed_at":"2026-08-06T23:57:22.096140Z","title":"Scaling inference-time search with vision value model for improved visual comprehension.arXiv preprint arXiv:2412.03704, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15649","last_updated":"2025-06-18T17:23:36Z","snapshot_observed_at":"2026-08-07T09:16:49.443338Z","submitted_at":"2025-06-18T17:23:36Z","title":"Dual-Stage Value-Guided Inference with Margin-Based Reward Adjustment for Fast and Faithful VLM Captioning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:57:22.096140Z"},"links":{"cited_paper":"/paper/2412.03704","citing_paper":"/paper/2506.15649"},"observation_digest":"sha256:8ae3d643326da1b1f1ddf851395e76f0c5e2914dbb766bb2a03c6ca840d22be2","observation_id":"6add957d-08f8-48a0-9bdf-d3f310ccc30a","resolution":{"observed_at":"2026-08-06T23:57:22.096140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03704","last_updated":"2025-06-30T20:29:34Z","snapshot_observed_at":"2026-08-08T15:13:22.075804Z","submitted_at":"2024-12-04T20:35:07Z","title":"Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension","version":3},"cited_work":{"arxiv_id":"2412.03704","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03704","snapshot_observed_at":"2026-08-05T13:24:40.386203Z","title":"Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension","venue":"cs.CV","work_id":"c1f8f2e3-f159-4193-b5f9-d1ce0694c852","year":2024},"citing_paper":{"arxiv_id":"2509.00676","last_updated":"2025-08-31T03:08:02Z","snapshot_observed_at":"2026-08-07T21:36:21.058533Z","submitted_at":"2025-08-31T03:08:02Z","title":"LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T13:24:39.858355Z"},"links":{"cited_paper":"/paper/2412.03704","citing_paper":"/paper/2509.00676"},"observation_digest":"sha256:a389b9c2c8ca5c2fa9ee413e2b5dc41572c22c769c6c0379cd58db55e8765da9","observation_id":"e74bdea1-5859-4b61-a8b2-633f4646b1b9","resolution":{"observed_at":"2026-08-05T13:24:40.393917Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03704/citation-record","integrity":"/paper/2412.03704/integrity","json":"/paper/2412.03704/citation-record.json","paper":"/paper/2412.03704"},"outbound":[],"paper":{"arxiv_id":"2412.03704","last_updated":"2025-06-30T20:29:34Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T15:13:22.075804Z","submitted_at":"2024-12-04T20:35:07Z","title":"Scaling Inference-Time Search with Vision Value Model for Improved Visual Comprehension"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2412.03704."}