{"as_of":"2026-08-09T13:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:410e80c2715f8ba0de231b0d77a12c3f03adf915889d327f31d7f5dc55c362df","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:05:19.719944Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2504.12501","last_updated":"2026-08-03T01:47:58Z","snapshot_observed_at":"2026-08-07T16:01:39.307745Z","submitted_at":"2025-04-16T21:36:46Z","title":"Reinforcement Learning from Human Feedback","version":9},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-05-22T19:27:40.991325Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2504.12501"},"observation_digest":"sha256:7e2d247dfcf5fdd0685a97a5c8cb1b2b84cfc7a6683af23fb4494976d370f740","observation_id":"bbd64e70-7770-4536-8d60-02c2d38e2c38","resolution":{"observed_at":"2026-05-22T19:32:01.167091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2506.01937","last_updated":"2026-04-23T14:42:19Z","snapshot_observed_at":"2026-07-06T21:35:12.872021Z","submitted_at":"2025-06-02T17:54:04Z","title":"RewardBench 2: Advancing Reward Model Evaluation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T11:18:03.965711Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2506.01937"},"observation_digest":"sha256:89c0168f0f8b88660f7519ea882461e544a8182bb6ff0c1465b52334790afe85","observation_id":"1319239b-82a9-44d7-822c-8d284f2c19fd","resolution":{"observed_at":"2026-05-19T11:22:16.608330Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-07T11:05:19.719944Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04280","last_updated":"2025-06-04T04:21:32Z","snapshot_observed_at":"2026-08-09T12:57:20.961064Z","submitted_at":"2025-06-04T04:21:32Z","title":"Evaluating MLLMs with Multimodal Multi-image Reasoning Benchmark","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:05:19.719944Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2506.04280"},"observation_digest":"sha256:bd31cc6a71a753bb38fccc433626e208de002b04f7a8644f89e79dbbd0dbdf62","observation_id":"4f95da42-0fbe-49f0-b7a7-b9d955e24ffa","resolution":{"observed_at":"2026-08-07T11:05:19.719944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-06T21:02:42.505501Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.01368","last_updated":"2025-07-02T05:10:29Z","snapshot_observed_at":"2026-08-09T13:26:45.734009Z","submitted_at":"2025-07-02T05:10:29Z","title":"Activation Reward Models for Few-Shot Model Alignment","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T21:02:42.505501Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2507.01368"},"observation_digest":"sha256:d58e039bbc3d54beffad11cd7a3d1222e8f660e39143f2dc211347a20107722c","observation_id":"e2908560-f838-4916-a340-625aab08f338","resolution":{"observed_at":"2026-08-06T21:02:42.505501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-07T10:45:27.091213Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08104","last_updated":"2025-06-04T21:58:50Z","snapshot_observed_at":"2026-08-08T11:56:24.333937Z","submitted_at":"2025-06-04T21:58:50Z","title":"VideoConviction: A Multimodal Benchmark for Human Conviction and Stock Market Recommendations","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:27.091213Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2507.08104"},"observation_digest":"sha256:64f5e85656d44c7af4e32f7f5fa6963f1e3b3586b19454963db1abdec096070a","observation_id":"5cf78738-ebe9-47ea-8cec-8709444bdde9","resolution":{"observed_at":"2026-08-07T10:45:27.091213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-03T03:04:44.967292Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models.arXiv preprint arXiv:2502.14191,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-08T13:06:41.126177Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:44.967292Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:ac10fdd7747d4182bf70571c870d561348fdba6eb5e575b92ee6f43f8dfb1bad","observation_id":"34d46e00-8265-46f7-9b5d-b82fb86938ac","resolution":{"observed_at":"2026-08-03T03:04:44.967292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-02T19:56:32.626573Z","title":"Multimodal RewardBench: Holistic Evalua- tion of Reward Models for Vision Language Models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.00546","last_updated":"2026-07-15T15:03:39Z","snapshot_observed_at":"2026-08-07T07:10:53.274893Z","submitted_at":"2026-02-28T08:49:22Z","title":"Advancing Multimodal Judge Models through a Capability-Oriented Benchmark and MCTS-Driven Data Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T19:56:32.626573Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2603.00546"},"observation_digest":"sha256:ae86a4a49fa0c34412615d8f58e345d84d185fcc595b6742cff7ffab7b3d2b46","observation_id":"9f2c75f4-4926-474b-a789-d457d18ac3e6","resolution":{"observed_at":"2026-08-02T19:56:32.626573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2604.13029","last_updated":"2026-04-14T17:58:22Z","snapshot_observed_at":"2026-07-06T23:01:05.634599Z","submitted_at":"2026-04-14T17:58:22Z","title":"Visual Preference Optimization with Rubric Rewards","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T15:45:52.980881Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2604.13029"},"observation_digest":"sha256:c6013591846f7fc9525fe75b6ba9066dbc746ee72d777a43747178b8018089c5","observation_id":"109f52c6-f545-4e49-bd84-c8daf21b16f3","resolution":{"observed_at":"2026-05-11T09:56:00.849378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2604.19405","last_updated":"2026-04-21T12:29:10Z","snapshot_observed_at":"2026-07-31T17:39:49.500629Z","submitted_at":"2026-04-21T12:29:10Z","title":"Lost in Translation: Do LVLM Judges Generalize Across Languages?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-10T02:18:17.579110Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2604.19405"},"observation_digest":"sha256:8c99857ced45f0e43ba17f018ed445622cbb0e36492250880a7a17569e82ed34","observation_id":"ad5abe45-5d39-4f6f-90c2-04f93480da09","resolution":{"observed_at":"2026-05-11T13:06:05.856802Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2604.19544","last_updated":"2026-04-21T15:02:50Z","snapshot_observed_at":"2026-07-06T23:06:12.542013Z","submitted_at":"2026-04-21T15:02:50Z","title":"DT2IT-MRM: Debiased Preference Construction and Iterative Training for Multimodal Reward Modeling","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T01:45:30.001398Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2604.19544"},"observation_digest":"sha256:ceaa75f84bbf8a00eaa7ec267ee0337f642d156428c87a4ef0d819df614d0624","observation_id":"a4daae0a-28c5-47f7-bf5e-79d00ad236eb","resolution":{"observed_at":"2026-05-11T13:26:03.893380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2604.21718","last_updated":"2026-04-26T23:28:29Z","snapshot_observed_at":"2026-08-03T21:12:35.258126Z","submitted_at":"2026-04-22T09:01:04Z","title":"Building a Precise Video Language with Human-AI Oversight","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-10T00:37:31.858728Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2604.21718"},"observation_digest":"sha256:f126a1a4aa33bdf48ac50b9cfcc265c9b866f9bba495f59c4e2cd4071a32af68","observation_id":"0301289b-53ba-42bb-a78a-9253bb63f7ef","resolution":{"observed_at":"2026-05-11T13:46:04.512494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2605.07872","last_updated":"2026-05-08T15:29:11Z","snapshot_observed_at":"2026-08-04T19:38:15.330922Z","submitted_at":"2026-05-08T15:29:11Z","title":"Video Understanding Reward Modeling: A Robust Benchmark and Performant Reward Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T02:18:20.880231Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2605.07872"},"observation_digest":"sha256:4e9ce969b4a26b40b1e5d9ee84c9212ace9efe80774d8e7a6d9d50e15e749bb8","observation_id":"def1d5e6-910a-4f5e-8dea-a6d3c493f332","resolution":{"observed_at":"2026-05-11T03:45:58.316951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2605.09269","last_updated":"2026-05-10T02:32:19Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-10T02:32:19Z","title":"DeltaRubric: Generative Multimodal Reward Modeling via Joint Planning and Verification","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T04:41:44.833354Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2605.09269"},"observation_digest":"sha256:2ad9df04b8d98a85e51f7e034a83414e8c0fecbf8ac06c625a51aa5fc7907e13","observation_id":"5a2bc0ff-d920-4e03-8077-660d03fc6295","resolution":{"observed_at":"2026-05-12T06:01:24.318015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:697bb5ff16500cd8ceddf3587f4a9e8c5c062ce367bbe9442131f7aedfcea854","observation_id":"5c822b84-a066-493a-a62b-baf5fcfee596","resolution":{"observed_at":"2026-07-01T06:05:29.027260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.14191/citation-record","integrity":"/paper/2502.14191/integrity","json":"/paper/2502.14191/citation-record.json","paper":"/paper/2502.14191"},"outbound":[],"paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2502.14191."}