{"as_of":"2026-08-14T01:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf247af4bf55a4775ba29ae1a424b19cbc44a5e5c88108cf33fb0cfa9b1b804e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:31:10.642858Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T10:25:41.390707Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback","version":3},"cited_work":{"arxiv_id":"2402.03746","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03746","snapshot_observed_at":"2026-07-01T10:25:41.390707Z","title":"Tuning large multimodal models for videos using reinforcement learning from ai feedback","venue":null,"work_id":"31cb70fc-3046-4c10-854f-f58ce474d6d5","year":2024},"citing_paper":{"arxiv_id":"2411.02327","last_updated":"2026-05-01T17:44:24Z","snapshot_observed_at":"2026-07-06T19:45:00.034364Z","submitted_at":"2024-11-04T17:50:36Z","title":"PPLLaVA: Varied Video Sequence Understanding With Prompt Guidance","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T17:31:59.030963Z"},"links":{"cited_paper":"/paper/2402.03746","citing_paper":"/paper/2411.02327"},"observation_digest":"sha256:0b7fe2626f7a43b8c5839b19d1640343da793f3c4a9b03add407d9dc59508801","observation_id":"6b7a964c-7182-4033-8d99-3d38e54cd72c","resolution":{"observed_at":"2026-05-23T17:33:15.688660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03746","snapshot_observed_at":"2026-08-12T13:31:10.642858Z","title":"Tuning large multimodal models for videos using reinforcement learning from ai feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16201","last_updated":"2024-11-25T08:59:39Z","snapshot_observed_at":"2026-08-13T07:17:26.849810Z","submitted_at":"2024-11-25T08:59:39Z","title":"Video-Text Dataset Construction from Multi-AI Feedback: Promoting Weak-to-Strong Preference Learning for Video Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:31:10.642858Z"},"links":{"cited_paper":"/paper/2402.03746","citing_paper":"/paper/2411.16201"},"observation_digest":"sha256:91e559e7459012cb82d694e52b4f96c04e92f1522553760044bd093760f1ef26","observation_id":"d7e5fbeb-dd43-4e40-a0fe-5cad899f7f54","resolution":{"observed_at":"2026-08-12T13:31:10.642858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03746","snapshot_observed_at":"2026-08-11T11:09:12.868191Z","title":"Tuning large multimodal models for videos using reinforcement learning from ai feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15838","last_updated":"2024-12-30T07:27:58Z","snapshot_observed_at":"2026-08-13T05:16:24.404304Z","submitted_at":"2024-12-20T12:27:16Z","title":"Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T11:09:12.868191Z"},"links":{"cited_paper":"/paper/2402.03746","citing_paper":"/paper/2412.15838"},"observation_digest":"sha256:081728cbce0cf8faf57d00754e5b96f2d96314f6bd25e3ec830095cdce7a6b87","observation_id":"bac8d475-881c-409c-a107-3ae2a2ef5b20","resolution":{"observed_at":"2026-08-11T11:09:12.868191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03746","snapshot_observed_at":"2026-08-10T15:35:30.073317Z","title":"Tuning large multimodal models for videos using reinforcement learning from ai feedback.arXiv preprint arXiv:2402.03746, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13919","last_updated":"2025-09-01T07:50:58Z","snapshot_observed_at":"2026-08-11T01:32:58.320917Z","submitted_at":"2025-01-23T18:58:03Z","title":"Temporal Preference Optimization for Long-Form Video Understanding","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T15:35:30.073317Z"},"links":{"cited_paper":"/paper/2402.03746","citing_paper":"/paper/2501.13919"},"observation_digest":"sha256:a1ebf27b7d47ced1740fd4c5f453d99a32e1f2cff88fe324d895c9bfa0f46b43","observation_id":"244a4b93-45c9-4d73-bedf-b8b6ef16fd29","resolution":{"observed_at":"2026-08-10T15:35:30.073317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback","version":3},"cited_work":{"arxiv_id":"2402.03746","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03746","snapshot_observed_at":"2026-07-01T10:25:41.390707Z","title":"Tuning large multimodal models for videos using reinforcement learning from ai feedback","venue":null,"work_id":"31cb70fc-3046-4c10-854f-f58ce474d6d5","year":2024},"citing_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-14T00:44:30.558048Z"},"links":{"cited_paper":"/paper/2402.03746","citing_paper":"/paper/2503.05236"},"observation_digest":"sha256:c7a5690fbe77c57332a00fd0fa492dfb9786797c9f72c68904f2bb93116cbae2","observation_id":"9fabc273-b5eb-4b28-a318-29c4073a9a0f","resolution":{"observed_at":"2026-05-14T00:44:30.834901Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03746","snapshot_observed_at":"2026-08-07T11:51:25.225828Z","title":"Tuning large multimodal models for videos using reinforcement learning from ai feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01274","last_updated":"2026-06-11T17:06:50Z","snapshot_observed_at":"2026-08-10T04:03:56.011290Z","submitted_at":"2025-06-02T03:08:07Z","title":"ReFoCUS: Reinforcement-guided Frame Optimization for Contextual Understanding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:25.225828Z"},"links":{"cited_paper":"/paper/2402.03746","citing_paper":"/paper/2506.01274"},"observation_digest":"sha256:aa4ed7f0e13e17bc348fdbda2f8647d0529d7e00c396f33a90eaa38cfa09d55e","observation_id":"f3996da9-09bb-4a8f-8bfb-570abc504414","resolution":{"observed_at":"2026-08-07T11:51:25.225828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03746","snapshot_observed_at":"2026-08-06T14:13:07.285336Z","title":"Tuning large multimodal models for videos using reinforcement learning from ai feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19672","last_updated":"2025-07-25T20:52:58Z","snapshot_observed_at":"2026-08-07T12:02:14.124506Z","submitted_at":"2025-07-25T20:52:58Z","title":"Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges","version":1},"reference_index":279,"source":"arxiv_source","source_observed_at":"2026-08-06T14:13:07.285336Z"},"links":{"cited_paper":"/paper/2402.03746","citing_paper":"/paper/2507.19672"},"observation_digest":"sha256:c55c9bb2c13319210db2e2c877e087943a5992e3a73dcbfe295934dda647b033","observation_id":"e2dd9dfb-5cdc-44c4-adae-5d950cc26882","resolution":{"observed_at":"2026-08-06T14:13:07.285336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback","version":3},"cited_work":{"arxiv_id":"2402.03746","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03746","snapshot_observed_at":"2026-07-01T10:25:41.390707Z","title":"Tuning large multimodal models for videos using reinforcement learning from ai feedback","venue":null,"work_id":"31cb70fc-3046-4c10-854f-f58ce474d6d5","year":2024},"citing_paper":{"arxiv_id":"2604.02467","last_updated":"2026-04-27T18:17:15Z","snapshot_observed_at":"2026-08-13T08:23:55.814605Z","submitted_at":"2026-04-02T18:58:56Z","title":"VERTIGO: Visual Preference Optimization for Cinematic Camera Trajectory Generation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T21:14:42.021240Z"},"links":{"cited_paper":"/paper/2402.03746","citing_paper":"/paper/2604.02467"},"observation_digest":"sha256:179c9e8761dfba08bd40c896dc332d3615733d8a48c7e9ce64ac0753b2d2c074","observation_id":"103c13cb-73d8-40a6-a73f-d54345f52c5c","resolution":{"observed_at":"2026-05-13T21:18:17.198125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback","version":3},"cited_work":{"arxiv_id":"2402.03746","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.03746","snapshot_observed_at":"2026-07-01T10:25:41.390707Z","title":"Tuning large multimodal models for videos using reinforcement learning from ai feedback","venue":null,"work_id":"31cb70fc-3046-4c10-854f-f58ce474d6d5","year":2024},"citing_paper":{"arxiv_id":"2606.31933","last_updated":"2026-06-30T16:38:41Z","snapshot_observed_at":"2026-08-02T09:05:31.252280Z","submitted_at":"2026-06-30T16:38:41Z","title":"No Place to Hide: Benchmarking Video Hallucination with Background-Controlled Pairs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-01T05:35:08.200219Z"},"links":{"cited_paper":"/paper/2402.03746","citing_paper":"/paper/2606.31933"},"observation_digest":"sha256:b886a1bc275f7368b76308d8d4c3355489e2515a94d421e76e382174b3b9041a","observation_id":"4d28b137-a65e-400c-b13c-d8dd2b4b9be0","resolution":{"observed_at":"2026-07-01T10:25:41.391957Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.03746/citation-record","integrity":"/paper/2402.03746/integrity","json":"/paper/2402.03746/citation-record.json","paper":"/paper/2402.03746"},"outbound":[],"paper":{"arxiv_id":"2402.03746","last_updated":"2024-06-17T08:20:33Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T04:25:26.631532Z","submitted_at":"2024-02-06T06:27:40Z","title":"Tuning Large Multimodal Models for Videos using Reinforcement Learning from AI Feedback"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2402.03746."}