{"as_of":"2026-08-09T13:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7cb104798a7bd0f92ca3713281d3f55903410f1cd3d15c5d9351cf5bfee0641a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:57:06.069990Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T08:35:32.544536Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.05046","last_updated":"2025-05-06T15:33:55Z","snapshot_observed_at":"2026-08-08T00:08:56.223081Z","submitted_at":"2024-04-07T19:00:45Z","title":"FGAIF: Aligning Large Vision-Language Models with Fine-grained AI Feedback","version":2},"cited_work":{"arxiv_id":"2404.05046","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05046","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fgaif: Aligning large vision- language models with fine-grained ai feedback","venue":null,"work_id":"622fe540-0817-449e-a10f-5d70c925eaaf","year":2024},"citing_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-11T12:33:32.631346Z"},"links":{"cited_paper":"/paper/2404.05046","citing_paper":"/paper/2404.18930"},"observation_digest":"sha256:46a14e54a5661127cfaf287e679c755dc48c835e92aacb5c0611b67ee8bcd0b5","observation_id":"284c11df-c240-457f-96f5-e9968c74f38d","resolution":{"observed_at":"2026-05-11T12:33:33.864804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05046","last_updated":"2025-05-06T15:33:55Z","snapshot_observed_at":"2026-08-08T00:08:56.223081Z","submitted_at":"2024-04-07T19:00:45Z","title":"FGAIF: Aligning Large Vision-Language Models with Fine-grained AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05046","snapshot_observed_at":"2026-08-07T13:57:06.069990Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20569","last_updated":"2025-05-29T14:24:24Z","snapshot_observed_at":"2026-08-08T00:06:38.957985Z","submitted_at":"2025-05-26T23:06:54Z","title":"Retrieval Visual Contrastive Decoding to Mitigate Object Hallucinations in Large Vision-Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:06.069990Z"},"links":{"cited_paper":"/paper/2404.05046","citing_paper":"/paper/2505.20569"},"observation_digest":"sha256:88b2f78619095b00bf57811ad9286c527d1600474142261fa4c5a1751580d025","observation_id":"e6595046-8b54-4a70-a9a5-f3918fbb52ee","resolution":{"observed_at":"2026-08-07T13:57:06.069990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05046","last_updated":"2025-05-06T15:33:55Z","snapshot_observed_at":"2026-08-08T00:08:56.223081Z","submitted_at":"2024-04-07T19:00:45Z","title":"FGAIF: Aligning Large Vision-Language Models with Fine-grained AI Feedback","version":2},"cited_work":{"arxiv_id":"2404.05046","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05046","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fgaif: Aligning large vision- language models with fine-grained ai feedback","venue":null,"work_id":"622fe540-0817-449e-a10f-5d70c925eaaf","year":2024},"citing_paper":{"arxiv_id":"2507.12455","last_updated":"2026-05-22T04:17:50Z","snapshot_observed_at":"2026-08-08T21:41:53.901114Z","submitted_at":"2025-07-16T17:55:43Z","title":"Mitigating Object Hallucinations via Sentence-Level Early Intervention","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-25T08:31:24.173135Z"},"links":{"cited_paper":"/paper/2404.05046","citing_paper":"/paper/2507.12455"},"observation_digest":"sha256:5976f36b7ecdf9c041264c4bbe6c24f43d66736c3a919b1f34635d099b8a82e5","observation_id":"f41038fe-c266-4a23-b176-e79d8f69683d","resolution":{"observed_at":"2026-05-25T08:35:32.547950Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05046","last_updated":"2025-05-06T15:33:55Z","snapshot_observed_at":"2026-08-08T00:08:56.223081Z","submitted_at":"2024-04-07T19:00:45Z","title":"FGAIF: Aligning Large Vision-Language Models with Fine-grained AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05046","snapshot_observed_at":"2026-08-06T14:13:07.288520Z","title":"Fgaif: Aligning large vision-language models with fine-grained ai feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19672","last_updated":"2025-07-25T20:52:58Z","snapshot_observed_at":"2026-08-07T12:02:14.124506Z","submitted_at":"2025-07-25T20:52:58Z","title":"Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges","version":1},"reference_index":280,"source":"arxiv_source","source_observed_at":"2026-08-06T14:13:07.288520Z"},"links":{"cited_paper":"/paper/2404.05046","citing_paper":"/paper/2507.19672"},"observation_digest":"sha256:c184712385cdfd8378de68e9acb8284c05c5069b586ec14b62dd7c49c2f5c7f6","observation_id":"dd1e8d19-788f-481c-8135-6a6577e1f933","resolution":{"observed_at":"2026-08-06T14:13:07.288520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05046","last_updated":"2025-05-06T15:33:55Z","snapshot_observed_at":"2026-08-08T00:08:56.223081Z","submitted_at":"2024-04-07T19:00:45Z","title":"FGAIF: Aligning Large Vision-Language Models with Fine-grained AI Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05046","snapshot_observed_at":"2026-08-05T20:29:02.201967Z","title":"Jing and X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10955","last_updated":"2025-08-14T07:25:45Z","snapshot_observed_at":"2026-08-09T12:54:37.629481Z","submitted_at":"2025-08-14T07:25:45Z","title":"Empowering Multimodal LLMs with External Tools: A Comprehensive Survey","version":1},"reference_index":191,"source":"arxiv_source","source_observed_at":"2026-08-05T20:29:02.201967Z"},"links":{"cited_paper":"/paper/2404.05046","citing_paper":"/paper/2508.10955"},"observation_digest":"sha256:8b357bb96cf90e32c9c33e96c519a234e6aa795f4d6210cd06366a5922bfe0fc","observation_id":"890ed4af-e217-4132-9b46-8b1009af927c","resolution":{"observed_at":"2026-08-05T20:29:02.201967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2404.05046/citation-record","integrity":"/paper/2404.05046/integrity","json":"/paper/2404.05046/citation-record.json","paper":"/paper/2404.05046"},"outbound":[],"paper":{"arxiv_id":"2404.05046","last_updated":"2025-05-06T15:33:55Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:08:56.223081Z","submitted_at":"2024-04-07T19:00:45Z","title":"FGAIF: Aligning Large Vision-Language Models with Fine-grained AI Feedback"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2404.05046."}