{"as_of":"2026-08-10T00:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8fee2cd18de871be3572c6035bb0150e2d5f026d3f712e008ecbb022c3868245","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T06:01:13.181293Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T01:07:30.306320Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.02477","last_updated":"2024-07-02T17:55:03Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:55:03Z","title":"Understanding Alignment in Multimodal LLMs: A Comprehensive Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02477","snapshot_observed_at":"2026-08-09T06:01:13.181293Z","title":"Understanding alignment in multimodal llms: A comprehensive study","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04371","last_updated":"2025-02-05T11:28:11Z","snapshot_observed_at":"2026-08-09T05:54:22.550320Z","submitted_at":"2025-02-05T11:28:11Z","title":"PerPO: Perceptual Preference Optimization via Discriminative Rewarding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T06:01:13.181293Z"},"links":{"cited_paper":"/paper/2407.02477","citing_paper":"/paper/2502.04371"},"observation_digest":"sha256:c5de4bcea7a4ac7e4495151366e7d047c7489de0d141b1074c683eeb4eafe31a","observation_id":"b8703a87-72fa-44b0-a36f-1fdf8b04c253","resolution":{"observed_at":"2026-08-09T06:01:13.181293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02477","last_updated":"2024-07-02T17:55:03Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:55:03Z","title":"Understanding Alignment in Multimodal LLMs: A Comprehensive Study","version":1},"cited_work":{"arxiv_id":"2407.02477","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.02477","snapshot_observed_at":"2026-07-03T01:07:30.306320Z","title":"arXiv preprint arXiv:2407.02477 , year=","venue":null,"work_id":"e5f87824-1df3-4fd0-8461-241f137fcb96","year":2024},"citing_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T05:26:04.960844Z"},"links":{"cited_paper":"/paper/2407.02477","citing_paper":"/paper/2505.07062"},"observation_digest":"sha256:3e08baea5ac6e2148bfbb05f5af30b81883e7b00ccbe2c44c3a1a2c6d788e072","observation_id":"a1c198b8-abb0-44c3-b207-214fe00f3088","resolution":{"observed_at":"2026-05-11T05:26:06.032367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02477","last_updated":"2024-07-02T17:55:03Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:55:03Z","title":"Understanding Alignment in Multimodal LLMs: A Comprehensive Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02477","snapshot_observed_at":"2026-08-07T14:02:59.199626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20124","last_updated":"2025-05-27T12:10:27Z","snapshot_observed_at":"2026-08-08T09:10:32.146078Z","submitted_at":"2025-05-26T15:24:06Z","title":"TUNA: Comprehensive Fine-grained Temporal Understanding Evaluation on Dense Dynamic Videos","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:02:59.199626Z"},"links":{"cited_paper":"/paper/2407.02477","citing_paper":"/paper/2505.20124"},"observation_digest":"sha256:10108eef1377ec33fb4d1ea7980feaffef9ba7ea1ad93c2529805d5f1bb1004b","observation_id":"a2e78cdb-1c50-4de0-aa61-8865a41e9cfc","resolution":{"observed_at":"2026-08-07T14:02:59.199626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02477","last_updated":"2024-07-02T17:55:03Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:55:03Z","title":"Understanding Alignment in Multimodal LLMs: A Comprehensive Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02477","snapshot_observed_at":"2026-08-05T19:52:50.159792Z","title":"Understand- ing alignment in multimodal llms: A comprehensive study","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11616","last_updated":"2025-08-15T17:29:06Z","snapshot_observed_at":"2026-08-09T00:49:49.650768Z","submitted_at":"2025-08-15T17:29:06Z","title":"Controlling Multimodal LLMs via Reward-guided Decoding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T19:52:50.159792Z"},"links":{"cited_paper":"/paper/2407.02477","citing_paper":"/paper/2508.11616"},"observation_digest":"sha256:e0358d3a28bca2fa9513fed9b73afa1b109650d60fe26eb925368164d0b48ab0","observation_id":"f1ba0cee-9f31-4e8b-a0fc-4456da44a26f","resolution":{"observed_at":"2026-08-05T19:52:50.159792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02477","last_updated":"2024-07-02T17:55:03Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:55:03Z","title":"Understanding Alignment in Multimodal LLMs: A Comprehensive Study","version":1},"cited_work":{"arxiv_id":"2407.02477","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.02477","snapshot_observed_at":"2026-07-03T01:07:30.306320Z","title":"arXiv preprint arXiv:2407.02477 , year=","venue":null,"work_id":"e5f87824-1df3-4fd0-8461-241f137fcb96","year":2024},"citing_paper":{"arxiv_id":"2604.10527","last_updated":"2026-04-12T08:43:28Z","snapshot_observed_at":"2026-07-06T22:59:09.778842Z","submitted_at":"2026-04-12T08:43:28Z","title":"STORM: End-to-End Referring Multi-Object Tracking in Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:25:31.777907Z"},"links":{"cited_paper":"/paper/2407.02477","citing_paper":"/paper/2604.10527"},"observation_digest":"sha256:d2a52fdff964e3e5dbfe8d6bfc95e94d1cdca8a3a2eee98183187da95f065a73","observation_id":"d92ef524-ed8b-4f9d-9da7-df4dd275bc81","resolution":{"observed_at":"2026-05-11T08:56:00.429658Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02477","last_updated":"2024-07-02T17:55:03Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:55:03Z","title":"Understanding Alignment in Multimodal LLMs: A Comprehensive Study","version":1},"cited_work":{"arxiv_id":"2407.02477","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.02477","snapshot_observed_at":"2026-07-03T01:07:30.306320Z","title":"arXiv preprint arXiv:2407.02477 , year=","venue":null,"work_id":"e5f87824-1df3-4fd0-8461-241f137fcb96","year":2024},"citing_paper":{"arxiv_id":"2605.10622","last_updated":"2026-05-11T14:16:25Z","snapshot_observed_at":"2026-07-06T23:22:32.858399Z","submitted_at":"2026-05-11T14:16:25Z","title":"Vocabulary Hijacking in LVLMs: Unveiling Critical Attention Heads by Excluding Inert Tokens to Mitigate Hallucination","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-12T05:15:34.156717Z"},"links":{"cited_paper":"/paper/2407.02477","citing_paper":"/paper/2605.10622"},"observation_digest":"sha256:fd4840442edac513f20a145ffd4b40f46a0cd6c231c9811c995bb16a9eef0c48","observation_id":"ffbdc1ec-ecb5-437c-adf6-63ef1d32d0f6","resolution":{"observed_at":"2026-05-12T05:16:24.424276Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02477","last_updated":"2024-07-02T17:55:03Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:55:03Z","title":"Understanding Alignment in Multimodal LLMs: A Comprehensive Study","version":1},"cited_work":{"arxiv_id":"2407.02477","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.02477","snapshot_observed_at":"2026-07-03T01:07:30.306320Z","title":"arXiv preprint arXiv:2407.02477 , year=","venue":null,"work_id":"e5f87824-1df3-4fd0-8461-241f137fcb96","year":2024},"citing_paper":{"arxiv_id":"2606.09038","last_updated":"2026-06-08T05:10:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-08T05:10:05Z","title":"Personalization Meets Safety:Mechanisms,Risks,and Mitigations in Personalized LLMs","version":1},"reference_index":259,"source":"pdf_text","source_observed_at":"2026-06-27T16:49:14.243931Z"},"links":{"cited_paper":"/paper/2407.02477","citing_paper":"/paper/2606.09038"},"observation_digest":"sha256:8d6ee84194e4119cdf696128aa268f023c634e419b1a4a7002a1a6f578eb5d5f","observation_id":"d090b960-9e66-4b7d-8041-4da8f0f7ca45","resolution":{"observed_at":"2026-07-03T01:07:30.307746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02477","last_updated":"2024-07-02T17:55:03Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:55:03Z","title":"Understanding Alignment in Multimodal LLMs: A Comprehensive Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02477","snapshot_observed_at":"2026-08-02T04:15:35.851690Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13712","last_updated":"2026-07-15T11:28:27Z","snapshot_observed_at":"2026-08-07T12:44:12.629063Z","submitted_at":"2026-07-15T11:28:27Z","title":"Groc-PO: Grounded Context Preference Optimization for Truthful Multimodal LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T04:15:35.851690Z"},"links":{"cited_paper":"/paper/2407.02477","citing_paper":"/paper/2607.13712"},"observation_digest":"sha256:ec33e3bc0ce10ccc0686b4099a46f1ee8c8ae83db54051800829bd00395e763c","observation_id":"38e9c4e0-8eb8-43a0-a74a-20a97fa64a51","resolution":{"observed_at":"2026-08-02T04:15:35.851690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.02477/citation-record","integrity":"/paper/2407.02477/integrity","json":"/paper/2407.02477/citation-record.json","paper":"/paper/2407.02477"},"outbound":[],"paper":{"arxiv_id":"2407.02477","last_updated":"2024-07-02T17:55:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:55:03Z","title":"Understanding Alignment in Multimodal LLMs: A Comprehensive Study"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2407.02477."}