{"as_of":"2026-08-17T14:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:448e4bacadb9e1cf2551c32abd79bb3bf7f8a36411c16edb08d2cbff468b8e0e","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T18:17:06.263351Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.08125/citation-record","integrity":"/paper/2412.08125/integrity","json":"/paper/2412.08125/citation-record.json","paper":"/paper/2412.08125"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.079046Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.079046Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:7bc515592348d88d46f3c9efb30e1113722343e06f99ec21761921823e88d316","observation_id":"f58d82cd-87ce-46f3-a166-18ebcd28082a","resolution":{"observed_at":"2026-08-11T18:17:06.079046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.085685Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.085685Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:419556238745fa188f72e7ef1ac8bfadf38cbd800362942185f76952388112ed","observation_id":"c4433e12-1f80-4d58-8798-a1b500086249","resolution":{"observed_at":"2026-08-11T18:17:06.085685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.748209Z","title":null,"venue":null,"work_id":"0d52d1a2-b5ba-4e3d-a88b-f2b488ef1b06","year":2022},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.091748Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:22a3455ea637b327ec25f036a1176d2dbb60aac80d816b38c6acd6e81da5fb53","observation_id":"01676e43-0156-4087-a744-d4304cac726a","resolution":{"observed_at":"2026-08-11T18:17:06.753232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-11T18:17:06.096170Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.096170Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:c34c8329c3f015bcbbcb71fe304f036baa3a9ef9597308a4b2d61448df35f6fa","observation_id":"b6fcd400-8301-48bc-82c6-abd86eff57b7","resolution":{"observed_at":"2026-08-11T18:17:06.096170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.734814Z","title":null,"venue":null,"work_id":"adfcf387-5783-482c-9197-f61bf0aa8517","year":2014},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.100611Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:df4e2b1a3a047726a04b7a367aca86c50e7959bd6a861c5aa54d175a72a94057","observation_id":"8727d7ad-35d7-4b03-af51-3ec900946da0","resolution":{"observed_at":"2026-08-11T18:17:06.739123Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.720042Z","title":null,"venue":null,"work_id":"8530a771-a03f-45c8-9987-8186917ffdda","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.106330Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:fe579cc2b78c3b5ea777cb1e328cef95d38705829b283b35abb67029ede8ff61","observation_id":"4382c04f-cf82-4f6a-bc8e-e778f1c4b2fd","resolution":{"observed_at":"2026-08-11T18:17:06.724956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-17T13:04:04.064087Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-11T18:17:06.110320Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.110320Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:353df7688abfd6e541c56c9fe73d694a488918492a1760b6cc3a5200335e4e8c","observation_id":"1ade942e-534b-4990-94c9-5b05bc528533","resolution":{"observed_at":"2026-08-11T18:17:06.110320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.708058Z","title":null,"venue":null,"work_id":"376bd63b-d654-4acb-9210-e648d7ef7cf9","year":1960},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.115606Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:c5c84300bb4ef8d53a45d1e603f91dd6a9771477ff147343ab631d754aa04daf","observation_id":"0db20106-e84b-4b2b-9867-3cdb193824d0","resolution":{"observed_at":"2026-08-11T18:17:06.712027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.695426Z","title":null,"venue":null,"work_id":"fed943f0-c83c-4124-8fb5-fb14e02fa401","year":2016},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.120616Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:0215a82bc4d6741ebe1a4797ef246b8e56c95cc2382ff3c2c06873ba789fadfb","observation_id":"ad22c261-1b7d-4da3-bb11-4d68780fbb53","resolution":{"observed_at":"2026-08-11T18:17:06.698817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13432","last_updated":"2021-08-25T11:36:26Z","snapshot_observed_at":"2026-08-16T18:14:36.090994Z","submitted_at":"2021-06-25T05:12:42Z","title":"Hierarchical Object-oriented Spatio-Temporal Reasoning for Video Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13432","snapshot_observed_at":"2026-08-11T18:17:06.124939Z","title":"H.; Le, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.124939Z"},"links":{"cited_paper":"/paper/2106.13432","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:cda1835b243af5a8a0a09e9f056d7b57c3184a124d6781cd1ff6980f7c17ebd5","observation_id":"b05edda5-4524-4746-ab28-b565712ff025","resolution":{"observed_at":"2026-08-11T18:17:06.124939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.685717Z","title":null,"venue":null,"work_id":"a4532426-a3ca-42c0-999c-79c308c49ca0","year":2022},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.129699Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:66226d7325cc201a436a33492ce7c2f36c8dd923a8fe444dac36f2c21f126fe5","observation_id":"b676201f-1da9-4b11-b2da-f9550e9be93d","resolution":{"observed_at":"2026-08-11T18:17:06.688823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.673606Z","title":null,"venue":null,"work_id":"65852f13-0951-46e3-837f-e035fdaab700","year":2012},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.135136Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:217a9c2e8b7064d689c67d67bf5f1133207ea7d639d2406584889c23e90a7da8","observation_id":"6db5f140-7ae6-43ac-82f8-3a1fb2385b63","resolution":{"observed_at":"2026-08-11T18:17:06.677764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.139711Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.139711Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:4bae36955f712390be90f31299ef15bcde500b810b422b0c6b3e89b1c73937d7","observation_id":"b01563fd-f0cb-464d-b321-e18862bdf64a","resolution":{"observed_at":"2026-08-11T18:17:06.139711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T18:17:06.145369Z","title":"J.; Shen, Y.; Wallis, P.; Allen-Zhu, Z.; Li, Y.; Wang, S.; Wang, L.; and Chen, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.145369Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:6e2aa9f4ed22e98eb5c928ec195c5c0b4e8348fad68edb1232b904cf46f36c64","observation_id":"3acd0955-aa33-4cfa-9e04-a58d4f0aeef2","resolution":{"observed_at":"2026-08-11T18:17:06.145369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.654527Z","title":"K.; Patra, B.; et al","venue":null,"work_id":"387f8af1-43f4-4288-bcea-04baeb103d4d","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.150243Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:9b7309ede6ebe448c6cbb28de6d64a2b26db4ab7a2a3301b9f15534d483c5f8d","observation_id":"44f34efa-2b26-4f89-a99e-e3b5ffa6ef34","resolution":{"observed_at":"2026-08-11T18:17:06.658612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.642038Z","title":"A.; and Manning, C","venue":null,"work_id":"2e35f449-05eb-4acc-8896-2c805a796d90","year":2019},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.154983Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:a1a17be6157b56d0a7f45ef5e678d63c53816cefef5819250c2db03e4e8e917c","observation_id":"4f524a37-d721-4ca8-b33b-6fff89e7cf42","resolution":{"observed_at":"2026-08-11T18:17:06.646054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.631017Z","title":null,"venue":null,"work_id":"073245e6-3ff7-448d-8f91-7645d6d4a5ec","year":2020},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.159146Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:c2a2ffe9d720fa79f9b9161ea3cc52aac3fa25c33ed97b9e8668c12665d5fbb0","observation_id":"85378678-594f-429f-a86f-d0c333cde960","resolution":{"observed_at":"2026-08-11T18:17:06.635225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.618463Z","title":"M.; and Partee, B","venue":null,"work_id":"c71a2d3c-b0a8-4210-97d3-a78a892afb80","year":1997},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.163853Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:54bfb24cf8d2bf04b6d432bc21fbf7bd81fc46b1854717292310bf36ad938dd8","observation_id":"c7ef61d7-260c-4007-8ea1-6d5507b5a411","resolution":{"observed_at":"2026-08-11T18:17:06.622469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-11T18:17:06.168470Z","title":"Q.; Sablayrolles, A.; Roux, A.; Mensch, A.; Savary, B.; Bamford, C.; Chaplot, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.168470Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:7f3a25bd6409e5a0a386ebfb565b1a8e63b0a499f916f8e4c85dc9de9a3c5bb3","observation_id":"15d342f5-9cc3-4e9c-8119-180a5e8db2af","resolution":{"observed_at":"2026-08-11T18:17:06.168470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.607649Z","title":null,"venue":null,"work_id":"c354b8f2-44f2-4bd5-97d0-2cae6f87f430","year":2014},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.172495Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:d2dac41451c978ee559fdcdc8cb9776aa5968dbdc4c0b14356ad6e58a76bce13","observation_id":"8a800034-f83a-4075-95e9-48e01275d09a","resolution":{"observed_at":"2026-08-11T18:17:06.610873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.596940Z","title":null,"venue":null,"work_id":"af17610e-0571-4261-be9e-ff844d17e241","year":2021},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.178237Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:2e1213475112c3f5483dd1f7a4a10f03760205ca5716b7a8c2bc61d7a9f84e76","observation_id":"ca415897-a9cd-4b64-8070-b2379d9416ba","resolution":{"observed_at":"2026-08-11T18:17:06.600755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.584274Z","title":null,"venue":null,"work_id":"df92bfe8-b645-4ac3-9450-f646ed3ef577","year":2019},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.181688Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:04eef54bbf4bec8a92347c3eb18ae848c844d9fa2774e6265df4eee3abcda53f","observation_id":"30a11930-083b-44fd-b6c0-9a1f423f7f54","resolution":{"observed_at":"2026-08-11T18:17:06.588209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.572200Z","title":"A.; et al","venue":null,"work_id":"0548587a-53ef-4bfc-8ee5-f8796f049d3c","year":2017},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.185784Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:c514f6254ffbe233be475818c14cc10c3be53257a19980bfb0352655304f6f92","observation_id":"a07a0489-b3e4-4d72-bb5e-8390861370da","resolution":{"observed_at":"2026-08-11T18:17:06.575838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.560634Z","title":"M.; Le, V.; Venkatesh, S.; and Tran, T","venue":null,"work_id":"e69b9c85-a9c8-4807-92ce-d02b73e53c3a","year":2020},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.189130Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:3ef00a3b24dccb116c5e909511d0a1a9165158e277f87cf20dad962dc460cfc5","observation_id":"4e51bac2-83d4-4e96-9082-fbc0bb9aafe0","resolution":{"observed_at":"2026-08-11T18:17:06.564653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03354","last_updated":"2023-11-06T18:59:44Z","snapshot_observed_at":"2026-08-16T14:45:33.725152Z","submitted_at":"2023-11-06T18:59:44Z","title":"CoVLM: Composing Visual Entities and Relationships in Large Language Models Via Communicative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03354","snapshot_observed_at":"2026-08-11T18:17:06.194020Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.194020Z"},"links":{"cited_paper":"/paper/2311.03354","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:85b7a6cbbe467dba2d5abd5d37896a0452ec2980738d30f07b41129da962233b","observation_id":"70171532-8b38-4b87-800a-21addb893a3e","resolution":{"observed_at":"2026-08-11T18:17:06.194020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.549735Z","title":null,"venue":null,"work_id":"a4ce66c5-3929-4eda-95f9-d4aceed87272","year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.198575Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:f3ec9b835174024d1e6a2d799f4f652bc8e6816ff1d6a1359ce72734b79866a4","observation_id":"f6e5c6d4-fc1c-48ef-8b65-4e1d4fb2a7c5","resolution":{"observed_at":"2026-08-11T18:17:06.553804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.539277Z","title":null,"venue":null,"work_id":"36888ec6-e1a1-446c-8b95-d6722c601f60","year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.203704Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:e4ed7bd05cfb21ed9dc00b2666f0ae97051b4c3d07581a4e62298bd32d5eb957","observation_id":"4311eaea-ea22-4c6c-8fa8-81f5c6699623","resolution":{"observed_at":"2026-08-11T18:17:06.543315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.528424Z","title":null,"venue":null,"work_id":"a7729ca2-8964-4767-b983-cd60112ba55a","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.208478Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:d564473b32f2b3c1986d48e8c47feeef6f9c04d371274a13c8c5e1bd78f68fa8","observation_id":"ea871e84-cb89-4c6f-ab81-b73d064ce780","resolution":{"observed_at":"2026-08-11T18:17:06.532324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-11T18:17:06.211796Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.211796Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:729a5ca3a97c176466a0efc5a3d1c7252ef94c1aede7b09a9cfadcb84df94112","observation_id":"a0c43349-e56a-41ad-b84d-47bc035bfe82","resolution":{"observed_at":"2026-08-11T18:17:06.211796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.519493Z","title":"O.; Gandhi, M.; Gao, I.; and Krishna, R","venue":null,"work_id":"cc849bd2-82a6-4948-8ec8-84d81249c8d0","year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.215286Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:cb901a5022904928d59843af2a8e4f38c579aa1d8c71986d3521a4fcf76523d5","observation_id":"6ab68c9a-8519-4782-97d2-cab93de0a760","resolution":{"observed_at":"2026-08-11T18:17:06.522333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.507781Z","title":"L.; and Murphy, K","venue":null,"work_id":"83feefb4-d080-4ade-bf18-99417776549a","year":2016},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.219372Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:e922ba59981485c0f692c9b2937c39082dc7db4b07cfa6f72144277c787ae49d","observation_id":"ef1c416e-6d11-4397-b506-b6f202817510","resolution":{"observed_at":"2026-08-11T18:17:06.512468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.495517Z","title":null,"venue":null,"work_id":"0bdd2f22-3c7a-4d44-928b-417ef35189c9","year":2008},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.224014Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:5f06437f5e30d47d9eb5768365c21891856aa647d52bd0307299d6aaf2e68112","observation_id":"3a203d5e-7960-4749-b4b1-08871a28d578","resolution":{"observed_at":"2026-08-11T18:17:06.499596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.484281Z","title":null,"venue":null,"work_id":"d3fd2b57-afc9-4ae1-a13e-22b7d4d54368","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.228524Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:75023d028d938d999700aa49a3a037255d01ecb2a3db7526a61ddd6aa7f56b90","observation_id":"5824d950-62c4-4e62-a8b8-55523cedce6b","resolution":{"observed_at":"2026-08-11T18:17:06.487722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.470864Z","title":"A.; Wang, L.; Cervantes, C","venue":null,"work_id":"d9b275f8-f1f7-409d-b61f-d58dcdb4524a","year":2015},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.232348Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:3ddf99b3faf58dc55406e74d655ba39f92beccbca9d27a0d3574416a2cad6097","observation_id":"7929454f-37c9-48fb-8723-50ebb4892fc3","resolution":{"observed_at":"2026-08-11T18:17:06.474955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.459070Z","title":null,"venue":null,"work_id":"6a945470-db40-43d9-a4c1-7ea2de3a250b","year":2019},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.235920Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:44464f86afb9e8ee77b7a29da3c1d5cd2590c49786069833caafb091dece2935","observation_id":"46b9664e-ad61-49fe-92a8-6cf885c8f753","resolution":{"observed_at":"2026-08-11T18:17:06.463277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.445178Z","title":null,"venue":null,"work_id":"bc8ba2a6-8816-4826-a718-6b5367fc0d94","year":2022},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.239356Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:d1d2517c0fc6d883802ee80fa13c5a9882ba33ec1b9c72e898dbe8ce7996792a","observation_id":"3312f287-05ec-40f7-acff-7eab0c313639","resolution":{"observed_at":"2026-08-11T18:17:06.449165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.434292Z","title":null,"venue":null,"work_id":"7254c0f2-bf83-4f46-99a1-642760e290cd","year":2024},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.243926Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:3b15caf38e541b29fd7564f50e2f53f0e97c384054101bf2a0b0fb42a1905ea1","observation_id":"9729b605-a070-4143-9dc8-8e9558fb27eb","resolution":{"observed_at":"2026-08-11T18:17:06.437893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.422656Z","title":"C.; and Berg, T","venue":null,"work_id":"fecd68e8-c03c-4f29-996c-16bfe4f2650e","year":2016},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.247642Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:469862d262855bf52a1e734ae4bc767294f49b980b6a169ffd2c1cfcbc569a53","observation_id":"17a75dcd-0225-4746-9d2d-d128e63b644a","resolution":{"observed_at":"2026-08-11T18:17:06.426335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.409824Z","title":null,"venue":null,"work_id":"90d36f5b-8e87-43ef-a566-4522f03c6559","year":2023},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.251198Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:3279e29ef45aa39960b249539d01776c49b31bb212bf2389cabb4adc41f8087d","observation_id":"a4922ffa-f999-4e19-bf98-b842174c245f","resolution":{"observed_at":"2026-08-11T18:17:06.414370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08276","last_updated":"2022-06-01T16:45:09Z","snapshot_observed_at":"2026-08-16T17:41:33.408972Z","submitted_at":"2021-11-16T07:55:26Z","title":"Multi-Grained Vision Language Pre-Training: Aligning Texts with Visual Concepts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08276","snapshot_observed_at":"2026-08-11T18:17:06.254943Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.254943Z"},"links":{"cited_paper":"/paper/2111.08276","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:2471dd1dbcd80808308a9bd7c0acc843ea42e32066b86321342d0ee6ce14d6cb","observation_id":"550b026c-80d7-4699-87cc-d6019b2d24c2","resolution":{"observed_at":"2026-08-11T18:17:06.254943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00221","last_updated":"2023-06-22T16:55:44Z","snapshot_observed_at":"2026-08-16T16:49:03.285397Z","submitted_at":"2022-07-01T06:25:53Z","title":"VL-CheckList: Evaluating Pre-trained Vision-Language Models with Objects, Attributes and Relations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.00221","snapshot_observed_at":"2026-08-11T18:17:06.258515Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.258515Z"},"links":{"cited_paper":"/paper/2207.00221","citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:24d781d66d8a873d5449befeb2b3d7e5c0566707e26989473ff3843ad05c9163","observation_id":"06c6fe06-7548-4ce7-b2f1-1f808c4ebe90","resolution":{"observed_at":"2026-08-11T18:17:06.258515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:17:06.395565Z","title":null,"venue":null,"work_id":"619c79c8-832e-4575-89d3-55a7c3f47737","year":2016},"citing_paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T18:17:06.263351Z"},"links":{"citing_paper":"/paper/2412.08125"},"observation_digest":"sha256:a834cf782e4e01f6a98dbb930a897f448bbf449582c295f4369952fa5c109ca9","observation_id":"91c6b993-c5ea-4153-89f7-25634aebe423","resolution":{"observed_at":"2026-08-11T18:17:06.400597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.08125","last_updated":"2024-12-19T05:46:29Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T05:44:01.164208Z","submitted_at":"2024-12-11T06:21:33Z","title":"Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.08125."}