{"as_of":"2026-08-15T11:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3f6539b275b8fb6fa621d3431477be6dbad69e0abc6ed5dfafb75148bf57e2c1","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:14:56.957808Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:08:49.205080Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T04:08:53.251034Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.05939","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05939","snapshot_observed_at":"2026-08-07T04:08:53.251034Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","venue":"cs.CV","work_id":"07a6030b-2fec-41cf-b5b8-2505c94f2440","year":2024},"citing_paper":{"arxiv_id":"2506.11515","last_updated":"2025-06-13T07:16:41Z","snapshot_observed_at":"2026-08-14T02:40:24.668658Z","submitted_at":"2025-06-13T07:16:41Z","title":"Manager: Aggregating Insights from Unimodal Experts in Two-Tower VLMs and MLLMs","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-07T04:08:49.205080Z"},"links":{"cited_paper":"/paper/2412.05939","citing_paper":"/paper/2506.11515"},"observation_digest":"sha256:c65670f4ab6fafaecb179d6588cd18ab6329a1e0ec183edc2b4a6c0f138dd5f3","observation_id":"a2673b7b-bbbd-415f-820a-73268831873c","resolution":{"observed_at":"2026-08-07T04:08:53.344399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.05939/citation-record","integrity":"/paper/2412.05939/integrity","json":"/paper/2412.05939/citation-record.json","paper":"/paper/2412.05939"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.998517Z","title":"For V3Det, we remove object labels with frequency less than 3","venue":null,"work_id":"b643bc88-d85e-45ae-86a0-d60937c18cad","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.626495Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:6cb349fa31c16cc7af750e509d48242a2c4261cdcc1ad393c5954b59455889dc","observation_id":"86f25a70-1968-4825-9dae-671de663f430","resolution":{"observed_at":"2026-08-11T20:14:58.002749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.983801Z","title":"For Open Images, we also remove the attribute and relationship annotations corresponding to these illegal objects","venue":null,"work_id":"f778c6d1-e2f9-446e-8575-1a20c1911e0c","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.632723Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:1558a3ee9776435992f96c3acd34a725cc4d37aaa6d5896b7957322c000e4a46","observation_id":"a5cad1f9-2016-4227-a1f4-9f34a0e70bbc","resolution":{"observed_at":"2026-08-11T20:14:57.988782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.964198Z","title":null,"venue":null,"work_id":"a2c18d50-92b2-4642-a79b-7a445c94a77b","year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.638144Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:da0156fa8103aad6fa6d72f4cee58a00110b7c3cd0c39bcbf456ad7f1ddc1939","observation_id":"f9b63835-85f7-4e18-920c-2878327796c7","resolution":{"observed_at":"2026-08-11T20:14:57.974477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.903259Z","title":null,"venue":null,"work_id":"388c8d50-65a7-4bc7-8cbe-2efccb373acb","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.655461Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:af43d1dc40e0a6d101b8c44944471756784b98d3df1398e96f91fe9fbd31f344","observation_id":"e0b271e5-88d5-4254-9a0a-9dc682c5aaca","resolution":{"observed_at":"2026-08-11T20:14:57.908428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02992","last_updated":"2024-04-26T01:24:57Z","snapshot_observed_at":"2026-08-15T10:40:55.504401Z","submitted_at":"2023-10-04T17:28:44Z","title":"Kosmos-G: Generating Images in Context with Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02992","snapshot_observed_at":"2026-08-11T20:14:56.594042Z","title":"Zhiliang Peng, Li Dong, Hangbo Bao, Qixiang Ye, and Furu Wei","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.594042Z"},"links":{"cited_paper":"/paper/2310.02992","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:407ef4f8e651b59ccb836f40d93dd184b14fdcc9d11044ea744e41da4688f89f","observation_id":"0155ab72-192d-4ae9-bf5c-69e738d3b83b","resolution":{"observed_at":"2026-08-11T20:14:56.594042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-12T21:25:32.312122Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-11T20:14:56.599821Z","title":"Lewei Yao, Jianhua Han, Youpeng Wen, Xiaodan Liang, Dan Xu, Wei Zhang, Zhenguo Li, Chunjing Xu, and Hang Xu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.599821Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:0469f2da0566afc83b4a8f4dd1a36a020061a2ecd92c1469a065c95865b2f80e","observation_id":"45c5c501-d04e-4eed-9241-6db4752e7282","resolution":{"observed_at":"2026-08-11T20:14:56.599821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09251","last_updated":"2023-12-14T18:59:43Z","snapshot_observed_at":"2026-08-14T17:39:36.185216Z","submitted_at":"2023-12-14T18:59:43Z","title":"VL-GPT: A Generative Pre-trained Transformer for Vision and Language Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09251","snapshot_observed_at":"2026-08-11T20:14:56.605430Z","title":"Jinguo Zhu, Xiaohan Ding, Yixiao Ge, Yuying Ge, Sijie Zhao, Hengshuang Zhao, Xiaohua Wang, and Ying Shan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.605430Z"},"links":{"cited_paper":"/paper/2312.09251","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:b31bc3e89171733dd889ea25ec383b2817faaddbf1ff82ea796dea20ca880338","observation_id":"a92aea54-cee4-49cf-a20e-bbf5f78850c7","resolution":{"observed_at":"2026-08-11T20:14:56.605430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:58.041789Z","title":"Instance Location, Instance Interaction, Visual Reasoning","venue":null,"work_id":"f5a8cb6a-fbcd-4529-8c7d-ae653c112e0d","year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.610955Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:3ba15b272f1dc8d7edd01edaf73ac1d2c17c4066ee67a932ef7dee0a6e78333e","observation_id":"4221501a-1918-4bea-8614-57970eebe879","resolution":{"observed_at":"2026-08-11T20:14:58.046685Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:58.011570Z","title":"batter” → “batter (ballplayer)","venue":null,"work_id":"9c6cc48d-83be-4cda-a8fe-38323f4084fb","year":2022},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.621196Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:e8d1e89c5655d8ef6a289a49f065633944056c9215054aa1ded0b84665ec24f3","observation_id":"ac2d4aa7-6bb6-479f-bea7-641b89a52f69","resolution":{"observed_at":"2026-08-11T20:14:58.016480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.948858Z","title":null,"venue":null,"work_id":"4da57dec-f1a1-4759-a3e3-98186847e4ac","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.642335Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:c6964fc3219226b39c2bed5a8200c7eb4ad122e05cab93c520c8b4f85fa574b5","observation_id":"c0873608-b736-45ac-9afd-fb45da685f55","resolution":{"observed_at":"2026-08-11T20:14:57.953908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.934451Z","title":"We also remove objects that have illegal coordinates or exceed the image range","venue":null,"work_id":"ce86eb6c-2748-4864-9d65-8c47e488379c","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.646214Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:ee272aab0e27906c658ed9d473dc2f9dc795e86aae67d970bd9f2bd1eb015a35","observation_id":"c5a1cfe8-9b7e-4f10-a233-42a0a8ddadce","resolution":{"observed_at":"2026-08-11T20:14:57.939375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.919268Z","title":"batter (baseball player)","venue":null,"work_id":"0feba96c-1744-489d-b1b5-587bd09ea1b2","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.650250Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:e3d49cbacb5c3b8ccb8694abd25aa67f6adbe909ed015cc0beaa5b3c2a1810b4","observation_id":"c7945383-35f1-401b-b4da-ad271d5fc579","resolution":{"observed_at":"2026-08-11T20:14:57.924134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.888199Z","title":"Secondly, we count the frequency of each label and remove the relationship/attribute whose frequency is less than 5 or is empty","venue":null,"work_id":"81be0e3f-3c90-4420-9627-bff06fdebace","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.660626Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:4b6e4837cbe6d2e3a06a791e758c945bfe276a46177f8bb7a910a820f58395df","observation_id":"8d579735-5c71-4d73-84fc-8c55deca54ee","resolution":{"observed_at":"2026-08-11T20:14:57.893528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.873584Z","title":"For unreasonable labels, we remove them and the corresponding object, attribute, relationship annotations","venue":null,"work_id":"c5401946-65bf-4d85-87ca-7bc137c18373","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.665028Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:90850aa77fe05b4f61001f2e81f2df5cc1224525b4daf1b6454b3419ecb3b1b4","observation_id":"f226edde-00bf-43a5-aff0-97bc67061d68","resolution":{"observed_at":"2026-08-11T20:14:57.878193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.859328Z","title":"For images in Visual Genome with a flickr id but no coco id, we match them with images from flickr30k and discard the matched images","venue":null,"work_id":"959c750d-e81b-4ec0-94f9-446865bcadcc","year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.669674Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:1057dc96e142b30f514392b77d3c2f08b5e3d4c61d533902978f4f73ebe26810","observation_id":"721bb45c-afd5-4a19-aff7-7a214836a14a","resolution":{"observed_at":"2026-08-11T20:14:57.863808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.845283Z","title":null,"venue":null,"work_id":"af26bf20-54f4-45f2-9323-b4385e660435","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.674257Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:e1c21b3dd5a86017dcb438821cf09a4a0746b01ac0744eb7a821fed91a2a23c5","observation_id":"7e644ff2-037f-45e2-aab5-90bd5ef6d20b","resolution":{"observed_at":"2026-08-11T20:14:57.850058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.830509Z","title":null,"venue":null,"work_id":"ed785c50-1cde-4279-9660-884b41462a65","year":2021},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.678937Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:b1cdd9410501f8d42f888db27ec3a2944a6fb660c77388f94e7222bd66b35f5d","observation_id":"b269db73-6e28-47a0-8c7f-f8e7e69c1a18","resolution":{"observed_at":"2026-08-11T20:14:57.835356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.817027Z","title":null,"venue":null,"work_id":"4595d4ba-a7e5-46f0-a71b-6a4206bcfb7f","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.683239Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:cd119d81c5c1b7c214261cb6bf788c4549c3a80401533d8ffb043db53d7b40fc","observation_id":"09ea4dcf-48be-4e8f-a650-148acc8c3fbc","resolution":{"observed_at":"2026-08-11T20:14:57.821104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.801965Z","title":"If no caption is selected, we select the caption with the highest similarity score","venue":null,"work_id":"07884757-d72c-4d29-a265-ff76384e30fd","year":2022},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.688145Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:64ea3f1102d7fb064ad7c1df1c7e09ac9d7ec0a9e01a4a7a539a29ba09ddd7ac","observation_id":"8a654fef-8175-49e6-8b7a-aec90030e681","resolution":{"observed_at":"2026-08-11T20:14:57.806754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.787650Z","title":null,"venue":null,"work_id":"2fbe4fd3-ae14-4988-8d9c-0846e7228b47","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.693243Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:bce848bdfa1bf586e86f65ea5e0d41bb959b57037a17afd211880939a6740fad","observation_id":"06726344-e681-4c39-93f0-09151dad2b41","resolution":{"observed_at":"2026-08-11T20:14:57.792486Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.773514Z","title":"Then we remove the descriptions with a probability of 0.5 to prevent model overfitting which might be caused by description repetitions","venue":null,"work_id":"7c5b72d1-6c89-4bd1-b4fb-d0b7b71bc00e","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.698176Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:8fec2607338d8fd427dbf24a4864fb91eedecf11031cc35aeb5795abcf3b9a3b","observation_id":"a0564405-1a01-46bb-853f-e2c80319cc88","resolution":{"observed_at":"2026-08-11T20:14:57.778372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.758586Z","title":"Secondly, we replace the positions corresponding to [IMG] using the corresponding visual token sequence with [IMG] and [/IMG] inserted before and after it","venue":null,"work_id":"2a0bc1d1-d910-4164-811a-4dbc649b11b0","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.702653Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:7105357c7d7f055d37c64d076c5e1c88e829a07684bee07ecf5f5deacfc7040b","observation_id":"43fd7009-d5be-4af5-97a4-1059c595e0fe","resolution":{"observed_at":"2026-08-11T20:14:57.763406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.745000Z","title":"Detail caption instruction","venue":null,"work_id":"edef17df-0b70-4b45-ad53-2eb1fc18670e","year":2011},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.707352Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:36fc8f99dc3310624987e19f602d73fbe44f1b6d6e5d1465efdb8a389b89ade2","observation_id":"3de25e1a-7e59-4147-9c2f-b1c700c67a68","resolution":{"observed_at":"2026-08-11T20:14:57.749184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.616054Z","title":"It resembles a large pig in shape, with a short, prehensile trunk, small eyes, and pointed ears","venue":null,"work_id":"cf2beee6-11f1-482f-ba07-4eb5e24ec5a5","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.749625Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:287d26d434c0e55e10f8ff86161abf48780ae273dfa9fdaf86e2addbbe6658c9","observation_id":"b691cb9d-7568-48f6-b98e-4aa16fd688c0","resolution":{"observed_at":"2026-08-11T20:14:57.620847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.480789Z","title":null,"venue":null,"work_id":"76951b49-75b4-4df2-a2df-a98a1b11582f","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.786990Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:8a311f1f89aada1bed51e078cb2d4701cadad72b43674840376c4a0cfdcd94f2","observation_id":"0519d2f5-0252-4ab0-a65f-d3e0211374c9","resolution":{"observed_at":"2026-08-11T20:14:57.486201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.464907Z","title":null,"venue":null,"work_id":"2760666d-1c2a-4124-9c31-4e2f8cb9607a","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.791904Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:727a3c0875c36f7c2358beacbc8b1e0e832cc71f8d880534cf9bd6ec606e7eb3","observation_id":"2d961eb4-017f-44ab-a950-fcad9217b560","resolution":{"observed_at":"2026-08-11T20:14:57.469457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.354401Z","title":"Invalid","venue":null,"work_id":"38707dab-7402-4ad2-a515-4668e0d171ec","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.827982Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:a142a086db6422be51dfc9c9b69a64330da59b95bc934a363f1cb15ff3ab8162","observation_id":"a51a9a2f-4dcd-4008-8ed2-79b2804f6a91","resolution":{"observed_at":"2026-08-11T20:14:57.358898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.731727Z","title":null,"venue":null,"work_id":"0dc1c48b-f807-4edd-95cc-c3fe27c1462e","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.832495Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:57e120e4204d1d614faf99a34eaba40f07f84f6ae7c60acc8139ce1c979a6b41","observation_id":"affb92a0-1eff-4e38-8e0f-e2cc83875be5","resolution":{"observed_at":"2026-08-11T20:14:57.736201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.718632Z","title":"bank\" can be","venue":null,"work_id":"53d8c52c-30b8-4329-8a7f-983b7324e67e","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.837073Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:f8c3922b07e0c7719bb66f2820c5d021aa3cfe95df45562b92baf9b9ed391c9f","observation_id":"75b02bc5-aa7e-47dc-b5d7-cad946c8eb48","resolution":{"observed_at":"2026-08-11T20:14:57.722923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.704628Z","title":null,"venue":null,"work_id":"a4c82212-b447-44d6-9c26-29c94d2594a1","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.841342Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:338c3a93276a564b2507ca27a85c1a8c1690aacf638665cf5a293e62011d08a0","observation_id":"a0339240-6c81-40bc-87cd-de5c3b242f34","resolution":{"observed_at":"2026-08-11T20:14:57.709287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.690113Z","title":null,"venue":null,"work_id":"dd52899e-0c97-43ba-b2e7-3e90837b0d09","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.845632Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:1ff6f20a7c8fbff4c36a63d635f3e750f53ea66be3088352f4da20057008e217","observation_id":"281220d6-3bd4-4e0d-a4bb-9feb09e8a820","resolution":{"observed_at":"2026-08-11T20:14:57.694632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.674302Z","title":null,"venue":null,"work_id":"25c8fb09-97f1-4ad6-8056-df1b3e53f6bd","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.850173Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:112358477ba51197fc566e63c754163491239e43fd96d9557978725d734e5b32","observation_id":"68c69e42-74df-48b6-9991-fb999ac6bdfc","resolution":{"observed_at":"2026-08-11T20:14:57.679370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.659693Z","title":null,"venue":null,"work_id":"d69e7e7f-7d21-4085-aa7e-98f887b89837","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.854197Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:ff3502b31d074405da3f19017034dc1cfc84a840a0261c20dbfbb06922852cf4","observation_id":"d650eeb7-eff4-49bc-a673-aa397f412c06","resolution":{"observed_at":"2026-08-11T20:14:57.664201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.645270Z","title":null,"venue":null,"work_id":"576be1b2-4563-4134-9757-b84515674d34","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.858331Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:67cd5ea3cf45c8c7f7450f876b0f5e6cdac2a9fc05451c8c67900ff487d9e8cf","observation_id":"ce8b98ca-f938-4d59-94da-9b3563f19a93","resolution":{"observed_at":"2026-08-11T20:14:57.649787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.630087Z","title":null,"venue":null,"work_id":"b8d00e02-6c4b-4005-9223-f9686c193d01","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.863353Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:38250ddf229e44b875e19dc40729146434ca59dc064ef53668a503e4c8c305c8","observation_id":"e3faae6e-4259-4b79-8b79-bd6341123dac","resolution":{"observed_at":"2026-08-11T20:14:57.634479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.340156Z","title":"It resembles a large pig in shape, with a short, prehensile trunk, small eyes, and pointed ears","venue":null,"work_id":"93fbff44-a165-4529-bbb1-3ef46850015d","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.867494Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:97955b5857595d0742f02748afde82f38f3e74b3feb8e2e89cbc57333a9dfb92","observation_id":"57503e9a-58a7-45fe-9b9d-1c111516f92e","resolution":{"observed_at":"2026-08-11T20:14:57.344589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.325469Z","title":"You should disregard such noisy related object category labels","venue":null,"work_id":"143818cc-7205-4f0e-95ce-2cb97526d9e0","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.872755Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:0fa9f776847a35059880491caf43c6a374d3a71031c75722fa6b038ca1a3f058","observation_id":"a50e25e3-dbd5-4daf-8b7b-7d60b8ac0865","resolution":{"observed_at":"2026-08-11T20:14:57.330356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.309708Z","title":"Invalid","venue":null,"work_id":"6802aaf9-5909-40dd-86cc-ae42a3b44ab7","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.877645Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:ede90135f0c531b1f83a1bb7255e55cdbc340cb6a3403c97e44d4e2c3c47813b","observation_id":"4e59bed0-60a3-47be-8066-2563ae115bbe","resolution":{"observed_at":"2026-08-11T20:14:57.315244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.601002Z","title":null,"venue":null,"work_id":"cc9bc94d-97d2-4c6a-8577-4ad4858fb295","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.881599Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:73e4895a6664dcb624b30329083e1431bb55cc04fa1048ffdd2286ab253249b9","observation_id":"1bcbf797-8b54-41ad-aa3c-f275ccc6c8c5","resolution":{"observed_at":"2026-08-11T20:14:57.605866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.584866Z","title":"awake\" is an adjective meaning","venue":null,"work_id":"1fad0272-e295-435c-a270-18b6078d7a80","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.885537Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:9a30dc40909f062af93b52f5c035ec93d22b052011d4741281190cf3e2d04563","observation_id":"944e42b5-1637-4941-ad15-4f07377809b9","resolution":{"observed_at":"2026-08-11T20:14:57.589464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.571372Z","title":null,"venue":null,"work_id":"d5693d49-45cf-4b49-a336-83d2285531b9","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.889297Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:7b49107944ce674784c81385a8bfc3d603571a1429ef522ef913328c4e75a6b1","observation_id":"81bbfac1-3456-4fec-a690-53007260ab16","resolution":{"observed_at":"2026-08-11T20:14:57.575617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.556227Z","title":"This could include color, texture, size, sense, function, or any other aspect that is significant for the attribute","venue":null,"work_id":"505d26d5-73e3-4bec-9995-4b87b375c048","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.893166Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:5afa5464984f7f87877bc711e679aae57fe42035356c07674d4800bfb3f5d154","observation_id":"5e620f1d-68cb-497d-8c49-8a682df32f14","resolution":{"observed_at":"2026-08-11T20:14:57.561034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.527202Z","title":null,"venue":null,"work_id":"093b354b-d381-4ca7-a583-f1a803c09313","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.900725Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:69bed8d567ca7255941f3a9240c1f04b10eb05fe644b1a6783b8266a62d42973","observation_id":"0e570504-a0c5-42d7-a12e-e03e1e8f00d4","resolution":{"observed_at":"2026-08-11T20:14:57.532071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.510785Z","title":null,"venue":null,"work_id":"5cb7f16a-0159-41a2-bbf5-1737946d890c","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.904521Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:fd55eff9b6e6efefc59dce23aeddea1e3579817f5ddcb71882a9457d020611d7","observation_id":"655bf87d-0e9c-4998-b3ef-2405c4ffd2bf","resolution":{"observed_at":"2026-08-11T20:14:57.516606Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.495950Z","title":null,"venue":null,"work_id":"4f100f67-622f-4731-bdb0-de2612255d21","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.908169Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:e9e635f5b1cc47b76a7bb6453394288f3a09c408aa999e70303c3ea029ca88bd","observation_id":"ac8ec7ac-92ae-474e-a315-d06c74cd9b71","resolution":{"observed_at":"2026-08-11T20:14:57.501350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.292904Z","title":null,"venue":null,"work_id":"ec017d6a-0921-46de-8b9c-176db11e56e4","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.912235Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:441ac006fd140beff722e0039b2514e6b7f9873986705e270bd451c56636582d","observation_id":"5d88c803-46d2-4798-a5d0-5573a947c182","resolution":{"observed_at":"2026-08-11T20:14:57.298316Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.276092Z","title":"You should disregard such noisy related subject-object pairs","venue":null,"work_id":"6ba40736-9741-450f-a2a4-7cb4166e362f","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.916513Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:74982e41cd561971fb478c57ff4df126d0b104d7e82b1cedf043be45b8eb6c27","observation_id":"a355aaf7-9168-4951-a55a-2eed8ba73a3d","resolution":{"observed_at":"2026-08-11T20:14:57.282372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.260961Z","title":"Invalid","venue":null,"work_id":"7bf26c8e-ca9f-4fe9-9bb8-d748954fa408","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.920376Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:420e600516977b67e6ff56b44cdf98669f9ce27521f8a479cd7883d3444418d7","observation_id":"81f6b493-0395-430a-ac4a-19a4eb9ab7bd","resolution":{"observed_at":"2026-08-11T20:14:57.265631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.245138Z","title":null,"venue":null,"work_id":"b7a148a3-1177-4317-b1c7-ad2cbeb1416c","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.924681Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:46b3ba9fa87840e5a6b0d4e60048cd4ed177af5ec3a76f20a0b54adaddfb9a3c","observation_id":"cd1b12ae-76e7-44cf-94d1-bac08b549f42","resolution":{"observed_at":"2026-08-11T20:14:57.250378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.449501Z","title":"truck\" is a verb meaning","venue":null,"work_id":"71a7f080-1e62-421b-b124-84f5153b23f0","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.928934Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:77fd5f36a814af11e158aa58a14c0f16ed563b5fb3648ae5b7b56f79267a22c9","observation_id":"b05feb79-3c19-48c9-8e92-48675d611573","resolution":{"observed_at":"2026-08-11T20:14:57.454668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.433857Z","title":null,"venue":null,"work_id":"6ce23561-6ce9-4f0b-8cb9-8cfec234d135","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.932845Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:5625da7218766afee14d9e3b48b5e512e051f6dd1fb55c3eb513f0a1b21ab136","observation_id":"92c49432-a71a-4b07-86f6-45f57dfa5bca","resolution":{"observed_at":"2026-08-11T20:14:57.439859Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.418205Z","title":null,"venue":null,"work_id":"a7bd567c-33ea-421d-98e7-b2efe45077e3","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.936754Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:2568105117d13306834c36736eecf6abffea6f6cb8dcd63b401c61649f34f1e6","observation_id":"4e06afea-dec1-444e-968a-31315f7b6077","resolution":{"observed_at":"2026-08-11T20:14:57.423276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.541770Z","title":null,"venue":null,"work_id":"c00077cf-ac6f-4e97-888f-4e94113f1b32","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.940735Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:96585f22ceca3edb8fa50913237e93c7c945b63b2fb9d9e01a8ed774448e4dde","observation_id":"05b88217-8654-4797-8dac-4d9ecc3f690a","resolution":{"observed_at":"2026-08-11T20:14:57.546531Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.402769Z","title":null,"venue":null,"work_id":"bdcb5c07-aa00-4b79-a2f7-468bd68b13c3","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.944496Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:819c7d84fffc2eafb52f8efe58fb98dd24d67c42044a0ba7a26eb35f7b6b4e03","observation_id":"787e0036-dc03-4bd0-a464-17a8b200dc51","resolution":{"observed_at":"2026-08-11T20:14:57.407577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.386891Z","title":null,"venue":null,"work_id":"86963d62-0b64-423d-b026-f2a13869cbbf","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.948642Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:cf3bee225c5677fdb5599ac69860d77f9b913679ed6e9a6bed8b463a0f196d1f","observation_id":"65c93dfd-705a-4ada-8311-0dd09b613d2c","resolution":{"observed_at":"2026-08-11T20:14:57.392523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.370535Z","title":null,"venue":null,"work_id":"1a338057-d82a-4b2a-a3cb-8b5fbe64f6b9","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.953924Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:723315d69720a2558155d5944e7aeeb2d5bc9994c83a652c5549c326489aafd7","observation_id":"581a4a09-43f8-4b62-be63-e3023a6cdd1f","resolution":{"observed_at":"2026-08-11T20:14:57.376384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:57.229154Z","title":null,"venue":null,"work_id":"61ab2d4e-fd92-4d3b-949b-bfe29e247fe4","year":null},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.957808Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:2a66e4825b83ff103ecbdf1e3fec1451349805e5bb7d7d522ed0fe20058d8bb2","observation_id":"46f9acb5-0418-4f93-b16d-991c0803011f","resolution":{"observed_at":"2026-08-11T20:14:57.234613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:58.026151Z","title":"batter” → “batter (ballplayer)","venue":null,"work_id":"54ad6621-23ff-4973-9223-611fc266f539","year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.616212Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:9fdbc37b053f4a984d46ab29afe8315e32f6a91eb238e0d2d734fcf003be9eed","observation_id":"2f2a07b9-944d-48f7-a44b-67673b7d04d3","resolution":{"observed_at":"2026-08-11T20:14:58.031740Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-08-12T13:10:06.472493Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-11T20:14:56.578719Z","title":"Jonathan Ho, Ajay Jain, and Pieter Abbeel","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.578719Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:664876d272ceef798b0a71d8b74bd612463086231b3539381ba0afeea175f19f","observation_id":"bfcab0fe-e17e-4378-bde6-f566bc15f339","resolution":{"observed_at":"2026-08-11T20:14:56.578719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09611","last_updated":"2024-04-18T18:51:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-14T17:51:32Z","title":"MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09611","snapshot_observed_at":"2026-08-11T20:14:56.588481Z","title":"URL https://openreview.net/pdf?id=E01k9048soZ","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.588481Z"},"links":{"cited_paper":"/paper/2403.09611","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:1a8a5cccf1f543c36a6a0b3bfbca0107fe0f2e0c4525fe089a315c0847ae49eb","observation_id":"0818035c-79c4-4ac0-9e41-2f9af1ac53ef","resolution":{"observed_at":"2026-08-11T20:14:56.588481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-11T20:14:56.572962Z","title":"doi: 10.18653/v1/2024.acl-long.446","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.572962Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:d8ed05f9ee713719b5961ce7f06c4bf20210d2885d62ebf85142d12ae0a9f887","observation_id":"0f3705c9-8c74-4031-8864-94d81dbc2805","resolution":{"observed_at":"2026-08-11T20:14:56.572962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:14:56.583099Z","title":"doi: 10.1109/CVPR.2019.00686","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models","version":1},"reference_index":6709,"source":"pdf_text","source_observed_at":"2026-08-11T20:14:56.583099Z"},"links":{"citing_paper":"/paper/2412.05939"},"observation_digest":"sha256:ee0dcf6fd192b168879655a288a4cab36553df035615a8b3d6f219fc483f0f02","observation_id":"c98f3d26-ca9a-4f3d-bff0-47e10caeb27a","resolution":{"observed_at":"2026-08-11T20:14:56.583099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.05939","last_updated":"2024-12-08T13:45:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T10:41:55.944075Z","submitted_at":"2024-12-08T13:45:44Z","title":"Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2412.05939."}