{"as_of":"2026-08-14T18:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:57394dcba012767a444cafe7aa4760dded6b1acfc13191641199221c175913b5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:05:41.379301Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:48:56.078143Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08737","last_updated":"2024-12-11T19:12:13Z","snapshot_observed_at":"2026-08-12T13:29:44.116221Z","submitted_at":"2024-12-11T19:12:13Z","title":"Euclid: Supercharging Multimodal LLMs with Synthetic High-Fidelity Visual Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08737","snapshot_observed_at":"2026-08-07T14:05:41.379301Z","title":"Zhang, O","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20021","last_updated":"2025-05-26T14:09:24Z","snapshot_observed_at":"2026-08-12T17:30:28.025690Z","submitted_at":"2025-05-26T14:09:24Z","title":"Decomposing Complex Visual Comprehension into Atomic Visual Skills for Vision Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:05:41.379301Z"},"links":{"cited_paper":"/paper/2412.08737","citing_paper":"/paper/2505.20021"},"observation_digest":"sha256:b57b5794b30e37c9ad847e32d3735a96d1e960615da6a491900e36e54fd3ba1b","observation_id":"6a39e83f-74bd-4625-9c10-0e87e15c6203","resolution":{"observed_at":"2026-08-07T14:05:41.379301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08737","last_updated":"2024-12-11T19:12:13Z","snapshot_observed_at":"2026-08-12T13:29:44.116221Z","submitted_at":"2024-12-11T19:12:13Z","title":"Euclid: Supercharging Multimodal LLMs with Synthetic High-Fidelity Visual Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08737","snapshot_observed_at":"2026-08-06T19:41:46.969807Z","title":"Zhang, O","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04878","last_updated":"2025-07-07T11:04:17Z","snapshot_observed_at":"2026-08-13T01:21:04.100561Z","submitted_at":"2025-07-07T11:04:17Z","title":"Transcribing Spanish Texts from the Past: Experiments with Transkribus, Tesseract and Granite","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:46.969807Z"},"links":{"cited_paper":"/paper/2412.08737","citing_paper":"/paper/2507.04878"},"observation_digest":"sha256:696b7cfb945df95b6abc818f217604b6cf9705250196efc4ad5df6117ed0aa48","observation_id":"7f4ecd6d-ea18-4b65-adbf-23d71fffcce8","resolution":{"observed_at":"2026-08-06T19:41:46.969807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08737","last_updated":"2024-12-11T19:12:13Z","snapshot_observed_at":"2026-08-12T13:29:44.116221Z","submitted_at":"2024-12-11T19:12:13Z","title":"Euclid: Supercharging Multimodal LLMs with Synthetic High-Fidelity Visual Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08737","snapshot_observed_at":"2026-08-03T06:26:54.751965Z","title":"URL https: //doi.org/10.48550/arXiv.2412.08737","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.23220","last_updated":"2026-06-01T03:26:20Z","snapshot_observed_at":"2026-08-12T13:30:00.104607Z","submitted_at":"2026-01-30T17:45:10Z","title":"Med-Scout: Curing MLLMs' Geometric Blindness in Medical Perception via Geometry-Aware RL Post-Training","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T06:26:54.751965Z"},"links":{"cited_paper":"/paper/2412.08737","citing_paper":"/paper/2601.23220"},"observation_digest":"sha256:0553b309bcb8600787e333ed7ae30d873d8a27e5d22f92468ebc14bf6fccaf04","observation_id":"07c3d75a-35f7-4da3-b78b-bb77a5e70ba1","resolution":{"observed_at":"2026-08-03T06:26:54.751965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08737","last_updated":"2024-12-11T19:12:13Z","snapshot_observed_at":"2026-08-12T13:29:44.116221Z","submitted_at":"2024-12-11T19:12:13Z","title":"Euclid: Supercharging Multimodal LLMs with Synthetic High-Fidelity Visual Descriptions","version":1},"cited_work":{"arxiv_id":"2412.08737","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08737","snapshot_observed_at":"2026-07-03T20:48:56.078143Z","title":"Euclid: Superchargingmul- timodal LLMs with synthetic high-fidelity visual descriptions.arXiv preprint arXiv:2412.08737, 2024","venue":null,"work_id":"eb4f197b-4c69-4be7-a455-ce79158a5952","year":2024},"citing_paper":{"arxiv_id":"2606.18216","last_updated":"2026-06-16T17:46:02Z","snapshot_observed_at":"2026-08-10T09:12:54.601851Z","submitted_at":"2026-06-16T17:46:02Z","title":"Zone of Proximal Policy Optimization: Teacher in Prompts, Not Gradients","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-06-27T01:08:52.981296Z"},"links":{"cited_paper":"/paper/2412.08737","citing_paper":"/paper/2606.18216"},"observation_digest":"sha256:2bf90f9d8a9951fab42441be03a5c774d7c096a16049b4af35dd9c0fb2746b22","observation_id":"5dd018aa-7e93-4299-9064-ad1de3fff079","resolution":{"observed_at":"2026-07-03T20:48:56.079807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08737","last_updated":"2024-12-11T19:12:13Z","snapshot_observed_at":"2026-08-12T13:29:44.116221Z","submitted_at":"2024-12-11T19:12:13Z","title":"Euclid: Supercharging Multimodal LLMs with Synthetic High-Fidelity Visual Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08737","snapshot_observed_at":"2026-08-02T01:57:57.325537Z","title":"Euclid: Supercharging mul- timodal llms with synthetic high-fidelity visual descriptions.arXiv preprint arXiv:2412.08737, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14499","last_updated":"2026-07-16T02:25:03Z","snapshot_observed_at":"2026-08-14T10:19:53.685113Z","submitted_at":"2026-07-16T02:25:03Z","title":"Contextualized Evaluation of Vision Language Models through Dynamic, Multi-turn Interactions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T01:57:57.325537Z"},"links":{"cited_paper":"/paper/2412.08737","citing_paper":"/paper/2607.14499"},"observation_digest":"sha256:2c9df6119e8373b20efde379c7c2cd613658304a293636cddd50abf0fdc4c285","observation_id":"ef353168-5262-43f0-8b33-9898de791eb0","resolution":{"observed_at":"2026-08-02T01:57:57.325537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08737","last_updated":"2024-12-11T19:12:13Z","snapshot_observed_at":"2026-08-12T13:29:44.116221Z","submitted_at":"2024-12-11T19:12:13Z","title":"Euclid: Supercharging Multimodal LLMs with Synthetic High-Fidelity Visual Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08737","snapshot_observed_at":"2026-08-01T21:12:08.912480Z","title":"Euclid: Supercharging multimodal llms with synthetic high-fidelity visual descriptions.arXiv preprint arXiv:2412.08737, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16165","last_updated":"2026-07-17T17:46:23Z","snapshot_observed_at":"2026-08-10T11:09:11.819021Z","submitted_at":"2026-07-17T17:46:23Z","title":"An Exam for Active Observers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T21:12:08.912480Z"},"links":{"cited_paper":"/paper/2412.08737","citing_paper":"/paper/2607.16165"},"observation_digest":"sha256:0f471caf6bf362be6b27f004b479e4c5bb00e320ab9f7ad2d966957f9a633299","observation_id":"c75c4a90-04ba-414c-8136-7e22dee7a066","resolution":{"observed_at":"2026-08-01T21:12:08.912480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.08737/citation-record","integrity":"/paper/2412.08737/integrity","json":"/paper/2412.08737/citation-record.json","paper":"/paper/2412.08737"},"outbound":[],"paper":{"arxiv_id":"2412.08737","last_updated":"2024-12-11T19:12:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T13:29:44.116221Z","submitted_at":"2024-12-11T19:12:13Z","title":"Euclid: Supercharging Multimodal LLMs with Synthetic High-Fidelity Visual Descriptions"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2412.08737."}