{"as_of":"2026-08-17T18:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b532da723ec78ce62683a32e683e76a963520ba87538bb0f4e8f475e907f00dd","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:39:57.143411Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T18:38:50.054309Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1912.08226","last_updated":"2020-03-20T19:29:14Z","snapshot_observed_at":"2026-08-11T21:16:15.750838Z","submitted_at":"2019-12-17T19:03:23Z","title":"Meshed-Memory Transformer for Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.08226","snapshot_observed_at":"2026-08-11T22:59:57.278741Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02971","last_updated":"2024-12-04T02:32:53Z","snapshot_observed_at":"2026-08-15T00:33:19.907096Z","submitted_at":"2024-12-04T02:32:53Z","title":"MedAutoCorrect: Image-Conditioned Autocorrection in Medical Reporting","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:59:57.278741Z"},"links":{"cited_paper":"/paper/1912.08226","citing_paper":"/paper/2412.02971"},"observation_digest":"sha256:f544446b3773e7e1de970f3dd4155d0557412e316355c489b1b4d1b524338cf7","observation_id":"cd6f0173-9d6d-4866-b912-a10740a3f50e","resolution":{"observed_at":"2026-08-11T22:59:57.278741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.08226","last_updated":"2020-03-20T19:29:14Z","snapshot_observed_at":"2026-08-11T21:16:15.750838Z","submitted_at":"2019-12-17T19:03:23Z","title":"Meshed-Memory Transformer for Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.08226","snapshot_observed_at":"2026-08-08T18:10:38.290999Z","title":"Available: http://arxiv.org/abs/1912.08226","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2502.05738","last_updated":"2025-02-09T01:47:59Z","snapshot_observed_at":"2026-08-17T12:54:01.375805Z","submitted_at":"2025-02-09T01:47:59Z","title":"Performance Analysis of Traditional VQA Models Under Limited Computational Resources","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-08T18:10:38.290999Z"},"links":{"cited_paper":"/paper/1912.08226","citing_paper":"/paper/2502.05738"},"observation_digest":"sha256:7e8f04a1b3682de07c8ac0527d74fcda3675f6681f12646b66a060061788a0a0","observation_id":"2385e11e-2888-4327-9185-b82d5e498178","resolution":{"observed_at":"2026-08-08T18:10:38.290999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.08226","last_updated":"2020-03-20T19:29:14Z","snapshot_observed_at":"2026-08-11T21:16:15.750838Z","submitted_at":"2019-12-17T19:03:23Z","title":"Meshed-Memory Transformer for Image Captioning","version":2},"cited_work":{"arxiv_id":"1912.08226","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1912.08226","snapshot_observed_at":"2026-07-03T18:38:50.054309Z","title":"Meshed-Memory Transformer for Image Captioning","venue":null,"work_id":"882f1dd5-23c0-45bc-9f42-b23dd925000c","year":1912},"citing_paper":{"arxiv_id":"2503.18297","last_updated":"2025-08-15T14:30:05Z","snapshot_observed_at":"2026-08-03T03:51:16.266270Z","submitted_at":"2025-03-24T03:02:11Z","title":"Image-to-Text for Medical Reports Using Adaptive Co-Attention and Triple-LSTM Module","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T23:32:49.136132Z"},"links":{"cited_paper":"/paper/1912.08226","citing_paper":"/paper/2503.18297"},"observation_digest":"sha256:b666e2384ba760685b6c7d43337e88ae13cb15a94a1e10cdbdc30e3d1b50fa75","observation_id":"9c9cc006-6a07-4ad5-b4c0-87cadabcc360","resolution":{"observed_at":"2026-05-22T23:35:13.541194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.08226","last_updated":"2020-03-20T19:29:14Z","snapshot_observed_at":"2026-08-11T21:16:15.750838Z","submitted_at":"2019-12-17T19:03:23Z","title":"Meshed-Memory Transformer for Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.08226","snapshot_observed_at":"2026-08-16T12:39:57.143411Z","title":"and Cucchiara, R","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.12256","last_updated":"2025-04-16T17:07:16Z","snapshot_observed_at":"2026-08-17T00:24:36.591851Z","submitted_at":"2025-04-16T17:07:16Z","title":"FLIP Reasoning Challenge","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T12:39:57.143411Z"},"links":{"cited_paper":"/paper/1912.08226","citing_paper":"/paper/2504.12256"},"observation_digest":"sha256:a57a95872aea6b8f518331361ec3cfa671b4f639a991b60b962773b030c4f00c","observation_id":"8175d20d-354c-493d-8d8f-14a52e859b35","resolution":{"observed_at":"2026-08-16T12:39:57.143411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.08226","last_updated":"2020-03-20T19:29:14Z","snapshot_observed_at":"2026-08-11T21:16:15.750838Z","submitted_at":"2019-12-17T19:03:23Z","title":"Meshed-Memory Transformer for Image Captioning","version":2},"cited_work":{"arxiv_id":"1912.08226","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1912.08226","snapshot_observed_at":"2026-07-03T18:38:50.054309Z","title":"Meshed-Memory Transformer for Image Captioning","venue":null,"work_id":"882f1dd5-23c0-45bc-9f42-b23dd925000c","year":1912},"citing_paper":{"arxiv_id":"2606.17430","last_updated":"2026-06-16T02:24:08Z","snapshot_observed_at":"2026-08-04T03:12:28.342139Z","submitted_at":"2026-06-16T02:24:08Z","title":"CIAN: Multi-Stage Framework for Event-Enriched Image Captioning via Retrieval-Augmented Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T02:25:43.829365Z"},"links":{"cited_paper":"/paper/1912.08226","citing_paper":"/paper/2606.17430"},"observation_digest":"sha256:8fb74bed34fbc10f3cb61aa8bb6819025175a31443b699612d1798a6c5609d98","observation_id":"328ba9c6-5883-4738-9e38-9bb439a293b0","resolution":{"observed_at":"2026-07-03T18:38:50.056158Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1912.08226/citation-record","integrity":"/paper/1912.08226/integrity","json":"/paper/1912.08226/citation-record.json","paper":"/paper/1912.08226"},"outbound":[],"paper":{"arxiv_id":"1912.08226","last_updated":"2020-03-20T19:29:14Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T21:16:15.750838Z","submitted_at":"2019-12-17T19:03:23Z","title":"Meshed-Memory Transformer for Image Captioning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:1912.08226."}