{"as_of":"2026-08-20T11:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c029e626e1d2784a06fd9dfc3e58e45faf425baa4bb5fb76f6c3529e83f9dd16","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T05:04:48.591958Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:58:29.159335Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T15:31:33.327638Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.02050","snapshot_observed_at":"2026-08-11T16:58:29.159335Z","title":"Tiger: Text-to-image grounding for image caption evaluation","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.09582","last_updated":"2025-01-18T00:52:42Z","snapshot_observed_at":"2026-08-17T06:39:08.796450Z","submitted_at":"2024-12-12T18:54:48Z","title":"Neptune: The Long Orbit to Benchmarking Long Video Understanding","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T16:58:29.159335Z"},"links":{"cited_paper":"/paper/1909.02050","citing_paper":"/paper/2412.09582"},"observation_digest":"sha256:e32cdf839c47ee11100144a370debec043b0cf867f3512435f43582ae2126a23","observation_id":"695ecbd0-6eda-4838-af89-c8a8905cfe20","resolution":{"observed_at":"2026-08-11T16:58:29.159335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.02050","snapshot_observed_at":"2026-08-07T12:48:05.100035Z","title":"Tiger: Text-to-image grounding for image caption evaluation","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.23484","last_updated":"2025-05-29T14:34:25Z","snapshot_observed_at":"2026-08-19T02:04:57.644552Z","submitted_at":"2025-05-29T14:34:25Z","title":"VCapsBench: A Large-scale Fine-grained Benchmark for Video Caption Quality Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:48:05.100035Z"},"links":{"cited_paper":"/paper/1909.02050","citing_paper":"/paper/2505.23484"},"observation_digest":"sha256:2d3592ca509dfa10ec4c4abc4911d747aaa314a3431c963f6eac910e376fabaa","observation_id":"51a60773-3653-4a53-b54e-5e1419e2f3bc","resolution":{"observed_at":"2026-08-07T12:48:05.100035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.02050","snapshot_observed_at":"2026-08-07T10:17:46.673913Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10019","last_updated":"2025-06-06T11:09:46Z","snapshot_observed_at":"2026-08-17T19:45:22.860227Z","submitted_at":"2025-06-06T11:09:46Z","title":"A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations","version":1},"reference_index":131,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:46.673913Z"},"links":{"cited_paper":"/paper/1909.02050","citing_paper":"/paper/2506.10019"},"observation_digest":"sha256:f5a43796295101ae958d7a6b8d6f4beb73df4d49743863032f7451d751634649","observation_id":"bc6e627b-a754-489a-ba7f-0f2f0436bfdf","resolution":{"observed_at":"2026-08-07T10:17:46.673913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.02050","snapshot_observed_at":"2026-08-06T18:50:41.661086Z","title":"Tiger: Text-to-image grounding for image caption evaluation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.08039","last_updated":"2025-07-09T18:40:17Z","snapshot_observed_at":"2026-08-18T18:27:55.983826Z","submitted_at":"2025-07-09T18:40:17Z","title":"Towards Evaluating Robustness of Prompt Adherence in Text to Image Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:41.661086Z"},"links":{"cited_paper":"/paper/1909.02050","citing_paper":"/paper/2507.08039"},"observation_digest":"sha256:a38fa9bb80dacf1fbc7e056291950d99f9f064d16bd4c786f3f5d120e26d595d","observation_id":"7fb06671-0a1b-477d-bda8-0ac32e8ce279","resolution":{"observed_at":"2026-08-06T18:50:41.661086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"cited_work":{"arxiv_id":"1909.02050","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.02050","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evalu- ation, Sept","venue":null,"work_id":"6d00f7f1-490b-43e9-9479-beace7c034e4","year":2019},"citing_paper":{"arxiv_id":"2509.16538","last_updated":"2026-04-19T03:58:34Z","snapshot_observed_at":"2026-08-13T00:07:57.935058Z","submitted_at":"2025-09-20T05:04:41Z","title":"VC-Inspector: Advancing Reference-free Evaluation of Video Captions with Factual Analysis","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T15:30:29.933558Z"},"links":{"cited_paper":"/paper/1909.02050","citing_paper":"/paper/2509.16538"},"observation_digest":"sha256:0c1b011e3d440f75464160a6845aa812a3d3fb6fc4bea8d99a68669a37b9447f","observation_id":"fe566bff-fc3f-4000-823f-8d3583aaa55f","resolution":{"observed_at":"2026-05-18T15:31:33.330914Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1909.02050/citation-record","integrity":"/paper/1909.02050/integrity","json":"/paper/1909.02050/citation-record.json","paper":"/paper/1909.02050"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.440919Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.440919Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:d8fff3d2de859a68a6b7a2373d1aeb19f6ed34dd285489cfa3ad7f7789f14508","observation_id":"029ffc90-0399-4de2-a219-eb21851bc2ba","resolution":{"observed_at":"2026-08-14T05:04:48.440919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.446002Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.446002Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:167cde44202ab360545242860983fc312e1cef60d00fa606fbc0ae3053d93319","observation_id":"7dbf09a8-d652-4b73-a516-714c84fa310c","resolution":{"observed_at":"2026-08-14T05:04:48.446002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.03292","last_updated":"2015-11-10T21:14:51Z","snapshot_observed_at":"2026-08-15T08:14:16.255380Z","submitted_at":"2015-11-10T21:14:51Z","title":"From Images to Sentences through Scene Description Graphs using Commonsense Reasoning and Knowledge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.03292","snapshot_observed_at":"2026-08-14T05:04:48.455440Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.455440Z"},"links":{"cited_paper":"/paper/1511.03292","citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:5973f9ebcd2bf36f628bff6f1ea8deef84fd432ea93b90937e9be957f4768996","observation_id":"dbfcbe4f-ba05-4e82-a195-26a1ab98c6ba","resolution":{"observed_at":"2026-08-14T05:04:48.455440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:49.038265Z","title":null,"venue":null,"work_id":"07e28b9f-7169-4831-b8a0-902418075854","year":2016},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.459467Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:d00053823a6b259eb246d8914e5e108e0f97a69927a55a8fc5e10e18075c1ee8","observation_id":"0f67e8e3-8456-4875-a343-1533abced676","resolution":{"observed_at":"2026-08-14T05:04:49.042563Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:49.024115Z","title":null,"venue":null,"work_id":"cb99fb67-da4c-4208-9137-367b1e800c57","year":2018},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.463303Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:185d6b3edbf5b4d96efcb3a7b01c395b858fa1fa8cd52408d7d3c2a7ff250c4a","observation_id":"862ab2e6-1c0f-47a0-a8c9-19084d321d70","resolution":{"observed_at":"2026-08-14T05:04:49.028693Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.467106Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.467106Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:7d1c017992dd734c4423b44432f0d4bb8e9ad800bffc3f869ea619f33e5d775b","observation_id":"c45ea5e8-9ab9-4bfa-8b68-cdb9f0c2de08","resolution":{"observed_at":"2026-08-14T05:04:48.467106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.999798Z","title":null,"venue":null,"work_id":"cccd3981-defe-488c-8601-181b4a13f077","year":2005},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.470789Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:fce91f6bbbd51ebaca1f83f7c2551a2e8d8fa6b01cce8c3e4f04c2e42d5baec5","observation_id":"da5bb84d-e3b9-4206-8a71-547da7593180","resolution":{"observed_at":"2026-08-14T05:04:49.004402Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.985578Z","title":null,"venue":null,"work_id":"b4286e76-e2bf-400e-9208-f7cc0f2495fe","year":2016},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.475090Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:87239e1586463668edbc2d28b4d48b51c6ce5b71c0ad119daefc669622aa6ce8","observation_id":"698cf0cd-dcbd-44be-a811-cc7ada19fa4e","resolution":{"observed_at":"2026-08-14T05:04:48.990117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.971312Z","title":null,"venue":null,"work_id":"fb6e2ddd-4462-400b-ab25-c77b483a8c2d","year":2018},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.478933Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:cdd22aa7c37f832a93bba669b0f56cee6fb5bb09cee679e2d4757d85c2af114c","observation_id":"9e942470-283f-46e8-8b54-7ade71aa8ece","resolution":{"observed_at":"2026-08-14T05:04:48.975728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.958199Z","title":null,"venue":null,"work_id":"857b9d26-2178-45b3-bd4d-5c0b1f98846d","year":2001},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.482646Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:59f985e89c3f3e9f120093427467ac46ba10465f22fc4a1825b819a3e469edce","observation_id":"202ef39e-4986-4157-bdda-8ddc16935535","resolution":{"observed_at":"2026-08-14T05:04:48.962022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.486801Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.486801Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:2a4efb559b41728753c6b62d39deff7c9002d83da4c4472019de69545e676803","observation_id":"c3af11ab-2e48-451f-954f-4c570c6c64bc","resolution":{"observed_at":"2026-08-14T05:04:48.486801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.935917Z","title":null,"venue":null,"work_id":"eb80310e-2a05-48b5-9c2f-af8efdc6e6c4","year":2017},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.491246Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:0099e5a378983868e1fcd6aa897d49c7ec3fc84c6b487f4e2e39047a9f2770dd","observation_id":"39691e5b-b4a8-40ae-a895-8988f108eba7","resolution":{"observed_at":"2026-08-14T05:04:48.939857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.495528Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.495528Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:f27dacece7124dc3222637faece563987eed73635c0e7660fc638b90dee44b17","observation_id":"d0305ec4-dc24-40e9-9116-49fce2ad3bcd","resolution":{"observed_at":"2026-08-14T05:04:48.495528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.911627Z","title":null,"venue":null,"work_id":"a49626d4-86cc-4e46-8039-5c9e8fc6d4c6","year":2015},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.499724Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:e75928108d4f966dd861c545c2cc41da6a54d3880070b1213268ed1a8e4ced1e","observation_id":"c0033074-8b04-45fd-baa7-1a784e5bd3e9","resolution":{"observed_at":"2026-08-14T05:04:48.916869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.896435Z","title":null,"venue":null,"work_id":"cc8f6b1c-75ea-420c-a807-8d071fe03f80","year":2013},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.503893Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:43a17f71a1fb0a25297379fe145c95963b4081c23438b132caf44a6604d46031","observation_id":"61c04fed-3a2c-40bf-9db0-37d48ddd59f6","resolution":{"observed_at":"2026-08-14T05:04:48.901423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.882281Z","title":null,"venue":null,"work_id":"c592fa6c-b110-4488-9dee-2a4b1f713cf1","year":2016},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.508272Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:6f2fccc323eb3f6d900309de725df58a240f3b2bb4caf3a7b915cbbfbbe78879","observation_id":"677827f1-b943-45a3-bc98-2f5df75172f9","resolution":{"observed_at":"2026-08-14T05:04:48.886721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.868013Z","title":null,"venue":null,"work_id":"02d694ca-b102-40c5-9014-10008249f766","year":2017},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.513093Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:9a041bf3b786e616351ac4da2ef25d3f89466d59b84a930f07793af52485153b","observation_id":"fe9908c2-f348-4ff7-8b0e-0eb12ef2596d","resolution":{"observed_at":"2026-08-14T05:04:48.872476Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.854014Z","title":null,"venue":null,"work_id":"55ab0a71-7fbb-4439-8f83-6ca41cd6adcd","year":2019},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.517391Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:b2ae8320ecfe9d2dbf60685c8ceba861205b7ac2365cef9bf3a628516f3c0310","observation_id":"313c60ee-efca-48f2-aa5f-ab6629a4cbb0","resolution":{"observed_at":"2026-08-14T05:04:48.858754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.521725Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.521725Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:9564f64a2064b5b1b3747ed19dd3292941e7f223f60911119951b82593da0a86","observation_id":"fed7fee1-d3d4-46a3-b44a-f1144cf9aef5","resolution":{"observed_at":"2026-08-14T05:04:48.521725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.830832Z","title":null,"venue":null,"work_id":"b8faf082-fffd-4804-ab73-e58fb9f9872a","year":2019},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.526942Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:49b81d49784fd74bb152f51bacf5760e9ff33b65c5fe0b70a28370f0e4ef14ac","observation_id":"efc8e4b9-4b88-4225-bec8-59535fcb1679","resolution":{"observed_at":"2026-08-14T05:04:48.835288Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.816847Z","title":null,"venue":null,"work_id":"0ac107f9-f6b7-4e07-b6b7-7315a63f7d3d","year":2016},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.531085Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:cc87d40600a3834e9d9dce2326788537246c90f669e8f2ec9b94b2beb6ea34fb","observation_id":"1797ab31-8aa4-4a19-967d-7fea41420ab5","resolution":{"observed_at":"2026-08-14T05:04:48.821403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.803386Z","title":"a rvelin and Jaana Kek \\","venue":null,"work_id":"5aa38305-749d-4c0e-8c4c-bbb29262804c","year":2002},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.535444Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:cc814813002fb240419d20f58a54ebcebf86c24a87ffd734bd09941cccfe11b1","observation_id":"4970da9a-858e-42f0-a310-79b6bf9b72ef","resolution":{"observed_at":"2026-08-14T05:04:48.807625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.539656Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.539656Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:304bed839f3595b39c9f14cf6f20c03aea65b723d7ebec9794e36bbfc3b0216f","observation_id":"2da873a0-8ea6-4a32-b117-463d99702b39","resolution":{"observed_at":"2026-08-14T05:04:48.539656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.781858Z","title":null,"venue":null,"work_id":"05732d22-2d17-4734-b382-7f1a1e819462","year":2014},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.543705Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:7fad8435357dd3d88cd5c45d31e3d3c91a4bd6982adf528be20fc82e22ad8c0c","observation_id":"e640a309-e80c-4d20-84b0-08e41da67b81","resolution":{"observed_at":"2026-08-14T05:04:48.785733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.766476Z","title":null,"venue":null,"work_id":"40e20527-6996-46ec-a5ec-ab70c5c7b8e2","year":2015},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.547860Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:caab342e19ac23e6506916af4a02f2dd27ecf5e27d59924a47ef8e950c023ede","observation_id":"759a961f-e1f0-463a-9415-d161d0babda4","resolution":{"observed_at":"2026-08-14T05:04:48.770997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1411.2539","last_updated":"2014-11-10T19:09:41Z","snapshot_observed_at":"2026-08-14T23:12:14.296355Z","submitted_at":"2014-11-10T19:09:41Z","title":"Unifying Visual-Semantic Embeddings with Multimodal Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.2539","snapshot_observed_at":"2026-08-14T05:04:48.551916Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.551916Z"},"links":{"cited_paper":"/paper/1411.2539","citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:1f8b165d1168077b80f73d8bd6ef0c4ccf89aab4a0a534d56497d210ba492a1c","observation_id":"d248deff-05fb-459e-94df-b804306c7c1f","resolution":{"observed_at":"2026-08-14T05:04:48.551916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.751879Z","title":null,"venue":null,"work_id":"0317d1ef-2071-4669-8e32-ee5fa93903ca","year":2004},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.556477Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:d50f75b34b79deeb7177b84ce1f65429da0375cd6b0d9d8fbcc3c7479472891b","observation_id":"b488e44e-1fd2-45f4-8085-c3b401d47dc7","resolution":{"observed_at":"2026-08-14T05:04:48.756789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.737611Z","title":null,"venue":null,"work_id":"0d513348-47e6-47d5-a225-269850672252","year":1951},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.560734Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:f938bbcbafefe9c6e3cc23c4b1df925bd448bdc174f204eb12e72c8c7e01f79c","observation_id":"59dae3a4-edbc-44da-a7fb-c01a60d925b3","resolution":{"observed_at":"2026-08-14T05:04:48.742317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.564805Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.564805Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:fe1b1303026a0c1b3de111518b244efe142495bbb162a35ee9eabcf6df56df92","observation_id":"9e8d1589-d82e-4ed6-a31c-26f8e3fb0310","resolution":{"observed_at":"2026-08-14T05:04:48.564805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.569058Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.569058Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:c0c51033b052ad83e7c24553c562fb072f6077ae61084d2a741fd41f88025d63","observation_id":"2e8dcf9f-afd4-475f-8712-01d11a37e05b","resolution":{"observed_at":"2026-08-14T05:04:48.569058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.573283Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.573283Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:01fd1c1b3428ecdb8f692596496264a6180c29ccbe4d2441a7c7cac06c579527","observation_id":"a1f9e2a3-aefa-45a4-92ed-2bf9d01b05d0","resolution":{"observed_at":"2026-08-14T05:04:48.573283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.697039Z","title":null,"venue":null,"work_id":"9628e595-9aa5-4894-be54-f2a9433118ff","year":2017},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.576800Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:86c1d9899b077aad4ec0b26de32e9f045e8d49852d1541ae76b47a259e05dd47","observation_id":"a96f0f84-20cc-4aeb-b9aa-d00addcfdd7a","resolution":{"observed_at":"2026-08-14T05:04:48.701796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.580646Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.580646Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:bda318175cf57463cbe0da86ca587fc5fd8985979c4af9a67c08f9aadc4ff7a9","observation_id":"245f7694-a334-4db8-a234-7f670e427ef5","resolution":{"observed_at":"2026-08-14T05:04:48.580646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.584289Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.584289Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:139c3921529b499ff19e9d8e3d89e04326c3f47324705e2201b8dcd02ea23151","observation_id":"95b291dc-ee24-4bb3-b5f9-eeb9172cf2be","resolution":{"observed_at":"2026-08-14T05:04:48.584289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.664567Z","title":null,"venue":null,"work_id":"a4469b9a-d6fb-48e5-8bfc-d2ecd85888c1","year":2018},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.587928Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:2641ee004882f79f86289a417a6f537c8ef902704a731e5d329ac14d7ddebad6","observation_id":"8f0d994b-47db-49e1-ad4c-5032f752b10e","resolution":{"observed_at":"2026-08-14T05:04:48.668858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:04:48.649546Z","title":null,"venue":null,"work_id":"c10332e4-023d-4ed2-af9b-dab57033bca2","year":2018},"citing_paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T05:04:48.591958Z"},"links":{"citing_paper":"/paper/1909.02050"},"observation_digest":"sha256:e147892122d4467127888dd23cc80abe9881d38376c8bfbaaa5c0c2f1f06cb21","observation_id":"86c8f697-a23f-4340-90e2-be97fe4128a1","resolution":{"observed_at":"2026-08-14T05:04:48.654839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1909.02050","last_updated":"2019-09-04T18:43:04Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T08:15:12.300483Z","submitted_at":"2019-09-04T18:43:04Z","title":"TIGEr: Text-to-Image Grounding for Image Caption Evaluation"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 5 inbound Pith citation observations for arXiv:1909.02050."}