{"as_of":"2026-08-15T10:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7f5943b3ff0d8fc76ad6fe9ffd8c950cb36e7b536255269d6120158b8ead8861","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:25:34.169118Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.10118/citation-record","integrity":"/paper/2502.10118/integrity","json":"/paper/2502.10118/citation-record.json","paper":"/paper/2502.10118"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.467638Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.467638Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:f63d75d189c762ccf9abf0fa5558ca19afa92cbca4ff903ee295f98c9483e8b8","observation_id":"aa4a5621-038b-4697-8500-4d1f2f11010d","resolution":{"observed_at":"2026-08-07T19:25:33.467638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.499305Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.499305Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:94294dcf0f6a4d74bd6a38d11ed216cd51ccc0f52492225ad26242fc0c2a72b4","observation_id":"b8316e0d-7389-40ee-a9cf-e780a4b05719","resolution":{"observed_at":"2026-08-07T19:25:33.499305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.14883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.038755Z","title":null,"venue":null,"work_id":"10715f51-7d0a-4c83-b240-aff812a3ccb2","year":2025},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.528785Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:48dd2b7696c081e49a62cf23ffabdf45894dc66e839979002ae1321a639099b5","observation_id":"ead2f968-5e09-4675-8aeb-141e96a55638","resolution":{"observed_at":"2026-08-07T19:25:36.054649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.704042Z","title":null,"venue":null,"work_id":"0be919ec-3868-4599-97da-ff156cb315af","year":2024},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.531752Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:0ce2dcc77e518d3d7230a676a02cf722e6619aac2861e326b9e9eb2013140a7e","observation_id":"859d34b3-00e6-4aa5-832e-cec2dae4d5a3","resolution":{"observed_at":"2026-08-07T19:25:36.706941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08529","last_updated":"2019-08-22T17:59:08Z","snapshot_observed_at":"2026-08-14T11:34:50.329307Z","submitted_at":"2019-08-22T17:59:08Z","title":"Sequential Latent Spaces for Modeling the Intention During Diverse Image Captioning","version":1},"cited_work":{"arxiv_id":"1908.08529","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.08529","snapshot_observed_at":"2026-08-07T19:25:35.415589Z","title":"Sequential Latent Spaces for Modeling the Intention During Diverse Image Captioning","venue":"cs.CV","work_id":"72eff24e-cd0a-4613-9908-1ef7bd8572b2","year":2019},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.534230Z"},"links":{"cited_paper":"/paper/1908.08529","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:f33be425ec347770152ac9c39ebaa97d8efa255b3de430dcbf4bf8430e149cac","observation_id":"f4ac3de0-ec1d-4fd2-9dd6-d203e4c0f0fa","resolution":{"observed_at":"2026-08-07T19:25:35.475849Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.694191Z","title":null,"venue":null,"work_id":"f21be97d-f360-400f-8f1f-1ec9631c94f8","year":2019},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.537274Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:ac8e4ff64841ab4377a4bff9ac8c19f5f6db21e3393bba03cec95728b91dc477","observation_id":"546450be-0115-4939-9628-b4e78e731cb1","resolution":{"observed_at":"2026-08-07T19:25:36.697435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.540295Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.540295Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:ce991a153d33c9309cfc12e8205efeeedc84949e5040d658614568f60842f4a1","observation_id":"9cc50b74-be6b-4bfa-a8d7-90d7de24a3bb","resolution":{"observed_at":"2026-08-07T19:25:33.540295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.1503","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"3eddf518-0b56-41cb-a8ff-143de7af2298","year":2025},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.542937Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:cef7b4ee68b1cccc82c8c808265942c2c86a906e9055219560f2f65bea8ce15e","observation_id":"76fa143b-82fb-4e96-b783-b7977ca1aac9","resolution":{"observed_at":"2026-08-07T19:25:34.405000Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.545277Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.545277Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:d805dbaaede4582eee9ebc2a53000af4fb474c99c9eaaf52a4f387030daa39cc","observation_id":"6dd52c43-0805-42d2-8c48-f54dd9a33514","resolution":{"observed_at":"2026-08-07T19:25:33.545277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06742","last_updated":"2024-04-01T03:00:06Z","snapshot_observed_at":"2026-08-13T05:04:50.000343Z","submitted_at":"2023-12-11T18:59:06Z","title":"Honeybee: Locality-enhanced Projector for Multimodal LLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06742","snapshot_observed_at":"2026-08-07T19:25:33.547503Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.547503Z"},"links":{"cited_paper":"/paper/2312.06742","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:7c40c3882784dd390d1cc9d90a4e1128098c4de38e82f9fb71f8fa2770bc9685","observation_id":"f3f95225-f6ea-42eb-9236-2ab51d5cdbe2","resolution":{"observed_at":"2026-08-07T19:25:33.547503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00485","last_updated":"2025-08-20T17:41:38Z","snapshot_observed_at":"2026-08-14T15:18:00.645394Z","submitted_at":"2024-05-01T12:49:57Z","title":"What Makes for Good Image Captions?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00485","snapshot_observed_at":"2026-08-07T19:25:33.550436Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.550436Z"},"links":{"cited_paper":"/paper/2405.00485","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:b88b6d8046e40c46e002f0bc37d45c566f8ac80d4d4ff8a8aba11bb93358dcfd","observation_id":"ac771f15-1c3e-403e-95d1-18291c5cd0e2","resolution":{"observed_at":"2026-08-07T19:25:33.550436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.629664Z","title":null,"venue":null,"work_id":"7e8406b9-8b42-4823-983a-3116c857bd37","year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.553168Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:4ebcaf6b60b07b676c8f45c90b59e7d4518c27418f0183352896b59debc91edc","observation_id":"a8b88e4a-d5f3-48c6-a815-bdef4223e7f2","resolution":{"observed_at":"2026-08-07T19:25:36.683121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.08231","last_updated":"2023-08-15T07:24:55Z","snapshot_observed_at":"2026-08-14T07:40:29.842944Z","submitted_at":"2022-09-17T03:25:46Z","title":"Learning Distinct and Representative Styles for Image Captioning","version":2},"cited_work":{"arxiv_id":"2209.08231","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.08231","snapshot_observed_at":"2026-08-07T19:25:35.210125Z","title":"Learning Distinct and Representative Styles for Image Captioning","venue":"cs.CV","work_id":"f7e02921-3933-4f2f-8ad9-f5ac8164ab39","year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.555646Z"},"links":{"cited_paper":"/paper/2209.08231","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:08891054331bd210c6bd0805d72b9f4a48121dafb326c846292c64552e2545d0","observation_id":"ed7c734c-c624-444b-998c-636e6e9963d9","resolution":{"observed_at":"2026-08-07T19:25:35.213342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01937","last_updated":"2023-05-03T07:28:50Z","snapshot_observed_at":"2026-08-13T11:50:17.843572Z","submitted_at":"2023-05-03T07:28:50Z","title":"Can Large Language Models Be an Alternative to Human Evaluations?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01937","snapshot_observed_at":"2026-08-07T19:25:33.558270Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.558270Z"},"links":{"cited_paper":"/paper/2305.01937","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:be12a870a251697bf7db81b8c5255db7baa05a9c524e0107ff1ce08edcd6a6a2","observation_id":"3ea38642-fee4-454e-b912-af096972d4fa","resolution":{"observed_at":"2026-08-07T19:25:33.558270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.561008Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.561008Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:32ab8d140fb9425ec205a9cb96a35042df44947728478679f7bfd207833204a5","observation_id":"bd1132c6-67f7-4ab9-b4a0-32720b4a88d2","resolution":{"observed_at":"2026-08-07T19:25:33.561008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T19:25:33.563017Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.563017Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:d0ecc9fe8eae5df31b7869fc19b7d6005b68ef14893f05153f425885508bb30d","observation_id":"297f2d1e-da8b-4638-b695-69ba721e6a0f","resolution":{"observed_at":"2026-08-07T19:25:33.563017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.615672Z","title":null,"venue":null,"work_id":"7e05a123-ac87-4de6-97f5-ebb07f2081dd","year":2020},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.565233Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:03577404eba914b45c89d593fc18abedf73ad3c354ef250a7820741b7fe1c2e6","observation_id":"356d3a29-415a-4cae-9964-88aa365277f8","resolution":{"observed_at":"2026-08-07T19:25:36.618649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.573506Z","title":null,"venue":null,"work_id":"eb5a66ab-6fa1-42ea-9694-42f6d438ddd3","year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.567271Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:19bbc6967a285928d49adb130449afebbd619332e1a011eb422d7e97c319742d","observation_id":"fc3b6aad-8349-4a50-87b1-af01ccf63581","resolution":{"observed_at":"2026-08-07T19:25:36.608367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04166","last_updated":"2023-02-13T16:19:05Z","snapshot_observed_at":"2026-08-05T08:58:00.258106Z","submitted_at":"2023-02-08T16:17:29Z","title":"GPTScore: Evaluate as You Desire","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04166","snapshot_observed_at":"2026-08-07T19:25:33.571035Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.571035Z"},"links":{"cited_paper":"/paper/2302.04166","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:3896aa25984c770b09731122eb88336a75802dd09a573a4709a5b0e7cb7b3149","observation_id":"1b8b2a03-0263-4cb5-b24a-ae85641934f7","resolution":{"observed_at":"2026-08-07T19:25:33.571035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.573774Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.573774Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:9067543742a25d86f3044d46211bba89ca10d3625f61685ad27547feb3204d0b","observation_id":"b88151a1-b97c-4b55-a260-a80db9015d8c","resolution":{"observed_at":"2026-08-07T19:25:33.573774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.600147Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.600147Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:d206d48c15f4d8d9360eea1e850a0076ea4628b6e306b4246f72b8c54ec8b5ec","observation_id":"37bac9dd-a9f8-4328-8d56-85e15024eb0b","resolution":{"observed_at":"2026-08-07T19:25:33.600147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.474715Z","title":null,"venue":null,"work_id":"5bb922a3-f606-41f0-8a92-492428f216bc","year":2017},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.643128Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:8c8c644d56a30c570de703943e8fa93e4870be4715c4a8e877baf579760922ed","observation_id":"10ae4e38-cd6e-4dd1-8912-09ab99250d46","resolution":{"observed_at":"2026-08-07T19:25:36.508136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.453380Z","title":null,"venue":null,"work_id":"73dfa9b6-4109-49cc-9796-3f47093fce4e","year":2021},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.688662Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:cb377022e4d1051b653c0d20aa5e21b341ca763d64317e26713bcf90e3c9bc9d","observation_id":"eebad87a-65f0-4c97-9cce-6994cf948e47","resolution":{"observed_at":"2026-08-07T19:25:36.455961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.2306","last_updated":"2015-04-14T05:02:53Z","snapshot_observed_at":"2026-08-14T23:08:39.824540Z","submitted_at":"2014-12-07T02:36:07Z","title":"Deep Visual-Semantic Alignments for Generating Image Descriptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.2306","snapshot_observed_at":"2026-08-07T19:25:33.733124Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.733124Z"},"links":{"cited_paper":"/paper/1412.2306","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:35f923f2925eb1145c567c21718d7d67d0d3c1c4d7a63d11af525c1013a380b9","observation_id":"d3bfd178-f4f1-45f5-a395-fe248973285e","resolution":{"observed_at":"2026-08-07T19:25:33.733124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-07T19:25:33.735909Z","title":"Berg, Wan-Yen Lo, Piotr Doll \\'a r, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.735909Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:56caec728f211aa780adbb28bb62390de5927574346b38e81937f1b7762df1ef","observation_id":"6acf5f46-57b2-4339-8a15-6a1a8ae77bcc","resolution":{"observed_at":"2026-08-07T19:25:33.735909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-07T19:25:33.738830Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.738830Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:b6aea72cf215683711a4ab8df071ac3a9437530cf45b4c13cc820f30c13c5c92","observation_id":"369cfa1f-97d8-4594-8695-4591ba373fa2","resolution":{"observed_at":"2026-08-07T19:25:33.738830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.444843Z","title":null,"venue":null,"work_id":"76b631c3-c91f-4fd9-b69d-9ddfd0901c02","year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.741656Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:05acd89bf67ed2f7d101d0dfd1bcef8158e29344dad11ce2a7e00c057aecc940","observation_id":"8bb2c361-3005-4458-8d2b-541ee3e13221","resolution":{"observed_at":"2026-08-07T19:25:36.447323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-09T08:39:37.884261Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-07T19:25:33.743835Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.743835Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:95f3f909f7668c093712d47c07e3ffe11048dae01f6368a02a7866dbd574fc95","observation_id":"75f5a4ab-e5bf-4ba6-bc12-dcd437da3911","resolution":{"observed_at":"2026-08-07T19:25:33.743835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.746467Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.746467Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:34af7aca7642816fd92b29a3bccee91f9feabe2010181dd2ea3950deca55989e","observation_id":"a46dd69c-556e-4fed-873c-8af11153a27b","resolution":{"observed_at":"2026-08-07T19:25:33.746467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.748964Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.748964Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:f9b438d54dba00c4e01bc2466f73566cc3bd7df8e8b992996af661fb24488374","observation_id":"a24937ca-3364-4c5c-8693-3919c47071df","resolution":{"observed_at":"2026-08-07T19:25:33.748964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05437","last_updated":"2023-11-09T15:22:26Z","snapshot_observed_at":"2026-08-13T05:29:05.048863Z","submitted_at":"2023-11-09T15:22:26Z","title":"LLaVA-Plus: Learning to Use Tools for Creating Multimodal Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05437","snapshot_observed_at":"2026-08-07T19:25:33.751527Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.751527Z"},"links":{"cited_paper":"/paper/2311.05437","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:f19be5bcfb7fd3fe10fa1e317d4db09c2540573acb87e006142be99265559c86","observation_id":"c09a4593-00e2-4dac-b352-4eecbd225704","resolution":{"observed_at":"2026-08-07T19:25:33.751527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16634","last_updated":"2023-05-23T22:12:16Z","snapshot_observed_at":"2026-08-02T04:02:36.848064Z","submitted_at":"2023-03-29T12:46:54Z","title":"G-Eval: NLG Evaluation using GPT-4 with Better Human Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16634","snapshot_observed_at":"2026-08-07T19:25:33.755439Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.755439Z"},"links":{"cited_paper":"/paper/2303.16634","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:3305a90350fbade3a424407f6103a3b7c4f29cbf23a7644e721169db632ed334","observation_id":"feb52e77-1deb-4607-a59e-17c9a537b68e","resolution":{"observed_at":"2026-08-07T19:25:33.755439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T19:25:33.758153Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.758153Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:fd54d246cf5b945171ecf2771c3851502a3f7cdd88802ff3a5cd7ec69d370487","observation_id":"528f547a-d821-48c4-9278-e06e549a2085","resolution":{"observed_at":"2026-08-07T19:25:33.758153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:35.140132Z","title":null,"venue":null,"work_id":"0742bd89-fa70-4991-bd1b-c7e0978c0bab","year":2002},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.760819Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:d1142ee1d865d149c55e76c61d38c1bdd4047c359b263847c5ff504862dec8a9","observation_id":"e80cb94f-3b78-4a08-bd7f-39891c3638e9","resolution":{"observed_at":"2026-08-07T19:25:35.142995Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.426513Z","title":null,"venue":null,"work_id":"a296e672-90f8-407f-81f3-26c59dc61616","year":2002},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.763402Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:16fb5a5c9bf785bda5c39db947b4b88ab770f3f414f93c64c67bcb02853a3779","observation_id":"b5670a7e-712e-4597-98db-04edb6111371","resolution":{"observed_at":"2026-08-07T19:25:36.429202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T19:25:33.765645Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.765645Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:77b677d57447e5824aae7f2c60f15688e4093af786dcce3ce5e2ad04ee093c1f","observation_id":"5df3fd44-4336-4518-9405-280f2a01160e","resolution":{"observed_at":"2026-08-07T19:25:33.765645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.418121Z","title":null,"venue":null,"work_id":"019e1d06-6080-4c31-bada-88e0cdf45ed3","year":2021},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.768481Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:ebb6e92b1d873e7b040d7a3b5b5c3b5b8f4aab5cbcef146a4dbaf171fe6bdc24","observation_id":"07609803-4d61-43c8-90c5-f361244f5b34","resolution":{"observed_at":"2026-08-07T19:25:36.420976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.770836Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.770836Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:1e4c69a19530fe560e7accd15d6367929f18b663224feebac7a3ac06a143c599","observation_id":"8268ccd1-be71-4350-8947-82995259f222","resolution":{"observed_at":"2026-08-07T19:25:33.770836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:33.793991Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.793991Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:39fc40763dd603dc6c1271a5dca1e0e10319dc12d6c4c4f49ed67c0ac0c98e13","observation_id":"e1c51927-f55f-4e1f-911e-0097e06858c9","resolution":{"observed_at":"2026-08-07T19:25:33.793991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.397898Z","title":null,"venue":null,"work_id":"ebc479b4-ba3d-4bb7-aaf6-95737ab87139","year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.862989Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:bd52aecb30de220e14e31177306803e191e230f8d881f4e4fa1cd9f6a0234058","observation_id":"be7d2470-657b-4429-8653-d9063826bf52","resolution":{"observed_at":"2026-08-07T19:25:36.400864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02352","last_updated":"2024-06-09T23:21:28Z","snapshot_observed_at":"2026-08-13T04:27:32.750906Z","submitted_at":"2024-02-04T05:33:04Z","title":"Region-Based Representations Revisited","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02352","snapshot_observed_at":"2026-08-07T19:25:33.927715Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:33.927715Z"},"links":{"cited_paper":"/paper/2402.02352","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:f5c82c93fecea29465968bc300dfffef1d8f96296ca45bbbfad97be946c0c09f","observation_id":"f787e2bd-561d-4e00-bb72-4b731a4ccdd7","resolution":{"observed_at":"2026-08-07T19:25:33.927715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.390054Z","title":null,"venue":null,"work_id":"ae8c696c-16c2-4514-a926-2aa7d163db5f","year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.008077Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:3e571c18ba7136e9b48b0266762668ef8e5f88829d82563a03c0262025975b1a","observation_id":"b2848dbf-99b4-4358-b20c-bc11c9dcc05e","resolution":{"observed_at":"2026-08-07T19:25:36.392912Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.73","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"2f22d693-c370-4124-be68-6ddd647f0a04","year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.097981Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:4234a1acabc7f84c144f1e17a0ce16aff30c90e208f5d6b732fe41b4e90024c3","observation_id":"3e1e3af0-029b-4ddc-b072-30ea64e61c69","resolution":{"observed_at":"2026-08-07T19:25:34.361129Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.381644Z","title":null,"venue":null,"work_id":"e911f936-98ff-408d-8337-ed5722efc552","year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.100881Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:e3afc973feacb869b29ca2719cf276a1fa55438df46bf18d4a9e63ae13abe74d","observation_id":"3aa21bf0-f8fa-4baf-bbf0-3d46e6416063","resolution":{"observed_at":"2026-08-07T19:25:36.384468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T19:25:34.104244Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.104244Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:11e79e13067310a35100c562b845c0f05ea3cf9a9062accd7bc11c283539568b","observation_id":"0f730e41-8b35-4ba1-9fc0-faf4c69f620e","resolution":{"observed_at":"2026-08-07T19:25:34.104244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:34.991425Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":"5273db9b-b6f8-4539-a63b-0c029f207d95","year":2015},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.107280Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:bbaae9991a9d7c35fd2e9577153517c5dd51fd83a6221303588770628fafd39e","observation_id":"2af9d7b3-3266-4995-9dae-25c944e658cd","resolution":{"observed_at":"2026-08-07T19:25:35.052311Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17455","last_updated":"2026-06-26T13:24:26Z","snapshot_observed_at":"2026-08-06T14:45:09.380269Z","submitted_at":"2025-07-23T12:23:03Z","title":"VLM-Guided Visual Place Recognition for Planet-Scale Geo-Localization","version":2},"cited_work":{"arxiv_id":"2507.17455","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.17455","snapshot_observed_at":"2026-08-07T19:25:34.432542Z","title":"VLM-Guided Visual Place Recognition for Planet-Scale Geo-Localization","venue":"cs.CV","work_id":"c19e5fc8-7293-40f2-bf87-2fda0acd361c","year":2025},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.110391Z"},"links":{"cited_paper":"/paper/2507.17455","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:90b904f64151e9db8c97f4bf4d0f19f1cc0f016edd240438d8f2529b2c9c982d","observation_id":"7e40051d-73db-49ab-85c2-0c201e70e767","resolution":{"observed_at":"2026-08-07T19:25:34.436452Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.10442","last_updated":"2022-08-31T02:26:45Z","snapshot_observed_at":"2026-08-13T14:40:51.995893Z","submitted_at":"2022-08-22T16:55:04Z","title":"Image as a Foreign Language: BEiT Pretraining for All Vision and Vision-Language Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.10442","snapshot_observed_at":"2026-08-07T19:25:34.115740Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.115740Z"},"links":{"cited_paper":"/paper/2208.10442","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:0b1ed1768a270886cd468172b79a3f6f136dbee3f54f9273ed9ec4e97c8d7681","observation_id":"a25a8aca-fde3-460c-b13d-81105354d563","resolution":{"observed_at":"2026-08-07T19:25:34.115740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00936","last_updated":"2025-03-02T15:19:37Z","snapshot_observed_at":"2026-08-07T17:35:45.126755Z","submitted_at":"2025-03-02T15:19:37Z","title":"IteRPrimE: Zero-shot Referring Image Segmentation with Iterative Grad-CAM Refinement and Primary Word Emphasis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00936","snapshot_observed_at":"2026-08-07T19:25:34.118310Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.118310Z"},"links":{"cited_paper":"/paper/2503.00936","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:4f37c9c28b73ff41aad26c21ec7e2f5560dfa3e6b721246a30a753fdc419f373","observation_id":"49ec7240-df3b-4bb1-8dd1-a937a6de4628","resolution":{"observed_at":"2026-08-07T19:25:34.118310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.374167Z","title":null,"venue":null,"work_id":"f740148d-eea1-480e-b47e-faddc69512d0","year":2021},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.121604Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:2c5f3e871e2648a8056bb825e28c86d85f280b06fc8387806ea2f75deb43d43e","observation_id":"cda4f9a6-c3cf-4a10-b7a3-41b6ee086779","resolution":{"observed_at":"2026-08-07T19:25:36.376837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.304324Z","title":null,"venue":null,"work_id":"b603d783-db0a-4c32-9c4e-c6e27d7fef80","year":2019},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.124819Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:b964a15ac0ac943d0d3d7f51b0e9d72deba8edd4a26d51cf033e5fef02240412","observation_id":"c8a2732f-834f-4ce7-87e6-62176b59c44e","resolution":{"observed_at":"2026-08-07T19:25:36.368847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:34.127360Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.127360Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:c4e314c762998aff2256b4183436524f1e94b45b51a4fc5e7e9e979a20d54e36","observation_id":"380885f3-627d-4531-8c11-56976c7eec7d","resolution":{"observed_at":"2026-08-07T19:25:34.127360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.215204Z","title":null,"venue":null,"work_id":"dea78ceb-77fe-4ab9-ad3d-10d572593f6d","year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.129831Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:7b674f055c4612b1ed773dd87d4300dab8b1f38833c384c0ec6fa1ea1bb9948e","observation_id":"5becfe5a-5548-4f17-9059-da5ceb6a5187","resolution":{"observed_at":"2026-08-07T19:25:36.239756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:34.132536Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.132536Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:17c79ff83f9cda20c91d25b03416c117f4860268e2335488d018a5ab8e8d3889","observation_id":"186c3f45-4abc-4c03-84af-02a6f49c3e71","resolution":{"observed_at":"2026-08-07T19:25:34.132536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:36.115504Z","title":null,"venue":null,"work_id":"b8a433fc-dddf-45ef-8182-227094797348","year":2021},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.135309Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:a72e86e59b8cedb1972e33c605290adaa7e1f1abbc56854bc13c110815e12181","observation_id":"4e509519-c6f2-47c8-9de8-58d26913cfe7","resolution":{"observed_at":"2026-08-07T19:25:36.163409Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12156","last_updated":"2023-06-21T10:08:29Z","snapshot_observed_at":"2026-08-13T11:12:44.426861Z","submitted_at":"2023-06-21T10:08:29Z","title":"Fast Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12156","snapshot_observed_at":"2026-08-07T19:25:34.137933Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.137933Z"},"links":{"cited_paper":"/paper/2306.12156","citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:14eca80f9512f34b432554111f0c68b2f7b9511b6076f4c1e6f0ecf25d4bb7f8","observation_id":"2bdffec3-0cb7-4d07-9319-158402647dbe","resolution":{"observed_at":"2026-08-07T19:25:34.137933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:34.141267Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.141267Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:eaeba4350ba966f9655049c839570f8307de1f31d7954e2f290c6e5fcef203b5","observation_id":"19e07378-850f-489b-b150-65ede70d64fb","resolution":{"observed_at":"2026-08-07T19:25:34.141267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:25:34.169118Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T19:25:34.169118Z"},"links":{"citing_paper":"/paper/2502.10118"},"observation_digest":"sha256:66e638147fe05f137059e8a00f0a938ee38bc7a666567cee35a5819e7748d4ba","observation_id":"10d524db-26c9-4d86-9de4-7c9b9cb80c01","resolution":{"observed_at":"2026-08-07T19:25:34.169118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.10118","last_updated":"2025-09-04T15:00:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T16:25:44.853270Z","submitted_at":"2025-02-14T12:33:19Z","title":"Image Embedding Sampling Method for Diverse Captioning"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2502.10118."}