{"as_of":"2026-08-15T20:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73106dffc964f35fca025294cad5216b3f0033e45d5d14b6d88bedf1193e2f18","coverage":[{"denominator":86,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":86,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T10:24:04.451032Z","state":"measured"},{"denominator":87,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":87,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T16:35:47.826165Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T16:35:48.139466Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"cited_work":{"arxiv_id":"1908.11310","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.11310","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aesthetic image captioning from weakly-labelled photographs","venue":null,"work_id":"9fad4839-ec06-4bb3-a53c-e91f97625eb9","year":1908},"citing_paper":{"arxiv_id":"2312.17090","last_updated":"2023-12-28T16:10:25Z","snapshot_observed_at":"2026-08-02T07:14:02.308302Z","submitted_at":"2023-12-28T16:10:25Z","title":"Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels","version":1},"reference_index":252,"source":"arxiv_source","source_observed_at":"2026-05-15T16:35:47.826165Z"},"links":{"cited_paper":"/paper/1908.11310","citing_paper":"/paper/2312.17090"},"observation_digest":"sha256:2f219ee816561a2975c97017b58b3b50ca886ed82321ca05e25cf94fc257ca3a","observation_id":"e43a36b9-1763-4261-beca-1cbaf9ec3884","resolution":{"observed_at":"2026-05-15T16:35:48.142985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.11310/citation-record","integrity":"/paper/1908.11310/integrity","json":"/paper/1908.11310/citation-record.json","paper":"/paper/1908.11310"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.119126Z","title":"Dont just assume; look and answer: Over- coming priors for visual question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.119126Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:fa2eb3ec46f0549236517b31e505faccb76a301f7c96196f5a5c01be8a8ab3ce","observation_id":"cff8e22f-0fd5-420e-8378-ce0ba1100bd2","resolution":{"observed_at":"2026-08-14T10:24:04.119126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.124224Z","title":"Spice: Semantic propositional image cap- tion evaluation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.124224Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:988e0315ffe7cc73960d0dee1d4c4be0cf78ca480c5b25c2d0005e72af7148de","observation_id":"278150c5-fa41-42ab-86cb-54b73590a772","resolution":{"observed_at":"2026-08-14T10:24:04.124224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.128913Z","title":"Convolutional image captioning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.128913Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:6be2bfe6ee7624c80373731e22ad71bdafdbac16f7f484839c08592fd77a262b","observation_id":"e9513915-e20e-41b0-9bfc-fbfd9e9e550f","resolution":{"observed_at":"2026-08-14T10:24:04.128913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.133484Z","title":"Deep compositional captioning: Describing novel ob- ject categories without paired training data","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.133484Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:93a9d79bd9bba4be0e0121f4ed26d9b8a2b6304f6b8d497a515a70e6b7d9b869","observation_id":"11ff552c-5454-4be9-b1fe-a1b9662a5ebf","resolution":{"observed_at":"2026-08-14T10:24:04.133484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.138038Z","title":"Vqa: Visual question answering","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.138038Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:e85a0f132364aed1f380672385b7f3c26bbad0ad0d089e1d1a76679867b136f2","observation_id":"8fbcbd09-1a08-4a87-82d2-3dae41712ec7","resolution":{"observed_at":"2026-08-14T10:24:04.138038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.142206Z","title":"Automated aesthetic analysis of photographic images","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.142206Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:93218bcca2c352c070d22467d37010e46a3ebdd0f06cf79974e665c08e76e35a","observation_id":"be3ac050-4944-4205-a307-94035dbcdbd8","resolution":{"observed_at":"2026-08-14T10:24:04.142206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.146508Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with hu- man judgments","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.146508Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:e2421acc4365b1acf80f92830e35d148f4402c90ebc54180ffd0b53bafdec9f6","observation_id":"1703a009-6bf0-4157-a041-466a7941fab7","resolution":{"observed_at":"2026-08-14T10:24:04.146508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.431839Z","title":"Au- tomatic attribute discovery and characterization from noisy web data","venue":null,"work_id":"daecc3d0-f023-4f56-bafc-ef39537523f3","year":2010},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.150303Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:fb320b83fca4cb2cb4634104192e518b9bcb07759fbd92dca6a8aa69b2be59b3","observation_id":"e32d86db-9bf7-49b5-b4f3-5c874e3c8b68","resolution":{"observed_at":"2026-08-14T10:24:05.436426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.418488Z","title":"Vizwiz: nearly real-time answers to visual questions","venue":null,"work_id":"ef3bdc75-786f-4e41-92bf-63f540902f79","year":2010},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.154071Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:648e485f70d7710228d9fe5061d0e36d438a9d8717a525f04eac498c2682665e","observation_id":"18da67dd-7109-4fa9-a14d-5d8847cac06e","resolution":{"observed_at":"2026-08-14T10:24:05.423262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.157931Z","title":"Latent dirichlet allocation","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.157931Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:03764fac98a5e8aefcd942394aea1805e2cfdcb155ed6fd70902676fdcb7cbd4","observation_id":"7ee5c37e-b01d-4b1b-bd21-bbe62beb5fe5","resolution":{"observed_at":"2026-08-14T10:24:04.157931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.398353Z","title":"Aesthetic critiques generation for photos","venue":null,"work_id":"1bbdc8c1-1eea-4539-92c1-f39bf485eeb8","year":2017},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.161791Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:4282d4e5eb98e2a5c58a8998071a6041f49103cbf8579312d80418b4e1c58d1d","observation_id":"28873462-731f-401b-b2f8-8f850724a6c1","resolution":{"observed_at":"2026-08-14T10:24:05.402516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.386089Z","title":"Neil: Extracting visual knowledge from web data","venue":null,"work_id":"951d50cd-c9ae-40f2-8ba4-ad9c97db9641","year":2013},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.165649Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:d46a817c5b6b69286252fc851f4f01e31dc5508387fd712bab32c885caebf80c","observation_id":"b649d380-8021-4c2e-89d6-5b2596db365e","resolution":{"observed_at":"2026-08-14T10:24:05.390290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.373540Z","title":"Learning to evaluate image captioning","venue":null,"work_id":"46849bb8-cbcd-443d-ac18-d209554cd113","year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.169561Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:e0a98a30a36f922e550dbb9adbaa788aa9275297dc0a39f3b3ce013b20d505c1","observation_id":"b7320418-0d07-4ff0-b833-14a56a30f65c","resolution":{"observed_at":"2026-08-14T10:24:05.377542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.361515Z","title":"Study- ing aesthetics in photographic images using a computational approach","venue":null,"work_id":"9a175518-40ff-44ca-9ccd-4967667de3b6","year":2006},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.173598Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:2093ea753f3b5893af8f93b79d93316c459eb3627ee04c8ed918ed242e6c077a","observation_id":"beb44d3c-d5a6-4713-a864-165120abe42e","resolution":{"observed_at":"2026-08-14T10:24:05.365846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.347751Z","title":"Imagenet: A large-scale hierarchical im- age database","venue":null,"work_id":"405396ff-4f97-4b40-8b36-5eb760cfe132","year":null},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.178541Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:57f1e2444af05922bfca9cbb4ded10237209c0c8af259ae1475e6d60baf403d9","observation_id":"31ddd7bf-7dae-47fa-8690-0364e1554dc2","resolution":{"observed_at":"2026-08-14T10:24:05.351893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.321997Z","title":"High level describable attributes for predicting aesthetics and in- terestingness","venue":null,"work_id":"8b662e9e-477f-43c4-b4c7-fc0000c08fb2","year":2011},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.185972Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:6d2d402ffa6573b57cb4ca40225a9e6ca17718aeff7ceb7ab5d19c6dd65b2fcc","observation_id":"40483314-b9ba-4dc9-b915-79baaeaf6832","resolution":{"observed_at":"2026-08-14T10:24:05.326456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.310010Z","title":"Learn- ing everything about anything: Webly-supervised visual con- cept learning","venue":null,"work_id":"96bc5ba0-3121-4e1a-8e69-7e18ea110663","year":2014},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.189738Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:3fd752f46badd66e10605846622582ef97601ea84175d70cb58e44b292ee86ee","observation_id":"022b88a7-c62b-4e86-bc8a-4974967804df","resolution":{"observed_at":"2026-08-14T10:24:05.314051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.297813Z","title":"Multi-task self- supervised visual learning","venue":null,"work_id":"9fcdece0-8b74-4557-bdab-7c14c0d3823f","year":2017},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.193419Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:d823068cf54a0e63451832f5d907c41c88abf01054021eba74ae5e45622ff712","observation_id":"150b6fba-cc6f-4b68-bbd8-a23e7dad28d6","resolution":{"observed_at":"2026-08-14T10:24:05.301943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.285660Z","title":"Long-term recurrent convolutional net- works for visual recognition and description","venue":null,"work_id":"8ba6a113-4944-4829-a387-25c3fb0ade2d","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.197267Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:52b2483250b4344e7e102813739f97553c30b7000b4d23533a1abe59ec38119d","observation_id":"1a208174-a94c-40f6-bfce-dea441bc6b7f","resolution":{"observed_at":"2026-08-14T10:24:05.289747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.273887Z","title":"From captions to vi- sual concepts and back","venue":null,"work_id":"c2b5566d-8cdc-4532-b70b-6434c010375c","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.201654Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:07df8c4d9491f7ba1d698613e885aa83bd3e013a8ef6edbcab9bfe9caddf341d","observation_id":"d72c703f-8693-485e-8451-a3a91bd47677","resolution":{"observed_at":"2026-08-14T10:24:05.277997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.260455Z","title":"Every picture tells a story: Generating sentences from images","venue":null,"work_id":"b4fcf8cc-d8d0-4dca-89db-015ba8b7b136","year":2010},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.205716Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:d7cdd28a8ace52e75dee0137b6056c576f5d6daa776d655656bdeb063f955bb6","observation_id":"5234a00b-0d0a-4234-95b9-c3a7a9fc62c5","resolution":{"observed_at":"2026-08-14T10:24:05.265636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.210145Z","title":"Im- age style transfer using convolutional neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.210145Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:ba3c6cc4211834024492cf54ba1ce7dca154222c284cd1dc6b3260000762b2aa","observation_id":"5e10268f-9b2c-44d9-8b45-4858d9d9d820","resolution":{"observed_at":"2026-08-14T10:24:04.210145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.239770Z","title":"Visual turing test for computer vision sys- tems","venue":null,"work_id":"7aef811c-c37c-432b-9a6b-d240495f098a","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.214183Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:9ab61c474899872b560ea7ac0737c176b9e846ba22bd1225445288484c3018a6","observation_id":"d18d8675-48e9-4251-9879-f22ce9ec1b62","resolution":{"observed_at":"2026-08-14T10:24:05.243993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.227528Z","title":"The data that transformed ai researchand possibly the world, 2017","venue":null,"work_id":"72917704-e1d1-4e95-8e72-f9a0b4ca6256","year":2017},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.218265Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:c2de61f41c87271e7d85efc630586d4b782aa29480a1439cef500e0604b2ddaf","observation_id":"ff96ec38-7c66-4410-9953-19e2a3b194df","resolution":{"observed_at":"2026-08-14T10:24:05.231726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.212175Z","title":"A geometry-sensitive approach for photographic style classiﬁ- cation","venue":null,"work_id":"cdd224ee-18f6-4b70-94ce-d7da103c868a","year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.222059Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:57acf1b099abb79b641b0ebf356ada7ca8029910cf520763f7afcfd169c05df9","observation_id":"df32dfa1-ceb6-4c8d-a90b-7af57828c63f","resolution":{"observed_at":"2026-08-14T10:24:05.218561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.225994Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.225994Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:3a3c57a9013016a19da1292bb55888b84228196c5364f762489762c8e8506ad9","observation_id":"e8c1fa70-74d2-4522-92b3-c5d23a3089f8","resolution":{"observed_at":"2026-08-14T10:24:04.225994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.190913Z","title":"Fram- ing image description as a ranking task: Data, models and evaluation metrics","venue":null,"work_id":"5f0cbe1e-a174-4ec8-b09d-17b4a8ecf576","year":2013},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.229987Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:4d0a588d032fc5ef4ddc5e07ee14dbe29ff239adc1950f2e4ac9e2ad09bff9c5","observation_id":"250889b7-e7cc-44b0-9273-1390055999bb","resolution":{"observed_at":"2026-08-14T10:24:05.196240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.178159Z","title":"Learning hypergraph-regularized attribute predic- tors","venue":null,"work_id":"67d126be-c923-43b9-b4ba-a99512900012","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.234353Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:ae954e3c48bfcef37a7a85b23d26625f3c8232928decd3f5f4bddb1335c881f2","observation_id":"f0c2b537-e3c7-45da-80c6-67ecec3a9498","resolution":{"observed_at":"2026-08-14T10:24:05.182410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.165287Z","title":"Learn- ing cross-modality similarity for multinomial data","venue":null,"work_id":"94892fe6-e222-456d-b479-371fde327c04","year":2011},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.238796Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:433c0458dea2b9c901f2919c8e5c98488e8723a399beb00f9fe3284c7154dcc9","observation_id":"6fabbca1-1d29-492e-b357-6bed646cfbc5","resolution":{"observed_at":"2026-08-14T10:24:05.169607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.06272","last_updated":"2015-06-20T17:25:38Z","snapshot_observed_at":"2026-08-14T22:43:38.021954Z","submitted_at":"2015-06-20T17:25:38Z","title":"Aligning where to see and what to tell: image caption with region-based attention and scene factorization","version":1},"cited_work":{"arxiv_id":"1506.06272","doi":null,"metadata_source":"pith","pith_arxiv_id":"1506.06272","snapshot_observed_at":"2026-08-14T10:24:04.497929Z","title":"Aligning where to see and what to tell: image caption with region-based attention and scene factorization","venue":"cs.CV","work_id":"bbd3a833-f995-456a-9beb-da1c61fb9606","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.242861Z"},"links":{"cited_paper":"/paper/1506.06272","citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:42463949c93ee3014128cf0287177a5bd7b8a5d772b9bc819d2ec36a1deb115a","observation_id":"c0b7c5fd-4dd8-45ae-aa33-81386a6a2014","resolution":{"observed_at":"2026-08-14T10:24:04.504036Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.152257Z","title":"Densecap: Fully convolutional localization networks for dense caption- ing","venue":null,"work_id":"6896787f-9df6-411f-9744-2921b48a91eb","year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.247133Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:31b9fbd553504af6052b68194ac34533ea44b24a7571b1323d7dba24304d7b3a","observation_id":"4aa3876b-905b-494e-83ad-21fad4ca31fb","resolution":{"observed_at":"2026-08-14T10:24:05.156629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.139879Z","title":"Aesthet- ics and emotions in images","venue":null,"work_id":"99223f7e-02d6-4a9b-981c-714bf821f2de","year":2011},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.250943Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:5d20f8fc991f646b30678bedb0b29b87652532a87c2f27511bce0b1a36b0695f","observation_id":"94a421b9-2ceb-4378-9ba0-0c6106010fe4","resolution":{"observed_at":"2026-08-14T10:24:05.143799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.125957Z","title":"Speech & language processing","venue":null,"work_id":"d51c9ad9-e7bc-4891-9ebc-9b09f6bae458","year":2000},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.254735Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:61e1982a117e06f538cff3c1f5e6b3307a0f7f5641483b5e3d8db17770fa5d59","observation_id":"3c84bf26-605a-45cc-9188-a7023bf28576","resolution":{"observed_at":"2026-08-14T10:24:05.130681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.112947Z","title":"Recognizing image style","venue":null,"work_id":"ebd330b8-85ec-452c-ac74-b6b656de24cd","year":2014},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.258537Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:b4972eee9f07eadd843682bafae694c280a95ef7ac30f363451180c3f6bad60e","observation_id":"a6471b87-c060-47f0-a945-6916246239c6","resolution":{"observed_at":"2026-08-14T10:24:05.117459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.098429Z","title":"Deep visual-semantic align- ments for generating image descriptions","venue":null,"work_id":"f3b7c93b-92b4-46b1-bdfd-6be7840211d7","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.262782Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:08eb4fdb3ed5e774dd24ec1d82caf0530118e9b93cb28d7cf16f9d6c90bbf741","observation_id":"527555e9-49e6-47c3-90c7-05323acd738a","resolution":{"observed_at":"2026-08-14T10:24:05.102935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.084731Z","title":"The design of high- level features for photo quality assessment","venue":null,"work_id":"dc107d1d-804b-4664-8251-34db65bb7bc8","year":2006},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.266560Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:b905bde4e66f70392ed32f7a3049163e715168465669969cd14638051452a4a2","observation_id":"829db220-9ddc-46fb-8c2a-6e4cf06755de","resolution":{"observed_at":"2026-08-14T10:24:05.089323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.071660Z","title":"Where does data come from?, 2018","venue":null,"work_id":"a716573b-f1ec-48c2-a44c-65e9498adfca","year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.270458Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:47abd5b6d13011f6e995c745188ce95419e504b736bd3a402537b4c92a062d2c","observation_id":"22851789-3287-48f3-becc-7bc372a51cba","resolution":{"observed_at":"2026-08-14T10:24:05.075800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.057170Z","title":"neural-storyteller, 2015","venue":null,"work_id":"6d0a2b4e-8a2c-4493-a78b-68962cf1bce3","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.274112Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:8eb37e80a0e0729eab21d3859a05ecfdefd3c7b1287d73e45f36cbb9a53ad0ee","observation_id":"cc0a6cda-3928-44dc-b9a3-139c5dde2081","resolution":{"observed_at":"2026-08-14T10:24:05.062141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.045406Z","title":"Topic modeling and latent dirichlet allocation (lda) in python, 2018","venue":null,"work_id":"eb8af272-d191-40cf-903f-0234f4c64bc4","year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.277916Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:230803c8d5d812600dfdf7d02220254779a74b53cd38b701903766b3eb007059","observation_id":"fcb21edd-7ca4-4f15-863e-ec1928e104c7","resolution":{"observed_at":"2026-08-14T10:24:05.049510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.281691Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.281691Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:7db1100b378462168b6fc2092b607ee7bddb30490f118f8715c4654699f7e8ce","observation_id":"c1ae3843-3b89-45a5-bc9d-c8d7ddd2fcde","resolution":{"observed_at":"2026-08-14T10:24:04.281691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.285492Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.285492Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:af939558149c6d0f10cc646904eda2792e6d075d90917ca51b8d8ccb8a001dd6","observation_id":"f1e208ec-491d-498b-90c3-9dc1a195de74","resolution":{"observed_at":"2026-08-14T10:24:04.285492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.289289Z","title":"Fully convolutional networks for semantic segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.289289Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:9ec42bc8675e7419427c7360dd1b5e5bfa7d6d9a8924f8ac93527e169b1e8381","observation_id":"29e2b585-053e-46bd-a890-b7d6ee44867c","resolution":{"observed_at":"2026-08-14T10:24:04.289289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.010303Z","title":"Nltk: The natural language toolkit","venue":null,"work_id":"ab87249f-1306-421d-9afd-7bf817227c2d","year":2002},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.293021Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:11cbd4d868765df84ba95816c8e62bc3bf5a094e7bfc69423508236fa5b7dcf9","observation_id":"d4c53fdd-c054-49a6-859f-064b70f81499","resolution":{"observed_at":"2026-08-14T10:24:05.014548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.998002Z","title":"Rapid: Rating pictorial aesthetics using deep learn- ing","venue":null,"work_id":"67e61171-a3e3-48df-ab69-fff4105bce52","year":2014},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.297422Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:fcedce9176c94fea1cddde81cabcb5878608f0a412cdfd867160ec89407bab70","observation_id":"4b805a25-a5bf-4509-925c-f0d1badf6ae2","resolution":{"observed_at":"2026-08-14T10:24:05.002137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.986438Z","title":"Deep multi-patch aggregation network for image style, aesthetics, and quality estimation","venue":null,"work_id":"cf496f8c-9698-4d3a-b839-3bafd6f33ffb","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.301567Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:f95d2f2a1353bc32635651be38cf4d3c2db2fa856f091091e894f1e759562e6a","observation_id":"4e585c2b-d8f3-40a5-8e27-abd986535511","resolution":{"observed_at":"2026-08-14T10:24:04.990607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.974594Z","title":"An image captioning codebase in pytorch, 2017","venue":null,"work_id":"c936cf02-9887-4718-aadb-ebf521999a14","year":2017},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.305338Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:328fce0cc5222d5d7b62b88cfb74ca7f21b2c43c1a2c32c1fc793767eabfe6b8","observation_id":"cc1689d7-012f-4921-83bb-b8d126b5e6a6","resolution":{"observed_at":"2026-08-14T10:24:04.978806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.962004Z","title":"Photo and video quality eval- uation: Focusing on the subject","venue":null,"work_id":"c37599d1-a175-46a8-8eaf-a03985ff5484","year":2008},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.309055Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:421301f57c985ef66cfd0669cd1e0a05d80b53a78f23b7c729171483ff3534f9","observation_id":"fc8e7500-3c37-445f-88c1-4305401cb50b","resolution":{"observed_at":"2026-08-14T10:24:04.966335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.948151Z","title":"A-lamp: Adap- tive layout-aware multi-patch deep convolutional neural net- work for photo aesthetic assessment","venue":null,"work_id":"1506f9fc-fbb4-4eba-8454-b0abfd910f51","year":2017},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.312847Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:8f97768726b370c4c50c09bf96d610be6d5b01b90abb5c3e0be9e547b519be60","observation_id":"ac7878e7-bb2c-47f2-869e-6ed26846a302","resolution":{"observed_at":"2026-08-14T10:24:04.952183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.936731Z","title":"Composition-preserving deep photo aesthetics assessment","venue":null,"work_id":"9e464919-19b0-4069-adf6-017379d394df","year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.316663Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:b7d47631a22e2ae090870be18131d9df0d3f26c412edb22b39aac84501a7ac59","observation_id":"6d7b79db-cfc4-4961-98e9-61c4ae45f0a1","resolution":{"observed_at":"2026-08-14T10:24:04.940960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.925224Z","title":"Ask your neurons: A neural-based approach to answering questions about images","venue":null,"work_id":"8d187f21-4485-4ee9-9ef6-1de6d29c4022","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.320284Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:536d70c4549eebed24d3220e7a60d968341fb1c1c07b8f63f05d7dddaac34330","observation_id":"5ecebfa3-318a-4b31-9d9b-2bb0ff601f49","resolution":{"observed_at":"2026-08-14T10:24:04.929200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.913098Z","title":"Bapi, and Bipin Indurkhya","venue":null,"work_id":"81bdc85c-394b-4b27-a4da-d93c64204c32","year":2017},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.324011Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:da1c238ded43543084f0ee67e888d96b2c6c623bc62900be8f58c1c124b3e0c1","observation_id":"5e889382-5a02-42c5-bf64-36c5575f283d","resolution":{"observed_at":"2026-08-14T10:24:04.916853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.901538Z","title":"Generation and comprehension of unambiguous object descriptions","venue":null,"work_id":"95d797fe-f9a7-4b45-82aa-c33f8ab5a72c","year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.327903Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:e70ebaca8498a7cfa398838121aeb77ce9a30bf167a2dedf05eb184adb7c859c","observation_id":"777a9312-a642-41c3-a1d2-5093ab9fb243","resolution":{"observed_at":"2026-08-14T10:24:04.905476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.888029Z","title":"Learning like a child: Fast novel visual concept learning from sentence descriptions of images","venue":null,"work_id":"96598216-6be3-47f0-9b95-eb8b2e8209d5","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.331778Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:73eec987e51bfd95dc046e0be9ced054a98fade3ea66ef68fff3e825de7d4112","observation_id":"3e39564c-5565-4f6c-8324-02c60784a8f3","resolution":{"observed_at":"2026-08-14T10:24:04.892360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6632","last_updated":"2015-06-11T15:26:58Z","snapshot_observed_at":"2026-08-15T10:22:07.704120Z","submitted_at":"2014-12-20T08:10:04Z","title":"Deep Captioning with Multimodal Recurrent Neural Networks (m-RNN)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6632","snapshot_observed_at":"2026-08-14T10:24:04.335521Z","title":"Deep captioning with multimodal recurrent neural networks (m-rnn)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.335521Z"},"links":{"cited_paper":"/paper/1412.6632","citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:76092c8fd70d8478fa3fb3d4368ca35d932243cac7c9492c3d5dcdb7ba583f34","observation_id":"39242dbd-843a-48f6-81ab-dcbc58d14b51","resolution":{"observed_at":"2026-08-14T10:24:04.335521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.875856Z","title":"Dis- covering beautiful attributes for aesthetic image analysis","venue":null,"work_id":"fa9251f3-51b8-4190-92c3-5f9bea26598d","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.339479Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:8f455be56cb1b32dd38e8a68533cbf27d08ca1a68fa8b2621a1a6f330c712864","observation_id":"6b7a0b84-439f-49af-88af-4aee42ce8ef2","resolution":{"observed_at":"2026-08-14T10:24:04.880169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.863559Z","title":"Semstyle: Learning to generate stylised image captions using unaligned text","venue":null,"work_id":"05704572-1354-46c0-968f-e59a87dd4632","year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.343316Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:249aad7c8b3ba2f3978646a7c7b6ef77fe36db7368bc829d7df70c15beddffb8","observation_id":"9e9857c5-d891-4dfd-80d1-e662e7b3c76f","resolution":{"observed_at":"2026-08-14T10:24:04.867636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.851014Z","title":"From red wine to red tomato: Composition with context","venue":null,"work_id":"bb495456-d6ab-4e22-866b-d58d86fb3906","year":2017},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.346886Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:d55f0476adf5172d53650b5ddcd7c055c46fdbb440912884339f167de9c98ab3","observation_id":"29d3fbd4-d65f-4749-8c69-c64c2df73be3","resolution":{"observed_at":"2026-08-14T10:24:04.855244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.838612Z","title":"Ava: A large-scale database for aesthetic visual analysis","venue":null,"work_id":"364b5282-7640-403a-8f88-f327d39064cc","year":2012},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.350333Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:ca9b395fb18e5492f09867597c0d9998f77198b54957aa8977c2e353bc18ef4c","observation_id":"7ca0e98c-9562-431d-8c8a-882a03e3489c","resolution":{"observed_at":"2026-08-14T10:24:04.843016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.826785Z","title":"Attributes as op- erators: factorizing unseen attribute-object compositions","venue":null,"work_id":"98b6ae93-f6e7-4bdb-903f-524b3f976971","year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.354178Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:5118ca886568efe34752fe549a723dcfbb058b372f09a43a9ea394645e14f7f2","observation_id":"b87a05ba-02fe-4bfe-8895-b26872d9ce62","resolution":{"observed_at":"2026-08-14T10:24:04.830883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.814520Z","title":"Towards category-based aesthetic models of photographs","venue":null,"work_id":"5cb4a1d4-ac24-4a0c-bf31-9adecb788fbb","year":2012},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.358317Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:5fba26c0a53b565f082bf8600562b88375a04d481c3085cec8d3975943da9d45","observation_id":"b9f08163-cc1c-422d-9bec-625a699645b5","resolution":{"observed_at":"2026-08-14T10:24:04.818526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.802731Z","title":"Im2text: Describing images using 1 million captioned pho- tographs","venue":null,"work_id":"6755ae5d-66b3-4bc7-a880-c531b18b5736","year":2011},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.362027Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:b55102bb0d1f7dbea9996d133419611aa2462cbabb9e75594a10b26954bfde57","observation_id":"81f84e47-57a8-470d-9d1c-b77bbef2b78f","resolution":{"observed_at":"2026-08-14T10:24:04.806669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.790211Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"25e6dac4-445c-4372-bcb6-7731d2003d2a","year":2002},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.365633Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:e6bed1554ee0a9b10a79c591fc7e19d2bfe5b3c1ef4cfb9543543648eacac799","observation_id":"20f38f3b-13d0-4bea-8b66-11d01f992c51","resolution":{"observed_at":"2026-08-14T10:24:04.794538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.778042Z","title":"Relative attributes","venue":null,"work_id":"2399bf06-54bc-47f5-8976-446bcdff3848","year":2011},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.369486Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:d6a25fc668c4718f5f50cd63a6dbd75a054fdd9ed2b01bd23dab2cd5ca654d4b","observation_id":"b0706d63-55e8-4ce2-badc-21ab7c763631","resolution":{"observed_at":"2026-08-14T10:24:04.782070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.765308Z","title":"Flickr30k entities: Collecting region-to-phrase corre- spondences for richer image-to-sentence models","venue":null,"work_id":"a1c209d1-174c-4b0c-bb7a-141cc5f8d6c2","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.373319Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:c6951e5b28130416f1b54c8e360ea4b96fde7ffc9a2037b9466d9e57dfdaf7c2","observation_id":"41b82189-05e6-4589-9a8a-be39ac145dac","resolution":{"observed_at":"2026-08-14T10:24:04.769866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.753674Z","title":"Fast collapsed gibbs sampling for latent dirichlet allocation","venue":null,"work_id":"df2674e4-2b67-4777-8cd1-23eaa96881b0","year":2008},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.376982Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:8d17f251565c008191941e34bc28a2a77be313795af03b553d5cc4ba69fdc293","observation_id":"d0f0ccef-d2d5-46c6-a532-7678870ff954","resolution":{"observed_at":"2026-08-14T10:24:04.757761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.739541Z","title":"Using tf-idf to determine word relevance in document queries","venue":null,"work_id":"7b63e4e9-8d61-4731-9df3-70b909b5388c","year":2003},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.380882Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:310c15fb1e3da7862a31bffd2b159b88739005a52f903239bd6379dac5c818ba","observation_id":"21e65b31-6263-40d7-b580-89156c5baa97","resolution":{"observed_at":"2026-08-14T10:24:04.745149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.728282Z","title":"Deep tone mapping operator for high dynamic range images","venue":null,"work_id":"4667d1cd-4c63-499f-970b-0982a194d133","year":2019},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.384386Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:f2e226f9fbddfa396880949cee9c3ecfb599a7753e60dfbccfd2feaa93db806d","observation_id":"a79704a3-494a-46af-8b80-05a5e83c7894","resolution":{"observed_at":"2026-08-14T10:24:04.732379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.716335Z","title":"Fea- ture learning for the image retrieval task","venue":null,"work_id":"e4d773b6-fe1e-4524-b2d4-e5be66ff75ab","year":2014},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.388228Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:f844face40fddaef3a5cde3cdbe364caab04dc98b667c2854722840acbd45158","observation_id":"c48b3189-9f5a-4e63-a984-43e7bd3bfb98","resolution":{"observed_at":"2026-08-14T10:24:04.720250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.704448Z","title":"Cross-domain self- supervised multi-task feature learning using synthetic im- agery","venue":null,"work_id":"9ac96a04-7046-4162-a379-b6c0df0f96e9","year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.392030Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:2af7d9e163438521303635eec34055bac3b7b2cd526a41c6d772588c01b46455","observation_id":"511393d0-53b5-47ab-9ca3-f2e4f129e476","resolution":{"observed_at":"2026-08-14T10:24:04.708422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.692850Z","title":"The cross-entropy method: a uniﬁed approach to combinatorial optimization, Monte-Carlo simulation and machine learning","venue":null,"work_id":"602fa128-85c0-40e3-acb9-5578301db8e6","year":2013},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.395813Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:16e4f272c3a5c14b4c2fa54ed91b5ffaf5bc33a2ce985f162990e7befc80b41c","observation_id":"1a02bc04-0e1b-4e3c-ba36-28cea446b812","resolution":{"observed_at":"2026-08-14T10:24:04.697048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.679789Z","title":"Recognition us- ing visual phrases","venue":null,"work_id":"8af29c10-0c2b-4126-8905-b8e06d0f8cfe","year":2011},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.399300Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:6bc75a5cdf43ee1297d39c7206d465189acdb8308a9267ea925d7883d72410a7","observation_id":"e9a6fa07-9356-4a89-b612-6e2f9e5d2d20","resolution":{"observed_at":"2026-08-14T10:24:04.683677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.667022Z","title":"Leveraging user comments for aesthetic aware image search reranking","venue":null,"work_id":"f3b0f9e6-1a69-40e0-8b4d-c6599de0e665","year":2012},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.402995Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:5600d34efdfc7f19587236a59d91e3052ac59af9a42de933115f57a581404a00","observation_id":"2b4c3238-a0d3-4f89-8c8c-2be8b43ba859","resolution":{"observed_at":"2026-08-14T10:24:04.671674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.654488Z","title":"Neural algebra of classiﬁers","venue":null,"work_id":"65629e5d-6b44-4540-8de5-feefb934ac22","year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.406787Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:90c8cbac7ca8a5e673f5c4ecbccdf3900d8c3e5f76414e72df89ae6d20c11094","observation_id":"af27d25e-fbd2-4904-bf8d-a174fb1aaf89","resolution":{"observed_at":"2026-08-14T10:24:04.658513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.641730Z","title":"Conceptual captions: A cleaned, hypernymed, im- age alt-text dataset for automatic image captioning","venue":null,"work_id":"52bb0ff3-e993-46e7-83f1-d869c1f8d586","year":2018},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.410162Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:3f461e4682ac4462a2ee2d38a8c156599ef69f4a088844cfc979b1b601981ddc","observation_id":"4fb65cf1-35dc-4500-b77b-1fc5fbac8f4e","resolution":{"observed_at":"2026-08-14T10:24:04.646600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.629612Z","title":"Grounded compositional se- mantics for ﬁnding and describing images with sentences","venue":null,"work_id":"922ed475-e4cf-4f8d-8f20-fb8fa35b2d67","year":2014},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.413966Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:4bf9051af65dd53b2f60a7c83bda25810b1436c972c874e8adf4c48b97609d01","observation_id":"82868ee8-08a5-4675-97a7-43fce3007f6d","resolution":{"observed_at":"2026-08-14T10:24:04.633822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.617843Z","title":"Automatic con- cept discovery from parallel text and visual corpora","venue":null,"work_id":"75739b42-223a-405c-b14f-b53f0a435b3d","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.417701Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:df40164dc23f00a6f27b8425ad9d59eba531cb50fb97a06938bd0a2298da710b","observation_id":"758fc6d6-efd0-4ff0-9e96-d8cb453ff493","resolution":{"observed_at":"2026-08-14T10:24:04.622045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.605651Z","title":"Joint video and text parsing for under- standing events and answering queries","venue":null,"work_id":"a0aab434-b522-43dd-b1ca-e679b2781a05","year":2014},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.421262Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:5235c14cd03100ce5b5c5d2173713388eed5ee7ede2f41c54a5211f01c992476","observation_id":"ab985272-ef2a-4ba2-b64b-cfdfe178c4fb","resolution":{"observed_at":"2026-08-14T10:24:04.609786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.424914Z","title":"Cider: Consensus-based image description evalua- tion","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.424914Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:d413fd4ab745958225fcb4dfca38b497033e6d7df5f16f1ac077192dbf52a4c3","observation_id":"704e928f-040c-4b6a-b122-3a8302a088ba","resolution":{"observed_at":"2026-08-14T10:24:04.424914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.587249Z","title":"Au- tomatic attribute discovery with neural activations","venue":null,"work_id":"9defc7ce-24ff-48fb-afc8-8646e6bc7192","year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.428660Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:02b35fee43392bcbf96fc9c2a956c4e7548626447034c9369f18577e6dadf588","observation_id":"cb6797cf-80fa-41c7-8473-c35c96793a9c","resolution":{"observed_at":"2026-08-14T10:24:04.591137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.573806Z","title":"Walk and learn: Facial attribute representation learning from ego- centric video and contextual data","venue":null,"work_id":"de66f933-c6f8-497f-95d8-08f6d8741829","year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.432337Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:0d2784d4f5804edd378d61b5aa865b2e6841962f3bae9c91dbcf5d2196bfcca3","observation_id":"3d213678-fb3b-4842-9679-ce5c16c59311","resolution":{"observed_at":"2026-08-14T10:24:04.579010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.561084Z","title":"Show, attend and tell: Neural image caption gen- eration with visual attention","venue":null,"work_id":"8e5f8fbd-74b8-4a23-ab07-d47e7751275a","year":2015},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.436121Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:6d242488fbae7901fac75df1766f942d8a37eaf009156e6c49a6dc1d58f763eb","observation_id":"25e6614f-f5ef-4620-900b-da72924f1e01","resolution":{"observed_at":"2026-08-14T10:24:04.565311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.548381Z","title":"Learning to describe e- commerce images from noisy online data","venue":null,"work_id":"d373fcce-7d9a-4ff0-a3e7-3fcc6f3e2011","year":2016},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.439532Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:a263465e0296c9b8a699c264cb09d760e43736b5f088d2b9cb634fa983ff23c0","observation_id":"e123f454-3707-41f3-9d61-b80de5e8da33","resolution":{"observed_at":"2026-08-14T10:24:04.552753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.536741Z","title":"Color- net - estimating colorfulness in natural images","venue":null,"work_id":"2e64d743-b0ab-4505-a7bb-ad024d23a20e","year":2019},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.443128Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:dcf010e745ae90843be81ce2d721f821cb44d9883be0583cbcc3276e0bb79802","observation_id":"3030a32a-2435-43ef-9f7f-86896768bd7d","resolution":{"observed_at":"2026-08-14T10:24:04.540717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.524244Z","title":"Visual translation embedding network for visual relation detection","venue":null,"work_id":"381c95f8-c1bd-4c47-a642-3e06d92f1ad8","year":2017},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.447204Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:55525b3ddfb933c40cec6f3ad420e2b6afa665b100d9c46ba2f2d53ef1e53d67","observation_id":"e1db2032-4ee5-4289-b18d-72a4ff812a96","resolution":{"observed_at":"2026-08-14T10:24:04.528418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:04.512402Z","title":"Panda: Pose aligned net- works for deep attribute modeling","venue":null,"work_id":"062d0109-c6ba-4e41-b8de-0632268e3cc2","year":2014},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.451032Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:63c3e6eb4da80cef1e0fba226a31025efb4689d5127ecfd18319d7f89c1aa0b8","observation_id":"3c3f3df9-5bbb-4e33-b87d-76c0813908c9","resolution":{"observed_at":"2026-08-14T10:24:04.516329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:24:05.335337Z","title":"IEEE Conference on , pages 248–255","venue":null,"work_id":"087ea4b0-c575-4c02-b5fd-d952c3e03a8c","year":2009},"citing_paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-14T10:24:04.182469Z"},"links":{"citing_paper":"/paper/1908.11310"},"observation_digest":"sha256:8c1e8e55c350d91a9f2c1c4e529b982c47650aada87028305e7c6f7dc663d045","observation_id":"c33759a3-5e8a-41df-b007-8c1f35ea1135","resolution":{"observed_at":"2026-08-14T10:24:05.340208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.11310","last_updated":"2019-08-29T15:50:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T12:47:07.687597Z","submitted_at":"2019-08-29T15:50:28Z","title":"Aesthetic Image Captioning From Weakly-Labelled Photographs"},"reference_resolution":{"displayed":86,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":70},"total_outbound_references":86},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 86 of 86 outbound references and 1 inbound Pith citation observation for arXiv:1908.11310."}