{"as_of":"2026-08-17T19:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c58c515da0e5cb1b2df5117dc8d639576d9c772fbb8d088722a5c609a11e94e9","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:44:37.383365Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:22:37.555217Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T22:22:39.534674Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"cited_work":{"arxiv_id":"1908.02660","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.02660","snapshot_observed_at":"2026-08-06T22:22:39.534674Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","venue":"cs.CV","work_id":"18c615c4-e391-48c3-a505-bece3f803265","year":2019},"citing_paper":{"arxiv_id":"2506.21876","last_updated":"2025-06-27T03:24:29Z","snapshot_observed_at":"2026-08-16T09:54:48.614134Z","submitted_at":"2025-06-27T03:24:29Z","title":"Do Vision-Language Models Have Internal World Models? Towards an Atomic Evaluation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T22:22:37.555217Z"},"links":{"cited_paper":"/paper/1908.02660","citing_paper":"/paper/2506.21876"},"observation_digest":"sha256:a64f978f625155bd05cb8d3febe3a62495c9424eaf35d5172318ff9adace8046","observation_id":"7f3f7446-c88c-416c-a422-478b4e23c352","resolution":{"observed_at":"2026-08-06T22:22:39.582059Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.02660/citation-record","integrity":"/paper/1908.02660/integrity","json":"/paper/1908.02660/citation-record.json","paper":"/paper/1908.02660"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.821985Z","title":"Dont just assume; look and answer: Over- coming priors for visual question answering","venue":null,"work_id":"f45b3428-ebf3-4fca-8268-199283c8c4e0","year":2018},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.241568Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:7dc3b4edf8521d0ead1ccc2e7acf9aa29745ccc45c29b998f3253fb5a0f18aaa","observation_id":"77e3483e-3637-41c8-bc19-e67556a5c960","resolution":{"observed_at":"2026-08-14T14:44:37.825623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.812045Z","title":"Beat the machine: Challenging workers to ﬁnd the unknown unknowns","venue":null,"work_id":"86c49da8-4bfb-40ec-8135-1836143be91b","year":2011},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.246000Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:a78d53f6b9f84dca4c33972b634e8c154d945d2a63920f49bdeb1db14c9aeb98","observation_id":"cff5baa6-112a-4511-af23-618f4fa9a1a3","resolution":{"observed_at":"2026-08-14T14:44:37.815505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.07121","last_updated":"2018-06-10T20:34:21Z","snapshot_observed_at":"2026-08-14T21:05:13.218408Z","submitted_at":"2017-04-24T10:05:19Z","title":"Being Negative but Constructively: Lessons Learnt from Creating Better Visual Question Answering Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.07121","snapshot_observed_at":"2026-08-14T14:44:37.249742Z","title":"Being nega- tive but constructively: Lessons learnt from creating bet- ter visual question answering datasets","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.249742Z"},"links":{"cited_paper":"/paper/1704.07121","citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:656d63d2e1f424bb58adc2e4b3c3b42af6dc3c8fe6a1562a745d49a2273531a7","observation_id":"1ff05fe2-d91e-4ec4-92b4-ccca4700d4d0","resolution":{"observed_at":"2026-08-14T14:44:37.249742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-08-15T13:36:27.756066Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-14T14:44:37.253689Z","title":"Learning phrase representations using rnn encoder-decoder for statistical machine translation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.253689Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:7179f0740299a214c361914dea63efa8fcea946e27e3904cc619ed72c1bf4c46","observation_id":"19280984-437f-446b-903b-6750a2a41f11","resolution":{"observed_at":"2026-08-14T14:44:37.253689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.800927Z","title":"Detecting visual rela- tionships with deep relational networks","venue":null,"work_id":"0d6e66d3-7245-4b95-a649-123fcecb08b3","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.258061Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:b2ea1b7a722228618a915bd17d376e03bdbfb4975fe2bb254cfd0a8ae277295b","observation_id":"b87058a7-0754-4709-aa4f-df7aec27548b","resolution":{"observed_at":"2026-08-14T14:44:37.804853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.789957Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answer- ing","venue":null,"work_id":"3bdb5aa7-2a81-46aa-96d8-5db4ae7a9a3d","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.261898Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:d732e5de32c77666ee63caf91ede58b5a80a381ad06fcb8f63af339c10aaee92","observation_id":"549fd0b2-ce08-431f-9b85-e39061d8016e","resolution":{"observed_at":"2026-08-14T14:44:37.793658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.778868Z","title":"Grounding spatial relations for human-robot in- teraction","venue":null,"work_id":"8bfc3ebc-a3b7-4e96-9494-8102db6314ec","year":2013},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.266050Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:a168ce7c1f812397f7306ae150e25be382a936d026e27997af436ecdef14b9c8","observation_id":"e071efdd-2ef5-4c68-a833-065fb5461407","resolution":{"observed_at":"2026-08-14T14:44:37.782832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.269901Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.269901Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:fad86c4e4667befc5ed3b2af064784c94d4e0c25f7956ef1ba13796f9fa6f5ff","observation_id":"7d3f45db-f4f5-445b-b7b8-68d0584c9908","resolution":{"observed_at":"2026-08-14T14:44:37.269901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.761987Z","title":"Batch normalization: Accelerating deep network training by reducing internal co- variate shift","venue":null,"work_id":"18a4d77d-98c1-40e5-8b40-214f6c5e89f8","year":2015},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.273459Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:b8090ec474ca8ade96e6bd220d1c429c2af1416c61dc5f08e0db3c936befa62f","observation_id":"49c6b1a6-04bf-4bd6-8e01-ac1fa6a2c1e9","resolution":{"observed_at":"2026-08-14T14:44:37.765743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.751156Z","title":"Lawrence Zitnick, and Ross Girshick","venue":null,"work_id":"486a8135-4b91-4072-b225-defe895ceb65","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.277188Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:fb91954c6b1691fec664b8df881d4b122ab5f88170a01a145e81c414dbbb777d","observation_id":"8da74410-e8f3-499a-8712-ac55f0f789e3","resolution":{"observed_at":"2026-08-14T14:44:37.754671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.739735Z","title":"An analysis of visual question answering algorithms","venue":null,"work_id":"4a20a394-04c9-400f-8658-1e40c6e47427","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.280898Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:ef718864f1824cd9dd274e9d28946e029e7f8fc7da3d1a557d1b36ef183313a5","observation_id":"363a53c8-ef00-47f8-94f0-7dd1435b5184","resolution":{"observed_at":"2026-08-14T14:44:37.743686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.728276Z","title":"Active learning with gaussian processes for object categorization","venue":null,"work_id":"afcffb4d-58b5-4361-87d7-749e7ef36057","year":2007},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.284300Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:165e741c7bdfd8240679629a893e22b8cb692da76198fc7e50ea2e6d56559c68","observation_id":"0ea2d343-3a5f-4e9f-8bde-b5d852445ded","resolution":{"observed_at":"2026-08-14T14:44:37.732386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.716729Z","title":"Visual genome: Connecting language and vision using crowdsourced dense image annotations","venue":null,"work_id":"8c1c163b-d27a-4b56-b47e-e8947bc515ff","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.287919Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:3bccbd3142eb92d2455f295573d87ad9141f23d84b4861bf7b442d981840b447","observation_id":"7444ad61-1527-4282-bca0-3e4232c87a7f","resolution":{"observed_at":"2026-08-14T14:44:37.720624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00982","last_updated":"2020-02-21T15:15:33Z","snapshot_observed_at":"2026-08-14T18:05:03.518125Z","submitted_at":"2018-11-02T16:58:28Z","title":"The Open Images Dataset V4: Unified image classification, object detection, and visual relationship detection at scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00982","snapshot_observed_at":"2026-08-14T14:44:37.291646Z","title":"The open images dataset v4: Uniﬁed image classiﬁcation, object detection, and visual relationship detection at scale","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.291646Z"},"links":{"cited_paper":"/paper/1811.00982","citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:fc9420fcfdb365c31721eba6c73c8b49c790096222b9b3a36ff704d165bf776f","observation_id":"72b8d15d-e8aa-4f87-91e5-a9253a22fa56","resolution":{"observed_at":"2026-08-14T14:44:37.291646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.705047Z","title":"Whence and whither in spatial language and spatial cognition? Behavioral and brain sciences, 16(2):255–265, 1993","venue":null,"work_id":"b8524acb-c799-405b-97df-1b1a93b2169f","year":1993},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.295392Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:24d2d4f31c588f75c67a404e85a8fb92bdc5627aa66dc4f32502528c8a5ade6c","observation_id":"977e88b5-7f5f-4579-9ee0-fd2e69468400","resolution":{"observed_at":"2026-08-14T14:44:37.708734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.694632Z","title":"Vip-cnn: Visual phrase guided convolutional neural network","venue":null,"work_id":"79010b6d-093d-44fe-b5d9-039fc75e043f","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.298584Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:93599419b023ec319ad3a30baa6c5974201bca081b8865e1e6e3ebefd03a359b","observation_id":"e5caf37a-1aee-4679-a05c-1e9de34da380","resolution":{"observed_at":"2026-08-14T14:44:37.698227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.682155Z","title":"Factorizable net: an efﬁcient subgraph-based framework for scene graph generation","venue":null,"work_id":"aecb187d-eee1-43cb-892f-a83672fb8b45","year":2018},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.301446Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:f19ed150b44ace0cb3b8e238314988212a118064ec4d917d135e545335d1abf3","observation_id":"2a8e7aa1-742f-4d83-a9c1-1045b6d8e251","resolution":{"observed_at":"2026-08-14T14:44:37.686867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.670173Z","title":"Scene graph generation from objects, phrases and region captions","venue":null,"work_id":"6744ee77-d9f7-4937-aeef-744fa5caa024","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.304509Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:cab252b81dc3c138ca9202772d4728b2b18fdd3c6c7cca306c1a56a9f0588eb1","observation_id":"940aaf7e-b1da-463e-a53d-a7cc4241f802","resolution":{"observed_at":"2026-08-14T14:44:37.674216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.658882Z","title":null,"venue":null,"work_id":"750468a1-c2ba-4003-b7dd-fcad799c5423","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.307653Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:063c630cf2065b26e20f77cde8d12ab7d2f570a27040bc7005cc9f2402a5986f","observation_id":"91c05069-3097-4370-9b3f-0fbc413e1f4a","resolution":{"observed_at":"2026-08-14T14:44:37.662428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.310583Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.310583Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:751b3eeaab31ee5389daa96d6fdd7721afbf6bf28785f763e1474be660539f97","observation_id":"1d36838d-3916-4cb1-911c-9ee7c707195b","resolution":{"observed_at":"2026-08-14T14:44:37.310583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.640242Z","title":"Visual relationship detection with language priors","venue":null,"work_id":"59c61510-3a64-4cbf-95ee-1776c4f780a2","year":2016},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.314236Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:6244f652efefc25e80f5126dde76fe90d081211432b3f5a11cd42a7fa129b56e","observation_id":"443c874f-2115-42ea-8b2f-50dd4e4da21b","resolution":{"observed_at":"2026-08-14T14:44:37.644062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.628965Z","title":"Explicit bias discovery in visual question answering models","venue":null,"work_id":"70a62a3e-75e6-4d4c-bce2-81555c19c409","year":2019},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.317406Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:eb89ae293b6e7331b0f0f36d8b854e011cb50cfb3d952875efc141704b808a15","observation_id":"6f7de0b2-8d99-461f-8633-0a0782cc6ded","resolution":{"observed_at":"2026-08-14T14:44:37.633114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.320667Z","title":"Distributed representations of words and phrases and their compositionality","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.320667Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:b8f59898a19d26a08bb5d104d3a67cba3f94845090b072e4ec696d17037eca24","observation_id":"651e2a59-7ef1-4f47-acec-9c0f571c3b64","resolution":{"observed_at":"2026-08-14T14:44:37.320667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.324292Z","title":"Rectiﬁed linear units im- prove restricted boltzmann machines","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.324292Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:68aaa82c9841504e6fb4b00d3154e8a0dab51db55cf9be951f548b02fb82c7b1","observation_id":"2fc75eff-e5ba-43da-8c8f-c66a3dfd6d53","resolution":{"observed_at":"2026-08-14T14:44:37.324292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.328001Z","title":"Stacked hour- glass networks for human pose estimation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.328001Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:64554201b147a3a23a0673aa4dc839e6d65cd4bfa060c22c118658164750fb7b","observation_id":"cb799259-ba4a-4b21-b8ff-566f19abb09d","resolution":{"observed_at":"2026-08-14T14:44:37.328001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.332206Z","title":"Automatic differentiation in pytorch","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.332206Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:dd251f8b79fbabb3065a9a062f80a0119b86a2e5356149052bb47ed1dee9bf24","observation_id":"c3c6952e-a2b6-4f60-a22a-d01389ecd3f7","resolution":{"observed_at":"2026-08-14T14:44:37.332206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.589110Z","title":"Weakly-supervised learning of visual relations","venue":null,"work_id":"4e5c6f1d-1162-4098-adaf-f265894406d9","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.336014Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:258ec4e6f2f6251ee1f2b5f5797b46f361d1856e5004c59e7d8a71121c803c7d","observation_id":"d92d6d9e-040e-49d8-93bd-f7f6b904c9c8","resolution":{"observed_at":"2026-08-14T14:44:37.592873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.577472Z","title":"Recognition us- ing visual phrases","venue":null,"work_id":"ab8135d6-cb02-46db-89ea-735a2f9b35a8","year":2011},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.339937Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:61817c2dc262a6cc8bf6debc7d4c28d01c09543c3282dfc5033df02c2caaf4c1","observation_id":"a05d4b95-7938-4838-903e-1419f94c8cd7","resolution":{"observed_at":"2026-08-14T14:44:37.581610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.343606Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.343606Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:939120706a267928b2dfb46c9ade098079e16b93800cce1af0f03cfac3708a14","observation_id":"b1b822bb-4b5e-4553-ac11-a8b57d1afdbd","resolution":{"observed_at":"2026-08-14T14:44:37.343606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.560184Z","title":"Unbiased look at dataset bias","venue":null,"work_id":"e74603d2-68ce-4294-82ac-530b2fb870fd","year":2011},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.347240Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:cb784a59d17d052e32bcc41775b176cbe2f0f7d470574a85126587f4501c9542","observation_id":"e58f0b67-7538-4053-b867-3861152e1399","resolution":{"observed_at":"2026-08-14T14:44:37.563809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.548092Z","title":"Large- scale live active learning: Training object detectors with crawled data and crowds","venue":null,"work_id":"f93c1794-a33c-4702-b5cc-32c88101e9a7","year":2014},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.350947Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:78fe4a4e5ef42e28b3bd245459001019f01d3e036a51115f20d8d69cfe86cc31","observation_id":"3361398d-9991-4647-bae3-4d8ec205b372","resolution":{"observed_at":"2026-08-14T14:44:37.551404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.538048Z","title":"Linknet: Relational embedding for scene graph","venue":null,"work_id":"a4610d70-0b82-421a-a6a3-0ad48dc0e058","year":2018},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.354534Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:aee17d1ad336c10d1414ed34459ca907490356386794bbc8a6b53bdb36108459","observation_id":"7607c6c1-02de-4137-a0cb-aa64c4d635a2","resolution":{"observed_at":"2026-08-14T14:44:37.541315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.528522Z","title":"Choy, and Li Fei-Fei","venue":null,"work_id":"5190a0d9-2b0d-4d1c-b4e1-c0bc0ac0adfc","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.358119Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:6d7c88fb1963b8dee708a79927cad7bf6df1aa8fd4064492571fa0f39c25382f","observation_id":"5fc408da-dd93-45b3-93f0-a04192799612","resolution":{"observed_at":"2026-08-14T14:44:37.531592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.518532Z","title":"Shufﬂe-then- assemble: Learning object-agnostic visual relationship fea- tures","venue":null,"work_id":"0a6245f3-a32d-4079-ab54-9be6c231bcda","year":2018},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.361567Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:d6d37030fbb1d7a8047333ed884b28e4dabe07294aca0ba98e81fa093a935a45","observation_id":"08241787-bb75-45a2-b0a4-893cf019b9e1","resolution":{"observed_at":"2026-08-14T14:44:37.521793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.506853Z","title":"Morariu, and Larry S","venue":null,"work_id":"7e433125-f5d3-4e6e-ab61-cbba5330b763","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.365300Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:7c7910d10950be2f5f3748bf67ca30b70d46ccebb626de04b1ed16f6b16bea4b","observation_id":"9419c0cc-ef39-43dc-bcc7-9ac93aa2746b","resolution":{"observed_at":"2026-08-14T14:44:37.510672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.494817Z","title":"Semantic robot programming for goal- directed manipulation in cluttered scenes","venue":null,"work_id":"ee330436-11d8-4c7b-a8ee-ef7539d779ed","year":2018},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.368725Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:e84f81d982aec032ca8887e4d5fcbc62f5eeda941738398bc788840d50ed37c7","observation_id":"3be03521-cf54-4c2f-8a3c-3e3520c6b1de","resolution":{"observed_at":"2026-08-14T14:44:37.498879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.482859Z","title":"Visual translation embedding network for visual relation detection","venue":null,"work_id":"e3e53619-3ae7-4e59-a4c2-d3ec749cae5a","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.372549Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:05b803666735a15f3da12f56030db542385f7152ef035535dadcff53b7702f30","observation_id":"8ad3cdbf-39af-47ea-850f-46d0875148c5","resolution":{"observed_at":"2026-08-14T14:44:37.487232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.471031Z","title":"Ppr-fcn: Weakly supervised visual relation detec- tion via parallel pairwise r-fcn","venue":null,"work_id":"1855ac55-3b44-4d6b-887a-d3d2af38fd3b","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.376283Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:ad7bcdd4e19b8be9fa3dd6d9f97520c83eb8d93e6d35d360b6c34afaebfa4542","observation_id":"0718cfb1-edf8-4444-a8e1-e13da9d47928","resolution":{"observed_at":"2026-08-14T14:44:37.475083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.459202Z","title":"Yin and yang: Balancing and an- swering binary visual questions","venue":null,"work_id":"adc49e65-2936-4562-95d6-bdf1ac714181","year":2016},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.380039Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:c0f8fcb3d4ca72fec3b2d5227d611ec7e44e6f9edc3280bc065734a5a5223207","observation_id":"c2a3c9c0-1eac-4ab0-a8de-441e4aded287","resolution":{"observed_at":"2026-08-14T14:44:37.463249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:44:37.445352Z","title":"Towards context-aware interaction recognition for visual re- lationship detection","venue":null,"work_id":"723f0053-7443-446b-8857-23b6f65007e3","year":2017},"citing_paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T14:44:37.383365Z"},"links":{"citing_paper":"/paper/1908.02660"},"observation_digest":"sha256:270a660614f6ed2adce06681784ae2b080023d64e6c5a82b71936989e77f5e57","observation_id":"4d2487b3-931a-4367-a1cc-36401623dd2c","resolution":{"observed_at":"2026-08-14T14:44:37.451302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.02660","last_updated":"2019-08-29T20:30:38Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T06:04:15.667040Z","submitted_at":"2019-08-07T14:41:30Z","title":"SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation Recognition"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:1908.02660."}