{"as_of":"2026-08-10T15:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7858974a4405aa1b06f9023cdd225962989e7cc6e5230f5f0dac8a3133406f88","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:30:45.710548Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02291/citation-record","integrity":"/paper/2506.02291/integrity","json":"/paper/2506.02291/citation-record.json","paper":"/paper/2506.02291"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.646604Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.646604Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:4b852a5d10eed32818da9ea065ca6c2a875a8ee93cd59377153e94ef4519d0c3","observation_id":"3066be84-79b5-4e9d-9294-fa72899d1869","resolution":{"observed_at":"2026-08-07T11:30:45.646604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.650543Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.650543Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:0e40b85312e66582b0b817f2a4fc390466cfaccbd9bb5677dc85bdeb0d46b72a","observation_id":"1a9db0b0-340d-4dfd-a27f-7e1daa0190c6","resolution":{"observed_at":"2026-08-07T11:30:45.650543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-08-07T11:30:45.654665Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.654665Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:7aa7b1b172b339179d430b4442bf7429c418dc19b7f6193f4ccd681b64efc2bc","observation_id":"01168198-2b48-4807-9edc-b9fe66dcc032","resolution":{"observed_at":"2026-08-07T11:30:45.654665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9028.18066","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.869676Z","title":"Henry, Robert Bradshaw, and Nathan Weizenbaum","venue":null,"work_id":"39491e8d-d450-4043-9846-66871d03862b","year":2010},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.658280Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:44ccd1cd9add2901cf8bf6d37764263c8648a93b45297a6e2e65ffbf3bcd5100","observation_id":"dd92cc51-74b2-439a-bd74-676d5792204d","resolution":{"observed_at":"2026-08-07T11:30:45.874097Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.08981","last_updated":"2021-03-30T08:20:34Z","snapshot_observed_at":"2026-08-09T09:33:13.219731Z","submitted_at":"2021-02-17T19:15:53Z","title":"Conceptual 12M: Pushing Web-Scale Image-Text Pre-Training To Recognize Long-Tail Visual Concepts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.08981","snapshot_observed_at":"2026-08-07T11:30:45.661946Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.661946Z"},"links":{"cited_paper":"/paper/2102.08981","citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:ea0298911ccc8e623e25d6a4a90d4ca7e963f19b082a2fb34e01a9d0bcb0b32c","observation_id":"2ad43a37-cd7d-49f7-9fb6-bd9a39efa155","resolution":{"observed_at":"2026-08-07T11:30:45.661946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.969946Z","title":null,"venue":null,"work_id":"4341419c-52f8-4a03-93bf-9984b918adec","year":2023},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.665858Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:4a8da8aee7fd6fcec84c5c7b10ba6e113821b2a0c56b262c58cb99eba0e6340c","observation_id":"9b5982c7-7d77-4efe-895f-33a614e8978c","resolution":{"observed_at":"2026-08-07T11:30:45.974034Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.961210Z","title":"https://en.wikipedia.org/wiki/Wikipedia:Copyrights","venue":null,"work_id":"9f6ea0b9-b47d-4a03-adbe-bbdf8c929b41","year":null},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.669093Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:74c5722d2a0b6a842f92d46cee6243d29790f929d22f729358e7c8c6af256827","observation_id":"11d87df8-1fcb-424e-a10c-1d7aeb5357f2","resolution":{"observed_at":"2026-08-07T11:30:45.964338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.07120","last_updated":"2022-11-15T14:45:18Z","snapshot_observed_at":"2026-08-09T16:40:03.213411Z","submitted_at":"2022-04-14T17:21:14Z","title":"Exploring Dual Encoder Architectures for Question Answering","version":2},"cited_work":{"arxiv_id":"2204.07120","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.07120","snapshot_observed_at":"2026-08-07T11:30:45.757179Z","title":"Exploring Dual Encoder Architectures for Question Answering","venue":"cs.CL","work_id":"3de52b22-2758-42ce-ba1b-f9e2a5a78920","year":2022},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.672337Z"},"links":{"cited_paper":"/paper/2204.07120","citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:1a3d0b059c5ab47e4efb094bed29e6f99bd84bfeee7d971d40124ff36b9e931a","observation_id":"fbae1094-6e6c-4d3b-a3a4-aeaf398a1f07","resolution":{"observed_at":"2026-08-07T11:30:45.762105Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T11:30:45.676559Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.676559Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:b83706556926fedc2f3e0d12eea45692bcc8f5b0922ad0c741787494ec963d2d","observation_id":"d9e05f05-94aa-4048-a8fb-d0d5d82e4521","resolution":{"observed_at":"2026-08-07T11:30:45.676559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.951827Z","title":null,"venue":null,"work_id":"e77f80b5-b14a-4385-bbbf-23d0207ae927","year":null},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.680256Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:1e5b68f2db657574164978420c96624a4a47e40771099d976b0d0446ae0b9fe7","observation_id":"0590c774-3e93-41b0-a2ca-145e4abf454a","resolution":{"observed_at":"2026-08-07T11:30:45.955520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.943343Z","title":null,"venue":null,"work_id":"6983af0d-fae9-45fe-8076-5a12803b1dbb","year":null},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.683341Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:88f7be365f70797d24cc8b48406610243b290ef4ea3baa4f032750b9d8cd3347","observation_id":"7cae9b37-43a0-4e06-ad8e-0fd788ee6af0","resolution":{"observed_at":"2026-08-07T11:30:45.946239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.933457Z","title":"Huang, Xiao Zhang, Menglong Zhu, Yuan Li, Yang Zhao, and Larry S","venue":null,"work_id":"6fbc8407-7ab0-412d-ad42-4949aac7a733","year":2017},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.687079Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:a2f0dd36e8717bbc4ad151ef04592069dee033371e09355b90a783d3ab3dc121","observation_id":"7684efa8-d586-4738-b417-b8e67a789194","resolution":{"observed_at":"2026-08-07T11:30:45.937456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.924779Z","title":null,"venue":null,"work_id":"6bf38d13-07f6-4295-8812-e2c07bd44ab4","year":2019},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.690165Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:2b080427adcfc0a8acca4f3a573ddf33cad1b66debc3e16afd1b2082a188a1b4","observation_id":"2c17ff50-fc56-4df8-8cee-bb1bef43def2","resolution":{"observed_at":"2026-08-07T11:30:45.927725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.915381Z","title":"https://github.com/google-research-datasets/wit/blob/main/LICENSE","venue":null,"work_id":"44ea04ce-3bc5-44a5-9c39-8940f0acae7f","year":null},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.694114Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:bb801104efbf6dbcd9f0f81d9fa2cd2d630f5bef823b747408fdb19bdca89d27","observation_id":"d47ef6a5-a51b-4bfb-9106-1b41704e5a98","resolution":{"observed_at":"2026-08-07T11:30:45.919188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.903442Z","title":"Lawrence Zitnick","venue":null,"work_id":"68c144a2-60cd-4113-996a-5d5079005c48","year":2014},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.697474Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:ce2b0f9aa3ede3b62e018905897485a0823638067ed70575a1604436458e2dbc","observation_id":"bcb81b26-2a99-439c-89ec-4d2b0c8c81cf","resolution":{"observed_at":"2026-08-07T11:30:45.909673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.04235","last_updated":"2018-04-11T21:42:32Z","snapshot_observed_at":"2026-07-06T06:32:58.709094Z","submitted_at":"2018-04-11T21:42:32Z","title":"Adafactor: Adaptive Learning Rates with Sublinear Memory Cost","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.04235","snapshot_observed_at":"2026-08-07T11:30:45.700365Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.700365Z"},"links":{"cited_paper":"/paper/1804.04235","citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:ca731f0b0e1bb8302ebf11ff769f66447ba14151e4ebe18a8f0d18511b914e01","observation_id":"603d35d0-3b3d-4943-9b5c-8080b147777b","resolution":{"observed_at":"2026-08-07T11:30:45.700365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.892882Z","title":null,"venue":null,"work_id":"6514ff5d-e998-47f1-80ec-d65861c4c1e0","year":2021},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.703723Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:54d4cf92734da934775bfbfe463aa0c4ce8a61ed2f3a1cc607b309fdc205c686","observation_id":"f3811296-a255-4b8c-93df-31f865ff9f4d","resolution":{"observed_at":"2026-08-07T11:30:45.896956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11934","last_updated":"2021-03-11T18:45:13Z","snapshot_observed_at":"2026-08-09T05:32:57.900052Z","submitted_at":"2020-10-22T17:58:14Z","title":"mT5: A massively multilingual pre-trained text-to-text transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11934","snapshot_observed_at":"2026-08-07T11:30:45.706545Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.706545Z"},"links":{"cited_paper":"/paper/2010.11934","citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:e2b237972c65b997b173412032479e0f99fc2bd44e9a8fdb14af994c44d539f6","observation_id":"d9529cdc-2f58-43b7-a861-d0f7558cd611","resolution":{"observed_at":"2026-08-07T11:30:45.706545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:30:45.710548Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:30:45.710548Z"},"links":{"citing_paper":"/paper/2506.02291"},"observation_digest":"sha256:7acc9e4125d3e3f9f793d5cb29a2b4590fae6da28f148e39bb5f73720e0002dd","observation_id":"4ac10b70-343d-42eb-9e99-ff25299d2503","resolution":{"observed_at":"2026-08-07T11:30:45.710548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02291","last_updated":"2025-06-02T22:04:06Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T16:40:01.768827Z","submitted_at":"2025-06-02T22:04:06Z","title":"Entity Image and Mixed-Modal Image Retrieval Datasets"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2506.02291."}