{"as_of":"2026-08-16T23:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d72eda79d33eec388c4efeea9bd4376afd1ef28d6b95147b48eb9a295794121","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:12:08.806060Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12532/citation-record","integrity":"/paper/2608.12532/integrity","json":"/paper/2608.12532/citation-record.json","paper":"/paper/2608.12532"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1311.2971","last_updated":"2013-11-12T22:15:26Z","snapshot_observed_at":"2026-08-16T08:47:45.115093Z","submitted_at":"2013-11-12T22:15:26Z","title":"Approximate Inference in Continuous Determinantal Point Processes","version":1},"cited_work":{"arxiv_id":"1311.2971","doi":null,"metadata_source":"pith","pith_arxiv_id":"1311.2971","snapshot_observed_at":"2026-08-16T00:12:09.971218Z","title":"Approximate Inference in Continuous Determinantal Point Processes","venue":"stat.ML","work_id":"ad538e05-1a18-4357-be86-cd7aed7cba41","year":2013},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.453720Z"},"links":{"cited_paper":"/paper/1311.2971","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:49f35b5d433dd6fec5c36ec56cb61fdfb18aa63a02fcdfa6e83823af837100d6","observation_id":"d4dbe156-d24f-4e83-9f29-2c5b1fbf0640","resolution":{"observed_at":"2026-08-16T00:12:09.978058Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/1498759","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.874921Z","title":null,"venue":null,"work_id":"4fefbce7-4a1c-4a39-b1a5-15d207631078","year":2009},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.460874Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:64cceb64d104c26aa314bbc9db9504b26f0db56f7eb91ee803f3e391dff13bc0","observation_id":"1961d953-885c-4543-92ed-d205ebf8d168","resolution":{"observed_at":"2026-08-16T00:12:08.881202Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-07-06T13:05:12.350238Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.14198","snapshot_observed_at":"2026-08-16T00:12:08.467239Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.467239Z"},"links":{"cited_paper":"/paper/2204.14198","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:ad0025c7117ed24c1c6cc14e4892cb54926163246d48acd08d19622562325b6c","observation_id":"186f881d-142a-4645-9ff8-e75c35dcd6f7","resolution":{"observed_at":"2026-08-16T00:12:08.467239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.348057Z","title":null,"venue":null,"work_id":"5c62080d-4a3b-46b2-b184-d8bb520c274a","year":2017},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.472735Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:b440f61828d8f542ef1bbfc373ffa6869790161e068f8f3ce22ebe482e6d3f62","observation_id":"9dd8a055-b0e3-4684-92ae-92861a8aa046","resolution":{"observed_at":"2026-08-16T00:12:10.353795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.330244Z","title":null,"venue":null,"work_id":"227dc0f2-ac67-4bed-9517-7053797940b2","year":2006},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.480282Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:fb75eaebcf8758bba08f11ce4f05d89e980fd0fb7d1ba2d3788b9d3ec80e20ac","observation_id":"7490f639-693a-4fde-bcaf-04e7b525a7c0","resolution":{"observed_at":"2026-08-16T00:12:10.335576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.313254Z","title":null,"venue":null,"work_id":"9d0c0a31-16b7-4e6e-b7b9-5a6875e3cf6a","year":2017},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.488344Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:6062f8d26807ef1e8030b3ce3356a895f06b39c936365d3bda4ffaa9f23375ca","observation_id":"da8d9f6b-130c-4a33-b921-1f7aadbd06db","resolution":{"observed_at":"2026-08-16T00:12:10.318049Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.293722Z","title":null,"venue":null,"work_id":"a48e58ee-bf17-4078-b242-04a2d625e70b","year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.495164Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:f3f30c374aa5920882cd9a7fcaab47e3f0919df4b572c3ed68a79e9fdba0135f","observation_id":"1d7285b9-65c3-4754-b8d0-4741a9171608","resolution":{"observed_at":"2026-08-16T00:12:10.299266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.507283Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.507283Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:f364344daf7c19bd497a1b7f09f69d9d4be76aee8e43e0ec51759c44b186fd5a","observation_id":"939426ae-fe3f-45e3-ad3e-778583142945","resolution":{"observed_at":"2026-08-16T00:12:08.507283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.273142Z","title":null,"venue":null,"work_id":"e63362e8-3111-4af2-b161-1cf61dc45e76","year":2018},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.513691Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:f75f52e251aeb0fc4715673ace97e3a87e1ccab463acef5092e013132256ef95","observation_id":"a7cbc843-5ee4-4320-ada5-cb6e7da0509b","resolution":{"observed_at":"2026-08-16T00:12:10.277850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.255016Z","title":null,"venue":null,"work_id":"e24d8c6a-474b-4907-a424-cba1cefd8f8b","year":2024},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.518541Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:89d89b496b0a110243df3da324e212dff6f4fb2f9c87c4ffb6abd9dd150ec9d5","observation_id":"5c222176-9ba9-409e-949e-c821651c6c79","resolution":{"observed_at":"2026-08-16T00:12:10.260961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11740","last_updated":"2020-07-17T22:19:59Z","snapshot_observed_at":"2026-08-09T19:02:25.484253Z","submitted_at":"2019-09-25T20:02:54Z","title":"UNITER: UNiversal Image-TExt Representation Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11740","snapshot_observed_at":"2026-08-16T00:12:08.524191Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.524191Z"},"links":{"cited_paper":"/paper/1909.11740","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:e1f082180ae394b3942184b4e2ab89a176a99e2bb3bc7f8802fd949b3ef43791","observation_id":"cbc61fdb-edcc-469f-b999-c395dde7d123","resolution":{"observed_at":"2026-08-16T00:12:08.524191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.529322Z","title":"Bruce Croft","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.529322Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:b47cc1d78404a031317eaab2cb07641d4874c86bd63599f4de0fc2febb79dd6f","observation_id":"730050d4-6d3c-480b-aa68-a9ce65cd0b3a","resolution":{"observed_at":"2026-08-16T00:12:08.529322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1102.3975","last_updated":"2011-02-25T01:12:26Z","snapshot_observed_at":"2026-08-15T04:54:14.968472Z","submitted_at":"2011-02-19T07:25:00Z","title":"Submodular meets Spectral: Greedy Algorithms for Subset Selection, Sparse Approximation and Dictionary Selection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1102.3975","snapshot_observed_at":"2026-08-16T00:12:08.534150Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.534150Z"},"links":{"cited_paper":"/paper/1102.3975","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:40ab2d6742468fc29c9be6dd5e0889453e15a9201f4e1f88e69c62e76028d8ae","observation_id":"6612cc48-66dd-49f3-9636-a9344a187bf7","resolution":{"observed_at":"2026-08-16T00:12:08.534150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0912.0322","last_updated":"2011-11-06T22:23:46Z","snapshot_observed_at":"2026-08-15T05:32:32.434938Z","submitted_at":"2009-12-02T02:02:27Z","title":"Submodular Functions: Extensions, Distributions, and Algorithms. A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0912.0322","snapshot_observed_at":"2026-08-16T00:12:08.539393Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.539393Z"},"links":{"cited_paper":"/paper/0912.0322","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:db5bfead5890d5f09211fa5d49fb8d40c0cbdd8b28ee24fd21dd9c88e1147867","observation_id":"a34fd930-33d2-4572-80e5-eade19308034","resolution":{"observed_at":"2026-08-16T00:12:08.539393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.237335Z","title":"Fleet, Jamie Ryan Kiros, and Sanja Fidler","venue":null,"work_id":"f98412cd-eb29-4290-a0e1-26a801a09276","year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.544243Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:49d884fd3a3d656bd39c6df687adacfead2d92f9682ef2d659f8f618f41e0a37","observation_id":"3f5a4333-32c1-4fb8-8f59-2d09e7893ffb","resolution":{"observed_at":"2026-08-16T00:12:10.242818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02410","last_updated":"2023-07-02T22:58:51Z","snapshot_observed_at":"2026-08-16T16:26:39.313657Z","submitted_at":"2022-10-05T17:32:16Z","title":"The Vendi Score: A Diversity Evaluation Metric for Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02410","snapshot_observed_at":"2026-08-16T00:12:08.554593Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.554593Z"},"links":{"cited_paper":"/paper/2210.02410","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:6da41a22373fa65fc8e2d838bc17854e440f9f35f997afd0147313eb91b15bb3","observation_id":"98cc21dc-2dd8-4962-b82d-5986f1983eab","resolution":{"observed_at":"2026-08-16T00:12:08.554593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.217045Z","title":"Corrado, Jonathon Shlens, Samy Bengio, Jeffrey Dean, Marc’Aurelio Ranzato, and Tomas Mikolov","venue":null,"work_id":"ec42d2e4-8b95-4887-b729-a4469b840308","year":2013},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.559831Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:dafe1ae7ed18d6d50db32541df12aa93510dd2477039b8946b9fe412a7dd198b","observation_id":"f8a1e626-0a5d-4de4-ba86-adb272d68aac","resolution":{"observed_at":"2026-08-16T00:12:10.222701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1207.0560","last_updated":"2013-08-24T05:35:11Z","snapshot_observed_at":"2026-08-15T00:54:36.137079Z","submitted_at":"2012-07-03T01:25:10Z","title":"Algorithms for Approximate Minimization of the Difference Between Submodular Functions, with Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1207.0560","snapshot_observed_at":"2026-08-16T00:12:08.565556Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.565556Z"},"links":{"cited_paper":"/paper/1207.0560","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:8a898d006086575b39c13fe374f99d2f3ce80bf7914d9283cf2a3b57bae2b41f","observation_id":"6ebcc7e9-5ff9-40de-b24d-58b07db4d237","resolution":{"observed_at":"2026-08-16T00:12:08.565556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1311.2106","last_updated":"2013-11-08T23:28:02Z","snapshot_observed_at":"2026-08-14T23:55:56.018259Z","submitted_at":"2013-11-08T23:28:02Z","title":"Submodular Optimization with Submodular Cover and Submodular Knapsack Constraints","version":1},"cited_work":{"arxiv_id":"1311.2106","doi":null,"metadata_source":"pith","pith_arxiv_id":"1311.2106","snapshot_observed_at":"2026-08-16T00:12:09.661387Z","title":"Submodular Optimization with Submodular Cover and Submodular Knapsack Constraints","venue":"cs.DS","work_id":"a654fb73-d3e2-4500-b1e3-b3a56c73b64c","year":2013},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.571927Z"},"links":{"cited_paper":"/paper/1311.2106","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:9fa845640097d55d792f070492d43d032aacfa8919b761289aa210fdf9008b43","observation_id":"5c7c92ae-6ff9-4c63-aa59-1f6663a16862","resolution":{"observed_at":"2026-08-16T00:12:09.666903Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05918","last_updated":"2021-06-11T07:51:39Z","snapshot_observed_at":"2026-08-16T18:46:16.265182Z","submitted_at":"2021-02-11T10:08:12Z","title":"Scaling Up Visual and Vision-Language Representation Learning With Noisy Text Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05918","snapshot_observed_at":"2026-08-16T00:12:08.581177Z","title":"Le, Yunhsuan Sung, Zhen Li, and Tom Duerig","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.581177Z"},"links":{"cited_paper":"/paper/2102.05918","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:176c5e1847f0adf7e68c251ac844d591f7755b5ff21bc06e04e46af7610a2924","observation_id":"e59a47cb-8137-4931-a00c-1b059f3e6e87","resolution":{"observed_at":"2026-08-16T00:12:08.581177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03334","last_updated":"2021-06-10T17:15:46Z","snapshot_observed_at":"2026-08-16T18:47:26.631995Z","submitted_at":"2021-02-05T18:36:11Z","title":"ViLT: Vision-and-Language Transformer Without Convolution or Region Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.03334","snapshot_observed_at":"2026-08-16T00:12:08.587553Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.587553Z"},"links":{"cited_paper":"/paper/2102.03334","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:988812740a8c443e0623c98b1d4858ea01bff81c6207f1c01a476ba9a35fec03","observation_id":"5b9568b8-3fc4-4537-a771-ed819cc9b0cb","resolution":{"observed_at":"2026-08-16T00:12:08.587553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7777.11277","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:09.598269Z","title":"Krause, C","venue":null,"work_id":"205ae28f-6682-4f98-b3e5-07e8ac180f9b","year":2006},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.593062Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:038f1c62ae937ae8015cdeab4ab9200d1a97edf6bd47c6671699ca843ad4502c","observation_id":"6587dc4b-7e08-4da8-bde2-e8d2875003f7","resolution":{"observed_at":"2026-08-16T00:12:09.608051Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.07332","last_updated":"2016-02-23T22:00:40Z","snapshot_observed_at":"2026-08-14T22:09:05.495219Z","submitted_at":"2016-02-23T22:00:40Z","title":"Visual Genome: Connecting Language and Vision Using Crowdsourced Dense Image Annotations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.07332","snapshot_observed_at":"2026-08-16T00:12:08.599566Z","title":"Shamma, Michael S","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.599566Z"},"links":{"cited_paper":"/paper/1602.07332","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:dffbace56fc456230864ca8758642866f4c6a5a6d0c95f50a978e327816c52c3","observation_id":"fb4e51b1-1ae0-49aa-b948-932b3ab4c6ea","resolution":{"observed_at":"2026-08-16T00:12:08.599566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.199881Z","title":null,"venue":null,"work_id":"5b113664-b2c9-49eb-a32c-4f2a7faeb9d9","year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.607848Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:3232a9c04aa7f6c8076cde51b9b75bb949150924d9d889bf67225be170d16987","observation_id":"61e67617-4be6-4314-89ae-c773ff807522","resolution":{"observed_at":"2026-08-16T00:12:10.205281Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.614330Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.614330Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d76c0283251fefa110e2b41d532f362d2f57cb6bf5404e477f9803877c5bd4fe","observation_id":"9db7dba7-abbc-45f0-b19f-b98924d2c8ef","resolution":{"observed_at":"2026-08-16T00:12:08.614330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.620349Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.620349Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:45bac6c27fe7d495c438af0a214b5a727b2ceb03f2be3339792ca938b36cd554","observation_id":"144054c1-b9a3-483c-a04d-61fbed774c4b","resolution":{"observed_at":"2026-08-16T00:12:08.620349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.08024","last_updated":"2018-07-23T04:41:57Z","snapshot_observed_at":"2026-08-14T19:33:52.138713Z","submitted_at":"2018-03-21T17:22:27Z","title":"Stacked Cross Attention for Image-Text Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08024","snapshot_observed_at":"2026-08-16T00:12:08.625959Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.625959Z"},"links":{"cited_paper":"/paper/1803.08024","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:ddf41edb8e5d1e9a9f25467a6b45b0e670f9c1f9bb762477f1e611d534318277","observation_id":"49667ef4-6ca0-4611-b7a4-acf435fc2916","resolution":{"observed_at":"2026-08-16T00:12:08.625959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.631290Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.631290Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:46a8ea7c6740787e8c074a9743b636b29761cc8a3cdf1f40278a6552eb194ae7","observation_id":"fc1bff25-a0fc-431a-b186-51bcf1541119","resolution":{"observed_at":"2026-08-16T00:12:08.631290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-16T00:12:08.635930Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.635930Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:27c2da6f22481a85f72f12d8e25b78d7476d44e7e07685d9b2fb72379ad0fb93","observation_id":"142f4c79-9716-4b9d-846b-a104524d20d0","resolution":{"observed_at":"2026-08-16T00:12:08.635930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.641323Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.641323Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:62ac4670e592ffed4ae8c084cbdacd5ec9f2c07507bb7335343f4ee98c31e726","observation_id":"126d8755-12c5-46e8-bf04-d0d2ff4fe3c7","resolution":{"observed_at":"2026-08-16T00:12:08.641323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.647393Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.647393Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:022c9fa1fad931d1e4bd19a2035b402ab87642f5661136d6105c2dbbc6718ea4","observation_id":"76c48e83-3229-49ef-93de-fe2f1aa5e748","resolution":{"observed_at":"2026-08-16T00:12:08.647393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.169874Z","title":null,"venue":null,"work_id":"0517e944-81dc-4d5b-ac96-10c237d33112","year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.656832Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:1d5ea4f2d6378308d254ad319e309b86e3ee7e3cd69b1f90fe21ecb94874183b","observation_id":"ba04c329-85b2-465f-bf14-5e87662cb69a","resolution":{"observed_at":"2026-08-16T00:12:10.176037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.662439Z","title":"Lawrence Zitnick, and Piotr Dollár","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.662439Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:e8f85ebe673b62bc352457495fc446b5b01f24532eb23af8c3d3aedc373aa3b0","observation_id":"78bb5002-2e0e-4c7e-938d-abcd6882fccf","resolution":{"observed_at":"2026-08-16T00:12:08.662439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"math/0204325","last_updated":"2003-06-18T23:00:18Z","snapshot_observed_at":"2026-08-06T23:57:08.152664Z","submitted_at":"2002-04-26T17:04:02Z","title":"Determinantal probability measures","version":4},"cited_work":{"arxiv_id":"math/0204325","doi":null,"metadata_source":"pith","pith_arxiv_id":"math/0204325","snapshot_observed_at":"2026-08-16T00:12:09.292208Z","title":"Determinantal probability measures","venue":"math.PR","work_id":"0353e471-2471-4746-9dcc-c636fc3b7c9b","year":2002},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.673552Z"},"links":{"cited_paper":"/paper/math/0204325","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:c66bcfefcf00cba104d78fbe434913c1e7db97b61364d2f5a055093f6744fec3","observation_id":"afbfb54a-fd68-4f2f-a191-cbe572dcdd0c","resolution":{"observed_at":"2026-08-16T00:12:09.297919Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02051","last_updated":"2019-01-07T20:42:13Z","snapshot_observed_at":"2026-08-14T17:34:03.474416Z","submitted_at":"2019-01-07T20:42:13Z","title":"DPPNet: Approximating Determinantal Point Processes with Deep Networks","version":1},"cited_work":{"arxiv_id":"1901.02051","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.02051","snapshot_observed_at":"2026-08-16T00:12:09.268276Z","title":"DPPNet: Approximating Determinantal Point Processes with Deep Networks","venue":"stat.ML","work_id":"2d2a88b6-1dae-4f49-bf24-fd87441657e6","year":2019},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.678165Z"},"links":{"cited_paper":"/paper/1901.02051","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:4fc2e34639a93176879dbc2b35b96ec77fcd21e3150e3f617ea23b0fe7efd6e5","observation_id":"7b9321ab-1b32-42d9-b4ca-5059130757e2","resolution":{"observed_at":"2026-08-16T00:12:09.273196Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.132256Z","title":null,"venue":null,"work_id":"a83e3620-6c11-427e-b4c1-bf919ab677f2","year":2015},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.683067Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:cac9b0aba35b55dab35bd6fd256245a2c4d8bd87a7a5dffe8d757b9cae97641f","observation_id":"8299b095-9098-4cf1-8a12-196adaf7b8e3","resolution":{"observed_at":"2026-08-16T00:12:10.140969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.687920Z","title":null,"venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.687920Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:0d6cb92f42c663ed62ca754235e42fbb47dc79113cbc253e4b48a5c69bbd68e9","observation_id":"eb46f15c-620f-400b-b475-ad456a874074","resolution":{"observed_at":"2026-08-16T00:12:08.687920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04870","last_updated":"2016-09-19T20:20:42Z","snapshot_observed_at":"2026-08-14T22:48:03.209909Z","submitted_at":"2015-05-19T04:46:03Z","title":"Flickr30k Entities: Collecting Region-to-Phrase Correspondences for Richer Image-to-Sentence Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04870","snapshot_observed_at":"2026-08-16T00:12:08.692697Z","title":"Plummer, Liwei Wang, Chris M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.692697Z"},"links":{"cited_paper":"/paper/1505.04870","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d84749ceb48e041afcbb05f3a65d844ec4fe05676a669de839950734e6397d94","observation_id":"f0ec3cfe-b7b7-4b23-afae-c7f11f703ec1","resolution":{"observed_at":"2026-08-16T00:12:08.692697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-16T00:12:08.698339Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.698339Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:4e873e45b2f3fbc9b05ee6f0b82b05df6154992ad8449ce1e2e59349cfeac918","observation_id":"93eae2c4-05b8-45f0-a98d-dfe079959690","resolution":{"observed_at":"2026-08-16T00:12:08.698339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.705834Z","title":"Santos, Craig Macdonald, and Iadh Ounis","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.705834Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:85c4f2879d2fd2aa68ff763cc4c65e3ae1b405d3c27f1661483616361408bc22","observation_id":"5dcb1584-a476-4d61-89b6-efd5129e7b69","resolution":{"observed_at":"2026-08-16T00:12:08.705834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.103870Z","title":null,"venue":null,"work_id":"1280459d-5933-4b8c-83de-f1ab1509e47c","year":2015},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.710498Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:9ec98e4df9db6848077d1dcfd1636fc09b06cc3a90d036be8c6788afda608a04","observation_id":"dab0adba-56d9-4ae7-a88d-a658169442b2","resolution":{"observed_at":"2026-08-16T00:12:10.108606Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.083983Z","title":null,"venue":null,"work_id":"756c927c-de44-4f66-a098-1633779296fe","year":2010},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.715317Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:772338c280705598b190d54b74fdecd699d2ec0ce5cda7c26889e55fb7863994","observation_id":"aaefa40e-b066-4970-b152-56f1113b10ba","resolution":{"observed_at":"2026-08-16T00:12:10.092402Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.720711Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.720711Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:52c5eca3a6b3c5b77ae70a3619d08261a243ed4149ed436380f42e85586421ed","observation_id":"88b166e3-72c3-4f4c-ba64-da1978118f18","resolution":{"observed_at":"2026-08-16T00:12:08.720711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10328","last_updated":"2024-06-14T17:59:53Z","snapshot_observed_at":"2026-08-16T13:42:51.448762Z","submitted_at":"2024-06-14T17:59:53Z","title":"From Pixels to Prose: A Large Dataset of Dense Image Captions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10328","snapshot_observed_at":"2026-08-16T00:12:08.733637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.733637Z"},"links":{"cited_paper":"/paper/2406.10328","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:1fa040463b8e305203d20e4286abe5cbf20d00c018d0e1470d72c77aa17a3e17","observation_id":"aa6e3ee2-b88f-4c9e-b7e7-8ab22a7867f6","resolution":{"observed_at":"2026-08-16T00:12:08.733637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06654","last_updated":"2025-07-09T08:38:46Z","snapshot_observed_at":"2026-08-15T17:28:15.867790Z","submitted_at":"2025-07-09T08:38:46Z","title":"MS-DPPs: Multi-Source Determinantal Point Processes for Contextual Diversity Refinement of Composite Attributes in Text to Image Retrieval","version":1},"cited_work":{"arxiv_id":"2507.06654","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.06654","snapshot_observed_at":"2026-08-16T00:12:09.029317Z","title":"MS-DPPs: Multi-Source Determinantal Point Processes for Contextual Diversity Refinement of Composite Attributes in Text to Image Retrieval","venue":"cs.CV","work_id":"c5a0fa33-a9f2-458b-9e6b-77cf49ce7975","year":2025},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.741419Z"},"links":{"cited_paper":"/paper/2507.06654","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:1485525e8bd2ac75c68d4b57bdf61bd5fa60c2f884c2b6c6d695fa776448a5b0","observation_id":"b32283fa-f813-4a5b-85f5-fd211ac1a3e0","resolution":{"observed_at":"2026-08-16T00:12:09.035099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.747794Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.747794Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:8051d7b3620dc94c4833b46b96eab3c48ad8002c056f328412d7ab5eb92610e5","observation_id":"b02d35ef-37c0-4b13-8283-3e33e50c851e","resolution":{"observed_at":"2026-08-16T00:12:08.747794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.04236","last_updated":"2022-01-11T23:03:57Z","snapshot_observed_at":"2026-08-16T17:28:55.811973Z","submitted_at":"2022-01-11T23:03:57Z","title":"Incidents1M: a large-scale dataset of images with natural disasters, damage, and incidents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.04236","snapshot_observed_at":"2026-08-16T00:12:08.759271Z","title":"Papadopoulos, Agata Lapedriza, Ferda Ofli, Muhammad Imran, and Antonio Torralba","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.759271Z"},"links":{"cited_paper":"/paper/2201.04236","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:e36a7c8780aaeeed2b6d00dbef0887d1942902ec52a7d73832982019b4b5033d","observation_id":"2528cdd1-45bc-45f0-8527-8fd81187d945","resolution":{"observed_at":"2026-08-16T00:12:08.759271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:08.764308Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.764308Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:13c62e177383e1e28d6c921e3a9bbec84dca71dbc8723f891dc42706759e14b6","observation_id":"dcf1ef8c-cfee-4216-89ee-b9c0218f57a1","resolution":{"observed_at":"2026-08-16T00:12:08.764308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14464","last_updated":"2024-02-19T00:29:54Z","snapshot_observed_at":"2026-08-16T16:05:22.513487Z","submitted_at":"2022-12-29T21:58:37Z","title":"Result Diversification in Search and Recommendation: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14464","snapshot_observed_at":"2026-08-16T00:12:08.769536Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.769536Z"},"links":{"cited_paper":"/paper/2212.14464","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:1f49a95c58217b14cb165e2cbb11decf2fee8a1c2d3dec67bfad5f30d59669bc","observation_id":"783bf5bd-7476-4f08-91b7-2dd4928ac8cd","resolution":{"observed_at":"2026-08-16T00:12:08.769536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.032041Z","title":null,"venue":null,"work_id":"4d5924d3-58d9-4629-b068-95d8880bf4d6","year":2014},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.775315Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:2099e59a01cc08113b17dd0ad7356d22f4f5e0ee360851e36a682b94d28002bb","observation_id":"72a3abce-dc5e-426f-9625-a67ef45869e7","resolution":{"observed_at":"2026-08-16T00:12:10.037141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:10.011603Z","title":null,"venue":null,"work_id":"5e4a634f-9e7c-4694-aad5-91bc3e614f45","year":2025},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.780183Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:1863ae61b70dc710c6a6ccc5ce94832239e8acbf2b44c9ec6ed1425e2b765396","observation_id":"0417e061-5b09-470c-917e-3ee6d3d71c10","resolution":{"observed_at":"2026-08-16T00:12:10.016612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:12:09.992119Z","title":null,"venue":null,"work_id":"9b60a60b-aec6-487f-8e6f-96122ee4e3f4","year":2022},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.784961Z"},"links":{"citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:983634faa18750798ace361b283562e6bfdd758567ee3a4d51df75acdf512393","observation_id":"55f2f2cf-2677-4701-8239-27d93b7c3ee5","resolution":{"observed_at":"2026-08-16T00:12:09.997561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-08-13T15:12:42.567441Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-16T00:12:08.789621Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.789621Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:4f2919382e07fe9e6ffbe9d08cb7c98435227442f6d856d6f336137237bbba7c","observation_id":"993d96b1-cb7b-40a7-8daa-19283f7d2c40","resolution":{"observed_at":"2026-08-16T00:12:08.789621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11432","last_updated":"2021-11-22T18:59:55Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:55Z","title":"Florence: A New Foundation Model for Computer Vision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11432","snapshot_observed_at":"2026-08-16T00:12:08.794672Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.794672Z"},"links":{"cited_paper":"/paper/2111.11432","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:b08eadc3030c120b21e60cb8d820870aea8e2de2651b43873358f407f1c9a4be","observation_id":"9c91e209-f4d5-4205-af08-e869a5e250b3","resolution":{"observed_at":"2026-08-16T00:12:08.794672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.00607","last_updated":"2017-08-23T23:34:28Z","snapshot_observed_at":"2026-08-14T21:03:35.510339Z","submitted_at":"2017-05-01T17:53:51Z","title":"Determinantal Point Processes for Mini-Batch Diversification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.00607","snapshot_observed_at":"2026-08-16T00:12:08.799830Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.799830Z"},"links":{"cited_paper":"/paper/1705.00607","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:5ac2af52da7691a0002786e42ceffc0436f7f4943e04f020169244e8e080c54a","observation_id":"d0329b95-48ca-4c51-ab4e-de3796c57f34","resolution":{"observed_at":"2026-08-16T00:12:08.799830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00529","last_updated":"2021-03-10T01:27:16Z","snapshot_observed_at":"2026-08-16T18:54:38.205001Z","submitted_at":"2021-01-02T23:35:27Z","title":"VinVL: Revisiting Visual Representations in Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00529","snapshot_observed_at":"2026-08-16T00:12:08.806060Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.806060Z"},"links":{"cited_paper":"/paper/2101.00529","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:887acc224b85e32d82432d63e3afd102e11d62be0f7a2e3ae4139a7ed2a74afb","observation_id":"d70aadd0-591e-4151-b336-91d4d0f2279e","resolution":{"observed_at":"2026-08-16T00:12:08.806060Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1105.4255","last_updated":"2011-05-21T12:09:46Z","snapshot_observed_at":"2026-08-15T04:46:13.783649Z","submitted_at":"2011-05-21T12:09:46Z","title":"Efficient Diversification of Web Search Results","version":1},"cited_work":{"arxiv_id":"1105.4255","doi":null,"metadata_source":"pith","pith_arxiv_id":"1105.4255","snapshot_observed_at":"2026-08-16T00:12:09.923641Z","title":"Efficient Diversification of Web Search Results","venue":"cs.IR","work_id":"aa210517-3cdb-4e13-8a54-ce6004dc5d27","year":2011},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.501081Z"},"links":{"cited_paper":"/paper/1105.4255","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:d10c68abc626bc7f310f8504ea299496fad15e96bedf9a76224ed55f2927f79f","observation_id":"397c72b2-ec5c-4cac-a7af-bd1fc6350fd5","resolution":{"observed_at":"2026-08-16T00:12:09.929005Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-07-06T03:42:37.507458Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-16T00:12:08.668270Z","title":"arXiv:1405.0312 [cs.CV] https://arxiv.org/abs/1405.0312","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.668270Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:0d7c95e0151929b0311ca33ba7f2c56ed97000e6b82dd85d7faed2cfd1f28692","observation_id":"cbc65d56-7e75-4c83-bb86-bb94924c0342","resolution":{"observed_at":"2026-08-16T00:12:08.668270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.05612","last_updated":"2018-07-29T19:11:57Z","snapshot_observed_at":"2026-08-14T20:46:56.185352Z","submitted_at":"2017-07-18T13:51:32Z","title":"VSE++: Improving Visual-Semantic Embeddings with Hard Negatives","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.05612","snapshot_observed_at":"2026-08-16T00:12:08.549021Z","title":"arXiv:1707.05612 [cs.LG] https://arxiv.org/abs/1707.05612","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.549021Z"},"links":{"cited_paper":"/paper/1707.05612","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:874fb6c93c200a258275053893faa1c2726a8e4c7997e20bf08bc635ce28231a","observation_id":"c55203a9-f553-4fe8-bf65-00ee0065a725","resolution":{"observed_at":"2026-08-16T00:12:08.549021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.06165","last_updated":"2020-07-26T00:46:46Z","snapshot_observed_at":"2026-08-09T03:42:28.505858Z","submitted_at":"2020-04-13T19:18:10Z","title":"Oscar: Object-Semantics Aligned Pre-training for Vision-Language Tasks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.06165","snapshot_observed_at":"2026-08-16T00:12:08.651989Z","title":"arXiv:2004.06165 [cs.CV] https://arxiv.org/abs/2004.06165","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.651989Z"},"links":{"cited_paper":"/paper/2004.06165","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:2a4aad49897c563118dff48ed2e4f736e4254724703b9ca729b39dc6cb71ab44","observation_id":"3c011e3b-6dd6-449e-934c-e63de9153502","resolution":{"observed_at":"2026-08-16T00:12:08.651989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-16T00:12:08.726460Z","title":"arXiv:2111.02114 [cs.CV] https://arxiv.org/abs/2111.02114","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.726460Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:5630183a9b25a8407c08a33b5a60188191b3d6081e3777d3a35a1a6280f60530","observation_id":"f65b8d65-d6a0-4f6a-aab4-a9efcc8c33d6","resolution":{"observed_at":"2026-08-16T00:12:08.726460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12856","last_updated":"2023-12-20T09:19:48Z","snapshot_observed_at":"2026-08-16T14:33:03.747257Z","submitted_at":"2023-12-20T09:19:48Z","title":"SkyScript: A Large and Semantically Diverse Vision-Language Dataset for Remote Sensing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12856","snapshot_observed_at":"2026-08-16T00:12:08.754344Z","title":"arXiv:2312.12856 [cs.CV] https://arxiv.org/abs/2312.12856","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T00:12:08.754344Z"},"links":{"cited_paper":"/paper/2312.12856","citing_paper":"/paper/2608.12532"},"observation_digest":"sha256:79dc120fff316af361d54a6a8eb02bc8464dc8d3bd550a3395554beb054bca00","observation_id":"08314d22-c3e8-4752-b23f-611cfa0b47ee","resolution":{"observed_at":"2026-08-16T00:12:08.754344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.12532","last_updated":"2026-08-12T19:07:07Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-16T23:10:31.557641Z","submitted_at":"2026-08-12T19:07:07Z","title":"MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":2,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":50,"verified_exact":6,"verified_fuzzy":2},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2608.12532."}