{"as_of":"2026-08-09T22:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ea277e0cc3c2f5d6c63227366a9673a1c1ce026c585c14b5a0e121a2045f49a","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T20:41:37.343881Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23507/citation-record","integrity":"/paper/2607.23507/integrity","json":"/paper/2607.23507/citation-record.json","paper":"/paper/2607.23507"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.07316","last_updated":"2023-03-19T13:37:01Z","snapshot_observed_at":"2026-07-06T14:04:58.943383Z","submitted_at":"2022-10-13T19:42:08Z","title":"MTEB: Massive Text Embedding Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07316","snapshot_observed_at":"2026-07-30T20:41:34.449255Z","title":"MTEB: Massive Text Embedding Bench- mark,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:34.449255Z"},"links":{"cited_paper":"/paper/2210.07316","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:7f1be7166f5dc2e1ebea179ab6a841f26b66e8e74c6cf1bebdc4619deae1f1a8","observation_id":"1d064fd9-9d3d-4acb-b3e8-28f06b5cb920","resolution":{"observed_at":"2026-07-30T20:41:34.449255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08663","last_updated":"2021-10-21T01:18:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-04-17T23:29:55Z","title":"BEIR: A Heterogenous Benchmark for Zero-shot Evaluation of Information Retrieval Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08663","snapshot_observed_at":"2026-07-30T20:41:34.518571Z","title":"BEIR: A Heterogeneous Bench- mark for Zero-shot Evaluation of Information Retrieval Models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:34.518571Z"},"links":{"cited_paper":"/paper/2104.08663","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:339fa099972ed5b2853e9a5713fafea746d547a3ed64fa3d19415b8da39eca84","observation_id":"e07beb99-bb00-4d55-b2ee-289e20592eb1","resolution":{"observed_at":"2026-07-30T20:41:34.518571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:34.630153Z","title":"WWW’18 Open Challenge: Financial Opinion Mining and Question Answering,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:34.630153Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:428736e924e13a8e4f3dad1e52a2a6fdf3fa5f11153e045c10ea06f82fd2a189","observation_id":"140b8f5b-5cb2-417e-96e3-89b62e0ef602","resolution":{"observed_at":"2026-07-30T20:41:34.630153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:34.693173Z","title":"A Full-Text Learning to Rank Dataset for Medical Information Retrieval,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:34.693173Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:33c5eac06ffbcfb8474d74549b7a547690024389cb02595399dd16e5fc26486d","observation_id":"4a9b1b1f-738a-44a9-b829-b2ec7f9e3c89","resolution":{"observed_at":"2026-07-30T20:41:34.693173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:34.763412Z","title":"Fact or Fiction: Verifying Scientific Claims,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:34.763412Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:e4d32e17ae21d9777cc1083c092cef06bd02bcd7130f2d1a16b6034b77cc2ad8","observation_id":"e3fcf4f5-fc52-4f2d-9023-8b2dff3b6437","resolution":{"observed_at":"2026-07-30T20:41:34.763412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:34.797908Z","title":"TREC-COVID: Constructing a Pandemic Information Retrieval Test Collec- tion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:34.797908Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:7736fb6a7e37c78383401e0039099ca13ed2395d25341455828fef109c945efa","observation_id":"57f60392-889c-4c62-9a5d-90bfb2fc7273","resolution":{"observed_at":"2026-07-30T20:41:34.797908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:34.887800Z","title":"Cumulated Gain-Based Evaluation of IR Techniques,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:34.887800Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:1aa3e8d2522f0b35632e332e943a9eba0498b5ea029f237184fc0031d1474b1c","observation_id":"54edffe0-8902-4500-a336-8dced7fa3322","resolution":{"observed_at":"2026-07-30T20:41:34.887800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03533","last_updated":"2024-02-22T06:21:51Z","snapshot_observed_at":"2026-07-06T14:27:46.217000Z","submitted_at":"2022-12-07T09:25:54Z","title":"Text Embeddings by Weakly-Supervised Contrastive Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03533","snapshot_observed_at":"2026-07-30T20:41:34.947396Z","title":"Text Embeddings by Weakly-Supervised Contrastive Pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:34.947396Z"},"links":{"cited_paper":"/paper/2212.03533","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:0c75bdd13e762c495db8053399ab6d47a062a2a9dd665f5148245ec1bcbee096","observation_id":"2d5de710-20e3-40ef-bf1d-4e703d7fecd5","resolution":{"observed_at":"2026-07-30T20:41:34.947396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05672","last_updated":"2024-02-08T13:47:50Z","snapshot_observed_at":"2026-07-30T09:46:51.062184Z","submitted_at":"2024-02-08T13:47:50Z","title":"Multilingual E5 Text Embeddings: A Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05672","snapshot_observed_at":"2026-07-30T20:41:35.055490Z","title":"Multilingual E5 Text Embed- dings: A Technical Report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.055490Z"},"links":{"cited_paper":"/paper/2402.05672","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:ccffad460c5e066406197966ea7c91c38a5d229f64bcc8fc7a40df9c035dc514","observation_id":"c26f2b5b-dced-4e69-b04e-1d4c70b9db49","resolution":{"observed_at":"2026-07-30T20:41:35.055490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07597","last_updated":"2024-09-24T03:01:25Z","snapshot_observed_at":"2026-08-09T21:52:29.568774Z","submitted_at":"2023-09-14T10:57:50Z","title":"C-Pack: Packed Resources For General Chinese Embeddings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07597","snapshot_observed_at":"2026-07-30T20:41:35.115835Z","title":"C-Pack: Packaged Resources To Advance General Chinese Embedding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.115835Z"},"links":{"cited_paper":"/paper/2309.07597","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:7b79e78702d5a7b540d186d1a9af6d474acc8c052e8c31496f699c935d672bbe","observation_id":"52c93f20-a801-4eff-b4c2-2f5f11a7b041","resolution":{"observed_at":"2026-07-30T20:41:35.115835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-07-06T17:25:35.493362Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-07-30T20:41:35.233975Z","title":"BGE M3-Embedding: Multi-Lingual, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.233975Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:a8dd0151d12049bebf6abb2ec81cdccffa39bac1becd50907316c0a9c56ed197","observation_id":"4e4aa7f3-24b2-4f77-a2f7-a5399f36ffe8","resolution":{"observed_at":"2026-07-30T20:41:35.233975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:35.314097Z","title":"Language-agnostic BERT Sentence Embedding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.314097Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:f3ab9de212a49337756b2a6f3d9fc45ad67ac21f844a1de0fb8506e0d80c17ea","observation_id":"2894f04f-c521-4578-97bd-eaf78197a3e9","resolution":{"observed_at":"2026-07-30T20:41:35.314097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:35.425576Z","title":"MPNet: Masked and Permuted Pre-training for Language Understanding,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.425576Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:0214519d45c795a4bf88d502580f4dcb56404f4482e7ed062524c52f00ca8894","observation_id":"11a2264a-fb9f-4638-9ee8-8c6aa79c1213","resolution":{"observed_at":"2026-07-30T20:41:35.425576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:35.540258Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT- Networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.540258Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:87fcb77ec38e91a96cbbfdaf10b5b8dffa52a783535c241aea92302b01c7782c","observation_id":"e5944273-48d3-45f4-80ae-ecacd5dc0bca","resolution":{"observed_at":"2026-07-30T20:41:35.540258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:35.653913Z","title":"SimCSE: Simple Contrastive Learning of Sentence Embeddings,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.653913Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:893a68dca71653ebe38b6df75f5970ae1628fec7470703da1e04103717f5a0a4","observation_id":"dd6c9b64-2ad8-4e22-893c-8dedc4b20925","resolution":{"observed_at":"2026-07-30T20:41:35.653913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:35.764104Z","title":"Unsuper- vised Dense Information Retrieval with Contrastive Learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.764104Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:01a07e4a21848dd03c2207753bc65e19a6b9d24e4f6ef95dd8bba370272b0a63","observation_id":"c790f91f-1923-4a68-895d-541bb8547c50","resolution":{"observed_at":"2026-07-30T20:41:35.764104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:35.931908Z","title":"SPECTER: Document-level Representation Learning using Citation-informed Transformers,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.931908Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:715dbd3431ff639b3cfca4dc617fbbfa7d16186659f5d52f3c83d7fb9ea98d19","observation_id":"c8bc7451-924d-49c2-8ec4-ac9d32e22fb4","resolution":{"observed_at":"2026-07-30T20:41:35.931908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.07899","last_updated":"2021-12-15T05:33:27Z","snapshot_observed_at":"2026-07-06T12:18:53.315820Z","submitted_at":"2021-12-15T05:33:27Z","title":"Large Dual Encoders Are Generalizable Retrievers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.07899","snapshot_observed_at":"2026-07-30T20:41:35.991806Z","title":"Large Dual Encoders Are Generalizable Retrievers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:35.991806Z"},"links":{"cited_paper":"/paper/2112.07899","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:1092628620e6b0e1c83612965c5122ff850ffaf005414e3fe84a92d153678480","observation_id":"97f0ddc0-ea66-4810-95fe-e6f7ea9411ce","resolution":{"observed_at":"2026-07-30T20:41:35.991806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.08877","last_updated":"2021-12-14T06:19:33Z","snapshot_observed_at":"2026-08-06T08:28:54.662531Z","submitted_at":"2021-08-19T18:58:02Z","title":"Sentence-T5: Scalable Sentence Encoders from Pre-trained Text-to-Text Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.08877","snapshot_observed_at":"2026-07-30T20:41:36.099940Z","title":"Sentence-T5: Scalable Sentence Encoders from Pre-trained Text-to-Text Models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.099940Z"},"links":{"cited_paper":"/paper/2108.08877","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:3cd1045b1e8b58b5bef1512574a53e9db237938859f5b9924eee9ee7fe284265","observation_id":"f06bcd2c-5584-4a66-ba5f-bb8046dca091","resolution":{"observed_at":"2026-07-30T20:41:36.099940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.08904","last_updated":"2022-08-05T09:33:10Z","snapshot_observed_at":"2026-08-05T15:40:41.912643Z","submitted_at":"2022-02-17T21:35:56Z","title":"SGPT: GPT Sentence Embeddings for Semantic Search","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.08904","snapshot_observed_at":"2026-07-30T20:41:36.268379Z","title":"SGPT: GPT Sentence Embeddings for Semantic Search,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.268379Z"},"links":{"cited_paper":"/paper/2202.08904","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:19cfcdbe5f9c26a1cae75b3b61a72ce0d7976d67fad3c1d49eb7f9b7b9b6ff7a","observation_id":"04495888-35ad-4922-9dc7-14702b88c2b2","resolution":{"observed_at":"2026-07-30T20:41:36.268379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.329572Z","title":"GloVe: Global Vectors for Word Representation,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.329572Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:666922fd4280feb078265cf3c5d90ee0274d24ed687d3043be6d9d1d73fa821c","observation_id":"e2d387e2-79b5-4364-a78c-1069edec0481","resolution":{"observed_at":"2026-07-30T20:41:36.329572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.438222Z","title":"Dependency Based Embeddings for Sentence Classification Tasks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.438222Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:44d5f23f6ad5f96f61275afc3d977c4788da246f2192cd484f91c4ce108e177e","observation_id":"d58c7700-925f-4649-bb5b-e95c5fef19b8","resolution":{"observed_at":"2026-07-30T20:41:36.438222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.545485Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.545485Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:2c6ac6c1a6ee3b99711145d1a1880e3f05feecd0b90b2a6ab8f3e6f2ceddc1ab","observation_id":"aa5f4157-69da-4a70-b891-40aeaefa474b","resolution":{"observed_at":"2026-07-30T20:41:36.545485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.651523Z","title":"Massively Multilingual Sentence Embeddings for Zero-Shot Cross- Lingual Transfer and Beyond,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.651523Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:ca5c3ea727aef05061cf59682ad950e63284a2c8e1c8dcdef9fbb69a1270c1a7","observation_id":"a22d034e-6f3f-4171-8945-526c27b3f8cd","resolution":{"observed_at":"2026-07-30T20:41:36.651523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.684091Z","title":"ColBERT: Efficient and Effective Passage Search via Contextualized Late Interaction over BERT,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.684091Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:37f68bb5f3ca6fc4eb330d30b99e8ce1e02b589f21e4241368a74dfd7a2d210c","observation_id":"9489c6a4-0025-4c58-9b00-7532c7a8e513","resolution":{"observed_at":"2026-07-30T20:41:36.684091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.687535Z","title":"SPLADE: Sparse Lexical and Expansion Model for First Stage Ranking,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.687535Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:6a0d10dfe44d9feaaa73bb942e8fbc19d6235aee8c9764030b6eaa3e061aa63b","observation_id":"bbd152ba-ca2c-49bc-bfcb-42eccea733c9","resolution":{"observed_at":"2026-07-30T20:41:36.687535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.699706Z","title":"The Probabilistic Relevance Framework: BM25 and Beyond,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.699706Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:7d4024983e8439893f91fa73a6448063b5e8911366f700cc79fcb70c1c4b0ad7","observation_id":"1d3bbf2c-8ef6-4163-86e6-7ab59266b934","resolution":{"observed_at":"2026-07-30T20:41:36.699706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.789057Z","title":"Efficient and Robust Approximate Nearest Neighbor Search Using Hierarchical Navigable Small World Graphs,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.789057Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:72324b085d0fba3815e1b0063781f4d60c9aedbba8f0fa30aae0c89c49f9b2f6","observation_id":"4585e848-d6bd-42e4-85a4-ad1c35e1caaf","resolution":{"observed_at":"2026-07-30T20:41:36.789057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.894541Z","title":"Product Quantization for Nearest Neighbor Search,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.894541Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:1168762fd4d86bd785cec45269de6ce33fa770dd8ba451a31d11aaf25c882946","observation_id":"570030f1-8286-4044-89b9-28c14c9b9452","resolution":{"observed_at":"2026-07-30T20:41:36.894541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:36.989530Z","title":"Billion-scale Similarity Search with GPUs,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:36.989530Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:d024842d205ba1f7510f15e0aae74487f9d993769bd82a215c4e64a17facf778","observation_id":"c2c36fdf-2c53-40bc-b573-85d74c6bffda","resolution":{"observed_at":"2026-07-30T20:41:36.989530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:37.053029Z","title":"Milvus: A Purpose-Built Vector Data Management System,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:37.053029Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:a1e78750ba609c0593a904583d73837f993b443935da310304b254f15fa3a52a","observation_id":"de474351-df9f-43e1-a13b-008c31bff9c2","resolution":{"observed_at":"2026-07-30T20:41:37.053029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01613","last_updated":"2025-02-03T22:26:56Z","snapshot_observed_at":"2026-08-08T18:16:47.501613Z","submitted_at":"2024-02-02T18:23:18Z","title":"Nomic Embed: Training a Reproducible Long Context Text Embedder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01613","snapshot_observed_at":"2026-07-30T20:41:37.169734Z","title":"Nomic Embed: Training a Reproducible Long Context Text Embedder,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:37.169734Z"},"links":{"cited_paper":"/paper/2402.01613","citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:cd28eeb7bde9b642ec65838c962e90a887e16b2b8da75e74f8fd2943ae33fd60","observation_id":"0ddd7bba-4c6b-47f2-8a62-e276303a5817","resolution":{"observed_at":"2026-07-30T20:41:37.169734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:37.283607Z","title":"Qdrant: Vector Database for the Next Generation of AI Applications,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:37.283607Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:6685ca2ec38a62d62bb39e0f9c379d2fd12c0a99ec7d324105eec81ec644881c","observation_id":"8dbb9f31-31e0-403d-a5f8-45029a03a766","resolution":{"observed_at":"2026-07-30T20:41:37.283607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:41:37.343881Z","title":"Pinecone Vector Database,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-30T20:41:37.343881Z"},"links":{"citing_paper":"/paper/2607.23507"},"observation_digest":"sha256:73f97f2a3e1254ab524f581e58aedf4c261e8e632013d63423ead48ecad56334","observation_id":"f4f8036e-9d1d-42d3-b8b5-47793e213c65","resolution":{"observed_at":"2026-07-30T20:41:37.343881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23507","last_updated":"2026-07-26T07:13:33Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-08T22:42:54.413805Z","submitted_at":"2026-07-26T07:13:33Z","title":"Choosing a Text Embedding Model: A Practical Benchmarking and Decision Framework"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2607.23507."}