{"as_of":"2026-08-10T13:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:886da8aa7a597db0dad3ba9a6ffe018c6feb8d495cf52cd42e83fa1fca2edb5f","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T16:55:28.735209Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:45:15.934455Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04581","snapshot_observed_at":"2026-08-02T08:45:15.934455Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04071","last_updated":"2026-07-18T19:23:45Z","snapshot_observed_at":"2026-08-07T02:30:23.421775Z","submitted_at":"2026-07-05T01:06:29Z","title":"Beyond Multilingual Averages: MTEB-PT, a Benchmark for Portuguese Sentence Encoders","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T08:45:15.934455Z"},"links":{"cited_paper":"/paper/2607.04581","citing_paper":"/paper/2607.04071"},"observation_digest":"sha256:d606082304ffa88cfe02746f15d067f8a80defe542ee8ed7de4ff4e947eacab7","observation_id":"3937775a-dfcf-479b-8141-8ee1ed42ec0f","resolution":{"observed_at":"2026-08-02T08:45:15.934455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.04581/citation-record","integrity":"/paper/2607.04581/integrity","json":"/paper/2607.04581/citation-record.json","paper":"/paper/2607.04581"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"MTEB: Massive text embedding benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:80e3cfd11382763701a9e95247534b95f17c3b15141b2bfd7d5df5567c7c3e9d","observation_id":"5087861e-ee3f-4143-9592-9a378cecd8ff","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"MMTEB: Massive multilingual text embedding benchmark,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:92b25d76277e2234825c8c5ddbd20b81b9c6a509681e7799082f1446ed715137","observation_id":"549fea7f-0848-4ea9-9e16-9368d9a63461","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"mMARCO: A multilingual version of the MS MARCO passage ranking dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:90e245f0324de5285a25891c11df19ca13fcb7af3446f3047ae81fa3c3cc570d","observation_id":"511266d5-b996-4e6e-a5ad-51b903d043ee","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"VN-MTEB: Vietnamese massive text embedding benchmark,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:d0a52610d5927d6c633645cd54e1b9f9929f2c837dd11f0da4cd7855a2c7f66c","observation_id":"4a91a814-7a7e-4f6b-b5f2-cb945f5d9d97","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07597","last_updated":"2024-09-24T03:01:25Z","snapshot_observed_at":"2026-08-09T21:52:29.568774Z","submitted_at":"2023-09-14T10:57:50Z","title":"C-Pack: Packed Resources For General Chinese Embeddings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07597","snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"C- Pack: Packed resources for general Chinese embeddings,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"cited_paper":"/paper/2309.07597","citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:17c75da3d94c0adc49a33bc17fb83fceca87d0135c72e4d78016d73ef6cde9a9","observation_id":"852bf0d4-2725-4372-86ad-a8fd427261e4","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"The Scandinavian embedding benchmarks: Comprehensive assessment of multilingual and monolingual text embedding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:2c8da2b237c7bc42ebdc2cb3e4855d951ef23725bb3c80f3134b37cb8250bab1","observation_id":"bb96ff81-99d1-4698-8ed2-456af1b61d4d","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"MTEB-French: Resources for French sentence embedding evaluation and analysis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:e53efaf38090a07a894e066caf31c456c7f69946116afa9b2e2ed7b1a2d282cf","observation_id":"28bf6485-a146-4565-b48f-09e5ce94bc7e","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"PL-MTEB: Polish massive text embedding benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:d8eb8f1b31cf3a3e45f2926c3cbda52b07922109644c8587cb340a599b214c67","observation_id":"e6ffbe54-362c-4d23-a08b-b6c1e8d7ce35","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"The Russian-focused embedders’ exploration: ruMTEB benchmark and Russian embedding model design,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:86b4b7de1376a2f51638f12ffc6a07ed810e5069fa68e080b59587cb9c839184","observation_id":"ab6b2e1e-9120-4f8e-ba89-66c7ddc446a4","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"FaMTEB: Massive text embedding benchmark in Persian language,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:47ec12246a86368f9816d789894ab05c52d89db857e7c09db7badf9c5fbc2411","observation_id":"56aba30d-a676-4d43-9e50-5e0a390cf45d","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"MTEB-NL and E5-NL: Embedding benchmark and models for Dutch,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:172085c1235c97b5b5a741ef5e33cf1305d5706f73a02c04ddf9546e2da0a2da","observation_id":"3cc2bdf9-1fe7-48ac-bfaf-0b37817dcf45","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"German text embedding clustering benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:33702c2e7fbaece686ccc684729b7fa6a5732de1375f27c14764993c4c87c037","observation_id":"d69565a0-6fdf-4986-82cd-8fbb82de04d5","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Ruri: Japanese general text embeddings,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:e2156d37bc30fc2e1ffecaecea2bc634e7612b1890a62b77735200d1fd22212f","observation_id":"4963b912-af4f-4756-9e1f-cb2a0c33abd6","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"SentEval: An evaluation toolkit for universal sentence representations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:ea78970aa2768d97791e5c2268f01188fe734cbc173984191a479c61aa89c071","observation_id":"960809f1-3d15-422a-9089-25f00eb52330","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08663","last_updated":"2021-10-21T01:18:28Z","snapshot_observed_at":"2026-08-09T23:22:21.200279Z","submitted_at":"2021-04-17T23:29:55Z","title":"BEIR: A Heterogenous Benchmark for Zero-shot Evaluation of Information Retrieval Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08663","snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"BEIR: A heterogenous benchmark for zero-shot evaluation of infor- mation retrieval models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"cited_paper":"/paper/2104.08663","citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:3349d1b6d5fb9d5f7a3334e3fee468cdbb1bd883740b331ae41e4375d0ba1262","observation_id":"7ef566a4-6342-4c03-b220-d15cac7bc318","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"MIRACL: A multilingual retrieval dataset covering 18 diverse languages,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:f7349106ff0ec34356fdfb34279b32bfa55c1047ebfdcb5394903ba80f532084","observation_id":"5b4067c1-a25d-4013-a44c-e7ac93294f1d","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Available: https://aclanthology.org/2023.tacl-1.63/","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:203974ce485cae8556aebf1f15e3d88c58a8dcbb23ce08b9acb055340a38ed98","observation_id":"49261ee1-1523-4624-863c-a08c15686990","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"BEIR-PL: Zero shot information retrieval benchmark for the Polish language,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:5e9c6a67160b9a52ad56cd28f34afa3d3e4d73889f63ce8b796f93bfc6b7fc06","observation_id":"3b1984ea-e788-4603-8969-893d61442633","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Napolab: The natural portuguese language bench- mark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:a2755d35157bb37b3203e026c363891aa00f21dccc4b44a0d0877c67c34e05f9","observation_id":"b8e728a2-8693-4b97-baeb-58153efac145","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"PORTULAN ExtraGLUE datasets and models: Kick-starting a benchmark for the neural processing of Portuguese,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:cf355ffcc97043cb8d7d10393fc55cf7ab9c4fbe2fb14ae36b4d023aae9804a6","observation_id":"e4bfe681-7900-4f52-9bd9-9c741e62d4ac","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Beyond multilingual averages: MTEB-PT, a benchmark for Portuguese sentence encoders,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:e1bf26665c8b338964c79cceedc09cc36e7f786604f53c9a69c335bd3e64bbfa","observation_id":"2076e809-4623-4e02-8ec4-002ff42f58fe","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"HateBR: A large expert annotated corpus of Brazilian Instagram comments for offensive language and hate speech detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:fac0415c0a3927d53b64134698e2ea755ffe6ad5aa901d62579057157cc56c77","observation_id":"cb8b8d6a-f411-42ce-a4c1-ced1fa29d697","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"FACTCK.BR: a new dataset to study fake news,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:6f542f4f120e9cf417fc561be7836cea3b2cd359a6416acb4445406f25d44df3","observation_id":"2b274027-c1e0-4b84-93f4-93523326d4ae","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"ToxSyn-PT: A synthetic fine-grained dataset of minority- targeted toxic language in Portuguese,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:f2068dcd779406936a1f40852e0adcfec8095b0254f8cdc65f2b8023b76827c6","observation_id":"cd39f9c8-6edf-40b9-8c93-88bbebaec2f1","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Vis˜ao Geral da Avaliac ¸˜ao de Similaridade Sem ˆantica e Infer ˆencia Textual,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:64147b40cc61df0b96bc0b9de6abb349882b7c17ef4420c895c3d48c48d6e18a","observation_id":"98b0e1dc-cc9f-4d6b-87ec-bdd22829ac16","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"InferBR: A natural language inference dataset in Portuguese,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:bf52746db54629eceae9bc4cec50245f26586fe412180ab1801a96f2b5bbe19e","observation_id":"ba7d6e8a-efc7-4dda-8a27-2d350ffcf7af","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"The ASSIN 2 shared task: A quick overview,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:39b38c7ad06b31fabc83a4f733b6f068b4055c3b7803e73806ef1d90b5f7f428","observation_id":"5f23f83e-ffeb-4035-9bdb-c292612f4d63","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"MedPT: A massive medical question answering dataset for Brazilian-Portuguese speakers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:320beeb3e435daea122bdbd6b84c90fcdd3bf98535a02e4830e86709720b1347","observation_id":"9c0ccc5f-de0a-46f6-b619-de753735574d","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Brazilian Portuguese Wikipedia categories clustering dataset,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:c16af6711a1efce647cdbbd49a34870f00c9bb02ef9d34fa7a362355c0a4f019","observation_id":"ebfaa18e-3034-4c1b-a1a3-a79e49e88cd1","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08379","last_updated":"2025-08-01T19:19:55Z","snapshot_observed_at":"2026-08-07T17:13:07.218307Z","submitted_at":"2025-03-11T12:39:04Z","title":"JurisTCU: A Brazilian Portuguese Information Retrieval Dataset with Query Relevance Judgments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08379","snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"JurisTCU: A Brazilian Portuguese information retrieval dataset with query relevance judgments,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"cited_paper":"/paper/2503.08379","citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:6152e31ee5af3d12b80a9ac5682ebe4dfb9bc540e750b04d32917d2b209c58a6","observation_id":"a1bc8c0d-fdb0-41c8-930a-db497cb76a46","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"SciELO Brazil scientific abstracts clustering dataset,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:b8ead0c61cafd36acfcfbf37f44c705bc371695b4119d18844450da82a08ebec","observation_id":"3e4018fc-85b0-4ef9-a8cd-69e90461d0d6","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Portuguese Stack Overflow clustering dataset,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:371fb88de6735b1944758613fbee1e84f8118a4d452e8270954ba14ddb6bbdcd","observation_id":"0f795c78-b94e-465c-bc6d-29e9b39c6cdd","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/bracis","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:58:08.807566Z","title":"FaQuAD: Reading comprehension dataset in the domain of Brazilian higher education,","venue":null,"work_id":"17a1232b-62e8-4c8f-8721-ece727296cca","year":2019},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:f62a1ef3f0d05bef379f9025f2091a2a7f37f0361abeeae0494fef1295ef5ad4","observation_id":"6ba9489c-58dd-4139-8fa4-e31d37749cb8","resolution":{"observed_at":"2026-07-11T16:58:08.810107Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Quati: A Brazilian Portuguese information retrieval dataset from native speakers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:d6468177443254bf855a152ca7f466e725bc183ebac3462b626555f58c2c9ea0","observation_id":"5021fe95-06e6-4820-9a5c-511ba4db4f2a","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"FaqBacen: Banco central do brasil public FAQ retrieval dataset,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:8531852ac965fd1a691c1118a71280aacbbca1bc4548ee5c332aa9b6f47c0af9","observation_id":"e7f10294-be7a-4801-b91c-6777179e13a6","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"BR-TaxQA-R: A dataset for question answering with references for Brazilian personal income tax law, including case law,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:28afea788a6ae9ec4f8929bd8a043876fd53428d4d4b11aa1a11075b14adf97a","observation_id":"8865b975-43f8-44d3-866a-3991a1fc2427","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"RoBERTaLexPT: A legal RoBERTa model pretrained with deduplication for Portuguese,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:31db23d4dc370f9612b5f7dadcc69abcf3b89d244759559f4b967b506bbf8b5d","observation_id":"08cecd67-3e21-4932-8930-b0d4549e3aea","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"BRIGHTER: BRIdging the gap in human-annotated textual emotion recognition datasets for 28 languages,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:b99f82329f22acec8b90df189337c1f3e2a8fb2de2e370e25d27598bf34c159e","observation_id":"c6c47d65-36df-49e9-b2d1-633fc94ed98d","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Qwen3 embedding: Advancing text embedding and reranking through foundation models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:fca0f3b87420d2a49177a139882391111c8b13bb349c31ff875a2f15b2c6a31d","observation_id":"0c6af2dc-8806-4710-9713-a3c1914d57fb","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Octen-embedding model family,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:2ef61531b7bec8b7ff730ba20d45e12d36eadcf9d42f218bede2c325a1a25f21","observation_id":"61de10b0-cd62-40a1-9a29-72de4460f333","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"F2LLM-v2: Inclusive, performant, and efficient embeddings for a multilingual world,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:964444b3277b15010b865112728c9d61656227664e6b983add5a3a6a69f7a278","observation_id":"b0d83301-ff9b-4ce4-9b3c-0cf73daecd40","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Harrier-OSS-v1 embedding family,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:1a94b090987d5ea77d5b69c76184c8c2c0a65daf6e689114c93ab21aec87a326","observation_id":"146cfd9f-4141-4d3e-9bac-2295fd859ca1","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"SFR-embedding-mistral: Enhance text retrieval with transfer learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:fb9043ec043994481d65a98a181bb14da275587b372c2604e6fe83a0a243b53d","observation_id":"9c7aa73c-e96a-43a2-9fc3-9b7ad1d2c12a","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03281","last_updated":"2023-08-07T03:52:59Z","snapshot_observed_at":"2026-08-04T23:10:23.964516Z","submitted_at":"2023-08-07T03:52:59Z","title":"Towards General Text Embeddings with Multi-stage Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03281","snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Towards general text embeddings with multi-stage contrastive learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"cited_paper":"/paper/2308.03281","citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:17ec479d7902bc57a736cf912c281e68bd8fe36598bb9af417f99c0ae346bc98","observation_id":"4e67795c-3b6d-4f86-b900-51a607ff7a78","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Linq-Embed-Mistral technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:2a9864b5d010e334597af5714a62fcec763fefbc5236ad916b8565172dfd57be","observation_id":"1629db09-a9d8-4e37-b426-a6a2d23f2422","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"KaLM-Embedding-V2: Superior training techniques and data inspire a versatile embedding model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:9817ac11b2492807ccc3fc9eca931201c196ae8ea47eddf07252ff11cda8bc72","observation_id":"d778ad52-eb46-4951-b3da-913b24ac4016","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Llama-Embed-Nemotron-8B: A universal text embedding model for multilingual and cross-lingual tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:8f183a2a2953cd1a8a0afc54686b8a84018a4fe871ad07fe0da751b493cc561b","observation_id":"ddbf0886-9ee5-4f59-b6ae-74300e561c0d","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"BidirLM: From text to omnimodal bidirectional encoders by adapting and composing causal LLMs,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:a73bf562b4b5170e46e94aecd6d7ee65d86319f7703b90f920a2ac4032d6fee8","observation_id":"98be4b82-70fa-4620-b6ee-968eb5acbb1b","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"jua: Domain-adaptive dense retrieval embeddings for Brazilian legal search,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:2f144094ad4fa880408a01c5b05fd0ce36059e7817fdefd0472a52b51dd80c63","observation_id":"1c25690a-918b-4883-8b9f-dd57390dbdf5","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Multilingual E5 text embeddings: A technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:a7d5c1ae55f236975ce77fd3a66ec770151319bac93b241c016d66c3dc417b92","observation_id":"7809d949-cb21-462b-af77-86a408f5a8f7","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Sentence-BERT: Sentence embeddings using Siamese BERT-networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:20cbc2194137132db6b728dff9584ebc4233b7238d87b766cea645d970e7dce1","observation_id":"bcf911d4-75ef-4c29-96fa-c6b3fbd88a9d","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Granite embedding multilingual R2 models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:29eb635b386920f7e25b6257c6091aec524f5c51b2a70466f8afa3be8670f946","observation_id":"ff6e06ee-10f1-476e-bd86-2f9a31d29295","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"jina-embeddings-v5-text: Task-targeted embed- ding distillation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:4e87c58d890a206ddad4fef288173e915f3be3a498facf4bc4b0baca3578b911","observation_id":"9765ec5e-23d3-4042-8b50-d59d302dcba9","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"M3-embedding: Multi-linguality, multi-functionality, multi-granularity text embeddings through self-knowledge distillation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:626bbcbfacc5c9cf5d591ce56797f65265b77a94f105c9bd8421d0960c0a078b","observation_id":"6ae1b587-e4cd-44cd-96c7-3f9d78811163","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Arctic-embed 2.0: Multi- lingual retrieval without compromise,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:1feafb614b33e4ebdcfa7fa164e1f14c055bfacdf63cff35fd736727d3bc4e30","observation_id":"ffb0edc9-42ae-4045-94ef-e1700c492444","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19527","last_updated":"2024-07-28T16:34:25Z","snapshot_observed_at":"2026-08-09T17:38:08.209766Z","submitted_at":"2024-07-28T16:34:25Z","title":"Open Sentence Embeddings for Portuguese with the Serafim PT* encoders family","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19527","snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Open sentence embeddings for Portuguese with the Serafim PT* encoders family,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"cited_paper":"/paper/2407.19527","citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:071ada62ac252a74698ecfca14a9f9eec6dbafbd14208aaa759f277c2a833fc2","observation_id":"abeb1e78-4458-4907-a278-2bc4f97c4b47","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Fostering the ecosystem of open neural encoders for Portuguese with Albertina PT* family,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:5313b091b3d3d67f63890c52b503f2082851835f2ea0ae5af877d3db207db57c","observation_id":"22c41d77-40c8-40ae-b8f3-8f2ba21a4a9f","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"BERTimbau: Pretrained BERT models for Brazilian Portuguese,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:d21c2fe48c5846aae0e8d3e816d63dbbc2c1a5024ac31320c509a0edac4bfa10","observation_id":"62e460e6-b3ac-4258-84db-a55371d83033","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"A semantic search system for the Supremo Tribunal de Justic ¸a,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:98f02af87b498698a8692ac5a25c68f0f6ff12033f3364d776d3e0b7d2058210","observation_id":"8e231ee4-f138-4559-acb5-ff120ea4b613","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Language- agnostic BERT sentence embedding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:5585171282bcdd5723e85c371a784ca8e8eb46b0377a501f5ec6b155b5cc9cf2","observation_id":"cce035fa-6466-43d1-8648-9d3031a98057","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"EmbeddingGemma: Powerful and lightweight text representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:241bc0bf5ab75bce4f727293eb1dcdd1d03e5f37097e302918c6961436f2339c","observation_id":"4cc83b6c-82aa-43ff-89eb-5cef6af73f72","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"PIXIE-rune-v1.0,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:920cbe9dc3492979a09a2040aa933d4ad34196623faf9db4b104d219f3556a2b","observation_id":"04ffcbb8-b8ed-46f4-bf3b-52615c9ff237","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"PwC-embedding expr,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:070357ca29f71aa0e5594bd99aedd179f37a69da5adbb7d44119f8bf04e6a29b","observation_id":"ffe9e9e0-6d48-46be-9a79-8b1c613fabd2","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03799","last_updated":"2022-10-07T17:52:53Z","snapshot_observed_at":"2026-08-07T15:24:29.831112Z","submitted_at":"2022-02-08T11:44:20Z","title":"What are the best systems? New perspectives on NLP Benchmarking","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03799","snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"What are the best Systems? New Perspectives on NLP Benchmarking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"cited_paper":"/paper/2202.03799","citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:dbe0587229a9f9fc08d43a2027c48b359c89d52503e3877a2eb19745085c4df8","observation_id":"5f4535cd-0037-4d6a-80f3-b29b51caf2ae","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":null,"venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:2c659cd642dcbf95fe5e9a5b5840e6aca34a48b434f876f52ea86a9b5995be65","observation_id":"aa7c11af-d329-4c9c-a1d7-4218f3a45320","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Building an evaluation scale using item response theory,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:ebecfb45d906bf30a4e3746f47580a9b8ec9ec8a1c47dad3d32336420c641b23","observation_id":"634a025e-76df-4e32-980a-8c57d775da13","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"tinyBenchmarks: evaluating LLMs with fewer examples,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:f50510ef04b3196887156649ad2a1527ac700a1b12e80d6713e88c85dad148b4","observation_id":"be3a9d01-efb5-4cbf-93f2-dc35f1c91451","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T16:55:28.735209Z","title":"Evaluation examples are not equally informative: How should that change NLP leaderboards?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-11T16:55:28.735209Z"},"links":{"citing_paper":"/paper/2607.04581"},"observation_digest":"sha256:72228dc20ac502d2da8fe1cc620b0669661b83f39fcb72f1dd51e2f338b2f0d3","observation_id":"1f397c67-1702-437b-afb1-f8bd1c229425","resolution":{"observed_at":"2026-07-11T16:55:28.735209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04581","last_updated":"2026-07-07T20:54:18Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-01T19:12:54.126950Z","submitted_at":"2026-07-06T01:19:30Z","title":"MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 1 inbound Pith citation observation for arXiv:2607.04581."}