{"as_of":"2026-08-17T19:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:114282bf5f86f8f15fd4fd8b68773e89ec5fb90891970074cbc09ace43036be3","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:18:27.131979Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:22:14.288351Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T13:36:59.108858Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-08-04T08:22:14.288351Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.21364","last_updated":"2026-06-01T11:38:51Z","snapshot_observed_at":"2026-08-14T21:28:11.868911Z","submitted_at":"2025-10-24T11:48:49Z","title":"SindBERT, the Sailor: Charting the Seas of Turkish NLP","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T08:22:14.288351Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2510.21364"},"observation_digest":"sha256:bdfebc6af49c9a8f30b22508e814997d5e4e09d2d470fff7cf5ca5589e4aea4f","observation_id":"47406b1b-089a-44a5-a3ee-31cbf53463b2","resolution":{"observed_at":"2026-08-04T08:22:14.288351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-08-04T08:21:43.058196Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.21372","last_updated":"2026-06-01T11:52:23Z","snapshot_observed_at":"2026-08-09T13:28:37.992565Z","submitted_at":"2025-10-24T11:52:29Z","title":"HalleluBERT: Let Every Token That Has Meaning Bear Its Weight","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T08:21:43.058196Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2510.21372"},"observation_digest":"sha256:2c0e3e4b8e3690e907ff8913a3598e6a0f7c8446e2f5c40f2673104ebd63f7b5","observation_id":"9c0bec12-84cf-425b-8381-5bcca65204f7","resolution":{"observed_at":"2026-08-04T08:21:43.058196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2510.27269","last_updated":"2026-04-13T06:54:57Z","snapshot_observed_at":"2026-08-05T20:44:12.020817Z","submitted_at":"2025-10-31T08:17:59Z","title":"Why Do Multilingual Reasoning Gaps Emerge in Reasoning Language Models?","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T03:16:01.561180Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2510.27269"},"observation_digest":"sha256:52e73b147317cc976bc754ab0ded5d1b9ddbb412eaaa3055bd93ad83e151e57c","observation_id":"b298ef7d-4711-4d06-8c1b-b1957acb738d","resolution":{"observed_at":"2026-05-18T03:20:49.219898Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-08-03T11:08:45.430895Z","title":"Hadar Miller, Tsvi Kuflik, and Moshe Lavee","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07533","last_updated":"2026-07-11T18:41:47Z","snapshot_observed_at":"2026-08-13T15:04:05.932528Z","submitted_at":"2026-01-12T13:34:49Z","title":"Loci Similes: A Benchmark for Extracting Intertextualities in Latin Literature","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T11:08:45.430895Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2601.07533"},"observation_digest":"sha256:14a749d431be4e0e7ae97598a4620003a8cc486e949d65bb8f1c0c654fb34ceb","observation_id":"172f5c1f-5cb5-4973-b4da-ac2e0c9f6475","resolution":{"observed_at":"2026-08-03T11:08:45.430895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2604.16380","last_updated":"2026-03-25T13:30:40Z","snapshot_observed_at":"2026-08-15T22:16:01.152280Z","submitted_at":"2026-03-25T13:30:40Z","title":"Data Mixing for Large Language Models Pretraining: A Survey and Outlook","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:04.958757Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2604.16380"},"observation_digest":"sha256:f407b3483d730a2d104d7d65f1f62d08d2737b8c00d9b5be76eaf2aeed8f9348","observation_id":"aa4a43c3-889c-43d7-9fef-84e8b2ad9b6d","resolution":{"observed_at":"2026-05-15T00:58:25.726943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2605.05277","last_updated":"2026-05-06T15:22:40Z","snapshot_observed_at":"2026-08-11T10:49:37.467491Z","submitted_at":"2026-05-06T15:22:40Z","title":"GLiNER Guard: Unified Encoder Family for Production LLM Safety and Privacy","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T16:49:28.684979Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2605.05277"},"observation_digest":"sha256:90086c5d8b2fac153db3b53512b53c4e8dc8800e8726cb9e15953e3c700f29ed","observation_id":"f808d8b2-6aca-443d-8334-c156a13b2a24","resolution":{"observed_at":"2026-05-11T18:01:05.737161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2605.13521","last_updated":"2026-05-13T13:37:45Z","snapshot_observed_at":"2026-08-17T08:13:54.190812Z","submitted_at":"2026-05-13T13:37:45Z","title":"Granite Embedding Multilingual R2 Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-14T18:16:49.148303Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2605.13521"},"observation_digest":"sha256:60d8d43a5a197530289c60b05676ed04d325f89f53a9a695d2b75554c9763d9d","observation_id":"423a8068-0293-495b-be2e-e801095d9a33","resolution":{"observed_at":"2026-05-14T18:17:34.999588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2605.14257","last_updated":"2026-05-21T13:46:16Z","snapshot_observed_at":"2026-08-15T16:54:48.695790Z","submitted_at":"2026-05-14T01:57:35Z","title":"Sakura at BEA 2026 Shared Task 1: What Makes Vocabulary Difficult?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-15T02:59:51.258877Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2605.14257"},"observation_digest":"sha256:f16d0d53fccb551e0101b6c66e1c513d01431e1565b4f161cd30e8a0d0fc5b3b","observation_id":"e8c435a6-f6b8-4d30-90d3-e3a8c412779d","resolution":{"observed_at":"2026-05-15T03:03:57.846854Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2605.14257","last_updated":"2026-05-21T13:46:16Z","snapshot_observed_at":"2026-08-15T16:54:48.695790Z","submitted_at":"2026-05-14T01:57:35Z","title":"Sakura at BEA 2026 Shared Task 1: What Makes Vocabulary Difficult?","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-22T10:32:17.479731Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2605.14257"},"observation_digest":"sha256:fb05d2a10d59c3d06b048c724ba99c741719a7f0becc3b7494690d4657d9e6b4","observation_id":"a2fa4443-3833-43f3-a185-312387497bf6","resolution":{"observed_at":"2026-05-22T10:34:47.456242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2605.23033","last_updated":"2026-05-21T20:58:42Z","snapshot_observed_at":"2026-08-14T23:43:00.259898Z","submitted_at":"2026-05-21T20:58:42Z","title":"Uncovering the Latent Potential of Deep Intermediate Representations","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-25T05:36:24.743558Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2605.23033"},"observation_digest":"sha256:9f63ce754ae6ae593339e196af004ef618fefe2ba1ce1491e4e7b6213de0fc3e","observation_id":"17ce8325-8654-4d58-ad84-217dc8353eb0","resolution":{"observed_at":"2026-05-25T05:36:39.272488Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2606.06349","last_updated":"2026-06-04T16:20:14Z","snapshot_observed_at":"2026-08-16T09:33:25.474530Z","submitted_at":"2026-06-04T16:20:14Z","title":"\"Chi nas dal soch el sent de legn\" -- Auditing Text Corpora for Lombard","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-28T01:35:02.981356Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2606.06349"},"observation_digest":"sha256:da1a07de01334271fbe305330cf22df9f84021c27b130d625083edc3d055c06c","observation_id":"fd9aeb98-bade-4618-82b2-941b8270fcd9","resolution":{"observed_at":"2026-07-02T13:06:59.120356Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2606.06738","last_updated":"2026-06-04T21:51:50Z","snapshot_observed_at":"2026-08-16T12:43:58.830618Z","submitted_at":"2026-06-04T21:51:50Z","title":"Modular Monolingual Adaptation using Pretrained Language Models","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-06-28T01:11:42.032901Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2606.06738"},"observation_digest":"sha256:ffb25ad25e35f9e7ba1b8e92914009bd58aad428f624b2abb17f04dd34fe23f8","observation_id":"33bf8e1a-561d-43f4-94b1-ef09ca38a4a7","resolution":{"observed_at":"2026-07-02T13:36:59.110192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":"2509.06888","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-02T13:36:59.108858Z","title":"arXiv preprint arXiv:2509.06888 , year=","venue":null,"work_id":"a4af1942-6773-4b72-afdc-d0963c88f9a6","year":2025},"citing_paper":{"arxiv_id":"2606.30312","last_updated":"2026-06-29T13:54:04Z","snapshot_observed_at":"2026-08-12T07:59:03.018067Z","submitted_at":"2026-06-29T13:54:04Z","title":"DialogPII: A multilingual dataset of synthetic dialog transcripts to detect personal information","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T06:23:41.296504Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2606.30312"},"observation_digest":"sha256:a6770e26752c6c8078c5f4a75452a9897cd15e3434305ba00373277ff5ebe133","observation_id":"58021135-b89e-4c82-b11f-8e95393acbf2","resolution":{"observed_at":"2026-06-30T06:24:18.784290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-08-01T03:15:59.904120Z","title":"mmBERT : A modern multilingual encoder with annealed language learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25180","last_updated":"2026-07-28T01:13:37Z","snapshot_observed_at":"2026-08-16T09:47:27.195023Z","submitted_at":"2026-07-28T01:13:37Z","title":"Bekko Embedding: Parameter-Efficient Multilingual Retrieval with Ultra-Compact Encoders","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-01T03:15:59.904120Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2607.25180"},"observation_digest":"sha256:4f60df7de30057f7e585f2da573db1a4498b92b212bc5eeda30b1c5a5b6745ed","observation_id":"31ae76f7-141e-4bc6-a164-5e1d3fd727e5","resolution":{"observed_at":"2026-08-01T03:15:59.904120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-07-30T11:17:16.860483Z","title":"Lawrie, and Benjamin Van Durme","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27178","last_updated":"2026-07-31T14:35:24Z","snapshot_observed_at":"2026-08-15T03:21:16.950609Z","submitted_at":"2026-07-29T17:50:51Z","title":"DenseOn with the LateOn: Fully Open Dense and Late-Interaction Models for Multilingual, Long-Context, and Code Search","version":1},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-07-30T11:17:16.860483Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2607.27178"},"observation_digest":"sha256:3c1c468b02b18da8006502e223514adb0fcbea8c946488aa3dabf5f6fcdad1ef","observation_id":"794c04d1-975c-4a7b-8cfa-48227618340a","resolution":{"observed_at":"2026-07-30T11:17:16.860483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06888","snapshot_observed_at":"2026-08-03T01:43:12.273462Z","title":"Lawrie and Benjamin Van Durme , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27178","last_updated":"2026-07-31T14:35:24Z","snapshot_observed_at":"2026-08-15T03:21:16.950609Z","submitted_at":"2026-07-29T17:50:51Z","title":"DenseOn with the LateOn: Fully Open Dense and Late-Interaction Models for Multilingual, Long-Context, and Code Search","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-03T01:43:12.273462Z"},"links":{"cited_paper":"/paper/2509.06888","citing_paper":"/paper/2607.27178"},"observation_digest":"sha256:ed3c9361bc5edf3afe9c95a5e56a99167b4343cb28446484adbbee3315dc793d","observation_id":"996c3c8a-7faa-461c-a19b-a4d3ed5adbb2","resolution":{"observed_at":"2026-08-03T01:43:12.273462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.06888/citation-record","integrity":"/paper/2509.06888/integrity","json":"/paper/2509.06888/citation-record.json","paper":"/paper/2509.06888"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T16:18:26.412899Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.412899Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:e230f5652b73962851dc51f53d8b86dca57f41f6e0ece5fed2a11bda27672de5","observation_id":"75cea561-6a3a-4d89-8175-ec4dd9328497","resolution":{"observed_at":"2026-08-15T16:18:26.412899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.11041","last_updated":"2018-02-26T16:54:14Z","snapshot_observed_at":"2026-08-15T01:21:20.257668Z","submitted_at":"2017-10-30T16:17:34Z","title":"Unsupervised Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.11041","snapshot_observed_at":"2026-08-15T16:18:26.441826Z","title":"Unsupervised neural machine translation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.441826Z"},"links":{"cited_paper":"/paper/1710.11041","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:414155ffd3a769e96d57bf9b55f5e838887dc54674cabb86148209079254659b","observation_id":"642473dc-da73-445c-8530-dccbeb45a799","resolution":{"observed_at":"2026-08-15T16:18:26.441826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-08-15T16:18:26.448271Z","title":"Ms marco: A human generated machine reading comprehension dataset","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.448271Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:5a38f6d9422c77e0e7e87e55d5a5a4874f32f64ac7a5bf98473c94d878ff6c23","observation_id":"fe621ff5-95a2-40e0-9f3c-a3ee356afce6","resolution":{"observed_at":"2026-08-15T16:18:26.448271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07049","last_updated":"2023-07-13T20:04:02Z","snapshot_observed_at":"2026-08-16T15:16:23.725497Z","submitted_at":"2023-07-13T20:04:02Z","title":"MegaWika: Millions of reports and their sources across 50 diverse languages","version":1},"cited_work":{"arxiv_id":"2307.07049","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.07049","snapshot_observed_at":"2026-08-15T16:18:28.020318Z","title":"MegaWika: Millions of reports and their sources across 50 diverse languages","venue":"cs.CL","work_id":"dbb2866a-aa3e-4f6f-8baf-597e02318a43","year":2023},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.453312Z"},"links":{"cited_paper":"/paper/2307.07049","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:d7b9c69a557ad3b62615106d675d91557b0fd267aefb1c4817c79aa87cb4cb50","observation_id":"a017ee28-b79e-4ca9-8ef7-f71d1f24f42e","resolution":{"observed_at":"2026-08-15T16:18:28.025638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03828","last_updated":"2025-08-05T18:18:17Z","snapshot_observed_at":"2026-08-15T03:51:40.716769Z","submitted_at":"2025-08-05T18:18:17Z","title":"MegaWika 2: A More Comprehensive Multilingual Collection of Articles and their Sources","version":1},"cited_work":{"arxiv_id":"2508.03828","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.03828","snapshot_observed_at":"2026-08-15T16:18:27.997211Z","title":"MegaWika 2: A More Comprehensive Multilingual Collection of Articles and their Sources","venue":"cs.DL","work_id":"bc48fc28-783a-4c59-b0d9-7b668137793a","year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.458318Z"},"links":{"cited_paper":"/paper/2508.03828","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:f91e6c632404f2586ecb6e0239d1a800d7e7b87b7a7f913d686b22ab80f9afb3","observation_id":"b9a7c347-b10d-4dd8-9de0-96f6f7d88fd3","resolution":{"observed_at":"2026-08-15T16:18:28.003307Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05500","last_updated":"2026-06-01T09:22:31Z","snapshot_observed_at":"2026-08-16T12:52:08.464775Z","submitted_at":"2025-03-07T15:13:58Z","title":"EuroBERT: Scaling Multilingual Encoders for European Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05500","snapshot_observed_at":"2026-08-15T16:18:26.463007Z","title":"Eurobert: scaling multilingual encoders for european languages","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.463007Z"},"links":{"cited_paper":"/paper/2503.05500","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:11b88ca71ff87384560d6091034d95028b32349ba999a394e10f19e3d39b7fb0","observation_id":"be569f27-5ffa-47bd-b119-4047e95c7bf9","resolution":{"observed_at":"2026-08-15T16:18:26.463007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.468436Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.468436Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:9240b08038e9a09161509a678d66a720899e8e2d7cce4b9a342368192eb9b0dd","observation_id":"6e69a6d1-1faa-4d37-a080-ebee8224a734","resolution":{"observed_at":"2026-08-15T16:18:26.468436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-15T16:18:26.478308Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodality, long context, and next generation agentic capabilities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.478308Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:6bbd7348b954c8881e0ecb5faa81ffaf6f99aedf8468acf922492454a37ab8fd","observation_id":"01aa3b65-b211-4ef0-b5d8-153a0ea7412b","resolution":{"observed_at":"2026-08-15T16:18:26.478308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02116","last_updated":"2020-04-08T01:02:17Z","snapshot_observed_at":"2026-08-16T12:39:33.749100Z","submitted_at":"2019-11-05T22:42:00Z","title":"Unsupervised Cross-lingual Representation Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02116","snapshot_observed_at":"2026-08-15T16:18:26.495852Z","title":"Unsupervised cross-lingual representation learning at scale","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.495852Z"},"links":{"cited_paper":"/paper/1911.02116","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:fd336c26aa16fd82656e181c11e56c9d49416b144cbc69261849393905753d3a","observation_id":"c72acc5d-080f-4a6d-b59f-a8961c30abed","resolution":{"observed_at":"2026-08-15T16:18:26.495852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.520758Z","title":"BERT: pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.520758Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:5dbec8c434e2d3624e5e0b2a9ad6d9bb2c395ee7e410f713d06ffee68e5279f9","observation_id":"0cac66f9-8be8-41c5-913f-29a15e972608","resolution":{"observed_at":"2026-08-15T16:18:26.520758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T16:18:26.526287Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.526287Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:1f0dd50ce82d86bd35c894446f3aa4673bec8c0c8955f9fe15cd72eac9cc7ee9","observation_id":"aa4b8efb-c728-4913-a484-8657a2d28e98","resolution":{"observed_at":"2026-08-15T16:18:26.526287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.530911Z","title":"Mmteb: Massive multilingual text embedding benchmark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.530911Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:43340d05d44a9a6423f71f786f7e24a2c68e163d214754b47c320c7c4a4b774c","observation_id":"f8911fdb-a38b-4c83-91e0-bda20bd9f33c","resolution":{"observed_at":"2026-08-15T16:18:26.530911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.535536Z","title":"Beyond english-centric multilingual machine translation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.535536Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:a35d7855495394d33b38a8dab459f790b69eba468c411351f9ad9dddc8772046","observation_id":"03dc9cbc-4812-4bda-90af-5e93b320d8b4","resolution":{"observed_at":"2026-08-15T16:18:26.535536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.671974Z","title":"Question-answering in a low-resourced language: Benchmark dataset and models for tigrinya","venue":null,"work_id":"a7e3a7dd-fcab-49fc-abee-1b55dd2e9a07","year":2023},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.539938Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:49a4e7098822f753084281c9797fc264992a925e56af60a3fdb9350d41107967","observation_id":"a357f415-9c1c-412e-9e1b-ca0ba4fcfe80","resolution":{"observed_at":"2026-08-15T16:18:28.676920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.544591Z","title":"How to train long-context language models (effectively), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.544591Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:7d3e2c91881a251e508cb12975bd5d41407a7a5634df429c3fe408910eee6b06","observation_id":"f2a4c0c6-68bf-4a22-8a3c-20d36233d875","resolution":{"observed_at":"2026-08-15T16:18:26.544591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-15T16:18:26.550001Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.550001Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:a154739ac8cb6eebb725a74eb6b196e51efb4e784512c8cb17e9394b26bebba1","observation_id":"968937d0-b4a8-4a07-a5a5-55b834323554","resolution":{"observed_at":"2026-08-15T16:18:26.550001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-15T16:18:26.554516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.554516Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:919d4a0a1dc4896f78b33be590a51d33e2517c260ada5c461e4a0f36c89ec1bd","observation_id":"519b121b-4528-4715-9cdb-ddb2a295eca0","resolution":{"observed_at":"2026-08-15T16:18:26.554516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00994","last_updated":"2026-05-05T08:00:08Z","snapshot_observed_at":"2026-08-17T01:19:17.344110Z","submitted_at":"2025-07-01T17:45:48Z","title":"Should We Still Pretrain Encoders with Masked Language Modeling?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00994","snapshot_observed_at":"2026-08-15T16:18:26.559598Z","title":"Alves, Emmanuel Malherbe, André F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.559598Z"},"links":{"cited_paper":"/paper/2507.00994","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:d9507b7a9d550214ee42d09f0740139f015f218ff6a47b5f2b63027a989279fe","observation_id":"7ade6385-a108-4f76-aeda-bed9ae51ae91","resolution":{"observed_at":"2026-08-15T16:18:26.559598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.655903Z","title":"Debertav3: Improving deberta using electra-style pre-training with gradient-disentangled embedding sharing","venue":null,"work_id":"cdb2b563-ab74-4c97-b2c7-0fd2ef016153","year":2023},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.564311Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:dd6042757322843c96a3e4f114a201cb7f35c3f5d6ae647375336401e6f2428f","observation_id":"77c45754-d836-4373-aad5-64aa400d8b89","resolution":{"observed_at":"2026-08-15T16:18:28.661191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.638549Z","title":"Xtreme: A massively multilingual multi-task benchmark for evaluating cross-lingual generalisation","venue":null,"work_id":"9bb59f8c-0e47-4ddc-a19f-2e9cc605bc66","year":2020},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.569718Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:fa31380f78ef0a5f8ba4a4b5c3b88d2e1aebd9997ba686eaedbed1365ebe23b6","observation_id":"5c91f704-5bcd-498d-a907-e0ada9c68673","resolution":{"observed_at":"2026-08-15T16:18:28.644847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.538168Z","title":"Neobert: A next generation bert","venue":null,"work_id":"b1730d5b-2794-4977-af13-132d782de2b6","year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.574124Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:4716357d2f03e4079949485a57775d8778585b83aa04dac4e242d37449b043da","observation_id":"83ca2a92-1dae-4f09-b886-c558cfe3210b","resolution":{"observed_at":"2026-08-15T16:18:28.595942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.523443Z","title":"Datacomp-lm: In search of the next generation of training sets for language models","venue":null,"work_id":"9debac00-23db-4d75-982a-a71bc92eda0a","year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.578143Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:234d5d6cffc3e64259d69901342a9d3660e85d64c7d279e1a964a7ed4dbbc9d4","observation_id":"20bd91ee-eb81-4ae1-ae34-815f5df7218f","resolution":{"observed_at":"2026-08-15T16:18:28.528396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02883","last_updated":"2025-06-06T03:39:22Z","snapshot_observed_at":"2026-08-16T13:37:29.391352Z","submitted_at":"2024-07-03T07:58:20Z","title":"CoIR: A Comprehensive Benchmark for Code Information Retrieval Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02883","snapshot_observed_at":"2026-08-15T16:18:26.606516Z","title":"Coir: A comprehensive benchmark for code information retrieval models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.606516Z"},"links":{"cited_paper":"/paper/2407.02883","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:30abfb93d566b2632072b192cc8561cde42b08c3da783652eb13737127b0ce58","observation_id":"d4f301de-51e7-49e8-aea6-b8430078ea1f","resolution":{"observed_at":"2026-08-15T16:18:26.606516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-15T16:18:26.683169Z","title":"Roberta: A robustly optimized BERT pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.683169Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:caa4337f992fb00d1e480ee6bf2910d5981f880d40a633390c27659dcaf42751","observation_id":"10023e63-b180-45de-9183-d1944e9d088e","resolution":{"observed_at":"2026-08-15T16:18:26.683169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.694659Z","title":"Fineweb-edu: the finest collection of educational content, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.694659Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:8a37c627f080b7644f3312f39964af6a5399f2122492edfabcbbbca699db20f4","observation_id":"eedea4cd-b4ad-4683-a2f7-af42d7a512b4","resolution":{"observed_at":"2026-08-15T16:18:26.694659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.497224Z","title":"Eurollm: Multilingual language models for europe","venue":null,"work_id":"250c727b-eb6e-40c1-8d2c-edb5d5c79fe0","year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.698880Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:384078792a3ab540d90d22bb0852490c8202066b2138344584961b3a4b93ac6c","observation_id":"a192e8d7-d121-4bb7-bc85-ccfa3c2ad226","resolution":{"observed_at":"2026-08-15T16:18:28.502017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.703510Z","title":"Enhancing multilingual llm pretraining with model-based data selection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.703510Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:9ac7743e52e52f046bcc221e2161ab7910c75264d144d70f2165ffe91cb31e44","observation_id":"e2b0b6a3-854f-4667-945c-f80047eed3a8","resolution":{"observed_at":"2026-08-15T16:18:26.703510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00906","last_updated":"2023-04-03T11:51:46Z","snapshot_observed_at":"2026-08-16T15:43:14.793715Z","submitted_at":"2023-04-03T11:51:46Z","title":"ScandEval: A Benchmark for Scandinavian Natural Language Processing","version":1},"cited_work":{"arxiv_id":"2304.00906","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.00906","snapshot_observed_at":"2026-08-15T16:18:27.541404Z","title":"ScandEval: A Benchmark for Scandinavian Natural Language Processing","venue":"cs.CL","work_id":"658da87f-2d5e-4946-b906-5430b6e9d7ac","year":2023},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.709162Z"},"links":{"cited_paper":"/paper/2304.00906","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:d97b9df281940d35eb90cbc64c0417d6d6e3d365abed0449f4dea2eb60f95bd8","observation_id":"c33332a0-2cc5-425a-94fe-2467dc578880","resolution":{"observed_at":"2026-08-15T16:18:27.594534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01613","last_updated":"2025-02-03T22:26:56Z","snapshot_observed_at":"2026-08-14T15:03:32.894363Z","submitted_at":"2024-02-02T18:23:18Z","title":"Nomic Embed: Training a Reproducible Long Context Text Embedder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01613","snapshot_observed_at":"2026-08-15T16:18:26.714494Z","title":"Morris, Brandon Duderstadt, and Andriy Mulyar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.714494Z"},"links":{"cited_paper":"/paper/2402.01613","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:52395a648ab9cc1bfc1b230daefcba99cdd9181f747387787c345f4672c6895f","observation_id":"72eca498-2f57-4c78-b98b-a192e944490b","resolution":{"observed_at":"2026-08-15T16:18:26.714494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-17T13:58:40.683829Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-15T16:18:26.720234Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.720234Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:5f4d03f9320d819491c1726d1eb9952ab6527733f8076783d5ecc61334796e3e","observation_id":"d991638c-7ceb-4786-8cda-ba0bd085f3a2","resolution":{"observed_at":"2026-08-15T16:18:26.720234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.459368Z","title":"Openai o3 and o4-mini system card, 2025","venue":null,"work_id":"d78de7af-a582-40ce-8b42-537abc37a4fe","year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.725824Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:1d1df378ea8bcac87d06f3f93066cb0e57bc7164e3cf184bb831ab49f7042222","observation_id":"8cedd245-84d2-477a-a9a7-dfcd15056499","resolution":{"observed_at":"2026-08-15T16:18:28.485656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.730281Z","title":"The fineweb datasets: Decanting the web for the finest text data at scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.730281Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:230f6fcc1281c33cf17ebb12b5e0d385d88d3644bbd07453e952f47aeee87986","observation_id":"17d91353-3ea4-49aa-a033-1bd713712e07","resolution":{"observed_at":"2026-08-15T16:18:26.730281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20920","last_updated":"2025-06-26T01:01:47Z","snapshot_observed_at":"2026-08-13T04:59:54.179036Z","submitted_at":"2025-06-26T01:01:47Z","title":"FineWeb2: One Pipeline to Scale Them All -- Adapting Pre-Training Data Processing to Every Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20920","snapshot_observed_at":"2026-08-15T16:18:26.734265Z","title":"Fineweb2: One pipeline to scale them all -- adapting pre-training data processing to every language, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.734265Z"},"links":{"cited_paper":"/paper/2506.20920","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:18250201071856bd5dd2a40979691c6663b29e2f7498a148d948dc9f400cb2f7","observation_id":"6bc22003-f510-43ac-92f7-025f702bf74c","resolution":{"observed_at":"2026-08-15T16:18:26.734265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.738516Z","title":"Peters, Mark Neumann, Mohit Iyyer, Matt Gardner, Christopher Clark, Kenton Lee, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.738516Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:cd09f49bb40dcdf1582e7d9da21b47c4d682fe3965754329d6646ee64b276357","observation_id":"60d85e22-30b1-4fb8-a354-10a5b3e02ea3","resolution":{"observed_at":"2026-08-15T16:18:26.738516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.282483Z","title":"Mosaicbert: A bidirectional encoder optimized for fast pretraining","venue":null,"work_id":"60b3ed13-3c72-45c2-a047-3b1d5a7b79c7","year":2023},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.744162Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:afab112575626ce738f8583902f95c396319e8a74abab4897fc0fbf22b19c439","observation_id":"72b86be0-00e3-4be9-9cf9-a47b79ed806d","resolution":{"observed_at":"2026-08-15T16:18:28.370372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-15T16:18:26.850594Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.850594Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:32df50f69b060cd41af4b2354d162ff8a760192283e9ff99ce47bee32449b77a","observation_id":"b3bd6391-dab2-42c1-a005-e4e05e80060d","resolution":{"observed_at":"2026-08-15T16:18:26.850594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-15T16:18:26.978797Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.978797Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:e076b8636a513030eb4bf6f163973a24a9e929d542d08d4f39dcc892045033ef","observation_id":"c769baec-2a8b-409e-8ff5-21391ce021f4","resolution":{"observed_at":"2026-08-15T16:18:26.978797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07642","last_updated":"2025-02-11T15:33:17Z","snapshot_observed_at":"2026-08-16T10:20:06.442839Z","submitted_at":"2025-02-11T15:33:17Z","title":"FoQA: A Faroese Question-Answering Dataset","version":1},"cited_work":{"arxiv_id":"2502.07642","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.07642","snapshot_observed_at":"2026-08-15T16:18:27.453565Z","title":"FoQA: A Faroese Question-Answering Dataset","venue":"cs.CL","work_id":"9f2badc2-92bc-48e8-8452-7911c9555e03","year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.983999Z"},"links":{"cited_paper":"/paper/2502.07642","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:4d2ed37ff7603f89e9112bdef4ae39d555e7bd2db778d15c5d882ee7d06ce59d","observation_id":"65d2e28a-0bfb-439a-a3f8-1290cc5ecc3e","resolution":{"observed_at":"2026-08-15T16:18:27.460619Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00159","last_updated":"2024-06-06T18:46:40Z","snapshot_observed_at":"2026-08-16T14:22:43.864879Z","submitted_at":"2024-01-31T20:29:50Z","title":"Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00159","snapshot_observed_at":"2026-08-15T16:18:26.989113Z","title":"Dolma: An open corpus of three trillion tokens for language model pretraining research","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.989113Z"},"links":{"cited_paper":"/paper/2402.00159","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:4650a75eca95d31d62baadceacb5c5b0abd8e8a0cef4ac565fb91f7aa5e1ac1e","observation_id":"149d19ad-cbec-4a71-a0a9-b1906e082c87","resolution":{"observed_at":"2026-08-15T16:18:26.989113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:26.994627Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.994627Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:709bd78848a1394f2e060c33435d2a40676f48e6212895391f363bf83997f6ec","observation_id":"aeeed955-2814-4f1f-83a3-512cb9791b9b","resolution":{"observed_at":"2026-08-15T16:18:26.994627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-15T16:18:26.999440Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:26.999440Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:c5acaa8c4e5abc10bad9c607f956e9139f4ce87f03df7e29878e5834e1dfadfc","observation_id":"b8fe5b1d-621f-4598-8027-82cc60d5cd86","resolution":{"observed_at":"2026-08-15T16:18:26.999440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-15T16:18:27.004861Z","title":"Gemma 3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.004861Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:9bd6299fe6e8082e31f6a9cdd193bb6b783eb57d237a593c2942756647954d46","observation_id":"df0911ea-d125-4130-b169-39f5e12ca5b1","resolution":{"observed_at":"2026-08-15T16:18:27.004861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-15T16:18:27.009429Z","title":"No language left behind: Scaling human-centered machine translation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.009429Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:14cfd1ad21a58813c2ef732a45fb761860897bf11c5b1e6522ea1027cfdcdac7","observation_id":"def02932-26c8-47fe-b646-b4d982a112bd","resolution":{"observed_at":"2026-08-15T16:18:27.009429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-08-16T09:50:11.319379Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-15T16:18:27.018657Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.018657Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:580dd58f526617dcd604d7c6edd31123c669978c75e3806a99664df83a3e8fa8","observation_id":"528a5e6c-e555-45cd-8c76-bdf09b3752dd","resolution":{"observed_at":"2026-08-15T16:18:27.018657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.256675Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers","venue":null,"work_id":"968a90fc-6767-454d-8d66-61caf8d857d8","year":2020},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.045985Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:99c9a55722c12fb6016e11edaf1c9bbe4a3c9f13f486b76b294d8fabd87fc60c","observation_id":"b1c67fae-e59b-422a-b941-a027e3f92a86","resolution":{"observed_at":"2026-08-15T16:18:28.261770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-08-16T17:36:35.256420Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-15T16:18:27.061863Z","title":"Smarter, better, faster, longer: A modern bidirectional encoder for fast, memory efficient, and long context finetuning and inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.061863Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:94a6106378631f8721643e8f3e1f6eaf354ed0925e5ddfb735d51d41758959a2","observation_id":"30d90b12-c3ad-41ec-8cca-6bd05cd1b716","resolution":{"observed_at":"2026-08-15T16:18:27.061863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:27.092075Z","title":"Seq vs seq: An open suite of paired encoders and decoders","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.092075Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:76f7109902044159de07b8a13febb27a66d82505f29871551edf72fd73a2be3e","observation_id":"dfac921c-d217-45dc-82af-fdb2c52f88a4","resolution":{"observed_at":"2026-08-15T16:18:27.092075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:27.096998Z","title":"Transformers: State-of-the-art natural language processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.096998Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:e15719026ed61a854a7059884ed28c2b0d89cbeea0b0100bafdecc0a395db318","observation_id":"625b0296-cd5b-468f-ba4a-f3ca1eb0f71b","resolution":{"observed_at":"2026-08-15T16:18:27.096998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11934","last_updated":"2021-03-11T18:45:13Z","snapshot_observed_at":"2026-08-17T02:24:20.015689Z","submitted_at":"2020-10-22T17:58:14Z","title":"mT5: A massively multilingual pre-trained text-to-text transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11934","snapshot_observed_at":"2026-08-15T16:18:27.101260Z","title":"mt5: A massively multilingual pre-trained text-to-text transformer","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.101260Z"},"links":{"cited_paper":"/paper/2010.11934","citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:4acaee146907924036db9fffa4f20f0bba626138371488adbd0be75034282c6d","observation_id":"3bf45a6a-c17d-4290-9731-a37f60804925","resolution":{"observed_at":"2026-08-15T16:18:27.101260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:27.106188Z","title":"Ties-merging: Resolving interference when merging models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.106188Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:ab3cbb7029176ef02060a26e9ce8583e781621ce3d6aae65cd30639c74f42a66","observation_id":"11af8f60-81c3-44da-b35d-d0354a81a977","resolution":{"observed_at":"2026-08-15T16:18:27.106188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.219636Z","title":"mgte: Generalized long-context text representation and reranking models for multilingual text retrieval","venue":null,"work_id":"190833da-c89a-48a8-bea7-971fe9e0390a","year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.111335Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:031cc5ae0d1c734e5ae195d19f9f1b6969ddd962601e44e6b9ade0a5626be3b1","observation_id":"abb2d4ef-f30c-46d9-b76b-e8517089f650","resolution":{"observed_at":"2026-08-15T16:18:28.225059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:27.116182Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.116182Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:256fa50a47d8391a8f40d39a6ea7e9ed691ec0223072608bd5816749e4fe6fd0","observation_id":"0a831d35-0a9b-4444-a87b-1f124625b119","resolution":{"observed_at":"2026-08-15T16:18:27.116182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:27.121273Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.121273Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:15e147accc70ed7623200ef39042009cdc366de5933c32ac1271922c0ecb2203","observation_id":"903b0da4-c8ab-43de-a708-7ba4b9538f64","resolution":{"observed_at":"2026-08-15T16:18:27.121273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:27.126863Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.126863Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:49544abc05802d112bf1497291d5d990c9413c57b99d093aaf16496f13e8d8df","observation_id":"7535148f-f9bc-4eda-9247-a67018de69d1","resolution":{"observed_at":"2026-08-15T16:18:27.126863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:18:28.084138Z","title":"Under review","venue":null,"work_id":"9cb89769-a6e3-4494-b517-45a9f6828941","year":2024},"citing_paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T16:18:27.131979Z"},"links":{"citing_paper":"/paper/2509.06888"},"observation_digest":"sha256:dee4ee23564f9b34878c2c332ec85f08503c3b2d1a4e14c682daddb4cd1c46c0","observation_id":"db527eeb-d5c9-444b-a784-f93b90969003","resolution":{"observed_at":"2026-08-15T16:18:28.137707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.06888","last_updated":"2025-09-08T17:08:42Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T16:11:55.841631Z","submitted_at":"2025-09-08T17:08:42Z","title":"mmBERT: A Modern Multilingual Encoder with Annealed Language Learning"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":4,"verified_fuzzy":11},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 16 inbound Pith citation observations for arXiv:2509.06888."}