Pith. sign in

Paper Citation Record · LEDGER

Language Models are Universal Embedders

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2310.08232.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2310.08232 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 8 of 8 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 8 of 8 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:48:01.889809Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

2
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation d2a476cd-ade0-43e7-94d6-2761c7ac8f63 · inbound

Data-CUBE: Data Curriculum for Instruction-based Sentence Representation Learning cites this paper.

Data-CUBE: Data Curriculum for Instruction-based Sentence Representation Learning Language Models are Universal Embedders

Reference 53

Resolution
verified exact
arxiv_id, observed 2026-05-24T04:33:53.645931Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-05-24T04:29:05.113230Z digest=sha256:f20f438039dc0825e11e82ed28fad4800152b8c1c7d33b1b3bd5bf2862e39ab5

Observation b8d4e2f2-f7fe-49f0-8aba-ce439538dab1 · inbound

Contrastive Learning on LLM Back Generation Treebank for Cross-domain Constituency Parsing cites this paper.

Contrastive Learning on LLM Back Generation Treebank for Cross-domain Constituency Parsing Language Models are Universal Embedders

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T13:48:01.889809Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T13:48:01.889809Z digest=sha256:caa2f5f2751dd5565b85deb733f022f8619e9d2e0bd40213bd396028545f6405

Observation 0278ade8-7992-4456-aca6-2b4ac33e8f70 · inbound

GATE: General Arabic Text Embedding for Enhanced Semantic Textual Similarity with Matryoshka Representation Learning and Hybrid Loss Training cites this paper.

GATE: General Arabic Text Embedding for Enhanced Semantic Textual Similarity with Matryoshka Representation Learning and Hybrid Loss Training Language Models are Universal Embedders

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:29.530957Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:35:29.530957Z digest=sha256:836461711f88335bddfa6152a27393ad3ef7777e48d36bc669a6e2c050622b43

Observation 9ee9f992-0319-452f-9318-4926fb7c705f · inbound

Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning cites this paper.

Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning Language Models are Universal Embedders

Reference 125

Resolution
unresolved
no resolver link, observed 2026-08-07T05:18:33.823315Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T05:18:33.823315Z digest=sha256:4f409a1f5c342dcf2e68a0d1b0d1b6cc3cfe528ce5f9986edbf55bba0b96da3b

Observation 7d764506-9809-4df9-b08c-d063559ac7a6 · inbound

Causal2Vec: Improving Decoder-only LLMs as Embedding Models through a Contextual Token cites this paper.

Causal2Vec: Improving Decoder-only LLMs as Embedding Models through a Contextual Token Language Models are Universal Embedders

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-19T02:21:59.269987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-19T02:19:20.792488Z digest=sha256:0214e87a498b8edc03518acdb823af783b02dbe8804a1f42a84942d98c8bd0e6

Observation 15701eec-a68a-4602-bb80-7ceeb2824b31 · inbound

Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future cites this paper.

Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future Language Models are Universal Embedders

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-05T23:06:49.731775Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T23:06:49.731775Z digest=sha256:523ff96b3485846870a5e93d11402d42aff81d98e5b574eeb5b83152ffd70173

Observation 51d59568-163a-4516-baa9-9ed13413b0fa · inbound

Negative Matters: Multi-Granularity Hard-Negative Synthesis and Anchor-Token-Aware Pooling for Enhanced Text Embeddings cites this paper.

Negative Matters: Multi-Granularity Hard-Negative Synthesis and Anchor-Token-Aware Pooling for Enhanced Text Embeddings Language Models are Universal Embedders

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-05T13:16:26.851241Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T13:16:26.851241Z digest=sha256:af10f16aee54187fbd51652cdbdd6a0721503667e504254160f3296e5e959c65

Observation 3bdb5ebd-9b76-4ef6-880b-4620ec3a7171 · inbound

Embedding-based In-Context Prompt Training for Enhancing LLMs as Text Encoders cites this paper.

Embedding-based In-Context Prompt Training for Enhancing LLMs as Text Encoders Language Models are Universal Embedders

Reference 62

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T16:46:14.936176Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-05-09T15:03:33.323423Z digest=sha256:8953ddb7434408088f233ccd787c48a5634d090458bee2766064411406b7cd06