Pith. sign in

Paper Citation Record · LEDGER

CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2010.00133.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2010.00133 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 20 of 20 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 20 of 20 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T23:35:42.784802Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T17:38:44.469211Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9a077b82-d57f-43c1-ac94-05b8d5ebfae8 · inbound

BBQ: A Hand-Built Bias Benchmark for Question Answering cites this paper.

BBQ: A Hand-Built Bias Benchmark for Question Answering CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 43

Resolution
verified exact
arxiv_id, observed 2026-05-16T19:55:11.531159Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-16T19:55:11.431020Z digest=sha256:671aa4a60b57e47f1fe3231a4456dc6926340d7323bb939377bd899bd1b54a60

Observation 38d5b2cf-e3c2-4d57-b0fd-c6b791de08f3 · inbound

Ethical and social risks of harm from Language Models cites this paper.

Ethical and social risks of harm from Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 201

Resolution
verified exact
arxiv_id, observed 2026-05-11T18:24:30.394343Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-11T18:24:28.835688Z digest=sha256:d3adad80517b1e9448a8abd6bb374802f483f11d902b9a31255f1faf588bbed3

Observation 17ce16be-f6a0-4e89-a2cf-9c92e3b0b68e · inbound

OPT: Open Pre-trained Transformer Language Models cites this paper.

OPT: Open Pre-trained Transformer Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 218

Resolution
verified exact
arxiv_id, observed 2026-05-10T20:53:17.745943Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-10T20:53:16.720145Z digest=sha256:0176ef31b294a5d0f8e4c333708a07ba4b3b20940f57c43452831ef18a706ac2

Observation 623afe96-ab53-475a-91b2-a99c22756bc2 · inbound

StarCoder: may the source be with you! cites this paper.

StarCoder: may the source be with you! CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 273

Resolution
verified exact
arxiv_id, observed 2026-05-10T23:33:01.075879Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-10T23:32:59.517389Z digest=sha256:9b051a4dfa184ab49808c9b38d9116d9d920f66af65b54812529f9a134bb7f6e

Observation a93c8510-cb55-44e1-8637-8e8266c155c7 · inbound

Self-Rewarding Language Models cites this paper.

Self-Rewarding Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 47

Resolution
verified exact
arxiv_id, observed 2026-05-13T12:01:42.380838Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-13T12:01:42.290502Z digest=sha256:47763063cbc92f0dc8df0bcff8337e012f92ea19bb057d8e0b3651f789d53784

Observation 9650fbdc-45db-4b52-91b3-d6f33ab9d339 · inbound

The Science of Evaluating Foundation Models cites this paper.

The Science of Evaluating Foundation Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-07T23:35:42.784802Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T23:35:42.784802Z digest=sha256:9ce0a18a4351d63dce8460bd658f729c87609f8970d88dc144531df186a106f3

Observation debc0755-9045-45b1-9b60-0bd2280fead5 · inbound

Relative Bias: A Comparative Framework for Quantifying Bias in LLMs cites this paper.

Relative Bias: A Comparative Framework for Quantifying Bias in LLMs CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T15:12:22.712392Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:12:22.712392Z digest=sha256:edc4654b70c92c016451fe2e3373ff9544ef3cb69e4dcedd99c5a6bf5423da60

Observation d944497f-7a5c-4241-b556-6f5bc7a114c2 · inbound

Fairness Dynamics During Training cites this paper.

Fairness Dynamics During Training CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T11:39:52.400219Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:39:52.400219Z digest=sha256:e324541ab4989b0a88cd80a1eb3018a65ee502fcb60f6e318cc0beb1bde205f2

Observation 805eee57-73d7-44a2-873d-e2ec3c41b2cd · inbound

Adaptive Task Vectors for Large Language Models cites this paper.

Adaptive Task Vectors for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T11:13:02.006492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:13:02.006492Z digest=sha256:7b59bbff99e9cf10e072049c93d8ca4caa43cfddb30ce7e0eaceda8afa484fff

Observation 956799bb-5b48-4886-a37a-afef76e8b8bd · inbound

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models cites this paper.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.107028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.107028Z digest=sha256:0bd772504f0ab247467e9511c495f4f2afc577070d16245273a9cec20c4e9347

Observation 58c20924-ff9c-45c0-9830-1ccea725e76b · inbound

Investigating Intersectional Bias in Large Language Models using Confidence Disparities in Coreference Resolution cites this paper.

Investigating Intersectional Bias in Large Language Models using Confidence Disparities in Coreference Resolution CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-05T22:21:05.877970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T22:21:05.877970Z digest=sha256:8dc4b0e95f768097fc5297173be1695a8cecd9bc14701121bec4a2c81b72907f

Observation 3981cd43-c751-4627-810a-b9e4ba610def · inbound

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models cites this paper.

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-04T19:55:56.548322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:55:56.548322Z digest=sha256:bf6f2569058251f224b53750bc5ea60d9430e5d619711f6c59323acf0a9b19fc

Observation b82a6b6e-1404-4b73-9f76-abb97ecb214a · inbound

When Tables Go Crazy: Evaluating Multimodal Models on French Financial Documents cites this paper.

When Tables Go Crazy: Evaluating Multimodal Models on French Financial Documents CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-03T01:12:32.176313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T01:12:32.176313Z digest=sha256:fbd0c7937551d3f0a6b2e033e6c54acebf9a2c85cb597700665979f1631ea039

Observation 3c42b4ce-a9d9-4f74-810d-221cf1e7e337 · inbound

Social Bias in LLM-Generated Code: Benchmark and Mitigation cites this paper.

Social Bias in LLM-Generated Code: Benchmark and Mitigation CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 146

Resolution
verified exact
arxiv_id, observed 2026-05-11T15:36:08.686178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-09T19:34:51.433422Z digest=sha256:c7f31b047bb6adf238d01dfc6c084c17cd2ce1e2329fed0b7b1b7d508b83e8b0

Observation adf7ac43-6339-4af9-9a3a-c029af57c42a · inbound

Navigating the Sea of LLM Evaluation: Investigating Bias in Toxicity Benchmarks cites this paper.

Navigating the Sea of LLM Evaluation: Investigating Bias in Toxicity Benchmarks CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-12T05:31:23.870735Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-12T05:28:45.453455Z digest=sha256:e0fd73638bb9cadce6eddd1cfd9fb91024a4d1350123e46ee53548bfae255a9f

Observation 088dc25c-51b0-4bf0-bf5c-bf8b7116fbbe · inbound

SafetyRepro: Configuration-Conditional Rank Instability on Alignment Benchmarks cites this paper.

SafetyRepro: Configuration-Conditional Rank Instability on Alignment Benchmarks CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 38

Resolution
verified exact
arxiv_id, observed 2026-06-29T22:54:00.973683Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-06-29T22:50:48.263600Z digest=sha256:9005b92aaa158945d6d903c2ad7708323f8266d073199e94b3a42b520f764521

Observation 979da584-358f-44a4-a9da-9f842a0443b5 · inbound

KARMA: Karma-Aligned Reward Model Adaptation cites this paper.

KARMA: Karma-Aligned Reward Model Adaptation CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-06-29T17:53:46.866135Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-06-29T17:52:06.830441Z digest=sha256:f5b12c8fe4415e150347994f00308f6bf6c237a1e1c7f47bcd38a92c9cd02f09

Observation 254081b9-522e-4c6c-9f52-853f3a8e261b · inbound

On The Effectiveness-Fluency Trade-Off In LLM Conditioning: A Systematic Study cites this paper.

On The Effectiveness-Fluency Trade-Off In LLM Conditioning: A Systematic Study CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 84

Resolution
verified exact
arxiv_id, observed 2026-07-03T11:08:03.493479Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-06-27T09:40:48.736006Z digest=sha256:21b52defa44a0972fb6f3dcd23c7ec02cbd02b8dcdab0aa36b73077ec631500f

Observation 29904cd7-ad28-4077-9d5e-36ba742a7f6d · inbound

AgentFairBench: Do LLM Agents Discriminate When They Act? cites this paper.

AgentFairBench: Do LLM Agents Discriminate When They Act? CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-07-03T17:38:44.470755Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-27T03:53:38.554457Z digest=sha256:b2ed82c49bead87ac08d6ffd9ca63a5aad0421439809b5d07ca25a3340c53fa7

Observation da97eac8-1fb3-4ae9-8c6b-0d23d3ed6c0e · inbound

How LLM Task-Adaptation Reshapes Alignment: A Multi-dimensional Study of Behavioral and Representational Drift cites this paper.

How LLM Task-Adaptation Reshapes Alignment: A Multi-dimensional Study of Behavioral and Representational Drift CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T07:44:10.447865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:44:10.447865Z digest=sha256:e4ed3bcfc73431a5c7b84d6798309330d7504fcc31292e026804ec3673f7b2a1