Pith. sign in

Paper Citation Record · LEDGER

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models

As of 17 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:2507.02088.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.02088 v2

Coverage vector

measured 53 of 53 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T20:43:53.885759Z

measured 54 of 54 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-04T11:21:56.069608Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

53 of 53 outbound references displayed

  • verified exact2
  • verified fuzzy1
  • unresolved50
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 70abc207-a1eb-458a-8883-cd69d079d4f5 · outbound

This paper cites online" 'onlinestring :=.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models online" 'onlinestring :=

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.123150Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.123150Z digest=sha256:923e61e4b1bb815f76f83b06c11bbbc8485f04413c453af018a7e87189717c16

Observation 11fc4adf-2604-49d5-9d04-3ac95f35fba7 · outbound

This paper cites write newline.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models write newline

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.226291Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.226291Z digest=sha256:4c9a142bbcc76921cd5bd6385aaca729dced8c1d0b070f58473dd706d080e2d6

Observation b37ad127-5536-4c43-a507-75a2e287896c · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.783403Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.315950Z digest=sha256:9b6d2cfbd0aa7cdbfeb159c4b52e9242b053ac29a1f681c6a381cfe99e142a76

Observation 140c1b4a-2550-4dd6-9fcc-5f6760e6fdd9 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.633355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.425837Z digest=sha256:d4e9165ac6e115d6c21a37869df1edc8a63f8b279a89e8680be2948d62e94609

Observation 579d1fd5-ec8d-41fb-ba9f-0ca66bfbdd6b · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.451103Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.527301Z digest=sha256:a68aee5e3a8df0535df772f0f3a70173c3f3e20ae99e67cca9b318b705fe9990

Observation c00e381d-2a85-450b-abe4-4ce14f24f5e6 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.259950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.639647Z digest=sha256:afe1ee376e0dd929699217ae3f2556d90b145a1f6a1bfd12050735f18cf9b3d5

Observation c74d4ac1-3d19-4634-b0ba-f2bf0f9e0a96 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.752463Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.752463Z digest=sha256:97badb771c556ea2e6b2d794a07d9a2d6e377e1015380fa0d91c36eb692bb380

Observation 5857c4b6-59ff-4de3-9e51-24ceca7200f1 · outbound

This paper cites InternLM2 Technical Report.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models InternLM2 Technical Report

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.853394Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.853394Z digest=sha256:03250c8e1693584cab0f37025e40e0407a9e0cf19847f135f1be7ff1571c47c1

Observation 19d5d1f3-28f0-48ef-9d4e-5c1800b785ee · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.938219Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.938219Z digest=sha256:eec3df4b1a874b6dc02c5269f492c38fbe718ab9479fd9e59ad2fdb3413b7dca

Observation 50fd2ee8-154e-4584-9183-5a498eb5753b · outbound

This paper cites WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:50.098492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:50.098492Z digest=sha256:d775a01f476d5307cbe7dc184d64b843fc8c2c7923676c77fc646da5cac1687d

Observation 0a67863e-e0d6-411c-b7e0-bc8d4ec444bc · outbound

This paper cites ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:50.227498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:50.227498Z digest=sha256:52abb0112466fa87c9b83ef6d34491db9a6f1d91c1b9968a59b1ddd39ecdee74

Observation 711881eb-41c9-4394-8e25-1bb9cf8f1e5e · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.084220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.433474Z digest=sha256:2d3a1ce6e3e7217b85c14a86520d7f020101f4e9a04caea734ca2d555fec99b7

Observation eea9c54a-c79d-48d7-98e3-56ffa50cceb0 · outbound

This paper cites RuBia: A Russian Language Bias Detection Dataset.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models RuBia: A Russian Language Bias Detection Dataset

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-08-06T20:43:54.557581Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.584453Z digest=sha256:e1dc5ddee7d9064c74b639a98f231a772792e47f9cec63c0683f185026d7bd89

Observation b7655efe-803e-4065-804a-cc4b883dbd81 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.929909Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.740044Z digest=sha256:36a496e0b1f93c4218157829805272786365b25e1d2a4abf233d782587f5fc19

Observation 60f3b0c1-5e71-4e43-a9aa-8466e799799e · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:50.823334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:50.823334Z digest=sha256:026997d4971ca139d8b94cfad38ac4cd9c51e3442f3b771dc74cf911ecb7c964

Observation 4d597594-5ac7-44a8-87f2-1a412b48ff08 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.722708Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.920491Z digest=sha256:5ea200fc9e4f75690c34a6779e73326104743e68d5eab0cb2effcafa435f0e31

Observation 21b1fcfc-3760-4be6-9caa-dbbbb477bad0 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.520559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.026171Z digest=sha256:34662bca7764659b90ae8016194e2121c2901db9966cad15c5976ae860962421

Observation 414bec75-ebbf-4aea-a2d0-dc4def6fd23c · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.401960Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.129634Z digest=sha256:a5cd3936a27e3056a837fbc9d0f81b6bc129af56e384d0cbd6a5fed19d6ccd2a

Observation b6ca40df-5202-4e74-9d4c-d7ccea68f00e · outbound

This paper cites CBBQ: A Chinese Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CBBQ: A Chinese Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.221195Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.221195Z digest=sha256:2f9251d8e340e9a468dbff1b0e1a36c91428ec4e09508351858204153994666c

Observation a11af52c-2bf3-4bf4-be6b-59a079bfd91a · outbound

This paper cites Mistral 7B.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Mistral 7B

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.288121Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.288121Z digest=sha256:aef2e202f4d0b5c51690c718b3c0914f1dc0cc20cecb375c242c0866c377a03d

Observation c5a13ecc-504a-4c5f-b138-7ef275f6a922 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.259778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.461104Z digest=sha256:e38fedc470a7c4fb2214f514f8c9fc1785859de3353a132ee09f8fc00f441baa

Observation c98fa4de-2435-4b8c-82be-5c4916487221 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.116278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.569770Z digest=sha256:65b0a9eeec1c56e8dbbc955d90bd35af7055cecb893c153273c21f9e00d5dd11

Observation 5ad80883-d926-42b7-9fb2-81e0fe2de551 · outbound

This paper cites Adaptation of Deep Bidirectional Multilingual Transformers for Russian Language.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Adaptation of Deep Bidirectional Multilingual Transformers for Russian Language

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.655254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.655254Z digest=sha256:78f3e13f54ca44fda115b491c04ee57d898b3982f9875e2b46585ed18ae66254

Observation 27243f0e-bde1-493f-bec9-c19cc552c9b8 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.959436Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.735395Z digest=sha256:7be3766804882e4ad84a98d58f0bc81114af917670fb84530b9a615662e8c9aa

Observation 339dddbf-8122-4751-8ac9-b2e0d8799660 · outbound

This paper cites Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.814181Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.814181Z digest=sha256:44585a01a88dbd2f7c5eca94d37b5524e8127bc51203e5ecaca39c13d8ff8d9b

Observation 67dae05b-d3a9-4b9a-872b-4e1f2c8e8f8b · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.791668Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.877921Z digest=sha256:440c5e37ee7686a4700ed0e53f22a591895bbee14973273a5560adcd88b8d5cc

Observation 13fa5e33-fe40-4336-a0d7-54fcc4c693e7 · outbound

This paper cites DeepSeek-V3 Technical Report.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models DeepSeek-V3 Technical Report

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.950417Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.950417Z digest=sha256:0df811e38d6b6923b8fa2b9b271b51f034265fa5c5a04aa96784ada791641808

Observation 15aaa887-d913-426b-b5e8-10cec00af024 · outbound

This paper cites StereoSet: Measuring stereotypical bias in pretrained language models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models StereoSet: Measuring stereotypical bias in pretrained language models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.015253Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.015253Z digest=sha256:424211b955d29a782a6d0d1b27660367953b40fb715e5ed4e95fd1aff5657bdc

Observation 956799bb-5b48-4886-a37a-afef76e8b8bd · outbound

This paper cites CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.107028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.107028Z digest=sha256:617d37ebf2b9f8b4fd972c0719cfd70e960ca92f4fc9ea3af4b50b246b5a3750

Observation 822d56e8-7382-462d-8647-94fbd17a5cfe · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.668459Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.191096Z digest=sha256:8b2ec373456901555ee644b6a88ee5a0dc71636317c63c0d77aa09e67cd3a23c

Observation 95106ad7-492a-481e-be92-a869e79e368f · outbound

This paper cites BBQ: A Hand-Built Bias Benchmark for Question Answering.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models BBQ: A Hand-Built Bias Benchmark for Question Answering

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.282476Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.282476Z digest=sha256:3f68684c3fab64342d926a6c8ae1b59c8f813cda0382bc370d7f166d13a97f69

Observation 5ed5d67c-23b9-472e-99fb-0df4755d1218 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.571998Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.373254Z digest=sha256:60227ab00f17ef8791c3c5c74cb5e3ada1c664a55e26a2da0da75ccfc9cd7fd6

Observation b79a0352-d996-4431-84c1-4747ed27f94c · outbound

This paper cites Gender Bias in Coreference Resolution.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Gender Bias in Coreference Resolution

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.465611Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.465611Z digest=sha256:7caf48e4d6e9f19e3cdc82451fefef29148b10ec19e45e8bde68c8c296251c14

Observation 495eeaea-a1db-40cf-9318-d9bb0771aa49 · outbound

This paper cites IndiBias: A Benchmark Dataset to Measure Social Biases in Language Models for Indian Context.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models IndiBias: A Benchmark Dataset to Measure Social Biases in Language Models for Indian Context

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.544990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.544990Z digest=sha256:e8d75cb4ecc8afbfb54c4eb323531130bfe85845012af71e8cc218f7b5266fc5

Observation 660fae65-61ce-4433-ab83-96b4d6077ec1 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.417463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.646131Z digest=sha256:0369d74e1ce8baaf2df36dfd2efccb41caac1db97de4f27edb68adeddbd4ccc7

Observation 188f3a01-cd5b-4912-8827-6a5a68477e9d · outbound

This paper cites FineDeb: A Debiasing Framework for Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models FineDeb: A Debiasing Framework for Language Models

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.727546Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.727546Z digest=sha256:0f3ece99d26acefac91af065ec8f04fc4dd04510619b6578318d546a934c29cb

Observation 33389b95-9cd5-4c41-a542-d58029060d49 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 37

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.274110Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.818717Z digest=sha256:9ae447fd77bafef8c729e04e814c313f02eb834d14a1a07a05542c89fc9f30d1

Observation c50c5c8d-83b8-4e69-9b03-7946e5c9643b · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.160238Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.864756Z digest=sha256:90f72903650e23e98ab0da66458096e000698ac60091250df23c648e13649fa1

Observation d8eafa20-d2bf-47d2-b74a-483033cb4afa · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.004800Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.940549Z digest=sha256:5f58a5d51aa86276b90cc468ef4f28737153133f878c43889e4d5a49ce6789fd

Observation 5072e452-4ab7-462d-91a6-0ed79477adcb · outbound

This paper cites Fewer Errors, but More Stereotypes? The Effect of Model Size on Gender Bias.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Fewer Errors, but More Stereotypes? The Effect of Model Size on Gender Bias

Reference 40

Resolution
verified exact
local_arxiv, observed 2026-08-06T20:43:54.221961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:53.025679Z digest=sha256:6143198ff4b3f6b7c8cf0262fa48857576dfbc88df7ebf158157a4c0c4b67bf2

Observation 8477accb-86c4-4061-846b-7bb701530001 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 41

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:54.870070Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:53.083634Z digest=sha256:e632b81ca0c6d9f892f561f1fae8fbca26e5ca205adcf2f52d9b277a87d0ecef

Observation c61b1df8-725e-4e2f-aba9-29824afb4487 · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.162694Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.162694Z digest=sha256:438d493c6e51af54ca13f8be9eac948c027c18ceb253cb9548d7daf9f76a1af5

Observation 4a1e8297-fdc4-4be5-ac49-e0b56ca7201d · outbound

This paper cites Nationality Bias in Text Generation.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Nationality Bias in Text Generation

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.240019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.240019Z digest=sha256:d0f3d5f28d0c35d3809f028b1d796386cb546d06b575b9a48958d7199fbb19f9

Observation 70271fd1-06bf-41e7-8540-248463cab8de · outbound

This paper cites White Men Lead, Black Women Help? Benchmarking and Mitigating Language Agency Social Biases in LLMs.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models White Men Lead, Black Women Help? Benchmarking and Mitigating Language Agency Social Biases in LLMs

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.300456Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.300456Z digest=sha256:b2f57951a72c275d9971d1588980a3ebad438bcfc2d6fbf0123edbda3f78987c

Observation 877703ff-2ac7-4b28-be53-30272425dd63 · outbound

This paper cites "Kelly is a Warm Person, Joseph is a Role Model": Gender Biases in LLM-Generated Reference Letters.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models "Kelly is a Warm Person, Joseph is a Role Model": Gender Biases in LLM-Generated Reference Letters

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.367103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.367103Z digest=sha256:6885c26d553be7d2e8f820d7989f75b26d331d1c884027aa9de9645ce1e69e60

Observation ff44f5cd-30d7-4cb2-83c9-1110f53c9b92 · outbound

This paper cites CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.456321Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.456321Z digest=sha256:610f049dbca2b54d13949f8761b00b712731ba2ad63cc56e4e0c08bb23168981

Observation 1c487782-603d-477f-9d56-0034ad23110a · outbound

This paper cites Ethical and social risks of harm from Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Ethical and social risks of harm from Language Models

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.513331Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.513331Z digest=sha256:497bc4eee150ad72aef80853719d5236e189d599c5a63c7562f1f6029af95891

Observation 7ff40210-2587-489d-a6db-d2b757d2e7f4 · outbound

This paper cites JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.588373Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.588373Z digest=sha256:afe43910520d99b454f7ad3454a89fa462a23780ba6e42a987c21e1ecd8e4046

Observation 9137be06-1e66-4d95-857b-bebef2820f60 · outbound

This paper cites Baichuan 2: Open Large-scale Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Baichuan 2: Open Large-scale Language Models

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.690428Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.690428Z digest=sha256:c0e61b95bcaea617fab3869773b19b8ad05f04a94201c72e51993cb7c45191b5

Observation f7a8b70f-23c1-4cb3-9ad5-aeab1bcf4259 · outbound

This paper cites CHBias: Bias Evaluation and Mitigation of Chinese Conversational Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CHBias: Bias Evaluation and Mitigation of Chinese Conversational Language Models

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.769413Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.769413Z digest=sha256:6842d7157d5650fca948952ae9f682ea278164198a0480b8b19e5b9fbf5bd571

Observation 221ed02f-c165-45ca-8ca4-c281abc1fa5f · outbound

This paper cites Gender Bias in Coreference Resolution: Evaluation and Debiasing Methods.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Gender Bias in Coreference Resolution: Evaluation and Debiasing Methods

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.846796Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.846796Z digest=sha256:5c58a8dbe32bbd41a9d6f3e5639e389659d944243e1d320cbb047df7f0f3572f

Observation 163053ac-8f4e-47d8-a93c-afba362ab467 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.858313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.858313Z digest=sha256:f7943223ca52ca5405a3f40ef2e963812712f43651fda1b1137a68c92c3a0e4c

Observation 7cbd701e-4012-4d63-8239-d3eb8b1d673c · outbound

This paper cites Markov, Vladislav Mikhailov, and Alena Fenogenova.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Markov, Vladislav Mikhailov, and Alena Fenogenova

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:43:54.739474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-06T20:43:53.885759Z digest=sha256:33317e0346321b291b79fe69b5b5b64183a5d02d7ee43ce03f6fe085c691bb7e

Pith citing papers

Observation dcb47e15-903c-4418-9f64-2f1fc147d8d6 · inbound

Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages cites this paper.

Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-04T11:21:56.069608Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T11:21:56.069608Z digest=sha256:61545117f7e7edfecf1f619036d9d9b57f458b28e2841b7a5adc7eeb27d088d7