Pith. sign in

Paper Citation Record · LEDGER

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models

As of 20 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 1 inbound Pith citation observation for arXiv:2507.02088.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.02088 v2

Coverage vector

measured 53 of 53 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T20:43:53.885759Z

measured 54 of 54 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-04T11:21:56.069608Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

53 of 53 outbound references displayed

  • verified exact2
  • verified fuzzy1
  • unresolved50
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 70abc207-a1eb-458a-8883-cd69d079d4f5 · outbound

This paper cites online" 'onlinestring :=.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models online" 'onlinestring :=

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.123150Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.123150Z digest=sha256:923e61e4b1bb815f76f83b06c11bbbc8485f04413c453af018a7e87189717c16

Observation 11fc4adf-2604-49d5-9d04-3ac95f35fba7 · outbound

This paper cites write newline.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models write newline

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.226291Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.226291Z digest=sha256:4c9a142bbcc76921cd5bd6385aaca729dced8c1d0b070f58473dd706d080e2d6

Observation b37ad127-5536-4c43-a507-75a2e287896c · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.783403Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.315950Z digest=sha256:21535d0996b25ac467bd11f6d30ed3cc4664042ee362e75ba7004b2621764a83

Observation 140c1b4a-2550-4dd6-9fcc-5f6760e6fdd9 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.633355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.425837Z digest=sha256:40ca956aa6ecfd41ee60d42c3934c4ebc0eb04479613f99ca6f4f983487a0fb6

Observation 579d1fd5-ec8d-41fb-ba9f-0ca66bfbdd6b · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.451103Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.527301Z digest=sha256:a2ca034f152761949730f5b3a1186c3d33b470d9263c7401e3ee5de7cc69dbf8

Observation c00e381d-2a85-450b-abe4-4ce14f24f5e6 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.259950Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:49.639647Z digest=sha256:7a187dd4366979be91ef3c5af68d28aaf2518deb8e037131216280452d53d268

Observation c74d4ac1-3d19-4634-b0ba-f2bf0f9e0a96 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.752463Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.752463Z digest=sha256:97badb771c556ea2e6b2d794a07d9a2d6e377e1015380fa0d91c36eb692bb380

Observation 5857c4b6-59ff-4de3-9e51-24ceca7200f1 · outbound

This paper cites InternLM2 Technical Report.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models InternLM2 Technical Report

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.853394Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.853394Z digest=sha256:03250c8e1693584cab0f37025e40e0407a9e0cf19847f135f1be7ff1571c47c1

Observation 19d5d1f3-28f0-48ef-9d4e-5c1800b785ee · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:49.938219Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:49.938219Z digest=sha256:eec3df4b1a874b6dc02c5269f492c38fbe718ab9479fd9e59ad2fdb3413b7dca

Observation 50fd2ee8-154e-4584-9183-5a498eb5753b · outbound

This paper cites WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:50.098492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:50.098492Z digest=sha256:d775a01f476d5307cbe7dc184d64b843fc8c2c7923676c77fc646da5cac1687d

Observation 0a67863e-e0d6-411c-b7e0-bc8d4ec444bc · outbound

This paper cites ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:50.227498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:50.227498Z digest=sha256:52abb0112466fa87c9b83ef6d34491db9a6f1d91c1b9968a59b1ddd39ecdee74

Observation 711881eb-41c9-4394-8e25-1bb9cf8f1e5e · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:57.084220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.433474Z digest=sha256:29af976e198f305d102d8a2c267bf0d30d687c941980755f7157504762ac89e9

Observation eea9c54a-c79d-48d7-98e3-56ffa50cceb0 · outbound

This paper cites RuBia: A Russian Language Bias Detection Dataset.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models RuBia: A Russian Language Bias Detection Dataset

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-08-06T20:43:54.557581Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.584453Z digest=sha256:9e09981eff4ae42db382df5a7379bbdebc089adc242af9444f5babc3dca947fa

Observation b7655efe-803e-4065-804a-cc4b883dbd81 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.929909Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.740044Z digest=sha256:561581e2af103d25b24756b50f5a35eb12eaf4e8c3a4147e4b41ac1e5fbb1d5d

Observation 60f3b0c1-5e71-4e43-a9aa-8466e799799e · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:50.823334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:50.823334Z digest=sha256:026997d4971ca139d8b94cfad38ac4cd9c51e3442f3b771dc74cf911ecb7c964

Observation 4d597594-5ac7-44a8-87f2-1a412b48ff08 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.722708Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:50.920491Z digest=sha256:a5e2d04699f0a82dd5e2c1f6e0ee9145261f03f6f1e48c914544c8ce287bc91a

Observation 21b1fcfc-3760-4be6-9caa-dbbbb477bad0 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.520559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.026171Z digest=sha256:06f78cfa7982bff73aa77e14b203cdd858968572125905cafdf7e4bd4423b5dd

Observation 414bec75-ebbf-4aea-a2d0-dc4def6fd23c · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.401960Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.129634Z digest=sha256:6dbb9d4c93e94d1812c83ba1d9b5c44e958f73e33a332ef0bd01f60e57490b5e

Observation b6ca40df-5202-4e74-9d4c-d7ccea68f00e · outbound

This paper cites CBBQ: A Chinese Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CBBQ: A Chinese Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.221195Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.221195Z digest=sha256:25e9563e4470494c6be0c8df72ab9614953324c872441c4173c27a03c42b5f77

Observation a11af52c-2bf3-4bf4-be6b-59a079bfd91a · outbound

This paper cites Mistral 7B.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Mistral 7B

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.288121Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.288121Z digest=sha256:898c3ad2fb0af5f20ce9fe96c50a529be5c1c48f1dbc0f73d8e8460987e7b959

Observation c5a13ecc-504a-4c5f-b138-7ef275f6a922 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.259778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.461104Z digest=sha256:31ad145522901c65f533f2f0ea30f5239e6d82de83362af3cc415161e0c3d5ca

Observation c98fa4de-2435-4b8c-82be-5c4916487221 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:56.116278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.569770Z digest=sha256:91b3d2be62c05aa1e1e0ad66173e4ac0f2fb1664eca62e887f17ac3ca35ec2ff

Observation 5ad80883-d926-42b7-9fb2-81e0fe2de551 · outbound

This paper cites Adaptation of Deep Bidirectional Multilingual Transformers for Russian Language.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Adaptation of Deep Bidirectional Multilingual Transformers for Russian Language

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.655254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.655254Z digest=sha256:78f3e13f54ca44fda115b491c04ee57d898b3982f9875e2b46585ed18ae66254

Observation 27243f0e-bde1-493f-bec9-c19cc552c9b8 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.959436Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.735395Z digest=sha256:df30ca8859dae1e38bd12cab9936f3401d6908e46019deb7f714434072476ab5

Observation 339dddbf-8122-4751-8ac9-b2e0d8799660 · outbound

This paper cites Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.814181Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.814181Z digest=sha256:44585a01a88dbd2f7c5eca94d37b5524e8127bc51203e5ecaca39c13d8ff8d9b

Observation 67dae05b-d3a9-4b9a-872b-4e1f2c8e8f8b · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.791668Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:51.877921Z digest=sha256:4f8bb377c3918608a74668810b9b8639e3e4529a76d82461ebbe53a120413a6f

Observation 13fa5e33-fe40-4336-a0d7-54fcc4c693e7 · outbound

This paper cites DeepSeek-V3 Technical Report.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models DeepSeek-V3 Technical Report

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:51.950417Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:51.950417Z digest=sha256:f3b4a939726d5a429cecccd445cfc46e276d978c4bd82ee8662cbd9b9d86a92c

Observation 15aaa887-d913-426b-b5e8-10cec00af024 · outbound

This paper cites StereoSet: Measuring stereotypical bias in pretrained language models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models StereoSet: Measuring stereotypical bias in pretrained language models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.015253Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.015253Z digest=sha256:2872adc2425748e821eaa50335ca6d5d36c88fdeb1b39743917ab05a8a9dcd9c

Observation 956799bb-5b48-4886-a37a-afef76e8b8bd · outbound

This paper cites CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.107028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.107028Z digest=sha256:617d37ebf2b9f8b4fd972c0719cfd70e960ca92f4fc9ea3af4b50b246b5a3750

Observation 822d56e8-7382-462d-8647-94fbd17a5cfe · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.668459Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.191096Z digest=sha256:2167f718a3d1b664ea5d9b052ea8ecf2e33d15009c299325cc19ae666b606c6b

Observation 95106ad7-492a-481e-be92-a869e79e368f · outbound

This paper cites BBQ: A Hand-Built Bias Benchmark for Question Answering.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models BBQ: A Hand-Built Bias Benchmark for Question Answering

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.282476Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.282476Z digest=sha256:3f68684c3fab64342d926a6c8ae1b59c8f813cda0382bc370d7f166d13a97f69

Observation 5ed5d67c-23b9-472e-99fb-0df4755d1218 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.571998Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.373254Z digest=sha256:392bc24b3cca09df54a39108e0fab98f738a8e500568d0dbb57c41c6a22996ab

Observation b79a0352-d996-4431-84c1-4747ed27f94c · outbound

This paper cites Gender Bias in Coreference Resolution.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Gender Bias in Coreference Resolution

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.465611Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.465611Z digest=sha256:7caf48e4d6e9f19e3cdc82451fefef29148b10ec19e45e8bde68c8c296251c14

Observation 495eeaea-a1db-40cf-9318-d9bb0771aa49 · outbound

This paper cites IndiBias: A Benchmark Dataset to Measure Social Biases in Language Models for Indian Context.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models IndiBias: A Benchmark Dataset to Measure Social Biases in Language Models for Indian Context

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.544990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.544990Z digest=sha256:e8d75cb4ecc8afbfb54c4eb323531130bfe85845012af71e8cc218f7b5266fc5

Observation 660fae65-61ce-4433-ab83-96b4d6077ec1 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.417463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.646131Z digest=sha256:9fd38ab8f5456d057b3b3d3d97c906dc7421f10a1de24e6fd129f0458407f9c8

Observation 188f3a01-cd5b-4912-8827-6a5a68477e9d · outbound

This paper cites FineDeb: A Debiasing Framework for Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models FineDeb: A Debiasing Framework for Language Models

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:52.727546Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:52.727546Z digest=sha256:0f3ece99d26acefac91af065ec8f04fc4dd04510619b6578318d546a934c29cb

Observation 33389b95-9cd5-4c41-a542-d58029060d49 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 37

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.274110Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.818717Z digest=sha256:27df9513d24840f6d14085782e662603944aaee0951a74c4c0ad4cb0dd912179

Observation c50c5c8d-83b8-4e69-9b03-7946e5c9643b · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.160238Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.864756Z digest=sha256:ce8a217bc0a1a361fe57c5cc4ce9836378c2556f13f8beca74d1c6c94bb4068d

Observation d8eafa20-d2bf-47d2-b74a-483033cb4afa · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:55.004800Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:52.940549Z digest=sha256:7a3f9238a8142c4a4a8400d87141f3664bf1655ad47382038708775fedc8a484

Observation 5072e452-4ab7-462d-91a6-0ed79477adcb · outbound

This paper cites Fewer Errors, but More Stereotypes? The Effect of Model Size on Gender Bias.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Fewer Errors, but More Stereotypes? The Effect of Model Size on Gender Bias

Reference 40

Resolution
verified exact
local_arxiv, observed 2026-08-06T20:43:54.221961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:53.025679Z digest=sha256:d24584871dcec5f91399bc2c6cd7c8c1a8a8e9db4fd074a8f4141b3a8c79ef05

Observation 8477accb-86c4-4061-846b-7bb701530001 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 41

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:43:54.870070Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:53.083634Z digest=sha256:a12df55e5cefa8f7ed122165d33b5b376fcc4f1f8b5489a98d3f92d36aa0bea6

Observation c61b1df8-725e-4e2f-aba9-29824afb4487 · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.162694Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.162694Z digest=sha256:438d493c6e51af54ca13f8be9eac948c027c18ceb253cb9548d7daf9f76a1af5

Observation 4a1e8297-fdc4-4be5-ac49-e0b56ca7201d · outbound

This paper cites Nationality Bias in Text Generation.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Nationality Bias in Text Generation

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.240019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.240019Z digest=sha256:d0f3d5f28d0c35d3809f028b1d796386cb546d06b575b9a48958d7199fbb19f9

Observation 70271fd1-06bf-41e7-8540-248463cab8de · outbound

This paper cites White Men Lead, Black Women Help? Benchmarking and Mitigating Language Agency Social Biases in LLMs.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models White Men Lead, Black Women Help? Benchmarking and Mitigating Language Agency Social Biases in LLMs

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.300456Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.300456Z digest=sha256:68cdfefa1ec4ccf690cfe16503a9e025cb7b62b0c6b3b023eb0d2cea82c36e43

Observation 877703ff-2ac7-4b28-be53-30272425dd63 · outbound

This paper cites "Kelly is a Warm Person, Joseph is a Role Model": Gender Biases in LLM-Generated Reference Letters.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models "Kelly is a Warm Person, Joseph is a Role Model": Gender Biases in LLM-Generated Reference Letters

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.367103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.367103Z digest=sha256:6885c26d553be7d2e8f820d7989f75b26d331d1c884027aa9de9645ce1e69e60

Observation ff44f5cd-30d7-4cb2-83c9-1110f53c9b92 · outbound

This paper cites CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.456321Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.456321Z digest=sha256:610f049dbca2b54d13949f8761b00b712731ba2ad63cc56e4e0c08bb23168981

Observation 1c487782-603d-477f-9d56-0034ad23110a · outbound

This paper cites Ethical and social risks of harm from Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Ethical and social risks of harm from Language Models

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.513331Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.513331Z digest=sha256:497bc4eee150ad72aef80853719d5236e189d599c5a63c7562f1f6029af95891

Observation 7ff40210-2587-489d-a6db-d2b757d2e7f4 · outbound

This paper cites JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.588373Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.588373Z digest=sha256:afe43910520d99b454f7ad3454a89fa462a23780ba6e42a987c21e1ecd8e4046

Observation 9137be06-1e66-4d95-857b-bebef2820f60 · outbound

This paper cites Baichuan 2: Open Large-scale Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Baichuan 2: Open Large-scale Language Models

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.690428Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.690428Z digest=sha256:c0e61b95bcaea617fab3869773b19b8ad05f04a94201c72e51993cb7c45191b5

Observation f7a8b70f-23c1-4cb3-9ad5-aeab1bcf4259 · outbound

This paper cites CHBias: Bias Evaluation and Mitigation of Chinese Conversational Language Models.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models CHBias: Bias Evaluation and Mitigation of Chinese Conversational Language Models

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.769413Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.769413Z digest=sha256:6842d7157d5650fca948952ae9f682ea278164198a0480b8b19e5b9fbf5bd571

Observation 221ed02f-c165-45ca-8ca4-c281abc1fa5f · outbound

This paper cites Gender Bias in Coreference Resolution: Evaluation and Debiasing Methods.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Gender Bias in Coreference Resolution: Evaluation and Debiasing Methods

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.846796Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.846796Z digest=sha256:5c58a8dbe32bbd41a9d6f3e5639e389659d944243e1d320cbb047df7f0f3572f

Observation 163053ac-8f4e-47d8-a93c-afba362ab467 · outbound

This paper cites an unresolved cited work.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Unresolved cited work

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-06T20:43:53.858313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:43:53.858313Z digest=sha256:f7943223ca52ca5405a3f40ef2e963812712f43651fda1b1137a68c92c3a0e4c

Observation 7cbd701e-4012-4d63-8239-d3eb8b1d673c · outbound

This paper cites Markov, Vladislav Mikhailov, and Alena Fenogenova.

McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models Markov, Vladislav Mikhailov, and Alena Fenogenova

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:43:54.739474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-06T20:43:53.885759Z digest=sha256:7c87f587ad6525fad1e7000549da67823d983a95bb447a48285e610d3d3bb9df

Pith citing papers

Observation dcb47e15-903c-4418-9f64-2f1fc147d8d6 · inbound

Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages cites this paper.

Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-04T11:21:56.069608Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T11:21:56.069608Z digest=sha256:61545117f7e7edfecf1f619036d9d9b57f458b28e2841b7a5adc7eeb27d088d7