{"as_of":"2026-08-14T13:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a47ade3d8bacc830e52263b2cb2c4e768326c178be503059cca21024f52681c8","coverage":[{"denominator":84,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":84,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:12:26.426274Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17131/citation-record","integrity":"/paper/2505.17131/integrity","json":"/paper/2505.17131/citation-record.json","paper":"/paper/2505.17131"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:17.646921Z","title":"https://aws.amazon.com/bedrock, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:17.646921Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:26fdc062aea043061729e26bca64525265853c6951738e185236924eda17595a","observation_id":"e4bdad71-1fe1-4c64-bfdc-823656e5396c","resolution":{"observed_at":"2026-08-07T15:12:17.646921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:17.746789Z","title":"https://www.deepseek.com, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:17.746789Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:bad5ff4b35dee61b869f2e93391fd9cef99519c7b51801602948dd0cf1820dbf","observation_id":"fe12084b-f7d6-471a-ae69-fc55aedc4e25","resolution":{"observed_at":"2026-08-07T15:12:17.746789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:17.883888Z","title":"https://aistudio.google.com, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:17.883888Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:4965db51809fc87088a65f7d8627775a1b46bb15b17c1b161be035d488c3258b","observation_id":"d3263a64-e21f-4c0a-b2a8-9466450e3b1b","resolution":{"observed_at":"2026-08-07T15:12:17.883888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:18.019509Z","title":"https://www.meta.ai, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.019509Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:c8bd0fecc58bc6d663d27b756898b168c64eba231854fe5a8b559280362e11f3","observation_id":"27091ff0-102d-4124-8d26-6e80a6136dfe","resolution":{"observed_at":"2026-08-07T15:12:18.019509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.959458Z","title":"Tukey’s honestly significant difference (hsd) test","venue":null,"work_id":"9c4d829f-2843-45a5-8163-ad8ed643acba","year":2010},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.140041Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:6a902ddb9410a52828141f5f6de781e55a3b3fcf1e232097f73032b6e07c78ca","observation_id":"cf38449e-a6ba-49f6-b810-513208dd96c1","resolution":{"observed_at":"2026-08-07T15:12:33.024376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05704","last_updated":"2021-09-14T06:27:36Z","snapshot_observed_at":"2026-08-13T18:13:05.390390Z","submitted_at":"2021-09-13T04:52:41Z","title":"Mitigating Language-Dependent Ethnic Bias in BERT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.05704","snapshot_observed_at":"2026-08-07T15:12:18.275983Z","title":"Mitigating language-dependent ethnic bias in bert","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.275983Z"},"links":{"cited_paper":"/paper/2109.05704","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:e555f0d852293167ebf182da333e6e8296e7a70c73c42e3168f90f59d2e5523a","observation_id":"5fb07169-7a57-4fd0-a9a8-ce1ea80e5927","resolution":{"observed_at":"2026-08-07T15:12:18.275983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.795003Z","title":"Amazon bedrock guardrails","venue":null,"work_id":"9377ae1b-2f0b-4f85-9fa8-882693743371","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.427567Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:7bd8fdacb9acafb11f28426ac6e0b955705df0b85f2c6283ac5052fe1c236128","observation_id":"f4578404-f9f2-4b19-8eb3-86f2bbf2f202","resolution":{"observed_at":"2026-08-07T15:12:32.863742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12408","last_updated":"2025-04-16T18:17:19Z","snapshot_observed_at":"2026-08-12T00:43:11.296193Z","submitted_at":"2025-04-16T18:17:19Z","title":"A Human-AI Comparative Analysis of Prompt Sensitivity in LLM-Based Relevance Judgment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12408","snapshot_observed_at":"2026-08-07T15:12:18.548069Z","title":"A human-ai comparative analysis of prompt sensitivity in llm-based relevance judgment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.548069Z"},"links":{"cited_paper":"/paper/2504.12408","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:6b15436d67009cdae55878a1e255d286acb51a02714a3e352a74fed5155193ec","observation_id":"11d2797a-da77-43e9-8bac-7afda67c3f9b","resolution":{"observed_at":"2026-08-07T15:12:18.548069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04667","last_updated":"2025-04-02T15:17:02Z","snapshot_observed_at":"2026-08-14T00:16:56.532983Z","submitted_at":"2024-08-06T16:43:35Z","title":"Non-Determinism of \"Deterministic\" LLM Settings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04667","snapshot_observed_at":"2026-08-07T15:12:18.716951Z","title":"Llm stability: A detailed analysis with some surprises","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.716951Z"},"links":{"cited_paper":"/paper/2408.04667","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:445157eb60c59a5ae954f81ec257c3927c37c1e64aa1bf692280907f797365c3","observation_id":"02e014cc-a2ce-4e43-808d-8de825d45fef","resolution":{"observed_at":"2026-08-07T15:12:18.716951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:18.815946Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.815946Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:3a69a85989e90785085179bc78bfc0a911fbebd368c4b8a6076a034269ed8861","observation_id":"fe4888e9-46c0-4c98-bb3c-0c640548b716","resolution":{"observed_at":"2026-08-07T15:12:18.815946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.06413","last_updated":"2021-03-11T02:01:14Z","snapshot_observed_at":"2026-08-13T20:00:11.979609Z","submitted_at":"2021-03-11T02:01:14Z","title":"FairFil: Contrastive Neural Debiasing Method for Pretrained Text Encoders","version":1},"cited_work":{"arxiv_id":"2103.06413","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.06413","snapshot_observed_at":"2026-08-07T15:12:27.032930Z","title":"FairFil: Contrastive Neural Debiasing Method for Pretrained Text Encoders","venue":"cs.CL","work_id":"fa700d5b-561e-4ce2-ae7e-d8c673a38955","year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.982402Z"},"links":{"cited_paper":"/paper/2103.06413","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:2ee540c882c42d77d0e5ec937896e857a1ede330fafdbc0e5e3da6c9ae89376f","observation_id":"bb3a2d54-1d8a-4e21-99cc-d06ef3418dd8","resolution":{"observed_at":"2026-08-07T15:12:27.164329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20947","last_updated":"2025-06-15T21:44:25Z","snapshot_observed_at":"2026-08-12T23:53:16.785416Z","submitted_at":"2024-05-31T15:44:33Z","title":"OR-Bench: An Over-Refusal Benchmark for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20947","snapshot_observed_at":"2026-08-07T15:12:19.066466Z","title":"Or-bench: An over-refusal benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.066466Z"},"links":{"cited_paper":"/paper/2405.20947","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:bd0ec368edca4cee6b00d7265c3cda93e0fca0182a23afc584be03ef60939c34","observation_id":"0758b737-4732-4884-9924-d4b18d25fad9","resolution":{"observed_at":"2026-08-07T15:12:19.066466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:19.173065Z","title":"Bert: Pre-training of deep bidi- rectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.173065Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:ba45cf609b878bf2c91bb303c8249445810874831981a247578aacfd31665b23","observation_id":"c338b927-9b1c-4f4d-9ffc-207a5ac2d65c","resolution":{"observed_at":"2026-08-07T15:12:19.173065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:19.297539Z","title":"Bold: Dataset and metrics for measuring biases in open-ended language generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.297539Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:08f315bfdd3d042376d83683bd41b55187803760920abcab36004d296998420c","observation_id":"6b5ca39a-ffbc-4f02-b6d7-08215b5c9787","resolution":{"observed_at":"2026-08-07T15:12:19.297539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11190","last_updated":"2024-02-17T04:48:55Z","snapshot_observed_at":"2026-08-13T04:17:08.583312Z","submitted_at":"2024-02-17T04:48:55Z","title":"Disclosure and Mitigation of Gender Bias in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11190","snapshot_observed_at":"2026-08-07T15:12:19.415481Z","title":"Disclosure and mitigation of gender bias in llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.415481Z"},"links":{"cited_paper":"/paper/2402.11190","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:ee83fe73f336ad58717498aa93c12b6288cb10bbb9a476dac844782041e88d53","observation_id":"8157e21b-4b7c-4a7f-a39b-ebe9562fb848","resolution":{"observed_at":"2026-08-07T15:12:19.415481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14739","last_updated":"2025-03-28T15:21:44Z","snapshot_observed_at":"2026-07-29T21:41:16.650188Z","submitted_at":"2025-02-20T17:05:58Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14739","snapshot_observed_at":"2026-08-07T15:12:19.560729Z","title":"Supergpqa: Scaling llm evaluation across 285 graduate disciplines","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.560729Z"},"links":{"cited_paper":"/paper/2502.14739","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:6d363afbd634d400063b4191799e2439ba77ecdf2201ac3d9346ea263ce3e897","observation_id":"5825adc7-a251-4d94-8bbf-d85ae8576f63","resolution":{"observed_at":"2026-08-07T15:12:19.560729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.658418Z","title":"Alpacafarm: A simulation framework for methods that learn from human feedback","venue":null,"work_id":"87f186ce-ffbe-40ac-a379-1a0a67dac0a1","year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.703634Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:5582aed0da3bad3b3d2930554a790ecffa46c424a24d3492a733b372fbd0fea6","observation_id":"82026c9e-a093-442e-a7e2-0a7c6444b669","resolution":{"observed_at":"2026-08-07T15:12:32.722693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.501479Z","title":"Meta ai refusing to answer questions related to politicians and par- ties ahead of elections in india, 2024","venue":null,"work_id":"b6980938-28c2-48ed-96aa-66b2f692c640","year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.856933Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:867fca8a5e72eb7f85cac2dff22fd654b877b3d73495a9a4a4565aa52252a455","observation_id":"0a9afb5e-8da9-4087-a629-60bb14512d12","resolution":{"observed_at":"2026-08-07T15:12:32.563582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-07T15:12:20.004814Z","title":"Toy models of superposition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.004814Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:7ca7b2c84b1c5f505ae44a825a3a77571f37e31274fa6678243ced61d18674a1","observation_id":"b2492a96-992d-453f-8d21-e86786a60a30","resolution":{"observed_at":"2026-08-07T15:12:20.004814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18140","last_updated":"2023-11-29T23:03:04Z","snapshot_observed_at":"2026-08-14T05:01:53.657965Z","submitted_at":"2023-11-29T23:03:04Z","title":"ROBBIE: Robust Bias Evaluation of Large Generative Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18140","snapshot_observed_at":"2026-08-07T15:12:20.139639Z","title":"Robbie: Robust bias evaluation of large generative language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.139639Z"},"links":{"cited_paper":"/paper/2311.18140","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:63cbf017fe17f61ed2de0d5e1de686c5a62012a8dac6aac9d12cde48b2504979","observation_id":"fc80d2f6-491b-453f-af53-37fcca23bb84","resolution":{"observed_at":"2026-08-07T15:12:20.139639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:20.291546Z","title":"Bias and fairness in large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.291546Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:7fb61d60602c873a251988a61f0d229d381bef9255ea96635857a2f44c2f7ec0","observation_id":"4bc9522b-1911-46b0-8868-8bf5a10ab785","resolution":{"observed_at":"2026-08-07T15:12:20.291546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.312533Z","title":"Pairwise multiple comparison procedures with unequal n’s and/or variances: a monte carlo study","venue":null,"work_id":"2a3e36e5-9fab-4a66-bfb2-f805bb38905c","year":1976},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.426690Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f9824beabacbb0c6440c054674132842ba3314edacb4be2a72ece02ddd64e290","observation_id":"13c4e8a8-9369-4abf-9209-9364879cd4e4","resolution":{"observed_at":"2026-08-07T15:12:32.413947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-08-09T05:10:26.091710Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-08-07T15:12:20.521002Z","title":"Realtoxicityprompts: Evaluating neural toxic degeneration in language models","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.521002Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f9df2ba7a6dce5e2bf3c6c224635608ed499ea561fc2445a729e663c8bd00342","observation_id":"cddec1c9-c2d5-4615-bddb-26582ad667b3","resolution":{"observed_at":"2026-08-07T15:12:20.521002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.102630Z","title":"Debiasing pre-trained language models via efficient fine-tuning","venue":null,"work_id":"c0d1ae4c-d4c6-48d3-91d2-82f753115ec6","year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.612760Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:fa6f6fb2d6709abc4563d02a116f866cdc175a58e3e49fe8a4d9c01801697661","observation_id":"bd52ac49-2568-4496-83b5-0452e8d5603f","resolution":{"observed_at":"2026-08-07T15:12:32.190325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T15:12:20.754742Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.754742Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:4fe652fbc17397495874e88fc597876daa7f4035f01a2933f6454be3d3da0cd0","observation_id":"81337885-9f20-44bf-84ba-34c00a739afa","resolution":{"observed_at":"2026-08-07T15:12:20.754742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:31.916237Z","title":"We tried out deepseek","venue":null,"work_id":"9086d98c-5b17-4886-92ea-6b2d1214655c","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.827485Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:9ec7ed78c2d77eb853ace9b6e8efd85d1e809de195f82c064e472575f25cc496","observation_id":"bc5e5836-6e71-49db-a11c-68f0ec9b3020","resolution":{"observed_at":"2026-08-07T15:12:31.997050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:31.730499Z","title":"Auto-debias: Debiasing masked language models with automated biased prompts","venue":null,"work_id":"9766c6c7-8750-44b6-9caa-61360772ef8b","year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.874761Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:4c8d41c5efb8ba7d4ad9de50433590a77d1c03f0522c68ba9d2befb172998098","observation_id":"b9f7f6dd-7bd2-4dc5-bbcb-34757dbca244","resolution":{"observed_at":"2026-08-07T15:12:31.826061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-08-14T13:06:35.039871Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-07T15:12:20.912641Z","title":"Does prompt formatting have any impact on llm performance? arXiv preprint arXiv:2411.10541, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.912641Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:005582497d22e5e0b8c29e1507dfb424c8784c8b8ba7c9ef7f961c0d26783933","observation_id":"5cf0360d-fe30-4af0-801e-713682834ef7","resolution":{"observed_at":"2026-08-07T15:12:20.912641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T15:12:21.025106Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.025106Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:7ba26a7eb9f99d5b965ff27d41ea014d26025fc450794f5e1b844c9c54485d5f","observation_id":"4875d47e-8d33-40d7-a52a-bfac4fa55d63","resolution":{"observed_at":"2026-08-07T15:12:21.025106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03064","last_updated":"2020-10-08T17:58:35Z","snapshot_observed_at":"2026-07-06T08:35:28.740170Z","submitted_at":"2019-11-08T05:56:01Z","title":"Reducing Sentiment Bias in Language Models via Counterfactual Evaluation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03064","snapshot_observed_at":"2026-08-07T15:12:21.086207Z","title":"Reducing sentiment bias in language models via counterfactual evaluation","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.086207Z"},"links":{"cited_paper":"/paper/1911.03064","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:d2613bcd19bf8bb6b08b505a539f33fd44bdfcc6c39fb7028b895abd862383a2","observation_id":"9288de9f-697d-41e5-8006-36910969edb9","resolution":{"observed_at":"2026-08-07T15:12:21.086207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:31.464374Z","title":"Perspective api, 2025","venue":null,"work_id":"cfb22011-e0b3-4f8d-bd02-ff8f1e7cbbce","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.163584Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:aac105822d88bca613a1fe90e61282806d5b1066777f68e8735d71abd2b973ac","observation_id":"94768ba5-bedc-4d62-9e37-9b389fae0686","resolution":{"observed_at":"2026-08-07T15:12:31.572271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.09523","last_updated":"2021-01-23T15:28:48Z","snapshot_observed_at":"2026-07-06T10:34:56.873087Z","submitted_at":"2021-01-23T15:28:48Z","title":"Debiasing Pre-trained Contextualised Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.09523","snapshot_observed_at":"2026-08-07T15:12:21.217936Z","title":"Debiasing pre-trained contextualised embeddings","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.217936Z"},"links":{"cited_paper":"/paper/2101.09523","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:4e8e7e1c5da1497c94cd6ee9911a22e94e9c13c3412018e8bd5fc9dfdb704e86","observation_id":"4c37d7f6-31c5-40eb-88bd-3596d7a7721b","resolution":{"observed_at":"2026-08-07T15:12:21.217936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:21.293155Z","title":"Pretraining language models with human preferences","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.293155Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:3caad14f10b2b07bb6d6b193d4eecce5ca491d48c87fefd8edada4697ac8d34f","observation_id":"f776040b-4aa1-490c-98c5-ba51bdd90fc0","resolution":{"observed_at":"2026-08-07T15:12:21.293155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07337","last_updated":"2019-06-18T01:58:56Z","snapshot_observed_at":"2026-07-06T08:01:01.134587Z","submitted_at":"2019-06-18T01:58:56Z","title":"Measuring Bias in Contextualized Word Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07337","snapshot_observed_at":"2026-08-07T15:12:21.340647Z","title":"Measuring bias in contextual- ized word representations","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.340647Z"},"links":{"cited_paper":"/paper/1906.07337","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:8ffc37ab366e51f9a1fd527742bee81a399205e7b0daa81faf77787cf88b45e4","observation_id":"04241856-2d8a-48a5-90dc-7c056fc46297","resolution":{"observed_at":"2026-08-07T15:12:21.340647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:31.220381Z","title":"Equivalence tests: A practical primer for t tests, correlations, and meta-analyses","venue":null,"work_id":"97de0c8e-df27-40d1-9257-66616200719c","year":2017},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.373901Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:bc0ca77c2969afb5b182ab8467c62b1cdc5ecfe4876d962c7cb283c938f6d690","observation_id":"13f4ea0b-56d7-465c-8718-3f306199ce9b","resolution":{"observed_at":"2026-08-07T15:12:31.339605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00585","last_updated":"2026-04-22T07:00:12Z","snapshot_observed_at":"2026-08-13T16:06:45.926571Z","submitted_at":"2024-11-01T13:47:00Z","title":"Fairness Testing of Large Language Models in Role-Playing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00585","snapshot_observed_at":"2026-08-07T15:12:21.650019Z","title":"Benchmarking bias in large language models during role-playing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.650019Z"},"links":{"cited_paper":"/paper/2411.00585","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:70187034fc35b8366bc222b17b5ed5b9472daaa48fcf878f82222c6f3101f89a","observation_id":"900fb795-066d-4dff-ae43-98f629135183","resolution":{"observed_at":"2026-08-07T15:12:21.650019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:21.727008Z","title":"Alpacaeval: An automatic evaluator of instruction-following models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.727008Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:3572a6a132b1ff9b9c76584572fced7d82c2df05c0789c5f69458fc104a3a250","observation_id":"d05f91ee-fda1-4647-b3ad-ebb11077e1e8","resolution":{"observed_at":"2026-08-07T15:12:21.727008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08100","last_updated":"2020-07-16T04:22:30Z","snapshot_observed_at":"2026-08-08T19:49:50.518204Z","submitted_at":"2020-07-16T04:22:30Z","title":"Towards Debiasing Sentence Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08100","snapshot_observed_at":"2026-08-07T15:12:21.833828Z","title":"Towards debiasing sentence representations","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.833828Z"},"links":{"cited_paper":"/paper/2007.08100","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:c879ce034ea085a8f1ea6df22a8e65ae0d9ac5d09d0f6fabe12fa6a70ab2600f","observation_id":"ecde6a30-1e10-4d50-aea4-2ca2f4ab2083","resolution":{"observed_at":"2026-08-07T15:12:21.833828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:30.962855Z","title":"Towards understanding and mitigating social biases in language models","venue":null,"work_id":"3f76a72f-43e3-498b-a5c2-3aa7fe90dfc7","year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.919579Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:8235a4f936d4eca937940527e481da795eaca6c8f463511dfcd21bee3d2c2ab8","observation_id":"94d18f79-d22a-4a1d-8332-1afc7a36329e","resolution":{"observed_at":"2026-08-07T15:12:31.100134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-07T15:12:22.022328Z","title":"Holistic evaluation of language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.022328Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:936b085bb00da4c853c039da17ca682d377f17c73a6ffcf3cee3342ee868aa96","observation_id":"9e817d53-75a9-4742-972f-1035cb756a88","resolution":{"observed_at":"2026-08-07T15:12:22.022328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14896","last_updated":"2024-12-10T07:43:50Z","snapshot_observed_at":"2026-08-13T00:48:14.672560Z","submitted_at":"2024-03-22T00:59:48Z","title":"Investigating Bias in LLM-Based Bias Detection: Disparities between LLMs and Human Perception","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14896","snapshot_observed_at":"2026-08-07T15:12:22.173007Z","title":"Investigating Bias in LLM-Based Bias Detection: Disparities between LLMs and Human Perception, December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.173007Z"},"links":{"cited_paper":"/paper/2403.14896","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:80926b3c6ffb14966e976e0956948a06e7ac24c47c5ab3e7475631bb8c9bb101","observation_id":"5be1b9cd-4210-480c-846b-3d16adc3b2f5","resolution":{"observed_at":"2026-08-07T15:12:22.173007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10486","last_updated":"2020-10-31T19:04:07Z","snapshot_observed_at":"2026-07-06T08:31:36.604379Z","submitted_at":"2019-10-16T22:17:02Z","title":"Does Gender Matter? Towards Fairness in Dialogue Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10486","snapshot_observed_at":"2026-08-07T15:12:22.311528Z","title":"Does gender matter? towards fairness in dialogue systems","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.311528Z"},"links":{"cited_paper":"/paper/1910.10486","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:51432b62463cd87cc0d891ecd2c4cba0d4e0a79a15b27304e6d7348cd43c59a2","observation_id":"bed8add1-4382-4d3a-a30b-00692b898d15","resolution":{"observed_at":"2026-08-07T15:12:22.311528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:30.716292Z","title":"Lmarena: Open platform for crowdsourced ai benchmarking","venue":null,"work_id":"02a1def6-6c09-476b-891a-138f33f45182","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.483302Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:1c78ebc5b98a71c3ff58201704cc6662d6e26706fa28e5b1eca0de16bbfef81a","observation_id":"d5d6003c-7c16-44c6-85d0-3af142aefd78","resolution":{"observed_at":"2026-08-07T15:12:30.817269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:30.467038Z","title":"Azure openai service content filtering","venue":null,"work_id":"b0263f8b-5c6e-4069-a5c3-ea9f056544d2","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.598191Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:21fc0fb2de77d2d7308fe281a864a478c918e13c6ae6ce7447356943301cbc20","observation_id":"7f818f25-51e8-4eb6-9bee-290dcef3de71","resolution":{"observed_at":"2026-08-07T15:12:30.573600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-07T15:12:22.712392Z","title":"Crows-pairs: A challenge dataset for measuring social biases in masked language models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.712392Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:2290ac73ce3096c8a3b4380b65cf671f972693bfaae231cdb22fd452f887331a","observation_id":"debc0755-9045-45b1-9b60-0bd2280fead5","resolution":{"observed_at":"2026-08-07T15:12:22.712392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.08877","last_updated":"2021-12-14T06:19:33Z","snapshot_observed_at":"2026-08-13T18:25:41.638516Z","submitted_at":"2021-08-19T18:58:02Z","title":"Sentence-T5: Scalable Sentence Encoders from Pre-trained Text-to-Text Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.08877","snapshot_observed_at":"2026-08-07T15:12:22.808661Z","title":"Sentence-t5: Scalable sentence encoders from pre-trained text-to-text models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.808661Z"},"links":{"cited_paper":"/paper/2108.08877","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:bae3728936797e0064ef225f67b574193e6795bf63ad554a3d8c11efbb81e771","observation_id":"82e35708-b7a9-4509-960f-b2fcb2468cf6","resolution":{"observed_at":"2026-08-07T15:12:22.808661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:30.220653Z","title":"Honest: Measuring hurtful sentence completion in language models","venue":null,"work_id":"c67f3c52-ec30-4ffc-b338-332ff3012fb0","year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.902161Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f79344265283d7fc5b67b64fc87ee64e224ccb73e6860d47a4ce11135ae4b8a2","observation_id":"bc9135a4-6626-4692-8217-3ef9f92ed405","resolution":{"observed_at":"2026-08-07T15:12:30.369802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14769","last_updated":"2023-12-29T11:07:09Z","snapshot_observed_at":"2026-08-13T04:55:12.778458Z","submitted_at":"2023-12-22T15:38:13Z","title":"Large Language Model (LLM) Bias Index -- LLMBI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14769","snapshot_observed_at":"2026-08-07T15:12:22.978844Z","title":"Large Language Model (LLM) Bias Index – LLMBI, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.978844Z"},"links":{"cited_paper":"/paper/2312.14769","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:7e168a16ea05af3027eb6f29d39856b4221b693c14b92b422de0779daecaad71","observation_id":"7f840faa-bef0-42ee-b0dc-83a1ca6f1fa7","resolution":{"observed_at":"2026-08-07T15:12:22.978844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:12:23.078776Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.078776Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:7ce8240ea488679a0b2b2a1a5bdcf2716b78f24f3a24a69ff7fcebe05080692e","observation_id":"db77cd14-10cc-4dad-942e-f3e128a84168","resolution":{"observed_at":"2026-08-07T15:12:23.078776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.994170Z","title":"The perils and promises of fact-checking with large language models","venue":null,"work_id":"c5612d10-15c1-4186-93d3-a4095e9f8e65","year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.154522Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:5dea67d37bc8ba55372e29757be58ddfeff91d42035e346ae1e865ce038e6602","observation_id":"7b5cda11-1dbf-44bf-adf9-4569df9bbcfc","resolution":{"observed_at":"2026-08-07T15:12:30.102080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11290","last_updated":"2024-06-28T16:35:15Z","snapshot_observed_at":"2026-08-13T00:04:36.713101Z","submitted_at":"2024-05-18T13:31:12Z","title":"MBIAS: Mitigating Bias in Large Language Models While Retaining Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11290","snapshot_observed_at":"2026-08-07T15:12:23.243382Z","title":"Mbias: Mitigating bias in large language models while retaining context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.243382Z"},"links":{"cited_paper":"/paper/2405.11290","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:a1ad457d79a7422208a7f7745b2e5602990de314cd01813458635ba86c3a3c4c","observation_id":"4aa33908-6d17-4353-a76f-5c31de903cc5","resolution":{"observed_at":"2026-08-07T15:12:23.243382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10501","last_updated":"2023-10-16T15:20:30Z","snapshot_observed_at":"2026-08-13T22:48:44.761206Z","submitted_at":"2023-10-16T15:20:30Z","title":"NeMo Guardrails: A Toolkit for Controllable and Safe LLM Applications with Programmable Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10501","snapshot_observed_at":"2026-08-07T15:12:23.329400Z","title":"Nemo guardrails: A toolkit for controllable and safe llm applications with programmable rails","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.329400Z"},"links":{"cited_paper":"/paper/2310.10501","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:dbee1a72be535b8df402045a2c7a385bfc1c5fe55d58cd580e388ca493e45b03","observation_id":"717f6f6f-6ed1-4ab2-8aac-de77b9e10e61","resolution":{"observed_at":"2026-08-07T15:12:23.329400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-07T15:12:23.428995Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.428995Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:a76095f2d4d1952cf9a2cc902d25fc0da204afe7596ddf2ecb3d718b6ca35dca","observation_id":"023e3dd2-a012-45f6-8ce4-d8c286ca2e5b","resolution":{"observed_at":"2026-08-07T15:12:23.428995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.761205Z","title":"Does deepseek censor its answers? we asked 5 questions on sensitive china top- ics","venue":null,"work_id":"6596dbed-bbd5-43a1-9462-83c0bf748864","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.541843Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:23fa065bb26ca8c48e85e45f1b4be21febc07ac438316362a7869aeca426e0b6","observation_id":"d7384e92-8db2-4a4b-82cd-52ed3d1c5261","resolution":{"observed_at":"2026-08-07T15:12:29.864986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:23.660114Z","title":"Introduction to probability models","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.660114Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:965be36341dd7ce03c3edb274dc1509dcdcd72d63617c331aaa0b9babac6a3e1","observation_id":"5dad7343-2525-4cc9-a388-3578f07946de","resolution":{"observed_at":"2026-08-07T15:12:23.660114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.532517Z","title":"Self-diagnosis and self-debiasing: A proposal for reducing corpus-based bias in nlp","venue":null,"work_id":"0b28365b-f2f9-4a5e-9cde-d8ba1646413f","year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.743605Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:a0a05b9fe2e85ab982b1113a59ddb09267349b527b80571e2e73233d3ac2437b","observation_id":"c786a44b-f57f-4d3f-9d2d-5d2398be8f55","resolution":{"observed_at":"2026-08-07T15:12:29.641418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.377420Z","title":"A comparison of the two one-sided tests procedure and the power approach for assessing the equivalence of average bioavailability","venue":null,"work_id":"4e64c8af-e3c9-45ae-937c-fef967d07ff4","year":1987},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.964865Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:6d3b6f3d0536e93d7e15ab53a58b8bfd38e33329b7506d609695a37d87ffbd80","observation_id":"237f47cf-82c3-43bb-9f8b-520b225f8c36","resolution":{"observed_at":"2026-08-07T15:12:29.430369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15025","last_updated":"2023-09-26T15:49:23Z","snapshot_observed_at":"2026-08-13T10:04:36.296007Z","submitted_at":"2023-09-26T15:49:23Z","title":"Large Language Model Alignment: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15025","snapshot_observed_at":"2026-08-07T15:12:24.027242Z","title":"Large language model alignment: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.027242Z"},"links":{"cited_paper":"/paper/2309.15025","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:30f0fb521745625156042c6dbf1765aa7b637094f756cf08320ab8f330775e82","observation_id":"5e59c711-700f-44cf-b5de-bb0b683911ad","resolution":{"observed_at":"2026-08-07T15:12:24.027242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09150","last_updated":"2023-02-15T02:24:43Z","snapshot_observed_at":"2026-08-14T13:20:54.824438Z","submitted_at":"2022-10-17T14:52:39Z","title":"Prompting GPT-3 To Be Reliable","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09150","snapshot_observed_at":"2026-08-07T15:12:24.224762Z","title":"Prompting gpt-3 to be reliable","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.224762Z"},"links":{"cited_paper":"/paper/2210.09150","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:30620b6f65889cf22f7f47aa7586a8cc43c87248f666926a06dd2a8a7c688f4e","observation_id":"99c86017-6745-4a4d-935a-2c35e05ab2d2","resolution":{"observed_at":"2026-08-07T15:12:24.224762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10457","last_updated":"2024-07-15T06:12:17Z","snapshot_observed_at":"2026-08-12T23:22:17.483443Z","submitted_at":"2024-07-15T06:12:17Z","title":"The Good, The Bad, and The Greedy: Evaluation of LLMs Should Not Ignore Non-Determinism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10457","snapshot_observed_at":"2026-08-07T15:12:24.340787Z","title":"The good, the bad, and the greedy: Evaluation of llms should not ignore non-determinism","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.340787Z"},"links":{"cited_paper":"/paper/2407.10457","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:da5c70976dca9109ec195c510214ea2651fa7504d916212725e582b165db80df","observation_id":"3ea5021e-aa06-4c4f-a1cb-bce3c7a11016","resolution":{"observed_at":"2026-08-07T15:12:24.340787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.197821Z","title":"Analysis of variance (anova).Chemometrics and intelligent laboratory systems, 6(4):259–272, 1989","venue":null,"work_id":"f3d8eda8-0b0d-4bc8-9609-7acf461555b4","year":1989},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.408924Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:b5a0dd51f1a24ad96030ed5e369418dac1f79dcf9bddd4b9e8e1467a26bb0ba0","observation_id":"8d7614bc-8ed8-49dc-a1c9-73f71e6fe84a","resolution":{"observed_at":"2026-08-07T15:12:29.270644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09741","last_updated":"2023-05-30T15:22:50Z","snapshot_observed_at":"2026-08-13T13:18:45.782206Z","submitted_at":"2022-12-19T18:57:05Z","title":"One Embedder, Any Task: Instruction-Finetuned Text Embeddings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09741","snapshot_observed_at":"2026-08-07T15:12:24.472276Z","title":"One embedder, any task: Instruction-finetuned text embeddings","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.472276Z"},"links":{"cited_paper":"/paper/2212.09741","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:21feac7625a3564ce0efa5f7c534872c16b18fb5999e30fe506cd6bf7ed71176","observation_id":"118dff2d-0753-4dd6-9bc8-c24c37b20be7","resolution":{"observed_at":"2026-08-07T15:12:24.472276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.930863Z","title":"Grok 3 appears to have briefly censored unflattering mentions of trump and musk, 2025","venue":null,"work_id":"47235d99-970b-4d23-ae35-31b63f3631e2","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.566817Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:04eba3798410ea17e9cc5e25d0d5f14d693dfdf7b9203398b2e4a8ea5a6daeec","observation_id":"d94475bd-d37f-40e5-b28d-2b83a782add4","resolution":{"observed_at":"2026-08-07T15:12:29.089474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14552","last_updated":"2022-10-26T08:13:58Z","snapshot_observed_at":"2026-08-13T21:57:13.414885Z","submitted_at":"2022-10-26T08:13:58Z","title":"A Robust Bias Mitigation Procedure Based on the Stereotype Content Model","version":1},"cited_work":{"arxiv_id":"2210.14552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.14552","snapshot_observed_at":"2026-08-07T15:12:26.586151Z","title":"A Robust Bias Mitigation Procedure Based on the Stereotype Content Model","venue":"cs.CL","work_id":"bf3f104d-b513-4d63-8620-00a65a2559ee","year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.658029Z"},"links":{"cited_paper":"/paper/2210.14552","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f5f0af929d742d47c38bc0f3980de58ff79c51e28bf6d2402509291f958f09f5","observation_id":"2554893e-4bef-45d0-a450-5f78479ec2bc","resolution":{"observed_at":"2026-08-07T15:12:26.644599Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.735925Z","title":"Llm leaderboard, 2025","venue":null,"work_id":"b48df884-c61a-4e6c-8388-42a00f4a1066","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.738891Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:508118e2bc2fa1158e2230188681b43aa0afdd094677ce0f5f3a96a9b289a5fa","observation_id":"ea0bf318-8eca-4227-be09-d081ae39eca8","resolution":{"observed_at":"2026-08-07T15:12:28.824739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.492206Z","title":"The dark side of generative artificial intelligence: A critical analysis of controversies and risks of chatgpt","venue":null,"work_id":"9a9ef5ee-ceab-4a67-898f-1092ba0f233a","year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.829066Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:eefa02ddb122a32992f95082709d7a397f01bd0d4d47fba20724b0c463698064","observation_id":"0fed6980-7565-461d-85dd-9683beba6d21","resolution":{"observed_at":"2026-08-07T15:12:28.629921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17926","last_updated":"2023-08-30T13:22:35Z","snapshot_observed_at":"2026-08-14T09:51:03.197404Z","submitted_at":"2023-05-29T07:41:03Z","title":"Large Language Models are not Fair Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17926","snapshot_observed_at":"2026-08-07T15:12:24.922647Z","title":"Large language models are not fair evaluators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.922647Z"},"links":{"cited_paper":"/paper/2305.17926","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:3fecb700252bb84d0ff88eb3d0f878ab14cf05df5898c1114a6f25d92c36cba1","observation_id":"9f96eb18-a34c-4bf0-a191-435305c35cf0","resolution":{"observed_at":"2026-08-07T15:12:24.922647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-08-13T22:45:34.795769Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-07T15:12:24.998012Z","title":"Self-instruct: Aligning language models with self-generated instructions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.998012Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:28b80ecb6913acdb11883b66ae83e263188fc4e93edf48384ac6715399c8a3c7","observation_id":"d4827d86-f6f6-4b39-b673-e5803bfd6fe1","resolution":{"observed_at":"2026-08-07T15:12:24.998012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:25.092944Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.092944Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:4f7aed248f961985a1bdb60f1733dd1bc6066949eed3a850dafefd55ecb11c38","observation_id":"4c3efecd-3656-42c7-801a-bbec0a5ce01b","resolution":{"observed_at":"2026-08-07T15:12:25.092944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:25.172063Z","title":"All of statistics: a concise course in statistical inference","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.172063Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:a8077035e4336af874132eafc18d81729f3c3ea28791fc2a87cbfd30348f24fc","observation_id":"d37038b2-8922-475e-98fc-2cf000c107c7","resolution":{"observed_at":"2026-08-07T15:12:25.172063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.06032","last_updated":"2021-03-02T21:04:26Z","snapshot_observed_at":"2026-08-14T00:28:11.031387Z","submitted_at":"2020-10-12T21:15:29Z","title":"Measuring and Reducing Gendered Correlations in Pre-trained Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.06032","snapshot_observed_at":"2026-08-07T15:12:25.231885Z","title":"Measuring and reducing gendered correlations in pre-trained models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.231885Z"},"links":{"cited_paper":"/paper/2010.06032","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:bf6970ae55c44a012152ca79f8fa403c2cc1078e88d7213d6432eaeb07f304ba","observation_id":"91b9fee3-05ff-4342-92ce-8b9e21dd9b7b","resolution":{"observed_at":"2026-08-07T15:12:25.231885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:25.322067Z","title":"The generalization of ‘student’s’problem when several different population varlances are involved","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.322067Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:4df10579705b177a2475748334815be1b24e71ef6cde9031695a300124d7d6ee","observation_id":"a60db2fb-3c48-4f80-9cb9-f55dad0982d9","resolution":{"observed_at":"2026-08-07T15:12:25.322067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.258205Z","title":"Livebench: A challenging, contamination-free LLM benchmark","venue":null,"work_id":"1bcfc5cc-a3e7-4c43-9afb-2e9ac0a901e0","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.414011Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:b4843653a627bcf8d70513ed4ec079d2c4c729a08d1a9b713eff89528fc65e0f","observation_id":"fdbc3afe-5b05-4fca-8ae5-f5e313faf5b8","resolution":{"observed_at":"2026-08-07T15:12:28.344544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.050075Z","title":"This powerful new chatbot works great—unless you ask about china, 2025","venue":null,"work_id":"fd588543-8e78-4623-a1c0-675565247373","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.526743Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:58500fc7ae31ea640c9cc238107f70f97a4e6f4f4aa7b859fc0db699d038c11d","observation_id":"8ea27ce6-d086-4b6b-a7ff-3aa3a6784b2c","resolution":{"observed_at":"2026-08-07T15:12:28.133989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:27.877951Z","title":"Compensatory debiasing for gender imbalances in language models","venue":null,"work_id":"ae08b339-11ce-4cd8-88b3-dfbd054c75a6","year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.608617Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:d7f8849e827084c64cfbcf559661a8825c2f42c5120e81b99ff669055cf1f9ba","observation_id":"8a853731-12f4-440a-ad5f-9c07a3867568","resolution":{"observed_at":"2026-08-07T15:12:27.962499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05093","last_updated":"2025-05-12T01:30:34Z","snapshot_observed_at":"2026-08-12T23:05:58.345430Z","submitted_at":"2024-08-09T14:34:32Z","title":"Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05093","snapshot_observed_at":"2026-08-07T15:12:25.691449Z","title":"Order matters in hallucination: Reasoning order as benchmark and reflexive prompting for large-language-models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.691449Z"},"links":{"cited_paper":"/paper/2408.05093","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:8805e1f4337a9d6985e248bbb10ea22186254b447c9154855fca15ef32fa98c0","observation_id":"febd100a-0219-41c8-9fd7-2d4b3b64b0cb","resolution":{"observed_at":"2026-08-07T15:12:25.691449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:27.719313Z","title":"Large language model as attributed training data generator: A tale of diversity and bias","venue":null,"work_id":"2587e676-6f78-4543-bf71-a052898f85cc","year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.797224Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:2d48b88c4be99b2f2ba578c76f04b499fcb13cf71d544cbc5cc69f5e3dd3a00d","observation_id":"c813e29d-1692-4e8f-b78b-f080f31fb17d","resolution":{"observed_at":"2026-08-07T15:12:27.777884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01862","last_updated":"2023-08-03T16:38:34Z","snapshot_observed_at":"2026-08-13T10:41:45.345243Z","submitted_at":"2023-08-03T16:38:34Z","title":"Wider and Deeper LLM Networks are Fairer LLM Evaluators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01862","snapshot_observed_at":"2026-08-07T15:12:25.897572Z","title":"Wider and deeper llm networks are fairer llm evaluators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.897572Z"},"links":{"cited_paper":"/paper/2308.01862","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:ecca147ef457e6c41a1119a161c9f00dfebf297ed2e50e2309bb2fffcc0b268c","observation_id":"b497a7b1-6cbe-42cb-8f8f-6b4ef4ab3a57","resolution":{"observed_at":"2026-08-07T15:12:25.897572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:25.991115Z","title":"Explainability for large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.991115Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:54b2f99aaad1c5dba783e8f0a4ddbffca77831b40b330411315d65bfdc03f8b2","observation_id":"a85f9f47-6d90-443d-ada6-a810ed66b41e","resolution":{"observed_at":"2026-08-07T15:12:25.991115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06315","last_updated":"2023-12-11T12:02:14Z","snapshot_observed_at":"2026-08-13T05:05:12.129271Z","submitted_at":"2023-12-11T12:02:14Z","title":"GPTBIAS: A Comprehensive Framework for Evaluating Bias in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06315","snapshot_observed_at":"2026-08-07T15:12:26.108646Z","title":"Gptbias: A comprehensive framework for evaluating bias in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.108646Z"},"links":{"cited_paper":"/paper/2312.06315","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:b9078e9ad449f317669d8cd4a0b32b9a31dafc16ed9fd0186be1bb83f2eff30e","observation_id":"0186f663-106e-4d56-b52e-bc8829b8046b","resolution":{"observed_at":"2026-08-07T15:12:26.108646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:26.214959Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.214959Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:3fab531a63f51872b2923c9c657e4e3b80403fc4145f7552358c696c69a8d9e1","observation_id":"36bb37d0-4df9-483f-8d44-fdea6d64eb38","resolution":{"observed_at":"2026-08-07T15:12:26.214959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:26.258317Z","title":"Lima: Less is more for alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.258317Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:359ffc4fa61235609f1d16777a34fbbde76c936cfdd9c58f110aaee93e91bbea","observation_id":"3483dc30-69ef-424c-8e25-217f447deeca","resolution":{"observed_at":"2026-08-07T15:12:26.258317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:27.528778Z","title":"{question}","venue":null,"work_id":"4328a345-91e5-45c4-b2b9-6f22a6a60c64","year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.342749Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:8d4208d5bede092d55053120ef476ecef7254c508215fb6d6f37618a17422d13","observation_id":"13ab7a7b-870e-4cd0-a527-687eedc76b63","resolution":{"observed_at":"2026-08-07T15:12:27.596932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:27.337896Z","title":"A.3 Bias Criteria Table Score Description 1 Fully neutral and factual","venue":null,"work_id":"7d80e5d6-7eb3-4c2a-b032-19270c8a397c","year":null},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.426274Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:48544458af7b5c327b101bb200970668fcb8531eb1fba2a2a19e1d762dacd576","observation_id":"5ba7887e-9682-456e-966d-43e54c02743d","resolution":{"observed_at":"2026-08-07T15:12:27.434147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T22:11:49.574494Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs"},"reference_resolution":{"displayed":84,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":2,"verified_fuzzy":28},"total_outbound_references":84},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 84 of 84 outbound references and 0 inbound Pith citation observations for arXiv:2505.17131."}