{"as_of":"2026-08-06T09:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:87a2db0f7186e3360015c818ca5c436397577c77f9bbcc4070989d5ebd6e328b","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T16:24:02.947458Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:34:28.258222Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T21:06:13.143835Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"cited_work":{"arxiv_id":"2605.05073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.05073","snapshot_observed_at":"2026-07-01T21:06:13.143835Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","venue":"stat.ME","work_id":"b2e2fa45-9b97-4f15-90c4-37af8edc65f8","year":2026},"citing_paper":{"arxiv_id":"2606.01034","last_updated":"2026-05-31T05:50:27Z","snapshot_observed_at":"2026-08-04T18:54:04.912017Z","submitted_at":"2026-05-31T05:50:27Z","title":"A Finite-Calibration Regime Map for LLM Judge Panels","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T17:34:28.258222Z"},"links":{"cited_paper":"/paper/2605.05073","citing_paper":"/paper/2606.01034"},"observation_digest":"sha256:e8ec18b95fcc69ee693b35e4a5304777137ba75e7b5629705689c7e4bade5fba","observation_id":"b7aabcb3-e7ed-4bfa-a041-47de13584e5b","resolution":{"observed_at":"2026-07-01T21:06:13.145282Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.05073/citation-record","integrity":"/paper/2605.05073/integrity","json":"/paper/2605.05073/citation-record.json","paper":"/paper/2605.05073"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:02:31.140821Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena.Advances in neural information processing systems, 36:46595– 46623","venue":null,"work_id":"a23893be-7ce1-410f-b15c-bed10c608d09","year":2023},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:9760f9cf2e4d554f6b79d116079bf6694df80167ba23fa09baac2ea80fe509f1","observation_id":"8b5827ca-e143-4776-9248-9c1555f90962","resolution":{"observed_at":"2026-05-26T10:07:09.320348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep reinforcement learning from human preferences.Advances in neural information pro- cessing systems, 30","venue":null,"work_id":"e8647f09-22dd-4467-9202-bfcd555d6c7f","year":2017},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:1407ec65e69bc081a4f37feaef2d39bbffd95570388e82f9c4117c860a6e7b55","observation_id":"c22cf8ad-28a7-4dba-be01-14106a26e45c","resolution":{"observed_at":"2026-05-26T10:07:09.324007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T18:16:26.555721Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744","venue":null,"work_id":"aa3e2ba7-4265-495b-8612-615b2ddc9991","year":2022},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:4a661a75d681b8bd08c4aafd09fceb9552a18eef4828149268f9c8c0ea2b5665","observation_id":"3932fc76-75ac-43ae-9dbe-88693fceae11","resolution":{"observed_at":"2026-05-26T10:07:09.312820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:54:50.108470Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"5d2e1082-e73f-4c1b-a18c-bf0ba1772c23","year":2023},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:6edfcb6f377e9ab9ea3a23330d599b814fd8ae5939d0cc445320f261a9b1177c","observation_id":"12ad109c-173e-4678-aa8f-5bd802916828","resolution":{"observed_at":"2026-05-26T10:07:09.338498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pairwise ranking ag- gregation in a crowdsourced setting","venue":null,"work_id":"028d639d-2f50-4d6c-a2c0-143a03543c47","year":2013},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:1c331e6e8225c7a4a907273a5b564c5a5b01d1418ec0da2906bab60096d38f8e","observation_id":"01f21fd3-ff6e-493c-9c21-d594af68eb29","resolution":{"observed_at":"2026-05-26T10:07:09.316837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Irt-based aggre- gation model of crowdsourced pairwise comparison for evaluating machine translations","venue":null,"work_id":"c6a2e73b-e4f1-44dd-a8c0-a270ddd71b31","year":2016},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:d0e36180728950b116de04900e0b91c049ac37c8f622dcc325bb45e25215c36d","observation_id":"63fe1ca0-ee26-4440-96df-c6357530c379","resolution":{"observed_at":"2026-05-26T10:07:09.327612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language model coun- cil: Democratically benchmarking foundation models on highly subjective tasks","venue":null,"work_id":"929dd78e-3453-4412-aca9-31674e979a6b","year":2025},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:cc6bce32bcea5afc5238777240f92e2ea7c6e67c9c2ef9c84af4f3869cea40a5","observation_id":"7db2312b-daea-4262-8a79-1a0610f36863","resolution":{"observed_at":"2026-05-26T10:07:09.308808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ranking large language models without ground truth","venue":null,"work_id":"25adead6-ae9e-47ca-95f5-f62fb293dc0d","year":2024},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:c991dd02b9cff9b993d985446b2debbe0bd5cf7bf07941daed13eff972629d29","observation_id":"470e53f3-b7fd-4110-98c9-7e262d4c907b","resolution":{"observed_at":"2026-05-26T10:07:09.334552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llms instead of human judges? a large scale empirical study across 20 nlp evaluation tasks","venue":null,"work_id":"5fa0c264-4960-4d43-ab51-2380bca3df41","year":2025},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:8dcaa41e8b19e45bc1fae1cbc8adbca9793b624a5355f7ad593c067f790e10ce","observation_id":"fa17a9fb-a6cd-4d61-b103-52e7cfc90f0e","resolution":{"observed_at":"2026-05-26T10:07:09.331046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How reliable is multilingual llm-as-a-judge? InFindings of the Associa- tion for Computational Linguistics: EMNLP 2025","venue":null,"work_id":"75c08339-0401-4b14-bee4-97595a96c3fe","year":2025},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:13394ebfdfb89899ee783b52e5ac3c9a86867b32729be4ea41f8b1fe92ca4d45","observation_id":"e1b477b0-6ae9-43d9-8bf0-77b701627bbe","resolution":{"observed_at":"2026-05-26T10:07:09.301335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Validating llm-as-a-judge systems under rating indeterminacy","venue":null,"work_id":"6ec98698-3964-4515-8dd0-0e574780935c","year":2025},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:b2d231ea163d9f34cde477fee3fe4157d9ce449e1a9bd80bfbf330ad9817f5ee","observation_id":"ecea5205-9976-45be-a033-7eba1548bc2a","resolution":{"observed_at":"2026-05-26T10:07:09.285433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Re- evaluating automatic llm system ranking for alignment with human preference","venue":null,"work_id":"fc092168-a99f-418b-b0f2-f7dea14c4cfe","year":2025},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:51e03b20914987efa40b2b9d7d9fe31dfecb050fbe154e98daef523f6b5e30af","observation_id":"e1410c0c-b985-4fc8-8b44-95f20ddb2b22","resolution":{"observed_at":"2026-05-26T10:07:09.278467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:44:43.389356Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":"7c92dc1c-5c6b-42d3-a3a8-1b5b19d220da","year":1952},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:f53c57da94bb4ca5370ad1654f08031df068c22111dd2612a1b24b8732471c4c","observation_id":"06a2f3b2-0b23-4aca-8da9-4a6fba0cc4ad","resolution":{"observed_at":"2026-05-26T10:07:09.194349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mm algorithms for generalized bradley-terry models.The annals of statistics, 32(1):384–406","venue":null,"work_id":"5afc2e9a-bcb3-419f-bebb-9454761b4934","year":2004},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:1b4fb5bdb5402a63c522c79f91a0209cdf20d96a1e3e61365927330272332576","observation_id":"de72dc7b-a437-4b36-8d54-5e7195a84d6e","resolution":{"observed_at":"2026-05-26T10:07:09.267462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chatbot arena: An open platform for evaluating llms by human preference","venue":null,"work_id":"c983f4f4-108b-4eba-98b8-aebcbd612e8a","year":2024},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:f633e6bc35deb34dd88715054cbfb20df0c5bd7ec4feff7f0c630627bdd208ea","observation_id":"6f36587c-7568-4b46-af6e-f48052d42d02","resolution":{"observed_at":"2026-05-26T10:07:09.198418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:26:21.185971Z","title":null,"venue":null,"work_id":"74e56a81-f602-4f5f-b11b-333bf08299d5","year":2023},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:53e3667187be6d717ccbe1044ecdf066551eec450625b1d8a33cb6844e3aaa8f","observation_id":"3678c1e9-6134-4879-af85-a5914da62226","resolution":{"observed_at":"2026-05-26T10:07:09.240801Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21817","last_updated":"2026-06-10T10:26:33Z","snapshot_observed_at":"2026-08-03T06:49:02.662507Z","submitted_at":"2026-01-29T15:01:28Z","title":"A Judge-Aware Ranking Framework for Evaluating Large Language Models without Ground Truth","version":3},"cited_work":{"arxiv_id":"2601.21817","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.21817","snapshot_observed_at":"2026-07-02T02:36:27.400571Z","title":"A judge-aware ranking framework for evaluating large language models without ground truth.arXiv preprint arXiv:2601.21817","venue":"stat.ML","work_id":"8546cd51-763d-4f81-a5e9-9170e6b8935f","year":2026},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"cited_paper":"/paper/2601.21817","citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:cc8ecc5f1901104b1ca51d8a79736d45e1d6a8faa2dbeaf5748f29544ee4034c","observation_id":"8055a142-2278-4227-bb83-484b4288b8de","resolution":{"observed_at":"2026-06-05T02:15:33.479664Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Individualized rank aggregation using nuclear norm regular- ization","venue":null,"work_id":"b577a833-4be5-41cf-8928-49628d84633e","year":2015},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:5c0ec7c4e5cf68dce08803b136e49efd4bc4dcf7643c6307f24eedc17cc4f1f4","observation_id":"9545e783-2ab9-4426-b1ed-a9b96f6f4957","resolution":{"observed_at":"2026-05-26T10:07:09.201824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preference completion: Large-scale collaborative ranking from pairwise comparisons","venue":null,"work_id":"17281280-1630-4407-a624-a68571a931d7","year":1907},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:408f029f7141a5c72df97923d2bb60ca7c791346bf3d444ebace070ba329f309","observation_id":"5d7d5d52-a3da-461b-890a-020e5e626a8d","resolution":{"observed_at":"2026-05-26T10:07:09.222635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When can we rank well from comparisons of o (n\\log (n)) non-actively chosen pairs? InConference on Learning Theory, pages 1376–1401","venue":null,"work_id":"d2703e56-0c49-4264-a824-c63e29a4442e","year":2016},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:a7d9a14c98e67e604d01ccb60242a5c9b1986deb8095ab9e131eb787a014eff6","observation_id":"cd42f923-8b3d-463d-9287-a5c941d3c59a","resolution":{"observed_at":"2026-05-26T10:07:09.281980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rank aggregation via heterogeneous thurstone preference models","venue":null,"work_id":"5e6fad3e-a60c-48b0-a2e6-259996dea9f3","year":2020},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:8577da56cb0fba30345e800f1348c000fd5d46fd7ab6a92de571e81081f86825","observation_id":"fa1310f2-fa86-428d-a267-5183ff6215e1","resolution":{"observed_at":"2026-05-26T10:07:09.289088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clustering and inference from pairwise comparisons","venue":null,"work_id":"d8f3574c-1c12-491a-822a-282649cfbaf0","year":2015},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:b92765b7288bcff13a8911c0750895c0991ea33e95cf7e3f1caacc9c3ea1f0ca","observation_id":"2e6be196-70fc-4a2d-a982-6054be59e2f6","resolution":{"observed_at":"2026-05-26T10:07:09.264012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generalised probabilistic modelling and improved uncer- tainty estimation in comparative llm-as-a-judge","venue":null,"work_id":"17ff6d70-3535-4be1-a23a-216ca220416b","year":2025},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:a3a1da500476949b4b42a26b4162ed2aca421165a1284904b7bdccc64db70c23","observation_id":"12900027-51cb-4ac2-b36e-82b062887279","resolution":{"observed_at":"2026-05-26T10:07:09.257593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving LLM-as-a-judge inference with the judgment distribution","venue":null,"work_id":"f40afef6-fe34-49ff-b5a3-4892a824baff","year":2025},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:6f2065ed36f50802d96346c3b5be92262881e0a9f2fb3078da2f3b706b319918","observation_id":"2a0e4c8e-7731-4ee2-84b6-a1916b03f884","resolution":{"observed_at":"2026-05-26T10:07:09.260841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.01847","last_updated":"2025-09-02T00:10:17Z","snapshot_observed_at":"2026-08-05T12:13:08.872230Z","submitted_at":"2025-09-02T00:10:17Z","title":"Uncertainty Quantification for Ranking with Heterogeneous Preferences","version":1},"cited_work":{"arxiv_id":"2509.01847","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.01847","snapshot_observed_at":"2026-06-29T14:53:32.250053Z","title":"arXiv preprint arXiv:2509.01847 , year=","venue":null,"work_id":"28345465-ce82-48b2-b566-c2df01214fd0","year":2025},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"cited_paper":"/paper/2509.01847","citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:47ecb83e9e8e661d6a135f93c8b1e32a0276cdd541e36afce61635516be697f0","observation_id":"80e3f9db-4821-405c-a49c-17627fc00739","resolution":{"observed_at":"2026-05-11T18:16:09.523827Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wiley New York","venue":null,"work_id":"cbf28cdc-e3b9-433d-98de-bf54493924ee","year":1959},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:345ceacb2e8d9819889bafb2b2a738460c232c8b2b45853fedab0df0b18cd9d9","observation_id":"152c8b33-bf17-493d-802f-31149e862377","resolution":{"observed_at":"2026-05-26T10:07:09.305157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hybrid-mst: A hybrid active sampling strategy for pairwise preference aggregation.Advances in neural information processing systems, 31","venue":null,"work_id":"7c828b83-b3c2-487c-a5fb-0ca90af1c11e","year":2018},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:68c3cb75fef1c8f3b1d3a535dfa804b924d0d2e73f5030bb0703509d3d7401f6","observation_id":"5e6f053a-af38-45d5-9f32-a704d7cb5be8","resolution":{"observed_at":"2026-05-26T10:07:09.274450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ULTRAFEEDBACK: Boosting language models with scaled AI feedback","venue":null,"work_id":"3498712b-61b7-413c-a4e7-573930b6ae91","year":2024},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:2d3e0f44a28cb6dd744902389911dddd937b5d431f18289b2f6cbc9e340a2eac","observation_id":"057b48f8-66d1-4842-992e-9c8666e211ba","resolution":{"observed_at":"2026-05-26T10:07:09.253930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"American Mathematical Soc","venue":null,"work_id":"b07c7d4a-8018-47d0-81c7-536d22658aa6","year":1997},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:3bf5e35c8d61d93a540a0153ba6d72e6b67657b49f0cd7319b2147c410ba644d","observation_id":"f3e765e1-c462-47a8-8a8f-9af8966ae703","resolution":{"observed_at":"2026-05-26T10:07:09.244116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graph theory and probability.Canadian Journal of Mathematics, 11:34–38","venue":null,"work_id":"748a4a4c-a568-4e7d-bfde-588ce899125c","year":1959},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:f1aaea6da90200d67d395a2573b2fe5ae8b2faefea6fb6c6dd3b176b4a945f32","observation_id":"a29331ac-cf5d-4e61-a5ed-5d0dc2a38a9d","resolution":{"observed_at":"2026-05-26T10:07:09.247831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self and Kung-Yee Liang","venue":null,"work_id":"03090d43-2e27-49ee-94f0-ff758f030763","year":1987},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:b6c6a1d0fb4ae4a0ebfc1c09977919aa9d3b40e5dc5005471664a16d931a2b63","observation_id":"40344a96-379c-4a12-9226-6273ae0e2b8e","resolution":{"observed_at":"2026-05-26T10:07:09.250904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a264ac55-d5cb-420d-9fa6-ffd27df8ce83","year":2000},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:7200d0f2cc8bfa769bac5c876ed1fa0bf506824ac17317adb023482fd18fe8b6","observation_id":"f2166238-a00f-4988-8833-0132edf27c2e","resolution":{"observed_at":"2026-05-26T10:07:09.270638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Linear convergence of gradient and proximal- gradient methods under the polyak-łojasiewicz condition","venue":null,"work_id":"67fb7434-7b06-47ce-a095-ccd65f28dc7e","year":2016},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:c057740da2ce5c2f328709d85e7a5814609b84bbbb58a0c0b4a8e28101be30b5","observation_id":"cd5b91df-1663-4f94-965d-30d8a69a9d20","resolution":{"observed_at":"2026-05-26T10:07:09.293133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gradient methods for minimizing functionals.Zhurnal vychisli- tel’noi matematiki i matematicheskoi fiziki, 3(4):643–653","venue":null,"work_id":"af378c87-30bc-42db-a1d7-07814222765b","year":1963},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:6c6311536cfb325464aed821be3403745e9cc018e80d3c1a0f38d8d6937a71a3","observation_id":"6ba4f192-d1d7-4886-b33c-637a9f061af9","resolution":{"observed_at":"2026-05-26T10:07:09.226811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0aa9c39a-940d-4266-ab78-ae8e82909468","year":2010},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:08c2abfd74f81cc97e7561a35f857c1fa176a54f11ffaf70680502af42add710","observation_id":"daa95a70-3185-4f3f-ae5e-c9837b418e53","resolution":{"observed_at":"2026-05-26T10:07:09.296800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2401.08463","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Statistical inference for pairwise comparison mod- els","venue":null,"work_id":"182438a4-8638-47b1-a2ff-7a56918e28ab","year":2025},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:5ef080acc6a3c6366525ba20acbb98f9bed74270d7d4f43d9f484f418808961c","observation_id":"a8848e25-56b2-41c0-a5fb-b1fd761faa2f","resolution":{"observed_at":"2026-05-11T18:16:09.531103Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A limited memory algorithm for bound constrained optimization.SIAM Journal on scientific computing, 16(5):1190–1208","venue":null,"work_id":"a5782cbc-0bb1-4438-b35a-ce664c74ebf8","year":1995},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:dc511a0b42c2d2c528a981dade63db2b42f6870cb071a9448f6fcecd1d8f919e","observation_id":"74bbea56-1164-400d-b91f-64dd3abc8369","resolution":{"observed_at":"2026-05-26T10:07:09.233975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"o” and “O","venue":null,"work_id":"2c00dae2-7932-4dba-8e06-c15a908935d0","year":1972},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:6d04cc004730fce93477a8cc3d1af169e4f9c795cde7f6bd17656317df340609","observation_id":"93c470de-55d3-4055-9226-5bb2d52ea1b7","resolution":{"observed_at":"2026-05-26T10:07:09.230297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"de37a703-c055-4bf0-9ed2-7e4505f81dae","year":null},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:e670a16a5f5c8f8a357b24f68e78f698216621caf891d5e6eeccf56fa86c32d5","observation_id":"78df1925-b560-47e4-848a-16705f7be42f","resolution":{"observed_at":"2026-05-26T10:07:09.237350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Part II: Local sequence convergence.Suppose further that Assumptions A2 and A3 concerning the basin hold","venue":null,"work_id":"36937aa1-36c0-4f23-9a87-57d9079dd736","year":null},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:8f711d0c5118715635e78d1506d4f8f96850213f4c0b58196ae83f66a2f0be6b","observation_id":"369210c9-c088-41da-83f1-2faf9fe4260e","resolution":{"observed_at":"2026-05-26T10:07:09.215785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3f26090a-4911-44f8-b7d6-651857b3424c","year":null},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:ad0825f8df09ba589f7762ca9b117ead0924cbd37ada4007d42223a1479a951d","observation_id":"29765db5-96f8-489e-a892-ca625943d0b7","resolution":{"observed_at":"2026-05-26T10:07:09.219027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5f35468d-46b9-4603-8fa8-68e5ad28c6d3","year":null},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:c547003555bb408df1b5e46916a07bc527c589e5c292b00dea2c5d4da1a116fc","observation_id":"bc265e90-4b89-473b-83d4-8d60be8137ef","resolution":{"observed_at":"2026-05-26T10:07:09.212338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5ed56063-a1d1-420e-9435-da7e079481a5","year":null},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:26fb7b41da6d2567b88ea336a0af5c0d6ebb0886c64c99908d3ae4b392748710","observation_id":"57ec3858-89d4-4098-9a40-5bfe80391682","resolution":{"observed_at":"2026-05-26T10:07:09.209155Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unstructured BTL + SVD","venue":null,"work_id":"ff848d1a-04bd-4085-a2bf-efe4b60494d0","year":2000},"citing_paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T16:24:02.947458Z"},"links":{"citing_paper":"/paper/2605.05073"},"observation_digest":"sha256:2e0597de2e79a4a82fbca3f1b05228eb950c534ac061d89522ff90d3bc863889","observation_id":"4ada6842-4566-4209-9427-a496eb0d421d","resolution":{"observed_at":"2026-05-26T10:07:09.205432Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.05073","last_updated":"2026-05-07T02:46:46Z","latest_version":2,"primary_category":"stat.ME","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:09:55Z","title":"Heterogeneous Judge-Aware Ranking with Sensitivity, Disagreement, and Confidence"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":3,"verified_fuzzy":33},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2605.05073."}