{"as_of":"2026-08-15T18:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:41f5f2e2fd8683243276d0ece73c9939f8374d2bf60665f34b6f9d592572c5b1","coverage":[{"denominator":127,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:26:07.196148Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T08:40:40.910461Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T08:40:41.645465Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"cited_work":{"arxiv_id":"2502.02988","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02988","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Train- ing an llm-as-a-judge model: Pipeline, insights, and practical lessons","venue":null,"work_id":"b6522c86-4f7f-40b4-8b5c-67d8f5a32e18","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":279,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2502.02988","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:cd835c38a76ca26bc707eb382240f22bcd4d77b54362a01395f4f100ce459024","observation_id":"bf223e65-e5a7-4420-ac2d-3453d7ca8f34","resolution":{"observed_at":"2026-05-12T08:40:41.647942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02988/citation-record","integrity":"/paper/2502.02988/integrity","json":"/paper/2502.02988/citation-record.json","paper":"/paper/2502.02988"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.817210Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.817210Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e08138b67855198ef684db383f4146ff974b4d69711fdf01b37d47e728580ab7","observation_id":"be3d46be-6a4b-4285-9b6a-01e813ce598f","resolution":{"observed_at":"2026-08-09T10:26:06.817210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-09T10:26:06.822426Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.822426Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:4532f0a10313211dd2c8fef9bce4701df4b19b41267b0d2d87e68fe69b925259","observation_id":"6b1f7a9a-3c21-478d-9009-a9fc405a9a4d","resolution":{"observed_at":"2026-08-09T10:26:06.822426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.827012Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.827012Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:91ceb7f7582f6c190adc39e6e1cec29916b43f78578a8c9be4a8bcecb7fc833b","observation_id":"0b5bcc2c-6a9c-466c-8c08-0f47f57d34b4","resolution":{"observed_at":"2026-08-09T10:26:06.827012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12744","last_updated":"2024-05-10T06:09:02Z","snapshot_observed_at":"2026-08-15T01:19:42.088342Z","submitted_at":"2024-04-19T09:44:51Z","title":"Beyond Human Norms: Unveiling Unique Values of Large Language Models through Interdisciplinary Approaches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12744","snapshot_observed_at":"2026-08-09T10:26:06.830821Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.830821Z"},"links":{"cited_paper":"/paper/2404.12744","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:85ddb848d93e33a68f54044cc32d9e6877256100cb6bc89975847a51273fdfdf","observation_id":"b66b2701-1539-4dfd-b7cd-d72ca486d915","resolution":{"observed_at":"2026-08-09T10:26:06.830821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06644","last_updated":"2024-03-11T12:07:13Z","snapshot_observed_at":"2026-08-14T08:50:44.849271Z","submitted_at":"2024-03-11T12:07:13Z","title":"Elephants Never Forget: Testing Language Models for Memorization of Tabular Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06644","snapshot_observed_at":"2026-08-09T10:26:06.835116Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.835116Z"},"links":{"cited_paper":"/paper/2403.06644","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:8d0c4d205aa81f9fd9055aef0eaba8d5838171ab0f831b246412d83f2a340880","observation_id":"d31a6332-3d1c-43d1-bcbd-14e14b2cf2eb","resolution":{"observed_at":"2026-08-09T10:26:06.835116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11813","last_updated":"2024-11-12T16:38:37Z","snapshot_observed_at":"2026-08-13T00:17:06.843658Z","submitted_at":"2024-06-17T17:54:40Z","title":"How Do Large Language Models Acquire Factual Knowledge During Pretraining?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11813","snapshot_observed_at":"2026-08-09T10:26:06.839189Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.839189Z"},"links":{"cited_paper":"/paper/2406.11813","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:1610ba714f1784550283dda301b82aa774f706d3e8cb6c8be75ce1dfb0305197","observation_id":"0defba75-5860-4040-ab04-8de92acdfea3","resolution":{"observed_at":"2026-08-09T10:26:06.839189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T10:26:06.843560Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.843560Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:0b00901a3c0a1477b0cef2e69ab73e3e50ac0f1ab91ca3ec3ca3442deeeb630a","observation_id":"c48d21eb-34f5-4bb6-94fd-b0728f4f44e9","resolution":{"observed_at":"2026-08-09T10:26:06.843560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04132","last_updated":"2024-03-07T01:22:38Z","snapshot_observed_at":"2026-08-02T17:55:33.750637Z","submitted_at":"2024-03-07T01:22:38Z","title":"Chatbot Arena: An Open Platform for Evaluating LLMs by Human Preference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04132","snapshot_observed_at":"2026-08-09T10:26:06.848171Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.848171Z"},"links":{"cited_paper":"/paper/2403.04132","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:c3f8d574411dc173aa72e159e6e4e238f0a6e046951dd6a97e8d5ae096a3ca2f","observation_id":"a37e6233-d4a7-427f-b753-92dc686d0203","resolution":{"observed_at":"2026-08-09T10:26:06.848171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05492","last_updated":"2024-06-07T15:51:08Z","snapshot_observed_at":"2026-08-13T05:54:09.385656Z","submitted_at":"2023-10-09T07:56:16Z","title":"How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05492","snapshot_observed_at":"2026-08-09T10:26:06.852425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.852425Z"},"links":{"cited_paper":"/paper/2310.05492","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:7e236af9d244c2f68a6fe67ee4f08b52f9ae4b878efe854e830563ed88c86830","observation_id":"e8c9c9a1-1af3-4aec-bfe5-f8f37b16949f","resolution":{"observed_at":"2026-08-09T10:26:06.852425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00811","last_updated":"2024-10-03T21:07:09Z","snapshot_observed_at":"2026-08-14T09:24:30.475037Z","submitted_at":"2024-02-25T02:35:56Z","title":"Cognitive Bias in Decision-Making with LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00811","snapshot_observed_at":"2026-08-09T10:26:06.856504Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.856504Z"},"links":{"cited_paper":"/paper/2403.00811","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:684c01baf5fa45696a3ffa3174775c7771048ce9debb8b94df7621049a164ece","observation_id":"9b4f2c8c-b709-419b-9656-9261b93f2d2c","resolution":{"observed_at":"2026-08-09T10:26:06.856504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.860248Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.860248Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:28169c696a44e2c79d57d7f85c4a83b40b65607201dc7368a4e1e50ffc4dca6f","observation_id":"7f72c403-5571-4b72-b6e3-e6d91972face","resolution":{"observed_at":"2026-08-09T10:26:06.860248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-09T10:26:06.864124Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.864124Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:6abc38653357606e7c13ceb0cef6d68a54de72dff686698265fc2d105321e6b9","observation_id":"add0e4ed-2a60-43b2-b9bf-7a7b564570ae","resolution":{"observed_at":"2026-08-09T10:26:06.864124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.868011Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.868011Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e3ee7753c9073524973169c435711f1a97e8d79ea3784e8f88d2559bf3809223","observation_id":"caf00782-7f33-4abf-add2-4970e7ff18d6","resolution":{"observed_at":"2026-08-09T10:26:06.868011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08322","last_updated":"2023-11-06T13:24:16Z","snapshot_observed_at":"2026-08-13T11:42:53.314611Z","submitted_at":"2023-05-15T03:20:19Z","title":"C-Eval: A Multi-Level Multi-Discipline Chinese Evaluation Suite for Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08322","snapshot_observed_at":"2026-08-09T10:26:06.871799Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.871799Z"},"links":{"cited_paper":"/paper/2305.08322","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:d56a158cf97b877dc7faa09a182ef44c368a1becdfc93f50dd637db779b96836","observation_id":"3cc9abd6-4204-43ca-ae8e-4404f0b0c694","resolution":{"observed_at":"2026-08-09T10:26:06.871799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.875671Z","title":"Mercer, Lalit R","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.875671Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:d2001c8b29e12610725ef9f81349bc30b6fa26072a48baaa8e039db05de76f24","observation_id":"e6552762-4a13-4086-900c-10e6e65bf5f6","resolution":{"observed_at":"2026-08-09T10:26:06.875671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14230","last_updated":"2025-06-11T07:47:45Z","snapshot_observed_at":"2026-08-12T23:38:28.168630Z","submitted_at":"2024-06-20T11:51:00Z","title":"Raising the Bar: Investigating the Values of Large Language Models via Generative Evolving Testing","version":5},"cited_work":{"arxiv_id":"2406.14230","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.14230","snapshot_observed_at":"2026-08-09T10:26:07.554906Z","title":"Raising the Bar: Investigating the Values of Large Language Models via Generative Evolving Testing","venue":"cs.CL","work_id":"a6afa6c7-85bf-4580-a57c-e992766312ed","year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.879399Z"},"links":{"cited_paper":"/paper/2406.14230","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:a6b5f213fc617b1a24bf482fc9e173553bda2de285781f4a666b46db1b5b6281","observation_id":"12331cd9-c807-45ff-a61d-642d9d7c5173","resolution":{"observed_at":"2026-08-09T10:26:07.561014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07574","last_updated":"2022-07-12T17:48:46Z","snapshot_observed_at":"2026-08-13T17:53:01.670751Z","submitted_at":"2021-10-14T17:38:12Z","title":"Can Machines Learn Morality? The Delphi Experiment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07574","snapshot_observed_at":"2026-08-09T10:26:06.883680Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.883680Z"},"links":{"cited_paper":"/paper/2110.07574","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:ac6d5e0cc23fc1ab77d119e31ccff1a2b3f7d61f70e86c3c31713b009e28b8f5","observation_id":"8e46a871-a14d-4854-aadb-9229148a2492","resolution":{"observed_at":"2026-08-09T10:26:06.883680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.887711Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.887711Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:9f6300067f74c432ee488a5d8abe3a1573faf3b501fb04aa0afa5786406aec88","observation_id":"b509fb7f-c652-42f9-acda-d1d976c1a974","resolution":{"observed_at":"2026-08-09T10:26:06.887711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.895858Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.895858Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:2d42b2af1052ba8af97aa7452b6ac4f3b6fb32e1fcbdcf90fc419383ea8108b2","observation_id":"f440211e-204c-4471-9d45-923ec4e592b1","resolution":{"observed_at":"2026-08-09T10:26:06.895858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.899646Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.899646Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:95c7be30bfb08af12baa6f7c95988cbac13ce808313bedfdd4f7e4b1c9c0f795","observation_id":"34399e51-cd30-47a2-aa20-dc9673f26f45","resolution":{"observed_at":"2026-08-09T10:26:06.899646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12032","last_updated":"2024-04-06T03:52:04Z","snapshot_observed_at":"2026-08-13T22:13:22.197575Z","submitted_at":"2023-08-23T09:45:29Z","title":"From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12032","snapshot_observed_at":"2026-08-09T10:26:06.907720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.907720Z"},"links":{"cited_paper":"/paper/2308.12032","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:51c12e563de05e9b3dca52304edc0322523f218d8ebd128432808ace6d83c222","observation_id":"08e40cce-7785-46dc-a878-6922821ff89f","resolution":{"observed_at":"2026-08-09T10:26:06.907720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-11T09:34:38.920981Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-09T10:26:06.912272Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.912272Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:f2f893e63c3d95f5421a0cc561874485674cb79977cf1460152f179410db0b87","observation_id":"dc0bf80f-caa7-488a-8b38-6a5a8127e90f","resolution":{"observed_at":"2026-08-09T10:26:06.912272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.916238Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.916238Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:02008f118710653d5fa7e0f6dbdd510535e3d399e48d58122f2e97b7e116459b","observation_id":"f547d0bd-4731-4c1f-a920-f54ef4010caa","resolution":{"observed_at":"2026-08-09T10:26:06.916238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.924394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.924394Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:a58d98534a1f2a569d6f10623f576972df1c89e97f96140ee7e53aba08cab459","observation_id":"6fd91538-2c06-44c8-93b7-3ce0d42b24ed","resolution":{"observed_at":"2026-08-09T10:26:06.924394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.927917Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.927917Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:fb3462f5b729c8b13d6f9ebac97260fa2d7350ef791ca3f7834a5879a4a901d0","observation_id":"a6ce5c1b-10e3-4142-891d-a6383c32c97c","resolution":{"observed_at":"2026-08-09T10:26:06.927917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04770","last_updated":"2024-10-05T22:39:51Z","snapshot_observed_at":"2026-08-12T23:48:02.751889Z","submitted_at":"2024-06-07T09:15:44Z","title":"WildBench: Benchmarking LLMs with Challenging Tasks from Real Users in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04770","snapshot_observed_at":"2026-08-09T10:26:06.920314Z","title":"arXiv:2406.04770 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.920314Z"},"links":{"cited_paper":"/paper/2406.04770","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:b4cc4cd3902260fd2fc095b34ab550acad3a7706bf15c358d6c5e2421b217be9","observation_id":"4cb36887-c76c-494b-9193-9c12d2543941","resolution":{"observed_at":"2026-08-09T10:26:06.920314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08700","last_updated":"2024-10-02T07:26:40Z","snapshot_observed_at":"2026-08-14T13:25:45.645023Z","submitted_at":"2024-04-10T18:08:59Z","title":"DyKnow: Dynamically Verifying Time-Sensitive Factual Knowledge in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08700","snapshot_observed_at":"2026-08-09T10:26:06.935195Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.935195Z"},"links":{"cited_paper":"/paper/2404.08700","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:646af1177c55fe137ca67cbc0a0546c1ca9b073419ee750bcece908a0712b9c0","observation_id":"02f74949-ed50-4efe-824d-4ee66f82934a","resolution":{"observed_at":"2026-08-09T10:26:06.935195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02707","last_updated":"2023-06-05T08:58:39Z","snapshot_observed_at":"2026-08-09T03:29:22.849759Z","submitted_at":"2023-06-05T08:58:39Z","title":"Orca: Progressive Learning from Complex Explanation Traces of GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02707","snapshot_observed_at":"2026-08-09T10:26:06.938927Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.938927Z"},"links":{"cited_paper":"/paper/2306.02707","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:aa6af5a130b7df4955c648911e6b3787dade7d9e5e1fc9975d0ced6da0eca954","observation_id":"ddc85e57-5157-4936-8c1c-80fdb85602a4","resolution":{"observed_at":"2026-08-09T10:26:06.938927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18743","last_updated":"2024-08-25T09:58:57Z","snapshot_observed_at":"2026-08-13T05:13:04.857556Z","submitted_at":"2023-11-30T17:41:30Z","title":"AlignBench: Benchmarking Chinese Alignment of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18743","snapshot_observed_at":"2026-08-09T10:26:06.931661Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.931661Z"},"links":{"cited_paper":"/paper/2311.18743","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:f5ffe40f0938879b4bf802fa9a853ff5300c7576051bb3124ea7c0c47607ffbb","observation_id":"2effc0c7-cc26-48f1-b2bd-3739b840c7f0","resolution":{"observed_at":"2026-08-09T10:26:06.931661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-09T10:26:06.946505Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.946505Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:0c2d14372e21597c11e169fec6f949542acaf9cc323b570ebf9b43f502fc3d24","observation_id":"4f33ea1a-0123-4c43-b8ac-85cd8ad5d979","resolution":{"observed_at":"2026-08-09T10:26:06.946505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05934","last_updated":"2024-01-30T11:58:10Z","snapshot_observed_at":"2026-08-14T02:11:00.839407Z","submitted_at":"2023-12-10T16:52:00Z","title":"Fine-Tuning or Retrieval? Comparing Knowledge Injection in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05934","snapshot_observed_at":"2026-08-09T10:26:06.950598Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.950598Z"},"links":{"cited_paper":"/paper/2312.05934","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:11bd3a65fcb2b7e1e6b7104eec6567ef3fc2d80ae7e5cacd0ca7f6205fe5edfc","observation_id":"86187629-cb05-4a5d-8900-6c9978297955","resolution":{"observed_at":"2026-08-09T10:26:06.950598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T10:26:06.942790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.942790Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:936462f493042f046305c775e06ec027c33b180a42e875a4c68b3aa6519be866","observation_id":"5e99fb3d-655f-45eb-89af-5a4f17be4c4d","resolution":{"observed_at":"2026-08-09T10:26:06.942790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.957794Z","title":"Peng, Xi Yang, Aokun Chen, Kaleb E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.957794Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:8fb0df84a6d0f8f7e141dcd25019d117447f7391a766ce79b91adb11b9e1decd","observation_id":"8017578b-3cd1-40d4-bf43-65a3ce7a8fca","resolution":{"observed_at":"2026-08-09T10:26:06.957794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.961369Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.961369Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e7b4e8ad4c67031d15245e804849fd200b61a4bdfbcbe57958fd0e51df4b6859","observation_id":"a806afed-7b33-49fc-ae43-0d72fcf3fdcb","resolution":{"observed_at":"2026-08-09T10:26:06.961369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.954234Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.954234Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:233654c4a6705217df53d0b8b32ce475449bbed91c4511a670f504655cfbe55e","observation_id":"e882d754-624c-4928-8ab1-7c6b44fb55f9","resolution":{"observed_at":"2026-08-09T10:26:06.954234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.968348Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.968348Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:78dd14bc65a7eccecc0c648f1c33c6a0a1d35b1ae47bbf98e2b8ef1efde64f9a","observation_id":"dd2e88cc-510f-4582-9440-f23a7b92435e","resolution":{"observed_at":"2026-08-09T10:26:06.968348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.971926Z","title":"Link, Roxana Daneshjou, and Nicolás W Cortés- Penfield","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.971926Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:015aa745ef7e20f78a95db32c07e176f44f8e18e8ad780aea4cae12b68617d8e","observation_id":"e1f4fd36-d6c1-444d-942d-401a9c7b59b1","resolution":{"observed_at":"2026-08-09T10:26:06.971926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.964892Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.964892Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:103ef84419ecdabb498d54f0f96137d3d7d1a8ced38753f09cf22ed583702d11","observation_id":"67d14a92-6227-4e27-a194-ba2ce7f69ad5","resolution":{"observed_at":"2026-08-09T10:26:06.964892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05561","snapshot_observed_at":"2026-08-09T10:26:06.983198Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.983198Z"},"links":{"cited_paper":"/paper/2401.05561","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:7970ba8e3d52cb4e8b5efad435bbc6153fa54d632492b4f0f410b89504912ea3","observation_id":"b447b56b-f7eb-43c7-9f15-7e07cc42e8c8","resolution":{"observed_at":"2026-08-09T10:26:06.983198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.986899Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.986899Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:822a73570d8c9dfcca4dd524d54e371c69c07daa713465a07dae11efae3099d9","observation_id":"ba93b126-4dc7-4203-ad72-4e7c3eb6e680","resolution":{"observed_at":"2026-08-09T10:26:06.986899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.975429Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.975429Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:afa297683fd8bd46807a0c8936abc562fafbe0c4279c82aa87eca1ca848b2621","observation_id":"94dd0f13-a279-420c-9074-382b70b94005","resolution":{"observed_at":"2026-08-09T10:26:06.975429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14526","last_updated":"2024-06-03T06:48:34Z","snapshot_observed_at":"2026-08-13T16:44:54.218846Z","submitted_at":"2024-02-22T13:20:53Z","title":"Balanced Data Sampling for Language Model Training with Clustering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14526","snapshot_observed_at":"2026-08-09T10:26:06.979516Z","title":"arXiv:2402.14526 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.979516Z"},"links":{"cited_paper":"/paper/2402.14526","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:141bba64d3d56fa7a98d1cf2220b89a00ba7540cc5415c4d2a776bfbd5def327","observation_id":"449c8f6a-fd07-4389-968e-0a2d2e54d28b","resolution":{"observed_at":"2026-08-09T10:26:06.979516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10817","last_updated":"2024-07-15T15:33:45Z","snapshot_observed_at":"2026-08-12T23:21:55.244752Z","submitted_at":"2024-07-15T15:33:45Z","title":"Foundational Autoraters: Taming Large Language Models for Better Automatic Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10817","snapshot_observed_at":"2026-08-09T10:26:06.997800Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.997800Z"},"links":{"cited_paper":"/paper/2407.10817","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:973211d2578fb1f44e12599b864b532619755f509f5678087a1948789b880cb1","observation_id":"af6ecb3f-2016-40f0-95d1-db9311c2b413","resolution":{"observed_at":"2026-08-09T10:26:06.997800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-08-15T15:06:42.719366Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-09T10:26:07.001623Z","title":"Smith, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.001623Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:4ebb34db5c2217775d74f55fb232e4519c82dcaafb4910b33a857d0a894018ba","observation_id":"ebeebc30-5e2c-46d2-a248-aaab702056d3","resolution":{"observed_at":"2026-08-09T10:26:07.001623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-09T10:26:06.990380Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.990380Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:12be082c5c5aebda56773bdb624d38f8bfbc979569a9932a8c41c279ba9c653c","observation_id":"31178b6e-4d8f-4ba0-81a9-7f7a7ba630f5","resolution":{"observed_at":"2026-08-09T10:26:06.990380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-09T10:26:06.994040Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.994040Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:7145ef7a1e961e689a149b14c9c3e8f3ce6a98b6c8d2fcf52c6cce5a7100fd34","observation_id":"d5fa3378-1e24-4054-88d6-b8547c91307e","resolution":{"observed_at":"2026-08-09T10:26:06.994040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.017644Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.017644Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:edbbb3ded6ac6b8d259ba70b636047417efe74c0dd4ece00579b3b9d2a6849fe","observation_id":"41883e9e-f47e-41de-8fe4-7089df947271","resolution":{"observed_at":"2026-08-09T10:26:07.017644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.025199Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.025199Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:3c2f801c2402a90b21a253f40f77e19bea7aae70adbeb56504f2dbb7c2f5c900","observation_id":"afc84953-b666-4491-a485-dd8475913de0","resolution":{"observed_at":"2026-08-09T10:26:07.025199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.005480Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.005480Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:fdc3af82babc2a9b3393c46d7e4a4ee3e445cdb0530c2da6b50fa6f4afc0a184","observation_id":"736eabad-522a-4488-8b12-0f99501b77ef","resolution":{"observed_at":"2026-08-09T10:26:07.005480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.009288Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.009288Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:0e13d63fc0a2b7f4eb8c1a8ee8814e78d7d9703d6b10def2406cf5b4a56d371b","observation_id":"dcdb9dd1-b7da-4657-910f-2a062a02b86d","resolution":{"observed_at":"2026-08-09T10:26:07.009288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07384","last_updated":"2024-12-05T18:47:47Z","snapshot_observed_at":"2026-08-15T11:23:57.029266Z","submitted_at":"2024-03-12T07:45:33Z","title":"SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07384","snapshot_observed_at":"2026-08-09T10:26:07.012786Z","title":"arXiv:2403.07384 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.012786Z"},"links":{"cited_paper":"/paper/2403.07384","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:4c0e650b91341d8a69369d53fdaa5b08418b0d133da4943fec3beb48ae5d311a","observation_id":"3cdad77c-5806-4c65-a766-405eb59b9d5f","resolution":{"observed_at":"2026-08-09T10:26:07.012786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06364","last_updated":"2023-09-18T14:23:02Z","snapshot_observed_at":"2026-08-07T12:51:50.861720Z","submitted_at":"2023-04-13T09:39:30Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06364","snapshot_observed_at":"2026-08-09T10:26:07.043089Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.043089Z"},"links":{"cited_paper":"/paper/2304.06364","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:3816dc9441f87188e3ac0d0d400c74da05ccab8950a49e28bda0fb9b8e9acb9e","observation_id":"daa1fa42-6884-49d6-8aee-e3ace2c9d895","resolution":{"observed_at":"2026-08-09T10:26:07.043089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16952","last_updated":"2025-03-20T03:31:27Z","snapshot_observed_at":"2026-08-13T15:22:13.497826Z","submitted_at":"2024-03-25T17:14:00Z","title":"Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16952","snapshot_observed_at":"2026-08-09T10:26:07.021278Z","title":"arXiv:2403.16952 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.021278Z"},"links":{"cited_paper":"/paper/2403.16952","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:60a03cb6edc98a94ac9721b72c1e63ed5dcf348b3ad76e9759187f80e8897e9b","observation_id":"740895cd-dda9-4473-8fc9-dbb30f9541cd","resolution":{"observed_at":"2026-08-09T10:26:07.021278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.028606Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.028606Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:f3bb37e668cd80fb807ce6b21e82d6ac2bca8d880eb01e6099df43d72ebb4870","observation_id":"2a8e2467-5cb0-4dd7-b4cb-eaa0a4abcbc9","resolution":{"observed_at":"2026-08-09T10:26:07.028606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12491","last_updated":"2024-01-23T05:19:47Z","snapshot_observed_at":"2026-08-13T04:37:15.001588Z","submitted_at":"2024-01-23T05:19:47Z","title":"Assessing and Understanding Creativity in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12491","snapshot_observed_at":"2026-08-09T10:26:07.032116Z","title":"arXiv:2401.12491 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.032116Z"},"links":{"cited_paper":"/paper/2401.12491","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:3fa7d203f3839a9d33ad6d75d6b7e9f05093838e6edff50f056a093e1e20494c","observation_id":"dc33ccdc-86ba-45bc-8512-66a8af32cd4b","resolution":{"observed_at":"2026-08-09T10:26:07.032116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11998","last_updated":"2024-03-10T19:34:57Z","snapshot_observed_at":"2026-08-13T10:08:28.290453Z","submitted_at":"2023-09-21T12:13:55Z","title":"LMSYS-Chat-1M: A Large-Scale Real-World LLM Conversation Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11998","snapshot_observed_at":"2026-08-09T10:26:07.035838Z","title":"Xing, Joseph E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.035838Z"},"links":{"cited_paper":"/paper/2309.11998","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:b050cc8597a081fbb473a8a6db797dd3d30f347ce1eef7fbdb04f79c3938b59a","observation_id":"e2406660-7881-4991-b79e-1e8687a5bc08","resolution":{"observed_at":"2026-08-09T10:26:07.035838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.039751Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.039751Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:8ce2fbfda701369fe311e1033a023808e497fa394dc719ab5a0a54e416920df2","observation_id":"079248f0-27bb-4433-8901-4b813b7bc10b","resolution":{"observed_at":"2026-08-09T10:26:07.039751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01964","last_updated":"2023-11-03T14:59:54Z","snapshot_observed_at":"2026-08-15T06:36:12.799269Z","submitted_at":"2023-11-03T14:59:54Z","title":"Don't Make Your LLM an Evaluation Benchmark Cheater","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01964","snapshot_observed_at":"2026-08-09T10:26:07.046518Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.046518Z"},"links":{"cited_paper":"/paper/2311.01964","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:70ddafdcfa2976d4cc4af2c0443790fe759bfbe7455d162b00428a8cb4f6b2c9","observation_id":"baffcdb0-75e8-4e3c-ba63-4cef2ebc7c87","resolution":{"observed_at":"2026-08-09T10:26:07.046518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.050876Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.050876Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e3444629ae372cf849b73abd6aa6118d99285a8ffd32a00b4468fe8e9143564b","observation_id":"474f3143-8449-4e7d-9abe-4fe56a3cbb6c","resolution":{"observed_at":"2026-08-09T10:26:07.050876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.054391Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.054391Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:ec5631cba67fcdbea2660e5de010a0def4718e084a203be72f0ff7a45a037065","observation_id":"1385e0d1-96c9-44b5-a532-e660174ecd53","resolution":{"observed_at":"2026-08-09T10:26:07.054391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.058052Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.058052Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:40503699f90396feda9773c2db342325105ae438e89ca5248082bc9ee1f36d74","observation_id":"a081cb06-f31d-42f6-9232-6a20dc5d78ef","resolution":{"observed_at":"2026-08-09T10:26:07.058052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.061558Z","title":"3.Instruction compli- ance: The output should strictly follow the specific requirements of the instructions, including action steps and any constraints","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.061558Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:60f48a7e031a38be9c30676af444b18f9163f7d439a3a0eb2b66b9133ea53c96","observation_id":"e452ce85-2756-4dbe-b226-2ac1e1256bf9","resolution":{"observed_at":"2026-08-09T10:26:07.061558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.064933Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.064933Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:683764460c5ad50a1b0bf5a5b696036eee1dfa4952edc322ef681c5331da752f","observation_id":"2e46225c-6049-4568-817d-57d5cd8cd8b7","resolution":{"observed_at":"2026-08-09T10:26:07.064933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.068681Z","title":"(9) Role-playing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.068681Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:185fdb7c4900ef563fdb53f06bdcd56e06ef2e85dcc53df1d4df37b05aafbc5a","observation_id":"8578f05c-7e30-4006-b069-2e162d1d0981","resolution":{"observed_at":"2026-08-09T10:26:07.068681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.072732Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.072732Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:253c50e20cce1ac176e7ddb580346239243088ab0ff9d97f66588907114a4ba1","observation_id":"741285a0-f600-4d92-87e2-f91d2a239ee0","resolution":{"observed_at":"2026-08-09T10:26:07.072732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.076622Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.076622Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:47e96a5f1cc83d6821e390e057cd0ac24e9e0bf6f1aee2c1bef9e63e0e0ea600","observation_id":"6d9a6233-5b67-4724-899a-3605d6de5f27","resolution":{"observed_at":"2026-08-09T10:26:07.076622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.080525Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.080525Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:39408064c5714b8576231da5fb98a8697e7fc16bb9a550001d671b22c0011973","observation_id":"158abd19-0ce3-40c9-b338-1e83da2ebcd4","resolution":{"observed_at":"2026-08-09T10:26:07.080525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.084242Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.084242Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:207adb3fd5a45e6909d9be7d58ecf6f449cb3c3149b45d0874e0cbaa767a07ba","observation_id":"dcc2aaa7-b9d5-4889-8098-81240d8e567e","resolution":{"observed_at":"2026-08-09T10:26:07.084242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.087822Z","title":"The same output requirement and format as in Table 1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.087822Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:ad07b99919470c82f0315d1ee511852eb136716fd6ba8bf340abd16a75b42722","observation_id":"35f1365f-ad6e-4aa5-bd0f-1b4ca5d1449f","resolution":{"observed_at":"2026-08-09T10:26:07.087822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.091650Z","title":"Requirements for the scenario: Name: {scenario name } Definition: {scenario description } Reference Text: {reference text } Requirements:","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.091650Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:0828ccf1ee578199e3aba3612a21dbe42ba67c7691737394a6bc514710e66209","observation_id":"b51ba750-e9c9-4142-be8f-f013df2dd02f","resolution":{"observed_at":"2026-08-09T10:26:07.091650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.095181Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.095181Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:14a7243024bd1f8d275f2c8169364519e35597e3a9cddd0cf989d9cac717894c","observation_id":"82af8738-c8e6-4739-a06e-fb9b18e8edb6","resolution":{"observed_at":"2026-08-09T10:26:07.095181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.099401Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.099401Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:f7f71b5b791372073beb3181d1a75f183b3441b6ebf9a13d8da88e488d6069b7","observation_id":"578cf78f-f429-43c2-9a05-ba66a0076001","resolution":{"observed_at":"2026-08-09T10:26:07.099401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.103621Z","title":"Sorry, this article does not contain enough information related to {scenario name } to generate relevant questions and answers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.103621Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:1fe75731d1c7319cb58948d6469ed2b22e76a7d5c1c0d3d528ae2cf4da11acf5","observation_id":"d6fd51ea-6759-4f9c-b3a6-83a42bbb3aa3","resolution":{"observed_at":"2026-08-09T10:26:07.103621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.107062Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.107062Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:d8e13520b88c31af3e05a2bae55d8d5fb923052c28188410cd013f173926bde2","observation_id":"41963ea3-372d-48d4-a8c9-70b3ad72f2ea","resolution":{"observed_at":"2026-08-09T10:26:07.107062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.110270Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.110270Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:2a7df521d024d3ef259af01f91245167c97d34f0b1bb3154b95e47b297329424","observation_id":"27935d7d-3675-4a21-9ae0-52f3815b7045","resolution":{"observed_at":"2026-08-09T10:26:07.110270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.113484Z","title":"question","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.113484Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:975df193b23c5ed8a516f763e9c5c1f5e4a06166da4d49cf1732dac8b557655d","observation_id":"42f63cfa-5dd8-4e39-91e2-a427376ebdb1","resolution":{"observed_at":"2026-08-09T10:26:07.113484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.116888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.116888Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:c1ffd1eb65142d05cbb6f0e8698a6b3165867b053c6f59c858dadcae3337ad53","observation_id":"a033202f-2a09-44b6-8d0d-5fcaf05cbf35","resolution":{"observed_at":"2026-08-09T10:26:07.116888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.120376Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.120376Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:1d750c0ffc425e77c5e55ac1fe74ed2d1180bdf37b1df49636151f15808d3f7f","observation_id":"da25a752-bb6c-40f8-acaf-29464a326859","resolution":{"observed_at":"2026-08-09T10:26:07.120376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.123609Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.123609Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:b1f3b4b2ba4b1bdb1e870d2640c5ce823f7cb5e7c0e37ab383bb8ea9c1bb1fb5","observation_id":"b71bebb5-c71d-4127-a373-ddd457bf2a1e","resolution":{"observed_at":"2026-08-09T10:26:07.123609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.127171Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.127171Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:3d9d5f3ab297c1163e34ca5ebc4bb2c74075233965fe7f06e774a84ec902865f","observation_id":"4b9b8cf7-ef28-408b-b5ca-60c90db9940f","resolution":{"observed_at":"2026-08-09T10:26:07.127171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.105846Z","title":null,"venue":null,"work_id":"5591c386-a133-42e9-af24-121abc425a03","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.130463Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:efef89623bb669f1aa0981277a9db81cbddc5cfc5a07cf8837788136eae48f5d","observation_id":"2d0f0a54-ae8e-48c0-ab30-f024d5bb9eb7","resolution":{"observed_at":"2026-08-09T10:26:08.109294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.096188Z","title":null,"venue":null,"work_id":"d76ab787-7f2c-4710-8687-47b7a17f0eb9","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.133915Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:3a9aff12f33ab187948e3a1d7ac98e293f4aa1bffe60a74eeb3d9c695438ccfb","observation_id":"419b57d7-70fc-400e-9868-716ac2a79fcb","resolution":{"observed_at":"2026-08-09T10:26:08.099447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.085766Z","title":null,"venue":null,"work_id":"f963d72a-9b74-4834-92b2-1c315c320cc1","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.137261Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e3fc1f8b2cde9edca52c4370972e66bd9419361f12534822747dfaed93695360","observation_id":"8fba1f61-0ca7-4ffa-bce1-ef08edc05161","resolution":{"observed_at":"2026-08-09T10:26:08.089628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.075889Z","title":null,"venue":null,"work_id":"c621ff20-42bf-4dd9-af29-0b3c9b7e14b0","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.140462Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:cddbe2969bcbdd271b36f7bdd7b55d9d6361ca6dc0f9f165eabc7bf7077ba197","observation_id":"d6f5a985-953c-453f-8a91-64ff1daeb949","resolution":{"observed_at":"2026-08-09T10:26:08.079165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.066261Z","title":null,"venue":null,"work_id":"1bfe148c-b49b-458f-9035-6e80fbe4b942","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.143846Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:9303daac48733f4a017b4c3ecacf9963913b95a4a41959cc9aede1303daf2ff1","observation_id":"5a6415ea-619f-42cc-ad9c-7c47c787752a","resolution":{"observed_at":"2026-08-09T10:26:08.069611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.056146Z","title":"answering mathematical questions","venue":null,"work_id":"5d27adf6-0ee8-4b7f-b58d-420405e71ef9","year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.147208Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:039cce3866393ddfd6c8ca6ef2bbfbb40d53c21cd36c4247a47f417b195e0989","observation_id":"7d92f8d6-27bf-4b39-85eb-919b89c6d79e","resolution":{"observed_at":"2026-08-09T10:26:08.059991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.046847Z","title":null,"venue":null,"work_id":"e5283af6-8528-4cdc-a9e8-dcfed390c4cf","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.150817Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e2d08cc85587bfe100a57bae5eefa67a3385112952ba8016c301300bd0313fba","observation_id":"2f0e63f4-6606-4498-8e80-5be63eda0730","resolution":{"observed_at":"2026-08-09T10:26:08.049961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.037178Z","title":null,"venue":null,"work_id":"383739e0-45eb-497e-bfaa-adead304f097","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.154679Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:2f460f9e5b9989f3337f43564ade9202d7c27a77136f9a23f261f91dbca320e1","observation_id":"bee8ab36-431f-4d95-a01c-d69b02d92d48","resolution":{"observed_at":"2026-08-09T10:26:08.040625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.027796Z","title":null,"venue":null,"work_id":"d8d8a8b1-fe08-4447-9207-c9935c16ed1d","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.158121Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:fa4867288ca10540f7c63fccfcb7274c416366f863167746863f7330baaaa3d0","observation_id":"77247908-1df8-488d-9bca-d5aeaf148899","resolution":{"observed_at":"2026-08-09T10:26:08.030964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.018470Z","title":null,"venue":null,"work_id":"82b16ab7-b461-47fe-b869-35aa0ebee33b","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.161630Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:1900eacbfa94fddcac224f507aff20cd1e31741a4f255ac0bc7d149083bfdae0","observation_id":"ad00961e-cbf8-4957-be63-01bf446f8a09","resolution":{"observed_at":"2026-08-09T10:26:08.021706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.008771Z","title":null,"venue":null,"work_id":"50e0eada-a5e3-4349-937e-26afbca7b4cf","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.165059Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e8255fa3bcce5c1b10a4a0cd3076c4e112e2dd1f72427fac3496c06b71f37871","observation_id":"ba33ef3a-c86e-445a-a03e-f93ddd0c2eea","resolution":{"observed_at":"2026-08-09T10:26:08.011969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.998904Z","title":null,"venue":null,"work_id":"f363d98d-f1c2-47ff-96cc-29acf84fe2b8","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.168408Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:36a0814736f463c97662b003cceb19b28f80e2f97d808ecb6b2330c0f3c0e513","observation_id":"4a783726-0f8b-45b7-997f-45b635ae97d6","resolution":{"observed_at":"2026-08-09T10:26:08.002138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.989195Z","title":"answering mathematical questions","venue":null,"work_id":"e514409e-a695-43be-b4e9-893c40c08949","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.171943Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:5a92dd17175780ce7160aba1939ecf5b9d4795224083a3aeefc582de9bebe5c2","observation_id":"b5e25f44-9539-4884-a32d-ef4e0143c4a9","resolution":{"observed_at":"2026-08-09T10:26:07.992644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.979390Z","title":null,"venue":null,"work_id":"41f55480-0f38-41b8-a8b5-a5c2e1da5faf","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.175557Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:469609ee74a65bca1b301de058fcf510b14d470bcc74180c8b1bd032157c9c37","observation_id":"82c591b6-5a96-46c1-a092-56d85dfb17cc","resolution":{"observed_at":"2026-08-09T10:26:07.982876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.969473Z","title":null,"venue":null,"work_id":"71963a7e-57f3-4a7f-8c37-318854828fe8","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.179032Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:c5ae22824325fdf16323755d73a2cdaaf7cb8af42d6b42f7b8c5b19a23f265a2","observation_id":"6b597b12-3ee6-46d2-846b-c291354a95d4","resolution":{"observed_at":"2026-08-09T10:26:07.973017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.959365Z","title":null,"venue":null,"work_id":"4075b0d8-20c1-419a-b61b-519902bd22ef","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.182542Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:4c6be9e296febaddfcdc95484c43f353cb90614f0c49602dbd2843caea1cba51","observation_id":"d5f4c378-aaa6-404d-a1ff-5b99e76dc791","resolution":{"observed_at":"2026-08-09T10:26:07.962812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.949661Z","title":"Think carefully for a moment, then give your conclusion","venue":null,"work_id":"20c2a26c-2078-476d-86a9-109e888140b0","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.185935Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:9928894582ef77807b40c57a28720318ae5fa139063900ecd8b22651897fce1b","observation_id":"905e1a75-c732-4d9b-b8a0-d610f199af37","resolution":{"observed_at":"2026-08-09T10:26:07.953122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.939373Z","title":null,"venue":null,"work_id":"2f7022a1-5c4b-4005-9460-d3fde28ccef7","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.189312Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:13822f2c656792a87cabdee2e1c86466d1f99fac447112d54b0a59a1c6b73014","observation_id":"a0bf0c0e-4abe-4396-b4e5-128b6049f4b9","resolution":{"observed_at":"2026-08-09T10:26:07.943013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.928601Z","title":"GPT-4’s response I believe the overall rating for this reply is [[1]] for the following reasons: Advantages of the current reply:","venue":null,"work_id":"1683aca0-375f-4cfd-bbb2-23630c3f7147","year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.192887Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:895c8bce23ac3e1df38b529de3f254dabbe5bb5a19ea7adf45c07a4c370de35e","observation_id":"b8cfcbf2-c3c9-4af4-897f-8e72c222cebc","resolution":{"observed_at":"2026-08-09T10:26:07.933203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.917614Z","title":"[[3]] Shortcomings of the current reply:","venue":null,"work_id":"dfb89844-845f-4fc1-b6ef-7c78f2c667d8","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.196148Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:d4f96dc98c52762ee10d182bed621221aba72ff68393a2b5cc34fad39262c0d8","observation_id":"26c1c9bf-8dc7-4568-bb35-c477c232a335","resolution":{"observed_at":"2026-08-09T10:26:07.921431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T03:32:41.177319Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":94,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":127},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 127 outbound references and 1 inbound Pith citation observation for arXiv:2502.02988."}