{"as_of":"2026-08-08T22:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b1f6f801892815922f6b2f44e6d63f80c8ff81f3407d113c77a4b82cb8dc986","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:34:52.667559Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T11:39:47.080762Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":"2408.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-07-04T11:39:47.080762Z","title":"Self-taught evaluators","venue":null,"work_id":"9599e5b4-f4d0-48e3-9cd8-5b366fb2ae20","year":2024},"citing_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"reference_index":162,"source":"pdf_text","source_observed_at":"2026-05-23T17:33:13.394338Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2411.15594"},"observation_digest":"sha256:d80b08bd0bb1b840daece492c8f40b6f09339eabfc40e797362cb52d535ecf95","observation_id":"e284f656-bc61-432e-bee0-b54d8ff14625","resolution":{"observed_at":"2026-05-23T17:35:44.077704Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":"2408.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-07-04T11:39:47.080762Z","title":"Self-taught evaluators","venue":null,"work_id":"9599e5b4-f4d0-48e3-9cd8-5b366fb2ae20","year":2024},"citing_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"reference_index":240,"source":"pdf_text","source_observed_at":"2026-05-11T23:08:34.312466Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2412.05579"},"observation_digest":"sha256:9997aa8f29545744b5b10f1165b901528c05d3e3c5238a69e4f4c10626c44c7b","observation_id":"3a599e2b-4a53-405d-a5ba-9b88dda5f78f","resolution":{"observed_at":"2026-05-11T23:08:35.619226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-07T15:34:52.667559Z","title":"Self-taught evaluators.arXiv preprint arXiv:2408.02666, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14674","last_updated":"2025-05-20T17:58:03Z","snapshot_observed_at":"2026-08-07T23:14:31.982740Z","submitted_at":"2025-05-20T17:58:03Z","title":"Reward Reasoning Model","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:34:52.667559Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2505.14674"},"observation_digest":"sha256:bc12a65a2e6788eb3996704089f182d821b7c1063f79b674663eba532d5074b9","observation_id":"d720deb4-efae-4f39-b636-0d2064001d37","resolution":{"observed_at":"2026-08-07T15:34:52.667559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-07T15:15:41.997675Z","title":"Self-taught evaluators.arXiv preprint arXiv:2408.02666, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15817","last_updated":"2025-06-09T21:22:15Z","snapshot_observed_at":"2026-08-07T23:33:11.410147Z","submitted_at":"2025-05-21T17:59:54Z","title":"Learning to Reason via Mixture-of-Thought for Logical Reasoning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:41.997675Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2505.15817"},"observation_digest":"sha256:3778f0ea4b5d0888624cc9589be2718a9a0902aa534e80830dee582af6ab55fb","observation_id":"f42bd0e0-562c-4f4d-b9c7-f08dab4cba0b","resolution":{"observed_at":"2026-08-07T15:15:41.997675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-07T12:12:36.267450Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00319","last_updated":"2025-05-31T00:08:59Z","snapshot_observed_at":"2026-08-08T05:48:50.179328Z","submitted_at":"2025-05-31T00:08:59Z","title":"SkillVerse : Assessing and Enhancing LLMs with Tree Evaluation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:12:36.267450Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2506.00319"},"observation_digest":"sha256:0959f696d02f31fc87d881e5e39ea353a182acea6aa7d826ed35701bee36f874","observation_id":"2d11fb40-7bb4-40ab-854d-10e171d8a16b","resolution":{"observed_at":"2026-08-07T12:12:36.267450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-07T04:18:38.084976Z","title":"Self-taught evaluators, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.084976Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:f65c36d6ff526f2b5c27a96c6f4346f524e497d8b8072ca1f818073f4eb8bd19","observation_id":"f6fc7ac3-3d55-4304-b3b2-e556f1ec9ee3","resolution":{"observed_at":"2026-08-07T04:18:38.084976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-06T23:49:47.837626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16024","last_updated":"2025-06-19T04:44:34Z","snapshot_observed_at":"2026-08-06T23:42:02.504756Z","submitted_at":"2025-06-19T04:44:34Z","title":"From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:47.837626Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2506.16024"},"observation_digest":"sha256:8ad69d7fe5d58d66823f5f2e8d5571dad482b7f33df3ded6128b96457f180fbb","observation_id":"164df63e-321b-459d-a263-6131ebd555aa","resolution":{"observed_at":"2026-08-06T23:49:47.837626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-06T17:32:33.368009Z","title":"Self-taught evaluators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10535","last_updated":"2025-08-14T17:58:50Z","snapshot_observed_at":"2026-08-06T17:26:10.296563Z","submitted_at":"2025-07-14T17:56:29Z","title":"CodeJudgeBench: Benchmarking LLM-as-a-Judge for Coding Tasks","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:32:33.368009Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2507.10535"},"observation_digest":"sha256:60240337203177071b0255ce1665a38bc01eb8ee70fb7b994f5a42449400530a","observation_id":"ac0be8b9-04c1-4ea2-a14f-64a21bb03f77","resolution":{"observed_at":"2026-08-06T17:32:33.368009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-06T17:03:46.209554Z","title":"Y., Fazel-Zarandi, M., Weston, J., Li, X., ``Self-taught evaluators'', arXiv preprint arXiv:2408.02666, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":145,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:46.209554Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:11479a1b8bbb503d9ad651d7abe5c65e083e12169362bda5e770c6d13f2078dc","observation_id":"2d9e0ca0-a2e4-428f-a9f1-f5eb5f577acd","resolution":{"observed_at":"2026-08-06T17:03:46.209554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-06T13:22:24.899310Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20752","last_updated":"2025-07-28T12:01:59Z","snapshot_observed_at":"2026-08-08T20:43:55.354749Z","submitted_at":"2025-07-28T12:01:59Z","title":"Multilingual Self-Taught Faithfulness Evaluators","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T13:22:24.899310Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2507.20752"},"observation_digest":"sha256:283975203122d4ca1b5170a4fe1b51eb65e13642974048a12b1f04a989faada3","observation_id":"6339ba3e-8db3-49cc-ae12-7296d9190e59","resolution":{"observed_at":"2026-08-06T13:22:24.899310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-05T12:27:27.624059Z","title":"Self-taught evalu- ators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01610","last_updated":"2025-09-01T16:43:48Z","snapshot_observed_at":"2026-08-08T14:14:58.948394Z","submitted_at":"2025-09-01T16:43:48Z","title":"Improving Large Vision and Language Models by Learning from a Panel of Peers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T12:27:27.624059Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2509.01610"},"observation_digest":"sha256:c1c531547c78e863eeef8910512f2d7a93a142fc7c0e22cefbbd579f2a0f566c","observation_id":"13502761-0064-481f-a9ac-e087347d6afa","resolution":{"observed_at":"2026-08-05T12:27:27.624059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":"2408.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-07-04T11:39:47.080762Z","title":"Self-taught evaluators","venue":null,"work_id":"9599e5b4-f4d0-48e3-9cd8-5b366fb2ae20","year":2024},"citing_paper":{"arxiv_id":"2509.23542","last_updated":"2026-04-19T04:59:30Z","snapshot_observed_at":"2026-08-03T18:10:00.237919Z","submitted_at":"2025-09-28T00:43:52Z","title":"On the Shelf Life of Fine-Tuned LLM-Judges: Future-Proofing, Backward-Compatibility, and Question Generalization","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-18T12:53:45.767341Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2509.23542"},"observation_digest":"sha256:e746486d487e2b916c16f23f1611b8a562f72e99d45b388c7faf15d501413f0a","observation_id":"b5f00401-d095-4c5f-86a6-8d031751195e","resolution":{"observed_at":"2026-05-18T12:56:24.630408Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":"2408.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-07-04T11:39:47.080762Z","title":"Self-taught evaluators","venue":null,"work_id":"9599e5b4-f4d0-48e3-9cd8-5b366fb2ae20","year":2024},"citing_paper":{"arxiv_id":"2601.21464","last_updated":"2026-05-07T16:58:04Z","snapshot_observed_at":"2026-07-31T17:41:41.271363Z","submitted_at":"2026-01-29T09:41:14Z","title":"Conversation for Non-verifiable Learning: Self-Evolving LLMs through Meta-Evaluation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T10:04:44.379128Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2601.21464"},"observation_digest":"sha256:0f75b2496b0db9ab9e16c8514d6f6b3668cc6fce8aa9c09d85f80771e5f6d3ad","observation_id":"ef3f7e79-e7b6-4bb2-b2b8-0f13d14ed7a5","resolution":{"observed_at":"2026-05-16T10:07:43.335795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-02T19:56:30.964243Z","title":"Self- taught evaluators.arXiv preprint arXiv:2408.02666, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.00546","last_updated":"2026-07-15T15:03:39Z","snapshot_observed_at":"2026-08-07T07:10:53.274893Z","submitted_at":"2026-02-28T08:49:22Z","title":"Advancing Multimodal Judge Models through a Capability-Oriented Benchmark and MCTS-Driven Data Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T19:56:30.964243Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2603.00546"},"observation_digest":"sha256:aa2db1e41cf98daa28b2c56c27ce8800a9806366920e8e1d7a53415020fe90a6","observation_id":"c956993e-8033-4bb3-b88b-75403199d96d","resolution":{"observed_at":"2026-08-02T19:56:30.964243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":"2408.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-07-04T11:39:47.080762Z","title":"Self-taught evaluators","venue":null,"work_id":"9599e5b4-f4d0-48e3-9cd8-5b366fb2ae20","year":2024},"citing_paper":{"arxiv_id":"2605.01687","last_updated":"2026-05-03T02:55:30Z","snapshot_observed_at":"2026-07-06T23:14:52.417213Z","submitted_at":"2026-05-03T02:55:30Z","title":"MultiBreak: A Scalable and Diverse Multi-turn Jailbreak Benchmark for Evaluating LLM Safety","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-10T16:00:32.413225Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2605.01687"},"observation_digest":"sha256:b37149f66c0a7d4014cb2f3a795b5d6c8bf785495c40dd85252ec2190c04f416","observation_id":"b809b336-e4db-44ff-922c-99944a7e300d","resolution":{"observed_at":"2026-05-11T09:31:01.129656Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":"2408.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-07-04T11:39:47.080762Z","title":"Self-taught evaluators","venue":null,"work_id":"9599e5b4-f4d0-48e3-9cd8-5b366fb2ae20","year":2024},"citing_paper":{"arxiv_id":"2605.04542","last_updated":"2026-05-06T06:42:47Z","snapshot_observed_at":"2026-07-06T23:17:18.486586Z","submitted_at":"2026-05-06T06:42:47Z","title":"Power Distribution Bridges Sampling, Self-Reward RL, and Self-Distillation","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-08T16:53:00.860162Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2605.04542"},"observation_digest":"sha256:087357c781b147dd802880f1effdca9bc690ab23af9a61d97b3ddf32f375c865","observation_id":"a996b724-8eb1-4702-9738-752da9dde08f","resolution":{"observed_at":"2026-05-11T17:56:08.424802Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":"2408.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-07-04T11:39:47.080762Z","title":"Self-taught evaluators","venue":null,"work_id":"9599e5b4-f4d0-48e3-9cd8-5b366fb2ae20","year":2024},"citing_paper":{"arxiv_id":"2606.24004","last_updated":"2026-06-29T07:01:12Z","snapshot_observed_at":"2026-08-02T11:15:29.427964Z","submitted_at":"2026-06-22T23:21:55Z","title":"Towards Spec Learning: Inference-Time Alignment from Preference Pairs","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-06-26T07:49:36.816100Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2606.24004"},"observation_digest":"sha256:c755e6ac5b092149b290aa55d770ee3e77f1f426543cffd0262651335ed2fdbf","observation_id":"d10d6478-a27e-4e88-998b-15103a3cb8f2","resolution":{"observed_at":"2026-07-04T11:39:47.082804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":"2408.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-07-04T11:39:47.080762Z","title":"Self-taught evaluators","venue":null,"work_id":"9599e5b4-f4d0-48e3-9cd8-5b366fb2ae20","year":2024},"citing_paper":{"arxiv_id":"2606.24004","last_updated":"2026-06-29T07:01:12Z","snapshot_observed_at":"2026-08-02T11:15:29.427964Z","submitted_at":"2026-06-22T23:21:55Z","title":"Towards Spec Learning: Inference-Time Alignment from Preference Pairs","version":2},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-06-30T10:17:33.176525Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2606.24004"},"observation_digest":"sha256:e40c3bb99a4f73ea3c111d8959ee64be3c0b0672c56376e047b9f6884a82258e","observation_id":"db66d51a-4494-44a0-9a20-39e034d00ae3","resolution":{"observed_at":"2026-06-30T12:44:39.540134Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":"2408.02666","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-07-04T11:39:47.080762Z","title":"Self-taught evaluators","venue":null,"work_id":"9599e5b4-f4d0-48e3-9cd8-5b366fb2ae20","year":2024},"citing_paper":{"arxiv_id":"2606.28898","last_updated":"2026-06-27T13:02:13Z","snapshot_observed_at":"2026-08-06T05:16:31.950828Z","submitted_at":"2026-06-27T13:02:13Z","title":"PASTA: A Paraphrasing And Self-Training Approach for Knowledge Updating in LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T09:42:40.357949Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2606.28898"},"observation_digest":"sha256:0cc0233b77817336b727bd3c11117ef52f0a014537d81aee93c57c5b867fa1f9","observation_id":"83be3beb-3088-4a67-a07d-45c960555ef8","resolution":{"observed_at":"2026-06-30T09:44:37.486590Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-02T12:49:09.307551Z","title":"Y .; Fazel-Zarandi, M.; Weston, J.; Li, X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22561","last_updated":"2026-05-29T03:13:24Z","snapshot_observed_at":"2026-08-07T11:44:21.900458Z","submitted_at":"2026-05-29T03:13:24Z","title":"Codifying the Judge: Scalable Evaluation via Program Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T12:49:09.307551Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2607.22561"},"observation_digest":"sha256:6137128a7d7f9639b7dd83c963f21314b237bc6df96114768756bb620ff07922","observation_id":"551babe2-fe27-43d0-a6b4-11cc905ba28b","resolution":{"observed_at":"2026-08-02T12:49:09.307551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2408.02666/citation-record","integrity":"/paper/2408.02666/integrity","json":"/paper/2408.02666/citation-record.json","paper":"/paper/2408.02666"},"outbound":[],"paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T10:45:45.471332Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2408.02666."}