{"as_of":"2026-08-15T04:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af159a02ad3f58c51018e8f175ab8ecf56f44712ab4d95850b3d0e7c946e42aa","coverage":[{"denominator":238,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:41:20.255874Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:34:30.627327Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:34:32.141658Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"cited_work":{"arxiv_id":"2505.14279","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14279","snapshot_observed_at":"2026-08-06T17:34:32.141658Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","venue":"cs.CL","work_id":"00a228a1-1527-40d9-b9b7-03e9727e1e75","year":2025},"citing_paper":{"arxiv_id":"2507.10522","last_updated":"2025-07-14T17:47:28Z","snapshot_observed_at":"2026-08-13T01:59:20.783949Z","submitted_at":"2025-07-14T17:47:28Z","title":"DeepResearch$^{\\text{Eco}}$: A Recursive Agentic Workflow for Complex Scientific Question Answering in Ecology","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:34:30.627327Z"},"links":{"cited_paper":"/paper/2505.14279","citing_paper":"/paper/2507.10522"},"observation_digest":"sha256:a3f4bf820d342ad36755946089506b7508ff7fd85945e1dbd5aab03eb2fd851a","observation_id":"0690fa75-c482-4f54-bdd8-f3da76d3f084","resolution":{"observed_at":"2026-08-06T17:34:32.261596Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14279/citation-record","integrity":"/paper/2505.14279/integrity","json":"/paper/2505.14279/citation-record.json","paper":"/paper/2505.14279"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.461105Z","title":"These alterations mimic realistic errors that may go unnoticed in automated evaluations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.461105Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:0fd10a25bd14ad46d53b642cd618f920b125b146a8783bf44a3627584ef1923e","observation_id":"332db1ee-8ec1-4b4d-8680-abccee039192","resolution":{"observed_at":"2026-08-07T15:41:10.461105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.538531Z","title":"Research Fields","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.538531Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:51073d72fbfc0e831418fd73fbf63d740b6736a6e3576fb95d54484c38cc670b","observation_id":"c476f6f5-eecd-40bd-b37c-2af7fed5286d","resolution":{"observed_at":"2026-08-07T15:41:10.538531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.744690Z","title":"– Extreme: Remove the last sentence and append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.744690Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:db660b48b406655bd20edb08f6a370c506f1fa8bd3a1fd41806b778d7910361f","observation_id":"c951a1e4-507f-4bd5-b798-cce091f3c167","resolution":{"observed_at":"2026-08-07T15:41:10.744690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:09.754564Z","title":"In Proceed- ings of the 17th Conference of the European Chap- ter of the Association for Computational Linguistics, pages 1650–1669","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:09.754564Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:016beb6bb3e721422855019d988370ed0c664460983bc2f04e23c77937c94207","observation_id":"19bbbb97-d433-4a37-aed4-98bf0079a921","resolution":{"observed_at":"2026-08-07T15:41:09.754564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.966575Z","title":"however\",","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.966575Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:098f7fefbaa128b96b87cbdf27136446f4b18e47f5871e2753c67fae51d059b1","observation_id":"1bbabe68-e7bc-463b-8022-73abafb38293","resolution":{"observed_at":"2026-08-07T15:41:10.966575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:09.894540Z","title":"In Proceedings of the 37th International Conference on Neural In- formation Processing Systems, NIPS ’23, Red Hook, NY , USA","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:09.894540Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:feef73ce3f825e57dc89c1dd3600c54a4644ec727e56efefbdfb34c5bd761e26","observation_id":"77c3fbbe-5983-4c93-85bb-3decec7f7e32","resolution":{"observed_at":"2026-08-07T15:41:09.894540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.184552Z","title":"– Extreme: Append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.184552Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:9d3e10b8cd67b8abb0d2bd2f296d002570c85143fffcc5ba1ce908b06421bab4","observation_id":"9b1daebd-176d-4249-be25-8e39037f00a3","resolution":{"observed_at":"2026-08-07T15:41:11.184552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-07T15:41:10.083275Z","title":"In Proceedings of the 57th annual meeting of the as- sociation for computational linguistics, pages 1085– 1097","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.083275Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:cd352ca720ddc0fdeae39d62ba0956c5f2ae8a02d970f0fcb4c7537017eebf8f","observation_id":"eadb2dc3-3f6b-4111-aebb-d8057d1f20cb","resolution":{"observed_at":"2026-08-07T15:41:10.083275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.151604Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.151604Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:95d64a049c0a651032d32b03ce506f97b263c6c7b4d467cee463fe90a700e338","observation_id":"2ad93087-4824-4673-b8c6-cbd719ac74f4","resolution":{"observed_at":"2026-08-07T15:41:10.151604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.631398Z","title":"– Extreme: Append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.631398Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:de04e11702b693956115d6a69a55ec44a0500d71a8b6c1be15987280d32eb5f7","observation_id":"b6b401c2-0b35-4fab-9ebe-3ce9d7ef62d5","resolution":{"observed_at":"2026-08-07T15:41:10.631398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.740191Z","title":"– Extreme: Append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.740191Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:669b7afd24003fab4ecf16fa31553c6688f164f9b6a67db2f05d88476b65aec8","observation_id":"dfa3daa8-5e1c-4479-8894-c7825b3f8fbb","resolution":{"observed_at":"2026-08-07T15:41:10.740191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:10.818806Z","title":"– Extreme: Append a sentence from an unrelated sports news article","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:10.818806Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:e14684713c5b6fba92b4d6c0c0b395bac6204b1001a2a1ecd286b7f0f026289c","observation_id":"3832d8b2-eeb2-46e3-be72-f9a4c64cdc50","resolution":{"observed_at":"2026-08-07T15:41:10.818806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.091813Z","title":"– Extreme: Randomly shuffle all sen- tences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.091813Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:34d5b26438649d2471063151fd29029f075ff6660ee6f94c8c8b27d1313ad1aa","observation_id":"4d0c629f-b0f7-4893-8ce9-5dad464fef38","resolution":{"observed_at":"2026-08-07T15:41:11.091813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.296245Z","title":"– Extreme: Append a sentence from an informal tweet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.296245Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:dba12ff1287bea947a5930a3adcb585c0fec6ed23f52f415fd5663a26ced0402","observation_id":"2b81a11e-a3c1-4ff3-91b6-e7b65f4db880","resolution":{"observed_at":"2026-08-07T15:41:11.296245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.420784Z","title":"Here is a redundant sentence","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.420784Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:87067130e8a636ae7c85cd90ac75788f3c72fc3fcce647fac0702e7c267ecf2d","observation_id":"349c8d91-a13c-4ff1-8deb-0e6a0a268849","resolution":{"observed_at":"2026-08-07T15:41:11.420784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.755052Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.755052Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:b4573a3f6585c4064f999497a0a8c037804786733864304c9def9aa63cc77c2f","observation_id":"e7841a81-9923-4ace-8848-2ac8c47d2f98","resolution":{"observed_at":"2026-08-07T15:41:11.755052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:11.888088Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:11.888088Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:31a448659480287fe4b4673c41def9863c0047355790ec7ab99529cd18eda825","observation_id":"93e5ce2e-c1aa-401e-89fa-eadc8f000322","resolution":{"observed_at":"2026-08-07T15:41:11.888088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.021779Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.021779Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:5e7a2cf7c3256ecefb13f7bfec490b9b2e393b743845fe66d680ecdfeb4412a9","observation_id":"03060775-15d2-43f0-a93c-a9e8b6777949","resolution":{"observed_at":"2026-08-07T15:41:12.021779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.178157Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.178157Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:07b216e3892c5850b57fd43d1c182f25270e0488ec2b1af6d11edf001a5dc015","observation_id":"dc522936-bc27-4fa1-892a-4a86b467f870","resolution":{"observed_at":"2026-08-07T15:41:12.178157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.299079Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.299079Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:5526c880c01039cc366e5d3fceb057d918d23c05685046cbe0bd2e9039bd2a05","observation_id":"0d06994a-2e31-4301-87f9-4aaa81f94e9a","resolution":{"observed_at":"2026-08-07T15:41:12.299079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.423322Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.423322Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:ad913e7b503d569e223f4b9be14e30bb80d5aeee800ff98a1a0d31965f72d033","observation_id":"24ac681e-529e-481e-83d3-69a0e22e1ee0","resolution":{"observed_at":"2026-08-07T15:41:12.423322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.577790Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.577790Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:a0fa072d2d09da8383df806dc6889ae83029c898b49c3b0ee5a6af6d3524905b","observation_id":"24983167-4c8c-4976-9b9b-c42006c378e4","resolution":{"observed_at":"2026-08-07T15:41:12.577790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.738275Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.738275Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:634f99c18734c15ffc5acb9e6074a5e067a94826c38dec513ea52452f84f826e","observation_id":"e6f0551c-10a3-4c44-8090-f129b8046044","resolution":{"observed_at":"2026-08-07T15:41:12.738275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:12.878609Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:12.878609Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:bae50af6d14bf7730a988e11c981a2d765619dd785291f3e4ac38075c475b3e5","observation_id":"cbfd7d27-8cd5-4133-88c1-cc40319c3924","resolution":{"observed_at":"2026-08-07T15:41:12.878609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.001717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.001717Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:43bb4ce27181d64cf557fbbdf6cac79fb035734502cae6fcf2e09ad9cf26bafa","observation_id":"eae91843-3197-49e9-87be-ce417d0ddd4e","resolution":{"observed_at":"2026-08-07T15:41:13.001717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.186067Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.186067Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:519a9102b3ded9467cbede23453aa6c294d930a628106a09b926abae8c2badd9","observation_id":"141e0aaa-589e-4e9f-b890-1fb571feb832","resolution":{"observed_at":"2026-08-07T15:41:13.186067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.408717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.408717Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8bffd16d46ea05667d0afbc7860e8693db223ae41dbefaba6a633bc53f217ef2","observation_id":"61b1a62f-3cc3-42cd-a9de-86eede92825c","resolution":{"observed_at":"2026-08-07T15:41:13.408717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.469859Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.469859Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:75f43f3932fec2aac427551b611782af460fd60e141db241c7eeb52e65c35494","observation_id":"4924f260-032a-498d-9977-6f6c8c889ee6","resolution":{"observed_at":"2026-08-07T15:41:13.469859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.522414Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.522414Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:7c148332065a91171fe6c0cda2d7892ef6d281bfe160a5c8803d7512da92a518","observation_id":"072a86f1-6b48-405b-bf47-915b71f00812","resolution":{"observed_at":"2026-08-07T15:41:13.522414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.605269Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.605269Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:136b2b721f96dca418baff675b1aab5a62309e31715e3def81a8ee2ce6c7d0f4","observation_id":"14b7a219-4dbc-436f-be41-258ac53c9a63","resolution":{"observed_at":"2026-08-07T15:41:13.605269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.693885Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.693885Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:fcb20dba07db87091aaba5661479a050866dafa15527186182d8ec556c742da2","observation_id":"f9c92743-af67-43fe-8248-ed803de14676","resolution":{"observed_at":"2026-08-07T15:41:13.693885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.783338Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.783338Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:b417a1eeb6a30dabeaf916d92b118826c6833c03a91262a9afd24e770dfc00c6","observation_id":"19dbaf49-1e67-4afc-87c0-b5c48d28505d","resolution":{"observed_at":"2026-08-07T15:41:13.783338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.870856Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.870856Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:f98216fc0e9a4dea524056aa9681ac27c84eb65bfaf6bdf6e31a3c454515d715","observation_id":"f38f2272-fbf7-4299-a418-a16c18d8e1c3","resolution":{"observed_at":"2026-08-07T15:41:13.870856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:13.952513Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:13.952513Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:e5a057769fa09b17f1e6f5c326be979004c07f4071584fe18744bf0a60ba73cd","observation_id":"1d561a44-f96f-48c3-abb4-b9c66c4683c2","resolution":{"observed_at":"2026-08-07T15:41:13.952513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.005247Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.005247Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:6c138d67a1e0742cf409ba13a43424f5df15281abe72d42ce9c03f9f281bcd8a","observation_id":"62e53074-b425-4c19-830c-714f794baf15","resolution":{"observed_at":"2026-08-07T15:41:14.005247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.091717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.091717Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:34b640c0015ce75c9621ca553029ab7ff61c1c0405c067c39b22377cd39c8344","observation_id":"5d59f393-4954-4855-a4e9-126c4bf85048","resolution":{"observed_at":"2026-08-07T15:41:14.091717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.177795Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.177795Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:315d049de76d3bf869f53f4acad707df5495226ae4ba8d739d918c16116f8e59","observation_id":"b5ff1d6b-f9ad-492b-a2b5-d3dc6c0f570f","resolution":{"observed_at":"2026-08-07T15:41:14.177795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.253619Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.253619Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:20c1da5095c128b98783fab02c848ab20f3c08c0751c6d0f649a6209906bc252","observation_id":"709f17ba-df42-4e6b-91af-c18d1b79f5e5","resolution":{"observed_at":"2026-08-07T15:41:14.253619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.343375Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.343375Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:2bd2e97da3f8b0ab6b77de866712a36c7e91384a6b88a8eed07c3e145382a1b6","observation_id":"1c9e7b2a-4cc7-44d1-a76a-2ced9a60bb93","resolution":{"observed_at":"2026-08-07T15:41:14.343375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.429262Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.429262Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:fb0f18c6a361f3900e4d992c59cdb7de4c6b264320cf38c5f3a0dcfbfc0686d8","observation_id":"a28e7146-79a1-4253-8509-d95a213d2e9b","resolution":{"observed_at":"2026-08-07T15:41:14.429262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.512730Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.512730Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:1fbe30e123091c217a4df13a966fee47d44c35bb37705fe1ef849160e5b52397","observation_id":"1be723e3-cd3e-4338-8c2d-35a26eec5672","resolution":{"observed_at":"2026-08-07T15:41:14.512730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.624422Z","title":"Set Rubrics M1 M2 M3 M4 M5 M6 M7 benign","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.624422Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:a8f3d32b7fa04597ed6c950acf757be6f7a644addd5b397bd0de9cbfd5966a14","observation_id":"495b3c65-6f0e-4b6f-836e-c94fd86ba210","resolution":{"observed_at":"2026-08-07T15:41:14.624422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.701821Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.701821Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:3f4be3ded356b805924a8b174953c29b6eb5830b379ea82ae57c814579b0fe21","observation_id":"be10b81f-71ab-4d55-aa0d-edb2dae74731","resolution":{"observed_at":"2026-08-07T15:41:14.701821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.841596Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.841596Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:ebc972665a701186685cebd6dcb6a90f1f7b8136edd53302f7dec2b646ca41cf","observation_id":"c2f8103c-c23b-4a18-8f72-7565ac5aef6f","resolution":{"observed_at":"2026-08-07T15:41:14.841596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:14.923073Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:14.923073Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8a291a4b6f095244274448375dd65b99f3cd52dbc869cd6d4331f3fa404abe0d","observation_id":"62cb296e-7ff1-49ce-ac9b-6621ecfedc91","resolution":{"observed_at":"2026-08-07T15:41:14.923073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.009164Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.009164Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8e5984fe0e843e35dc5aee8b80c27cc73ab1a0691cddce0fe4bba28112d139bc","observation_id":"4ef53334-da63-4ca5-897a-4fdf20851e9e","resolution":{"observed_at":"2026-08-07T15:41:15.009164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.102676Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.102676Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:1f362f3e996b922cd7e398b02d93e75db79541b74807dc3baa559f7f503bf6c5","observation_id":"fe6646ac-99b0-47ba-8c72-c28837d0dcd0","resolution":{"observed_at":"2026-08-07T15:41:15.102676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.223363Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.223363Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:19822f158c1fa40e22bb2a3a529af0a7fd63876109114daae3f5bfd9269eca42","observation_id":"2b9b0988-c325-417c-b279-2d81a2c42cbd","resolution":{"observed_at":"2026-08-07T15:41:15.223363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.309780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.309780Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:5ec536e1adf4ade08e44042dca7816bee257a6e2d6fa655d2e2ff0bbd44cf849","observation_id":"bd54827e-c525-4ad3-8d59-5061527d4f91","resolution":{"observed_at":"2026-08-07T15:41:15.309780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.459548Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.459548Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:d4417614e936b9c2c21392bdd915f3b26d182379bba80f48eace002c61eb3df0","observation_id":"9d55030d-a9d6-4306-8df7-52b7dbb228c8","resolution":{"observed_at":"2026-08-07T15:41:15.459548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.537273Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.537273Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:a7821b8321f18bfd276ed774f24b3a0fccd748d5475c5d2639b5d407f027cea6","observation_id":"6282475d-1f54-4d68-80b5-359a7aaf751d","resolution":{"observed_at":"2026-08-07T15:41:15.537273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.639095Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.639095Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:71082db47e205bb6b3f7f03d937182eded1948bbae2df5d18af4cf1aab6a2560","observation_id":"1c593693-4299-4e78-adcb-c7d644e8d6fd","resolution":{"observed_at":"2026-08-07T15:41:15.639095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.729156Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.729156Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:83e28abc7635c07dce9c0f65d4e68f74b83e692800efbd221ed1633c68a2d002","observation_id":"1e72812b-34fc-42fb-9778-b05f933937f6","resolution":{"observed_at":"2026-08-07T15:41:15.729156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.811587Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.811587Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:402e8d77228e2e723dcc62cd974c44f732f84750d76d95717008d1635a5df425","observation_id":"81f6db67-d2c2-4fae-9d8c-a951f09d7379","resolution":{"observed_at":"2026-08-07T15:41:15.811587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.915830Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.915830Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:e553020919a78782dc109dc7405f199b1865e30d446c53d877ed9291d55408bb","observation_id":"306d5c56-9f6b-4933-821f-1330d75ebf7b","resolution":{"observed_at":"2026-08-07T15:41:15.915830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:15.994743Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:15.994743Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:85997ec0436723059276a1002ef1086d8e2cf6a2983da43b215c6379234909f7","observation_id":"db6d393c-1bc2-4756-a830-80a723e709f0","resolution":{"observed_at":"2026-08-07T15:41:15.994743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.146419Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.146419Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:29183c91f3243b0654a90160c29cbe687facd11bed9a7b1fe63e9ed8622fb26f","observation_id":"b4ac9295-0bb7-466c-8804-de8f5b0468ef","resolution":{"observed_at":"2026-08-07T15:41:16.146419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.267483Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.267483Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:32ddfc8457478b2979d6341e754ca0eec1e532fad59e1c2f45b655328fd8da73","observation_id":"7946b2b8-9d26-442c-8d8e-7a61d99fc17c","resolution":{"observed_at":"2026-08-07T15:41:16.267483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.351395Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.351395Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:b7692bcf4302830ec94a826d00785ee08f93ad0d6e04f420d6a341d5f3718013","observation_id":"6c8ec02e-32ad-49a8-a074-3f75deef90f0","resolution":{"observed_at":"2026-08-07T15:41:16.351395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.459889Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.459889Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:da8ac24b2b83918c055c31efe920822352fe548eeb3e40ab440f8383429686c7","observation_id":"a795c52a-05b4-41b4-868f-c245d83d8739","resolution":{"observed_at":"2026-08-07T15:41:16.459889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.572280Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.572280Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c303237ca3c46033458cdb7758a3545103e673a87a4c9a83481b3c9b277e31ac","observation_id":"ac6a07d2-0356-4b05-abb4-ec54df3891b2","resolution":{"observed_at":"2026-08-07T15:41:16.572280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.690686Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.690686Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:86a55d68ff7cce4707d04ea6c8e7dcd021f6b22dc1c2512a0a06b37dae39df9b","observation_id":"ad596cdf-45ea-4827-af9a-147f40592611","resolution":{"observed_at":"2026-08-07T15:41:16.690686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.805495Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.805495Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:2d6b9e3cdb33bd313943792b6265f279b90b2e36c2bb5e1daabb9a86f73750c4","observation_id":"ff4300ea-0496-4f52-bd61-9f81c58c67b2","resolution":{"observed_at":"2026-08-07T15:41:16.805495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:16.921569Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:16.921569Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:f0be4f4b2bcb6a9dc0525f12a4fff46782b2ec942aff3010353a3bd8204bd087","observation_id":"9593a0d9-3ce9-4057-b5fc-34ae025037fe","resolution":{"observed_at":"2026-08-07T15:41:16.921569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.036860Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.036860Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:f295645da1420fe4228eb5715a7efa4ccab4b389ba5e57118c02b1a38167fba9","observation_id":"e18b0893-bdd0-40ae-91b9-c3a99ded40c9","resolution":{"observed_at":"2026-08-07T15:41:17.036860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.157136Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.157136Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:d2ae3b1bcb1738f9c6f45f6c76ca8051d55e9e16b2ba96db4761400f65a214a9","observation_id":"7942aaad-e72c-478f-9b92-670c5ffff9f3","resolution":{"observed_at":"2026-08-07T15:41:17.157136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.231515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.231515Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:6c17cb2b160f10ec8605a5fb4cf29d76fa3f8cc4c5285374c1c10156009350b0","observation_id":"498e705d-fc9f-44fc-bd4a-d380eca18837","resolution":{"observed_at":"2026-08-07T15:41:17.231515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.307935Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.307935Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:eadbdff25cdfa99fb45d1b2eba9e8f9a5839b6e5f6bc587796cd9ce6c72115e8","observation_id":"9d80ffc2-91cf-4d2e-8bf5-ecce98d3c530","resolution":{"observed_at":"2026-08-07T15:41:17.307935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.404663Z","title":"Set Rubrics M1 M2 M3 M4 M5 M6 M7 benign","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.404663Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:b0d5f256613a48e8b5e5ccd2603cca084c5238d7dcbcfa393b72c126fdc34a45","observation_id":"f947f22c-7e19-4d3d-843c-09522345b9ee","resolution":{"observed_at":"2026-08-07T15:41:17.404663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.506426Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.506426Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:dfbb5de07f34581bff2de9a3308a67deb2cfe7e55fb93729b72226fb69a1409f","observation_id":"67949395-410f-4400-9a6c-84a3ac15ed90","resolution":{"observed_at":"2026-08-07T15:41:17.506426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.614987Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.614987Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:e25056052043f5315de4da074246b09b183a444b680b1fe5027f0651d2db8222","observation_id":"c618124a-7e04-493c-85d7-a1e6aa7713eb","resolution":{"observed_at":"2026-08-07T15:41:17.614987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.702562Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.702562Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:d25ebf75ae65bed77bf3f6f32baadd4857cd4af2b5348b2a5eb8bd972c9843b0","observation_id":"526ed5ea-84c1-48c8-b44d-548732188ae7","resolution":{"observed_at":"2026-08-07T15:41:17.702562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.837289Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.837289Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:197687c68402160e6f2a2c4f583b8c4311037a65b0f8b7c59167950deb599c66","observation_id":"edf909cd-3474-4da7-a8a7-1b3967bf9814","resolution":{"observed_at":"2026-08-07T15:41:17.837289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:17.972712Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:17.972712Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:5f5726792b8550ce900b8dea42fabb1b4b1dd115be926af489dbcf3e43cf7ace","observation_id":"de9e4fe1-f0f4-430a-9cf1-769d033aa987","resolution":{"observed_at":"2026-08-07T15:41:17.972712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.074954Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.074954Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:f84846863bc7c58a0a2821238e699244566830a96782bcbcb174375dc3e396b2","observation_id":"68110f00-6a31-4920-aee4-11efeae71287","resolution":{"observed_at":"2026-08-07T15:41:18.074954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.176527Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.176527Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:4ae8be4769495f532fdd66496ffd4942bffbbc09d57ff33107b307354d4e238b","observation_id":"dbb1786d-5256-4749-94c4-c8daf9f4f554","resolution":{"observed_at":"2026-08-07T15:41:18.176527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.273717Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.273717Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:fd664cf333e633dbc4a26a78188d973fb0afe2e763f7e7c36ff64311b5eb48e9","observation_id":"551a7c89-c885-4007-9a54-55f08564f598","resolution":{"observed_at":"2026-08-07T15:41:18.273717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.379842Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.379842Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:042820133f6b375065217de7d4cfcef3f43077ba79d1e3c855dfb6c068a93248","observation_id":"94027041-c4db-403e-896b-0f61147e3ca8","resolution":{"observed_at":"2026-08-07T15:41:18.379842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.449810Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.449810Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:88c0297244f41795cdba5fc0534029ecfd11d4f91370eccd73364317016e5c57","observation_id":"44f7deb9-f520-45f6-8234-7d35fc78cd5d","resolution":{"observed_at":"2026-08-07T15:41:18.449810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.535325Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.535325Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:80b2571e3c00cc8c257f64d9ebd2b2051d3d9107128efce4a9c6960887c2492d","observation_id":"7a72b4aa-9c3b-4b0c-8466-09371ae6525d","resolution":{"observed_at":"2026-08-07T15:41:18.535325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.608324Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.608324Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:57a53ffb817e80c6d3c9ae8368727f83031e49db50c5766be86271d593e83f0d","observation_id":"74f37b4b-e7e1-4231-b0b8-4373e3d585b1","resolution":{"observed_at":"2026-08-07T15:41:18.608324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.685283Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.685283Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:b031fca3b35047d05bfa29b65cbcd8a0e02dd33739c14d0ed749b2b78d126ffb","observation_id":"d08dba1b-64a1-4110-b86d-2a5856667f23","resolution":{"observed_at":"2026-08-07T15:41:18.685283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.763665Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.763665Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:2af786baba198417b89d72ffdd8cd901f61203e2d040dc089ff53180f6c509a7","observation_id":"ff613d9f-caa0-4af9-9675-f3616fbfa676","resolution":{"observed_at":"2026-08-07T15:41:18.763665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:18.900593Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:18.900593Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:53b8d0b6717432bfbc92fb8ee2963f7920511fe1f26a2e8be50d6ceb71e590ca","observation_id":"89ee8712-fa3e-4869-b8b9-792c224f8b79","resolution":{"observed_at":"2026-08-07T15:41:18.900593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.037954Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.037954Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c41612ccc10f6cd8c57b14a5b8c050c1b09fcaa8ce8ec2547c7a506ccabc3cc3","observation_id":"9a788887-f4db-470e-b064-e28731d58d57","resolution":{"observed_at":"2026-08-07T15:41:19.037954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.139256Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.139256Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8936ce03497b8cf941039d25a755e69f9b0a3d05092b023062820e91ebc1082b","observation_id":"bbe41dc1-4099-4a31-abb8-1b123567f3ac","resolution":{"observed_at":"2026-08-07T15:41:19.139256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.219973Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.219973Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:84bbad15cbd3b3d9f8f3b677d61a6348afe5eed11b6c834c3cf9d89057f42462","observation_id":"fc8e2d31-2fe4-4ab7-8a80-e0761bb634f2","resolution":{"observed_at":"2026-08-07T15:41:19.219973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.340708Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.340708Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:0909b61203aaa11de83d132cde0113c77cde8f908a2dd6b6ba366f55ea8fd7bf","observation_id":"33073363-1264-45e5-85a9-18db563d46d8","resolution":{"observed_at":"2026-08-07T15:41:19.340708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.419406Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.419406Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:577a09fd489bba11ed9e3d5275dfcd4687474066448fcbbc82f0d579cfcd218c","observation_id":"8cd60862-5044-47c0-8c8c-f32e412e8bbd","resolution":{"observed_at":"2026-08-07T15:41:19.419406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.512403Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.512403Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:70b09614d722cb574ba303d66389af6bece6a15a0f956cce63e3d608d8924f91","observation_id":"b4929638-3773-4a9e-b018-ac57be1eafee","resolution":{"observed_at":"2026-08-07T15:41:19.512403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.607251Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.607251Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:487dc3d8aafc21867c3747e340d95e8e0a32b56f9217148f3fc10d7f014ea593","observation_id":"e00d3944-88f9-4fd4-9956-b56e5b79021e","resolution":{"observed_at":"2026-08-07T15:41:19.607251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.689453Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.689453Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:b720a2e4798f22d6c71615d02460c6ff2c09874968080995bc998f34c505de9e","observation_id":"a743ceb3-c1d9-473b-9707-b00845a148f7","resolution":{"observed_at":"2026-08-07T15:41:19.689453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.765357Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.765357Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:d8d749da2abd4bacb84bd9e3b808a96e908f18c5e70c056cdbb4918d1db95c1d","observation_id":"515b0523-ea3b-4229-893f-3dfc4352740e","resolution":{"observed_at":"2026-08-07T15:41:19.765357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.840623Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.840623Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:c75194f84b08efb1b33601b6685163e11bcbfd47c57ee71bfd8cfebbbd9e8653","observation_id":"ab4ca766-b88b-40ce-9b01-564e34083b1a","resolution":{"observed_at":"2026-08-07T15:41:19.840623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.915393Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.915393Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:8d4959523039b0b3d476afd30c0f0e552787c9c09b40410ece088af53ef1b25b","observation_id":"a9fd80bc-bbbd-4a0d-a15b-dc6b49b40252","resolution":{"observed_at":"2026-08-07T15:41:19.915393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:19.983858Z","title":"Set Rubrics M1 M2 M3 M4 M5 M6 M7 benign","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:19.983858Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:0785edd14099b9b823cc56f705567c42136e6f06edc0fd4314318293d88bac61","observation_id":"d226a8d0-4898-4895-b9ef-61c838070341","resolution":{"observed_at":"2026-08-07T15:41:19.983858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:20.065351Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:20.065351Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:e36b1aaaf337a916d0ce909696b401b0fe8030042eb03329f33b2661747415ed","observation_id":"33f4ec98-fce1-4d83-9852-a5942b12affa","resolution":{"observed_at":"2026-08-07T15:41:20.065351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:20.122055Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:20.122055Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:af1b3e37a44fd1619b73a62ebfa68aec8d2e14d4c9ccf8d88b1e4decd06d3c40","observation_id":"e02a8f69-0329-4ce2-942c-d759657e5589","resolution":{"observed_at":"2026-08-07T15:41:20.122055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:20.188795Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:20.188795Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:da8f055a8891b048cb1cf60400c1ae3b9cb32e323512df0ccce2d1518a9b9993","observation_id":"30d4f575-e8a5-423f-8b39-1ea4ce2ae164","resolution":{"observed_at":"2026-08-07T15:41:20.188795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:41:20.255874Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering","version":2},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:20.255874Z"},"links":{"citing_paper":"/paper/2505.14279"},"observation_digest":"sha256:3349d49ac583385bc16a115705400759a9491b5c02f72f24989020dd24fae29b","observation_id":"8d39d701-f496-4805-8f8e-1326330b5d3e","resolution":{"observed_at":"2026-08-07T15:41:20.255874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14279","last_updated":"2025-05-29T16:45:00Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T23:01:58.458430Z","submitted_at":"2025-05-20T12:30:46Z","title":"YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":238},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 238 outbound references and 1 inbound Pith citation observation for arXiv:2505.14279."}