{"as_of":"2026-08-19T21:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d03ecd75f17918a84d9fe7ac8493c1b94666ef0ac6f84c78bb86833e5500fbaf","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:02:47.526084Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:20:33.617934Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00777","snapshot_observed_at":"2026-07-14T11:49:31.595873Z","title":"arXiv preprint arXiv:2506.00777 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10428","last_updated":"2026-07-24T14:32:58Z","snapshot_observed_at":"2026-08-15T21:39:52.906936Z","submitted_at":"2026-07-11T18:22:49Z","title":"Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-14T11:49:31.595873Z"},"links":{"cited_paper":"/paper/2506.00777","citing_paper":"/paper/2607.10428"},"observation_digest":"sha256:27165bcdad9441099857fb9f91a09ba6363d2a4e2b57914a05bb26e7467d5e9d","observation_id":"b2697847-5dea-482a-82da-5a066fb655a6","resolution":{"observed_at":"2026-07-14T11:49:31.595873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00777","snapshot_observed_at":"2026-08-02T07:20:33.617934Z","title":"arXiv preprint arXiv:2506.00777 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10428","last_updated":"2026-07-24T14:32:58Z","snapshot_observed_at":"2026-08-15T21:39:52.906936Z","submitted_at":"2026-07-11T18:22:49Z","title":"Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T07:20:33.617934Z"},"links":{"cited_paper":"/paper/2506.00777","citing_paper":"/paper/2607.10428"},"observation_digest":"sha256:9f7b823df033f5c44faa7cef9a6ba6e9b7c916c2558f113b3cfb51ec5a46d5b1","observation_id":"3d01d9e4-23ce-496d-8e1e-f52f7e92bc81","resolution":{"observed_at":"2026-08-02T07:20:33.617934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00777/citation-record","integrity":"/paper/2506.00777/integrity","json":"/paper/2506.00777/citation-record.json","paper":"/paper/2506.00777"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T12:02:43.279759Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.279759Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:77bfb59e6c7fb4f7b4aa9ec5895565f85f20c14d5c3d9045acff661fad337124","observation_id":"cbc6415e-83f8-4705-a460-ea733bb3876e","resolution":{"observed_at":"2026-08-07T12:02:43.279759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:02:43.374841Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.374841Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:f755adbf6881058d53263d8b05f1dad0a0a111f901deda60f525f1bd8ce4da55","observation_id":"7106c982-2c18-40da-b7fc-c50c17e8645b","resolution":{"observed_at":"2026-08-07T12:02:43.374841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-07T12:02:43.455923Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.455923Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:b81efb257c37068326158975dd9cee10029e48e2116da73f00358e0a853b28dc","observation_id":"77d10d3b-a33b-47cb-84f2-7a33f045acd9","resolution":{"observed_at":"2026-08-07T12:02:43.455923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.942654Z","title":null,"venue":null,"work_id":"ed5fb929-37e0-4753-8334-10623c355e51","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.506723Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:62ffee3a18b71647cbe00680e18eb4c4c82a5477b714e7080f1920bddb651b86","observation_id":"c8b80b04-3649-4f7b-a8e1-866fb883057d","resolution":{"observed_at":"2026-08-07T12:02:52.076468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.570013Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.570013Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:113f9ca285c9788719f1f8bb36655aae3f08d23cfdfe37620b8b19e0ba945ab3","observation_id":"2b483b88-b595-4566-a055-62d9d73d343a","resolution":{"observed_at":"2026-08-07T12:02:43.570013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.667380Z","title":"Do, Yan Xu, and Pascale Fung","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.667380Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:83ac7532828cb9e55d461371a993be76892392865c887e8e4494d95c14b34627","observation_id":"ae6a5b49-c271-4d04-bbc5-f107955debdb","resolution":{"observed_at":"2026-08-07T12:02:43.667380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:43.774395Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.774395Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:0cae9073c2e266313e2f976fd49ee5b8bf21cc265853a7ced912c3c7b750ea53","observation_id":"14591c23-b534-4fe1-a311-27e02139c2e3","resolution":{"observed_at":"2026-08-07T12:02:43.774395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14782","last_updated":"2026-05-31T00:04:33Z","snapshot_observed_at":"2026-08-16T13:50:06.099874Z","submitted_at":"2024-05-23T16:50:49Z","title":"Lessons from the Trenches on Reproducible Evaluation of Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14782","snapshot_observed_at":"2026-08-07T12:02:43.811421Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.811421Z"},"links":{"cited_paper":"/paper/2405.14782","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:49955d74a527165972e54fa1bfce1c284d026b82cde63715d88cbdb387c9676e","observation_id":"dbe47d2d-c4e9-4e09-94f4-5926e32a1963","resolution":{"observed_at":"2026-08-07T12:02:43.811421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.675784Z","title":null,"venue":null,"work_id":"7dacbd9d-67c5-4fdd-b1ad-acf5fc09bbb2","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.908302Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:d4400a597d60c6580d2903020721c2dbad1a30e7a7304e62d48afec9e65ebc49","observation_id":"fdc7ff7e-8cd7-4932-bb5f-d44032f25b2e","resolution":{"observed_at":"2026-08-07T12:02:51.799121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00841","last_updated":"2024-04-15T17:56:58Z","snapshot_observed_at":"2026-08-16T14:22:23.614137Z","submitted_at":"2024-02-01T18:31:34Z","title":"Tiny Titans: Can Smaller Large Language Models Punch Above Their Weight in the Real World for Meeting Summarization?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00841","snapshot_observed_at":"2026-08-07T12:02:43.971142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.971142Z"},"links":{"cited_paper":"/paper/2402.00841","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:5bfc6163afb294d16adf9a2f86b9cd62184263fb2ec519cfec63d3393ef6df21","observation_id":"e46f93ed-c5e8-4406-8463-fbfd8a3d8f3f","resolution":{"observed_at":"2026-08-07T12:02:43.971142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.456596Z","title":null,"venue":null,"work_id":"5a17a71b-d6c4-498c-89af-0ba36c7be8ff","year":2020},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.045874Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:001981423b0908b196794a0c3d1c817461163e885895eb5ddb9116136d1cab7b","observation_id":"6ec81de2-7bac-4235-9bde-7f605eb4f692","resolution":{"observed_at":"2026-08-07T12:02:51.515495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:02:44.092977Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.092977Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:e7384fb8d3bebeff769290b91cc53d534df7153e75ef3cec8e0d5821027bc338","observation_id":"c16909de-1bcd-45b2-a1ba-703ef69ca796","resolution":{"observed_at":"2026-08-07T12:02:44.092977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T12:02:44.191039Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.191039Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:34d05d052074cec505af31b9dafacbb2d0a4cd5558cc789aa220cb6970549c9a","observation_id":"50cf506a-f7c1-4a37-a1bf-2367ccb2b5fb","resolution":{"observed_at":"2026-08-07T12:02:44.191039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11644","last_updated":"2023-10-02T06:12:30Z","snapshot_observed_at":"2026-08-13T11:19:55.436754Z","submitted_at":"2023-06-20T16:14:25Z","title":"Textbooks Are All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11644","snapshot_observed_at":"2026-08-07T12:02:44.278334Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.278334Z"},"links":{"cited_paper":"/paper/2306.11644","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:cd51968f181c951981e5156a4d3afebee0d2717fa18022d2fe650c78def36538","observation_id":"5c4fc371-c7ee-459a-a98d-c2389ef9501d","resolution":{"observed_at":"2026-08-07T12:02:44.278334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.222809Z","title":null,"venue":null,"work_id":"ebeff5ef-0ba4-4c21-b7b1-b97f5e92e620","year":2025},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.343234Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:be3ee6021d3a3ec46a42d99d46c73db8014d89e472dccaa136d2a66783fbc6e9","observation_id":"273682e8-0e02-4749-83a5-286b9146a2da","resolution":{"observed_at":"2026-08-07T12:02:51.337098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:51.098056Z","title":null,"venue":null,"work_id":"bcad7610-1668-4995-b0d0-6cc0ff897877","year":2013},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.450715Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:aa2ca8c8346372c54611cb5a90bf5506f7e1d9acbf8c77eea78e6919a5c9d500","observation_id":"cbae3a98-ca16-4dd6-bbdd-44dca82ce701","resolution":{"observed_at":"2026-08-07T12:02:51.158245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.886121Z","title":null,"venue":null,"work_id":"ae9e17d4-e18d-4815-a395-d8227a17a47b","year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.579781Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:25aa781af46395b296b41f95a24c5982bb24aa8c11913e8bc7af8980387fdc70","observation_id":"318fbf0a-8b9e-46ba-b30e-1bc1ba27c0f1","resolution":{"observed_at":"2026-08-07T12:02:50.973844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.751248Z","title":null,"venue":null,"work_id":"a35ab409-11b6-4b52-b6a0-a6dda599e5e3","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.624950Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:4143a392baec8cd4cf2263cf440591721f5aa5f512a0d4ba383629264d6f17fe","observation_id":"0acd8fa1-ae60-42a3-a3ab-4e4fcb1837a8","resolution":{"observed_at":"2026-08-07T12:02:50.819956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.614562Z","title":null,"venue":null,"work_id":"40cf4c26-fc07-49ad-b03b-b614a2f01b34","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.680467Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:707f401d5e230e42002b75426fc96ae714469ef3f0d8ce64a1af766ff6be0f26","observation_id":"750697ef-7b14-416b-8c6e-a9e46d38f0a4","resolution":{"observed_at":"2026-08-07T12:02:50.701200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T12:02:44.774585Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.774585Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:e95d83cf4a6a19a155437d6fa48a713f3eee3fc19939d2cb14b2814065e1ac79","observation_id":"a37e638d-10f7-4dbd-a7d6-7fc50ad630ae","resolution":{"observed_at":"2026-08-07T12:02:44.774585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:44.846828Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.846828Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:a3397601ee1736ea9ab4669f3a8ef569d62b477ad1b1c09c220fe063dc6da129","observation_id":"a5c456ea-1544-4d02-b8f0-e6aad9adf624","resolution":{"observed_at":"2026-08-07T12:02:44.846828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.484861Z","title":null,"venue":null,"work_id":"17da4f82-8cd1-4a5e-9b0b-d6bd6eca7bca","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.901982Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:2fa4ec4f62b6dab3b7fa009bdb4daf3f9c93543d59a9a3164651f67aec7535dd","observation_id":"9435f877-6007-4322-a81e-c5810a4c9458","resolution":{"observed_at":"2026-08-07T12:02:50.551364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.301306Z","title":null,"venue":null,"work_id":"e7aab3f1-e553-49b8-81fe-ca351d69c447","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:44.985167Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:6a7b95a7202b99908def63c21427538ccdea8c8fef1cef90475418e735db1cde","observation_id":"81544950-e252-4a74-9359-af0383cc8fb3","resolution":{"observed_at":"2026-08-07T12:02:50.386188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:50.171147Z","title":null,"venue":null,"work_id":"66a19d44-3ef5-475f-8bd0-e505a10cfb49","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.060211Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:3e80e8b53f9e9168ce0f1dd88b9eb26aca94af0147dbb25911ee28b406c278eb","observation_id":"26eb1209-bb7b-4000-a877-b69af6dcc843","resolution":{"observed_at":"2026-08-07T12:02:50.234920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.938680Z","title":null,"venue":null,"work_id":"9a1d76c9-09be-49f1-8edf-13e43d3fdf5b","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.123893Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:2950694cb11e5f59e7318f2e61ce4d0112a24e53e79105c6c7a07b8139e80882","observation_id":"2560fe2a-3da9-4493-8ab7-659330931aed","resolution":{"observed_at":"2026-08-07T12:02:50.062140Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:45.164069Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.164069Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:4671f9dc2d39727a50403cdbccb5770751495883042ad640af7de3e34b8ac32f","observation_id":"298d0589-20bc-4e25-85c1-96296dd9b862","resolution":{"observed_at":"2026-08-07T12:02:45.164069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.775694Z","title":null,"venue":null,"work_id":"8739661b-c4ac-4c17-989e-b2d3b388f961","year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.199548Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:35b23612ffc2d58bbf5a2a376c35f7450e9c1b13b6f1a7a62b7b3b753590c9cb","observation_id":"06bf94d4-9c2f-48d7-9bff-76396c9df471","resolution":{"observed_at":"2026-08-07T12:02:49.844122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08468","last_updated":"2025-07-07T17:58:15Z","snapshot_observed_at":"2026-08-15T21:51:58.043694Z","submitted_at":"2025-05-13T11:50:08Z","title":"Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?","version":2},"cited_work":{"arxiv_id":"2505.08468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.08468","snapshot_observed_at":"2026-08-07T12:02:48.057736Z","title":"Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning?","venue":"cs.CL","work_id":"6437a691-7f8a-42f7-bb8d-f85eb7f3d273","year":2025},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.290988Z"},"links":{"cited_paper":"/paper/2505.08468","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:8e9a1e421d9e50365ac8913e83d9aa55def4ba0e6e69ba20f2a2668f291b3496","observation_id":"4a2ef83a-53bf-4b90-80a8-e7d056c11299","resolution":{"observed_at":"2026-08-07T12:02:48.093541Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.587652Z","title":null,"venue":null,"work_id":"f6f98c47-005c-43bd-9aa8-2532ab470360","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.386523Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:e3cb24a7cc861e2d23fdd8805ead24f21a9229c9d625c4dddbefe5bff88aa305","observation_id":"5cadf5ed-49d7-46e9-bd80-4030446042c0","resolution":{"observed_at":"2026-08-07T12:02:49.699229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-08-17T10:18:05.650518Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-08-07T12:02:45.447467Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.447467Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:8a0b7ef6980ecc2d0f8af5b4c24c74a5af4eab48984e204db784e35423ba6ffa","observation_id":"aff110c5-0e2c-4e02-a339-daba80ea5fbf","resolution":{"observed_at":"2026-08-07T12:02:45.447467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.404193Z","title":null,"venue":null,"work_id":"792b8986-2039-4618-b573-61539008bbb7","year":2016},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.522250Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:4171f8461c7ddf17952bcf53a48f6e3e5a81b8cd0d2344d5ac6ffd821d2d766c","observation_id":"83333015-ee06-4a8d-b60c-dfcf78e74003","resolution":{"observed_at":"2026-08-07T12:02:49.488172Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:45.662507Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.662507Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:5ec8ea7b853fe2769fdd8a3ec496fadf6045fe34b959dcd9bd52565ac31da306","observation_id":"42e80012-10ba-4cc7-8113-db1af6a125ff","resolution":{"observed_at":"2026-08-07T12:02:45.662507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:49.176279Z","title":null,"venue":null,"work_id":"425f18b5-6028-4648-82df-0bc134930426","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.735422Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:73336e6106f3bd73637caaf3ca606f3319b667c702c8b440cd2f59c8efd46271","observation_id":"2095bc52-8ce1-4095-8456-d2006553892e","resolution":{"observed_at":"2026-08-07T12:02:49.258384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.976735Z","title":null,"venue":null,"work_id":"422e3983-2df7-444d-832b-792193830465","year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.811541Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:676617406ec57429257a32863a6b0046e24738c88fab06ad4d4d3e4785ef717f","observation_id":"92117b81-12ff-469f-8f40-7013e7db6479","resolution":{"observed_at":"2026-08-07T12:02:49.070708Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-07T12:02:45.923985Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:45.923985Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:49c6a265dab54e35f07b074cb6950a96677171540deb2fda0d064d0add14f93d","observation_id":"ce3edb10-ee22-421e-b374-a70e25b9e77d","resolution":{"observed_at":"2026-08-07T12:02:45.923985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.028316Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.028316Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:1abcd1f07dc9e6aecd7add2b6315c9095e065b56fcf7f9d7b9196ca9b358dc23","observation_id":"97fa6cba-6fe9-4112-b633-bd51a6587bc9","resolution":{"observed_at":"2026-08-07T12:02:46.028316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.811998Z","title":null,"venue":null,"work_id":"24ee5036-c6d7-4a64-9100-08dbc66c0002","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.066169Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:88eb4ef2bf50c2e55882dd89fb2c98d7e5d6379c48c54a80b07f9d66bfae6ef6","observation_id":"833e2177-030b-4af2-bc95-7632073d094d","resolution":{"observed_at":"2026-08-07T12:02:48.903055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18416","last_updated":"2024-05-01T17:12:10Z","snapshot_observed_at":"2026-07-06T18:06:49.190172Z","submitted_at":"2024-04-29T04:11:28Z","title":"Capabilities of Gemini Models in Medicine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18416","snapshot_observed_at":"2026-08-07T12:02:46.105692Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.105692Z"},"links":{"cited_paper":"/paper/2404.18416","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:e610a22213639a0153544af6727fac132a261ec3ea0449017c7f5df20ab8a388","observation_id":"26328e55-814b-46e0-b17c-7f2f17807602","resolution":{"observed_at":"2026-08-07T12:02:46.105692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.631033Z","title":null,"venue":null,"work_id":"8745b42a-5d5a-447b-b140-6cca8f4a3797","year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.175013Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:6964dca9e1a99a76b77951a4c0950dee7b88c57ace43eb5e2f8cd8590bd68441","observation_id":"e1eb2724-5824-4238-ae81-2151f47b44b0","resolution":{"observed_at":"2026-08-07T12:02:48.696990Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T12:02:46.272794Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.272794Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:f6d34cb520e5fa20102cde0f17a1334ecc7f323253ee2ba39652744011ec5bd4","observation_id":"a1c00059-8291-4ba1-8775-412fa7dbda72","resolution":{"observed_at":"2026-08-07T12:02:46.272794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.473916Z","title":null,"venue":null,"work_id":"3e65b9c5-d014-4aa8-8463-8537543d487b","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.351173Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:3cd3783799c578abd1001ad0c668b639a1d4124086d61c2bf56113b75938f62b","observation_id":"ae4979be-f501-4ceb-9281-b6eb49557a47","resolution":{"observed_at":"2026-08-07T12:02:48.559413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T12:02:46.447687Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.447687Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:38172928ea085baf4784145ab51a4ac46283c69ff022e532d2d04a0d201629dc","observation_id":"314fb2e5-19f0-4af3-9c87-50d91fa7f7fd","resolution":{"observed_at":"2026-08-07T12:02:46.447687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:02:46.559562Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.559562Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:53a6154bb0b1af0bf1ee612099c5310fab295dd93b51401a5df966bb0b7b66c8","observation_id":"e742cba8-03c6-46fa-b04f-7a509c554f3c","resolution":{"observed_at":"2026-08-07T12:02:46.559562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.635872Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.635872Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:7dbf97fb3b90bd77e365772efde83cb2b2ad1e67c1e134371c59b9ddb2a22cc4","observation_id":"68bca6ec-97b6-4e23-84de-f71a635099d1","resolution":{"observed_at":"2026-08-07T12:02:46.635872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:46.689377Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.689377Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:56347c4d070b076d7e8a15305cb18ef9a09fc3b0d6aef6271debf28c219994c6","observation_id":"a894cab8-c0f5-4d16-a157-c7161b72cab6","resolution":{"observed_at":"2026-08-07T12:02:46.689377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.40","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"0ad8ee83-3650-4be2-81a9-465f296158bb","year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.767706Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:e12cff5e40fd23f84f1a9aece21a2c58ad4f700fba2024bc8bf5e7da20cd40af","observation_id":"4663eb2b-2686-445f-a5d7-a8a7b0df7032","resolution":{"observed_at":"2026-08-07T12:02:47.762727Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T12:02:46.842724Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.842724Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:677fa9085281f0f90e606ff93c9dc7f0639222f2a08bcfe26b25ab5cb9ba5d5c","observation_id":"30c32547-5fa8-4a28-bec9-fa48dd432be1","resolution":{"observed_at":"2026-08-07T12:02:46.842724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:02:46.912360Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:46.912360Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:f76b0e9189f4253bff31268137289faa6ee826bd37102cdd4e336de6b659782d","observation_id":"95adc132-2783-4092-a826-74124f853fc3","resolution":{"observed_at":"2026-08-07T12:02:46.912360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-17T18:51:13.219936Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T12:02:47.010722Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.010722Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:db47b8681442be266aad670ba5b89519332586d3d80fcbaaa37d6d0cdc60cb9c","observation_id":"58ebfe33-87a9-4cf2-acb7-27659c5495b8","resolution":{"observed_at":"2026-08-07T12:02:47.010722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.084587Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.084587Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:3a8d607bee96f5643b45e6b4113eb4cd2370bb785e98d9033a3a40aa17949b1b","observation_id":"04287b94-8cbe-4d13-a478-4cbb1f7b122d","resolution":{"observed_at":"2026-08-07T12:02:47.084587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T12:02:47.192473Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.192473Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:914842b3647252a39437160da6009bb0436945f5b344208d4637d97d5495b535","observation_id":"82a3b566-caff-4747-837c-9698baec91c2","resolution":{"observed_at":"2026-08-07T12:02:47.192473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.241849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.241849Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:b3e5031c1c5447978d7b6327195f42d5cf619c09bea12170bd4ae9d12cfcf673","observation_id":"b3160186-47ab-43f5-aa75-3981d65cb121","resolution":{"observed_at":"2026-08-07T12:02:47.241849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:48.284617Z","title":null,"venue":null,"work_id":"f0715aff-d948-4d2a-a6e4-606f697cf018","year":2021},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.356554Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:c79d308ac5bcb4dab9ce3246a815f716b4cd0fe0e53bc7191236a846b2bc3ebc","observation_id":"29b03e43-fffa-4182-a8a2-54e8643a8ea0","resolution":{"observed_at":"2026-08-07T12:02:48.359311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.459081Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.459081Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:55efee4069f5f6a8d1a502a84f7c282e40891e2415ca2ec96e18d4a1057caa92","observation_id":"fa99093f-eff0-48e5-8bd8-ad20e2821bd3","resolution":{"observed_at":"2026-08-07T12:02:47.459081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:47.526084Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:47.526084Z"},"links":{"citing_paper":"/paper/2506.00777"},"observation_digest":"sha256:0f8986d73d81e875edaf5000bb99201847943a5a90e59971969b4f820e08e24e","observation_id":"65b484b4-22af-470f-9f3e-ec5db528a1a3","resolution":{"observed_at":"2026-08-07T12:02:47.526084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00777","last_updated":"2025-06-01T02:01:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T08:41:16.225446Z","submitted_at":"2025-06-01T02:01:52Z","title":"Improving Automatic Evaluation of Large Language Models (LLMs) in Biomedical Relation Extraction via LLMs-as-the-Judge"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 2 inbound Pith citation observations for arXiv:2506.00777."}