{"as_of":"2026-08-10T19:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d0921c3ddd7074c56de6311a7bb2ae3066b9809f24cc7d86700676a12700b9f","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T02:57:48.186085Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.03322/citation-record","integrity":"/paper/2603.03322/integrity","json":"/paper/2603.03322/citation-record.json","paper":"/paper/2603.03322"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.219382Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.219382Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:2aa9ed6d2dfdf8b96bb6bb0a8d56c65ba3159a36196dd739a26ddb5c4023c35d","observation_id":"ac949c24-b965-40e5-bee2-80a8acf9153d","resolution":{"observed_at":"2026-08-03T02:57:46.219382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.247969Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.247969Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:003fb4628a81bcd23e829d957b7e5635c55b3d97a5a4714ee28198a74c45196f","observation_id":"ab5bf0d7-1d06-4f90-b159-0e736a4284fb","resolution":{"observed_at":"2026-08-03T02:57:46.247969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.287331Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.287331Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:540b9cd83e6794b9a73fb2eb02faa4bf718c082d3264b5cbcb9d21c46453859b","observation_id":"0fa86ca3-6459-4274-80c4-7540767bfe6f","resolution":{"observed_at":"2026-08-03T02:57:46.287331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15224","last_updated":"2026-05-29T09:49:21Z","snapshot_observed_at":"2026-08-07T17:59:49.245849Z","submitted_at":"2025-02-21T05:35:20Z","title":"Auto-Discovery-Bench: Diagnosing Structured State Tracking in Oracle-Guided Discovery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15224","snapshot_observed_at":"2026-08-03T02:57:46.329763Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.329763Z"},"links":{"cited_paper":"/paper/2502.15224","citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:19c04b86966d3da444fa475bf9433e5bfa8c617f5e4eb950010910ce59962377","observation_id":"2521bfe5-dcce-40cb-8f6b-5df0d432c0c7","resolution":{"observed_at":"2026-08-03T02:57:46.329763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.362735Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.362735Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:ac55f82ec7949540f14ba965309d9c908c20bdda93c5463da4249efcd9f6c888","observation_id":"1e21c3aa-1a23-4284-9662-4ceadb256fe5","resolution":{"observed_at":"2026-08-03T02:57:46.362735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-03T02:57:46.447146Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.447146Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:f8f7230639d95acc30a7a80681cf2a7e31983e989db7097b5991299640b89d0e","observation_id":"1753ccaf-3cf6-4db5-8811-efb37c7c2d9c","resolution":{"observed_at":"2026-08-03T02:57:46.447146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.488860Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.488860Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:f9b42e2837f6f4e502d5b9bc05c890854116df6ddb3978e3f31cdaf510907c94","observation_id":"2b1f11a8-0eac-4569-a87b-16d86af7abba","resolution":{"observed_at":"2026-08-03T02:57:46.488860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.521104Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.521104Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:79f4350e5254af471fd523ab4724d6bbcf90e04dc73cee2ecd6d26cc81b39944","observation_id":"d19e02c4-3ca3-4e98-8bdf-c783f4ded4eb","resolution":{"observed_at":"2026-08-03T02:57:46.521104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.556890Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.556890Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:748f6dc1638b4cd79aceb1f4f6a4dbfb1dc1a6ffa90fbfc6e076158d18e72d50","observation_id":"72b10248-b57b-404d-af0d-3bd6302d21d3","resolution":{"observed_at":"2026-08-03T02:57:46.556890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.587787Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.587787Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:c0f553705c6dd12ac7c63244ac6af8a5ce09101db31766e3faa373c7349a8c46","observation_id":"6917a371-ad60-4992-ad86-c9adc70a38bd","resolution":{"observed_at":"2026-08-03T02:57:46.587787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.631426Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.631426Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:7accb02680744d9f0485d1c4b31bcd029a7f47acbf49c70c3978aa6290b9453d","observation_id":"a2dc1f4b-f513-4cab-a0a8-4ef3bcda89e5","resolution":{"observed_at":"2026-08-03T02:57:46.631426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.656705Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.656705Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:30e2d8ebb22f20061796fed802332f3d39a3a5edccb006495cfc24b150507a9c","observation_id":"2e6c03f5-7837-4694-8621-0175933269c1","resolution":{"observed_at":"2026-08-03T02:57:46.656705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.691160Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.691160Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:a572eb23bf270392809a5ed3298a319c72d09da49a5f379c0f20bf85f16237bd","observation_id":"ad2318a4-ae72-409f-96ca-ee5a8cdf02b7","resolution":{"observed_at":"2026-08-03T02:57:46.691160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09321","last_updated":"2025-09-11T10:10:48Z","snapshot_observed_at":"2026-08-09T07:35:26.627440Z","submitted_at":"2025-09-11T10:10:48Z","title":"Towards Adaptive ML Benchmarks: Web-Agent-Driven Construction, Domain Expansion, and Metric Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09321","snapshot_observed_at":"2026-08-03T02:57:46.718690Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.718690Z"},"links":{"cited_paper":"/paper/2509.09321","citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:6a6bd653c2d2b52ccb40adc778e3258aa8c3ead7b6e2d366156306b7e5324047","observation_id":"83bb601f-f2dc-4200-ba0d-534fbcd87854","resolution":{"observed_at":"2026-08-03T02:57:46.718690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.759886Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.759886Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:3fce2f648fd39a3b05ea5c90bcd286932d341b41e1ac3a5e8ffec0e5a13d6b18","observation_id":"d9d6cde4-505b-4b47-94ca-50d63bc87fed","resolution":{"observed_at":"2026-08-03T02:57:46.759886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.791895Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.791895Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:a9695ad1489a9190a0f6a1ddde31f942a30be2fef955d9ab69bead02ee72a055","observation_id":"75d8c7af-6629-4251-9f59-aa0b9a7509f1","resolution":{"observed_at":"2026-08-03T02:57:46.791895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.822473Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.822473Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:799d321d8a5797d3579568c876b79d667a7597f2d2e8a54eb13882bc7b4eab28","observation_id":"a998b67d-069c-49b6-bc86-9fe37cdd1795","resolution":{"observed_at":"2026-08-03T02:57:46.822473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.865515Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.865515Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:d5d3aaf70eb7e0d9e861189048157c6e7c6aecde9ceb0fc76d92d50fe2da3c44","observation_id":"267ccfa0-6f78-442a-8c27-e128d0a137b2","resolution":{"observed_at":"2026-08-03T02:57:46.865515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-08-03T02:57:46.893753Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.893753Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:6d89bd21950e1b797c68e5b68cc3484cfdf7b0e4416f6af0c03f7151ab877b11","observation_id":"a261c4ad-6932-4249-9185-d9ea76e54f92","resolution":{"observed_at":"2026-08-03T02:57:46.893753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21248","last_updated":"2026-04-20T16:53:43Z","snapshot_observed_at":"2026-07-06T20:59:31.273397Z","submitted_at":"2025-03-27T08:09:15Z","title":"ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21248","snapshot_observed_at":"2026-08-03T02:57:46.930452Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.930452Z"},"links":{"cited_paper":"/paper/2503.21248","citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:a8285b45a1bdf6d3ea80ac610e4ef19e8625b12b29ff9e6369ca5287ede5d5bd","observation_id":"87d68fee-abb4-4001-ae3f-6ece1f560ad4","resolution":{"observed_at":"2026-08-03T02:57:46.930452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.966417Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.966417Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:816be30df389ca8735af2d0ce0503f98e143401a981092541bc946a430bad45f","observation_id":"4ff58efd-6207-43a4-9340-debcfd93a56f","resolution":{"observed_at":"2026-08-03T02:57:46.966417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.007554Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.007554Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:65bd9be80f5ab8da39182309ed4a6b9a21af4f335c367bde1dfd72aca0fed199","observation_id":"5510b165-971a-4b7e-bdce-bbfd51746561","resolution":{"observed_at":"2026-08-03T02:57:47.007554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.049859Z","title":"2025.Introducing GPT-5.2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.049859Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:185c738bf9dc216a87c64504cfd08bc49c49f2cec02fe249d2b8963664d9011b","observation_id":"dc50af80-1460-4b07-9db6-5d3d4f032f59","resolution":{"observed_at":"2026-08-03T02:57:47.049859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-08-03T02:57:47.753290Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.753290Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:a7de4994a3d878d760895c1f3afab755ce6e52f7d7ebe714c3e3af4e840befd5","observation_id":"9dd84299-2207-4d55-83a7-719e9c08e796","resolution":{"observed_at":"2026-08-03T02:57:47.753290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.910873Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.910873Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:23d00987f3b580aee175f0855e37cd439e66bd43e1993d756b276cd272dcf90d","observation_id":"78fbdf71-4efe-46d9-94d8-4956cc1f7693","resolution":{"observed_at":"2026-08-03T02:57:47.910873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.932452Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.932452Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:543ba7f8e8e45bc4eb9e2a1af76cc8e06664fcdab34cc31b3856920b119cfe6e","observation_id":"2f4da02f-b62d-4c63-86f3-bd876671a475","resolution":{"observed_at":"2026-08-03T02:57:47.932452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.941964Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.941964Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:f53d62596627caa1843df9d8389a5a0659405473d515d2ef7f15278dbbb8b8a6","observation_id":"0d61141c-3d81-4daf-bd17-8f5010c9abb9","resolution":{"observed_at":"2026-08-03T02:57:47.941964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09939","last_updated":"2024-07-10T01:25:50Z","snapshot_observed_at":"2026-07-06T18:15:11.806744Z","submitted_at":"2024-05-16T09:42:37Z","title":"SciQAG: A Framework for Auto-Generated Science Question Answering Dataset with Fine-grained Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09939","snapshot_observed_at":"2026-08-03T02:57:47.951224Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.951224Z"},"links":{"cited_paper":"/paper/2405.09939","citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:a46238820cce155a2ed4c03af24eca789469df08a938d859fb59cf48ec0ed482","observation_id":"468a4674-b87b-4830-a98f-0092981ab8a1","resolution":{"observed_at":"2026-08-03T02:57:47.951224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.958922Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.958922Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:c205eac4835552c6cc4bdb78ee637ad9e8fad9759b662bb3edc8f31a0b2ca113","observation_id":"9384930d-23da-4230-a176-4a7ccd7fbc0a","resolution":{"observed_at":"2026-08-03T02:57:47.958922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.968312Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.968312Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:442626bee5b5bba2b609dc5924bec62400c5d9fcd563665356231ac3512e1b77","observation_id":"66b0a147-8266-4b39-8811-2cd390b914c5","resolution":{"observed_at":"2026-08-03T02:57:47.968312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.979745Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.979745Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:03fb7381f4adbea8a4d69d9b8bfc82a586e4bd347c0aa89fc62948cab9ed729c","observation_id":"d053d8c4-6ec5-435d-8041-23409d120e63","resolution":{"observed_at":"2026-08-03T02:57:47.979745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.997321Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.997321Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:7cef9f11ecf4175dc8c559fc632517524708cecb3f0095ec6dfc3bbecf37d0cc","observation_id":"f48351a9-aac9-40e3-a395-36cd15817a03","resolution":{"observed_at":"2026-08-03T02:57:47.997321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.005684Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.005684Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:e3f756bb46ca103f49c78ef6511fa0e6a7ac89eefc3e62f1acde671d6433f7ca","observation_id":"615f3591-81e1-4c6d-b66c-74ddc27b930a","resolution":{"observed_at":"2026-08-03T02:57:48.005684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11987","last_updated":"2025-09-05T09:15:55Z","snapshot_observed_at":"2026-08-05T19:39:12.827378Z","submitted_at":"2025-08-16T08:54:08Z","title":"FutureX: An Advanced Live Benchmark for LLM Agents in Future Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.11987","snapshot_observed_at":"2026-08-03T02:57:48.014062Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.014062Z"},"links":{"cited_paper":"/paper/2508.11987","citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:e166a84d522e8d12761b28a0a1baac081f609363f071ddb61e6cb0388381003a","observation_id":"4086e844-9e3c-4fcb-a18a-802f58fa529d","resolution":{"observed_at":"2026-08-03T02:57:48.014062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.021538Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.021538Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:8c0ab48063355c3c612c2b57385d55478b41e6370d155bfea16dfd7897a7f82f","observation_id":"da5a33cc-c970-4806-9fde-53b05b7bea7d","resolution":{"observed_at":"2026-08-03T02:57:48.021538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.026947Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.026947Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:5167ec61d9d2ce18727960adbf58ac20fc4ca433dcae9077821bf80d2b17b92a","observation_id":"aba3bf65-62d5-409e-9962-1f525c224dc9","resolution":{"observed_at":"2026-08-03T02:57:48.026947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.036318Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.036318Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:719908c1a3bbb6e3b3eba2b65639b64b58b6aa656aeb6fa401cb3d6207c67650","observation_id":"3c25a10d-7ebc-46ce-9800-5a21113a7777","resolution":{"observed_at":"2026-08-03T02:57:48.036318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.043552Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.043552Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:733505a7db696d97a484e8de8440dde7b4ee3095d23bd1f947e3f29683c8b218","observation_id":"348d7729-7552-4639-88ec-5b0222ac39c8","resolution":{"observed_at":"2026-08-03T02:57:48.043552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.049286Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.049286Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:9a46072f3a47a7dba603098b1a1a9589ba0f81021669c662f750dff3ef6d8107","observation_id":"022e461d-c5b2-461b-9c2b-855557474690","resolution":{"observed_at":"2026-08-03T02:57:48.049286Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.058425Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.058425Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:7abc16aa73eef538312946727fdf83e76a0bcb6fe05ceb8877717c22abc5477c","observation_id":"b015dde8-ad88-4f57-a3bc-efaf4c9b26c9","resolution":{"observed_at":"2026-08-03T02:57:48.058425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.081618Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.081618Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:3bfe1ae9ee14ac0b5889546719dfa625cb7ffc748f8dba043056d4333af1015d","observation_id":"19d6034f-c62e-422a-9baa-30fd384b689e","resolution":{"observed_at":"2026-08-03T02:57:48.081618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.122761Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.122761Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:ef4878e0c142b1810d18f4c3a7fff194ec469774c42392b874fc9471efb43b18","observation_id":"07d7752e-b5f5-49ee-ac70-084ad6eac116","resolution":{"observed_at":"2026-08-03T02:57:48.122761Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.140678Z","title":"•GPT-5-Mini: Released on August 7, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.140678Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:45b663ef86c91c835571621e63cb2bc5ce53e48c5496a5eea2b34166aa38a932","observation_id":"6a925548-cbb9-42ef-a259-0ae2b4cff399","resolution":{"observed_at":"2026-08-03T02:57:48.140678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.147157Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.147157Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:0c451f426fffe2e7d8c3bcae989c52a740948a7c4cf140f41452357810875192","observation_id":"dc6bbddd-c63f-4405-bfb2-8496ee2200a3","resolution":{"observed_at":"2026-08-03T02:57:48.147157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.168526Z","title":"Does X regulate Y phenomenon ?","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.168526Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:928122d90ae7f3a7b4d94bfe410cc150aa5094a422167384648596583d41b9db","observation_id":"af6db63d-e02a-471c-8c9c-fe42de19c7ff","resolution":{"observed_at":"2026-08-03T02:57:48.168526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:48.186085Z","title":"based on the text","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:48.186085Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:41d38ad593dac2602a151a5d80355c4c1a1550f4973c34f0949577c2ad6e6906","observation_id":"d14b253a-e063-4066-8e0c-45b4dc8fdebd","resolution":{"observed_at":"2026-08-03T02:57:48.186085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:46.405511Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:46.405511Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:868158a590bc4c5ea989aabe18830399361a7639519a3ec8d740755f3e6005bb","observation_id":"ab696429-6bc7-429b-86ed-2b77c2214e1f","resolution":{"observed_at":"2026-08-03T02:57:46.405511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:57:47.989428Z","title":"In The Thirteenth International Conference on Learning Representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T02:57:47.989428Z"},"links":{"citing_paper":"/paper/2603.03322"},"observation_digest":"sha256:f16bda6982ed0e337367b8e93af8c558d4ce0be6458a3587d35f4bfd3c257969","observation_id":"57c3caf0-83f5-49bb-9e5b-b24517861ea1","resolution":{"observed_at":"2026-08-03T02:57:47.989428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.03322","last_updated":"2026-07-31T08:12:53Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T10:49:25.218764Z","submitted_at":"2026-02-10T05:47:22Z","title":"Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":2,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2603.03322."}