Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-15T20:21:14.773467Z
Paper Citation Record · LEDGER
As of 18 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:2505.13220.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-15T20:21:14.773467Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-18T06:34:40.430872+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-07T14:00:32.650100Z
A source-named dated measurement, never combined with another source.
Source: arxiv_reference, observed 2026-05-21T05:23:58.557619Z
36 of 36 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation 734619c6-c26e-41ba-8da2-b8553f9b2da1 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science online" 'onlinestring :=
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 407b5cd4-3e1d-4d40-a927-b198c2f970e2 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science write newline
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1d2b756a-98f1-4628-b1b7-23e083bdce9d · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science GPT-4 Technical Report
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a8515b7a-d8d3-4f20-949b-4ec1e5f925ce · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Leveraging Vision Language Models for Specialized Agricultural Tasks
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 88676b39-5b18-4065-bba1-de77d926830f · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science InternLM2 Technical Report
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3b84247e-1e81-463f-b92d-a5e0a6498418 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f2500695-017e-47e9-8334-ded57ec4ee7f · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1f76dad8-6f8a-4b53-ab3e-8ee826c5017b · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 8
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation 91a469c6-ff76-4006-89df-22754ca335a9 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation 3977866f-e066-4ffe-9821-a9369eb9104a · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 09316f19-e126-4631-9b35-41e9acf1c2c7 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science The Llama 3 Herd of Models
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2e5486c9-cd51-4f6b-bbf5-3ca25eb4878e · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Egan, Rainer W
Reference 12
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation 50048c15-5e43-4fc5-90a9-6deab40bf054 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 13
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation c61368f9-52c6-4252-a89e-b0d2c536b5eb · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9ba389d9-c383-41b5-b89b-4bdccabc55ea · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5304b0d5-e948-4a47-882f-82203d783605 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 587ac67b-0cb8-4b22-a540-bdf830950050 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 17
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation 0a7f4259-bd77-4fef-96c0-3543b684fe85 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Mistral 7B
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0a3cce52-a201-4d11-a48f-416ffc7db0ae · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 19
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation 7bdf3aa7-5614-423d-a35e-470d7e8a2e2d · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 20
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation 6524a129-9d29-42c5-b148-9321f7edacbb · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science GeoGLUE: A GeoGraphic Language Understanding Evaluation Benchmark
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c589ca0f-51f8-421a-bb52-c4176dc7036b · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation eaa13cfe-5be9-41cc-99b1-c2fd6569af07 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 23
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation 86273e81-4b0a-4b92-a63b-935b8d22e960 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science DeepSeek-V3 Technical Report
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 012e69ab-39e4-4e3f-8b45-f9fff0871489 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation 46115f4d-2b29-4f94-9ac4-8f1452b3fac9 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1c267698-b3d1-4a40-83b7-80889d7f144b · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 85960fbd-dd3e-4cb0-9b14-8192fa76a14e · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 857dfd14-86c7-47fa-bd9d-63ec2a96b3ae · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science MinerU: An Open-Source Solution for Precise Document Content Extraction
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d1b4a90b-7513-416a-8aa0-e83149fe20fa · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science CCI3.0-HQ: a large-scale Chinese dataset of high quality designed for pre-training large language models
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8e0d1afd-c041-4579-8548-a9bff1c88e8e · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 31
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation 8f0d257b-5fa2-4fb8-adeb-2da3b1377207 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science FinBen: A Holistic Financial Benchmark for Large Language Models
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1817fb0f-c21a-41f9-9242-b36b312513dd · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Qwen2.5 Technical Report
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5a8d0a9c-7f8a-4453-b710-43b5aab98d30 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science PLLaMa: An Open-source Large Language Model for Plant Science
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8423a07c-a668-4f3a-8980-45457e22ced9 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work
Reference 35
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.
Observation b5e2442d-5ad2-4a68-b5a2-a3d8ae457114 · outbound
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Instruction-Following Evaluation for Large Language Models
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 236b59b8-3ae9-4f02-940c-250ec8b3a712 · inbound
GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science
Reference 37
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 60103591-8c2b-4d6b-ae81-df123e72c32d · inbound
Focus-then-Context: Subject-Centric Progressive Visual Token Reduction for Vision-Language Models SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science
Reference 36
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.