Pith. sign in

Paper Citation Record · LEDGER

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science

As of 18 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:2505.13220.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.13220 v1

Coverage vector

measured 36 of 36 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T20:21:14.773467Z

measured 38 of 38 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-18T06:34:40.430872+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:00:32.650100Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-21T05:23:58.557619Z

Reference resolution

36 of 36 outbound references displayed

  • verified exact0
  • verified fuzzy1
  • unresolved35
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 734619c6-c26e-41ba-8da2-b8553f9b2da1 · outbound

This paper cites online" 'onlinestring :=.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science online" 'onlinestring :=

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.632792Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.632792Z digest=sha256:8596e0d5c1502b06d5f55f796f64e66c85b4ed739a7ca5eafb6f04628569a7e7

Observation 407b5cd4-3e1d-4d40-a927-b198c2f970e2 · outbound

This paper cites write newline.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science write newline

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.637557Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.637557Z digest=sha256:ff8a960485dbfdda47dbdf4a93b1763fa5c1326aac6a6b73026d7a3150759a78

Observation 1d2b756a-98f1-4628-b1b7-23e083bdce9d · outbound

This paper cites GPT-4 Technical Report.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science GPT-4 Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.642195Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.642195Z digest=sha256:180e9f3b3001f7b21a4205888cb2cf8f0982e06fbc4ed02d95d5ba5c2463b617

Observation a8515b7a-d8d3-4f20-949b-4ec1e5f925ce · outbound

This paper cites Leveraging Vision Language Models for Specialized Agricultural Tasks.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Leveraging Vision Language Models for Specialized Agricultural Tasks

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.646632Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.646632Z digest=sha256:26a308f5826db3b4e60a61da5e968d7d6bd16be55f72e04e09a849d8438a193c

Observation 88676b39-5b18-4065-bba1-de77d926830f · outbound

This paper cites InternLM2 Technical Report.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science InternLM2 Technical Report

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.651171Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.651171Z digest=sha256:11947c609631f865b7a3936a1f118d3eb97aa44c5a52063f95b2509c37eb9e11

Observation 3b84247e-1e81-463f-b92d-a5e0a6498418 · outbound

This paper cites GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.656584Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.656584Z digest=sha256:57df76dc6ac89ce32662fba9e552101e41af999a1a65c0c4231b4b2a865559cc

Observation f2500695-017e-47e9-8334-ded57ec4ee7f · outbound

This paper cites Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.660891Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.660891Z digest=sha256:a9643edf3699598527c9f6c8ccb55f5cb0b9bb066f7fc2eae3c427b307012b58

Observation 1f76dad8-6f8a-4b53-ab3e-8ee826c5017b · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.190897Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.664981Z digest=sha256:041dbff82ad21b7c9f461ce65122ef3923f17978f4e2f8a5ee9dd597a451d89b

Observation 91a469c6-ff76-4006-89df-22754ca335a9 · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.176461Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.669054Z digest=sha256:3569b899617f612f447eed58c105db017915ea443785c081ba13d564da7b536f

Observation 3977866f-e066-4ffe-9821-a9369eb9104a · outbound

This paper cites BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.673176Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.673176Z digest=sha256:8b067cc41a9ab22b30ab3b80f739beaad523c15020cf70941866f629b2d8381c

Observation 09316f19-e126-4631-9b35-41e9acf1c2c7 · outbound

This paper cites The Llama 3 Herd of Models.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science The Llama 3 Herd of Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.677212Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.677212Z digest=sha256:e0f3c3f22c62a5dcb4ca18cf425ac898f4820b98ea9bff3e016cf98f1344d89e

Observation 2e5486c9-cd51-4f6b-bbf5-3ca25eb4878e · outbound

This paper cites Egan, Rainer W.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Egan, Rainer W

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:21:15.164656Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.681425Z digest=sha256:acabe385648e9da6a595fa4f23e0059b6778039a8e5c92a707daf8758e4de3e6

Observation 50048c15-5e43-4fc5-90a9-6deab40bf054 · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.152680Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.685146Z digest=sha256:07675f24159c1593e05af3bf3ebaf2ebb27903c3df89012bae689b652689c045

Observation c61368f9-52c6-4252-a89e-b0d2c536b5eb · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.689110Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.689110Z digest=sha256:668e3c3e246bbab1f773372e7b2cbc15359a594dd6636d0ac25e3f80fa09cb6e

Observation 9ba389d9-c383-41b5-b89b-4bdccabc55ea · outbound

This paper cites ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.692731Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.692731Z digest=sha256:d93d77d68acdda916ae005696236a159b20bf9ead2e9e68f41bbf23fb6c1acf4

Observation 5304b0d5-e948-4a47-882f-82203d783605 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.696600Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.696600Z digest=sha256:8f2e7ee975ceaa0c1d11903570dbd95bb512a08c69e9af5a685c21406d7dc4c4

Observation 587ac67b-0cb8-4b22-a540-bdf830950050 · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.132867Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.700402Z digest=sha256:f44df5c42f7f3da0918a4387ca03e22716a27ba40ce72b8ef0248ce106ee5440

Observation 0a7f4259-bd77-4fef-96c0-3543b684fe85 · outbound

This paper cites Mistral 7B.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Mistral 7B

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.703955Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.703955Z digest=sha256:5705f1da4205d4ff6ff827917bd17a302193166b432be6776a9adbb34789d00c

Observation 0a3cce52-a201-4d11-a48f-416ffc7db0ae · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.120450Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.708098Z digest=sha256:dbddab05790b5722f9a16358d58b432ae71d8a685ac7e265ab969217cbf96771

Observation 7bdf3aa7-5614-423d-a35e-470d7e8a2e2d · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.108513Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.712005Z digest=sha256:a6f170772d146e97d4e21ac6a28e908f2c25f804858bd5d6d7cc95981b64583a

Observation 6524a129-9d29-42c5-b148-9321f7edacbb · outbound

This paper cites GeoGLUE: A GeoGraphic Language Understanding Evaluation Benchmark.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science GeoGLUE: A GeoGraphic Language Understanding Evaluation Benchmark

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.715998Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.715998Z digest=sha256:72bd90c6a91cc6d149979fd9326067626c647281b34c7c09f9b7376a7d550962

Observation c589ca0f-51f8-421a-bb52-c4176dc7036b · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.720686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.720686Z digest=sha256:28bad21aba2377f0870951407982fa3f1c0b30c28a528b4102bcd42e8c8f5924

Observation eaa13cfe-5be9-41cc-99b1-c2fd6569af07 · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.088075Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.724360Z digest=sha256:043482bd03e61df6980ab8eeed32342660ea08703723bd8324a775bf281053da

Observation 86273e81-4b0a-4b92-a63b-935b8d22e960 · outbound

This paper cites DeepSeek-V3 Technical Report.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science DeepSeek-V3 Technical Report

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.728133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.728133Z digest=sha256:0d77fd861d6e9d98be5d53216024b735c31d5871e271c4cf2743053db668b8c2

Observation 012e69ab-39e4-4e3f-8b45-f9fff0871489 · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.075964Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.731772Z digest=sha256:15c4946ed7344077f2d6cf530a9a6e16c43a950eaef341f46f866c0b432189e6

Observation 46115f4d-2b29-4f94-9ac4-8f1452b3fac9 · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.735425Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.735425Z digest=sha256:3b07e0b958f8508bac989195589f64205f2b6c534ce2b7fea56eb81bf707e68f

Observation 1c267698-b3d1-4a40-83b7-80889d7f144b · outbound

This paper cites Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.738908Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.738908Z digest=sha256:c7c4cd6e4f20efac1b82b610af40d0d17fa777012085fb0dd5c12a77ae260d86

Observation 85960fbd-dd3e-4cb0-9b14-8192fa76a14e · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.742744Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.742744Z digest=sha256:c5745e05de72c68659800fc4b7666935eb9d8cca6c41c10d050a00dad48d1fb6

Observation 857dfd14-86c7-47fa-bd9d-63ec2a96b3ae · outbound

This paper cites MinerU: An Open-Source Solution for Precise Document Content Extraction.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science MinerU: An Open-Source Solution for Precise Document Content Extraction

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.746312Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.746312Z digest=sha256:024db593602ba66026cb71aab7371a4fa056a389d06678f4e0cf0d36704d05d2

Observation d1b4a90b-7513-416a-8aa0-e83149fe20fa · outbound

This paper cites CCI3.0-HQ: a large-scale Chinese dataset of high quality designed for pre-training large language models.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science CCI3.0-HQ: a large-scale Chinese dataset of high quality designed for pre-training large language models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.749939Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.749939Z digest=sha256:e599683a239937de1f074898be2ebc5e09fc96c3d63fa959f56f84912f20d049

Observation 8e0d1afd-c041-4579-8548-a9bff1c88e8e · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.047829Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.753527Z digest=sha256:a1a11bc8979635cffc4e963037c882d2d72179622b86856cc25c33ec72a8f57a

Observation 8f0d257b-5fa2-4fb8-adeb-2da3b1377207 · outbound

This paper cites FinBen: A Holistic Financial Benchmark for Large Language Models.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science FinBen: A Holistic Financial Benchmark for Large Language Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.757206Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.757206Z digest=sha256:beefcbc3c6a6e61d00cd253a8e193e70e3201e9ee39e1617faad79e501a8744c

Observation 1817fb0f-c21a-41f9-9242-b36b312513dd · outbound

This paper cites Qwen2.5 Technical Report.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Qwen2.5 Technical Report

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.761160Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.761160Z digest=sha256:0b70113dc8ed47edcdf7c5cc94c2c2a2c32ebb12c9679f2612579cd3beac2234

Observation 5a8d0a9c-7f8a-4453-b710-43b5aab98d30 · outbound

This paper cites PLLaMa: An Open-source Large Language Model for Plant Science.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science PLLaMa: An Open-source Large Language Model for Plant Science

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.765013Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.765013Z digest=sha256:4c3aad5814eca4e27e35826452c59e2e28317ee9724d8a1a2e776689b2d2be71

Observation 8423a07c-a668-4f3a-8980-45457e22ced9 · outbound

This paper cites an unresolved cited work.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-15T20:21:15.034623Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-08-15T20:21:14.769331Z digest=sha256:ee6d73f586f0d442fc6befa7a7ed7f1bcde0e58d47f6616c5cc7cc81978609bb

Observation b5e2442d-5ad2-4a68-b5a2-a3d8ae457114 · outbound

This paper cites Instruction-Following Evaluation for Large Language Models.

SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science Instruction-Following Evaluation for Large Language Models

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-15T20:21:14.773467Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T20:21:14.773467Z digest=sha256:9dbf840fb6115acd25f489b424b162ce34382a4d00a63637a12bc75c2a4cc888

Pith citing papers

Observation 236b59b8-3ae9-4f02-940c-250ec8b3a712 · inbound

GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation cites this paper.

GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T14:00:32.650100Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:00:32.650100Z digest=sha256:7a035f3dce249e5fef8f18c027f019d16a010c2b4e5fc6eddf570dc9d22ca7a7

Observation 60103591-8c2b-4d6b-ae81-df123e72c32d · inbound

Focus-then-Context: Subject-Centric Progressive Visual Token Reduction for Vision-Language Models cites this paper.

Focus-then-Context: Subject-Centric Progressive Visual Token Reduction for Vision-Language Models SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-05-21T05:23:58.559256Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=arxiv_source observed=2026-05-21T05:20:55.448430Z digest=sha256:1310adb51343c395a8e08ce8a6db97e3399faac97a76ce8e6981fc5091647cef