{"as_of":"2026-08-14T10:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a04d2b2e56328400880db6806aa31f9e7f280f07d304947b95c9db0a085a32d3","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:58:03.429016Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.14497/citation-record","integrity":"/paper/2411.14497/integrity","json":"/paper/2411.14497/citation-record.json","paper":"/paper/2411.14497"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-12T15:58:03.107270Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.107270Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:38d2f7e4d83b0e11454f68f00768889feb91d61fd53264df49032b28c99fe92b","observation_id":"199db1fe-006d-42b0-9cae-3f91a61953a0","resolution":{"observed_at":"2026-08-12T15:58:03.107270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.113108Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.113108Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:0034b86b294a1ba4851930e588d7d92020c29bce39fd46c5c97d05f2f75c1225","observation_id":"a01cd8d5-54fa-475a-8e4e-82d4ce272478","resolution":{"observed_at":"2026-08-12T15:58:03.113108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.117842Z","title":"Yu, Qiang Yang, and Xing Xie","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.117842Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:25a8ac2de90dbac8045a3a64918425fcd9b3d677211a1ce816d14b6918550511","observation_id":"d4f9737d-fbc4-4ef3-81f8-52aa064d5cd2","resolution":{"observed_at":"2026-08-12T15:58:03.117842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01620","last_updated":"2024-06-07T18:13:16Z","snapshot_observed_at":"2026-08-14T00:59:30.001024Z","submitted_at":"2024-02-02T18:35:14Z","title":"MAGDi: Structured Distillation of Multi-Agent Interaction Graphs Improves Reasoning in Smaller Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01620","snapshot_observed_at":"2026-08-12T15:58:03.122563Z","title":"Magdi: Structured distillation of multi-agent interaction graphs improves reasoning in smaller language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.122563Z"},"links":{"cited_paper":"/paper/2402.01620","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:b483831d9be5ed39ab3e2a35d2bcbeea71edd412a5044abf81cf6d7fde44cb22","observation_id":"544b8a8c-ac44-4f4f-bc31-f835b630fa1d","resolution":{"observed_at":"2026-08-12T15:58:03.122563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-08-13T10:54:00.274565Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-12T15:58:03.127453Z","title":"Alpagasus: Training a better alpaca with fewer data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.127453Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:73c15b811d71daefcd94a48cc964ce209455424a06c3e224f1ff90a0dca1a371","observation_id":"fba1d299-30a0-4b36-bf5e-271669529567","resolution":{"observed_at":"2026-08-12T15:58:03.127453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.132334Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.132334Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:754bc81067cf47baa05dddf9166d90791539e72484dfa06c85c46cca102c64d3","observation_id":"adcf0ac7-cced-49cb-b625-c8fe2e8bd957","resolution":{"observed_at":"2026-08-12T15:58:03.132334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.137315Z","title":"Free dolly: Introducing the world’s first truly open instruction-tuned llm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.137315Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:7195ace483cb332805286263c24b76fb458225495c584357b2c7f46e9e484e66","observation_id":"38c96e23-1651-4199-9f7f-c625c2653cf3","resolution":{"observed_at":"2026-08-12T15:58:03.137315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14233","last_updated":"2023-05-23T16:49:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T16:49:14Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14233","snapshot_observed_at":"2026-08-12T15:58:03.142083Z","title":"Enhancing chat language models by scaling high-quality instructional conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.142083Z"},"links":{"cited_paper":"/paper/2305.14233","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:819b9d5bef890a5eca05e95745243fe8f9198df246e4b45d07328b7e52532883","observation_id":"b758bef4-0d93-4689-84ee-6d4fb99dab5a","resolution":{"observed_at":"2026-08-12T15:58:03.142083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.363367Z","title":"GLM: General language model pretraining with autoregressive blank infilling","venue":null,"work_id":"e9c0612e-2b17-41d2-affe-4aa322fb6942","year":2022},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.146927Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:557e499086fe704f4c99173703020c8bc912651397b8412f6ee79d35905bcb82","observation_id":"a3325bdc-e665-476d-b2af-0170e7d6193b","resolution":{"observed_at":"2026-08-12T15:58:04.367802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19736","last_updated":"2023-11-25T17:35:12Z","snapshot_observed_at":"2026-08-13T05:37:22.635735Z","submitted_at":"2023-10-30T17:00:52Z","title":"Evaluating Large Language Models: A Comprehensive Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19736","snapshot_observed_at":"2026-08-12T15:58:03.151597Z","title":"Evaluating large language models: A comprehensive survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.151597Z"},"links":{"cited_paper":"/paper/2310.19736","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:28398831eb2568690df0d6337104f99a7c468e1c94582ebb8ca7c4e849d92707","observation_id":"fbb7778b-83db-4141-b825-2edcf7f93bfb","resolution":{"observed_at":"2026-08-12T15:58:03.151597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.156467Z","title":"Phi-2: The surprising power of small language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.156467Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:576bb21997aaeed63e75fec8c94824514b0dffe4f0156734875b92a1e7834883","observation_id":"48c05bd9-d8a9-42da-ab69-deda9c42281e","resolution":{"observed_at":"2026-08-12T15:58:03.156467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-12T15:58:03.160957Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.160957Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:ee19aed27e60f313b4d70b40a039cd59b1d95b2b3a541a5c86a70813bd5524ee","observation_id":"ff91aa08-9316-4b46-8e0b-9408f2ccd0d6","resolution":{"observed_at":"2026-08-12T15:58:03.160957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12870","last_updated":"2023-10-14T02:21:24Z","snapshot_observed_at":"2026-08-14T05:31:58.941659Z","submitted_at":"2023-05-22T09:49:16Z","title":"Lion: Adversarial Distillation of Proprietary Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12870","snapshot_observed_at":"2026-08-12T15:58:03.165659Z","title":"Lion: Adversarial distillation of closed-source large language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.165659Z"},"links":{"cited_paper":"/paper/2305.12870","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:466841b9dfc1a6d0ae20e2cba8f8a1e5af4433f68c9a39656e6db2755f460b25","observation_id":"f4b9315f-31c9-4413-9674-87f6bab00d78","resolution":{"observed_at":"2026-08-12T15:58:03.165659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.340855Z","title":"UNIFIEDQA: Crossing format boundaries with a single QA system","venue":null,"work_id":"8f1371f4-0ce1-429a-8ac2-eed9bec8f6a2","year":2020},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.170278Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:e917f668d62bc93a15400026bab29421f331098e047f2d2365d5445d019e5628","observation_id":"c4e7a19c-635a-40a0-a39a-778b70b12314","resolution":{"observed_at":"2026-08-12T15:58:04.345274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.326875Z","title":"Openassistant conversations- democratizing large language model alignment","venue":null,"work_id":"7727fff4-77d4-48ac-bee2-f78aa224fa04","year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.174729Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:c560c8cb313b9d70a21e81f892d43dd8f41b69735758d4103a8dbde3d3f342a8","observation_id":"604aa171-6fb2-4fbd-a3c6-bc46b64e1586","resolution":{"observed_at":"2026-08-12T15:58:04.331455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.178976Z","title":"Camel: Communicative agents for\" mind\" exploration of large scale language model society","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.178976Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:092fc7e64bbfe62c0e13adc836bf68d3f2fe72f0056647cec891c566be8332d3","observation_id":"e93aefa8-283e-4309-96a0-f2771877d1f4","resolution":{"observed_at":"2026-08-12T15:58:03.178976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10110","last_updated":"2024-06-07T20:23:21Z","snapshot_observed_at":"2026-08-13T04:18:10.447708Z","submitted_at":"2024-02-15T17:06:21Z","title":"Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10110","snapshot_observed_at":"2026-08-12T15:58:03.183133Z","title":"Selective reflection-tuning: Student-selected data recycling for llm instruction-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.183133Z"},"links":{"cited_paper":"/paper/2402.10110","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:34262d280c826605bbbd9c0c0d43e39a3708e6b3f3feac2abf710b033a97d5e9","observation_id":"f2d72888-d2e9-4b7b-87b5-70d3c717aacc","resolution":{"observed_at":"2026-08-12T15:58:03.183133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11716","last_updated":"2023-10-18T05:13:47Z","snapshot_observed_at":"2026-08-13T05:47:08.434157Z","submitted_at":"2023-10-18T05:13:47Z","title":"Reflection-Tuning: Data Recycling Improves LLM Instruction-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11716","snapshot_observed_at":"2026-08-12T15:58:03.187930Z","title":"Reflection- tuning: Data recycling improves llm instruction-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.187930Z"},"links":{"cited_paper":"/paper/2310.11716","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:b80113acddde455739bbcd054c6b3790ad0857ef72c727fdc58d60d72449cb3a","observation_id":"aa7e2b39-0e95-425d-8487-4c9d22518a73","resolution":{"observed_at":"2026-08-12T15:58:03.187930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.304446Z","title":"Superfiltering: Weak-to-strong data filtering for fast instruction-tuning, 2024","venue":null,"work_id":"01dfd3b1-6549-48c1-83cc-5b4920133e17","year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.192459Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:c97c2adb3b021afe77e7aa81c767be8420fcaf336e38d7a4be7d4407b1f8e420","observation_id":"3dc11b88-fc57-468f-b3d1-2ffc3cfee250","resolution":{"observed_at":"2026-08-12T15:58:04.308989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12032","last_updated":"2024-04-06T03:52:04Z","snapshot_observed_at":"2026-08-13T22:13:22.197575Z","submitted_at":"2023-08-23T09:45:29Z","title":"From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12032","snapshot_observed_at":"2026-08-12T15:58:03.196830Z","title":"From quantity to quality: Boosting llm performance with self-guided data selection for instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.196830Z"},"links":{"cited_paper":"/paper/2308.12032","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:8389901356286f3e8372ac5798443e4cbd32d9508712bad9e251434d32a03635","observation_id":"06e5d5b4-6403-4720-b35d-f0979fd130fd","resolution":{"observed_at":"2026-08-12T15:58:03.196830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12316","last_updated":"2024-03-18T23:21:37Z","snapshot_observed_at":"2026-08-13T00:50:47.642874Z","submitted_at":"2024-03-18T23:21:37Z","title":"OpenEval: Benchmarking Chinese LLMs across Capability, Alignment and Safety","version":1},"cited_work":{"arxiv_id":"2403.12316","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.12316","snapshot_observed_at":"2026-08-12T15:58:03.726587Z","title":"OpenEval: Benchmarking Chinese LLMs across Capability, Alignment and Safety","venue":"cs.CL","work_id":"1cb6c01d-39ed-4915-b488-aaada4d70968","year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.201719Z"},"links":{"cited_paper":"/paper/2403.12316","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:70633a0d3545a76d72b62ef5485a0ecf9bffc013b75f40abf4d3339f706f7689","observation_id":"9de6171a-7de3-46c2-92c4-97b6d075b6df","resolution":{"observed_at":"2026-08-12T15:58:03.733361Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15685","last_updated":"2024-04-16T02:46:58Z","snapshot_observed_at":"2026-08-13T04:54:16.874411Z","submitted_at":"2023-12-25T10:29:28Z","title":"What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15685","snapshot_observed_at":"2026-08-12T15:58:03.206242Z","title":"What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.206242Z"},"links":{"cited_paper":"/paper/2312.15685","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:1a847c4d121af99bdad75b8532db695634c211dc3c6965e584362794a04ba189","observation_id":"8fdf9a15-9b37-4a3c-b16a-4663db41252b","resolution":{"observed_at":"2026-08-12T15:58:03.206242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13688","snapshot_observed_at":"2026-08-12T15:58:03.210627Z","title":"Longpre, Le Hou, Tu Vu, Albert Webson, Hyung Won Chung, Yi Tay, Denny Zhou, Quoc V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.210627Z"},"links":{"cited_paper":"/paper/2301.13688","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:a65e70a764446c40063c7389d1ec657f3d8af7296636486274fcec17aeee8b9b","observation_id":"db7f2206-fea3-4d36-9092-c09a0e4d5349","resolution":{"observed_at":"2026-08-12T15:58:03.210627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.289819Z","title":"# instag: Instruction tagging for analyzing supervised fine-tuning of large language models","venue":null,"work_id":"f55a54dd-1dfb-4e43-a356-bf2843bd7ec3","year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.215157Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:c8d829a32fdc18e60ee12f97eac703439a8f4f17148931ec10289374fd95ecca","observation_id":"015f3ebd-e785-4479-8a93-560038e00441","resolution":{"observed_at":"2026-08-12T15:58:04.294858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-12T15:58:03.219636Z","title":"A comprehensive overview of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.219636Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:b1479127295bf58a9591572b6c3133fccb059de9643fcdc3bfede395e9063d9a","observation_id":"dcd53dab-0c7e-4d5e-b9aa-546a71955440","resolution":{"observed_at":"2026-08-12T15:58:03.219636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03450","last_updated":"2023-09-07T02:20:03Z","snapshot_observed_at":"2026-08-13T18:25:08.377232Z","submitted_at":"2023-09-07T02:20:03Z","title":"XGen-7B Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03450","snapshot_observed_at":"2026-08-12T15:58:03.224358Z","title":"Xgen-7b technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.224358Z"},"links":{"cited_paper":"/paper/2309.03450","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:6697bdf47e9abe855bef61e6a715bb634e92ddd6e275b2235c9d191944256852","observation_id":"e584c61d-5cef-4a32-a59e-310db05797ce","resolution":{"observed_at":"2026-08-12T15:58:03.224358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15025","last_updated":"2023-09-26T15:49:23Z","snapshot_observed_at":"2026-08-13T10:04:36.296007Z","submitted_at":"2023-09-26T15:49:23Z","title":"Large Language Model Alignment: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15025","snapshot_observed_at":"2026-08-12T15:58:03.228839Z","title":"Large language model alignment: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.228839Z"},"links":{"cited_paper":"/paper/2309.15025","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:d9534a02464c3b72fc527b61eda32b04ede64a2ae18557c0847df23bc5523542","observation_id":"059deb5d-0000-4beb-afa2-f6506871e99a","resolution":{"observed_at":"2026-08-12T15:58:03.228839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16132","last_updated":"2024-02-16T10:02:44Z","snapshot_observed_at":"2026-08-13T04:53:44.594934Z","submitted_at":"2023-12-26T17:40:55Z","title":"RoleEval: A Bilingual Role Evaluation Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16132","snapshot_observed_at":"2026-08-12T15:58:03.233374Z","title":"Roleeval: A bilingual role evaluation benchmark for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.233374Z"},"links":{"cited_paper":"/paper/2312.16132","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:b0a021c2a2c2cd05d5a3902a3dd0a9d215fc298da8c7007d15d1e8604b8806a7","observation_id":"b2df884a-9610-4c1b-bfab-dc40fc85d249","resolution":{"observed_at":"2026-08-12T15:58:03.233374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.237796Z","title":"On the exploitability of instruction tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.237796Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:0e126daca9aed172e494a5e03d9b86998f187ebf8e0c3e3c03b3367b0527ec2f","observation_id":"4194a8a6-9ee8-460d-8738-cc56bcb5207c","resolution":{"observed_at":"2026-08-12T15:58:03.237796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06273","last_updated":"2024-10-26T15:55:33Z","snapshot_observed_at":"2026-08-12T23:04:49.861309Z","submitted_at":"2024-08-12T16:34:56Z","title":"FuxiTranyu: A Multilingual Large Language Model Trained with Balanced Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06273","snapshot_observed_at":"2026-08-12T15:58:03.242032Z","title":"Fuxitranyu: A multilingual large language model trained with balanced data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.242032Z"},"links":{"cited_paper":"/paper/2408.06273","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:4bf2215f36a081a3c352caee90d8d6f65226a8848c5ca3939a50cfff27d7eef8","observation_id":"2c2ecd4a-e1ca-4a8d-88d0-a231c1672b5d","resolution":{"observed_at":"2026-08-12T15:58:03.242032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02791","last_updated":"2025-04-03T02:13:53Z","snapshot_observed_at":"2026-08-13T04:27:01.626889Z","submitted_at":"2024-02-05T07:59:38Z","title":"PanGu-$\\pi$ Pro:Rethinking Optimization and Architecture for Tiny Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02791","snapshot_observed_at":"2026-08-12T15:58:03.246709Z","title":"Rethinking optimization and architecture for tiny language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.246709Z"},"links":{"cited_paper":"/paper/2402.02791","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:78ffa1961722816c2788d81f71d19bc12b3b909da56651d1b14bee85bdab678e","observation_id":"e46ec5a2-dce8-4747-b22c-1dc0ec93cee6","resolution":{"observed_at":"2026-08-12T15:58:03.246709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.251242Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.251242Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:456bd0471e07312fee89d0b0f3ac7f48bcee70c342c3a1dbdd6fe3e307974c16","observation_id":"5d2fea6c-861b-4eb9-9424-4ec60f04864a","resolution":{"observed_at":"2026-08-12T15:58:03.251242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.255534Z","title":"Stanford alpaca: An instruction-following llama model, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.255534Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:424198df7d538e259905514f56ed5df699d60cefb0ab35d57c443ae4cf7ab9ec","observation_id":"590bfe89-3064-4171-afc4-154c9ea4e6a3","resolution":{"observed_at":"2026-08-12T15:58:03.255534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-12T15:58:03.260132Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.260132Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:7e91ad110e6e96a3f5e19d8dbcbae7ed338a3966cf9f1f745f207a22e575cba0","observation_id":"752e056d-8d6f-4cab-8a87-09636c7c8d32","resolution":{"observed_at":"2026-08-12T15:58:03.260132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T15:58:03.264529Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.264529Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:c595a01df48b7d77f2923dc00d1934edec9e8830ae5675dc6b546077cc8b16da","observation_id":"5c38a238-b016-49a8-b508-ee7d882390ed","resolution":{"observed_at":"2026-08-12T15:58:03.264529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-08-13T22:45:34.795769Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-12T15:58:03.268890Z","title":"Self-instruct: Aligning language models with self-generated instructions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.268890Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:3068c09f01a470d80171159be127c529d871a0793e43be8c22c88d752e414aca","observation_id":"15feb09d-5736-40f6-be83-f0462c1a63e6","resolution":{"observed_at":"2026-08-12T15:58:03.268890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.249833Z","title":"Smith, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":"0fe90a3b-807d-4db1-927f-b935a2030c1f","year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.273283Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:21433589e803b6fa1a0629253e9ea89ae769a42899e5497b442596ba4d61e86b","observation_id":"bba2960e-a63a-4bf6-bb4e-599eba85fd53","resolution":{"observed_at":"2026-08-12T15:58:04.254148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.236019Z","title":"Super- NaturalInstructions: Generalization via declarative instructions on 1600+ NLP tasks","venue":null,"work_id":"d8f27b21-7463-48b1-a0ba-870bdab1befd","year":2022},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.277386Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:ce2522229db904e1c5e164aa70628e0c9553c250c20cf9b627bf4ab1be9c9ca4","observation_id":"d7a40cf1-7a48-4fc0-8e29-f83627a77d9f","resolution":{"observed_at":"2026-08-12T15:58:04.240508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17276","last_updated":"2023-12-27T11:49:24Z","snapshot_observed_at":"2026-08-13T04:53:24.854643Z","submitted_at":"2023-12-27T11:49:24Z","title":"PanGu-$\\pi$: Enhancing Language Model Architectures via Nonlinearity Compensation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17276","snapshot_observed_at":"2026-08-12T15:58:03.281496Z","title":"Pangu- pi: Enhancing language model architectures via nonlinearity compensation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.281496Z"},"links":{"cited_paper":"/paper/2312.17276","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:b218ef0dc427b38546e726c7aff0f7319350fefa96148de294f2770dffca0318","observation_id":"e3fdc165-5bd9-481e-bcda-f226ab17c7fc","resolution":{"observed_at":"2026-08-12T15:58:03.281496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.285850Z","title":"Dai, and Quoc V Le","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.285850Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:0175f466d8c9e2711b4bdf050d31d7c82cb4a2ca06d557b132af1793ef329645","observation_id":"89e888b8-f725-497c-a963-e545cfecdad0","resolution":{"observed_at":"2026-08-12T15:58:03.285850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-14T06:11:14.515796Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-12T15:58:03.289990Z","title":"Finetuned language models are zero-shot learners","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.289990Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:cced0734406826b9043beb631e7bf87a65f5ede74aa2846b4b4a2e213e0dd702","observation_id":"3290dec4-3f66-4d78-8faf-29bd5796dcd3","resolution":{"observed_at":"2026-08-12T15:58:03.289990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06694","last_updated":"2024-04-11T01:18:06Z","snapshot_observed_at":"2026-08-13T05:52:56.563579Z","submitted_at":"2023-10-10T15:13:30Z","title":"Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06694","snapshot_observed_at":"2026-08-12T15:58:03.294682Z","title":"Sheared llama: Accelerating language model pre-training via structured pruning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.294682Z"},"links":{"cited_paper":"/paper/2310.06694","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:5e9c3e4d2582e8209d2a48169ee2d4e75d8a1aa4c5eddca4e675fb9d8df0b441","observation_id":"c9c885b3-732c-40fe-8d7b-30301b26f335","resolution":{"observed_at":"2026-08-12T15:58:03.294682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-13T04:24:51.821062Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-12T15:58:03.299039Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.299039Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:88a947a0ac0bb414a01ded3da6330eeb08f5055f5aeda162b1391fd10a92eceb","observation_id":"91040c02-dd05-4c54-9924-57e20f97a625","resolution":{"observed_at":"2026-08-12T15:58:03.299039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-12T15:58:03.303522Z","title":"Wizardlm: Empowering large language models to follow complex instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.303522Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:7893e7fc600239d79bcc0e4dae9382e8676a2e75662926eb49c8d1ab45c502f3","observation_id":"8599d1e4-e2b9-4795-bc7c-5d311ad2c00a","resolution":{"observed_at":"2026-08-12T15:58:03.303522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01196","last_updated":"2023-12-02T21:05:22Z","snapshot_observed_at":"2026-08-13T12:10:07.949088Z","submitted_at":"2023-04-03T17:59:09Z","title":"Baize: An Open-Source Chat Model with Parameter-Efficient Tuning on Self-Chat Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01196","snapshot_observed_at":"2026-08-12T15:58:03.307992Z","title":"Baize: An open-source chat model with parameter-efficient tuning on self-chat data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.307992Z"},"links":{"cited_paper":"/paper/2304.01196","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:505d6df13e286efb2359f98c67d564a45adc4f9854ceaeec54e9f551b53aa79f","observation_id":"f398ef56-5fb4-4466-90d8-bc9a0c5fdcb7","resolution":{"observed_at":"2026-08-12T15:58:03.307992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.312414Z","title":"Rethinking the instruction quality: Lift is what you need, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.312414Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:78e4b653f51991c8d49dd6710b9bae276b14f4d92f6fceaa7fe29a888adc3d96","observation_id":"7f534d61-ba28-484e-a1a4-ce63fdeeea07","resolution":{"observed_at":"2026-08-12T15:58:03.312414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.203757Z","title":"Backdooring instruction-tuned large language models with virtual prompt injection","venue":null,"work_id":"4d9ac62f-0a6e-47e3-af73-70594787f492","year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.316580Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:8c196c2eae87443f471b608dcd63bd51e9ebc9048fd471291a95cde9012fe54a","observation_id":"361128d0-55aa-425d-ab6d-65939adc8bb1","resolution":{"observed_at":"2026-08-12T15:58:04.208457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.189333Z","title":"Virtual prompt injection for instruction-tuned large language models, 2023","venue":null,"work_id":"cd0aadc5-bdc6-4b49-b9ea-3c3b23b397d9","year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.320806Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:641a7e0a32f0775492071217076a95e3e228f7b3038f37d8e52b6878642f2f25","observation_id":"602b3b0d-0e7c-4b72-8cf7-7786b68a522e","resolution":{"observed_at":"2026-08-12T15:58:04.194207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.175772Z","title":"Harnessing the power of llms in practice: A survey on chatgpt and beyond, 2023","venue":null,"work_id":"a8b8b3ad-5eda-4e07-bfa4-9ffe7512ddd3","year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.325549Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:c5c69f7b284fcabc20cc303dc70369fcb42595b7f8aacf09da0c4f8024dfe135","observation_id":"9a0a7d4e-0188-4ef1-a0cc-d063398fffed","resolution":{"observed_at":"2026-08-12T15:58:04.180116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.161746Z","title":"CrossFit: A few-shot learning challenge for cross-task generalization in NLP","venue":null,"work_id":"68112673-3acd-44ac-a982-9d9706fd42b6","year":2021},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.330069Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:8b3ec45acbb81bbdddc94f55fc2b10d6665e8ca1feabe7ee382bc1de67668e8e","observation_id":"f64b69be-8daf-44c5-8572-e8ea4112026c","resolution":{"observed_at":"2026-08-12T15:58:04.166277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02414","last_updated":"2023-10-25T05:22:43Z","snapshot_observed_at":"2026-08-02T04:26:53.194797Z","submitted_at":"2022-10-05T17:34:44Z","title":"GLM-130B: An Open Bilingual Pre-trained Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02414","snapshot_observed_at":"2026-08-12T15:58:03.334179Z","title":"Glm-130b: An open bilingual pre-trained model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.334179Z"},"links":{"cited_paper":"/paper/2210.02414","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:747bb6e9d991f8cf3c35f35e84c1bbc93e5250774114a3698c4e1a54b5c1f6c2","observation_id":"c487b405-3968-4159-b6da-c3384a2d4802","resolution":{"observed_at":"2026-08-12T15:58:03.334179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-12T15:58:03.338781Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.338781Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:b4245cbb7ced766bcb8e096f20cfd4bd09c94acddfa6b5c26864ed0ce224bdde","observation_id":"280e74d4-288f-4a44-8fe8-cb62c935c0e4","resolution":{"observed_at":"2026-08-12T15:58:03.338781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.343414Z","title":"A survey of large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.343414Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:0e821962faea97a12ac8b064b5a708d7f1f53df5d7510ffcedb39688e4c12bd9","observation_id":"8f3bc009-9f96-46fa-b168-74b8aae10557","resolution":{"observed_at":"2026-08-12T15:58:03.343414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.139146Z","title":"[[A]]” if assistant A is the bset, “[[B]]","venue":null,"work_id":"10979c4e-7b94-4dae-9f77-b3c1d750accd","year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.347715Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:178d3f35f85d0a935938eca8a44dad03d691176b7dac250152e1772a333c112d","observation_id":"660c457b-f6ba-4d86-89b9-f179cd2bd993","resolution":{"observed_at":"2026-08-12T15:58:04.143414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.124281Z","title":"It is a relatively simple and interpretable model that works well with linearly separable datasets","venue":null,"work_id":"304e38e2-8c29-4495-8574-063f68c87c12","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.352299Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:449cb4da1b11ebf3247e257481b67886244365363abd0306e405b5818c202d1c","observation_id":"56d366db-e567-4bbd-bf6b-892a388af1f8","resolution":{"observed_at":"2026-08-12T15:58:04.129815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.110442Z","title":"SVMs can handle high-dimensional data and work well with datasets that are not linearly separable","venue":null,"work_id":"bafe016a-8ae7-495e-aea2-2ec1eaa9bc02","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.356581Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:3817bb6fbbd99b1ecba9ecaa2798b43ee2eeb9f82bad1cb4e56495118a9064d4","observation_id":"0362ba54-7f52-4c1d-82f6-af5a11c54004","resolution":{"observed_at":"2026-08-12T15:58:04.115034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.095516Z","title":null,"venue":null,"work_id":"d99854f1-13c6-46e7-9d8d-33d4ade1c19a","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.361080Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:4f1ed1e4ed4d1ccfc8965b65c2eec4547f116ff1bc774f4af3840fcc79e9289c","observation_id":"851c7ba9-5f05-4ce1-a05a-d10a9370c110","resolution":{"observed_at":"2026-08-12T15:58:04.101141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.081854Z","title":"Neural networks can handle non-linear relationships between variables and are capable of learning complex patterns in the data","venue":null,"work_id":"b8d1af19-0b9c-435a-a05a-4073cecd585d","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.365766Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:a912c1ba2f4dcd279027b254056e1f878b414bf3d509ee36823455cfcc24cea9","observation_id":"2e645562-9589-4f06-9900-1f98e2c41432","resolution":{"observed_at":"2026-08-12T15:58:04.086556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.068528Z","title":"It works by estimating the probability of the positive class and using it to make predictions","venue":null,"work_id":"aefe0602-c5e5-40ab-b551-84913030e232","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.370171Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:97541e6e05221c3cf688f44a7906477de6323f9025a5a8d5d849d05da362c4fe","observation_id":"ca0da12d-bf8b-479a-9805-27ca0fcf9fa9","resolution":{"observed_at":"2026-08-12T15:58:04.073174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.054349Z","title":"They work by recursively splitting the data into subsets based on the values of the input features","venue":null,"work_id":"2a37d508-db04-45dc-a279-4cc509e58373","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.375411Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:0a2c0450f0d9bc07e0c67f0010769fd5f2dc0aa60dd8442492aac8c324fbc5b0","observation_id":"e86f8f5d-d462-498c-8d86-810752633b7c","resolution":{"observed_at":"2026-08-12T15:58:04.058706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.040916Z","title":"It works by creating a set of decision trees and then averaging their predictions","venue":null,"work_id":"2de19f0a-9ce8-47ed-9704-a68c63df29ca","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.379687Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:f29a889889523f439559e977c4ac991fd8a118b851751f7591285e4191abb245","observation_id":"1a63f130-0bb3-4109-bff6-a9aa3fa17751","resolution":{"observed_at":"2026-08-12T15:58:04.045402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.026897Z","title":"It works by finding the hyperplane that maximally separates the classes in the feature space","venue":null,"work_id":"82cb0944-2236-44d7-98fa-6dbd01d4a474","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.383699Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:d0aa9a75c93fdb58e89adf86f8f6e758049bdec15272c532a90d4915911bebc8","observation_id":"afa3f0cf-359a-4951-9496-fda66e99d10e","resolution":{"observed_at":"2026-08-12T15:58:04.031668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:04.012903Z","title":"They can handle complex and nonlinear relationships between the input features and the output labels","venue":null,"work_id":"0c9991a6-b858-4c71-b7f8-0eea55ecbbcd","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.388158Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:ff2d9fdf0be9b4b69b01f796725ea07d905983f4f7a95c14fe14dcc6cc2cd615","observation_id":"184b5bce-8c0b-4985-aebd-17e3c9a18783","resolution":{"observed_at":"2026-08-12T15:58:04.017368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.997261Z","title":"It’s linear and can handle both categorical and continuous features","venue":null,"work_id":"77498805-b3d8-4f18-9ba8-3ecab44f7705","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.392316Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:9ce6ce3b322058512e9f84ce2f68472292f1f84036d88b024608d0b8e13659ae","observation_id":"7b959a4e-6c25-4064-847f-3e5384337763","resolution":{"observed_at":"2026-08-12T15:58:04.002846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.983245Z","title":"Random Forest is an ensemble method that combines multiple decision trees, reducing overfitting","venue":null,"work_id":"ab393d21-18e4-49ed-805c-5a6f443e84ac","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.397105Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:a13870d73f0305d45921b6c8d76a4df95cfaf55bd2d4383698a3240e7b132ff9","observation_id":"07058485-4eae-4681-979c-6301da10b8aa","resolution":{"observed_at":"2026-08-12T15:58:03.988016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.969398Z","title":"SVMs are robust to outliers and can be used for both linear and non-linear classification","venue":null,"work_id":"deb0b208-077c-49bd-b258-f128b5ffdeaf","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.401806Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:1360d2459c2a1dce95e864ff938554f18e300bd18c99600a8a13fef1fd0685be","observation_id":"c3154dd5-fdba-4e20-9456-33da4f340732","resolution":{"observed_at":"2026-08-12T15:58:03.973867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.954298Z","title":"It’s fast, easy to implement, and works well for text classification or when features are not highly correlated","venue":null,"work_id":"250fb8e0-c58a-44a0-8c0a-7d672d1458b3","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.407053Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:50e7e2330347ae5729d0a0ee50b6b3e7088048c6ddfeba6c4c8e4eb054696310","observation_id":"cd583ffc-846c-480c-9f36-a191a7009f1b","resolution":{"observed_at":"2026-08-12T15:58:03.959549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.938844Z","title":"It’s non-parametric and can be useful for small datasets","venue":null,"work_id":"c9830ab9-36b4-4b30-b7c4-495f0d6ab85c","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.411412Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:7de6e3c913e2e57a7be641dc08ebab31fdf2d0a74f04ddeec9955c8e32b00125","observation_id":"6a558432-a31e-4394-994b-93af38ccc58b","resolution":{"observed_at":"2026-08-12T15:58:03.943216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.924836Z","title":"They are powerful but require more data and computational resources","venue":null,"work_id":"bff99565-f114-4198-95b2-24ba80505808","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.415792Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:5ddaf4a2f42a8d7e7235c8c4075eca8d8c7c7c14745d2ab8e5c8b1d876879a27","observation_id":"90fe250c-0b4f-4290-bb8d-3ac65dd0ae94","resolution":{"observed_at":"2026-08-12T15:58:03.929442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.911098Z","title":"They are often used for structured data and can handle high dimensionality","venue":null,"work_id":"8dfdb3cf-77ea-427d-af5b-901c671657d5","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.420084Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:ca85b239bb72feaa528177700fffe5fc06f413a437365aca2785b574858b2485","observation_id":"e945a490-3927-47c7-a6f5-a4ee52b8cae1","resolution":{"observed_at":"2026-08-12T15:58:03.915475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.896996Z","title":"It’s particularly useful when dealing with imbalanced datasets","venue":null,"work_id":"eea8256f-37d0-4be3-bd84-e03f9add7d69","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.424672Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:4726b8425b4e611e43ed017384294a3c1ab5025ead71f18ee46852cc74962b8c","observation_id":"725fc435-b7d1-4fd8-afc8-b4789b6cfeb6","resolution":{"observed_at":"2026-08-12T15:58:03.901543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:58:03.882968Z","title":null,"venue":null,"work_id":"a9289756-9ba4-4d01-974c-76364ea6582b","year":null},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.429016Z"},"links":{"citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:574ce526b23022306b6f64c96ba4888595ef33d72dac633232b82540093e6584","observation_id":"b3bbb453-45d8-4d7c-9163-d9b559bf12f4","resolution":{"observed_at":"2026-08-12T15:58:03.887631Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T20:42:03.921423Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2411.14497."}