{"as_of":"2026-08-18T21:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba6a0cd997c117e38a31344ad718112a80023561d2316d0674c8698f9285f152","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T22:57:12.869989Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:33:02.869499Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T00:12:50.066065Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-08-16T11:33:02.869499Z","title":"Scoreflow: Mastering llm agent workflows via score-based preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.869499Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:2491eefbdcf868791c815a637c16fdc7d13d88cdaf789111f92eece99b4eb9bd","observation_id":"0a41fbf5-200c-4f0b-a399-205d9a46a1b9","resolution":{"observed_at":"2026-08-16T11:33:02.869499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-08-15T20:51:13.601509Z","title":"Scoreflow: Mastering llm agent workflows via score-based preference optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13516","last_updated":"2025-05-17T04:14:03Z","snapshot_observed_at":"2026-08-15T20:44:42.404108Z","submitted_at":"2025-05-17T04:14:03Z","title":"HALO: Hierarchical Autonomous Logic-Oriented Orchestration for Multi-Agent LLM Systems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:51:13.601509Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2505.13516"},"observation_digest":"sha256:50f34e87c5981a9ed3d1d4fa32a94f1f0274da8612d16853fc6d81624047d2b9","observation_id":"c72814f9-1626-49eb-81e5-f5da80437d1b","resolution":{"observed_at":"2026-08-15T20:51:13.601509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-08-07T13:00:08.840573Z","title":"Scoreflow: Mastering LLM agent workflows via score-based preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22967","last_updated":"2025-05-29T01:08:36Z","snapshot_observed_at":"2026-08-16T13:55:34.491384Z","submitted_at":"2025-05-29T01:08:36Z","title":"MermaidFlow: Redefining Agentic Workflow Generation via Safety-Constrained Evolutionary Programming","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:08.840573Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2505.22967"},"observation_digest":"sha256:c9a36044acedcb6b052280f561f0983c9f8c71f231850e501633c9b33b0961e8","observation_id":"8e15cffa-39ec-400a-9577-83390127f903","resolution":{"observed_at":"2026-08-07T13:00:08.840573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":"2502.04306","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-06-29T00:12:50.066065Z","title":"Scoreflow: Mastering llm agent workflows via score-based preference optimization","venue":null,"work_id":"08cbd7b5-1206-48e7-81e9-b8e287a56c15","year":2025},"citing_paper":{"arxiv_id":"2507.21035","last_updated":"2026-05-17T21:43:43Z","snapshot_observed_at":"2026-08-15T23:53:19.475091Z","submitted_at":"2025-07-28T17:55:08Z","title":"GenoMAS: A Multi-Agent Framework for Scientific Discovery via Code-Driven Gene Expression Analysis","version":3},"reference_index":126,"source":"pdf_text","source_observed_at":"2026-05-22T00:37:11.945418Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2507.21035"},"observation_digest":"sha256:35138e9a63c1b9c0950953a6bf9be7cbbc8de1e5bb491b0abfb4ac5e66396e99","observation_id":"a721dc97-9037-4479-b644-6c9584fbabac","resolution":{"observed_at":"2026-05-22T00:40:51.269575Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-08-03T17:21:28.646860Z","title":"arXiv preprint arXiv:2502.04306 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.11001","last_updated":"2026-07-07T14:01:07Z","snapshot_observed_at":"2026-08-12T13:49:43.584085Z","submitted_at":"2025-12-10T20:16:20Z","title":"Rethinking Query Optimization for Multi-Agent Systems [Vision]","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-03T17:21:28.646860Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2512.11001"},"observation_digest":"sha256:0bdb3a4b53783eb9f12403778f8eac8fb0aa9e6c78e3282e44df314226fa974a","observation_id":"f3c0730e-c85b-4733-8c99-a39eff0612f1","resolution":{"observed_at":"2026-08-03T17:21:28.646860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":"2502.04306","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-06-29T00:12:50.066065Z","title":"Scoreflow: Mastering llm agent workflows via score-based preference optimization","venue":null,"work_id":"08cbd7b5-1206-48e7-81e9-b8e287a56c15","year":2025},"citing_paper":{"arxiv_id":"2604.15034","last_updated":"2026-06-20T11:36:45Z","snapshot_observed_at":"2026-08-13T10:31:29.452835Z","submitted_at":"2026-04-16T14:04:06Z","title":"Autogenesis: A Self-Evolving Agent Protocol","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T10:27:34.143483Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2604.15034"},"observation_digest":"sha256:ce5e4b6c79fae459959e1dc045a311590f176d6a9bad88b05436603a4a41496f","observation_id":"ff54a86d-7777-42ff-84a2-9d05f1a66d12","resolution":{"observed_at":"2026-05-10T10:29:24.729524Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":"2502.04306","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-06-29T00:12:50.066065Z","title":"Scoreflow: Mastering llm agent workflows via score-based preference optimization","venue":null,"work_id":"08cbd7b5-1206-48e7-81e9-b8e287a56c15","year":2025},"citing_paper":{"arxiv_id":"2604.15034","last_updated":"2026-06-20T11:36:45Z","snapshot_observed_at":"2026-08-13T10:31:29.452835Z","submitted_at":"2026-04-16T14:04:06Z","title":"Autogenesis: A Self-Evolving Agent Protocol","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T00:15:18.079458Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2604.15034"},"observation_digest":"sha256:ab17e406941cdf21854b33524f2cce2ed1185d860f3e024f54d26b2ef1f6d721","observation_id":"b2c07b09-5da3-4bfd-8109-fc522d1443b7","resolution":{"observed_at":"2026-05-21T00:19:16.783581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":"2502.04306","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-06-29T00:12:50.066065Z","title":"Scoreflow: Mastering llm agent workflows via score-based preference optimization","venue":null,"work_id":"08cbd7b5-1206-48e7-81e9-b8e287a56c15","year":2025},"citing_paper":{"arxiv_id":"2605.11136","last_updated":"2026-05-11T18:42:33Z","snapshot_observed_at":"2026-08-11T13:02:08.995167Z","submitted_at":"2026-05-11T18:42:33Z","title":"EVOCHAMBER: Test-Time Co-evolution of Multi-Agent System at Individual, Team, and Population Scales","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T02:38:33.870289Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2605.11136"},"observation_digest":"sha256:078f7fbe0ac097eaa70a09e8a6000f6c7fea0a6266e584ec0b755c1e61498999","observation_id":"879697a1-c5a3-4c0c-ab0c-6d9f2a50c1e1","resolution":{"observed_at":"2026-05-13T02:47:08.474776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":"2502.04306","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-06-29T00:12:50.066065Z","title":"Scoreflow: Mastering llm agent workflows via score-based preference optimization","venue":null,"work_id":"08cbd7b5-1206-48e7-81e9-b8e287a56c15","year":2025},"citing_paper":{"arxiv_id":"2605.22505","last_updated":"2026-05-21T13:55:02Z","snapshot_observed_at":"2026-08-17T21:36:22.915943Z","submitted_at":"2026-05-21T13:55:02Z","title":"Towards Direct Evaluation of Harness Optimizers via Priority Ranking","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T06:14:28.559147Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2605.22505"},"observation_digest":"sha256:43bf9c4eb8726c803ecf9681bc14483793f009d90bf6ec143ed9bb72cf33f639","observation_id":"a8b83235-1d34-42e4-a096-2ae6ff7980ac","resolution":{"observed_at":"2026-05-22T06:14:40.387427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":"2502.04306","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-06-29T00:12:50.066065Z","title":"Scoreflow: Mastering llm agent workflows via score-based preference optimization","venue":null,"work_id":"08cbd7b5-1206-48e7-81e9-b8e287a56c15","year":2025},"citing_paper":{"arxiv_id":"2605.29790","last_updated":"2026-05-28T11:40:16Z","snapshot_observed_at":"2026-08-06T19:17:26.541233Z","submitted_at":"2026-05-28T11:40:16Z","title":"Evolve as a Team: Collaborative Self-Evolution for LLM-based Multi-Agent Systems","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-29T00:05:31.780655Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2605.29790"},"observation_digest":"sha256:c1f31d06e50038359c4694eaaa38fd94f5eb3b78df91679e4fdf3b6ec240276a","observation_id":"e287924a-aa6a-4bed-ba34-0e1a35ca3380","resolution":{"observed_at":"2026-06-29T00:12:50.067704Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-07-12T05:56:18.797766Z","title":"arXiv:2502.04306 [cs.CL]https://arxiv.org/ abs/2502.04306","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02942","last_updated":"2026-07-03T04:28:49Z","snapshot_observed_at":"2026-08-16T07:15:39.099146Z","submitted_at":"2026-07-03T04:28:49Z","title":"A Workflow-Aware Serving Layer for Agentic Applications","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-12T05:56:18.797766Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2607.02942"},"observation_digest":"sha256:db1af9c755976887cbcd85d1a477c2ab4373819506fb8086f8551bc06aed0742","observation_id":"75c452f2-a934-4964-995b-d6c0c695d327","resolution":{"observed_at":"2026-07-12T05:56:18.797766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-07-12T04:03:40.067404Z","title":"arXiv preprint arXiv:2502.04306 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03220","last_updated":"2026-07-03T11:34:27Z","snapshot_observed_at":"2026-08-12T21:38:33.754805Z","submitted_at":"2026-07-03T11:34:27Z","title":"CONTRA: Red-Teaming Configurations of Personalizable Agents","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-12T04:03:40.067404Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2607.03220"},"observation_digest":"sha256:8dc20d501d01fcb144765123bf15d12b02e6d410c4feec71c0a6843912f0f2bd","observation_id":"af735b10-0f92-44ae-9c45-29658aba67bf","resolution":{"observed_at":"2026-07-12T04:03:40.067404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-08-02T02:15:34.145140Z","title":"ScoreFlow: Mastering LLM agent workﬂows via score-based preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14408","last_updated":"2026-07-15T22:50:32Z","snapshot_observed_at":"2026-08-13T07:40:24.675101Z","submitted_at":"2026-07-15T22:50:32Z","title":"Reward-Free Evolving Agents via Pairwise Validator","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T02:15:34.145140Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2607.14408"},"observation_digest":"sha256:8681634678f161e66b4e53b629045694cfeb27465739ccea326195628cb69a4f","observation_id":"d32dd730-36fd-4726-b31b-54bf42d8bf75","resolution":{"observed_at":"2026-08-02T02:15:34.145140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-08-02T16:08:11.758646Z","title":"arXiv preprint arXiv:2502.04306 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21596","last_updated":"2026-04-18T06:52:42Z","snapshot_observed_at":"2026-08-14T00:21:23.938127Z","submitted_at":"2026-04-18T06:52:42Z","title":"FlowEvo: Self-Evolving Agents through the Co-Evolution of Workflows and Executable Skills","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T16:08:11.758646Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2607.21596"},"observation_digest":"sha256:238f8198c36a220dd1724917eec7e9e6968bb65bb580daff20017e0160f473a9","observation_id":"689c9664-2d66-48fa-9e2b-80feda11857e","resolution":{"observed_at":"2026-08-02T16:08:11.758646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04306/citation-record","integrity":"/paper/2502.04306/integrity","json":"/paper/2502.04306/citation-record.json","paper":"/paper/2502.04306"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T22:57:12.618521Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.618521Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:b94c2e67e9758cc6fcca30ccaecf89605ca84ef6a3c4f44594eb2c13b4cd984f","observation_id":"d3730524-bea0-40f6-9a2c-abdb6403fa3f","resolution":{"observed_at":"2026-08-08T22:57:12.618521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-08T22:57:12.623748Z","title":"Palm 2 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.623748Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:4c8d9832c57c78bede00824ae388e480c9a9369b7a31d6b64d5906144e758581","observation_id":"76f5f5bf-e1a0-46e3-a21e-6ac3c9782fb8","resolution":{"observed_at":"2026-08-08T22:57:12.623748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-08T22:57:12.628595Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.628595Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:51ab1584912fd64a9f8c22ac86f42fb6a4452031a7f951151f92518dae0bbcc7","observation_id":"4037b6a2-85c3-4b69-b849-17dc8a9ab4b2","resolution":{"observed_at":"2026-08-08T22:57:12.628595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.865214Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":"8dcdd27b-d9e1-43a8-967a-5c3ef6f4d1ab","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.633813Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:1d725c69502b7b099a57932039a47329df7cae39e1ba622954dd1b3bedce4760","observation_id":"abad24c7-c5c3-4cd5-a387-e10f708402d2","resolution":{"observed_at":"2026-08-08T22:57:13.869742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:12.638465Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.638465Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:554d0764c3ea7f8744edc198359c6f23adb94c98596ec3879a67bb33f9f1f830","observation_id":"6715730b-9f74-4afe-beba-3889b44ef644","resolution":{"observed_at":"2026-08-08T22:57:12.638465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19534","last_updated":"2024-10-31T14:32:28Z","snapshot_observed_at":"2026-08-16T13:48:00.309039Z","submitted_at":"2024-05-29T21:29:44Z","title":"Preference Learning Algorithms Do Not Learn Preference Rankings","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19534","snapshot_observed_at":"2026-08-08T22:57:12.643098Z","title":"Preference learning algorithms do not learn preference rankings","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.643098Z"},"links":{"cited_paper":"/paper/2405.19534","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:d6581490652a9cda11bccf92b38c5b851368b81f553e9c7d6ec99c592e0be165","observation_id":"783e1512-f46d-4dda-8cd1-732d3404c361","resolution":{"observed_at":"2026-08-08T22:57:12.643098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17288","last_updated":"2024-04-29T18:38:26Z","snapshot_observed_at":"2026-08-16T14:56:29.843666Z","submitted_at":"2023-09-29T14:46:30Z","title":"AutoAgents: A Framework for Automatic Agent Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17288","snapshot_observed_at":"2026-08-08T22:57:12.648358Z","title":"Autoagents: A framework for automatic agent generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.648358Z"},"links":{"cited_paper":"/paper/2309.17288","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:cd18ecca58fc13df3477e1a7455caf2a7f7812ad79fac71cd10df134db228998","observation_id":"db93fe2f-df8b-4c0a-8d2f-fef6567543bb","resolution":{"observed_at":"2026-08-08T22:57:12.648358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-08T22:57:12.653008Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.653008Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:95313d5af3ebbeb332c0b47b8c9e96da5aecd4346b98274d3041b64aa9bf5546","observation_id":"bbe9f0a0-813a-492a-8ed9-a5e07f1aeae5","resolution":{"observed_at":"2026-08-08T22:57:12.653008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T22:57:12.657855Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.657855Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:f6f9409c97c0b8a4d6176459a7b9fcfccfeb82e59b220920d813e72a1b0ceac6","observation_id":"39132a60-e940-4c92-b3b1-5acf31439456","resolution":{"observed_at":"2026-08-08T22:57:12.657855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:12.662885Z","title":"DROP: A reading comprehension benchmark requiring discrete reasoning over paragraphs","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.662885Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:217782c9ff329c3d589602eef2757d3689a605570180af3a1b089ea3bf7667da","observation_id":"9ed8e6d1-280b-488f-a08c-4529977cc6b1","resolution":{"observed_at":"2026-08-08T22:57:12.662885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-08-14T11:37:32.461743Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16797","snapshot_observed_at":"2026-08-08T22:57:12.667166Z","title":"Promptbreeder: Self-referential self-improvement via prompt evolution","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.667166Z"},"links":{"cited_paper":"/paper/2309.16797","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:aaa22ef94c9f71b9756c682a8f412b5c6c030007b7e926903bf67fd5f870394f","observation_id":"22a688a3-97ee-4aec-b0a7-5bcd43a35937","resolution":{"observed_at":"2026-08-08T22:57:12.667166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18679","last_updated":"2024-10-15T15:52:57Z","snapshot_observed_at":"2026-08-16T14:14:23.095590Z","submitted_at":"2024-02-28T19:49:55Z","title":"Data Interpreter: An LLM Agent For Data Science","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18679","snapshot_observed_at":"2026-08-08T22:57:12.672145Z","title":"Data interpreter: An llm agent for data science","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.672145Z"},"links":{"cited_paper":"/paper/2402.18679","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:e3002d05da421fe5e0f0e9df6a6580c0a2965111a96979fe110c90e56d3aea5e","observation_id":"523419a9-71b1-49a0-bd12-65b3a6e44f69","resolution":{"observed_at":"2026-08-08T22:57:12.672145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.832215Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, and Weizhu Chen","venue":null,"work_id":"26ff10d0-6a8c-4249-af81-81a7abe7f4b3","year":2022},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.676662Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:bb19a94057f106672ac29f7680deada864d9f50acf4f8ed2f35c86a56bf1a786","observation_id":"b17995c6-1247-46e8-8fd5-82887e161ca6","resolution":{"observed_at":"2026-08-08T22:57:13.836771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.817540Z","title":"Automated design of agentic systems","venue":null,"work_id":"69eeb58b-84c6-40ac-9187-63ef0333bfb5","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.680923Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:1b209212062dc95dafd8a04222018541902274dab26b2e481f8b8822722be170","observation_id":"66f9f549-15d9-4508-9cce-51f1e93e5fb4","resolution":{"observed_at":"2026-08-08T22:57:13.822483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17031","last_updated":"2024-03-24T02:59:27Z","snapshot_observed_at":"2026-08-18T11:13:28.954163Z","submitted_at":"2024-03-24T02:59:27Z","title":"The N+ Implementation Details of RLHF with PPO: A Case Study on TL;DR Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17031","snapshot_observed_at":"2026-08-08T22:57:12.685241Z","title":"The n+ implementation details of rlhf with ppo: A case study on tl; dr summarization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.685241Z"},"links":{"cited_paper":"/paper/2403.17031","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:91911ebc060b409facc9a00d0de7f59dc8fe4fd6090a878dbd6d11172b29b535","observation_id":"f9036684-3777-4203-a531-692cecb8b42b","resolution":{"observed_at":"2026-08-08T22:57:12.685241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04298","last_updated":"2024-09-06T01:14:26Z","snapshot_observed_at":"2026-08-17T22:52:54.773071Z","submitted_at":"2024-04-04T20:27:37Z","title":"SELF-[IN]CORRECT: LLMs Struggle with Discriminating Self-Generated Responses","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04298","snapshot_observed_at":"2026-08-08T22:57:12.690459Z","title":"Self-[in] correct: Llms struggle with refining self-generated responses","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.690459Z"},"links":{"cited_paper":"/paper/2404.04298","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:ee1dc70424d4ffd352944ec88c681b1e8bb7681c71a60e3d3456605e41b9de8f","observation_id":"34217c21-d590-4e49-9398-d3b734f99674","resolution":{"observed_at":"2026-08-08T22:57:12.690459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.801796Z","title":"Dspy: Compil- ing declarative language model calls into state-of-the-art pipelines","venue":null,"work_id":"422babd6-ed23-4be8-a9a6-2d7eb05a518d","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.694921Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:74cda0ec05d2af940749f4633e13ffb331c130a377b2f319729aef8d64392d36","observation_id":"0eacf067-512e-41a4-946a-f8b685c3d21f","resolution":{"observed_at":"2026-08-08T22:57:13.806667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:12.699289Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.699289Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:c72adcb227642fdd8e5530e20ec5bdb43086b6cee1cd2d3eba3ec509d11efeda","observation_id":"a57525fb-7c3a-44ad-8b1d-0b1ebe9974ad","resolution":{"observed_at":"2026-08-08T22:57:12.699289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12821","last_updated":"2024-07-01T21:05:02Z","snapshot_observed_at":"2026-08-18T16:26:17.064804Z","submitted_at":"2024-07-01T21:05:02Z","title":"AutoFlow: Automated Workflow Generation for Large Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12821","snapshot_observed_at":"2026-08-08T22:57:12.703649Z","title":"Autoflow: Automated workflow generation for large language model agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.703649Z"},"links":{"cited_paper":"/paper/2407.12821","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:2edc05cc955a2383eee63a557ef40631ebb383e48297c1b76e10d585f64ee1fc","observation_id":"5aec9b39-8049-4888-bd3c-0ba7e85892e1","resolution":{"observed_at":"2026-08-08T22:57:12.703649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-08T22:57:12.708501Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.708501Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:d168db6a084cacefc506594422cacfab788c302494083320c1de4eeebf1c4285","observation_id":"9182281b-7a15-4fd4-9b4f-7ffc17c828cd","resolution":{"observed_at":"2026-08-08T22:57:12.708501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:12.713084Z","title":"A dynamic llm-powered agent network for task-oriented agent collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.713084Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:1fd3b2e91ce1d8f1c2488fad4f4e32221c26aa22bd31aadd1391bd8a11b9de82","observation_id":"b6dcd6c3-db4d-424a-997a-ca66c168ca8c","resolution":{"observed_at":"2026-08-08T22:57:12.713084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.767587Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":"49ef5043-cc35-4edc-a818-2d020bb59f02","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.717444Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:902f67265ca33c1b66d1ff8ffd6bfe71064f9b12c000db3759f4720212c32859","observation_id":"68acb43a-21cb-41fb-8287-a80311037be4","resolution":{"observed_at":"2026-08-08T22:57:13.772353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-16T13:50:07.192537Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-08T22:57:12.721732Z","title":"Simpo: Simple preference optimization with a reference- free reward","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.721732Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:553d2ed042e28d3c366b907ee942a63d02781b38926cc1073683a9192897a4ed","observation_id":"afa58b2c-fcc2-4aad-b839-c1d5bb82114a","resolution":{"observed_at":"2026-08-08T22:57:12.721732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16452","last_updated":"2023-11-28T03:16:12Z","snapshot_observed_at":"2026-08-16T14:39:48.082697Z","submitted_at":"2023-11-28T03:16:12Z","title":"Can Generalist Foundation Models Outcompete Special-Purpose Tuning? Case Study in Medicine","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16452","snapshot_observed_at":"2026-08-08T22:57:12.726195Z","title":"Can generalist foundation models outcompete special-purpose tuning? case study in medicine","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.726195Z"},"links":{"cited_paper":"/paper/2311.16452","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:478cc3a856d43c96ba1d4550bb958857db174932ae7354e4ba701131af912c2c","observation_id":"3c524b6e-e454-4f60-8800-0d5e6d45c54e","resolution":{"observed_at":"2026-08-08T22:57:12.726195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.753071Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"b834b7b8-c627-4b78-a266-1319a5f8b34f","year":2022},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.730665Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:cc16401225396ac7d6f3855edd31103c4ecd3d821226f58d3de88fb5f2000fcc","observation_id":"995c473c-f3e3-40b5-b607-113fb98b3c4b","resolution":{"observed_at":"2026-08-08T22:57:13.757784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.737366Z","title":"Disentangling length from quality in direct preference optimization","venue":null,"work_id":"e5b99288-058d-41c9-89b7-e4b47351a567","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.734619Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:1adeae3c73ae138da7a19434eb396aa09ee9ac39775be4df5254a1771386bfd8","observation_id":"e09a88e1-aa5e-4373-adf5-19920e30f149","resolution":{"observed_at":"2026-08-08T22:57:13.742715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:12.738726Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.738726Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:107e4dc1b51c1fa041741c1a9a64a5cca93a53a1ab09be17f1df09cc98395e06","observation_id":"96c6840c-58d5-4b4e-9a3d-c39a35a5bcaa","resolution":{"observed_at":"2026-08-08T22:57:12.738726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08500","last_updated":"2024-01-16T17:00:36Z","snapshot_observed_at":"2026-08-17T15:38:45.204670Z","submitted_at":"2024-01-16T17:00:36Z","title":"Code Generation with AlphaCodium: From Prompt Engineering to Flow Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08500","snapshot_observed_at":"2026-08-08T22:57:12.743463Z","title":"Code generation with alphacodium: From prompt engineering to flow engineering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.743463Z"},"links":{"cited_paper":"/paper/2401.08500","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:a3433709b17ccb5f23ee3d43cfff01e5da6931543a262b5a6f22759c3e3f37a5","observation_id":"730793c5-2d09-4834-bd38-8a53edb308ad","resolution":{"observed_at":"2026-08-08T22:57:12.743463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15254","last_updated":"2025-06-10T21:52:15Z","snapshot_observed_at":"2026-08-18T09:10:51.874242Z","submitted_at":"2024-09-23T17:53:42Z","title":"Archon: An Architecture Search Framework for Inference-Time Techniques","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15254","snapshot_observed_at":"2026-08-08T22:57:12.748007Z","title":"Archon: An architecture search framework for inference-time techniques","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.748007Z"},"links":{"cited_paper":"/paper/2409.15254","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:421634cb0315b70eab7368738c3e09ec9ed3b06fc3f6a94039bf65ce7489b12c","observation_id":"c7637e98-1356-47e2-bc61-66235a1b08d6","resolution":{"observed_at":"2026-08-08T22:57:12.748007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-08T22:57:12.752579Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.752579Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:6a2e0e2ffdcf278dc9492a3791c3884bcc541fd59c188307a78d79f7472ddfee","observation_id":"590e455e-1797-4d30-b5a0-3605336b837d","resolution":{"observed_at":"2026-08-08T22:57:12.752579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.712116Z","title":"Reflexion: Language agents with verbal reinforcement learning","venue":null,"work_id":"b8c0d7c7-7e82-45f3-b437-bdb3f0795834","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.757173Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:1f9368d97bf101cac8fafaf170663f81ff9753d83f2423000e32f3a75fc1f0da","observation_id":"1552c035-da6d-403d-9411-129bc9a05d11","resolution":{"observed_at":"2026-08-08T22:57:13.716896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19425","last_updated":"2025-03-02T06:36:57Z","snapshot_observed_at":"2026-08-17T22:52:14.603469Z","submitted_at":"2024-05-29T18:08:37Z","title":"Adaptive In-conversation Team Building for Language Model Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19425","snapshot_observed_at":"2026-08-08T22:57:12.761310Z","title":"Adaptive in-conversation team building for language model agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.761310Z"},"links":{"cited_paper":"/paper/2405.19425","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:87b196ddade2d093ef5dd7f626f76b0fcbded0b5a2c6cebd4bbbf1557beec1be","observation_id":"cf0d7583-db8f-4d2a-a930-ba87247585b7","resolution":{"observed_at":"2026-08-08T22:57:12.761310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T22:57:12.765587Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.765587Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:c083fe09df8648acc4615e104ffc69903e488a0823e4d974621b5289665fcd34","observation_id":"957d2528-5de7-43b6-9827-a7763559cb4f","resolution":{"observed_at":"2026-08-08T22:57:12.765587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.696171Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":"51cb78bc-ab2b-4652-b18b-a6a4742edbbf","year":2022},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.770342Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:67a1f5dba75f2282c03c703a5e486c43d481ea332d270e7bfd86ca91f4a69656","observation_id":"cfa4f3c3-9a2d-4b3b-a7b0-b030e6a684a6","resolution":{"observed_at":"2026-08-08T22:57:13.701555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.680675Z","title":"Unleashing the emergent cognitive synergy in large language models: A task-solving agent through multi- persona self-collaboration","venue":null,"work_id":"0544f3b3-85dc-447e-b84a-6a5a33694a72","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.774619Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:69c208c8f0e883ea080f28202b2043627c114ba8b78ca3716be260d87fb8a7e9","observation_id":"9a66ec3b-ca81-4111-8059-3af9c63ef40c","resolution":{"observed_at":"2026-08-08T22:57:13.685561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:12.779256Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.779256Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:92eb58f47d917c5a2b90a89475d6ed3b5e003849f31439c3dfa9e4a0b699c439","observation_id":"0d8999c4-e272-4ada-9252-1e886f0e2e92","resolution":{"observed_at":"2026-08-08T22:57:12.779256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.656674Z","title":"Is dpo superior to ppo for llm alignment? a comprehensive study","venue":null,"work_id":"7fc8f7e8-c97f-41de-b1c6-2a4d1bca64a4","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.783467Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:09ebdb9ffcea035a0506c8661901ee7fc1a841d4defe473f2b1acd4767109d5d","observation_id":"75839ae2-a980-484e-ad82-47651ca6bd13","resolution":{"observed_at":"2026-08-08T22:57:13.661527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.641607Z","title":"Lemur: Harmonizing natural language and code for language agents","venue":null,"work_id":"ef9344fa-3d87-4b35-afef-f9d75fc3b11d","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.787784Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:fba24a9707d0e6dc92184e0ccb95f584283ae0bf2d4f90fb0916495f5c58882f","observation_id":"29de14fb-a760-4134-8026-859dbf0b7960","resolution":{"observed_at":"2026-08-08T22:57:13.646406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-08T22:57:12.792051Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.792051Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:a545fa728dd2542387bff1fe7e903496185dfb33ec6958a8521dfa7be34e7e11","observation_id":"af447a64-30b5-454f-a568-7a1014933a12","resolution":{"observed_at":"2026-08-08T22:57:12.792051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03409","last_updated":"2024-04-15T07:50:32Z","snapshot_observed_at":"2026-08-15T09:21:11.223719Z","submitted_at":"2023-09-07T00:07:15Z","title":"Large Language Models as Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03409","snapshot_observed_at":"2026-08-08T22:57:12.796606Z","title":"Large language models as optimizers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.796606Z"},"links":{"cited_paper":"/paper/2309.03409","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:c6c90acea3392529648ecd06ce9fde55eccaaa14c81d1c53bd02fc569438f3b0","observation_id":"872f6fb6-0f25-49dd-8a5c-51a2cfa4610e","resolution":{"observed_at":"2026-08-08T22:57:12.796606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.626829Z","title":"Buffer of thoughts: Thought-augmented reasoning with large language models","venue":null,"work_id":"935fa6a2-06ba-4906-8632-868af369de60","year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.801065Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:28e333236202ae3b6e5d0aee98932401b244aab0767568fc877033354478d49a","observation_id":"34433255-8367-41b9-b74a-996117b5ff42","resolution":{"observed_at":"2026-08-08T22:57:13.631900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09008","last_updated":"2025-02-26T06:32:31Z","snapshot_observed_at":"2026-08-16T13:10:14.611901Z","submitted_at":"2024-10-11T17:25:52Z","title":"SuperCorrect: Advancing Small LLM Reasoning with Thought Template Distillation and Self-Correction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09008","snapshot_observed_at":"2026-08-08T22:57:12.805488Z","title":"Supercorrect: Supervising and correcting language models with error-driven insights","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.805488Z"},"links":{"cited_paper":"/paper/2410.09008","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:99d2e3f8604ee6f17542569e25e045c0ffb0149c7ff16512435fc3a4b6d11e62","observation_id":"a8523c9a-d6f9-495e-a4c8-9ba3a264929d","resolution":{"observed_at":"2026-08-08T22:57:12.805488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.611958Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":"d93062a1-7ceb-4692-97e9-f30ff73de9e0","year":2018},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.809888Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:cf225c9aa8ff2e32fa027508977310cbdf9844b597b19faa892ababd3fc64fcc","observation_id":"eebd04e1-989f-4d39-bc8d-b7abc32cb453","resolution":{"observed_at":"2026-08-08T22:57:13.616769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07496","last_updated":"2024-06-11T17:32:21Z","snapshot_observed_at":"2026-08-13T02:15:58.634561Z","submitted_at":"2024-06-11T17:32:21Z","title":"TextGrad: Automatic \"Differentiation\" via Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07496","snapshot_observed_at":"2026-08-08T22:57:12.814593Z","title":"Textgrad: Automatic ”differentiation” via text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.814593Z"},"links":{"cited_paper":"/paper/2406.07496","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:cf58da7fa892f12608b220ed04e777737a89e062a18869dd93c419c90de53f3e","observation_id":"056913e2-58e7-4a41-b99d-e8a92a24c65e","resolution":{"observed_at":"2026-08-08T22:57:12.814593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11782","last_updated":"2025-02-06T15:37:52Z","snapshot_observed_at":"2026-08-16T20:58:20.513341Z","submitted_at":"2024-10-15T17:01:21Z","title":"G-Designer: Architecting Multi-agent Communication Topologies via Graph Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11782","snapshot_observed_at":"2026-08-08T22:57:12.819438Z","title":"G-designer: Architecting multi-agent communication topologies via graph neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.819438Z"},"links":{"cited_paper":"/paper/2410.11782","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:57bb831a5686b3f4f0a2960d5a37a6f96f5dd4481a31f1f9a853bca588127c89","observation_id":"28aae596-721c-49e4-9ebf-e193d166fa80","resolution":{"observed_at":"2026-08-08T22:57:12.819438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10762","last_updated":"2025-04-15T02:44:55Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:40:40Z","title":"AFlow: Automating Agentic Workflow Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10762","snapshot_observed_at":"2026-08-08T22:57:12.824216Z","title":"Aflow: Automating agentic workflow generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.824216Z"},"links":{"cited_paper":"/paper/2410.10762","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:e21e303bd66642f3acd144c5def91df77a809c21bf2c9a566884b596e621c6e9","observation_id":"c84e06ba-b204-4691-869a-70b5adf62783","resolution":{"observed_at":"2026-08-08T22:57:12.824216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14963","last_updated":"2025-03-27T07:08:33Z","snapshot_observed_at":"2026-08-16T13:58:33.568799Z","submitted_at":"2024-04-23T12:16:05Z","title":"Achieving >97% on GSM8K: Deeply Understanding the Problems Makes LLMs Better Solvers for Math Word Problems","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14963","snapshot_observed_at":"2026-08-08T22:57:12.828725Z","title":"Achiev- ing¿ 97% on gsm8k: Deeply understanding the problems makes llms perfect reasoners.arXiv preprint arXiv:2404.14963, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.828725Z"},"links":{"cited_paper":"/paper/2404.14963","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:36cc2f877e89e7aa6cb3c4dce5036e5fe34a5a2e28b1dd244501da8263993bc3","observation_id":"2aa3e9ba-73b0-476d-9f36-219b6f159f2b","resolution":{"observed_at":"2026-08-08T22:57:12.828725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18532","last_updated":"2024-06-26T17:59:18Z","snapshot_observed_at":"2026-08-18T00:31:42.941116Z","submitted_at":"2024-06-26T17:59:18Z","title":"Symbolic Learning Enables Self-Evolving Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18532","snapshot_observed_at":"2026-08-08T22:57:12.833466Z","title":"Symbolic learning enables self-evolving agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.833466Z"},"links":{"cited_paper":"/paper/2406.18532","citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:ba4fc86905e6dbf2d0ba4f3f13b75634b6486af2a6abad955e2cf1f32d08b816","observation_id":"7ae5b654-d6f7-4043-b10e-578f07115c06","resolution":{"observed_at":"2026-08-08T22:57:12.833466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:12.838215Z","title":"\"\" This is a wor kf low graph","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.838215Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:f4f55f1859a368180482ed0933b435b990d4eea5be28a090aa916eb89a198975","observation_id":"4a2e3f73-e73a-4640-99e3-4f25bb359481","resolution":{"observed_at":"2026-08-08T22:57:12.838215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.596692Z","title":"Format MUST follow : custom ( i n s t r u c t i o n : str ) -> str You can modify the i n s t r u c t i o n prompt","venue":null,"work_id":"1a2575b1-4430-4e15-975d-a9ea5f59ca1f","year":null},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.842713Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:1cbab2972c95aad4bb79c8e847999def20266d9742e80ae2a2b849cfa08551c7","observation_id":"8a7763ed-99b6-40b2-b47c-9a5e5f0c87b0","resolution":{"observed_at":"2026-08-08T22:57:13.601950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.581747Z","title":null,"venue":null,"work_id":"5ba72964-1dd5-410e-937f-2c4a06465558","year":null},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.847115Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:acaa37a612f08bab10b6f4a4c18b7771c890ef4c06e685e6e0e9aeb6d1a308ba","observation_id":"f7132786-fb17-40e0-877a-7e974988f781","resolution":{"observed_at":"2026-08-08T22:57:13.586250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.565576Z","title":"Format MUST follow : a n s w e r _ g e n e r a t e () -> str For example : so lu tio n = await self","venue":null,"work_id":"1f21f535-e74b-4512-9908-e01401f9d037","year":null},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.852322Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:3bab7c31dd32e47da1ce8f902c6e3e7899f8c456c45886cc0a3287fc031b51b6","observation_id":"6e5e3a19-ae31-4779-a77e-fa615ea6dd22","resolution":{"observed_at":"2026-08-08T22:57:13.571072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.551057Z","title":null,"venue":null,"work_id":"a4fa5ab1-cef4-4bb9-8d96-3ff0dad1c057","year":null},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.856799Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:452c2d53a62a8d2124754e0c6c748fb1f44349fa45096dada6cd4fa98192aaaf","observation_id":"7e8f3ce8-6a70-498b-9671-0c4c8b1cde36","resolution":{"observed_at":"2026-08-08T22:57:13.555653Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.535400Z","title":null,"venue":null,"work_id":"2c0ff1ac-1f93-418a-860e-20fa4518cc63","year":null},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.861442Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:5cf4411c86d004dd300abee15f7a5e4b23980590a7698e81afffac68939761e6","observation_id":"37c5180b-f107-4b6e-b2c7-fd36eaa2b531","resolution":{"observed_at":"2026-08-08T22:57:13.540101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.520349Z","title":null,"venue":null,"work_id":"6b8f21a7-c0cc-4fff-973e-0346ab0cd116","year":null},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.865732Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:1bbfbac4294ea36435926786ac0173aaa89455afa87e8324e74dc48d74f3e509","observation_id":"b0b2d1a0-ab32-4f7e-a8de-7e1c27894b5f","resolution":{"observed_at":"2026-08-08T22:57:13.524891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T22:57:13.503681Z","title":"\"\" This is a wor kf low graph","venue":null,"work_id":"8ac0f1fd-701b-4c4a-9aed-97ca54ae5d8a","year":2000},"citing_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T22:57:12.869989Z"},"links":{"citing_paper":"/paper/2502.04306"},"observation_digest":"sha256:8db1a88b0dfc4f963856a0ed5b81baff8e211e82e053929fb0071040f05fdd8e","observation_id":"8576080f-d72b-4221-b476-829f078754ea","resolution":{"observed_at":"2026-08-08T22:57:13.509722Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 14 inbound Pith citation observations for arXiv:2502.04306."}