{"as_of":"2026-08-17T22:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d6422c284e0111ea128d6e30a20b53c0c312d8a84bf0f19d5f70e611b398de21","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:33:02.934738Z","state":"measured"},{"denominator":87,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":87,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:21:40.459605Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T14:17:10.147620Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-08-09T17:44:03.765759Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.00806","last_updated":"2025-04-25T05:12:51Z","snapshot_observed_at":"2026-08-16T02:11:17.975189Z","submitted_at":"2025-02-02T14:04:53Z","title":"UniGraph2: Learning a Unified Embedding Space to Bind Multimodal Graphs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T17:44:03.765759Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2502.00806"},"observation_digest":"sha256:5391b665705d5608100bea9f93282fceb74d1875c7aa61fcf85de383c1b164c3","observation_id":"1d0c77ce-042c-467e-a1a3-8002a524dab7","resolution":{"observed_at":"2026-08-09T17:44:03.765759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-08-15T20:21:40.459605Z","title":"Flowreasoner: Reinforcing query-level meta-agents.arXiv preprint arXiv:2504.15257, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13426","last_updated":"2025-05-19T17:54:39Z","snapshot_observed_at":"2026-08-16T18:48:02.870022Z","submitted_at":"2025-05-19T17:54:39Z","title":"G1: Bootstrapping Perception and Reasoning Abilities of Vision-Language Model via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:40.459605Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2505.13426"},"observation_digest":"sha256:c85cc9b6bc151040b24845dce0a8ea98eda229d51e4d2ab4d642e9f7a9a25675","observation_id":"1c4d1528-a51b-4f91-89a1-44542b429875","resolution":{"observed_at":"2026-08-15T20:21:40.459605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-08-07T13:00:07.280769Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22967","last_updated":"2025-05-29T01:08:36Z","snapshot_observed_at":"2026-08-16T13:55:34.491384Z","submitted_at":"2025-05-29T01:08:36Z","title":"MermaidFlow: Redefining Agentic Workflow Generation via Safety-Constrained Evolutionary Programming","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:07.280769Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2505.22967"},"observation_digest":"sha256:f82ebc0719c0282d50d127a252beaf0de9b172342231d438461a2df67c30dc20","observation_id":"c0403561-f31d-4c25-9f6d-771c7d7002fe","resolution":{"observed_at":"2026-08-07T13:00:07.280769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-08-06T16:59:39.941777Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11988","last_updated":"2025-07-17T03:34:27Z","snapshot_observed_at":"2026-08-17T15:27:11.231613Z","submitted_at":"2025-07-16T07:38:28Z","title":"Aime: Towards Fully-Autonomous Multi-Agent Framework","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T16:59:39.941777Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2507.11988"},"observation_digest":"sha256:b562f9c82ea5827fc7016c7ea3f94cad9fbdc0a9cf04a071b040c65d21abe767","observation_id":"d6c76f69-800a-401c-9415-72961e538eb6","resolution":{"observed_at":"2026-08-06T16:59:39.941777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"reference_index":274,"source":"arxiv_source","source_observed_at":"2026-05-14T22:23:14.621091Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2507.21046"},"observation_digest":"sha256:7afb31dc7026010e7d49c0f8e506c6261fcec143fdee47f83519cfb641e3bdef","observation_id":"d71509ef-f199-496f-98c6-638059431cc9","resolution":{"observed_at":"2026-05-14T22:23:15.343837Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-08-06T12:51:59.079387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.21407","last_updated":"2025-08-30T06:01:56Z","snapshot_observed_at":"2026-08-15T03:27:34.517290Z","submitted_at":"2025-07-29T00:27:12Z","title":"Graph-Augmented Large Language Model Agents: Current Progress and Future Prospects","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T12:51:59.079387Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2507.21407"},"observation_digest":"sha256:239b9d642c2265564f945d607f77bd921c97f92e63551a6c6c973320ab1ba800","observation_id":"3cca4135-475c-4b29-b9ae-3aa42e41fc93","resolution":{"observed_at":"2026-08-06T12:51:59.079387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2508.07407","last_updated":"2025-08-31T14:55:05Z","snapshot_observed_at":"2026-08-10T13:27:07.744131Z","submitted_at":"2025-08-10T16:07:32Z","title":"A Comprehensive Survey of Self-Evolving AI Agents: A New Paradigm Bridging Foundation Models and Lifelong Agentic Systems","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T23:21:42.029285Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2508.07407"},"observation_digest":"sha256:998a6f2abf74b3c2c4592744c870af01cd1d20366455e8715e3439fa3b7acfc0","observation_id":"550ee823-b7fd-4278-a5d6-657e204c8381","resolution":{"observed_at":"2026-05-15T23:21:42.385695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2510.05746","last_updated":"2026-05-19T06:43:05Z","snapshot_observed_at":"2026-08-16T20:05:23.015714Z","submitted_at":"2025-10-07T10:04:48Z","title":"ARM: Discovering Agentic Reasoning Modules for Generalizable Multi-Agent Systems","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T20:47:24.114157Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2510.05746"},"observation_digest":"sha256:8d805c4347759eba72ada6027149fe36a0de251010d5280562393457c9c1d356","observation_id":"b23e3449-b1b4-4a96-bde0-cb72041969ff","resolution":{"observed_at":"2026-05-21T20:50:36.706338Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2603.25111","last_updated":"2026-04-24T19:01:59Z","snapshot_observed_at":"2026-07-06T22:50:37.468743Z","submitted_at":"2026-03-26T07:32:20Z","title":"SEVerA: Verified Synthesis of Self-Evolving Agents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T00:34:10.481373Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2603.25111"},"observation_digest":"sha256:620f6cefae04802b43622d9fd95504d3dd0b7c7026af6d4c3d27c66777bf6d1e","observation_id":"8f1186a3-292a-422e-93e9-bf05475ea59f","resolution":{"observed_at":"2026-05-15T00:38:23.510479Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2604.17503","last_updated":"2026-04-19T15:46:46Z","snapshot_observed_at":"2026-08-13T22:54:35.604766Z","submitted_at":"2026-04-19T15:46:46Z","title":"SkillGraph: Self-Evolving Multi-Agent Collaboration with Multimodal Graph Topology","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T05:23:34.996713Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2604.17503"},"observation_digest":"sha256:4cdf93542e5daf31eb5db82361328f13c9a02c7dee0463064ddf8f00a0dd86d3","observation_id":"15d595bf-8285-4af7-b04c-edc22189e5ff","resolution":{"observed_at":"2026-05-10T05:25:54.988476Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2605.08401","last_updated":"2026-05-15T12:46:04Z","snapshot_observed_at":"2026-08-11T06:44:47.502612Z","submitted_at":"2026-05-08T19:06:55Z","title":"AIPO: Learning to Reason from Active Interaction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T01:17:28.124867Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2605.08401"},"observation_digest":"sha256:527b79742af31667a9dd9c0e55cce09b1810cc589385ff5411442ad5c0b34deb","observation_id":"c0402598-6857-41d4-a237-bc5377409584","resolution":{"observed_at":"2026-05-12T08:06:31.780262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2605.08401","last_updated":"2026-05-15T12:46:04Z","snapshot_observed_at":"2026-08-11T06:44:47.502612Z","submitted_at":"2026-05-08T19:06:55Z","title":"AIPO: Learning to Reason from Active Interaction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T18:07:27.492419Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2605.08401"},"observation_digest":"sha256:2136b15dd4fda4e07444d01b4ba717a1d78693c2bca60ed6c69f0a0b5586b2c9","observation_id":"f8bfd9f9-a150-4d84-ae80-6f2d76acc975","resolution":{"observed_at":"2026-05-19T18:07:42.383559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2605.14483","last_updated":"2026-05-14T07:24:09Z","snapshot_observed_at":"2026-08-13T06:35:30.761431Z","submitted_at":"2026-05-14T07:24:09Z","title":"LEMON: Learning Executable Multi-Agent Orchestration via Counterfactual Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T02:13:46.176823Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2605.14483"},"observation_digest":"sha256:eec960f940c8d29f81a5baa66fc570f866f2eca3441d6614146184d31f6cc2d3","observation_id":"456905a1-f2c5-4868-bba3-68eef1f753a9","resolution":{"observed_at":"2026-05-15T02:18:31.440337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2605.22505","last_updated":"2026-05-21T13:55:02Z","snapshot_observed_at":"2026-08-17T21:36:22.915943Z","submitted_at":"2026-05-21T13:55:02Z","title":"Towards Direct Evaluation of Harness Optimizers via Priority Ranking","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T06:14:28.559147Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2605.22505"},"observation_digest":"sha256:5e67b5977688fc180ba5acb3f04e712d597eb0d072e56b71fc53a144ae833709","observation_id":"2404ddf3-f9ea-477a-8465-3e39a588f282","resolution":{"observed_at":"2026-05-22T06:14:40.474336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2605.29790","last_updated":"2026-05-28T11:40:16Z","snapshot_observed_at":"2026-08-06T19:17:26.541233Z","submitted_at":"2026-05-28T11:40:16Z","title":"Evolve as a Team: Collaborative Self-Evolution for LLM-based Multi-Agent Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T00:05:31.780655Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2605.29790"},"observation_digest":"sha256:40f2ffed113404efb88a29efbb7d8c65b0175700e16aca515c4c80030b630712","observation_id":"bb8e85e9-97ff-4190-8249-b9ee54a272da","resolution":{"observed_at":"2026-06-29T00:12:50.129033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2606.08656","last_updated":"2026-06-07T14:53:19Z","snapshot_observed_at":"2026-08-15T14:51:31.360266Z","submitted_at":"2026-06-07T14:53:19Z","title":"From Player to Master: Enhancing Test-Time Learning of LLM Agents via Reinforcement Learning over Memory","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T18:48:30.813878Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2606.08656"},"observation_digest":"sha256:5b2f48ee94061cdb3b050f17407883f1f4d3e9fafee715d9c3b8f66c4017adc5","observation_id":"f4c757ef-ebd4-4afa-a2e1-36c6f7cc922c","resolution":{"observed_at":"2026-07-02T22:37:25.603588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2606.12191","last_updated":"2026-06-10T15:15:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-10T15:15:01Z","title":"Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application","version":1},"reference_index":279,"source":"pdf_text","source_observed_at":"2026-06-27T09:46:30.702256Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2606.12191"},"observation_digest":"sha256:9d78b22cb6d04adc7c9bbfe6a346478dddd8631ae38dfd24854b071ae768b1f3","observation_id":"68475208-adf8-43c2-83ba-bdc56b22a43a","resolution":{"observed_at":"2026-07-03T10:58:02.903868Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2606.23537","last_updated":"2026-06-22T16:13:39Z","snapshot_observed_at":"2026-08-12T15:51:33.406694Z","submitted_at":"2026-06-22T16:13:39Z","title":"SQLConductor: Search-to-Policy Learning for Step-wise Text-to-SQL Orchestration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T06:19:42.165869Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2606.23537"},"observation_digest":"sha256:8e48f4aa5e3cd72e93340a6d295b003683b6d3f4a51e73a9fd44e87257abbd07","observation_id":"b136fec9-b0a9-4caa-8601-128eabc38303","resolution":{"observed_at":"2026-07-04T12:39:49.614349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-12T05:56:18.797766Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02942","last_updated":"2026-07-03T04:28:49Z","snapshot_observed_at":"2026-08-16T07:15:39.099146Z","submitted_at":"2026-07-03T04:28:49Z","title":"A Workflow-Aware Serving Layer for Agentic Applications","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T05:56:18.797766Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2607.02942"},"observation_digest":"sha256:960176aad4284c5b444c1a1709731aae3ff7d819d49d48137d9d94ab9625bd23","observation_id":"fc9739a4-6160-461d-98e4-cf3eb69d0ba1","resolution":{"observed_at":"2026-07-12T05:56:18.797766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2607.06935","last_updated":"2026-07-08T02:57:22Z","snapshot_observed_at":"2026-08-12T22:38:38.255404Z","submitted_at":"2026-07-08T02:57:22Z","title":"Mathematical methods of reinforcement learning","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-07-09T22:47:51.676289Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2607.06935"},"observation_digest":"sha256:f22340a0b5d2f0534665e25e934f2608851774be4e677c672fb32f633e554fee","observation_id":"e5c1a9ac-5745-4382-bbed-f61ffedad3a0","resolution":{"observed_at":"2026-07-09T22:56:37.767436Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":"2504.15257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-07-10T14:17:10.147620Z","title":"Flowreasoner: Reinforcing query-level meta-agents","venue":"cs.AI","work_id":"1e4145d4-7462-4e43-a99d-e8f0b14cab76","year":2025},"citing_paper":{"arxiv_id":"2607.07989","last_updated":"2026-07-08T23:33:49Z","snapshot_observed_at":"2026-08-16T07:40:13.122161Z","submitted_at":"2026-07-08T23:33:49Z","title":"Who Broke the System? Failure Localization in LLM-Based Multi-Agent Systems","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-07-10T14:09:11.328304Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2607.07989"},"observation_digest":"sha256:a170e8a49cee131a3d442dd8dde12556095b7e43177fe9b1ed13287bcc0136c7","observation_id":"f02e287d-aa12-41e9-9002-3ccd3bf397fe","resolution":{"observed_at":"2026-07-10T14:17:10.148893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15257","snapshot_observed_at":"2026-08-02T16:08:11.749229Z","title":"arXiv preprint arXiv:2504.15257 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21596","last_updated":"2026-04-18T06:52:42Z","snapshot_observed_at":"2026-08-14T00:21:23.938127Z","submitted_at":"2026-04-18T06:52:42Z","title":"FlowEvo: Self-Evolving Agents through the Co-Evolution of Workflows and Executable Skills","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T16:08:11.749229Z"},"links":{"cited_paper":"/paper/2504.15257","citing_paper":"/paper/2607.21596"},"observation_digest":"sha256:1deeb4708ba8f9fd91b2605c8328d46a59ebc89a9cac5f013f845f6c62a3f68a","observation_id":"d20a202d-5868-4dd5-a57e-e055f32996dd","resolution":{"observed_at":"2026-08-02T16:08:11.749229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.15257/citation-record","integrity":"/paper/2504.15257/integrity","json":"/paper/2504.15257/citation-record.json","paper":"/paper/2504.15257"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T11:33:02.683212Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.683212Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:be4e87f6409f414ba39fb385ec66605a5c743674ffe0eff9fcc1d3e7a9e9ed79","observation_id":"6ee43994-98be-498b-a1a9-8cf67686fcdc","resolution":{"observed_at":"2026-08-16T11:33:02.683212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.689711Z","title":"Introducing computer use, a new claude 3.5 sonnet, and claude 3.5 haiku","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.689711Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:d7f7355904edc6568e7e0435e99904e3dc1cd1056dfff4c66846cb8e47751f7d","observation_id":"264628c1-4352-48d0-b318-801b1d20ae13","resolution":{"observed_at":"2026-08-16T11:33:02.689711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:03.918758Z","title":"Abstraction and reasoning corpus for artificial general intelligence","venue":null,"work_id":"85c9d7d4-42c9-4424-afdc-9763b754d83a","year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.693679Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:d84e6e8e0c680a4e7a7ffff57f9bf01007562f29716e937134fa64bce4a7885b","observation_id":"a08217a4-f485-4ee3-9d7d-f29009582fc2","resolution":{"observed_at":"2026-08-16T11:33:03.922645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-16T11:33:02.697750Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.697750Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:0e3f01eaa079f634dac09516252e3d7844c4d1bf4c2736bf7349ed8adf2b3aaf","observation_id":"287d1fff-fcc7-42ec-a0f3-dfad7517043e","resolution":{"observed_at":"2026-08-16T11:33:02.697750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17288","last_updated":"2024-04-29T18:38:26Z","snapshot_observed_at":"2026-08-16T14:56:29.843666Z","submitted_at":"2023-09-29T14:46:30Z","title":"AutoAgents: A Framework for Automatic Agent Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17288","snapshot_observed_at":"2026-08-16T11:33:02.701787Z","title":"Autoagents: A framework for automatic agent generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.701787Z"},"links":{"cited_paper":"/paper/2309.17288","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:1af3cc300bc91f5dfb2fbd0c9314976bec865e68e68c1718e8550d7c121c736b","observation_id":"9a7c5b20-7e94-4af4-b08f-6be343336e7a","resolution":{"observed_at":"2026-08-16T11:33:02.701787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-16T11:33:02.705975Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.705975Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:f72580c38b9ec2caab6aaba4a079e504dbcc56148a2e2be69a44e0f448bd57e1","observation_id":"10bab2bc-e100-4524-a3fb-f710cf4c7fdb","resolution":{"observed_at":"2026-08-16T11:33:02.705975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10848","last_updated":"2023-10-23T05:05:15Z","snapshot_observed_at":"2026-08-17T11:26:57.477995Z","submitted_at":"2023-08-21T16:47:11Z","title":"AgentVerse: Facilitating Multi-Agent Collaboration and Exploring Emergent Behaviors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10848","snapshot_observed_at":"2026-08-16T11:33:02.710623Z","title":"Agentverse: Facilitating multi-agent collaboration and exploring emergent behaviors in agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.710623Z"},"links":{"cited_paper":"/paper/2308.10848","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:45f5835e4abc6da58a938de3dbb0349781159921b5c05da1a61f9a8943082476","observation_id":"63ba88e0-3607-402b-805b-a324d1769259","resolution":{"observed_at":"2026-08-16T11:33:02.710623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-16T11:33:02.714575Z","title":"Do not think that much for 2+ 3=? on the overthinking of o1-like llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.714575Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:bdfb6d60c5059f481fb8bcfd6ca4054862996a69d2f45d08f12d3ca24506d711","observation_id":"988b3f32-3b44-48f5-8349-b232c25e7617","resolution":{"observed_at":"2026-08-16T11:33:02.714575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:03.907704Z","title":"Introducing devin, the first ai software engineer","venue":null,"work_id":"3fb27330-fc42-4500-96c3-0e44ec017a7d","year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.718696Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:bec789f54ab418c6bfaee3cb73e7b1a1f3de2cf38e98bd20cacc6e65651bd2de","observation_id":"a159517d-cde0-4a02-918f-e3a67ea3a442","resolution":{"observed_at":"2026-08-16T11:33:03.911588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-08-16T11:33:02.722739Z","title":"Improving factuality and reasoning in language models through multiagent debate, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.722739Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:86c4bc909785d088555799658854b7e1a64c8701dc101be13fbb36f268b8a4e9","observation_id":"26289e74-bca3-45aa-8d6b-1404cb804225","resolution":{"observed_at":"2026-08-16T11:33:02.722739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.726750Z","title":"Heterogeneous swarms: Jointly optimizing model roles and weights for multi-llm systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.726750Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:3b5f77e73f671c14664e91a9c3617c7579e91a2ce25b26f37ba50e3a2f9b343e","observation_id":"11a8515d-6e38-42ca-a75d-cb3b334d3fd4","resolution":{"observed_at":"2026-08-16T11:33:02.726750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-08-14T11:37:32.461743Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16797","snapshot_observed_at":"2026-08-16T11:33:02.730370Z","title":"Promptbreeder: Self-referential self-improvement via prompt evolution","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.730370Z"},"links":{"cited_paper":"/paper/2309.16797","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:5076773b567e332cba572a314c26307f0555e424d7992e4d30bdb60bd9e5ccfa","observation_id":"1ff623bb-f82c-4f37-810b-996ca568ab5f","resolution":{"observed_at":"2026-08-16T11:33:02.730370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19622","last_updated":"2025-03-25T13:12:17Z","snapshot_observed_at":"2026-08-16T12:47:00.004172Z","submitted_at":"2025-03-25T13:12:17Z","title":"Exploring Hallucination of Large Multimodal Models in Video Understanding: Benchmark, Analysis and Mitigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19622","snapshot_observed_at":"2026-08-16T11:33:02.734224Z","title":"Exploring hallucination of large multimodal models in video understanding: Benchmark, analysis and mitigation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.734224Z"},"links":{"cited_paper":"/paper/2503.19622","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:28ec853c5b47cd79a625d923ce1514d5e488e4db7c7849e65b6d28535db0d281","observation_id":"6fd4926d-6a75-49a4-baed-e20566a79929","resolution":{"observed_at":"2026-08-16T11:33:02.734224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-16T14:55:24.465196Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-16T11:33:02.738000Z","title":"Think before you speak: Training language models with pause tokens","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.738000Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:5c98ef665994122055915b63b5ddfb871dee30d4a6b89ce0c99472294127bbba","observation_id":"7d72c98d-937d-4006-8ba3-bf96735209c3","resolution":{"observed_at":"2026-08-16T11:33:02.738000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01680","last_updated":"2024-04-19T01:15:16Z","snapshot_observed_at":"2026-08-10T13:10:07.804621Z","submitted_at":"2024-01-21T23:36:14Z","title":"Large Language Model based Multi-Agents: A Survey of Progress and Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01680","snapshot_observed_at":"2026-08-16T11:33:02.741754Z","title":"Large language model based multi-agents: A survey of progress and challenges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.741754Z"},"links":{"cited_paper":"/paper/2402.01680","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:bbc01060b67b2aee62756eaa36651af8e223834ea2abad867d1c401fe56fd654","observation_id":"f948012b-1672-40f5-add6-9a285914888c","resolution":{"observed_at":"2026-08-16T11:33:02.741754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-17T06:12:37.525438Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-16T11:33:02.745714Z","title":"Training large language models to reason in a continuous latent space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.745714Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:e4d641d7e6103f2ab8ea870c34c7dcc2b3f1cf5e81a3be3cd33d278487a6da95","observation_id":"068e9572-f6c2-46dc-aa3b-ce2a4a167fc8","resolution":{"observed_at":"2026-08-16T11:33:02.745714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-08-12T16:02:21.969968Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-16T11:33:02.749890Z","title":"Metagpt: Meta programming for multi-agent collaborative framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.749890Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:af0e3dca969fe0d9e41da9e6dfcca233d057b2c826cb8607613ed5f6d4fdfc7f","observation_id":"496be0ba-5e3c-4c98-9d8e-d9388f6a060f","resolution":{"observed_at":"2026-08-16T11:33:02.749890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08435","last_updated":"2025-03-02T05:13:28Z","snapshot_observed_at":"2026-08-06T11:45:45.286982Z","submitted_at":"2024-08-15T21:59:23Z","title":"Automated Design of Agentic Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08435","snapshot_observed_at":"2026-08-16T11:33:02.754082Z","title":"Automated design of agentic systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.754082Z"},"links":{"cited_paper":"/paper/2408.08435","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:8f39897ad7c7f63c59aba43d2c3e34486cef17780fd3206466c371b3a3b32e27","observation_id":"c5313048-b584-4784-bc47-3e40f509af1c","resolution":{"observed_at":"2026-08-16T11:33:02.754082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:03.895540Z","title":"Ensemble learning for heterogeneous large language models with deep parallel collaboration","venue":null,"work_id":"d1c336b5-36d9-4a09-95b0-a9693e156ba8","year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.758196Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:05a6388812b4b1a85629f2b7f03e97d06b7418b282e3b7c3d57deaed94cf92f6","observation_id":"856bfe62-c594-4e4f-8906-ca01107c0578","resolution":{"observed_at":"2026-08-16T11:33:03.899839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02561","last_updated":"2023-06-30T21:39:54Z","snapshot_observed_at":"2026-08-16T15:26:41.664301Z","submitted_at":"2023-06-05T03:32:26Z","title":"LLM-Blender: Ensembling Large Language Models with Pairwise Ranking and Generative Fusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02561","snapshot_observed_at":"2026-08-16T11:33:02.761414Z","title":"Llm-blender: Ensembling large language models with pairwise ranking and generative fusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.761414Z"},"links":{"cited_paper":"/paper/2306.02561","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:a0e7aa97f9d8f5e2575813578ecb4ea90c983b300e8a4e92273fcbf73593cd8b","observation_id":"3caed995-6180-40bc-8cc7-e312e20000ea","resolution":{"observed_at":"2026-08-16T11:33:02.761414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18702","last_updated":"2024-06-26T07:44:11Z","snapshot_observed_at":"2026-08-16T14:38:46.037887Z","submitted_at":"2023-11-30T16:52:42Z","title":"CritiqueLLM: Towards an Informative Critique Generation Model for Evaluation of Large Language Model Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18702","snapshot_observed_at":"2026-08-16T11:33:02.765083Z","title":"Critiquellm: Scaling llm-as-critic for effective and explainable evaluation of large language model generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.765083Z"},"links":{"cited_paper":"/paper/2311.18702","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:05abd894b5b612202e8cc61fdb5de3530c4de662252d0def0e4fe104531316c6","observation_id":"6e1e8a28-8308-4f94-a6db-8d899736a6ab","resolution":{"observed_at":"2026-08-16T11:33:02.765083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.768523Z","title":"Dspy: Compiling declarative language model calls into state-of-the-art pipelines","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.768523Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:3b06331246bac19526b2315b843c422d8cdf8d3816a83e0ed262a21881b8324b","observation_id":"2dfaa27a-9834-4235-bba5-19d998992f2b","resolution":{"observed_at":"2026-08-16T11:33:02.768523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-16T21:53:14.144225Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-16T11:33:02.771898Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.771898Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:bacdc61dc3205200f2adb397eea4db23e5edfc9892c0af754440d019474540e8","observation_id":"ccc4b8a6-28ac-459a-96f1-330fcadfdded","resolution":{"observed_at":"2026-08-16T11:33:02.771898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.775136Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.775136Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:15d9382ab496028013ee6895c8c068581dda25f6ab07bc98766c934ac83b9cf3","observation_id":"4d6ed369-59a4-4c20-97c9-6e8a625d6d5d","resolution":{"observed_at":"2026-08-16T11:33:02.775136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-08-16T03:33:39.637646Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12917","snapshot_observed_at":"2026-08-16T11:33:02.778415Z","title":"Training language models to self-correct via reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.778415Z"},"links":{"cited_paper":"/paper/2409.12917","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:c4c76e1ea4e70393f170d2f8a186275e49dcf9d489c8e8ae0771263a80688286","observation_id":"06a11cc6-cf4b-4284-821e-2f9dee04e089","resolution":{"observed_at":"2026-08-16T11:33:02.778415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.782699Z","title":"Camel: Communicative agents for\" mind\" exploration of large language model society","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.782699Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:057a28e15c05ec4753f6c67af593aa94c76d5da862dfe9edf47a9c1509b2ba2b","observation_id":"fac1cf42-7911-44b7-86c9-fac7a3b22a32","resolution":{"observed_at":"2026-08-16T11:33:02.782699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12821","last_updated":"2024-07-01T21:05:02Z","snapshot_observed_at":"2026-08-17T17:42:09.819449Z","submitted_at":"2024-07-01T21:05:02Z","title":"AutoFlow: Automated Workflow Generation for Large Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12821","snapshot_observed_at":"2026-08-16T11:33:02.786523Z","title":"Autoflow: Automated workflow generation for large language model agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.786523Z"},"links":{"cited_paper":"/paper/2407.12821","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:ab0f4e64308444ffc288fcb895578ec0bd3356e2551c687e4e26d26aa630b152","observation_id":"4b7f201a-6dbe-41f8-bed5-6fa3cfa0b3b8","resolution":{"observed_at":"2026-08-16T11:33:02.786523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17419","last_updated":"2025-06-25T02:24:46Z","snapshot_observed_at":"2026-08-10T09:42:17.185681Z","submitted_at":"2025-02-24T18:50:52Z","title":"From System 1 to System 2: A Survey of Reasoning Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17419","snapshot_observed_at":"2026-08-16T11:33:02.790544Z","title":"From system 1 to system 2: A survey of reasoning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.790544Z"},"links":{"cited_paper":"/paper/2502.17419","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:a5bc8d9c96487f9860a306712009cacc1e1dfa11c7cbf7dbfde05d6d25a36d7d","observation_id":"d0dce5db-5f88-456f-80de-4d7d785fe603","resolution":{"observed_at":"2026-08-16T11:33:02.790544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19118","last_updated":"2024-10-09T02:41:21Z","snapshot_observed_at":"2026-08-15T13:46:19.286791Z","submitted_at":"2023-05-30T15:25:45Z","title":"Encouraging Divergent Thinking in Large Language Models through Multi-Agent Debate","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19118","snapshot_observed_at":"2026-08-16T11:33:02.795421Z","title":"Encouraging divergent thinking in large language models through multi- agent debate","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.795421Z"},"links":{"cited_paper":"/paper/2305.19118","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:8e24d9698541e94020f5d7ee0951049f0d09b8cd9012bb793ff9af60daca354d","observation_id":"4571be96-ca5d-4144-b1a7-33dfc0fc0cdf","resolution":{"observed_at":"2026-08-16T11:33:02.795421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-16T11:33:02.799431Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.799431Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:eb0c3682fe37fc07f382c3f2489230ec5bbf77ba1bfb981fdfd2f7b7db8f6505","observation_id":"64661589-346e-4c86-8d84-2a2f8e53beb2","resolution":{"observed_at":"2026-08-16T11:33:02.799431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.803298Z","title":"Guardreasoner: Towards reasoning-based llm safeguards","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.803298Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:a2d95dbd339d460e8f65d1594a30d80bfe28794a28d05d8f3b958d7297927a28","observation_id":"9aa1b39d-60c0-4301-b0af-7cc46bbf4eb1","resolution":{"observed_at":"2026-08-16T11:33:02.803298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23077","last_updated":"2025-08-13T15:48:46Z","snapshot_observed_at":"2026-08-16T12:45:45.167493Z","submitted_at":"2025-03-29T13:27:46Z","title":"Efficient Inference for Large Reasoning Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23077","snapshot_observed_at":"2026-08-16T11:33:02.806889Z","title":"Efficient inference for large reasoning models: A survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.806889Z"},"links":{"cited_paper":"/paper/2503.23077","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:43eaa040dccbc29689e49150727c650d9a48ce3a734e58d423f5dfb744e6a5c5","observation_id":"859d95a9-85c4-4b88-9cb6-c21064ab8cea","resolution":{"observed_at":"2026-08-16T11:33:02.806889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02170","last_updated":"2024-11-15T04:30:04Z","snapshot_observed_at":"2026-08-07T04:49:42.215176Z","submitted_at":"2023-10-03T16:05:48Z","title":"A Dynamic LLM-Powered Agent Network for Task-Oriented Agent Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02170","snapshot_observed_at":"2026-08-16T11:33:02.810831Z","title":"Dynamic llm-agent net- work: An llm-agent collaboration framework with agent team optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.810831Z"},"links":{"cited_paper":"/paper/2310.02170","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:f451fbdd0af6ac84e5ec2cd6106f47d90ce9701ee8df1da3a83209362b2c4f90","observation_id":"bc67433c-a673-4b19-918f-21179d8a5d0e","resolution":{"observed_at":"2026-08-16T11:33:02.810831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.814822Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.814822Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:3b23d3246499b450af4533330d387a20aaea5c026f03677ddf8fd5082ba8f7e8","observation_id":"a73e0075-eb00-4604-a7cd-c1635c4f49cc","resolution":{"observed_at":"2026-08-16T11:33:02.814822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:03.859443Z","title":"Introducing chatgpt","venue":null,"work_id":"0c674326-cee6-417b-9355-8775896eabd9","year":2022},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.818303Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:e340729d1cc1987f262405395f476569dc1002d5519764d37ab8d18598def5b4","observation_id":"def952e7-9360-4358-938e-6ee339950b4d","resolution":{"observed_at":"2026-08-16T11:33:03.863201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.822178Z","title":"Learning to reason with llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.822178Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:69a45fbf3047f72070692eead5b3767dad9c8a3d8ba3d26961902a97f6dbcd9a","observation_id":"f97354c0-c452-42fd-aaba-ea38d6a6ef13","resolution":{"observed_at":"2026-08-16T11:33:02.822178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.825647Z","title":"Introducing deep research","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.825647Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:254f4049ac46fce91422aa3319df1cd8843c1d657d277667ca6af653e4d865c5","observation_id":"5768e77d-c2f5-4cd7-b7f7-aac023665b03","resolution":{"observed_at":"2026-08-16T11:33:02.825647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.829177Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.829177Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:7a600ef86ef317ceacd57a3f7a2321d762ae5e8ca5fdca13d21385c9334aa6cf","observation_id":"25276841-72a8-4459-8912-8825f6c5ffdd","resolution":{"observed_at":"2026-08-16T11:33:02.829177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.832689Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.832689Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:dc21c035aaa1b333d9d734fcff79db4574fc18486786538b086b78c3950d1d20","observation_id":"2b65f49d-f70d-4826-94d7-a9134b7a1708","resolution":{"observed_at":"2026-08-16T11:33:02.832689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-08-14T18:15:53.516440Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-16T11:33:02.836292Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.836292Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:610523b2445e3cc1f7116efe0bda0ed850fbffc7688c8525f0dc2d6a0e3d1054","observation_id":"8250f0dc-6800-40f0-9c80-818108c570a4","resolution":{"observed_at":"2026-08-16T11:33:02.836292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15254","last_updated":"2025-06-10T21:52:15Z","snapshot_observed_at":"2026-08-16T13:16:09.656675Z","submitted_at":"2024-09-23T17:53:42Z","title":"Archon: An Architecture Search Framework for Inference-Time Techniques","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15254","snapshot_observed_at":"2026-08-16T11:33:02.840034Z","title":"Archon: An architecture search framework for inference-time techniques","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.840034Z"},"links":{"cited_paper":"/paper/2409.15254","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:2325f213ce916e9433e6a9abe525d08a9263ca7afe42d2b847b01ddeb7d770be","observation_id":"bd0b24a9-3e7e-4d74-a1cd-8873193db485","resolution":{"observed_at":"2026-08-16T11:33:02.840034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06153","last_updated":"2025-02-27T13:33:55Z","snapshot_observed_at":"2026-08-16T13:11:26.802618Z","submitted_at":"2024-10-08T15:52:42Z","title":"AgentSquare: Automatic LLM Agent Search in Modular Design Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06153","snapshot_observed_at":"2026-08-16T11:33:02.843850Z","title":"Agentsquare: Automatic llm agent search in modular design space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.843850Z"},"links":{"cited_paper":"/paper/2410.06153","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:9c1d23e289268a24be4885fc7f57ffb71854cd82eb8a80a0ad1dd107fd627a83","observation_id":"f12c40db-e149-4d37-a2e4-abb881cc6914","resolution":{"observed_at":"2026-08-16T11:33:02.843850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:03.819145Z","title":"The claude 3 model family: Opus, sonnet, haiku","venue":null,"work_id":"668efc87-65af-4100-87a5-08b2b60dda48","year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.847783Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:0705c83805e124252a2d5d08612bc2bc1040a07851bb5a69875eecdee9c6c183","observation_id":"f7a4787e-f1cf-4d0a-bd09-ccce9493e203","resolution":{"observed_at":"2026-08-16T11:33:03.823368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T11:33:02.851468Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.851468Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:23e9fa7b60fe12c138628086c4662569e9bc724a6281c1b968281a8217089c6c","observation_id":"50801d10-ccd3-4db1-9db0-4b7a87f24784","resolution":{"observed_at":"2026-08-16T11:33:02.851468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-15T22:38:53.825110Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-16T11:33:02.854830Z","title":"Kimi k1.5: Scaling reinforcement learning with llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.854830Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:ba9d61e5f5eeb74e975a21ad5cbd8b98d0700370610859705ddce19f1f481cc6","observation_id":"fab7a91e-1915-4430-8dd8-00f81f511d7b","resolution":{"observed_at":"2026-08-16T11:33:02.854830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:03.805391Z","title":"Qvq: To see the world with wisdom","venue":null,"work_id":"01b443cf-5d59-450e-b470-c2ca40470bbf","year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.858456Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:8b133afeb2dd08618a8d5cbda901145bec3ab0a3d7b1a9aafc886c59301cab8e","observation_id":"9d859234-2fcc-4321-9420-c65881c939c5","resolution":{"observed_at":"2026-08-16T11:33:03.809696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:03.792866Z","title":"Qwq: Reflect deeply on the boundaries of the unknown","venue":null,"work_id":"248c0625-cd51-4e59-b2a4-42146b43088b","year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.861986Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:a4bf2a4eaa17e8d4bd2844f35915154bd11ad8f1cdc00c5d37c37cc5d5b4add7","observation_id":"50cf5a25-ce03-4f6d-aecd-381331186b5b","resolution":{"observed_at":"2026-08-16T11:33:03.797004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04091","last_updated":"2023-05-26T07:06:48Z","snapshot_observed_at":"2026-08-15T11:15:42.066340Z","submitted_at":"2023-05-06T16:34:37Z","title":"Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04091","snapshot_observed_at":"2026-08-16T11:33:02.865568Z","title":"Plan-and-solve prompting: Improving zero-shot chain-of-thought reasoning by large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.865568Z"},"links":{"cited_paper":"/paper/2305.04091","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:cb9a1e0a1606dab1c2b70bdfc27177058a182f2386b806ac302cdfb101276793","observation_id":"2a180205-0594-445e-b1bd-9bc3ed59fca9","resolution":{"observed_at":"2026-08-16T11:33:02.865568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04306","last_updated":"2025-02-06T18:47:49Z","snapshot_observed_at":"2026-08-14T21:16:48.876864Z","submitted_at":"2025-02-06T18:47:49Z","title":"ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04306","snapshot_observed_at":"2026-08-16T11:33:02.869499Z","title":"Scoreflow: Mastering llm agent workflows via score-based preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.869499Z"},"links":{"cited_paper":"/paper/2502.04306","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:2491eefbdcf868791c815a637c16fdc7d13d88cdaf789111f92eece99b4eb9bd","observation_id":"0a41fbf5-200c-4f0b-a399-205d9a46a1b9","resolution":{"observed_at":"2026-08-16T11:33:02.869499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.873528Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.873528Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:5ff49cdc4e8362c726e0a37de476b00cdeb273cb1dd11c4ef8ed482486a3313c","observation_id":"83cdc08a-00e6-4f8c-a44c-54f419efd299","resolution":{"observed_at":"2026-08-16T11:33:02.873528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-16T11:33:02.877372Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.877372Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:54b31c4935942e3b1abf5d6dec663500f7631e9ca3cad70f959a40c42b753e83","observation_id":"010ec3b8-bef6-4bad-acbb-dda3bdbb31a5","resolution":{"observed_at":"2026-08-16T11:33:02.877372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-16T11:33:02.881412Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.881412Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:bc71f2669832abc82fbfc22d7cdbb21fa3a7c8cd705ee4e6284873e3a7202394","observation_id":"c16616f6-8e6d-4feb-91fc-81ad27f91c81","resolution":{"observed_at":"2026-08-16T11:33:02.881412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03409","last_updated":"2024-04-15T07:50:32Z","snapshot_observed_at":"2026-08-15T09:21:11.223719Z","submitted_at":"2023-09-07T00:07:15Z","title":"Large Language Models as Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03409","snapshot_observed_at":"2026-08-16T11:33:02.885446Z","title":"Large language models as optimizers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.885446Z"},"links":{"cited_paper":"/paper/2309.03409","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:e6e1909aa482886228015301a3d81b20f48b8b75933a373e9cb154aab46f92e2","observation_id":"a9e61750-ab67-48b6-a4f8-847be4119f5f","resolution":{"observed_at":"2026-08-16T11:33:02.885446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14228","last_updated":"2025-03-10T02:42:01Z","snapshot_observed_at":"2026-08-16T13:41:08.794281Z","submitted_at":"2024-06-20T11:49:23Z","title":"EvoAgent: Towards Automatic Multi-Agent Generation via Evolutionary Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14228","snapshot_observed_at":"2026-08-16T11:33:02.889308Z","title":"Evoa- gent: Towards automatic multi-agent generation via evolutionary algorithms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.889308Z"},"links":{"cited_paper":"/paper/2406.14228","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:f1f90ca22916732b863a2ec4df7cd52923a76e0e485384f84b395a5674ca889b","observation_id":"5d2b30e3-8299-4198-a79e-c2a42622750a","resolution":{"observed_at":"2026-08-16T11:33:02.889308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07496","last_updated":"2024-06-11T17:32:21Z","snapshot_observed_at":"2026-08-13T02:15:58.634561Z","submitted_at":"2024-06-11T17:32:21Z","title":"TextGrad: Automatic \"Differentiation\" via Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07496","snapshot_observed_at":"2026-08-16T11:33:02.892788Z","title":"differentiation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.892788Z"},"links":{"cited_paper":"/paper/2406.07496","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:ff9c39fe30dfb63881949493fad7b1d1845094644a960af9ec490edc5d37c594","observation_id":"95f3911b-9627-40b1-b67a-53ef04be3f09","resolution":{"observed_at":"2026-08-16T11:33:02.892788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11782","last_updated":"2025-02-06T15:37:52Z","snapshot_observed_at":"2026-08-16T20:58:20.513341Z","submitted_at":"2024-10-15T17:01:21Z","title":"G-Designer: Architecting Multi-agent Communication Topologies via Graph Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11782","snapshot_observed_at":"2026-08-16T11:33:02.896957Z","title":"G-designer: Architecting multi-agent communication topologies via graph neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.896957Z"},"links":{"cited_paper":"/paper/2410.11782","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:86f1856cdbe972da2e1f5c4f48fdd68ad7a47635caf0c5da8543686d13fa2bbe","observation_id":"437003ba-baaa-4ea2-a019-d3c0a85ad6e9","resolution":{"observed_at":"2026-08-16T11:33:02.896957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04180","last_updated":"2025-06-09T05:15:47Z","snapshot_observed_at":"2026-08-17T21:29:37.125066Z","submitted_at":"2025-02-06T16:12:06Z","title":"Multi-agent Architecture Search via Agentic Supernet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04180","snapshot_observed_at":"2026-08-16T11:33:02.901949Z","title":"Multi-agent architecture search via agentic supernet","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.901949Z"},"links":{"cited_paper":"/paper/2502.04180","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:16cb0fc22ba4f0b174b79282cc25edb0a2deb0905daaa2171769986dc5a4acfe","observation_id":"56ab15bc-0b53-4bb6-9012-5f024c3d1533","resolution":{"observed_at":"2026-08-16T11:33:02.901949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10762","last_updated":"2025-04-15T02:44:55Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:40:40Z","title":"AFlow: Automating Agentic Workflow Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10762","snapshot_observed_at":"2026-08-16T11:33:02.906655Z","title":"Aflow: Automating agentic workflow generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.906655Z"},"links":{"cited_paper":"/paper/2410.10762","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:4fcfdb91414ec9928bb0ca3256055289d4ac1786db4636950fd2fe1e5e04560f","observation_id":"6a4f8aa4-20d9-41c2-be71-410efa1ebf2d","resolution":{"observed_at":"2026-08-16T11:33:02.906655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:03.773603Z","title":"Offline training of language model agents with functions as learnable weights","venue":null,"work_id":"fc3cf634-c48d-4980-b47b-339b608c388c","year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.910951Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:9aabaa78cba574e6395d386e0a5b53dc92d0be893911600a89112e4db2b1ff6d","observation_id":"5527c9fe-f56f-41ec-9eba-a8b30c832d99","resolution":{"observed_at":"2026-08-16T11:33:03.777385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-08-17T02:51:06.474773Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-16T11:33:02.914961Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.914961Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:ba85de2ca8dc129f0ce901a2186085321c5db25e3db4cefc05baad07ce597533","observation_id":"771ec4f1-d47b-4c06-a52d-9aa89862b343","resolution":{"observed_at":"2026-08-16T11:33:02.914961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:03.760514Z","title":"Self-discover: Large language models self-compose reasoning structures","venue":null,"work_id":"d1ec0645-bb35-4096-9ccd-abe4c5a67ed4","year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.919149Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:d729bc8275eb74ad9665f6693bec48dca376ec09aef586aa1ee186c39a551efa","observation_id":"ac190166-2c5b-4d9d-994c-c76f085a12c2","resolution":{"observed_at":"2026-08-16T11:33:03.766062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18532","last_updated":"2024-06-26T17:59:18Z","snapshot_observed_at":"2026-08-16T13:39:20.201392Z","submitted_at":"2024-06-26T17:59:18Z","title":"Symbolic Learning Enables Self-Evolving Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18532","snapshot_observed_at":"2026-08-16T11:33:02.922901Z","title":"Symbolic learning enables self-evolving agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.922901Z"},"links":{"cited_paper":"/paper/2406.18532","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:1916ff81891983828a40602a248126ab7bae5b9d885a3024356ca018294d5dc9","observation_id":"ef85d6aa-3eeb-4cc3-aee8-355bf9fef6a5","resolution":{"observed_at":"2026-08-16T11:33:02.922901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.926969Z","title":"Mindstorms in natural language-based societies of mind","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.926969Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:4f18882f66f9d0be7af91e541c99e822ee2c9df6971b160e021efd8ac11c9f7a","observation_id":"5086f990-42c7-45b8-b3dc-397c5cf773b3","resolution":{"observed_at":"2026-08-16T11:33:02.926969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:33:02.930955Z","title":"Gptswarm: Language agents as optimizable graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.930955Z"},"links":{"citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:a726c30725c57d9c3eb83fc9ade5b9f4377fb2afcc003f97f9eaabf5961fd9ad","observation_id":"1ab487e7-92c1-4de5-9da2-d23aa5999d34","resolution":{"observed_at":"2026-08-16T11:33:02.930955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-08-14T15:45:30.011625Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-16T11:33:02.934738Z","title":"{ p r o m p t _ c u s t o m . G R A P H _ G E N E R A T E _ P R O M P T }\\ n Pr obl em Ana ly si s : { p r o b l e m _ a n a l y s i s [ ’ re sp on se ’]}","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T11:33:02.934738Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2504.15257"},"observation_digest":"sha256:5156ed8f2bd199a4a825cd568d67ad0eb88a00d533df4dd317a0da14ded18474","observation_id":"1f501999-c2ae-485e-843c-b89881e7923a","resolution":{"observed_at":"2026-08-16T11:33:02.934738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.15257","last_updated":"2025-04-21T17:35:42Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T11:27:17.531953Z","submitted_at":"2025-04-21T17:35:42Z","title":"FlowReasoner: Reinforcing Query-Level Meta-Agents"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 22 inbound Pith citation observations for arXiv:2504.15257."}