{"as_of":"2026-08-09T15:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1fde4fb3061638ec6fd2b297b4e5ef82de88dc4303153163f80391b4b9a609e2","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:10:04.649930Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T21:54:13.090019Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T09:46:01.011609Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04518","snapshot_observed_at":"2026-07-12T21:54:13.090019Z","title":"Shishir G Patil, Huanzhi Mao, Fanjia Yan, Char- lie Cheng-Jie Ji, Vishnu Suresh, Ion Stoica, and Joseph E","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.11556","last_updated":"2026-06-18T16:56:08Z","snapshot_observed_at":"2026-08-05T05:03:09.113194Z","submitted_at":"2026-04-13T14:42:44Z","title":"FM-Agent: Scaling Formal Methods to Large Systems via LLM-Based Hoare-Style Reasoning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T21:54:13.090019Z"},"links":{"cited_paper":"/paper/2509.04518","citing_paper":"/paper/2604.11556"},"observation_digest":"sha256:78598ecb9918ecc04caf2d5dd84303581ffa093bfccc01e18fbc6d984c117f84","observation_id":"d9bff33a-e35d-4524-9579-123ad546bf1d","resolution":{"observed_at":"2026-07-12T21:54:13.090019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2509.04518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04518","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shishir G Patil, Huanzhi Mao, Fanjia Yan, Char- lie Cheng-Jie Ji, Vishnu Suresh, Ion Stoica, and Joseph E","venue":null,"work_id":"c715bdd2-1bf0-497d-9ea8-6dff55ce2f41","year":2025},"citing_paper":{"arxiv_id":"2604.11557","last_updated":"2026-05-25T09:56:37Z","snapshot_observed_at":"2026-08-08T03:59:49.160721Z","submitted_at":"2026-04-13T14:43:47Z","title":"UniToolCall: Unifying Tool-Use Representation, Data, and Evaluation for LLM Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:51:22.508030Z"},"links":{"cited_paper":"/paper/2509.04518","citing_paper":"/paper/2604.11557"},"observation_digest":"sha256:a8431305f258757a784c24bcf5cb6e43a0577ece72b812456450f652d1b60cee","observation_id":"2a4dd6d6-a61a-4d34-8ed9-cecbef6a54d1","resolution":{"observed_at":"2026-05-11T09:46:01.014476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.04518/citation-record","integrity":"/paper/2509.04518/integrity","json":"/paper/2509.04518/citation-record.json","paper":"/paper/2509.04518"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.969857Z","title":"xLAM: A Family of Large Action Models to Empower AI Agent Systems","venue":null,"work_id":"68f596eb-397a-42ff-8432-c195344beaea","year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:00.978776Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:7e5d007214f0d689598a09f09f8b491b9a73c8061314b1d8031788d743259036","observation_id":"5a739158-c700-47d6-b97c-2a8a6e6ee523","resolution":{"observed_at":"2026-08-05T11:10:05.975207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15790","last_updated":"2025-02-26T06:34:55Z","snapshot_observed_at":"2026-08-09T12:29:50.691670Z","submitted_at":"2024-09-24T06:36:56Z","title":"Small Language Models: Survey, Measurements, and Insights","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15790","snapshot_observed_at":"2026-08-05T11:10:01.164458Z","title":"Small Language Models: Survey, Measurements, and Insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:01.164458Z"},"links":{"cited_paper":"/paper/2409.15790","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:6c5a7f2438ab170598f68ba23075a330f3ac80ebd597d1e44d481b8f07037e2c","observation_id":"acdecbb0-7f67-498e-96ff-6bdf79cb8cb7","resolution":{"observed_at":"2026-08-05T11:10:01.164458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03350","last_updated":"2024-12-28T09:18:36Z","snapshot_observed_at":"2026-08-04T03:34:32.259687Z","submitted_at":"2024-11-04T04:43:01Z","title":"A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03350","snapshot_observed_at":"2026-08-05T11:10:01.491388Z","title":"A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:01.491388Z"},"links":{"cited_paper":"/paper/2411.03350","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:5dcb140c694049cb565f974f28fab9f96d40c47523a761b3a35431ad192c024e","observation_id":"d8591ed5-cdcf-4658-9f78-2a8da7684f8a","resolution":{"observed_at":"2026-08-05T11:10:01.491388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20011","last_updated":"2024-10-25T23:52:28Z","snapshot_observed_at":"2026-08-01T23:27:59.038399Z","submitted_at":"2024-10-25T23:52:28Z","title":"A Survey of Small Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20011","snapshot_observed_at":"2026-08-05T11:10:01.962412Z","title":"A Survey of Small Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:01.962412Z"},"links":{"cited_paper":"/paper/2410.20011","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:375ea19d8b89803fa60e8c894a56f1019167deac1b129da4d932c4dfaa306845","observation_id":"0d357488-fbff-48f6-8760-0e1d122f737d","resolution":{"observed_at":"2026-08-05T11:10:01.962412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:02.412340Z","title":"A Survey on Large Language Model Based Autonomous Agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:02.412340Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:c0284709b6676d0d2ee98627b0fde3b475d4f3318533bfd5e0d63895c4fd7444","observation_id":"314604c8-6f0a-4502-825b-62a61616c468","resolution":{"observed_at":"2026-08-05T11:10:02.412340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.953115Z","title":"Report on a General Problem-Solving Program,","venue":null,"work_id":"e41f9a96-cdba-4bd6-8564-45f81647e8e1","year":1959},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:02.945525Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:7cb015209612f9fb77ece67c8049b10cf973b224cb63799cd3af31eb74eea2c5","observation_id":"9d0408b0-35b3-4889-bd7b-9c50d71362c5","resolution":{"observed_at":"2026-08-05T11:10:05.958735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/367177","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:04.888768Z","title":"Recursive Functions of Symbolic Expressions and Their Computation by Machine, Part I,","venue":null,"work_id":"ef6f842e-1ae4-466a-85b5-74f7485ede55","year":1960},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.110076Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:ac489d2cd2b527bcba25641b14b42e904f46d0cee1d1c8170097688b2b74d39a","observation_id":"19602187-4f0b-43b8-8617-5db64f913ecd","resolution":{"observed_at":"2026-08-05T11:10:04.939574Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.937155Z","title":"Language Models are Unsupervised Multitask Learners,","venue":null,"work_id":"041048a3-715f-4f84-85f6-0beb0a04846f","year":2019},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.208256Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:e91d4d376f2bd6ca175c2a1df02375924bc3fd56d04e9bb7f2a098aac5b6132f","observation_id":"02c4f326-0cbf-45c8-938c-23847ffc2f9e","resolution":{"observed_at":"2026-08-05T11:10:05.942175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.12914","last_updated":"2019-12-30T13:08:12Z","snapshot_observed_at":"2026-07-06T08:47:37.114560Z","submitted_at":"2019-12-30T13:08:12Z","title":"'Alexa, Do You Know Anything?' The Impact of an Intelligent Assistant on Team Interactions and Creative Performance Under Time Scarcity","version":1},"cited_work":{"arxiv_id":"1912.12914","doi":"10.48550/arxiv.1912.12914","metadata_source":"pith","pith_arxiv_id":"1912.12914","snapshot_observed_at":"2026-08-05T12:16:14.913508Z","title":"'Alexa, Do You Know Anything?' The Impact of an Intelligent Assistant on Team Interactions and Creative Performance Under Time Scarcity","venue":"cs.HC","work_id":"cef49573-7fb1-42d0-969d-c8909deb592d","year":2019},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.295382Z"},"links":{"cited_paper":"/paper/1912.12914","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:956a7fee62ddf2b41aca36b715003eff0aab50c7ef035ad8a1886dc1c9473d64","observation_id":"a587a32d-68ca-43e2-bd58-4e71eeeb6eca","resolution":{"observed_at":"2026-08-05T11:10:04.877547Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:03.382282Z","title":"End-to- End Autonomous Driving: Challenges and Frontiers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.382282Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:dd84cf99934536c06528145c68718929520327b653c3fd8858cbecc7acd8cada","observation_id":"ed528a00-fba9-4f79-a27f-f7dfd58408f4","resolution":{"observed_at":"2026-08-05T11:10:03.382282Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01502","last_updated":"2024-07-01T17:48:14Z","snapshot_observed_at":"2026-08-06T22:15:08.500389Z","submitted_at":"2024-07-01T17:48:14Z","title":"AI Agents That Matter","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01502","snapshot_observed_at":"2026-08-05T11:10:03.458069Z","title":"AI Agents That Matter,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.458069Z"},"links":{"cited_paper":"/paper/2407.01502","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:8a2bb03bba5c932c25771410c21b2c918147949bb670ad66312e2453e4d2ce8e","observation_id":"b35464ff-239f-42da-98bb-40e31cecb7a8","resolution":{"observed_at":"2026-08-05T11:10:03.458069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.880426Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools,","venue":null,"work_id":"2487105d-c91b-4484-8e03-5138d1a97fa8","year":2023},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.567181Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:0efa5f1be5a87eef4d04be2e5cf865ef65bab77c4eb220de47d321939a2ab9de","observation_id":"b766be02-3661-4252-b449-f14034bf437b","resolution":{"observed_at":"2026-08-05T11:10:05.921779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.736326Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs,","venue":null,"work_id":"c0dbe5fe-fdc7-4b78-9191-4dc0ce48b90b","year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.642778Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:5aefbc0ed28f83f372484ce45cabf86f8d90a71634244326e031384b87012810","observation_id":"4ccdd332-9f88-4cd7-8a73-524320bf1074","resolution":{"observed_at":"2026-08-05T11:10:05.801284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.582818Z","title":"Training Language Models to Follow Instructions with Human Feedback,","venue":null,"work_id":"8c82586b-958d-4430-b744-d4ba67349db2","year":2022},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.751242Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:24b12f3a6a68283f294c7bf9aa21e6aea7770228b356ce0b7848205c97fb730c","observation_id":"03d53b38-d8a9-4db5-a503-f4de6e79841b","resolution":{"observed_at":"2026-08-05T11:10:05.645364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.459835Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models,","venue":null,"work_id":"44690bec-d60a-4bb8-9997-90abbec423e1","year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.843310Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:9e81be50c62222cd5ef96a298b816d9de72007cceeb34c52eb4794db0c0789d0","observation_id":"e4e28a8d-eeef-49f0-9ab0-e02b5a725ad6","resolution":{"observed_at":"2026-08-05T11:10:05.517883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T11:10:04.079194Z","title":"DeepSeek-R1: Incen- tivizing Reasoning Capability in LLMs via Reinforcement Learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.079194Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:098d2a28a3f8ae750edf46d1060aa361813ccab807e26f68bec4329c1278be94","observation_id":"ef53e933-8bd7-439b-86a5-6e4b5a864c74","resolution":{"observed_at":"2026-08-05T11:10:04.079194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T11:10:04.188526Z","title":"Proximal Policy Optimization Algorithms,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.188526Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:0cdf94ae60c98c1d1143557293adeb9c3b868f61a76d4574808a5b5c63e8b2c0","observation_id":"d523fb7a-35c5-448f-a7e1-2b1709459da8","resolution":{"observed_at":"2026-08-05T11:10:04.188526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.279791Z","title":"TinyAgent: Function Calling at the Edge,","venue":null,"work_id":"f53661e7-5ed9-4ce5-b225-54df207f5e3d","year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.304885Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:69bd0c8663529f271631f50f2894a606a8034d80d31583c7525b6a83edcd13c2","observation_id":"831b30e6-4e91-4df4-aca9-717956e41689","resolution":{"observed_at":"2026-08-05T11:10:05.333086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18890","last_updated":"2024-10-24T16:27:35Z","snapshot_observed_at":"2026-08-06T04:16:49.356443Z","submitted_at":"2024-10-24T16:27:35Z","title":"Improving Small-Scale Large Language Models Function Calling for Reasoning Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18890","snapshot_observed_at":"2026-08-05T11:10:04.397873Z","title":"Improving Small-Scale Large Language Models Function Calling for Reasoning Tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.397873Z"},"links":{"cited_paper":"/paper/2410.18890","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:00c231ba7e09c30664fb1f6c13491930760dc92026673243ff35a8f8937a9453","observation_id":"535412ba-ab79-4f6c-bc3f-16386e6dc8a0","resolution":{"observed_at":"2026-08-05T11:10:04.397873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T11:10:04.469320Z","title":"Qwen2.5 Technical Report,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.469320Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:72d4eeae803910cb71f4cbb0bf2084e2c3ec595529187abfaf1aa2105290ac7b","observation_id":"66a8bba0-6122-44f4-ad60-afb7355bb878","resolution":{"observed_at":"2026-08-05T11:10:04.469320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T11:10:04.649930Z","title":"LLaMA: Open and Efficient Foundation Lan- guage Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.649930Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:e60a3d7731fbf573a282b49fe497bc48f466a844ee1a43d95a8fb398df0ce465","observation_id":"957abe72-1b9f-4cc3-9c9b-aee939aa7add","resolution":{"observed_at":"2026-08-05T11:10:04.649930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T11:10:04.581497Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.581497Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:5175b63d39c1e425fa944cdc12bb8134a064c0854b03298dd91eb9e23e959b6e","observation_id":"f7d9ffda-4c03-4d16-84f1-3a92e51592c7","resolution":{"observed_at":"2026-08-05T11:10:04.581497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:05.406179Z","title":null,"venue":null,"work_id":"e4e86cc4-7989-4135-ab0e-46900b0d1405","year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:04.202015Z"},"links":{"citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:b6000b2ca2acd0adc377245be5e8aa24286ea53d123969600545f703383dddf8","observation_id":"6f424498-7f7b-437d-862b-b2486113aa2b","resolution":{"observed_at":"2026-08-05T11:10:05.411430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T11:10:03.953925Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:03.953925Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.04518"},"observation_digest":"sha256:abc54f2d6cd38bb52c274e7da0e60f9b6172414812faa717c88ecde1f99725f3","observation_id":"5a58ba46-ed0d-4905-b6b0-141cc59415d8","resolution":{"observed_at":"2026-08-05T11:10:03.953925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.04518","last_updated":"2025-09-08T19:46:21Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T03:59:34.445462Z","submitted_at":"2025-09-03T07:41:14Z","title":"Advancing SLM Tool-Use Capability using Reinforcement Learning"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":8},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 2 inbound Pith citation observations for arXiv:2509.04518."}